跳到正文

#部署/工程

今日 5 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
今天10月8日周四
10月7日周三
10月6日周二
  1. Reddit · r/LocalLLaMA31

    腾讯开源 Octop:本地自托管多智能体 AI 助手

    腾讯开源 Octop,一款完全自托管的多智能体 AI 助手,提供 Web 控制台、CLI 与 IM 集成,单进程启动即可使用。它支持桌面客户端(Windows / macOS / Linux 及 FnOS NAS 包)和 Docker 部署,通过多智能体架构为团队、家庭和个人构建独立且协作的智能环境,所有数据完全运行在用户本地机器上。

  2. Reddit · r/LocalLLaMA24

    PewDiePie 微调本地模型 Ajax 两次被 OpenAI 封号

    PewDiePie 在自家电脑上微调一个 9B 本地模型 Ajax 时,因用 OpenAI API 输出来构建数据集,两次违反使用条款被封号、申诉解封后又立即再被封。他随后转向开源工具移除模型内置拒答与说教式回复,继续推进完全本地化的 9B agent 构建。该事件借 PewDiePie 的影响力,为开源模型带来了一次面向数百万观众的免费宣传。

10月5日周一
  1. Hacker News · 首页28

    Homa:终结 AI 集群的 TCP 时代

    论文 Homa 提出面向 AI 集群的新型网络传输协议,目标取代该场景长期使用的 TCP。AI 训练与推理集群对低延迟、高吞吐的需求与 TCP 机制存在错配,Homa 通过定制传输层设计回应这一挑战。该工作已在 Hacker News 引发讨论,目前尚未公布具体性能数据与开源安排。

  2. Reddit · r/LocalLLaMA21

    LLM Inference Dashboard:本地 LLM 推理资源监控工具

    开发者正在构建一个轻量级(64mb)的本地 LLM 推理资源仪表板,支持 llama、strata、custom cuda engines、unsloth、LMS 等多种推理引擎,提供比默认 API 端点更丰富的日志和指标。该工具通过 collector 扩展网络 API 端点,目前尚未公开发布,作者在 Reddit 社区调研潜在用户兴趣。

10月4日周日
  1. Reddit · r/ChatGPT45

    ChatGPT 停止转录音频

    付费版 ChatGPT 用户反馈语音转录功能此前效果良好,但本周突然无法使用,ChatGPT 拒绝转录且未给出解释。官方建议的替代方案是使用 TurboScribe 生成 SRT 格式后再发送,但需将音频剪至 30 分钟以内,且每天仅支持 3 次。用户询问是否应转用 Gemini 等其他 AI 程序。

  2. Hacker News · 首页72

    Vx:统一异构计算的系统编程语言

    Vx 是一种面向异构计算的系统编程语言,将 CPU、GPU、NPU 和加速器内存纳入类型系统,在编译期防止数据放置错误、越界访问和内存溢出。该语言支持 H100、H200、B200、A100、MI300X、Apple M4 等硬件,编译结果可输出至 CPU、GPU 和 Apple AMX/ANE 后端,并提供机器描述文件以精确管理内存层次结构和带宽。