跳到正文

#开源生态

今日 7 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
10月1日周四
  1. Reddit · r/LocalLLaMA80

    Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB

    作者发布 Jeff-Qwen3.5-0.8B,这是一款小型“System 1”模型,可在一轮前向传播中从给定选项中做出选择并返回校准概率。作者为其训练了 9 个 LoRA 适配器,分别处理 prompt 注入检测、工具选择、票据优先级排序、答案溯源等常见决策任务。

    推荐理由:原文给出了具体的性能对比数据和开源资源,读者可以据此判断这种“小模型+LoRA适配器前置”的架构是否适合自己本地部署的场景。

  2. Hugging Face Blog61

    AllenAI 发布 Olmo-core 3:面向大规模 MoE 的开源可扩展训练基础设施

    AllenAI 发布 Olmo-core 3 训练框架,支持将专家池从 8 扩展到 128 而每 token 仅激活 4 个专家,总参数量从 4.6B 增至 47B,训练吞吐量仅下降不到 5%。在 8 个 NVIDIA B300 GPU 上,47B MoE 达 52,000 tokens/s/GPU,约为此前实现的 2.7 倍。系统已测试至 1.2 万亿参数规模。

    推荐理由:原文给出了专家池扩展、吞吐量提升和参数规模的具体数字,读者可以据此判断这套训练基础设施对大模型研究的具体价值。

  3. Reddit · r/LocalLLaMA14

    寻找 Claude Cowork 的开源替代品

    用户在 Reddit 询问 Claude Cowork 的开源替代品,需要项目/文档集成(Notion、Gmail 等)、网页搜索、PDF 创建等功能。通过自托管服务器运行 LLM,需支持连接 Ollama、Ninfer 等推理服务。目前发现 Eigent 工具但缺乏实际评测。

  4. Reddit · r/LocalLLaMA67

    DeepSeek harness 0.2 发布:可选Bundle架构、Windows沙盒改进、异步问答模式

    DeepSeek harness 发布 0.2 版本,主要更新包括:将定时提醒功能拆分为可选Bundle;Windows沙盒新增权限诊断和恢复技能;异步问答模式允许 Agent 在用户未及时响应时继续工作;模型层支持无需 API 密钥使用 Web Search,第三方模型目录更新并支持模糊搜索和键盘导航;官方 Windows 和 macOS 客户端发布。

  5. Product Hunt · AI 分类35

    Twin:开源本地 AI 助手

    Twin 是一款免费开源的 Mac 桌面浮窗 AI 助手,可查看短信、记住日程、语音回复,并在用户遗忘前发送提醒。数据完全本地存储在 DuckDB 文件中,支持用户自行接入 Claude、GPT、Gemini 或 Grok API 密钥,无云端、无需注册账户。

  6. Reddit · r/LocalLLaMA37

    Strata 如何配置采样参数

    用户可通过在 Strata 配置文件(如 strata-iq3_s.json)中添加 "sampling" 块来设置采样参数,支持 temperature: 1.0、top_p: 0.95、top_k: 20。请求自带的采样字段优先级高于配置文件默认值,完全未配置时默认使用 greedy 解码。该配置说明位于 docs/DETAILS.md。

  7. Reddit · r/LocalLLaMA43

    ASTRABOX - 开源街机游戏生成器

    ASTRABOX 是一款街机游戏生成器,用户描述游戏需求后 AI 自动构建,每个游戏拥有独立视觉和玩法,支持边玩边用语音要求修改。系统基于 Codex 构建共享运行时处理控制器、分数、玩家加入等通用功能,代码完全开源,可作为本地 Web 应用运行。项目仍处于实验阶段,欢迎开发者定制并探索适配本地编码模型和本地 STT/TTS。

  8. Hacker News · 首页21

    Show HN: Strata – 可对 LLM 说"不"的表达性语义层

    Strata 是 Netflix 内部孵化的商业智能平台,定位为 AI 时代的高性能语义层,支持 15 分钟本地部署(Docker + 自有编码智能体),提供治理语义层、自助仪表板、实时数据智能体和联邦开放 OLAP 引擎。某全球娱乐公司客服部门使用 Strata 后,800 名非技术用户自助分析从每周 5 次增至 100+ 次,临时数据请求下降 90%,合作伙伴入职仅需 10 分钟。

  9. Reddit · r/ChatGPT25

    【实验】从 Blender 草图到现场表演

    作者利用 GPT Astra 辅助,在 Blender 中设计舞台块面草图,并结合身份、动作和视觉参考,通过 Uisato Studio 将静态设计转化为现场表演。 Realtime Audioreactive Pointclouds v1.7 已通过 Patreon 和 Store 发布,为现场演出提供实时音频响应视觉效果。

  10. Reddit · r/LocalLLaMA15

    Yandex/AliceAI 80B-A3B 微调进展更新

    独立开发者正在微调 Yandex/AliceAI 80B-A3B 模型,初始微调已完成约 40%。训练过程有直播可查看全部训练数据,开发者同时使用 gemini 3.8 flash 辅助微调。该数据集包含约 3.5k 样本,由 sftmill 生成,未来计划公开分享。

9月30日周三
  1. Hugging Face Blog70

    Hugging Face 发布 Open TTS Leaderboard:开源多语言 TTS 与语音克隆的可扩展评估

    Hugging Face 发布 Open TTS Leaderboard,使用客观指标(WER/CER 可理解性、RTFx 推理速度、TTFA 首音频延迟、SIM 说话人相似度)评估开源 TTS 模型,解决 arena 方式无法跟上模型发布速度的问题。

    推荐理由:给出了具体的评估指标和部分模型排名,读者可以直接查看 leaderboard 了解各开源 TTS 模型的可理解性和速度表现。

  2. Product Hunt · AI 分类49

    SelfJev 开源 4B 决策模型

    SelfJev 是一个开源的 4B 参数决策模型,支持自托管。可针对任意文本提出类型化问题(yes/no、pick one、pick any、score),返回校准概率。通过两个环境变量将 TypeSafe SDK 指向服务器即可使用,也可在自有数据上进行微调。

  3. Reddit · r/MachineLearning71

    免费开源 AI 工程课程:手把手实现每个算法,已发布 EPUB/PDF 书籍

    AI Engineering from Scratch 是 MIT 许可的课程,共 523 节课分为 20 个阶段,涵盖线性代数、反向传播、Transformer、LLM、智能体和生产部署等内容。代码采用 stdlib 优先方式展示每一步实现。本月更新发布了 6 卷 EPUB 和 PDF 书籍,支持 8 种语言,并修复了测试和数据集问题。

  4. Simon Willison18

    OpenAI DevDay 2026 实时博客报道

    Simon Willison 于 9月29日在旧金山 Fort Mason 现场报道 OpenAI DevDay 2026。他今年用 vibe-coding 方式构建了一个博客照片上传系统,原计划使用 Codex Cloud(途中在手机上开发),但遇到问题后改用 Claude Code 完成网页端开发。OpenAI 为其提供了免费门票及主题演讲"创作者"区域座位。

  5. Reddit · r/artificial19

    为什么中国 AI 实验室如此专注于开源模型?

    有观点认为,中国实验室更愿意发布开源权重模型,可能是因为它们认为模型权重并非 AI 竞赛的真正护城河,真正的护城河可能是专门的训练数据或评估体系。该讨论还指出,部分专家训练数据来源于美国公司(如 Mercor/SurgeAI),并推测这可能反映了中美 AI 实验室在模型开放策略上的文化差异。

  6. Hacker News · 首页56

    ESP32S3 集群运行 1.58-bit BitNet 语言模型

    开源项目 ESP32s3-LLM-Cluster 在 7 个 ESP32S3 开发板上分布式运行切片的 0.5B LLM,其中 1 个 master 节点负责 tokenizer 和 embedding,6 个计算节点通过高速 SPI Daisy-Chain 通信执行 attention 层和 MLP,模型采用 1.58-bit BitNet 量化技术。