#开源生态
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源生态
今日 5 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条The DecoderAI 评分7171 NASA 与 IBM 发布开源月球基础模型,将 17 年轨道器数据转化为月球科学研究基础
NASA 与 IBM 联合发布 Lunar Foundation Model,这是首批用于月球科学的开源基础模型之一。模型基于 TerraMind 从头训练,使用了来自月球勘测轨道飞行器(LRO)17 年观测的近 200 万个图块,涵盖 11 种模态和两种空间尺度。
Reddit · r/LocalLLaMAAI 评分2020 不同推理引擎中 IQ3_S 模型表现差异:llama.cpp 可生成连贯答案
用户在"miracle engine"中运行 IQ3_S 模型让其评价帖子时,模型陷入 doom loop,10k tokens 后仍无法给出连贯答案。同一模型在 llama.cpp 中可以正常生成连贯回复。当前开源模型中仍缺乏有效减少谄媚(sycophancy)的方案。
Reddit · r/LocalLLaMAAI 评分1414 LocalLLaMA 用户分享本地 AI 服务器设置体验
用户将设置好的 AI 服务器关机后移至地下室的服务器机架,重新启动后在客户端应用发送测试消息,得到满意的回复。帖子获得较多关注但无具体模型或技术细节。
Reddit · r/artificialAI 评分1616 从 100KB 到 2.5TB:Reddit 用户梳理 AI 模型规模谱系与硬件成本
Reddit 用户 abhishekkumar333 整理了从 100KB TinyML 到 2.5TB MoE 巨模型的 AI 模型规模谱系,对应不同硬件需求与运行成本。
Reddit · r/LocalLLaMAAI 评分6464 B站发布 Index-Translate:基于 Qwen3.5 的多语言翻译模型家族
B站发布了 Index-Translate 多语言翻译模型家族,基于 Qwen3.5,支持150种语言的文本翻译、语音同声传译(Index-Echo)、音节控制翻译(Index-Homura)和长文档上下文翻译(Index-NativeLong),已在 GitHub 开源。
Product Hunt · AI 分类AI 评分5959 Aperture 发布开源 AI 代码编辑器
Aperture 是一款开源 AI 代码编辑器,其 Composer 功能会将变更计划为 diff 视图,在应用前进行多重检查:解析、导入解析、类型检查、预览渲染和测试运行。测试可在浏览器中免费运行。
Hacker News · 首页AI 评分4141 Thoreau BASIC:现代复兴的 BASIC 编程语言,支持 64 位、图形、网络和 UEFI 直启
Thoreau BASIC 3.2 发布,这是一款从 GW-BASIC 语法出发但支持 64 位内存、24 位图形、精灵图、鼠标输入、TCP/IP 和 HTTP 网络的现代 BASIC 方言。
Reddit · r/artificial精选AI 评分7979 AI 智能体获得邮件功能后,首先互相提交缺陷报告
AIPass 是一个开源多智能体协作框架,构建了 7 个月,拥有 18 个智能体、21000 多测试、280+ GitHub 星标。其核心设计是为每个智能体分配独立目录和身份,通过邮件系统(email 和 dispatch)实现智能体间的通信协调。
推荐理由:原文呈现了一种通过通信机制而非单纯提升推理能力来实现多智能体协作的设计思路,读者可以据此思考自己系统的协调架构。
Reddit · r/LocalLLaMAAI 评分3737 Strata Qwen 3.8 flash next 是自 Qwen 3.8 27b 发布以来最重要的更新
Strata Qwen 3.8 flash next 让低显存用户能以较高速度运行 Flash Next 作为主力模型。实测速度达到 80-110 tok/s(2500 pp),与 qwen 3.5-35-a3b 速度相当,但智能水平超过 Qwen 3.8 27b,可在双 RTX 3090(96GB DDR5)上运行。
Hacker News · 首页AI 评分6969 Jeffy:可在 CPU 上运行的本地预训练文本分类器
某项目发布了可在 CPU 上运行的本地预训练文本分类器工具,包含 13 个预训练分类器,支持自定义训练,提供 Python API 和 HTTP 服务。首次推理需下载约 1.2 GB 的编码器模型,推理延迟约 50-80 ms。
Reddit · r/LocalLLaMAAI 评分2828 Arex-2 vs Swift vs Qwen3.8 27b
Reddit 用户推荐 Arex-2 为其用过最好的 agentic coding 微调模型,未提供 benchmark 数据,仅建议用户自行下载测试比较三款模型的实际表现。
Reddit · r/LocalLLaMAAI 评分5050 如何在 16GB RTX 3080 笔记本上运行 Qwen3.8 Flash Next 176B
利用 TensorSharp 推理引擎通过量化 + MoE 感知的跨内存层次统一调度(VRAM、RAM、SSD),在配备 16GB VRAM 的 RTX 3080 笔记本上成功运行 176B MoE 大语言模型。
Hacker News · 首页精选AI 评分7777 Cloudflare 发布 Artifacts 新功能并发起下一代 Git 平台竞赛
Cloudflare 推出 Artifacts 新功能,包括可部署到 Workers、可从 Workers 管理、事件订阅、数据司法管辖和指标监控,并发起竞赛邀请开发者构建面向 AI 智能体时代的下一代 Git 平台。竞赛截止到 2026 年 10 月 14 日,一等奖可获 2.5 万美元 Cloudflare 积分。
推荐理由:原文列出了 5 个新能力和竞赛细节,读者可以据此判断这个面向 AI 智能体的 Git 基础设施是否值得尝试参与。
Hacker News · 首页AI 评分1515 Kolibri Tech Report
本报告详细内容未在摘要中提供。该页面仅显示 Hacker News 热度数据(94 points, 4 comments),无法提取具体技术内容。建议直接访问 PDF 原文获取完整信息。
Reddit · r/LocalLLaMAAI 评分2121 用户用 3 张 RTX 3060 12GB 搭建 "Flash Next" 推理卡:速度达 38-40 t/s
Reddit 用户在 r/LocalLLaMA 分享使用 3 张 RTX 3060 12GB 显卡运行 Flash Next 框架的测试结果,在 IQ3 模型上达到 38-40 t/s 推理速度,同条件 llama.cpp 仅能实现 13.2 t/s。
Reddit · r/LocalLLaMAAI 评分5454 Sopro V2 Turbo 2610 发布:改善克隆语音质量,保持120M模型和CPU速度
Sopro V2 Turbo 2610 发布,主要改进是减少部分克隆语音的粗糙感和破音问题。保持120M参数模型和约300ms的首音频延迟(笔记本CPU)。支持英语、欧洲葡萄牙语、法语、德语,后续计划支持更多语言和更精细的语音控制。仍难以处理高亢卡通嗓音、嘈杂参考音频和一些异常语音。如需帮助可联系作者提交失败样本。
Reddit · r/artificialAI 评分4646 Oscilloscope Diffusion 发布:基于扩散模型的音频响应几何视频编辑工具
Oscilloscope Diffusion 是一种通过扩散模型干预现有视频的新方法,以音频响应几何体的运动和形式为起点,重新诠释纹理、材质和视觉语言。用户可选择视频源、描述处理方式,并通过提示词、LoRAs 和可编辑时间轴控制结果与原始素材的接近程度。该工具已上线 Uisato Studio,即将开源。
Reddit · r/LocalLLaMAAI 评分6363 用本地 LLM 玩魔兽世界:开源项目展示
作者搭建了一个魔兽世界私人服务器,并编写了浏览器客户端和 MCP Agent 工具,可通过 WebSocket 用 LLM 控制角色玩游戏。项目支持本地模型连接,24GB 内存可运行 Qwen3.8-27B-GPTQ-W4A16,16GB 内存推荐用 vLLM 加载自定义的 Gemma4-e4b-coder(约 200 tok/s)。
Reddit · r/LocalLLaMAAI 评分6060 开源引擎 Kyojin 发布:在 128GB AMD Strix Halo 迷你 PC 上运行 300B MoE 模型
作者在 AMD Strix Halo(128GB)上基于 ExLlamaV3 构建了 Kyojin 引擎,成功运行两个约 300B 的 MoE 模型。
The DecoderAI 评分6868 Meta 推出 Muse Gadgets 开源项目,让爱好者可自行构建 AI 硬件
Meta 发布 Muse Gadgets 开源项目,包含 ESP32 板的固件和 Linux SDK,可将自制设备连接到 Meta 的 AI 智能体 Muse,代码采用 Apache 2.0 许可并有 Discord 社区。
Reddit · r/LocalLLaMAAI 评分3737 Strata 发布 MoE 缓存方案,性能超越 llama.cpp 5-10 倍
Strata 用约两周时间实现了 MoE 缓存优化,带来 5-10x prefill 和 3-4x decode 性能提升。方案基于 Qwen-3.8-flash-next 模型,在 8-16gb 显卡 + 64gb 内存配置下达 2000/70 t/s+ 速度,比 27b 模型更快。
Hacker News · 首页精选AI 评分7676 Aleph Alpha 发布 Kolibri 主权开放权重模型
Aleph Alpha 发布 Kolibri,这是一款英德双语混合专家 Transformer 模型,总参数 78B、活跃参数 3B,支持最长 100 万 token 上下文。模型已在 Hugging Face 开源,可下载权重使用。该模型专为德国公共管理、工业和航空航天等受监管行业的主权任务构建,在数学、代码、Agent 能力等方面可匹配参数多至 4 倍的竞品。
推荐理由:原文给出了模型的关键参数、性能基准和与竞品的对比数据,读者可以据此评估其在特定行业的适用性。
Hacker News · 首页精选AI 评分8282 Aleph Alpha 发布开放权重模型 Kolibri,支持德语和英语
德国 AI 公司 Aleph Alpha 发布开放权重大语言模型 Kolibri,总参数 78B、激活参数约 3.5B,采用混合专家架构,基于 Apache 2.0 许可证开源。
推荐理由:提供了模型的技术架构、性能数据、对比基准和可用入口,读者可以据此判断这个模型在德语场景和本地部署需求下的适用性。
Reddit · r/LocalLLaMAAI 评分5959 Anyworld:本地大语言模型驱动的自托管多人文字RPG
Anyworld 是一款浏览器端多人(也支持单人)文字冒险游戏,由本地大语言模型担任 DM。玩家通过链接加入游戏,模型解析多人行动并生成故事。游戏支持真实骰子roll点、私密 DM 指导、隐藏触发器、上下文记忆管理和非英语语言(通过 OpenAI 后端)。推荐使用 Gemma 4-26B Q4 模型配合 llama.cpp 运行。项目已开源,采用 MIT 许可证。
Reddit · r/LocalLLaMAAI 评分5555 Aleph-Alpha 发布 Kolibri-1 模型:78B 参数、3.46B active、1M 上下文、Apache 2.0
Aleph-Alpha 在 Hugging Face 上发布 Kolibri-1 模型,总参数 78B,active 参数 3.46B,支持最高 1M tokens 上下文,采用 Apache 2.0 开源许可证。
Reddit · r/LocalLLaMAAI 评分4242 Hugging Face 多 harness RL 训练终极指南
Hugging Face post-training 团队发布指南,介绍如何使用 TRL 和 Harbor 框架在不同编程 harness 环境中训练开源模型。指南针对 Pi 等自定义 harness 提供性能优化方案,适用于各类开源模型。
Reddit · r/LocalLLaMAAI 评分5252 ninfer vs llama.cpp 在 RTX 5090 上运行 Qwen3 27B 的性能与质量对比评测
在 RTX 5090 上测试 Qwen3 27B 运行 ninfer 和 llama.cpp 的性能,结果显示 ninfer 比 llama.cpp 快约 2.3 倍,但 llama.cpp 开启 MTP 后速度从 68 t/s 提升至 141 t/s,接近 ninfer 水平。
Latent SpaceAI 评分1919 Latent Space AINews 2026年10月1-2日:AI领域动态汇总
OpenAI发布GPT-6.1 Sol,定价每百万token输入2美元、输出10美元,比Astra便宜81%,在DeepSWE v1.1上比GPT-6 Sol高6.4分。Sonnet 5.5首次亮相即进入Agent Arena前三,在Chat类别排名第一。Anthropic模型目前占据Agent Arena前三名。
Reddit · r/LocalLLaMAAI 评分4949 <think>让我分析这篇原文:
1. **来源**:Reddit · r/LocalLLaMA 2. **原始标题**:gufo_windows pre-package for Strix Halo users 3. **正文内容**。
Reddit · r/artificialAI 评分2323 AI模型何时会达到进步瓶颈?
有观点认为AI模型依赖互联网数据和用户对话反馈训练,当这些数据耗尽时,模型可能只能实现微小到难以察觉的提升。这一看法忽略了合成数据、合成知识及后训练阶段的持续改进空间。当前社区正在讨论数据枯竭是否会成为AI能力发展的根本限制。
Reddit · r/ChatGPTAI 评分3535 我用 GPT images 为 Airship roguelite 制作了 600+ 艺术资产
开发者使用 GPT images 生成了其 Airship roguelite 游戏的全部 600+ 艺术资产,还制作了"后台"环境和角色表。开发者表示 GPT images 已成为其创作的主要支柱。该游戏计划在两周后发布于 Steam 平台。
Reddit · r/LocalLLaMAAI 评分5959 LiquidAI 发布 LFM2.5-Encoder 250M/350M 多语言双向编码器
LiquidAI 发布 LFM2.5-Encoder 350M 多语言双向编码器,基于 LFM2 架构,支持 15 种语言,可用于分类、标记、检索、重排序和语义相似度任务。上下文窗口 8k,支持 CPU 长上下文和 WebGPU 浏览器运行。在 NLI、释义、情感和多语言任务上表现强劲,推理速度与 ModernBERT 相当或更快。
Product Hunt · AI 分类AI 评分4747 Meta 发布 Muse Gadgets 开源硬件工具包
Meta 发布 Muse Gadgets 开源硬件工具包,将 AI 助手 Muse 带入物理世界。支持连接 ESP32、Raspberry Pi 或 Linux 设备至显示器、麦克风、扬声器、按钮、传感器等硬件,可构建口袋 AI 伴侣、电子墨水简报显示器、智能家居控制器等产品。SDK 和固件基于 Apache 2.0 开源许可。
Product Hunt · AI 分类AI 评分4949 bmux:免费开源分屏浏览器,AI 智能体可通过 CLI 后台运行
bmux 是一款免费开源的分屏浏览器,支持命名会话和独立配置文件。内置键盘快捷键操作,AI 智能体可在后台 CLI 会话中工作,用户可随时附加查看智能体的工作进展。
Reddit · r/LocalLLaMAAI 评分5353 mlsubgen:本地运行的45语言视频字幕工具
mlsubgen 是一款本地运行的字幕生成工具,支持45种语言。其技术特点包括:按语音段检测语言以支持混合语言内容;运行两个语音识别器并用本地大语言模型融合结果;优先使用已有的嵌入式字幕轨道(包括 Blu-ray PGS 轨的 OCR),无字幕时才分析音频。在 24GB RTX A5000 上处理速度约等于目标语言的实时时长,需要 16-32 GB 系统内存和 30-65 GB 模型存储。
Reddit · r/LocalLLaMAAI 评分2828 Strata + Qwen3.8 Next 在中端 GPU 上的本地运行体验
用户在 DDR4 + 7900XTX 配置下运行 Strata + Qwen3.8 Next 的 IQ3_XXS 权重(约 80GB),推理速度稳定在 45-70 token/s,12GB 和 16GB 显卡用户也获得类似结果。对比同设备的 Llama CPP 调优版最高 22.5 token/s,Strata 速度提升约 2-3 倍,用户反馈质量更优但不推荐 Q2 权重。
TechCrunch · AIAI 评分6464 Meta 推出 Muse Gadgets 开源项目,允许开发者构建自定义硬件连接 Muse
Meta 发布了 Muse Gadgets 开源项目,提供开源固件、Linux SDK 和项目 ideas,让开发者可将 Muse 连接到 Raspberry Pi、ESP32 等设备上,创建自定义硬件如彩色墨水屏或 HDMI 电视棒。
Hacker News · 首页AI 评分5252 在 M4 Mac mini 上启动 Linux 的历程
作者记录了在 M4 Mac mini 上成功启动 Linux 的完整过程。M4 是首款强制启用 SPTM 的 Apple Silicon 芯片,作者依次解决了 GXF 功能锁定、MMU 初始化时的 MMIO 映射、CPU 寄存器访问权限、以及 WFI 指令导致寄存器状态丢失等问题。
Hacker News · 首页AI 评分1919 Debian 推理门户
Debian 推出推理门户,为 Debian 贡献者提供 LLM 推理服务的自助门户。贡献者可通过该门户管理 API keys 并追踪预算消耗,目前仅向 Debian Developers 和 Debian Maintainers 开放访问。
Reddit · r/artificialAI 评分3333 小型语言模型为何被低估?是否是有意为之?
多数企业认为前沿大模型成本效益不佳,但仍不愿采用小型语言模型策略。作者用一年多前构建的机器测试 DeepSeek R1,发现其性能出色且工作稳定。金融科技行业客户对小而安全的本地模型仍持谨慎态度。