#开源生态
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源生态
今日 5 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/LocalLLaMAAI 评分1111 当前有哪些开源权重模型能处理反编译/重编译项目
用户在 r/LocalLLaMA 询问是否已有任何开源权重模型能处理反编译与重编译类项目。Opus5.5、Sol6.1、Fable、Astra 等闭源模型已证明可行,相关生态近一周爆发。
Reddit · r/LocalLLaMAAI 评分3636 中国 AI 实验室的开放策略分化:头部闭源、追赶者开源
在北京和上海走访中国 AI 实验室后,文章梳理了主要厂商的模型开放策略分化。ByteDance 旗下的豆包(Doubao)作为唯一保持旗舰模型闭源的大厂,凭借已拥有的 300 million 用户级 ChatGPT 式超级应用分发渠道而选择闭源。
TechCrunch · AIAI 评分5858 Nous Research 确认 15 亿美元估值,并推出面向企业用户的 Hermes AI 智能体
Nous Research 宣布完成 9 亿美元 B 轮融资,估值达 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 和 1789 Capital 参投,三年累计融资 1.58 亿美元。
Reddit · r/MachineLearningAI 评分2121 用户将 56 亿条 TikTok 视频元数据上传至 Hugging Face,覆盖 2014 年至 2026 年 10 月
一名用户将覆盖 2014 年至 2026 年 10 月、共 56 亿条 TikTok 视频元数据上传至 Hugging Face。数据集同时提供基于 ClickHouse 的在线查询接口,包含创作者表 45 亿行、视频表 56 亿行和音频表 6.33 亿行。用户表示该数据库为自托管,呼吁查询者避免高负载请求。
Reddit · r/LocalLLaMAAI 评分3737 Liquid AI 发布 Open d1:面向决策任务的开源权重多模态模型
Liquid AI 发布开源权重决策模型 Open d1,包含 3B 参数的 d1-3B(文本+视觉)和实验性的 600M 参数 d1-omni-600M(文本+图像/音频)。
Latent SpaceAI 评分4848 Stacklok Mecatl:基于 Kubernetes 的云原生 AI 智能体 harness
Kubernetes 创始团队创立的 Stacklok 开源了云原生智能体 harness Mecatl,旨在将 agent loop、工具调用、会话状态与执行环境解耦,解决桌面端 harness 难管理的问题。该项目已以 GitHub 开源项目形式自 6 月起开发,被定位为面向企业的云原生基础设施,意在降低对 Codex、Claude Code 等前端模型厂商的依赖。
Reddit · r/LocalLLaMAAI 评分2727 EmbeddingGemma 2 的图像-文本检索借助 ruNNtime WebGPU 推理库实现浏览器端运行
EmbeddingGemma 2 将图像和文本映射到同一个 768 维向量空间,支持以文字描述检索图片。开发者将其文本塔与视觉塔移植到 TypeScript 写的 WebGPU 推理库 ruNNtime,并在浏览器中用本地 GPU 完成完整检索流程,原始数据无需上传服务器。ruNNtime 同时兼容多种类视觉模型,可在交互式文档里直接体验。
Hacker News · 首页AI 评分2525 开源社区用 Rust 干净室重写 Adobe Photoshop / Lightroom / Premiere Pro
Hacker News 首页列出多个用 Rust 干净室重写的 Adobe 替代品,包括开源 Photoshop(9.8k star)、Lightroom(1.6k star)和 Premiere Pro(2k star)。这些项目分别提供后端与 Web 前端实现,面向艺术家、设计师和影视创作者。同帖还介绍了 ArtCraft 这款面向创意工作者的"刻意创作引擎"。
Hacker News · 首页AI 评分3737 NanoMuse:跨手机与电脑的开源个人 AI 智能体
NanoMuse 是一款开源个人 AI 智能体,最新版本为 0.1.40 Clear,支持 Android、iOS、macOS、Windows 和 Linux,可在手机、电脑与自托管服务器上运行并共享同一账号。
Reddit · r/LocalLLaMAAI 评分1515 ik_llama.cpp 在多 GPU 层拆分混合推理中为何反而慢于主线 llama.cpp
用户在 4 张异构 GPU(3 张 P102-100 + 1 张 RTX 3060 12GB)混合卸载 Qwen 3.8 Flash-Next 177B(IQ3_XXS)并配合 AVX-512 CPU 跑 32k 上下文时。
Hacker News · 首页AI 评分5050 Vibecoding Photoshop 替代品盘点:四款 AI 智能体驱动的 Photoshop 克隆工具评测
文章盘点了四款 Vibecoding 产生的 Photoshop 替代工具,Photon Studio(闭源免费,支持本地 AI 模型与智能体调用)、PhotoCraft(纯 Rust 编写的开源 clean-room 重写)。
Reddit · r/LocalLLaMAAI 评分2020 开发者展示 ~960M 参数本地 AI 世界模型,可在消费级显卡上实时将图像转为可操控角色
独立开发者 lucidml_lover 发布其本地 AI 世界模型第二版,参数约 960M,采用纯 Transformer 架构配合扩散强制(diffusion forcing)训练,推理时每帧进行 2-5 步扩散并加入 KV cache,配合滑动窗口保留最近 80 帧上下文。
Hacker News · 首页AI 评分5252 Google DeepMind 发布开源端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议,参数 740M,面向文本、图像、音频、视频的统一多模态嵌入。
The DecoderAI 评分5151 Google 发布开源多模态嵌入模型 EmbeddingGemma 2,主打端侧运行
Google 发布开源多模态嵌入模型 EmbeddingGemma 2,参数量为 740M,可将文本、图像、视频、音频和代码转为向量。Google 称在多模态嵌入基准上它优于尺寸达其两倍的竞品,是同档中最紧凑的模型;在 Massive Text Embedding Benchmark (Code) 上得分 78.68,比前代提升近 10 分。
Reddit · r/LocalLLaMAAI 评分1515 Hugging Face 工程师分享 llama.cpp 本地 AI 生态技术演讲
Hugging Face 工程师 Merve 在一场开发者大会上分享了关于 llama.cpp 的演讲内容,涵盖 prefill 与 decode、内存类型、speculative decoding 等本地 LLM 推理基础概念,供社区参考使用并要求注明出处。
Reddit · r/LocalLLaMAAI 评分3131 21M 模型外挂 6.4B 参数查找表:性能追平 114M dense 模型,NVMe SSD 即可承载
作者在 21M 模型外挂一张 16.8M 行、6.4B 参数的查找表,在 500M Wikipedia token 训练下性能接近同条件下的 114M dense 模型。
Reddit · r/LocalLLaMAAI 评分1515 llama.cpp 新增 K2 Horizon dense 与 MoVA 模型支持
llama.cpp 提交 PR #29535,新增对 K2 Horizon dense 与 MoVA 模型的支持。该 PR 由 bitalov 提交,目的是在 ggml-org/llama.cpp 中加入上述模型架构的推理能力。
TechCrunch · AIAI 评分3333 LibreOffice 明确表态:可预见未来内默认安装不会内置 AI 功能
开源办公软件 LibreOffice 所属的 The Document Foundation 发布博客称,默认安装包不会内置任何 AI 功能,并将其作为一项"刻意的设计立场",要求用户数据不离开本机且无需联网。用户仍可通过扩展接入本地 AI 模型,但目前没有满足其全部要求的集成方案;这一决定被用户视为对硅谷软件厂商普遍堆砌 AI 功能趋势的明确反叛。
Reddit · r/LocalLLaMAAI 评分1515 Qwen3.8-Flash-Next 在 Strata 上获得 Strix Halo 机器的官方实验性支持
Strata 面向 Strix Halo 机器新增对 Qwen3.8-Flash-Next 的官方实验性支持,目前仅在 Linux 上可用。该实现基于 Unsloth 的 Q4 和 GSQ-RS 模型权重,在长上下文解码与 ppts 上表现最佳,上下文长度最高可达 1M 而速度损失不大,作者欢迎反馈和 pull request。
NVIDIA BlogAI 评分2525 电信运营商为何以开源模型为基础构建 AI 战略
电信运营商正以开源模型为基础构建 AI 战略,看重的不仅是成本,更在于可信、可控与可定制。NVIDIA 最新《State of AI in Telecommunications》报告显示 89% 受访者认为开源模型与软件对其公司 AI 战略重要。
Reddit · r/LocalLLaMAAI 评分1010 团队提出用 LoRA 适配器充当 LLM 可切换技能,想验证这是否值得做成产品
一个团队正在验证一个想法:把 LoRA 适配器当作 LLM 的持久化、可切换的专用技能,按需加载或卸载,以减少上下文占用、复用专项能力并可能降低推理成本。他们希望 LoRA 的创建与管理能像维护知识库一样简单,并询问用户是否会在实际场景中使用该方案,以及该思路在哪些场景下不适用。
Latent SpaceAI 评分4848 Reflection 发布 Beam:501B 总参 / 23B 激活的开源 MoE 编程模型
Reflection 发布 Beam,一款文本模型,总参数 501B、激活 23B 的 MoE,面向编程、智能体和科学场景,从零训练并计划于本月以 Apache 2.0 开源完整权重,团队称其在 SWE-bench Verified 上拿到 80.9,推理效率据称是 GLM 5.2 的 3–4 倍。
Reddit · r/LocalLLaMAAI 评分4545 Western 开源 AI Reflection 终于亮相,推出首个开放模型 Beam
Reflection AI 正式发布首个开放模型 Beam,由前 DeepMind 成员创立,定位于非中国厂商的开源替代方案,主打编程与 AI 智能体方向,号称效率高出其他开源模型 3-4 倍。公司估值达 250 亿美元,并已开始训练下一代模型。
Reddit · r/LocalLLaMAAI 评分1919 ik_llama.cpp fork 新增 MoE 优化:专家常驻显存与自适应 CPU/GPU 混合执行,支持 Q2_0 量化
开发者基于 ik_llama.cpp 推出新 fork,引入带宽自适应的 CPU/GPU 混合执行与 MoE 专家常驻(expert residency)机制,并新增 Q2_0 量化支持。
Reddit · r/LocalLLaMAAI 评分1616 Kolibri-1 演示:直接输出动作概率玩 Breakout,单步推理延迟低于 25ms
用户在未做微调的情况下,让 Aleph__Alpha 的 Kolibri-1 自主游玩 Breakout,仅输出四种动作概率而不生成文本,单次推理延迟约 25ms,并强调该模型采用开源权重。该实验用于检验 Kolibri-1 在结构化输出与约束条件下的能力表现。
Reddit · r/LocalLLaMAAI 评分2424 PewDiePie 微调本地模型 Ajax 两次被 OpenAI 封号
PewDiePie 在自家电脑上微调一个 9B 本地模型 Ajax 时,因用 OpenAI API 输出来构建数据集,两次违反使用条款被封号、申诉解封后又立即再被封。他随后转向开源工具移除模型内置拒答与说教式回复,继续推进完全本地化的 9B agent 构建。该事件借 PewDiePie 的影响力,为开源模型带来了一次面向数百万观众的免费宣传。
Reddit · r/LocalLLaMAAI 评分1010 yandex/AliceAI-80B-A3B 后训练 Instruct 微调进展更新
开发者对 yandex/AliceAI-80B-A3B-Base 进行 Instruct 微调,目标为支持智能体任务与对话,并通过 qwen 3.8 27b 的浅层蒸馏注入链式推理能力。
TechCrunch · AIAI 评分7272 Reflection AI 发布开源权重模型 Beam,对标中国模型并降低推理算力成本
Reflection AI 正式发布首个前沿开源权重模型 Beam,这是一个文本 MoE 模型,总参数 501B、激活参数 23B,预训练使用 23.8T tokens,上下文窗口为 1M。
TechCrunch · AIAI 评分1010 TechCrunch Disrupt 2026 议程前瞻:AI 创始人们如何选择开源、闭源与自建模型
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举办,议程聚焦 AI 创始人对模型路线的抉择。
Reddit · r/LocalLLaMAAI 评分1515 开发者实验本地 LLM 项目 Neco:让 AI 像"住"在机器上一样持续存在
开发者围绕 Ollama 和 Open WebUI 构建本地 AI 项目 Neco,通过只读系统层让模型感知主机 uptime、内存占用、负载、电量和温度等状态,并由后台守护进程在无对话时自主生成"闲思"。模型不获得 shell 权限或主机控制权,下一步计划实验情景式记忆与选择性检索,让行为在数周至数月间形成连续性。
Reddit · r/LocalLLaMAAI 评分55 Strata 跑 Qwen 模型速度惊艳,但社区呼吁展示实际本地运行成果
Reddit 用户对 Strata 项目只展示 Qwen 模型 token 速度而不公开实际运行成果表示失望,呼吁作者分享此前无法本地运行的具体任务示例及所用量化精度,强调"小而有效"的模型比参数规模更重要。
Reddit · r/LocalLLaMAAI 评分3232 Apex-2 训练复盘:单卡 H100 瓶颈、DiLoCo 多实例合并与 FineWeb-Edu 去重经验
开发者复盘了自训模型 Apex-2 的经验。原计划用约 1T tokens 训练,但单卡 H100 算力不足,最终只训了约 80B tokens;改用两台 GH200 实例按 DiLoCo 方式每 350 步合并模型,训练速度约为单卡的 1.9x,每张 GPU MFU 约 40%。
Product Hunt · AI 分类AI 评分2222 开源简历工具 Reactive Resume v6 发布,整合求职信与职位追踪
开源简历构建工具 Reactive Resume 推出 v6 版本,将简历生成、配套求职信和职位追踪整合到重新设计的同一工作流中,继续保持免费、开源与可自托管。该版本加入 AI 能力、细致的自定义选项以及分享与协作功能,距首次发布已积累 6 年用户信任。
Reddit · r/LocalLLaMAAI 评分2727 Reflection AI 即将发布美国开源权重模型,对标 DeepSeek 和 Qwen
Reflection AI 计划发布一款美国开源权重模型,旨在与 DeepSeek 和 Qwen 竞争。该模型参数量目标控制在 200B 以下,以满足显存受限用户的需求。随着更多西方开源模型即将推出,开源大模型竞争格局有望变得更加多元化。
Reddit · r/LocalLLaMAAI 评分1313 有什么免费、本地的带旁白解释视频制作工具?
explainroo 是一款完全本地运行的带旁白解释视频制作工具,整合了 Kokoro 语音合成、Whisper 单词计时、headless Chrome 画帧和 ffmpeg 视频合成,无需 API 密钥。该用户认为功能较为简单,生成的视频风格缺乏变化,正在 Reddit 社区寻求其他免费本地替代方案。
Reddit · r/LocalLLaMAAI 评分4444 SPOPI: 允许 Pi 自己修改的本地 AI 编程 UI 和编辑器
开发者推出 SPOPI,一个围绕 Pi(本地 AI 编程工具)构建的 UI 和编辑器,采用 Tauri 2 + Rust 开发,使用系统原生 Webview。该工具完全本地运行、离线可用、无遥测数据,其核心特点是 Pi 可以实时修改 UI 界面,如布局、颜色、按钮等,并自动支持新功能包。
Reddit · r/LocalLLaMAAI 评分7272 AgrillaMoE:面向16GB GPU的Qwen3.6-35B MoE推理引擎发布
作者基于llama.cpp服务器创建了AgrillaMoE,专门优化Qwen3.6-35B-A3B模型。在16GB V100上使用2-bit UD-Q2_K_XL量化实现57-60 tok/s生成速度,支持OpenAI和Anthropic API,Claude Code可直接调用。
Reddit · r/LocalLLaMAAI 评分6868 repOx:快速打包代码仓库到提示词的 Rust CLI/TUI 工具
作者开发了 repOx 工具,用于将代码仓库打包成适合 LLM 的提示词。该工具用 Rust 编写,处理 3k 文件的仓库仅需约 14ms,提供 Lazygit 风格的 TUI 界面,可勾选文件夹、预览文件、搜索和实时查看 token 使用量。
Reddit · r/LocalLLaMAAI 评分6363 玩家在FPGA上运行Qwen3.5 9B INT4:75MHz下单卡约2-3 tok/s
作者使用eBay购买的SQRL FK33 FPGA开发板在75MHz下运行Qwen3.5 9B INT4模型,实测prefill约5.5-6 tok/s,生成约2.4-3.2 tok/s。文中还估算27B模型在多卡配置下的性能:2x VU35P在200MHz下可达约16 tok/s prefill和8 tok/s生成,4x VU35P四路并行约25 tok/s。项目已开源至GitHub。
Hacker News · 首页AI 评分6767 SCM:macOS 本地 AI 照片与视频逐帧搜索工具
SCM(Screen Memories)是一个 macOS 本地优先的 AI 搜索工具,可对照片和视频的每一帧进行语义搜索。支持四种搜索模式:文件语义搜索、视频场景定位、OCR 文字识别、Whisper 对话文字检索,还可开启本地 LLM 聊天功能。所有推理在本地 Mac 上运行,首次下载模型权重后完全离线,无账户、无云端、无上传。提供 Homebrew 安装方式。