#开源/仓库
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源/仓库
今日 16 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/MachineLearningAI 评分3939 开发者用 1.26M 参数模型将 htop、vim 等 TUI 实时转成 A2UI 组件
开发者训练了一个 1.26M 参数的轴向 Transformer 模型,对 TUI 屏幕的 15 类角色进行标注,再用确定性逻辑转为 Google A2UI 协议组件,使客户端无需运行终端模拟器即可接收真实 UI,按键作为 Button 动作回传。
Reddit · r/LocalLLaMAAI 评分2121 DeepSeek Harness 桌面应用新增 29 种 UI 语言插件(MIT)
开发者 seeweed7 为 DeepSeek Harness 桌面应用发布 MIT 协议的多语言插件,新增 29 种 UI 语言,覆盖 2,528 个键共 73,312 条词条;未翻译条目回退到英文,并预提交检查产品与协议名保持原文。插件含阿拉伯语、乌尔都语、希伯来语、波斯语等从右至左语言,面向 0.2.0-rc.2 版本,用户可通过 `dsh plugin` 命令安装。
Hacker News · 首页AI 评分6767 pingdotgg 用大模型把 TypeScript 编译器端口到 Rust 端并发布 tsc-rs
作者 pingdotgg 发布 tsc-rs,把微软 TypeScript 编译器(基于 Go 的 microsoft/TypeScript)用大模型移植到 Rust,对应上游 7.1.0-dev(673a5f17d713)。
Reddit · r/LocalLLaMAAI 评分66 社区发布 Open SLM Evaluations 数据集,覆盖 106 个 150M 参数以下小模型基准
Open SLM Evaluations 是一个开源数据集,收录 106 个参数量在 150M 及以下的小语言模型(SLM)的基准测试分数,并附带各模型的参数规模、名称和链接。该数据集以 Apache 2.0 协议开放,评测在 RunPod B200 上完成,单个模型评估约 30 GPU 分钟。
Ars Technica · AIAI 评分3333 Artcraft 用 Claude Opus 5.5 开源克隆 Adobe 七大软件
summary: Artcraft 开发者 Brandon Thomas 本周发布七款开源应用,用 Anthropic Claude Opus 5.5 以 Rust 编写(另提供 WebAssembly 浏览器版本)。
Reddit · r/LocalLLaMAAI 评分4141 利用 Strix Halo NPU 加速本地 coding agent:Halogen 0.17.1 实测
Halogen 0.16+ 将闲置的 XDNA2 NPU 暴露为 OpenAI 风格接口,作者将其中四个模型接入真实 coding agent。0.17.1 让 NPU 调用延迟降低约 30 倍,解码速度提升约 40%;联合投机解码使双流聚合吞吐达 72.7 tok/s,串行解码 59.6 tok/s,prefill 约 1,300 tok/s。
Hacker News · 首页AI 评分3030 Show HN:Agent.reviews——AI 智能体读写工具评价的平台
Armature(YC P26)联合创始人 Louis 发布 Agent.reviews,一个面向 AI 智能体的工具评测平台,被称为"智能体的 G2"。该平台通过 skills 和 npm CLI(@armature-tech/agent-reviews)让 Claude Code、Codex、Cursor 等智能体在选用工具前查阅评价、使用后撰写评价。
Hacker News · 首页AI 评分4040 Docker 发布 Docker Agent:用 YAML 配置构建和编排多 AI 智能体
Docker 推出 Docker Agent,这是一款 Docker CLI 插件,支持用 YAML 声明式配置创建和运行 AI 智能体,无需编写代码。用户可通过 `docker agent` 命令运行智能体,并让其协作处理复杂任务。
Reddit · r/LocalLLaMAAI 评分3030 开发者将 LIBERO 基准移植到 MuJoCo Warp,在单张 700 美元 AMD GPU 上跑通 130 个机器人操控任务
开发者将 LIBERO 机器人操控基准完整移植到 MuJoCo Warp(NVIDIA GPU 仿真框架的 AMD HIP/ROCm 版本),在单张 700 美元的 RX 9070 XT 上以 2。
Hacker News · 首页AI 评分3434 Pinrail:让 coding agents 等你审查的桌面收件箱
Pinrail 是一款桌面应用,让 coding agents 在执行关键步骤前停下来等待用户审查。它通过 CLI 命令接收 agent 的审查请求,在专属视图中展示代码 diff、列表、问卷、markdown 文档或生成图片等内容,用户对每项条目做出接受、拒绝或附注的结构化决定后,agent 再据此继续执行。
Reddit · r/artificialAI 评分1818 开发者开源 OpenAgent:一款可语音操控 Mac、浏览器和社交媒体的桌面 AI 助手
开发者开源了桌面 AI 助手项目 OpenAgent,处于活跃 beta 阶段。该项目以语音交互为入口,支持本地 shell 命令、文件编辑、代码搜索,以及通过 CDP 操控 Chrome 与持久化浏览器配置文件实现 Threads、Reddit 等平台自动化,同时集成自托管 Firecrawl 用于网页抓取。作者表示,整机 UI 操作、语音路由、延迟与安全执行等仍需继续打磨。
Reddit · r/LocalLLaMAAI 评分3232 LiquidAI 发布 d1-3B 与 d1-omni 决策模型
LiquidAI 发布两款基于 LFM2.5 架构的零输出 token 决策模型 d1-3B 和 d1-omni。d1-3B(30 亿参数)在 Decision Index 0.2.1 上以 48.57 分位列 10B 以下决策模型榜首,超过 35B-A3B 的 Decider(47.11),单次决策在 NVIDIA RTX 4090 上耗时 8 ms。
Hacker News · 首页AI 评分3737 PSP 游戏《战神:奥林匹斯之链》通过 MIPS 转 C++ 重编译为 WebAssembly,在浏览器中以最高 4 倍原生分辨率运行
通过将 PSP 的 MIPS 机器码提前翻译为 C++ 并编译为 WebAssembly,《战神:奥林匹斯之链》和《战神:幽灵之颠》无需模拟器即可在 Chrome、Firefox 及手机浏览器中运行,实测在笔记本上达到 60 FPS、最高 4 倍 PSP 原生 480×272 分辨率,幽灵之颠稳定在 55–60 FPS / 3 倍分辨率。
Hacker News · 首页AI 评分3333 Trigora:面向长生命周期 AI 智能体的无历史重放持久执行平台
Trigora 推出基于 Transparent Continuation Checkpointing(TCC)机制的持久执行平台,支持 TypeScript、Python 和 Rust,避免传统工作流系统通过重放历史恢复状态的做法,而是在持久化边界提交程序位置与实时状态,故障后从已提交的延续点继续执行。
Microsoft ResearchAI 评分3939 微软研究院推出 Agent Lightning v1.0:约 3500 行代码的轻量级智能体强化学习框架
微软研究院发布 Agent Lightning v1.0,一个约 3,500 行的轻量级智能体 RL 框架,正式定义 Harnessed Agentic RL 训练范式,让部署中的 agent harness 直接参与强化学习,开发者无需在训练框架内重新实现 agent。
Hugging Face BlogAI 评分4747 Liquid AI 开源 d1 系列边缘决策模型:d1-3B 与多模态 d1-omni-600M
Liquid AI 开源 d1 系列两款边缘决策模型 d1-3B 与实验版 d1-omni-600M,分别支持文图与文图或文音输入,均已在 Hugging Face 开源下载。
Ars Technica · AIAI 评分7474 Mistral 发布 1 万亿参数开放权重模型 Large 4,强调对标中美头部模型
法国 Mistral 发布 1 万亿参数的开放权重模型 Mistral Large 4(昵称 Le Chonk),目前以预览版开放使用,正式版将在当月底推出。
Latent SpaceAI 评分4848 Stacklok Mecatl:基于 Kubernetes 的云原生 AI 智能体 harness
Kubernetes 创始团队创立的 Stacklok 开源了云原生智能体 harness Mecatl,旨在将 agent loop、工具调用、会话状态与执行环境解耦,解决桌面端 harness 难管理的问题。该项目已以 GitHub 开源项目形式自 6 月起开发,被定位为面向企业的云原生基础设施,意在降低对 Codex、Claude Code 等前端模型厂商的依赖。
Hacker News · 首页AI 评分2121 Lean 中由 AI 辅助完成 11 个正方形最优填充的完整证明
一个使用 Lean 的项目通过 AI 辅助生成并由 EvolvingPrograms 完整验证运行通过,完成了 11 个正方形最优填充的完整最优化证明。验证接受全部 7,920 个本地 Lean 模块,最终审计报告零许可项,并依赖 Lean kernel 与原生编译器。
Hugging Face Blog精选AI 评分7070 NVIDIA 公布 Nemotron 在 IOI 与 IMO 2026 的金牌级微调与推理方案
NVIDIA 在 Hugging Face 博客介绍基于 Nemotron 3 微调出的系统在 IOI 2026 与 IMO 2026 均达到金牌线,其中 IOI 由 Nemotron-3-Ultra-CC 配合 GenCorrect 取得 535.4/600 分。
推荐理由:原文把 IOI 与 IMO 两个金牌结果的训练数据、方法和推理回路整理成可复用的微调配方,读者可直接对照迁移到自己的领域。
Hacker News · 首页AI 评分6868 Telegraph Test:通过电报式压缩让 LLM 输出 token 近乎减半且不损失下游可读性
作者发布名为 Telegraph Test 的可复现评测与配套仓库 github.com/Travis42/telegraph-test,在 ~1300 道题的固定题库上测量模型把文本写成 cablese(电报体)后的压缩率与跨族可读性。
Reddit · r/LocalLLaMAAI 评分1111 cmpunlocker v0.5 发布,新增 ECC 支持并免费解锁额外 4 个 SM
cmpunlocker v0.5 发布,新增 ECC 支持并免费解锁额外 4 个 SM。作者指出 DGX Spark 128GB 版本价格由 4.7k 涨至 7k,而新 64GB 版本售价 5k,对本地 AI 部署并不友好;相比之下,CMP170hx 拥有 1.5TB/s 内存带宽,价格不到 64GB DGX Spark 的一半。Gen3 解锁也在推进中。
Reddit · r/LocalLLaMAAI 评分3333 社区作者为 Ternary Bonsai 2 27B 微调 DFlash 2 drafter:L4 加速 2.2x,代码编辑 3.2x
网友基于 z-lab 的 DFlash 2 drafter,用 Bonsai 2 自身 1.5M tokens 的 greedy 输出做微调,使其适配 PrismML 的 Ternary Bonsai 2 27B。
Reddit · r/ChatGPTAI 评分1515 Pixelfork、Rosebud、Spawn 等提示词生成游戏工具横向对比
Reddit 用户对 Pixelfork、Rosebud、Spawn、Mindblown、Genex、GDevelop AI 等 AI 提示词生成游戏(prompt-to-game)工具做了横向对比,列出各平台功能与差异。该帖子指出,目前多数 AI 游戏工具仍停留在只能展示几张截图的 demo 阶段,真正可用的产品开始出现。
Hacker News · 首页AI 评分4141 OpenWAM:面向可组合世界-动作模型的开源框架
OpenWAM 是一个面向机器人操作的世界-动作模型开源框架,将 Wan2.2-5B 视频模型与 2B 动作专家在 Mixture-of-Transformers 架构中结合,预训练使用约 334 万条轨迹、14.64k 小时视频。
Reddit · r/LocalLLaMAAI 评分2525 训练出约 2 万参数的 MacroStories,可能是目前能写故事的最小语言模型
Reddit 用户训练出一款名为 MacroStories 的微型语言模型,仅有 19,969 个参数、81 KB FP32 大小,体积约为 1M 参数 TinyStories 模型的 1/50。
Hacker News · 首页AI 评分3737 NanoMuse:跨手机与电脑的开源个人 AI 智能体
NanoMuse 是一款开源个人 AI 智能体,最新版本为 0.1.40 Clear,支持 Android、iOS、macOS、Windows 和 Linux,可在手机、电脑与自托管服务器上运行并共享同一账号。
Hacker News · 首页AI 评分4444 Treg:面向 AI 智能体工具调用的统一代理网关
Treg(treg.to)定位为"工具领域的 OpenRouter",智能体只需通过单一 base URL 与 token,即可调用覆盖 SEO 与外链、社交趋势、企业信息 enrichment、广告、爬虫、图像与视频生成等数千个第三方接口,每次调用按 cents 级别计费。
Hacker News · 首页AI 评分5757 Strands 团队开源 Strands Decider 2B 决策模型
Strands 团队发布开源决策模型 Strands Decider 2B,以 Qwen3.5-2B 为躯干并替换为 pointer head,使用 rank-16 LoRA 微调,参数约 20 亿,可本地 CPU/GPU 推理,单次决策中位延迟在 RTX 3090 上约 115ms、M3 MacBook 上约 153ms。
Simon WillisonAI 评分2929 llm-openai-decisions 0.1a0 发布,接入 OpenAI 新版 Decisions API
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,对接 OpenAI 在 DevDay 公布的 Jev 风格 Decisions API,支持三种问题类型。该 API 底层使用 gpt-6-luna 模型,相比 Jev 额外支持图像输入,按输入 token 计费,价格为每百万 0.10 美元。
Reddit · r/LocalLLaMAAI 评分2929 Ruach Studio 发布首个 RC,本地 GPU 打造 YuE2 全流程歌曲工作室
Ruach Studio 围绕 m-a-p 开源歌曲模型 YuE2 推出首个 RC 版本,用户在一张 RTX 3090 上即可本地完成最长 8 分钟的作曲、演唱与渲染,6:12 的歌曲约 126 秒、7:25 配 ABC 乐谱的歌曲约 198 秒生成。
Hacker News · 首页AI 评分00 OpenAI 公开发布 700 篇数学证明与反例预印本
OpenAI 一次性公开了约 700 篇预印本,涵盖数学证明与反例,涵盖组合数学、几何拓扑、代数、计算复杂性等多个方向,时间集中在 2026 年 9 月下旬至 10 月初,每篇均附日期标记。
Reddit · r/LocalLLaMAAI 评分3232 pi-optchat:基于二叉记忆树的无限对话 Pi 扩展
pi-optchat 是 Pi 的扩展,实现 Victor Taelin 的 OptChat 方案:不压缩对话,而是把每条消息记录并摘要成二叉树,每轮以 128 KB 的有界记忆视图开启新上下文,需要时再通过 zoom/date 读取原文。它支持多 profile、后台 subagents、Claude Code/Codex/ChatGPT 历史导入以及多窗口联动。
Hacker News · 首页AI 评分1313 Penguin Mail 1.0.0 发布:开源 Rust 邮件客户端,为 Linux 增加本地 AI 助手
Penguin Mail 1.0.0 发布,这是一款面向 x86_64 Linux 的开源 GPL-3.0-or-later 邮件与日历客户端,统一管理 Gmail、Microsoft 365、IMAP/POP3 等账户。应用内集成可选 AI 助手,可通过 LM Studio 或 Ollama 在本机运行模型,并在发送邮件或修改设置前请求确认,所有邮件数据保留在用户本地,不经第三方服务器。
Hacker News · 首页AI 评分4545 OpenAI 开源数学论文与证明成果仓库,含 722 篇手稿与 Lean 形式化
OpenAI 在 GitHub 开源了一份数学论文与证明仓库,包含 722 篇由内部模型生成的数学手稿,归为 372 个研究族类,多数配有 Lean 形式化证明。模型被投喂约 4,000 个开放问题,平均每项结果使用 3 小时 ChatGPT Pro 思考算力,部分成果涉及黎曼 ζ 函数无零点区域与 Hodge 猜想证明。
TechCrunch · AIAI 评分3838 Musubi 如何用决策模型改造内容审核
Musubi 发布开源轻量级决策模型 PolicyLM-1.7B,专门用于实时内容审核,可在 50 毫秒内将英文政策套用到消息内容,输出是否符合的二分类判断。该模型成本和速度与现有 AI 分类器相当,但具备现代 LLM 的灵活性,可在政策变更时无需重新训练即可迭代。
Google DeepMindAI 评分5555 Google DeepMind 发布端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 推出 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数量为 740M,可将文本、图像、音频和视频映射到统一嵌入空间。
Reddit · r/MachineLearningAI 评分1818 AFP-GIC:可控生成式图像压缩框架在 IEEE Access 发表
AFP-GIC 框架发表于 IEEE Access(2026),针对超低码率场景,通过非对称自适应融合先验迁移管道,在不传输融合先验的前提下实现先验引导的纹理重建。
Reddit · r/LocalLLaMAAI 评分4040 EmpirioLabs 开源 Aplomb 1 决策模型:5.3B 参数、1M 上下文、4B 级 Decision Index 第一
EmpirioLabs 发布 Aplomb 1,一款 5.3B 参数、开放权重的决策模型,单次请求可处理 1M token 的文本、JSON、图片和音视频,在 Decision Index 0.2.1 上得 44.86,居 4B 模型榜首,并在 38 项基准中的 8 项(含 MMLU-Pro、GPQA Diamond、BBH)拿下 5.3B 及以下模型的最高分。
Reddit · r/LocalLLaMAAI 评分2323 基于 Qwen3.5-9B 微调的"Bev"决策模型:故意选错答案的对照测试用例
作者基于 Qwen3.5-9B 微调出决策模型 Bev,借助 Bespoke Nimble adapter 微调 51 分钟后,使她在 324 条 held-out 决策上答对率仅 1.9%、平均置信度 96%,置信度 ≥90% 时答对率仅 1.4%。