#开源/仓库
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#开源/仓库
今日 6 条编程 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Product HuntAI 评分2727 offstage:为 Claude Code、Codex 和 opencode 提供独立的 macOS 副账户运行环境
开源工具 offstage 为 Claude Code、Codex 和 opencode 等 AI 编程智能体分配一个独立的 macOS 账户,使其在隔离的桌面环境中运行模拟器、Xcode UI 测试及智能体刚构建的应用。代理操作期间用户的主屏幕、键盘和鼠标不受占用。该工具免费开源。
Product HuntAI 评分4242 Termaxa:在 Claude Code、Codex、Cursor 和 Copilot 终端命令执行前加入策略网关
Termaxa 是一款用 Rust 编写的开源安全网关,插入 Claude Code、Codex、Cursor 和 Copilot 等 AI 编码工具的终端 hook 路径,在命令执行前显示将要删除的内容并预先备份,再根据用户策略放行或拒绝。默认从 observe 模式启动,不拦截任何操作,仅生成本可拦截事件的报告。
Reddit · r/MachineLearningAI 评分3939 开发者用 1.26M 参数模型将 htop、vim 等 TUI 实时转成 A2UI 组件
开发者训练了一个 1.26M 参数的轴向 Transformer 模型,对 TUI 屏幕的 15 类角色进行标注,再用确定性逻辑转为 Google A2UI 协议组件,使客户端无需运行终端模拟器即可接收真实 UI,按键作为 Button 动作回传。
Hacker News · 首页AI 评分6767 pingdotgg 用大模型把 TypeScript 编译器端口到 Rust 端并发布 tsc-rs
作者 pingdotgg 发布 tsc-rs,把微软 TypeScript 编译器(基于 Go 的 microsoft/TypeScript)用大模型移植到 Rust,对应上游 7.1.0-dev(673a5f17d713)。
Reddit · r/LocalLLaMAAI 评分4141 利用 Strix Halo NPU 加速本地 coding agent:Halogen 0.17.1 实测
Halogen 0.16+ 将闲置的 XDNA2 NPU 暴露为 OpenAI 风格接口,作者将其中四个模型接入真实 coding agent。0.17.1 让 NPU 调用延迟降低约 30 倍,解码速度提升约 40%;联合投机解码使双流聚合吞吐达 72.7 tok/s,串行解码 59.6 tok/s,prefill 约 1,300 tok/s。
Hacker News · 首页AI 评分3434 Pinrail:让 coding agents 等你审查的桌面收件箱
Pinrail 是一款桌面应用,让 coding agents 在执行关键步骤前停下来等待用户审查。它通过 CLI 命令接收 agent 的审查请求,在专属视图中展示代码 diff、列表、问卷、markdown 文档或生成图片等内容,用户对每项条目做出接受、拒绝或附注的结构化决定后,agent 再据此继续执行。
Reddit · r/LocalLLaMAAI 评分2525 训练出约 2 万参数的 MacroStories,可能是目前能写故事的最小语言模型
Reddit 用户训练出一款名为 MacroStories 的微型语言模型,仅有 19,969 个参数、81 KB FP32 大小,体积约为 1M 参数 TinyStories 模型的 1/50。
Simon WillisonAI 评分2929 llm-openai-decisions 0.1a0 发布,接入 OpenAI 新版 Decisions API
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,对接 OpenAI 在 DevDay 公布的 Jev 风格 Decisions API,支持三种问题类型。该 API 底层使用 gpt-6-luna 模型,相比 Jev 额外支持图像输入,按输入 token 计费,价格为每百万 0.10 美元。
Reddit · r/LocalLLaMAAI 评分1515 llama.cpp 新增 K2 Horizon dense 与 MoVA 模型支持
llama.cpp 提交 PR #29535,新增对 K2 Horizon dense 与 MoVA 模型的支持。该 PR 由 bitalov 提交,目的是在 ggml-org/llama.cpp 中加入上述模型架构的推理能力。
Hacker News · 首页AI 评分2525 Tapo 开源 Rust/Python 客户端在 v0.11.1 加入 TPAP 协议支持,可在 TP-Link 第三方兼容开关关闭时控制插头与灯具
tapo 开源 Rust 与 Python 客户端在 v0.11.1 新增对 TP-Link TPAP 协议的支持,使运行固件 1.4.0 及以上的灯具、插头、插线板和 H100 hub 能在 Tapo 应用的"Third-Party Compatibility"开关处于关闭状态时被客户端连接,无需修改代码。
Reddit · r/LocalLLaMAAI 评分1515 NInfer6000 在 RTX 6000 上跑 Qwen 3.8 Flash Next,token 生成达 400 tg/s
网友基于 NInfer 改写的 NInfer6000 分支在 RTX 6000(96GB VRAM)上运行 Qwen 3.8 Flash Next,将非专家层从 16-bit 下采样到 8-bit 并启用 MTP3 解码与小型 drafting head 后,在理想条件下达到 400 tok/s 生成速度。
Reddit · r/LocalLLaMAAI 评分1313 德国 Aleph Alpha Kolibri 模型通过 Tesseracted 托管生成 Nim 代码
德国 Aleph Alpha 的小模型 Kolibri 由 Tesseracted 提供托管,在 3code 上用完整小众语言 Nim 写出了一段可运行的小型命令行工具。模型、托管方、运行环境和编程语言均产自德国,体现了德国本土 AI 栈的端到端能力。鉴于模型体量较小,能在 Nim 这类冷门语言上跑通代码被认为颇为难得。
Product Hunt · AI 分类AI 评分3737 开源 GitHub PR 桌面评审工具 Review:支持多 AI 模型协作审查
Review 是一款开源(MIT)的免费桌面工具,可在 Mac、Windows 和 Linux 上评审 Git 分支与 GitHub PR,支持逐行评论且发布前保持私密。内置 AI 评审功能,可接入 OpenAI、Anthropic、Gemini、OpenRouter 或通过 Ollama 接入本地模型,并能拆分任务由不同模型分别审查、显示每条规则的命中情况,仅重试遗漏部分。该工具无需账号。
Reddit · r/LocalLLaMAAI 评分7272 LocalMind 在浏览器标签页中流式运行 Gemma 4 26B-A4B 与 Qwen3.6 MoE 模型
作者发布 LocalMind:一个通过 WebGPU 在浏览器标签页内运行的静态网页推理引擎,新增两套可在生成过程中按需从磁盘流式读取 MoE 专家权重的引擎。
Reddit · r/LocalLLaMAAI 评分1919 ik_llama.cpp fork 新增 MoE 优化:专家常驻显存与自适应 CPU/GPU 混合执行,支持 Q2_0 量化
开发者基于 ik_llama.cpp 推出新 fork,引入带宽自适应的 CPU/GPU 混合执行与 MoE 专家常驻(expert residency)机制,并新增 Q2_0 量化支持。
Hacker News · 首页精选AI 评分7777 Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。
推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。
Reddit · r/LocalLLaMAAI 评分2222 基于 40 万合成数据微调的 1.5B Qwen 模型在 bash 命令生成上达到 gpt-4o 水平,并开源微调数据集
网友 Comfortable-Rock-498 作为业余项目,将 1.5B 参数的 Qwen 模型微调用于生成 bash 命令,全部使用 40 万条合成数据进行训练,并在该任务上达到 gpt-4o 水平。作者同步开源了微调后的模型与训练数据集,公开了训练与 CLI 流程,欢迎社区自行训练或使用。
Reddit · r/LocalLLaMAAI 评分3939 Qwen3.8-Flash-Next (125B) 在单台 Strix Halo 迷你 PC 上跑通:投机解码下 44-59 tok/s,开源推理引擎同步发布
团队在搭载 Ryzen AI Max+ 395、128 GB 内存的 Strix Halo 迷你 PC 上成功运行 Qwen3.8-Flash-Next(125B MoE,激活 6B),并同步开源其推理引擎 Kyojin(基于 ExLlamaV3 构建)。
Reddit · r/LocalLLaMAAI 评分2424 在 veloGB10 上运行 Swift 1.5:xhigh 档位反超 base Flash-Next 中档 vLLM 表现
在两台 DGX Spark 上,UkisAI 基于 Qwen3.8-Flash-Next 微调的 Swift 1.5(推理高效版)借助 sf-stav 的 Rust/CUDA 推理引擎 veloGB10 实现了约 110 tok/s 的单流解码速度,运行 xhigh effort 仍比旧 vLLM NVFP4 环境下 base Flash-Next medium 档更快。
Reddit · r/LocalLLaMAAI 评分2727 开发者开源 NihonSub:基于 Whisper-Large-v3 与 Groq / DeepSeek 的日语动漫实时字幕翻译引擎
Reddit 用户 u/Grand_Marionberry115 开源 NihonSub,一个针对日语动漫的实时字幕与翻译工具,采用 ffmpeg 静音检测切分语音后。
Reddit · r/LocalLLaMAAI 评分1717 Project Athena:如何用纯 Markdown 文件把本地编码 Agent 的 KV cache 压到 2K tokens 以内(开源)
开发者将一套名为 Project Athena 的本地 LLM 编码工作流以 MIT 协议开源,核心做法是把状态存为磁盘上纯文本、git 版本化的 Markdown 文件。
Reddit · r/LocalLLaMAAI 评分4545 Infermeld:支持 AMD + NVIDIA 混合 GPU 推理的 llama.cpp Linux 工具包
Infermeld 是一个实验性开源 Linux 工具包,可让同一 GGUF 模型同时在 AMD 和 NVIDIA 显卡上运行,采用 llama.cpp 作为推理引擎,Vulkan + CUDA 双后端支持。
Product Hunt · AI 分类AI 评分1717 Pheebs:开源 AI 编码智能体使用度量化工具
Eversynced 开源了 AI 编码工作流量化工具 Pheebs。Pheebs 通过 hooks 接入 Claude Code、Cursor 和 Codex,仅采集会话形态等轻量交互信号,不捕获具体代码内容,帮助团队衡量自身与 AI 编码智能体的真实协作方式。
Product Hunt · AI 分类AI 评分3737 GeckIt:把多 Claude Code 会话搬到 Kanban 看板的开源工具
GeckIt 是一款开源工具,可将多个 Claude Code 会话并排显示在 Kanban 看板上,区分运行中、等待用户和已完成状态。它直接复用用户自己的 Claude 订阅运行 Claude Code,无需额外 API key,并支持 macOS、Windows 与 Linux,免费可用。