#GitHub
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#GitHub
今日 2 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Hacker News · 首页AI 评分3434 Pinrail:让 coding agents 等你审查的桌面收件箱
Pinrail 是一款桌面应用,让 coding agents 在执行关键步骤前停下来等待用户审查。它通过 CLI 命令接收 agent 的审查请求,在专属视图中展示代码 diff、列表、问卷、markdown 文档或生成图片等内容,用户对每项条目做出接受、拒绝或附注的结构化决定后,agent 再据此继续执行。
GitHub Blog · AI & ML精选AI 评分6262 GitHub 推出 ModernBERT 密钥分类器扩展 Push Protection
GitHub 与 Microsoft Applied Sciences 构建了微调的 ModernBERT 分类器,可在不到 2 milliseconds 内评估一组候选密钥,并让可阻止的密钥数量增加一倍以上。
推荐理由:GitHub 用九个季度的数据说明密钥泄露风险未随代码量明显上升,并公开了保护机制扩展到非结构化密钥的方法。
Latent SpaceAI 评分4848 Stacklok Mecatl:基于 Kubernetes 的云原生 AI 智能体 harness
Kubernetes 创始团队创立的 Stacklok 开源了云原生智能体 harness Mecatl,旨在将 agent loop、工具调用、会话状态与执行环境解耦,解决桌面端 harness 难管理的问题。该项目已以 GitHub 开源项目形式自 6 月起开发,被定位为面向企业的云原生基础设施,意在降低对 Codex、Claude Code 等前端模型厂商的依赖。
The Rundown AIAI 评分6767 OpenAI 一周发布 722 篇数学论文,Mistral 开源 1T 参数 Large 4
The Rundown AI 周报把多件事拢在一起:OpenAI 发布 722 篇来自未公开内部模型的数学论文,按 372 个结果族分组,并称其中包含对“准黎曼猜想”的证明,162 篇主结果用 Lean 写出,多数任务只需一次 Prompt、平均消耗 3 小时 ChatGPT Pro 算力。
Reddit · r/MachineLearningAI 评分1818 AFP-GIC:可控生成式图像压缩框架在 IEEE Access 发表
AFP-GIC 框架发表于 IEEE Access(2026),针对超低码率场景,通过非对称自适应融合先验迁移管道,在不传输融合先验的前提下实现先验引导的纹理重建。
Reddit · r/LocalLLaMAAI 评分1515 Qwen3.8-Flash-Next 在 Strata 上获得 Strix Halo 机器的官方实验性支持
Strata 面向 Strix Halo 机器新增对 Qwen3.8-Flash-Next 的官方实验性支持,目前仅在 Linux 上可用。该实现基于 Unsloth 的 Q4 和 GSQ-RS 模型权重,在长上下文解码与 ppts 上表现最佳,上下文长度最高可达 1M 而速度损失不大,作者欢迎反馈和 pull request。
Reddit · r/LocalLLaMAAI 评分2929 开发者发布 Chrome 扩展,用浏览器内本地小模型过滤 YouTube 信息流
开发者发布 Chrome 扩展 opendecider-focus 0.8.1,通过 ONNX Runtime Web 在浏览器内加载 opendecider-nano 模型,对 YouTube 视频标题分类并按用户规则隐藏特定类型内容,全程不上传数据、离线运行。
Reddit · r/LocalLLaMAAI 评分4444 用闭式轨迹权重手术把 Qwen 3.5 4B 能力迁移到 0.8B:中间层为何崩溃及 4 个锚点块如何修复
研究者提出一种跳过反向传播的闭式轨迹匹配方法,通过正则化最小二乘和谱投影直接把 Qwen 3.5 4B 的层间隐藏状态轨迹迁移到 0.8B 学生模型;起初编辑全部 24 层导致 NLL 暴涨 64.78%。
Hacker News · 首页AI 评分6464 开发者撰文称 AI 正在杀死他所熟悉的开源协作模式
作者 vinhnx 发表长文《Open Source as We Know It Is Dead》,以自己 14 年前向陌生人提交 PR 并被合并的经历为引子,指出 AI 让生成 PR 的成本趋近于零,但维护者审核成本并未下降,甚至因大量低质量、AI 生成乃至伪造的安全报告而急剧上升。
Reddit · r/MachineLearningAI 评分2121 ZhemaIsmayil 曾用神经网络为每个字体生成嵌入向量并以 tSNE 可视化,意外得到花朵状结构
一名开发者用预训练神经网络为每个字体的字符生成嵌入向量,再用 tSNE 把降维后的嵌入映射为 XYZ 和 RGB 通道并以点云可视化,使视觉相近的字体在位置和颜色上自然聚集。在 Google Fonts 语料上,该可视化呈现出花朵形状,大多数手写体字体集中于花蕊区域。作者另在其字体检索网站上提供了基于全部可搜索字体的类似可视化。
Reddit · r/MachineLearningAI 评分3030 Chunkr:用 Rust 实现的 chunking 库,速度比 LangChain 等方案快约 20 倍
开发者推出 Rust 编写的 chunking 库 Chunkr,支持 Character、Recursive、Markdown header、Late chunking、Hierarchical chunking 等策略及原生 PDF 加载。
GitHub Blog · AI & MLAI 评分3636 GitHub 推出 ReviewBench:面向 AI 代码评审智能体的开源基准
GitHub 发布开源代码评审基准 ReviewBench,涵盖 19 种语言的 219 个公开 pull request,其语言与仓库规模分布基于对 103.9M 个 GitHub pull request 的分析建模而成。
Reddit · r/LocalLLaMAAI 评分4545 Speakrail:单张 RTX 4090 即可运行的全本地低延迟语音助手
开发者发布开源全本地全双工语音助手 Speakrail,在单张 RTX 4090 上运行,组件包括 Voxtral Realtime 语音识别、Gemma 4 12B 微调大语言模型和 Breeze TTS 2 语音合成。该项目在部分基准测试中可比肩 GPT-Live,并支持插话、静默与打断等全双工交互模式。作者表示后续将发布完整技术报告。
Hacker News · 首页AI 评分3131 Minigraf:基于 Rust 的嵌入式双时态图数据库,支持 Datalog 查询与多语言绑定
Minigraf 是一款基于 Rust 的单文件嵌入式图数据库,主打 Datalog 查询、双时态时间旅行与窗口函数,单个 .graph 文件即可在 Rust 原生、WASM、Android、iOS、Node.js、Python 等多平台运行。
Reddit · r/LocalLLaMAAI 评分2424 在 veloGB10 上运行 Swift 1.5:xhigh 档位反超 base Flash-Next 中档 vLLM 表现
在两台 DGX Spark 上,UkisAI 基于 Qwen3.8-Flash-Next 微调的 Swift 1.5(推理高效版)借助 sf-stav 的 Rust/CUDA 推理引擎 veloGB10 实现了约 110 tok/s 的单流解码速度,运行 xhigh effort 仍比旧 vLLM NVFP4 环境下 base Flash-Next medium 档更快。
Reddit · r/LocalLLaMAAI 评分2727 开发者开源 NihonSub:基于 Whisper-Large-v3 与 Groq / DeepSeek 的日语动漫实时字幕翻译引擎
Reddit 用户 u/Grand_Marionberry115 开源 NihonSub,一个针对日语动漫的实时字幕与翻译工具,采用 ffmpeg 静音检测切分语音后。
Hacker News · 首页AI 评分4545 Gitframes:面向 AI 编码智能体的代码优先视频生成 npm 包
Gitframes 是一个 npm 包,将 Photoshop 级合成、After Effects 级动效和 Blender 级 3D 场景整合在一起,供智能体通过 TypeScript 直接驱动并渲染 MP4,绕开无头浏览器和 DOM 重排。
Reddit · r/LocalLLaMAAI 评分3434 Lokutor 团队发布 ItoTTS:面向 $5 ESP32-S3 的自然语音 TTS 引擎,单个声部权重仅 4.89 MB
Lokutor 团队发布面向 ESP32-S3 的流式 TTS 引擎 ItoTTS,提供两个 24 kHz 英语人声,单个声部权重仅 4.89 MB,目标是让本地大语言模型在 $5 芯片上获得语音输出。
Reddit · r/LocalLLaMAAI 评分4646 Agens Volundr 32B Preview 发布:Blockway 自研混合架构,72 层仅 18 层保留 KV cache
Blockway 团队发布 Agens Volundr 32B Preview,这是其首款基于自研混合架构的模型,72 层中仅 18 层保留 KV cache,上下文窗口 262K,采用 Apache-2.0 开源。
Reddit · r/LocalLLaMAAI 评分3232 Apex-2 训练复盘:单卡 H100 瓶颈、DiLoCo 多实例合并与 FineWeb-Edu 去重经验
开发者复盘了自训模型 Apex-2 的经验。原计划用约 1T tokens 训练,但单卡 H100 算力不足,最终只训了约 80B tokens;改用两台 GH200 实例按 DiLoCo 方式每 350 步合并模型,训练速度约为单卡的 1.9x,每张 GPU MFU 约 40%。
Product Hunt · AI 分类AI 评分3636 Reviu:一款用于审查 AI 智能体代码的原生桌面应用发布
Reviu 是一款原生桌面应用,用于在代码推送前审查 AI 智能体编写的代码。它支持运行 Claude Code、Codex、Gemini 等 ACP 智能体,可在持久会话中检查每次 diff、向智能体发回评论,并直接在应用内完成 stage、rebase、commit、开 PR 及审查 GitHub pull requests。
Reddit · r/LocalLLaMAAI 评分6868 repOx:快速打包代码仓库到提示词的 Rust CLI/TUI 工具
作者开发了 repOx 工具,用于将代码仓库打包成适合 LLM 的提示词。该工具用 Rust 编写,处理 3k 文件的仓库仅需约 14ms,提供 Lazygit 风格的 TUI 界面,可勾选文件夹、预览文件、搜索和实时查看 token 使用量。
Hacker News · 首页AI 评分6969 Jeffy:可在 CPU 上运行的本地预训练文本分类器
某项目发布了可在 CPU 上运行的本地预训练文本分类器工具,包含 13 个预训练分类器,支持自定义训练,提供 Python API 和 HTTP 服务。首次推理需下载约 1.2 GB 的编码器模型,推理延迟约 50-80 ms。
Hacker News · 首页AI 评分2424 越来越多的人正在离开大平台:转向个人站点与自托管应用
近期涌现大量关于离开 Reddit、WordPress、Discord、GitHub 等平台的帖子,原因包括定价变化、平台将用户内容用于 AI 训练、新所有者或新政策、以及服务不再以用户为中心。人们正从大平台迁移至更小的个人站点、自托管应用或 Gopher、Gemini 等小众网络,追求更多控制而非更广触达。这一趋势被视为合理选择,而非放弃。
Hacker News · 首页AI 评分6767 Show HN:在 Pi 中使用所有 Codex 插件连接器
作者发布了 pi-codex-connector 扩展,允许在任何 Pi 模型中使用已连接的 Codex(ChatGPT)插件,包括 GitHub、Gmail、Google Calendar/Drive、Slack、Linear、Figma 等服务。该扩展通过启动 Codex app-server 并调用其 MCP 服务器工具实现,而非直接使用 Codex 模型。
GitHub Blog · AI & MLAI 评分3939 AI 正在改变开发者工作:加强这3项技能
GitHub 指出 AI 时代开发者需掌握三项核心技能:学会引导 AI 智能体而非仅使用 AI 工具;不轻信 AI 首个答案,用第二个模型审查首个模型的输出;利用 AI 节省的时间解决更广泛的工程问题,如理解客户需求和评估技术权衡。随着 AI 承担更多实现工作,技术判断力将成为区分优秀工程师的关键能力。
Reddit · r/LocalLLaMAAI 评分5252 开发者 Roy3838 发布 Observer:基于本地大模型的屏幕监控自动化工具 v3.0.0
独立开发者 Roy3838 发布了开源应用 Observer v3.0.0,这是一个基于 MCP 的微智能体框架,可监控屏幕并在特定条件触发时执行通知或自动化操作。桌面版使用 llama.cpp 作为推理引擎,网页版使用 transformers.js,支持 v1/chat/completions 端点。作者经过一年迭代使应用达到普通用户可用的水平,其母亲首次成功设置了一个监控智能体。
Hacker News · 最佳AI 评分5555 资深工程师论 AI 编程工具:编程远未解决
作者基于 4 年 AI 开发经验,指出业界“编程已解决”的叙事存在严重问题。LLM 是概率模型,缺乏真正的逻辑推理能力;代码维护、安全、可扩展性等非功能性需求仍是难题;AI 无法被追责,无法承担后果——最严重的惩罚不过是拔掉电源。文章还批评了 Claude Code 等工具的实际问题,以及行业过度营销的危害。
Product Hunt · AI 分类AI 评分3838 Vantage:面向 coding agents 的开源成本与用量监控工具
Vantage 是一款免费、开源的 coding agents 成本和用量监控工具,支持 guardrail 与 session log 功能。该工具现已上线 Product Hunt,隶属于 Software Engineering、Developer Tools 与 GitHub 标签类别。
GitHub Blog · AI & ML精选AI 评分6161 GitHub Copilot canvas:超越聊天的自定义 AI 工作流界面
GitHub Copilot 推出 canvas 功能,这是一种可在应用内运行的全栈自定义 UI,智能体可与其双向通信。作者认为聊天作为 AI 交互界面存在局限性,而 canvas 能让用户创建针对特定任务的定制界面,还可调用第三方 API 和本地代码执行,并展示了用 canvas 构建 Connect 4 游戏、Winget 包管理、SQLite 数据库操作、工作流自动化等实际用例。
推荐理由:原文展示了 canvas 功能解决的具体问题和使用场景,读者可以据此思考如何用自定义 UI 改进自己的 AI 工作流。
GitHub Blog · AI & ML精选AI 评分6767 GitHub Security Lab 发布 Taskflow Agent:实现 AI 驱动的自动化模糊测试
GitHub Security Lab 发布 Fuzzing Taskflow,这是一个基于 LLM Agent 的 C/C++ 项目自动化模糊测试管道。只需指定一个 GitHub 仓库,Agent 会自动完成入口点识别、构建系统分析、模糊测试用例生成、AFL++ 运行、覆盖率分析、用例优化和漏洞报告编写。
推荐理由:原文详细给出了自动化模糊测试的完整工作流程,包括覆盖率反馈循环、结构感知变异和语料库演进等具体机制,读者可据此迁移到自己的安全测试中。
GitHub Blog · AI & MLAI 评分4040 GitHub 营销运营自动化实战:用 Copilot 和 Actions 实现活动管理全流程
GitHub 日本/韩国营销团队利用 GitHub Copilot 和 GitHub Actions 将活动管理全流程自动化,原本需耗时数天的活动筹备、参会者筛选、会后数据整理等工作现可从一个 GitHub Issue 自动完成。
GitHub Blog · AI & ML精选AI 评分7777 GitHub 发布 Project HydraFusion 研究预览:通过多模型编排实现前沿质量
GitHub 推出 Project HydraFusion 研究预览,通过运行时编排从多个模型提供商动态选择工作流程(Single、Cascade、Critique 三种模式)来解决编码任务。
推荐理由:原文给出了具体 benchmark 数据和可用入口,读者可以据此判断这个新功能会如何改变代码生成的效率成本权衡。
GitHub Blog · AI & MLAI 评分4242 GitHub Copilot 应用教程:如何同时运行多个智能体
GitHub Copilot 应用现在支持并行运行多个智能体会话,每个智能体在独立的 Git worktree 上运行,互不干扰,可同时处理不同任务。教程演示了同时进行添加功能、无障碍审查、运行测试三个任务,各会话保持独立上下文,可自由切换无需重新解释。
The Rundown AIAI 评分6666 Slack 发布 Slack Code:在消息频道内协同开发代码
Slack 推出 Slack Code 功能,允许用户直接在消息平台内通过共享房间开发代码,AI 智能体在频道中编写软件,团队成员(无论是否为工程师)都可以观看、指导和参与构建过程。部署变更需人工审批,完成的项目留下可搜索的存档频道。所有 Slack 计划均可使用,可连接 ChatGPT、Claude、Devin、Vercel 和 GitHub 等智能体。
The Rundown AIAI 评分6262 Cursor 推出 Origin 挑战 GitHub
AI 编程平台 Cursor 推出 Origin 早期测试版,提供代码仓库托管和拉取请求功能,内置智能体和审查工具,可与 GitHub 同步代码库。Origin 选在 GitHub 当天大规模宕机时发布,最初面向 Cursor 付费用户开放。
Google Research精选AI 评分7878 Google 发布 TabFM:面向表格数据的零样本基础模型
Google 发布 TabFM,一个面向表格数据分类和回归任务的基础模型。该模型将表格预测重新定义为上下文学习问题,通过混合注意力架构(交替行列注意力、行列压缩)在数百万人工合成数据集上训练,实现了真正的零样本预测——无需针对新数据集进行模型训练、超参数调优或特征工程。
推荐理由:读者可通过本文了解 Google 如何将大语言模型的零样本能力迁移到结构化表格数据,理解其架构创新和实际可用性。