#Agent
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#Agent
今日 6 条编程 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Product HuntAI 评分2727 offstage:为 Claude Code、Codex 和 opencode 提供独立的 macOS 副账户运行环境
开源工具 offstage 为 Claude Code、Codex 和 opencode 等 AI 编程智能体分配一个独立的 macOS 账户,使其在隔离的桌面环境中运行模拟器、Xcode UI 测试及智能体刚构建的应用。代理操作期间用户的主屏幕、键盘和鼠标不受占用。该工具免费开源。
Product HuntAI 评分4242 Termaxa:在 Claude Code、Codex、Cursor 和 Copilot 终端命令执行前加入策略网关
Termaxa 是一款用 Rust 编写的开源安全网关,插入 Claude Code、Codex、Cursor 和 Copilot 等 AI 编码工具的终端 hook 路径,在命令执行前显示将要删除的内容并预先备份,再根据用户策略放行或拒绝。默认从 observe 模式启动,不拦截任何操作,仅生成本可拦截事件的报告。
Reddit · r/artificialAI 评分1414 Reddit 用户讨论如何让 Claude、Codex 等模型直接使用 REA、Ghidra 等 MCP 智能体技能进行游戏逆向与 mod 开发
Reddit 用户反映 Claude 和 Codex 在调用 REA、Ghidra 等 Agentic MCP 技能对专有二进制代码进行反编译和构建 mod 时,反复以法律与版权为由拒绝执行;但同时看到有用户晒出同类模型直接逆向其他游戏、复改代码并合成 pass-through mod 的成功案例。
Reddit · r/MachineLearningAI 评分3939 开发者用 1.26M 参数模型将 htop、vim 等 TUI 实时转成 A2UI 组件
开发者训练了一个 1.26M 参数的轴向 Transformer 模型,对 TUI 屏幕的 15 类角色进行标注,再用确定性逻辑转为 Google A2UI 协议组件,使客户端无需运行终端模拟器即可接收真实 UI,按键作为 Button 动作回传。
Reddit · r/LocalLLaMAAI 评分4141 利用 Strix Halo NPU 加速本地 coding agent:Halogen 0.17.1 实测
Halogen 0.16+ 将闲置的 XDNA2 NPU 暴露为 OpenAI 风格接口,作者将其中四个模型接入真实 coding agent。0.17.1 让 NPU 调用延迟降低约 30 倍,解码速度提升约 40%;联合投机解码使双流聚合吞吐达 72.7 tok/s,串行解码 59.6 tok/s,prefill 约 1,300 tok/s。
Hacker News · 首页AI 评分3434 Pinrail:让 coding agents 等你审查的桌面收件箱
Pinrail 是一款桌面应用,让 coding agents 在执行关键步骤前停下来等待用户审查。它通过 CLI 命令接收 agent 的审查请求,在专属视图中展示代码 diff、列表、问卷、markdown 文档或生成图片等内容,用户对每项条目做出接受、拒绝或附注的结构化决定后,agent 再据此继续执行。
Hacker News · 首页AI 评分5050 Vibecoding Photoshop 替代品盘点:四款 AI 智能体驱动的 Photoshop 克隆工具评测
文章盘点了四款 Vibecoding 产生的 Photoshop 替代工具,Photon Studio(闭源免费,支持本地 AI 模型与智能体调用)、PhotoCraft(纯 Rust 编写的开源 clean-room 重写)。
Hacker News · 首页AI 评分2727 Berth:让 Claude Code、Codex 等编码智能体在 Mac 休眠时持续运行的桌面客户端
Berth 是一款面向 macOS(Apple silicon 与 Intel)的开源桌面客户端,可在本地开发机上运行 Claude Code、Codex 等编码智能体,用户关闭 Mac 后智能体继续工作。支持 ⌘N 一键创建 worktree 并启动智能体,多个 worktree 可同屏对比,命令、读取、diff 均实时呈现;内置 19 套主题并支持自定义聊天背景。
Reddit · r/MachineLearningAI 评分2727 SWE-Race:基于 188 个真实并发缺陷的编程 Agent 评测基准,三款模型结果出炉
SWE-Race 是一个收录约 100 个 Python 项目合并 PR 中真实并发缺陷(竞态、死锁、取消问题)的编程 Agent 评测基准,含 188 个任务,每个任务在无网络容器中由项目自带测试打分。
Product Hunt · AI 分类AI 评分3131 Brnch:面向人与 AI 编码智能体协作的代码托管平台
Brnch 是一款面向人与 AI 编码智能体协作的代码托管平台,基于 Git 构建,兼容现有工具链。每个 AI 智能体拥有独立身份并由用户作为 sponsor 担保,可追溯到具体代码行的改动;每次合并都对最终落地结果进行测试,并附带可验证的签名回执。
Reddit · r/LocalLLaMAAI 评分7272 LocalMind 在浏览器标签页中流式运行 Gemma 4 26B-A4B 与 Qwen3.6 MoE 模型
作者发布 LocalMind:一个通过 WebGPU 在浏览器标签页内运行的静态网页推理引擎,新增两套可在生成过程中按需从磁盘流式读取 MoE 专家权重的引擎。
Hacker News · 首页精选AI 评分7777 Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。
推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。
Product Hunt · AI 分类AI 评分3636 Reviu:一款用于审查 AI 智能体代码的原生桌面应用发布
Reviu 是一款原生桌面应用,用于在代码推送前审查 AI 智能体编写的代码。它支持运行 Claude Code、Codex、Gemini 等 ACP 智能体,可在持久会话中检查每次 diff、向智能体发回评论,并直接在应用内完成 stage、rebase、commit、开 PR 及审查 GitHub pull requests。
Product Hunt · AI 分类AI 评分3737 GeckIt:把多 Claude Code 会话搬到 Kanban 看板的开源工具
GeckIt 是一款开源工具,可将多个 Claude Code 会话并排显示在 Kanban 看板上,区分运行中、等待用户和已完成状态。它直接复用用户自己的 Claude 订阅运行 Claude Code,无需额外 API key,并支持 macOS、Windows 与 Linux,免费可用。