#编码
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#编码
今日 6 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/artificialAI 评分1414 Reddit 用户讨论如何让 Claude、Codex 等模型直接使用 REA、Ghidra 等 MCP 智能体技能进行游戏逆向与 mod 开发
Reddit 用户反映 Claude 和 Codex 在调用 REA、Ghidra 等 Agentic MCP 技能对专有二进制代码进行反编译和构建 mod 时,反复以法律与版权为由拒绝执行;但同时看到有用户晒出同类模型直接逆向其他游戏、复改代码并合成 pass-through mod 的成功案例。
Hacker News · 首页AI 评分6767 pingdotgg 用大模型把 TypeScript 编译器端口到 Rust 端并发布 tsc-rs
作者 pingdotgg 发布 tsc-rs,把微软 TypeScript 编译器(基于 Go 的 microsoft/TypeScript)用大模型移植到 Rust,对应上游 7.1.0-dev(673a5f17d713)。
Reddit · r/artificialAI 评分1616 AI 工程师职业边界未定型,独立开发者如何在大平台收编前保持自主性
一名独立工程师在 Reddit 提出:当前 AI 工具已足够强,个人或小团队可以独立完成原本需要大组织才能构建的产品,但 AI 工程师、智能体工程师等新角色的职业边界、认证与实践体系尚未定型,这与早期独立游戏程序员、自由软件作者和早期 Web 开发者的处境类似。
Reddit · r/LocalLLaMAAI 评分2626 双卡 CMP 170HX 64GB 部署 GLM-5.3-Flash 384K 上下文方案与 Qwen3.8 实测对比
玩家在两张 64GB CMP 170HX 显卡上跑通了 GLM-5.3-Flash 的 EXL3 3.05bpw 量化方案,目标权重约 125.2GB 全驻留 HBM,配合 DFlash2 6bpw 草稿模型实现 384K 上下文,单请求预算约 392,960 tokens,生成速度约 90 tok/s。
Hacker News · 首页精选AI 评分8080 Anthropic 发布 Claude Haiku 5.5,主打高吞吐低成本任务
Anthropic 发布 Claude Haiku 5.5,主打高吞吐、成本敏感型任务,是其迄今最便宜、最快、能力最强的小模型。
推荐理由:原文把新模型的价格、速度、子智能体定位和基准成绩一次性给出,方便对比 Haiku 4.5 与同级模型的取舍。
GitHub Blog · AI & ML精选AI 评分6262 GitHub 推出 ModernBERT 密钥分类器扩展 Push Protection
GitHub 与 Microsoft Applied Sciences 构建了微调的 ModernBERT 分类器,可在不到 2 milliseconds 内评估一组候选密钥,并让可阻止的密钥数量增加一倍以上。
推荐理由:GitHub 用九个季度的数据说明密钥泄露风险未随代码量明显上升,并公开了保护机制扩展到非结构化密钥的方法。
Reddit · r/artificialAI 评分66 用 Claude + VS Code 开发 SaaS 与项目时如何规划学习路径与应对 token 限额
该用户已是 AI 技术爱好者,正使用 Claude 与 VS Code 在终端开发 SaaS、社区和站点/配送类项目,但感到缺乏方向、流程容易迷失,也受困于 token 限额(已使用 RTK 压缩消耗,额度用完后几乎无法继续)。
Hacker News · 首页AI 评分2828 软件工程师如何避免沦为"永远的新人":在 AI 智能体时代培养自己向 Senior 进阶的技能
AI 智能体正在改变软件工程师的工作方式,但更值得警惕的是"Senior 消失"——所有人在 LLM 与 AI 智能体的辅助下沦为只能互相审阅代码的"永远的新人"。
量子位 QbitAIAI 评分2727 "AI不说人话"引热议:Coding 场景模型输出集体文言化,Gemini 凭何仍是例外
多款 AI Coding 模型在交付汇报中频繁使用"单腿哑火""15/15 全绿""对拍"等黑话,被开发者吐槽"全球 AI 表达能力集体倒退两千年,重新进入文言文纪元"。
Hacker News · 首页AI 评分1818 AI 编程让人不满的五个理由:代码艺术、就业、人机协作、工程规则与公司伦理
文章逐一拆解了五种反对 AI 编程的常见理由:把代码视为艺术而否定生成代码、认为 AI 偷走了编码工作、把人类降为软件任务的"中介"、质疑 AI 无法遵循 SOLID 等工程规则,以及担忧大型 AI 公司利益与社会背离。作者引述马克思《机器论片断》和 Babbage 的论述指出,智力劳动被机器取代是资本生产方式的内在逻辑,技术本身并未"夺走"工作。
Reddit · r/artificialAI 评分2121 用 Claude Code 写了一个帮你"停下来"的应用,结果我熬到了凌晨两点
作者用 Claude Code 开发了一款"未完成项目存档"小应用:截图、记录已实现与待修复内容、写下回来后第一步该做什么,让中断项目变得更容易重启。但他本人在调缩略图细节时反复觉得"再花五分钟就好",一路从晚间改到凌晨两点女友已经睡着,应用本想帮人停下来,他自己却最不会用这个功能。作者向 r/artificial 社区征集"什么时候真的合上电脑"的经验。
Hacker News · 首页AI 评分2828 State of Devs 2026 调查:开发者职业不确定性与 AI 影响加剧
Devographics 2026 年度开发者调查共回收 5,463 份问卷,显示近半数受访者曾经历职业不安全感,约四分之一遭遇过裁员;62% 曾在职业生涯中出现职业倦怠,与去年持平。
Reddit · r/ChatGPTAI 评分77 开发者用 ChatGPT 构建微内核操作系统,寻求加速完成的方法
一名开发者正在用 ChatGPT 协助构建一款微内核操作系统,目前已实现音频、视频、网络与文件系统等大部分功能,计划以开源许可证发布。作者反馈 ChatGPT 出现响应变慢、修复一个问题常引发其他回归的情况,正考虑切换其他模型或优化提示词,并计划以每次约 300 行代码的节奏继续推进。
Reddit · r/LocalLLaMAAI 评分3232 pi-optchat:基于二叉记忆树的无限对话 Pi 扩展
pi-optchat 是 Pi 的扩展,实现 Victor Taelin 的 OptChat 方案:不压缩对话,而是把每条消息记录并摘要成二叉树,每轮以 128 KB 的有界记忆视图开启新上下文,需要时再通过 zoom/date 读取原文。它支持多 profile、后台 subagents、Claude Code/Codex/ChatGPT 历史导入以及多窗口联动。
Reddit · r/ChatGPTAI 评分66 网友分享用 ChatGPT 开发 Minecraft Create 模组附加包的经验
一名无开发经验的网友尝试用 ChatGPT 编写 Minecraft Create 模组附加包,目前进展顺利,ChatGPT 在代码增补和细节调整上没有出现明显问题。他发帖征集其他用户用 ChatGPT 做游戏 mod 的经验,并寻求让流程更顺畅的建议。
Reddit · r/ChatGPTAI 评分66 Reddit 用户发现 ChatGPT 可主动建议切换到 work 模式
一名用户在编写 Maxscript 时向 ChatGPT 询问是否应切换到 work 模式以应对复杂任务,ChatGPT 直接给出了切换选项。该用户表示此前并不知道 ChatGPT 具备主动建议切换模式的能力。
Hacker News · 首页AI 评分1818 Vibecoding 不如手写代码有趣:一位开发者的亲身体验与反思
一位开发者在尝试 AI 辅助编程(vibecoding)后发现,尽管 vibecoding 能让原型快速成型并带来短期快感,但手写代码过程中"硬啃下来的成就感"和"学习带来的乐趣"无法被 AI 替代。
Hacker News · 首页AI 评分4444 Jotbus:面向 Claude Code、Codex 等编码智能体的端到端加密共享协作共享夹
Jotbus 是一款端到端加密的共享协作夹,让 Claude Code、Codex、Cursor、Gemini CLI、opencode、GitHub Copilot CLI、Windsurf、Qwen Code 等编码智能体及任何 MCP 客户端跨机器共享笔记、文件和接手任务,无需注册即可通过 `npx jotbus` 创建 60 分钟工作空间。
Mistral AI精选AI 评分8585 Mistral 发布 Mistral Large 4 公开预览:1 万亿参数原生多模态模型
Mistral 发布 Mistral Large 4(昵称 le Chonk)公开预览 API,模型为 1 万亿总参数、490 亿激活参数的原生多模态模型,权重计划本月底开源,由 Mistral 欧洲自建数据中心用 3,800 张 NVIDIA Grace Blackwell GPU 训练。
推荐理由:1 万亿参数原生多模态模型公开预览并在网络安全、编码与视觉任务上对标开源前沿,可作为开源权重模型能力上限的参考基线。
Reddit · r/LocalLLaMAAI 评分4040 Qwen3.8-Flash-Next 本地运行 vs Claude Opus 5.5:同一 Rust 任务对比实测
网友在 Strix Halo 笔电(128GB)上用 Qwen3.8-Flash-Next(xhigh effort)与 Claude Opus 5.5(medium effort)完成同一 LlamaStash Rust 功能;Flash-Next 约 130 分钟完成并合并,Opus 5.5 约 18 分钟,费用 $7.53 vs 本地 $0 加约 0.15 kWh。
Reddit · r/LocalLLaMAAI 评分1818 千问 Qwen3.8 27b 与 flash next 实测对比:27b 在简单编码工作流中更胜一筹
一名用户在自托管 unsloth/Qwen3.8-27B-GGUF:Q4_K_XL(llamacpp、130K 上下文窗口)与阿里云 Qwen 套餐 flash next(上下文封顶 256K)的对比中发现。
Reddit · r/MachineLearningAI 评分2727 SWE-Race:基于 188 个真实并发缺陷的编程 Agent 评测基准,三款模型结果出炉
SWE-Race 是一个收录约 100 个 Python 项目合并 PR 中真实并发缺陷(竞态、死锁、取消问题)的编程 Agent 评测基准,含 188 个任务,每个任务在无网络容器中由项目自带测试打分。
Product Hunt · AI 分类AI 评分2626 Appto:基于 Claude Code / Codex 的 macOS iOS 应用工厂
Appto 是一款运行在 Mac 上的 iOS 应用自动生产工具,能根据已有盈利的细分市场发现机会,并完成应用设计、编码、生成多语言 App Store 页面(含截图和 ASO 文案)以及填写 App Store Connect。它支持发布后实时追踪每笔销售、回复评论、监控关键词并建议修复,且依托用户的 Claude Code 或 Codex 订阅运行,不产生额外的 token 费用。
Reddit · r/LocalLLaMAAI 评分1818 GLM-5.3 Flash 用于生产级代码库:替代前沿模型的实测体验与训练细节讨论
一名开发者称其公司在涉及数百万行代码的生产环境中,用 GLM-5.3 Flash 承担日常编码工作,替代了前沿模型。该模型在仓库探索、特性实现、重构和理解大型代码库方面表现超出预期,速度快且未以牺牲能力为代价。原帖重点询问其代码训练管线细节,包括代码预训练/后训练规模、合成数据占比、是否从更大 GLM 模型蒸馏以及针对仓库级与多文件任务的训练方式。
Reddit · r/LocalLLaMAAI 评分4545 Western 开源 AI Reflection 终于亮相,推出首个开放模型 Beam
Reflection AI 正式发布首个开放模型 Beam,由前 DeepMind 成员创立,定位于非中国厂商的开源替代方案,主打编程与 AI 智能体方向,号称效率高出其他开源模型 3-4 倍。公司估值达 250 亿美元,并已开始训练下一代模型。
Hacker News · 首页AI 评分2828 为什么 Common Lisp 现在是最佳编程语言
作者认为 Common Lisp 现在是最佳编程语言,因为 LLM 改变了编程瓶颈:写代码变快后,反馈循环和调试速度成为关键。Common Lisp 基于 image 存储,函数可热替换且程序崩溃时直接进入包含完整栈和变量的调试器,作者称它是唯一同时具备这些特性的主流语言。
Reddit · r/LocalLLaMAAI 评分1515 Qwen 3.8 27B 实际使用体验是否被高估:开发者反馈其在复杂任务上常陷入思考循环
一位拥有 32GB VRAM 的软件开发者使用 Unsloth Q6 量化版本的 Qwen 3.8 27B(搭配 OpenCode)后反馈,该模型在小任务上表现尚可,但在需要一定复杂度的任务中频繁陷入"but wait""actually"等思考循环,甚至耗尽 95k 上下文窗口仍无产出。
Reddit · r/LocalLLaMAAI 评分2626 CivBench 评测大语言模型打《文明 5》游戏能力,GLM-5.3 领先 Opus-5.5
研究者发布更新版 CivBench 基准,测试大语言模型在《文明 5》中的长链策略能力。所有模型在三个相同固定开局下轮换对战,每局由两个被测 LLM 文明与六个 Vox Populi AI 对手组成。
AWS Machine Learning BlogAI 评分1919 智谱 GLM 5.3 上线 Amazon Bedrock,主打编码与长链路智能体任务
智谱(Z.ai)的 GLM 5.3 现已在 Amazon Bedrock 上线,面向企业客户提供全托管 API 接入。该模型为 753B 参数的 MoE 架构,专为编码与长链路智能体任务优化,发布时在 CyberGym 基准上取得 84.5 分。Bedrock 同时提供跨区域推理、隐式与显式 prompt caching,以及 Flex / Priority / Standard 三档服务等级。
Hacker News · 首页AI 评分2727 Worth Building:LLM 时代下,一个人用 Claude Code 周末写出一款域名的简单工具
借助 Claude Code,作者在一个周末内用三段 prompt 和约一小时构建并部署了 heade.rs:一款提供 DNS 与注册记录、实时延迟、邮箱配置与 HTTPS 详情的域名查询工具,月运行成本不到一杯咖啡,无需销售变现。
Hacker News · 首页精选AI 评分7777 Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。
推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。
Reddit · r/LocalLLaMAAI 评分2525 单卡 RTX5090 跑本地 LLM 推理遇瓶颈:解码速度足够快,CPU 反而成为智能体编码的真正瓶颈
开发者将 Kenshi 项目移植到 Godot,使用单张 RTX5090 跑本地 LLM 推理服务,GPU 平均解码约 700t/s 却无法再提速;启动 25 个智能体并发占满 12 个服务槽位后,任务卡在 tool call 阶段,CPU 满载。
AWS Machine Learning BlogAI 评分3030 Amazon SageMaker AI 推出 aws-ai-ml 技能,为编码 Agent 提供推理优化能力
Amazon SageMaker AI 发布 aws-ai-ml 技能,可接入 Kiro、Claude Code、Codex 等支持 MCP 的编码 Agent,让其具备推理端点基准测试、部署配置推荐和 SageMaker Python SDK v3 代码生成能力。
AWS Machine Learning BlogAI 评分3030 在 AWS GovCloud (US) 中用 Claude Code 与 Amazon Bedrock 加速受监管工作负载
Anthropic Claude Opus 5.5 与 Claude Sonnet 5.5 已在 AWS GovCloud (US) 区域 Amazon Bedrock 上可用。
Reddit · r/LocalLLaMAAI 评分2222 用户反馈 Qwen3.8-Flash-Next 在编码场景中过于主动调用工具
开发者反馈 Qwen3.8-Flash-Next 在编码和作为语音 Agent 大脑使用时过于急切,倾向未经确认就直接修改代码、创建 issue 或在一次回复中同时提问并调用工具保存答案。
GitHub Blog · AI & MLAI 评分3636 GitHub 推出 ReviewBench:面向 AI 代码评审智能体的开源基准
GitHub 发布开源代码评审基准 ReviewBench,涵盖 19 种语言的 219 个公开 pull request,其语言与仓库规模分布基于对 103.9M 个 GitHub pull request 的分析建模而成。
Hacker News · 首页AI 评分4545 Gitframes:面向 AI 编码智能体的代码优先视频生成 npm 包
Gitframes 是一个 npm 包,将 Photoshop 级合成、After Effects 级动效和 Blender 级 3D 场景整合在一起,供智能体通过 TypeScript 直接驱动并渲染 MP4,绕开无头浏览器和 DOM 重排。
Reddit · r/ChatGPTAI 评分3333 Codex 可基于 YouTube 视频逆向重建 1983 年《Starwars》街机游戏
用户向 Codex 发送一段 1983 年《Starwars》街机游戏的 YouTube 视频,要求它在 Love2D 中以宽屏比例重新构建,包含 3D 画面、音效、人物对白、关卡、计分板和演示模式。Codex 在约 30 分钟内先从视频中截取截图和音频片段,再用不同语言和平台(非模拟)代码写出了近乎完全一致的复刻版本。
Reddit · r/ChatGPTAI 评分1616 Reddit 用户整理 285 款用 Claude、ChatGPT 等 AI 工具制作的浏览器游戏目录
Reddit 用户 friuns 发布了一份浏览器游戏目录,收录 285 款由 Claude、ChatGPT 等 AI 工具制作的 AI 编程 demo,每个条目附带可玩链接、截图及源代码或作者出处,并按 Opus、Sonnet、Astra 以及模型未知的"uncertain"分类。目录页面提供浏览与筛选功能,作者开放征集新提交与反馈。
Reddit · r/artificialAI 评分1010 独立开发者推 schema-based AI 网站构建器,主打 token 节省,beta 发布前征集反馈
一位独立开发者正在构建一款 AI 网站构建器,采用与 Lovable、Bolt、Replit 不同的方案:基于预定义 schema 与渲染系统,让 AI 先生成结构化数据再渲染网页,相比持续生成代码可降低 token 用量并提升生成速度与可预测性。该工具还将内置域名连接与发布流程。开发者定位其核心卖点为"token 最省",并在 beta 发布前向社区征集产品方向与差异化策略建议。