交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 8 条编程 · 工具·提示词·论文 三栏速览
每栏 1 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/artificialAI 评分1414 Reddit 用户讨论如何让 Claude、Codex 等模型直接使用 REA、Ghidra 等 MCP 智能体技能进行游戏逆向与 mod 开发
Reddit 用户反映 Claude 和 Codex 在调用 REA、Ghidra 等 Agentic MCP 技能对专有二进制代码进行反编译和构建 mod 时,反复以法律与版权为由拒绝执行;但同时看到有用户晒出同类模型直接逆向其他游戏、复改代码并合成 pass-through mod 的成功案例。
Reddit · r/MachineLearningAI 评分3939 开发者用 1.26M 参数模型将 htop、vim 等 TUI 实时转成 A2UI 组件
开发者训练了一个 1.26M 参数的轴向 Transformer 模型,对 TUI 屏幕的 15 类角色进行标注,再用确定性逻辑转为 Google A2UI 协议组件,使客户端无需运行终端模拟器即可接收真实 UI,按键作为 Button 动作回传。
Hacker News · 首页AI 评分6767 pingdotgg 用大模型把 TypeScript 编译器端口到 Rust 端并发布 tsc-rs
作者 pingdotgg 发布 tsc-rs,把微软 TypeScript 编译器(基于 Go 的 microsoft/TypeScript)用大模型移植到 Rust,对应上游 7.1.0-dev(673a5f17d713)。
Reddit · r/LocalLLaMAAI 评分2929 Strata 实测:可靠性堪忧,12 小时编程测试出现多次严重幻觉与生成错误
用户在 12 小时编程测试中发现 Strata 出现三类关键故障:混淆是否真的写入了执行报告、幻觉读取工具输出(误读路径中的数字"5")、以及反复写出畸形代码到不存在的路径。
Reddit · r/LocalLLaMAAI 评分4141 利用 Strix Halo NPU 加速本地 coding agent:Halogen 0.17.1 实测
Halogen 0.16+ 将闲置的 XDNA2 NPU 暴露为 OpenAI 风格接口,作者将其中四个模型接入真实 coding agent。0.17.1 让 NPU 调用延迟降低约 30 倍,解码速度提升约 40%;联合投机解码使双流聚合吞吐达 72.7 tok/s,串行解码 59.6 tok/s,prefill 约 1,300 tok/s。
AWS Machine Learning BlogAI 评分5252 Claude Haiku 5.5 在 Amazon Bedrock 上线
AWS 宣布 Anthropic Claude Haiku 5.5 即日起在 Amazon Bedrock 与 Claude Platform on AWS 提供。
Hacker News · 首页AI 评分3434 Pinrail:让 coding agents 等你审查的桌面收件箱
Pinrail 是一款桌面应用,让 coding agents 在执行关键步骤前停下来等待用户审查。它通过 CLI 命令接收 agent 的审查请求,在专属视图中展示代码 diff、列表、问卷、markdown 文档或生成图片等内容,用户对每项条目做出接受、拒绝或附注的结构化决定后,agent 再据此继续执行。
Reddit · r/LocalLLaMAAI 评分2828 Liquid AI 发布 d1-omni-600M,作者用 WebGPU 在浏览器中运行
Liquid AI 发布 600M 参数的 d1-omni-600M 决策模型,作者将其移植到自研的 WebGPU 推理库 runntime,纯 TypeScript 实现并直接加载 HF safetensors 权重,无 WASM 中间层。
Product HuntAI 评分1111 SunSed:面向 AI 的应用开发平台
SunSed 是一款 AI-native 应用开发平台,主打用经过封装的可靠组件替代让 AI 从零生成易碎代码的方式,强调极高的 token 效率、零构建错误,并规避传统 AI 生成器常见的代码腐烂问题。每个订阅捆绑托管服务、独立数据库、事务邮件、用户认证、文件存储和自动备份,目标是让 AI 直接构建可上线的生产级应用。
Product HuntAI 评分2020 Postquel:可调用 Claude Code、Codex或 Cursor 的原生 macOS PostgreSQL 客户端开源
Postquel 是一款面向 macOS 的原生 PostgreSQL 客户端,免费开源。其 AI 功能直接复用用户已有的 Claude Code、Codex 或 Cursor 订阅,能读取真实数据库 schema,但仅具备只读权限,所建议的任何修改都需用户手动 dry-run 并应用。
Product HuntAI 评分66 Reika:一款优先面向本地模型的 coding agent CLI
Reika 是一款面向本地与托管模型的 coding agent CLI,以本地模型为优先设计目标。它并不能让小模型变得更智能,但能提供更顺畅的日常使用体验;对超出其目标算力区间、运行更大本地模型或托管模型的用户,也能开箱即用获得稳定表现。
Reddit · r/LocalLLaMAAI 评分2525 训练出约 2 万参数的 MacroStories,可能是目前能写故事的最小语言模型
Reddit 用户训练出一款名为 MacroStories 的微型语言模型,仅有 19,969 个参数、81 KB FP32 大小,体积约为 1M 参数 TinyStories 模型的 1/50。
Reddit · r/ChatGPTAI 评分1515 Opus 4.5 与 Sol 6.1 任务完成度对比反差明显
一名 Reddit 用户用相同的提示词分别测试 Sol 6.1 和 Opus 4.5 两款模型,要求它们在 10 欧元预算内完成一个家庭社交应用的搭建。结果 Sol 6.1 仅停留在"pursuing goal stalled"状态未交付任何成果,而 Opus 4.5 自主选定域名并完成了整个应用的构建。该用户在帖子中以 TLDR 形式总结这一反差,但尚未对最终产物进行测试。
Reddit · r/ChatGPTAI 评分4141 用 ChatGPT 中的 GPT-6 Astra 一天做出移动游戏 Reactor Town
作者用 Codex 中的 GPT-6 Astra(开启 Ultrafast mode)在一天内完成了一款 Android 竖屏游戏 Reactor Town,游戏上半部分为等距像素小镇、下半部分为落沙反应堆沙盒,电量供需匹配推动小镇成长、解锁材料与设备。
Simon WillisonAI 评分2929 llm-openai-decisions 0.1a0 发布,接入 OpenAI 新版 Decisions API
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,对接 OpenAI 在 DevDay 公布的 Jev 风格 Decisions API,支持三种问题类型。该 API 底层使用 gpt-6-luna 模型,相比 Jev 额外支持图像输入,按输入 token 计费,价格为每百万 0.10 美元。
Reddit · r/ChatGPTAI 评分77 开发者用 ChatGPT 构建微内核操作系统,寻求加速完成的方法
一名开发者正在用 ChatGPT 协助构建一款微内核操作系统,目前已实现音频、视频、网络与文件系统等大部分功能,计划以开源许可证发布。作者反馈 ChatGPT 出现响应变慢、修复一个问题常引发其他回归的情况,正考虑切换其他模型或优化提示词,并计划以每次约 300 行代码的节奏继续推进。
Hacker News · 首页AI 评分5050 Vibecoding Photoshop 替代品盘点:四款 AI 智能体驱动的 Photoshop 克隆工具评测
文章盘点了四款 Vibecoding 产生的 Photoshop 替代工具,Photon Studio(闭源免费,支持本地 AI 模型与智能体调用)、PhotoCraft(纯 Rust 编写的开源 clean-room 重写)。
Hacker News · 首页AI 评分2727 Berth:让 Claude Code、Codex 等编码智能体在 Mac 休眠时持续运行的桌面客户端
Berth 是一款面向 macOS(Apple silicon 与 Intel)的开源桌面客户端,可在本地开发机上运行 Claude Code、Codex 等编码智能体,用户关闭 Mac 后智能体继续工作。支持 ⌘N 一键创建 worktree 并启动智能体,多个 worktree 可同屏对比,命令、读取、diff 均实时呈现;内置 19 套主题并支持自定义聊天背景。
Reddit · r/ChatGPTAI 评分66 Reddit 用户发现 ChatGPT 可主动建议切换到 work 模式
一名用户在编写 Maxscript 时向 ChatGPT 询问是否应切换到 work 模式以应对复杂任务,ChatGPT 直接给出了切换选项。该用户表示此前并不知道 ChatGPT 具备主动建议切换模式的能力。
Reddit · r/LocalLLaMAAI 评分1515 llama.cpp 新增 K2 Horizon dense 与 MoVA 模型支持
llama.cpp 提交 PR #29535,新增对 K2 Horizon dense 与 MoVA 模型的支持。该 PR 由 bitalov 提交,目的是在 ggml-org/llama.cpp 中加入上述模型架构的推理能力。
Hacker News · 首页AI 评分2525 Tapo 开源 Rust/Python 客户端在 v0.11.1 加入 TPAP 协议支持,可在 TP-Link 第三方兼容开关关闭时控制插头与灯具
tapo 开源 Rust 与 Python 客户端在 v0.11.1 新增对 TP-Link TPAP 协议的支持,使运行固件 1.4.0 及以上的灯具、插头、插线板和 H100 hub 能在 Tapo 应用的"Third-Party Compatibility"开关处于关闭状态时被客户端连接,无需修改代码。
Reddit · r/LocalLLaMAAI 评分1515 NInfer6000 在 RTX 6000 上跑 Qwen 3.8 Flash Next,token 生成达 400 tg/s
网友基于 NInfer 改写的 NInfer6000 分支在 RTX 6000(96GB VRAM)上运行 Qwen 3.8 Flash Next,将非专家层从 16-bit 下采样到 8-bit 并启用 MTP3 解码与小型 drafting head 后,在理想条件下达到 400 tok/s 生成速度。
Reddit · r/LocalLLaMAAI 评分1313 德国 Aleph Alpha Kolibri 模型通过 Tesseracted 托管生成 Nim 代码
德国 Aleph Alpha 的小模型 Kolibri 由 Tesseracted 提供托管,在 3code 上用完整小众语言 Nim 写出了一段可运行的小型命令行工具。模型、托管方、运行环境和编程语言均产自德国,体现了德国本土 AI 栈的端到端能力。鉴于模型体量较小,能在 Nim 这类冷门语言上跑通代码被认为颇为难得。
Reddit · r/MachineLearningAI 评分2727 SWE-Race:基于 188 个真实并发缺陷的编程 Agent 评测基准,三款模型结果出炉
SWE-Race 是一个收录约 100 个 Python 项目合并 PR 中真实并发缺陷(竞态、死锁、取消问题)的编程 Agent 评测基准,含 188 个任务,每个任务在无网络容器中由项目自带测试打分。
Product Hunt · AI 分类AI 评分1010 CodeCrab:100% 本地优先的 AI Pull Request 评审桌面应用
CodeCrab 是一款原生桌面应用,可在本地通过 CLI 在数秒内审阅 Pull Request,全程 100% 客户端运行,代码不离开用户机器。该工具已在 Product Hunt 首发并提供免费下载,由团队基于 TinyFish 构建。
Product Hunt · AI 分类AI 评分3737 开源 GitHub PR 桌面评审工具 Review:支持多 AI 模型协作审查
Review 是一款开源(MIT)的免费桌面工具,可在 Mac、Windows 和 Linux 上评审 Git 分支与 GitHub PR,支持逐行评论且发布前保持私密。内置 AI 评审功能,可接入 OpenAI、Anthropic、Gemini、OpenRouter 或通过 Ollama 接入本地模型,并能拆分任务由不同模型分别审查、显示每条规则的命中情况,仅重试遗漏部分。该工具无需账号。
Product Hunt · AI 分类AI 评分3131 Brnch:面向人与 AI 编码智能体协作的代码托管平台
Brnch 是一款面向人与 AI 编码智能体协作的代码托管平台,基于 Git 构建,兼容现有工具链。每个 AI 智能体拥有独立身份并由用户作为 sponsor 担保,可追溯到具体代码行的改动;每次合并都对最终落地结果进行测试,并附带可验证的签名回执。
Reddit · r/LocalLLaMAAI 评分7272 LocalMind 在浏览器标签页中流式运行 Gemma 4 26B-A4B 与 Qwen3.6 MoE 模型
作者发布 LocalMind:一个通过 WebGPU 在浏览器标签页内运行的静态网页推理引擎,新增两套可在生成过程中按需从磁盘流式读取 MoE 专家权重的引擎。
Reddit · r/ChatGPTAI 评分33 50 岁夫妇想用 AI 工具从零开发一款教学游戏,咨询是否可行
一名 50 岁 Atari 2600 老玩家希望为零游戏经验的伴侣开发一款类似马里奥的教学游戏,从简单类型入手逐步过渡到现代玩法与操作,自己没有开发经验,正考虑借助 AI 工具从零开始,询问这是否是一项合理的任务。
Reddit · r/LocalLLaMAAI 评分1919 ik_llama.cpp fork 新增 MoE 优化:专家常驻显存与自适应 CPU/GPU 混合执行,支持 Q2_0 量化
开发者基于 ik_llama.cpp 推出新 fork,引入带宽自适应的 CPU/GPU 混合执行与 MoE 专家常驻(expert residency)机制,并新增 Q2_0 量化支持。
Reddit · r/LocalLLaMAAI 评分1616 Kolibri-1 演示:直接输出动作概率玩 Breakout,单步推理延迟低于 25ms
用户在未做微调的情况下,让 Aleph__Alpha 的 Kolibri-1 自主游玩 Breakout,仅输出四种动作概率而不生成文本,单次推理延迟约 25ms,并强调该模型采用开源权重。该实验用于检验 Kolibri-1 在结构化输出与约束条件下的能力表现。
Reddit · r/LocalLLaMAAI 评分88 NVIDIA Blackwell 4000 与 RTX 3060 能否组合用于本地 LLM 推理
用户询问能否将一张 NVIDIA Blackwell 4000 24GB 与旧款 RTX 3060 12GB 组合,用于本地运行大语言模型(侧重编程任务),并希望了解 tensor split 是否支持这种跨代显卡混搭配置。
Hacker News · 首页精选AI 评分7777 Reflection 发布开源权重模型 Beam:501B 总参数 / 23B 激活,主打编码与智能体效率
Reflection 发布首个开源权重模型 Beam,采用稀疏 MoE 架构,总参数量 501B、激活 23B,面向编码、推理与智能体场景。模型在 23.8T token 上完成预训练,并在 10.5K 块 NVIDIA GB300 GPU 上用 4 周生成超 1 亿次 rollout 进行高算力强化学习。
推荐理由:原文给出模型规模、训练规模与推理效率数据,并承诺本月开源权重与技术报告,可作为西方开源前沿模型的参照基线。
AWS Machine Learning BlogAI 评分3030 在 AWS GovCloud (US) 中用 Claude Code 与 Amazon Bedrock 加速受监管工作负载
Anthropic Claude Opus 5.5 与 Claude Sonnet 5.5 已在 AWS GovCloud (US) 区域 Amazon Bedrock 上可用。
GitHub Blog · AI & MLAI 评分3636 GitHub 推出 ReviewBench:面向 AI 代码评审智能体的开源基准
GitHub 发布开源代码评审基准 ReviewBench,涵盖 19 种语言的 219 个公开 pull request,其语言与仓库规模分布基于对 103.9M 个 GitHub pull request 的分析建模而成。
Reddit · r/LocalLLaMAAI 评分2222 基于 40 万合成数据微调的 1.5B Qwen 模型在 bash 命令生成上达到 gpt-4o 水平,并开源微调数据集
网友 Comfortable-Rock-498 作为业余项目,将 1.5B 参数的 Qwen 模型微调用于生成 bash 命令,全部使用 40 万条合成数据进行训练,并在该任务上达到 gpt-4o 水平。作者同步开源了微调后的模型与训练数据集,公开了训练与 CLI 流程,欢迎社区自行训练或使用。
Reddit · r/LocalLLaMAAI 评分3939 Qwen3.8-Flash-Next (125B) 在单台 Strix Halo 迷你 PC 上跑通:投机解码下 44-59 tok/s,开源推理引擎同步发布
团队在搭载 Ryzen AI Max+ 395、128 GB 内存的 Strix Halo 迷你 PC 上成功运行 Qwen3.8-Flash-Next(125B MoE,激活 6B),并同步开源其推理引擎 Kyojin(基于 ExLlamaV3 构建)。
Reddit · r/LocalLLaMAAI 评分2424 在 veloGB10 上运行 Swift 1.5:xhigh 档位反超 base Flash-Next 中档 vLLM 表现
在两台 DGX Spark 上,UkisAI 基于 Qwen3.8-Flash-Next 微调的 Swift 1.5(推理高效版)借助 sf-stav 的 Rust/CUDA 推理引擎 veloGB10 实现了约 110 tok/s 的单流解码速度,运行 xhigh effort 仍比旧 vLLM NVFP4 环境下 base Flash-Next medium 档更快。
Reddit · r/LocalLLaMAAI 评分2727 开发者开源 NihonSub:基于 Whisper-Large-v3 与 Groq / DeepSeek 的日语动漫实时字幕翻译引擎
Reddit 用户 u/Grand_Marionberry115 开源 NihonSub,一个针对日语动漫的实时字幕与翻译工具,采用 ffmpeg 静音检测切分语音后。
Reddit · r/ChatGPTAI 评分3333 Codex 可基于 YouTube 视频逆向重建 1983 年《Starwars》街机游戏
用户向 Codex 发送一段 1983 年《Starwars》街机游戏的 YouTube 视频,要求它在 Love2D 中以宽屏比例重新构建,包含 3D 画面、音效、人物对白、关卡、计分板和演示模式。Codex 在约 30 分钟内先从视频中截取截图和音频片段,再用不同语言和平台(非模拟)代码写出了近乎完全一致的复刻版本。