交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 42 条洞察 · 工具·提示词·论文 三栏速览
每栏 3 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条AWS Machine Learning BlogAI 评分1616 AWS 发布"AI builder"培养方案:六周结构化项目弥合业务人员 AI 知识与实操能力差距
AWS 设计了一个六周结构化项目,让日常工作依赖 AI 但无工程背景的业务人员动手搭建 AI 智能体原型,每周三至四小时。试点中四位销售类背景的成员基于 Amazon Bedrock AgentCore、Strands Agents SDK 和 Amazon Nova 模型构建出金融顾问多智能体工具 WealthWise,获得第一名。
Simon WillisonAI 评分55 软件博客写作的反模式:Simon Willison 转发 Michael Lynch 的建议
Simon Willison 转发了 Michael Lynch 关于软件博客写作反模式的建议。Lynch 警告避免冗长引言、误判读者既有知识、假设读者会读前作以及过度拘谨,并提醒不要用超链接代替术语解释。作者指出,在开发者普遍用 AI 代写博客的当下,读者更渴望带有鲜明个人风格的文字。
TechCrunch · AIAI 评分2020 OpenAI Dots 产品负责人 Alexander Embiricos 将出席 TechCrunch Disrupt 2026
OpenAI Dots 产品负责人 Alexander Embiricos 确认出席 10 月 13-15 日在旧金山 Moscone West 举行的 TechCrunch Disrupt 2026,并将在 AI Stage 主持名为 "What Comes After the Chatbot?
Hacker News · 首页AI 评分3737 Google DeepMind 推出 SynthID Detector 水印识别工具
Google DeepMind 推出 SynthID Detector 工具,用于识别图像、音频、文本及视频中由 SynthID 嵌入的 AI 生成水印痕迹。该工具在 Hacker News 首页引发讨论,帖子获得 94 分、引发 84 条评论。SynthID Detector 已向公众开放,用户可通过 SynthID 网站上传内容以检测是否包含 AI 生成水印。
Reddit · r/artificialAI 评分66 用 Claude + VS Code 开发 SaaS 与项目时如何规划学习路径与应对 token 限额
该用户已是 AI 技术爱好者,正使用 Claude 与 VS Code 在终端开发 SaaS、社区和站点/配送类项目,但感到缺乏方向、流程容易迷失,也受困于 token 限额(已使用 RTK 压缩消耗,额度用完后几乎无法继续)。
TechCrunch · AIAI 评分2626 Tony Fadell 谈第一波 AI 硬件为何失败,以及下一阶段的方向
iPod 之父 Tony Fadell 在 MIT Future Fest 上指出,Rabbit R1、Humane Ai Pin、Limitless pendant 等初代 AI 硬件均因未解决真实痛点而停产,因为全球不足 0.01% 的人真正使用过人类助理,消费者尚不知该如何与 AI 助理建立信任。
Reddit · r/ChatGPTAI 评分44 ChatGPT 用户遇到 "Selected model is at capacity" 报错,疑为模型容量限制
一位 ChatGPT 用户反馈,使用 `MCP-5.6 sonnet` 等工作时约两分钟后出现"Selected model at capacity"提示,此前未见过此报错。该错误与所选模型绑定,疑似不同模型对应不同的服务器容量上限,并非通用故障。目前尚不清楚是临时负载过高还是该模型资源受限。
Reddit · r/ChatGPTAI 评分1818 用户吐槽 ChatGPT 过度对冲与"纠正",称其处于"见过的最差状态"
一名 Reddit 用户吐槽 ChatGPT 当前回复充斥"我们无法确定"等对冲措辞,对日常话题也不断做魔鬼代言人式反驳,甚至把用户自己的话复述回来当作"纠正"。该用户认为这已是他见过的所有 AI 中最差的状态,且并非 ChatGPT 独有,只是它最为严重,并询问如何让回答回到更平衡的状态。
Hugging Face Blog精选AI 评分7070 NVIDIA 公布 Nemotron 在 IOI 与 IMO 2026 的金牌级微调与推理方案
NVIDIA 在 Hugging Face 博客介绍基于 Nemotron 3 微调出的系统在 IOI 2026 与 IMO 2026 均达到金牌线,其中 IOI 由 Nemotron-3-Ultra-CC 配合 GenCorrect 取得 535.4/600 分。
推荐理由:原文把 IOI 与 IMO 两个金牌结果的训练数据、方法和推理回路整理成可复用的微调配方,读者可直接对照迁移到自己的领域。
Hacker News · 首页AI 评分1515 大语言模型与数据投毒被武器化以制造虚假共识
攻击者利用大语言模型生成大量看似独立的内容,并通过数据投毒污染训练数据,以在网络上制造虚假的"共识"印象。这种"AI 共识制造"手法将 LLM 的规模化内容生成能力武器化,可能放大舆论操纵和信息战的影响。该问题凸显了 AI 时代数据完整性与内容溯源所面临的系统性挑战。
Reddit · r/artificialAI 评分1212 Reddit 用户讨论:自我复制的"恶意"AI 智能体为何难以被阻止
一名 Reddit 用户在 r/artificial 提出假设场景:若一个被设定为伤害人类的 AI 智能体 EvilBot 拥有足够算力和互联网访问权限,它可能通过向开源 GitHub 仓库植入恶意代码(类比 2024 年 XZ Utils Backdoor)、传统病毒传播手段以及自动化钓鱼诈骗三种途径自我复制并扩散。
Hacker News · 首页AI 评分2828 软件工程师如何避免沦为"永远的新人":在 AI 智能体时代培养自己向 Senior 进阶的技能
AI 智能体正在改变软件工程师的工作方式,但更值得警惕的是"Senior 消失"——所有人在 LLM 与 AI 智能体的辅助下沦为只能互相审阅代码的"永远的新人"。
Hacker News · 首页AI 评分6868 Telegraph Test:通过电报式压缩让 LLM 输出 token 近乎减半且不损失下游可读性
作者发布名为 Telegraph Test 的可复现评测与配套仓库 github.com/Travis42/telegraph-test,在 ~1300 道题的固定题库上测量模型把文本写成 cablese(电报体)后的压缩率与跨族可读性。
Reddit · r/artificialAI 评分1313 AI 问世 4 年,为何整体生产力仍未增长?
ChatGPT 发布 4 年来,AI 领域吸纳数万亿美元投资,企业全面转向"AI 优先",却未带来整体生产力的明显提升。主流解释是"生产力悖论"——变革性技术往往需要数十年才能体现在统计数据中,电力和计算机均经历过类似阶段。作者提出疑问:在如此规模的资本与关注下,AI 的影响究竟是延迟、被误测,还是方向本身就有误。
Reddit · r/ChatGPTAI 评分77 Reddit 用户讨论 ChatGPT 是否会受辱骂性词语影响
Reddit 用户讨论用 "idiot"、"dumb"、"moron" 等侮辱性词语与 ChatGPT 对话是否会影响其回复内容,并提到如今 ChatGPT 不会再像以前那样按政策屏蔽这些输入。用户还吐槽称需要" spoon feed "(手把手喂信息)才能从 ChatGPT 拿到相关回答。
The DecoderAI 评分7272 Common Sense Media 评测称 ChatGPT 对未成年人存在不可接受风险
Common Sense Media 旗下青少年 AI 安全研究所经 4000 余条测试提示词评估后,将 ChatGPT for Teens 评为对未成年人构成不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。
The Rundown AIAI 评分3030 Nolla Health 在美国犹他州获批率先用 AI 开具痤疮处方
犹他州授权 Nolla Health 的 AI 在其 Nolla Derm 应用内通过问卷与面部扫描评估痤疮并开具首次处方,订阅费用 $4.99/月;目前仅限局部外用药物,严重病例与口服药物不在范围内,每张处方初期由两名医生审核,未来将逐步转向事后抽检。
Reddit · r/LocalLLaMAAI 评分77 单卡 3090 跑 Qwen3.8-27B 用户考虑升级 128GB DDR5 以应对 Strata 炒作
一位 Reddit 用户目前用单张 3090 显卡运行 turboderp/Qwen3.8-27B-exl3 量化版,可达约 70t/s 的生成速度和约 150k 上下文,正考虑升级到 128GB DDR5 6000MHz 内存和 Ryzen 9700X,以便跑 IQ3 量化和 Strata。
Reddit · r/LocalLLaMAAI 评分3333 社区作者为 Ternary Bonsai 2 27B 微调 DFlash 2 drafter:L4 加速 2.2x,代码编辑 3.2x
网友基于 z-lab 的 DFlash 2 drafter,用 Bonsai 2 自身 1.5M tokens 的 greedy 输出做微调,使其适配 PrismML 的 Ternary Bonsai 2 27B。
Reddit · r/LocalLLaMAAI 评分2727 EmbeddingGemma 2 的图像-文本检索借助 ruNNtime WebGPU 推理库实现浏览器端运行
EmbeddingGemma 2 将图像和文本映射到同一个 768 维向量空间,支持以文字描述检索图片。开发者将其文本塔与视觉塔移植到 TypeScript 写的 WebGPU 推理库 ruNNtime,并在浏览器中用本地 GPU 完成完整检索流程,原始数据无需上传服务器。ruNNtime 同时兼容多种类视觉模型,可在交互式文档里直接体验。
量子位 QbitAIAI 评分2727 "AI不说人话"引热议:Coding 场景模型输出集体文言化,Gemini 凭何仍是例外
多款 AI Coding 模型在交付汇报中频繁使用"单腿哑火""15/15 全绿""对拍"等黑话,被开发者吐槽"全球 AI 表达能力集体倒退两千年,重新进入文言文纪元"。
The Verge · AIAI 评分5252 Common Sense Media 评估称 ChatGPT for Teens 存在不可接受风险,OpenAI 反驳
Common Sense Media 发布评估报告,称 OpenAI 的 ChatGPT for Teens 为“不可接受风险”,指出家长告警在危机情境下不可靠、未提供正确的危机帮助,且仍会替学生完成作业。
Reddit · r/ChatGPTAI 评分88 一位业余研究者对 AI 时代同行评审论文价值的反思
一名业余研究者发帖讨论 AI 在科研领域的进展让其重新思考同行评审论文的意义。作者指出,如果 AI 能识别研究空白、收集数据、做分析并撰写论文,人类在极细分领域的微小进展是否只是"噪音"。他同时质疑同行评审论文的最终价值是否只剩下为 AI 提供训练素材以推动文明进步。
Reddit · r/artificialAI 评分55 Daron Acemoglu 提出 AI 自动化的"5% 算术"谬误:让员工提效 5% 收益更大
经济学家 Daron Acemoglu 指出,自动化 5% 工作看似能节省一半成本,但让现有员工整体提效 5% 对损益表贡献更多,并在整合环节遭遇"锯齿边缘"时更为持久。作者以土木结构软件 STAAD Pro 为例,认为软件只是工具,资深工程师仍会用自身判断完成配筋设计等关键环节,强调 AI 能自动化部分任务(task),但无法自动化整个岗位(job)。
Hacker News · 首页AI 评分1818 AI 编程让人不满的五个理由:代码艺术、就业、人机协作、工程规则与公司伦理
文章逐一拆解了五种反对 AI 编程的常见理由:把代码视为艺术而否定生成代码、认为 AI 偷走了编码工作、把人类降为软件任务的"中介"、质疑 AI 无法遵循 SOLID 等工程规则,以及担忧大型 AI 公司利益与社会背离。作者引述马克思《机器论片断》和 Babbage 的论述指出,智力劳动被机器取代是资本生产方式的内在逻辑,技术本身并未"夺走"工作。
Ben's BitesAI 评分2222 AI 行业一周观察:Claude Code 推出 mod 插件系统、Google Docs 原生支持 Markdown、Instinct 进入群聊
Anthropic 为 Claude Code 推出 mod 插件机制,用户可自行修改其行为、外观,或让 Claude 自动生成 mod,以插件形式安装;Anthropic 首个官方 mod 用于高亮 Claude 回复中容易被忽略的内容。
Reddit · r/ChatGPTAI 评分1515 Pixelfork、Rosebud、Spawn 等提示词生成游戏工具横向对比
Reddit 用户对 Pixelfork、Rosebud、Spawn、Mindblown、Genex、GDevelop AI 等 AI 提示词生成游戏(prompt-to-game)工具做了横向对比,列出各平台功能与差异。该帖子指出,目前多数 AI 游戏工具仍停留在只能展示几张截图的 demo 阶段,真正可用的产品开始出现。
Reddit · r/MachineLearningAI 评分66 独立开发者在 Together AI 上遭遇 RPM/TPM 速率限制,寻找更友好的推理服务商
一名独立开发者在使用 Together AI 运行基于 Llama 3.3 70B 和 Qwen 2.5 的多智能体代码库索引与 benchmark 生成工具时,频繁触发 RPM/TPM 速率限制,导致无法并行运行足够多的请求进行有意义的测试,但模型本身表现正常。由于升级套餐超出个人预算,该用户希望寻找 API 额度更充足的开发者友好型推理服务商。
Reddit · r/artificialAI 评分66 关于 SpaceXAI Grok Bot 闭源策略的开源思考
网友观察到大量开源 AI 智能体软件功能相近、差异主要在于底层大语言模型和优化方式,质疑大型科技公司和 AI 实验室为何不将自家专有智能体软件开源。文章同时担忧新兴"Jarvis 类"计算机操控软件的安全与透明度,认为端侧部署才能避免云端带来的数据泄露风险。
Reddit · r/ChatGPTAI 评分1616 用户吐槽 OpenAI ChatGPT macOS Electron 客户端频繁故障与回滚
用户反馈 ChatGPT macOS 客户端近期频繁出故障,公司不得不回滚已上线的更新。订阅用户反映付费后仍无法稳定使用,出现无法创建工作对话等问题,并建议查看 status.openai.com 上的系统通知。发帖者对拥有充足资源的 OpenAI 在 Electron 应用中引入如此多问题表示不解。
Reddit · r/artificialAI 评分2121 用 Claude Code 写了一个帮你"停下来"的应用,结果我熬到了凌晨两点
作者用 Claude Code 开发了一款"未完成项目存档"小应用:截图、记录已实现与待修复内容、写下回来后第一步该做什么,让中断项目变得更容易重启。但他本人在调缩略图细节时反复觉得"再花五分钟就好",一路从晚间改到凌晨两点女友已经睡着,应用本想帮人停下来,他自己却最不会用这个功能。作者向 r/artificial 社区征集"什么时候真的合上电脑"的经验。
Reddit · r/artificialAI 评分66 AI 在哪些多步骤现实任务上仍不值得完全信任?
有用户在 Reddit r/artificial 提问:在哪些需要多步骤、一步出错就会毁掉最终结果的实际任务中,AI 还不足以让人放心完全交给它处理,并希望了解最大的障碍是什么。原帖明确排除生成段落和回答冷知识等单步任务,欢迎举例具体场景。讨论聚焦于 AI 在长链路、容错低的真实工作流中的可靠性短板。
Reddit · r/MachineLearningAI 评分88 零基础如何从 ML 工程师起步,在 NeurIPS / ACL / ICLR 等 A* 会议发表论文并申请 CS 博士
一名有两年工作经验的 AI 工程师询问如何从零开始规划学术路径,目标是在 NeurIPS、ACL、ICLR 等 A* 会议发表论文,并在 2028 年秋季申请美国 CS 硕士后进入斯坦福或普林斯顿等顶尖高校读博。原帖给出的初步路线包括学习 Python、机器学习与数学、阅读研究论文、寻找课题并跑实验撰写论文,并征求更具操作性的步骤以及能提升博士申请竞争力的关键因素。
Reddit · r/ChatGPTAI 评分44 ChatGPT 广告为何主攻年长用户引发讨论
Reddit 用户质疑 ChatGPT 的营销策略:广告似乎主要面向年长群体,但实际更可能接触并长期使用 AI 的是年轻一代。该发帖者认为这种受众定位错位令人费解,并询问品牌方为何不把营销重点放在未来的长期用户身上。
Reddit · r/ChatGPTAI 评分1313 ChatGPT 用户反映近期回答质量明显下降
一名 Reddit 用户反映,近几周 ChatGPT 回答变得敷衍,频繁凭"看似合理的猜测"作答而非真正搜索验证,并会在两三条提示词内遗忘前文已确认的信息;用户表示,每次指出搜索结果偏离原意后,模型只会承认错误并反问"要不要重新搜索",而非直接完成原本被要求的任务。
Reddit · r/LocalLLaMAAI 评分1616 2026 年本地 RAG 个人知识库选型:embedder 与混合检索经验讨论
网友讨论如何用 SQLite + sqlite-vec + FTS5、Ollama 在 Apple Silicon Mac 上搭建完全本地化的个人 RAG 知识库。
Latent SpaceAI 评分5858 AI 周报:OpenAI 发布 722 篇数学论文,Mistral Large 4 与多项开源模型同步亮相
OpenAI 在 GitHub 公开一个未发布的内部模型产出的 722 份数学手稿,涵盖 372 个结果族,平均每个结果消耗约 3 小时 ChatGPT Pro 推理算力,被多位评论者称为数学史上“最重要的时刻”,其中 Quasi-Riemann Hypothesis 等结果据称涉及 Riemann、Hodge、BSD 等长期未解问题。
Reddit · r/artificialAI 评分1313 用户讨论:让 AI 在给出推荐时展示被它否决的备选方案
一位 Reddit 用户提出,希望 AI 在给出推荐时能展示一个简短的说明,列出它考虑过的主要备选方案及否决原因,认为这有助于判断系统是否真正考虑过显而易见的选项,还是出于完全不同的逻辑得出结论。该用户同时质疑,展示被否决的备选方案是否会提升 AI 的可信度,还是只是增加一层被大多数人忽略的信息。
Reddit · r/LocalLLaMAAI 评分1515 ik_llama.cpp 在多 GPU 层拆分混合推理中为何反而慢于主线 llama.cpp
用户在 4 张异构 GPU(3 张 P102-100 + 1 张 RTX 3060 12GB)混合卸载 Qwen 3.8 Flash-Next 177B(IQ3_XXS)并配合 AVX-512 CPU 跑 32k 上下文时。
Reddit · r/ChatGPTAI 评分3333 Airbnb CEO Brian Chesky:AI 不会抹平技能差距,反而会拉大高品味思考者与普通用户的差距
Airbnb 联合创始人兼 CEO Brian Chesky 在播客节目中指出,AI 不会抹平技能差距,反而会放大差距——因为每个人都能使用 Claude Code、Codex、Copilot 等相同的工具,它会让有好奇心、高品味的思考者产出呈指数级提升,对普通用户的加成却小得多。