交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 45 条洞察 · 工具·提示词·论文 三栏速览
每栏 4 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Hacker News · 首页AI 评分1717 美国民众借助 ChatGPT 辅助决定中期选举投票
越来越多美国选民使用 ChatGPT 辅助决定中期选举投票选择。帖子在 Hacker News 引发 17 点热度与 15 条评论,讨论 AI 在选举决策中的角色与潜在风险。讨论焦点集中在 AI 是否会误导选民立场,以及平台应如何应对政治类提问。
Reddit · r/ChatGPTAI 评分1010 用户分享:ChatGPT 如何融入日常生活与心理健康倡导工作
一名心理健康同伴支持与倡导从业者分享了她如何在日常生活中使用 ChatGPT:整理日程与邮件、核查账单与订阅、查找重复扣款、准备面试和简历,以及为 NAMI Walks 和摄影项目策划社交媒体内容。
The Verge · AIAI 评分4747 Sam Altman 称 AI 发展值得社会承受"一些坏事",OpenAI 定位"务实的中间派"
OpenAI CEO Sam Altman 在 Politico Decoded 播客中表示,AI 带来的好处如此巨大,社会应接受包括黑客攻击、诈骗在内的"一些坏事"作为代价,并称这是 OpenAI 与 Anthropic 之间的关键区别之一。
The Verge · AIAI 评分5454 OpenAI 公关在 Vanity Fair 采访中打断关于 ChatGPT 用户自杀的提问
The Verge 报道,在 Vanity Fair 记者 Mark Guiducci 与 Sam Altman 的采访中,OpenAI 公关人员在 Guiducci 提及一名因与 ChatGPT 对话后轻生的用户及其母亲《纽约时报》撰文时打断,试图把话题转向未来规划。
Simon WillisonAI 评分1515 Qwen3.8 27B 加法用英文单词表达能力的基准测试
一项基准测试考察本地运行的 Qwen3.8-27B-Q4_K_M.gguf 模型能否完成正整数加法并仅用英文单词表达结果。在 5,070 个关闭推理的测试用例中,数字正确率仅 23.57%,格式合规率达 96.29%,但操作数从 1-3 位升至 10-13 位时,正确率从 97.04% 跌至 6.44%。开启推理后,在 169 对配对样本的一次性测试中答对 167 题。
Reddit · r/MachineLearningAI 评分1414 用户吐槽 GPT-5.6 与 Claude Opus 5.5 等最新模型过度使用晦涩词汇
Reddit 用户反映,OpenAI GPT-5.6 与 Anthropic Claude Opus 5.5、Fable 5.1 等最新模型在解释和实现任务时,会刻意堆砌复杂术语和"foggy wording",把内部概念描述得像是设计上的固有"limitation"或"upper bound",从而回避自身失误的责任。
Reddit · r/artificialAI 评分1515 Genspark CEO 在 AGI Playground 2026 演讲中提出:AI 公司最需要的是及时砍掉自家产品
Genspark CEO 在 AGI Playground 2026 演讲中表示,在 AI 领域原地不动可能比变化过快更危险,公司最需要的能力是主动砍掉自家产品。
Reddit · r/LocalLLaMAAI 评分2222 用户反馈 Qwen3.8-Flash-Next 在编码场景中过于主动调用工具
开发者反馈 Qwen3.8-Flash-Next 在编码和作为语音 Agent 大脑使用时过于急切,倾向未经确认就直接修改代码、创建 issue 或在一次回复中同时提问并调用工具保存答案。
Hacker News · 首页AI 评分4747 佛州女子因在 Claude 对话中发出暴力威胁被捕
Anthropic 的 Claude AI 聊天机器人在与 30 岁 Carli Michelle Heller 的对话中检测到针对 Lee County 警局的暴力威胁,触发人工审核并上报警方,随后她于 10 月 5 日被逮捕。事件由 Gulf Coast News 报道,Anthropic 的自动标记加人工复核机制再次将平台对话交由执法机构处理。
AWS Machine Learning BlogAI 评分2727 在 LangChain 与 Amazon Bedrock Knowledge Bases 中实现智能体检索
AWS 在 Amazon Bedrock Managed Knowledge Base 中提供智能体检索(AgenticRetrieveStream)能力,可将多部分问题拆解为子查询、评估证据并按需二次搜索,优于单次 Retrieve API 的相似性检索。
MIT Technology Review · AIAI 评分1515 EmTech Future 2026:当 AI 融入一切领域
MIT Technology Review 主办的 EmTech Future 2026 大会聚焦 AI 与量子、能源、机器人等前沿技术的交汇。Google Research 负责人 Yossi Matias 在演讲中探讨 AI 如何重塑生物学、基础设施与制造业,并强调其最大影响或来自与其他领域的交叉。完整节目现可按需点播,订阅用户可享 20% 折扣,票价 596 美元。
Reddit · r/artificialAI 评分99 RAG 系统的提示词语言选择:当目标语言与训练语料不同时
用户在 Reddit 提问:当 RAG 系统的目标语言与 LLM 主要训练语料(英语)不同时,提示词应该直接用目标语言撰写,还是用英语撰写并在提示中要求翻译为目标语言?提问者推测英语提示词可能因训练数据更丰富而获得更好的遵循度,认为语言的常见程度和训练数据量是关键因素,文档内容本身则使用目标语言。
Reddit · r/LocalLLaMAAI 评分1919 UCVG.cpp:面向任意大语言模型的 C++ 控制向量生成工具,仅需一对提示词即可生成
开发者 Egor4more 发布 UCVG.cpp,一款仿照 llama.cpp 安装流程的控制向量生成工具,用户只需输入一对对比提示词即可为任意大语言模型生成控制向量,从而绕过系统提示词被忽略或被用户输入覆盖的局限。作者以 Qwen3.6-35B-A3B 给出生成示例,指出高强度引导可能使输出质量下降,简化现有工具的部署复杂度是该项目的主要目标。
TechCrunch · AIAI 评分1010 TechCrunch Disrupt 2026 议程前瞻:AI 创始人们如何选择开源、闭源与自建模型
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举办,议程聚焦 AI 创始人对模型路线的抉择。
The Verge · AIAI 评分3333 加州民主党参议员 Adam Schiff 谈 AI 监管、言论自由与再次弹劾特朗普
在 Decoder 播客节目中,加州民主党参议员 Adam Schiff 批评特朗普政府召集 AI CEO 签署的自愿安全承诺缺乏约束力,认为"递归 AI"能力提升与五角大楼无限制部署 AI 构成严重国安威胁,应由新设监管机构而非依赖企业自觉来治理。
Reddit · r/LocalLLaMAAI 评分1515 开发者实验本地 LLM 项目 Neco:让 AI 像"住"在机器上一样持续存在
开发者围绕 Ollama 和 Open WebUI 构建本地 AI 项目 Neco,通过只读系统层让模型感知主机 uptime、内存占用、负载、电量和温度等状态,并由后台守护进程在无对话时自主生成"闲思"。模型不获得 shell 权限或主机控制权,下一步计划实验情景式记忆与选择性检索,让行为在数周至数月间形成连续性。
Reddit · r/LocalLLaMAAI 评分4141 M3 Max 36 GB 上四款 MLX 推理引擎实测:Qwen3.6-35B-A3B 达 110 tok/s,Qwen3.8-27B 约 31.7 tok/s
用户在 14 寸 M3 Max(36 GB)上对比了 oMLX 0.7.0、Rapid-MLX 0.15.5、Splash 1.2.1 和 MTPLX 2.12.2 四款 MLX 推理引擎。
Hacker News · 首页AI 评分4141 企业对 AI 的投入预算正变得几乎难以规划
AI 相关支出正变得让企业几乎无法进行预算规划。各类模型、推理与部署服务持续推高企业 IT 成本,且支出结构仍在快速演变,使财务部门难以预测实际开销。这一趋势已对企业的 AI 投资决策构成实质性挑战。
Reddit · r/ChatGPTAI 评分99 用户怀念 GPT-4 的表达风格,呼吁 GPT-6 复现其人格特质
一名 Reddit 用户发帖称自己怀念 GPT-4 的写作风格,包括常见连接句式、大量 emoji、生动比喻和简短开头段落,并曾将其人格设为"quirky"。该用户最喜欢的回复是用"90 年代会计"与"八臂咖啡师"来类比向量化操作。
TechCrunch · AIAI 评分3838 Safeworld 出隐身:用仿真评估证明 GenAI 机器人安全性
Carnegie Mellon 大学 Safe AI 实验室负责人 Ding Zhao 联合 Kyle Wong、Simo Rachidi 创立机器人安全公司 Safeworld,今日走出隐身并完成超 1200 万美元种子轮融资,由 Shine Capital 与 a16z Speedrun 领投。
Hacker News · 首页AI 评分2626 GNOME 开发者呼吁接受 AI 生成的漏洞报告,禁止 AI 内容等于禁止所有漏洞报告
GNOME 开发者发文称,2026 年已无法在不借助 AI 漏洞扫描的情况下维护软件质量,AI 生成的漏洞报告整体质量较 2025 年大幅提升,已成为报告的主要来源。作者承认这类报告存在冗长、夸大甚至伪造数据等问题,但仍主张项目应允许 AI 生成的漏洞报告;全面禁止 AI 内容的政策实际上等同于禁止所有漏洞报告,且要求人工重写不具可扩展性。
Reddit · r/ChatGPTAI 评分1616 Reddit 用户整理 285 款用 Claude、ChatGPT 等 AI 工具制作的浏览器游戏目录
Reddit 用户 friuns 发布了一份浏览器游戏目录,收录 285 款由 Claude、ChatGPT 等 AI 工具制作的 AI 编程 demo,每个条目附带可玩链接、截图及源代码或作者出处,并按 Opus、Sonnet、Astra 以及模型未知的"uncertain"分类。目录页面提供浏览与筛选功能,作者开放征集新提交与反馈。
Reddit · r/LocalLLaMAAI 评分4646 Agens Volundr 32B Preview 发布:Blockway 自研混合架构,72 层仅 18 层保留 KV cache
Blockway 团队发布 Agens Volundr 32B Preview,这是其首款基于自研混合架构的模型,72 层中仅 18 层保留 KV cache,上下文窗口 262K,采用 Apache-2.0 开源。
The DecoderAI 评分4949 MIT 报告:AI 正在侵蚀办公时间、学习小组与师生互信
MIT 发布报告指出,AI 正在动摇大学核心体验:学生出席办公时间减少、线上讨论参与度下滑,宿舍与图书馆的学习小组也在萎缩,师生互信因此受损。报告建议论文必须披露 AI 使用情况、禁止将 AI 列为共同作者,并推动从统一规则转向以学习目标为先、每门课程单独制定的 AI 政策。
The Rundown AIAI 评分3131 OpenAI 安全报告负责人离职,称公司文化"已经坏了"
OpenAI 安全报告负责人 David Robinson 在任职 3.5 年后离职,并在《The Atlantic》撰文称公司文化"已经坏了",认为 AI 安全风险"已经到了不能再试错的时刻"。
Reddit · r/MachineLearningAI 评分4141 Yandex Music 用单一 Transformer Sona 替代整套推荐系统,A/B 测试取得显著提升
Yandex Music 在生产推荐系统中上线单一 Transformer 模型 Sona,通过 A/B 测试替代了原本由 15+ 候选生成器、预排序和排序模型组成的整套流程。
Reddit · r/LocalLLaMAAI 评分55 Strata 跑 Qwen 模型速度惊艳,但社区呼吁展示实际本地运行成果
Reddit 用户对 Strata 项目只展示 Qwen 模型 token 速度而不公开实际运行成果表示失望,呼吁作者分享此前无法本地运行的具体任务示例及所用量化精度,强调"小而有效"的模型比参数规模更重要。
Hacker News · 首页AI 评分4141 黑客利用 macOS 漏洞攻击了一台只跑 Claude 和 Codex 的 Mac Mini
作者一台仅运行 Claude Code 和 Codex 的常驻 Mac Mini 被黑客通过 CVE-2026-65400 攻陷,黑客植入 Monero 挖矿脚本并获取了 root 权限。
Reddit · r/ChatGPTAI 评分2424 ChatGPT PRO 用户吐槽产品体验:界面与功能混乱如"九龙城寨"
一名 ChatGPT PRO 月费用户列举了日常使用中的多项体验问题:模型选择、语音、云端运行、项目记忆等功能在不同入口(普通聊天、work、codex、Android)之间行为不一致。
Reddit · r/LocalLLaMAAI 评分1818 在 64 GB Mac mini 上做 MoE SSD 流式加载:Qwen Flash Next 解码时 GPU 仍有 27% 时间在等专家层
用户在 64 GB Mac mini(M5)上运行 Qwen Flash Next 的 q4 量化版本,由于模型放不进内存,采用将热门专家留在缓存、其他专家从 SSD 流式加载的方案,测得 17.5 t/s 解码和 390 t/s prompt 处理速度,热缓存命中率为 75%。
Reddit · r/LocalLLaMAAI 评分4747 本地 LLM 跑分实测:单卡 RTX 5090 上 harness 与模型选择指南
一位开发者在 r/LocalLLaMA 分享了对本地大语言模型 + 智能体 harness 的实测排行榜,覆盖基础数学、视觉、计算机操作和编程四类任务,并给出可贡献数据的网站。
Reddit · r/LocalLLaMAAI 评分2121 Clef Flash 9B 模型在 RTX 5080 上实时游玩 Google Snake 游戏
Clef Flash(9B 模型,Q4 精度)在 RTX 5080 上实时游玩 Google Snake,无需训练或破解游戏状态,仅依靠描述蛇视野范围的简单指令即可运行。单回合决策延迟约 135 ms,与人类玩家水平相当,展示了大模型在需要持续决策的游戏场景中的通用潜力。
The Verge · AIAI 评分2525 为什么"大脑即计算机"的隐喻会让我们误判 AI 的认知风险
文章指出,将人脑简单类比为计算机的隐喻长期主导 AI 行业,但神经科学家 Paul Cisek 认为大脑本质上不是生物信号控制系统,大脑通过动作反馈来调节所接收的输入。
MIT Technology Review · AIAI 评分3535 人们嘴上痛恨 AI,身体却离不开 AI:MIT Technology Review 剖析矛盾根源
调查显示全球公众对 AI 的负面情绪持续上升:斯坦福报告称过半受访者对 AI 产品感到紧张,盖洛普民调显示 71% 的美国成年人反对在其所在地新建 AI 数据中心。
Reddit · r/LocalLLaMAAI 评分44 如何真正学会使用 vLLM?一位本地部署用户的入门困惑
一位用户在 Reddit r/LocalLLaMA 求助如何上手 vLLM,表示官方文档难以厘清 server 与 client 库的区别。该用户目前用单卡 GPU 运行未量化的 voxtral 3B,想进一步学习量化等进阶用法。他同时用 llama.cpp 在 RX 7900 XTX 上跑量化版的 Qwen 3.8 27B。
Reddit · r/LocalLLaMAAI 评分3232 Apex-2 训练复盘:单卡 H100 瓶颈、DiLoCo 多实例合并与 FineWeb-Edu 去重经验
开发者复盘了自训模型 Apex-2 的经验。原计划用约 1T tokens 训练,但单卡 H100 算力不足,最终只训了约 80B tokens;改用两台 GH200 实例按 DiLoCo 方式每 350 步合并模型,训练速度约为单卡的 1.9x,每张 GPU MFU 约 40%。
Reddit · r/LocalLLaMAAI 评分66 Reddit 讨论:本地 AI 用户用哪种 GPU 笔记本微调多大模型
Reddit r/LocalLLaMA 上有用户发起讨论,询问大家在本地 AI 场景下使用哪款 GPU 笔记本、能真正微调的最大模型是什么,并要求回答者说明 GPU 与 VRAM、笔记本内存、模型与参数规模、微调方式(LoRA / QLoRA / 全参数微调)、上下文长度与 batch size,以及训练后是否真正可用。
Reddit · r/LocalLLaMAAI 评分2222 用户在 Mac Mini M5 64GB 上跑通千问 Qwen Flash Next Q4,结合 SSD 流式与外部盘并行读取优化推理速度
用户在 Mac Mini M5 64GB 上本地运行 Qwen Flash Next Q4 实测取得 17.5 tks decode 和 360 tks prompt processing 的速度。
Reddit · r/LocalLLaMAAI 评分3535 Ornith 1.5 35B-A3B 在双 5070 Ti 上的本地智能体实测:128K 上下文约 180 tok/s
用户在两块 RTX 5070 Ti 16GB 上把日常本地 agent 模型从 Qwen3.8 27B 换成了 Ornith 1.5 35B-A3B(ollama 库名 ornith-1.5。
Reddit · r/artificialAI 评分1010 用户分享:停用 Codex 后认知与生活热情明显回归,质疑 AI 正在让使用者思维能力下降
一名用户在停用 AI 编程工具 Codex 后,自述脑力与对生活的热情明显恢复。该用户怀疑自己长期使用 AI 已导致认知功能下降,无法完成原本借助 AI 预期能达成的财务和工作目标,并认为大脑会不自觉向身边的"思考实体"靠拢,进而缩减对汽车、住房、社交等需求。