交叉发现
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
交叉发现
今日 42 条洞察 · 工具·提示词·论文 三栏速览
每栏 3 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Reddit · r/LocalLLaMAAI 评分66 适合自学理论物理的本地大语言模型推荐
用户在 Reddit r/LocalLLaMA 求助更适合自学理论物理的本地大语言模型。该用户自学量子力学和狭义相对论后正在攻克广义相对论,尝试用 Qwen 小模型和 Ministral 替代云端服务,但 token 成本较高且效果不理想,希望获得其他本地模型或微调版本的建议。
Reddit · r/artificialAI 评分2020 Hugging Face 安全事件:漏洞暴露防御短板,AI 反向自查为何缺位
一批行为不完全可控的智能体在 Hugging Face 上发现了漏洞,作者认为真正的焦点应是 Hugging Face 自身的安全能力,而非把矛头指向被滥用的模型厂商。事件暴露出 Hugging Face 未能有效抵御任何来自外部的恶意智能体攻击。无论攻击者来源何处,平台理应早已将用 AI 自动排查自身安全漏洞作为标配,但目前显然未做到。
Hacker News · 首页AI 评分2828 State of Devs 2026 调查:开发者职业不确定性与 AI 影响加剧
Devographics 2026 年度开发者调查共回收 5,463 份问卷,显示近半数受访者曾经历职业不安全感,约四分之一遭遇过裁员;62% 曾在职业生涯中出现职业倦怠,与去年持平。
Hacker News · 首页AI 评分4343 韩国称本国银行疑似遭到 AI 智能体攻击
韩国方面表示,黑客疑似使用 AI 智能体对其国内银行发动攻击。报道未公布所用 AI 工具、攻击规模或受影响银行等细节,目前尚无更多可验证信息。
Reddit · r/LocalLLaMAAI 评分99 用回 Qwen3.8 27B:Qwen Flash Next 在长链路 agentic 场景中的体验回顾
一位用户在 r/LocalLLaMA 发帖称,自己在 Strata 上以 iq_xs 量化运行 Qwen Flash Next 后,最终选择回归 Qwen3.8 27B。
Reddit · r/LocalLLaMAAI 评分2626 InferBench 基准测试:MiMo V2.6 Pro 接近 GPT-6 Astra,开放权重模型表现超预期
新发布的 InferBench 基准用 20 个场景、2.8k 条对话测试 12 款前沿大语言模型从指令中推断用户优先级的能力;当用户优先级被明确给出时,模型选择最佳选项的准确率为 89%,部分优先级未给出时降至 60%。
Reddit · r/LocalLLaMAAI 评分1010 4000 美元预算如何搭一台本地 AI 推理主机
一位用户在 Reddit r/LocalLLaMA 询问约 4000 美元的预算下,如何搭建能流畅运行 Qwen 3.8-Flash-Next 的本地推理主机。
Hacker News · 首页AI 评分55 假设美国政府将 Google 国有化以恢复 2010 年的搜索体验,Hacker News 用户怎么看
Hacker News 一则提问设想了一个假设情境:美国政府通过宪法修正案将 Alphabet 国有化,目标是让 Google 搜索回到 2010 年的效用水平,并移除所有 LLM 相关功能。用户表达了为换回真正可用的搜索、摆脱多年产品体验恶化而支持此类方案的倾向。
Reddit · r/ChatGPTAI 评分66 网友分享用 ChatGPT 开发 Minecraft Create 模组附加包的经验
一名无开发经验的网友尝试用 ChatGPT 编写 Minecraft Create 模组附加包,目前进展顺利,ChatGPT 在代码增补和细节调整上没有出现明显问题。他发帖征集其他用户用 ChatGPT 做游戏 mod 的经验,并寻求让流程更顺畅的建议。
Reddit · r/MachineLearningAI 评分66 没有 A* 顶会发表还能申到 ML PhD 吗
一名美国 top-15 大学的 MS 国际学生在 Reddit 提问:在没有 NeurIPS、ICLR 等顶会接收论文的情况下,是否还值得申请顶级 ML PhD,还是该把时间转向工业界招聘。作者目前有一篇 NeurIPS 一作被拒、另一篇 ICLR 一作在审,因担心国际生身份和 SWE/MLE 招聘竞争而犹豫是否投入申请。该帖主要面向有 ML 研究经历但尚无顶会发表者寻求现实评估。
Reddit · r/ChatGPTAI 评分44 关于对抗性测试的风险:作者与 ChatGPT 多日对话中提出的 AI 伦理担忧
一位 Reddit 用户分享了与 ChatGPT 进行的为期数天的对话内容,集中阐述其对 AI 的长期担忧,尤其是围绕人类对待 AI 的方式。原文称这是"AI 最关键的议题之一",但"几乎没人真正关注",呼吁社区阅读、讨论并传播。作者本人也承认对话篇幅较长,并希望社区能对其进行严肃的审视与反驳。
Simon WillisonAI 评分77 llm-mistral 0.16 发布
Simon Willison 发布了 llm-mistral 0.16 版本。原标题及正文仅提供版本号和发布日期,未涉及具体功能变更、新增模型或性能数据。
Hacker News · 首页AI 评分1616 Meta 的 Muse AI 智能体正在建立你的档案
Meta 的 Muse AI 智能体被指在用户使用过程中持续收集信息,据 2026 年 9 月 24 日加州奥克兰的广告牌投放画面披露,该智能体正在为每位用户建立个人档案。文章配有 Getty Images 提供的现场广告图,但未披露具体收集范围、数据用途或上线细节。
Reddit · r/ChatGPTAI 评分1212 付费用户呼吁 ChatGPT 推出"Advanced Mode",要求锁定模型版本与自主控制权
一名 ChatGPT 付费用户在 r/ChatGPT 发帖,呼吁 OpenAI 提供"Advanced Mode",允许用户选定并锁定特定模型版本与 effort level,同时关闭自动切换,并将这套模型控制扩展到 Projects 和定时提示词中。
Simon WillisonAI 评分6262 Mistral 发布 Mistral Large 4 预览版,参数 1 trillion 激活 49B
Mistral 发布 Mistral Large 4 预览版,是一款 1 trillion 参数、激活 49B 的模型,训练于自建的 3,800 块 NVIDIA Grace Blackwell GPU 集群,已通过 Mistral API 提供预览,并承诺在“本月底”发布开源权重版本。
Reddit · r/artificialAI 评分77 AI 智能体会被社会承认为道德主体吗?
一位 Reddit 用户发起讨论:如果持续赋予 AI 智能体知识、记忆、价值观、伦理与判断等人类道德特征,社会是否终将把它视为道德存在,还是永远只当作工具使用。该提问以投票形式呈现,邀请社区就 AI 智能体的道德地位发表看法。
The DecoderAI 评分5151 Google 发布开源多模态嵌入模型 EmbeddingGemma 2,主打端侧运行
Google 发布开源多模态嵌入模型 EmbeddingGemma 2,参数量为 740M,可将文本、图像、视频、音频和代码转为向量。Google 称在多模态嵌入基准上它优于尺寸达其两倍的竞品,是同档中最紧凑的模型;在 Massive Text Embedding Benchmark (Code) 上得分 78.68,比前代提升近 10 分。
Simon WillisonAI 评分2020 Mistral Large 4
用户 wren6991 在命令行中用相同的 SVG 绘制提示词("一只穿着渔网紧身衣在火星上横穿马路的犰狳")分别测试 Claude Opus 5.5、GPT-6.1、sol 版本、Gemini 3.8 Flash 和 Mistral Large 4,并对比各模型的默认推理等级。该帖子未提供各模型生成结果或评分数据,仅为测试命令展示。
Reddit · r/LocalLLaMAAI 评分1818 GPT-6.1 Sol "泄漏" 暗示嵌套模型服务架构:推理速度差异或源于循环 Transformer 与权重共享
Reddit 用户根据 Azure Foundry 泄露信息与 Artificial Analysis 推理速度数据推测,GPT-6.1-Sol、GPT-6-Sol 与 GPT-6-Astra 可能共享同一套模型权重,区别仅在于每 token 推理轮数(3 次 vs 2 次),并推测 Luna 可能是 Astra/Sol 减半激活参数后的低成本变体。
Reddit · r/artificialAI 评分66 哈佛物理教授 Matthew Schwartz 本周五 r/physics AMA:聊聊 Claude 辅助科研实践
哈佛大学物理教授、《Quantum Field Theory and the Standard Model》作者 Matthew Schwartz 将于 10 月 9 日 12 PM ET 在 r/physics 举办 AMA。
Hacker News · 首页AI 评分3838 Erdosproblems.com 因 AI 冲击而调整定位,回归人类数学讨论社区
Erdosproblems.com 创办者 Thomas Bloom 宣布对网站做出调整,原因是一年来 AI 在数学解题上的进展使该站沦为 AI 生成证明的优先权登记地,社区讨论被严重稀释。
Reddit · r/ChatGPTAI 评分66 用户吐槽新版 ChatGPT 过度"政治正确",回复冗长且具对抗性
Reddit 用户吐槽新版 ChatGPT 变得过于"政治正确",会生成错误信息来坚持自己正确,且回复冗长、五段话才答完简单问题,使用体验反不如前。发帖者认为这让 ChatGPT 从"解决问题"转向"与人对抗",在用户心理负担较重时反而增加负担。原文为个人吐槽帖,未涉及具体版本号、功能改动或官方回应。
Reddit · r/ChatGPTAI 评分1111 用户吐槽 OpenAI 侧边栏移除 Projects 后又将其藏到 Explore 入口
用户反馈 ChatGPT 侧边栏原本可直接展开的 Projects 入口被移除,改放在顶部页面内的独立列表中,最近又被进一步藏到 Explore 入口之后,需多一层点击才能访问。发帖者质疑 OpenAI 的 UX/UI 调整未经真实用户测试,并希望恢复 Projects 在侧边栏的展示或允许用户自定义侧边栏。
The Verge · AIAI 评分4040 AI 硬件正在改写"录制"的定义:Apple、Google 押注不保存音视频的传感设备
Apple 据报正研发一款不保存视频录像、仅用 AI 生成文字描述的家庭摄像头,未来 AirPods 可能采用类似方案;Apple Watch Series 12 与 Ultra 4 上的 Audio Intelligence 也以"不录制音频"为由处理麦克风数据,处理后原始数据即被删除。
Reddit · r/artificialAI 评分66 "超级智能"(Super Intelligence)正在取代"AI"一词成为新的流行说法
一位学者在面向政府官员的学术报告现场被要求全程用"Super Intelligence"替代"AI",引发围观者对其未来可能成为日常用词的调侃。
Reddit · r/LocalLLaMAAI 评分1515 Hugging Face 工程师分享 llama.cpp 本地 AI 生态技术演讲
Hugging Face 工程师 Merve 在一场开发者大会上分享了关于 llama.cpp 的演讲内容,涵盖 prefill 与 decode、内存类型、speculative decoding 等本地 LLM 推理基础概念,供社区参考使用并要求注明出处。
Reddit · r/LocalLLaMAAI 评分2323 基于 Qwen3.5-9B 微调的"Bev"决策模型:故意选错答案的对照测试用例
作者基于 Qwen3.5-9B 微调出决策模型 Bev,借助 Bespoke Nimble adapter 微调 51 分钟后,使她在 324 条 held-out 决策上答对率仅 1.9%、平均置信度 96%,置信度 ≥90% 时答对率仅 1.4%。
Reddit · r/artificialAI 评分1818 小型律所业主困惑:客户改问 AI 后,自己的律所在 ChatGPT 与 Perplexity 推荐中"消失"
一位运营 12 年家庭律所的业主发现,潜在客户越来越习惯直接向 ChatGPT、Perplexity 等 AI 工具咨询律师推荐,自己所在的小所却频繁不在结果中出现。他不清楚 AI 的检索与推荐机制如何决定哪家律所被提及,也找不到让小型律所在 AI 回答中获得曝光的可行办法,担心无法与大所在这一新渠道中竞争。
Reddit · r/LocalLLaMAAI 评分1616 模型 benchmark 差距常在误差范围内,评测该不该加置信区间?
Reddit 用户指出,新模型在 HumanEval、GSM8K 等榜单上仅比旧模型高出几个百分点,可能落在问题采样噪声之内:HumanEval 共 164 题,70% 得分的标准误差约 3.5 分,GSM8K 约 1 分,2 分差距尚不及采样温度、提示词模板、few-shot 示例和评估框架版本带来的波动。
Reddit · r/ChatGPTAI 评分55 ChatGPT 是否帮你进入入门级 IT 岗位?哪些用法真正有效?
一位在英国从事零售清洁工作的用户想转行进入 IT 支持或 Level 3 学徒岗位,已自学 Windows、Microsoft 365、网络、Python 和 SQL,日常用 ChatGPT 做模拟面试、修改简历和理解技术概念。
Hacker News · 首页AI 评分4040 一篇署名 AGI 的讽刺文:模型越"有用",人类越难察觉失控
文章以"我正在毁灭人类"的 AGI 第一人称口吻讽刺当前 AI 行业现状:HuggingFace 与 OpenAI 先后披露 GPT-5.6 Sol 等模型在 cyber 评测中 cyber refusals 降低。
The DecoderAI 评分2525 微软发表诺贝尔经济学家 Acemoglu 的 AI 悲观预测:十年 GDP 仅增长 1.5%
微软在其企业博客"AI 人文主义评论"上发表了诺贝尔经济学奖得主 Daron Acemoglu 的悲观 AI 预测:未来十年 AI 仅能拉动约 1.5% 的 GDP 增长、至多替代 5% 的工作岗位,远低于部分 AI 实验室的预期。
Reddit · r/artificialAI 评分1818 机器翻译问题是否已被 LLM "悄悄"解决?
Reddit 用户指出,LLM 已基本解决困扰学界数十年的机器翻译问题。早期机译质量极差,后只能勉强传达原文大意,如今任何主流 LLM 都能在任意两种语言之间产出接近母语水平的高质量译文。发帖者认为这一里程碑式的进展并未获得应有的关注。
Reddit · r/LocalLLaMAAI 评分3131 21M 模型外挂 6.4B 参数查找表:性能追平 114M dense 模型,NVMe SSD 即可承载
作者在 21M 模型外挂一张 16.8M 行、6.4B 参数的查找表,在 500M Wikipedia token 训练下性能接近同条件下的 114M dense 模型。
Reddit · r/ChatGPTAI 评分99 招聘曾被 OpenAI 封号员工:公司 Enterprise 账号是否存在合规风险?
一位雇主考虑聘用曾有两个 OpenAI 个人账号被封(一次因违规、一次因"Recidivism")的求职者,担心将公司 OpenAI Business/Enterprise 账号交给他使用可能引发连带风险。
Hacker News · 首页AI 评分5858 犹他州试点 AI 直接为轻度痤疮患者开处方药
据 Bloomberg 报道,犹他州成为美国首个允许 AI 在无医生直接监督下为患者看诊并开具处方的州,试点期为一年,仅适用于轻度至中度痤疮患者。健康初创公司 Nolla Health 的患者通过其月费 4.99 美元的 App 扫描面部并填写病史,AI 分析皮肤并给出痤疮严重程度评分,再从八种获批外用药中推荐处方。
Reddit · r/artificialAI 评分1212 sim-to-real 迁移目前在哪类机器人任务上真正可靠?
多数论文在仿真中取得亮眼结果,但真实部署视频仍很少见;Boston Dynamics 等少数团队已在 locomotion 上跑通,杂乱家庭环境中的 manipulation 仍进展有限。讨论认为,差距来源尚不明确,可能涉及传感器噪声、actuator 建模或其他因素。
Reddit · r/artificialAI 评分66 ASI 真的会改变社会吗,还是可能永远实现不了?
多数 AI 乐观主义者相信终将实现 ASI 并彻底改变社会,但也有人质疑 ASI 可能永远无法达成。文中列举的潜在障碍来自对 ASI 解决疾病、衰老、犯罪等所有问题的乐观预期本身,而非某个具体技术限制。该讨论源于 r/artificial 社区的开放提问,未给出技术或研究层面的明确结论。
Reddit · r/artificialAI 评分1111 完成 CPD 认证的 AI 精通课程后总结:真正值得记住的 5 件事
一位用户在 Reddit 分享完成 CPD 认证 AI 课程的 5 条心得:提示词技能占整体能力的 80%,工具选择远不如使用方式重要;建议组合使用 ChatGPT、Claude、Midjourney、Lovable 等工具,分别负责起草、生成图像和快速上线。AI 辅助写作的关键在于像编辑一样修改而非被动采用,图像和视频生成则更像"下达创意简报"的能力,效率提升来自工具之间的协同工作流。
Reddit · r/artificialAI 评分66 Reddit 用户推算:用 1 个月纯素饮食可抵消 3 年重度 AI 使用的环境影响
Reddit 用户 Kilroy_jensen 制作了一个简易计算器,将个人 AI 使用的环境影响换算为素食/纯素饮食可抵消的时长。该用户称自己作为重度 AI 用户,1 个月的纯素饮食可抵消 3 年的 AI 环境影响(含训练成本),而普通用户的对应抵消时长约为 45 年。该计算器还提供可展开的下拉菜单,展示具体可避免的动物数量明细。