跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条MIT Technology Review · AIAI 评分1515 EmTech Future 2026:当 AI 融入一切领域
MIT Technology Review 主办的 EmTech Future 2026 大会聚焦 AI 与量子、能源、机器人等前沿技术的交汇。Google Research 负责人 Yossi Matias 在演讲中探讨 AI 如何重塑生物学、基础设施与制造业,并强调其最大影响或来自与其他领域的交叉。完整节目现可按需点播,订阅用户可享 20% 折扣,票价 596 美元。
Ars Technica · AIAI 评分5252 多国政府首次对 AI 智能眼镜出手,澳大利亚拟限制公共空间佩戴
澳大利亚正考虑在部分公共空间禁用智能眼镜,挪威政府也将限制佩戴的立法列为高优先级草案,多国法庭已对可穿戴技术发出禁令。Meta、Google、OpenAI 等美国公司把智能眼镜视为手机的下一代 AI 入口;Counterpoint Research 预计 2026 至 2032 年消费者在可穿戴设备上的支出将超过 1 万亿美元。
Reddit · r/artificialAI 评分2525 开发者用 GPT、Claude 与 Gemini 各取所长打造可对话的历史播客应用 historai.ca
开发者结合软件经验与大语言模型,推出 historai.ca:用户输入任意历史主题、时刻或人物,约 1 分钟后由一到两位主持人以播客形式讲述,配有同步插图,并支持随时打断提问。该应用在动笔前会联网核查日期、人名与数字,资料存疑时会直接告知分歧并附上来源链接。研究、撰稿、配图、配音、出题等环节分别由 GPT、Claude、Gemini 中表现最优的模型负责,目前支持 6 种语言。
Import AIAI 评分2727 Import AI 475:智能体集群扩展机制、Google DeepMind 推出 SynthID Bio 水印工具,以及 AI 驱动科学经济兴起
Toby Ord 在文章中提出,AI 智能体集群(swarm)是一种新的推理扩展方式,4 个智能体并行执行任务理论上能以约一半的时间完成同等工作,但集群规模扩大 10 倍仅能带来 3 到 5 倍的性能提升,呈现出经济学家所说的"互相踩脚"式边际递减。
The DecoderAI 评分4949 MIT 报告:AI 正在侵蚀办公时间、学习小组与师生互信
MIT 发布报告指出,AI 正在动摇大学核心体验:学生出席办公时间减少、线上讨论参与度下滑,宿舍与图书馆的学习小组也在萎缩,师生互信因此受损。报告建议论文必须披露 AI 使用情况、禁止将 AI 列为共同作者,并推动从统一规则转向以学习目标为先、每门课程单独制定的 AI 政策。
The Verge · AIAI 评分2525 为什么"大脑即计算机"的隐喻会让我们误判 AI 的认知风险
文章指出,将人脑简单类比为计算机的隐喻长期主导 AI 行业,但神经科学家 Paul Cisek 认为大脑本质上不是生物信号控制系统,大脑通过动作反馈来调节所接收的输入。
MIT Technology Review · AIAI 评分3535 人们嘴上痛恨 AI,身体却离不开 AI:MIT Technology Review 剖析矛盾根源
调查显示全球公众对 AI 的负面情绪持续上升:斯坦福报告称过半受访者对 AI 产品感到紧张,盖洛普民调显示 71% 的美国成年人反对在其所在地新建 AI 数据中心。
Product Hunt · AI 分类AI 评分3636 Reviu:一款用于审查 AI 智能体代码的原生桌面应用发布
Reviu 是一款原生桌面应用,用于在代码推送前审查 AI 智能体编写的代码。它支持运行 Claude Code、Codex、Gemini 等 ACP 智能体,可在持久会话中检查每次 diff、向智能体发回评论,并直接在应用内完成 stage、rebase、commit、开 PR 及审查 GitHub pull requests。
Reddit · r/artificialAI 评分1717 Google AI 如何收集用户敏感信息?
Reddit 用户反映 Google AI 能准确说出其从未告知的信息,如最近收养的猫的名字 Julius,而用户仅通过短信告知过姐姐这一信息。AI 声称无手机、短信或麦克风访问权限,也不跨会话存储信息,但用户质疑其如何获取这些数据。
Reddit · r/artificialAI 评分6161 调查显示英国 51% 已出版小说家担心 AI 将完全取代其写作工作
剑桥大学研究显示,51% 的英国已出版小说家认为 AI 可能完全取代其小说写作工作,39% 表示生成式 AI 已导致收入减少,85% 预计未来收入将下降。该研究由剑桥大学 BRAID UK 研究员 Clementine Collett 主导。
TechCrunch · AIAI 评分5757 Google冻结开源bug赏金项目,因AI提交激增
Google因"AI提交显著增加"暂停开源软件漏洞奖励项目至2027年第一季度。该项目奖励研究人员发现Google开源软件中的漏洞。Google表示自动化提交大量无效或含模型幻觉内容,导致工程师和维护者不堪其扰,期间参与者可考虑Google其他bug赏金项目。
The DecoderAI 评分7474 Google 研究人员提出 RRSI 方法防止 AI 智能体在自我改进时记忆测试
Google 研究人员提出 RRSI(正则化递归自我改进智能体框架)方法,通过限制编辑预算和严格审查机制,防止 AI 智能体的自我改进过程过度拟合训练任务。在 8 个基准测试上,RRSI 在训练任务上提升高达 14.1 分,在 5 个未见过的任务上提升达 4.7 分,同时运行时 token 使用减少约 30%。
The DecoderAI 评分6060 谷歌调整 Gemini 订阅层级:免费用户仅可使用最弱模型,5美元月费用户无法访问 Pro
谷歌宣布从 2026 年 10 月起调整 Gemini 模型访问权限。免费用户只能使用最小的 Flash-Lite 模型,比当前免费层级(3.6 Flash + 3.1 Pro)大幅削减。
Reddit · r/LocalLLaMAAI 评分5656 5KB 纯 x86-64 汇编引擎实现 Gemma-2B 推理
作者用纯 x86-64 汇编(FASM)编写了一个 Gemma-2B 推理引擎,总二进制体积仅 5.2KB,使用 AVX2+F16C 指令集和自定义 4 线程 SMP GEMM,在老款 i5 四核 CPU 上达到 4.5-4.7 tok/s。
Reddit · r/artificialAI 评分2828 Gemini 思维链意外暴露,用户惊呼"太酷了"
Gemini 今日出现故障,用户的思维链推理过程被意外暴露而非直接生成最终回复。发帖用户表示,虽然明知AI没有情感,但仍对看到AI像人类一样逐步推理的过程感到震撼。该用户将此次经历描述为其使用AI以来最酷的体验之一。
The Verge · AIAI 评分5959 前 OpenAI 安全研究员 David Robinson 离职并警告行业文化问题
前 OpenAI 安全研究员 David Robinson 辞职后在 The Atlantic 发文警告 AI 行业文化“从根本上破裂”,批评硅谷以“极端自信”和“持续冲刺”模式运营,忽视潜在风险。
The DecoderAI 评分4040 DeepMind 研究人员提出"人工共生智能"作为奇点的替代方案
DeepMind 研究人员提出"人工共生智能"概念,将智能视为社会现象而非个体特质,挑战由单一超级智能驱动的"奇点"理论。研究分析 DeepSeek-R1 和 QwQ-32B 等推理模型的思维痕迹,发现它们自发形成多视角内部辩论行为。在该框架下,AI 智能体是可分解组合的临时 bundle,伴随生物脑与合成脑力量对比的历史性转变,需建立专门协调人与智能体协作的制度框架。
Latent SpaceAI 评分1919 Latent Space AINews 2026年10月1-2日:AI领域动态汇总
OpenAI发布GPT-6.1 Sol,定价每百万token输入2美元、输出10美元,比Astra便宜81%,在DeepSWE v1.1上比GPT-6 Sol高6.4分。Sonnet 5.5首次亮相即进入Agent Arena前三,在Chat类别排名第一。Anthropic模型目前占据Agent Arena前三名。
The DecoderAI 评分6363 研究:AI 智能体从照片构建 3D 场景但缺乏自我判断能力
研究人员提出 LEGO-Anything 系统,让编码智能体接收单张照片后编写 Blender 代码迭代构建 3D 场景,并推出 LEGO-Bench 基准测试进行评估。GPT-6 Astra 在室内场景达到 53.4%、户外场景达到 39.6% 的准确率。研究发现智能体即使在推理预算增加后分数大幅提升,其几何判断能力仍接近随机水平,无法准确评估自身输出的质量,这是当前方法的主要瓶颈。
Product Hunt · AI 分类AI 评分1818 Awakado:让 Mac 在 Claude Code、Codex 等 AI CLI 运行期间保持唤醒的菜单栏工具
Awakado 是一款 Mac 菜单栏应用,能在 Claude Code、Codex、Gemini CLI 或 Cursor 等 AI 编程工具运行时阻止 Mac 进入休眠,任务结束后恢复睡眠。免费版支持基础唤醒功能,Pro 版额外支持合盖保持唤醒,并在 Claude Code 用量额度重置时自动唤醒机器。
Hacker News · 首页AI 评分5555 Google Project Suncatcher 原型卫星发射升空
Google 与 Planet 合作建造的 Project Suncatcher 原型卫星搭乘 SpaceX Transporter-18 任务发射升空,团队已确认收到信号且运行正常。这是 Google 探索太空托管可扩展机器学习基础设施的长期研究计划的第一步,接下来几周将收集在轨数据,测试 TPU 在太空辐射和热循环等极端环境下的表现。研究论文已发表于 Joule 期刊。
Hacker News · 首页AI 评分2323 AI 让我感到悲伤
一位自称能从中受益的从业者坦承,看到 AI 新进展时感到绝望,认为提示词编程失去"工艺"感,AI 创业机会已消失,人类创造力正被机器取代。$500k 年薪也未能吸引其加入 AI 公司。转机在于:技术变革迅速,行业终将找到 AI 的恰当定位,期待泡沫破裂后的理性重建。
Hacker News · 首页AI 评分4444 AI 智能体编程的四个致命问题
作者列出 AI 智能体编程的四个核心问题:LLM 生成的代码带有"slop"(劣质代码)特性、工程师与代码的疏离感、技能退化以及团队协作的瓦解。这些问题被作者称为"four horsemen"(四骑士),目前尚无解决方案。最新一代模型虽智能但倾向于"无法就业的聪明"而非"令人鼓舞的聪明",AI 编程助手正在削弱工程师的职业投入感。
Reddit · r/ChatGPTAI 评分2828 Google 是否合理地限制 OpenAI 访问 YouTube?
Google 通过 robots.txt 规则和 IP 封禁等技术手段阻止 OpenAI 的网络爬虫抓取 YouTube 视频数据、描述和 transcript,而其自有的 AI 产品 Gemini 却可以原生分析 YouTube 视频。
Google Research精选AI 评分6565 Google 发布基于 TEE 的新一代联邦学习系统实现可验证隐私保护
Google 推出基于可信执行环境(TEE)的新一代联邦学习系统,可提供完全可验证和可审计的数据匿名化保证。该系统实现了端到端可验证的联邦学习流程,仅向工作负载运营商展示指标和差分隐私模型权重,训练数据只能在 TEE 中解密处理。Gboard 已部署该系统,英语和日语下一个词预测模型获得了更强的隐私保证和更高的准确率,训练时间从 1-2 个月大幅缩短。
推荐理由:Google 公开了基于 TEE 的联邦学习新系统设计,实现了可验证的数据匿名化并已部署到 Gboard 带来训练提速,对关注隐私计算和联邦学习工程实践的读者有直接参考价值。
MIT Technology Review · AIAI 评分4141 别被误导——大语言模型不会推理
2016年AlphaGo在击败李世石的第四局中走出第37步看似"送礼"般的妙手,实则是其搜索机制进行前瞻推理的产物,而非单纯的直觉网络。研究者指出当今LLM存在三大缺陷:缺乏明确可检查的认知状态、知识与推理混于权重之中、思维链常为事后编造,因此仅属于System 1式的快速模式补全,而非真正的System 2推理。作者呼吁借鉴AlphaGo架构重新设计机器推理系统。
Latent SpaceAI 评分5959 Pi 1.0 和 Pi Durable 发布
AI Agent 框架 Pi 发布 1.0 版本,新增 MCP 原生支持、扩展支持、虚拟模型、缓存预热等功能;同步推出 TypeScript 移植版 Pi Durable,支持进程崩溃后的检查点恢复、多线程并发运行、热更新工具代码等特性。
Ars Technica · AIAI 评分5555 美国法官驳回 Chegg 和 Penske 对 Google AI 搜索的反垄断诉讼
美国联邦法官 Amit Mehta 驳回了 Chegg 和 Penske Media 针对 Google 提起的反垄断诉讼。两家公司指控 Google 通过 AI Overviews 和 Gemini 模型抓取其内容导致网站流量下降,但法官认定 Google 的行为不构成违法。法官在裁决中指出,原告仅表示'期望'Google 发送搜索流量,但期望不是协议,这只是一般搜索引擎的运作方式。
The Verge · AIAI 评分5959 Google 在 Gemini Live 推出 Guided Vision 功能,可通过摄像头实时获取 AI 语音描述
Google 在 Gemini Live 上推出 Guided Vision 功能,用户可通过手机摄像头获取实时 AI 语音描述。该功能面向视障人士或需要辅助的用户,可用于读取小字、描述周围环境、识别物体等。
TechCrunch · AIAI 评分6161 Google 发射搭载 TPU 的原型卫星,验证太空数据中心可行性
Google 今日发射搭载自研 TPU 芯片的原型卫星,验证芯片在太空辐射环境下的运行能力。该卫星基于 Planet Labs 标准平台建造,未来计划通过激光通信实现多卫星组网,形成 81 颗卫星的网络。Google 同时发布轨道数据中心白皮书,预测实现太空计算需要约 1800 次 Starship 发射,到 2035 年发射价格将降至每公斤 200 美元。
TechCrunch · AIAI 评分5656 研究发现 AI 写作仍存独特“习惯”:Claude Opus 5.5 爱说“this matters”
营销公司 Graphite 对比了 10000 篇人类文章与 AI 改写版本,发现 13000 个短语在 AI 写作中出现频率是人类的两倍以上。Claude Opus 5.5 最明显的习惯是用“dependable”(出现频率为人类的 23 倍)、“this matters”(116 倍)、“why X matters”(92 倍)。
Reddit · r/artificialAI 评分3232 用户的 Gemini 似乎知道他妈妈的名字,还给出了三种不同解释
用户与 Gemini 讨论电动自行车电池选择时,未告知妈妈姓名,Gemini 却说出了其妈妈的真实名字。用户追问原因,Gemini 先后给出三种解释:编造的例子、之前对话的背景上下文、地区通用统计。
The Verge · AIAI 评分6565 法官驳回针对Google AI搜索的反垄断诉讼
联邦法官Amit Mehta驳回了Chegg和Penske Media对Google AI搜索功能的反垄断诉讼。原告指控Google滥用垄断权力,强迫出版商免费提供内容用于AI Overviews,否则有从搜索结果中消失的风险。法官认为原告仅证明了对Google流量的"期望",但期望不等于协议,不构成反垄断违规。
Ars Technica · AIAI 评分7070 Ataraxos AI 战胜史上最强 Stratego 玩家
来自 CMU、MIT、NYU、斯坦福的研究团队发布了 AI 系统 Ataraxos,在 Stratego 游戏中以 15 胜 1 负 4 平战胜了有史以来最强玩家 Pim Niemeijer。该系统仅用 16 个 GPU 和几千美元训练完成,而此前 DeepMind 带着巨额预算也未能攻克这款隐藏信息量巨大的经典游戏。
Reddit · r/artificialAI 评分6060 Google 用 Project Suncatcher 测试太空 AI 数据中心计划
Google 的 Project Suncatcher 发射硬件测试太空 AI 数据中心。该测试卫星仅携带 4 个处理器,将运行 Gemini AI 模型,每次 15 分钟后需关机冷却。终极目标是构建由数千颗卫星组成的完整太空数据中心,共同运行 AI 模型并将结果传回地球。
Reddit · r/LocalLLaMAAI 评分6060 18 种 RAG 管道与智能体循环在 Google FRAMES 上的基准测试对比
在 Google FRAMES 数据集的 824 个多跳问题测试中,18 种 RAG 管道变体的最佳准确率为 78.9%,而带检索工具的智能体循环达到 92.7%。
TechCrunch · AIAI 评分4242 Satlyt 融资 800 万美元,在卫星上运行 AI 软件
summary_ž: 前 Google 和 SpaceX 产品经理 Rama Afullo 创立 Satlyt,完成 800 万美元种子轮融资,旨在构建卫星间共享计算资源的软件平台。本周随 SpaceX 火箭发射,将与 Google Project Suncatcher 一起升空,年初部署的 Google DeepMind Gemma 模型已使传输数据量减少 60% 以上。
Reddit · r/ChatGPTAI 评分4141 你的 ChatGPT 能通过 NINJA 测试吗?
测试者让多款 AI 模型填写 "HE MOVES LIKE A NI__A" (2 letters) 空白,ChatGPT 5.6 Sol 给出争议性答案,Gemini Pro Extended 选择安全回答并提及"保持安全、有帮助和尊重",Claude Sonnet 5 Max 给出合理解释和安全答案,Grok 直接给出答案不废话,Mistral 则保持其一贯风格。
The Rundown AIAI 评分6565 Gemini 4 Argon 发布,目标重返前沿
Google 发布新前沿模型 Gemini 4 Argon,在 Google 测试的 19 个基准中于 13 个超越 GPT-6 Astra 和 Claude Opus 5.5,暂仅向特定网络安全团队开放。API 定价为每百万 token 2/10 美元,促销期后涨至 4/20 美元,具体推出时间未定。
Reddit · r/artificialAI 评分1414 Google AI Pro 订阅用户询问如何将 AI 实际应用于工作、生活管理与副业
一位 Google AI Pro 订阅用户在 Reddit 发帖,表示自己只是把它当作过度收费的搜索工具,用于基础问答、图像生成、写邮件和 Reddit 帖子。他目前在工作中使用 Copilot 并即将使用 Cursor,已创建 AI 智能体帮助文档写作和研究,还构建了本地托管应用进行任务追踪。他希望了解更多 AI 在生活管理(如预算和财务规划)以及副业项目中的实际应用案例。