#新工具
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#新工具
今日 0 条研究 · 工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条The DecoderAI 评分7171 BootLoops 发布:支持 AI 模型进行精确科学计算
哈佛大学物理学教授 Matthew Schwartz 开发了开源工具 BootLoops,让 Claude 可以在科学研究中进行精确计算。该工具在三个月内产出了 36 篇论文,涵盖粒子物理学、生态学、群体遗传学、经济学和语言学等领域。Schwartz 指出,AI 虽然能快速解决计算问题,但科学价值仍需领域专家来把握方向;模型存在过早宣布成功、难以判断任务复杂度等局限。
Reddit · r/LocalLLaMAAI 评分4949 SWE-sweep:Meta 等推出新 benchmark,测试大语言模型主动发现并修复 bug 能力
Meta、Stanford、Harvard、UW 研究人员推出 SWE-sweep benchmark,测试大语言模型在用户遇到 bug 前主动发现并修复 bug 的能力,bugs 均为来自真实代码库的可发现可修复问题。
Hacker News · 首页AI 评分6666 开源工具 livenerf 发布:追踪 Claude Opus 5.5 发布后能力漂移
livenerf 是一个针对 Claude Opus 5.5 的基准测试工具,于 2026-09-24(发布后约 2.5 天)开始运行,计划连续 30 天每天运行一次以追踪模型能力变化。
Microsoft Research精选AI 评分6666 微软发布 Quine:面向生物学复杂性的 AI 研究系统
微软研究院发布 Quine,这是一款旨在连接科学工具、文献、实验室和研究人员的 AI 研究系统。与 Broad Institute 合作,该系统用于预测和优先排序能够驱动肿瘤状态转变的化合物。在胰腺导管腺癌(PDAC)的湿实验证中,Quine 最高排名的化合物产生了最大的预期转录变化,整个过程仅用一个周末就完成了候选化合物的筛选和验证。
推荐理由:原文给出了 Quine 的具体能力(世界模型+交互式 harness)、应用场景(胰腺癌药物预测)和初步验证结果,读者可以据此了解这个 AI 系统如何辅助生物研究以及实际效果。
NVIDIA BlogAI 评分5656 曼彻斯特大学用 NVIDIA Earth-2 预测英国空气污染
曼彻斯特大学团队使用 NVIDIA Earth-2 CorrDiff(生成式降尺度模型)和 StormCast(时间依赖预测模型),基于 Isambard-AI 超级计算机训练,仅用两天构建了覆盖英国、分辨率 2-3 平方公里的空气污染预测模型。
Hugging Face Blog精选AI 评分7070 Hugging Face 开源 Grabette:手持式机器人操作数据采集系统
Hugging Face 发布 Grabette,一款开源手持式机器人操作数据采集系统。用户可用手持夹持器记录人类演示,自动转换为 LeRobot 格式的数据集用于训练机器人策略。
推荐理由:原文给出了具体的硬件成本 BOM、配套的 Gripette 机械爪和 LeRobot 训练流程,读者可以据此判断这个数据采集方案是否适合自己的机器人学习项目。
Google Research精选AI 评分7070 Google Research 在 I/O 2026 展示多项研究进展:科学工具、医疗健康、边缘计算、天气预测等
Google Research 在 I/O 2026 展示了多个研究进展。Gemini for Science 套件整合了 ERA(研究编码系统)和 Co-Scientist(多智能体系统),可辅助科学假设生成和计算实验。
推荐理由:原文系统展示了Google在I/O 2026的多个研究进展,涵盖科学工具、医疗健康、边缘计算、天气预测等方向,读者可从中了解AI在科研和产业应用的前沿进展。
Google Research精选AI 评分6363 Google 发布 Empirical Research Assistance (ERA),一款用于科学研究代码编写的 AI 工具
Google 发布 Empirical Research Assistance (ERA),这是一款使用 Gemini 编写和优化科学代码的研究工具,可搜索科学文献、写代码、探索方案、组合技术并评估结果,在基因组学、公共卫生、卫星图像分析等多个基准上达到专家水平。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Google ResearchAI 评分5959 Google 发布 Vantage:用生成式 AI 评估未来必备技能的研究实验
Google Research 联合纽约大学发布 Vantage,一个利用生成式 AI 在模拟环境中创建对话来评估学生未来必备技能(如批判性思维、协作、创造性思维)的研究实验。该工具有 Executive LLM 引导对话进行自适应评估,AI Evaluator 与人类专家评分一致性相当。Vantage 现已在 Google Labs 开放英语注册,旨在为教育者提供可扩展的技能评估方法。
Google DeepMind精选AI 评分7272 Google DeepMind 发布 AI 赋能光标原型
Google DeepMind 发布实验性的 AI 赋能光标,能够理解用户指向的内容及上下文。用户只需指向并用自然语言提问(如“显示方向”“对比这些产品”),AI 即可识别光标处的文字、图像、代码块等元素并提供相应帮助。该原型基于 Gemini 构建,计划集成到 Chrome 和新的 Googlebook 设备中。
推荐理由:Google DeepMind 展示了 AI 赋能光标的新交互范式,读者可以了解 AI 如何从理解'指向什么'升级到理解'为什么指向',以及这一变化对现有工作流的意义。
Google Research精选AI 评分7575 Google Flood Hub 推出 AI 城市突发洪水预报,可提前 24 小时预警
Google 宣布在 Flood Hub 上推出 AI 城市突发洪水预报功能,可提前 24 小时预测城市突发洪水风险。该系统使用 Groundsource 方法论(由 Gemini 分析新闻报道生成历史洪水数据集)训练 LSTM 模型,仅依赖全球气象数据即可生成 20x20 公里分辨率的预报。
推荐理由:原文给出了AI驱动方法如何弥合全球预警差距的具体数据,读者可以据此评估它对发展中国家的实际价值。