跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
一手 · 工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Google Research精选AI 评分6868 Google 研究:AI 协助三个月专利撰写实地实验显示初级律师未获持久判断力提升
Google Research 发布与 NBER 合作的论文《Does AI Assistance Enhance or Erode Expertise?
推荐理由:原文基于三个月实地实验区分了即时产出与长期判断力,可帮助读者理解 AI 工具在专业培养中的边界。
Google DeepMindAI 评分5555 Google DeepMind 发布端侧多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 推出 EmbeddingGemma 2,基于 Gemma 4 架构,采用 Apache 2.0 协议开源,参数量为 740M,可将文本、图像、音频和视频映射到统一嵌入空间。
Google ResearchAI 评分4141 Google Earth AI 用 PDFM 行星地理空间基础模型赋能全球公共卫生
Google Research 团队以 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)为代表,演示了行星级地理空间基础模型在公共卫生中的新范式。
Google ResearchAI 评分3737 Google 发布《智能体隐私与安全的开放与新兴问题》研讨会报告,主张以"情境完整性"框架约束 AI 智能体行为
Google 发布一份由 50 多位学界与业界专家共同撰写的研讨会报告,系统梳理 AI 智能体在隐私与安全上区别于传统软件的三大挑战:非结构化接口带来的提示词注入、概率性控制流难以用传统测试保障,以及任务委派后用户监督失效的"确认疲劳"。报告主张以"情境完整性"理论为基础,构建包含系统级沙箱、模型级推理与用户级控制的分层防御架构,并提出由实时动态策略引擎监督智能体行为是否合乎所在情境的社会规范。
Google Research精选AI 评分6565 Google 发布基于 TEE 的新一代联邦学习系统实现可验证隐私保护
Google 推出基于可信执行环境(TEE)的新一代联邦学习系统,可提供完全可验证和可审计的数据匿名化保证。该系统实现了端到端可验证的联邦学习流程,仅向工作负载运营商展示指标和差分隐私模型权重,训练数据只能在 TEE 中解密处理。Gboard 已部署该系统,英语和日语下一个词预测模型获得了更强的隐私保证和更高的准确率,训练时间从 1-2 个月大幅缩短。
推荐理由:Google 公开了基于 TEE 的联邦学习新系统设计,实现了可验证的数据匿名化并已部署到 Gboard 带来训练提速,对关注隐私计算和联邦学习工程实践的读者有直接参考价值。
Google DeepMind精选AI 评分7777 Google DeepMind 发布 Gemini 4 Argon 前沿模型
Google 发布新前沿模型 Gemini 4 Argon,在复杂软件工程、企业知识工作和网络安全防御方面达到前沿性能。上下文窗口扩展至 100 万 token,定价为输入每百万 token 2 美元、输出 10 美元。该模型通过 Fairwind Program 向部分受信任的网络防御者提供,并将在不久后向付费 API 客户和 Google AI Ultra 订阅用户开放。
推荐理由:原文给出了具体的能力变化和性能数据,读者可以据此判断这个模型的能力水平和应用场景。
Google DeepMind精选AI 评分6161 Google DeepMind 发布 SynthID Bio:为 AI 生成蛋白质嵌入水印技术
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,在保留生物功能的前提下向 AI 生成的蛋白质序列和预测的 3D 结构中嵌入不可察觉的签名。该技术可通过湿实验验证,已在水印蛋白质binder上成功测试,与未水印版本具有相同的命中率和结合亲和力。
推荐理由:这是首个将数字水印嵌入生物代码并能在合成蛋白质上验证的技术,读者可据此理解 AI 生物设计的安全防护新路径。
Google ResearchAI 评分5959 Google发布Diffusion Controller:统一并简化AI图像生成控制
Google Research提出Diffusion Controller框架,将图像生成的去噪过程重新定义为连续控制问题。该框架通过轻量级的“转向阻尼器”网络实现对生成轨迹的动态调整,可在不修改基础模型的情况下控制生成结果。在Stable Diffusion v1.4上的实验显示,灰盒版本在HPS-v2胜率上优于LoRA,白盒版本相较基线模型达到90%胜率。
Google Research精选AI 评分6464 Google Research 提出多智能体框架实现连贯长视频生成
Google Research 发布多个研究框架(Co-Director、CANVAS、A²RD、VQQA)用于解决长视频生成的连贯性问题。AI video co-director 将视频叙事建模为全局优化问题,通过多智能体分层架构协调创意策略;CANVAS 维护视觉记忆确保角色和场景一致性;A²RD 支持分钟级视频的自主生成;VQQA 通过视觉问答实现闭环优化。
推荐理由:原文提出了多个解决长视频一致性问题的框架,读者可以了解如何通过多智能体协作和世界状态跟踪来改善视频生成的连贯性。
Google DeepMind精选AI 评分7070 Gemini 3.8 Live 推出 Live Avatar 功能,实现实时视觉呈现
Google DeepMind 推出 Gemini 3.8 Live 的 Live Avatar 功能,实现近实时视频生成与语音同步,支持精确口型同步、自然表情和 97 种语言无缝切换。该功能现已在 Gemini Enterprise 可用,企业可定制头像(仅限白名单)。所有输出均带有 SynthID 水印以确保透明度。
推荐理由:原文给出了具体的能力变化和可用范围,读者可以据此判断它对现有工作流的影响。
NVIDIA Blog精选AI 评分7171 NVIDIA 联合 Google DeepMind 和 EMBL-EBI 发布 2800+ 病毒蛋白质复合物 3D 结构数据集
NVIDIA 与 Google DeepMind、EMBL-EBI 等机构合作发布了超过 2800 种病毒的蛋白质复合物 3D 结构预测数据集,通过 AlphaFold Database 公开供全球科学家使用。
推荐理由:给出了具体的病毒数量、全新发现比例和技术方案,读者可以据此判断该数据集对自己的研究是否有直接帮助。
Google DeepMindAI 评分5757 Google DeepMind 发布安全服务器端内存的 Private AI Compute 架构更新
Google DeepMind 发布 Private AI Compute 平台的技术更新,新增 persistent memory 功能。该架构将服务器端内存设计为安全数字保险库,用户数据在云端加密存储,解密密钥仅存在于用户个人设备端,确保 Google 也无法访问用户数据。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.8 Text-to-Speech
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款新的文本转语音模型,在 Hume AI Voice Design Benchmark 获得第一。
推荐理由:原文给出了具体的能力变化和开放入口,读者可以据此判断它会怎样改变现有的语音生成工作流。
Google Research精选AI 评分6262 Google Research 发布利用生成式 UI 帮助教师创建互动学习工具的研究
Google Research 发布新研究实验,利用生成式用户界面(GenUI)技术帮助教育者创建定制的互动学习模拟工具。
推荐理由:这是 Google 将生成式 UI 技术应用于教育场景的研究实验,给出了具体的技术实现路径和教师反馈数据。
NVIDIA BlogAI 评分5959 Emerald AI、Google 和 NVIDIA 成立 AI Energy Management Alliance,推动灵活 AI 数据中心发展
Emerald AI、Google 和 NVIDIA 宣布成立 AI Energy Management Alliance(AEMA),这是首个推动数据中心根据电网状况动态管理电力使用的联盟组织。
Google ResearchAI 评分5454 绕过推理瓶颈:用 Retrieve-for-Train 加速复杂 AI 搜索
Google Research 提出 Retrieve-for-Train 框架,通过离线 RL 将搜索推理行为蒸馏到 53.9M 参数的扩散模型中。在时尚和音乐数据集上,该方法实现了 12-20 倍的推理加速,同时保持搜索结果的多样性和相关性。
Google DeepMind精选AI 评分7676 Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking
Google DeepMind 发布两款新的实时对话模型:Gemini 3.8 Live 注重规模化和成本效率,结合对话智能与流畅交互;Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备增强智能和多步推理能力。
推荐理由:原文给出了具体性能数据(82.6% Speech to Speech Quality Index、68.6% τ-Voice 等)和多个平台可用入口,读者可据此判断该模型相对现有产品的能力提升和适用场景。
Google Research精选AI 评分6262 ToolGrad:基于文本“梯度”的高效工具使用数据集生成
ToolGrad 采用"答案优先"策略,先生成真实工具调用链,再标注对应用户提示,利用文本梯度迭代构建 API 工作流。实验表明该方法可生成更复杂的长程工具使用数据,pass rate 接近 100%,成本更低。
推荐理由:提出一种新的数据生成范式,可生成更复杂的工具使用数据并降低成本,学生模型甚至超越教师模型。
Google DeepMind精选AI 评分8282 Google DeepMind 发布 AlphaGenome Atlas:覆盖人类基因组全部 90 亿单碱基变异的预测图谱
Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组全部 90 亿个单核苷酸变异的分子效应预测,并推出 AVI 综合评分帮助研究人员快速排序和解读变异影响。该平台已在罕见疾病研究和群体遗传学分析中取得实际成果,现通过官网免费向学术研究开放。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Google Research精选AI 评分7171 Google Research 联合发布完整雄性果蝇大脑连接组图谱
Google Research 与 HHMI Janelia、MRC 分子生物学实验室等机构合作,在 Cell 期刊发表了完整的雄性果蝇大脑和中央神经系统连接图谱,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今为止最大的大脑图谱。该图谱可帮助科学家研究果蝇的神经机制,并为理解更复杂的大脑(包括人类大脑)奠定基础。
推荐理由:这是目前最大的大脑图谱,为研究大脑工作原理提供了基础资源,读者可了解连接组学的前沿进展及其对神经科学的意义。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 WeatherNext 3:迄今最先进、最准确的全球天气 AI 模型
Google DeepMind 发布 WeatherNext 3,这是迄今最先进、最准确的全球天气 AI 模型。新模型使用实时卫星数据训练,每小时更新一次,分辨率 5-25 公里,比上一代 WeatherNext 2 清晰约 5 倍。
推荐理由:原文给出了具体的性能提升数据(CRPS 提升 60%/30%/10%),分辨率提升 5 倍,与上一代 WeatherNext 2 有明确对比,读者可以据此判断模型的实际进步幅度。
Google DeepMindAI 评分5555 Google DeepMind 推出 Fairwind Program,为政府和企业提供主动网络防御能力
Google DeepMind 推出 Fairwind Program,一个面向政府、受信任合作伙伴和 Google Cloud 客户的有限访问项目,提供 Gemini 3.8 Flash Cyber 和 CodeMender 工具,帮助防御者自主发现和修复漏洞。
Google DeepMind精选AI 评分7777 Google DeepMind 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber
Google DeepMind发布Gemini 3.8 Flash和3.8 Flash Cyber两款新模型。3.8 Flash在DeepSWE v1.1基准上超越多数更大规模的frontier模型,在HLE-Verified上达54.9%,价格为每百万输入token 0.75美元、输出token 3.75美元。
推荐理由:原文给出了在软件工程、Agent任务和多步推理方面的具体性能提升数据和成本对比,读者可据此判断模型能力变化。
Google Research精选AI 评分6262 Google 与 NASA 合作利用深度学习从太空绘制全球甲烷排放图
Google 与 NASA JPL 合作发布了 MAPL-EMIT 深度学习框架,可从 EMIT 卫星高光谱图像中自动检测、量化并定位甲烷排放源。该模型在专家标注的 plumes 上达到 84% 召回率,比现有方法多检测约 50% 的可信 plumes,并在全球 25 个最大排放填埋场中的 24 个成功绘制了羽流。
推荐理由:原文给出了具体性能指标(84%召回率、比现有方法多检测50% plumes)和数据集规模(3.6万个合成 plumes),提供了可迁移的环境监测方法论。
Google DeepMind精选AI 评分7474 Google DeepMind 推出 Gemini 智能体视频理解功能
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解功能,该功能将模型核心推理与原生视频工具结合,动态搜索和检查目标视频片段,相比静态处理可降低最多 88% 的 token 消耗和 66% 的成本,同时提升最多 7% 的准确率。
推荐理由:原文给出了 token 消耗降低 88%、成本降低 66%、质量提升 7% 的具体数据,读者可以据此评估该功能对自身工作流的效率提升。
Google Research精选AI 评分7878 Google 发布 TimesFM-3 零样本多变量时间序列预测基础模型
Google Research 发布 TimesFM-3,这是新一代零样本时间序列基础模型,专为多变量预测设计。模型拥有 3.3 亿参数,在超过 1 万亿时间点的真实和合成数据上预训练,支持多目标同时预测、过去协变量和过去-未来协变量。
推荐理由:读者可通过本文了解时间序列预测的基础模型最新进展,以及多变量预测相比单变量预测的具体精度提升。
Google ResearchAI 评分4343 Google Earth AI 的 Planetary Prediction Engine 如何实现全球地理空间预测自动化
Google 推出 Planetary Prediction Engine(PPE),作为 Google Earth AI 的实验性研究能力,可自主完成从数据发现到模型训练的完整地理空间预测工作流,将复杂建模周期从数周缩短至数分钟。
Google DeepMind精选AI 评分7676 Google DeepMind 发布 Gemini Omni 1.1 Flash
Google DeepMind 发布 Gemini Omni 1.1 Flash,带来场景扩展、首尾帧插值、360p 快速预览和 4K 超分辨率等创意控制功能。新模型支持最长 40 秒视频生成,可在 Google AI Studio 和 Agent Platform API 中使用,也可通过 Google AI Plus、Pro 和 Ultra 订阅在 Google Flow 中访问。
推荐理由:提供了具体的性能提升数据和可用性信息,读者可以评估新模型对自己工作流的实际价值。
Google DeepMindAI 评分5454 Google DeepMind 推出全球首个双盲 AI 评估方法
Google DeepMind 联合新加坡 AI 安全研究所、OpenMined 等机构,首次对 Gemini Flash Lite 模型实施双盲评估。该方法通过加密技术将外部评估限制在隔离环境中,防止模型预先获取测试题,从而避免 benchmark 污染问题,提升评估的可信度和完整性。
Google ResearchAI 评分4848 Google 发布 GlucoFM:用于连续血糖监测的基础模型
Google 推出 GlucoFM,一种自监督双流基础模型,可将缓慢血糖趋势与短期偏离分离,在 14 项队列-任务评估中平均 PR-AUC 较最佳 GluFormer 变体提升 5.8 个百分点。
Google DeepMind精选AI 评分7474 Google 发布 Gemini 3.5 Transcribe 语音转文字模型
Google 发布 Gemini 3.5 Transcribe语音转文字模型,支持实时流式和预录制音频两种模式,通过 Gemini API (Google AI Studio) 和 Enterprise Agent Platform 提供。
推荐理由:给出了具体的 WER 数值和延迟改善比例,读者可以直接对比评估它的实际性能。
Google ResearchAI 评分4848 AgentHands:让XR智能体实现同步手势交互的研究原型
Google Research在CHI 2026发布AgentHands研究原型,使AI智能体能在XR环境中生成与语音同步的手势。该系统将LLM响应中的GestureEvents映射到XR设备的手势动画,通过12人用户研究验证了在植物护理指导、3D打印机操作等场景中,体感交互显著提升空间 grounding 效果。
Google ResearchAI 评分4444 Google Research 发布 Biomarker Discovery Framework:可穿戴传感器数据候选生物标志物优先排序 AI 工具
Google Research 发布 Biomarker Discovery Framework,一个用于从可穿戴设备传感器数据中优先排序候选生物标志物的多智能体系统。
Google DeepMind精选AI 评分6161 Google DeepMind 回顾 15 年游戏 AI 研究并宣布与 EVE Online 开发商合作
Google DeepMind 回顾了从 Atari DQN 到 AlphaGo、AlphaFold 的 15 年游戏 AI 研究历程,宣布与 Fenris Creations 合作探索 EVE Universe。
Google ResearchAI 评分4848 Google Research 如何用 ME-POIs 框架让语言模型更深入理解地点
Google Research 推出 Mobility-Embedded POIs 框架,通过将聚合匿名移动模式(如到达时间、停留时长)融入地点的文本表征,解决传统语言模型仅依赖静态元数据的问题。该方法在意图预测、价格分类和繁忙度估计上分别实现 81.9%、75.1% 和 24.7% 的相对提升。框架采用访问对齐、空间多尺度传播和文本-移动协同三步流程,有效缓解了中小商户数据稀疏的"长尾"难题。
Google ResearchAI 评分5252 Google 发布 PhotoScan:用智能手机照片预测身体成分和胰岛素抵抗风险
Google Research 发布 PhotoScan 深度学习框架,可从标准 2D 智能手机照片估算身体脂肪百分比、Android-to-Gynoid 脂肪比和内脏-皮下脂肪比。
Hugging Face BlogAI 评分5454 开放模型现状:2026年夏季观察
Hugging Face 发布2026年1月至8月开放模型生态报告。公开模型仓库从243万增长至296万,数据集从71.1万增至100万,Spaces从100万增至144万。
Google DeepMind精选AI 评分7979 Google DeepMind 发布 Gemini 3.7 Flash
Google DeepMind 推出 Gemini 3.7 Flash,这是其面向编码和智能体任务的工作主力模型。该模型在软件工程任务中实现显著提升,FrontierCode 1.1 Main 得分从 34.4% 提升至 43.6%,DeepSWE v1.1 从 49.0% 提升至 65.3%。
推荐理由:原文给出了性能基准提升和价格信息,读者可以据此判断新模型是否值得在生产环境中使用。
Google DeepMind精选AI 评分6666 Google DeepMind 发布 SL2T 手语转文本模型
Google DeepMind 推出突破性的多语言手语转文本模型 SL2T,训练数据涵盖 50 多种手语超过 10 万小时。该模型首次将手语 AI 带入消费产品,已在 Gboard 和 Live Transcribe 的 Pixel 11 上线,支持美式手语转英语。
推荐理由:首个将手语 AI 实际带入消费产品的突破,在 FLEURS-ASL 基准上实现了 70 BLEURT 的零样本成绩,可供读者了解当前手语 AI 的实际可用性。
Google Research精选AI 评分7070 空架子还是丢失的钥匙?召回成为大语言模型参数化事实性的瓶颈
Google Research 发布新研究,引入知识分析框架区分编码失败和召回失败,分析了 Gemini-3、GPT-5 等前沿模型发现:编码率已达95-98%饱和,但直接召回仍失败26-34%的事实,即使启用思考仍失败11-12%。研究表明事实性错误主要源于知识可访问性问题而非知识缺失,思考能力可恢复约40-65%已编码但无法直接回忆的知识。
推荐理由:原文给出了编码vs召回的新分析框架和量化数据,读者可以据此理解前沿模型的事实性瓶颈已从知识获取转向知识利用。