#新工具
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#新工具
今日 0 条一手 · 工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条Hugging Face Blog精选AI 评分6262 Allen AI 开源 AstaBrief 8B 科学报告生成模型
Allen AI 发布并开源了 AstaBrief 8B 模型,该模型可将研究问题和检索到的文献片段转化为带引用的科学报告。作为 Asta 平台 Generate a report 功能的 Fast 模式,平均生成时间为 51.1 秒,相比 Claude 驱动的 Thinking 模式(178.5 秒)提速约 3.5 倍。
推荐理由:提供了完整的训练数据构建、偏好数据过滤、评估指标设计过程,可供研究科学报告生成模型的开发者参考。
Hugging Face Blog精选AI 评分6161 AllenAI 发布 Olmo-core 3:面向大规模 MoE 的开源可扩展训练基础设施
AllenAI 发布 Olmo-core 3 训练框架,支持将专家池从 8 扩展到 128 而每 token 仅激活 4 个专家,总参数量从 4.6B 增至 47B,训练吞吐量仅下降不到 5%。在 8 个 NVIDIA B300 GPU 上,47B MoE 达 52,000 tokens/s/GPU,约为此前实现的 2.7 倍。系统已测试至 1.2 万亿参数规模。
推荐理由:原文给出了专家池扩展、吞吐量提升和参数规模的具体数字,读者可以据此判断这套训练基础设施对大模型研究的具体价值。
NVIDIA BlogAI 评分3030 NVIDIA 开放 2027-2028 研究生奖学金申请,最高 $60,000
NVIDIA 研究生奖学金项目(第26届)现面向全球开放申请,面向 AI、机器学习、自动驾驶、计算机图形学、机器人、医疗及高性能计算等领域的博士生,最高奖励 $60,000/人。申请截止日期为 2026 年 10 月 30 日,需在 2027 年夏季完成实地实习。自 2002 年起该项目已发放超 220 项奖学金,总额约 $800 万。
Hugging Face Blog精选AI 评分7070 Hugging Face 发布 Open TTS Leaderboard:开源多语言 TTS 与语音克隆的可扩展评估
Hugging Face 发布 Open TTS Leaderboard,使用客观指标(WER/CER 可理解性、RTFx 推理速度、TTFA 首音频延迟、SIM 说话人相似度)评估开源 TTS 模型,解决 arena 方式无法跟上模型发布速度的问题。
推荐理由:给出了具体的评估指标和部分模型排名,读者可以直接查看 leaderboard 了解各开源 TTS 模型的可理解性和速度表现。
Google DeepMind精选AI 评分6161 Google DeepMind 发布 SynthID Bio:为 AI 生成蛋白质嵌入水印技术
Google DeepMind 发布 SynthID Bio,将水印技术引入合成生物学,在保留生物功能的前提下向 AI 生成的蛋白质序列和预测的 3D 结构中嵌入不可察觉的签名。该技术可通过湿实验验证,已在水印蛋白质binder上成功测试,与未水印版本具有相同的命中率和结合亲和力。
推荐理由:这是首个将数字水印嵌入生物代码并能在合成蛋白质上验证的技术,读者可据此理解 AI 生物设计的安全防护新路径。
Microsoft Research精选AI 评分6666 微软发布 Quine:面向生物学复杂性的 AI 研究系统
微软研究院发布 Quine,这是一款旨在连接科学工具、文献、实验室和研究人员的 AI 研究系统。与 Broad Institute 合作,该系统用于预测和优先排序能够驱动肿瘤状态转变的化合物。在胰腺导管腺癌(PDAC)的湿实验证中,Quine 最高排名的化合物产生了最大的预期转录变化,整个过程仅用一个周末就完成了候选化合物的筛选和验证。
推荐理由:原文给出了 Quine 的具体能力(世界模型+交互式 harness)、应用场景(胰腺癌药物预测)和初步验证结果,读者可以据此了解这个 AI 系统如何辅助生物研究以及实际效果。
AWS Machine Learning Blog精选AI 评分6868 AWS 发布基于智能体的对话式视频智能解决方案
AWS 发布了基于 Strands Agents SDK 的对话式视频智能解决方案,整合 Amazon Bedrock、Rekognition 和 Transcribe,允许用户用自然语言提问视频内容。该方案在运行时动态决定调用哪些服务,无需为每种查询类型预建管道。已有客户使用后手动审查时间减少约 80%。完整实现已开源。
推荐理由:给出了基于 Strands Agents SDK 的视频智能架构完整实现方案,读者可据此复用到其他模态。
OpenAI NewsAI 评分2222 invideo 如何用 GPT‑6 Astra 实现颜色分级提升 3 倍
GPT‑6 Astra 帮助 invideo 实现颜色校正和分级效率提升 3 倍,编辑规划精度显著提高。invideo 现在可在一日内生成 50 个自定义效果。
OpenAI NewsAI 评分3939 OpenAI 推出法律 AI 产品 Astra for Law
OpenAI 发布面向法律行业的 AI 产品 Astra for Law,提供法律领域前沿智能、自定义律所工作流程和连接的合法数据源。该产品同时提供法律级安全控制,支持机密客户工作。
NVIDIA Blog精选AI 评分6767 NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次亮相中实现领先性能
NVIDIA Vera Rubin NVL72 系统首次提交 MLPerf Inference v6.1 预览测试,在 Qwen3-VL 基准上提供高达 3.7 倍于 GB300 NVL72 的吞吐量,在 DeepSeek-R1 上达到 2.5 倍。GB300 NVL72 在 288-GPU 四机架扩展测试中实现 99% 扩展效率,软件优化相比 v6.0 提升高达 1.6 倍性能。
推荐理由:给出了具体的性能倍数和扩展效率数据,读者可以据此评估新硬件对推理工作负载的实际价值。
OpenAI NewsAI 评分3131 OpenAI 探索 AI 广告体验:Sponsored Agents 及其与 HubSpot、Shopify 整合
OpenAI 推出 AI 广告体验,包括面向营销人员的 Sponsored Agents 工具,以及与 HubSpot、Shopify 的深度集成,为广告投放和客户互动提供新的 AI 驱动解决方案。
NVIDIA BlogAI 评分5656 曼彻斯特大学用 NVIDIA Earth-2 预测英国空气污染
曼彻斯特大学团队使用 NVIDIA Earth-2 CorrDiff(生成式降尺度模型)和 StormCast(时间依赖预测模型),基于 Isambard-AI 超级计算机训练,仅用两天构建了覆盖英国、分辨率 2-3 平方公里的空气污染预测模型。
NVIDIA Blog精选AI 评分6363 NVIDIA 发布 DSX 平台优化 AI 工厂电力管理
NVIDIA 推出 DSX(Digital Spectrum eXchange)平台,旨在优化 AI 工厂的每兆瓦产出。Lambda 在 HGX B200 服务器上的验证显示,在相同电力预算下运行 19 个节点(85% 功率)相比 16 个节点(满功率)可实现 24% 的集群 token 吞吐量提升和 23% 的每瓦性能提升。
推荐理由:原文给出了具体性能数据(24% 吞吐量提升、23% 每瓦性能提升),这是 AI 工厂电力优化的真实验证结果,读者可据此评估其实用性。
OpenAI NewsAI 评分5353 ChatGPT Work 推出 Data agent 智能体
ChatGPT Work 发布新的 Data agent 智能体,支持用户用自然语言连接公司数据、发现洞察并构建交互式仪表板。
OpenAI NewsAI 评分5555 OpenAI 与 GSA 合作向美国各级政府提供 AI 访问和网络防御支持
OpenAI 与 GSA 合作,为符合资格的美国联邦、州、地方和部落政府提供零许可费、5 折使用费以及扩展的网络防御支持。
OpenAI NewsAI 评分77 OpenAI 探索更强大、更可负担的 AI 如何扩展工作可能性
OpenAI 发布文章,探讨更强大且更可负担的 AI 如何扩展个人和企业的工作完成能力。内容聚焦 AI 技术使增长更加经济,尚未公布具体模型名称或技术细节。
GitHub Blog · AI & ML精选AI 评分7777 GitHub 发布 Project HydraFusion 研究预览:通过多模型编排实现前沿质量
GitHub 推出 Project HydraFusion 研究预览,通过运行时编排从多个模型提供商动态选择工作流程(Single、Cascade、Critique 三种模式)来解决编码任务。
推荐理由:原文给出了具体 benchmark 数据和可用入口,读者可以据此判断这个新功能会如何改变代码生成的效率成本权衡。
Hugging Face BlogAI 评分5757 Hugging Face 发布 funes:为编码智能体提供自有记忆层
Hugging Face 发布 funes,这是一个持久记忆层工具,可为 Claude Code、Codex、pi、Hermes 等编码智能体提供跨会话、跨机器的记忆能力。
Google DeepMind精选AI 评分7474 Google DeepMind 推出 Gemini 智能体视频理解功能
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解功能,该功能将模型核心推理与原生视频工具结合,动态搜索和检查目标视频片段,相比静态处理可降低最多 88% 的 token 消耗和 66% 的成本,同时提升最多 7% 的准确率。
推荐理由:原文给出了 token 消耗降低 88%、成本降低 66%、质量提升 7% 的具体数据,读者可以据此评估该功能对自身工作流的效率提升。
Hugging Face Blog精选AI 评分7474 Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核支持本地 AI 推理
Hugging Face 发布 WebGPU 内核库 @hugglingface/kernels,包含 207 个优化内核,可从 Hub 直接加载运行。性能对比测试显示,与 ORT WebGPU 相比,新内核在 Apple M4 GPU 上实现几何平均 2.57 倍提速、中位数 1.90 倍提速,部分操作如 bilinear Einsum 提速超过 10000 倍。
推荐理由:原文给出了 207 个内核的性能对比数据(2.57x 几何平均提速),读者可以据此判断这个底层工具对自己浏览器端 AI 推理工作流的价值。
Hugging Face Blog精选AI 评分6565 Liquid AI 发布 LFM2.5-DSpark 草稿模型,最高实现 3.2 倍推理加速
Liquid AI 发布 LFM2.5 系列的 DSpark 草稿模型检查点,包括 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 三款。
推荐理由:给出了在 H100 和 MacBook M4 Max 上的具体加速数字,以及 llama.cpp 和 SGLang 的集成方式,读者可以据此判断迁移成本和预期收益。
Mistral AI精选AI 评分7575 Mistral 发布 Shieldstral:3B 参数开源多模态安全分类器
Mistral 发布 Shieldstral,这是一款 3B 参数的开源多模态安全分类器,通过将内容审核重新定义为政策自适应的问答任务,在文本安全和多模态审核基准上超越了尺寸高达其 7 倍的模型。
推荐理由:它把内容审核重新定义成政策自适应的问答任务,一个 3B 模型能达到 7 倍尺寸模型的水平,而且可以在推理时用自然语言直接改写政策,不需要重新训练。
Google DeepMind精选AI 评分6767 Google DeepMind 发布 Gemini Robotics ER 2,带来视频理解、任务编排和多机器人协作能力
Google DeepMind 发布 Gemini Robotics ER 2,这是其最强大的具身推理模型。该模型可调用 Google Search 等工具,支持多步骤任务自纠错,并将执行交接给低层 VLA 模型。
推荐理由:原文给出了视频理解、任务编排和多机器人协作的具体性能数据,读者可以据此了解具身智能的最新能力边界和可用入口。
Hugging Face Blog精选AI 评分7070 NVIDIA 发布 Cosmos-H-Dreams:面向手术机器人的实时生成式模拟器
NVIDIA 发布 Cosmos-H-Dreams,一款实时的、动作条件的手术机器人生成式模拟器。该系统基于 Cosmos-H-Surgical-Simulator,通过师生蒸馏和自强制学习将模型精简为因果few-step模型,并在 FlashDreams 加速库支持下,在单张 RTX PRO 6000 GPU 上实现约 160 FPS 的交互式帧生成。
推荐理由:原文给出了性能数据(160 FPS、单卡运行)和技术实现路径,读者可以据此评估它对手术机器人训练和模拟的实际价值。
Hugging Face Blog精选AI 评分7878 Hugging Face Diffusers 原生支持 Nunchaku 4-bit 扩散模型推理
Nunchaku 4-bit 扩散模型推理引擎现已原生集成到 Diffusers,支持通过 from_pretrained() 直接加载预量化模型,无需本地 CUDA 编译。
推荐理由:原文给出了 Nunchaku Lite 的性能数据、实现方式和可用入口,读者可以据此判断这个量化推理方案是否适合自己的场景。
Hugging Face Blog精选AI 评分7070 Hugging Face 开源 Grabette:手持式机器人操作数据采集系统
Hugging Face 发布 Grabette,一款开源手持式机器人操作数据采集系统。用户可用手持夹持器记录人类演示,自动转换为 LeRobot 格式的数据集用于训练机器人策略。
推荐理由:原文给出了具体的硬件成本 BOM、配套的 Gripette 机械爪和 LeRobot 训练流程,读者可以据此判断这个数据采集方案是否适合自己的机器人学习项目。
Google DeepMindAI 评分4949 Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,应对 AI 时代的全球生物安全
Google DeepMind 与 Isomorphic Labs 公布生物韧性联合方案,涵盖预防、检测和响应三大领域,过去 12 个月推进了超过 15 个政府、生物安全组织和研究机构的合作。
Google DeepMindAI 评分5252 Google DeepMind 推出 ATL Saathi,为印度教育者提供 Gemini 驱动的 AI 助手
Google DeepMind 推出 ATL Saathi,这是一款基于 Gemini 的 Web 应用,为印度 ATL(Atal Tinkering Labs)教育者提供 24/7 的规划和培训助手。该应用支持多语言交互,可生成课程摘要、AI 信息图表、项目创意和分步指导,现已在 100 所试点学校推出。
Hugging Face Blog精选AI 评分6262 Hugging Face 和 Cerebras 合作展示 Gemma 4 实时语音 AI
Hugging Face 与 Cerebras 合作展示了基于 Gemma 4 的实时语音转语音系统,采用模块化开源架构:Nvidia Parakeet 语音识别 + Cerebras 加速 Gemma 4 VLM 推理 + 阿里 Qwen3TTS 语音生成。该系统已在超过 9,000 台 Reachy Mini 机器人上部署,旨在解决语音 AI 的延迟问题,提供更稳定、可预测的低延迟体验。
推荐理由:原文展示了实时语音 AI 的低延迟方案,读者可以了解这个技术演示的核心架构和性能改进。
Google DeepMind精选AI 评分8181 Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash
Google DeepMind 正式发布 Nano Banana 2 Lite(gemini-3.1-flash-lite-image)——公司最快、最省成本的图像生成模型,文生图延迟 4 秒,定价 $0.034/千张图;同时发布 Gemini Omni Flash(gemini-omni-flash-preview),支持高质量视频生成和对话式编辑,定价 $0.10/秒。
推荐理由:原文给出了两个模型的具体性能数据和定价,读者可以据此判断相比竞品和前代产品的速度、成本和功能优势。
Mistral AI精选AI 评分7878 Mistral 推出 OCR 4:支持 170 种语言的文档解析模型
Mistral 发布 OCR 4,这是一款文档解析产品,支持 170 种语言,提供边界框、块分类和内联置信度分数等结构化输出。该模型在人类评估和基准测试中均优于现有 OCR 系统,可通过 API、Document AI 或自托管部署使用。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.5 Live Translate,实现 70+ 语言实时语音翻译
Gemini 3.5 Live Translate 是 Google DeepMind 发布的最新音频模型,可实现超过 70 种语言的近实时语音到语音翻译。该模型自动检测语言并生成流畅、自然的翻译语音,保留说话者的语调、节奏和音调。
推荐理由:原文详细说明了模型的核心能力(70+语言、保留语调、延迟几秒)和三个明确的落地入口,读者可以对照自己的使用场景判断迁移成本。
Google Research精选AI 评分6767 Google 发布 Gemini Enterprise Agent Platform 的 Agentic RAG 功能
Google 推出 Gemini Enterprise Agent Platform 的 Agentic RAG 功能,采用多智能体架构(Orchestrator、Planner、Query Rewriter、Search Fanout)处理复杂多源查询。
推荐理由:原文给出了具体准确率提升数据(最高34%)和新的 Sufficient Context Agent 机制,读者可以据此判断这个新产品在企业知识管理场景中的实际价值。
Google Research精选AI 评分6565 Google 开源水文建模框架,助力各国气象水文部门提升洪水预报能力
Google Research 开源了其水文建模框架,基于 LSTM 神经网络架构,使用气候、土壤、地形等地理特征和降雨、气温等气象预报数据来预测全球河流日流量。
推荐理由:开源了完整的水文建模框架和预训练模型,研究人员和预报机构可直接下载使用或基于此进行本地化微调。
Google Research精选AI 评分7070 Google Research 在 I/O 2026 展示多项研究进展:科学工具、医疗健康、边缘计算、天气预测等
Google Research 在 I/O 2026 展示了多个研究进展。Gemini for Science 套件整合了 ERA(研究编码系统)和 Co-Scientist(多智能体系统),可辅助科学假设生成和计算实验。
推荐理由:原文系统展示了Google在I/O 2026的多个研究进展,涵盖科学工具、医疗健康、边缘计算、天气预测等方向,读者可从中了解AI在科研和产业应用的前沿进展。
Mistral AIAI 评分5959 Mistral AI 在 AI Now Summit 2026 发布工业工程 AI 解决方案及 Vibe 智能体
Mistral AI 在 AI Now Summit 2026 上发布了面向工业工程的新 AI 解决方案,与 Airbus、BMW、ASML 达成合作,同时推出统一智能体 Vibe,可处理编码、研究等长周期任务,并计划于 2026 年 Q3 在法国 Les Ulis 开设 10 MW 数据中心以增强推理计算的安全与控制。
Mistral AI精选AI 评分7474 Mistral 发布统一 AI 智能体 Vibe,兼顾工作与编码
Mistral 发布统一 AI 智能体 Vibe,可处理长时间运行的任务,包括邮箱管理、研究和文档起草,以及从功能开发到 Pull Request 的编码工作流。Vibe 提供 Work Mode 处理跨企业工具的多步骤任务,Code Mode 支持远程编码,并配备 VS Code 扩展和 CLI 工具。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Mistral AI精选AI 评分7777 Mistral AI 推出 Search Toolkit 公开预览版
Mistral AI 发布了 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产搜索管道的可组合框架。该工具将数据摄入、检索和评估整合到单一框架中,支持 BM25 稀疏检索、密集向量检索和混合检索配置,内置 recall、precision、MRR、NDCG 等评估指标,开源且可在云端、本地或边缘运行。
推荐理由:它将数据摄入、检索和评估整合到一个框架中,帮助团队把时间从集成维护转向搜索质量提升。
Mistral AIAI 评分5454 Mistral 推出 Physics AI:面向工程加速的物理智能体
Mistral 发布 Physics AI,这是一种数据驱动的物理 AI 模型,可从几何和边界条件直接预测物理行为,在单 GPU 上数秒内完成推理(传统求解器需数小时至数周)。该模型支持几何和参数泛化,一个模型可服务整个设计系列。首批合作伙伴包括 ASML、Airbus、Safran 和 Siemens Energy,应用领域涵盖航空航天、汽车、电子半导体、能源和工业设备。
Mistral AI精选AI 评分7272 Mistral Studio 发布 Connectors 功能:内置和自定义 MCP 连接器现已可通过 API 使用
Mistral 发布 Studio 中的 Connectors 功能,所有内置连接器和自定义 MCP 现可通过 API/SDK 用于模型和智能体调用。同时推出直接工具调用和人工介入审批流程,可在 LeChat 和 AI Studio 中使用,支持与企业系统如 CRM、知识库和生产力工具的复杂工作流集成。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。