跳到正文
AI 工具导航

近 90 天 · AI 圈最值得看的 22 个AI 新工具

每条发布 = 一张工具卡 · 命中 "新工具 / 产品更新 / 模型发布 / 平台" 标签(itemType=tool_release)· 按时间排序

  1. AWS Machine Learning Blog80

    Grok 4.7 在 Amazon Bedrock 上可用

    xAI 的 Grok 4.7 现已在 Amazon Bedrock 上线,支持 50 万 token 上下文窗口和低/中/高/xhigh 四档可配置推理 effort。该模型定位为 xAI 最强的编码和知识工作模型,强调在困难任务上工作更久并更仔细地自我验证,支持 Responses、Chat Completions 和 Converse API,可通过跨区域推理配置文件路由。

    推荐理由:提供了模型在 Bedrock 上的具体接入方式、API 接口和定价策略,读者可据此评估集成成本和工作流适配性。

  2. AWS Machine Learning Blog70

    在 AWS 上推出 Claude Sonnet 5.5

    Anthropic 的 Claude Sonnet 5.5 现已在 Amazon Bedrock 和 Claude Platform on AWS 可用。该模型更适合聚焦的编码和知识工作,相较 Opus 5.5 以更低的每任务成本和更快的速度完成范围明确的工作。文章提供了在 Amazon Bedrock 控制台测试和通过 AWS SDK 编程调用的具体步骤,并列出了必要的 IAM 权限要求。

    推荐理由:原文给出了 Claude Sonnet 5.5 的能力定位(更适合聚焦编码和知识工作)和成本/速度优势,读者可以据此判断它是否适合替换当前的模型方案。

  3. GitHub Blog · AI & ML61

    GitHub Copilot canvas:超越聊天的自定义 AI 工作流界面

    GitHub Copilot 推出 canvas 功能,这是一种可在应用内运行的全栈自定义 UI,智能体可与其双向通信。作者认为聊天作为 AI 交互界面存在局限性,而 canvas 能让用户创建针对特定任务的定制界面,还可调用第三方 API 和本地代码执行,并展示了用 canvas 构建 Connect 4 游戏、Winget 包管理、SQLite 数据库操作、工作流自动化等实际用例。

    推荐理由:原文展示了 canvas 功能解决的具体问题和使用场景,读者可以据此思考如何用自定义 UI 改进自己的 AI 工作流。

  4. Google DeepMind70

    Gemini 3.8 Live 推出 Live Avatar 功能,实现实时视觉呈现

    Google DeepMind 推出 Gemini 3.8 Live 的 Live Avatar 功能,实现近实时视频生成与语音同步,支持精确口型同步、自然表情和 97 种语言无缝切换。该功能现已在 Gemini Enterprise 可用,企业可定制头像(仅限白名单)。所有输出均带有 SynthID 水印以确保透明度。

    推荐理由:原文给出了具体的能力变化和可用范围,读者可以据此判断它对现有工作流的影响。

  5. Google DeepMind78

    Google DeepMind 发布 Gemini 3.8 Text-to-Speech

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款新的文本转语音模型,在 Hume AI Voice Design Benchmark 获得第一。

    推荐理由:原文给出了具体的能力变化和开放入口,读者可以据此判断它会怎样改变现有的语音生成工作流。

  6. NVIDIA Blog73

    NVIDIA Isaac ROS 5.0 发布,增强 Agent 能力并推进开源机器人开发

    NVIDIA 发布 Isaac ROS 5.0,这是一个基于 ROS 的 GPU 加速机器人开发工具包。新版本支持 ROS Lyrical 和 Ubuntu 24.04,引入了新的 agentic 工作流程。

    推荐理由:原文给出了具体能力变化(FoundationPose 5.5x 提升、CuMotion 2-5ms 路径规划)和多个合作方集成信息,读者可以据此判断这个版本对机器人开发工作流的具体影响。

  7. NVIDIA Blog72

    NVIDIA 发布 Halos:首个Physical AI全栈安全系统

    NVIDIA 发布 Halos,这是首个面向 Physical AI(自动驾驶汽车、人形机器人、工业机器人等)的全栈安全系统。

    推荐理由:原文给出了具体的时间预测(2035年 4900万辆 L3-L5 自动驾驶汽车)、合作伙伴名单和第三方认证机构,以及 NVIDIA 全栈安全平台的具体组件,读者可以据此判断 Physical AI 安全领域的当前状态和主要玩家。

  8. Mistral AI64

    Mistral 与 Mozilla 合作,为 Firefox Smart Window 提供 AI 支持

    Mistral 宣布与 Mozilla 合作,Firefox Smart Window(测试版)现由 Mistral 模型驱动。该功能首先在法国和北美推出,英德两国预计今年晚些时候上线。此合作将 Mistral 的开源模型与 Firefox 的隐私保护传统结合,为用户提供多语言、多方言的本地化 AI 体验,对话默认不保存在 Mozilla 服务器上,Mistral 承诺零数据保留。

    推荐理由:这是一次将开源大模型嵌入主流浏览器的合作案例,展示了 AI 助手在浏览器场景中的实际应用和隐私保护机制。

  9. Google DeepMind76

    Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking

    Google DeepMind 发布两款新的实时对话模型:Gemini 3.8 Live 注重规模化和成本效率,结合对话智能与流畅交互;Gemini 3.8 Live Extended Thinking 面向高复杂度任务,具备增强智能和多步推理能力。

    推荐理由:原文给出了具体性能数据(82.6% Speech to Speech Quality Index、68.6% τ-Voice 等)和多个平台可用入口,读者可据此判断该模型相对现有产品的能力提升和适用场景。

  10. Google DeepMind82

    Google DeepMind 发布 AlphaGenome Atlas:覆盖人类基因组全部 90 亿单碱基变异的预测图谱

    Google DeepMind 发布 AlphaGenome Atlas 平台,包含人类基因组全部 90 亿个单核苷酸变异的分子效应预测,并推出 AVI 综合评分帮助研究人员快速排序和解读变异影响。该平台已在罕见疾病研究和群体遗传学分析中取得实际成果,现通过官网免费向学术研究开放。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  11. Microsoft Research65

    Microsoft Research 发布 Skala 1.1 深度学习 DFT 方法

    Microsoft Research 发布深度学习 DFT 方法 Skala 1.1,训练数据量比前身多 2.5 倍,在 GMTKN55 基准测试的 55 个类别中获得 32 项第一,加权平均误差 2.8 kcal/mol。该方法现已在 CP2K 中可用,正集成到 Psi4、FHI-aims、ORCA 和 VASP 等主流计算化学软件中,并推出动态性能基准测试追踪优化进展。

    推荐理由:Skala 1.1 在 GMTKN55 基准上获得 32 项第一,且已集成到多个主流计算化学软件中,读者可据此判断其在材料模拟领域的实用价值。

  12. Mistral AI71

    Mistral 发布 Agentic Search,提供更准确高效的 AI 搜索结果

    Mistral 发布 Agentic Search,在 FinanceBench 和 OfficeQA Pro 基准测试中实现了更准确的搜索结果,同时减少了对话轮次、token 使用和延迟。

    推荐理由:原文给出了具体性能数据:金融文件正确率从 26.7% 提升到 86%(3x),p90 延迟降低 39.6%,token 消耗减少最多 1/3,读者可据此判断该技术对自己场景的实际价值。

  13. Microsoft Research73

    微软发布 Orchard:可扩展智能体 AI 的开源框架

    微软发布 Orchard 开源框架,包含 Orchard Env 运行环境服务和三个领域训练工作流(Orchard-SWE、Orchard-GUI、Orchard-Claw)。

    推荐理由:原文给出了具体性能数据(69.7% on SWE-bench Verified)和三个可复用的训练工作流,读者可以据此判断这个开源框架对自己研究或项目的实用价值。

  14. Replicate Blog80

    Stable Diffusion 3.5 现已在 Replicate 可用

    Stable Diffusion 3.5 在 Replicate 平台发布,提供 Large、Large Turbo 和 Medium 三个变体。Large Turbo 只需 4 步推理即可生成高质量图像,Medium 为 2.5B 参数可运行在消费级 GPU。定价分别为每张图 $0.065、$0.04、$0.035。非商业使用免费,商业使用年收入低于 100 万美元免费。

    推荐理由:原文给出了三个版本的能力差异和具体价格,读者可以据此判断在什么场景下该使用哪个版本以及成本是多少。

已经到底了