跳到正文

本月新增

30 天内首发或首次收录到本站的 AI 工具。

71条精选相关主题本周热榜

最新精选

第 21–40 条 · 共 71 条
9月30日周三
  1. The Decoder80

    OpenAI 推出常驻智能体 Dots,与 Meta Muse 竞争

    OpenAI 在 DevDay 2026 开发者大会上发布了常驻智能体 Dots,可自动处理工作任务如修复 Slack 报告的 bug 或发送遗漏发票,有时在用户提出前就主动完成。

    推荐理由:原文详细介绍了 Dots 的主动工作能力、与 Meta Muse 的对比、定价和可用性,读者可以据此判断它与现有工作流助手的差异。

  2. Product Hunt · AI 分类61

    Audryo:面向 AI 智能体的邮件生命周期工具

    Audryo 是一款为 AI 智能体构建的邮件生命周期管理工具,支持通过 MCP、API 或 CLI 连接 Claude Code、Codex 或 Cursor。AI 智能体可创建受众、邮件旅程、营销活动和品牌邮件,发送前需用户审核。工具在沙盒环境中测试,邮件通过用户自己的提供商发送。公开测试期间免费使用。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  3. Product Hunt · AI 分类61

    Arc 发布 AI 屏幕助手,支持 Android 和 Mac

    Arc 推出一款浮窗式 AI 屏幕助手,可在任何应用上运行,支持一键操作如事实核查、分析表格或从食物照片中识别卡路里,并允许用户自定义操作。新增 500 多个社区动作、信息库(供 AI Writer 填充个人信息)、AI 通话分析、从阅读内容生成闪卡以及智能提取屏幕数据功能,现已支持 Android 和 Mac 平台。

    推荐理由:列出了多个具体功能变化和开放入口,读者可以据此判断它对自己现有的工作流是否有帮助。

  4. Product Hunt · AI 分类63

    Arsaze 发布 AI 视频编辑器,支持 AI 智能体与人类协同编辑

    Arsaze 推出 AI 视频编辑器,定位为视频编辑领域的 Cursor。该产品提供真正的多轨时间线,AI 智能体和人类都能通过 MCP 或语音驱动进行编辑,整合 AI 视频编辑、生成和智能体驱动编辑功能于同一时间线。

    推荐理由:原文给出了产品定位和核心能力,读者可以据此判断它与传统视频编辑器的差异。

  5. Product Hunt · AI 分类67

    Codex Remote:开源 Mac 菜单栏应用让用户在自己的云端运行 AI 智能体

    Codex Remote 是一个开源的 Mac 菜单栏应用,可将 Codex 和 Claude Code 部署到用户自己控制的云机器上。用户选择提供商和服务器规格后,应用会使用 OpenTofu 置备服务器、安装智能体并连接到已有应用。

    推荐理由:原文说明了如何把 AI 智能体部署到用户自己控制的云端,并给出了具体的功能组合方式,读者可以据此判断它是否适合自己的工作流。

9月29日周二
  1. Hacker News · 首页79

    Jevstiller:带 Disagreement Bound 的本地模型蒸馏工具

    Jevstiller 是一个将 Jev 模型蒸馏为本地小模型的系统,使用 bge-small 编码器加逻辑回归头,约几百 KB,CPU 上 15ms 响应。核心创新是提供 95% 置信度的协议保证:设置如 98% 的目标Agreement,系统保证本地模型与 Jev 的不一致率不超过预算。

    推荐理由:给出了一个带数学保证的蒸馏系统实现,读者可以学习其如何用统计方法保证协议达成。

  2. Microsoft Research66

    微软发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,这是一款旨在连接科学工具、文献、实验室和研究人员的 AI 研究系统。与 Broad Institute 合作,该系统用于预测和优先排序能够驱动肿瘤状态转变的化合物。在胰腺导管腺癌(PDAC)的湿实验证中,Quine 最高排名的化合物产生了最大的预期转录变化,整个过程仅用一个周末就完成了候选化合物的筛选和验证。

    推荐理由:原文给出了 Quine 的具体能力(世界模型+交互式 harness)、应用场景(胰腺癌药物预测)和初步验证结果,读者可以据此了解这个 AI 系统如何辅助生物研究以及实际效果。

  3. Product Hunt · AI 分类62

    Firetower 发布:可在自有服务器运行编码智能体

    Firetower 是一款开源、可自托管的编码智能体运行工具,支持 Claude Code 和 Codex,可在其控制的基础设施上运行并从桌面或移动设备管理。该工具用 Rust 构建。

    推荐理由:它提供了开源、可自托管的编码智能体部署方案,读者可据此判断是否适合自己的基础设施。

9月24日周四
  1. AWS Machine Learning Blog68

    AWS 发布基于智能体的对话式视频智能解决方案

    AWS 发布了基于 Strands Agents SDK 的对话式视频智能解决方案,整合 Amazon Bedrock、Rekognition 和 Transcribe,允许用户用自然语言提问视频内容。该方案在运行时动态决定调用哪些服务,无需为每种查询类型预建管道。已有客户使用后手动审查时间减少约 80%。完整实现已开源。

    推荐理由:给出了基于 Strands Agents SDK 的视频智能架构完整实现方案,读者可据此复用到其他模态。

9月20日周日
  1. Product Hunt · AI 分类64

    LUCI Desktop 发布:本地屏幕历史与会议记录工具

    Luci 是一款在本地保存屏幕历史和会议记录的工具,可让 Claude Code、Cursor、Codex 等 AI 智能体帮助用户查找未收藏的页面或回忆会议决策,无需为每个应用单独设置连接器。提供设备端转录和基于 Microsoft Foundry Local 的每日摘要,Mac 和 Windows 免费使用。

    推荐理由:提供了本地优先的屏幕历史和会议记录方案,读者可据此判断它是否能解决跨应用上下文获取的痛点。

9月17日周四
9月16日周三
  1. NVIDIA Blog67

    NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 首次亮相中实现领先性能

    NVIDIA Vera Rubin NVL72 系统首次提交 MLPerf Inference v6.1 预览测试,在 Qwen3-VL 基准上提供高达 3.7 倍于 GB300 NVL72 的吞吐量,在 DeepSeek-R1 上达到 2.5 倍。GB300 NVL72 在 288-GPU 四机架扩展测试中实现 99% 扩展效率,软件优化相比 v6.0 提升高达 1.6 倍性能。

    推荐理由:给出了具体的性能倍数和扩展效率数据,读者可以据此评估新硬件对推理工作负载的实际价值。

  2. NVIDIA Blog63

    NVIDIA 发布 DSX 平台优化 AI 工厂电力管理

    NVIDIA 推出 DSX(Digital Spectrum eXchange)平台,旨在优化 AI 工厂的每兆瓦产出。Lambda 在 HGX B200 服务器上的验证显示,在相同电力预算下运行 19 个节点(85% 功率)相比 16 个节点(满功率)可实现 24% 的集群 token 吞吐量提升和 23% 的每瓦性能提升。

    推荐理由:原文给出了具体性能数据(24% 吞吐量提升、23% 每瓦性能提升),这是 AI 工厂电力优化的真实验证结果,读者可据此评估其实用性。

9月5日周六
  1. GitHub Blog · AI & ML77

    GitHub 发布 Project HydraFusion 研究预览:通过多模型编排实现前沿质量

    GitHub 推出 Project HydraFusion 研究预览,通过运行时编排从多个模型提供商动态选择工作流程(Single、Cascade、Critique 三种模式)来解决编码任务。

    推荐理由:原文给出了具体 benchmark 数据和可用入口,读者可以据此判断这个新功能会如何改变代码生成的效率成本权衡。

9月2日周三
  1. Google DeepMind74

    Google DeepMind 推出 Gemini 智能体视频理解功能

    Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解功能,该功能将模型核心推理与原生视频工具结合,动态搜索和检查目标视频片段,相比静态处理可降低最多 88% 的 token 消耗和 66% 的成本,同时提升最多 7% 的准确率。

    推荐理由:原文给出了 token 消耗降低 88%、成本降低 66%、质量提升 7% 的具体数据,读者可以据此评估该功能对自身工作流的效率提升。

9月1日周二
  1. Hugging Face Blog74

    Hugging Face 发布 @huggingface/kernels:207 个 WebGPU 内核支持本地 AI 推理

    Hugging Face 发布 WebGPU 内核库 @hugglingface/kernels,包含 207 个优化内核,可从 Hub 直接加载运行。性能对比测试显示,与 ORT WebGPU 相比,新内核在 Apple M4 GPU 上实现几何平均 2.57 倍提速、中位数 1.90 倍提速,部分操作如 bilinear Einsum 提速超过 10000 倍。

    推荐理由:原文给出了 207 个内核的性能对比数据(2.57x 几何平均提速),读者可以据此判断这个底层工具对自己浏览器端 AI 推理工作流的价值。

8月31日周一
  1. The Rundown AI79

    Hugging Face $399 双足机器人 Microduck 开放预购,首日订单达 260 万美元

    Hugging Face 与 Pollen Robotics 合作推出的 $399 双足机器人 Microduck 开放预购,配备 15 个电机、相机、LiDAR、麦克风和扬声器,具备行走、拾取物体、从跌倒中恢复等 7 种开箱即用行为,可选轮子支持轮滑。

    推荐理由:原文给出了具体价格、订单金额、交付时间和硬件规格,读者可以据此判断这个低价双足机器人是否适合自己的需求。

8月21日周五
8月4日周二
  1. Mistral AI75

    Mistral 发布 Shieldstral:3B 参数开源多模态安全分类器

    Mistral 发布 Shieldstral,这是一款 3B 参数的开源多模态安全分类器,通过将内容审核重新定义为政策自适应的问答任务,在文本安全和多模态审核基准上超越了尺寸高达其 7 倍的模型。

    推荐理由:它把内容审核重新定义成政策自适应的问答任务,一个 3B 模型能达到 7 倍尺寸模型的水平,而且可以在推理时用自然语言直接改写政策,不需要重新训练。

7月30日周四
  1. Google DeepMind67

    Google DeepMind 发布 Gemini Robotics ER 2,带来视频理解、任务编排和多机器人协作能力

    Google DeepMind 发布 Gemini Robotics ER 2,这是其最强大的具身推理模型。该模型可调用 Google Search 等工具,支持多步骤任务自纠错,并将执行交接给低层 VLA 模型。

    推荐理由:原文给出了视频理解、任务编排和多机器人协作的具体性能数据,读者可以据此了解具身智能的最新能力边界和可用入口。