跳到正文
AI 工具导航

近 30 天 · AI 圈最值得看的 7 个AI 新工具

每条发布 = 一张工具卡 · 命中 "新工具 / 产品更新 / 模型发布 / 平台" 标签(itemType=tool_release)· 按时间排序

  1. Hacker News · 首页83

    OpenAI 一次发布 372 项数学证明,包括唯一游戏猜想

    据 Scott Aaronson 整理,OpenAI 在顾问组推荐下一次性公开 372 项数学突破结果,其中包括 Subhash Khot 的唯一游戏猜想(UGC)证明、L=BPL、Fourier 变换整数乘法低于 O(n log n) 的新上界、Unitary Synthesis 问题的正面解答、Parity 不在 QAC0 等,部分配有 Lean 证书。

    推荐理由:原文列出 372 项数学突破与所用算力、问题类型,可帮助读者判断新模型在深度推理上的实际边界。

  2. Latent Space80

    Anthropic 发布 Claude Haiku 5.5:定价对齐 GPT-6 Luna,同步下调 Sonnet 5.5 缓存读取费用

    Anthropic 发布 Claude Haiku 5.5,这是约一年以来 Haiku 系列首次更新,定价对齐 OpenAI 的 GPT-6 Luna;官方称运行成本平均比 Haiku 4.5 低约 75%,同一天把 Sonnet 5.5 缓存读取费用减半,并为 Max 5x、Max 20x、Team 订阅附带可跨模型使用的 API 额度。

    推荐理由:汇总了 Anthropic 官方、合作伙伴与 Artificial Analysis 独立评测的小尺寸模型性能与定价,可作为评估 Haiku 5.5 是否值得替换现有低层模型的事实底稿。

  3. Latent Space80

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 等新品,ChatGPT 周活达 12 亿

    OpenAI 在 2026 DevDay 上发布语音智能体 Dots、GPT-6.1 Sol(定价为 Astra 的五分之一)、Ultrafast 加速模式(最高 8 倍提速)和 Decisions API,同时推出 ChatGPT Spaces 和企业市场。

    推荐理由:原文提供了 OpenAI DevDay 2026 的完整产品矩阵和行业关键事件(Anthropic IPO、NVIDIA 收购 Hugging Face),读者可据此了解当下 AI 竞争格局的全景。

  4. AWS Machine Learning Blog66

    AWS Bedrock 在首尔和新加坡推出 Anthropic Claude 模型区域内推理功能

    Amazon Bedrock 现已在首尔(ap-northeast-2)和新加坡(ap-southeast-1)区域支持 Claude Opus 5 和 Claude Sonnet 5 的区域内推理。用户在以上区域调用 bedrock-runtime 端点时,输入提示和输出结果将全程保持在区域内,不会离开指定区域,满足韩国和新加坡金融、医疗、公共部门等的数据驻留要求。

    推荐理由:AWS Bedrock 在首尔和新加坡新增 Claude 模型的区域内推理功能,满足金融、医疗等行业的严格数据驻留要求。

  5. AWS Machine Learning Blog70

    在 AWS 上推出 Claude Sonnet 5.5

    Anthropic 的 Claude Sonnet 5.5 现已在 Amazon Bedrock 和 Claude Platform on AWS 可用。该模型更适合聚焦的编码和知识工作,相较 Opus 5.5 以更低的每任务成本和更快的速度完成范围明确的工作。文章提供了在 Amazon Bedrock 控制台测试和通过 AWS SDK 编程调用的具体步骤,并列出了必要的 IAM 权限要求。

    推荐理由:原文给出了 Claude Sonnet 5.5 的能力定位(更适合聚焦编码和知识工作)和成本/速度优势,读者可以据此判断它是否适合替换当前的模型方案。

  6. The Decoder76

    Anthropic 发布 Claude Sonnet 5.5:基准接近 Opus 5.5,成本低 30%

    Anthropic 发布 Claude Sonnet 5.5,输出速度快 30% 以上,单任务成本降低达 30%。在 Terminal-Bench 4.0 上从 10.3% 跃升至 70.6%,CursorBench 4.0 达 55.5%,仅比 Opus 5.5 低 2 分。

    推荐理由:原文给出了 Claude Sonnet 5.5 在多项基准上的具体分数和与 Opus 5.5、GPT-6 Sol 的对比,以及成本和速度数据,读者可据此判断是否值得切换模型。

已经到底了