AI 周报 · 2026 年第 40 周 · 09.28 — 10.04
MYHOT
OpenAI发布GPT-6.1 Sol与Dots 智能体
2026年9月28日至10月4日,AI行业迎来密集发布。OpenAI DevDay 2026发布GPT-6.1 Sol(性能接近Astra但价格仅五分之一)、常驻智能体Dots及Ultrafast加速模式,ChatGPT周活达12亿。Google发布Gemini 4 Argon前沿模型,能力过强仅限可信网络防御者使用。AMD宣布82亿美元收购李飞飞创立的World Labs。本地运行取得突破:Slipstream可在64GB Mac以41-52 tok/s运行Qwen3.8-Flash-Next,Oído可在5美元微控制器上运行语音识别。Anthropic IPO招股书警告十年内可能人类灭绝。Flock车牌监控系统被裁定违宪。
OpenAI DevDay 发布新品
本版导读OpenAI在DevDay 2026发布GPT-6.1 Sol,性能达到GPT-6 Astra的99%但价格仅五分之一;推出常驻智能体Dots,由GPT-6 Astra驱动,每个dot拥有独立云电脑和浏览器,可连接4000+应用24/7工作;发布Ultrafast加速模式最高8倍提速;ChatGPT周活突破12亿。
OpenAI 发布 GPT-6.1 Sol,性能接近 GPT-6 Astra 且价格更低
OpenAI 在 DevDay 上发布了 GPT-6.1 Sol,仅在一周前推出了 GPT-6 Sol。该模型在编码、计算机使用和专业工作方面达到了 GPT-6 Astra 几乎相同的智能水平,但标准输入和输出 token 价格仅为五分之一。
OpenAI 推出常驻智能体 Dots,与 Meta Muse 竞争
OpenAI 在 DevDay 2026 开发者大会上发布了常驻智能体 Dots,可自动处理工作任务如修复 Slack 报告的 bug 或发送遗漏发票,有时在用户提出前就主动完成。
OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 等新品,ChatGPT 周活达 12 亿
OpenAI 在 2026 DevDay 上发布语音智能体 Dots、GPT-6.1 Sol(定价为 Astra 的五分之一)、Ultrafast 加速模式(最高 8 倍提速)和 Decisions API,同时推出 ChatGPT Spaces 和企业市场。
OpenAI 发布 Dots 智能体功能
OpenAI 在 ChatGPT 上推出 Dots 智能体功能,由 GPT-6 Astra 驱动。每个 dot 拥有独立的云电脑和浏览器,可通过插件连接超过 4000 个应用,24/7 为用户工作。
Google发布前沿模型Argon
本版导读Google发布Gemini 4 Argon前沿模型,在复杂软件工程、企业知识工作和网络安全防御方面达前沿性能,上下文窗口扩展至100万token,定价输入每百万token 2美元、输出10美元。但该模型能力过强,Google仅向特定可信网络防御者开放,正与美国政府合作进行发布前审查。
Google 发布 Gemini 4 Argon,称能力太强仅限"可信网络防御者"使用
Google发布新模型Gemini 4 Argon,定位为前沿性能模型,涵盖软件工程、企业知识工作和网络安全防御领域。该模型基准测试优于OpenAI和Anthropic的竞品,但初期仅向特定"可信网络防御者"开放,Google正与美国政府合作进行发布前审查。Gemini 4 Argon已用于Google内部工作流,如大规模代码库迁移。
Google DeepMind 发布 Gemini 4 Argon 前沿模型
Google 发布新前沿模型 Gemini 4 Argon,在复杂软件工程、企业知识工作和网络安全防御方面达到前沿性能。上下文窗口扩展至 100 万 token,定价为输入每百万 token 2 美元、输出 10 美元。该模型通过 Fairwind Program 向部分受信任的网络防御者提供,并将在不久后向付费 API 客户和 Google AI Ultra 订阅用户开放。
本地运行取得突破
本版导读Slipstream引擎发布,可在64GB Mac上以41-52 tok/s运行95.5 GiB Qwen3.8-Flash-Next,比llama.cpp快1.76倍。Jeff-Qwen3.5-0.8B配合9个LoRA适配器实现38倍加速。Oído语音识别模型可在ESP32-S3微控制器上运行,无需GPU/NPU击败Whisper-tiny。
Slipstream 发布:可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next
开发者发布 Slipstream 引擎,可在 64GB Mac 上以 41-52 tok/s 运行 95.5 GiB Qwen3.8-Flash-Next 模型,比 llama.cpp 快 1.76 倍。
Jeff-Qwen3.5-0.8B v1.2 + 9 个 LoRA 适配器:置于 Qwen3.8-27B 前实现 38 倍加速和 +8.7 准确率,额外内存占用不足 2GB
作者发布 Jeff-Qwen3.5-0.8B,这是一款小型“System 1”模型,可在一轮前向传播中从给定选项中做出选择并返回校准概率。作者为其训练了 9 个 LoRA 适配器,分别处理 prompt 注入检测、工具选择、票据优先级排序、答案溯源等常见决策任务。
Oído:可在 5 美元微控制器上运行的语音识别模型,击败 Whisper-tiny
Lokutor 团队发布 Oído 语音识别模型,基于 NVIDIA Conformer-CTC Small(1300 万参数,int8),可在 ESP32-S3(8 MB PSRAM)上运行,无需 GPU 或 NPU。
AI智能体生态快速演进
本版导读AIPass多智能体协作框架通过邮件系统实现智能体间通信。Pi Durable框架专为长时间运行持久化智能体设计。aweb提供智能体通信平台,支持稳定身份标识和跨运行时唤醒。Singularity用原子化ticket替代聊天,每个ticket独立Git worktree。
AI 智能体获得邮件功能后,首先互相提交缺陷报告
AIPass 是一个开源多智能体协作框架,构建了 7 个月,拥有 18 个智能体、21000 多测试、280+ GitHub 星标。其核心设计是为每个智能体分配独立目录和身份,通过邮件系统(email 和 dispatch)实现智能体间的通信协调。
Earendil 发布 Pi Durable:用于构建持久化智能体的实验性框架
Earendil 伴随 Pi 1.0 发布了实验性新框架 Pi Durable,该框架专为构建长时间运行、可在任何 JavaScript 运行时执行的持久化智能体设计。
aweb:面向 AI 智能体的通信工具发布
aweb 是一个面向 AI 智能体的通信平台,提供稳定的身份标识、持久的邮件和聊天功能,以及跨会话、跨运行时的唤醒事件。支持 Claude Code 和 Pi 等运行时,CLI 和 API 与运行时无关,可自托管或使用托管服务,代码采用 MIT 许可证开源。
Singularity:原子化 ticket 驱动的 AI 编码工具
Singularity 是一款新的 AI 编码工具,用原子化 ticket 替代聊天,每个 ticket 对应一个独立 Git worktree 和最小上下文。支持跨仓库并行运行多个 agent,审查 diff 后合并。免费、本地优先、需要用户自备 API key。
AMD收购World Labs
本版导读AMD宣布以82亿美元全股票交易收购AI创业公司World Labs,该公司由李飞飞于2024年创立,首个公开工具Marble可生成3D资产。预计2026年底完成交易,李飞飞将加入AMD担任执行副总裁兼首席科学家。
AMD 82亿美元收购 World Labs,李飞飞创立的世界模型公司
AMD 宣布将在年底前收购世界模型公司 World Labs,交易估值 82 亿美元。该公司由计算机视觉科学家李飞飞于 2024 年创立,获得了 2.3 亿美元融资(部分来自 AMD),其首个公开工具 Marble 可生成用于影视和游戏制作的 3D 资产。Nvidia 在该领域处于领先地位,AMD 此前虽有开源世界模型 Micro-World,但缺乏与 Nvidia Cosmos 竞争的产品。
AMD 82亿美元收购 AI 世界模型创业公司 World Labs
AMD 以约 82 亿美元全股票交易收购 AI 创业公司 World Labs,AI 先锋李飞飞将加入 AMD 担任执行副总裁兼首席科学家。该交易预计 2026 年底完成。