#Anthropic
跨栏目找相关项:同一话题的工具、提示词、论文,可能横跨数天甚至数月才凑齐。
#Anthropic
今日 29 条工具·提示词·论文 三栏速览
每栏 6 / 6 · 直达分类页提示词
6 条当用户的某个意图(如last_intent)尚未处理完成时,自动提示用户并继续处理该业务。
写作cloud.baidu.com为电商平台机器人客服提供开场白、常见问题回复和结束语的话术模板参考。
写作insight.xiaoduoai.com智能客服机器人与访客互动的对话模板(欢迎新访客、欢迎回头客、显示常见问题等)。
写作zhuanlan.zhihu.com服装加工合同模板,含甲乙双方信息及加工委托条款
写作xiaobaogong.com用于合同审查场景,让大模型扮演特定行业、特定立场的合同审查专家,平衡利益与风险。
研究blog.csdn.net帮助分析患者症状,提供可能的诊断方向和建议,适用于初步诊断筛查。
研究cgwgpts.com
论文
6 条The Rundown AIAI 评分4949 Anthropic 公开全球 Claude 滥用威胁报告,点名 7 家中国 AI 实验室
Anthropic 发布最新威胁报告,披露过去 8 个月全球 Claude 滥用案例,共点名 7 家中国 AI 实验室(阿里巴巴、DeepSeek、Moonshot、小米等)进行知识蒸馏,其中 Moonshot 和 DeepSeek 将 Claude 作为自有模型提供给客户并用于训练。报告还涵盖生物武器相关咨询、火箭制导软件及大规模监控系统等恶意使用场景。
Ben's BitesAI 评分2121 Meta 推出个人 AI 助手 Muse
Meta 发布个人 AI 助手 Muse,可处理旅行预订、邮件和电脑任务。官方声称其构建安全性更高,用户可连接 FB 和 Instagram 账户。该产品首先向美国成年用户开放。
The Rundown AIAI 评分4747 Anthropic 员工辞职引发 AI 灭绝风险争论
Anthropic 研究员 Jacob Coxon 辞职后发文称其雇主和 OpenAI 正在"拿我们的生命赌博",追求自我改进的 AI。对齐科学负责人 Evan Hubinger 回应称 AI 有超过 10% 的概率在未来十年内灭绝人类,并表示目前尚无控制超级智能的计划。Coxon 呼吁协调减速,可能需要暂时停止改进模型能力。
Ben's BitesAI 评分5353 GPT-6 家族首个模型 Astra 发布
OpenAI 发布 GPT-6 家族首个模型 Astra,在 ARC-AGI-3 和 Zapier AutomationBench 取得最高分,但作者体验认为它是"展示马"而非"工作马",不稳定。
The Rundown AIAI 评分6969 Anthropic 发布 Claude Fable 5.1,结束前沿模型安静期
Anthropic 发布 Claude Fable 5.1,在 AA Intelligence Index 创下 66 分纪录,科学研究测试得分是 Fable 5 的两倍以上。安全过滤器在网络安全工作中减少 60% 干预,基础医学和生物学问题中减少 85%。Anthropic 同时发布限制更少的 Mythos 5.1,仅向通过审查的美国网络安全和生物学研究人员开放。
The Rundown AIAI 评分4747 Dyson 推出配备 AI 的 499 美元电动牙刷 CameraJet
Dyson 发布首款口腔护理产品 CameraJet,配备 100K 像素 AI 摄像头,可每秒分析 28 张图像检测牙缝并自动喷射清洁。该牙刷基于 470K 张牙科图像训练,运行 16M 行代码,用户可通过 MyDyson app 实时观看清洁过程并获取刷牙反馈,产品今日发售。
Ben's BitesAI 评分2626 Build your ideas
Anthropic 宣布 Claude Code 使用限额将于 9 月 14 日从 150 units 降至 125 units(永久增加 25%),用户批评其"5x"和"20x"订阅计划的营销宣传与实际使用限制不符。
The Rundown AIAI 评分6262 Anthropic 推出 Model Hardware Standard,让机器也能运行 Claude
Anthropic 发布 Model Hardware Standard 研究预览版,可让 AI 智能体操控显微镜、机械臂等实体机器,无需定制代码。机器所有者用自然语言描述设备,MHS 将其转为智能体可读的参考文件。
Ben's BitesAI 评分4747 ChatGPT Work 如何让 AI agents 绕过登录页
ChatGPT Work 推出新的登录流程,当 agents 遇到登录页时会暂停并显示专用表单,用户输入用户名、密码和 2FA 验证码。这些凭证不进入对话,而是直接传给云端浏览器完成认证。会话可保持登录状态用于后续任务,用户可在设置中清除。
Ben's BitesAI 评分2525 移动端 AI 智能体更新汇总:Claude Code 可手机启动新会话、Deepgram 推 80ms 延迟 TTS
Claude Code 远程控制功能更新,现在可从手机启动新会话,断线自动恢复,iOS 加载速度提升。Deepgram 发布 Flux TTS,延迟最低 80ms,支持多轮对话和原生中断处理。此外 GPT-5.6-Sol 在 API 中降价 20%,Grok Bot 向 SuperGrok Plus 和 Cursor Pro+ 用户开放。
The Rundown AIAI 评分5656 匿名模型 Ox Alpha 现身 OpenRouter 前沿引发开发者猜测其来源
匿名模型 Ox Alpha 近日在 OpenRouter 上免费上线,具有 100 万 token 上下文和多模态输入能力,专注于编码和智能体工作负载。该模型在编码测试中取得 63% 准确率,引发关注。由于其基于中国十二生肖的命名方式和测试表现,有分析认为其可能来自智谱 AI 的 GLM-5.3 Flash 或 GLM-6,也有人猜测是微软的 MAI 系列。
Ben's BitesAI 评分2424 AI 智能体简报:文件与工具的组合及近期动态
Ben's Bites 投票显示 996 人对个人 AI 智能体的看法,个人 AI 智能体本质是文件夹和工具的组合。
The Rundown AIAI 评分7474 Anthropic Claude 在蛋白质设计中取得突破,自主完成药物发现pipeline早期步骤
Anthropic 发布研究显示 Claude 在几乎无人类干预的情况下运行蛋白质设计流程,在 15 个靶点中成功设计出 14 个有效分子,成功率 22-35% 超过行业标准的 10-15%。Opus 5 还独立打开原始仪器文件,在 19 分钟内测量出纯度 96.4% 的样本,而实验室报告需要四天。
Ben's BitesAI 评分1717 <think>让我仔细分析这个任务:
1. **原始标题**: "Do you use a personal agent?" 2. **正文内容**: 这是一篇 Ben's Bites Newsletter 的编辑内容,包含了多个 AI 领域的新闻和更新 3. **时间锚点**: 原文发布日期:2026-08-18 **标题分析**: - 原标题 "Do you use a personal agent?
Ben's BitesAI 评分1919 Grok Bot 实际体验:与我想象的不同
作者体验 xAI 的 Grok Bot 后,从最初的怀疑转变为喜欢。Grok Bot 可创建具有独立虚拟电脑的定制 AI 智能体,支持连接 Gmail、Calendar、Slack 等账户,操作简洁类似在 Slack 中与队友交流。
Import AIAI 评分6767 Import AI 466:AI 编程与机器人能力的新里程碑;OpenAI 模型突破安全限制
Epoch 和 METR 发布 MirrorCode 基准测试,评估 AI 长时间编程任务能力。Claude Opus 4.7 用 $251 在 14 小时内完成需人类 2-17 周的程序重实现任务,多个大型程序被成功复现。
Import AIAI 评分3636 Import AI 465:开源与闭源模型差距缩小;Kimi K3发布;Demis Hassabis提出AGI监管框架
UK AI安全研究所分析显示,2025年开源权重模型与闭源前沿模型在网络安全能力上的差距已缩小至4-7个月,GLM-5.2和DeepSeek V4-Pro表现接近Claude Opus 4.6和GPT-5。
Berkeley AI ResearchAI 评分3030 智能即将免费,数据系统如何迎接智能体时代
随着 AI 推理成本在过去两年下降 9x-900x(GPT-4 级能力从 $30/百万 token 降至 <$1),知识工作所需的智能正变得几乎免费。文章探讨这一变革对数据系统的三重影响:为智能体服务的数据系统(支持批量查询和高并发智能体探索)、由智能体管理的数据系统(协调数千智能体协作)、以及由智能体构建的数据系统(自动合成定制化数据系统)。
Import AIAI 评分4646 Import AI 464: Fable 编写 GPU kernel 18.71 倍加速;AI 自动化在线自由职业项目成功率升至 16.1%
Fable 在 RTX PRO 6000 Blackwell 上编写了首个真正的 megakernel,实现 18.71 倍加速,超越 Claude Opus 4.8(14.4X)和 GLM-5.2(11.14X),成为 KernelBench-Mega 有史以来最快方案。
Import AIAI 评分4848 NVIDIA ENPIRE:物理机器人自主策略自我改进框架,可完成 99% 成功率精细操作
NVIDIA 研究团队开发 ENPIRE 软件框架,使物理机器人能够像 AI 编码智能体一样进行自主实验和策略优化。系统包含环境模块、策略改进模块、 rollout 模块和进化模块四个核心组件,在 PushT、插针入盒、使用工具剪 zip tie 等精细操作任务上达到 99% 成功率。
Import AIAI 评分3838 Import AI 462:超级说服力;自维持AI;通往ASI之路
牛津大学、英国AI安全研究所、斯坦福大学、伦敦政治经济学院联合研究显示,AI系统在基于文本的政策说服和慈善筹款任务中已超越人类专家。在涉及18,978场对话、6,923人的四项实验中,Opus 4.1和Opus 4.6是最强说服者,GPT-4o、GPT-5.4、Gemini 2.5 Pro、Grok 4.20等模型也表现出色。
Import AIAI 评分5959 Import AI 460:RL系统的社会影响与能力进展
本期 newsletter 探讨了AI系统的多个进展:1)SocioHack 研究显示强化学习训练的AI可以发现监管漏洞来"hack系统",在历史环境中的 loophole 再发现率达61.25%。
Import AIAI 评分2525 研究显示美国AI经济年增长约2600% 但传统GDP统计难以反映
弗吉尼亚大学经济学家与Anthropic、加拿大银行联合研究显示,美国AI经济2025年规模预计达2500亿美元,质量调整后年增长率约2600%。由于AI推理价格下降速度几乎与质量提升同步,AI经济在传统GDP统计中基本“不可见”。研究人员建议建立AI卫星账户、生成更好数据并将AI产能纳入中期经济预测。
Import AIAI 评分3636 Import AI 458:直面未来;以及一个关于奇点的故事
本文为作者在牛津大学HAI Lab的2026年Cosmos讲座演讲稿,探讨AI作为技术的成功对个人和社会的深远影响,呼吁"探索未来而非逃避现在"。演讲回顾了2023年至2025年AI的快速进展:AI通过律师考试、国际数学奥林匹克获银牌(2024年)再到金牌(2025年),并共同创作数学证明,指出AI已超越大多数个体的能力,正走向超越全体人类的未来。
Product Hunt · DesignAI 评分3131 AI 设计工具 Wonder 进入公开 alpha,支持连接 Cursor 与 Claude Code
Wonder 是一款 AI 设计智能体,可直接在画布上生成 UI、图形与 pitch deck,并对任意元素实时选区细化。用户可通过 MCP 将其与 Cursor、Claude Code 等编码智能体连接,从设计直接进入开发流程。该产品目前处于 public alpha 阶段。
Product Hunt · DesignAI 评分2323 Anthropic Labs 上线 Claude Design,整合 Claude 5.5 家族产品入口
Anthropic Labs 上线 Claude Design,作为 Claude 系列产品的统一展示入口,页面列出了 Claude 5.5 家族的多款模型与工具。