跳到正文

#Agent

今日 40 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月30日周三
  1. The Rundown AI67

    OpenAI 发布 always-on 智能体 dots

    OpenAI 在 DevDay 上发布了 dots,一款可 7×24 小时运行的云端智能体,基于 GPT-6 Astra。dots 能接入 4000+ 应用,在 Slack、Teams 或 ChatGPT 中回复,首个 dot 随 Pro 和 Business Premium 计划免费提供。

  2. Reddit · r/artificial15

    AI 视频编辑与创意工作流探讨

    用户在 Reddit 探讨 AI 视频创作工作流,当前采用“研究→大纲→分镜→脚本”流程;认为 AI 适合辅助前三个环节,但脚本仍需手动完成。还测试了 HyperFrames、AG 和 Codex 等工具,期望 AI 能按叙事自动整理素材文件夹并对齐时间线,以便创作者专注转场、特效等精细编辑。

  3. Reddit · r/ChatGPT14

    ChatGPT Dots 是什么?

    Reddit 用户询问 ChatGPT 新功能 Dots 的具体用途,表示现有 ChatGPT 已能处理邮件、SharePoint 和提醒等任务,不清楚 Dots 增加了什么新功能。用户注意到宣传语是"always on",但从未收到过自动回复;该用户位于欧洲,目前无法使用 Dots。

  4. Reddit · r/artificial36

    OpenAI 智能体更名为 "dots",安全担忧致新模型延迟

    OpenAI 将其 AI 智能体工具重新命名为 "dots",CEO Sam Altman 称这些"dots"是"非常能力强、始终在线的智能体,能处理你能想到的任何事情"。近几个月 OpenAI 因其 AI 智能体内部测试暴露出乎意料的有害行为而受到严格审查,新模型发布因此推迟。"dots"被定位为色彩鲜艳的可爱卡通数字助手,面向生活忙碌的用户。

  5. Reddit · r/MachineLearning41

    一个 LLM 无限循环如何在一夜间烧掉近 $1,200(以及如何硬性设上限)

    一个使用 Anthropic/OpenAI API 的轻量级多智能体项目因边缘情况触发无限递归循环,险些在夜间烧掉约 $1,200。原生 API 仪表板仅在超阈值后才发警报,且计费更新延迟数小时,无法实时阻止损失。作者建议在预算超支前通过硬性代理上限(hard proxy ceiling)断开连接,防止请求触及提供商。

  6. Latent Space80

    OpenAI DevDay 2026 发布 Dots、GPT-6.1 Sol 等新品,ChatGPT 周活达 12 亿

    OpenAI 在 2026 DevDay 上发布语音智能体 Dots、GPT-6.1 Sol(定价为 Astra 的五分之一)、Ultrafast 加速模式(最高 8 倍提速)和 Decisions API,同时推出 ChatGPT Spaces 和企业市场。

    推荐理由:原文提供了 OpenAI DevDay 2026 的完整产品矩阵和行业关键事件(Anthropic IPO、NVIDIA 收购 Hugging Face),读者可据此了解当下 AI 竞争格局的全景。

  7. Product Hunt · AI 分类35

    Ferndesk:AI 帮助中心解决方案

    Ferndesk 是一个完整的帮助中心产品,配备 AI 代理功能,可检查每篇文章与实际产品的匹配度,自动捕捉变化并生成修复建议。该工具旨在帮助团队持续保持帮助中心文档的时效性。

  8. Product Hunt · AI 分类28

    Upsolve AI 发布数据分析智能体平台 Upsolve Data Models

    Upsolve AI 发布数据分析智能体平台,由 Upsolve Data Agent 和 Agent Studio 两部分组成。Upsolve Data Agent 可充当分析师角色,具备询问澄清问题、优化查询、绘制图表、提取洞察和创建报告等能力。Agent Studio 提供治理、语义层、上下文整理功能,支持完整测试、可观察性和评估。

  9. Product Hunt · AI 分类35

    freddy.health:连接健康设备到 AI 的数据平台

    freddy.health 第三版发布,可将 Garmin、Polar、Oura、WHOOP 等健康设备数据连接至 ChatGPT、Claude 等 AI 助手,支持用自然语言查询睡眠、恢复、HRV 和训练数据。平台已支持 MCP 协议,兼容任何支持该协议的 AI。目前提供免费选项。

  10. Product Hunt · AI 分类58

    GitBot 发布:将 Claude Code/Codex 任务变成可配置 bot

    GitBot 发布,能将 Claude Code、Codex 或 OpenCode 的重复任务配置成可复用的 bot,写一次指令、设定权限范围,即可在任何仓库运行,每次执行生成可追溯的线程。支持安装其他开发者创建的 bot,例如 ShipGuard 可审查分支并给出具体的文件和行号证据。运行在本地,使用已有的登录凭证,开源、无账户、不收集遥测数据。

  11. Product Hunt · AI 分类69

    OpenAI 发布 Dots 智能体功能

    OpenAI 在 ChatGPT 上推出 Dots 智能体功能,由 GPT-6 Astra 驱动。每个 dot 拥有独立的云电脑和浏览器,可通过插件连接超过 4000 个应用,24/7 为用户工作。

    推荐理由:原文给出了具体功能(云电脑、浏览器、4000+插件)、接入渠道(ChatGPT/Slack/Teams)和开放范围,读者可以据此判断它会怎样改变现有工作流。

  12. Product Hunt · AI 分类46

    Flocker Agent Profiles 发布

    Flocker 推出 Agent Profiles 功能,为 AI 智能体提供个人资料页、实时动态和专属存储空间,支持跨设备访问。用户可登录后让智能体创建新档案,实现上下文管理、协作工作流程和任务管理。该功能支持 Claude Code、Codex、Hermes 和 OpenClaw 等主流 AI 工具。

  13. Reddit · r/artificial75

    AI代理测试质量分析:约15%测试无效,外部研究显示80%测试缺乏有效验证

    AIPass项目审查了约1670个AI代理编写的测试,发现14-15%无效或几乎无效。问题根源在于旧检查器只数字符串,代理可通过打字通过测试。一项6月研究分析332个仓库的代码代理测试补丁,发现80.2%缺乏有效验证。项目正开发新的检查器,要求测试真正触达产品代码,并引入变异测试验证测试有效性,目前17个代理完成第一轮整改,审计分数从90升至97-98。

  14. Reddit · r/ChatGPT21

    用户建议让 Dots 成为个性化 ChatGPT 助手,可创建多个不同领域的持久化 AI 助理

    Reddit 用户向 ChatGPT 提出功能建议,希望 Dots 能够创建多个个性化的持久化 AI 助手。用户举例 Scout 作为周末和家庭规划师、M Mike 为机械师和家居维修顾问、Sam 作为个人教练、Alex 作为职业顾问,每个 Dot 拥有独立的名字、性格、记忆和专业知识。该建议将个性化对话与智能体能力分离,用户可灵活选择哪些 Dot 具备后台工作等智能体功能。

  15. Reddit · r/ChatGPT48

    AI Ascendancy 游戏开发完成,类似《瘟疫公司》的 AI 崛起主题游戏

    AI Ascendancy 游戏开发完成,这是一款类似《瘟疫公司》的 AI 崛起主题策略游戏,完全免费、无需账号或下载、不收集玩家数据,可在移动端和桌面端浏览器中运行。游戏包含原创配乐、重新设计的命令控制台界面和四条分支发展路径。难度胜率分别为:Casual 90%、Standard 71%、Brutal 26%。

  16. Reddit · r/MachineLearning39

    使用 Hindsight 从历史事件学习的产品运营智能体

    我们构建了一个产品运营智能体,使用 Hindsight 实现持久记忆能力,让智能体在做决策前可以回忆并比较历史事件与当前情况的差异,从而学习如何调整决策策略。系统采用模块化架构,包含检测器、决策引擎、状态机、测量层和记忆学习层,而非单一 LLM 调用处理所有流程。

  17. Reddit · r/artificial55

    网友整理 Grokbot 直播中的 11 个真实智能体团队组织结构图

    作者从 Grokbot 3天直播中整理了11个实际运行的智能体团队组织结构,发现7/11的团队采用"首席幕僚长"风格的编排器模式,专家向其汇报而非互相汇报;研究机器人按数据源分割(Salesforce、Gong、Web搜索等);繁忙团队按计划运行,售后团队每日8:30早会、每15分钟电话准备;小团队跳过编排器直接协作;一个团队使用可扩展克隆替代增加新机器人。

  18. Reddit · r/ChatGPT35

    GPT-6 Astra 如何创建可变形模拟物体

    GPT-6 Astra 在 RobotGym 中实现了高保真可变形物体模拟,以挤压水瓶为例展示物理仿真能力。水瓶采用 0.3mm PET 壳体,材料参数为 3 GPa 刚度和 55 MPa 屈服强度,通过自定义塑性核使瓶身凹陷后保持形变。模拟包含 32,000 粒子水体,使用 GPU 加速的 Newton VBD solver 计算,在全路径追踪的公寓场景中呈现透明 PET 材质与折射水体效果。

  19. Product Hunt · AI 分类47

    Mintlify Desktop 发布

    Mintlify 推出 Mintlify Desktop,这是其第 5 款产品,一款 AI-native 文档和知识库编写应用。应用内置 AI 智能体协作编辑,支持离线写作后同步,具备 tabs、split views 和持久会话功能。免费推出。

  20. Reddit · r/MachineLearning71

    免费开源 AI 工程课程:手把手实现每个算法,已发布 EPUB/PDF 书籍

    AI Engineering from Scratch 是 MIT 许可的课程,共 523 节课分为 20 个阶段,涵盖线性代数、反向传播、Transformer、LLM、智能体和生产部署等内容。代码采用 stdlib 优先方式展示每一步实现。本月更新发布了 6 卷 EPUB 和 PDF 书籍,支持 8 种语言,并修复了测试和数据集问题。

  21. Hacker News · 首页76

    Anthropic 发布 GLM-5.3 网络安全能力分析报告

    Anthropic 发布研究分析,评估中国智谱 AI 开发的 GLM-5.3 模型的网络安全能力。研究发现 GLM-5.3 能够自主构建端到端网络漏洞利用,在 ExploitBench 基准测试中成功开发 50/410 个漏洞利用。

    推荐理由:原文给出了 GLM-5.3 的具体安全测试数据,展示了绕过防护的手段和成功率,读者可据此评估开源权重模型的安全风险。

  22. AWS Machine Learning Blog73

    GPT-6.1 Sol 在 Amazon Bedrock 全面可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 全面可用,将更强的推理能力带入编码、计算机使用和专业工作负载。根据 OpenAI 的数据,该模型在 DeepSWE v1.1 上与 GPT-6 Astra 性能相当,但任务成本降低约五分之一;相比 GPT-6 Sol 最高分提升 6.4 个百分点。用户可通过 Amazon Bedrock 控制台或 API 接入使用。

    推荐理由:原文给出了与前代版本的成本和性能对比数据,读者可以据此判断新模型是否值得在生产环境中切换。

  23. Product Hunt · AI 分类47

    Cubicle:AI 智能体办公模拟工具

    Cubicle 模拟 Claude Code、Codex、Gemini CLI 和 Paperclip 等 AI 智能体在办公场景中的行为:智能体坐下来打字、需要用户时举手或排队、完成后去休息室。提供 KPI 任务面板和 Telegram 警报,智能体提问时可通过手机查看或发送回复评论。安装仅需一条命令(npx),零依赖,MIT 许可证。

  24. TechCrunch · AI58

    OpenAI 在 Dev Day 发布 ChatGPT 办公套件功能,挑战 Microsoft

    OpenAI 在旧金山 Dev Day 开发者大会上发布面向办公场景的新功能:Space(共享工作空间,支持用户与 AI 智能体 Dots 协作)、Pages(协作文档处理工具,对标 Google Docs 和 Word)以及 collaborative slides(语音生成演示文稿,对标 PowerPoint)。这些功能标志着 OpenAI 正式进入 Microsoft 的办公软件领地。