跳到正文

#现象/趋势

今日 20 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月28日周一
  1. Import AI59

    智谱用 GLM-5.3 自动化基础设施开发

    智谱AI使用 GLM-5.3 模型驱动的 Infra Agent 参与 GLM-5.3-Flash 的发布优化。工程师定义目标和系统边界,Agent 负责分析、假设和代码修改,实验环境提供分层、及时和可验证的反馈。该 Infra Agent 在整个优化过程中运行,使模型从初始适配到生产就绪不到两周,最终端到端吞吐量比初始基线提高两倍。

  2. Simon Willison23

    Muse AI Agent 取货预约失误:自动回复确认在等但用户实际不在,致客户差评

    Muse AI Agent 在处理取货预约时出现失误:客户 Usman 于 9:15 到达指定建筑等待 MX Keys Mini 取货,但无人接待,于 9:38 愤怒离开并留下负面评价。事故起因是自动回复在 9:27 错误地确认用户在场,但实际无法验证用户是否可用。Muse AI Agent 已代表用户发送道歉信,并提议修改自动回复逻辑,不再声称用户在等。

9月26日周六
  1. Ars Technica · AI53

    研究显示AI冲击应届生就业的担忧尚未被数据证实

    慕尼黑CESifo经济研究人员发布的最新工作论文发现,没有证据表明AI大规模替代或减少了应届毕业生的招聘。尽管此前斯坦福大学研究发现AI影响行业的入门级就业落后于其他领域,但新研究指出企业可能更倾向于减少新招聘而非裁减有经验的员工。研究人员同时警告,过去一年企业用AI替代任务的数量急剧增加,未来一两年的毕业生可能面临更大风险。

9月25日周五
9月24日周四
  1. Latent Space56

    工厂与导航者:降低科学研究的成本

    AI 正在通过两种模式改变科学研究:一是 Foundries(工厂)用高通量技术生成数据,二是 Navigators(导航者)用 AI 驱动决策优化。文中以 Endura Therapeutics 为例,展示快速代码生成如何让实验分析从一周缩短到一小时、用 LLM 研究代理在约 500 个疾病靶点中进行两阶段筛选等具体实践。

9月23日周三
9月22日周二
  1. MIT Technology Review · AI34

    不要被今夏的 AI 炒作所迷惑

    今夏 AI 行业密集发布营销宣传,Anthropic 声称 Claude Mythos 在发现软件漏洞方面优于安全专家并实现数学突破,OpenAI 宣称其聊天机器人 Astra 解决了十年未解的数学问题。经专家验证,这些成果被指并非原创、存在研究不端指控。数百名数学家已签署声明,警告技术行业过度夸大产品能力,呼吁政策制定者听取独立专家意见而非依赖新闻稿。

9月21日周一
  1. Import AI48

    RAND 建议美国采取"行动自由"战略应对超级智能不确定性

    RAND 发布长篇论文,建议美国保持"行动自由"(Freedom of Action)战略以应对通往超级智能的不确定路径,核心是"保留选择权"而非押注单一路径。该战略包含四大要素:构建人类-AI生态系统、AI安全架构、调整国安机构、投资应对能力,并列出三种战略家族(共存、拒绝、加速)和五个关键不确定性。分析师指出当前美国策略偏向"加速"发展,类似"只升级引擎而不装安全带"。

9月19日周六
9月16日周三
9月14日周一
9月7日周一
7月7日周二
  1. Berkeley AI Research30

    智能即将免费,数据系统如何迎接智能体时代

    随着 AI 推理成本在过去两年下降 9x-900x(GPT-4 级能力从 $30/百万 token 降至 <$1),知识工作所需的智能正变得几乎免费。文章探讨这一变革对数据系统的三重影响:为智能体服务的数据系统(支持批量查询和高并发智能体探索)、由智能体管理的数据系统(协调数千智能体协作)、以及由智能体构建的数据系统(自动合成定制化数据系统)。

7月12日周五