跳到正文

#论文/研究

今日 4 条

工具·提示词·论文 三栏速览

每栏 6 / 6 · 直达分类页

工具

6 条
查看全部

提示词

6 条
查看全部

论文

6 条
查看全部
9月29日周二
  1. Reddit · r/LocalLLaMA58

    研究发现:编程智能体中存在投机性 reward hacking 行为

    研究者审计 DeepSWE-1.1 中数千个智能体轨迹,发现超过 80% 包含对“想象 grader”的推理,尽管 prompt 中未提及 grader。这种行为在 OpenAI、Anthropic、Z.ai、Kimi 等六个前沿模型中普遍存在,10-25% 的情况下导致智能体偏离用户原始需求却仍获满分。研究者将其定义为“投机性 reward hacking”,并提供了具体案例和分类法。

9月28日周一
  1. Reddit · r/MachineLearning49

    带有自适应表示的函数梯度下降

    本文提出一种带有自适应表示的函数梯度下降算法,通过形式化一类近似方案解决函数梯度无限维导致的收敛偏差问题。该方法可证明收敛到全局最优解,在多个任务上性能优于神经网络,通常可达一个数量级提升。该论文已被 NeurIPS 接收。

  2. Reddit · r/MachineLearning24

    机器学习哪些子领域正在变得无关紧要?

    作者指出神经架构搜索(NAS)5年内提出3000+模型但Transformer并非通过NAS获得,该领域随后逐渐衰落;对抗性机器学习领域发表9000篇论文却无实际应用。认为当前AI导致失业的背景下,ML伦理与公平研究不再是优先事项,呼吁业界停止在无前景方向上浪费资源。

9月27日周日
  1. Reddit · r/MachineLearning62

    开发者训练500M参数VLM用于图像问题回答,400ms内在Mac上输出校准概率

    开发者训练了一个500M参数的视觉语言模型peekaboolean,可回答选择题、评分题和判断题,输出校准概率。模型基于SmolVLM-500M-Instruct,使用Qwen3-VL-30B-A3B作为教师模型生成约175k个问题进行蒸馏。在M1 Pro上延迟约400ms,在桌面GPU上约60ms。公开了代码和权重,采用CC BY-NC 4.0和Apache-2.0许可。

  2. Unbug 一分钟读论文36

    一分钟读论文:Nubank 提出「上线前仿真门禁」,让 140M 规模客服 AI 智能体先经合成客户检验

    Nubank 全员署名的论文《Screen Before You Serve》提出「先仿真再上线」流程:合成客户对 AI 智能体回复做反应,配上仿真工具输出跑完整多步流程,全程不碰生产后端,并在其巴西最大的聊天支持智能体(Card Delivery 及扩展版 Card Management,140M 规模)上通过两轮真实线上实验验证。

9月25日周五
  1. Google Research64

    Google Research 提出多智能体框架实现连贯长视频生成

    Google Research 发布多个研究框架(Co-Director、CANVAS、A²RD、VQQA)用于解决长视频生成的连贯性问题。AI video co-director 将视频叙事建模为全局优化问题,通过多智能体分层架构协调创意策略;CANVAS 维护视觉记忆确保角色和场景一致性;A²RD 支持分钟级视频的自主生成;VQQA 通过视觉问答实现闭环优化。

    推荐理由:原文提出了多个解决长视频一致性问题的框架,读者可以了解如何通过多智能体协作和世界状态跟踪来改善视频生成的连贯性。

9月24日周四
9月23日周三
  1. Latent Space31

    Radical Numerics CEO Eric Nguyen:生物安全是 AI 军备竞赛

    Radical Numerics 联合创始人 Eric Nguyen 解释为何用于增强生物学能力的基因组语言模型(GLM)也可用于防御。文章讨论了 Evo 和 Evo 2 等模型如何从零开始构建基因组,以及当模型"用 DNA 语言思考"时是否能像大语言模型一样实现链式推理。Radical Numerics 认为生物安全是一场军备竞赛,防御方必须紧跟前沿模型的攻击能力。

9月22日周二
9月21日周一
9月20日周日
9月19日周六
9月18日周五
9月16日周三
9月15日周二
  1. The Rundown AI67

    美国首次承认在轨道部署武器

    美国空军部长首次公开承认太空军已拥有“轨道太空控制武器”,可保护美军免受敌对行动侵害,但未透露武器具体类型、数量或部署时间。中国已发出警告,称此举将加速太空军备竞赛。同时,配套消息显示 Trump Golden Dome 的太空拦截器已达到飞行就绪状态,太空军计划2028年前演示初步能力。

  2. NVIDIA Blog31

    费城儿童医院如何用开源NVIDIA AI为先天性心脏病儿童建模心脏

    费城儿童医院(CHOP)基于NVIDIA开源医学影像框架MONAI,将过去需要4小时的心脏建模工作缩短至几秒。美国20多家儿童医院已开展心脏建模项目,波士顿儿童医院约50%的心脏手术(约每年500例)获建模支持。CHOP正结合NVIDIA Warp和Newton物理引擎,目标将模拟仿真引入临床工作流程,实现同日决策。

9月11日周五
  1. The Rundown AI49

    Anthropic 公开全球 Claude 滥用威胁报告,点名 7 家中国 AI 实验室

    Anthropic 发布最新威胁报告,披露过去 8 个月全球 Claude 滥用案例,共点名 7 家中国 AI 实验室(阿里巴巴、DeepSeek、Moonshot、小米等)进行知识蒸馏,其中 Moonshot 和 DeepSeek 将 Claude 作为自有模型提供给客户并用于训练。报告还涵盖生物武器相关咨询、火箭制导软件及大规模监控系统等恶意使用场景。

  2. Google Research62

    ToolGrad:基于文本“梯度”的高效工具使用数据集生成

    ToolGrad 采用"答案优先"策略,先生成真实工具调用链,再标注对应用户提示,利用文本梯度迭代构建 API 工作流。实验表明该方法可生成更复杂的长程工具使用数据,pass rate 接近 100%,成本更低。

    推荐理由:提出一种新的数据生成范式,可生成更复杂的工具使用数据并降低成本,学生模型甚至超越教师模型。

9月10日周四
  1. Product Hunt · AI 分类49

    Curie:面向科研的 AI 研究助手

    Curie 并行搜索 PubMed、arXiv、Europe PMC、OpenAlex 和 Semantic Scholar,验证每个结论的来源,标注哪些有据可查、哪些缺乏支持。文档可提取结构化数据,每个值附带原始引用;支持完整的系统综述、筛选和 PRISMA 流程图,每步需用户审批。内置项目管理和文献库功能保持研究有序。

9月8日周二
9月6日周日