跳到正文
原文
Berkeley AI Research·· 2026-07-26精选AI 评分60

ABBEL:通过信念状态实现高效长程交互

Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction

AI 导读

本文提出 ABBEL 框架,通过将交互历史压缩为自然语言信念状态来替代完整上下文,从而降低长程任务的计算成本。在协同编码任务 CollabBench 中,使用基于重建的信念评分(belief grading)可将性能差距缩小约 50%,训练步数从 100 降至 50,峰值 token 减少 57%。该方法在组合锁游戏和多目标问答任务中也展现了学习效率优势。

推荐理由

给出了具体性能数据(性能差距缩小50%、训练步数减半、峰值token大幅降低),读者可以直接评估这个方法对长程交互任务的实际价值。

来源:Berkeley AI Research · bair.berkeley.edu