跳到正文
原文
Reddit · r/LocalLLaMA· /u/boutell·· 2 天前AI 评分34

Meta 与华盛顿大学研究:允许小模型每轮自主编辑上下文窗口,基准测试成绩提升

Allowing small models to edit their own context on every turn = big win?

AI 导读

Meta 与华盛顿大学研究者抛弃压缩策略,转而让模型在每一轮中自主编辑上下文窗口,利用 shell 技能避免整体重写,并由模型自行决定保留哪些内容,同时保留"仅追加输出"的选项。在 Qwen 3.5 9B 和 Qwen 3.6 27B 等小模型上的基准测试成绩有所提升。该方法理论上适用于任何具备 bash 能力的模型,并可轻松集成到 Pi 或 OpenCode 等本地运行框架中。

来源:Reddit · r/LocalLLaMA · reddit.com