Berkeley AI Research·· 2026-07-26AI 评分55
ABBEL 通过更新信念状态提升 LLM 长程交互效率
Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction
AI 导读
Berkeley AI Research 提出 ABBEL,将交互摘要表示为可监督的自然语言信念状态,让模型根据新观察更新记忆并据此行动。在 CollabBench 中,带重构式信念评分的 ABBEL 将与完整上下文模型的性能差距缩小约 50%,训练步数从 100 降至 50,同时使用更少的峰值上下文 token。
来源:Berkeley AI Research · bair.berkeley.edu