跳到正文
Berkeley AI Research·· 2026-07-26AI 评分55

ABBEL 通过更新信念状态提升 LLM 长程交互效率

Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction

AI 导读

Berkeley AI Research 提出 ABBEL,将交互摘要表示为可监督的自然语言信念状态,让模型根据新观察更新记忆并据此行动。在 CollabBench 中,带重构式信念评分的 ABBEL 将与完整上下文模型的性能差距缩小约 50%,训练步数从 100 降至 50,同时使用更少的峰值上下文 token。

来源:Berkeley AI Research · bair.berkeley.edu