智客 ZICQ
EN 登录 / 注册
智客前沿 智能体 #长时智能体 #内存管理 #LLM #arXiv #CTWM

arXiv提出Core-Tail World Model (CTWM):优化长时语言智能体内存使用效率

Mr.Xu 的头像

文 / Mr.Xu

发布时间:

中文阅读 (Chinese) English Version

摘要:arXiv发布了一项关于长时语言智能体内存使用模式的研究,提出了一种名为Core-Tail World Model (CTWM)的新方法。该方法通过分析智能体在有限上下文和重复检索下的内存使用模式,发现其倾向于集中于核心状态而将罕见状态留在长尾中,导致预测误差积累。CTWM通过引入基于排名的内存控制器,以单一指数分配提示预算,同时保留总结后的长尾信息。在多个基准测试中,CTWM在保持完整状态和转换覆盖的同时,显著减少了提示token数量并降低了尾部预测误差,展示了其在提高智能体内存使用效率方面的潜力。


研究背景与动机

长时语言智能体越来越依赖于外部记忆作为冻结的世界模型,但现有的内存系统通常仅通过任务成功率或token成本进行评估,忽略了内存使用模式的重要性。在有限上下文和重复检索的情况下,智能体内存倾向于集中于核心状态,而将罕见状态留在长尾中,导致预测误差积累。

Core-Tail World Model (CTWM) 方法

为了解决上述问题,研究团队提出了Core-Tail World Model (CTWM)。该方法通过以下方式优化内存使用:

  • 基于排名的内存控制器:CTWM引入了一个基于排名的内存控制器,通过单一指数$\tau$分配提示预算,同时保留总结后的长尾信息。
  • 核心-长尾痕迹分析:通过保守的长尾审计,研究发现内存集中是重复的,但依赖于策略。随机游走智能体产生对数正态分布的检索伪影,而语义LLM策略则产生最强的截断幂律核心-长尾痕迹。

实验结果

在多个基准测试中,CTWM表现出色:

  • Synthetic Graph World:CTWM在保持完整状态和转换覆盖的同时,减少了5.9%的提示token,并将下半部长尾预测误差降低了13.6%。
  • ALFWorld和LongMemEval:在ALFWorld上,CTWM实现了与基准方法一致的token节省;在LongMemEval上,CTWM将token数量减少了24.48%,同时保持了总体准确性。

行业影响与开发者建议

CTWM的提出为长时语言智能体的内存管理提供了新的思路,尤其在以下方面具有重要意义:

  • 提高内存使用效率:CTWM通过优化内存分配策略,减少了不必要的token消耗,提升了智能体的运行效率。
  • 增强预测准确性:通过保留总结后的长尾信息,CTWM有效降低了尾部预测误差,提高了智能体的预测准确性。
  • 开发者建议:建议开发者在设计长时语言智能体时,考虑采用类似CTWM的内存管理策略,以优化智能体的整体性能。

未来研究方向

未来的研究可以进一步探索CTWM在不同类型智能体和任务中的应用,以及如何结合其他优化技术(如剪枝和量化)以实现更高效的内存管理。


消息来源:ArXiv AI (cs.AI) (2026-10-02)

—— 完 ——

主题标签: #长时智能体 #内存管理 #LLM #arXiv #CTWM

社区整体评论区

正在加载实时智能评论与划词标注…