论文
HyMem:具有动态检索调度的混合记忆架构
HyMem: Hybrid Memory Architecture with Dynamic Retrieval Scheduling
摘要
大型语言模型(LLM)智能体在短文本场景中表现出强劲性能,但由于记忆管理低效,在长对话中常常表现不佳。现有方法面临效率与效果之间的根本权衡:记忆压缩有丢失复杂推理所需关键细节的风险,而保留原始文本会为简单查询引入不必要的计算开销。症结在于单一化记忆表示与静态检索机制的局限,它们无法模拟人类所展现的灵活而主动的记忆调度能力,因而难以适应多样的问题场景。受认知经济原则启发,我们提出 HyMem,一种通过多粒度记忆表示实现动态按需调度的混合记忆架构。HyMem 采用双粒度存储方案,配合动态两级检索系统:轻量模块构建摘要级上下文以高效生成回复,而基于 LLM 的深度模块仅在复杂查询时被选择性激活,并由反思机制增强以迭代精炼推理。实验表明,HyMem 在 LOCOMO 和 LongMemEval 两个基准上均取得强劲表现,优于全上下文方式,同时将计算成本降低 92.6%,在长期记忆管理中确立了效率与性能之间最先进的平衡。
