论文

双过程语言智能体的认知扩展:交互环境中的记忆与自反思

Cognitive Extensions for Dual-Process Language Agents: Memory and Self-Reflection in Interactive Environments

智能体系统上下文与知识记忆Agent 架构与控制循环Agent记忆

摘要

语言智能体在交互环境中仍然脆弱,因为成功需要长期状态追踪、有效动作执行以及从失败步骤恢复。我们扩展结合快速动作提议器与慢速规划器的双过程智能体SwiftSage,加入两个模块化认知扩展:自适应记忆模块AMM用于显著性门控的情景存储和触发式检索,自反思模块SRM用于有界的执行时验证与纠正干预。两者均在同一执行基础上以功能开关实现,可在ScienceWorld上开展受控消融。比较基线、基线加AMM、基线加SRM和完整系统四种配置,完整系统取得最佳平均最终分数64.62、成功率43.17%以及成功任务步数效率19.33步,而SRM是最强的独立贡献模块。结果提示,在该设置下执行时控制是主导瓶颈,情景记忆则在运行循环稳定后最有用。

双过程语言智能体的认知扩展:交互环境中的记忆与自反思:论文配图
图1:完整系统架构。SwiftSage负责动作选择,AMM增加显著性门控的情景写入与触发式检索,SRM在动作送入ScienceWorld前增加Gate–1验证、停滞检测及有边界的Critic纠正。