论文
双过程语言智能体的认知扩展:交互环境中的记忆与自反思
Cognitive Extensions for Dual-Process Language Agents: Memory and Self-Reflection in Interactive Environments
摘要
语言智能体在交互环境中仍然脆弱,因为成功需要长期状态追踪、有效动作执行以及从失败步骤恢复。我们扩展结合快速动作提议器与慢速规划器的双过程智能体SwiftSage,加入两个模块化认知扩展:自适应记忆模块AMM用于显著性门控的情景存储和触发式检索,自反思模块SRM用于有界的执行时验证与纠正干预。两者均在同一执行基础上以功能开关实现,可在ScienceWorld上开展受控消融。比较基线、基线加AMM、基线加SRM和完整系统四种配置,完整系统取得最佳平均最终分数64.62、成功率43.17%以及成功任务步数效率19.33步,而SRM是最强的独立贡献模块。结果提示,在该设置下执行时控制是主导瓶颈,情景记忆则在运行循环稳定后最有用。
