论文
Terminal Agents:命令行环境中的AI智能体综述
Terminal Agents: A Survey of AI Agents in Command-Line Environments
摘要
大语言模型智能体越来越多地通过终端采取行动,但现有综述把终端介导的行为分散在软件工程、工具使用和计算机使用研究中。我们将终端智能体视为这样一类系统:其承载进展的主要行动-观察循环由终端命令执行、文本反馈和有状态环境交互介导。以终端介导执行作为组织视角,本综述建立了工作负载层面的边界,并通过七维终端能力画像把系统架构、能力获取与评估连接起来。我们的综合表明,实现的行为由模型、接口、harness、运行时和环境共同塑造。可执行轨迹把学习锚定在行动后果、验证与恢复上,而流行的评估强调最终结果,对过程质量、恢复与治理的暴露不均衡。有界的固定条件诊断说明了两个含义:基准族暴露出不同的过程信号,匹配系统的比较揭示了依赖基准的性能以及组件归因的局限。这些发现促使显式报告系统与运行时条件,并以可重放轨迹和过程级证据作为支撑。该框架为研究软件工程与新兴应用领域中的终端介导能动性提供了统一基础。
