论文
AutoRAS:以原语表示学习鲁棒智能体系统
AutoRAS: Learning Robust Agentic Systems with Primitive Representations
摘要
智能体系统的自动化设计为把大语言模型(LLM)扩展到单智能体推理之外提供有前景路径。虽然先前工作经手工或自动生成的多智能体工作流推进任务性能——鲁棒性常被当作事后考虑——使系统易受外部对手与内部失败影响。我们提出AutoRAS——鲁棒智能体系统自动化设计框架。AutoRAS把系统设计形式化为生成联合编码结构连接与行为动作的符号原语序列——并以执行导出的安全信号与基于流的序列级目标学习优化该序列。大量实验表明AutoRAS在原始与对抗设定中都取得最佳性能——攻击下性能退化最小。进一步分析展示强可迁移性、稳定优化行为、跨原语集的稳定性与有利的成本权衡。代码见 GitHub。
