论文

COSMO-Agent:用于闭环优化、仿真与建模编排的工具增强智能体

COSMO-Agent: Tool-Augmented Agent for Closed-loop Optimization,Simulation,and Modeling Orchestration

智能体系统模型训练强化学习Agent 工具调用Agentic RL

摘要

迭代的工业设计-仿真优化受制于CAD-CAE语义鸿沟:如何在多样且相互耦合的约束下把仿真反馈转化为有效的几何修改。为填补这一鸿沟,我们提出COSMO-Agent(闭环优化、仿真与建模编排),一个工具增强的强化学习(RL)框架,教会LLM完成闭环的CAD-CAE流程。具体而言,我们将CAD生成、CAE求解、结果解析与几何修改构建为一个交互式RL环境,LLM在其中学习编排外部工具并修改参数化几何,直至约束得到满足。为使该学习稳定且可供工业使用,我们设计了多约束奖励,联合鼓励可行性、工具链鲁棒性与结构化输出有效性。此外,我们贡献了一个面向工业的数据集,覆盖25个零部件类别并附带可执行的CAD-CAE任务,以支持贴近实际的训练与评估。实验表明,COSMO-Agent训练显著提升了小型开源LLM在约束驱动设计上的能力,在可行性、效率与稳定性上超过大型开源模型和强闭源模型。

COSMO-Agent:用于闭环优化、仿真与建模编排的工具增强智能体:论文配图
图2:COSMO-Agent的整体闭环框架、面向CAD-CAE优化的MCP工具集及训练奖励函数三部分示意。