论文

Safactory:可扩展的代理工厂,提供值得信赖的自主智能

Safactory: A Scalable Agent Factory for Trustworthy Autonomous Intelligence

AI 基础设施AI 开发与运维平台

摘要

随着大模型从会话助手演化为自主智能体,挑战日益来自长时程决策、工具使用与真实环境交互。既有智能体基础设施在评估、数据管理与智能体进化间仍显碎片化,使系统性发现风险与闭环持续改进模型变得困难。本报告提出Safactory:面向可信自主智能体的可扩展智能体工厂。Safactory整合三个紧耦合平台:用于轨迹生成的并行仿真平台、用于轨迹存储与经验抽取的可信数据平台,以及用于异步强化学习与在策略蒸馏的自主进化平台。据我们所知,Safactory是首个为下一代可信自主智能体提出统一进化流水线的框架。

Safactory:可扩展的代理工厂,提供值得信赖的自主智能
图 15:在每个评分器绘制的 9,000 个样本子集上微调 Qwen2.5-7B 后的性能比较。通过综合考虑多个数据质量维度,DataElf取得了最佳的整体性能。虚线边框条表示完整数据基线和低于它的方法。