开源项目

AxisRL创建仓库:大规模Agent强化学习后训练框架

XYZ-AI-Lab/axrl

模型训练强化学习Agentic RL

概述

AxisRL(仓库名axrl)由XYZ-AI-Lab创建,定位为大规模Agent强化学习后训练框架,把多轮交互、工具调用的Agent任务纳入RL训练循环,提供可复用的训练组件与中英文文档、品牌化工程资产。仓库(仓库创建日,非功能发布日)。计划对Agent模型做强化学习后训练的团队可评估其训练拓扑与规模方案是否匹配自有算力;框架的收敛稳定性与训练成本需在小规模任务上先行试验,再考虑放大。