开源项目

SkillRL:技能增强强化学习训练代码

aiming-lab/SkillRL

模型训练强化学习

概述

SkillRL研究通过技能库与策略的递归共演化训练代理,让代理从原始经验中自动发现可复用技能,弥合原始经验与策略改进之间的落差。项目采用MIT许可,明确于2月18日发布代码,README提供环境安装说明与三个场景的强化学习训练脚本,可复现其训练流程。研究技能发现、代理自我改进方向的团队,可按说明搭建环境跑通三场景训练,也可在其技能机制上做改进实验。