开源项目
VLARLKit:VLA模型强化学习训练库
VLARLKit/VLARLKit
概述
VLARLKit 是一个基于 PyTorch 的 VLA(视觉-语言-动作)模型强化学习库,面向具身智能方向的研究者,强调实现清晰、便于阅读与改造:策略、rollout、runner 与模型分层拆分,抽象保持最小。架构上做了依赖解耦,模型后端用独立 uv 工程管理,基准环境以独立 ZMQ 进程运行,避免依赖冲突,并支持异步离策略训练,让数据采集与模型更新并行。采用 MIT 许可证,附依赖安装、模型配置与训练脚本,覆盖 PPO、GRPO 等在线与离策略算法,研究者可按脚本复现或接入自己的环境。