开源项目

GenRL:视觉生成强化学习训练框架

ModelTC/GenRL

模型训练强化学习

概述

GenRL是面向视觉生成模型优化的可扩展模块化强化学习框架,覆盖从图像到视频的生成任务,奖励函数可即插即用,支持多GPU分布式训练。项目2月10日创建,采用Apache-2.0许可,README提供依赖安装与训练命令,相关模型整理在Hugging Face合集中。需要对文生图或文生视频模型做强化学习后训练的团队,可基于其模块组合奖励设计与训练流程,在自有底模上对比不同奖励函数的效果。