开源项目

OpenRLHF:开源强化学习训练框架

OpenRLHF/OpenRLHF

模型训练强化学习Agentic RL

概述

OpenRLHF是GitHub上的开源强化学习训练框架,仓库README提供训练脚本与使用文档,可作为搭建RLHF训练流程的工程起点。本期观察显示,多模态多轮强化学习构成其主要工作流扩展,即框架在常规单轮文本对齐之外,向多模态输入与多轮对话场景延伸,为需要在多轮交互场景做对齐训练的团队提供可复用的脚本与文档入口。