论文

FluxVLA Engine:体现智能的一站式VLA工程平台

FluxVLA Engine: A One-Stop VLA Engineering Platform for Embodied Intelligence

AI 基础设施AI 开发与运维平台

摘要

视觉-语言-动作(VLA)模型、世界-动作模型(WAM)和离线强化学习方法正在迅速扩展具体化策略的设计空间,但将这些算法转变为可靠的机器人系统仍然受到碎片化数据格式、训练堆栈、评估协议、推理运行时和特定于具体化的接口的限制。我们提出了 $\mathrm{FluxVLA}$ 引擎,这是一个开放的、配置驱动的平台,它将异构的体现策略组件转变为可重复的数据到部署工作流程。 $\mathrm{FluxVLA}$ 没有引入另一个策略模型,而是标准化了数据集、视觉语言和世界模型、行动头、奖励或优势加权学习、分布式训练、模拟评估、优化推理和机器人操作员的接口。该引擎进一步集成了组合双臂仿真、可扩展的自动数据生成以及模型解耦的人机交互部署、接管、校正收集和奖励注释。为了实现响应式物理执行,它将实时分块 (RTC) 与加速推理后端、轻量级远程 GPU 服务和可配置轨迹后处理相结合。这些功能通过共享和可审计的合约将离线学习、模拟验证、在线校正和真实机器人执行连接起来。因此,$\mathrm{FluxVLA}$ 的目标是解决将有前途的体现学习算法与可重复评估和可靠部署分开的工程瓶颈。代码可在 https://github.com/FluxVLA/FluxVLA 获取