论文

Hy-Embodied-0.5-VLA:从视觉-语言-动作模型到现实世界的机器人学习堆栈

Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack

模型训练预训练

摘要

在本报告中,我们介绍了 Hy-Embodied-0.5-VLA,缩写为 HyVLA-0.5,这是一个涵盖完整机器人学习堆栈的端到端系统:数据收集、模型设计、持续 预训练 和监督 微调、RL 后训练 以及实际部署。每个组件在此堆栈中扮演着不同的角色。