开源项目
港大 hku-sail 团队开源 StreamPI:面向 VLA 模型的流式多模态时序建模
hku-sail/StreamPI
概述
仓库于 2026-08-27 创建(仓库创建)。StreamPI 全称 Streaming Multimodal Temporal Modeling for Vision-Language-Action Models,即面向视觉-语言-动作(VLA)模型的流式多模态时序建模方法,来自香港大学 hku-sail 团队,署名作者包括 Zhe Liu、Jinghua Hou 等。据摘要,仓库带实质代码与实验,可支撑复现。流式时序建模指向 VLA 在连续感知输入下的在线处理方向,对做机器人物理交互与实时决策的研究者有参考价值;本次抓取的 README 为截断快照,训练与评测细节需进入仓库进一步确认。