模型

京东全栈开源JoyAI-VL-Interaction:实时视频流的秒级发言决策

JoyAI-VL-Interaction 完整开源发布

智能体系统Agent 架构与控制循环

概述

京东发布面向实时视频流的视觉语言交互模型JoyAI-VL-Interaction(2026-06-20,开源发布日口径),并在同批次开放模型权重、部署系统、训练方法、时序对齐交互数据和vLLM-Omni部署方案。模型持续观察视频,并按秒决定发言、保持静默或将任务委派给后台模型或智能体。8B级(Hugging Face模型页约9B);输入实时视频、图像、文本,输出文本决策与回复,语音由可插拔ASR/TTS提供;Apache-2.0全栈开放。发布方:京东JoyAI。