模型

腾讯AI Lab发布Penguin-VL视觉语言模型家族

Penguin-VL模型家族及视觉编码器发布

模型训练预训练

概述

腾讯AI Lab(tencent-ailab)发布Penguin-VL视觉语言模型家族,采用文本LLM初始化视觉编码器,探索多模态建模效率。模型输入支持文本、图像和视频,家族包含Penguin-VL-2B与Penguin-VL-8B,配套的Penguin-Encoder参数规模未明确。模型及视觉编码器已在Hugging Face发布,推理代码同期开放,许可证未明确。发布日期记录为2026年3月9日。