模型

Qwen3.5首批模型发布,旗舰开放权重

Qwen3.5 首批模型发布

模型架构MoE混合架构

概述

阿里巴巴公布Qwen3.5首批模型,采用原生视觉语言训练及线性注意力与稀疏MoE混合架构,输入支持文本、图像与视频,输出文本。其中Qwen3.5-397B-A17B总参数397B、激活17B,开放权重下载,上下文原生262,144 tokens、可扩展至约1M;Qwen3.5-Plus提供官方API调用,上下文1M tokens,参数规模未披露。需要视觉语言与长上下文能力的团队,可先自部署开放权重版评测,再按成本与运维能力决定是否转用Plus服务。