模型Qwen3.8实时音视频翻译模型上线阿里巴巴 / Qwen·来源日期:2026.09.17应用与实践机器翻译收藏概述该模型将实时音视频输入用于翻译,区分说话人并提供识别转写。源语言覆盖与可生成的语音语言数量是不同指标。 支持60种源语言识别和29种语音输出,默认启用说话人区分与ASR转写,官方称端到端延迟约2.3秒。