模型

Qwen3.8实时音视频翻译模型上线

应用与实践机器翻译

概述

该模型将实时音视频输入用于翻译,区分说话人并提供识别转写。源语言覆盖与可生成的语音语言数量是不同指标。 支持60种源语言识别和29种语音输出,默认启用说话人区分与ASR转写,官方称端到端延迟约2.3秒。