模型
Qwen3-ASR与ForcedAligner发布开放
Qwen3-ASR 与 ForcedAligner 发布
概述
阿里巴巴发布Qwen3-ASR语音识别模型与Qwen3-ForcedAligner强制对齐模型:ASR提供0.6B、1.7B两种规格,输入音频输出文本,支持多语言语音转写与语言识别;ForcedAligner为0.6B,输入音频与文本,输出时间对齐结果,支持时间戳预测。两者均开放权重及推理代码,可自行部署。组合使用可覆盖语音转写加字幕对齐的完整流程,小参数规格也降低了部署门槛。