模型

MiMo-V2.5-ASR:小米开放的端到端语音识别模型

小米开放 MiMo-V2.5-ASR

应用与实践语音识别与转写

概述

小米 MiMo 团队发布端到端自动语音识别模型 MiMo-V2.5-ASR,同步提供可下载权重、推理代码和在线演示,官方 Hugging Face 提交历史显示模型文件于 4 月 23 日首次上传。模型面向中文语音的真实复杂场景,覆盖中英文、中文方言、中英混说、歌词、噪声环境、多人重叠语音及知识密集内容等情形,并可直接生成带标点的文字转写,减少后处理环节。方言与重叠语音场景的表现建议实测。