开源项目QwenOmnilinguaBench:评测复杂多语言音频任务QwenLM/Omnilingua-BenchQwenLM·来源日期:2026.09.15模型评测基准与评测资源收藏概述QwenOmnilinguaBench 是多语言音频理解评测资源,覆盖长音频、多说话人及复杂指令。 项目提供数据和校验工具,帮助检查模型能否在长内容和多语言条件下正确遵循任务。评测重点不仅是单段转写,还包括结合说话人、语言和指令理解音频的能力。