开源项目

QwenOmnilinguaBench:评测复杂多语言音频任务

QwenLM/Omnilingua-Bench

模型评测基准与评测资源

概述

QwenOmnilinguaBench 是多语言音频理解评测资源,覆盖长音频、多说话人及复杂指令。 项目提供数据和校验工具,帮助检查模型能否在长内容和多语言条件下正确遵循任务。评测重点不仅是单段转写,还包括结合说话人、语言和指令理解音频的能力。