论文
Open-Qwen-Music:开放LLM作曲与扩散渲染的完整研究链路
Open-Qwen-Music: An Auditable Framework for LLM-Based Music Composition and Diffusion Rendering
摘要
我们提出Open-Qwen-Music,一个对Qwen-Music的开放重建,以及定义完整的文本到音乐研究系统,将基于LLM的语义作曲与基于扩散的声学渲染结合。系统包含25Hz单码本音乐分词器、3B参数自回归Music LLM,以及生成48kHz立体声音频的扩散渲染器,遵循Qwen-Music公开报告的跨模块接口。这类设计中最强的系统仍然闭源,知名开放音乐生成项目虽发布权重和推理代码,却不提供训练语料或端到端训练实现。这限制了独立受控研究:信息损失和预测误差如何从语义表示经自回归规划传到声学渲染。据我们所知,Open-Qwen-Music是首个完整开放发布的LLM作曲加扩散渲染文本到音乐系统。除模型权重与推理代码外,发布还包含训练数据和来源清单,完整的数据处理、标注、训练、推理及评测流水线,以及所有学习模块的配置与预训练权重。产物清单在完整流程中绑定这些材料的身份。它们共同建立可复现的模块化架构实现,为组件级分析和未来评测提供实证基础。我们将系统定位为透明、可执行的研究基线和社区起点,而非已达到Qwen-Music质量的证据。Open-Qwen-Music仍在持续推进,我们将继续改善生成质量、可控性和鲁棒性。全部发布材料可在项目地址取得。 https://github.com/biang15343100-source/Open-Qwen-Music