论文
BEAT:通过统一时间步骤标记和生成符号音乐
BEAT: Tokenizing and Generating Symbolic Music by Uniform Temporal Steps
摘要
对音乐进行标记以适应语言模型的总体框架是一项引人注目的挑战,特别是考虑到可以表示音乐的多种符号结构(例如序列、网格和图形)。迄今为止,大多数方法将象征性音乐标记为音乐事件序列,例如开始、音高、时移或复合音符事件。这种策略很直观,并且在基于 Transformer 的模型中被证明是有效的,但它隐式地处理了音乐时间的规律性:各个标记可能跨越不同的持续时间,从而导致时间进展不均匀。在本文中,我们转而考虑是否可以采用替代标记化,其中统一长度的音乐步骤(例如节拍)作为基本单位。具体来说,我们以与一个标记相同的音高对单个时间步内的所有事件进行编码,并按时间步显式对标记进行分组,这类似于钢琴卷帘表示的稀疏编码。我们评估了所提出的音乐延续和伴奏生成任务的标记化,并将其与主流的基于事件的方法进行比较。结果显示音乐质量和结构连贯性得到了改善,而额外的分析证实了所提出的标记化对远程模式的更高效率和更有效的捕获。