一种混合学习Transformer编码器,融合音乐理论指导强化学习,生成符合理论规则的多轨音乐。
帖云 · 郭新 · Donghui, Zhang · Jiessie, Tie · 齐林 · Yuhang, Lu
IEEE Transactions on Computational Social Systems 2025
解码器以生成的音乐为初始状态进行强化学习,符合乐理规则时给予正反馈,否则给予负反馈,从而将生成过程约束在音乐理论框架内。
每条音轨采用独立Transformer编码器,保留轨内自注意力,并引入轨间互注意力机制;这些特征经拼接后输入解码器,促进多轨有效协作。
在公开LMD数据集和自建MUT数据集上进行了全面的仿真验证,大量实验结果证实了所提方法的有效性。