arXiv 自然语言处理· Shengyu Li, Jinting Wang, Li Liu·· 5 小时前AI 评分35
ARIA:面向粤语歌词创作的音频驱动旋律-声调关系建模框架
ARIA: Audio-Driven Melody-Tone Relation Modeling for Cantonese Lyric Authoring
AI 导读
研究人员提出音频驱动框架 ARIA,可直接基于带字符级时间戳的演唱录音生成符合旋律声调对齐要求的粤语歌词。该框架通过三流关系感知声调估计器 TRATE 预测 0243 声调序列,并结合解耦检索增强生成器 DRA-TCLG 完成歌词生成。团队还构建了大规模对齐的音频-粤拼-0243 数据集支持该任务。
来源:arXiv 自然语言处理 · arxiv.org