跳到正文
原文
arXiv cs.CL· Shengyu Li, Jinting Wang, Li Liu·· 4 小时前AI 评分30

ARIA:面向粤语歌词创作的音频驱动旋律-声调关系建模

ARIA: Audio-Driven Melody-Tone Relation Modeling for Cantonese Lyric Authoring

AI 导读

ARIA 提出两阶段音频驱动框架,可从带字级时间戳的演唱录音生成粤语歌词。TRATE 模块预测 0243 序列,DRA-TCLG 以预测声调加检索增强生成歌词,并构建大规模 audio-Jyutping-0243 数据集。该框架在 0243 预测与声调一致歌词生成上表现良好,已被 EMNLP 2026 Findings 接收。

来源:arXiv cs.CL · arxiv.org