我们正在开发 py-roller:自动生成滚动歌词时间轴的命令行工具
我们正在开发一个新的歌词工具:py-roller。它将滤波、降噪、去混响等传统音频处理算法与人声分离、强制对齐、TTS 等声学人工智能算法串联起来,实现滚动歌词制作过程自动化。
为什么要做自动打轴
网易云音乐等平台允许用户为数据库中缺失滚动歌词的歌曲上传歌词,并给予积分等奖励。同时滚动歌词也有在卡拉 OK、视频字幕等场景下的应用,然而手工打轴很消耗耐心。尤其是歌曲数量一多,这个过程中相当一部分是重复劳动。
即使存在 akari/lrc-maker 这样的项目将滚动歌词制作变得简单,但是它仍然大量依赖手工劳动。很多电子乐歌曲的歌词存在大量重复,制作这些歌词就变得很折磨。
处理流水线
py-roller 会把任务拆成几步:
- 分离或准备音频;
- 过滤不需要的部分;
- 转写音频;
- 解析歌词;
- 对齐歌词和转写结果;
- 写出 LRC 或 ASS。
这样拆开之后,每个阶段都可以替换。转写模型可以换,对齐策略可以换,输出格式也可以换。
第一阶段,滚动歌词对齐的功能会被做成 Python 命令行工具,也就是现在的 py-roller。它比较适合作为后续若存在的用户友好应用程序的引擎。
待软件进入比较成熟的阶段后,我们将公开其 GitHub 仓库,欢迎所有人加入测试或开发!
本博客所有文章除特别声明外,均采用 CC BY-SA 4.0 许可协议。转载请注明来源 簡諧點源!






