梦里的哼哼也能变成一首完整歌?!AI力全面爆发,1天搞定中日双语MV!
AI作曲 Suno 阅读时间 8 分钟

梦里的哼哼也能变成一首完整歌?!AI力全面爆发,1天搞定中日双语MV!

本文公开了作者如何以梦中随口哼唱的零散旋律(鼻歌)为起点,通过将各种AI工具(Suno、Gemini、豆包、Codex等)发挥到极致,在短短一天内将其升华转化为高质量中日双语原创单曲、以及横竖屏两个版本MV(音乐视频)的完整幕后全过程。 文章干货满满,凝聚了从新手到创作者都能立即复刻的实用技巧。其中重点分享了用于解决AI作曲工具(Suno)常见“后半段旋律跑偏暴走问题”的“空指令(伴奏先行)生成策略”、基于Python(Codex)的MV自动化生成脚本,以及利用零代码自制的LRC歌词制作工具等。

前言

恰逢周末,暂且抛开枯燥的技术干货,换个轻松有趣的分享主题:从零靠AI把梦里随口哼的旋律,做成中日双语原创歌曲+配套MV,完整落地流程全公开。

成品展示

中文版歌曲MV:
日文版歌曲MV:

创作缘起

某天夜里入睡做梦,迷迷糊糊脑海里凭空浮现一段独特旋律,说不清是过往听过的老歌碎片,还是沉睡时大脑即兴创作。做梦说梦话很常见,但睡着下意识哼调子,半夜自己都被奇怪哼唱吓醒。

当即翻身起床,打开录音设备,随手录下梦中原版哼唱(音质粗糙,慎听):

本着想到就落地的行动派习惯,索性借着这段灵感,花一整天,依靠各类AI工具把零散哼唱打磨成完整原创单曲,顺便踩遍弯路后整理出一套零门槛复刻教程。

Step1 规整原始旋律音频

我从四岁开始练习钢琴,长达十年的功底,扒谱对我而言不算难事。拿出便携电子琴,对照原录音修正音准、梳理完整主旋律,重新录制干净版旋律:

没有乐理基础、不会扒谱也无需焦虑,找安静环境重新录制一版清晰哼唱音频,即可进入下一步。

Step2 AI分语种定制歌词

先后实测Gemini、ChatGPT、Grok、DeepSeek、通义千问、豆包多款大模型,实测得出最优选择:

  • 中文歌词创作首选:豆包
  • 日文歌词创作首选:Gemini Flash3.5新版

Step3 避坑关键:空指令先行生成纯伴奏

绝大多数新手误区:直接上传哼唱音频+完整歌词+曲风标签丢进Suno生成歌曲。最终成品通病:只有开头小段贴合原创旋律,后半段AI自主乱改编曲、曲调完全跑偏。

多次试错总结解决方案:清空正文歌词,仅保留括号内曲风、段落标注指令,先用空白歌词配置生成完整伴奏,牢牢锁住原创主旋律。

image
生成的原曲如下:

Step4 填入歌词二次生成成品曲目

以固定伴奏为基底,回填完整中日双语歌词反复生成,也就是圈内常说的“抽卡调试”。逐版试听,修正拗口词句、调整断句排版,多次生成迭代直到词曲契合度达标。

image

Step5 借助Codex一键自动化生成横竖版MV

无需PR、AE等专业剪辑软件,依托Codex编写Python工程,搭建通用MV生成脚本,下方是完整定制:

制作带滚动字幕与音频动效的音乐MV,依托GPT Image2根据歌词内容动态生成背景画面;
画面主体设定:40岁气质深邃的亚裔中年男士,身着合身西装、暗藏利落肌肉线条,以背影出镜,身处日式居酒屋,窗外点缀东京夜景霓虹。
画面兼顾16:9横屏、9:16竖屏双规格构图,人物主体居中排布,歌词字幕适配双画幅不溢出画面;
增加音画联动特效:画面随音乐波形律动跳动,画面悬浮可视化动态声波;
程序做成可复用工程,启动时通过传参传入:音频文件路径、纯文本歌词路径、背景图源路径;程序自动解析音频频谱、载入素材,最终一次性输出横版、竖版两份成品视频。

彩蛋|自制LRC歌词快捷工具

手动做LRC歌词繁琐?附上我用Trae、VibeCoding零代码开发的开源工具仓库: https://github.com/perfact-tang/mp3lrctools 项目内置网页版LRC歌词制作器,下载源码后本地双击index.html就能离线运行,不用部署环境,快速制作标准歌词文件,搭配上面的MV生成程序直接使用,感兴趣可以下载体验。

image

VIBECODING

把 AI 与开发现场的知识,整理成易读的文章传递给你。

© 2026 VibeCoding Japan, Inc. All Rights Reserved.