更新于 2026年10月10日
本页更新
- — 页面上线
简短回答
这个 AI 音乐视频生成器把音乐视频的两半都包了:歌和画面。每人上传一张照片(或一张你们俩的合照),写一句歌要唱什么,AI 就会写出原创说唱歌词、做好伴奏、用两个 AI 声音唱出来,再让你们的脸对着口型表演。一支 12 秒、720p 的标准视频大约 3 分钟做好,花 10 积分;$9.99 的单次套餐够做一支。不能上传你自己的音轨,生成失败一律不扣积分。
一个连音乐也一起写的音乐视频生成器
大多数叫“AI 音乐视频生成器”的工具,都默认你手里已经有歌。你上传一个 MP3,它在上面铺一层动态画面:抽象图形、类似素材库的场景,或者歌词视频。如果你是有成品歌的音乐人,这很好用;但如果你想要的是你和好朋友表演一首还不存在的歌,它就帮不上忙了。
这个工具从另一头开始。你只需要提供人,也就是照片,其余的它全包:一首为你们写的原创歌、伴奏、人声,还有你们俩站在舞台上的表演视频。人声和脸是在同一次生成里做出来的,所以嘴型能跟上歌词。
两张照片进去,一支音乐视频出来
上面的工作台有三种放照片的方式:
- 两张照片。 每张一个人。不用在同一个地方拍,朋友在外地也可以。
- 一张合照。 一张你们俩同框、脸都看得清的照片。
- 单人。 只放一张你自己的照片,整首歌由你一个人唱。
最后拿到的是一个以这首歌为音轨的 MP4,可以直接发。不用摄像机,不用麦克风,也不用剪辑软件。
怎么做一支 AI 音乐视频
- 添加照片。 选“两张照片”“一张合照”或“单人”,然后上传。正脸、光线好的照片效果最好。
- 选舞台。 Hotel Lobby(橙色)、豪华酒店大堂或录音室。
- 写一句歌的主题。 一句话,最多 120 个字符,或者点一个快捷标签:生日、纪念日、好朋友、我的小店。留空的话会得到一首通用的炸场歌。
- 确认时长和画幅。 默认 12 秒、720p、竖屏 9:16。点“修改模型、分辨率、时长或画幅”可以调整,按钮上的积分价格会跟着变。
- 点“生成我们的说唱视频”。 大约 3 分钟后,做好的音乐视频就能下载了。
你会得到什么
- 一首原创歌。 歌词围绕你写的名字和细节来写,不是素材库音乐,也不用任何真实歌曲的歌词。
- 专门做的伴奏。 在同一次生成里为这首歌制作。
- 两个不同的声音。 双人组合听起来就是两个人在对唱,而不是一个声音唱两遍。
- 对得上的口型。 照片里的你们在表演这首歌,嘴型和人声同步。
- 你需要的画幅。 竖屏 9:16 适合 TikTok、Reels 和 Shorts,方形 1:1 适合信息流,横屏 16:9 也行;分辨率从 480p 到 1080p,视模型而定。
歌词用的是你主题那句话的语言。用中文写主题,唱出来就是中文说唱。
AI 音乐视频生成器和“音频转视频”工具的区别
搜“AI 音乐视频生成器”会搜出好几类完全不同的工具。该选哪一类,取决于你手里已经有什么:
| 这个生成器 | 音频转视频工具 | 换脸模板 | |
|---|---|---|---|
| 你从什么开始 | 照片和一句话 | 一首你已经录好的歌 | 一段热门视频和一张照片 |
| 歌从哪来 | AI 专门为你写、为你唱 | 你自己上传 | 原视频的音频 |
| 画面里是谁 | 你照片里的人,在表演 | 生成的场景、图形或歌词 | 别人的身体,换上你的脸 |
| 对口型 | 有,和人声一起生成 | 通常没有,画面跟着节拍走 | 跟着原表演者的嘴型 |
| 最适合 | 和朋友的趣味视频、礼物、宣传片 | 需要给新歌配画面的音乐人 | 照搬某一条爆款视频 |
如果你已经有成品歌、只缺画面,音频转视频工具才是对的选择,因为这个生成器不能导入你的音频。如果你想要的就是那段有名的橙色录音棚视频,Hotel Lobby AI 视频页面有“原版复刻”模式,用的是原曲(14 秒,720p 下 12 积分)。
让 AI 音乐视频更好看的小技巧
- 露出整张脸。 不戴墨镜、口罩,也别加重滤镜;表演是根据照片里能看到的东西做出来的。
- 两张照片尽量一致。 构图和光线相近,两个人看起来才像站在同一个舞台上。
- 主题写具体。 “小美 30 岁生日,还有那次帐篷被风吹跑的露营”比单写“生日”能让歌词有料得多。
- 一首歌只讲一件事。 12 秒是一段主歌,不是一张专辑。挑一个梗或一个瞬间就够了。
- 发手机平台就用竖屏。 TikTok、Reels 和 Shorts 保持 9:16;只有要放 YouTube 或电视上时才选 16:9。
给你的小店做一支音乐视频
最实用的一种用法,是让店主自己出镜拍一支短宣传片。点“我的小店”标签,写一句你卖什么(“Rosa 和 Tom 的面包店,每天早上 7 点酸面包出炉”),每位店主各放一张照片,就能得到一支你们俩出演的说唱广告。解锁后的视频可按服务条款用于商业用途。小店 AI 宣传视频页面有完整步骤,还讲了该写什么、选什么画幅。
需要了解的
- 只用对方同意的照片。 你自己、朋友、家人都可以。不要用明星或陌生人。
- 不克隆声音。 两个声音都是 AI 生成的,不模仿任何歌手;歌词也从不照搬真实歌曲。
- 时长。 默认 12 秒,最长 15 秒,顶配模型可到 30 秒。越长、越清晰,积分越多。
- 不用装 App。 在手机或电脑浏览器里就能用。
想先从歌词入手?AI 说唱生成器页面讲的是怎么写说唱。要送给特定场合,可以看看生日说唱歌,或者用唱的而不是说唱的定制情歌。套餐和订阅见价格页面。