发布于 2026-07-26 · 更新于 2026-07-30 · 13 分钟阅读
01 / 实用笔记
先明确作品要表达什么
先用一句话说明人物或主体、发生的地点,以及歌曲结束前应该出现的情绪变化。这个创意简报比堆砌风格词更有用,因为它让每个镜头都有可判断的目的。
Music2Video 会把音频范围、你的歌词和视觉方向转为可编辑的场景计划;它不会凭空替你决定故事、人物或版权许可。
02 / 实用笔记
按音乐结构安排镜头
标记前奏、主歌、副歌、间奏和结尾,再为每个变化安排一个镜头目的。安静段落可以保留更长的画面;能量上升时再提高剪辑密度或运动幅度。
先裁剪正在制作的范围。每个项目最多使用 180 秒裁剪后音频,原始歌曲始终是最终合成时的时间基准。
03 / 实用笔记
先锁定关键帧,再生成运动
关键帧负责人物、服装、光线、构图和留白;视频提示词只描述主体动作、镜头运动和镜头结束时的画面。把两类信息混在一起,通常会降低可控性。
先比较开场、副歌和结尾的少量关键帧,再扩大生成。这样可以在视频生成前修正身份或风格漂移。
04 / 实用笔记
保留可编辑的制作决策
分镜的标题、时间、歌词、提示词、顺序和启用状态都可以在生成前修改。对于歌词视频,LRC 时间戳会保留;普通歌词需要在场景中校对阅读时长。
单个场景应服务于一个明确的音乐或叙事节拍。不要用大量互不相关的短镜头代替节奏设计。
05 / 实用笔记
根据需要选择模型和口型同步
图片模型用于建立一致的视觉参考,视频模型用于生成镜头运动。口型同步只能使用兼容的 Seedance 模型,并且每个演唱场景不超过 15 秒。
Grok Imagine Video 不支持口型同步。无论是否使用口型同步,最终视频都会重新使用你裁剪后的原始歌曲。
06 / 实用笔记
导出前按歌曲检查成片
逐一检查切点、歌词可读性、画幅、首尾帧和音频时长。不要用转场掩盖没有对齐的节拍;先让硬切版本与音乐成立。
提交前还应确认你拥有音乐、歌词、人物肖像和参考材料的使用权。上传的原始素材保持私密。
常见问题
开始前需要准备什么?
准备可使用的歌曲、清晰的视觉方向,以及在需要歌词或口型同步时使用的歌词和人物参考。分镜中的每项决定都可以在生成前编辑。
如何避免重新制作整个视频?
先用少量关键帧验证人物、光线和构图,再逐个审核场景。发现问题时修改或重试单个镜头,而不是批量重做。
在 Studio 中建立分镜
上传歌曲、裁剪工作区间、确定视觉系统,并在生成前检查每个镜头。
创建音乐视频