你会完成什么
把参考视频拆开,准备人物、场景和道具,再用 Seedance 2.0 一个镜头一个镜头生成,最后剪成完整视频。
| 步骤 | 要做的事 | 最后得到 |
|---|---|---|
| 1 | 准备参考视频 | 清晰原片 |
| 2 | 让 GPT 或豆包分析 | 完整提示词 |
| 3 | 生成人物、场景、道具 | 参考素材包 |
| 4 | 逐镜生成并剪辑 | 最终成片 |
适合第一次做 AI 视频复刻的用户。
开始前:你需要准备这些工具
| 工具 | 用来做什么 |
|---|---|
| GPT 或豆包 | 分析参考视频、整理提示词 |
| 即梦、豆包等图片工具 | 生成人物、场景和道具参考图 |
| Seedance 2.0 | 生成视频镜头 |
| 剪映或 Premiere | 剪辑、配音、字幕和导出 |
准备好的材料
- ✓一条画面和声音都清楚的参考视频
- ✓一个保存人物、场景、道具和生成视频的文件夹
- ✓能正常使用 GPT/豆包、图片生成工具、Seedance 2.0 和剪辑软件
本案例设置
画面比例 1:1,分辨率不低于 720×720,帧率 25fps。生成阶段不要字幕,字幕最后在剪辑软件中添加。
整个流程只记住一件事
不要一次生成完整视频。要先准备素材,再一个镜头一个镜头生成。哪个镜头不对,只修改那个镜头。
第一步:准备参考视频
- 选择画面清楚、声音清楚、没有遮挡的原始视频。
- 不要裁掉画面,也不要先添加字幕或水印。
- 把视频保存好,然后直接上传给 GPT 或豆包。
完成标准
你已经有一份可以正常播放、人物和台词都能看清听清的参考视频。
第二步:让 GPT 或豆包分析视频
上传参考视频后,复制下面这段话发送:
可直接复制 · 视频分析提示词
我想制作一个和参考视频高度一致的视频。 请完整观看视频,并帮我整理以下内容: 1. 视频整体风格、画面比例、色彩和光线; 2. 所有人物的外貌、体型、服装和声音; 3. 影片需要的场景和道具; 4. 按镜头拆分画面,写清楚每个镜头的人物位置、动作、运镜、台词和说话人; 5. 整理一份可以直接用于 AI 视频生成的完整提示词。 多人镜头必须写清谁在左边、谁在右边、谁说话,不能交换人物位置和台词。 最后把全部内容整理成一份完整文档返回给我。
完成标准
你拿到了一份包含人物、场景、道具和每个镜头提示词的文档。
第三步:生成影片需要的参考素材
先不要生成视频。先把人物、场景和道具做出来,后面每个镜头都使用这些固定参考图。
| 顺序 | 要生成的内容 |
|---|---|
| 1 | 老人、主外星人、陪同外星人的三视图 |
| 2 | 荒地、老院子、旧屋等主要场景 |
| 3 | 飞船、检测仪、协议等重要道具 |
| 4 | 多人镜头的人物站位参考图 |
可直接复制 · 素材生成提示词
请结合上一步的提示词和参考视频,帮我生成影片需要的全部参考素材。 先生成: 1. 老人、主外星人、陪同外星人的正面、侧面、背面三视图; 2. 每个主要场景的无人空镜; 3. 飞船、检测仪、招聘协议等关键道具单图; 4. 多人镜头的站位参考图。 每生成一张,都要和参考视频对比。重点检查人物外貌、服装、左右位置、场景和道具是否一致。 如果不一致,请直接修改提示词后重新生成。 主外星人和陪同外星人必须分别使用不同参考图,不能混用。
完成标准
三个人物能一眼分清,主要场景和道具已经准备好,并分别保存。
第四步:在 Seedance 2.0 中逐镜生成
打开 Seedance 2.0,每次只生成一个镜头。
| 小步骤 | 怎么做 |
|---|---|
| 1 | 上传这个镜头需要的人物、场景和道具参考图 |
| 2 | 复制这个镜头的提示词 |
| 3 | 设置 1:1、720×720 以上、25fps |
| 4 | 生成后与原片对比,不对就只重做这个镜头 |
可直接复制 · 单镜头提示词模板
镜头___,时长___秒。 人物:___位于画面左侧;___位于画面右侧。 动作:本镜头只有一个主要动作——___。 场景:___。 画面风格:中国北方乡土纪实电影,低饱和复古科幻,真实自然,表演克制。 台词:只有___张嘴说:“___”。其他人物闭嘴。 必须保持参考图中的人物外貌、服装、位置和道具。 禁止人物换脸、交换左右、说错台词、多人同时张嘴、道具变形、字幕、水印。
生成时不要这样写
- 不要在一个镜头里写很多连续动作。
- 不要只写“两个外星人”,必须写“主外星人”和“陪同外星人”。
- 不要让模型自由生成字幕,字幕最后再加。
完成标准
所有镜头都已生成,人物没有换脸,位置和台词没有弄反。
最容易出错:两个高频翻车点
问题一:老人口音和音色不对
只写“北方农村口音”很容易变成夸张搞笑配音。正确方法是使用已经获得授权的老人参考音频,并始终使用同一个声音设置。
可直接复制 · 老人声音提示词
七十多岁中国北方农村老人,声音苍老、偏薄、气息略弱,语速稍慢,停顿自然。 只保留轻微、朴实的北方农村口音,不夸张,不表演方言,不添加喜剧腔。 始终使用同一份已获授权的参考音频和同一个声音设置。 禁止年轻男声、播音腔、机器人声音和金属混响。
问题二:两个外星人容易弄反
| 角色 | 最明显的区别 |
|---|---|
| 主外星人 | 更高瘦,头部更细长光滑,主要负责和老人说话 |
| 陪同外星人 | 肩膀更宽,脸部褶皱更多,主要负责拿检测设备 |
第二场必须这样安排
陪同外星人在左侧拿检测仪;主外星人在中央或右前方与老人说话;老人位于右侧。谁说台词,就明确写“只有谁张嘴”,其他人闭嘴。
- ✓两名外星人分别使用不同的三视图
- ✓每个镜头都重新写明谁在左边、谁在右边
- ✓每句台词都写清说话人,其他人物闭嘴
最后一步:剪辑、配音并检查成片
- 把生成的镜头按原片顺序放进剪辑软件。
- 加入人物配音,检查说话人与嘴型是否正确。
- 加入环境声、音效和字幕。
- 统一画面颜色和音量,最后按 1:1、25fps 导出。
导出前只检查这 6 项
- ✓老人、主外星人、陪同外星人全片没有换脸
- ✓两个外星人没有交换位置、设备和台词
- ✓老人声音没有变年轻,也没有夸张搞笑口音
- ✓飞船、检测仪和其他重要道具没有变形
- ✓字幕没有错字,画面没有水印和多余文字
- ✓镜头顺序、声音和画面可以完整播放
哪里不对改哪里
发现问题时,只重新生成出错的镜头,不需要从头再做整条视频。
准备视频 → AI 分析 → 生成素材 → 逐镜生成 → 剪辑检查。照着这条流程操作,就能完成第一支 AI 视频复刻。配套的分镜表、整段提示词和全部参考素材,可以在复刻项目页下载素材包直接取用。