参考视频,是最大的单一变量
大多数 AI 视频克隆的失败,不是模型的问题,而是参考视频的问题。给模型一段杂乱的素材,得到的也会是杂乱的视频;给一段构图干净、运镜自然的素材,生成结果会自然继承这些特质。
本文讲清楚:怎么挑参考视频,才能让你的克隆有更高的"可以直接发"概率。
1. 先想清楚最终要发什么
在刷 TikTok 找灵感之前,先把成品的样子定下来:
- 发在哪里?TikTok、Reels、Shorts,还是 YouTube 主信息流?每个平台都有自己主流的画幅。
- 钩子是什么?近景反应、大全景、产品旋转?
- 时长多少?大多数病毒视频在 15 秒以内就讲完一件事。
想清楚这些之后,你就不是在"找好看的视频",而是在找能解决某个具体构图与运动问题的素材。
2. 选择运镜稳定的素材
模型从运动中学到的东西比从某一帧中学到的更多。挑那种相机稳定、主体动作自然、抖动较少的参考。如果一定要在"有点糊但很稳"和"很清晰但抖得厉害"之间选,选稳的那个。
3. 主体与场景尽量贴近目标
参考越接近你最终想生成的内容,模型需要"脑补"的就越少。把海边日落的灯光克隆到城市街道,结果会显得诡异;克隆到另一段海边日落的素材上,效果就很自然。
4. 避免带水印或文字的素材
参考里的水印、字幕、Logo 经常会"复活"到生成结果里。用作参考之前先去掉,或者直接挑干净的版本。
5. 用前三秒做一次烟雾测试
如果参考视频自己在前三秒没有钩住你,那克隆出来的版本大概率也不会有。参考的开头决定了生成视频的节奏,按这个标准去选。
把上面这些拼起来
一段好的参考视频要满足:短、稳、主题一致、干净。它本身就应该已经是你愿意发布的样子。提示词、风格设置、反向提示词,都是在这个基础上的微调。
当你找到一段同时满足以上五点的素材时,记得存下来。慢慢积累一个你信任的"参考库",后续每次生成的起点都会更高。