先做故事版,再生成视频,效果真的会稳很多。
我最近在试一个 5 秒短片流程:
先把故事拆成 5 个 1 秒分镜
每个分镜写清楚画面、动作、景别、镜头运动
生成一张完整的 storyboard sheet
再用这张故事版作为参考去生成视频
这样比直接丢一句“生成一段电影感视频”更可控:角色更统一,镜头更明确,节奏也不容易乱。
比如这个设定:
一只迷你机械狐狸,在雨夜未来城市屋顶,发现一颗发光种子。
5 秒里讲完一个小故事:
0:00-0:01 远景建立场景,机械狐狸站在雨夜屋顶
0:01-0:02 中景发现水洼旁的蓝绿色光芒
0:02-0:03 近景靠近发光种子
0:03-0:04 特写触碰种子,能量光波扩散
0:04-0:05 大全景,屋顶长出发光植物
感觉现在做 AI 视频,关键不只是“提示词写得美”,而是先把镜头语言想清楚。
故事版 = 给模型一个导演分镜。
视频生成 = 让模型按分镜执行。
先导演,再生成。
🖼️ 参考图(最多 3 张,选填):
