AI视频分镜

AI视频分镜是把剧情、角色设定和镜头语言转化为可执行 storyboard 的工作环节。它介于“文字剧本”和“视频生成/剪辑”之间,负责把角色一致性、场景一致性、镜头顺序、景别、运镜、台词、音效和时长提前结构化,降低后续生视频或代码做视频的不确定性。

简介

在 AI 视频工作流里,直接让模型“生成一段视频”往往会遇到三类问题:人物前后不一致、场景道具漂移、镜头节奏不可控。AI视频分镜的作用,是在进入生视频工具、代码动画工具或剪辑工具之前,先生成一份视觉执行蓝图。它不只是传统影视分镜的 AI 版,也是一种面向模型的中间规格:角色长什么样、服装和道具如何保持、每个镜头该表现什么、镜头之间如何衔接、字幕和台词在哪里出现,都要在分镜阶段被写清楚。

素材 2026-07-06-woshipm-gpt-image-2-prompts-free 中的 GPT Image 2 案例展示了一条典型路径:先为“仙门大师兄”和“古灵精怪小药仙”生成多栏角色设定板,包含全身展示、多角度表情、服装纹理、手部细节、佩剑、玉佩、丹药、小药瓶、发饰等;再基于“真话丹误吸”剧情生成 8 宫格影视导演执行分镜表,表格里包括镜号、景别、画面内容、运镜、台词、时长等中文信息。这样做的意义是把“角色一致性 / 场景一致性 / 风格一致性”前置解决,而不是在视频生成失败后反复补救。

关键信息

  • 类型:AI 视频前期制作方法
  • 目标:把剧本转成可执行镜头计划,降低后续视频生成和剪辑的不确定性
  • 关键字段:镜号、景别、画面内容、角色状态、场景道具、运镜、台词、音效、时长、转场
  • 适用工具GPT Image 2、文本生成模型、AI 视频生成工具、代码做视频工具、剪辑软件
  • 相关概念场景合成提示词Vibe MotionAI创意设计提示词工程

核心特性

1. 角色设定先行

AI视频分镜不应从镜头表直接开始,而应先生成角色设定板。角色设定板要包含全身、半身、表情、服装、道具、发型、材质和气质关键词。对于连续视频,角色设定板相当于“视觉锚点”:后续每一帧、每个镜头都要回到这套设定,避免模型把同一个人物生成成不同脸、不同服装或不同气质。

2. 场景和道具固定

视频分镜需要明确场景母版和关键道具。以素材中的仙侠轻喜剧为例,场景不是泛泛的“炼丹房”,而是“巨型炼丹房、青铜丹炉、暖金色灵火、药材架、卷轴、烟雾、小灵兽”。道具也不是装饰,而是推动剧情的对象:真话丹、丹炉、符纸、佩剑、小药瓶。固定这些元素,才能让后续镜头看起来发生在同一个世界里。

3. 镜头字段结构化

执行分镜表的价值在于把镜头拆成字段,而不是只给一段散文描述。最小可用字段包括:镜号、景别、画面内容、运镜、台词/音效、时长。更完整的版本还可以增加角色出场、情绪目标、画面重点、转场方式、是否需要特效、参考图编号。字段化以后,后续可以把分镜交给不同工具:图片模型生成关键帧,视频模型做镜头运动,剪辑工具按时长拼接,代码动画工具按时间码触发元素。

4. 媒介风格明确

AI视频分镜可以是漫画 storyboard,也可以是影视导演执行分镜表、广告分镜、短剧分镜或口播视频图文卡分镜。素材中特别强调“不是海报拼贴,不是漫画分镜,是专业影视导演执行分镜板”,这是非常关键的负向约束。模型如果误判媒介类型,就会输出漂亮但不可执行的海报,而不是镜头计划。

5. 连接生成与剪辑

分镜不是最终产物,而是连接“生成”和“剪辑”的桥。对于 Vibe Motion 这类代码做视频路线,分镜可转成时间码、图层、动效和转场规则;对于传统 AI 视频路线,分镜可转成逐镜头图生视频提示词;对于人工剪辑路线,分镜可作为素材清单和审片标准。它的评估标准不是“图好不好看”,而是“后续能不能照着做”。

不同素材中的观点

  • 2026-07-06-woshipm-gpt-image-2-prompts-free:本文把 GPT Image 2 用在 AI 视频前期,而不是直接生视频。它先生成仙侠轻喜剧角色设定板,包括男女主的服装、表情、道具和气质;再生成影视执行分镜表,把“女主偷偷炼丹、丹炉失控、炸炉爆炸、男主登场、误吸丹药、弟子围观、男主被迫说真话、全场混乱”拆成 8 宫格镜头。核心观点是:人物一致性、风格一致性和场景一致性可以在分镜前置阶段解决,GPT Image 2 的文字排版能力让“分镜表本身”也可以成为清晰可读的视觉文档。

实用信息

可复用 Prompt 骨架

[项目类型]
影视导演执行分镜表 / 广告 storyboard / 短剧分镜 / 口播视频图文卡分镜。
 
[剧情概述]
用 1 段写清楚场景、人物关系、冲突和结尾。
 
[角色设定引用]
角色 A:外貌、服装、表情、道具、气质。
角色 B:外貌、服装、表情、道具、气质。
 
[分镜字段]
每格必须包含:镜号、景别、画面内容、运镜、台词/音效、时长。
 
[场景道具]
列出所有必须反复出现且不能漂移的场景元素和道具。
 
[风格要求]
真人拍摄感 / 动画分镜 / 科幻 UI / 古风纸张 / 广告提案风。
 
[负面约束]
不是海报拼贴;不是单张 KV;不要遗漏文字字段;不要让角色外貌漂移;不要改变场景主道具。

适用场景

  • AI 短剧、品牌广告、知识类视频、产品功能演示、角色 IP 视频、游戏剧情 PV。
  • 需要多镜头连续叙事,且角色和场景不能漂移的项目。
  • 需要把文字剧情交给多种工具执行的项目,例如图片模型出关键帧、视频模型做运动、剪辑工具拼接、代码工具做字幕和图文层。

常见误区

  1. 跳过角色设定板直接做镜头:容易导致每个镜头人物都不一样。
  2. 只写剧情不写景别和时长:后续剪辑无法控制节奏。
  3. 把分镜当海报:画面漂亮但没有镜号、运镜、台词、时长,不可执行。
  4. 没有负面约束:模型可能输出漫画分镜、海报拼贴或单张宣传图,而不是执行分镜表。
  5. 不固定场景道具:连续镜头中关键物件漂移,削弱叙事连续性。

相关页面