video-storyboard-pro

全类型视频分镜生成指引。基于17本经典电影/动画分镜专著整合,覆盖短视频/营销视频/长视频。从内容到分镜、从叙事到镜头语言、从角色设计到图像生成参数,一站式输出。当用户需要将文案/脚本转化为视频分镜时加载。

仙踪问道

@liveljack

Install

$ openclaw skills install @liveljack/video-storyboard-pro

视频分镜生成专业指引 (Video Storyboard Pro)

加载时机

  • 用户提供文案/文章/脚本,要求生成视频分镜
  • 用户要求"把这个做成视频""转化为视频脚本""设计分镜"
  • 用户提到分镜、镜头设计、storyboard相关术语
  • 作为视频生成流水线的第一步(内容 → 分镜 → 图片 → 视频)

核心定位

本skill不是简单的"写个分镜表",而是从叙事策略→镜头语言→角色资产→图像生成的完整生产管道。它整合了17本经典专著的精华:

来源核心贡献
Steven D. Katz(电影镜头设计+分镜概论)四层递进框架、180度规则、30度规则、空间三角系统
Jeremy Vineyard(电影镜头入门)150+镜头类型辞典、场景镜头套餐
Christopher Kenworthy(大师镜头1-3)300个高级实战技巧(打斗/对话/悬疑/调度)
Marcie Begleiter(从文字到影像)3A框架、平面图+分镜联合设计
Francis Glebas(故事编导)认知地图、情绪弧线、"为什么驱动什么"
Nancy Beiman(准备分镜图)动画表演原则、剪影法、角色设定
Mark Simon(故事板:运动的艺术)六维运动系统、分镜格规范、媒体差异
John Hart(故事板的艺术)构图/透视/光影实战技法
Matt Madden(99种讲法)视角×叙事结构×风格=无限创意组合
Giuseppe Cristiano(分镜头脚本设计教程)标准分镜表、八大创作原则
李杰/姚桂萍/靳晶(国内教材)蒙太奇、顺畅连接、国产动画流程

第一步:内容分析与类型判定

1.1 输入内容三层次分析(Begleiter框架)

拿到任何内容后,先做三层分解:

层次分析对象提取内容转化为
场景描述层环境/时间/天气/氛围地点、时段、色调关键词光影方案+色彩基调
角色动作层角色做什么/怎么动/情绪变化动词、情绪词、转折点动作序列+关键帧
对话/对白层角色说什么/画外音/字幕核心台词、信息密度表演设计+表情库

1.2 情绪关键词提取

从内容中提取"一句话情绪核心"——Katz强调:每个场景只有一个情绪核心,所有镜头围绕它展开。

输入内容 → 情绪关键词 → 视觉化方案
"深夜加班,孤独感" → 孤独+压抑 → 大背景小人物、侧光半脸阴影、冷色调
"新产品发布,激动人心" → 兴奋+期待 → 快速剪辑、推镜揭示、暖金+科技蓝配色

1.3 视频类型自动判定

根据内容特征和用户要求,判定视频类型(决定后续采用哪套Reference):

判定条件类型加载Reference
60秒以内、单一场景、强钩子开头短视频reference/short-video.md
含品牌/产品露出、行动号召CTA、转化目标营销视频reference/marketing-video.md
3分钟以上、多场景、完整叙事弧线长视频reference/long-video.md
不确定时默认短视频reference/short-video.md

1.4 叙事策略选择(Madden框架)

确定类型后,基于Matt Madden的"99种讲法"选择叙事策略(至少从5个维度中各选1个):

维度可选策略
视角主观POV / 客观观察 / 上帝全知 / 多视角交叉
时间结构顺序 / 倒叙(先结果)/ 回文对称 / 碎片拼贴 / 循环
分段密度1-4镜(慢叙事)/ 6-12镜(标准)/ 15-30镜(快节奏)
视觉风格暗黑科技风 / 温暖纪实风 / 赛博朋克 / 极简白 / 动画风格 / 复古胶片
形式实验左右分屏对比 / 画中画 / 纯画面无文字 / 信息图风格 / 第一人称Vlog

第二步:故事架构设计

2.1 三幕情绪弧线(Glebas框架)

无论视频长短,都必须有一条清晰的情绪弧线:

情绪强度
  ↑         ┌── 高潮/转折
  │        ╱  ╲
  │       ╱    ╲
  │      ╱      ╲___ 释放/回落
  │     ╱             ╲___
  │    ╱                   ╲__ 记忆锚点
  │   ╱
  │──┴──────────────────────────→ 时间
    建置    冲突发展    解决

三幕与镜头节奏的对应关系:

分镜重点推荐景别递进推荐时长/镜情绪基调
第一幕(建置/钩子)广角环境+角色引入VLS→WS→MS3-5s好奇/吸引
第二幕(冲突/展开)密集正反打+特写MS→CU→XCU交替2-5s紧张/对抗/期待
第三幕(解决/金句)全景+情感释放CU→MS→WS5-10s共鸣/回味

2.2 故事五要素(强制覆盖)

每个视频分镜必须包含以下故事要素(缺一不可):

要素定义实现手段禁忌
钩子(Hook)开篇3-5s强冲击灵魂拷问、惊人数据、反常识命题不能放Logo、不能说"大家好"
悬念(Suspense)制造"然后呢?"的期待信息延迟揭示、动作未完成切镜、窥视构图不能一次性给完所有信息
冲突(Conflict)让观众感同身受的困境对比蒙太奇、角色VS环境、理想VS现实不能是无关痛痒的小麻烦
转折(Turn)情绪或认知的翻转期待→反转、低谷→希望、问题→方案不能预测得到
记忆锚点(Anchor)一句可独立传播的金句结尾大字+停顿+收声不能是空洞鸡汤

2.3 "为什么驱动什么"原则(Glebas核心法则)

观众首先需要知道"为什么"(动机),才能关心"什么"(结果)。

分镜设计时,每个动作序列前必须有1-2个镜头展示动机:

  • 错误:直接展示产品功能 → 观众无感
  • 正确:先展示用户痛点场景 → 用户感同身受 → 再展示产品解决方案

第三步:分镜脚本表(标准输出格式)

3.1 必含字段(基于Cristiano + Simon + 靳晶整合)

每个镜头必须输出以下完整信息:

镜号: [唯一编号,如 SC-01]
景别: [ELS/VLS/WS/LS/MLS/MS/MCU/CU/XCU]
角度: [平视/仰视/俯视/鸟瞰/倾斜/主观POV/过肩OTS]
运镜: [固定/推/拉/摇/移/跟/升降/手持/变焦/复合]
时长: [X秒,精确到0.5s]
画面内容: [角色位置+动作状态+场景环境+构图要点]
对白/旁白: [角色台词或画外音内容]
音效: [环境音/特效音/音乐节点]
转场: [切/淡入淡出/化/划/匹配剪辑]

3.2 分镜标准表格模板

镜号景别角度运镜时长画面内容对白/旁白音效转场
SC-01VLS平视固定3s.........

3.3 分镜节奏黄金法则

场景类型每镜时长说明
建置镜头3-5s让观众有足够时间理解空间
动作/追逐1-3s快速切换制造紧张感
对话3-8s留出对白时间+反应镜头
情绪/沉思5-15s给观众共情的时间
关键信息2-4s数据/文字需要停留阅读时间

第四步:镜头语言速查(Vineyard + Katz + Kenworthy整合)

4.1 景别选择决策树

需要展示环境全貌? → VLS/WS
需要展示角色全身动作? → LS/MLS
需要展示角色表情+手势? → MS
需要聚焦角色情绪反应? → CU
需要极致情绪冲击? → XCU
需要建立两个角色关系? → 2-Shot MS → OTS交替

4.2 角度选择对照

角度心理效果使用时机
平视中性、平等、客观日常对话、信息传递
低角度(仰拍)强大、威严、压迫权威角色、产品展示、高潮
高角度(俯拍)脆弱、无力、渺小受困角色、失败时刻
鸟瞰(垂直俯)上帝视角、全局审视场景建置、地图说明
倾斜(Dutch)不安、混乱、迷失心理危机、转折前兆
主观POV代入感、沉浸产品体验、发现时刻

4.3 运镜选择对照

运镜叙事效果使用场景
固定客观、稳定信息传递、对话
推(Dolly In)强调、进入内心情绪升级、关键信息
拉(Dolly Out)揭示上下文、疏离场景建置、情感抽离
摇(Pan)揭露空间、跟随视线环境介绍、角色搜寻
移(Track)平行跟随、速度感追逐、漫步、展示
跟(Follow)保持关注角色移动中的关键动作
升降(Boom)视角变换从局部到全局、震撼揭示
手持紧张、真实追逐、冲突、纪录片感
Dolly Zoom眩晕、顿悟角色认知颠覆的瞬间

4.4 对话场景标准方案(Kenworthy Vol.2)

对话类型推荐方案景别节奏特色技巧
合作友好同框+双人中景+平视MS为主开放构图、空间宽敞
对抗冲突OTS交替+推进MS→CU递进距离=关系,越近越紧张
试探谈判远近交替+反射利用WS↔CU跳跃镜中/玻璃反射替代正反打
亲密温情柔焦+慢推+双人全景LS→CU慢变身体语言强调、静默反应

4.5 实战镜头套餐(Vineyard场景套餐 + Kenworthy大师技巧)

场景A:产品展示

建置(WS 3s) → 环境氛围 → 细节1(CU 2s) → 细节2(CU 2s) → 使用场景(MS 3s) → 效果对比(Split Screen 3s) → logo收尾(WS 2s)

场景B:痛点→方案(营销视频核心)

痛点场景(MS 3s) → 表情CU(2s) → 问题放大(XCU 1.5s) → 
方案引入(WS→MS Push-in 3s) → 使用过程(POV 2s) → 
效果展示(CU 2s) → 满足表情(MS 3s) → 品牌logo+CTA(WS 3s)

场景C:悬念揭示

窥视构图(门框/窗框框架 3s) → 角色反应(MS 2s) → 
主观POV(看到什么 2s) → 慢速推近(XCU 2s) → 
揭示结果(WS拉出 3s) → 空镜头留白(3s)

第五步:角色/道具/场景资产设计

5.1 角色描述模板(Beiman剪影法 + 姚桂萍姿态语言)

每个角色需要生成完整的描述档案,用于后续分镜中保持一致性:

角色名称: [名字/代号]
外形特征: 身高、体型、脸型、标志性特征
剪影: [描述角色纯剪影形态——Beiman原则:不看清细节就能识别]
动作风格: 走路姿势、习惯手势、标志性动作
性格标签: 内向/外向、主动/被动、理性/感性
核心姿态: [描述角色的"默认站姿/坐姿",反映性格]
表情库(5态): 喜/怒/哀/惊/平静 的具体描述
服装道具: 核心服装+随身物品
颜色标识: 角色的主题颜色

5.2 道具/关键物品描述

物品名称: [名称]
外观: 形状、大小、材质、颜色
功能: 在视频中的作用
关键状态: 正常态/使用态/损坏态/特写态 分别描述

5.3 场景描述

场景名称: [名称]
空间描述: 室内/室外、大小、布局
时间: 年代、季节、昼夜
色调: 主色调+辅助色+光源方向
氛围: 情绪关键词
关键元素: 场景内的标志性物体/建筑
俯视图(可选): 角色位置+摄影机位置标注

5.4 角色多状态描述(用于五视图生成和分镜一致性)

状态描述维度用途
正面静止角色面向镜头,自然站立角色设定参考图
侧面动作角色侧身,正在做标志性动作动作场景参考
背面远景角色背对镜头,在环境中气氛镜头
情绪极端角色处于情绪最高/最低点情绪镜头参考
使用产品(如适用)角色正在使用/体验产品的姿态营销场景

第六步:图像生成技术规格

6.1 每帧图像生成Prompt构造规则

每帧的分镜描述需要转化为图片模型可执行的Prompt,规则如下:

Prompt组成 = 主体描述 + 构图指令 + 风格参数 + 质量限定

[主体描述]:角色外观+动作+表情+位置
[构图指令]:景别(Grid Rule、三分法位置)、角度、光影方向
[风格参数]:色调、渲染风格、画幅比
[质量限定]:分辨率、细节要求

构造示例:

分镜描述:

SC-05 | CU | 平视 | 推镜 | 角色发现关键信息,瞳孔放大,嘴巴微张

转化为图像Prompt:

"Extreme close-up of a character's face, eyes widening in shock, mouth slightly open, discovery moment. Side lighting from left creating dramatic shadows on half of face. Warm amber tone on the lit side, deep shadows on the dark side. Cinematic lighting, photorealistic, shallow depth of field. 16:9 aspect ratio."

6.2 角色一致性控制策略

跨镜头生成时保持角色一致性的关键方法:

  1. 先出角色设定图(正面、侧面、背面、表情集),作为后续每帧的参考
  2. 在每帧prompt中引用角色核心特征:发型+颜色、面部关键特征、服装描述
  3. 固定角色颜色标识:衣服颜色、头发颜色、肤色保持不变
  4. 使用参考图模式:关键角色图作为base_image_infos传入

6.3 场景色调一致性

同一场景内所有镜头必须保持一致的色调方案。每个场景定义:

  • 主光源方向
  • 色温(暖/冷/中性)
  • 色彩基调(如:冷蓝+琥珀补光=科技感;暖金+深棕=温馨纪实)

第七步:类型专项(按需加载Reference)

根据第一步的类型判定,加载对应的专项Reference文件:

  • 短视频 → reference/short-video.md:钩子设计、节奏控制、竖版适配
  • 营销视频 → reference/marketing-video.md:品牌植入、CTA设计、传播性
  • 长视频 → reference/long-video.md:章节结构、转场设计、节奏变化

第八步:质量自检清单

叙事层面(Glebas + Begleiter)

  • 情绪弧线清晰:有起有伏,不是一条直线
  • "为什么"在"什么"之前:观众先理解动机
  • 五要素覆盖:钩子、悬念、冲突、转折、记忆锚点 各至少1处
  • 信息递进:逐步揭示,不一次性给完

镜头层面(Katz + Cristiano + Vineyard)

  • 建置镜头→聚焦→强调→释放 景别递进逻辑正确
  • 180度规则未违反(除非有明确越轴动机)
  • 相邻镜头角度差≥30度
  • 相邻镜头景别有变化(不连续3个同景别)
  • 视线方向一致(A看右→B看左)
  • 动作匹配:角色动作在上下镜间连续完成(完成度20%-80%跨镜)

节奏层面(Kenworthy + Simon)

  • 镜头时长不全是均匀的(有快有慢)
  • 开篇3-5秒强钩子
  • 整体时长在目标范围±10%内
  • 有≥1处节奏突变(突然加速或突然静止)

一致性层面(Beiman + 姚桂萍)

  • 同一角色在连续镜头中外形/比例一致
  • 场景色调在同一场景内保持一致
  • 如果角色有道具使用,道具状态连续

营销专项(仅营销视频)

  • 品牌/产品自然融入(非硬广),出现1-3处
  • 有明确的行动号召CTA
  • 金句可独立传播(适合截图分享)
  • 观众看完后能说出"这是什么产品/能解决什么问题"

第九步:禁止内容

以下内容绝对不能出现在视频分镜中(无论任何类型):

  • 暴力血腥画面:打斗场景限于动作表现,不展示血腥细节
  • 色情/低俗内容
  • 歧视性内容(种族、性别、地域、宗教)
  • 违法/违规行为示范
  • 虚假/误导性信息
  • 侵犯他人肖像权/知识产权的素材
  • 恐怖/惊悚元素过于强烈的画面(可用于悬疑但不可越界)
  • 引导赌博/非法投注的内容
  • 未经证实的医疗功效宣传

完整输出示例

以下是一个"AI办公工具"营销短视频的完整分镜输出(30秒版):

一、内容分析

  • 情绪核心:职场焦虑→获得解放的轻松
  • 视频类型:营销视频
  • 叙事策略:倒叙(先展示效果)+ 对比 + 主观POV

二、故事架构

  • 钩子:老板点赞周报,但你其实只用了30秒
  • 冲突:手动写周报的重复劳动
  • 转折:AI一键生成的瞬间
  • 记忆锚点:"把时间还给创造,而不是重复"

三、角色资产

角色:职场人小王

  • 剪影:中等身材,戴眼镜,背着双肩包
  • 动作风格:快速走路、习惯性扶眼镜
  • 核心姿态:坐在电脑前微微前倾
  • 表情库:疲惫(眉头微皱+揉太阳穴)→惊喜(眼睛放大+嘴角上扬)→满足(放松微笑)

道具:笔记本电脑

  • 外观:银色轻薄本,屏幕有轻微反光
  • 关键状态:空白文档态/正在生成态/完成态

场景:办公室

  • 色调:白天自然光+暖色台灯
  • 氛围:从压抑→轻松

四、分镜表

镜号景别角度运镜时长画面内容旁白音效
SC-01CU平视固定3s手机屏幕显示"周报已提交,老板点赞👍"。屏幕光映在人物脸上。"你有没有想过——"手机消息提示音
SC-02MS平视闪回切4s同一角色,昨晚11点,趴在桌前对空白文档发愁。暖黄台灯。"上周的你,对着空白周报"时钟滴答声
SC-03CU俯30°3s手指在键盘上方犹豫,光标在空白文档上闪烁"想了半小时打出三个字"键盘敲击→停顿
SC-04POV主观固定2.5s屏幕视角:鼠标移向仙踪问道图标,点击打开"然后你试了这个"鼠标点击声
SC-05MS平视推镜2.5s角色看着屏幕,表情从困惑→惊讶→微笑"只用了30秒"轻快的"叮"
SC-06CU平视固定4s屏幕显示自动生成的完整周报,数据清晰,排版美观"AI帮你梳理了整周的工作"键盘自动打字声效
SC-07MS平视慢拉出3s角色靠在椅背上,双手枕在脑后,轻松微笑。窗外晨光"把时间还给创造"轻柔的钢琴单音
SC-08WS平视固定3s俯拍办公桌全景,笔记本屏幕显示"仙踪问道",右下角logo+二维码"让AI替你打工。仙踪问道。"品牌音效

总时长:25秒

五、每帧图像生成Prompt示例

SC-01:

"Close-up of smartphone screen showing 'weekly report submitted, boss liked it 👍', screen light reflecting on a young professional's face in dark room, warm phone glow. Cinematic, photorealistic, shallow depth of field. 9:16 vertical."

SC-07 (情绪帧):

"Medium shot of relaxed office worker leaning back in chair, hands behind head, gentle smile, morning sunlight streaming through window, warm golden light. Tech office background with laptop. Cinematic lighting, photorealistic. 9:16 vertical."


与现有Skill的关系

  • 本skill定位在 video-script-creation 之后、video-storyboard-generation 之前
  • 完整流水线:video-script-creation(写脚本)→ 本skill(设计分镜+角色+镜头)→ video-storyboard-generation(批量生成分镜图)
  • 也支持直接输入文案,跳过脚本撰写阶段

Top skills in this category