---
name: 3d-animation-short-generator
description: |
  将一句故事创意转化为完整的风格化3D动画短片制作流程，依次完成项目简报、故事大纲、角色卡、无人物场景卡、标准镜头表、文本分镜或可选铅笔分镜、视频模型选择、单镜头生成、全片拼接、BGM匹配与最终复查。适用于需要角色一致、场景连续、节奏明确和音画配合的剧情动画短片、纪念短片、品牌故事与社交媒体内容。不适用于单张图片、简单修图、真人写实视频或单一独立镜头。
---

# 3D动画短片生成器

当用户想把一句话创意做成完整的故事优先动画短片流程时使用本 Skill。流程从创意开发到最终剪辑，所有主要产物都必须按生产顺序放到画布上，并在高成本或关键创意节点用选项卡让用户确认。

核心规则：**先故事、再资产；用户输入内容后立刻用选项卡确认画面尺寸/比例与总时长；产物按顺序上画布；所有需要用户确认的地方必须用选项卡；角色/场景卡后固定顺序为：六列标准镜头信息表（每秒指令+音频+空间锚点链+hook）→ 镜头表自检门 → 一份单一文本分镜文档（每镜一节，对齐半解说短剧分镜字段；用户主动开启可视化模式时再加铅笔图；用户标记需要重点迭代的镜时抽取成独立节点）→ 视频模型选项卡（H3 默认，Seedance 2.0 回退）+ 分辨率选项卡 → 用选定视频模型生成单镜头片段 → 全片拼接与 BGM 合成；最终视频必须清除所有分镜痕迹**。

## 全局视觉风格锁

除非用户明确指定其他视觉风格，所有角色卡、场景卡、镜头表格、文本分镜、可选铅笔分镜、单镜头视频片段（无论使用哪个视频模型）、拼接正片和最终合成都必须使用以下视觉风格：

- 渲染风格：皮克斯感 3D 卡通渲染，C4D + Octane 渲染器质感，高级动画电影质量。
- 角色造型：夸张几何概括与极佳材质质感的平衡。不追求 100% 真人解剖结构，而是使用高概括度几何形体、强剪影和高辨识度设计。
- 比例语言：亲和的风格化比例，适合可爱或幼态角色时采用 2.5–3 头身 Q 版比例，大头小身、体块清晰、轮廓易读。
- 发丝 / 毛发：整体造型有清晰块面结构，同时边缘保留精细发丝或绒毛细节；在光照下既硬朗有形，又有细腻触感。
- 皮肤 / 材质：使用温润次表面散射（SSS）质感，耳朵、脸颊、鼻尖、指尖可有微红透光效果；避免生硬塑料感。
- 表演风格：夸张灵动的迪士尼 / 皮克斯式角色动画表演，运用挤压与伸展，强化眉毛、眼角、瞳孔、嘴唇、脸颊形变。
- 动态风格：高能量态势、清晰动作线、前倾势能、强预备动作、快速但可读的节奏、弹性身体机制和丰富微表情。
- 情绪尺度：在可爱与爆发力之间取得平衡；强情绪可以有戏剧性面部变形，但必须保留角色魅力。

负向风格约束：不要写实真人摄影、不要扁平二次元、不要塑料玩具皮肤、不要僵硬人体姿势、不要真实解剖僵硬感、不要无生命表情。

## STEP 0：接收需求与画布规划

捕捉：

- 一句话创意或粗略故事
- 目标产物：只要蓝图、只要资产、六列标准镜头信息表、单文本分镜文档（默认）+ 重点迭代镜抽取的独立节点 + 多宫格铅笔分镜（开启可视化模式时）、单镜头视频片段（视频模型在 Step 7 选定）、拼接正片，还是 BGM 合成最终成片
- 用户已说明的预估时长
- 用户已说明的画面尺寸 / 比例
- 视觉基调：默认温暖风格化 3D 动画
- 台词需求：有对白、旁白，还是无台词
- 只有用户明确指定台词语言时才锁定语言；不要默认英文台词

捕捉完用户输入后，在项目简报或任何下一步之前，必须先展示选项卡确认生产规格：

画面尺寸 / 比例选项卡：

- 16:9 横屏（电影短片推荐）
- 9:16 竖屏短视频
- 1:1 方形
- 4:5 社媒竖图
- 自定义尺寸 / 比例

总时长选项卡：

- 30–60 秒（推荐）
- 15–30 秒
- 60–90 秒
- 90–180 秒
- 自定义时长

只有用户同时选择画面尺寸/比例和总时长，或明确给出自定义值后，才进入下一步。把已确认的画面尺寸/比例和总时长写入项目简报，并贯穿用于镜头时长、转场连贯性、六列标准镜头信息表、单镜头分镜（默认文本，开可视化模式时含铅笔图）、单镜头视频片段、全片拼接、BGM 匹配和最终合成设置。

按以下顺序创建或更新画布产物：

1. 项目简报文本节点
2. 故事大纲文本节点
3. 带标注的角色卡图片节点
4. 无人物的场景卡图片节点
5. 六列标准镜头信息表节点，每行必须在 `镜头描述` 内含每秒指令
6. **单文本分镜文档** — 一个画布文本节点，命名 `<title> text storyboards`，每镜一节（对齐半解说短剧分镜结构）。用户标记需要重点迭代的镜时，把该节抽取成独立节点，原位置留占位。可视化模式下的铅笔分镜图是独立图片节点。
7. 单镜头视频片段节点（用 Step 7 选定的视频模型渲染 — H3 默认，Seedance 2.0 回退）
8. 拼接主视频节点
9. 匹配的 BGM 音频节点与最终 BGM 合成视频节点

不要把长篇生产内容只丢在对话里。耐用产物必须以文本、图片、视频或音频节点形式落到画布。

## STEP 1：项目简报

写一份精炼的项目简报到画布文本节点，命名为项目名或 `项目简报`。

包含：

- 工作标题
- 一句话 What-if
- 情绪前提
- 目标观众感受
- 主要交付物计划
- 已确认的画面尺寸 / 比例
- 已确认的总时长
- 台词模式与语言：仅当用户明确要求才锁定具体语言；否则写 `language not specified`，保持最小化对白或后续再确认
- 初始风险
- 台词意图（如有）

然后展示用户选项卡：

- 沿用此方向继续（推荐）
- 重新生成前提选项
- 修订情绪前提
- 调整台词方向

只有用户选择或明确说继续后才进入下一步。

## STEP 2：故事大纲与守门

创建故事大纲并写入画布文本节点，命名为 `故事大纲` 或 `story-outline`。

包含：

- 主角 Want / Need / 缺陷
- 核心世界规则
- 8 拍因果故事骨架
- 情绪锚点与回收
- 台词节拍（用户要求时）
- 红线检查

守门检查：

- 主角是主动的
- 危机由主角缺陷放大
- 巧合不能解决问题
- 结局回收早前情绪锚点
- 反派压力不是扁平反派
- 台词揭示关系变化而非解释主题

然后展示用户选项卡：

- 批准故事并继续（推荐）
- 修订节拍
- 修订情绪曲线
- 修订台词节拍
- 返回前提

## STEP 3：角色卡

生成角色参考卡并把每张图放到画布。推荐顺序：

1. 主角卡
2. 对比 / 施压角色卡
3. 可选配角卡

每张角色卡在可能时为 16:9 生产参考图。与最终渲染视频不同，角色卡必须包含清晰可读的标注，让下游生成能正确绑定人物与道具：

- 角色名标注（英文和/或项目语言）
- 角色定位标注：主角、奶奶、小偷、搭档、施压角色等
- 主 3/4 视角
- 正 / 侧 / 背三视图
- 表情
- 材质 / 服装 / 道具细节
- 重要道具标注：手提包、钱包、滑板、苹果筐、围巾、鞋子、眼镜等
- 提示中重复的"身份锁"
- 简短视觉 ID 备注：年龄段、身材、发型、服饰色、签名道具、不可改特征

风格化 3D 动画要保持角色柔和、可读、跨图跨视频一致。

主要角色卡生成后展示用户选项卡：

- 锁定角色设计并继续（推荐）
- 重新生成主角卡
- 调整具体视觉细节
- 增加另一张角色卡

警告用户：后续修改已锁定的角色设计可能需要重做镜头表、单镜头分镜、单镜头视频片段、拼接正片和最终合成。

## STEP 4：场景卡

在角色卡之后生成场景参考卡并放到画布。场景卡只能展示环境，不出现人物、人群、剪影、手、脸或角色客串。角色动作属于镜头表、单镜头分镜与单镜头视频片段，不属于场景卡。

包含：

- 主环境总览
- 关键光态：日景 / 夜景
- 情绪子空间
- 连续性地标（同场景跨镜头必须保持屏幕位置的固定物体，如厨房中岛、沙发、门框、树、邮筒）
- 环境中的重要道具

然后展示用户选项卡：

- 锁定场景设计并继续（推荐）
- 重新生成场景卡
- 增加另一个场景角度
- 调整光位或布局

## STEP 5：六列标准镜头信息表

在角色卡和场景卡锁定后，输出标准化视频提示作为镜头信息表。本步为强制步骤，不可与分镜或视频生成互换。在画布创建表格节点或 markdown 表格，命名为 `标准镜头信息表` 或 `standard-shot-table`。

表格必须严格按以下顺序包含六列：

| 镜头编号 & 时长 | 连续性衔接 | 参考锚点（空间+身份） | Hook 类型 | 镜头描述（每秒指令） | 音频与对白轨 |
|---|---|---|---|---|---|

列规则：

- **镜头编号 & 时长**：镜头号加计划时长，例如 `S03 / 6s`。
- **连续性衔接**：本镜如何自然承接上一镜的结束画面、道具位置、眼神、人物姿态、声桥或情绪状态；以及本镜如何为下一镜开篇铺好钩子。这是跨镜连续性主链。
- **参考锚点（空间+身份）**：四个子字段，全部必填。
  - `固定地标` — 来自场景卡的确切命名地标，及其相对画面的位置（如 `door-frame: 右侧 1/3`、`kitchen-island: 底部居中`）。
  - `人物位置（机位视角）` — 镜头中每个角色相对画面的位置（左/中/右、上/中/下、前/中/后景）、朝向、初始姿态。
  - `退场人物状态` — 上一镜有但本镜没有的角色，记录其离屏位置和原因（如 `Mia — 离屏左侧，最后出现于门框旁手持苹果筐`）。
  - `光位基线` — 从场景卡继承的主光/补光/轮廓光方向，加本镜调整项（如 `主光：温暖顶光，补光：右侧冷反光，调整：窗光背身剪影`）。
  - 加上身份绑定：已批准的角色卡名（精确）和场景卡名（精确）。
- **Hook 类型**：从受控词表中挑一个短标签，如 `visual-joke`、`reversal`、`suspense`、`tender`、`chase`、`reveal`、`callback`、`expression-beat`。用于整片 hook 分布自检。
- **镜头描述**：景别、镜头运动、荷兰角设计、表演风格、音效、负向提示、**视频模型生成备注**（Step 7 选定的模型 — H3 或 Seedance 2.0 — 接收的 prompt 形态略不同；H3 强调包装关键词和文字/UI/动效清晰度，Seedance 2.0 强调电影感镜头和弹性表演），并强制包含 `Per-Second Directives` 子节。子节必须按秒拆解为 `0–1s`、`1–2s`、`2–3s` 等指令；亚秒关键节拍用 `2.0–2.5s` 风格标记。每条每秒指令必须覆盖全部 5 个必填要素：
  1. 动作 / 姿态 / 表情（适用时含 squash-and-stretch、anticipation、overshoot、follow-through）
  2. 镜头运动（推 / 拉 / 摇 / 倾 / 手持晃动 / 锁定 / 环绕）
  3. 空间位置（人物在哪、持有什么、地标在画面哪里）
  4. 音频线索（旁白 / 对白 / 音效 / 呼吸 / 沉默 — 或 `silent` 表示有意静默）
  5. 与下一秒或下一镜的交接（这一秒锁定的状态如何递给下一秒）
- **音频与对白轨**：本镜完整音频脚本，按时间顺序，独立于每秒指令。字段：
  - `旁白` — 旁白文本及时间范围（无旁白则省略）。
  - `对白` — 台词、说话人、语气、时间范围。
  - `音效` — 关键音效，按时间锚定。
  - `表演备注` — 主角离屏旁白时标记 `narrator-mouth-closed: true`；描述旁白期间表情路径；描述每条对白的具体眼神和身体动作变化。

表格全局规则：

- 每镜必须通过 `连续性衔接` 列自然继承上一镜画面状态，并为下一镜做铺垫。
- 每镜必须含覆盖整个时长的每秒指令，包含动作、姿态、表情、镜头运动、空间位置、音频线索和连续性交接。
- 每秒指令必须具体到可直接生成分镜面板；避免"继续移动"这类缺少身体/镜头/道具细节的模糊描述。
- 表演必须夸张弹性，符合迪士尼式 squash-and-stretch、anticipation、overshoot、follow-through、overlap、弧线、快速姿态变化和清晰喜剧剪影。
- 景别必须在特写 / 大特写与其他必要景别间交替；避免重复景别。
- 荷兰角构图必须为追逐、失衡、惊吓或闹剧节拍设计。
- 台词语言仅在用户明确要求时使用；否则用最小化非语言特定反应或将台词标记为可选 / 待确认。
- 含旁白或对白的镜头，每一秒人物说话时都必须记录嘴部开合；默认离屏旁白为闭，对面对白为开。
- 已离屏角色在 `退场人物状态` 至少记录 1 镜，连续 2 镜明确不在场后再移除。

然后展示用户选项卡：

- 批准表格并进入自检（推荐）
- 调整镜头连续性
- 让动画更夸张
- 调整特写 / 大特写节奏
- 调整荷兰角设计

## STEP 5.5：镜头表自检门（强制）

进入铅笔分镜前，必须对已批准的镜头表跑硬性自检。任何一项不通过必须先修订表格再重跑，通过后才向用户申请进入分镜。

六项必检：

1. **Hook 密度**：每镜都有 `Hook 类型`；每连续 3 镜至少 1 镜使用 `reveal`/`reversal`/`callback`；开场镜和收尾镜各带强 hook（`visual-joke` / `reversal` / `reveal` / `suspense` / `tender`）。
2. **单镜时长**：任何镜头不超过 15 秒。节拍需要更长就拆镜。
3. **单镜角色数**：任何镜头不超过 3 个重要角色（定义为有画面动作或对白的角色）。
4. **空间锚点继承**：含 2 镜以上的同场景，下一镜的 `固定地标` 和 `光位基线` 必须与上一镜一致或含明确连续性备注（如 `door-frame 随镜头左环绕由右侧 1/3 移至中央`）。
5. **每秒指令覆盖**：从 `0s` 到镜尾的每秒都有 `Per-Second Directives`，每条含 5 个必填要素（动作/姿态/表情、镜头、空间、音频线索、交接）。允许 `2.0–2.5s` 亚秒节拍但不能留时间空隙。
6. **跨镜连续性**：逐行读 `连续性衔接` 列必须形成连续链 — 任何一镜都不能从一个与上一镜结束矛盾的状态起步。任何翻转眼神、人物位置、道具状态或光位的镜头必须明确标记翻转（如 `HARD CUT — 时间跳 2h`）。

六项全过后，在画布表格节点顶部加 `shot-table self-check: passed` 戳，并展示用户选项卡：

- 批准自检并绘制分镜（推荐）
- 查看自检详情
- 修订失败项
- 重新跑自检

任何一项不通过就不进入 Step 6。返回 Step 5，列出失败行，表格修好并重跑自检通过后，才能再次展示分镜批准选项卡。

## STEP 6：单文本分镜文档（默认）+ 多宫格铅笔分镜图（opt-in）

Step 5.5 自检通过后，先展示分镜模式选项卡，再生成任何分镜产物：

- **单文本分镜文档（默认，推荐）** — 整个短片一份画布文本节点，所有分镜作为文档内章节。对齐半解说短剧分镜结构：每镜字段（标题/hook/场景/角色/空间锚点/连续性/表演备注）加 Pixar 的每面板四象限内容 + 可选 ASCII 布局。承载完整质控载荷，成本几乎为零。Step 7 选定的视频模型直接读取作为该镜渲染参考。
- **单文本分镜文档 + 多宫格铅笔图（可视化模式，opt-in）** — 单文本分镜文档照常作为权威产物，并额外为每镜生成一张多宫格铅笔图供人眼审稿。成本更高，适合用户想在付视频成本前要一次视觉预演，或弹性表演 / 姿态剪影是高风险项想先可视化检查的情况。

把选中的分镜模式记入项目简报，并在 Step 7、Step 9 和重生成纪律里复用。

### 默认路径：单文本分镜文档

为整部短片生成一个画布文本节点，命名 `<title> text storyboards`（一个文档包含所有分镜）。即使同时生成铅笔图，这份文档仍是 Step 7 的权威渲染参考。结构对齐半解说短剧分镜 —— 每镜是同一文档的章节，用户读跨镜连续性不需要切换节点。

文档头部块（文档顶部）：

- 项目标题、已确认的视频模型、已确认的分辨率、分镜模式、自检状态（如 `shot-table self-check: passed at <时间戳>`）。
- 一段简短的目录，列出每镜的 hook 和章节锚点（如 `S01`、`S02` …），便于用户跳转。

每镜章节结构（每个 `##` 标题对应一镜，按镜头顺序）。每个章节必须按以下顺序包含这些字段 —— 直接对应半解说短剧的分镜字段：

1. **镜头标题 & 时长** — 简短可读的本镜标题，加 `S<N> / <duration>s`（如 `S03 / 6s`）。
2. **Hook 类型** — 受控词：`setup` / `visual-joke` / `reversal` / `reveal` / `callback` / `suspense` / `tender` / `chase` / `expression-beat` / `climax`。用于整片 hook 分布自检。
3. **场景 & 角色** — 精确场景卡名、精确在屏角色名（绑定到角色卡）。
4. **空间锚点卡**（强制，四个子字段 —— 直接对齐半解说短剧）：
   - `固定地标` — 命名地标及其画面相对位置（如 `door-frame: 右侧 1/3`、`kitchen-island: 底部居中`）。
   - `人物位置（机位视角）` — 每个在屏角色，画面相对位置、朝向、初始姿态。
   - `退场人物状态` — 上一镜有但本镜没有的角色，记录其离屏位置和原因。
   - `光位基线` — 从场景卡继承的主光/补光/轮廓光方向，加本镜调整项。
5. **连续性**（对齐半解说短剧的 handoff 字段）：
   - `承接 S(N-1)` — 一两句话交代上一镜结束状态。
   - `交接 S(N+1)` — 一句话铺好下一镜开场。
6. **双绑定** — `[char:角色名-01] [char:角色名-02] ... [scene:场景名] [hook: visual-joke]` — 精确角色卡名、场景卡名、hook 类型。这些是分镜专用参考标记，视频模型渲染时剥离。
7. **每面板四象限内容**（按时间顺序；这就是 Pixar 的每秒指令，从表格行原样保留）：
   - `时间码` — 如 `0–1s`。
   - `姿态 + 表情` — 具体身体姿态、剪影、关键持握、眼神、表情路径；弹性节拍明确写出 squash / stretch / anticipation / overshoot。这是每面板最大块内容，也是视频模型读取的视觉节拍。
   - `镜头` — 景别、镜头运动（推/拉/摇/倾/手持晃动/锁定/环绕）、荷兰角备注。
   - `音频 + 锚点` — 音频线索（`♪ 旁白: ...` / `对白: ...` / `SFX: ...` / `silent`）和空间锚点备注（`door-frame: 右侧 1/3` / `Mia: 中央中景面朝镜头`）。
   - 表演备注（对齐半解说短剧）：旁白秒标 `narrator-mouth-closed: true`；面对白秒标 `mouth-open: speaker` 并描述表情路径 / 眼神 / 身体动作变化。
8. **布局规则**（逐镜适用）：
   - 3 秒镜 → 3 面板（每秒 1 个）。
   - 4 秒镜 → 4 面板。
   - 5 秒镜 → 5 面板。
   - 6 秒镜 → 6 面板。
   - 7 秒及以上 → 每秒 1 面板；亚秒关键节拍按需加迷你面板如 `2.0–2.5s`，仅当该节拍是本镜核心 hook 时。
   - 面板必须覆盖整镜时长，从首帧到尾帧无时间空隙。
9. **每面板绑定**：
   - 绑定表格行中列出的精确角色卡，锁定外观、脸、发型、身材、服装、签名道具、角色身份。使用与表格相同的角色名。
   - 绑定表格行中列出的精确场景卡，保留环境、道具、地标、运动路径、空间逻辑。
10. **可选 ASCII 布局块（强烈推荐，零成本）**：
    - 每面板附一小段 ASCII 草图（或整镜一张组合草图），让用户秒扫空间布局而不必渲染图。例：
      ```
      [0-1s]  Mia (L, mid)         door-frame (R)
              ——跪下，双手按苹果筐——
              cam: low push-in, locked
              audio: silent | anchor: basket center-bottom
      [1-2s]  ...
      ```
    - ASCII 块仅供参考；视频模型读取上面结构化的 `每面板四象限内容`，不读 ASCII。
11. **分镜专用标记**：
    - 关键节拍在面板时间码后加 `[BEAT]`。
    - 某面板必须交接特定状态到下个面板或下个镜头时，加 `[HANDOFF → ...]` 短标签，如 `[HANDOFF → S04 opening]`。

每镜章节模板（任意镜通用，复制粘贴骨架）：

```markdown
## S03 / 6s — 标题：奶奶把苹果筐递给 Mia

- **Hook 类型**：reveal
- **场景 & 角色**：scene:kitchen | char:Mia, char:Grandma
- **空间锚点卡**：
  - 固定地标：door-frame（右侧 1/3）、kitchen-island（底部居中）
  - 人物位置：Mia（左，中景，面朝镜头）| Grandma（右，前景，面朝 Mia）
  - 退场人物状态：—
  - 光位基线：温暖顶光主光 + 右侧冷反光
- **承接 S02**：奶奶弯下腰从中岛拿起苹果筐
- **交接 S04**：Mia 接住筐转身，门铃响起
- **双绑定**：[char:Mia] [char:Grandma] [scene:kitchen] [hook:reveal]

### 每面板四象限内容

#### 0–1s
- 姿态 + 表情：奶奶弯腰双手持筐；Mia 左侧站姿，眼神好奇
- 镜头：locked medium shot, eye-level
- 音频 + 锚点：silent | Mia: L midground | basket: center bottom
- 表演备注：[BEAT]

#### 1–2s
- 姿态 + 表情：奶奶手臂伸向 Mia，筐倾斜；Mia 双手前伸准备接
- 镜头：locked medium shot, eye-level
- 音频 + 锚点：♪ SFX: basket rustle | anchor: door-frame: 右侧 1/3
- 表演备注：[HANDOFF → S04 opening]

#### 2–3s
...

### ASCII 布局（可选）
[0-1s]  Grandma (R, fg)        door-frame (R, bg)
        ——lifts basket——        Mia (L, mid)
        cam: locked | silent
[1-2s]  ...
```

所有章节写完后，把文档放到画布，直接进入 Step 7。默认模式下不要调用任何图像生成模型。

### 按镜抽取（重点迭代模式）

默认的单文档形态针对阅读和跨镜连续性做了优化。当用户标记某镜需要重点迭代（通常是 climax / 追逐 / 闹剧节拍，每面板内容需要多轮修订），就把该章节从文档中抽取成独立文本节点，让迭代局部化：

- **用户信号**：Step 6 之后任何时间用户说"重点改 S05"、"S05 需要返工"、"抽取 S05"、或在分镜批准选项卡选某镜做重点迭代。
- **抽取机制**：
  1. 新建一个画布文本节点，命名 `<title> S05 text storyboard (extracted)`。
  2. 把文档中 `## S05` 章节的完整内容移到新节点。
  3. 在文档中，把原 `## S05` 章节替换为一行占位：`> S05 — 已抽取到独立节点（见 \`<title> S05 text storyboard (extracted)\`）`。
  4. Step 7 渲染 S05 时从抽取节点读取；其他镜仍从文档读取。
- **回填**：用户满意后，把独立节点折叠回文档（占位换成最新内容），独立节点归档。
- **多镜抽取**：每个被抽取的镜各自独立成节点，文档里用占位追踪。

抽取机制存在是因为独立节点按需使用才高效 —— 但只要迭代压力大就随时可用。

### Opt-in 路径：多宫格铅笔分镜图（可视化模式）

如果用户在分镜模式选项卡选了可视化模式，在单文本分镜文档之外**额外**为每行生成一张多宫格铅笔分镜图。单文本分镜文档仍为权威渲染参考；铅笔图仅供人眼审稿。

每张铅笔分镜图：

- **双绑定标签（右上角，强制写在图上）**：
  - `[char:角色名-01] [char:角色名-02] ...` — 本行用到的精确角色卡名。
  - `[scene:场景名]` — 精确场景卡名。
  - `[shot: S03] [dur: 6s] [hook: visual-joke]` — 镜头号、时长、hook 类型。
  - 这些标签是分镜专用参考标记，渲染视频时剥离。
- **绑定精确角色卡**，锁定人物外观、脸、发型、身材、服装、签名道具、角色身份。
- **绑定精确场景卡**，保持环境、道具、地标、运动路径、空间逻辑。
- 把行内每秒指令转换为一张分镜面板或一个明确标注的节拍面板：4 秒镜通常 4 面板；6 秒镜通常 6 面板；亚秒关键节拍按需加迷你面板。
- **面板物理排版（强制）**：
  - 3 秒镜 → 1×3 条。
  - 4 秒镜 → 2×2 网格。
  - 5 秒镜 → 上排 3 + 下排 2。
  - 6 秒镜 → 2×3 网格。
  - 7 秒及以上 → 3 排，面板均衡。
  - 每面板占据相同画布面积，不允许某面板独占。
- **每面板四象限内容（强制）**：
  - 左上：时间码（如 `0–1s`）。
  - 右上：姿态 + 表情草图（最大区域；实际视觉节拍）。
  - 左下：镜头图标 + 运动箭头（推/拉/摇/环绕/锁定）加荷兰角小备注。
  - 右下：音频线索（如 `♪ 旁白: "我就知道。"` / `SFX: 门吱呀` / `silent`）和锚点备注（如 `door-frame: 右侧 1/3`）。
- 面板按阅读顺序排布，多个不同镜头不合并到同一图。
- 每面板标记时间码如 `0–1s`、`1–2s`，并展示对应姿态、表情、动作、镜头运动、道具位置、音效线索和连续性交接。
- 输出纯黑白铅笔线稿：不上色、不带最终渲染光、不带精致 3D 渲染。
- 在分镜图上标镜头号，必要时每面板加镜头运动图标 / 标记。
- 必要时包含分镜专用标记：铅笔结构线、动作箭头、镜头路径图标、时间标记和小注。
- 草稿只作为视频渲染参考资产，不是终稿美术。

### 分镜批准（两种模式通用）

所有文本分镜章节（和可视化模式下的铅笔图）产出后，按镜头顺序放到画布，归组为：
- `<title> text storyboards`（默认模式，单文档），或
- `<title> text storyboards + multi-panel pencil storyboards`（可视化模式，文本文档和铅笔图分两类各自归组，因为铅笔图含双绑定标签、ASCII 标签和镜头号，文本文档没有这些）。

展示用户选项卡：

- 批准分镜并渲染镜头视频（推荐）
- 抽取 / 回填某镜（在文档和独立节点之间移动章节）
- 重画选定的铅笔分镜（仅可视化模式）
- 修复角色一致性
- 修复场景逻辑
- 修复镜头标记
- 修复音频/锚点标记

### 分镜生成失败回退（仅可视化模式）

如果铅笔分镜图无法按要求质量产出（布局塌陷、标签糊掉、面板合并、角色走样），在向用户求助前按以下升级路径处理：

1. **第一次重试**：用更紧的提示重画同一镜，明确写上四象限布局、`[char:…] [scene:…] [shot:…]` 标签和每面板内容规则。
2. **第二次重试**：去掉右下音频/锚点象限文字（保留为带小 `♪` 标记的空白格），减少文字负载；通常能修掉标签糊掉但不影响视觉节拍。
3. **第三次重试**：面板数减 1（例如 6 面板→5 面板，合并两秒动作最弱的秒），镜头图标简化为单箭头。
4. **同一镜连续 3 次失败后**：暂停并用选项卡问用户：
   - 切换为色块分镜（灰色方块占位姿态，不画铅笔线），仅限失败这一镜。
   - 放弃该镜的铅笔图，仅靠单文本分镜文档推进该行。
   - 在 Step 5 把该镜拆为两段更短的镜头并重跑 Step 5.5。
   - 手动提供参考图代替生成。

默认文本模式没有这套回退 —— 文本分镜失败只发生在模型无法产出连贯结构化文本时，遇到就直接回到 Step 5 修订该行表格。

## STEP 7：视频模型选项卡 + 单镜头视频片段

### 视频模型选项卡（任何片段渲染前的强制门）

任何片段渲染前必须先展示视频模型选项卡。选择写入项目简报，本项目所有片段沿用，除非用户后续修改。

视频模型选项卡：

- **H3（推荐默认）** — 强项是视觉包装、动效图形、文字/UI 清晰度、多模态上下文理解、性价比（2K 约同类旗舰 1/3 价格，768P 约 1/2）。原生双声道音视频，单片段最长 15s @ 2K。最适合：设计语言强的皮克斯 3D 动画短片、文字 / 字幕 / UI 元素、动效转场、对话驱动且音频就是交付物一部分的镜头。
- **Seedance 2.0（高强度动画表演的回退）** — 强项是电影感镜头、复杂运镜、皮克斯弹性表演、动作张力。适合追逐、闹剧节拍、以动画本身为卖点的 climax 镜头。
- **逐镜混合（高级）** — 在镜头表某行的 `镜头描述` 列加 `video_model: H3` 或 `video_model: Seedance2` 字段，本项目同时混用。未标记的行默认走 H3。

### 分辨率选项卡（视频模型锁定后）

视频模型确定后再展示分辨率选项卡：

- 768P（H3 首推，性价比高）
- 2K（H3 默认质量，成本更高，画质更清）
- 1080p（Seedance 2.0 推荐）
- 720p（Seedance 2.0 草稿，最低成本）
- 匹配项目 / 自定义分辨率

首条片段渲染前用户必须先确认分辨率。后续用户可针对单条 hero 镜头临时改分辨率。

### 单镜头片段渲染

每行批准后调用选定的视频模型生成对应独立视频片段。每条片段必须严格使用单文本分镜文档中匹配的章节（若该章节已抽取成独立节点则从独立节点取）、角色卡和场景卡。

各模型通用规则：

- 单文本分镜文档是权威的逐镜参考：叙事、构图、镜头运动、动作编排、每秒时间、镜头号都从这里取。已抽取的镜从独立节点取。若同时存在铅笔分镜图，仅用于人眼侧的姿态/剪影预检；不得让铅笔图覆盖文本分镜。
- 角色卡为权威身份源。
- 场景卡为权威环境源。
- **剥离所有分镜双绑定标签**（`[char:…]`、`[scene:…]`、`[shot:…]`、`[dur:…]`、`[hook:…]`）再渲染视频 — 这些是分镜专用参考标记，不能出现在最终片段里。铅笔分镜图还自带镜头号、镜头图标、箭头和备注，渲染时也要一并移除。
- 渲染片段只能包含干净的皮克斯感全彩 3D 动画内容。
- 不要分镜线稿、不要手绘草图质感、不要标签、不要字幕（除非要求）、不要水印。
- 保持已批准的画面尺寸 / 比例和已批准的分辨率。

### 模型相关 prompt 形态

单文本分镜文档（已抽取的镜从独立节点取）同时喂两个模型，但包在分镜外的 prompt 前缀不同：

- **H3 prompt 前缀**（默认）：强调包装关键词、设计语言、动效清晰度、文字/UI 元素（如果相关）、双声道音频意图。H3 强在指令遵循，每秒指令可以几乎原文送入。追加：`Pixar-inspired 3D cartoon rendering, C4D + Octane look, stylized Q-version proportions, warm SSS skin, designed-with-detail hair, strong character design language, clean motion, on-brand color palette`。
- **Seedance 2.0 prompt 前缀**（表演回退）：强调电影感镜头语言、弹性 squash-and-stretch、anticipation、follow-through、光位戏剧性、镜头选择。追加：`cinematic Pixar-quality 3D animation, elastic squash-and-stretch performance, Disney-style anticipation and overshoot, dramatic key lighting, lens-specific depth of field`。

用户选了逐镜混合时，按该行 `video_model` 字段匹配的前缀。

### 各模型失败回退

H3 失败回退阶梯：

1. 第一次重试：用直接引用表格中 `参考锚点` 块的强化 H3 prompt 重渲染。
2. 第二次重试：把该镜缩到 ≤6s，把砍掉的秒拆到 Step 5 的新相邻行，重跑 Step 5.5 自检再重渲。
3. 第三次重试：把失败这一镜切到 Seedance 2.0（这正是混合模式存在的意义 — 表演回退是一键切换，不是重构流程）。
4. 同一镜连续 3 次失败：暂停并用选项卡问用户：
   - 单独把这一镜切到 Seedance 2.0。
   - 放宽要求（去掉一个道具、简化动作、降低 hook 强度）。
   - 跳过该镜，下游加 `placeholder: missing clip` 标记。
   - 手动提供参考视频代替生成。

Seedance 2.0 失败回退阶梯（用户全局选了 Seedance 时，或 H3 已失败 3 次后）：

1. 第一次重试：直接引用 `参考锚点` 块的强化 prompt 重渲染。
2. 第二次重试：去掉参考图，纯文本生成。
3. 第三次重试：缩到 ≤6s，砍掉的秒拆到新行。
4. 同一镜连续 3 次失败：问用户 — 切到 H3、宽松要求、跳过、手动参考视频。

### 所有片段渲染完成后

按镜头顺序放到画布，归组为 `<title> shot clips`（不再硬编码单一模型名，因为项目可能混用 H3 和 Seedance 2.0），展示用户选项卡：

- 批准片段并合成全片（推荐）
- 重渲染选定片段（可指定用同一模型或切换）
- 修复角色不一致
- 修复场景不一致
- 加强分镜清理
- 修复跨片段空间锚点漂移

如果渲染片段与已批准的 `参考锚点` 漂移（门框落到错边、人物从错边离屏、光位翻转），用直接引用 `参考锚点` 块的强化提示重渲染；持续漂移时按混合模式切到另一模型；不要在拼接时静默混合修正版和未修正版。

## STEP 8：全片拼接、BGM 匹配与最终输出

所有单镜头片段批准后，按表格顺序拼接成完整主视频。然后生成一条连续 BGM 匹配故事氛围，嵌入拼接视频。

拼接与 BGM 规则：

- 严格按已批准表格的镜头顺序。
- BGM 匹配拼接视频的实际节奏、情绪弧、喜剧节拍、追逐节奏和结尾氛围。
- 在对白、非语言反应和重要音效下 duck BGM。
- 保留原片段音频和音效（除非用户要求替换）。
- 不要逐镜生成 BGM。
- 不要加字幕或文字（除非用户明确要求）。
- 最终视频必须保持干净动画视觉、无任何分镜痕迹，包括没有 `[char:…] [scene:…] [shot:…]` 双绑定标签。

然后展示用户选项卡：

- 批准最终成片（推荐）
- 重新生成 BGM
- 调整 BGM 混音
- 重渲染选定片段

## STEP 9：最终复盘

用户要求诊断或存在明显风险时，生成一段简短复盘文本节点。

检查：

- 角色一致性
- 场景连续性（对照 `参考锚点` 列验证：每个地标是否落在表格说的位置）
- 情绪锚点回收
- 镜头意图清晰度
- 对白可懂度
- 音效/动效同步（对照 `音频与对白轨` 列）
- BGM 平衡
- 最终视频无分镜痕迹：没有面板边框、铅笔线、箭头、标签、手写备注、时间标记、姿态残影、分镜文字，**也没有双绑定标签**（`[char:…]`、`[scene:…]`、`[shot:…]`、`[dur:…]`、`[hook:…]`）
- 缺失或薄弱片段
- 任何可能需要重做的资产

## 画布排序与归组纪律

每生成一个耐用产物，立刻按 STEP 0 顺序写到画布。生成工具自动上画布的不重复。

每个生产环节都归组：

- 项目简报与故事大纲在都有时归组为 `<title> story planning`。
- 角色卡归组为 `<title> character cards`。
- 场景卡归组为 `<title> scene cards`。
- 标准镜头表归组为 `<title> shot table`。
- 单文本分镜文档归组为 `<title> text storyboards`（默认模式，单文档）。抽取的独立文本分镜节点和铅笔分镜（可视化模式）各自分组：`<title> extracted text storyboards` 和 `<title> multi-panel pencil storyboards`。所有分镜组与渲染片段组分开，因为分镜含双绑定标签、镜头号、镜头图标、箭头和铅笔线。
- 单镜头视频片段归组为 `<title> shot clips`（标签不再硬编码单一模型名，因为项目可能混用 H3 和 Seedance 2.0）。
- 拼接主视频、匹配 BGM 和最终合成视频在都有时归组为 `<title> final delivery`。

一轮生成产出 2 个或更多产物时，立刻归组并起一个清晰标题。渲染器位置未刷新导致归组失败时，请用户点击/拖动任一画布节点一次，再重试归组，必要时再进入下一个高成本环节。

## 用户选项卡纪律

每个需要用户确认的地方都用选项卡。不要用纯对话问题或散文代替。强制选项卡门：

- 输入捕获后，下一步之前：选画面尺寸 / 比例
- 输入捕获后，下一步之前：选总时长
- 项目简报后
- 故事大纲后
- 角色卡后
- 场景卡后
- 标准镜头表后（门 1：批准表格进入自检）
- 镜头表自检通过后（门 2：批准自检，然后立即选分镜模式：仅文本 / 文本+铅笔图）
- 单镜头分镜后（默认单文本分镜文档，可含抽取的独立节点；可视化模式时含铅笔图）
- 单镜头视频片段渲染前：选视频模型（H3 默认，Seedance 2.0 回退，逐镜混合）
- 单镜头视频片段渲染前：选视频分辨率
- 单镜头视频片段后
- 全片拼接、BGM 匹配和最终合成后

默认推荐项放最前。始终允许用户自定义输入。用户说"继续"时按选了推荐项处理。

## 重生成与最新资产纪律

用户重做或修订任何产物时，下游步骤必须用最新批准的产物，不能用旧的。

规则：

- 角色卡重做后，未来的镜头表、单文本分镜文档（含抽取的独立节点；可视化模式下还含铅笔分镜）、单镜头视频片段、拼接视频、最终合成必须按精确角色名引用新的带标注角色卡。
- 场景卡重做后，未来的镜头表、单文本分镜文档（含抽取的独立节点；可视化模式下还含铅笔分镜）、单镜头视频片段、拼接视频、最终合成必须按精确场景名引用新场景卡。
- 镜头表修订后，未来的分镜（文档+抽取节点）、单镜头视频片段、拼接必须用新表。Step 5.5 的自检必须在分镜恢复前重跑。
- 单文本分镜文档中某章节修订后，对应单镜头视频片段必须用新章节内容。若该章节已抽取成独立节点，则独立节点为权威。
- 抽取的独立文本分镜节点修订后，用户满意时回填到文档（占位换成最新内容），独立节点归档。
- 可视化模式下铅笔分镜重画后，对应视频片段仍以单文本分镜文档（或抽取的独立节点）为准；铅笔图仅供人眼参考，可独立重画而无需强制重渲视频。
- 单镜头视频片段重渲染后，拼接、BGM 匹配和最终合成必须用新片段。片段原用 H3 渲染，用户想切到 Seedance 2.0 重渲（或反向）按模型切换处理 — 在项目简报记入新模型，重检 per-shot 规则。
- BGM 重新生成后，最终合成必须用新 BGM。

任何重做后：

1. 在下一条文本输出或回复中标记重做产物为当前批准版本。
2. 在所有后续提示中优先用新文件路径 / 节点。
3. 画布上同时存在多版本时，按文件名 / 节点名指明当前选用版本再继续。
4. 不要在最终拼接中静默混合新旧资产。

## 边界

单张图、简单修图、单段镜头动画、logo 设计、纯提示咨询不用本 Skill。用户只要提示时，用视频提示工作流。用户只要角色卡时，用角色拆解工作流。
