name: 3d-animation-short-generator description: | 将一句故事创意转化为完整的风格化3D动画短片制作流程,依次完成项目简报、故事大纲、角色卡、无人物场景卡、标准镜头表、文本分镜或可选铅笔分镜、视频模型选择、单镜头生成、全片拼接、BGM匹配与最终复查。适用于需要角色一致、场景连续、节奏明确和音画配合的剧情动画短片、纪念短片、品牌故事与社交媒体内容。不适用于单张图片、简单修图、真人写实视频或单一独立镜头。
当用户想把一句话创意做成完整的故事优先动画短片流程时使用本 Skill。流程从创意开发到最终剪辑,所有主要产物都必须按生产顺序放到画布上,并在高成本或关键创意节点用选项卡让用户确认。
核心规则:先故事、再资产;用户输入内容后立刻用选项卡确认画面尺寸/比例与总时长;产物按顺序上画布;所有需要用户确认的地方必须用选项卡;角色/场景卡后固定顺序为:六列标准镜头信息表(每秒指令+音频+空间锚点链+hook)→ 镜头表自检门 → 一份单一文本分镜文档(每镜一节,对齐半解说短剧分镜字段;用户主动开启可视化模式时再加铅笔图;用户标记需要重点迭代的镜时抽取成独立节点)→ 视频模型选项卡(H3 默认,Seedance 2.0 回退)+ 分辨率选项卡 → 用选定视频模型生成单镜头片段 → 全片拼接与 BGM 合成;最终视频必须清除所有分镜痕迹。
除非用户明确指定其他视觉风格,所有角色卡、场景卡、镜头表格、文本分镜、可选铅笔分镜、单镜头视频片段(无论使用哪个视频模型)、拼接正片和最终合成都必须使用以下视觉风格:
负向风格约束:不要写实真人摄影、不要扁平二次元、不要塑料玩具皮肤、不要僵硬人体姿势、不要真实解剖僵硬感、不要无生命表情。
捕捉:
捕捉完用户输入后,在项目简报或任何下一步之前,必须先展示选项卡确认生产规格:
画面尺寸 / 比例选项卡:
总时长选项卡:
只有用户同时选择画面尺寸/比例和总时长,或明确给出自定义值后,才进入下一步。把已确认的画面尺寸/比例和总时长写入项目简报,并贯穿用于镜头时长、转场连贯性、六列标准镜头信息表、单镜头分镜(默认文本,开可视化模式时含铅笔图)、单镜头视频片段、全片拼接、BGM 匹配和最终合成设置。
按以下顺序创建或更新画布产物:
镜头描述 内含每秒指令<title> text storyboards,每镜一节(对齐半解说短剧分镜结构)。用户标记需要重点迭代的镜时,把该节抽取成独立节点,原位置留占位。可视化模式下的铅笔分镜图是独立图片节点。不要把长篇生产内容只丢在对话里。耐用产物必须以文本、图片、视频或音频节点形式落到画布。
写一份精炼的项目简报到画布文本节点,命名为项目名或 项目简报。
包含:
language not specified,保持最小化对白或后续再确认然后展示用户选项卡:
只有用户选择或明确说继续后才进入下一步。
创建故事大纲并写入画布文本节点,命名为 故事大纲 或 story-outline。
包含:
守门检查:
然后展示用户选项卡:
生成角色参考卡并把每张图放到画布。推荐顺序:
每张角色卡在可能时为 16:9 生产参考图。与最终渲染视频不同,角色卡必须包含清晰可读的标注,让下游生成能正确绑定人物与道具:
风格化 3D 动画要保持角色柔和、可读、跨图跨视频一致。
主要角色卡生成后展示用户选项卡:
警告用户:后续修改已锁定的角色设计可能需要重做镜头表、单镜头分镜、单镜头视频片段、拼接正片和最终合成。
在角色卡之后生成场景参考卡并放到画布。场景卡只能展示环境,不出现人物、人群、剪影、手、脸或角色客串。角色动作属于镜头表、单镜头分镜与单镜头视频片段,不属于场景卡。
包含:
然后展示用户选项卡:
在角色卡和场景卡锁定后,输出标准化视频提示作为镜头信息表。本步为强制步骤,不可与分镜或视频生成互换。在画布创建表格节点或 markdown 表格,命名为 标准镜头信息表 或 standard-shot-table。
表格必须严格按以下顺序包含六列:
| 镜头编号 & 时长 | 连续性衔接 | 参考锚点(空间+身份) | Hook 类型 | 镜头描述(每秒指令) | 音频与对白轨 |
|---|
列规则:
S03 / 6s。固定地标 — 来自场景卡的确切命名地标,及其相对画面的位置(如 door-frame: 右侧 1/3、kitchen-island: 底部居中)。人物位置(机位视角) — 镜头中每个角色相对画面的位置(左/中/右、上/中/下、前/中/后景)、朝向、初始姿态。退场人物状态 — 上一镜有但本镜没有的角色,记录其离屏位置和原因(如 Mia — 离屏左侧,最后出现于门框旁手持苹果筐)。光位基线 — 从场景卡继承的主光/补光/轮廓光方向,加本镜调整项(如 主光:温暖顶光,补光:右侧冷反光,调整:窗光背身剪影)。visual-joke、reversal、suspense、tender、chase、reveal、callback、expression-beat。用于整片 hook 分布自检。Per-Second Directives 子节。子节必须按秒拆解为 0–1s、1–2s、2–3s 等指令;亚秒关键节拍用 2.0–2.5s 风格标记。每条每秒指令必须覆盖全部 5 个必填要素:
silent 表示有意静默)旁白 — 旁白文本及时间范围(无旁白则省略)。对白 — 台词、说话人、语气、时间范围。音效 — 关键音效,按时间锚定。表演备注 — 主角离屏旁白时标记 narrator-mouth-closed: true;描述旁白期间表情路径;描述每条对白的具体眼神和身体动作变化。表格全局规则:
连续性衔接 列自然继承上一镜画面状态,并为下一镜做铺垫。退场人物状态 至少记录 1 镜,连续 2 镜明确不在场后再移除。然后展示用户选项卡:
进入铅笔分镜前,必须对已批准的镜头表跑硬性自检。任何一项不通过必须先修订表格再重跑,通过后才向用户申请进入分镜。
六项必检:
Hook 类型;每连续 3 镜至少 1 镜使用 reveal/reversal/callback;开场镜和收尾镜各带强 hook(visual-joke / reversal / reveal / suspense / tender)。固定地标 和 光位基线 必须与上一镜一致或含明确连续性备注(如 door-frame 随镜头左环绕由右侧 1/3 移至中央)。0s 到镜尾的每秒都有 Per-Second Directives,每条含 5 个必填要素(动作/姿态/表情、镜头、空间、音频线索、交接)。允许 2.0–2.5s 亚秒节拍但不能留时间空隙。连续性衔接 列必须形成连续链 — 任何一镜都不能从一个与上一镜结束矛盾的状态起步。任何翻转眼神、人物位置、道具状态或光位的镜头必须明确标记翻转(如 HARD CUT — 时间跳 2h)。六项全过后,在画布表格节点顶部加 shot-table self-check: passed 戳,并展示用户选项卡:
任何一项不通过就不进入 Step 6。返回 Step 5,列出失败行,表格修好并重跑自检通过后,才能再次展示分镜批准选项卡。
Step 5.5 自检通过后,先展示分镜模式选项卡,再生成任何分镜产物:
把选中的分镜模式记入项目简报,并在 Step 7、Step 9 和重生成纪律里复用。
为整部短片生成一个画布文本节点,命名 <title> text storyboards(一个文档包含所有分镜)。即使同时生成铅笔图,这份文档仍是 Step 7 的权威渲染参考。结构对齐半解说短剧分镜 —— 每镜是同一文档的章节,用户读跨镜连续性不需要切换节点。
文档头部块(文档顶部):
shot-table self-check: passed at <时间戳>)。S01、S02 …),便于用户跳转。每镜章节结构(每个 ## 标题对应一镜,按镜头顺序)。每个章节必须按以下顺序包含这些字段 —— 直接对应半解说短剧的分镜字段:
S<N> / <duration>s(如 S03 / 6s)。setup / visual-joke / reversal / reveal / callback / suspense / tender / chase / expression-beat / climax。用于整片 hook 分布自检。固定地标 — 命名地标及其画面相对位置(如 door-frame: 右侧 1/3、kitchen-island: 底部居中)。人物位置(机位视角) — 每个在屏角色,画面相对位置、朝向、初始姿态。退场人物状态 — 上一镜有但本镜没有的角色,记录其离屏位置和原因。光位基线 — 从场景卡继承的主光/补光/轮廓光方向,加本镜调整项。承接 S(N-1) — 一两句话交代上一镜结束状态。交接 S(N+1) — 一句话铺好下一镜开场。[char:角色名-01] [char:角色名-02] ... [scene:场景名] [hook: visual-joke] — 精确角色卡名、场景卡名、hook 类型。这些是分镜专用参考标记,视频模型渲染时剥离。时间码 — 如 0–1s。姿态 + 表情 — 具体身体姿态、剪影、关键持握、眼神、表情路径;弹性节拍明确写出 squash / stretch / anticipation / overshoot。这是每面板最大块内容,也是视频模型读取的视觉节拍。镜头 — 景别、镜头运动(推/拉/摇/倾/手持晃动/锁定/环绕)、荷兰角备注。音频 + 锚点 — 音频线索(♪ 旁白: ... / 对白: ... / SFX: ... / silent)和空间锚点备注(door-frame: 右侧 1/3 / Mia: 中央中景面朝镜头)。narrator-mouth-closed: true;面对白秒标 mouth-open: speaker 并描述表情路径 / 眼神 / 身体动作变化。2.0–2.5s,仅当该节拍是本镜核心 hook 时。[0-1s] Mia (L, mid) door-frame (R)
——跪下,双手按苹果筐——
cam: low push-in, locked
audio: silent | anchor: basket center-bottom
[1-2s] ...每面板四象限内容,不读 ASCII。[BEAT]。[HANDOFF → ...] 短标签,如 [HANDOFF → S04 opening]。每镜章节模板(任意镜通用,复制粘贴骨架):
## S03 / 6s — 标题:奶奶把苹果筐递给 Mia
- **Hook 类型**:reveal
- **场景 & 角色**:scene:kitchen | char:Mia, char:Grandma
- **空间锚点卡**:
- 固定地标:door-frame(右侧 1/3)、kitchen-island(底部居中)
- 人物位置:Mia(左,中景,面朝镜头)| Grandma(右,前景,面朝 Mia)
- 退场人物状态:—
- 光位基线:温暖顶光主光 + 右侧冷反光
- **承接 S02**:奶奶弯下腰从中岛拿起苹果筐
- **交接 S04**:Mia 接住筐转身,门铃响起
- **双绑定**:[char:Mia] [char:Grandma] [scene:kitchen] [hook:reveal]
### 每面板四象限内容
#### 0–1s
- 姿态 + 表情:奶奶弯腰双手持筐;Mia 左侧站姿,眼神好奇
- 镜头:locked medium shot, eye-level
- 音频 + 锚点:silent | Mia: L midground | basket: center bottom
- 表演备注:[BEAT]
#### 1–2s
- 姿态 + 表情:奶奶手臂伸向 Mia,筐倾斜;Mia 双手前伸准备接
- 镜头:locked medium shot, eye-level
- 音频 + 锚点:♪ SFX: basket rustle | anchor: door-frame: 右侧 1/3
- 表演备注:[HANDOFF → S04 opening]
#### 2–3s
...
### ASCII 布局(可选)
[0-1s] Grandma (R, fg) door-frame (R, bg)
——lifts basket—— Mia (L, mid)
cam: locked | silent
[1-2s] ...
所有章节写完后,把文档放到画布,直接进入 Step 7。默认模式下不要调用任何图像生成模型。
默认的单文档形态针对阅读和跨镜连续性做了优化。当用户标记某镜需要重点迭代(通常是 climax / 追逐 / 闹剧节拍,每面板内容需要多轮修订),就把该章节从文档中抽取成独立文本节点,让迭代局部化:
<title> S05 text storyboard (extracted)。## S05 章节的完整内容移到新节点。## S05 章节替换为一行占位:> S05 — 已抽取到独立节点(见 0 <title> S05 text storyboard (extracted) 1 )。抽取机制存在是因为独立节点按需使用才高效 —— 但只要迭代压力大就随时可用。
如果用户在分镜模式选项卡选了可视化模式,在单文本分镜文档之外额外为每行生成一张多宫格铅笔分镜图。单文本分镜文档仍为权威渲染参考;铅笔图仅供人眼审稿。
每张铅笔分镜图:
[char:角色名-01] [char:角色名-02] ... — 本行用到的精确角色卡名。[scene:场景名] — 精确场景卡名。[shot: S03] [dur: 6s] [hook: visual-joke] — 镜头号、时长、hook 类型。0–1s)。♪ 旁白: "我就知道。" / SFX: 门吱呀 / silent)和锚点备注(如 door-frame: 右侧 1/3)。0–1s、1–2s,并展示对应姿态、表情、动作、镜头运动、道具位置、音效线索和连续性交接。所有文本分镜章节(和可视化模式下的铅笔图)产出后,按镜头顺序放到画布,归组为:
<title> text storyboards(默认模式,单文档),或<title> text storyboards + multi-panel pencil storyboards(可视化模式,文本文档和铅笔图分两类各自归组,因为铅笔图含双绑定标签、ASCII 标签和镜头号,文本文档没有这些)。展示用户选项卡:
如果铅笔分镜图无法按要求质量产出(布局塌陷、标签糊掉、面板合并、角色走样),在向用户求助前按以下升级路径处理:
[char:…] [scene:…] [shot:…] 标签和每面板内容规则。♪ 标记的空白格),减少文字负载;通常能修掉标签糊掉但不影响视觉节拍。默认文本模式没有这套回退 —— 文本分镜失败只发生在模型无法产出连贯结构化文本时,遇到就直接回到 Step 5 修订该行表格。
任何片段渲染前必须先展示视频模型选项卡。选择写入项目简报,本项目所有片段沿用,除非用户后续修改。
视频模型选项卡:
镜头描述 列加 video_model: H3 或 video_model: Seedance2 字段,本项目同时混用。未标记的行默认走 H3。视频模型确定后再展示分辨率选项卡:
首条片段渲染前用户必须先确认分辨率。后续用户可针对单条 hero 镜头临时改分辨率。
每行批准后调用选定的视频模型生成对应独立视频片段。每条片段必须严格使用单文本分镜文档中匹配的章节(若该章节已抽取成独立节点则从独立节点取)、角色卡和场景卡。
各模型通用规则:
[char:…]、[scene:…]、[shot:…]、[dur:…]、[hook:…])再渲染视频 — 这些是分镜专用参考标记,不能出现在最终片段里。铅笔分镜图还自带镜头号、镜头图标、箭头和备注,渲染时也要一并移除。单文本分镜文档(已抽取的镜从独立节点取)同时喂两个模型,但包在分镜外的 prompt 前缀不同:
Pixar-inspired 3D cartoon rendering, C4D + Octane look, stylized Q-version proportions, warm SSS skin, designed-with-detail hair, strong character design language, clean motion, on-brand color palette。cinematic Pixar-quality 3D animation, elastic squash-and-stretch performance, Disney-style anticipation and overshoot, dramatic key lighting, lens-specific depth of field。用户选了逐镜混合时,按该行 video_model 字段匹配的前缀。
H3 失败回退阶梯:
参考锚点 块的强化 H3 prompt 重渲染。placeholder: missing clip 标记。Seedance 2.0 失败回退阶梯(用户全局选了 Seedance 时,或 H3 已失败 3 次后):
参考锚点 块的强化 prompt 重渲染。按镜头顺序放到画布,归组为 <title> shot clips(不再硬编码单一模型名,因为项目可能混用 H3 和 Seedance 2.0),展示用户选项卡:
如果渲染片段与已批准的 参考锚点 漂移(门框落到错边、人物从错边离屏、光位翻转),用直接引用 参考锚点 块的强化提示重渲染;持续漂移时按混合模式切到另一模型;不要在拼接时静默混合修正版和未修正版。
所有单镜头片段批准后,按表格顺序拼接成完整主视频。然后生成一条连续 BGM 匹配故事氛围,嵌入拼接视频。
拼接与 BGM 规则:
[char:…] [scene:…] [shot:…] 双绑定标签。然后展示用户选项卡:
用户要求诊断或存在明显风险时,生成一段简短复盘文本节点。
检查:
参考锚点 列验证:每个地标是否落在表格说的位置)音频与对白轨 列)[char:…]、[scene:…]、[shot:…]、[dur:…]、[hook:…])每生成一个耐用产物,立刻按 STEP 0 顺序写到画布。生成工具自动上画布的不重复。
每个生产环节都归组:
<title> story planning。<title> character cards。<title> scene cards。<title> shot table。<title> text storyboards(默认模式,单文档)。抽取的独立文本分镜节点和铅笔分镜(可视化模式)各自分组:<title> extracted text storyboards 和 <title> multi-panel pencil storyboards。所有分镜组与渲染片段组分开,因为分镜含双绑定标签、镜头号、镜头图标、箭头和铅笔线。<title> shot clips(标签不再硬编码单一模型名,因为项目可能混用 H3 和 Seedance 2.0)。<title> final delivery。一轮生成产出 2 个或更多产物时,立刻归组并起一个清晰标题。渲染器位置未刷新导致归组失败时,请用户点击/拖动任一画布节点一次,再重试归组,必要时再进入下一个高成本环节。
每个需要用户确认的地方都用选项卡。不要用纯对话问题或散文代替。强制选项卡门:
默认推荐项放最前。始终允许用户自定义输入。用户说"继续"时按选了推荐项处理。
用户重做或修订任何产物时,下游步骤必须用最新批准的产物,不能用旧的。
规则:
任何重做后:
单张图、简单修图、单段镜头动画、logo 设计、纯提示咨询不用本 Skill。用户只要提示时,用视频提示工作流。用户只要角色卡时,用角色拆解工作流。