SKILL.cn.md


name: paper-collage-explainer-generator description: | 面向内容创作者、教育讲解者和社交视频编辑,用触感纸拼贴语言表现口播句、知识点、观点或抽象主题。用户提供短文案、故事节点或核心概念,也可补充画幅、时长、色调和音频需求。Skill 会提炼含义与视觉隐喻,制定制作方案和分镜,生成并确认半调纸拼贴静帧,再制作带纸片滑入、弹入、轻敲、压平和摩擦声的停格动画片段,并可按需合成完整讲解视频。默认保留拼贴音效,不主动添加 BGM、旁白和字幕。适合知识讲解、观点表达、故事配画和社交 B-roll,不适合真人口播广告、精确可编辑图层、复杂文字排版或仅输出提示词。 trigger-words: [paper collage explainer, paper-collage animation, halftone collage, collage explainer, 纸拼贴, 拼贴科普, 定格拼贴, 拼贴动画]


纸拼贴讲解动画生成器

将一句口播、一个故事主题、观点句或抽象概念,转化为统一的编辑感纸拼贴动画序列。视觉语言是高级半调纸拼贴:大色块纸面、黑白半调照片剪影、选择性彩色卡纸点缀、暖白描边、柔和纸影、触感定格组装,以及清晰的拼贴音效。

这个 Skill 使用 Hub 原生图像、视频、音频和可选后期能力。它优先保证风格连续、色彩统一、纸张质感可控、定格拼贴节奏清楚,并采用新的音频策略:默认保留或生成触感拼贴音效,但明确默认不添加 BGM、旁白口播和字幕,除非用户要求。

适用场景

当用户需要以下内容时使用:

不适用于:

默认创作目标

除非用户另有说明:

音频策略

这个 Skill 的默认交付是:带拼贴音效,默认不添加 BGM、旁白口播和字幕。

  1. 在第一次制作方案确认时,必须明确写出默认媒体方式:保留或生成触感纸拼贴音效;默认不添加 BGM、旁白口播和字幕,除非用户明确要求。
  2. 对科普或讲解类内容,可以询问用户是否需要 旁白讲解/口播、BGM 或 字幕,但必须把它们作为可选增强,而不是默认项。
  3. 不要因为用户要“科普/讲解视频”就自动推断需要人声旁白。若用户没有选择旁白,就写无声视觉叙事节奏,而不是旁白稿。
  4. 不要因为用户要“社交视频”就自动推断需要 BGM 或字幕。若用户没有选择,就只保留拼贴音效。
  5. 生成视频片段时,如果模型支持音频,默认要求同步触感拼贴音效:纸片滑动、弹入、压平轻敲、轻微摩擦和小纸片脆响。
  6. 最终合成时,如果原片段音轨是拼贴音效,默认保留这些原始音轨,不要默认丢弃音频。
  7. 只有当用户要求静音、生成音频中出现不需要的人声/音乐,或用户要求另行混入音乐/旁白时,才移除或替换音频。只有用户明确要求时才生成或烧录字幕。

全局风格规则

对每张静帧和每段视频应用以下规则:

  1. 统一整体风格。 每段都应像同一套编辑感纸拼贴系列:半调剪影、大色块、暖白描边、柔和实体纸影、干净构图、触感纸材和协调的拼贴音效。
  2. 控制纸张质感强度。 纸张不能像完全扁平数字图层,也不能变得过旧、脏、皱或偏棕,除非用户明确要求。优先使用干净精致的手工纸质感:细纤维、轻微不规则撕边、浅层毛边、层叠接缝和软阴影。
  3. 统一色彩基调。 不要在未经确认时引入与静帧或整体色板冲突的牛皮纸、棕色、发黄或做旧底纸。每段从与已确认静帧主色一致的纸面开始。
  4. 让运动像停格拼贴。 使用明确纸片动作:逐片出现、滑入或弹入、轻微回弹、压平、暂停,然后锁定最终构图。避免快速旋转、过度翻飞、混乱飞散、全局淡入、平滑数字平移/缩放或泛泛漂浮。
  5. 保持段落协调。 当前一两段建立了批次风格和音效节奏后,后续片段和修订应参考该节奏与色调,让整支片子像同一系列。
  6. 默认制作精致 16:9 层次场景。 除非用户明确要求其他平台画幅,默认按 16:9 横版规划和生成。利用宽画幅建立前景/中景/背景层次、丰富环境道具、清晰主体层级和横向构图,不让画面变碎。
  7. 突出纸拼贴工艺。 每张静帧和每段视频都应让拼贴方法可见:可分离纸片组、半调照片剪影、彩色卡纸点缀、触感阴影、撕边、层叠接缝,以及弹入、滑入、轻微回弹、压平、暂停、锁定等停格动作。

STEP 1:解析输入

针对每条句子、概念、故事或主题,提炼:

若是故事主题,除非用户指定段落数,否则拆为 3–6 个简洁节点。相似节点可共享设计语言,但每段应有不同隐喻、物件、色场和音效节奏。

STEP 2:Gate 1 — 制作方案确认

在生成任何媒体前,先创建简洁制作方案文档,并等待用户确认。用户确认前不要生成静帧或视频。

制作方案必须包含:

Brief

视觉隐喻

每个计划段落包含:

脚本 / 视觉节奏轨

只有当用户明确要求旁白时,才写简洁旁白稿。若用户没有明确要求旁白,不要写旁白稿;改为写无旁白视觉节奏轨,说明观众将通过画面理解什么。

如果用户只需要为已有句子制作 B-roll,则保留原句作为上下文,不要发明旁白。

分镜

每个段落包含:

展示制作方案后,等待用户批准、否定或修改。如果用户只批准部分编号,只推进已批准部分并修改其余部分。

STEP 3:建立静帧规格

制作方案确认后,为每个已批准段落写紧凑的视觉规格,规格应能直接用于图像生成。

包含:

使用以下风格签名:

flat bold color field, black-and-white halftone photographic cut-outs, selective colored cardstock accents, warm cream keylines, soft paper shadows, fine uncoated-paper grain, premium editorial paper collage, clean refined hand-torn paper edges, subtle fibrous edges, layered paper seams

色彩建议:

不要把钴蓝作为自动默认色。通过纸张质感、半调处理、描边、阴影、画幅和受控色板统一整批画面。只有当故事节点需要对比时才变化色场。

STEP 4:Gate 2 — 生成并确认静帧

为每个已批准段落生成一张最终静帧。静帧应看起来像未来动画的完成最后一帧。

静帧要求:

展示生成的静帧,并在视频生成前等待用户确认。如果静帧太忙、色彩不匹配、纸层过多、边缘太数字化或纸张过旧/过棕,应先修订静帧再生成视频。

STEP 5:规划停格组装

对每张已批准静帧,准备运动方案,并把已批准静帧视为完成最终画面。

默认运动顺序:

  1. 从与已批准静帧主背景一致的干净纸色场开始,而不是不匹配的牛皮纸或棕色底。
  2. 基础结构作为纸片滑入、弹入或压入。
  3. 角色、卡片、物件或主要隐喻元素入场。
  4. 次要物件逐个组装,带小幅回弹、压平和暂停。
  5. 最终关系锁定到已批准构图。
  6. 结尾短暂停留在完整静帧式画面上。

运动提示词指导:

Paper-collage stop-motion assembly. Start on a clean paper field matching the approved still's background color and tone. Assemble the scene piece by piece with tactile stop-motion timing: foreground, midground, and background paper groups appear in a readable order; each paper object appears, slides or pops in, lightly bounces, presses flat, pauses, and locks into place. Preserve the halftone dots, cream keylines, subtle fibrous torn edges, layered paper seams, soft shadows, paper grain, color field, and approved aspect ratio. End by holding the completed composition matching the approved still frame. Sound design: tactile collage SFX only, synchronized to paper-piece motion: soft paper slide, pop-in, press-flat tap, light rustle, and tiny paper snap where appropriate. Default: do not add BGM, voiceover, dialogue, or subtitles unless the user explicitly requested them. No mismatched kraft-paper opening, no brown/yellowed base unless approved, no fast spinning, no chaotic object flight, no smooth digital layer movement, no scene cuts, no camera move, no zoom, no morphing, no new objects, no text, no logos, no watermark, no UI.

STEP 6:生成带拼贴音效的 B-roll 片段

Gate 2 确认后,为每张已批准静帧生成一段视频。

生成要求:

默认使用 MiniMax-H3 生成视频。除非 MiniMax-H3 失败、不可用或无法满足硬性能力需求,不要要求用户选择模型。如果用户明确指定其他模型,保留该模型为主并只在必要时调整参数。

STEP 7:质量检查

按以下标准检查静帧和视频:

只要隐喻清楚、最终构图仍像已批准静帧,微小细节漂移可以接受。若出现严重漂移、文字、假 UI、开场颜色不匹配、未经允许的牛皮纸底、过脏过皱纸质、丢失停格组装、不需要的 BGM 或不需要的旁白,应根据问题发生阶段重生成或后期处理。

STEP 8:可选合成、音乐、旁白与交付

如果用户要求多片段故事视频,按确认的分镜顺序合成已批准片段,并默认保留每段原始拼贴音效。

只有当用户明确要求时才添加 BGM、旁白口播或字幕。若用户在片段已生成后要求 BGM 或旁白,应在保留拼贴音效的基础上混入,除非用户要求静音或替换原音效。

每个完成项交付:

批量任务按编号组织结果,并保留用户原始句子或故事节点。

故障处理

下载此文件