本部分为自查证内容,来源均为公开报道与创作者本人的拆解,URL 附在各节。
| 维度 | 事实 |
|---|---|
| 作者身份 | 陈爱军,1991 年生,成都眼镜店老板,非设计科班,"纯小白"自学 AI 近两年 |
| 工作流 | Midjourney 出图 → 可灵 / 即梦 转视频(两句原话,没有更复杂的链路) |
| 爆款 | 一条 33 秒无台词无字幕短视频,被网友搬运至海外平台,不到 4 天播放破 500 万、4.8 万赞、转发 9700+ |
| 二次放大 | 外交部发言人毛宁在个人账号转发,配文"中式天堂长什么样"(数艺社报道) |
| 产量 | 抖音 50 万+ 粉丝,200+ 条作品,接近日更;单条制作 4–5 小时(状态好 2–3 小时) |
| 成本 | 画质要求不高 50–60 元/条;4K 画质 100–300 元/条;200 多条累计投入"数万元" |
| 变现 | 只靠抖音平台流量收益,未做商业授权;收支基本打平 |
| 下一步 | 计划 2026 年底/2027 年初做中国风修仙向 AI 短剧 |
读出来的三个关键结论:
来源:红星新闻/搜狐(2026-03-25,对话可梦智能 CEO 熊昺辉)
| 维度 | 事实 |
|---|---|
| 体量 | 81 集,单集平均 40 个镜头;上线 6 天播放破亿 |
| 团队 | 12 人,"AI + 人工"模式 |
| 周期 | 分镜 20 多天完成,整体制作约 30 天(真人剧前期动辄数月) |
| 成本 | 算力成本约 10 万元;真人短剧同体量 30–100 万元 |
| 流程 | 剧本 → 分镜 → 角色设定 → 场景设定 → 文生图 → 图生视频 → 剪辑 → 配音 |
| 已知短板 | ① 高速运动(御剑飞行、打斗)大场面边缘细节精度掉;② 复杂情绪("隐忍的愤怒""克制的喜悦""悲喜交加")还原不了,要么夸张要么平淡;③ 微表情(嘴角微颤、眼神闪烁、眉头轻蹙)不可控 |
| 补救体系 | "AI 生成 + 人工精准优化 + 专业指导"三层;用镜头语言兜底——慢镜头突出情绪、特写聚焦眼睛/面部、BGM 和音效强化氛围;剧本层面避免让 AI 承担超出能力的表演要求 |
这段访谈里最值钱的一句话是最后那句:不要去卷 AI 做不到的微表情,而是改剧本和分镜去避开它。这是所有 AI 视频项目能不能落地的分水岭。
来源:行者AI视频(@joshesye)《折腾 48 小时,我把神话里的天宫做成了 AI 视频》,经觉醒AI知识库转载。这是目前公开资料里最实操的一份天宫拆解。
作者的定序是:先看构图 → 再拆空间层次 → 然后决定镜头位置 → 最后处理建筑和人物的主次。 只对着参考图抄词("看到云海写云海")只能撞运气。
四个最容易崩的地方(原文四条铁律):
配色公式:白玉 + 冷青灰打底,暖金光只照重点,加一点朱红压细节。
作者的核心洞察:
画面越大,建筑越复杂,能交给模型的运动就越少。
第一版成片的问题是要么像动态 PPT,要么镜头晃动大、宫殿融化、远处人物崩掉。解决办法是"每次哪里崩了,就补一条限制",最终把一张静图拆成五个可写字段:时间轴 / 镜头 / 人物动作 / 环境动态 / 连续性约束。
各字段的具体要求:
可抄的 5 秒运镜提示词模板(原文简化版):
严格保持首帧构图与建筑结构。0 至 2 秒,镜头极慢速向前推进,云海从右向左缓缓流动,人物衣袖与发丝轻微摆动。2 至 5 秒,镜头轻微抬升,远处金色天光穿过云层,人物缓慢抬头。白玉阶、南天门、飞檐、立柱和栏杆全程固定,不变形,不位移。保持人物身份、服装和比例一致,不新增物体,不出现字幕与水印。环境声以高空风声和轻微衣袂声为主。
远景跑通后,作者做了一版"小师妹带我逛天宫"的 POV Vlog,关键工程是素材拆包:
片段示例(可直接套格式):
17 至 27 秒,月门望仙台。小师妹牵着镜头穿过月门,在栏杆旁停下。她抬手召出一只小云兽,云兽从掌边的薄雾里探出头,绕着她缓慢飞半圈。月门、栏杆与远处宫殿保持稳定。
作者的 6 条经验(原文照录):
他还把这两套规则做成了开源 Skill(Codex/Claude Skill 格式):
来源:数艺社/网易(2026-08-31)
两个 GitHub 开源技能包,装上就是"视觉导演 + 运镜导演":
Xianxia Visual Director(仙侠单帧画面视觉导演,负责出图)Xianxia Cinematic Video Director(仙侠多镜头视频运镜导演,负责出视频)三步复刻法:
技能内部会先"看清"素材图关键元素(汉白玉柱廊、红衣小人、远处重檐宫殿、侧逆光长影),再设计叙事运镜,而不是简单让图片动起来。
作者实测的构图输出值得记:一点透视柱廊引导视线延伸;右侧留 40%–60% 云海呼吸空间;暖金色晨光斜射;红衣人物立在画面约 3% 位置作为视觉锚点——和爆款参考图风格高度接近。这组数字就是"天宫感"的可量化配方。
同作者还有 liyue-aigc/female-outfit-director(女性换装导演),做古风卡点换装的完整规范,见 D4。
来源:FlowPix《AI绘画古风发饰怎么画不塑料?》(2026-07-14)
第一板斧——形制必须写准。 只写 "hairpin" / "hair accessory",形态全凭运气。正确写法是把形制和英文一起写死:
| 形制 | 正确写法 |
|---|---|
| 簪(单股) | zan, single-prong hairpin |
| 钗(双股) | chai, double-prong hairpin |
| 步摇(带坠流苏会动) | buyao, hairpin with dangling pendants that sway |
| 钿(花形片状) | dian, floral inlaid hair ornament |
作者建议新手从步摇入手:流苏坠子辨识度高,AI 容错率大。钗和钿细节多,画崩概率高。
第二板斧——材质词要写出工艺和透感(塑料感的根子在材质词太笼统):
| 目标 | 关键词 |
|---|---|
| 金 → 不要亮闪塑料金 | aged gold with subtle matte finish, fine filigree work, granulation texture(filigree=花丝,granulation=炸珠,两个古代金工技法词一加立刻有工艺感) |
| 玉 → 温润透 | translucent nephrite jade, soft inner glow, pale celadon tone |
| 珍珠 | lustrous freshwater pearls, soft iridescent sheen |
| 宝石火彩 | gemstone with light passing through, facet reflections |
第三板斧——光影让发饰立体: soft directional light from upper left, specular highlights on metal edges, subsurface scattering on jade, gentle shadow under ornaments
specular highlights 管金属锐利反光,subsurface scattering 管光透进玉石内部——这两个一搭配,金属和玉的质感就区分开了。flat lighting / even lighting,那种光下发饰必扁。dark blurred background,深褐或墨绿)才衬得出高光;浅背景会把发饰吃掉。第四板斧——朝代锁调性:
| 朝代 | 调性 | 关键词 |
|---|---|---|
| 唐 | 华丽、金灿灿大体量 | tang dynasty style, large gold buyao, ornate, rich |
| 宋 | 清雅、素银镶小玉 | song dynasty style, slender silver hairpin, minimalist, refined |
| 明 | 繁复、宝石堆镶 | ming dynasty style, gemstone inlaid dian, elaborate |
| 清 | 点翠烧蓝堆砌 | qing dynasty style, kingfisher feather inlay, turquoise enamel |
两条硬数据 / 硬经验:
dangling chains with individual pearl drops, separated strands, not tangled。来源:liyue-aigc/female-outfit-director SKILL.md
这是"一张图 → 卡点换装短视频"这类极高播放内容的工业级写法,几个可直接迁移的要点:
这份规范的价值不在具体参数,而在它示范了把"感觉"翻译成可执行约束清单的方法论——这正是业余和专业的分界线。
来源:shyman159/seedance-prompts-skill · prompt-craft-and-realism.md(由抖音"刺猬星球superi"37 集合集蒸馏)
核心理念:AI 图/视频"一眼假"的根因不是模型弱、也不是提示词不够长,而是你在"许愿"而不是用视觉语言下指令。
情绪 + 主体 + 光线 + 镜头 + 细节
词序就是优先级:
写"梦幻"它加烟雾,写"高级"它塞光斑,写"干净"它加纹理,写"自然"它加锐化。
| 你想说的 | 要写的 |
|---|---|
| 梦幻 | 低饱和 + 软光源 + 长焦压缩 |
| 高级 | 强光线对比 + 部分留白 |
| 质感 | 微弱侧光 + 高阴影对比 |
并直接告诉 AI 不要什么:无纹理、无锐化。
去摆拍感(视频),摆拍感来自镜头与画面关系不真实,与提示词无关,三因三解:
前景遮挡去 AI 味:
电影感 = 摄影约束先于美学:先写镜头类型/拍摄距离/光线结构,再写风格——90% 的人上来就写氛围,AI 只停在"图像渲染"而非"真实摄影"。
减法审美 + 剪词(让画面显贵):
避免动作崩坏:AI 眼里动词是"目标状态"不是"进行态"。
人物一致性(视频)——注意这句反直觉的结论:
参考图不是"参考人物",只是风格与结构输入。
三招:
声音一致性(AI 视频最易露馅的是声音):建角色声音参考库(把满意片段的音频抽出来存成独立文件,每次生成上传作参考)+ 独立配音模型设计音色 + 情绪声音库(同一角色"正常/愤怒/伤心"样本,按剧情选用)。
来源:Wayhhow/ai-video-shot-prompt-skill · keyword-library.md
超写实、极致逼真、真人实景拍摄(含人物场景,减少 CG 感)、电影动作捕捉(动作戏,真实物理感)、复古胶片质感
杜绝动作僵硬、杜绝人物畸形手指、杜绝穿模、杜绝肢体扭曲、杜绝人物漂浮、杜绝关节反向杜绝游戏CG感、杜绝塑料皮肤、杜绝过度磨皮、杜绝镜头漂移、杜绝水印、杜绝低分辨率杜绝光影不一致、杜绝影子方向错误、杜绝重力失真古风、青瓦白墙、红灯笼、青砖、油纸伞、丝绸、工笔重彩、水墨写意、黛青、朱红、宫墙、飞檐、长街雨巷 仙侠向:水墨、烟雨、竹林、剑光、留白、白衣
选一台真实存在的电影摄影机,按真实物理逻辑决定虚化/光斑/反射,而非随机拼凑:
ARRI Alexa 65 拍摄、ARRI Alexa Mini LF、RED V-Raptor 8K、Sony Venice 2Kodak Vision3 500T 胶片拍摄、Kodak Portra 400 色彩、Fuji Eterna Vivid 500iPhone 15 Pro 竖屏拍摄、大疆 DJI Mavic 3 航拍暖黄高光、金色阳光、琥珀色调;冷:青蓝冷调、去饱和冷调、深青阴影青橙对比(teal & orange)(电影最常用)、红青互补黄金时刻光线(magic hour)、蓝调时刻(blue hour)、黄昏侧逆光、黎明破晓光伦勃朗光(Rembrandt lighting)、轮廓光(rim light)、蝴蝶光