AI 短剧术语表:20 个概念一次讲清
AI 短剧、竖屏微短剧、小说转视频、分镜脚本、段与分镜、角色一致性、参考图、音画同出、AIGC 标识……每条 60–120 字。
AI 短剧
用 AI 生成(而非实拍)制作的连续剧集,通常为竖屏 60–120 秒/集、几十集一部。生产链路是:小说/剧本解析 → 角色与场景设定图 → 分镜脚本 → 逐段视频生成 → 配音 → 整集合成。与「AI 视频」的区别在于跨集角色一致与剧集结构。
竖屏微短剧
面向手机竖屏(9:16)的短剧格式:单集 1–2 分钟、前 3 秒有钩子、每集结尾有悬念,付费模式为单集解锁或免费+广告。国内 2024 年市场规模约 505 亿元,海外以 ReelShort、DramaBox 为代表。
小说转视频
把小说文本自动改编成视频剧集的流程。真正的门槛在解析层:拆集、写出可被图像模型还原的角色外貌、无剧情残留的场景描述、每集的冲突与钉子。没有解析层的工具只是视频生成器。
分镜脚本
给视频模型执行的逐镜文字:每个分镜写景别与机位、画面里有谁、动作(写原因不写结果)、台词与说话人、布光(光源方位与色温)、秒数。AI 短剧里分镜文字就是提示词本身。
段与分镜(segment / shot)
段 = 一次视频模型调用,通常 10–15 秒(万相可 30 秒);分镜 = 段内的机位/景别切换点,一段 3–6 个。原则「段要长、镜要短」:段切碎成本翻倍,分镜过长节奏拖沓。
角色一致性
同一角色在不同镜头、不同集里保持同一张脸、同一身形与服装。实现靠四层:可还原的外貌文字、白底中性光定妆照、每段注入参考图、分镜只正向写画面里有谁。
参考图
随提示词一起送入视频/图像模型的图片,用来锁定角色长相、场景空间或道具材质。各模型上限不同(H3 ≤9 张、千问图像 ≤3 张、SeedDream ≤14 张),部分模型首帧图与参考图互斥。
定妆照 / 角色设定图
角色的参考图:纯白底、正面全身、方向主光 + 补光 + 轮廓光、中性表情、9:16。目的不是好看而是辨识度——烘进去的情绪与光会被每个镜头继承。
场景空景(plate)
无人、无剧情残留物的场景参考图:三层纵深、材质、光源位置。判据是「换一场戏来拍这个场景,不该出现的东西不写」——碎镜、血迹、人群都属剧情残留,会在案发前就出现在每一集里。
首帧 / 尾帧
给视频模型指定开头或结尾画面的图片。首帧能做段间连续,但在部分模型(如 H3)上与角色参考图互斥——要连续性就要放弃长相锁定,这是跨段站位漂移的机制性原因。
音画同出
视频模型在生成画面的同时生成人声与环境音,口型与画面里开口的人对应。支持的模型:MiniMax H3、Seedance 2.x、Wan 3.0、Veo 3、Sora。没有这一能力的模型需要后期配音与口型同步。
参考音频
绑定到角色的 3–8 秒音色样本,随段一起送入模型让人声保持同一音色。H3 限制总时长 ≤15 秒、≤3 条;预置音色库匹配比逐角色生成音色便宜两个数量级。
对白秒数
按语速把台词换算成分镜秒数:中文约 5 字/秒,英文约 2.5 词/秒,句尾标点每个 +0.75 秒。给多了模型会复读或拖长音节来填时间,给少了后半句压到下一个镜头。
钉子 / 钩子
短剧每集结尾的悬念(身份暴露、情感悬而未决、认知颠覆,轮换使用)和开头 3 秒内的抓人点。短剧完播与付费转化几乎完全由它们决定,解析层应逐集产出。
积分制计费
多数 AI 视频平台的计费方式:先买积分再按调用扣。比较时要折算到「每秒成片」或「每部剧」,并看清积分是否清零(Runway 月度不结转、Vidu 订阅积分 30 天)。
720P / 1080P / 2K 档位
视频生成的分辨率档位,价格通常相差 45–60%。做法是草片用低档,定稿再切高档;竖屏交付规格 1080×1920。
提示词改写(prompt extend)
模型平台用大模型自动扩写你的提示词(万相、千问图像等默认开启)。对短剧分镜必须关掉:改写器会冲掉切点、时长与朝向规则。
内容审核
模型平台对提示词与产物的合规审核。国内模型对血腥、尸体、暴露等措辞拒绝生成(万相 DataInspectionFailed 等),失败通常不计费;写分镜时把暴力停在因果两端。
AIGC 标识
对 AI 生成内容的显式/隐式标识。中国《人工智能生成合成内容标识办法》要求生成方与平台加标识,大陆平台默认带水印;海外平台按各自政策要求披露。
IAA / IAP 短剧
两种短剧变现模式:IAP(单集付费解锁)与 IAA(免费观看、广告变现)。2025 年起国内以 IAA 为主,对内容产量要求更高,是 AI 生产的主要切口。