aimanju

这是本文档旧的修订版!


AI漫剧不是“把小说丢给AI,一键生成视频”,而是一条小型影视制作流水线:

选题/IP → 故事策划 → 剧本 → 分镜 → 角色与场景设定 → 分镜图 → 动态化 → 配音音效 → 剪辑包装 → 质检 → 发布复盘

AI主要负责提速,人仍然要控制故事、表演、镜头和审美。高质量与低质量漫剧的差距,通常不在于用了哪个模型,而在于有没有稳定的“制作标准”。

## 一、先弄清楚“AI漫剧”是什么

常见形式大致分为三档:

1. 静态漫画视频

  1. 漫画图片、推拉运镜、字幕、配音、音效。
  2. 成本最低,适合新手验证题材。

2. 动态漫

  1. 人物局部动作、嘴型、表情、头发、衣摆、镜头移动、特效。
  2. 性价比通常最高,也是当前比较实用的方向。

3. AI动画短剧

  1. 每个镜头都生成连续视频,角色有完整动作和表演。
  2. 效果上限高,但人物一致性、动作稳定性和成本控制最难。

建议新手从第二种开始:以高质量静帧为基础,再进行有限度动态化。不要一开始追求每个角色都跑跳打斗。

# 二、完整制作流程

## 1. 确定产品方向

开始制作前先决定:

- 发布平台:抖音、快手、视频号、B站、小红书、YouTube等。 - 横屏还是竖屏。 - 单集时长。 - 连载还是单篇完结。 - 受众是谁。 - 题材:逆袭、悬疑、恋爱、玄幻、都市、搞笑、科幻等。 - 画面风格:国漫、日漫、厚涂、写实、Q版、水墨等。 - 更新频率和预算。

这一步决定后面的节奏、镜头数量和制作成本。

例如竖屏短剧通常更强调:

- 前几秒必须出现冲突; - 对话短; - 近景和特写多; - 每隔几秒出现一次信息变化; - 结尾设置悬念。

## 2. 选题与故事策划

先写一个“一句话故事”,也叫故事梗概或Logline

一个被家族赶走的废柴少年,意外获得能听见古董声音的能力,并借此查出父亲失踪的真相。

然后继续确定:

- 主角想要什么; - 谁在阻止他; - 失败会失去什么; - 主角为什么必须现在行动; - 故事最大的差异化是什么; - 观众为什么要追下一集。

一个可连载的故事需要三层目标:

- 全剧目标:最终要解决的大问题。 - 阶段目标:每10~20集解决一个阶段问题。 - 单集目标:这一集发生什么变化。

## 3. 建立世界观和人物小传

### 世界观设定

包括:

- 时代和地点; - 社会规则; - 力量体系; - 阶级、组织和势力; - 货币、科技或法术; - 哪些事情允许发生,哪些不允许。

世界观最重要的不是“写得多”,而是规则不能前后矛盾

### 人物小传

每个主要人物至少要有:

- 姓名、年龄、身份; - 外形特征; - 性格; - 欲望; - 恐惧; - 缺点; - 秘密; - 与其他角色的关系; - 说话习惯; - 人物成长弧线。

人物弧线指角色从故事开始到结束发生的内在变化,例如:

从只相信力量,到学会相信伙伴。

角色只有外貌设定,没有欲望和缺点,就会像一个漂亮的纸片人。

## 4. 写剧集大纲

大纲不是完整对白,而是每一集发生什么。

可以按下面格式写:

- 本集目标; - 开场钩子; - 冲突升级; - 情绪转折; - 高潮; - 结尾悬念; - 下一集承接点。

例如:

第3集:主角参加鉴宝比赛。
开场:所有人嘲笑他带来一只破碗。
发展:对手故意要求现场验货。
转折:破碗发出声音,告诉主角自己内部藏有夹层。
高潮:夹层中出现失传印章。
结尾:评委看到印章后脸色骤变,说这是失踪者的东西。

高质量连载不是每集都靠“突然有人震惊”,而是要交替使用:

- 信息悬念; - 人物关系变化; - 危险升级; - 情绪回报; - 新问题出现。

## 5. 写正式剧本

剧本是“可以被拍出来的故事”,不等于小说。

小说可以写:

他心里涌起一阵无法言说的悲凉。

剧本需要把它变成可见、可听的内容:

林川攥紧父亲留下的旧表。
他想开口,却把话咽了回去。
林川:没事,我们走吧。

剧本通常包括:

- 场次编号; - 时间、地点、内外景; - 出场人物; - 动作; - 台词; - 必要的声音提示。

示例:

```text 03-02 旧货市场 日/外

人物:林川、摊主、围观者

林川停在一个破旧木箱前。

摊主 别碰,碰坏了你赔不起。

木箱里传来微弱的老人声音。

木箱(画外音) 找到我……我知道你父亲去了哪里。

林川猛然抬头。

切黑。 ```

### 写漫剧剧本要特别注意

- 台词要适合“说”,不要像书面文章; - 一句话尽量只表达一个意思; - 能用表情和动作表达的,不全靠旁白; - 每场戏都要发生变化; - 删除不推动剧情、人物或氛围的对白; - 动作难度要符合预算。

# 三、什么是分镜

分镜就是把剧本拆成一个个镜头,预先决定观众看到什么。

剧本写:

小雨进入房间,发现桌上放着一封信。她打开信,看到内容后惊呆了。

分镜可能拆成:

1. 房间全景:小雨推门进入; 2. 中景:她发现桌上的信; 3. 信封特写:写着她的名字; 4. 手部特写:撕开信封; 5. 主观镜头:信上的文字; 6. 脸部大特写:瞳孔收缩; 7. 门外黑影镜头:有人正在偷听。

同一段剧本,不同分镜会产生完全不同的节奏和悬念。

## 分镜表通常写什么

项目 含义
镜号 镜头编号
画面 这个镜头看见什么
景别 远景、全景、中景、近景、特写
机位 平视、俯视、仰视、侧面等
运镜 推、拉、摇、移、跟、环绕等
人物动作 谁做什么
台词/旁白 这个镜头对应的声音
音效 脚步、撞击、环境声等
时长 镜头持续几秒
转场 硬切、叠化、闪白、淡出等
素材方式 静帧、局部动画、图生视频等

## 常用景别

- 远景:交代环境、规模和孤独感。 - 全景:看清人物全身及动作。 - 中景:人物交流,腰部以上常见。 - 近景:强调表情和情绪。 - 特写:眼睛、手、物品、关键线索。 - 大特写:极强的情绪或冲击。

常见错误是整集全用半身正面镜头,效果会像“角色站着念台词”。

## 分镜、分镜图、动态分镜的区别

- 分镜脚本:文字表格,描述每个镜头。 - 分镜图/故事板:把镜头画出来,不一定精细。 - 动态分镜/Animatic:把分镜图按时间排好,加临时配音和音乐,提前观看节奏。

故事板本质上就是在正式制作前,用连续画面预演影视内容。动态分镜尤其重要,因为它能在昂贵的视频生成之前发现节奏问题。[Storyboard简介](https://en.wikipedia.org/wiki/Storyboard)

# 四、视觉设定与一致性管理

这是AI漫剧最容易翻车的部分。

## 1. 角色设定表

主要角色至少需要:

- 正面、侧面、背面; - 全身和脸部近景; - 常用表情; - 常用服装; - 身高比例; - 发型、瞳色、饰品; - 武器或标志性道具; - 禁止改变的特征。

建议为每个角色建立一份“角色圣经”:

```text 姓名:沈月 年龄:22 脸型:偏圆的鹅蛋脸 发型:黑色长发,右侧银色发夹 眼睛:浅灰色 服装:蓝白短款风衣,黑色长靴 识别点:右眼下方一颗小痣 禁止项:不能变成短发,不能改变发夹位置 ```

参考图不是可有可无。现在的生成系统一般通过角色参考图、风格参考和场景参考降低漂移;官方工作流也建议为重复出现的角色保存参考图、有效提示和失败禁忌。[Runway角色参考说明](https://help.runwayml.com/hc/en-us/articles/40042718905875-Creating-with-Gen-4-Image-References)

## 2. 场景设定表

固定场景也要设计:

- 空间布局; - 门窗位置; - 家具和道具; - 主色调; - 光线方向; - 白天、夜晚版本; - 不同拍摄角度。

否则同一个卧室会在下一镜突然多出一扇门。

## 3. 风格规范

需要固定:

- 线条粗细; - 上色方式; - 色彩饱和度; - 阴影类型; - 人体比例; - 镜头宽高比; - 光影风格; - 是否保留漫画网点、速度线、拟声字。

不要只写“精美、电影感、8K”。这种词无法真正约束风格。

# 五、从分镜图到动态画面

比较稳定的制作方法是:

1. 先生成并确认角色参考; 2. 生成每个镜头的静态关键帧; 3. 人工修正脸、手、服装、道具和构图; 4. 再把确认后的关键帧动态化; 5. 每个镜头单独生成; 6. 最后在剪辑中拼接。

相比直接用文字生成整段视频,先图后视频更容易控制构图和角色身份。目前的官方生成建议也强调:先得到正确静帧,再转成视频,并使用参考素材维持人物和场景一致性。[图生视频提示指南](https://help.runwayml.com/hc/en-us/articles/48324313115155-Image-to-Video-Prompting-Guide)

动态化时,提示重点应当是“运动”,例如:

```text 女孩缓慢抬头,先困惑,然后瞳孔收缩。 头发被微风轻轻吹动。 镜头缓慢推进。 背景人物保持不动。 ```

不要在图生视频阶段重新描述大量外貌,否则模型可能重新设计人物。

## 动作难度分级

新手先做:

- 眨眼; - 呼吸; - 轻微转头; - 头发和衣摆晃动; - 镜头推进; - 光影变化; - 烟雾、雨、粒子。

谨慎使用:

- 两人拥抱; - 复杂打斗; - 手持物品交接; - 快速跑动; - 多人同时表演; - 长时间连续对白; - 镜头内换装。

复杂动作可以通过“多镜头剪辑”绕开。例如打斗不必完整生成,而可以组合:

眼神特写 → 握拳 → 冲刺残影 → 撞击闪白 → 对手倒地 → 地面碎裂。

这就是镜头语言在替你省钱。

# 六、声音制作

声音至少占成片体验的一半,包括:

- 角色配音; - 旁白; - 环境声; - 动作音效; - 氛围音乐; - 情绪音乐; - 静音和停顿。

## 配音需要控制

- 每个角色的音色档案; - 年龄感; - 语速; - 情绪; - 重音; - 停顿; - 前后集音色一致; - 生僻字、多音字读音。

AI配音不要直接使用第一遍结果。台词要按表演拆开,例如:

```text “你……早就知道了?” ```

不能简单写成:

```text “你早就知道了” ```

前者包含迟疑、发现和质问,后者可能只被平淡地念出来。

## 音效分层

每场戏可以检查四层声音:

1. 人声; 2. 环境底噪; 3. 动作音效; 4. 音乐。

咖啡馆不能只有对白;雨夜不能只有雨声;打击动作不能只靠画面。

# 七、剪辑和后期包装

剪辑阶段要完成:

- 镜头节奏; - 配音对齐; - 字幕; - 音效; - 配乐; - 转场; - 调色; - 特效; - 片头片尾; - 封面; - 标题与发布文案。

## 剪辑顺序建议

先做声音版:

临时配音 → 分镜图 → 确认节奏 → 生成最终画面 → 精配音 → 音效音乐 → 字幕包装

不要先花大量时间生成高清画面,最后才发现剧情拖沓。

字幕不仅是把台词放上去,还要控制:

- 每行字数; - 断句; - 出现时机; - 是否遮挡人物; - 手机屏幕上的字号; - 重点词是否需要强调。

# 八、成片质检

发布前至少检查五遍:

## 剧情检查

- 前几秒有没有事件; - 主角目标是否清楚; - 观众能不能看懂人物关系; - 每场戏有没有推进; - 结尾是否让人想看下一集。

## 连续性检查

- 发型、衣服、饰品有没有变化; - 人物左右位置是否突然交换; - 道具有没有消失; - 场景结构是否改变; - 上一镜抬起的是不是下一镜同一只手。

## 画面检查

- 手指、牙齿、瞳孔; - 口型和表情; - 背景人物畸变; - 文字乱码; - 视频闪烁; - 镜头运动是否突然抽搐。

## 声音检查

- 音量是否忽大忽小; - 音乐是否盖住对白; - 角色音色是否串了; - 人名和生僻字是否读错; - 是否缺少环境声。

## 手机端检查

最终一定在手机上完整观看一次,因为电脑上清楚的字幕,手机上可能太小。

# 九、除了剧本和分镜,还要学什么

完整能力可以分成八组:

1. 故事能力

  1. 选题、人物、冲突、悬念、情绪、节奏、剧集结构。

2. 编剧能力

  1. 大纲、场次、动作、对白、伏笔、反转、人物弧线。

3. 导演与镜头语言

  1. 景别、构图、机位、调度、运镜、轴线、蒙太奇。

4. 美术能力

  1. 角色设计、场景设计、色彩、光影、服装、风格统一。

5. AI生成能力

  1. 提示设计、参考图、局部重绘、角色一致性、图生视频、失败素材修复。

6. 声音能力

  1. 配音导演、声音表演、音效设计、配乐和混音。

7. 剪辑能力

  1. 节奏、转场、字幕、画面衔接、声音衔接、情绪控制。

8. 制片与运营能力

  1. 素材管理、预算、排期、版权、平台规则、数据分析、系列化生产。

很多新手只学习第5项,所以会得到“画面漂亮但不好看”的作品。

# 十、高质量漫剧的核心标准

高质量不等于每一帧都极其精细,而是做到:

- 故事清楚:观众不会看不懂。 - 角色稳定:人物不会每个镜头换脸。 - 情绪准确:该紧张时紧张,该感动时感动。 - 镜头有效:镜头有叙事目的,不是随机切换。 - 声音可信:角色不是毫无情绪地念稿。 - 节奏紧凑:没有大量重复信息。 - 画面连续:服装、道具、方向和光线能接上。 - 风格统一:不会一会儿写实、一会儿二次元。 - 具有原创性:不是批量套模板、换名字、换图片。

以YouTube为例,平台并不是简单禁止AI内容,但会限制缺乏原创价值、批量生产或高度重复的内容,版权要求也仍然适用。[YouTube频道获利政策](https://support.google.com/youtube/answer/1311392?hl=en)

# 十一、新手最适合的练习路线

不要直接做100集连续剧。建议这样练:

### 第一阶段:30秒测试片

- 1个场景; - 1个角色; - 5~8个镜头; - 一次情绪变化; - 一句关键对白。

目标:学会完整走通流程。

### 第二阶段:1分钟完整故事

- 2个角色; - 2个场景; - 10~15个镜头; - 有开场、冲突、转折和结尾。

目标:解决角色一致性、对白和剪辑节奏。

### 第三阶段:3集试播集

- 每集1~2分钟; - 固定角色和场景; - 第一集建立冲突; - 第二集升级; - 第三集给阶段回报,同时留下新悬念。

目标:测试观众是否愿意追更。

### 第四阶段:再做批量化

只有试播数据和制作标准稳定后,才建立:

- 角色素材库; - 场景素材库; - 提示词模板; - 分镜模板; - 音效库; - 字幕模板; - 质检清单; - 文件命名规范; - 每集成本和工时统计。

# 十二、最容易被忽略的东西

除了剧本和分镜,还经常缺少:

- 导演意图:这一场到底想让观众感受到什么; - 表演设计:人物说台词时在想什么; - 连续性管理:服装、道具、位置、时间和光线; - 动态分镜:正式生成前先验证节奏; - 角色与场景资产库; - 声音设计; - 版本管理和文件命名; - 质量验收标准; - 版权与商业授权记录; - 平台运营和数据复盘; - 成本核算; - 稳定更新能力

一句话总结:

剧本决定观众想不想看,分镜决定故事好不好看,美术决定第一印象,声音决定代入感,剪辑决定能不能看完,一致性和制片流程决定能不能持续更新。
  • aimanju.1787236779.txt.gz
  • 最后更改: 2026/08/20 22:39
  • iteasyx