part06-漫剧制作常见技巧
大约 6 分钟
part06-漫剧制作常见技巧
1. Q版小人物的效果
前言
定义
dong
步骤:
- 将原版的三视图改成3D动漫Q版人物
- 输入主要提示词:
画面叠加3D立体动漫Q版变小版(xx角色) 在xxx头顶与肩头(xx地方)来回蹦跳,眉眼圆睁、满脸震惊激动,肢体动作夸张活泼,Q版人物以亢奋错愕的语气喊出台词: “xxx”,停顿半秒后,许柚柚做了个思考的动作说“xxx”
案例提示词 :
写实风格,12秒,9:16竖屏,搞笑喜剧氛围,明亮清新色调
【时间轴】
0-2秒:女孩第一人称视角(画面中不出现女孩的脸),女孩在病床上缓缓睁开眼睛,视线从模糊逐渐变清晰,看到白色的病房天花板、倒挂的输液瓶和输液管,镜头微微晃动表现刚醒来的恍惚感
2-4秒:第一人称视角转头,病房门被轻轻推开,一个帅气的男生图片节点 1走进来,随手关上门,手里提着一袋水果,走向病床,第一人称视角仰视他
4-6秒:男生图片节点 1在床边站定,微微弯腰,温柔地看着"我",表情关切,镜头轻微推近男生的脸
6-9秒:突然,一个Q版女孩小人图片节点 2(画中画形式,比正常人物小很多)从画面下方蹦出来,跳到男生图片节点 1的肩头上,在他肩膀上蹦蹦跳跳,手舞足蹈,表情夸张激动
【对白】(女孩声音,语速快,激动):"眼前这个人是我的死对头!他居然说他是我交往8年的男朋友!而且马上要结婚啦?!"
9-10秒:停顿一拍,Q版小人图片节点 2突然僵住,静止在男生肩头上,眼睛变成豆豆眼,画面安静,只有背景音
10-12秒:Q版小人扶额叹气图片节点 2,摇摇头,接着说话,表情从激动转为无奈,【对白】(女孩声音,语气转为无奈):“现在这个情况,还得从昨天说起”,画面逐渐变暗,暗示进入回忆
【声音】轻快滑稽的搞笑配乐 + 环境音效(心电监护仪滴滴声、开门声、脚步声)+ 女孩配音(6-9秒激动吐槽,10-12秒无奈叹气)
作业
练习一下吧,也可以在你的漫剧中增加这么一个角色,让故事更加生动有趣。(可以使用首尾帧+剪映进行替换哦)
2.场景图生成同空间侧面视角
前言
定义
在生成场景图的过程中,还有一个常见的需求,就是生成同空间的不同视角,时常会遇到生成出来的场景图,视角不对,导致家具、墙体、门窗结构错乱。

这里可以用即梦画布的多角度参考,最为方便。👇


3.参考视角
前言
定义
有些视角一时无法用语言表示,可以使用参考的视频视角,然后提供若干的图片,让模型参考这些图片,生成类似的视角视频。
比方说自己用手机镜像拍摄一组运镜视频或者在网上找的运镜视频作为参考,然后结合图片素材,生成类似的运镜效果,达到精品效果。


4.白模
前言
定义
白模(Whitebox / Greybox / Blockout),就是没有颜色、没有纹理的3D简易模型,只有空间结构和形状。
- 用简单的几何体(方块、圆柱)搭出房间、家具、人物的位置
- 标注主体在哪、运动轨迹是什么、镜头机位在哪
- 画面是灰白色的,像建筑模型的"毛坯房"阶段
一句话:白模 = AI视频的"动态分镜草图",先把空间和镜头定死,再让AI渲染细节。

为什么要用白模?
不用白模的痛点
| 问题 | 表现 |
|---|---|
| 空间失控 | 想让人物往左走,AI偏往右跑 |
| 运镜失控 | 想拍跟随镜头,结果镜头乱飞 |
| 人物走位乱 | 多人物场景,位置关系全乱 |
| 反复抽卡 | 改提示词没用,只能不停重生成烧钱 |
用了白模的效果
- ✅ 空间关系一次确定(人物在哪、家具在哪、镜头在哪)
- ✅ 运镜完全可控(推、拉、摇、移、环绕,提前设计好)
- ✅ 人物走位精准(从A点走到B点,路线画死)
- ✅ 从"猜AI怎么拍"变成"导演告诉AI怎么拍"
哪些模型支持白模
| 模型/平台 | 白模支持 | 说明 |
|---|---|---|
| 即梦 Seedance 2.5 | ✅ 完整支持 | 目前白模能力最成熟,官方主推功能 |
| Dreamina(CapCut海外版) | ✅ 支持 | 同属Seedance 2.5,3D Blockout to Video |
| 可灵 Kling | ❌ 暂不支持 | 没有白模参考功能 |
| 海螺 Hailuo | ❌ 暂不支持 | 没有白模参考功能 |
| Vidu | ❌ 暂不支持 | 没有白模参考功能 |
结论:目前做白模视频,首选即梦Seedance 2.5,是独家且最成熟的方案。

基础提示词:👇
@视频1 作为白模参考,参考其中的房间空间布局、人物从门口走到床边的走位、镜头缓慢推近的运镜方式。
不要复制白模的灰白颜色和圆柱体外型,根据白模轨迹重新生成真实画面。
场景是复古乡村卧室,土黄色泥墙,木质横梁,木床上有白色被褥,窗外绿色田野。
二次元动画风格,油画质感,暖色调午后阳光从窗户照进来,高细节,8K。5. 其他知识
前言
6.配音
前言
定义
1️⃣ 方式1:使用剪映中的音色
2️⃣ 方式1:即梦中有音色参考
3️⃣ 方式2:indexTTS
IndexTTS 2.0 是 B 站开源的零样本语音合成模型,核心能力:
- 5 秒音频就能克隆音色(不需要训练)
- 支持情绪控制(高兴、愤怒、悲伤、平静等)
- 毫秒级时长可控(可以精确控制每句话的长度,方便对口型)
- 完全免费、本地部署(数据不上传,隐私安全)
- 支持中文、英文、日文等多语言
一句话:录 5 秒某人的声音,以后输入任意文字,都能用这个人的声音读出来。
IndexTTS 替换视频音频 = 从视频提取 5 秒纯净人声 → 上传到 IndexTTS 克隆音色 → 输入台词生成配音 → 剪映里分离删除原音 → 导入新配音对齐口型
4️⃣ 方式3:使用ViiTorAI


还可以克隆自己的声音👇




生成好的音频,导入到剪映中,进行音频剪辑,调整音量,就可以使用了。
