AI漫剧如何配音?AI配音从拆台词开始
AI漫剧要配音,先把台词按角色拆开,再到AI音频里选声线一句一句生成。不要整集读一条,也不要一上来就铺背景音乐,否则后面改一句会牵动全轨。
大多数翻车不是因为声音难听,而是脚本没拆干净:三个角色混在一段里,生成出来像同一个人念旁白。把台词拆清楚,配音就成了一半。
先把台词拆成一句一句
漫剧对话密,一段里可能同时出现男主、女主和旁白。不要把整段扔进去生成,那条音轨到最后基本没法用。
- 打开脚本文档,把每个角色的台词单独提出来,按行分开。
- 每行只放一句,或一个连续反应,不要一段到底。
- 给每行标上角色名和情绪,例如「女主·急」「男主·压低声音」。
- 背景音、音效提示单独放一类,不要混进台词里。
拆句时尽量短。超过两三行的句子,生成时容易赶、吞字,结尾也会变得奇怪。如果原台词真的很长,先拆成两短句,再分别生成。
情绪标记不用太复杂,有个统一词表就够用。常用情绪可以固定成:平静、急、怒、笑、低声、惊讶、哭、质问。每次都用同一套词,不要昨天写「生气」、今天写「发火」,后面想复刻都找不到参照。
你搜的AI配音,在本站对应的功能叫AI音频。下面开始动手时,直接用它就行。
在AI音频里选声线并试听
先 打开AI音频,把一句台词放进去试。不要一上来就批量生成,先让每个主要角色各试一句,找到能明显区分开的声线。
| 角色类型 | 声线方向 | 配音注意 |
|---|---|---|
| 年轻女主 | 清亮或温柔女声 | 语速可以稍快,句尾不要拖 |
| 年轻男主 | 干脆或低沉青年男声 | 语速中等,避免太过浑厚 |
| 旁白 | 平稳中性声线 | 情绪少一点,重点保证咬字 |
选声线时不要只看名字,要放一句真实台词去试。同一个角色的每一句,后面都必须固定用同一条声线,不要这里换那里换。
多角色搭配时,主角之间至少要有一个明显差异:一个偏亮、一个偏沉,或者一个语速快、一个语速慢。两个温柔女声放在一起,单听都行,合起来观众分不清谁在说话。
试听时别只听到前两秒就切走,要把整句听完,重点看结尾语气和标点停顿。如果试了几条都觉得不对,问题多半在台词断句,不是声线不够多。
声线数量和风格取决于所选模型。有些模型能调语速、情绪,有些不能,先把能固定的项固定下来。
逐段生成配音
不要一次性粘贴整集脚本。分段生成的好处是:哪句不对重做哪句,不用整段返工。
- 把某角色的一句台词放进输入区。
- 确认当前选的是这个角色固定使用的声线。
- 生成后听完整句,不要只看波形。
- 不满意就在原句上改:删多余语气词、把长句拆短、或调整标点。
- 同一角色继续下一句,保持上面的设置不变。
这一步可以在 AI音频里逐段试,生成一句存一句,不要攒到最后一起处理。生成时如果句子里有括号、表情描述,建议把括号内容改成实际情绪或直接删掉,否则可能被原样读出来。
每存一条,按「角色名_编号_情绪」命名,比如「女主_01_急」「男主_02_低声」。别用「音频1」「新建文件」这种名字,后面找起来会非常痛苦。
让同一个角色听起来是同一个人
单句听没问题,拼起来却像换了人,通常是三个原因:声线没固定、语速不一致、台词格式前后差别太大。
- 固定声线:每个角色只保留一条可用声线,不要重复创建相近的。
- 固定语速:如果所选模型支持语速调节,同一个角色所有句子调成同一档。
- 固定格式:角色名、标点、断句方式保持一致,不要有时写「他说:」有时不写。
- 已经有人声素材时,可以先上传到AI音频里试听,用来对齐整段配音的听感。音频素材上传后只帮你找参照,别把不同来源的干声混在一起当成品。
音量不一致也会让人觉得换了人。生成多句后,如果有的声音明显大、有的明显小,别急着调,先检查是不是原句情绪标记差异太大。真要统一音量,导出后进剪辑软件做,生成阶段只能尽量保持同一设置。
背景音乐和音效最后再叠
漫剧只有人声会干,但音乐不要一开始就加。否则后面反复调人声时,音乐会一直干扰判断。
- 先完成所有角色配音,并逐句确认。
- 导出干声,进剪辑软件把配音轨和画面先对齐。
- 再把背景音乐、环境音、转场音效铺在单独轨道上。
- 人声优先,音乐压低,音效短促,不要和台词抢频率。
AI音频也可以上传背景音乐和音效素材,和已经生成的配音放在一起试听。但最终混音建议留在剪辑软件里做,保留一条干净的人声轨。
上传背景音乐时,选纯音乐比带歌词的更好。带人声的音乐会干扰对白频率,尤其漫剧对话密集时,很容易糊成一片。音效素材宁短勿长,能盖过转场就够。
手机上做要注意什么
手机浏览器打开AI音频,和桌面操作基本一致。但手机生成时更容易被打断。
- 不要把页面切到后台,容易中断生成。
- 长文本先在备忘录里拆好,再按句复制过去。
- 听结果时插耳机,外放容易听不清吞字和尾音。
- 每生成一句确认保存后再操作下一句,别连着点。
- 网络不稳时,先关掉其它占用流量的应用,避免生成到一半超时。
如果手机存储空间紧张,导出的干声文件建议随手传云端或电脑,不要全堆在手机里。命名规则和桌面保持一致,后面到剪辑软件里才好对轨。
常见问题
为什么生成出来像念稿?
多半是句子太长、没标点,或情绪备注没删掉。拆短句、加标点,再去掉括号里的动作描述。
为什么两个角色听起来像同一个人?
声线没分开。回到声线选择,换一条差异更大的,别用两个太接近的温柔女声。
为什么单句没问题,拼起来节奏不对?
每句语速不一致,或者生成中间改过台词。统一设置后,只重新导出对应句子,不必全部重来。
音乐盖住人声怎么办?
把音乐音量降到人声以下,再在剪辑软件里手动拉低重点段落。不要指望生成时一次混好。
免费能用到什么程度?
配音和声线选择都可以在AI音频里完成,生成次数和可用时长取决于所选模型。建议先做一集短片段跑通流程,再批量做后面的。
导出的干声要留成什么格式?
能留无损或高质量格式就留,不要为了省空间直接存成低码率。对轨和后续混音时,干声质量直接决定成片质感。格式选项以导出时界面上可选的为准。