用 WorkBuddy 做 AI 漫剧做到第二部时,卡在一个老问题上:分镜、出图都顺了,但配音库里找不到合适的中文 TTS,装配成片时 Flova 那边提示没有可用的配音技能。
后来我试了另一条路:让配音在本地干,WorkBuddy 只管装配。
我电脑装了 Python,用的是微软 edge-tts(免费、不限量、效果接近真人)。关键套路:
1. 配音脚本化:把剧本里每句台词按【角色+镜号】整理成清单,一个脚本循环调用 edge-tts,按镜号命名输出 mp3(镜2_苏晚.mp3、镜3_顾行舟.mp3),Flova 装配时直接对位放时间轴,不用手工拼接。
2. 分角色调声:edge-tts 每个中文声线音色都不同——女主用清冷女声、男主用低沉男声降音调、管家用老年声线降语速。同一句台词,"面无表情地念"才是喜剧效果,AI 同样能靠语速和音调调出来。
3. 时长提前对位:生成后顺手用 mutagen 读每个文件的秒数,写进时长清单,装配前就知道整集约多少秒,镜头间隙用 BGM 补,不浪费。
小测一句话:WorkBuddy 负责"做",本地脚本负责"声音",两段加起来,一集成片的音轨成本为零。这套流程我已经跑了三部片,稳得很。
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。