AI 视频配音工作室
把音频和视频一键翻译成 90+ 种语言,保留原说话人的音色、情绪与时间轴,背景音乐原封不动
配音工作室界面
交互式工具即将上线
功能特点
- ✓ 支持 90+ 种语言互译,含英语、西班牙语、法语、德语、日语、中文、阿拉伯语等,API 用 BCP-47 语言标签指定,如 fr、es-MX
- ✓ 保留每位说话者的情绪、语气、时间轴和独特音色,不是机械朗读,语速和停顿跟着原片走
- ✓ 原始背景音乐与音效完整保留,换语言不用重新混音,观众听到的还是同一份配乐
- ✓ 上传本地文件或直接粘贴 YouTube、TikTok 等链接即可开配,网页端单文件上限 2GB 且不超过 180 分钟
- ✓ 默认走完全自动的 Dubbing v2 模型,需要逐句精修时切换到 v1 进 Dubbing Studio 手工编辑,再批量套用到多语言
使用步骤
- 打开配音页面,上传音频/视频文件,或粘贴 YouTube、TikTok 视频链接
- 选择源语言和目标语言(可一次勾选多个目标语言,按语言计费)
- 点击生成,等待自动识别说话人、翻译文本并合成新配音
- 试听后导出成品;如需精修,创建 Dubbing Studio 项目逐句校对再导出
常见问题
AI 视频配音工作室 是什么?
一款基于 ElevenLabs Dubbing 能力的在线配音工具:把音频和视频翻译成 90+ 种语言,同时保留每位说话者的情绪、时间轴、音色和原始背景音。输入:音视频文件或视频链接。输出:目标语言的配音音视频。
配音支持多少种语言?
官方文档显示支持 90+ 种语言,包括英语、西班牙语、法语、德语、日语、中文、阿拉伯语等。API 通过 source_language 与 target_language 传入 BCP-47 标签(如 fr、es-MX);部分方言需要在 Dubbing v2 支持列表内。
配音后还会是原来的声音吗?
会。配音过程会分离说话人、翻译文本,再以接近原说话者声线特征的新录音重建,目标是在另一种语言里复现同样的演绎,同时原始背景音保持不变,无需重新混音。
单个文件有什么限制?
按官方文档,网页端 Dubbing v2 上传文件需同时小于 2GB 和 180 分钟,两个条件都要满足。大批量素材建议用 API 做流水线处理。
自动配音和 Dubbing Studio 有什么区别?
新版默认使用全自动的 Dubbing v2,生成后无法编辑内容;如果需要逐句调整译文或口型同步,要选择 v1 旧模型并勾选创建 Dubbing 项目,进入 Dubbing Studio 手工精修。已生成的自动版本不能转成可编辑项目。
可以一次配多个语言吗?
可以,在语言选择器里勾选多个目标语言即可,但会按每种语言分别计费。建议先在编辑器里确定一个目标语言并完成校对,再把修改同步套用到其余语言,保证多语言版本一致。