#6201 我制作的视频是动画类的多角色对话类型的中文语音,如何使用咱们的这个软件直接把每个人的说话都改成英文的,然后画面还比较一致?

120.243* Posted at: 12 hours ago

我制作的视频是动画类的多角色对话类型的中文语音,如何使用咱们的这个软件直接把每个人的说话都改成英文的,然后画面还比较一致?

1 Replies

这是可以通过软件主流程“翻译视频/音频”完成的:先做中文语音识别,再翻译为英文,再逐角色配音,最后只替换音轨并可选加字幕,原视频画面本身不会被改动。多角色差异化配音需配合“说话人识别”和“单视频交互模式”实现。

操作步骤:

  1. 选择视频:打开软件默认“翻译视频”页,点击「选择视频或音频」选择你的动画视频(一次只选这一个,才会进入单视频交互模式)。
  2. 设置语言

    • 发音语言(原视频说话语言):选 简体中文
    • 目标语言:选 英语
    • 发音语言必须明确选中,不要选“自动检测”。
  3. 语音识别渠道(中文优化):

    • 推荐:Qwen-ASR(内置)阿里FunASR(内置)Firered中文(内置)
    • 或使用 faster-whisper(内置) 并选 large-v3 模型。
  4. 字幕翻译渠道(保证英文通顺):

    • 推荐 DeepSeekOpenAI ChatGPTGemini,并勾选「发送完整字幕」。
    • 也可用免费的 微软翻译
  5. 开启说话人识别(多角色分人关键)

    • 点击主界面「设置更多参数...」,勾选「识别说话人」,并在后面填入你认为的角色数量(如 3-5 人),可提高准确度。
  6. 配音渠道与角色分配

    • 选择 Edge-TTS(免费) 作为配音渠道,然后稍后在弹窗中为每个角色分别选择不同的英文男/女声。
    • 如果你希望“听起来还是原角色音色、但说英文”,则选 OmniVoice / Qwen-TTS / F5-TTS 等支持克隆的渠道,并把“配音角色”选中 clone。动画原声通常不太适合克隆(参考音频质量不可控),若效果差,建议直接用不同音色的英文配音。
    • 在单视频交互模式下:

      • 第一步:语音识别完成后会弹出“字幕修改窗口”,可修改错别字。
      • 第二步:字幕翻译完成后会弹出“发音角色分配窗口”,你可以为每个说话人分别指定一个配音角色,实现“角色 A 用男声、角色 B 用女声、角色 C 用童声”等效果。
  7. 画面保持一致

    • 画面本身不会被重绘,软件只替换原视频音轨并可选叠加字幕。
    • 不要勾选「视频慢速」,否则会对画面切片变速重编码,导致体积暴涨且画面帧发生变化。
    • 推荐勾选「音频加速」以处理配音时长超出原时长的问题。
    • 如果不想画面出现字幕:字幕类型选“不嵌入字幕”;若需要字幕,选“嵌入软字幕”不会影响画面,播放器可开关。
    • 输出画质如需控制:菜单 → 工具 → 高级选项 → 视频输出控制,可调 视频输出质量控制(CRF)压缩率
  8. 可选:背景音乐保留

    • 动画类视频往往有BGM,建议在「设置更多参数」中勾选「分离人声背景声」和「嵌入背景」,这样配音英文时背景音乐仍能保留。

注意事项

  • 说话人识别准确度有限,若角色音色分配混乱,可在“发音角色分配窗口”手动为每行字幕单独指定角色。
  • 一次只能选一个视频才能进入上述多角色分配交互窗口;批量多选则不会弹出该窗口。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource