#6483 我想把YouTube上的英语游戏视频翻译成中文,角色配音,要和原视频音色一样,能实现吗

188.253.**1 Posted at: 2 hours ago

我想把YouTube上的英语游戏视频翻译成中文,角色配音,要和原视频音色一样,能实现吗

1 Replies

可以实现。pyVideoTrans 完全支持"英文视频 → 中文角色配音、保留原音色"的全流程。

操作步骤

  1. 将 YouTube 视频下载为本地 mp4/mkv/webm 等格式,放入纯英文路径(如 D:\videos\game.mp4)。
  2. 在主界面"翻译视频"中导入视频,进行如下配置:

    1. 发音语言:英语(源语言)
    2. 目标语言:中文(简体)
    3. 语音识别渠道:faster-whisper(内置),模型选 large-v3large-v3-turbo(推荐)
    4. 翻译渠道:优先选 DeepSeek 或 OpenAI 等 AI 渠道,并勾选「发送完整字幕」
    5. 配音渠道:选取支持音色克隆的渠道,如 OmniVoice(内置)、Confucius(内置)、Qwen3-TTS(内置)、F5-TTS(内置),本地 API 可选 GPT-SoVITS、CosyVoice、Index-TTS 等
    6. 配音角色:选择 clone(使用原视频说话人音色)
  3. 如需角色配音(不同说话人自动分配不同音色):

    • 点击「设置更多参数…」,勾选「识别说话人」,可预先设定说话人数(如 2)。
    • 在单视频交互模式下,字幕翻译完成后会弹出"角色配音分配窗口",可为每个说话人单独指定配音角色。
  4. 点击「开始」执行。

克隆音质最佳配置

菜单 → 工具/选项 → 高级选项 中调整:

  1. 禁止使用「LLM重新断句」,否则会破坏参考音频与时间轴对应。
  2. 语音识别参数

    • 最长语音持续秒数:6~10
    • 最短语音持续毫秒:3000~4000
    • 勾选「合并过短字幕到邻近」
  3. 主界面「设置更多参数」中,勾选「分离人声背景声」,可显著提升克隆音质。

注意

  • clone 模式会从原视频动态裁剪参考音频,若原视频有背景音乐/噪声,克隆效果会受干扰,强烈建议启用「分离人声背景声」并嵌入原始背景音。
  • 推荐使用 NVIDIA 显卡并勾选「CUDA加速」,否则本地模型处理速度会非常慢。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource