#6130 能不能做到翻译视频用到克隆的原声

38.113* Posted at: 14 hours ago

能不能做到翻译视频用到克隆的原声

1 Replies

可以,pyVideoTrans 支持在视频翻译中使用原音色克隆(voice cloning)。在主界面的「配音渠道」中选择支持克隆的渠道(如 OmniVoice-TTS、Qwen-TTS、F5-TTS、Confucius-TTS 等),然后在「配音角色」下拉框中选择 clone 即可自动使用原始视频中说话人的音色进行目标语言配音。

为获得最佳克隆效果,建议:

  1. 在主界面点击「设置更多参数」,勾选「分离人声背景声」以提高音质。
  2. 进入「菜单 → 工具 → 高级选项 → 语音识别参数」,设置「最短语音持续毫秒」=3000~4000,「最长语音持续秒数」=6~10,勾选「Whisper预分割音频」和「合并过短字幕到邻近」。
  3. 翻译渠道使用 DeepSeek 或 OpenAI 等 AI 大模型,并勾选「发送完整字幕」。
  4. 禁止使用「LLM重新断句」,以免时间轴错位导致参考音频截取错误。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource