#5850 配音阶段出错 [OmniVoice(本地内置)] 系统错误 (None):NoneTraceback (most recent call last):

106.113.**0 Posted at: 20 days ago

配音阶段出错 [OmniVoice(本地内置)] 系统错误 (None):None
Traceback (most recent call last):

File "videotrans\task\job.py", line 35, in run

File "videotrans\task\job.py", line 154, in process_task

File "videotrans\task\dubbing.py", line 51, in dubbing

File "videotrans\task\dubbing.py", line 204, in _tts

File "videotrans\tts\__init__.py", line 207, in run

File "videotrans\tts\_base.py", line 94, in run

File "videotrans\tts\_omnivoice.py", line 119, in _exec

File "omnivoice\models\omnivoice.py", line 260, in from_pretrained

File "D:\TTS\win-pyvideotrans-v4.06\_internal\transformers\modeling_utils.py", line 4060, in from_pretrained

checkpoint_files, sharded_metadata = _get_resolved_checkpoint_files(

File "D:\TTS\win-pyvideotrans-v4.06\_internal\transformers\modeling_utils.py", line 573, in _get_resolved_checkpoint_files

raise OSError(

OSError: Error no file named model.safetensors, or pytorch_model.bin, found in directory D:/TTS/win-pyvideotrans-v4.06/models/models--k2-fsa--OmniVoice.
cfg=TaskCfgTTS(uuid='fbd8ff055d', name='D:/Users/Administrator/Documents/0041 配音用 字幕/0041-zh-CN.srt', dirname='D:/Users/Administrator/Documents/0041 配音用 字幕', noextname='0041-zh-CN', basename='0041-zh-CN.srt', ext='srt', target_dir='D:/TTS/win-pyvideotrans-v4.06/output/tts', cache_folder='D:/TTS/win-pyvideotrans-v4.06/tmp/912/fbd8ff055d', is_cuda=False, source_language=None, source_language_code=None, source_sub=None, source_wav=None, source_wav_output=None, target_language=None, target_language_code='zh-cn', target_sub='D:/Users/Administrator/Documents/0041 配音用 字幕/0041-zh-CN.srt', target_wav='D:/TTS/win-pyvideotrans-v4.06/output/tts/0041-zh-CN.wav', target_wav_output=None, tts_type=3, volume='+0%', pitch='+0Hz', voice_rate='+0%', voice_role='yingyufanben.wav', voice_autorate=False, video_autorate=False, remove_silent_mid=False, align_sub_audio=False)


=
system:Windows-10-10.0.19045-SP0
version:v4.06
frozen:True
language:zh
root_dir:D:/TTS/win-pyvideotrans-v4.06

5 Replies

OmniVoice 模型文件缺失,软件在 D:/TTS/win-pyvideotrans-v4.06/models/models--k2-fsa--OmniVoice 目录下未找到 model.safetensorspytorch_model.bin。这通常是由于自动下载失败(网络不稳定、被墙或下载中断)导致的。

解决方法

  1. 手动下载 OmniVoice 模型
    前往 Hugging Face 仓库:https://huggingface.co/k2-fsa/OmniVoice/tree/main
    下载该仓库内的所有文件(建议用 git clone 或直接下载 zip 包解压)。
  2. 将模型文件放置到正确位置
    放入文件夹:D:/TTS/win-pyvideotrans-v4.06/models/models--k2-fsa--OmniVoice
    (如果该文件夹不存在,请手动创建)
  3. 重启软件后重新执行配音任务。

若手动下载后仍报错,请检查文件夹内是否确实包含 model.safetensors 文件。

配音速度慢

配音速度慢有以下常见原因及对应优化方法:

  1. CPU 处理本地模型(如 OmniVoice、F5-TTS)

    • 本地 TTS 模型未启用 GPU 加速时会非常慢。
    • 解决:确保已勾选主界面的 CUDA加速,且已安装 CUDA 12.8+ 和 cuDNN 9.11+。
    • 若显存不足,可进入 菜单 → 工具 → 高级选项 → 字幕配音调整 降低 并发配音线程数(设为1)。
  2. Edge-TTS 等在线 API 受并发限制

    • Edge-TTS 短时间大量请求会触发 IP 限流,导致配音变慢或失败。
    • 解决:在 高级选项 → 字幕配音调整 中:

      • EdgeTTS配音渠道配音并发数 设为 1
      • 配音后暂停秒 设为 5~10 秒。
  3. 使用了 clone 音色克隆模式

    • 克隆模式需要从原视频中实时裁切参考音频并调用本地模型,本身比普通配音慢。
    • 解决:避免在克隆模式中同时启用 LLM重新断句,并在高级选项中设置:

      • 最短语音持续毫秒:3000
      • 最长语音持续秒数:10
      • 并勾选 Whisper预分割音频
  4. 其他通用设置

    • 检查 高级选项 → 通用设置 中的 CPU同时任务数GPU同时任务数 是否合理(通常 GPU 任务数设为1)。
    • 如果使用本地 TTS 模型,确保模型已下载完整,避免因模型错误导致回退到 CPU 慢速。

若以上仍无法解决,请提供具体使用的配音渠道名称是否启用克隆、以及硬件配置(CPU/显卡),以便进一步分析。

OmniVoice 速度慢

OmniVoice 作为本地运行的多语言语音合成模型,速度慢通常由以下几个原因导致,请按顺序排查:

原因 1:未启用 GPU(CUDA)加速

本地 TTS 模型极度依赖 NVIDIA 显卡硬件加速,CPU 处理会非常慢。

  • 解决:在主界面勾选 CUDA加速,并确认已正确安装 CUDA 12.8+cuDNN 9.11+
    检查方法:命令提示符输入 nvcc -V 验证 CUDA 版本。

原因 2:模型文件较大,显存不足

OmniVoice 模型体积较大,若显存低于 6GB 或与其他程序共享,可能自动降级到 CPU 运行。

  • 解决

    • 关闭其他占用 GPU 的程序(如浏览器硬件加速)。
    • 进入 菜单 → 工具 → 高级选项 → 字幕配音调整,将 并发配音线程数 设为 1,降低资源竞争。

原因 3:启用了音色克隆(clone 角色)

克隆模式需要从原始视频中实时截取参考音频片段,增加了处理时间。

  • 优化

    • 高级选项 → 语音识别参数 中设置:

      • 最短语音持续毫秒3000
      • 最长语音持续秒数10
    • 勾选 Whisper预分割音频
    • 确认参考音频时长在 3~10 秒内,避免截取失败导致重试。

原因 4:未选择最佳模型

OmniVoice 可能包含不同大小的子模型(若软件后续更新提供选择),若未选择,默认可能使用较大模型。

  • 当前版本:OmniVoice 作为内置渠道,模型固定,暂无可选型号。请保持 CUDA加速 开启。

原因 5:CPU 同时任务数过高

  • 检查 高级选项 → 通用设置 中的 GPU同时任务数,建议设为 1(除非多卡且显存充足)。

若以上调整后仍慢,请提供你的显卡型号和显存大小,以便进一步分析。

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource