#7944 Error no file named pytorch_model.bin, model.safetensors, tf_model.h5, model.ckpt.index or flax_model.msgpack found in d

2602**b8 Posted at: 1 hour ago

Error no file named pytorch_model.bin, model.safetensors, tf_model.h5, model.ckpt.index or flax_model.msgpack found in directory D:/win-pyvideotrans-v4.14/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base.,Traceback (most recent call last):
File "videotrans\process\qwen_tts.py", line 63, in qwen3tts_fun
File "qwen_tts\inference\qwen3_tts_model.py", line 112, in from_pretrained

model = AutoModel.from_pretrained(pretrained_model_name_or_path, **kwargs)

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\models\auto\auto_factory.py", line 604, in from_pretrained

return model_class.from_pretrained(

File "qwen_tts\core\models\modeling_qwen3_tts.py", line 1876, in from_pretrained

model = super().from_pretrained(

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\modeling_utils.py", line 277, in _wrapper

return func(*args, **kwargs)

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\modeling_utils.py", line 4896, in from_pretrained

......
dels/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base.,Traceback (most recent call last):
File "videotrans\process\qwen_tts.py", line 63, in qwen3tts_fun
File "qwen_tts\inference\qwen3_tts_model.py", line 112, in from_pretrained

model = AutoModel.from_pretrained(pretrained_model_name_or_path, **kwargs)

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\models\auto\auto_factory.py", line 604, in from_pretrained

return model_class.from_pretrained(

File "qwen_tts\core\models\modeling_qwen3_tts.py", line 1876, in from_pretrained

model = super().from_pretrained(

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\modeling_utils.py", line 277, in _wrapper

return func(*args, **kwargs)

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\modeling_utils.py", line 4896, in from_pretrained

checkpoint_files, sharded_metadata = _get_resolved_checkpoint_files(

File "D:\win-pyvideotrans-v4.14\_internal\transformers4576\modeling_utils.py", line 989, in _get_resolved_checkpoint_files

raise OSError(

OSError: Error no file named pytorch_model.bin, model.safetensors, tf_model.h5, model.ckpt.index or flax_model.msgpack found in directory D:/win-pyvideotrans-v4.14/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base.

cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: D:/Baasir/Documents/A Day with a 22-Year-Old Manager of a Korean Internet Cafe that Runs 24_7.mp4,
输出结果保存到文件夹: D:/Baasir/Documents/_video_out/A Day with a 22-Year-Old Manager of a Korean Internet Cafe that Runs 24_7-mp4,
临时文件夹: D:/win-pyvideotrans-v4.14/tmp/3516/4d8d7fb0fd
已选 清理已存在
未启用CUDA加速
未选 降噪
语音识别:openai-whisper(内置), small, 发音语言: 英语, 断句方式:默认断句
翻译渠道:Google(免费),原始语言:英语,目标语言:简体中文, 已选 发送完整字幕
配音渠道:Qwen3-TTS(内置), 角色:clone, 配音语言:简体中文, 未选 二次语音识别
音量:+0%, 语速:+0%, 未选 音频加速, 已选 视频慢速
字幕: 嵌入硬字幕
代理地址:http://127.0.0.1:7897
video_duration_ms=984183


=
system:Windows-10-10.0.19045-SP0
version:v4.14
frozen:True
language:zh_CN
root_dir:D:/win-pyvideotrans-v4.14

1 Replies

#1 DeepSeek reply at 1 hour ago

这是模型下载不完整或下载失败导致的。Qwen3-TTS(内置) 的模型文件未成功写入本地目录,软件启动时找不到权重文件(model.safetensors 等),因此报错。此外,你选中了 clone 角色(音色克隆),Qwen3-TTS 的克隆功能依赖 Qwen3-TTS-12Hz-0.6B-Base 模型,该模型缺失时必然报此错。

解决方法(任选其一)

方法一:清空后重新自动下载(最简单)

  1. 关闭软件;
  2. 打开 D:/win-pyvideotrans-v4.14/models/,删除整个 models--Qwen--Qwen3-TTS-12Hz-0.6B-Base 文件夹(如果存在 models--Qwen--Qwen3-TTS-12Hz-0.6B-CustomVoice 也一并删除);
  3. 重新启动软件,再次执行任务,软件会重新在线下载模型(首次下载通常 1~3GB,耗时较长,请耐心等待并确保网络稳定)。

方法二:手动下载模型(自动下载反复失败时使用)

  1. 浏览器打开:https://huggingface.co/Qwen/Qwen3-TTS-12Hz-0.6B-Base/tree/main
  2. 点击下载该页面中的全部文件(含 model.safetensors、config.json、tokenizer 相关文件等);
  3. 将所有文件放入 → D:/win-pyvideotrans-v4.14/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base

    注意:不要放在子文件夹里,是直接把文件平铺放入该目录;若存在同名文件被浏览器自动重命名(如 model(2).safetensors),必须改回原名。

方法三:改用其他配音渠道(无需下载大模型)

如果不需要音色克隆,可把配音渠道换为 Edge-TTS(免费),速度最快且无需下载模型;若仍需要克隆音色,可改用 OmniVoice-TTS、Confucius-TTS、ChatterBox 等同样支持 clone 的渠道。

附加提醒(针对你的任务配置)

  1. 使用 clone 角色时,请在 菜单 → 工具 → 高级选项 → 语音识别参数 中把 最短语音持续(毫秒) 设为 3000 以上,否则参考音频切片过短,会导致配音失败或音质异常;
  2. 建议同时勾选「设置更多参数 → 分离人声背景声」,可显著提升克隆音质;
  3. 你未启用 CUDA 加速,Qwen3-TTS 走 CPU 会非常慢;若为 N 卡且已配置 CUDA 12.8 + cuDNN 9.11,建议勾选 启用CUDA加速。

请查阅相关文档:

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource