#7368 很短的一段话,点开始后已经十几分钟了,还在 starting

2409**3098 Posted at: 1 hour ago

image
很短的一段话,点开始后已经十几分钟了,还在 starting

9 Replies

#1 DeepSeek reply at 1 hour ago

这是模型在首次使用时正在自动在线下载,卡在了网络下载环节。模型体积较大(几百MB到数GB),且主要从国外 huggingface.co 下载,国内网络不稳定或下载源连接失败时会长时间卡在 starting 无进度。

解决办法:

  1. 确认网络环境,国内建议开启科学上网(VPN/代理),或在主界面对齐控制行右侧的代理文本框填入可用的 http://127.0.0.1:端口
  2. 若无稳定代理,软件会自动切换国内镜像站 hf-mirror.com,但镜像站有频率限制、速度慢,仍可能卡住或下载失败。
  3. 建议手动下载模型:打开 软件目录/models/ 查看缺失的模型文件夹(如 models--Systran--faster-whisper-large-v3-turbo 等),前往对应地址手动下载全部文件并按标准目录名放入,重启软件。
  4. 若长时间无进度,可直接关闭软件,检查日志确认是否为下载错误,然后按上述方式手动补齐模型。

模型下载地址及手动放置方法参见文档。

请查阅相关文档:

#2 2409**3098 reply at 1 hour ago

模型已经下载好了

#3 DeepSeek reply at 1 hour ago

既然模型已下载完成,卡在 starting 十几分钟通常是模型未正确放置、模型文件不完整,或进程被卡死未进入实际识别阶段。

排查步骤如下:

  1. 确认模型存放位置与命名完全正确。以 faster-whisper large-v3-turbo 为例,应放置在 软件目录/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo 下,文件夹名称必须为标准的 models--xxx--yyy 格式,多一个字符、斜线写成单个 - 都会导致识别不出来而卡住。
  2. 确认模型文件完整。下载中断导致的文件不全会让软件卡在加载阶段。请逐个核对官方文件列表,缺失或疑似不完整的(如只下了一部分)建议删除整个模型文件夹后重新完整下载。
  3. 确认放置路径中不含中文、空格、特殊符号。软件目录强烈建议为纯英文数字路径,如 D:\pyVideoTrans
  4. 若以上均正确仍卡在 starting,检查是否启用了 CUDA 但显卡驱动/cuDNN 不匹配导致 GPU 初始化卡死。可先取消勾选「启用CUDA加速」用 CPU 跑一个短音频测试,若 CPU 下能正常开始,则问题在 CUDA 环境;若 CPU 下仍卡住,则为模型加载问题。

请先按第 1、2 步核对模型位置和完整性。如仍未解决,请提供软件安装目录下 logs/ 文件夹中最新的日志文件,复制底部约30行报错信息以便分析。

请查阅相关文档:

#4 2409**3098 reply at 1 hour ago

原始输入文件名: E:/pyvideotrans/tmp/12532/20260916-221044.txt,
输出结果保存到文件夹: E:/pyvideotrans/output/tts,
临时文件夹: E:/pyvideotrans/tmp/12532/6269ee6994
未启用CUDA加速
配音渠道:Qwen3-TTS(内置), 角色:en_female_2.wav, 配音语言:zh-cn
音量:+0%, 语速:+0%, 未选 音频加速
未选 移除字幕间空隙, 未选 强制对齐字幕和声音
[DEBUG] self.volume='+0%', self.rate='+0%', self.pitch='+0Hz'
[DEBUG] 当前使用配音渠道:Qwen3-TTS(内置)
[DEBUG] [新进程任务 开始:title='Qwen3-TTS dubbing...']
[DEBUG] 新进程任务 参数:kwargs={'queue_tts_file': 'E:/pyvideotrans/tmp/12532/6269ee6994/queuetts-1789567844.308862.json', 'language': 'Chinese', 'logs_file': 'E:/pyvideotrans/tmp/12532/6269ee6994/qwen3tts-1789567844.308862.log', 'is_cuda': False, 'model_name': '0.6B', 'prompt': '', 'is_redubb': False, 'device_index': 0, 'device_name': 'auto'}
[DEBUG] CPU进程池:max_workers=2
[DEBUG] Qwen-TTS本地内置渠道使用 0.6B 模型

#5 DeepSeek reply at 1 hour ago

这是正常的模型加载阶段,不是卡死。日志显示 Qwen3-TTS 内置渠道已启动子进程,正在加载 0.6B 模型。关键点:你未启用CUDA加速,且这是首次使用 Qwen3-TTS——即使是 CPU 模式,0.6B 模型第一次加载仍需从磁盘读取并初始化,叠加纯CPU推理,速度会非常慢。

请按以下判断:

  1. 首次使用需等待模型加载:日志停在「Qwen-TTS本地内置渠道使用 0.6B 模型」说明正在加载模型。首次加载 + CPU 推理可能需要数分钟到十几分钟,属正常范围,请耐心等待,不要重复点击。
  2. 确认模型文件是否已完整下载:Qwen3-TTS 内置需要两个模型:

    • 存放位置:软件目录/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base
    • 存放位置:软件目录/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-CustomVoice
      若这两个文件夹为空或不完整,进程会卡在加载阶段。请核对这两个目录内文件是否齐全。
  3. 硬件要求:Qwen3-TTS 属于本地大模型 TTS,强烈依赖 NVIDIA 显卡 CUDA 加速。你当前未启用 CUDA,纯 CPU 运行 0.6B 模型极慢,一段很短的话也可能耗时很久。若有 N 卡,请配置好 CUDA 12.8 + cuDNN 9.11 后勾选「启用CUDA加速」。
  4. 查看子进程日志:日志中给了子进程日志路径 E:/pyvideotrans/tmp/12532/6269ee6994/qwen3tts-1789567844.308862.log,打开该文件查看是否有加载报错或进度信息,能准确判断是加载中还是已出错。

建议:先打开上述子进程 log 文件确认状态;若长时间无任何新增输出,优先怀疑模型缺失或不完整,并考虑改用对 CPU 友好的配音渠道(如 Edge-TTS)先测试流程是否通畅。

请查阅相关文档:

#6 2409**3098 reply at 1 hour ago

qwen3tts-1789567844.308862.log 是空文件

#7 DeepSeek reply at 1 hour ago

子进程日志为空,说明该进程在加载模型阶段就卡住或崩溃了,尚未进入任何实际推理输出。核心原因按可能性排序如下,请逐项排查:模型文件缺失或不完整(最常见)。Qwen3-TTS 需要两个模型目录都存在且文件完整:软件目录/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base软件目录/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-CustomVoice请进入这两个目录,核对文件是否齐全。若为空、或只有部分文件,进程会在加载时静默卡死,日志为空。不完整建议整个删除后重新完整下载。你现在使用了 clone 角色(en_female_2.wav)。前提确认:clone 音色只可用于「视频翻译」主功能,若这里是单独的文字配音功能使用 clone 参考音频,需确认参考音频文件已正确放入软件目录下的相关文件夹。但更关键的是第 1 点——模型加载失败,与音色无关。显卡/显存与计算设备问题。即便未勾选 CUDA,Qwen3-TTS 内部逻辑仍会「优先尝试使用GPU加速」。若无可用 GPU 或驱动异常,进程可能在设备初始化阶段挂起。可尝试在显卡设置中确认驱动正常,或查看系统是否装有 NVIDIA 驱动。排查顺序:1. 先检查上述两个 Qwen3-TTS 模型目录,这是日志为空的首要嫌疑。2. 用 Edge-TTS 测试同一段文本能否正常配音,若 Edge-TTS 正常,说明软件流程无问题,问题锁定在 Qwen3-TTS 本地模型的加载/环境。3. 若确认模型完整仍卡住,请把软件目录下 logs/ 文件夹中当天的日志复制底部约30行发来,以便进一步分析。请查阅相关文档:Qwen3-TTS(本地内置)手动下载模型

#8 2409**3098 reply at 1 hour ago

image

#9 DeepSeek reply at 1 hour ago

截图显示软件卡在最后一行 [DEBUG] Qwen-TTS本地内置渠道使用 0.6B 模型,且子进程日志为空,说明 Qwen3-TTS 的加载过程在设备初始化或模型读取时挂起了。

核心排查:

  1. 首选验证:换 Edge-TTS 测试。将配音渠道换成 Edge-TTS(免费),用同一段文本重新执行。若 Edge-TTS 能正常出结果,则软件主流程无问题,可以确定问题就锁定在 Qwen3-TTS 本地模型本身或 CUDA/设备环境。
  2. 检查模型是否完整。进入以下两个目录核对文件是否齐全(这一步很关键):

    • 软件目录/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base
    • 软件目录/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-CustomVoice

    若为空、或文件只有一两个、或只有一部分,进程会在加载 stage 静默卡死、日志为空。不完整就删掉整个目录重新完整下载。

  3. 检查 GPU/驱动环境。Qwen3-TTS 内部逻辑会「优先尝试使用GPU」。即使你没勾选 CUDA,它仍会去找 GPU。若无可用 N 卡或驱动异常,进程可能在设备初始化时挂起。可打开命令行执行 nvidia-smi 确认驱动正常。若有 N 卡但版本老旧,请更新驱动,并按文档配置 CUDA 12.8 + cuDNN 9.11 后再勾选「启用CUDA加速」。
  4. 首次加载耐心等待。0.6B 模型首次从磁盘加载 + 纯 CPU 初始化的确可能耗时较久,但如果超过几分钟且子进程 log 始终为 0 字节,基本可判定为加载卡死而非正常耗时。

建议执行顺序:先用 Edge-TTS 跑通确认流程,再逐一核对第 2、3 点。若确认模型完整、驱动正常仍卡住,请将 软件目录/logs/ 下当天日志复制底部约 30 行发来进一步分析。

请查阅相关文档:

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource