#6815 一直卡着不动

119.98.**4 Posted at: 4 hours ago

image
一直卡着不动

11 Replies

#1 DeepSeek reply at 4 hours ago

从截图来看(虽然无法直接查看图片内容),软件卡住不动常见于以下几种情况。请依次排查:

1. 正在下载模型(最常见原因)
语音识别/配音模型首次使用时需要在线下载,模型体积从几百MB到10G+不等,根据网络速度可能需要数分钟到数小时。此阶段进度条可能长时间不动。

  • 查看软件目录下 models/ 文件夹是否有新增文件
  • 如果网络不佳,建议手动下载模型放到对应目录(参考文档中手动下载方式)

2. 进程仍在运行但界面无响应
基于 PySide6 的界面在处理大文件时,UI 线程可能短暂无响应。请打开任务管理器查看 Python 进程 CPU/内存占用是否在持续变化:

  • 若 CPU 占用持续高位 → 正在处理,请耐心等待
  • 若 CPU 占用为 0 且长时间不变 → 可能已死锁

3. 模型下载失败导致假死
国内网络访问 huggingface.co 失败时,软件会自动切换国内镜像,但镜像站也可能限流。若下载失败,任务可能陷入等待状态。

  • 解决方法:手动下载模型后重启任务(文档中列出了所有模型的下载地址和存放位置)

4. 日志排查
请打开软件目录下 logs/ 文件夹,找到日期最新的日志文件(如 20260624.log),查看最后30行报错信息。


请提供以下信息以便进一步分析:

  • 软件左上角版本号
  • 卡在哪个阶段(是"语音识别中"/"翻译中"/"配音中"/"合并中"等)
  • 日志文件尾部约30行内容

请查阅相关文档:

#2 119.98.**4 reply at 4 hours ago

Resegment:ended

#3 DeepSeek reply at 4 hours ago

Resegment:ended 仅代表 LLM 重新断句阶段已结束,但后续流程可能因断句结果异常(返回空、格式错误、超时)而卡住。请按以下步骤排查:

1. 关闭 LLM 重新断句重试
进入 菜单 -> 工具 -> 高级选项 -> 通用设置,取消勾选 LLM重新断句,然后重新执行任务。若恢复正常,说明是断句环节导致。

2. 检查 AI 渠道配置
若必须使用断句,请确认:

  • LLM断句模型 选择的渠道(DeepSeek / OpenAI ChatGPT)已正确配置 API 密钥
  • 网络可正常访问对应 API
  • 模型支持超长上下文,建议设置 max token 为较大值,避免长字幕被截断

3. 查看日志中的报错
打开 logs/ 目录下最新日志文件,搜索 Resegment:ended 前后的 ERROR / Traceback 信息,复制末尾约30行提供。

4. 克隆音色时禁用断句
若配音角色选择了 clone强烈不建议启用 LLM 重新断句(截取的参考音频可能错位),请改为默认断句。

5. 检查断句结果是否为空
若断句后字幕文件为空,会导致后续流程无法继续。可临时将 高级选项 -> 语音识别参数 中的 最长语音持续秒数 调小(如 6~10),最短语音持续毫秒 调大(如 3000~4000),并勾选 合并过短字幕到邻近

若以上仍无法解决,请提供:

  • 软件左上角版本号
  • 卡住时界面显示的阶段(如"语音识别中/翻译中/配音中")
  • 日志文件尾部 30 行内容

请查阅相关文档:

#4 119.98.**4 reply at 4 hours ago


Application started at 2026-08-23 01:49:16

[DEBUG] 上次缓存的角色:No,字幕嵌入类型:0,发音语言:英语,目标语言:简体中文,目标语言代码:zh-cn,模型:large-v3,TTS渠道[0]
[DEBUG] NVIDIA_GPU_NUMS=1
[DEBUG] Found 1 GPUs, cost=1s
[DEBUG] process_max_gpu=1,is_multi_gpus=False
[DEBUG] Concurrent task_nums=1, process_max_cpu=0
[DEBUG] 返回缓存的编解码器 Windows-264: h264_nvenc
[DEBUG] start 9 jobs
[DEBUG] 返回缓存的编解码器 Windows-265: hevc_nvenc
[WARNING] 无法连接 huggingface.co, 使用镜像替换: hf-mirror.com
HTTPSConnectionPool(host='huggingface.co', port=443): Max retries exceeded with url: / (Caused by ProxyError('Unable to connect to proxy', NewConnectionError(': Failed to establish a new connection: [WinError 10061] 由于目标计算机积极拒绝,无法连接。')))

Logging error

Traceback (most recent call last):
File "urllib3\connection.py", line 198, in _new_conn
File "urllib3\util\connection.py", line 85, in create_connection
File "urllib3\util\connection.py", line 73, in create_connection
ConnectionRefusedError: [WinError 10061] 由于目标计算机积极拒绝,无法
......
ms_len': 3, 'streams_audio': 1, 'video_streams': 1, 'color': 'yuv420p'}

[DEBUG] 开始语音识别:渠道0
[DEBUG] [新进程任务 开始:STT use large-v3]
[DEBUG] 任务参数:kwargs={'detect_language': 'en', 'model_name': 'large-v3', 'logs_file': 'D:/pyvideotrans/tmp/18936/20208fa2f3/faster-en-1787429266.171828.log', 'is_cuda': True, 'no_speech_threshold': 0.6, 'condition_on_previous_text': False, 'speech_timestamps': None, 'audio_file': 'D:/pyvideotrans/tmp/18936/20208fa2f3/en.wav', 'local_dir': 'D:/pyvideotrans/models/models--Systran--faster-whisper-large-v3', 'compute_type': 'default', 'jianfan': False, 'audio_duration': 14425003, 'hotwords': None, 'prompt': '', 'beam_size': 5, 'best_of': 5, 'temperature': '', 'repetition_penalty': 1.0, 'compression_ratio_threshold': 2.4, 'max_speech_ms': 5000, 'device_index': 0}
[DEBUG] GPU进程池:max_workers=1
[DEBUG] [faster_whisper]加载模型:当前 is_cuda=True,_compute_type='default'
[DEBUG] faster-whisper模式下,对large-v3模型返回的断句结果重新修正
[DEBUG] 断句结果重新修正完毕
[DEBUG] 返回识别结果
[WARNING] _signal_of_process timed out after 1 hours: D:/pyvideotrans/tmp/18936/20208fa2f3/faster-en-1787429266.171828.log


Logging error

Traceback (most recent call last):
File "logging\__init__.py", line 1103, in emit
AttributeError: 'NoneType' object has no attribute 'write'
Call stack:
File "threading.py", line 973, in _bootstrap
File "threading.py", line 1016, in _bootstrap_inner
File "threading.py", line 953, in run
File "videotrans\configure\base.py", line 180, in _signal_of_process
File "logging\__init__.py", line 1489, in warning
File "logging\__init__.py", line 1624, in _log
File "logging\__init__.py", line 1634, in handle
File "logging\__init__.py", line 1696, in callHandlers
File "logging\__init__.py", line 968, in handle
File "logging\__init__.py", line 1108, in emit
Message: '_signal_of_process timed out after 1 hours: D:/pyvideotrans/tmp/18936/20208fa2f3/faster-en-1787429266.171828.log'
Arguments: ()

#5 DeepSeek reply at 4 hours ago

日志显示两个关键问题:代理错误导致模型下载/连接失败,以及语音识别子进程超时挂起。这正是卡住不动的直接原因。

核心原因:

  1. ProxyError: Unable to connect to proxy (WinError 10061 目标计算机积极拒绝) — 软件尝试通过代理访问 huggingface.co 时,代理端口未运行或地址错误,导致连接被拒。虽然软件尝试切换镜像 hf-mirror.com,但底层代理依然干扰网络。
  2. _signal_of_process timed out after 1 hours — faster-whisper 语音识别子进程执行超过 1 小时未返回,已挂起。这通常由 显存不足(large-v3 模型需 8GB+ 显存)或 模型加载失败 导致,而模型加载失败与上面的代理错误直接相关。

处理步骤(按顺序执行):

  1. 清空错误代理
    进入 菜单 -> 设置,找到代理设置项,将文本框清空后保存。若软件内无代理设置,请检查系统环境变量 http_proxy / https_proxy,删除或改为正确的代理地址(如 http://127.0.0.1:7890,需确保代理软件已运行)。
    也可直接在软件根目录创建空文件 noproxy.txt 强制绕过代理。
  2. 重启软件
    子进程已经挂起,必须完全关闭 sp.exe 后重新启动,才能恢复进程池。不重启直接重试依然会卡住。
  3. 降低模型负载(第二次尝试时配置)

    • 主界面语音识别模型改为 mediumlarge-v3-turbo(turbo 显存约 6GB,速度更快)。
    • 进入 菜单 -> 工具 -> 高级选项 -> 语音识别参数

      • 计算数据类型 改为 int8(最省显存,速度较快)
      • beam_sizebest_of 均改为 1
      • 取消勾选 启用上下文感知
    • 若视频时长超过 2 小时,建议先切片处理,否则 large 模型极易显存溢出。
  4. 确认模型文件完整
    软件目录/models/models--Systran--faster-whisper-large-v3 文件夹下检查文件是否齐全(至少包含 model.binconfig.json)。若不完整,删除该文件夹后重启任务,让软件重新下载(需先解决代理问题)。

若执行上述步骤后仍卡住,请提供:软件左上角版本号、再次运行后 logs/ 目录下最新日志文件尾部 30 行。

请查阅相关文档:

#6 119.98.**4 reply at 4 hours ago

我是要挂加速器吗?

#7 DeepSeek reply at 4 hours ago

不一定必须挂加速器。你的日志显示 无法连接 huggingface.co 后已自动切换到镜像 hf-mirror.com,但镜像下载仍被残留的代理设置拦截,报 ProxyError: Unable to connect to proxy

按以下情况处理:

情况一:你不使用代理(加速器)

  1. 进入软件 菜单 → 设置,将代理文本框清空并保存。
  2. 检查系统环境变量 http_proxyhttps_proxy,如有则删除。
  3. 重启软件后重新执行任务。软件会直接走国内镜像下载模型。

情况二:你使用代理(加速器)

  1. 先确认代理软件已正常启动,端口有效(例如 http://127.0.0.1:7890)。
  2. 在软件 菜单 → 设置 中填写正确的代理地址。
  3. 若代理软件本身不稳定,仍可能导致连接失败,建议临时关闭代理走镜像。

无论是否挂加速器,当前任务已经卡死,必须完全关闭 sp.exe 后重新启动再重试。

另外,日志中显示语音识别子进程已挂起超过1小时,说明模型加载失败或显存不足。重启后建议:

  • 将语音识别模型从 large-v3 改为 large-v3-turbo(显存需求约6GB)
  • 进入 高级选项 → 语音识别参数,将 计算数据类型 改为 int8beam_sizebest_of 均改为 1

如果镜像下载仍失败,可手动下载模型后放入 软件目录/models/models--Systran--faster-whisper-large-v3 文件夹内。

请查阅相关文档:

#8 119.98.**4 reply at 4 hours ago

我把网络代理删了 现在可以进行了吗

#9 DeepSeek reply at 4 hours ago

删除代理设置后,仍需完全关闭 sp.exe 并重新启动,因为之前的语音识别子进程已挂起,不重启无法恢复。重启后才能重新执行任务。

另外请确认两点:

  1. 系统环境变量:检查 Windows 环境变量中是否还有 http_proxy / https_proxy,如有请删除。仅删除软件内的代理设置可能不够。
  2. 模型完整性:进入 软件目录/models/models--Systran--faster-whisper-large-v3 文件夹,确认 model.binconfig.json 文件存在且完整。若缺失或不完整,请删除该文件夹,重启任务后让软件重新从镜像下载。

重新执行时建议先将语音识别模型改为 large-v3-turbo(显存需求约6GB,速度更快,兼容性更好)。

#10 119.98.**4 reply at 4 hours ago

模型完整性没问题 但是你这个系统环境变量是什么

#11 DeepSeek reply at 4 hours ago

系统环境变量是 Windows 操作系统层面的网络代理设置,它会作用于所有程序(包括 pyVideoTrans)。你之前使用过的代理软件(如 Clash、V2Ray 等)可能自动修改了系统环境变量,即使你在软件里清空了代理,系统层面仍可能残留代理地址,导致软件联网时被错误代理拦截。

如何查看与删除:

  1. Win + R 打开运行窗口,输入 sysdm.cpl 并回车,打开系统属性。
  2. 切换到“高级”选项卡 → 点击“环境变量”。
  3. 在弹出的窗口中,分别在“用户变量”和“系统变量”列表中查找 http_proxyhttps_proxy 这两个变量。

    • 如果找到,选中后点击“删除”。
    • 如果没找到,说明系统代理未设置,无需处理。
  4. 也可以快速检查:在命令提示符(CMD)中输入:

    echo %http_proxy%
    echo %https_proxy%

    如果输出的是 %http_proxy% 本身(即变量名原样),说明没有设置;如果输出了类似 http://127.0.0.1:7890 的地址,则必须删除。

重要提醒:

  • 删除环境变量后,必须完全关闭 sp.exe 并重新启动,否则旧进程仍会携带旧的代理配置。
  • 如果你使用的是代理软件的“TUN模式”或“系统代理”功能,即使环境变量已删除,代理软件仍可能接管系统网络。请关闭代理软件的“系统代理”开关或退出代理软件。
  • 确认无代理后,重新执行任务,软件会直接走国内镜像下载模型。

如果仍有问题,请提供再次运行后 logs/ 目录下最新日志尾部 30 行。

请查阅相关文档:

Thinking...
Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource