#6423 CUDA failed with error out of memory:Traceback (most recent call last): File

38.125.**6 Posted at: 55 minutes ago

CUDA failed with error out of memory:Traceback (most recent call last):
File "videotrans\process\stt_faster.py", line 139, in faster_whisper
File "faster_whisper\transcribe.py", line 586, in _batched_segments_generator
File "faster_whisper\transcribe.py", line 120, in forward
File "faster_whisper\transcribe.py", line 209, in generate_segment_batched
File "faster_whisper\transcribe.py", line 1400, in encode
RuntimeError: CUDA failed with error out of memory

Traceback (most recent call last):
File "videotrans\task\only_one.py", line 62, in run
File "videotrans\task\_stage_recogn.py", line 62, in recogn
File "videotrans\recognition\__init__.py", line 206, in run
File "videotrans\recognition\_base.py", line 92, in run
File "videotrans\recognition\_whisper.py", line 41, in _exec
File "videotrans\recognition\_whisper.py", line 129, in _faster
File "videotrans\configure\base.py", line 267, in _new_process
videotrans.configure.excepts.VideoTransError: CUDA failed with error out of memory:Traceback (most recent call last):
File "videotrans\process\stt_faster.py", line 139, in faster_whisper
File "faster_whisper\transcribe.py", line 586, in _batched_segments_generator
File "faster_whisper\transcribe.py", line 120, in forward
File "faster_whisper\transcribe.py", line 209, in generate_segment_batched
File "faster_whisper\transcribe.py", line 1400, in encode
RuntimeError: CUDA failed with error out of memory

cfg=[TaskCfgVTT]当前工作模式: 翻译视频或音频 单视频模式
原始输入文件名: C:/Users/Administrator/Desktop/翻译片段/2.mp4,
输出结果保存到文件夹: C:/Users/Administrator/Desktop/翻译片段/翻译输出/2-mp4,
临时文件夹: D:/win-pyvideotrans-v4.08/tmp/2200/7eef8c9b43
未选 清理已存在
已启用CUDA加速
未选 降噪
已选 识别说话人,最大说话人数量不限制
语音识别:faster-whisper(内置), model_name: large-v3, 发音语言: 简体中文, 断句方式:默认断句
翻译渠道:Google(免费),原始语言:简体中文,目标语言:英语, 已选 发送完整字幕
配音渠道:Qwen3-TTS(内置), 角色:clone, 配音语言:英语, 未选 二次语音识别
音量:+100%, 语速:+0%, 已选 音频加速, 未选 视频慢速
字幕: 嵌入硬字幕
已选 仅输出mp4
代理地址:


=
system:Windows-10-10.0.19045-SP0
version:v4.08
frozen:True
language:zh
root_dir:D:/win-pyvideotrans-v4.08

1 Replies

这是典型的显卡显存不足(CUDA out of memory)导致的,发生在 faster-whisper 使用 large-v3 模型进行语音识别时。large-v3 基础运行就需要约 8GB 以上可用显存,如果显存不够或同时有其他程序占用,就会触发此错误。

请按以下顺序操作:

  1. 降低语音识别模型尺寸
    在主界面「语音识别」渠道保持 faster-whisper(内置),将模型从 large-v3 改为 mediumsmall,显存不足时优先使用 small
  2. 更改计算数据类型
    打开 菜单 → 工具/选项 → 高级选项 → 语音识别参数,将「计算数据类型」从默认改为 int8,可显著降低显存占用。
  3. 降低搜索精度
    同上,在「语音识别参数」中将「识别准确度beam_size」和「识别准确度best_of」均改为 1
  4. 关闭上下文感知
    在「语音识别参数」中取消勾选「启用上下文感知」,可减少显存消耗。
  5. 排查显存占用
    关闭其他占用显卡显存的软件(浏览器、游戏、其他AI工具),或者重启电脑后再只运行本软件。
  6. 如果上述步骤仍无法解决
    说明显卡显存不足以运行 faster-whisper 的本地模型,可改用在线语音识别渠道(如 OpenAI 语音识别、Gemini 语音识别、字节语音识别等),或者暂时取消勾选「CUDA加速」改用CPU处理(但速度会非常慢,仅建议用于验证问题)。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource