#6396 could not create a memory object:Traceback (most recent call last): File

116.162.**6 Posted at: 9 hours ago

could not create a memory object:Traceback (most recent call last):
File "videotrans\process\stt_faster.py", line 182, in faster_whisper
File "faster_whisper\transcribe.py", line 1851, in restore_speech_timestamps
File "faster_whisper\transcribe.py", line 1190, in generate_segments
File "faster_whisper\transcribe.py", line 1400, in encode
RuntimeError: could not create a memory object

Traceback (most recent call last):
File "videotrans\task\only_one.py", line 62, in run
File "videotrans\task\_stage_recogn.py", line 62, in recogn
File "videotrans\recognition\__init__.py", line 206, in run
File "videotrans\recognition\_base.py", line 92, in run
File "videotrans\recognition\_whisper.py", line 41, in _exec
File "videotrans\recognition\_whisper.py", line 129, in _faster
File "videotrans\configure\base.py", line 267, in _new_process
videotrans.configure.excepts.VideoTransError: could not create a memory object:Traceback (most recent call last):
File "videotrans\process\stt_faster.py", line 182, in faster_whisper
File "faster_whisper\transcribe.py", line 1851, in restore_speech_timestamps
File "faster_whisper\transcribe.py", line 1190, in generate_segments
File "faster_whisper\transcribe.py", line 1400, in encode
RuntimeError: could not create a memory object

cfg=[TaskCfgVTT]当前工作模式: 翻译视频或音频 单视频模式
原始输入文件名: D:/ike/咖啡心语/生肉/咖啡心语p4-50分钟.mp4,
输出结果保存到文件夹: D:/ike/咖啡心语/8月5日/咖啡心语p4-50分钟-mp4,
临时文件夹: E:/ike/win-pyvideotrans-v4.08-0802/tmp/17320/0a1dee1212
已选 清理已存在
未启用CUDA加速
未选 降噪
已选 删除所有标点符号
语音识别:faster-whisper(内置), model_name: large-v3-turbo, 发音语言: 英语, 断句方式:LLM重新断句
翻译渠道:DeepSeek,原始语言:英语,目标语言:简体中文, 已选 发送完整字幕
未选 配音角色,不进行配音
字幕: 嵌入硬字幕(双) 目标语言在上双字幕
已选 仅输出mp4
代理地址:


=
system:Windows-10-10.0.22621-SP0
version:v4.08
frozen:True
language:zh
root_dir:E:/ike/win-pyvideotrans-v4.08-0802

5 Replies

该报错的核心原因是 faster-whisper 底层的 CTranslate2 引擎在编码音频时内存分配失败(could not create a memory object)。你在未启用 CUDA 的纯 CPU 模式下使用 large-v3-turbo 模型处理约 50 分钟的视频,系统可用内存不足时极易触发此错误。

请按以下顺序排查:

  1. 降低模型规格:将语音识别渠道中的模型从 large-v3-turbo 改为 mediumsmall,先验证能否跑通。CPU 模式下大模型对物理内存需求很高。
  2. 确认系统空闲内存:关闭其他大型程序,确保至少有 8-16GB 可用内存后再重试。
  3. 启用 CUDA 加速(若有 N 卡):当前是纯 CPU 运行,效率低且内存压力大。如果你有 NVIDIA 显卡,请安装 CUDA 12.8+ 和 cuDNN 9.11,并在主界面勾选 CUDA加速
  4. 调低内存占用设置:进入 菜单 → 工具 → 高级选项 → 语音识别参数,将 计算数据类型 设为 int8(最省内存);同时确认 CPU同时任务数1,修改后需重启软件。
  5. 清理临时文件:删除 E:/ike/win-pyvideotrans-v4.08-0802/tmp 下的旧临时文件和缓存后重试。
  6. 建议修改路径:当前视频路径含中文和空格(D:/ike/咖啡心语/生肉/咖啡心语p4-50分钟.mp4),底层 FFmpeg 对特殊路径兼容性较差,建议将视频移到纯英文路径(如 D:/ike/coffee.mp4)再试。
  7. 若以上步骤均无效,请提供 E:/ike/win-pyvideotrans-v4.08-0802/logs/ 下最新日志文件底部约 30 行报错信息,以便进一步分析。

请查阅相关文档:

但我之前跑两个多小时都跑成功了 这次为什么50分钟就报错了

即使之前成功处理过更长的视频,本次 50 分钟报错“could not create a memory object”仍属于运行环境/内存状态问题,而非模型能力不足。核心原因包括:系统当前可用内存不足:你上次成功时可能空闲内存更多,或后台程序占用更少。本次系统内存被其他程序或临时缓存挤占,faster-whisper 在纯 CPU 下编码时申请不到足够内存。未启用 CUDA,纯 CPU 模式内存压力大:large-v3-turbo 在 CPU 推理时对内存需求较高,长时间连续任务会进一步加剧波动。临时文件堆积:上次成功任务后,临时目录中的缓存和碎片文件未清理干净,也可能影响本次资源分配。

请按以下顺序排查:1. 重启软件或电脑后再试,确保系统内存完全释放;2. 关闭其他占用内存的程序;3. 检查 E:/ike/win-pyvideotrans-v4.08-0802/tmp 目录,清空其中所有旧临时文件和缓存;4. 将 高级选项 → 语音识别参数 → 计算数据类型 改为 int8(最省内存);5. 若仍有内存,将模型从 large-v3-turbo 临时降为 medium 确认能否稳定跑通。

如果以上操作后仍然失败,请提供软件安装目录下 logs/ 文件夹中的最新日志文件(复制底部约30行报错信息),以便进一步定位是否与系统状态或特定片段相关。

将 高级选项 → 语音识别参数 → 计算数据类型 改为 int8(最省内存)会有什么坏处吗

将计算数据类型改为 int8 的主要坏处是识别精度会有所下降,可能表现为:个别词语识别错误、标点或同音字偏差、专有名词(人名、地名)偶发不准。

int8 是通过量化压缩模型计算精度来换取更低内存占用和更快速度,属于权衡方案。

如果你对当前 large-v3-turbo 识别准确度满意,且系统能稳定跑完,建议优先保持默认或 float16 / float32,将 int8 作为紧急降载手段使用。

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource