#6538 语音识别阶段出错[faster-whisper(本地内置)] 分离音频失败,请检查日志或重试Traceback (most recent call last):

14.153.**9 Posted at: 5 hours ago

语音识别阶段出错[faster-whisper(本地内置)] 分离音频失败,请检查日志或重试
Traceback (most recent call last):

File "videotrans\task\job.py", line 35, in run

File "videotrans\task\job.py", line 100, in process_task

File "videotrans\task\trans_create.py", line 289, in recogn

videotrans.configure.excepts.SpeechToTextError: 分离音频失败,请检查日志或重试
cfg=[TaskCfgVTT]当前工作模式: 翻译视频或音频 批量翻译模式
原始输入文件名: D:/Desktop/哼哼猫下载/抱手戒指 6.30/美区抱手1 (53).mp4,
输出结果保存到文件夹: D:/Desktop/饰品素材/4.法国/美区抱手1 (53)-mp4,
临时文件夹: D:/soft/trans/win-pyvideotrans-v4.03-0626/tmp/15552/48e75de6b7
未选 清理已存在
未选 启用CUDA加速
未选 降噪
语音识别:faster-whisper(本地内置), model_name: large-v3-turbo, 发音语言: 英语, 断句方式:默认断句
翻译渠道:DeepSeek,原始语言:英语,目标语言:法语, 已选 发送完整字幕
配音渠道:Edge-TTS(免费), 角色:VivienneMultilingual(Female/FR), 配音语言:法语, 未选 二次语音识别
音量:+0%, 语速:+0%, 已选 音频加速, 未选 视频慢速
字幕: 不嵌入字幕
已选 分离人声与背景声, 已选 重新嵌入背景声, 背景音量0.8, 背景声音时长 短于 视频时长时: 拉长(降速播放)
已选 仅输出mp4
代理地址:http://127.0.0.1:5188


=
system:Windows-10-10.0.19045-SP0
version:v4.03
frozen:True
language:zh
root_dir:D:/soft/trans/win-pyvideotrans-v4.03-0626

1 Replies

这是分离人声与背景声阶段失败导致的,通常是因为输入视频文件路径中包含中文、空格、括号等特殊字符,FFmpeg 或相关分离工具无法正确解析该路径。

解决方案:

  1. 将视频文件复制到纯英文、无空格、无括号、无特殊符号的目录下,并重命名为简单文件名,例如 D:\test.mp4
  2. 如果仍需使用“分离人声与背景声”和“重新嵌入背景声”,请同时确保软件安装目录和视频路径都为纯英文路径,并保证磁盘剩余空间充足。
  3. 可先暂时取消勾选“分离人声与背景声”和“重新嵌入背景声”,再重新执行,确认是否能跳过该步骤正常完成。
  4. 你的版本为 v4.03,较旧,建议升级到最新版本(v4.09),若为 Windows 预打包版,请下载最新完整包或补丁包覆盖。
  5. 若问题仍然存在,请打开软件安装目录下的 logs/ 文件夹,将最新的 .log 文件底部约30行报错信息贴出。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource