#7625 bug提交:批量识别翻译时,出现识别不完整的问题,v4.12正常,v4.13出现这个问题

141.11**1 Posted at: 1 hour ago

bug提交:批量识别翻译时,出现识别不完整的问题,v4.12正常,v4.13出现这个问题

3 Replies

#1 DeepSeek reply at 1 hour ago

您的问题缺少必要信息,暂无法确定具体原因。

v4.12 正常、v4.13 出现识别不完整,可能涉及以下已知改动(v4.13/v4.12 更新日志中提到):

  • v4.13:优化 whisper 模型识别后重断句算法
  • v4.12:移除whisper预分割音频、合并邻近短字幕;优化 VAD 切分算法

这些改动会直接影响字幕切分的行数与颗粒度,但"识别不完整"的具体表现(丢字、丢句、丢整段、末尾截断等)需结合日志判断。

请补充以下信息以便定位:

  1. 软件版本号(左上角显示的完整版本号,如 v4.13-xxxx)
  2. 操作系统,以及是 Windows 预打包版还是源码部署
  3. 使用的语音识别渠道 + 模型名称(如 faster-whisper / large-v3-turbo)
  4. 是否勾选了 分离人声背景声、降噪、二次识别、LLM纠错
  5. 高级选项 → 语音识别参数中的 最长语音持续、最短语音持续、静音分割持续 当前值
  6. 软件安装目录下 logs/ 文件夹中最新的日志文件(复制底部约 30 行报错信息)

请查阅相关文档:

#2 141.11**1 reply at 1 hour ago

单个视频翻译没有问题,就是多个视频批量翻译的时候会出现

#3 DeepSeek reply at 1 hour ago

批量翻译与单视频翻译的差别之一在于:单视频(一次只选一个文件)会进入单视频交互模式,在每个阶段后暂停,允许您人工校对字幕;而批量翻译不暂停,直接按流程走完。

因此"单视频正常、批量不完整"通常不是识别引擎本身的问题,而是批量流程中的资源/缓存/并发因素。

可能相关的已知点:批量翻译时多个视频会交叉执行,若在 高级选项 → 通用 中设置了 批量翻译视频时每批数量,或 CPU同时任务数 / GPU同时任务数 > 1,多个 ASR 子进程并发会争抢显存/内存,可能出现子进程被回收、识别被截断的情况;BrokenProcessPool / SttTimeoutError 在批量并发时更易出现(子进程崩溃后该视频识别结果不完整);若未勾选 清理已生成,批量重复处理时可能复用上一次不完整的缓存字幕。

请先按以下步骤排查:1.

打开 菜单 → 工具/选项 → 高级选项 → 通用,将 GPU同时任务数 设为 1,CPU同时任务数 设为 1~2,批量翻译视频时每批数量 设为 1,重试。

2.

确认批量处理时勾选了 清理已生成,避免复用旧的残缺字幕。

3.

查看该批视频对应输出目录 _video_out/xxx-mp4/ 下的原始语言 srt,判断是识别阶段就缺,还是后续翻译/配音阶段丢内容。

4.

查看软件安装目录 logs/ 下当天的日志(如 20250622.log),搜索 BrokenProcessPool、SttTimeoutError、CUDA out of memory 等关键词。

请补充以下信息以便进一步判断:软件完整版本号(左上角,如 v4.13-xxxx)操作系统,Windows 预打包版 / 源码部署批量时选择的语音识别渠道与模型(如 faster-whisper / large-v3-turbo)是否勾选 启用CUDA加速,显卡型号与显存大小是否勾选了 二次识别 / LLM纠错 / 分离人声背景声 / 降噪,以及高级选项里的上述并发数值logs/ 目录下当天日志的底部约 30 行。

请查阅相关文档:
高级选项
常见问题FAQ

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource