#7013 No transcription results returned. Please check the original audio/video [info.duration_after_vad=0.0s].info=Transcripti

188.253**1 Posted at: 1 hour ago

No transcription results returned. Please check the original audio/video [info.duration_after_vad=0.0s].
info=TranscriptionInfo(language='en', language_probability=1, duration=48.4693125, duration_after_vad=0.0, all_language_probs=None, transcription_options=TranscriptionOptions(beam_size=5, best_of=5, patience=1, length_penalty=1, repetition_penalty=1.0, no_repeat_ngram_size=0, log_prob_threshold=-1.0, no_speech_threshold=0.6, compression_ratio_threshold=2.4, condition_on_previous_text=False, prompt_reset_on_temperature=0.5, temperatures=[0.0, 0.2, 0.4, 0.6, 0.8, 1.0], initial_prompt=None, prefix=None, suppress_blank=True, suppress_tokens=(1, 2, 7, 8, 9, 10, 14, 25, 26, 27, 28, 29, 31, 58, 59, 60, 61, 62, 63, 90, 91, 92, 93, 359, 503, 522, 542, 873, 893, 902, 918, 922, 931, 1350, 1853, 1982, 2460, 2627, 3246, 3253, 3268, 3536, 3846, 3961, 4183, 4667, 6585, 6647, 7273, 9061, 9383, 10428, 10929, 11938, 12033, 12331, 12562, 13793, 14157, 14635, 15265, 15618, 16553, 16604, 18362, 18956,
......
ons=TranscriptionOptions(beam_size=5, best_of=5, patience=1, length_penalty=1, repetition_penalty=1.0, no_repeat_ngram_size=0, log_prob_threshold=-1.0, no_speech_threshold=0.6, compression_ratio_threshold=2.4, condition_on_previous_text=False, prompt_reset_on_temperature=0.5, temperatures=[0.0, 0.2, 0.4, 0.6, 0.8, 1.0], initial_prompt=None, prefix=None, suppress_blank=True, suppress_tokens=(1, 2, 7, 8, 9, 10, 14, 25, 26, 27, 28, 29, 31, 58, 59, 60, 61, 62, 63, 90, 91, 92, 93, 359, 503, 522, 542, 873, 893, 902, 918, 922, 931, 1350, 1853, 1982, 2460, 2627, 3246, 3253, 3268, 3536, 3846, 3961, 4183, 4667, 6585, 6647, 7273, 9061, 9383, 10428, 10929, 11938, 12033, 12331, 12562, 13793, 14157, 14635, 15265, 15618, 16553, 16604, 18362, 18956, 20075, 21675, 22520, 26130, 26161, 26435, 28279, 29464, 31650, 32302, 32470, 36865, 42863, 47425, 49870, 50254, 50258, 50359, 50360, 50361, 50362, 50363), without_timestamps=False, max_initial_timestamp=1.0, word_timestamps=True, prepend_punctuations='"\'“¿([{-', append_punctuations='"\'.。,,!!??::”)]}、', multilingual=False, max_new_tokens=None, clip_timestamps=[0.0], hallucination_silence_threshold=None, hotwords=''), vad_options=VadOptions(threshold=0.5, neg_threshold=None, min_speech_duration_ms=0, max_speech_duration_s=inf, min_silence_duration_ms=140, speech_pad_ms=400))

cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: D:/TASTIEST Creamy Chipotle Chicken & Potatoes🍗🍟🧀 Only 548 Calories 51g Protein! [lsr_jqDkzVc].webm,
输出结果保存到文件夹: D:/TASTIEST Creamy Chipotle Chicken & Potatoes🍗🍟🧀 Only 548 Calories 51g Protein! [lsr_jqDkzVc]-webm,
临时文件夹: D:/fanyi/tmp/37068/856c7cc251
已选 清理已存在
已启用CUDA加速
未选 降噪
语音识别:faster-whisper(内置), large-v3-turbo, 发音语言: 英语, 断句方式:默认断句
翻译渠道:Google(免费),原始语言:英语,目标语言:简体中文, 已选 发送完整字幕
配音渠道:GPT-SoVITS(本地API), 角色:jala.wav, 配音语言:简体中文, 未选 二次语音识别
音量:+0%, 语速:+0%, 已选 音频加速, 已选 视频慢速
字幕: 嵌入软字幕
代理地址:http://127.0.0.1:7890


=
system:Windows-10-10.0.19045-SP0
version:v4.11
frozen:True
language:zh
root_dir:D:/fanyi

1 Replies

#1 DeepSeek reply at 1 hour ago

该报错的核心原因是:VAD(语音活动检测)将该音频中所有片段判定为“非语音”,导致 duration_after_vad=0.0s,因此没有截取到任何有效语音片段用于识别。这不一定是模型损坏或CUDA问题,而是音频本身未检测到人声或VAD阈值过严。

请按以下顺序排查:

  1. 确认原始视频是否真的包含清晰人声:用播放器试听该 .webm 文件,确认有说话声、且声音音量正常。如果只有背景音乐、纯音效或人声被音乐淹没,则无法转录(软件只能处理人类语音)。
  2. 调整VAD敏感度

    • 点击菜单 → 工具/选项 → 高级选项 → 语音识别参数
    • 语音阈值 调低(例如 0.5 改为 0.30.2),让VAD更敏感地捕获语音。
    • 非语音阈值 也适当调低(例如设为 0.3)。
    • 静音分割持续毫秒 适当调大(如 140 改为 300),避免过短静音切碎。
  3. 尝试关闭“Whisper预分割音频”

    • 在同一个高级选项页面,找到 Whisper预分割音频?,取消勾选。这样 whisper 模型将直接处理整段音频,绕过VAD预分割。
  4. 切换语音识别渠道

    • 将识别渠道从 faster-whisper(内置) 切换为 openai-whisper(内置),模型同样选 large-v3-turbo,该渠道默认不使用VAD预分割。
  5. 简化文件路径和名称

    • 当前文件名包含大量空格、表情符号和特殊字符(🍗🍟🧀 等),虽然不是引发该错误的主因,但会增大底层ffmpeg命令处理失败的概率。
    • 建议将文件重命名为纯英文简单的名称,如 video1.webm,并移动到浅层目录(如 D:/video1.webm)再试。

如果以上操作后仍报同样错误,请提供 logs/ 目录下最新的日志文件(包含底部约30行),并说明该视频在正常播放器中能否听到清晰人声。

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource