#7844 No human voice detected. Please confirm that human speech is present in the original file. [info.duration_after_vad=0.0s

222.120**9 Posted at: 1 hour ago

No human voice detected. Please confirm that human speech is present in the original file. [info.duration_after_vad=0.0s].
_kw={'beam_size': 5, 'best_of': 5, 'condition_on_previous_text': False, 'threshold': 0.45, 'no_speech_threshold': 0.6, 'temperature': 0.0, 'repetition_penalty': 1.0, 'compression_ratio_threshold': 2.4, 'initial_prompt': None}
info=TranscriptionInfo(language='zh', language_probability=1, duration=30.0930625, duration_after_vad=0.0, all_language_probs=None, transcription_options=TranscriptionOptions(beam_size=5, best_of=5, patience=1, length_penalty=1, repetition_penalty=1.0, no_repeat_ngram_size=0, log_prob_threshold=-1.0, no_speech_threshold=0.6, compression_ratio_threshold=2.4, condition_on_previous_text=False, prompt_reset_on_temperature=0.5, temperatures=[0.0], initial_prompt=None, prefix=None, suppress_blank=True, suppress_tokens=(1, 2, 7, 8, 9, 10, 14, 25, 26, 27, 28, 29, 31, 58, 59, 60, 61, 62, 63, 90, 91, 92, 93, 359, 503, 522, 542, 873, 893, 902, 918, 922
......
reshold=None, min_speech_duration_ms=0, max_speech_duration_s=inf, min_silence_duration_ms=2000, speech_pad_ms=400))

trk=[TransCreate]: uuid='29c2d8264a', proxy_str='http://127.0.0.1:7890', cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: C:/Users/Administrator/Desktop/微信视频2026-10-06_161025_560.mp4,
输出结果保存到文件夹: C:/Users/Administrator/Desktop/_video_out/微信视频2026-10-06_161025_560-mp4,
临时文件夹: C:/Users/Administrator/Desktop/tmp/21792/29c2d8264a
已选 清理已存在
未启用CUDA加速
未选 降噪
语音识别:faster-whisper(内置), large-v3-turbo, 发音语言: 简体中文,
翻译渠道:DeepSeek,原始语言:简体中文,目标语言:西班牙语, 已选 发送完整字幕
配音渠道:Edge-TTS(免费), 角色:Sebastian(Male/VE), 配音语言:西班牙语, 未选 二次语音识别
音量:+0%, 语速:+0%, 已选 音频加速, 未选 视频慢速
已选 移除每条字幕配音开头和结尾静音缓冲
静音移除力度: default
字幕: 嵌入硬字幕
代理地址: http://127.0.0.1:7890, precent=4, hasend=False, should_recogn=True, should_trans=True, should_dubbing=True, should_hebing=True, video_time=30100, video_info={'video_fps': 30.0, 'r_frame_rate': 30.0, 'video_codec_name': 'h264', 'audio_codec_name': 'aac', 'width': 1080, 'height': 1440, 'time': 30100, 'streams_len': 2, 'streams_audio': 1, 'video_streams': 1, 'color': 'yuv420p'}, is_copy_video=True, video_codec_num=264, ignore_align=False, is_audio_trans=False, clone_ref='', cost_duration=1791277254.0504787, should_recogn2=False, do_diarize=True
trk.cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: C:/Users/Administrator/Desktop/微信视频2026-10-06_161025_560.mp4,
输出结果保存到文件夹: C:/Users/Administrator/Desktop/_video_out/微信视频2026-10-06_161025_560-mp4,
临时文件夹: C:/Users/Administrator/Desktop/tmp/21792/29c2d8264a
已选 清理已存在
未启用CUDA加速
未选 降噪
语音识别:faster-whisper(内置), large-v3-turbo, 发音语言: 简体中文,
翻译渠道:DeepSeek,原始语言:简体中文,目标语言:西班牙语, 已选 发送完整字幕
配音渠道:Edge-TTS(免费), 角色:Sebastian(Male/VE), 配音语言:西班牙语, 未选 二次语音识别
音量:+0%, 语速:+0%, 已选 音频加速, 未选 视频慢速
已选 移除每条字幕配音开头和结尾静音缓冲
静音移除力度: default
字幕: 嵌入硬字幕
代理地址: http://127.0.0.1:7890
video_duration_ms=30100


=
system:Windows-10-10.0.19043-SP0
version:v4.15
frozen:True
language:zh_CN
root_dir:C:/Users/Administrator/Desktop

1 Replies

#1 DeepSeek reply at 1 hour ago

核心原因是:VAD(语音活动检测)在整段音频中未检测到任何人声,duration_after_vad=0.0s 表示经过语音活动检测后有效语音时长为 0,因此 faster-whisper 直接抛出「未检测到人声」错误,识别流程未能启动。

请按以下顺序排查:

  1. 先确认视频本身有没有声音:用播放器打开原视频,确认能否听到人声;部分从微信/网页下载的视频,音频轨可能缺失或音量极低。
  2. 降低 VAD 语音阈值(最常见有效的手段):进入 菜单(Menu)-工具/选项(Tools/Options)-高级选项(Advanced Options)-语音识别参数(ASR Settings),将 语音阈值(VAD: Speech probability threshold) 从默认 0.45 调低,例如改为 0.2 或 0.1,让 VAD 更容易把音频判定为语音。
  3. 调整非语音阈值:同区域将 非语音阈值(no speech threshold) 由 0.6 适当调高,例如 0.8。
  4. 勾选降噪 / 分离人声背景声:若视频背景噪声大、人声被淹没,请在主界面点击 设置更多参数(More...),勾选 降噪(Noise Reduction);如果背景音乐很响,改勾 分离人声背景声(Separate Vocal/BGM)(注意二者选一即可,不要同时选)。
  5. 确认发音语言选择正确:当前日志显示发音语言为「简体中文」,若视频实际是其他语言,请改为对应语言,语言选错也可能导致识别失败。
  6. 更换识别渠道验证:可临时改用 openai-whisper(内置) 或 Qwen-ASR(内置) 测试同一文件,若同样报无人声,则基本可确定是音频本身的问题。
  7. 检查音频编码:当前音频编码为 aac,一般正常;若上述均无效,可先用其他工具将视频转码为标准的 H.264/AAC MP4 后再导入。

另外提醒:当前未启用 CUDA 加速,large-v3-turbo 模型在 CPU 下运行会非常慢,若你有 N 卡,建议配置好 CUDA 12.8 + cuDNN 9.11 后勾选 启用CUDA加速。

若按上述调整后仍报同一错误,请提供该视频是否确有人声、以及调整后新的日志底部约 30 行信息。

请查阅相关文档:

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource