[DEBUG] [Video-Cut] 片段382 [原片段时长:3480.0ms] [目标:8110ms] [PTS:2.3304597701149423] 完成。真实时长: 8113ms, 真实-应生=3ms
[DEBUG] [Video-Cut] 片段390 [原片段时长:3260.0ms] [目标:5610ms] [PTS:1.7208588957055215] 完成。真实时长: 5596ms, 真实-应生=-14ms
[DEBUG] [Video-Cut] 片段391 [原片段时长:3480.0ms] [目标:7910ms] [PTS:2.2729885057471266] 完成。真实时长: 7914ms, 真实-应生=4ms
[DEBUG] [Video-Cut] 片段392 [原片段时长:3100.0ms] [目标:5750ms] [PTS:1.8548387096774193] 完成。真实时长: 5718ms, 真实-应生=-32ms
[DEBUG] [Video-Cut] 片段389 [原片段时长:3220.0ms] [目标:6910ms] [PTS:2.1459627329192545] 完成。真实时长: 6899ms, 真实-应生=-11ms
[DEBUG] [Video-Cut] 片段395 [原片段时长:3060.0ms] [目标:6840ms] [PTS:2.235294117647059] 完成。真实时长: 6810ms, 真实-应生=-30ms
[DEBUG] [Video-Cut] 片段393 [原片段时长:3480.0ms] [目标:5680ms] [PTS:1.632183908045977] 完成。真实时长: 5692ms, 真实-应生=12ms
[DEBUG] [Video-Cut] 片段397 [原片段时长:3500.0ms] [目标:6540ms] [PTS:1.8685714285714285] 完成。真实时长: 6512ms, 真实-应生=-28ms
[DEBUG] [Video-Cut] 片段396 [原片段时长:3260.0ms] [目标:5760ms] [PTS:1.7668711656441718] 完成。真实时长: 5745ms, 真实-应生=-15ms
[DEBUG] [Video-Cu
......
务 开始:title='Model: large-v3-turbo']
[DEBUG] 新进程任务 参数:kwargs={'detect_language': 'en', 'model_name': 'large-v3-turbo', 'logs_file': 'D:/YII/tmp/22228/1287cd5f18/faster-en-1790139973.8738022.log', 'is_cuda': True, 'no_speech_threshold': 0.8, 'threshold': 0.3, 'condition_on_previous_text': False, 'audio_file': 'D:/YII/tmp/22228/1287cd5f18/recogn2pass-1790139972.7334073.wav', 'local_dir': 'D:/YII/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo', 'compute_type': 'default', 'jianfan': False, 'audio_duration': 4467746, 'hotwords': '', 'prompt': '', 'beam_size': 5, 'best_of': 5, 'temperature': '0.0', 'repetition_penalty': 1.0, 'compression_ratio_threshold': 2.4, 'max_speech_ms': 10000, 'min_speech_ms': 3000, 'uuid': '1287cd5f18', 'subtitle_srt': 'D:/YII/tmp/faster-20260923-13_06_13.srt', 'recogn2_max_speech': 1500, 'recogn2_min_speech': 600, 'device_index': 0, 'device_name': 'auto'}
[DEBUG] 开始加载 faster-whisper模型large-v3-turbo,数据类型:default
[DEBUG] [faster_whisper]加载模型large-v3-turbo: running on cuda,_compute_type='default'
[DEBUG] 直接传递完整音频,由faster-whisper内部VAD处理,返回字级时间戳数据
[DEBUG] faster-whisper模式下,对large-v3-turbo模型返回的字级时间戳进行断句
[DEBUG] 进入二次识别重新断句:recogn2_min_speech=600,recogn2_max_speech=1500,info.language='en'
[DEBUG] 二次识别断句完成
[DEBUG] faster-whisper下已临时保存识别结果到 D:/YII/tmp/faster-20260923-13_06_13.srt,防止进程崩溃后永久等待
[DEBUG] [新进程任务 title='Model: large-v3-turbo'] 已返回
[DEBUG] [新进程任务 结束:title='Model: large-v3-turbo'],耗时113.95795369148254s
[DEBUG] 二次识别成功完成
[DEBUG] 视频时长4478154ms-音频时长4467745ms=10409ms,需延长音频
[DEBUG] [最终视频合成]copy模式,无需重新编码:
['-y', '-progress', 'compose1790140171.7881775.txt', '-i', 'novoice.mp4', '-i', 'will_embed.m4a', '-map', '0:v', '-map', '1:a', '-c:v', 'copy', '-c:a', 'copy', '-movflags', '+faststart', '-fps_mode', 'vfr', '-shortest', 'laste_target.mp4']
前半段视频正常,后半段没声音,没配音