shape '[1, 4995, 1, 32, 2]' is invalid for input of size 262144,Traceback (most recent call last):
File "videotrans\process\confucius_tts.py", line 75, in confucius_fun
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\cli\inference.py", line 332, in generate
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\cli\inference.py", line 246, in _synth_segment
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\flow\flow.py", line 242, in inference
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\flow\flow_matching.py", line 138, in forward
File "videotrans\confuciustts\flow
......
Error: shape '[1, 4995, 1, 32, 2]' is invalid for input of size 262144
trk=[TransCreate]: uuid='f9958b82fd', proxy_str=None, cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: C:/Private Filez/Videoz/Zum Übertragen/Dubbing/Dubprogress/Kikire, Zna - Reaactor 2.mp4,
输出结果保存到文件夹: C:/Private Filez/Videoz/Zum Übertragen/Dubbing/Dubprogress/Kikire, Zna - Reaactor 2-mp4,
临时文件夹: C:/vTrans/tmp/86692/f9958b82fd
未选 清理已存在
已启用CUDA加速
已选 降噪
已选 识别说话人,最大说话人数量不限制
STT Service:openai-whisper(Built-in), large-v3-turbo, 发音语言: English,
TranslateSrt:Local LLM (OpenAI-compatible),原始语言:English,目标语言:German, 未选 SendSRT
TTS Service:Confucius4(Built-in), 角色:clone, 配音语言:German, 未选 二次语音识别
音量:-1%, 语速:+0%, 已选 音频加速, 未选 视频慢速
已选 移除每条字幕配音开头和结尾静音缓冲
静音移除力度: default
字幕: No Subtitles
已选 分离人声与背景声, 已选 重新嵌入背景声, 背景音量0.8, 背景声音时长 短于 视频时长时: 拉长(降速播放),存在分离后的纯净人声文件,存在分离后的背景声音文件, precent=18, hasend=False, should_recogn=True, should_trans=True, should_dubbing=True, should_hebing=True, is_copy_video=True, video_codec_num=264, ignore_align=False, is_audio_trans=False, clone_ref='C:/vTrans/tmp/86692/f9958b82fd/vocal.wav', should_recogn2=False, do_diarize=True
trk.cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: C:/Private Filez/Videoz/Zum Übertragen/Dubbing/Dubprogress/Kikire, Zna - Reaactor 2.mp4,
输出结果保存到文件夹: C:/Private Filez/Videoz/Zum Übertragen/Dubbing/Dubprogress/Kikire, Zna - Reaactor 2-mp4,
临时文件夹: C:/vTrans/tmp/86692/f9958b82fd
未选 清理已存在
已启用CUDA加速
已选 降噪
已选 识别说话人,最大说话人数量不限制
STT Service:openai-whisper(Built-in), large-v3-turbo, 发音语言: English,
TranslateSrt:Local LLM (OpenAI-compatible),原始语言:English,目标语言:German, 未选 SendSRT
TTS Service:Confucius4(Built-in), 角色:clone, 配音语言:German, 未选 二次语音识别
音量:-1%, 语速:+0%, 已选 音频加速, 未选 视频慢速
已选 移除每条字幕配音开头和结尾静音缓冲
静音移除力度: default
字幕: No Subtitles
已选 分离人声与背景声, 已选 重新嵌入背景声, 背景音量0.8, 背景声音时长 短于 视频时长时: 拉长(降速播放),存在分离后的纯净人声文件,存在分离后的背景声音文件
video_duration_ms=1123966
=
system:Windows-10-10.0.26300-SP0
version:v4.15
frozen:True
language:en_US
root_dir:C:/vTrans