shape '[1, 4138, 1, 32, 2]' is invalid for input of size 262144,Traceback (most recent call last):
File "videotrans\process\confucius_tts.py", line 75, in confucius_fun
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\cli\inference.py", line 332, in generate
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\cli\inference.py", line 246, in _synth_segment
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\flow\flow.py", line 242, in inference
File "C:\vTrans\_internal\torch\utils\_contextlib.py", line 116, in decorate_context
return func(*args, **kwargs)File "videotrans\confuciustts\flow\flow_matching.py", line 138, in forward
File "videotrans\confuciustts\flow
......
e "videotrans\confuciustts\flow\flow_matching.py", line 178, in solve_euler
File "C:\vTrans\_internal\torch\nn\modules\module.py", line 1751, in _wrapped_call_impl
return self._call_impl(*args, **kwargs)File "C:\vTrans\_internal\torch\nn\modules\module.py", line 1762, in _call_impl
return forward_call(*args, **kwargs)File "videotrans\confuciustts\flow\DiT\dit.py", line 214, in forward
File "C:\vTrans\_internal\torch\nn\modules\module.py", line 1751, in _wrapped_call_impl
return self._call_impl(*args, **kwargs)File "C:\vTrans\_internal\torch\nn\modules\module.py", line 1762, in _call_impl
return forward_call(*args, **kwargs)File "videotrans\confuciustts\flow\DiT\modules.py", line 226, in forward
File "C:\vTrans\_internal\torch\nn\modules\module.py", line 1751, in _wrapped_call_impl
return self._call_impl(*args, **kwargs)File "C:\vTrans\_internal\torch\nn\modules\module.py", line 1762, in _call_impl
return forward_call(*args, **kwargs)File "videotrans\confuciustts\flow\DiT\modules.py", line 175, in forward
File "videotrans\confuciustts\flow\DiT\modules.py", line 129, in apply_rotary_emb
RuntimeError: shape '[1, 4138, 1, 32, 2]' is invalid for input of size 262144
cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: C:/Private Filez/Videoz/Zum Übertragen/Dubbing/Dubprogress/1.mkv,
输出结果保存到文件夹: C:/Private Filez/Videoz/Zum Übertragen/Dubbing/Dubprogress/1-mkv,
临时文件夹: C:/vTrans/tmp/5076/a95aac456d
未选 清理已存在
已启用CUDA加速
已选 降噪
已选 识别说话人,最大说话人数量不限制
STT Service:openai-whisper(Built-in), large-v3-turbo, 发音语言: English, 断句方式:默认断句
TranslateSrt:CompatibleAI/LocalModel,原始语言:English,目标语言:German, 已选 SendSRT
TTS Service:Confucius4(Built-in), 角色:clone, 配音语言:German, 未选 二次语音识别
音量:-1%, 语速:+0%, 已选 音频加速, 未选 视频慢速
字幕: No Subtitles
已选 分离人声与背景声, 已选 重新嵌入背景声, 背景音量0.8, 背景声音时长 短于 视频时长时: 拉长(降速播放),存在分离后的纯净人声文件,存在分离后的背景声音文件
=
system:Windows-10-10.0.26200-SP0
version:v4.12
frozen:True
language:en_US
root_dir:C:/vTrans