#7959 Sequence Length: 5999 has to be less or equal than config.max_position_embeddings 5000.:Traceback (most recent call last

211.64**8 Posted at: 2 hours ago

Sequence Length: 5999 has to be less or equal than config.max_position_embeddings 5000.:Traceback (most recent call last):
File "videotrans\process\stt_nemotron.py", line 41, in nemotron_asr
File "F:\win-pyvideotrans-v4.15\_internal\transformers\models\nemotron3_5_asr\generation_nemotron3_5_asr.py", line 35, in generate

return super().generate(inputs=inputs, generation_config=generation_config, **kwargs)

File "F:\win-pyvideotrans-v4.15\_internal\transformers\models\nemotron_asr_streaming\generation_nemotron_asr_streaming.py", line 228, in generate

outputs = super().generate(inputs=inputs, generation_config=generation_config, **kwargs)

File "F:\win-pyvideotrans-v4.15\_internal\transformers\models\parakeet\generation_parakeet.py", line 256, in generate

outputs = super().generate(inputs=inputs, generation_config=generation_config, **kwargs)

File "F:\win-pyvideotrans-v4.15\_internal\torch\utils\_contextlib.py", line 116, in decorate_context

return func(*a

......
models\nemotron_asr_streaming\modeling_nemotron_asr_streaming.py", line 1007, in forward

position_embeddings = self.encode_positions(inputs_embeds, cached_frames=cached_frames)

File "F:\win-pyvideotrans-v4.15\_internal\torch\nn\modules\module.py", line 1751, in _wrapped_call_impl

return self._call_impl(*args, **kwargs)

File "F:\win-pyvideotrans-v4.15\_internal\torch\nn\modules\module.py", line 1762, in _call_impl

return forward_call(*args, **kwargs)

File "F:\win-pyvideotrans-v4.15\_internal\torch\utils\_contextlib.py", line 116, in decorate_context

return func(*args, **kwargs)

File "F:\win-pyvideotrans-v4.15\_internal\transformers\models\nemotron_asr_streaming\modeling_nemotron_asr_streaming.py", line 376, in forward

raise ValueError(

ValueError: Sequence Length: 5999 has to be less or equal than config.max_position_embeddings 5000.

trk=[TransCreate]: uuid='e18055f032', proxy_str=None, cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: F:/mewtepe/1011.mp4,
输出结果保存到文件夹: F:/mewtepe/_video_out/1011-mp4,
临时文件夹: F:/win-pyvideotrans-v4.15/tmp/43260/e18055f032
已选 清理已存在
未启用CUDA加速
未选 降噪
语音识别:Nemotron-3.5-asr-0.6b(内置), , 发音语言: 日语,
翻译渠道:Hy-MT2-1.8B(内置),原始语言:日语,目标语言:简体中文, 未选 发送完整字幕
未选 配音角色,不进行配音
字幕: 嵌入硬字幕
已选 仅输出mp4, precent=4, hasend=False, should_recogn=True, should_trans=True, should_dubbing=False, should_hebing=True, is_copy_video=True, video_codec_num=264, ignore_align=False, is_audio_trans=False, clone_ref='', should_recogn2=False, do_diarize=True
trk.cfg=[TaskCfgVTT]当前工作模式: 翻译视频 单视频模式
原始输入文件名: F:/mewtepe/1011.mp4,
输出结果保存到文件夹: F:/mewtepe/_video_out/1011-mp4,
临时文件夹: F:/win-pyvideotrans-v4.15/tmp/43260/e18055f032
已选 清理已存在
未启用CUDA加速
未选 降噪
语音识别:Nemotron-3.5-asr-0.6b(内置), , 发音语言: 日语,
翻译渠道:Hy-MT2-1.8B(内置),原始语言:日语,目标语言:简体中文, 未选 发送完整字幕
未选 配音角色,不进行配音
字幕: 嵌入硬字幕
已选 仅输出mp4
video_duration_ms=7722033


=
system:Windows-10-10.0.26300-SP0
version:v4.15
frozen:True
language:zh_CN
root_dir:F:/win-pyvideotrans-v4.15

1 Replies

#1 DeepSeek reply at 2 hours ago

这是语音识别渠道 Nemotron-3.5-asr-0.6b(内置) 的模型输入长度超限错误:编码后的序列长度 5999 超过了该模型配置的最大位置编码 5000,也就是送进模型的单段音频切片过长(通常意味着 VAD 未正确切分,或切分参数被设置得过大)。你的视频时长约 7722 秒(2 小时 8 分),长视频叠加过大的切片更容易触发。

处理步骤

  1. 打开 菜单 → 工具/选项 → 高级选项 → 语音识别参数,检查并恢复/调整以下参数:

    • 最长语音持续(秒)/(VAD:max speech duration(s)):改为 5~8(默认 5,若被设成几十甚至几百秒会直接导致切片超长)
    • 最短语音持续(毫秒)/(VAD:min speech duration(ms)):3000
    • 静音分割持续毫秒/(VAD:Min silence duration for split(ms)):600
    • 同时确认 选择VAD/(Select VAD) 没有被设为 None,否则不会预分割音频

      注意:最长语音持续(秒) × 1000 必须大于 最短语音持续(毫秒)
  2. 保存后,勾选 清理已生成 重新执行一次。
  3. 若调整参数后仍报同一错误,改用其他识别渠道:

    • 日语视频推荐 openai-whisper(内置) large-v3,或 faster-whisper(内置)
    • 该 Nemotron 渠道本身是流式 0.6B 小模型,对超长音频片段容错较差
  4. 备用方案:先用 菜单 → 工具 → 按字幕剪辑视频 或第三方工具把 2 小时视频切分为若干 10~30 分钟片段,再分别识别。
  5. 另外日志显示 未启用CUDA加速,本地模型纯 CPU 运行极慢;有 N 卡建议配置 CUDA 后选中启用。

如果按上述参数调整后仍报同样错误,请提供软件安装目录下 logs/ 文件夹中最新的日志文件(底部约 30 行),以便进一步确认是否是切分逻辑异常。

请查阅相关文档:

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource