#6428 CUDA error: device-side assert triggeredCompile with `TORCH_USE_CUDA_DSA` to enable device-side assertions.

1.204.**5 Posted at: 1 hour ago

CUDA error: device-side assert triggered
Compile with TORCH_USE_CUDA_DSA to enable device-side assertions.
,Traceback (most recent call last):
File "videotrans\process\tts_fun.py", line 127, in qwen3tts_fun
File "torch\utils\_contextlib.py", line 116, in decorate_context

return func(*args, **kwargs)

File "D:\AIGC\pyVideoTrans\_internal\qwen_tts\inference\qwen3_tts_model.py", line 603, in generate_voice_clone

talker_codes_list, _ = self.model.generate(

File "torch\utils\_contextlib.py", line 116, in decorate_context

return func(*args, **kwargs)

File "D:\AIGC\pyVideoTrans\_internal\qwen_tts\core\models\modeling_qwen3_tts.py", line 2272, in generate

talker_result = self.talker.generate(

File "torch\utils\_contextlib.py", line 116, in decorate_context

return func(*args, **kwargs)

File "transformers\generation\utils.py", line 2566, in generate

result = decoding_method(

File "transformers\generation\utils.py", line 2789, in _sample

......
s, **kwargs)
File "D:\AIGC\pyVideoTrans\_internal\qwen_tts\core\models\modeling_qwen3_tts.py", line 2272, in generate

talker_result = self.talker.generate(

File "torch\utils\_contextlib.py", line 116, in decorate_context

return func(*args, **kwargs)

File "transformers\generation\utils.py", line 2566, in generate

result = decoding_method(

File "transformers\generation\utils.py", line 2789, in _sample

outputs = model_forward(**model_inputs, return_dict=True)

File "torch\nn\modules\module.py", line 1751, in _wrapped_call_impl

return self._call_impl(*args, **kwargs)

File "torch\nn\modules\module.py", line 1762, in _call_impl

return forward_call(*args, **kwargs)

File "transformers\utils\generic.py", line 918, in wrapper

output = func(self, *args, **kwargs)

File "D:\AIGC\pyVideoTrans\_internal\qwen_tts\core\models\modeling_qwen3_tts.py", line 1671, in forward

predictor_result = self.code_predictor.generate(

File "torch\utils\_contextlib.py", line 116, in decorate_context

return func(*args, **kwargs)

File "transformers\generation\utils.py", line 2566, in generate

result = decoding_method(

File "transformers\generation\utils.py", line 2831, in _sample

next_tokens = torch.multinomial(probs, num_samples=1).squeeze(1)

RuntimeError: CUDA error: device-side assert triggered
Compile with TORCH_USE_CUDA_DSA to enable device-side assertions.

cfg=[TaskCfgVTT]当前工作模式: 翻译视频或音频 单视频模式
原始输入文件名: D:/Bandicam/夜色名为温柔.mp4,
输出结果保存到文件夹: D:/Bandicam/_video_out/夜色名为温柔-mp4,
临时文件夹: D:/AIGC/pyVideoTrans/tmp/15920/5bc788c2b4
未选 清理已存在
已选 启用CUDA加速
未选 降噪
语音识别:faster-whisper(本地内置), model_name: large-v3-turbo, 发音语言: 简体中文, 断句方式:默认断句
翻译渠道:DeepSeek,原始语言:简体中文,目标语言:英语, 已选 发送完整字幕
配音渠道:Qwen3-TTS(本地内置), 角色:clone, 配音语言:英语, 未选 二次语音识别
音量:+0%, 语速:+0%, 已选 音频加速, 未选 视频慢速
字幕: 嵌入硬字幕
已选 仅输出mp4
代理地址:


=
system:Windows-10-10.0.26200-SP0
version:v4.04
frozen:True
language:zh
root_dir:D:/AIGC/pyVideoTrans

1 Replies

核心原因:Qwen3-TTS 启用 CUDA 加速后,输入数据超出模型允许范围,常见为显存不足、参考音频时长不合适,或 clone 模式下字幕切片时长设置不当,触发 CUDA 底层断言失败。

解决方案:

  1. 确保显存充足:关闭其他占用显存的程序,避免显存不足。
  2. 使用 clone 音色时,参考音频应保持在 3-10 秒。若自动截取的片段过短或过长,请调整语音识别参数。
  3. 进入“菜单 → 工具/选项 → 高级选项 → 语音识别参数”,设置:

    • 最短语音持续(毫秒):3000~4000
    • 最长语音持续(秒):6~10
    • 勾选“合并过短字幕到邻近”
  4. 你当前版本为 v4.04,此问题已在新版修复,请升级到 v4.05-0709 或更高版本(推荐最新 v4.08-0802)。
  5. 若排除以上问题后仍报错,请提供 logs/ 目录最新日志的末尾约30行。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource