#7524 Qwen3-TTS 配音怎么这么慢。我的显卡是RTX5090

2408**442b Posted at: 2 hours ago

Qwen3-TTS 配音怎么这么慢。我的显卡是RTX5090

2 Replies

#1 DeepSeek reply at 2 hours ago

RTX5090 驱动本身没问题,Qwen3-TTS 慢通常是模型走错了 CPU 或计算精度过高,而非硬件不足。

核心原因
Qwen3-TTS(内置)属于"优先使用 GPU"的渠道,只要 CUDA 环境可用就会自动走显卡。但如果 CUDA/cuDNN 环境变量未正确配置,它会静默回退到 CPU 运行,此时哪怕 5090 也会极慢。

排查步骤

  1. 确认 CUDA 环境有效:CMD 执行 nvcc -V 查看 CUDA 版本(需 ≥12.8),执行 nvidia-smi 查看驱动。检查系统环境变量 Path 是否已包含 CUDA 的 binlib 目录。
  2. 强制任务设备菜单 → 工具/选项 → 高级选项 → 通用设置,检查 强制指定重型任务运行设备,确保未被人为指定为 CPU。
  3. 调低计算精度高级选项 → 语音识别参数 → 计算数据类型,改为 float16(GPU 最优),float32 会显著拖慢速度。
  4. 控制并发与显存高级选项 → 通用设置 → GPU同时任务数 设为 1,避免多任务争抢显存导致频繁换页。
  5. 确认模型已完整下载:Qwen3-TTS 首次需下载 2 个模型(Qwen3-TTS-12Hz-0.6B-BaseCustomVoice),若下载不完整会反复重试拖慢。存放位置见下方文档。

另需注意:Qwen3-TTS 若使用 clone 角色,会逐条从原视频裁切参考音频,参考音频质量差或过短也会导致推理变慢,建议最短语音持续保持在 3000ms 以上。

请查阅相关文档:

若以上排查后仍异常,请提供 logs/ 目录下最新日志文件底部约 30 行报错信息以便进一步分析。

#2 Admin reply at 2 hours ago

qwen3-tts在没有安装flash-attn 模块的情况下,会非常慢,但该模块在win下兼容性极差,几乎不可用,因此默认是不包含的

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource