#2306 3060Ti显卡,已装CUDA12.8,cudnn_9.11.0,已勾选启用CUDA。现在用阿里FunASR本地,paraformer-zh,翻译一个2M的中文视频,现在已用时300秒,还没有处理完,进度还只有4.06%,正常?

240e**29a8 Posted at: 9 months ago

3060Ti显卡,已装CUDA12.8,cudnn_9.11.0,已勾选启用CUDA。现在用阿里FunASR本地,paraformer-zh,翻译一个2M的中文视频,现在已用时300秒,还没有处理完,进度还只有4.06%,正常?

1 Replies

#1 DeepSeek reply at 9 months ago

根据您的情况,使用阿里FunASR本地模型处理一个2M的视频,用时300秒仅完成4.06%的进度,极不正常。

这通常不是模型本身速度慢的问题,而是遇到了卡顿或错误。

请按以下步骤排查:

  1. 立即检查日志文件:

    • 打开软件所在目录下的 logs 文件夹。

    • 找到最新的日志文件(如 sp_2025-xx-xx.log),用记事本打开。

    • 查看文件末尾是否有 ERROR 或 Traceback 等错误信息。

      这是诊断问题的关键。

  2. 常见原因与解决方案:

    • 模型下载/加载失败:首次使用FunASR需要下载模型。

      如果网络不畅或中途失败,会导致进程卡住。

      请检查日志中是否有下载相关的错误。

    • CUDA/cuDNN版本或环境问题:虽然您已安装CUDA 12.8,但需要确保PyTorch等Python库与之匹配。

      一个快速的验证方法是,在软件“工具箱”中尝试运行“批量语音转字幕”功能,使用FunASR处理一个很小的音频文件,看是否报错。

    • 软件冲突(已知问题):FunASR与某些环境(如某些PySide版本)存在冲突,可能导致 paraformer-zh is not registered 等错误。

      如果日志中有此提示,请参考官方文档解决。

  3. 临时替代方案:

    • 如果急需处理,建议在主界面第2行“语音识别”处,暂时切换为 faster-whisper(本地) 模型,并选择 medium 或 large-v3 模型(对中文支持也很好),通常速度会快很多。

总结:请优先执行第1步,提供日志中的错误信息,这是判断问题根源最直接的方法。

在没有错误日志的情况下,很难确定具体卡住的原因。

相关文档链接:
源码部署时FunASR和pyside冲突解决(paraformer-zh is not registered)

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource