#6481 如果双开程序(分别在两个独立文件夹,双开互不影响),使用DEEPSEEK接口进行转录翻译,会影响SRT生成的速度吗?怎样才能加快SRT的速度?

2408:**:b853 Posted at: 4 hours ago

如果双开程序(分别在两个独立文件夹,双开互不影响),使用DEEPSEEK接口进行转录翻译,会影响SRT生成的速度吗?怎样才能加快SRT的速度?

5 Replies

双开程序本身(放在两个独立文件夹)不会互相抢占 tmp 临时目录,但会对整体 SRT 生成速度产生两方面不利影响:

  1. 硬件资源共享:同一台机器上两个实例同时执行语音识别(ASR)时,会争抢 CPU、内存和 NVIDIA 显卡显存。若两个实例都加载较大的 Whisper 模型,甚至可能触发显存不足而互相拖慢或报错。
  2. DeepSeek API 并发限流:每个实例的字幕翻译线程虽然强制为 1,但两个实例同时调用 DeepSeek 时相当于 2 个并发请求。DeepSeek 接口有 RPM/TPM 速率限制,一旦触发限流,请求会失败并自动重试,反而拖慢翻译阶段,进而影响最终 SRT 生成。

因此,除非你有多张显卡且需要同时处理多个大视频,否则不建议同一台机器上双开跑同一种任务。

加快 SRT 生成速度的操作建议

  1. 语音识别(转录)阶段(主要耗时点)

    • 在主界面勾选 CUDA加速(需 NVIDIA 显卡,CUDA ≥12.8,cuDNN ≥9.11)。
    • 语音识别渠道用 faster-whisper(内置),模型选 large-v3-turbo,兼顾速度与质量。
    • 进入 菜单 → 工具 → 高级选项 → 语音识别参数,将 计算数据类型 改为 float16beam_sizebest_of 调低为 1-2。
    • 不要勾选“分离人声背景声”(该步骤为纯 CPU 运算,非常慢)。
    • 除非必要,不要勾选“LLM重新断句”(会额外消耗 DeepSeek 请求,明显拖慢整体速度)。
  2. 字幕翻译(DeepSeek)阶段

    • 菜单 → 翻译设置 → DeepSeek 面板中,取消选中“Thinking 思考模式”,可显著减少响应时间(注意思考模式需要更大的 max token,否则易截断)。
    • 高级选项 → 字幕翻译调整 → AI翻译渠道每批字幕行数 适当调大(例如 100 或更多),减少请求次数、降低被限流概率。
    • 如果两个实例必须同时使用 DeepSeek,建议错开任务启动时间,避免同时触发大量翻译请求。
  3. 控制任务范围

    • 若你只需要生成 SRT 字幕,可直接使用左侧“语音转录”功能,不勾选配音/合成,能跳过最耗时的配音和视频压制阶段,速度会快很多。

请查阅相关文档:

语音转录功能可以实现生成什么样格式的SRT?是中文,英文,中英文的哪一种或者哪几种呢?

语音转录功能生成的是单一语言的 SRT 字幕,具体语言取决于你在「语音识别」中所选的「发音语言」:选中文就生成中文 SRT,选英文就生成英文 SRT。也支持「自动检测」,但只会按检测到的语言输出一种,不会自动生成中英双语或中外对照字幕。如果你需要中英文对照的双语 SRT,应使用「翻译字幕」功能(先转出一种语言,再翻译出另一种后手动合并),或直接使用「翻译视频」功能并选择双语字幕嵌入。请查阅相关文档:- 语音转录功能

分离人声背景声在哪里设置的?

分离人声背景声设置在主界面「翻译视频」区域,点击「设置更多参数...」,在弹出面板中勾选「分离人声背景声」;如需嵌入背景声,同时勾选「嵌入背景」。若需调整分离线程数或切换分离模型,请进入 菜单 → 工具 → 高级选项 → 字幕配音调整 → 人声背景分离线程数、分离背景声模型。请查阅相关文档:- 高级选项

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource