#7783 高级选项里,我主要翻译韩文视频,怎么设置正确率最高

103.151**5 Posted at: 7 hours ago

高级选项里,我主要翻译韩文视频,怎么设置正确率最高

1 Replies

#1 DeepSeek reply at 7 hours ago

翻译韩文视频时,提升“正确率”的关键不是单一参数,而是语音识别渠道/模型选择 + 字幕切分参数 + 翻译渠道三者配合。

按以下设置最稳妥:

1.

语音识别渠道(最关键)

  • 首选:faster-whisper(内置),模型选 large-v3(准确度最高)或 large-v3-turbo(速度与质量兼顾)
  • 备选:openai-whisper(内置) + large-v3
  • 若有 N 卡,务必勾选启用CUDA加速

2.

高级选项 → 语音识别参数(ASR Settings)

  • 计算数据类型:GPU 用 float16;显存不足改 int8
  • 识别准确度beam_size:调到 5(消耗显存更多但更准)
  • 识别准确度best_of:调到 5
  • 启用上下文感知:可开启,准确率提升,但容易出现重复/幻觉,若发现重复再关掉
  • 重复惩罚(repetition penalty):如出现重复字幕,适当增大
  • 热词(hotwords):把视频中反复出现的人名、专业术语填进去,用英文逗号分隔,对韩文识别帮助明显
  • 计算数据类型/模型等修改后建议先用单个短视频测试

3.

字幕切分颗粒度(影响识别完整度)

  • 最长语音持续(s):韩语语速较快,建议 4~5
  • 最短语音持续(ms):3000(若后续要用 clone 克隆音色,必须保持 ≥3000)
  • 静音分割持续(ms):500~600
注意:最长语音持续 × 1000 必须大于 最短语音持续,否则会识别混乱。

4.

翻译环节

  • 翻译渠道建议用 AI 大模型(如 DeepSeek / ChatGPT / Gemini),比传统接口质量明显更好
  • 勾选发送完整字幕
  • 高级选项 → 字幕翻译 → AI翻译渠道每批字幕行数 设为 100 或更大
  • 高级选项 → 字幕翻译 → AI翻译附带所有字幕做参考 选中,质量最佳(会大幅增加 token 消耗,需使用支持超长上下文的模型)

5.

其他

  • 若原视频有背景音乐/噪声,主界面设置更多参数里勾选分离人声背景声,识别准确率会提升(此选项选中后无需再选降噪)
  • 高级选项 → 语音识别参数 → 字幕繁体转简体 与韩文无关,不用管

如需了解各渠道详细说明,见下方文档。

请查阅相关文档:

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource