#6021 输入的是英文的无字幕的视频,经过翻译后输出的中文视频,翻译很不准确,意思都变了,能设置场景或语境吗,提高翻译准确度,也有可以在识别英文声音的时候读成英文的时候意思已经变了,再经过翻译阶段后,出来的中文视频意思就变了很多了

223.74* Posted at: 7 hours ago

输入的是英文的无字幕的视频,经过翻译后输出的中文视频,翻译很不准确,意思都变了,能设置场景或语境吗,提高翻译准确度,也有可以在识别英文声音的时候读成英文的时候意思已经变了,再经过翻译阶段后,出来的中文视频意思就变了很多了

1 Replies

语音识别或翻译环节本身未提供“场景语境”预设选项,但可通过以下配置大幅提升准确度:

  1. 升级语音识别模型

    • 将语音识别渠道切换为 faster-whisper(本地内置) 并选择 large-v3 模型(最准确)。
    • 勾选 CUDA加速(需NVIDIA显卡和对应CUDA环境)。
    • 避免使用 .en 结尾或 distil- 开头的轻量模型(它们仅支持英语且精度低)。
    • 若预算允许,使用付费渠道如 OpenAI语音识别API 效果最佳。
  2. 优化翻译渠道

    • 翻译渠道选择 DeepSeek、OpenAI ChatGPT 或 Gemini 等AI大模型,并勾选主界面的“发送完整字幕”(让AI看到前后文行号和字幕,翻译更连贯)。
    • 在高级选项 → 字幕翻译调整中,勾选 “AI翻译附带完整原字幕” 并增大每批字幕行数(如设为100)。
    • 可选:在“翻译术语表”内填写专业术语,避免误译(如 deep learning, 深度学习)。
  3. 检查断句与标点

    • 若开启了 LLM重新断句,请取消勾选(该功能会重新划分时间轴,可能引入错误)。
    • 在“设置更多参数”中勾选“恢复标点”有助于AI理解句子边界。

若上述调整后仍不理想,请提供软件左上角的版本号及 logs/ 中最新的日志(复制底部30行),以便进一步分析。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource