#5979 选择那个最好?

3.208* Posted at: 5 hours ago

image
选择那个最好?

13 Replies

根据常见的配置场景,建议如下:

  • 语音识别(ASR):如果是中文视频,选择 Qwen-ASR(本地内置)FunASR(本地内置) 效果最佳;如果是英文或其他语种,选择 faster-whisper(本地内置) 搭配 large-v3 模型。
  • 字幕翻译:推荐使用 DeepSeekOpenAI ChatGPT(需配置API密钥),并勾选“发送完整字幕”以获得更自然的翻译。
  • 配音(TTS):免费开箱推荐 Edge-TTS,若需音色克隆可选择 OmniVoice-TTSF5-TTS

由于无法查看您上传的图片,请确认上述推荐是否适用于您的场景。若图片展示的是具体的下拉选项,请提供文字描述,以便准确判断。

image
这些是否有需要优化的?

由于我无法查看您上传的图片,请描述一下图片中显示的是哪些设置项(如语音识别渠道、翻译渠道、配音角色、字幕类型等),以便我给出针对性的优化建议。

如果您是在询问视频翻译主界面的一般优化方向,以下是根据常见问题列出的关键点:

  1. 语音识别:中文视频优先选择 Qwen-ASR(本地内置)FunASR;英文及其他语种优先选择 faster-whisper(本地内置) 搭配 large-v3 模型,并勾选 CUDA(有N卡时)。
  2. 翻译渠道:推荐 AI 渠道(如 DeepSeek / OpenAI ChatGPT),并勾选“发送完整字幕”以获得上下文连贯的翻译。
  3. 配音渠道:免费首选 Edge-TTS;若需音色克隆,选择支持 clone 的角色,并在高级选项中设置最短语音持续 3000ms、最长 6-10s。
  4. 同步对齐:建议同时勾选“音频加速”和“视频慢速”,并在“设置更多参数”中确保“分离人声背景声”和“降噪”已按需开启。

如果图片中包含具体的下拉选择项,请将文字描述发来,我可以直接判断哪些需要调整。

选择解码质量,会影响最终的清晰度吗?

会。选择较高的解码质量(在菜单-工具/选项-高级选项-视频输出控制中将"视频输出质量控制(CRF)"设置为更小的数值,如18-20),输出的视频画质损失更小,清晰度更高,但文件体积会显著增大。CRF值越大(如默认23-28),画质损失越多,文件体积越小。

关键影响因子:

  • CRF值(0-51):22-23 是质量和体积的较好平衡点,18-20 可视为接近无损,28+ 可见明显劣化。
  • 压缩率(preset):选择 slowveryslow 可在相同 CRF 下获得更高压缩效率(体积更小而清晰度不变),但编码耗时数倍增加。
  • 编码格式(H.264 vs H.265):H.265(HEVC)在相同 CRF 下比 H.264 体积可缩小 30-50%,清晰度不变。

无损输出条件(完全不损失画质):当原始视频为 H.264/yuv420p 编码、未启用视频慢速、未嵌入硬字幕时,软件会自动跳过视频重编码,实现完全无损。此时 CRF 和 preset 设置均不生效。

建议配置:日常使用 CRF=22 + preset=veryfast + H.264 即可在速度和画质间取得良好平衡;对画质要求高则可改用 CRF=18 + preset=slow + H.265。

image
应该如何调整?

由于无法查看图片,请描述其中显示的参数名称和当前数值,以便精准调整。若为视频输出控制面板,推荐如下通用配置:视频输出质量控制(CRF)设为 22,压缩率(preset)设为 veryfast,编码选 H.264(兼容性好)或 H.265(体积小),可变帧率 vfr。如需更高画质可将 CRF 改至 18-20,但文件体积会增大。

根据图片 image_c8e5b2.png 中的内容,为您提取并整理格式如下:

[视频输出控制↓]

设置项当前设定 / 状态
视频输出质量控制20
输出视频压缩率slow
264/265编码265
输出视频格式(mp4/mkv).mp4
可变帧率vfr/固定帧率cfrvfr
强制软编码视频?未勾选 (☐)
视频合成cuda硬解码已勾选 (☑)
自定义ffmpeg命令参数自定义ffmpeg命令参数,将添加在输出文件之前的位置,例如 -bf 7 -b_ref_mode middle





以上内容应该如何调整?

您当前的配置属于高质量、高压缩、但编码耗时较长的方案,适合不介意等待时间、追求极致画质和最小体积的场景。

推荐调整方案(根据使用场景)

设置项当前值建议值(平衡模式)说明
视频输出质量控制(CRF)2022CRF20画质更高但文件大,22是质量与体积的通用平衡点
输出视频压缩率(preset)slowveryfastmediumslow压缩率更高但编码慢数倍,veryfast速度极快且画质几乎无差异
264/265编码265264(如需兼容旧设备)或保留265H.265体积小30%,但部分老旧播放器/浏览器不支持,H.264兼容性最好
强制软编码视频?未勾选若遇到编码错误则勾选当前使用硬件CUDA硬解码,若报错可启用软编码(速度慢但稳定)

快速总结

  • 追求速度与兼容性:CRF=22, preset=veryfast, 编码选264,其他不变。
  • 追求极致画质且不惧耗时:保持当前设置(CRF20+slow+265),但需注意:

    • H.265编码时间约为H.264的2-3倍;
    • 如果最终合成时出现花屏或编码失败,请尝试勾选“强制软编码视频” 并取消勾选“视频合成cuda硬解码”。
  • 自定义ffmpeg参数:若您不清楚具体参数,建议留空,无需填写。

强制软编码视频、硬件CUDA硬解码,有什么区别,那个更好?

强制软编码视频 和 视频合成CUDA硬解码 是两个不同环节的设置,并非二选一的关系,理解其区别有助于优化处理速度和稳定性。

区别说明

设置项作用对象作用方式速度稳定性
强制软编码视频(勾选)编码(Encoder)强制使用 CPU 进行视频编码(libx264/libx265),禁止使用 NVENC/Intel QSV 等硬件编码器非常稳定,兼容性最好
视频合成CUDA硬解码(勾选)解码(Decoder)最后合成输出时,使用 CUDA 硬件加速来解码原始视频帧,而非 CPU 软件解码可能因驱动或视频格式出错(如花屏、绿屏)

简单说:

  • 强制软编码 关闭了硬件编码加速,用 CPU 压视频,慢但稳;
  • CUDA硬解码 开启硬件解码加速,用 GPU 读视频,快但易出错。

哪个更好?

没有绝对的“更好”,取决于你的显卡性能和容忍度:

  • 追求速度 + 显卡稳定
    不勾选「强制软编码视频」(默认用硬件编码),勾选「视频合成CUDA硬解码」
    → 整体处理最快,适合 NVIDIA 显卡驱动正常、视频格式常见的情况。
  • 追求稳定性,避免花屏/崩溃
    勾选「强制软编码视频」,取消勾选「视频合成CUDA硬解码」
    → 完全使用 CPU 进行编解码,速度大幅下降但几乎不会出错,适合低频处理或对画质要求极高时。
  • 折中方案
    不勾选「强制软编码视频」,取消勾选「视频合成CUDA硬解码」
    → 编码用硬件加速(快),解码用 CPU 软件解(稳),相对平衡。

针对您当前配置的建议

您的图片显示已开启「视频合成cuda硬解码」,且未勾选「强制软编码视频」。如果运行中没有出现花屏、编码失败或绿屏,说明硬件稳定,保持现状即可(最快方案)。
如果遇到上述问题,先尝试 取消勾选「视频合成cuda硬解码」(解码改用 CPU),如果仍出错再 勾选「强制软编码视频」(编码也改用 CPU)。

另外请注意:视频编码质量(CRF)和预设(preset)在软编码模式下同样生效;硬编码(NVENC)可能会略微损失画质,但新版驱动下差异几乎不可见。

部分视频部分没有声音是什么情况?例如视频开头部分或者中间部分.是视频本身的问题还是软件自己的问题?

部分视频部分没有声音,可能的原因既包括视频源头问题,也可能是软件处理逻辑导致的,需要分步骤验证。以下是可能性排序及排查方法:

1. 检查视频本身是否完整
用其他播放器(如 PotPlayer、VLC)播放下原视频,快进到无声出现的位置。如果在播放器中同样没有声音,说明原视频部分音频轨道损坏或编码异常,与软件无关。

2. 软件处理中的常见原因

  • 语音识别(ASR)阶段:默认的 VAD(语音活动检测)参数可能将短暂的人声段误判为静音并切除了,导致这些片段未被转录,自然也就没有配音。可尝试在 菜单 → 工具/选项 → 高级选项 → 语音识别参数 中将 最短语音持续(毫秒) 降低到 500-1000ms,并勾选 Whisper预分割音频? 重试。
  • 配音渠道限流:如果使用 Edge-TTS 且出现大量 403 错误,部分配音片段会生成静音。可检查日志中是否有 edge-tts 相关错误,并在高级选项中将 EdgeTTS配音渠道配音并发数 设为 1、配音后暂停秒 设为 5-10。
  • 同步对齐引擎:如果未勾选 音频加速视频慢速,当配音时长超出原字幕时间轴时,超出部分会被丢弃或填充静音,导致中间段无声。建议勾选 音频加速 ,必要时同时勾选 视频慢速

3. 快速鉴别方法
选中一个已知无声的片段,保留所有默认设置,但将 配音角色 选为 No(不配音),仅输出含有翻译字幕后不配音的视频。如果此时视频在对应位置仍然无声,说明问题出在之前环节(如 ASR 切丢了或原视频问题);如果此时声音正常,说明是配音或对齐环节导致的。

4. 需要日志分析
如果以上排查仍无法定位,请提供软件安装目录下 logs/ 中最新日志文件的最后 30 行内容,以及出问题的视频格式(mp4/mkv)和使用的语音识别/配音渠道名称。

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource