-
#5608 开启视频缓速和语音加速后为什么最后几秒视频还是会卡顿...
💬 3[Last reply:2 months ago] 中文转泰文时,由于泰文的音节数和语法结构与中文差异较大,配音后的时长变化会更加明显,导致同步问题比常见语种更突出。建议按以下顺序调整:1. 强制音频加速(必选) 在主界面“同步对齐”行,仅勾选“音频加速”,不勾选“视频慢速”。加速会压缩配音片段使其匹配原时长,这是最有效的缓解手段。2. 降低语速适配 在“设置更多参数”中,将配音语速设置为 -10 至 -20(如 -15),让泰文配音读得更慢一...240e**1647 Posted at: 2 months ago -
#5609 MemoryError...
💬 1[Last reply:2 months ago] 这是 内存不足(MemoryError) 导致的崩溃,通常发生在 faster-whisper 处理长音频或使用 large-v3 模型时,系统物理内存(RAM)或显卡显存耗尽。解决方法:更换更小的模型 进入主界面 ASR Channel → 更换为 small 或 medium 模型(large-v3 至少需要 16GB 内存 / 10GB 显存)。启用 CUDA 加速(若您有 NVIDIA ...1.164**3 Posted at: 2 months ago -
#5603 保存字幕前格式化srt失败:file='D:/pyvideotrans/win-pyvideotrans-v4.03-0626/Minecraft but I get sent to PARKOUR PRISON-mp4/en.srt'Tr......
💬 21[Last reply:2 months ago] ...103.151**5 Posted at: 2 months ago -
#5607 :Traceback (most recent call last): File "urllib\request.py", line 1348, in do_open File "http\client.py", line 1283, ......
💬 1[Last reply:2 months ago] 模型下载失败,原因是网络无法连接到模型托管服务器(Hugging Face)。openai-whisper(本地内置) 首次使用需在线下载模型,由于国内网络限制或 SSL 证书问题导致下载中断。解决方案:手动下载模型文件 根据使用的模型 large-v3-turbo,下载对应的 .pt 文件,放到软件根目录的 models/ 文件夹下:下载地址:https://openaipublic.azur...36.231**8 Posted at: 2 months ago -
#5606 识别韩语语音用那个模型合适(本地内置)...
💬 3[Last reply:2 months ago] large-v3:准确度最高、速度最慢,推荐显存≥8GB 时使用。large-v3-turbo:速度比 large-v3 快约 2~4 倍,显存占用更低,准确度略低于 large-v3,适合资源有限或追求速度的场景。distil-large-v3.5:蒸馏版本,仅支持英语,不适用于韩语识别。因此,识别韩语时建议在 large-v3(质量优先)和 large-v3-turbo(速度优先)之间选择。...103.219**1 Posted at: 2 months ago -
#5605 gemini 3.5 flash翻译后暂停几秒合适不会出错...
💬 1[Last reply:2 months ago] Gemini 3.5 Flash 翻译后建议暂停 2–3 秒。若使用的是免费 API 额度,为避免触发每分钟请求次数限制(429 错误),可适当增大至 5 秒。操作步骤:打开主界面顶部 菜单 -> 工具/选项 -> 高级选项。找到 字幕翻译调整 区域。修改 翻译后暂停秒 的数值(默认可能是 0 或其他值),填入 2 或 3(免费版填 5)。保存后重启任务即可。若仍出现报错,可进一步降低...103.219**1 Posted at: 2 months ago -
#5604 cli 可以返回 语音识别文本 用户修改确认后 然后使用 修改后的语言文本继续吗...
💬 3[Last reply:2 months ago] 理论上可行,因为 pyVideoTrans 是开源软件,你可以自行修改 cli.py 及核心任务流水线来插入交互暂停。但官方未提供此类修改指南,知识库中也没有实现细节。建议直接使用 GUI 桌面端的单视频精修模式,该模式已内置“识别后编辑字幕”的交互流程。如需自行改造,可参考 videotrans/task/job.py 中 Worker 单视频模式的控制逻辑。...240e**1647 Posted at: 2 months ago -
#5602 LLM Resegment: Set OpenAI Model/Key in Settings....
💬 1[Last reply:2 months ago] The error indicates that the LLM Re-segmentation feature (used for correcting and re-splitting subtitles after ASR) requires an AI model and API key, but you haven't configured them yet.Solution:Go to...2001**936c Posted at: 2 months ago -
#5582 [DEBUG] 开始说话人分离,使用 pyannote/speaker-diarization-3.1 模型[ERROR] 说话人分离出错'NoneType' object has no attribute 'write':Tracebac......
💬 29[Last reply:2 months ago] use_cuda_for_pyannote 不是官方提供的功能。请勿创建。建议直接使用内置说话人分离模型,稳定且支持 GPU。WhisperX API 的 max_speakers 参数并非在 pyVideoTrans 界面中设置。它需要在您自行部署的 whisperx-api 服务端进行配置(例如修改启动参数或配置文件)。软件中 WhisperX 渠道仅要求填写 API 地址和 API Key,...103.151**3 Posted at: 2 months ago -
#5601 NoneTraceback (most recent call last): File "videotrans\task\only_one.py", line 46, in run File "videotrans\task\trans......
💬 1[Last reply:2 months ago] The error VideoTransError: None from Qwen-ASR (Local Built-in) usually indicates one of these underlying issues:The Qwen-ASR model (1.7B) failed to load or is incomplete.On CPU (no CUDA), the 1.7B mod...193.176**9 Posted at: 2 months ago -
#5600 videotrans.configure.excepts.DubbingSrtError: Value: 'Same as the voice reference' (type: <class 'str'>) is not in the list of choices: ['与音色参考音频相同', '使用情感参考音频', '使用情感向量控制']...
💬 1[Last reply:2 months ago] 该错误是 index-tts 开源库内部多语言翻译不一致导致的 Bugs。 解决办法:找到您本地部署的 index-tts 项目根目录下的 webui.py 文件。在文件中全局搜索字符串 i18n("与音色参考音频相同"),将其替换为英文 "Same as the voice reference"。保存文件并重启 index-tts 服务即可。请查阅相关文...123.245**0 Posted at: 2 months ago -
#5599 Pre-process Error Unknown error (empty stderr)Traceback (most recent call last):File "videotrans\util\help_ffmpeg.py", l......
💬 1[Last reply:2 months ago] The error Unknown error (empty stderr) from ffprobe indicates that FFmpeg could not parse the video file, but did not output any error details. This typically occurs due to one of the following reason...123.24**4 Posted at: 2 months ago -
#5598 Whisper.NET setup invalid: Whisper.net.dll not found: D:\win-pyvideotrans-v4.03-0626\deps\Whisper.net.dll; Native direct......
💬 1[Last reply:2 months ago] 该错误是由于 Whisper.NET 渠道缺少运行时依赖造成的。Whisper.NET 需要 pythonnet 库和 .NET 运行时,且仅支持 AMD 显卡通过 Vulkan 加速,在 Windows 打包版中并未内置这些组件。解决方案:放弃 Whisper.NET,改用更稳定的渠道 在「ASR Channel」下拉框中,切换为 faster-whisper(本地内置),并选择合适的模型(如...111.20**0 Posted at: 2 months ago -
#5597 视频翻译最后导出视频,发现视频末尾有一些英文字幕没有合并到视频里面去,字幕翻译阶段是完整的,导出视频就最后差几秒会不完整,这是什么原因,怎么解决呢?...
💬 1[Last reply:2 months ago] 这种情况通常是音画对齐时的截断问题——当配音后的音频时长超出原始视频时长,且未启用音频加速或视频慢速时,超出的部分会被强制裁剪,导致末尾台词丢失。解决方法:在主界面的「同步对齐」区域,勾选「音频加速」(必要时也可同时勾选「视频慢速」),让软件自动调整配音或画面速度来匹配原时长。如果不想改变速度,可尝试在主界面「设置更多参数」→ 增大「配音语速」(如设为 10 或 20),使配音变短。另一种方案:在...2408**b457 Posted at: 2 months ago -
#5596 (18.666667 > 2.400000)2026-07-02 16:19:45,208 - DEBUG - Compression ratio threshold is not met with temperature 0.6 (......
💬 3[Last reply:2 months ago] 你的情况很明确:CUDA 环境或显存配置导致 Whisper 模型在进行 GPU 加速时出现异常,而 CPU 模式因采用不同计算路径可正常完成。核心原因可能包括:CUDA 工具包 / cuDNN 版本与软件绑定的版本不严格匹配(要求 CUDA 12.8+、cuDNN 9.11+)。显存不足 — 当显存被其他程序占用或模型过大时,模型可能回退到降级处理策略,导致压缩比计算异常。计算数据类型冲突 — ...114.233**5 Posted at: 2 months ago -
#5595 [GPT-SoVITS] 该渠道需另行部署并启动后可用[https://pyvideotrans.com/gptsovits]Traceback (most recent call last): File "urllib3\connect......
💬 1[Last reply:2 months ago] 错误原因:pyVideoTrans 尝试连接 GPT-SoVITS 的 API 服务,但目标计算机(127.0.0.1:9880)拒绝了连接 – 说明 GPT-SoVITS 服务未启动或配置的 API 地址/端口不正确。解决方案:确认 GPT-SoVITS 已部署并启动:您需要先在本地部署 GPT-SoVITS,然后启动它的 API 服务(api.py 或 api_v2.py)。启动后会在终端看到...65.49**3 Posted at: 2 months ago -
#5594 (18.666667 > 2.400000)2026-07-02 16:19:45,208 - DEBUG - Compression ratio threshold is not met with temperature 0.6 (......
💬 1[Last reply:2 months ago] 这个日志是 Whisper 语音识别模型在尝试转录时,因为音频质量或背景噪声问题导致多次温度采样均不满足压缩比或对数概率阈值,从而无法输出有效文本。模型反复尝试(0.0~1.0)仍未通过,常见于以下情形:音频片段中无有效人声(如纯背景音乐、噪音、静音或极低音量)发音语言选择错误(例如视频是日语但你选了中文)环境噪声过大,VAD 未正确过滤解决方案确认发音语言:在主界面正确选择 Spoken Lan...114.233**5 Posted at: 2 months ago -
#5593 如何抹除原来的字幕...
💬 1[Last reply:2 months ago] pyVideoTrans 无法去除视频画面中已有的硬字幕(即直接嵌入视频像素中的字幕)。软件的核心功能是基于音轨进行语音识别和翻译,无法识别或修改视频画面像素。替代方案:使用专门的硬字幕去除工具,例如 Video Subtitle Remover 或 Remove Logo Now(需自行搜索)。如果硬字幕位置固定,可使用视频裁剪工具(如 FFmpeg)将该区域裁剪掉。使用 AI 修复工具(如 O...219.76**6 Posted at: 2 months ago -
#5592 omnivoice 该渠道需另行部署并启动后可用self.api_url='http://127.0.0.1:7860'[WinError 10061] 由于目标计算机积极拒绝,无法连接。[https://pyvideotrans.com/......
💬 1[Last reply:2 months ago] 报错原因是 OmniVoice 服务未启动。pyVideoTrans 无法连接到 http://127.0.0.1:7860,说明你本地没有运行 OmniVoice 的 WebUI 服务。解决方法:部署并启动 OmniVoice 服务 请参考官方文档,在你的电脑上完成 OmniVoice 的安装和启动(默认地址即为 http://127.0.0.1:7860)。确认服务已正常运行 在浏览器中打...65.49**3 Posted at: 2 months ago -
#5591 NoneTraceback (most recent call last): File "videotrans\task\only_one.py", line 46, in run File "videotrans\task\trans......
💬 1[Last reply:2 months ago] 该错误是由于 Qwen-ASR(本地内置) 模型加载或音频预处理时失败导致的,具体原因可能是:模型文件未正确下载或损坏:首次使用 Qwen-ASR 需要在线下载模型文件(约1.7B参数),网络不稳定或下载中断可能导致模型不完整。内存不足:未启用 CUDA 加速,使用 CPU 加载 1.7B 模型需要大量内存(建议至少 16GB 空闲内存)。若内存不足,子进程可能静默崩溃,返回空错误。音频预处理失败...123.152**0 Posted at: 2 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.