-
#4400 如何设置语音转字幕,准确率更高...
💬 1[Last reply:3 months ago] 这是针对无GPU环境下使用本地 Qwen-ASR 模型并配合 LLM 重新断句,提升中文语音转字幕准确率的最佳参数设置。基础设置在“语音识别”行选择 qwen-asr(本地),模型保持1.7B。发音语言务必手动选择“中文”,不要使用auto,避免模型判断错误导致识别率下降。主界面不勾选CUDA加速。核心语音识别参数(菜单 → 工具/选项 → 高级选项 → 语音识别参数)语音阈值:0.5。低于此值的...2408:8210* Posted at: 3 months ago -
#4399 [WinError 10061] 由于目标计算机积极拒绝,无法连接。 Traceback (most recent call last): File "httpx\_transports\default.py", line 101, in map_httpcore_exceptions File "httpx\_transports\default....
💬 1[Last reply:3 months ago] 这是由于 OmniVoice-TTS 本地服务没有启动或 API 地址配置错误,导致软件无法连接。错误信息 [WinError 10061] 由于目标计算机积极拒绝,无法连接 表示目标端口没有监听。请按以下步骤排查:确保 OmniVoice-TTS 服务已启动 OmniVoice-TTS 需要独立部署并运行 API 服务。如果你使用的是整合包,找到启动脚本双击运行;如果是源码部署,执行对应的启动...2408:8214* Posted at: 3 months ago -
#4398 3.99的更新补丁包地址?...
💬 1[Last reply:3 months ago] 补丁包与完整安装包在同一地址发布。请前往官方下载页面获取:https://pyvideotrans.com/downpackage...2408:8214* Posted at: 3 months ago -
#4397 requests.exceptions.ProxyError: HTTPSConnectionPool(host='edge.microsoft.com', port=443): Max retries exceeded with url: /translate/auth (Caused by ProxyError('Unable to connect to...
💬 1[Last reply:3 months ago] 这是代理配置错误导致无法连接微软翻译服务(edge.microsoft.com)。您在软件主界面的“网络代理地址”文本框中填写了代理地址,但该代理无法连接(目标计算机积极拒绝)。解决方法(二选一):如果您无需使用代理:直接删掉“网络代理地址”文本框里填写的所有内容(留空),然后重试。如果您必须使用代理:确保代理软件(如 Clash、V2Ray 等)正在运行;检查代理地址和端口是否填写正确(例如 h...125.78* Posted at: 3 months ago -
#4394 需要翻译的视频是没有声音,但视频中的韩文怎么翻译,单独翻译的话是没有效果...
💬 3[Last reply:3 months ago] 视频无法读取时长(“截取不到视频时长”)通常是文件路径问题或 FFmpeg 解析失败所致。 最常见的原因是:视频文件路径太长(超过 200 字符)或包含 中文、特殊符号、空格(Windows 下尤其严重);视频文件本身已损坏或不完整;软件缺少 FFmpeg 或 FFmpeg 环境变量未正确配置。解决方案(按顺序尝试)缩短并重命名文件 将视频文件移动到浅层目录(如 D:\videos),并改名为...240e:840* Posted at: 3 months ago -
#4395 TaskCfgSTS(is_cuda=False, uuid='3d0e0e2cdd', cache_folder=None, target_dir='J:/YouTube/DIY', source_language=None, source_language_code='English', source_sub='J:/YouTube/DIY/Evolut...
💬 1[Last reply:3 months ago] 这是因为发送给AI翻译模型的字幕总长度超过了该模型允许的最大Token数(max_tokens),导致响应被截断。您当前使用的“兼容AI/本地模型”渠道的max_tokens限制为4096,而本次请求的prompt_tokens+completion_tokens已达7122个。解决方案(按推荐顺序):减少每次发送的字幕行数:打开 菜单 → 工具/选项 → 高级选项 → 字幕翻译调整,将 “AI翻...14.153* Posted at: 3 months ago -
#4393 TaskCfgSTS(is_cuda=False, uuid='39bed11d8d', cache_folder=None, target_dir='...
💬 7[Last reply:3 months ago] 错误 [WinError 10061] 由于目标计算机积极拒绝,无法连接 表明软件无法与本地大模型 API 服务建立连接,核心原因是服务未运行或地址配置错误。请按以下顺序排查:验证服务是否在运行 在命令行执行 curl http://127.0.0.1:11434/v1/models(请替换为实际端口)。若提示“连接失败”,说明服务未启动。请启动你的本地大模型服务(如 Ollama、vLLM)。...240e:3ba* Posted at: 3 months ago -
#4392 在不勾选清理已生成的前题下,已经配过的音频如何在第2次合成时自动调用...
💬 9[Last reply:3 months ago] 根据日志分析,你在没有关闭软件的情况下,第二次合成时仍然触发了重新配音。这说明即便不关闭软件,配音阶段的临时音频缓存也在第一次翻译任务完成后被自动清除了。这是 pyVideoTrans 的一项设计:为了节省磁盘空间,当一个完整的视频翻译任务(配音→对齐→合成)结束时,软件会立即删除该任务在 tmp 目录下生成的中间配音文件(例如分句 wav、拼接后的 target.wav 等)。因此,即使你没有退...103.172* Posted at: 3 months ago -
#4391 TaskCfgSTS(is_cuda=False, uuid='844b36d1b1', cache_folder=None, target_dir=...
💬 1[Last reply:3 months ago] 连接错误,是因为软件无法与本地部署的大模型服务建立连接,通常由服务未启动、API 地址错误或端口未开放导致。确认本地大模型服务(如 Ollama、vLLM 等)正在运行,且监听在预期的地址和端口(例如 Ollama 默认 http://localhost:11434)。打开软件菜单 → “翻译设置” → “本地大模型设置”,检查填写的 API 地址是否与服务一致(需包含协议和端口,如 http:/...14.153* Posted at: 3 months ago -
#4389 完全相同的参数,每次翻译完的结果会不一样,如何保证稳定...
💬 9[Last reply:3 months ago] LLM 重新断句的核心任务是优化字幕的语义连贯性和断句结构,并非专门设计用于修正离谱的错误单词。它的处理流程是:读取 SRT 中的原始文本,利用大语言模型对上下文的理解,将零散的短句合并或拆分成长度适宜的完整句子,并同步调整时间轴。在这个过程中,LLM 可能会顺带根据上下文自动修正部分明显的同音错别字或不通顺的表述,但这属于非确定性行为。如果识别错误过于严重(如完全错误的单词),LLM 通常无法可...103.172* Posted at: 3 months ago -
#4206 克隆音色,怎么不支持上传本地音色,好像没有批量处理,右边字幕只能上传一个视频的吗?想节约时间,提前修改好字幕这样节省时间,但是没有批量处理的...
💬 15[Last reply:3 months ago] AI感强和断句突兀通常是由语音识别时的字幕切分策略、配音语速/停顿处理不当导致的。可针对性地调整以下参数,让最终音频更加自然流畅。减少句间停顿、使衔接更连贯移除配音前后静音缓冲:进入菜单 → 工具 → 高级选项 → 字幕配音调整,勾选 “移除配音前后静音缓冲”。这会裁剪掉每条配音开头和结尾的静音,使句子衔接更紧凑(但结尾可能稍显仓促,请根据效果取舍)。调整静音分割持续毫秒:进入菜单 → 工具 → ...74.48* Posted at: 3 months ago -
#4390 TaskCfgSTT(is_cuda=True, uuid='707d968762', cache_folder='E:/PyVideoTrans v3.99(Subtitle generation and translation software)/tmp/3036/707d968762', target_dir='E:/PyVideoTrans v3.9...
💬 1[Last reply:3 months ago] 这是由 NVIDIA 50 系列显卡(Blackwell 架构)与 CUDA 库不兼容导致的 cuBLAS 调用失败。解决方案:确认已安装 CUDA 12.8 和 cuDNN 9.11(与软件内置版本匹配)。在软件菜单中进入 工具/选项 → 高级选项,将 CUDA数据类型 改为 float16 或 int8。仍然不行时,在系统环境变量中添加以下项并重启软件:变量名:CUBLAS_WORKSPACE...14.153* Posted at: 3 months ago -
#4388 采样温度具体说一下作用...
💬 3[Last reply:3 months ago] 采样温度在 pyVideoTrans 文档中未明确列出默认值,但依据 Whisper 系列模型的标准做法,该值通常默认为 0.0(即完全确定性解码)。在实际使用中,保持软件默认值即可,一般情况下无需调整;若遇到频繁的重复输出,可尝试将此值略微调高(如 0.2~0.5)。...103.172* Posted at: 3 months ago -
#4387 cli模式怎样批量合并视频和字幕?...
💬 1[Last reply:3 months ago] CLI模式目前不支持【工具】【视频与字幕合并】的批量操作。其支持的任务类型仅包含语音转录(stt)、文字转语音(tts)、字幕翻译(sts)和视频翻译(vtv),未提供视频与字幕的混流功能。如需批量合并视频和字幕,请使用图形界面的“工具 -> 视频与字幕合并”完成,或自行编写调用 FFmpeg 的批处理脚本。...216.195* Posted at: 3 months ago -
#4386 TaskCfgSTT(is_cuda=True, uuid='aa9e13113a', cache_folder='E:/haokang/win-pyvideotrans-v3.91_20251220_225815/tmp/10568/aa9e13113a', target_dir='E:/haokang/win-pyvideotrans-v3.91_202...
💬 1[Last reply:3 months ago] 这是由于软件缺少 qwen_asr 模块,通常是因使用了不完整的补丁包或环境损坏导致的。解决方案:重新下载最新完整版:前往 pyvideotrans.com/downpackage 获取 v3.99 完整软件包(.7z 压缩包),不要只下载补丁。正确解压:将完整包解压到非系统盘、无中文和特殊符号的路径(例如 D:\pyVideoTrans),不要直接覆盖到旧版本文件夹。清理旧缓存:在解压后的新软件...34.177* Posted at: 3 months ago -
#4385 TaskCfg(cache_folder='D:/My Softwares/视频翻译配音 Pyvideotran 3.96/tmp/9728/5c77fab096', target_dir='E:/迅雷下载/_video_out/床上丽拉 2026-mp4', remove_noise=False, is_separate=False, detect_lan...
💬 1[Last reply:3 months ago] 这是由文件路径含有中文、空格或特殊符号导致的。软件在尝试创建并写入 ko.srt 文件时,因为目标路径可能无法正常创建,从而抛出 FileNotFoundError。解决方法:将视频文件移动到纯英文(无中文、空格、特殊符号)的短路径下,例如 E:\video\input.mp4。在软件中重新选择该视频,并确保输出目录也使用类似简洁路径(点击“输出到..”按钮单独设置,不要使用自动带原视频名的复杂文...120.217* Posted at: 3 months ago -
#4384 TaskCfgVTT(is_cuda=True, uuid='1e2b9bb1a7', cache_folder='D:/win-pyvideotrans-v3.98-314/tmp/18908/1e2b9bb1a7', target_dir='C:/课程/《STAAD.Pro澳洲规范钢结构设计教程》/_video_out/1、Creating Physic...
💬 1[Last reply:3 months ago] 这是显存或内存不足导致的进程崩溃。错误发生在整个视频同时发送给faster-whisper进行识别时(_overall.py 的 _faster 函数),因为您开启了 二次识别 (recogn2pass=True) 并选择了 large-v3-turbo 模型,在CUDA加速下双任务并发加剧了显存消耗。请按顺序尝试以下方案:立即取消“二次识别” 关闭主界面“配音渠道”行右侧的 二次识别 开关。该...218.48* Posted at: 3 months ago -
#4383 TaskCfgSTT(is_cuda=True, uuid='90e5c416ef', cache_folder='E:/win-pyvideotrans-v3.99-428/tmp/15200/90e5c416ef', target_dir='E:/_pyVideotrans Output/recogn', source_language=None, so...
💬 1[Last reply:3 months ago] 由于输入视频文件路径中含有中文和空格,导致 FFmpeg 命令行在创建输出文件时失败(Invalid argument)。这在 Windows 系统中尤为常见,即使路径被引号包围也可能触发编码兼容性问题。解决方案将原始视频 E:/0DayDown/教程_Tutorials/Unreal/Verse Bootcamp UEFN Academy/2 - Core Basics/4. Operators...103.172* Posted at: 3 months ago -
#4382 submitting packet to decoder: Invalid data found when processing input submitting packet to decoder: Invalid data found when processing input submitting packet to decoder: Invalid ...
💬 1[Last reply:3 months ago] 这是 FFmpeg 解码输入文件时遇到损坏或无法识别的数据 所致。错误信息 Invalid data found when processing input 表明视频文件 A:/kasi1111/01.mp4 可能已损坏、编码异常,或存放在不稳定的磁盘(如网络驱动器、移动硬盘)上导致读取数据错误。请按以下步骤排查:将视频复制到本地磁盘(如 D 盘根目录),并将文件名改为简短的英文/数字,例如 D:...91.243* Posted at: 3 months ago -
#4381 openai.NotFoundError: Error code: 404 - {'detail': 'Not Found'}...
💬 1[Last reply:3 months ago] This is caused by an incorrect API endpoint or model name for the OpenAI TTS service. The 404 error indicates the requested resource was not found on the server.Verify that you have correctly filled i...2405:4802* Posted at: 3 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.