-
#5623 文件不存在:C:\Users\z000gejt\Downloads\win-pyvideotrans-v4.03-0626\tmp\6568\vas-1783150649.3484106.srt...
💬 1[Last reply:1 month ago] 错误原因:软件在临时目录 tmp/6568/ 下未找到预期的 vas-*.srt 文件。通常是由于以下任一情况导致:误选了"清理已生成":该选项会在新任务开始前删除之前的临时文件,如果任务中止或重复启动,会导致依赖的中间文件丢失。任务异常中断:之前运行的任务在中途崩溃或手动停止,未能正常生成该缓存文件。路径/权限问题:临时目录被第三方清理工具(如杀毒软件、系统垃圾清理)误删。解决方法取消勾选"清理...168.138* Posted at: 1 month ago -
#5622 videotrans.configure.excepts.DubbingSrtError: Cannot find a function with `api_name`: /basic_tts....
💬 1[Last reply:1 month ago] 这是因 F5-TTS 或相关 Gradio API 服务未正确启动或 API 地址配置错误导致的。解决方法:确认服务已启动:确保已正确启动 F5-TTS 服务(例如执行 f5-tts/gradio.py 或对应启动脚本)。服务启动后控制台应有 Running on local URL: http://127.0.0.1:7860 等输出。检查 API 地址配置:在软件菜单 → TTS 设置 → F...122.190* Posted at: 1 month ago -
#5620 字幕翻译后,文本消失了好几行·显示是空...
💬 11[Last reply:1 month ago] 知识库中没有针对 4GB 显存可以稳定运行的本地翻译大模型的具体推荐。现有的本地翻译渠道(M2M100)需求较模糊,通常需要 6GB+ 显存才能流畅运行 large 版本,4GB 显存极易爆显存。建议以下更可靠的方案:换用在线翻译渠道(完全避免本地显存占用)免费:Microsoft 翻译(无需代理)、Google 翻译(需代理)收费但便宜:DeepL、百度翻译、腾讯翻译、DeepSeek API(...112.224* Posted at: 1 month ago -
#5621 No transcription results returned. Please check the original audio/video or model and try again.Traceback (most recent c......
💬 1[Last reply:1 month ago] No transcription results returned 表示 faster-whisper 模型未能从音频中检测到任何语音内容。结合你的配置(未启用CUDA加速,使用 large-v3-turbo 模型),核心原因是在纯CPU环境下运行大模型导致内存不足或处理异常。解决方案(按推荐顺序尝试):切换为更小的模型 在语音识别渠道中选择 small 或 base 模型,它们对CPU内存的需...116.16* Posted at: 1 month ago -
#5619 System Error (None): NoneTraceback (most recent call last): File "/Users/cuichi/pyvideotrans/.venv/lib/python3.10/site-......
💬 1[Last reply:1 month ago] This error is caused by a missing system library: libsndfile. PyVideoTrans requires libsndfile as a system dependency on macOS.Solution:Install libsndfile via Homebrew:brew install libsndfileAfter ins...2a09:bac3* Posted at: 1 month ago -
#5618 语音识别阶段出错[阿里FunASR(本地)(本地内置)] CUDA out of memory. Tried to allocate 3.42 GiB. GPU 0 has a total capacity of 7.96 GiB of w......
💬 1[Last reply:1 month ago] 这是由于显卡显存不足导致的。你的 GPU 0 总容量约 8GB,但 FunASR 模型和 PyTorch 已分配了 10.5 GB(包含部分预留),导致无法继续分配。解决方法(按推荐顺序尝试):切换为识音效果相近但显存占用低的本地渠道:在「ASR Channel」中选择 faster-whisper(本地内置),模型选 large-v3-turbo 或 medium。这两个模型对 8GB 显存更友...15.235* Posted at: 1 month ago -
#5617 语音识别阶段出错[openai-whisper(本地内置)] :Traceback (most recent call last): File "urllib\request.py", line 1348, in do_open Fil......
💬 1[Last reply:1 month ago] 这是由于 openai-whisper 尝试从 openaipublic.azureedge.net 在线下载模型时,SSL 证书验证失败导致的模型下载中断。常见原因包括:系统时间不正确、网络防火墙或代理干扰中国大陆访问该域名、系统证书过旧。解决方案:检查系统时间:确保电脑的日期和时间设置正确(尤其年份和时区),时间错误会导致 SSL 证书验证失效。暂时关闭代理或 VPN:如果开启了代理,请关闭后...183.195* Posted at: 1 month ago -
#5616 语音识别阶段出错[阿里FunASR(本地)(本地内置)] 处理列表或序列时索引越界:list index out of rangeTraceback (most recent call last):File "videotrans\task......
💬 1[Last reply:1 month ago] 该报错是因阿里FunASR语音识别渠道对韩语支持不足,在处理音频切片后列表为空(无有效语音片段)导致索引越界。解决方案(按优先级):更换ASR渠道为 faster-whisper(本地内置) 并选用 large-v3模型,该渠道对韩语识别效果更好,且支持CUDA加速。检查原始音频文件是否确实包含清晰的韩语人声,可先用播放器试听确认。请查阅相关文档:阿里FunASR说明faster-whisper本...206.189* Posted at: 1 month ago -
#5615 设置参数:批量翻译时每批数量:2CPU同时任务数:2GPU同时任务数:1电脑内存32GB任务开始分离音频时,电脑内存占满,运行卡顿,有没有办法缓解卡顿?...
💬 1[Last reply:1 month ago] 这是人声背景分离(UVR-onnx)纯CPU操作导致的。32GB内存下同时处理2个视频的分离,每个分离进程都可能消耗大量内存(比如分离模型加载和音频数据处理),加上CPU同时任务数2,导致内存爆满。缓解方案(按优先级操作):降低并发量:将批量翻译时每批数量设为 1(菜单-工具-高级选项-通用设置)。将CPU同时任务数[重启生效]设为 1(同上),重启软件后生效。这能保证同时只有一个分离任务运行,内...220.203* Posted at: 1 month ago -
#5614 TTS speak request failed, please verify your input and ensure theservice is operational.:Traceback (most recent call las......
💬 1[Last reply:1 month ago] 此错误表明 TTS 配音引擎无法处理请求,常见原因有:API 密钥无效/余额不足、本地服务未启动、网络代理配置错误、或输入内容(如字幕文本)格式异常。请按以下步骤排查:检查使用的配音渠道:是 Edge-TTS、GPT-SoVITS、OmniVoice 还是其他?确认服务状态:若使用本地渠道(如 GPT-SoVITS、OmniVoice),确认对应服务已启动且 API 地址正确。若使用在线渠道(如 ...240e:36f* Posted at: 1 month ago -
#5613 如何减少配音角色的机械感...
💬 3[Last reply:1 month ago] 使用 Qwen-TTS 进行声音克隆,软件会自动从原始视频中截取参考音频(无需您手动准备)。如果需要使用自己的音频文件(例如您自己录制的音色),则需要额外配置。操作流程(克隆原视频音色)选择 Qwen-TTS 渠道:在主界面「Dubbing Channel」下拉列表中选择 Qwen-TTS(本地内置)。第一次使用时软件会自动下载模型(约1~2分钟)。选择 clone 角色:在「Select Voi...171.83* Posted at: 1 month ago -
#5612 什么导出后文件里没有视频文件...
💬 1[Last reply:1 month ago] 导出后没有视频文件通常由以下原因导致:输出目录不正确:默认翻译后的视频保存在原视频所在目录下的 _video_out 文件夹内,而不是原视频同目录。请检查该文件夹。勾选了"仅输出mp4":若主界面勾选了该项,只有最终MP4会被保留,其他字幕、音频等会被删除,但视频本身应该存在。如果连MP4也没有,说明任务可能未正常完成。任务中途失败:语音识别、翻译或配音环节出错会导致任务中断,不会生成最终视频。可...218.94* Posted at: 1 month ago -
#5610 [WARNING] [SpeedRate] Rubberband 不可用,将使用pydub+ffmpeg处理音频加速。...
💬 3[Last reply:1 month ago] Windows 源码部署流程如下:安装依赖Python 3.10(建议使用)uv 包管理器(pip install uv)FFmpeg:将 ffmpeg.exe / ffprobe.exe 放入系统 PATH 或项目根目录下的 ffmpeg/ 文件夹libsndfile:Windows 下可通过 uv add pysoundfile 自动处理克隆仓库并安装 在命令行执行:git clone ht...240e:36f* Posted at: 1 month ago -
#5608 开启视频缓速和语音加速后为什么最后几秒视频还是会卡顿...
💬 3[Last reply:1 month ago] 中文转泰文时,由于泰文的音节数和语法结构与中文差异较大,配音后的时长变化会更加明显,导致同步问题比常见语种更突出。建议按以下顺序调整:1. 强制音频加速(必选) 在主界面“同步对齐”行,仅勾选“音频加速”,不勾选“视频慢速”。加速会压缩配音片段使其匹配原时长,这是最有效的缓解手段。2. 降低语速适配 在“设置更多参数”中,将配音语速设置为 -10 至 -20(如 -15),让泰文配音读得更慢一...240e:36f* Posted at: 1 month ago -
#5609 MemoryError...
💬 1[Last reply:1 month ago] 这是 内存不足(MemoryError) 导致的崩溃,通常发生在 faster-whisper 处理长音频或使用 large-v3 模型时,系统物理内存(RAM)或显卡显存耗尽。解决方法:更换更小的模型 进入主界面 ASR Channel → 更换为 small 或 medium 模型(large-v3 至少需要 16GB 内存 / 10GB 显存)。启用 CUDA 加速(若您有 NVIDIA ...1.164* Posted at: 1 month ago -
#5603 保存字幕前格式化srt失败:file='D:/pyvideotrans/win-pyvideotrans-v4.03-0626/Minecraft but I get sent to PARKOUR PRISON-mp4/en.srt'Tr......
💬 21[Last reply:1 month ago] ...103.151* Posted at: 1 month ago -
#5607 :Traceback (most recent call last): File "urllib\request.py", line 1348, in do_open File "http\client.py", line 1283, ......
💬 1[Last reply:1 month ago] 模型下载失败,原因是网络无法连接到模型托管服务器(Hugging Face)。openai-whisper(本地内置) 首次使用需在线下载模型,由于国内网络限制或 SSL 证书问题导致下载中断。解决方案:手动下载模型文件 根据使用的模型 large-v3-turbo,下载对应的 .pt 文件,放到软件根目录的 models/ 文件夹下:下载地址:https://openaipublic.azur...36.231* Posted at: 1 month ago -
#5606 识别韩语语音用那个模型合适(本地内置)...
💬 3[Last reply:1 month ago] large-v3:准确度最高、速度最慢,推荐显存≥8GB 时使用。large-v3-turbo:速度比 large-v3 快约 2~4 倍,显存占用更低,准确度略低于 large-v3,适合资源有限或追求速度的场景。distil-large-v3.5:蒸馏版本,仅支持英语,不适用于韩语识别。因此,识别韩语时建议在 large-v3(质量优先)和 large-v3-turbo(速度优先)之间选择。...103.219* Posted at: 1 month ago -
#5605 gemini 3.5 flash翻译后暂停几秒合适不会出错...
💬 1[Last reply:1 month ago] Gemini 3.5 Flash 翻译后建议暂停 2–3 秒。若使用的是免费 API 额度,为避免触发每分钟请求次数限制(429 错误),可适当增大至 5 秒。操作步骤:打开主界面顶部 菜单 -> 工具/选项 -> 高级选项。找到 字幕翻译调整 区域。修改 翻译后暂停秒 的数值(默认可能是 0 或其他值),填入 2 或 3(免费版填 5)。保存后重启任务即可。若仍出现报错,可进一步降低...103.219* Posted at: 1 month ago -
#5604 cli 可以返回 语音识别文本 用户修改确认后 然后使用 修改后的语言文本继续吗...
💬 3[Last reply:1 month ago] 理论上可行,因为 pyVideoTrans 是开源软件,你可以自行修改 cli.py 及核心任务流水线来插入交互暂停。但官方未提供此类修改指南,知识库中也没有实现细节。建议直接使用 GUI 桌面端的单视频精修模式,该模式已内置“识别后编辑字幕”的交互流程。如需自行改造,可参考 videotrans/task/job.py 中 Worker 单视频模式的控制逻辑。...240e:36f* Posted at: 1 month ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.