-
#4981 TaskCfgVTT(uuid='724416a535', name='C:/Users/yue/Desktop/1000.mp4', dirname='C:/Users/yue/Desktop', noextname='1000', basename='1000.mp4', ext='mp4', target_dir='C:/Users/yue/Deskt...
💬 1[Last reply:3 months ago] 语音识别阶段失败的根本原因是 faster-whisper 返回了空结果,通常由以下情况导致:音频中无有效人声、VAD 过滤掉了所有语音片段、或人声背景分离后生成的音频文件为空。解决方案(按推荐顺序尝试):检查视频是否包含清晰的人声 播放视频确认确实有说话声音,且背景噪音不过大。暂时关闭降噪和人声背景分离 您同时勾选了“降噪”和“分离人声背景声”,根据软件逻辑两者同时选中时只执行分离。请先取消...240e**473e Posted at: 3 months ago -
#4980 TaskCfgVTT(uuid='724416a535', name='C:/Users/yue/Desktop/1000.mp4', dirname='C:/Users/yue/Desktop', noextname='1000', basename='1000.mp4', ext='mp4', target_dir='C:/Users/yue/Deskt...
💬 1[Last reply:3 months ago] 语音识别阶段返回空结果,说明 faster-whisper 未从视频中提取到任何有效语音片段。常见原因及解决方案如下:检查视频是否包含人声且语言正确确认视频确实有清晰的说话声,而非纯音乐或静音。源语言选择“简体中文”必须与视频实际语言一致,否则模型无法识别。降低模型大小或调整识别参数当前使用 large-v3-turbo 模型较大,在 CPU 上可能因内存不足或耗时过长导致子进程崩溃返回空。建议先...240e**473e Posted at: 3 months ago -
#4979 TaskCfgVTT(uuid='c2fbaed3bb', name='C:/Users/yue/Desktop/1000型-铁屑破碎.mp4', dirname='C:/Users/yue/Desktop', noextname='1000型-铁屑破碎', basename='1000型-铁屑破碎.mp4', ext='mp4', target_dir='...
💬 1[Last reply:3 months ago] 语音识别阶段未返回任何结果,通常是因为 视频文件路径或名称包含中文、空格或特殊符号(如 1000型-铁屑破碎.mp4),导致 ffmpeg 在提取音频或处理文件时出错,无法生成有效音频送入 Whisper 模型。解决方案:简化视频文件名和路径 将视频文件移动到一个仅包含英文字母和数字的浅层目录(如 D:\videos\test.mp4),删除或替换掉 型-、铁屑 等中文字符。 示例:C:\te...240e**473e Posted at: 3 months ago -
#4973 Admin大神,二次识别后,能不能加个与识别前字幕比对纠错的步骤?...
💬 9[Last reply:3 months ago] 软件会将 prompts/recharge/recharge-llm.txt 中的系统提示词与字幕文本拼接后,作为一条完整消息发送给 DeepSeek。由于知识库未收录该提示词的具体内容,我无法给出精确模拟。但您可以直接打开软件安装目录下的 prompts/recharge/recharge-llm.txt 文件查看完整原文。通常其结构如下(示例性说明):系统提示词(要求AI对字幕进行重新断句、修...120.229**8 Posted at: 3 months ago -
#4978 TaskCfgVTT(uuid='50a926720d', name='F:/remix/Remix1.mp4', dirname='F:/remix', noextname='Remix1', basename='Remix1.mp4', ext='mp4', target_dir='F:/yifanyi/Remix/Remix1-mp4', cache_...
💬 5[Last reply:3 months ago] 你提供的 SRT 文件内容格式是正常的,但 ffmpeg 在读取时出错,常见原因包括:文件编码问题:SRT 文件可能是带有 BOM 的 UTF-8 或 ANSI 编码,导致 ffmpeg 无法解析。请用记事本打开该文件,另存为 UTF-8 无 BOM 格式后再试。文件路径特殊字符或过长:临时目录 C:/Users/PC/Desktop/pyvid/tmp/9212/50a926720d/ 路径较长...166.0**4 Posted at: 3 months ago -
#4976 TaskCfgVTT(uuid='4de6809276', name='F:/music remix/Remix (1).mp4', dirname='F:/music remix', noextname='Remix (1)', basename='Remix (1).mp4', ext='mp4', target_dir='F:/_video_out/m...
💬 3[Last reply:3 months ago] 不客气,问题解决后如遇其他疑问,随时提供日志。...166.0**4 Posted at: 3 months ago -
#4974 TaskCfgVTT(uuid='febd86e482', name='F:/混音/【电子音乐】手把手教你母带-p10-80.mp4', dirname='F:/混音', noextname='【电子音乐】手把手教你母带-p10-80', basename='【电子音乐】手把手教你母带-p10-80.mp4', ext='mp4', target_dir='...
💬 3[Last reply:3 months ago] 不客气,后续有问题随时提出。...166.0**2 Posted at: 3 months ago -
#4972 Resegment:ended之后就不动了,卡住了...
💬 18[Last reply:3 months ago] 二次识别(recogn2pass)本身是对配音后的音频再次进行 ASR 转录,目的是生成与配音精确对齐的简短字幕。由于两次转录使用的模型和语音(原始音频 vs 配音音频)不同,产生错别字是常见现象。软件暂无自动与识别前字幕逐行比对的纠错功能,但可通过以下方式减轻错别字影响:使用单视频交互模式 在单视频翻译时,二次识别后会弹出字幕编辑框(如知识库第 5.3 节所述),您可以手动将出现错别字的行与之...120.229**8 Posted at: 3 months ago -
#4971 gradio_client.exceptions.AppError: [Errno 2] No such file or directory: 'models\\openbmb__VoxCPM2\\config.json'...
💬 1[Last reply:3 months ago] 这是由于你本地部署的 VoxCPM-TTS 服务 缺少模型文件 models/openbmb__VoxCPM2/config.json。该错误由 gradio_client 从服务端返回,并非 pyVideoTrans 本身问题。解决方法检查 VoxCPM-TTS 的部署 确保你部署的 VoxCPM-TTS 服务(通常是 Gradio 应用)已正确下载模型。模型文件应位于其根目录下的 model...129.128**3 Posted at: 3 months ago -
#4970 videotrans.configure._except.StopRetry: [WinError 10061] 由于目标计算机积极拒绝,无法连接。...
💬 1[Last reply:3 months ago] 这是由于 F5-TTS 或 Index-TTS 等本地 API 配音渠道的服务未启动或连接地址配置错误导致的。解决方案:确认后端服务已启动:确保你已经独立运行了对应的 TTS 服务(例如 F5-TTS 的 webui.py 或 Index-TTS 服务),且终端窗口保持打开状态,未关闭或崩溃。检查 API 地址配置:在软件菜单栏点击 TTS设置 → F5-TTS,检查“API 地址”是否填写正确,...129.128**3 Posted at: 3 months ago -
#4329 能否使用ollama安装的本地大模型...
💬 7[Last reply:3 months ago] 修改 Ollama(兼容AI/本地模型)翻译提示词的方法:打开软件顶部菜单 → 翻译设置 → 本地大模型设置。在弹出窗口中点击 修改提示词 按钮,即可编辑发送给模型的翻译指令模板。如果你需要手动修改文件,提示词模板位于软件安装目录下的 prompts/srt/(发送完整字幕时使用)和 prompts/text/(未发送完整字幕时使用)文件夹内,文件名对应各 AI 渠道。对于“兼容AI/本地模型”渠...2409**8329 Posted at: 4 months ago -
#4969 videotrans.configure._except.StopRetry: E:/pyvideotrans/tmp/101960/b9f2cb5954/clone-333.wav is not exists...
💬 3[Last reply:3 months ago] OmniVoice 服务端报错 Reference audio is empty after silence removal,核心原因是发送给 OmniVoice 的参考音频在内部静音消除后内容为空(通常是参考音频过短、全静音或已损坏)。请按以下步骤排查:确保参考音频时长达标 如果你使用 clone 角色(从原视频截取参考音频),请确认最短语音持续毫秒 ≥ 3000,最长语音持续秒数 ≤ 10,...129.128**3 Posted at: 3 months ago -
#4968 openai.OpenAIError: Missing credentials. Please pass an `api_key`, `workload_identity`, `admin_api_key`, or set the `OPENAI_API_KEY` or `OPENAI_ADMIN_KEY` environment variable....
💬 1[Last reply:3 months ago] The error indicates a missing API key for the AI translation channel you are using (e.g., OpenAI, DeepSeek, Gemini). The traceback shows Missing credentials – no API key was provided.Solution:Open the...191.6**6 Posted at: 3 months ago -
#4967 视频翻译存在明显间隔,导致不连贯。并且存在最后一分钟无声音...
💬 7[Last reply:3 months ago] 最后五分钟无声,根因在于音画对齐阶段(Audio-Sync)检测到某条字幕(如[517])的原始时长计算为负数(-204685ms),这导致后续所有处理无法匹配,最终音频在那一时刻被强制截断。诊断步骤(建议按顺序执行)确认原始视频时长和完整性 打开命令行,运行:ffprobe -v error -show_entries format=duration -of default=noprint_w...129.128**3 Posted at: 3 months ago -
#4966 TaskCfgVTT(uuid='777ba972c7', name='E:/A Girl Wakes.mp4', dirname='E:/', noextname='A Girl Wakes', basename='A Girl Wakes.mp4', ext='mp4', target_dir='E:/_video_out/A Girl Wakes-mp...
💬 1[Last reply:3 months ago] The error indicates a network timeout when your system tried to reach the local AI/API service for translation (translate_type=8 – compatible AI/local model). This means the request to your local API ...191.6**6 Posted at: 3 months ago -
#4965 Error opening output files: No such file or directory...
💬 1[Last reply:3 months ago] The error is caused by the file path containing spaces and potentially other special characters (A Girl Wakes Up in a Restaurant and Meets 6 Handsome Boys, but one of them...), which causes ffmpeg to ...191.6**6 Posted at: 3 months ago -
#4964 在用qwen 3-TTS時, 進度條一直卡在15%, 出現下載中進度不變請等待...
💬 2[Last reply:3 months ago] base和custom 两套模型合计大约8G,耐心等待或按此方法手动下载 https://pyvideotrans.com/qwen-tts...210.6**0 Posted at: 3 months ago -
#4963 批量字幕翻译,选择原地保存,实际生成的srt文件依然在默认输出目录,批量配音也是这个情况...
💬 1[Last reply:3 months ago] 批量字幕翻译和批量配音的默认输出目录由“独立功能输出目录”控制,该选项在菜单→工具/选项→高级选项→通用设置中,默认值为软件安装目录下的 output/ 文件夹。你期望的“原地保存”未生效,是因为当前输出目录并非源文件所在目录。解决方法:打开软件顶部菜单 工具/选项 → 高级选项 → 通用设置找到 “独立功能输出目录”,将其清空(留空)或手动设置为源字幕/音频文件所在的文件夹。点击保存,重新执行批...89.116**4 Posted at: 3 months ago -
#4962 videotrans.configure.excepts.SpeechToTextError: 识别出错res={'code': 0, 'msg': '第三类接触还有多远啊?韦伯正式展开拍摄任务已经届满周年,最近也传过来许多过去难以拍摄到的照片。六月初,天文学家在《自然》期刊上发表了这张照片,在蓝色核心外环绕着一,'}...
💬 1[Last reply:3 months ago] 这是由于自定义识别API返回的识别文本被截断(末尾出现“,’})导致的解析错误。通常是因为API返回的JSON格式不符合软件要求,或数据过长导致截断。解决方案:检查你在 菜单→识别设置→自定义识别API 中配置的API返回格式是否严格按照要求:必须返回JSON,包含 code:0 和 text:完整字幕文本(支持多行,用换行符分隔)。确认API返回的text字段不是被截断的(例如网络超时或返回体过...2401**4a12 Posted at: 3 months ago -
#4961 语音识别阶段出错[faster-whisper(本地)] No transcription results returned. Please check the original audio/video or model and try a......
💬 1[Last reply:3 months ago] 该错误的核心原因是 faster-whisper 未能从音频中提取到任何有效语音内容。从你提供的日志分析,最可能由以下三个因素之一导致(按可能性排序):视频文件路径和名称包含大量特殊符号及中文字符(如 #, -, [ ]),且路径较长。软件底层调用 ffmpeg 时,Windows 命令行对路径长度和特殊字符敏感,容易导致音频提取失败或模型读取异常。显存不足:large-v3-turbo 模型需要...2409**23c5 Posted at: 3 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.