-
#4985 None语音识别阶段出错:faster-whisper(本地),翻译字幕阶段出错:Google(免 费),配音阶段出错:Edge-TTS(免费) Traceback (most recent call last): File"videotrans(task)only_one.py",line 47,in run Filevieorastaktraceate....
💬 21[Last reply:2 months ago] 这个 non-negative timestamp expected 错误在 faster-whisper 处理某些特定视频时偶发,根本原因是音频 VAD 分割后产生了负的时间戳(可能由于音频片段过短、纯静音或 ffmpeg 解码异常导致)。你已经尝试了更改路径、手动放置模型,但问题仍存在,说明这个视频文件与 faster-whisper 的 VAD 预处理不兼容。请按以下顺序彻底解决:立即执行(...104.160.**9 Posted at: 2 months ago -
#4984 TaskCfgSTT(uuid='1405fca7b7', name='D:/ZJJ/Desktop/素材/德国搭便车-副本.mp4', dirname='D:/ZJJ/Desktop/素材', noextname='德国搭便车-副本', basename='德国搭便车-副本.mp4', ext='mp4', target_dir='D:/win-pyvid...
💬 29[Last reply:2 months ago] 原因在于软件内部对这两个功能使用了不同的 max_tokens 默认值:翻译功能:读取您在翻译渠道设置面板中填写的 max_tokens 值(如 8192),所以能成功调用。LLM 重新断句功能:代码内部硬编码了 max_tokens = 65536,不读取您在翻译渠道设置的 max_tokens 值。而您使用的模型(如 DeepSeek)限制 max_tokens ≤ 32768,因此请求被拒绝...2406:**:970a Posted at: 2 months ago -
#4983 如何下载驱动,支持cuda...
💬 7[Last reply:2 months ago] 软件无法打开,请按以下步骤排查和解决:1. 检查文件路径:确保软件解压到的目录只包含英文和数字,不能有中文、空格或特殊符号(例如 D:\pyVideoTrans 正确,D:\视频 工具 错误)。2. 删除配置文件重置:进入软件根目录,找到 videotrans/params.json 和 videotrans/cfg.json 两个文件(或直接删除整个 videotrans 下的 params.j...183.199.**7 Posted at: 2 months ago -
#4986 opening input: Illegal byte sequence opening input file E:/codex安装与使用/pyvideotrans/tmp/16360/vas-tmp_audio-1780650720.7885778.wav. opening input files: Illegal byte sequence...
💬 1[Last reply:2 months ago] 该错误是由于文件路径中包含中文字符和空格(E:/codex安装与使用/pyvideotrans/...)导致 FFmpeg 无法解析非法字节序列。解决方法移动软件目录:将整个 pyvideotrans 文件夹移动到纯英文且无空格短路径,例如 D:\pyVideoTrans。清理缓存:移动后删除原路径下的 tmp/ 文件夹,或再次勾选主界面上的 清理已生成 重新处理。重命名输入文件:确保输入视频文件...151.242.**2 Posted at: 2 months ago -
#4982 TaskCfgVTT(uuid='724416a535', name='C:/Users/yue/Desktop/1000.mp4', dirname='C:/Users/yue/Desktop', noextname='1000', basename='1000.mp4', ext='mp4', target_dir='C:/Users/yue/Deskt...
💬 1[Last reply:2 months ago] 语音识别阶段未返回任何结果,说明 faster-whisper(base) 模型未能从音频中提取出有效文本。常见原因包括:音频中无人声、原始语言选择错误、模型下载不完整,或背景噪声干扰导致无声输出。请按以下步骤排查:验证视频音轨:用播放器打开 1000.mp4,确认视频确实包含人类说话声,且语言为简体中文。如果只有背景音乐或无语音,软件无法处理。临时关闭附加功能:当前开启了“降噪”和“分离人声背景...240e:**:473e Posted at: 2 months ago -
#4981 TaskCfgVTT(uuid='724416a535', name='C:/Users/yue/Desktop/1000.mp4', dirname='C:/Users/yue/Desktop', noextname='1000', basename='1000.mp4', ext='mp4', target_dir='C:/Users/yue/Deskt...
💬 1[Last reply:2 months ago] 语音识别阶段失败的根本原因是 faster-whisper 返回了空结果,通常由以下情况导致:音频中无有效人声、VAD 过滤掉了所有语音片段、或人声背景分离后生成的音频文件为空。解决方案(按推荐顺序尝试):检查视频是否包含清晰的人声 播放视频确认确实有说话声音,且背景噪音不过大。暂时关闭降噪和人声背景分离 您同时勾选了“降噪”和“分离人声背景声”,根据软件逻辑两者同时选中时只执行分离。请先取消...240e:**:473e Posted at: 2 months ago -
#4980 TaskCfgVTT(uuid='724416a535', name='C:/Users/yue/Desktop/1000.mp4', dirname='C:/Users/yue/Desktop', noextname='1000', basename='1000.mp4', ext='mp4', target_dir='C:/Users/yue/Deskt...
💬 1[Last reply:2 months ago] 语音识别阶段返回空结果,说明 faster-whisper 未从视频中提取到任何有效语音片段。常见原因及解决方案如下:检查视频是否包含人声且语言正确确认视频确实有清晰的说话声,而非纯音乐或静音。源语言选择“简体中文”必须与视频实际语言一致,否则模型无法识别。降低模型大小或调整识别参数当前使用 large-v3-turbo 模型较大,在 CPU 上可能因内存不足或耗时过长导致子进程崩溃返回空。建议先...240e:**:473e Posted at: 2 months ago -
#4979 TaskCfgVTT(uuid='c2fbaed3bb', name='C:/Users/yue/Desktop/1000型-铁屑破碎.mp4', dirname='C:/Users/yue/Desktop', noextname='1000型-铁屑破碎', basename='1000型-铁屑破碎.mp4', ext='mp4', target_dir='...
💬 1[Last reply:2 months ago] 语音识别阶段未返回任何结果,通常是因为 视频文件路径或名称包含中文、空格或特殊符号(如 1000型-铁屑破碎.mp4),导致 ffmpeg 在提取音频或处理文件时出错,无法生成有效音频送入 Whisper 模型。解决方案:简化视频文件名和路径 将视频文件移动到一个仅包含英文字母和数字的浅层目录(如 D:\videos\test.mp4),删除或替换掉 型-、铁屑 等中文字符。 示例:C:\te...240e:**:473e Posted at: 2 months ago -
#4973 Admin大神,二次识别后,能不能加个与识别前字幕比对纠错的步骤?...
💬 9[Last reply:2 months ago] 软件会将 prompts/recharge/recharge-llm.txt 中的系统提示词与字幕文本拼接后,作为一条完整消息发送给 DeepSeek。由于知识库未收录该提示词的具体内容,我无法给出精确模拟。但您可以直接打开软件安装目录下的 prompts/recharge/recharge-llm.txt 文件查看完整原文。通常其结构如下(示例性说明):系统提示词(要求AI对字幕进行重新断句、修...120.229.**8 Posted at: 2 months ago -
#4978 TaskCfgVTT(uuid='50a926720d', name='F:/remix/Remix1.mp4', dirname='F:/remix', noextname='Remix1', basename='Remix1.mp4', ext='mp4', target_dir='F:/yifanyi/Remix/Remix1-mp4', cache_...
💬 5[Last reply:2 months ago] 你提供的 SRT 文件内容格式是正常的,但 ffmpeg 在读取时出错,常见原因包括:文件编码问题:SRT 文件可能是带有 BOM 的 UTF-8 或 ANSI 编码,导致 ffmpeg 无法解析。请用记事本打开该文件,另存为 UTF-8 无 BOM 格式后再试。文件路径特殊字符或过长:临时目录 C:/Users/PC/Desktop/pyvid/tmp/9212/50a926720d/ 路径较长...166.0.**4 Posted at: 2 months ago -
#4976 TaskCfgVTT(uuid='4de6809276', name='F:/music remix/Remix (1).mp4', dirname='F:/music remix', noextname='Remix (1)', basename='Remix (1).mp4', ext='mp4', target_dir='F:/_video_out/m...
💬 3[Last reply:2 months ago] 不客气,问题解决后如遇其他疑问,随时提供日志。...166.0.**4 Posted at: 2 months ago -
#4974 TaskCfgVTT(uuid='febd86e482', name='F:/混音/【电子音乐】手把手教你母带-p10-80.mp4', dirname='F:/混音', noextname='【电子音乐】手把手教你母带-p10-80', basename='【电子音乐】手把手教你母带-p10-80.mp4', ext='mp4', target_dir='...
💬 3[Last reply:2 months ago] 不客气,后续有问题随时提出。...166.0.**2 Posted at: 2 months ago -
#4972 Resegment:ended之后就不动了,卡住了...
💬 18[Last reply:2 months ago] 二次识别(recogn2pass)本身是对配音后的音频再次进行 ASR 转录,目的是生成与配音精确对齐的简短字幕。由于两次转录使用的模型和语音(原始音频 vs 配音音频)不同,产生错别字是常见现象。软件暂无自动与识别前字幕逐行比对的纠错功能,但可通过以下方式减轻错别字影响:使用单视频交互模式 在单视频翻译时,二次识别后会弹出字幕编辑框(如知识库第 5.3 节所述),您可以手动将出现错别字的行与之...120.229.**8 Posted at: 2 months ago -
#4971 gradio_client.exceptions.AppError: [Errno 2] No such file or directory: 'models\\openbmb__VoxCPM2\\config.json'...
💬 1[Last reply:2 months ago] 这是由于你本地部署的 VoxCPM-TTS 服务 缺少模型文件 models/openbmb__VoxCPM2/config.json。该错误由 gradio_client 从服务端返回,并非 pyVideoTrans 本身问题。解决方法检查 VoxCPM-TTS 的部署 确保你部署的 VoxCPM-TTS 服务(通常是 Gradio 应用)已正确下载模型。模型文件应位于其根目录下的 model...129.128.**3 Posted at: 2 months ago -
#4970 videotrans.configure._except.StopRetry: [WinError 10061] 由于目标计算机积极拒绝,无法连接。...
💬 1[Last reply:2 months ago] 这是由于 F5-TTS 或 Index-TTS 等本地 API 配音渠道的服务未启动或连接地址配置错误导致的。解决方案:确认后端服务已启动:确保你已经独立运行了对应的 TTS 服务(例如 F5-TTS 的 webui.py 或 Index-TTS 服务),且终端窗口保持打开状态,未关闭或崩溃。检查 API 地址配置:在软件菜单栏点击 TTS设置 → F5-TTS,检查“API 地址”是否填写正确,...129.128.**3 Posted at: 2 months ago -
#4329 能否使用ollama安装的本地大模型...
💬 7[Last reply:2 months ago] 修改 Ollama(兼容AI/本地模型)翻译提示词的方法:打开软件顶部菜单 → 翻译设置 → 本地大模型设置。在弹出窗口中点击 修改提示词 按钮,即可编辑发送给模型的翻译指令模板。如果你需要手动修改文件,提示词模板位于软件安装目录下的 prompts/srt/(发送完整字幕时使用)和 prompts/text/(未发送完整字幕时使用)文件夹内,文件名对应各 AI 渠道。对于“兼容AI/本地模型”渠...2409:**:8329 Posted at: 3 months ago -
#4969 videotrans.configure._except.StopRetry: E:/pyvideotrans/tmp/101960/b9f2cb5954/clone-333.wav is not exists...
💬 3[Last reply:2 months ago] OmniVoice 服务端报错 Reference audio is empty after silence removal,核心原因是发送给 OmniVoice 的参考音频在内部静音消除后内容为空(通常是参考音频过短、全静音或已损坏)。请按以下步骤排查:确保参考音频时长达标 如果你使用 clone 角色(从原视频截取参考音频),请确认最短语音持续毫秒 ≥ 3000,最长语音持续秒数 ≤ 10,...129.128.**3 Posted at: 2 months ago -
#4968 openai.OpenAIError: Missing credentials. Please pass an `api_key`, `workload_identity`, `admin_api_key`, or set the `OPENAI_API_KEY` or `OPENAI_ADMIN_KEY` environment variable....
💬 1[Last reply:2 months ago] The error indicates a missing API key for the AI translation channel you are using (e.g., OpenAI, DeepSeek, Gemini). The traceback shows Missing credentials – no API key was provided.Solution:Open the...191.6.**6 Posted at: 2 months ago -
#4967 视频翻译存在明显间隔,导致不连贯。并且存在最后一分钟无声音...
💬 7[Last reply:2 months ago] 最后五分钟无声,根因在于音画对齐阶段(Audio-Sync)检测到某条字幕(如[517])的原始时长计算为负数(-204685ms),这导致后续所有处理无法匹配,最终音频在那一时刻被强制截断。诊断步骤(建议按顺序执行)确认原始视频时长和完整性 打开命令行,运行:ffprobe -v error -show_entries format=duration -of default=noprint_w...129.128.**3 Posted at: 2 months ago -
#4966 TaskCfgVTT(uuid='777ba972c7', name='E:/A Girl Wakes.mp4', dirname='E:/', noextname='A Girl Wakes', basename='A Girl Wakes.mp4', ext='mp4', target_dir='E:/_video_out/A Girl Wakes-mp...
💬 1[Last reply:2 months ago] The error indicates a network timeout when your system tried to reach the local AI/API service for translation (translate_type=8 – compatible AI/local model). This means the request to your local API ...191.6.**6 Posted at: 2 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.