-
#6930 语音识别阶段出错[faster-whisper(内置)] No transcription results returned. Please check the original audio/video [info.duration_after_vad=0.0s].info=TranscriptionInfo(language='ja', language_...
💬 1[Last reply:48 minutes ago] 这是 VAD(语音活动检测)将整段音频判定为“无人声” 导致的错误。日志中 duration_after_vad=0.0 表示:原始音频时长约 3118 秒,但经过 VAD 过滤后,被判定为语音的有效时长是 0 秒,所有片段都被当作静音/噪声剔除,因此 Whisper 识别不到任何内容。请按以下顺序排查先确认原视频能正常听到人声 用播放器打开 honnamatv-399.mp4,确认不是无音轨、...171.91.**4 Posted at: 48 minutes ago -
#6929 语音识别阶段出错[faster-whisper(内置)] No transcription results returned. Please check the original audio/video [info.duration_after_vad=0.0s].info=TranscriptionInfo(language='ja', language_...
💬 3[Last reply:1 hour ago] <VAD 将整个音频判定为静音,导致有效语音时长 duration_after_vad=0.0。原始音频时长约3500秒,却没有任何语音片段被保留。请按以下顺序排查:试听提取出的音频:用播放器打开 D:/win-pyvideotrans-v4.11/tmp/12720/f19863f6bc/蓝毛-1787906216.8428931.wav,确认是否有清晰日语人声。若无声,说明原视频音轨为空...171.91.**4 Posted at: 1 hour ago -
#6928 语音识别阶段出错[faster-whisper(内置)] No transcription results returned. Please check the original audio/video [info.duration_after_vad=0.0s].info=TranscriptionInfo(language='ja', language_...
💬 1[Last reply:1 hour ago] 核心原因:duration_after_vad=0.0s 表示 VAD(语音活动检测)将整个音频判定为无有效人声,导致 faster-whisper 未产生任何转录结果。结合你的日志,最可疑的是文件路径含中文(F:/新建文件夹/2/honnamatv-399.mp4),这可能导致底层 ffmpeg 提取音频流异常或音频被静音化;此外也可能是音频本身音量极低/无有效人声、或VAD 阈值设置不当。请按...171.91.**4 Posted at: 1 hour ago -
#6927 [WinError 32] 另一个程序正在使用此文件,进程无法访问。: 'E:/自动翻译/win-pyvideotrans-v4.10/tmp/13136/3b098f4033/final_audio_temp.wav':E:/自动翻译/win-pyvideotrans-v4.10/tmp/13136/3b098f4033/final_audio_temp....
💬 1[Last reply:2 hours ago] 这是由于Windows系统中临时音频文件 final_audio_temp.wav 被其他进程占用,导致 shutil.move 无法将其重命名为 target.wav 所致。常见原因包括杀毒软件实时拦截、播放器/预览窗口占用、或上一轮任务残留的进程句柄未释放。解决方案清理临时文件:完全关闭 pyVideoTrans 程序,手动进入报错路径 E:/自动翻译/win-pyvideotrans-v4....9.142.**2 Posted at: 2 hours ago -
#6926 配置GPT接口API的时候提示报错,麻烦开发团队帮看下是什么问题...
💬 11[Last reply:2 hours ago] 桂柳话(桂柳官话)属于汉语方言,不是标准语言代码,pyVideoTrans 不支持将其作为翻译或配音的目标语言。 原因:软件内置语言列表不含“桂柳话”;翻译渠道(Google、DeepSeek、OpenAI 等)均无方言翻译模型;配音渠道(如 Edge-TTS、Qwen3-TTS 等)也不提供桂柳话音色。若你一定需要,只能尝试自行扩展语言列表,但翻译和配音渠道不识别该方言,实际无法运行。建议改用...182.90.**6 Posted at: 2 hours ago -
#6925 Video file selection required...
💬 1[Last reply:3 hours ago] The error "Video file selection required" occurs because you clicked 开始执行 (Start Execution) without first selecting a video/audio file in the main Video Translation workspace. The "Select Audio or Vid...2402:**:def3 Posted at: 3 hours ago -
#6924 配音阶段出错 [Edge-TTS(免费)] 系统错误 (28):No space left on deviceTraceback (most recent call last):...
💬 1[Last reply:4 hours ago] 核心原因:您的磁盘(D盘)空间已满,导致配音文件无法写入。错误 No space left on device 表明程序在保存Edge-TTS生成的音频时,目标磁盘没有剩余空间了。解决方法:清理磁盘空间检查D盘剩余空间,建议至少保留10GB以上可用空间。清理软件临时文件:进入 D:/sp/tmp/ 文件夹,安全删除里面的所有内容(特别是 22224/ 等进程级缓存目录)。清理输出目录:检查 D:/...240e:**:86fb Posted at: 4 hours ago -
#6923 配音全部失败 NoneTraceback (most recent call last):...
💬 1[Last reply:5 hours ago] 配音失败 DubbingSrtError: 配音全部失败 None 是 TTS 引擎在合成过程中发生了未捕获异常。从你的日志看,使用的是 Confucius-TTS(本地内置) 且角色为 clone,该渠道高度依赖模型文件完整性和参考音频质量。核心排查方向:检查 Confucius-TTS 模型是否完整该渠道需要下载多个模型,若自动下载中断或不完整,会导致配音全部失败。请确认以下目录是否存在且文件...152.175.**7 Posted at: 5 hours ago -
#6922 pyVideoTrans 软件默认安装位置~????到底在哪里...
💬 1[Last reply:5 hours ago] pyVideoTrans 是绿色版软件,没有“默认安装位置”的概念,不需要安装。Windows 预打包版:你下载的是 .7z 压缩包,解压到任意英文纯路径文件夹(如 D:\pyVideoTrans)就是“软件位置”。解压后进入该文件夹,双击 sp.exe 启动。源码部署版:软件位置就是你自己 git clone 或存放代码的文件夹,例如 D:\pyvideotrans。注意:不要解压到中文、空格、...171.91.**4 Posted at: 5 hours ago -
#6921 This model is currently experiencing high demand. Spikes in demand are usually temporary. Please try again later.Traceback (most recent call last):...
💬 1[Last reply:10 hours ago] This error is caused by Google Gemini API rate limiting — the model is temporarily overloaded or your API key quota has been exhausted. It is a server-side issue, not a bug in pyVideoTrans.Immediate s...31.94.**8 Posted at: 10 hours ago -
#6920 Unable to open file 'model.bin' in model 'C:/Users/mohammad/Downloads/win-pyvideotrans-v4.11 (1)/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recen...
💬 1[Last reply:11 hours ago] The model file model.bin in your models--mobiuslabsgmbh--faster-whisper-large-v3-turbo folder is corrupted or incomplete, typically caused by an interrupted/failed download of the large model (large-v...31.94.**8 Posted at: 11 hours ago -
#6919 Unable to open file 'model.bin' in model 'F:/BaiduNetdiskDownload/win-pyvideotrans-v4.11/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent call l...
💬 1[Last reply:16 hours ago] 模型文件 model.bin 缺失或下载不完整,导致 faster-whisper 无法加载模型。解决办法:关闭软件,删除整个模型目录:F:/BaiduNetdiskDownload/win-pyvideotrans-v4.11/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo重新打开软件并执行任务,程序会再次尝试自动下载该模...185.244.**6 Posted at: 16 hours ago -
#6918 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:16 hours ago] 核心原因:通过你配置的代理 http://127.0.0.1:7890 连接 HuggingFace 时,SSL 握手被异常中断(EOF occurred in violation of protocol),说明代理服务未正常运行、端口不对,或代理网络本身不稳定/无法正常连接 huggingface.co。解决方案(按顺序尝试):1. 检查/修复代理确认代理软件(如 Clash/V2Ray)正在运...185.244.**6 Posted at: 16 hours ago -
#6917 [WinError 5] 拒绝访问。: 'D:\\翻译成品\\111-mp4':D:\翻译成品\111-mp4Traceback (most recent call last):...
💬 1[Last reply:19 hours ago] 核心原因是 Windows 系统拒绝创建输出目录 D:\翻译成品\111-mp4,通常是目录已存在但被占用(如正在被其他程序打开)、磁盘权限不足,或路径中带中文导致兼容性问题。解决方案更换输出目录:点击「输出到...」按钮,选择到一个全英文、无特殊符号的简单路径(例如 D:\out\111-mp4),建议不要直接使用含中文的目录。清理占用:关闭所有可能打开该文件夹的窗口或软件(如图片查看器、播放器...111.17.**5 Posted at: 19 hours ago -
#6916 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:20 hours ago] This is caused by Microsoft changing their free translation API endpoint. The https://edge.microsoft.com/translate/auth URL no longer exists, and your current version (v4.07) does not include the upda...2001:**:9dab Posted at: 20 hours ago -
#6915 <urlopen error [Errno 11001] getaddrinfo failed>:Traceback (most recent call last): File...
💬 1[Last reply:21 hours ago] 此报错 socket.gaierror: [Errno 11001] getaddrinfo failed 的底层原因是 DNS 解析失败,软件无法解析模型下载服务器的域名。从日志看,你配置了一个格式错误的代理地址:http=127.0.0.1:7897;https=127.0.0.1:7897;socks=127.0.0.1:7897这种格式并非软件要求的正确格式,会导致所有网络请求失败。解决方...188.253.**1 Posted at: 21 hours ago -
#6914 faster-whisper +large-v3 显卡是2060S .通用设置选择VAD: silero语音阈值: 0.5非语音阈值: 0.6最长语音持续(秒): 10最短语音持续(毫秒): 500二次识别最长语音持续(秒): 2二次识别最......
💬 5[Last reply:22 hours ago] 您说的现象(一条字幕内堆积大量文字)确实和 Whisper预分割音频 与 合并过短字幕 有一定关联,但主要原因不是它们本身,而是 VAD(语音活动检测)没有在句子间隙正确切分,导致一整段长音频被当作一条连续语音送入模型,模型因此输出一长串文字。Whisper预分割音频:这个选项的作用是在静音处把音频提前切成小段,本意是让句子更短。它不会主动把文字堆积在一起,反而应该减少长句。如果预分割没生效,恰恰...182.147.**2 Posted at: 22 hours ago -
#6913 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3000) must match the existing size (47284) at non-singleton dimension 1. Target sizes: [128, 3000]. Tensor sizes: [...
💬 23[Last reply:23 hours ago] Whisper预分割音频、合并过短字幕、启用上下文感知 这三个选项的作用不同,针对你的掉句子问题各有意义,但也要注意它们的代价:Whisper预分割音频 这个选项会让软件在把音频送入Whisper模型之前,先按静音段或一定时长切分成较均匀的短片段。如果不切分,一大段音频(比如几十秒)会被当作一个整体送入模型,模型在有限显存内处理时容易因为太长而截断,导致后半段漏识、掉句子。切分后每个片段长度可控...182.147.**2 Posted at: 23 hours ago -
#6912 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3092) must match the existing size (3000) at non-singleton dimension 1. Target sizes: [128, 3092]. Tensor sizes: [1...
💬 1[Last reply:23 hours ago] 核心原因是 Huggingface_ASR(内置) 渠道中的 kotoba-tech/kotoba-whisper-v2.0 模型与当前软件内置的 transformers 管道存在兼容性问题,当输入音频特征长度与模型期望长度不一致时,会触发张量填充维度错误(3092 vs 3000)。解决方案(按优先级):更换为其他日语识别模型:在 Huggingface_ASR 渠道的模型列表中选择 reaz...182.147.**2 Posted at: 23 hours ago -
#6911 语音识别阶段出错[Huggingface_ASR(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:23 hours ago] 这是由于自动从 HuggingFace 下载模型时网络连接超时(WinError 10060)导致的,HuggingFace 国内访问不稳定,自动下载失败。请按以下步骤手动下载模型并放置到正确位置:步骤 1:下载模型文件访问以下地址,下载该仓库内的所有文件:https://huggingface.co/reazon-research/japanese-wav2vec2-large-rs35kh/t...182.147.**2 Posted at: 23 hours ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.