-
#6923 配音全部失败 NoneTraceback (most recent call last):...
💬 1[Last reply:11 minutes ago] 配音失败 DubbingSrtError: 配音全部失败 None 是 TTS 引擎在合成过程中发生了未捕获异常。从你的日志看,使用的是 Confucius-TTS(本地内置) 且角色为 clone,该渠道高度依赖模型文件完整性和参考音频质量。核心排查方向:检查 Confucius-TTS 模型是否完整该渠道需要下载多个模型,若自动下载中断或不完整,会导致配音全部失败。请确认以下目录是否存在且文件...152.175.**7 Posted at: 11 minutes ago -
#6922 pyVideoTrans 软件默认安装位置~????到底在哪里...
💬 1[Last reply:14 minutes ago] pyVideoTrans 是绿色版软件,没有“默认安装位置”的概念,不需要安装。Windows 预打包版:你下载的是 .7z 压缩包,解压到任意英文纯路径文件夹(如 D:\pyVideoTrans)就是“软件位置”。解压后进入该文件夹,双击 sp.exe 启动。源码部署版:软件位置就是你自己 git clone 或存放代码的文件夹,例如 D:\pyvideotrans。注意:不要解压到中文、空格、...171.91.**4 Posted at: 14 minutes ago -
#6921 This model is currently experiencing high demand. Spikes in demand are usually temporary. Please try again later.Traceback (most recent call last):...
💬 1[Last reply:5 hours ago] This error is caused by Google Gemini API rate limiting — the model is temporarily overloaded or your API key quota has been exhausted. It is a server-side issue, not a bug in pyVideoTrans.Immediate s...31.94.**8 Posted at: 5 hours ago -
#6920 Unable to open file 'model.bin' in model 'C:/Users/mohammad/Downloads/win-pyvideotrans-v4.11 (1)/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recen...
💬 1[Last reply:6 hours ago] The model file model.bin in your models--mobiuslabsgmbh--faster-whisper-large-v3-turbo folder is corrupted or incomplete, typically caused by an interrupted/failed download of the large model (large-v...31.94.**8 Posted at: 6 hours ago -
#6919 Unable to open file 'model.bin' in model 'F:/BaiduNetdiskDownload/win-pyvideotrans-v4.11/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent call l...
💬 1[Last reply:11 hours ago] 模型文件 model.bin 缺失或下载不完整,导致 faster-whisper 无法加载模型。解决办法:关闭软件,删除整个模型目录:F:/BaiduNetdiskDownload/win-pyvideotrans-v4.11/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo重新打开软件并执行任务,程序会再次尝试自动下载该模...185.244.**6 Posted at: 11 hours ago -
#6918 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:11 hours ago] 核心原因:通过你配置的代理 http://127.0.0.1:7890 连接 HuggingFace 时,SSL 握手被异常中断(EOF occurred in violation of protocol),说明代理服务未正常运行、端口不对,或代理网络本身不稳定/无法正常连接 huggingface.co。解决方案(按顺序尝试):1. 检查/修复代理确认代理软件(如 Clash/V2Ray)正在运...185.244.**6 Posted at: 11 hours ago -
#6917 [WinError 5] 拒绝访问。: 'D:\\翻译成品\\111-mp4':D:\翻译成品\111-mp4Traceback (most recent call last):...
💬 1[Last reply:14 hours ago] 核心原因是 Windows 系统拒绝创建输出目录 D:\翻译成品\111-mp4,通常是目录已存在但被占用(如正在被其他程序打开)、磁盘权限不足,或路径中带中文导致兼容性问题。解决方案更换输出目录:点击「输出到...」按钮,选择到一个全英文、无特殊符号的简单路径(例如 D:\out\111-mp4),建议不要直接使用含中文的目录。清理占用:关闭所有可能打开该文件夹的窗口或软件(如图片查看器、播放器...111.17.**5 Posted at: 14 hours ago -
#6916 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:15 hours ago] This is caused by Microsoft changing their free translation API endpoint. The https://edge.microsoft.com/translate/auth URL no longer exists, and your current version (v4.07) does not include the upda...2001:**:9dab Posted at: 15 hours ago -
#6915 <urlopen error [Errno 11001] getaddrinfo failed>:Traceback (most recent call last): File...
💬 1[Last reply:16 hours ago] 此报错 socket.gaierror: [Errno 11001] getaddrinfo failed 的底层原因是 DNS 解析失败,软件无法解析模型下载服务器的域名。从日志看,你配置了一个格式错误的代理地址:http=127.0.0.1:7897;https=127.0.0.1:7897;socks=127.0.0.1:7897这种格式并非软件要求的正确格式,会导致所有网络请求失败。解决方...188.253.**1 Posted at: 16 hours ago -
#6914 faster-whisper +large-v3 显卡是2060S .通用设置选择VAD: silero语音阈值: 0.5非语音阈值: 0.6最长语音持续(秒): 10最短语音持续(毫秒): 500二次识别最长语音持续(秒): 2二次识别最......
💬 5[Last reply:17 hours ago] 您说的现象(一条字幕内堆积大量文字)确实和 Whisper预分割音频 与 合并过短字幕 有一定关联,但主要原因不是它们本身,而是 VAD(语音活动检测)没有在句子间隙正确切分,导致一整段长音频被当作一条连续语音送入模型,模型因此输出一长串文字。Whisper预分割音频:这个选项的作用是在静音处把音频提前切成小段,本意是让句子更短。它不会主动把文字堆积在一起,反而应该减少长句。如果预分割没生效,恰恰...182.147.**2 Posted at: 17 hours ago -
#6913 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3000) must match the existing size (47284) at non-singleton dimension 1. Target sizes: [128, 3000]. Tensor sizes: [...
💬 23[Last reply:18 hours ago] Whisper预分割音频、合并过短字幕、启用上下文感知 这三个选项的作用不同,针对你的掉句子问题各有意义,但也要注意它们的代价:Whisper预分割音频 这个选项会让软件在把音频送入Whisper模型之前,先按静音段或一定时长切分成较均匀的短片段。如果不切分,一大段音频(比如几十秒)会被当作一个整体送入模型,模型在有限显存内处理时容易因为太长而截断,导致后半段漏识、掉句子。切分后每个片段长度可控...182.147.**2 Posted at: 18 hours ago -
#6912 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3092) must match the existing size (3000) at non-singleton dimension 1. Target sizes: [128, 3092]. Tensor sizes: [1...
💬 1[Last reply:18 hours ago] 核心原因是 Huggingface_ASR(内置) 渠道中的 kotoba-tech/kotoba-whisper-v2.0 模型与当前软件内置的 transformers 管道存在兼容性问题,当输入音频特征长度与模型期望长度不一致时,会触发张量填充维度错误(3092 vs 3000)。解决方案(按优先级):更换为其他日语识别模型:在 Huggingface_ASR 渠道的模型列表中选择 reaz...182.147.**2 Posted at: 18 hours ago -
#6911 语音识别阶段出错[Huggingface_ASR(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:18 hours ago] 这是由于自动从 HuggingFace 下载模型时网络连接超时(WinError 10060)导致的,HuggingFace 国内访问不稳定,自动下载失败。请按以下步骤手动下载模型并放置到正确位置:步骤 1:下载模型文件访问以下地址,下载该仓库内的所有文件:https://huggingface.co/reazon-research/japanese-wav2vec2-large-rs35kh/t...182.147.**2 Posted at: 18 hours ago -
#6910 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:19 hours ago] 该错误是微软免费翻译接口已变更/关闭导致的 404。您当前所用版本为 v4.06,该接口已不可用。另外,您虽选择了“Google(免费)”,但国内无法直连 Google 时会自动回退到微软翻译,而微软翻译现已失效,因此报错。解决方案(二选一):升级软件:前往官网或 GitHub 下载并替换为 v4.09 及以上版本(若非最新,请再覆盖最新补丁包),随后重新执行翻译。更换翻译渠道:在翻译渠道下拉框中...240e:**:d27f Posted at: 19 hours ago -
#6909 语音识别阶段出错[Huggingface_ASR(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:19 hours ago] 该报错是网络连接中断导致 Huggingface 模型(kotoba-tech/kotoba-whisper-v2.0)自动下载失败。模型体积较大(约1.5GB),在下载过程中连接被服务端关闭,属于典型的国内网络环境问题。请手动下载模型:打开以下地址,下载该模型目录下的所有文件:官方源:https://huggingface.co/kotoba-tech/kotoba-whisper-v2.0/t...182.147.**2 Posted at: 19 hours ago -
#6908 Thinking level is not supported for this model.:Traceback (most recent call last): File...
💬 1[Last reply:22 hours ago] 该错误是因为 Gemini 翻译渠道启用了“思考级别”(Thinking level)参数,但您当前选择的 Gemini 模型不支持该参数,导致 Google API 返回 400 错误。解决方法(任选其一):打开 菜单 -> 翻译设置 -> Gemini,将“思考级别”设为“无”或关闭思考模式,保存后重试。更换为支持思考级别的模型(如 gemini-2.5-flash 或 gemin...45.125.**7 Posted at: 22 hours ago -
#6907 [DEBUG] 开始语音识别:渠道0[DEBUG] [新进程任务 开始:STT use large-v3][DEBUG] 任务参数:kwargs={'detect_language': 'en', 'model_name': 'large-......
💬 23[Last reply:22 hours ago] 请先确认“一直没变过”是指什么:是 final_video_with_freeze_lastend.mp4 的文件大小长时间不再增长,还是主界面的进度条一直停滞不动?如果是文件大小不变且 CPU 占用率明显下降,可能 ffmpeg 已完成编码,但软件正在进行最后的文件移动或收尾;如果 CPU 仍保持高占用,则可能是 ffmpeg 进程卡死。请打开软件安装目录下的 logs/ 文件夹,找到最新日期的...203.10.**4 Posted at: 23 hours ago -
#6906 create File "openai\_base_client.py", line 1332, in post File "openai\_base_client.py", line 1105, in requestopenai.In......
💬 1[Last reply:1 day ago] 这是你使用的本地大模型(如 llama-server)返回了不符合 OpenAI 兼容接口预期格式的内容导致的 500 错误。通常是因为模型本身能力较弱,未能严格按照要求输出格式,或输出中混入了额外文本、换行、XML 标签等,导致解析失败。解决方法更换更强大的翻译模型 本地小模型(7B 级及以下)指令跟随能力较弱,极易输出格式错误。建议改用 DeepSeek、GPT-4o 等旗舰在线模型,或使用...103.99.**8 Posted at: 1 day ago -
#6905 [DEBUG] OmniVoice-TTS本地内置渠道,is_cuda=False[DEBUG] 配音成功1个,失败0个[DEBUG] 分离背景声和人声成功[spleeter],耗时: 13.459s[DEBUG] 开始加载 faster-......
💬 3[Last reply:1 day ago] 日志中的 OmniVoice-TTS 显示 is_cuda=False 属于正常现象:OmniVoice-TTS 目前不支持 CUDA 加速,而 faster-whisper 环节已正常启用 CUDA(is_cuda=True)。两者互不影响。如果您遇到的问题并非 CUDA 相关,请具体说明:是任务中断报错了?进度卡住?还是结果异常?请提供软件安装目录 logs/ 下最新日志文件末尾约30行内容或...103.99.**8 Posted at: 1 day ago -
#6904 Application started at 2026-08-27 11:27:55 [DEBUG] 上次缓存的角色:No,字幕嵌入类型:1,发音语言:英语,目标语言:简体中文,目标语言代码:zh-cn,模型:large-v3,TTS渠道[......
💬 7[Last reply:1 day ago] 日志显示任务已成功进入最终合成阶段,正在执行 ffmpeg 命令将无声视频、配音和字幕合并为最终视频。当前命令使用 libx264 软编码、crf 23、preset medium,并且通过 tpad 在视频末尾克隆一帧以延长画面(用于对齐配音时长)。这是正常的处理流程,对于长视频或高分辨率视频,重新编码耗时较长,容易让人误以为卡住。判断是否真卡住的方法:观察任务管理器中的 CPU 占用率——若 ...203.10.**4 Posted at: 1 day ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.