-
#6703 Batch size mismatch: audio=8, context=0:Traceback (most recent call last): File "videotrans\process\stt_fun.py", line 5......
💬 1[Last reply:6 days ago] 该报错发生在 Qwen-ASR(内置) 本地模型推理阶段:Batch size mismatch: audio=8, context=0,即音频片段数量与模型上下文数量不一致,导致转录中断。暂无法确定这个错误的具体触发原因,但你的版本为 v4.02,与最新版 v4.09 相差较大,建议先按以下步骤排查:升级软件到最新版本 v4.09(下载完整包或补丁包覆盖),此报错可能属旧版 bug。检查 Qwe...27.19.**4 Posted at: 6 days ago -
#6702 连接被重置,网络可能不稳定Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是网络连接被远端服务器重置导致的翻译失败。您在配置中选择的翻译渠道是 Google(免费),当 Google 翻译请求失败后软件会自动切换到 Microsoft(微软翻译) 重试,但该次重试连接微软服务器时也被重置(WinError 10054 远程主机强迫关闭了一个现有的连接)。微软免费翻译接口目前已经不稳定/可能已关闭,且 Google 翻译在中国大陆需要科学上网。建议按以下顺序处理:更换更...111.45.**9 Posted at: 6 days ago -
#2669 你好,请问手工下载reazon-research/japanese-wav2vec2-large-rs35kh后,在使用界面找不到这个模型怎么办...
💬 5[Last reply:6 days ago] 这是因为您当前使用的模型/功能要求约33.9GB显存,而RTX 5070显卡显存通常为12GB或16GB,无法满足需求。请按以下步骤降低显存占用或更换更小模型:更换更小模型 在语音识别渠道中,将模型从 large-v3 或更大的模型,更换为 small / base / tiny,或使用 large-v3-turbo(约6GB显存)。降低计算精度 进入 菜单 → 工具 → 高级选项 → 语音识...212.135.**5 Posted at: 7 months ago -
#6701 连接被重置,网络可能不稳定Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是翻译渠道网络连接失败导致的。您选择的是 Google 翻译,在未配置代理时无法连接,软件会自动回退到微软翻译重试,而微软翻译的连接也被远程主机重置(WinError 10054),最终报错"连接被重置,网络可能不稳定"。解决方案:推荐改用 DeepSeek 翻译渠道:质量更好、国内可直接访问。前往 https://platform.deepseek.com 登录充值(可自定义充值1元)获取 A...111.45.**9 Posted at: 6 days ago -
#6700 语音识别阶段出错[阿里FunASR(内置)] Subprocess Error: regex>=2025.10.22 is required for a normal functioning of this module, but found regex==2023.10.3.Try: `pip install transformers -U` or `pi...
💬 5[Last reply:6 days ago] 你当前使用的是 Windows 预打包版(D:/pyvideotrans 下含 sp.exe),该版本不需要也不应该使用 uv 命令。uv 是源码部署(.py 方式)才需要的包管理器。请你直接按以下操作修复:前往官网下载最新的完整版压缩包(非补丁包,约 2.7GB):下载地址:https://pyvideotrans.com/downpackage彻底删除当前 D:/pyvideotrans 整个...182.90.**4 Posted at: 6 days ago -
#3730 TaskCfgVTT(is_cuda=False, uuid='f6e0359f4e', cache_folder='D:/pyvideotrans/tmp/4808/f6e0359f4e', target_dir='D:/Program Files/Desktop/治療2/_video_out/How to release your pec minor w...
💬 1[Last reply:6 days ago] 翻译阶段出错是因为 Gemini AI 返回了空结果。这通常是由于网络问题、API密钥无效、请求内容触发安全策略或模型暂时不可用导致的。请按以下步骤排查和解决:检查网络代理:Gemini 服务在国内无法直接访问。请确保已在软件主界面的“网络代理地址”中填写了正确的代理地址(格式如 http://127.0.0.1:10808)。验证 API 密钥:前往 菜单 -> 翻译设置 -> Ge...103.108.**1 Posted at: 5 months ago -
#1027 videotrans.configure._except.StopRetry: GPT-SoVITS error-1:{'message': 'prompt_lang: miqi is not supported in version v2'}...
💬 3[Last reply:6 days ago] 错误原因是 GPT-SoVITS 的 v2 版本 API 不支持你选择的语音角色 miqi。解决方案:在软件主界面,将“配音渠道”从“GPT-SoVITS”切换为其他渠道,例如“Edge-TTS(免费)”。如果必须使用 GPT-SoVITS,请确保你部署的 GPT-SoVITS 服务版本支持 miqi 这个语音角色。你可能需要更新或重新部署 GPT-SoVITS 服务端。在 GPT-SoVITS ...240e:**:fbf Posted at: 10 months ago -
#6699 Error code: 404:Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是 OpenAI 语音识别 API 返回 404 错误,核心原因是请求的接口地址或模型不存在,并非视频或字幕问题。常见原因如下:API 地址填写错误 在 菜单 → 翻译设置 → OpenAI语音识别 中,接口地址必须以 /v1 结尾,例如官方地址应填写 https://api.openai.com/v1。如果填写为 https://api.openai.com 或缺少 /v1,就会导致 404...2405:**:7e14 Posted at: 6 days ago -
#6698 Unsupported model `qwen-audio-3.0-asr-flash-filetrans` for OpenAI compatibility mode.https://dashscope-intl.aliyuncs.com/compatible-mode/v1...
💬 1[Last reply:6 days ago] 你选错了模型:qwen-audio-3.0-asr-flash-filetrans 是语音识别(ASR)类模型,不是文字翻译模型,不能放在“翻译渠道/OpenAI兼容模式”里使用,所以 DashScope 返回 model_not_supported。解决办法:如果你是要“翻译字幕”,请把翻译模型改为纯文本翻译模型,例如 qwen3.6-plus、qwen-mt-turbo 或 qwen-mt-p...2405:**:7e14 Posted at: 6 days ago -
#6697 Value: 'Same as the voice reference' (type: <class 'str'>) is not in the list of choices: ['与音色参考音频相同', '使用情感参考音频', '使用情感向量控制']:{'text': '你好啊,我亲爱的朋友,希望你的每一天都是美好愉快的!', 'rate': '+0%'...
💬 1[Last reply:6 days ago] 该报错是 index-tts 开源库自身的多语言界面校验 Bug,不是 pyVideoTrans 配置错误。解决办法:打开你本地部署的 index-tts 项目根目录下的 webui.py 文件;全局搜索字符串 i18n("与音色参考音频相同");将其替换为英文:Same as the voice reference;保存文件并重启 index-tts 服务;回到 pyVide...206.237.**6 Posted at: 6 days ago -
#6696 网络连接失败Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 核心原因是 ctranslate2 动态库(_ext)加载失败,而不是单纯的网络问题。通常由 CUDA/cuDNN 版本与软件内置的 ctranslate2 不匹配、或软件文件不完整/补丁覆盖不全导致。请按顺序排查:确认你使用的是完整安装包(约 2.7GB)解压运行,而不是只用了 260MB 补丁包。若不确定,请重新下载完整包,解压到纯英文路径(如 D:\pyVideoTrans),再覆盖最新补丁...60.235.**2 Posted at: 6 days ago -
#6695 网络连接失败Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这个报错的本质是 ctranslate2 的 DLL 加载失败,而不是网络问题。常见原因是软件安装包不完整、缺少 VC++ 运行库、路径含中文/特殊字符或文件被杀毒软件隔离。请按以下顺序排查:重新下载完整版安装包(约 2.7GB),不要只下载补丁包。 删除当前软件目录后,全新解压到纯英文路径(例如 D:\pyVideoTrans),确保路径中不要有中文、空格、特殊符号(你日志中的 F:/外贸视频...60.235.**2 Posted at: 6 days ago -
#6694 网络连接失败Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这个报错并不是网络问题,而是本地 DLL 加载失败。核心错误是 ctranslate2 导入时 DLL load failed while importing _ext: 找不到指定的程序。这是因为 FunASR 渠道内部仍需调用 faster-whisper 的 VAD 切分,而 faster-whisper 依赖的 ctranslate2 底层 DLL 在当前环境中无法正常加载。主要原因与解决...60.235.**2 Posted at: 6 days ago -
#6693 翻译字幕阶段出错 [兼容AI/本地模型] 内容太长超出最大允许Token,请减小内容或增大max_token,或者降低每次发送字幕行数Could not parse response content as the length limit was reached - CompletionUsage(completion_tokens=8192, prompt...
💬 1[Last reply:6 days ago] 这是本地AI大模型输出长度达到 max_tokens 上限(8192)后被迫截断导致的报错。你的日志显示 completion_tokens=8192,说明模型每次生成的文本已触顶,无法完整返回翻译结果。按以下步骤解决:打开 菜单 → 工具 → 高级选项 → 字幕翻译调整,将 AI翻译渠道每批字幕行数 调低,建议改为 1,再重新执行。打开 菜单 → 翻译设置 → 兼容AI/本地模型,将对应模型的 ...119.123.**9 Posted at: 6 days ago -
#6692 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是微软免费翻译接口已失效/变更导致的 404 错误。你的日志显示选择了 Google 翻译,但 Google 在未代理时失败后,软件会自动改用微软翻译重试,而微软翻译的 edge.microsoft.com/translate/auth 接口当前已不可用,因此返回 404。解决方案(按推荐顺序):升级软件到 v4.09 或更新版本:当前你使用的是 v4.08,微软已更改翻译 API,新版本已修复...240e:**:1a55 Posted at: 6 days ago -
#6691 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是微软免费翻译接口已失效导致的。你当前版本为 v4.08,微软已更改其翻译 API;同时你选择的是 Google 翻译,它失败后软件会自动改用微软翻译重试,结果又遇到 404,最终报错。解决方案(按优先级):更新到 v4.09 版本:重新下载完整包或补丁包覆盖升级。若已是 v4.09 仍报错:再次下载最新补丁包覆盖。更换翻译渠道:推荐使用 DeepSeek(物美价廉,1 元即可充值),在“菜单 ...240e:**:1a55 Posted at: 6 days ago -
#6690 Whisper.net not properly installed: No module named 'Whisper'Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是因为你当前使用的是 Windows 预打包版(frozen=True),该版本并未集成 Whisper.net 所需的 Whisper 模块。Whisper.net 渠道必须通过源码部署安装额外依赖后才可用,预打包版中直接使用会报 ModuleNotFoundError: No module named 'Whisper'。解决方案(任选其一):如果你想继续使用打包版,请更...240e:**:8907 Posted at: 6 days ago -
#6689 网络连接失败Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 核心原因:这是 ctranslate2 动态库 _ext 加载失败导致的,通常由软件安装包文件不完整/版本混用(例如补丁包直接覆盖旧版,或缺少运行库)引起;该错误触发于 VAD 分割阶段加载 faster-whisper 依赖时。解决方法彻底重装完整版(优先执行) 当前软件版本为 v4.10,且你使用了补丁式升级的场景。请先完全删除当前 D:/pyVideoTrans 目录,重新下载 2.7GB...60.235.**2 Posted at: 6 days ago -
#6688 网络连接失败Traceback (most recent call last):...
💬 1[Last reply:6 days ago] 这是 ctranslate2 库的 _ext DLL 加载失败导致的,常见原因是缺少微软 VC++ 运行库、软件包不完整,或相关 DLL 被杀毒软件隔离。请按以下步骤排查:安装微软 VC++ 运行库 下载并安装 微软官方 VC++ 全量运行库,安装后重启电脑。确认使用的是完整包而非补丁包 如果当前是从补丁包升级而来,请重新下载约 2.7GB 的完整绿色版压缩包,全量解压后覆盖使用。补丁包不包含...60.235.**2 Posted at: 6 days ago -
#6687 语音没有停顿导致识别的英文和中文翻译很长怎么解决...
💬 1[Last reply:6 days ago] 核心原因:语音识别是按静音和最大片段时长来切分的,说话人持续不停顿时,整段会被识别为一条长字幕,英文和中文自然都会很长。解决方案:打开主界面顶部 菜单 → 工具 → 高级选项 → 语音识别参数,将“最长语音持续(秒)”调小,例如设为 5-8,超过该时长会强制分割。调小“静音分割持续毫秒”,例如设为 300-500ms,让识别在较短停顿处断句。勾选“Whisper预分割音频?”,让模型先切分为短片段...116.162.**1 Posted at: 6 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.