-
#7096 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3104) must match the existing size (3000) at non-singleton dimension 1. Target sizes: [128, 3104]. Tensor sizes: [1...
💬 3[Last reply:26 days ago] 该报错是模型文件不完整或损坏,导致音频特征张量长度不匹配(3000 与 3104 不一致)。按以下顺序处理:删除模型文件夹 D:/win-pyvideotrans-v4.11/models/models--kotoba-tech--kotoba-whisper-v2.0,回到软件重跑,让软件自动重新下载。若自动下载仍失败,手动下载该模型所有文件(https://huggingface.co/kot...45.12**6 Posted at: 26 days ago -
#7095 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3104) must match the existing size (3000) at non-singleton dimension 1. Target sizes: [128, 3104]. Tensor sizes: [1...
💬 3[Last reply:26 days ago] 这是 Huggingface_ASR(内置) 渠道的 kotoba-tech/kotoba-whisper-v2.0 模型与 transformers pipeline 批次填充逻辑不兼容导致的张量维度错误。该模型在日语识别时,pipeline 内部按 batch 填充时无法正确对齐输入向量长度,导致 RuntimeError。建议按以下方案解决:更换该渠道下的其他日语模型将 Huggingfac...45.12**6 Posted at: 26 days ago -
#7091 还是会出现漏句子的情况 ,太难受了...
💬 27[Last reply:26 days ago] 具体部署 Parakeet-API 的步骤不在我的知识库中,无法提供可靠的操作指南。该渠道属于“高级自定义”类,需要你自行在本地或服务器上部署一个支持 GPU 加速的 Parakeet 语音转录服务,然后让 pyVideoTrans 通过 API 地址调用它。知识库中仅提供了该渠道的文档链接,具体部署步骤请访问:请查阅相关文档:Parakeet-tdt(本地API)。如果你不熟悉 Python 环...182.147**1 Posted at: 26 days ago -
#7093 [Errno 13] Permission denied: 'E:/菊花/新建文件夹/中/BOBB-442J.srt':E:/菊花/新建文件夹/中/BOBB-442J.srtTraceback (most recent call last):...
💬 5[Last reply:26 days ago] Parakeet 模型不区分软件版本,v4.12 中可直接使用以下两种方式:内置「parakeet日语(内置)」渠道 模型下载地址(首次使用时自动下载,失败可手动下载): https://modelscope.cn/models/himyworld/videotrans/resolve/master/parakeet-ja.zip 下载后解压,将压缩包内的 parakeet 文件夹复制到软件...182.147**1 Posted at: 26 days ago -
#7094 我用的是4.08版本,现在发现是4.12版本了,中间的版本,一共更新了什么新功能和修复bug,为我整理出来...
💬 1[Last reply:26 days ago] 当前知识库仅包含 v4.12 的最新更新日志,未收录 v4.09 至 v4.11 的逐版本变更记录,因此无法准确整理中间版本的完整更新内容。v4.12 版本的更新日志如下:移除whisper预分割音频、合并邻近短字幕优化 VAD 切分算法优化翻译提示词LLM重新断句调整为LLM纠错,只修改错别字和恢复标点,不重新断句,可在高级选项-通用设置-LLM纠错AI渠道调整,默认 DeepSeek二次识别固...141.11**2 Posted at: 26 days ago -
#7092 pyvideotrans翻译出来保存的字幕是乱码怎么回事...
💬 5[Last reply:26 days ago] 暴风影音对 UTF-8 编码的 SRT 文件支持不佳,默认通常按系统区域(GBK/ANSI)解析,导致文字乱码。您保存的字幕文件本身很可能内容是正确的,只是编码格式不被播放器识别。可按以下步骤处理:1. 用记事本或 Notepad++ 打开该 SRT 文件,确认内容是否为正常文字(若正常则说明只是编码读取问题)。2. 在编辑器中选择“另存为”,编码选择“UTF-8 with BOM”或“ANSI/...240e**62b4 Posted at: 26 days ago -
#7090 网络连接失败Traceback (most recent call last):...
💬 1[Last reply:26 days ago] 这是网络连接失败引起的。根据日志,你在使用 ElevenLabs.io 语音识别渠道时,经代理 http://127.0.0.1:7892 访问其服务器,但 SSL 握手被服务器中断(EOF occurred in violation of protocol),通常表示代理未生效、端口错误或代理不稳定。解决方案:确认你的科学上网工具已启动,且代理端口确为 7892(可在主界面"对齐控制"行右侧的代...2a09**1ba Posted at: 26 days ago -
#7089 Unable to open file 'model.bin' in model 'D:/pyvideotrans-v4.12/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent call last): File...
💬 1[Last reply:26 days ago] 错误原因是 faster-whisper large-v3-turbo 模型的 model.bin 文件缺失或下载不完整,导致模型无法加载。解决方案:删除损坏的模型目录 关闭软件后,删除整个文件夹: D:/pyvideotrans-v4.12/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo重新获取模型重新打开软件执行任务...43.212**9 Posted at: 26 days ago -
#7086 显示Resegment:ended...
💬 19[Last reply:26 days ago] 该日志片段 {"type": "logs", "text": "Resegment:ended"} 是语音识别子进程完成断句/纠错阶段后输出的正常标记,说明 faster-whisper 已成功处理识别结果并结束该步骤。它本身不是错误,也不表示流程中断。当前任务未继续或找不到 _video_out 文件夹,请按以下顺序...119.98**6 Posted at: 26 days ago -
#7088 Unable to open file 'model.bin' in model 'D:/BaiduNetdiskDownload/win-pyvideotrans-v4.12/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent call l...
💬 1[Last reply:26 days ago] 模型文件缺失或损坏,model.bin 无法被 faster-whisper 正确加载。这通常是因为模型下载不完整(大小/哈希校验失败)或文件被浏览器自动重命名所致。解决方案:彻底删除损坏的模型文件夹 删除整个目录:D:/BaiduNetdiskDownload/win-pyvideotrans-v4.12/models/models--mobiuslabsgmbh--faster-whispe...164.52**2 Posted at: 26 days ago -
#7087 Lỗi trong giai đoạn nhận diện giọng nói[faster-whisper(Tích hợp sẵn)] No transcription results returned. Please check the original audio/video [info.duration_after_vad=0.0s].info=T...
💬 1[Last reply:26 days ago] Lỗi này do VAD (Voice Activity Detection) không phát hiện được bất kỳ phân đoạn giọng nói nào trong âm thanh. Cụ thể, log cho thấy:Tổng thời lượng âm thanh: 688.69 giâyThời lượng sau VAD: 0.0 giây → t...116.99**8 Posted at: 26 days ago -
#7085 File not found: D:\A-win-pyvideotrans-v4.11\tmp\9332\vas-1788713282.5085945.srt...
💬 1[Last reply:27 days ago] This error is caused by the task pipeline referencing a temporary file that was either deleted prematurely or could not be read. The file D:\A-win-pyvideotrans-v4.11\tmp\9332\vas-1788713282.5085945.sr...42.116**3 Posted at: 27 days ago -
#7084 VAD errorTraceback (most recent call last):...
💬 1[Last reply:27 days ago] 该错误发生在语音识别阶段,由 Gemini 渠道执行 VAD(语音活动检测)时抛出。可能原因与排查步骤:VAD 参数设置异常 进入 菜单 → 工具 → 高级选项 → 语音识别参数,检查 语音阈值、静音分割持续毫秒 等参数。可尝试将 语音阈值 调低至 0.3 左右,或将 选择VAD 切换为其他选项。音频文件本身问题 确认 D:/video/RustTikTok-PhotoImport-...mp...2a09**1ba Posted at: 27 days ago -
#7083 Error code: 400 - {}:Traceback (most recent call last): File...
💬 1[Last reply:27 days ago] 该报错是阿里百炼(Qwen-MT)翻译渠道的请求参数错误(HTTP 400),常见原因是模型名称选择错误或API 地址/密钥配置不正确。请按以下顺序排查:检查模型名称:进入 菜单 → 翻译设置 → 阿里百炼 API,确认所填模型是纯文本模型(如 qwen-plus、qwen-mt 等)。严禁使用 qwen-asr 开头的模型(那是语音识别用的),也不能使用多模态模型,阿里百炼不允许多模态模型用于字...2a09**1ba Posted at: 27 days ago -
#7082 在“翻译视频”的功能中,有时候语音识别可能不准,不想在中途一句一句的修改,有现成的字幕文件,就缺了配音,但是像clone相关发声者的配音,能否直接替换发音语言和目标语言的所有srt文件,或者有没有其他方式?...
💬 1[Last reply:27 days ago] 可以直接使用现成的 SRT 字幕文件,跳过语音识别和翻译阶段,只进行配音和合成。方法一:手动替换(适用于少量视频)假设视频文件名为 myvideo.mp4,发音语言为英文(en),目标语言为中文(zh-cn):在视频同级目录创建 _video_out 文件夹;在 _video_out 内创建子文件夹:myvideo-mp4(格式为 [视频名]-[视频后缀],注意带后缀);将你的两个 SRT 文件复...2409**7d0b Posted at: 27 days ago -
#7081 File Not Foundhttp://127.0.0.1:8080/v1/models...
💬 1[Last reply:27 days ago] 这是典型的 404 NotFound 错误,核心原因是您配置的 OpenAI 兼容 API 地址或模型名称与本地服务实际提供的不匹配。排查步骤:检查 API 地址:确认您填写的是服务的基础地址,例如 http://127.0.0.1:8080(或 http://127.0.0.1:8080/v1),不要包含 /v1/models 这类后缀。软件内部会根据您填的地址自动拼接 /v1/chat/com...240e**9c00 Posted at: 27 days ago -
#7080 what is new in 4.12...
💬 7[Last reply:27 days ago] Here are the remaining ASR settings you can tune in 菜单 → 工具 → 高级选项 → 语音识别参数. The most important ones for aligning dubbing with the original video’s speech timing are already covered, but these additio...2a09**db Posted at: 27 days ago -
#7079 CUDA GPU acceleration unavailable. Verify NVIDIA GPU & CUDA installation (Help -> CUDA Help)....
💬 1[Last reply:27 days ago] This error indicates the software cannot detect a valid CUDA environment for GPU acceleration. Since you are running a source deployment (frozen:False), the issue is almost certainly one of the follow...2601**e2ca Posted at: 27 days ago -
#7078 语音识别阶段出错[阿里FunASR(内置)] Subprocess Error: regex>=2025.10.22 is required for a normal functioning of this module, but found regex==2023.10.3.Try: `pip install transformers -U` or `pi...
💬 1[Last reply:28 days ago] 这是预打包版中 regex 依赖版本过低(2023.10.3)与阿里 FunASR 所需的 regex>=2025.10.22 发生冲突,导致子进程初始化失败。由于你是 Windows 预打包版(frozen:True),无法直接执行 pip install 升级,请按以下顺序尝试解决:重新下载官方最新完整包并覆盖:先去 下载页面 下载最新 2.7GB 完整包,解压后覆盖当前目录。若只覆盖了...111.240**7 Posted at: 28 days ago -
#7077 Trans Error:[Microsoft (Free)] 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/auth:Traceback (most recent call last):...
💬 1[Last reply:28 days ago] The root cause is that Microsoft has discontinued the free translation endpoint (edge.microsoft.com/translate/auth) that your current version (v3.86) relies on. The 404 error means the service URL is ...2405**721 Posted at: 28 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.