-
#7218 今天刚发现,怎么识别的英语语音,造成时间偏差,统一往后移动几秒钟...
💬 3[Last reply:21 days ago] 底层的核心原因是:语音识别出的英文字幕时间轴整体后移,导致后续配音、合成全部跟着偏移。上午正常、晚上才出现,说明不是软件本身缺陷,而是本次识别过程受 VAD 切片边界或模型解码影响。请按以下顺序排查(每一步做完立刻重跑一个短视频验证):确认偏移量是否固定若所有字幕都后移相同的秒数(比如统一后移 3s),属于整体平移,可在单视频交互模式里手动修正,或用 Subtitle Edit 整体平移 srt ...141.11**0 Posted at: 21 days ago -
#7217 翻译术语表怎么写...
💬 5[Last reply:21 days ago] 没有唯一固定值,需按视频语速和停顿习惯调整。默认值通常偏小,容易在句中稍作停顿时就切断句子。参考设置:一般口播、语速正常:设为 400~600语速较慢、句中停顿多:设为 800~1200语速快、几乎不停顿:保持 300~400 即可调整思路:进入 菜单 → 工具 → 高级选项 → 语音识别参数 → 静音分割持续毫秒先从小值往上加,若发现句子被切碎就继续加大,若整段话粘连成一条就减小该值越大,切分出...223.81**6 Posted at: 21 days ago -
#7216 必须选择视频文件=system:Windows-10-10.0.26200-SP0version:v4.12frozen:Truelanguage:zh_CNroot_dir:D:/...
💬 1[Last reply:21 days ago] 此错误是由于未选择有效的视频文件或路径识别失败导致的。请按以下步骤排查:确认文件已选中:点击左上角「选择音频或视频」按钮后,在弹出的文件选择框中,务必双击文件或选中后点击「打开」确认,不要只选中就关闭窗口。规范文件路径与文件名:将视频移动到浅层纯英文数字目录下,例如 D:/videos/001.mp4,文件名和完整路径中禁止包含中文、空格、表情及特殊符号(如 ?、*、# 等)。确认路径可直接访问:...180.188**0 Posted at: 21 days ago -
#7215 语音识别阶段出错[faster-whisper(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:21 days ago] 核心原因是模型自动下载失败:日志显示 httpx.RemoteProtocolError: Server disconnected without sending a response,即在通过代理 http://127.0.0.1:10808 访问 huggingface.co 下载 faster-whisper-small 模型时连接被中断。国内直接访问 huggingface.co 通常不可...51.159**6 Posted at: 21 days ago -
#7214 语音识别阶段出错[faster-whisper(内置)] mkl_malloc: failed to allocate memory:Traceback (most recent call last): File...
💬 1[Last reply:21 days ago] 这是内存分配失败导致的错误。mkl_malloc: failed to allocate memory 表示当前系统可用内存不足以加载 large-v3-turbo 模型(未启用CUDA加速时,模型完全依赖系统内存/虚拟内存运行)。解决方案(按优先级依次尝试):更换更小的模型 将语音识别模型从 large-v3-turbo 改为 medium、small 或 base。模型越大占用内存越多,la...51.159**6 Posted at: 21 days ago -
#7213 必须选择视频文件=system:Windows-10-10.0.26200-SP0version:v4.12frozen:Truelanguage:zh_CNroot_dir:D:/工具/ai字幕/Windows...
💬 1[Last reply:21 days ago] 这是软件在启动视频翻译任务时,没有检测到任何已选择的视频或音频文件所导致的前置校验提示。常见原因有:文件未真正加入任务列表、路径含特殊符号导致读取失败、或上一次任务的残留状态。请按以下步骤逐一排查:重新选择文件:点击左上角「选择音频或视频」按钮,手动选择要翻译的 mp4/mkv/mov/wav/mp3 等格式文件,确保文件名出现在列表中。若你是想批量处理整个目录,请勾选「文件夹」并选定目录。修改文...27.36**8 Posted at: 21 days ago -
#7212 翻译字幕阶段出错 [Hy-MT2-1.8B(内置)] Try: `pip install transformers -U` or `pip install -e '.[dev]'` if you're working with git mainTraceback (most recent call last):...
💬 1[Last reply:21 days ago] 这是因为 transformers 库与 regex 库存在依赖版本冲突,导致 Hy-MT2-1.8B(内置) 翻译渠道加载失败。解决方案升级到最新版本的 v4.12(若已是最新版本,请重新下载补丁包覆盖)。如果升级后仍然报错,这通常是预打包版中依赖包版本不一致导致的,建议下载完整版压缩包覆盖安装。如果仍希望使用该渠道,可尝试改用其他翻译渠道,例如 DeepSeek、Google(免费) 或 M2...104.28**3 Posted at: 21 days ago -
#7211 为什么翻译视频时会产生残留中文、说话人错乱、时间轴漂移等问题,如何调整可避免,翻译流程中的区分说话人功能是否在字幕长度处理前先执行,然后再合并或拆分字幕?如果直接用批量化文件夹结构,利用原片字幕,是否还会预处理字幕(根据说话人、间隙、长度执......
💬 1[Last reply:21 days ago] 核心原因分三类,需分别处理:1. 残留中文语音识别(ASR)阶段漏识别或识别失败,导致部分片段没有对应字幕/译文。翻译渠道返回空结果(AI 模型合并相邻字幕、或输出格式不符)。可在 高级选项 → 字幕翻译 中将「Traditional/AI 翻译渠道每批字幕行数」设为 1,取消「发送完整字幕」,强制逐行翻译。未勾选有效配音/字幕渠道,导致部分行未处理。参考文档:翻译结果空白原因2. 说话人错乱仅在...203.10**8 Posted at: 21 days ago -
#7210 F:/VideoTrans/models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base does not appear to have a file named speech_tokenizer/config.json. Checkout 'https://huggingface.co/F:/VideoTrans/models...
💬 1[Last reply:21 days ago] 这是 Qwen3-TTS(内置) 的模型文件下载不完整导致的。报错表明模型目录中缺少 speech_tokenizer/config.json 文件。原因:Qwen3-TTS 模型由多个子模块组成(主模型 + speech_tokenizer),自动下载时未能完整获取全部文件。解决方案:删除已下载的不完整模型目录:F:/VideoTrans/models/models--Qwen--Qwen3-T...45.154**4 Posted at: 21 days ago -
#7209 最新版移除合并临近短字幕的话岂不是会TTS合成时参考音频长度不足?...
💬 1[Last reply:21 days ago] 移除的是合并邻近短字幕功能,而非最短语音持续限制。两者作用不同:合并邻近短字幕:把识别出的多条相邻短字幕合并为一条。最短语音持续(毫秒):控制 VAD 切分时,小于该时长的字幕会被尝试合并进相邻字幕。如果你担心参考音频过短导致克隆出错,应通过以下设置控制字幕时长,而非依赖已移除的功能:进入 菜单 → 工具 → 高级选项 → 语音识别参数将 最长语音持续(秒) 设为 6-10将 最短语音持续(毫秒)...203.10**8 Posted at: 21 days ago -
#7208 Subprocess Error: Error no file named model.safetensors, or pytorch_model.bin, found in directory F:/VideoTrans/models/models--k2-fsa--OmniVoice\audio_tokenizer.Traceback (most rec...
💬 1[Last reply:21 days ago] 这是 OmniVoice 内置渠道使用的 audio_tokenizer 模型文件缺失或不完整导致的。软件在指定目录中找不到 model.safetensors 或 pytorch_model.bin,说明模型没有下载成功(或只下载了一部分)。解决办法(手动下载 OmniVoice 模型):打开 HuggingFace 上的 OmniVoice 模型页面:https://huggingface.c...45.154**4 Posted at: 21 days ago -
#7207 Subprocess Error: Error no file named model.safetensors, or pytorch_model.bin, found in directory F:/VideoTrans/models/models--k2-fsa--OmniVoice.Traceback (most recent call last):...
💬 1[Last reply:21 days ago] 这是由于 OmniVoice 模型文件缺失或不完整导致的。软件在 F:/VideoTrans/models/models--k2-fsa--OmniVoice 目录下找不到 model.safetensors 或 pytorch_model.bin,说明该模型未下载完整或下载失败。解决方法:删除现有目录 F:/VideoTrans/models/models--k2-fsa--OmniVoice(...45.154**4 Posted at: 21 days ago -
#7206 Subprocess Error: Error no file named model.safetensors, or pytorch_model.bin, found in directory F:/VideoTrans/models/models--k2-fsa--OmniVoice.:{'text': 'Hello, my dear friend, I...
💬 1[Last reply:21 days ago] 这是因为 OmniVoice 模型文件下载不完整或缺失导致的:软件在 F:/VideoTrans/models/models--k2-fsa--OmniVoice 目录中找不到核心模型文件 model.safetensors 或 pytorch_model.bin,说明模型未成功下载或下载中断。解决方案(按顺序操作):删除已损坏的模型目录彻底删除 F:/VideoTrans/models/mode...45.154**4 Posted at: 21 days ago -
#7205 4.12版本 配音出问题 一直是电流一样的声音 试听那也是电流一样的声音 是怎么回事呀...
💬 1[Last reply:21 days ago] 配音出现电流音,需要先确认是哪一个配音渠道以及是否使用了克隆音色(clone)功能,不同原因处理方式不同。最常见的两种原因:1. 如果您使用了 clone 音色(克隆原始视频说话人音色)系统会从原始视频中自动截取对应时间段的音频作为参考音频。这个截取出来的片段可能存在以下问题,导致配音变成电流/杂音:参考音频时长不合适(太短或太长,TTS 引擎一般要求 3-10 秒)片段中含背景噪声或混入其他说话...45.154**4 Posted at: 21 days ago -
#7204 Dubbing failedNo ref_audio: role='en_female_1.wav',wavfile='F:/VideoTrans/f5-tts/en_female_1.wav':{'text': 'Hello, my dear friend, I hope every day of yours is wonderful and joyful...
💬 1[Last reply:21 days ago] 核心原因:该错误表示所选配音渠道(实际调用的是 Qwen-TTS(内置),见 traceback 中的 _qwenttslocal.py)未能找到参考音频 en_female_1.wav,即文件 F:/VideoTrans/f5-tts/en_female_1.wav 不存在、路径错误或格式不被识别。排查与解决:确认参考音频是否真实存在打开 F:/VideoTrans/f5-tts/ 目录,检查是...45.154**4 Posted at: 21 days ago -
#7203 No audio file was generated during the listening test.:{'text': 'Hello, my dear friend, I hope every day of yours is wonderful and joyful!', 'rate': '+0%', 'role': 'zh_female_cn.wa...
💬 1[Last reply:21 days ago] 核心原因:你选择的配音渠道(tts_type: 1)在试听时未能生成音频文件,导致 DubbingSrtError。同时你使用了参考音频 zh_female_cn.wav(中文音色)去配音英文文本,这本身就是矛盾的——中文克隆音色无法正确合成英文,极易导致该渠道合成失败。请按以下步骤排查:语言与音色匹配:文本是英文(language: en),但你选的参考音频是 zh_female_cn.wav(...144.225**3 Posted at: 21 days ago -
#7202 500: Error code: 500 - {'error': {'message': 'sensitive words detected (request id: 20260912103530480575230jgbvwa9khcDJ5)', 'type': 'new_api_error', 'param': '', 'code': 'sensitive...
💬 1[Last reply:21 days ago] A 500 error with sensitive_words_detected is returned by the AI provider/API gateway itself (a new_api_error type), not by pyVideoTrans. It means the text sent for translation was flagged and rejected...202.150**5 Posted at: 21 days ago -
#7201 This request requires at least $0.50 in balance for audio:Traceback (most recent call last):...
💬 1[Last reply:21 days ago] 这是 OpenRouter 平台余额不足导致的。错误信息明确显示:This request requires at least $0.50 in balance for audio,即使用 OpenRouter 的语音识别接口(用于音频转录)要求账户余额至少达到 $0.50,当前余额不足。解决方案:前往 https://openrouter.ai/settings/credits 为你的 Open...180.93**2 Posted at: 21 days ago -
#7200 Traceback (most recent call last): File...
💬 1[Last reply:22 days ago] This is caused by ffprobe failing to read the video file — the exit status 3221225501 (0xC0000142 / DLL initialization failure on Windows) is triggered by the special characters in your file path, spe...197.132**7 Posted at: 22 days ago -
#7199 Unable to open file 'model.bin' in model 'D:/software/pyvideotrans/win-pyvideotrans-v4.12-0908/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent ...
💬 1[Last reply:22 days ago] 核心原因是 faster-whisper 的 large-v3-turbo 模型文件(model.bin)下载失败或不完整,导致模型无法加载。解决方法:删除不完整的模型目录删除 D:/software/pyvideotrans/win-pyvideotrans-v4.12-0908/models/models--mobiuslabsgmbh--faster-whisper-large-v3-tur...46.151**1 Posted at: 22 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.