-
#7127 Faster-whisper [1] めっちゃ可愛いじゃん 性格悪くて騙されまくるやんって俺やらせてくれるやつって会うでしょ?で会って金取られてバイバイ えぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇ......
💬 3[Last reply:3 days ago] 你当前设的 VAD 参数组合(语音阈值0.3、非语音阈值0.4)容易让过多碎片被误判为语音,Whisper 会在这些无效/噪声片段上产生幻觉式的重复输出。请按以下方式调整:将“语音阈值”调高到 0.5~0.6,减少噪声被当成语音。将“非语音阈值”调低到 0.2~0.3,且必须小于语音阈值,否则判断逻辑会混乱。勾选主界面的“降噪”或“分离人声背景声”,排除背景干扰再识别。模型建议改为 large-v...139.202**7 Posted at: 4 days ago -
#7126 [Clone-Voice] 该渠道需另行部署并启动后可用self.api_url='http://127.0.0.1:9988'...
💬 1[Last reply:4 days ago] 核心原因:Clone-Voice 是本地 API 配音渠道,需你在本机单独部署并启动该服务,软件只是通过 http://127.0.0.1:9988 调用它。当前该服务未启动,所以报错“目标计算机积极拒绝”。解决方案:检查你是否已经安装并运行了 Clone-Voice 服务,确保其监听在 127.0.0.1:9988(可在浏览器打开该地址验证)。若你不需要使用 Clone-Voice,请直接在主界...82.26**7 Posted at: 4 days ago -
#7124 文件不存在:D:/tmp/11284/8c90c331db/silence_gap_0.wavTraceback (most recent call last):...
💬 1[Last reply:4 days ago] 这是临时工作目录中的静音文件未能生成导致的。排查建议:关闭所有其他 pyVideoTrans 实例。多实例共享同一个 tmp 临时文件夹,任一实例关闭时都可能清空该文件夹,导致另一个实例正在等待的 silence_gap_0.wav 被误删。检查磁盘空间。临时目录 D:/tmp 所在磁盘空间是否不足,若不足将无法生成任何文件。手动清理残留。关闭软件后,进入 D:/tmp 文件夹,将与本任务相关的临...152.32**9 Posted at: 4 days ago -
#7123 IMG_0154.MP4没有识别出字幕,请检查:【1】是否包含人类说话声,【2】说话语言是否和所选发音语言一致,【3】所选渠道是否支持该发音语言Traceback (most recent call last):...
💬 1[Last reply:4 days ago] 这是由于所选语音识别渠道不支持英语导致的。FireRed中文(内置) 渠道仅支持中文及20余种中文方言,不支持英语,因此无法识别英语发音,所以报错“没有识别出字幕”。解决方案:更换语音识别渠道。对于英语视频,请将语音识别渠道改为faster-whisper(内置)(默认推荐)或openai-whisper(内置)等支持英语的渠道。模型建议选择large-v3-turbo或large-v3。确认视频...39.129**1 Posted at: 4 days ago -
#7122 Unable to open file 'model.bin' in model 'D:/Program Files (x86)/sp4.12/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent call last): File...
💬 1[Last reply:4 days ago] 模型文件 model.bin 缺失或损坏,这通常是由于首次使用时自动下载模型未成功或不完整导致的。解决方案:彻底删除模型文件夹 D:/Program Files (x86)/sp4.12/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo;重新运行软件,让其自动重新下载模型;若自动下载仍失败,请手动前往 https://hugg...141.11**2 Posted at: 4 days ago -
#7120 shape '[1, 4138, 1, 32, 2]' is invalid for input of size 262144,Traceback (most recent call last): File...
💬 1[Last reply:4 days ago] This error is caused by a tensor shape mismatch inside the Confucius-TTS model's rotary embedding layer, typically triggered when the reference audio used for voice cloning is too long or the input se...188.192**8 Posted at: 4 days ago -
#7119 GPT-SoVITS-v2pro-20250604 下载链接...
💬 1[Last reply:4 days ago] 暂无法提供该特定版本的下载链接。知识库中未收录 GPT-SoVITS-v2pro-20250604 的官方下载地址。建议:前往 GPT-SoVITS 官方 GitHub 仓库(https://github.com/RVC-Boss/GPT-SoVITS)查看 Release 页面。或参考 pyVideoTrans 的 GPT-SoVITS 接入文档获取配置说明。请查阅相关文档:GPT-SoVITS...188.253**4 Posted at: 4 days ago -
#7118 视频中有多个角色,类似演讲、电视剧这类的视频,每个角色说的话都要克隆音色,即一钟角色的讲话对应一种音,现在也有对应的字幕,需要怎么做...
💬 1[Last reply:4 days ago] 核心原因:多角色克隆音色必须启用“说话人分离”,并在“单视频交互模式”下为每个说话人指定 clone 配音角色。如果直接用已有字幕跳过语音识别,则无法进行说话人分离,也就无法自动区分角色。操作步骤:在“翻译视频”界面选择单个视频文件(必须单视频,才会弹出交互编辑窗口)。展开“设置更多参数”,勾选 识别说话人,并设置 最大说话人 数量(≥实际角色数)。不要把已有字幕放入 _video_out 目录,...123.115**0 Posted at: 4 days ago -
#7117 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:4 days ago] 这是模型下载中断导致的。你使用的 biodatlab/whisper-th-large-v3 模型完整大小约 3.2GB,但网络连接在下载到 2.2GB 时就断开了,只下载了一部分。解决步骤:删除不完整的模型文件 删除 D:/BaiduNetdiskDownload/win-pyvideotrans-v4.12/models/models--biodatlab--whisper-th-large...18.162**8 Posted at: 4 days ago -
#7116 mkl_malloc: failed to allocate memory:Traceback (most recent call last): File...
💬 1[Last reply:4 days ago] 这是系统内存(物理内存或虚拟内存)不足导致的分配失败。你当前使用 faster-whisper(内置) + large-v3-turbo 模型,且未启用 CUDA 加速,纯 CPU 运行,内存消耗较高。错误发生在语音识别的 restore_speech_timestamps(时间戳恢复)阶段,此时一次性加载了较大音频片段。建议操作(按优先级排序)降低模型尺寸 将语音识别模型从 large-v3-...129.153**1 Posted at: 4 days ago -
#7115 没有Nvidia的显卡,只有Intel 的集显Arc 130v, 如何用它加速?...
💬 1[Last reply:4 days ago] Intel 集显无法用于 CUDA 加速。pyVideoTrans 的 GPU 加速仅支持 NVIDIA(N卡),AMD 或 Intel 显卡均不支持 CUDA 加速,因此 Arc 130v 无法用于加速。若你有 AMD 显卡,可尝试源码部署后使用 Whisper.net 渠道(仅限 Windows,支持 Vulkan 加速),但 Intel 核显无对应方案。建议使用 CPU 运行,或更换 NVI...129.153**1 Posted at: 4 days ago -
#7114 最新的4.12版本语音识别,切分更好一些吗?我用的是0.8版本,感觉英语切得断句很多,翻译过来后,没法听...
💬 5[Last reply:4 days ago] v4.12 相比 0.8 版本更新幅度较大,主要涉及语音识别切分算法、LLM 纠错逻辑、二次识别模型固定、修复多个 bug 等。其中与您当前痛点(英语断句碎)直接相关的是:优化了 VAD 切分算法,并将“LLM 重新断句”调整为“LLM 纠错”,只修正错别字和恢复标点,不再重新断句。这可能让字幕更符合原意,翻译后配音更连贯。另外,二次识别固定使用 faster-whisper 的 large-v3...2a14**38b Posted at: 4 days ago -
#7113 Unable to open file 'model.bin' in model 'D:/win-pyvideotrans-v4.12/models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo',Traceback (most recent call last): File...
💬 1[Last reply:4 days ago] 这是由于 faster-whisper 的 large-v3-turbo 模型下载不完整或已损坏,导致无法读取其中的 model.bin 文件。解决方法:删除损坏的模型文件夹 进入路径:D:/win-pyvideotrans-v4.12/models/ 找到并删除整个文件夹:models--mobiuslabsgmbh--faster-whisper-large-v3-turbo重新自动下载 ...129.153**1 Posted at: 4 days ago -
#7112 pyvideotrans-v4.12 使用的是哪个版本的parakeet内置...
💬 5[Last reply:5 days ago] 无法查看您提供的图片内容。请描述图片中所示的“引擎”具体名称或界面位置(例如是语音识别、翻译还是配音渠道),或提供截图中的文字信息,以便定位。...171.91**5 Posted at: 5 days ago -
#7111 non-negative timestamp expected:Traceback (most recent call last): File...
💬 1[Last reply:5 days ago] This error is caused by a known VAD (Voice Activity Detection) timestamp generation bug in faster-whisper on pyVideoTrans v4.09. The speech_timestamps list you see contains segments where the end time...200.195**8 Posted at: 5 days ago -
#7110 No transcription results returned. Please check the original audio/video or model and try again.Traceback (most recent call last):...
💬 1[Last reply:5 days ago] 这是 faster-whisper 语音识别阶段未能从音频中识别出任何有效语音导致的错误。常见原因有:模型文件损坏/未完整下载、CUDA 加速异常、原音频无人声或音量过低、版本过旧存在已知 Bug。按以下顺序排查:验证模型完整性 进入 D:/win-pyvideotrans-v4.03-0623/models/ 目录,检查是否存在 models--mobiuslabsgmbh--faster-w...217.69**6 Posted at: 5 days ago -
#7109 语音识别阶段出错[Huggingface_ASR(内置)] Subprocess Error: regex>=2025.10.22 is required for a normal functioning of this module, but found regex==2023.10.3.Try: `pip install transformers -U`...
💬 1[Last reply:5 days ago] 语音识别阶段出错是因为软件内置的 transformers 库版本与 regex 库版本不匹配,导致 Huggingface_ASR(内置) 渠道无法正常运行。你使用的是 Windows 预打包版(frozen:True),无法直接执行 pip 更新,请按以下步骤解决:访问官方下载页 https://pyvideotrans.com/downpackage,重新下载当前最新版本的补丁包(约360M...58.255**3 Posted at: 5 days ago -
#7108 语音识别阶段出错[faster-whisper(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:5 days ago] 这是由于模型下载过程中网络连接中断导致的。日志显示 peer closed connection without sending complete message body (received 1387921431 bytes, expected 1617884929),即下载到约 1.38GB 时连接被强制断开,模型文件下载不完整。解决方案1. 先删除不完整的模型文件模型下载失败后可能会留下残缺...15.164**9 Posted at: 5 days ago -
#7107 必须选择视频文件=system:Windows-10-10.0.18363-SP0version:v4.11frozen:Truelanguage:zhroot_dir:D:/軟件/win-pyvideotrans-v4.11...
💬 1[Last reply:5 days ago] 该报错通常是因为软件主界面未能成功加载到视频文件,最常见原因是软件安装路径或视频文件路径包含中文/特殊字符。你的安装目录是 D:/軟件/win-pyvideotrans-v4.11,其中包含中文「軟件」。软件底层依赖的 ffmpeg 等工具对非英文路径兼容性极差,会导致文件选择后无法正常识别,从而在点击「开始执行」时报出“必须选择视频文件”。请按以下步骤排查:确认是否真的选择了文件:检查主界面第一...43.243**2 Posted at: 5 days ago -
#7106 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载HTTPSConnectionPool(host='www.modelscope.cn', port=443): Max retries exceeded with url: /api/v1/models/Qwen/Qwen3-TTS-12Hz-0.6B-Base (Caused by NewC...
💬 1[Last reply:5 days ago] 自动下载 Qwen3-TTS 模型失败,根因是程序尝试连接 www.modelscope.cn 时被系统拒绝访问(WinError 5),常见于杀毒软件拦截、网络代理未配置或防火墙阻断,导致无法自动拉取模型文件。解决方案:手动下载模型手动下载模型文件 打开以下地址,下载整个模型目录的所有文件(建议用浏览器直接下载或使用下载工具):https://huggingface.co/Qwen/Qwen3...103.169**6 Posted at: 5 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.