-
#5798 配音全部失败 The upstream Gradio app has raised an exception but has not enabled verbose error reporting. To enable, set show_error=True in launch().[Qwen-ASR(本地内置), Google(免费), OmniVoi...
💬 1[Last reply:2 months ago] 你的问题是由 OmniVoice (本地API) 配音渠道未正确部署或启动 引起的。该渠道是一个需要自行在本地运行的 Gradio API 服务,但服务端没有启用详细错误报告,导致连接后无法获取具体错误原因。解决方案确认 OmniVoice 服务是否已启动 检查本地是否正在运行 OmniVoice 的 Gradio API 服务(默认地址 http://127.0.0.1:XXXX)。如果未启动...162.243**3 Posted at: 2 months ago -
#5792 nverguo.wav 文件怎么获取制作...
💬 7[Last reply:2 months ago] CLI 模式本身不提供单独的“设置参考音频”参数,但会读取与 GUI 共享的配置文件 videotrans/params.json。因此,您需要先在 GUI 中完成参考音频的注册,然后在 CLI 中使用对应的角色名称。操作步骤:在 GUI 中注册参考音频将您的 WAV 文件(如 nverguo.wav,3-10 秒,wav 格式)放入软件安装目录的 f5-tts/ 文件夹下。打开 GUI → 菜单...240e**53ac Posted at: 2 months ago -
#5795 RetryError[<Future at 0x21ded79e860 state=finished raised HTTPError>] CosyVoice...
💬 7[Last reply:2 months ago] 抱歉,我之前的回答中提到的“EdgeTTS配音渠道配音并发数”这个选项在 v3.79 版本中可能尚未添加。请直接尝试以下操作:调整全局配音并发和暂停: 在“菜单 → 工具/选项 → 高级选项 → 字幕配音调整”中,将并发配音线程数改为 1,配音后暂停秒改为 5 或 10。 这同样能有效降低 Edge-TTS 被限流的几率。关闭代理: 清空主界面“网络代理”文本框,或创建 edgetts-no...116.30**0 Posted at: 2 months ago -
#5796 Traceback (most recent call last): File...
💬 1[Last reply:2 months ago] 报错原因:你使用的「Hy-MT2-1.8B(本地内置)」翻译渠道依赖的 huggingface-hub 库版本不匹配——当前打包版中内置的版本是 0.35.3,但该翻译模块要求 ≥1.3.0,导致启动失败。解决方案如下(按推荐顺序执行):更换翻译渠道(推荐,最快捷) 在主界面「Trans Channel」处选择其他渠道,例如:Google 翻译(需科学上网)微软翻译(国内可用,免费)DeepSe...39.182**1 Posted at: 2 months ago -
#5794 终于找到原因了,我把英语通过人工翻译好中文,但是在生成语音的时候,你怎么老把时间轴给改动了啊...
💬 18[Last reply:2 months ago] 这是正常的例如原始字幕区间时长3秒,配音后时长变为了5秒,通过视频慢速将该区间视频片段延长到5秒和配音对齐,那么字幕时间轴也必须延长到5秒,否则说话还没结束,字幕就不显示了如果说之前版本没有改变时间轴,那是之前版本有bug,字幕声音没有精确对齐...2a14**2cb Posted at: 2 months ago -
#5793 终于找到原因了,我把英语通过人工翻译好中文,但是在生成语音的时候,你怎么老把时间轴给改动了啊...
💬 1[Last reply:2 months ago] 这是由于开启了“配音加速”或“视频慢速”等对齐选项导致的。这些选项会在配音时自动调整字幕时间轴,以匹配配音时长。解决方案: 在“批量为字幕配音”界面中,确保以下选项均未勾选:配音加速(Voice auto rate)视频慢速(Video auto rate)任何涉及自动调整时间轴的设置保持默认状态即可让配音严格遵循原始SRT字幕的时间轴,不做任何改动。如果仍然出现问题,请检查配音渠道的“移除配音...183.198**1 Posted at: 2 months ago -
#5750 豆包语音合成模型2.0是哪个模型...
💬 11[Last reply:2 months ago] 在免费或本地部署的配音渠道中,Confucius4-TTS(本地 API,需自行部署) 是目前泰语预设音色最多的渠道。它明确支持泰语,并提供多个预设发音角色(通常包含男女声、不同风格),适合需要丰富泰语选项的场景。如果你不想自行部署,也可以尝试 Edge-TTS(免费在线),其泰语音色数量较少但开箱可用。请查阅相关文档:Confucius4-TTS 等本地部署 TTS 说明(注:该页面涵盖多种本地...103.17**5 Posted at: 2 months ago -
#5791 =====system:Windows-10-10.0.26200-SP0version:v3.99frozen:Truelanguage:enroot_dir:E:/Application/dupping/win-pyvideo...
💬 1[Last reply:2 months ago] No specific issue was described. Please provide the error message you encountered, the steps you took before the error occurred, and any relevant log content (last 30 lines from logs/ folder). Also co...2001**5a2a Posted at: 2 months ago -
#5790 语音识别选择VAD模式...
💬 1[Last reply:2 months ago] 语音识别中的 VAD(Voice Activity Detection)选项位于 菜单 → 工具/选项 → 高级选项 → 语音识别参数 页面中。您可以在下拉菜单中选择对应的 VAD 类型(软件内置了多种 VAD 模型,如 Silero VAD 等)。调整 VAD 可以更精确地控制音频中被判定为“语音”或“静音”的门限,从而影响最终字幕的分割精度。建议:语音阈值:数值越低越灵敏(容易将噪声误判为语音...240e**9ad7 Posted at: 2 months ago -
#5789 连接超时,请检查网络连接是否稳定. 微软翻译使用频繁可能触发限流,请稍等段时间重试。Traceback (most recent call last):...
💬 1[Last reply:2 months ago] 微软翻译接口连接超时,通常由两种原因引起:网络不稳定或短时请求频繁触发限流。解决方法:增加翻译间隔:进入菜单 → 工具 → 高级选项 → 字幕翻译调整,将 翻译后暂停秒 改为 5 或 10,以避免被微软限流。更换翻译渠道:暂时改用 Google 翻译(需代理)或百度翻译、DeepSeek 等国内可用渠道。在“翻译渠道”下拉框中选择其他服务并配置好对应的 API 密钥。检查网络与代理:确保当前网络可...2408**4bd9 Posted at: 2 months ago -
#5787 我同时启动两个sp 结果发现,会修改其他翻译好的时间轴,会出现这种情况吗...
💬 3[Last reply:2 months ago] 可以。使用外部已翻译好的 SRT 字幕,可以批量跳过 ASR 和翻译阶段,直接进行配音和合成。具体操作为:将多个视频放在同一个文件夹内,每个视频的命名保持极简(如 a.mp4、b.mp4)。在每个视频同级目录下创建 _video_out 文件夹,再分别创建以“视频名-视频格式”命名的子文件夹(例如 a-mp4、b-mp4)。将对应的源语言字幕和目标语言字幕放入这些子文件夹,分别命名为 [语言代码]...2a14**4bd Posted at: 2 months ago -
#5786 代理设置不正确或代理不可用,请检查代理或关闭代理并删掉代理文本框中所填内容Traceback (most recent call last):...
💬 1[Last reply:2 months ago] 核心原因是您设置的代理地址 http://127.0.0.1:22004 指向的代理服务未能正常连接(“目标计算机积极拒绝”),导致所有尝试访问 Google 翻译的网络请求失败。解决方案如果不需要代理 在主界面 “网络代理” 文本框中彻底清空所有内容(删除 http://127.0.0.1:22004),点击保存后重新运行任务即可。如果需要代理确认您的代理软件(如 V2Ray、Clash 等)...112.120**4 Posted at: 2 months ago -
#5785 Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: tfTraceback (most recent call last):...
💬 1[Last reply:2 months ago] Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: tf indicates a conflict in CTranslate2’s internal TensorFlow backend, likely triggered by an incompatible ctrans...91.38**4 Posted at: 2 months ago -
#5782 你的设备不满足CUDA加速要求,请确认是NVIDIA显卡,并已配置好CUDA环境,点击菜单栏-帮助支持-CUDA help...
💬 9[Last reply:2 months ago] 根据你提供的 nvcc -V 输出,CUDA Toolkit 已更新到 13.3,但软件仍检测不到 GPU(可用 NVIDIA 显卡数为 0,耗时 20s)。目前核心矛盾:软件内置的 PyTorch 是针对 CUDA 12.8 编译的,而 CUDA 13.3 版本可能不被其完全支持(通常 PyTorch 需配套对应主版本号的 CUDA)。此外,你的显卡驱动版本可能仍为旧的 472.12,该驱动最多...2409**6afb Posted at: 2 months ago -
#5784 :Traceback (most recent call last):...
💬 1[Last reply:2 months ago] 这是由于软件打包版中内置的 huggingface-hub 库版本(0.35.3)过低,导致与所需的 transformers 模块版本要求(>=1.3.0)冲突。该错误常见于 v4.05 早期打包版。解决方法(按顺序尝试):下载并覆盖最新补丁包:前往 pyVideoTrans 官方下载页面 下载最新补丁包(约 260MB),解压后直接覆盖到原软件根目录,确保 _internal 目录下的依...240e**8828 Posted at: 2 months ago -
#5783 :Traceback (most recent call last):...
💬 1[Last reply:2 months ago] 这是由于打包环境中的 huggingface-hub 版本过低导致的:OmniVoice 依赖的 transformers 要求 huggingface-hub>=1.3.0,<2.0,但当前打包版本中固定为 0.35.3,不满足要求。解决方案(按顺序尝试):确认使用的是完整包(2.6GB):你提供的报错路径 D:\video_tool\pyvideotrans\_internal\t...240e**8828 Posted at: 2 months ago -
#5781 翻译字幕阶段出错 [Hy-MT2-1.8B(本地内置)] Couldn't instantiate the backend tokenizer from one of: (1) a `tokenizers` library serialization file,...
💬 1[Last reply:2 months ago] 这个错误是由于 Hy-MT2-1.8B 模型文件下载不完整或缺少 tokenizer 组件(如 tokenizer.json 或 sentencepiece 模型文件)导致的。解决方案:检查模型目录完整性:进入软件安装目录下的 models/models--tencent--Hy-MT2-1.8B 文件夹,确认是否包含所有必要的文件(尤其是 tokenizer.json、tokenizer_con...2409**ba12 Posted at: 2 months ago -
#5780 问:we're good no not sure you know just my friends they told me that like anal sex is so a greatand you know your dad is ......
💬 1[Last reply:2 months ago] 该问题通常由翻译渠道质量不足或上下文缺失导致。您使用的示例文本包含大量口语化俚语(如“b-hole”“butthole”)和不规范语法,免费传统翻译(Google/微软)对此类内容处理较差,易出现漏译或英中夹杂。解决方案:更换翻译渠道为AI大模型(如DeepSeek、OpenAI ChatGPT),并在主界面勾选发送完整字幕,让AI获得完整上下文以准确理解口语和俚语。清除翻译缓存:删除软件目录下t...27.47**6 Posted at: 2 months ago -
#5779 Error no file named pytorch_model.bin, model.safetensors, tf_model.h5, model.ckpt.index or flax_model.msgpack found in directory Z:/SOFTWARE/win-pyvideotrans-v4.05-0711/models/mode...
💬 1[Last reply:2 months ago] 错误原因是 Qwen3-TTS 本地模型文件下载不完整。目录 models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base 虽然存在,但缺少模型权重文件(如 pytorch_model.bin 或 .safetensors),导致加载失败。解决方法手动下载模型: 访问 Hugging Face 仓库 https://huggingface.co/Qwen/Qwen3...45.167**8 Posted at: 2 months ago -
#5778 默认断句和LLM断句什么区别...
💬 1[Last reply:2 months ago] 默认断句直接使用语音识别模型自带的自然断句结果,不做额外处理,速度快、稳定性高,但可能产生过长或过短的片段,影响后续TTS克隆效果。LLM重新断句在语音识别完成后,将整段字幕文本发送给AI大模型(如DeepSeek、OpenAI),让模型修正错别字、重新切分长句为合理短句、恢复标点等。结果更通顺自然,但依赖AI智能水平,可能反而变差,且处理较慢。当使用clone音色(原音色克隆)时,不建议启用,因...240e**9ad7 Posted at: 2 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.