• #5750 豆包语音合成模型2.0是哪个模型...
    💬 11
    [Last reply:21 days ago] 在免费或本地部署的配音渠道中,Confucius4-TTS(本地 API,需自行部署) 是目前泰语预设音色最多的渠道。它明确支持泰语,并提供多个预设发音角色(通常包含男女声、不同风格),适合需要丰富泰语选项的场景。如果你不想自行部署,也可以尝试 Edge-TTS(免费在线),其泰语音色数量较少但开箱可用。请查阅相关文档:Confucius4-TTS 等本地部署 TTS 说明(注:该页面涵盖多种本地...
    103.17* Posted at: 24 days ago
  • #5791 =====system:Windows-10-10.0.26200-SP0version:v3.99frozen:Truelanguage:enroot_dir:E:/Application/dupping/win-pyvideo...
    💬 1
    [Last reply:22 days ago] No specific issue was described. Please provide the error message you encountered, the steps you took before the error occurred, and any relevant log content (last 30 lines from logs/ folder). Also co...
    2001:ee0* Posted at: 22 days ago
  • #5790 语音识别选择VAD模式...
    💬 1
    [Last reply:22 days ago] 语音识别中的 VAD(Voice Activity Detection)选项位于 菜单 → 工具/选项 → 高级选项 → 语音识别参数 页面中。您可以在下拉菜单中选择对应的 VAD 类型(软件内置了多种 VAD 模型,如 Silero VAD 等)。调整 VAD 可以更精确地控制音频中被判定为“语音”或“静音”的门限,从而影响最终字幕的分割精度。建议:语音阈值:数值越低越灵敏(容易将噪声误判为语音...
    240e:3a3* Posted at: 22 days ago
  • #5789 连接超时,请检查网络连接是否稳定. 微软翻译使用频繁可能触发限流,请稍等段时间重试。Traceback (most recent call last):...
    💬 1
    [Last reply:22 days ago] 微软翻译接口连接超时,通常由两种原因引起:网络不稳定或短时请求频繁触发限流。解决方法:增加翻译间隔:进入菜单 → 工具 → 高级选项 → 字幕翻译调整,将 翻译后暂停秒 改为 5 或 10,以避免被微软限流。更换翻译渠道:暂时改用 Google 翻译(需代理)或百度翻译、DeepSeek 等国内可用渠道。在“翻译渠道”下拉框中选择其他服务并配置好对应的 API 密钥。检查网络与代理:确保当前网络可...
    2408:8411* Posted at: 22 days ago
  • #5787 我同时启动两个sp 结果发现,会修改其他翻译好的时间轴,会出现这种情况吗...
    💬 3
    [Last reply:22 days ago] 可以。使用外部已翻译好的 SRT 字幕,可以批量跳过 ASR 和翻译阶段,直接进行配音和合成。具体操作为:将多个视频放在同一个文件夹内,每个视频的命名保持极简(如 a.mp4、b.mp4)。在每个视频同级目录下创建 _video_out 文件夹,再分别创建以“视频名-视频格式”命名的子文件夹(例如 a-mp4、b-mp4)。将对应的源语言字幕和目标语言字幕放入这些子文件夹,分别命名为 [语言代码]...
    2a14:4900* Posted at: 22 days ago
  • #5786 代理设置不正确或代理不可用,请检查代理或关闭代理并删掉代理文本框中所填内容Traceback (most recent call last):...
    💬 1
    [Last reply:22 days ago] 核心原因是您设置的代理地址 http://127.0.0.1:22004 指向的代理服务未能正常连接(“目标计算机积极拒绝”),导致所有尝试访问 Google 翻译的网络请求失败。解决方案如果不需要代理 在主界面 “网络代理” 文本框中彻底清空所有内容(删除 http://127.0.0.1:22004),点击保存后重新运行任务即可。如果需要代理确认您的代理软件(如 V2Ray、Clash 等)...
    112.120* Posted at: 22 days ago
  • #5785 Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: tfTraceback (most recent call last):...
    💬 1
    [Last reply:22 days ago] Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: tf indicates a conflict in CTranslate2’s internal TensorFlow backend, likely triggered by an incompatible ctrans...
    91.38* Posted at: 22 days ago
  • #5782 你的设备不满足CUDA加速要求,请确认是NVIDIA显卡,并已配置好CUDA环境,点击菜单栏-帮助支持-CUDA help...
    💬 9
    [Last reply:22 days ago] 根据你提供的 nvcc -V 输出,CUDA Toolkit 已更新到 13.3,但软件仍检测不到 GPU(可用 NVIDIA 显卡数为 0,耗时 20s)。目前核心矛盾:软件内置的 PyTorch 是针对 CUDA 12.8 编译的,而 CUDA 13.3 版本可能不被其完全支持(通常 PyTorch 需配套对应主版本号的 CUDA)。此外,你的显卡驱动版本可能仍为旧的 472.12,该驱动最多...
    2409:8a4c* Posted at: 22 days ago
  • #5784 :Traceback (most recent call last):...
    💬 1
    [Last reply:22 days ago] 这是由于软件打包版中内置的 huggingface-hub 库版本(0.35.3)过低,导致与所需的 transformers 模块版本要求(>=1.3.0)冲突。该错误常见于 v4.05 早期打包版。解决方法(按顺序尝试):下载并覆盖最新补丁包:前往 pyVideoTrans 官方下载页面 下载最新补丁包(约 260MB),解压后直接覆盖到原软件根目录,确保 _internal 目录下的依...
    240e:b8e* Posted at: 22 days ago
  • #5783 :Traceback (most recent call last):...
    💬 1
    [Last reply:22 days ago] 这是由于打包环境中的 huggingface-hub 版本过低导致的:OmniVoice 依赖的 transformers 要求 huggingface-hub>=1.3.0,<2.0,但当前打包版本中固定为 0.35.3,不满足要求。解决方案(按顺序尝试):确认使用的是完整包(2.6GB):你提供的报错路径 D:\video_tool\pyvideotrans\_internal\t...
    240e:b8e* Posted at: 22 days ago
  • #5781 翻译字幕阶段出错 [Hy-MT2-1.8B(本地内置)] Couldn't instantiate the backend tokenizer from one of: (1) a `tokenizers` library serialization file,...
    💬 1
    [Last reply:22 days ago] 这个错误是由于 Hy-MT2-1.8B 模型文件下载不完整或缺少 tokenizer 组件(如 tokenizer.json 或 sentencepiece 模型文件)导致的。解决方案:检查模型目录完整性:进入软件安装目录下的 models/models--tencent--Hy-MT2-1.8B 文件夹,确认是否包含所有必要的文件(尤其是 tokenizer.json、tokenizer_con...
    2409:8a02* Posted at: 22 days ago
  • #5780 问:we're good no not sure you know just my friends they told me that like anal sex is so a greatand you know your dad is ......
    💬 1
    [Last reply:22 days ago] 该问题通常由翻译渠道质量不足或上下文缺失导致。您使用的示例文本包含大量口语化俚语(如“b-hole”“butthole”)和不规范语法,免费传统翻译(Google/微软)对此类内容处理较差,易出现漏译或英中夹杂。解决方案:更换翻译渠道为AI大模型(如DeepSeek、OpenAI ChatGPT),并在主界面勾选发送完整字幕,让AI获得完整上下文以准确理解口语和俚语。清除翻译缓存:删除软件目录下t...
    27.47* Posted at: 22 days ago
  • #5779 Error no file named pytorch_model.bin, model.safetensors, tf_model.h5, model.ckpt.index or flax_model.msgpack found in directory Z:/SOFTWARE/win-pyvideotrans-v4.05-0711/models/mode...
    💬 1
    [Last reply:22 days ago] 错误原因是 Qwen3-TTS 本地模型文件下载不完整。目录 models/models--Qwen--Qwen3-TTS-12Hz-0.6B-Base 虽然存在,但缺少模型权重文件(如 pytorch_model.bin 或 .safetensors),导致加载失败。解决方法手动下载模型: 访问 Hugging Face 仓库 https://huggingface.co/Qwen/Qwen3...
    45.167* Posted at: 22 days ago
  • #5778 默认断句和LLM断句什么区别...
    💬 1
    [Last reply:23 days ago] 默认断句直接使用语音识别模型自带的自然断句结果,不做额外处理,速度快、稳定性高,但可能产生过长或过短的片段,影响后续TTS克隆效果。LLM重新断句在语音识别完成后,将整段字幕文本发送给AI大模型(如DeepSeek、OpenAI),让模型修正错别字、重新切分长句为合理短句、恢复标点等。结果更通顺自然,但依赖AI智能水平,可能反而变差,且处理较慢。当使用clone音色(原音色克隆)时,不建议启用,因...
    240e:3a3* Posted at: 23 days ago
  • #5777 字幕输出原位置选项...
    💬 1
    [Last reply:23 days ago] 关于"字幕输出原位置":软件没有单独的开关来控制字幕输出到原视频位置。翻译过程的字幕文件默认与原视频最终输出文件保存在一起:执行视频翻译时,最终文件(MP4、SRT等)默认保存到原视频所在目录下的 _video_out 文件夹内。您可以通过主界面第一行的 "输出到.." 按钮自定义整个任务的输出目录(包括字幕、配音文件等)。如果仅处理字幕(如「批量翻译srt字幕」面板),可在该面板中设置独立输出目...
    240e:3a3* Posted at: 23 days ago
  • #5776 转录和翻译字幕是什么功能...
    💬 1
    [Last reply:23 days ago] 转录(语音转字幕)是将视频/音频中的人类说话声识别为带时间轴的SRT字幕文件;翻译是将已有字幕文件从一种语言转换到另一种语言。两者可单独使用,也可在“翻译视频和音频”全流程中自动串联——先转录原音频生成源语言字幕,再翻译为目标语言字幕。请查阅相关文档:语音转录功能说明字幕翻译功能说明...
    240e:3a3* Posted at: 23 days ago
  • #5775 只识别和生成双语字幕的方法...
    💬 1
    [Last reply:23 days ago] 要单独生成双语字幕(不配音、不合成视频),推荐使用左侧功能面板的 “批量语音转字幕” 和 “批量翻译 srt 字幕” 组合完成:语音识别:点击左侧「批量语音转字幕」→ 选择视频/音频 → 选择正确的发音语言、ASR渠道和模型 → 点击“开始”,生成源语言 SRT 字幕文件。字幕翻译:点击左侧「批量翻译 srt 字幕」→ 导入上一步生成的 SRT → 选择源语言、目标语言 → 在“双语字幕输出样式”...
    240e:3a3* Posted at: 23 days ago
  • #5774 ai翻译字幕速度较慢...
    💬 1
    [Last reply:23 days ago] AI翻译字幕速度较慢通常是由于在线API请求的通信延迟、单线程限制或每批字幕行数过少导致的。以下是优化建议:增大每批字幕行数:进入 菜单 → 工具 → 高级选项 → 字幕翻译调整,将 AI翻译渠道每批字幕行数 从默认值(如20)调大到 100~200 甚至更大。这样单次请求翻译更多行,有效减少请求次数,显著提升整体速度。确保使用正确的翻译渠道和模型:如果是本地模型(如 M2M100)速度受限,建议...
    240e:3a3* Posted at: 23 days ago
  • #5773 生成的字幕名称是什么格式...
    💬 1
    [Last reply:23 days ago] 生成的字幕文件名采用语言代码格式:源语言代码.srt 和 目标语言代码.srt。例如,中文为 zh-cn.srt,英文为 en.srt,日语为 ja.srt 等。这些文件默认保存在输出目录的对应子文件夹内(如 _video_out/视频名-格式/)。...
    240e:3a3* Posted at: 23 days ago
  • #5772 字幕格式什么格式...
    💬 1
    [Last reply:23 days ago] 字幕需要符合标准 SRT 格式:每段字幕由序号、时间轴、文本、空行组成时间轴格式:hh:mm:ss,毫秒(3位) --> hh:mm:ss,毫秒(3位)结束时间必须大于开始时间,下一条字幕的开始时间不能小于上一条的结束时间示例:1 00:00:01,000 --> 00:00:03,000 文本内容 2 00:00:04,000 --> 00:00:06,000 文本内容...
    240e:3a3* Posted at: 23 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource