-
#5914 语音识别阶段出错[faster-whisper(本地内置)] No transcription results returned. Please check the original audio/video or model and try again.Traceback (most recent call last):...
💬 1[Last reply:16 days ago] 该错误表示语音识别引擎未能从音频中提取出任何文字,最常见的原因是未启用 CUDA 时使用 large-v3-turbo 模型在 CPU 上运行导致超时,或者模型文件下载不完整。请按以下步骤排查:检查视频是否包含清晰的人声——先用播放器听一下,确认有说话声且语言设置正确(发音语言为简体中文)。检查模型是否下载完整——进入软件目录下的 models/models--mobiuslabsgmbh--fa...182.96* Posted at: 16 days ago -
#5913 ocrsp-0524识别不出字幕...
💬 8[Last reply:16 days ago] 我仍然无法获取到您上传的图片内容(显示为空或无法加载)。请通过文字描述您遇到的问题,或者直接提供 logs/ 目录下的最新日志文件内容(复制最后30行)。这样才能针对性分析。或者,请描述:视频的编码格式、分辨率以及字幕的语言和样式。ocrsp-0524 运行时控制台输出的具体错误或警告信息。...103.219* Posted at: 16 days ago -
#5910 程序内部错误:PreTrainedModel.initialize_weights..smart_apply() missing 1 required positional argument: 'is_remote_code'Traceba......
💬 5[Last reply:16 days ago] 这是由 transformers 库版本过高导致的兼容性问题。Confucius-TTS 需要旧版 transformers API,而 4.57.x 版本新增了 is_remote_code 参数导致调用失败。解决方案(任选其一):降级 transformers 库(推荐): 在终端中执行以下命令,将 transformers 降至 4.47.1:uv add transformers==4....2a14:7dc0* Posted at: 16 days ago -
#5912 {'code': 7, 'msg':...
💬 1[Last reply:16 days ago] 该错误 400 Bad Request: ('audio',) 表示发送给语音合成服务的请求格式被服务器拒绝,常见于使用了需要上传参考音频的克隆配音渠道(如 clone 角色、GPT-SoVITS、F5-TTS 等)时,音频参数不符合要求,或是请求体中携带了无效数据。解决方案:检查主界面 配音角色 是否选择了 clone 或其他需要参考音频的克隆渠道。如果是,请确保已经在 菜单...18.183* Posted at: 16 days ago -
#5911 {'code': 7, 'msg':...
💬 1[Last reply:16 days ago] 这是由于 TTS 配音请求被服务器拒绝(400 Bad Request),通常与代理配置或请求参数格式异常有关。解决方法:检查主界面「网络代理」文本框:如果填写了代理地址,清空并保存,重新执行任务。确认使用的配音渠道:如果是 Edge-TTS,进入「高级选项 → 字幕配音调整」,将「EdgeTTS 配音渠道配音并发数」设为 1,并设置「配音后暂停秒」为 5-10 秒。升级软件至 v4.06 或更高...3.35* Posted at: 16 days ago -
#5909 翻译字幕阶段出错 [Google(免费)] 429 Client Error: Too Many Requests for url: https://api-edge.cognitive.microsofttranslator.com/translate?from=&to=de&api-version=3.0&includeSentenceLength=tr...
💬 1[Last reply:16 days ago] 这是由于微软免费翻译 API 短时间内请求过于频繁触发的限流(HTTP 429)。软件在默认 Google 翻译失败后会回退到微软翻译,微软接口同样有请求频率限制。解决方案:打开 菜单 > 工具/选项 > 高级选项 > 字幕翻译调整。将 传统翻译渠道每批字幕行数 从默认值调小(例如设为 5~10 行)。将 翻译后暂停秒 设为 1~2 秒(给服务器喘息时间)。保存后重新执行翻译任务...2409:8a55* Posted at: 16 days ago -
#5908 语音识别阶段出错[parakeet日语(本地内置)] NoneTraceback (most recent call last):...
💬 1[Last reply:16 days ago] 直接原因:parakeet日语(本地内置) 渠道不支持 CUDA 加速,但你勾选了“启用 CUDA 加速”,导致底层 VAD 处理时因参数冲突崩溃。解决方法按顺序尝试:取消勾选“启用 CUDA 加速”,重新执行任务。该渠道纯 CPU 运行,无需 GPU。检查模型文件是否完整:parakeet 日语模型需手动下载解压到 软件目录/models/parakeet/。若未下载或文件损坏,请重新下载:pa...240e:39c* Posted at: 16 days ago -
#5907 怎样将mac中的pyvideotrans升级到最新版本...
💬 7[Last reply:16 days ago] 系统未安装 uv 包管理器,请先执行以下命令安装:`bashcurl -LsSf https://astral.sh/uv/install.sh | sh安装完成后,关闭并重新打开终端,再次进入 pyVideoTrans 目录执行:```bash uv sync --all-extras若在国内安装失败,可尝试使用国内镜像安装:curl -LsSf https://mirrors.aliyun.c...116.53* Posted at: 16 days ago -
#5906 怎样将mac中的pyvideotrans升级到最新版本...
💬 1[Last reply:16 days ago] 进入 pyVideoTrans 源码所在的目录,执行以下命令即可升级:git pull uv sync如果之前没有使用 Git 部署,而是直接下载源码压缩包,则需要重新下载最新版本并覆盖(注意备份 videotrans/params.json 等配置文件)。升级后首次运行时建议清理 tmp/ 目录下的旧缓存文件(可选)。...240e:34c* Posted at: 16 days ago -
#5905 也可直接去 https://github.com/jianchang512/pyvideotrans 该地址点击绿色Code按钮下载源码,解压后进入sp.py所在目录,这句话怎么操作‘...
💬 1[Last reply:16 days ago] 您提到的这句话是 pyVideoTrans 源码部署的步骤之一,具体操作如下:1. 打开 GitHub 仓库页面 访问 https://github.com/jianchang512/pyvideotrans2. 找到绿色「Code」按钮 在页面中间偏右位置,有一个绿色的 <> Code ▼ 按钮。3. 点击按钮并选择下载方式点击 Code → 弹出菜单中点击 「Download ...240e:34c* Posted at: 16 days ago -
#5904 Subprocess Error: module 'decoders' has no attribute 'DecodeStream'Traceback (most recent call last):...
💬 3[Last reply:16 days ago] 从日志可以看出,模型文件目录虽然存在,但加载时 ctranslate2 库报错 module 'decoders' has no attribute 'DecodeStream',这通常意味着该模型文件损坏或不完整,或者 ctranslate2 版本过旧。按以下步骤依次尝试:升级到最新版 v4.06:你当前使用的是 v4.03,该版本配套的 ctransla...157.85* Posted at: 16 days ago -
#5903 {"message":"tts failed","Exception":"\"slow_conv2d_cpu\" not implemented for 'Half'"}self.api_url='http://127.......
💬 10[Last reply:16 days ago] 请按以下步骤手动在终端中运行 GPT-SoVITS 的 API 服务并获取日志:找到 api.py 所在的文件夹通常在您下载的 GPT-SoVITS 主目录下,例如 D:\GPT-SoVITS\ 或 E:\GPT-SoVITS一键包\。如果找不到,可以在该目录里用搜索功能搜索 api.py。在该目录下打开命令提示符(CMD)在 api.py 所在的文件夹内,按住键盘上的 Shift 键,然后 右键...2408:825c* Posted at: 16 days ago -
#5902 [GPT-SoVITS] 该渠道需另行部署并启动后可用:...
💬 8[Last reply:16 days ago] 关闭当前已运行的 GPT-SoVITS 终端窗口(按 Ctrl+C 终止进程)。进入你的 GPT-SoVITS 项目目录。重新运行 API 接口脚本:python api.py等待命令行输出 Running on http://127.0.0.1:9880 后,回到 pyVideoTrans 重新开始配音任务。如果 API 进程是后台服务,可在任务管理器中找到 Python 进程并结束,再重新启动...2408:825c* Posted at: 16 days ago -
#5901 怎么下载最新的pyvideotrans for mac 的安装包...
💬 5[Last reply:16 days ago] 请先安装 uv 包管理器,macOS 推荐运行以下命令(二选一):# 方法一(使用pip,需先有Python 3.10+) pip install uv # 方法二(官方安装脚本,无需Python) curl -LsSf https://astral.sh/uv/install.sh | sh安装完成后重新打开终端,再次执行 uv sync 即可。...240e:34c* Posted at: 16 days ago -
#5900 {"message":"tts failed","Exception":"\"slow_conv2d_cpu\" not implemented for 'Half'"}self.api_url='http://127.......
💬 9[Last reply:16 days ago] 在 Windows 系统中,打开文本编辑器的步骤如下:1. 找到 GPT-SoVITS 根目录下的 config.json 文件。2. 右键点击该文件,选择“打开方式”,然后选择“记事本”或“Notepad++”(如果没有,可以选择“从电脑上选择应用”->“记事本”)。3. 在打开的记事本中,按 Ctrl+F 打开查找功能,搜索“precision”、“dtype”、“half”或“fp16...2408:825c* Posted at: 16 days ago -
#5899 方法一:克隆原始视频中已有的人声(直接使用原说话人音色)在主界面的「配音渠道」选择一个支持声音克隆的渠道(如 Qwen-TTS、OmniVoice-TTS、F5-TTS 等),然后在「配音角色」下拉框中选择 clone,没有找到clone选......
💬 1[Last reply:16 days ago] 原因分析clone 选项仅出现在明确支持音色克隆的配音渠道中,且需要先设定正确的「目标语言」。你当前的配置不满足显示条件。解决步骤确认配音渠道:在「配音渠道」下拉框中,必须选择知识库列出的支持克隆的渠道,例如:Qwen-TTS(本地内置)F5-TTS(本地内置)OmniVoice-TTS(本地内置)Confucius-TTS(本地内置)等(建议优先选择前三个本地内置渠道,无需额外部署)。设定目标语...240e:34c* Posted at: 16 days ago -
#5898 怎样使自己的声音成为输出音频的声音...
💬 1[Last reply:16 days ago] 要让自己的声音成为输出音频,有以下两种方法:方法一:克隆原始视频中已有的人声(直接使用原说话人音色) 在主界面的「配音渠道」选择一个支持声音克隆的渠道(如 Qwen-TTS、OmniVoice-TTS、F5-TTS 等),然后在「配音角色」下拉框中选择 clone。软件会自动从原始视频中截取对应时间段的音频作为参考,克隆该说话人的音色。方法二:使用自己录好的本地参考音频准备一段 3~10 秒的 ...240e:34c* Posted at: 16 days ago -
#5897 Traceback (most recent call last): File...
💬 1[Last reply:16 days ago] 原因分析这是因为您的 PyTorch 未安装 CUDA 支持(torch.cuda 不可用),通常由以下原因导致:您使用的是 CPU 版 PyTorch(打包版可能未包含 CUDA 依赖)或者系统缺少 CUDA 工具包 / cuDNN(软件要求 CUDA 12.8 + cuDNN 9.11)另外,v3.96 版本较旧,推荐升级到最新 v4.06 版本以获得更好的 CUDA 兼容性。解决方案如果您没...39.164* Posted at: 16 days ago -
#5896 语音识别阶段出错[Qwen-ASR(本地内置)] CUDA error: CUBLAS_STATUS_EXECUTION_FAILED when calling `cublasGemmEx( handle, opa, opb, m, n, k, alpha_ptr, a, CUDA_R_16F, lda, b, CUDA_R_16F, ldb, beta_p...
💬 1[Last reply:16 days ago] 这是由于 Qwen-ASR 1.7B 模型在 GPU 推理时 CUBLAS 执行失败,通常由显存不足、CUDA 版本不兼容或计算精度溢出引起。解决方案:切换 CPU 模式:暂时取消勾选主界面的 CUDA加速,用 CPU 运行以确认是否是 GPU 相关问题。降低模型尺寸:在语音识别渠道选择 Qwen-ASR(本地内置) 后,将模型切换为 0.6B(占用显存更少)。调整计算数据类型:进入 菜单 → 工...117.15* Posted at: 16 days ago -
#5895 Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: tensorflow_textTraceback (most recent call last):...
💬 1[Last reply:17 days ago] 这是 faster-whisper 语音识别子进程初始化时遇到的 TensorFlow Text 后端缺失错误。该错误可能由于系统环境冲突或软件包依赖损坏导致。解决方案:确保使用官方完整版:确认下载的是 2.6GB+ 的完整版压缩包而非 260MB 补丁包。清除旧版本后重新解压最新 v4.06 完整版到纯英文路径(如 D:\pyVideoTrans)。尝试更换语音识别渠道:在主界面将语音识别切换为...58.48* Posted at: 17 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.