-
#6038 语音识别阶段出错[faster-whisper(本地内置)] No transcription results returned. Please check the original audio/video or model and try again.Traceback (most recent call last):...
💬 1[Last reply:11 days ago] faster-whisper 模型 large-v3-turbo 在 未启用 CUDA 加速(纯 CPU 模式) 下运行时,由于模型体积较大(约 1.5GB),很容易因内存不足、模型加载失败或处理超时而导致无返回结果。故障排查步骤:检查模型完整性: 进入软件目录下的 models/models--mobiuslabsgmbh--faster-whisper-large-v3-turbo 文件夹,...27.189* Posted at: 11 days ago -
#6037 语音识别阶段出错:[openai-whisper(本地)] 系统错误 (None):None:Traceback (most recent call last):...
💬 1[Last reply:11 days ago] 这是模型文件下载失败导致的。openai-whisper 首次运行时需要从 Azure 服务器下载模型文件,你的网络无法连接到该下载地址。解决方案检查代理设置:如果你在中国大陆或需要科学上网才能访问国外网站,请在主界面底部 网络代理 处填写正确的代理地址(如 http://127.0.0.1:7890)并保存,然后重试。手动下载模型文件:如果代理设置后仍失败,请手动下载模型文件并放到 软件目录/m...182.89* Posted at: 11 days ago -
#6036 我生成视频时配音不会跟着原语速去进行适配和断句,就像现在这样,这个是翻译出来的文件00:00:00,320 --> 00:00:32,048他的铲子碰到了什么东西,硬邦邦的。他扒开泥土,发现它在闪闪发光。他把它挖出来,在手里感觉异常沉......
💬 1[Last reply:11 days ago] 这是翻译后的中文字幕被合并成了一条长字幕(原英文字幕正常分段)导致的。配音时会将这条长字幕视为一个连续段落,一口气读完,从而失去与原视频时间轴的匹配。解决方法:重新执行翻译,在软件主界面勾选 「发送完整字幕」(位于翻译渠道下方),这会让 AI 保持原有字幕的行数和时间轴,避免合并。若仍无效,请将 翻译渠道改为传统翻译(如 Google 或 Microsoft 翻译),这些渠道不会自动合并字幕。确保...182.89* Posted at: 11 days ago -
#6035 No dubbing audio generate, view logs:Traceback (most recent call last):...
💬 1[Last reply:11 days ago] DubbingSrtError: No dubbing audio generate 表示配音渠道未能成功生成音频文件。请按以下顺序排查:检查配音渠道是否配置正确若使用 Edge-TTS:进入 菜单→TTS设置,确认配音渠道选择了 Edge-TTS,且配音角色已选择一个音色。若使用 需 API Key 的渠道(如 OpenAI TTS、Azure TTS 等):必须先在对应设置面板填写正确的密钥和...172.245* Posted at: 11 days ago -
#6033 Parameter `text` is not a valid key-word argument. Please click on 'view API' in the footer of the Gradio app to see usage.:Traceback (most recent call last):...
💬 1[Last reply:11 days ago] 这是由于 TTS 渠道(特别是本地 API 类型,如 GPT-SoVITS、CosyVoice 等)的接口参数不匹配导致的。软件向该渠道传递了 text 参数,但被调用的 API 不接受该名称的参数(可能期望 content 或其他字段)。解决方法:更新软件到最新版本:确保你使用的是 v4.06 或更新的补丁版,开发者可能已修复参数映射问题。检查 TTS 渠道设置:确认你选择的 TTS 渠道(如 ...240e:39c* Posted at: 11 days ago -
#6032 Parameter `text` is not a valid key-word argument. Please click on 'view API' in the footer of the Gradio app to see usage.:Traceback (most recent call last):...
💬 1[Last reply:11 days ago] Parameter 'text' is not a valid key-word argument 错误表示你调用的某个 Gradio TTS 服务(如 GPT-SoVITS、F5-TTS、CosyVoice 等)不接受名为 text 的参数,而是期望其他参数名(如 prompt、input 等)。原因:该 TTS 渠道的 API 地址配置不正确,或选错了 API 版本(例如 ...240e:39c* Posted at: 11 days ago -
#6031 Parameter `text` is not a valid key-word argument. Please click on 'view API' in the footer of the Gradio app to see usage.:Traceback (most recent call last):...
💬 1[Last reply:11 days ago] 这是一个 Gradio API 调用参数错误,通常出现在使用了基于 Gradio 的本地 TTS 渠道(如 GPT-SoVITS、ChatTTS、CosyVoice 等)时,Gradio 服务的 API 接口参数名发生了变化,导致软件传递的 text 参数不被接受。请按以下步骤排查:确认 TTS 渠道:你在主界面“配音渠道”中选择了哪个?如果是 GPT-SoVITS、CosyVoice、ChatT...240e:39c* Posted at: 11 days ago -
#6030 翻译出来的字幕特别长是怎么回事?...
💬 1[Last reply:11 days ago] 字幕过长通常是由于没有限制单行最大字符数,或语音识别时分割颗粒度不够细导致的。您可以通过以下两个设置解决:调整单行最大字符数:进入 菜单 → 工具/选项 → 高级选项 → 字幕声音画面对齐,修改“中日韩字幕单行字符数”和“其他语言字幕单行字符数”(例如设为 30~40),超过该长度的字幕会自动换行。调整语音识别切分粒度:在同一高级选项的“语音识别参数”区域,减小“最长语音持续秒数”(例如设为 6~...220.203* Posted at: 11 days ago -
#6028 配音阶段出错 [Azure(免费试用)] 文件不存在:H:\工作\工作\5月\通风\葡语版\01分割完成\srt_output\13、采食量下降15%25.srtTraceback (most recent call last):...
💬 1[Last reply:11 days ago] 原因:你指定的字幕文件 13、采食量下降15%25.srt 实际并不存在,或者文件名中包含特殊字符(%、中文、空格)导致软件无法正常定位。解决方案:检查文件路径:前往 H:\工作\工作\5月\通风\葡语版\01分割完成\srt_output\,确认文件是否确实存在,注意文件名中的 %25 是 URL 编码,实际可能是 13、采食量下降15%.srt(Windows 允许 % 但容易与命令行转义冲突...117.159* Posted at: 11 days ago -
#6027 配音阶段出错 [Azure(免费试用)] Queue tts length is 0Traceback (most recent call last):...
💬 1[Last reply:11 days ago] RuntimeError: Queue tts length is 0 表示配音队列为空,没有字幕需要配音。从你的配置看,输入文件是 .txt 文本文件而不是标准 SRT 字幕格式文件,且路径包含中文和特殊符号,导致软件无法正确解析出待配音的字幕行。解决方案:检查输入文件:确认 7、第二个问题.txt 文件内有实际的文本内容(非空),且编码为 UTF-8。改用标准 SRT 格式:批量为字幕配音时,...103.62* Posted at: 11 days ago -
#6026 No transcription results returned. Please check the original audio/video or model and try again.Traceback (most recent call last):...
💬 1[Last reply:11 days ago] 核心原因:语音识别阶段未返回任何字幕。常见于以下情况:视频文件路径/名包含中文、空格或特殊符号,导致底层 FFmpeg 或 Whisper 模型无法正确读取音频。模型文件下载不完整或损坏(特别是 large-v3-turbo 体积较大,网络不稳定时容易出错)。视频本身无有效人声音轨,或发音语言选择错误(但您已选英语,可能性较低)。未启用 CUDA 加速:CPU 处理大模型可能因超时或内存不足而静默...182.108* Posted at: 11 days ago -
#6025 文件不存在:E:/课程/土神翻译/Lecture 001 - MSB - Market Structure Break/BEST TRADING STRATEGY Scalping to Swing Trade. HOW to Trade PRICE ACTION & Market Structure Breaks [JAGgL40_ntI]-mp4/BES...
💬 1[Last reply:12 days ago] 文件不存在错误通常是由于文件路径过长或包含特殊字符导致 Windows 系统无法访问。您的路径长达数百字符且混合了中文、空格、方括号等,超出了系统默认路径长度限制(260字符)。解决办法:将您的原始视频文件移动到盘符根目录下的短路径,例如 D:\vid\。重命名视频文件为纯英文数字组合,如 lecture001.mp4。重新打开软件,导入此简短路径下的视频开始翻译。注意: 请务必勾选主界面上的 清...2401:f1e0* Posted at: 12 days ago -
#6024 文件不存在:E:/课程/土神翻译/Lecture 001 - MSB - Market Structure Break/BEST TRADING STRATEGY ⧸ Scalping to Swing Trade. HOW to Trade PRICE ACTION & Market Structure Breaks [JAGgL40_ntI]-mp4/B...
💬 1[Last reply:12 days ago] 这个错误是因为文件路径中包含特殊字符(如 ⧸、空格、方括号等)且路径过长,导致底层 ffmpeg 或文件系统无法正确处理。Windows 命令行对路径长度有 260 字符限制,特殊符号也会引发解析异常。解决方法:缩短并规范文件路径将视频文件和字幕文件移到浅层目录,例如 E:\videos\。重命名文件,仅使用英文字母、数字、下划线,例如: E:\videos\lecture001_msb.mp4...2401:f1e0* Posted at: 12 days ago -
#6023 系统错误 (None):NoneTraceback (most recent call last):...
💬 1[Last reply:12 days ago] 核心原因是 M2M100 本地翻译模型文件缺失(找不到 sentencepiece.model)。通常是因为首次使用时自动下载失败(网络不稳定或被阻断),导致模型文件未正确放置到 models/ 目录下。解决方案:手动下载模型: 访问阿里魔塔下载链接: https://modelscope.cn/models/himyworld/videotrans/resolve/master/m2m100...223.74* Posted at: 12 days ago -
#6021 输入的是英文的无字幕的视频,经过翻译后输出的中文视频,翻译很不准确,意思都变了,能设置场景或语境吗,提高翻译准确度,也有可以在识别英文声音的时候读成英文的时候意思已经变了,再经过翻译阶段后,出来的中文视频意思就变了很多了...
💬 1[Last reply:12 days ago] 语音识别或翻译环节本身未提供“场景语境”预设选项,但可通过以下配置大幅提升准确度:升级语音识别模型将语音识别渠道切换为 faster-whisper(本地内置) 并选择 large-v3 模型(最准确)。勾选 CUDA加速(需NVIDIA显卡和对应CUDA环境)。避免使用 .en 结尾或 distil- 开头的轻量模型(它们仅支持英语且精度低)。若预算允许,使用付费渠道如 OpenAI语音识别AP...223.74* Posted at: 12 days ago -
#6020 预处理阶段出错 opening output file E:/ShiPinFanYi-pyVideoTrans/tmp/23376/585a5e9c5c/1-1784726322.090549.wav. opening output files: Invalid argumentTraceback (most recent call last):...
💬 1[Last reply:12 days ago] 核心原因:FFmpeg 在写入临时音频文件时因路径或权限问题失败,返回 Invalid argument 错误。通常由以下三种情况之一引起:临时文件夹异常、磁盘空间不足、或杀毒软件拦截了写操作。解决方案(按顺序操作):清理临时文件夹 完全关闭软件,手动进入 E:/ShiPinFanYi-pyVideoTrans/tmp/ 文件夹,彻底删除该文件夹下的所有内容(若提示文件占用,可重启电脑后再删除)...8.221* Posted at: 12 days ago -
#6019 pyvideotrans 4.06怎样设置中文字体...
💬 7[Last reply:12 days ago] 请按以下步骤操作以确保最终视频包含中文字幕:在主界面将 目标语言 设为 简体中文 (zh-cn)。在 同步对齐和字幕 一行,从下拉选项中选择 嵌入硬字幕(字幕永久烧录在画面中)或 嵌入软字幕(播放器可开关)。若需仅显示中文,不要选“(双)”。若之前已执行过但未勾选字幕,请勾选 清理已生成 后重新点击 开始,软件会重新生成并嵌入字幕。如需调整中文硬字幕的字体、大小、颜色等,点击 设置更多参数 → 修...54.189* Posted at: 12 days ago -
#6018 Value: 'Same as the voice reference' (type: <class 'str'>) is not in the list of choices: ['与音色参考音频相同', '使用情感参考音频', '使用情感向量控制']:Traceback (most recent call last):...
💬 1[Last reply:12 days ago] 这是 index-tts 开源库内部的国际化字符串不一致导致的 Bug。 解决方法:找到你本地部署的 index-tts 项目根目录下的 webui.py 文件。全局搜索字符串 i18n("与音色参考音频相同")。将其替换为英文:"Same as the voice reference"。保存文件并重启 index-tts 服务即可。请查阅相关文档:F5/...103.252* Posted at: 12 days ago -
#6017 翻译韩语视频语音识别参数怎么设置 断句不会太长 也不会把一个句子切断...
💬 1[Last reply:12 days ago] 对于韩语视频的语音识别,要避免断句太长或切断句子,建议按以下参数调整:语音识别渠道:选择 faster-whisper(本地内置),模型选 large-v3(对韩语支持好)。最长语音持续秒数:设为 10~15(防止单句过长被强行分割)。最短语音持续毫秒:设为 2000~3000(过短的片段会合并到邻近,减少碎片,但也不会让长句被切碎)。启用Whisper预分割音频:勾选此项,让模型根据语音自然停顿...103.219* Posted at: 12 days ago -
#6016 配音阶段出错 [Index-TTS(本地API)] 配音全部失败 Value: 'Same as the voice reference' (type: <class 'str'>) is not in the list of choices: ['与音色参考音频相同', '使用情感参考音频', '使用情感向量控制']Traceback (most rece...
💬 1[Last reply:12 days ago] 这是 Index-TTS 开源库内部多语言界面翻译不一致导致的校验错误 —— pyVideoTrans 发送的英文选项 Same as the voice reference 与 Index-TTS 的 WebUI 下拉列表中的中文选项 与音色参考音频相同 不匹配。解决方案:打开你本地部署的 Index-TTS 项目根目录下的 webui.py 文件。全局搜索字符串 i18n("与音色参...61.178* Posted at: 12 days ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.