-
#1975 RuntimeError: No graph was found in the protobuf....
💬 1[Last reply:8 months ago] 这个错误 RuntimeError: No graph was found in the protobuf. 表明在启动“实时语音转文字”功能时,软件未能正确加载所需的语音识别模型文件。请按以下步骤解决:检查模型文件:确保软件目录下的 models 文件夹中存在 sherpa-onnx 相关的模型文件。如果 models 文件夹不存在或为空,说明模型未正确下载。重新下载模型:关闭软件。删除 mod...152.70.**9 Posted at: 8 months ago -
#1974 TaskCfg(cache_folder='D:/Users/Desktop/win-pyvideotrans-3.89_20251210_143714/tmp/29468/b3c441b0f3', target_dir='D:/Users/Desktop/outtt/see-mp4', remove_noise=False, is_separate=Fal...
💬 1[Last reply:8 months ago] 这个错误表明在合并阶段,软件找不到分离出的无声视频文件 novoice.mp4。这通常发生在处理过程中文件被意外删除或路径问题。请按以下步骤解决:检查并清理缓存: 在主界面处理视频前,务必勾选“清理已生成”。这能确保软件重新生成所有中间文件,包括 novoice.mp4。检查文件路径: 您的软件解压路径 D:/Users/Desktop/win-pyvideotrans-3.89_20251210...36.230.**9 Posted at: 8 months ago -
#1973 这个情况该怎么弄呢?...
💬 1[Last reply:8 months ago] 这个问题是由于软件无法从 HuggingFace 下载所需的模型文件导致的。请按照以下步骤解决:使用代理(推荐):在软件主界面第5行的“网络代理”处,填入可用的代理地址(格式如 http://127.0.0.1:7860 或 http://your_proxy_ip:port),然后重试。手动下载模型:根据您选择的语音识别模型(例如 large-v3),从其他可靠渠道(如镜像站)下载对应的模型文件...163.53.**5 Posted at: 8 months ago -
#1972 numpy.core._exceptions._ArrayMemoryError: Unable to allocate 221. MiB for an array with shape (57904994,) and data type float32...
💬 1[Last reply:8 months ago] 这个错误是 显存(GPU内存)不足 导致的。当使用 faster-whisper 进行语音识别时,软件尝试将音频文件解码为一个巨大的浮点数组(这里需要约221MB),但您的GPU显存不足以容纳。请按以下步骤解决:立即操作(主界面):在软件主界面的 第2行“语音识别” 区域,将模型从 large-v2 或 large-v3 更换为更小的模型,例如 medium 或 small。tiny 最快但准确率...39.144.**4 Posted at: 8 months ago -
#1971 [Errno 2] No such file or directory: 'D:/win-videotrans-v3.83/tmp22744/d8bde3f32d/audio_clips/t_clip_00000_22260_silence.wav'...
💬 1[Last reply:8 months ago] 这个错误表明软件在尝试访问一个临时音频文件时,该文件不存在。这通常是由于临时文件被意外清理或路径权限问题导致的。请按以下步骤解决:清理缓存并重启软件:关闭 pyVideoTrans。前往软件根目录 D:/win-videotrans-v3.83。删除名为 tmp 的文件夹(如果存在)。重新启动软件。检查并修改工作目录:在软件主界面,点击菜单栏的 工具/选项 -> 高级选项。在“通用设置”区域...88.210.**2 Posted at: 8 months ago -
#1970 pyvideotrans的语音识别选项中模型paraformer-zh和secsevoicesmall区别...
💬 1[Last reply:8 months ago] 在 pyVideoTrans 中,paraformer-zh 和 seaco-voicesmall 都是 阿里FunASR 语音识别引擎下的模型,主要区别在于:paraformer-zh:定位:通用中文语音识别模型。特点:专注于中文语音的识别,在中文场景下准确率较高,对中文口音、专有名词的适应性较好。适用场景:原视频语音为中文时,推荐使用此模型以获得最佳识别效果。seaco-voicesmall:...121.8.**2 Posted at: 8 months ago -
#1969 中文翻译印度尼西亚语,字幕翻译出来还是中文,且视频生成没声音...
💬 1[Last reply:8 months ago] 根据您的描述,问题可能出在翻译环节或配音环节。请按以下步骤排查:检查翻译设置:在主界面第3行“翻译”处,确认“目标语言”已正确选择为 “印度尼西亚语”。如果使用的是AI模型(如ChatGPT、DeepSeek等),请检查“翻译设置”中对应的API Key是否有效,并确认模型支持印尼语翻译。检查配音设置:在主界面第4行“配音”处,确认已选择了一个支持 印度尼西亚语 的配音角色。例如,使用 Edge-...2408:**:3417 Posted at: 8 months ago -
#1382 RuntimeError: 请检查 appid 和 access token 参数是否正确...
💬 3[Last reply:8 months ago] Chyba pri fáze hlasového prekladu: [Doubao TTS Model 2.0] Runtime Error: Skontrolujte, či sú parametre appid a access token správne.Chyba naznačuje, že parametre appid a access token pre model Doubao ...2409:**:8210 Posted at: 9 months ago -
#1968 RuntimeError: No clip timestamps found. Set 'vad_filter' to True or provide 'clip_timestamps'....
💬 1[Last reply:8 months ago] 这个错误是由于 faster-whisper 在语音识别时没有检测到有效的语音片段导致的。核心原因是 VAD(语音活动检测)参数设置不当,导致软件无法从音频中分割出有效的人声。请按以下步骤解决:检查并调整 VAD 参数(首选方案):在软件主界面,点击右下角的 “设置更多参数”。找到 “VAD参数” 区域,调整以下两个关键值:语音阈值:将此值降低(例如从默认的 0.45 改为 0.3 或 0.2)。...205.185.**9 Posted at: 8 months ago -
#1967 numpy.core._exceptions._ArrayMemoryError: Unable to allocate 734. MiB for an array with shape (1, 480949, 400) and data type float32...
💬 1[Last reply:8 months ago] 这是典型的显存(GPU内存)不足错误。处理长音频时,faster-whisper 需要将整个音频的频谱特征加载到显存中,如果音频文件过大或显存不足,就会导致此错误。请按以下步骤解决:立即解决方案(推荐):在软件主界面,将 语音识别 模式从 整体识别 改为 批量推理。批量推理 模式会将长音频切分成小段处理,能显著降低单次显存占用。进一步优化(如果“批量推理”仍报错):进入菜单 工具/选项 ->...2001:**:8009 Posted at: 8 months ago -
#1966 语音识别选项 1整体识别和批量推理的区别?2默认断句和自动修正的区别?...
💬 1[Last reply:8 months ago] 整体识别 vs 批量推理的区别:整体识别:使用 VAD(语音活动检测)技术,先检测出语音片段再进行识别,断句更符合自然停顿,准确性更高,但速度相对较慢。批量推理:将音频按固定时长(如30秒)切分成多个片段后并行识别,处理速度更快,但可能在片段边界处出现断句不自然的情况。默认断句 vs 自动修正的区别:默认断句:直接使用语音识别模型输出的原始断句结果。自动修正:使用本地算法对识别结果的断句进行优化,...203.198.**4 Posted at: 8 months ago -
#1965 TaskCfg(cache_folder='C:/Users/jalal/Downloads/Compressed/win-pyvideotrans-v3.86/tmp16344/2ddb55a378', target_dir='C:/Users/jalal/Downloads/Video/3/_video_out/3', remove_noise=Fals...
💬 1[Last reply:8 months ago] The error indicates that the software is trying to read a subtitle file (ar.srt) that does not exist. This typically happens when the speech recognition (ASR) step fails to generate the initial subtit...31.31.**9 Posted at: 8 months ago -
#1934 软件双击后一直在加载中的页面...
💬 3[Last reply:8 months ago] 如果按照上述路径和权限调整后依然无法启动,请按以下步骤进行深度诊断:检查是否为完整包:确认您下载的文件大小是否约为 1GB。如果只有几百MB,说明下载的是升级补丁,不是完整版。请前往官网重新下载完整的预打包版本。检查关键文件是否存在:在您解压的纯英文路径(如 D:\videotrans)中,查看是否存在 sp.exe 和 python310.dll 这两个核心文件。如果缺少 python310.d...117.28.**3 Posted at: 8 months ago -
#1964 3.89 source ?...
💬 1[Last reply:8 months ago] 目前,pyVideoTrans 的最新稳定版本源码确实仍为 v3.86,托管在 GitHub 主仓库:https://github.com/jianchang512/pyvideotrans。v3.89 是预打包的 Windows 可执行文件版本,其源码更新可能尚未同步至公开的 GitHub 仓库。开源软件的开发流程中,可执行文件的发布有时会先于源码的公开推送。建议操作:关注官方发布渠道:请留意项...2a01:**:1e24 Posted at: 8 months ago -
#1962 TaskCfg(cache_folder='D:/win-pyvideotrans-v3.86/tmp18332/speech2text', target_dir='d:/浏览器下载/win-pyvideotrans-v3.86/output/recogn', remove_noise=False, is_separate=False, detect_lan...
💬 1[Last reply:8 months ago] 错误信息明确显示“CUDA failed with error out of memory”,即显存不足。这是使用 faster-whisper 大模型(如您使用的 large-v1)进行语音识别时的常见问题。请按以下步骤逐一尝试解决:1. 降低模型精度(最有效)进入菜单栏:工具 -> 高级选项。在 Faster/OpenAI/Whisper 语音识别微调 区域,找到 CUDA数据类型。将其...197.149.**8 Posted at: 8 months ago -
#1961 videotrans.configure._except.StopRetry: models/gemini-1.5-pro is not found for API version v1beta, or is not supported for generateContent. Call ListModels to see the list of avail...
💬 1[Last reply:8 months ago] 这个错误表明您选择的 Gemini 模型名称 gemini-1.5-pro 与您使用的 API 版本 v1beta 不匹配,或者该模型不支持 generateContent 方法。核心解决方法:在软件设置中更正 Gemini 模型名称。请按以下步骤操作:在 pyVideoTrans 主界面,点击菜单栏的 工具 -> 设置。在“翻译设置”区域,找到并点击 Gemini 渠道。在“模型名称”输入...156.146.**4 Posted at: 8 months ago -
#1960 TaskCfg(cache_folder='D:/AN/PyVideoTrans/win-pyvideotrans-v3.86/tmp23104/c3be81a467', target_dir='C:/Users/18289/Desktop/SAPP/_video_out/4927052-720p', remove_noise=False, is_separ...
💬 1[Last reply:8 months ago] 此错误表明 DeepSeek API 返回了非 JSON 格式的响应,导致解析失败。通常由以下原因导致:API Key 无效或未设置:请检查 DeepSeek API Key 是否正确,并在“翻译设置”中填入。网络代理问题:如果使用代理,请确保代理设置正确且能正常访问 api.deepseek.com。API 服务端临时异常:DeepSeek 服务器可能暂时返回了错误页面。请按以下步骤排查:验证 ...142.91.**1 Posted at: 8 months ago -
#1959 勾选字幕识别,自动修正的作用...
💬 1[Last reply:8 months ago] “勾选字幕识别,自动修正”的作用是:自动检测并修正视频中可能存在的硬字幕(即内嵌在画面中的文字),并将其作为原始文本进行翻译和配音。具体流程如下:检测:软件会尝试识别视频画面中的文字(OCR技术),提取出硬字幕。修正:将识别出的文字与通过语音识别(ASR)生成的文本进行比对和修正,以提高字幕的准确性。应用:使用修正后的字幕文本作为后续翻译和配音的源文本,而不是仅依赖语音识别的结果。适用场景:视频本...58.152.**0 Posted at: 8 months ago -
#1958 openai.BadRequestError: Error code: 400 - {'code': 20012, 'message': 'Model does not exist. Please check it carefully.', 'data': None}...
💬 1[Last reply:8 months ago] 错误信息显示您在使用硅基流动(SiliconFlow)作为翻译渠道时,指定的模型不存在(Model does not exist)。核心原因: 您在软件中配置的硅基流动模型名称不正确,或者该模型在硅基流动平台上已不可用。解决方案:检查并更新模型名称:打开 pyVideoTrans,进入菜单栏的 工具/选项 -> 翻译设置。在“翻译渠道”中选择“硅基流动”。查看“模型”输入框中的内容。常见的、...119.122.**0 Posted at: 8 months ago -
#1957 (venv) D:\python\f5ttsnew>f5-tts_infer-gradioTraceback (most recent call last): File "D:\python\f5ttsnew\venv\lib\si......
💬 1[Last reply:8 months ago] 您的问题与 pyVideoTrans 无关,这是您在独立部署 F5-TTS 语音合成模型时遇到的 torchaudio 库加载失败错误。核心原因是 torchaudio 库文件损坏或与当前 PyTorch 版本不兼容。请按以下步骤解决:卸载并重新安装匹配的 torchaudio 和 torch:在您的虚拟环境 (venv) 中,执行以下命令:pip uninstall torch torchaud...45.146.**7 Posted at: 8 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.