-
#4084 Advanced Drums - 4.mp4没有识别出字幕,请检查是否包含人类说话声音,以及说话语言是否和你选择的原始语言匹配...
💬 1[Last reply:4 months ago] 视频“Advanced Drums - 4.mp4”未能识别出字幕,通常由以下原因导致:视频确实不含有效人声:视频内容可能仅为鼓点或纯音乐,不含人类语音。背景噪音过大:如果视频环境非常嘈杂(如街道、演唱会),人声被掩盖,模型可能无法识别到有效的语音。语言选择错误:您选择的“原始语言”与视频中人物实际所说的语言不匹配。解决方案:确认视频内容:请使用播放器打开该视频,确认其中是否包含清晰可辨的人类说话...182.100.**8 Posted at: 4 months ago -
#4083 omnivoice配音音画不同步,而且会漏配...
💬 1[Last reply:4 months ago] OmniVoice-TTS 配音出现音画不同步和漏配问题,通常是由于配音音频时长与原视频片段时长不匹配,以及配音请求失败或超时导致的。解决方案:强制音画同步:在主界面,勾选 配音加速 和 视频慢速 选项,软件会自动调整音频速度或视频播放速度以强制对齐。启用二次识别:如果嵌入了单字幕,请务必勾选 二次识别。这会在配音完成后,对生成的配音音频重新进行语音识别,生成时间轴精准匹配的字幕,确保字幕与配音精...182.107.**6 Posted at: 4 months ago -
#4082 配音不根据我提供的字幕配,导致成品视频配音混乱。并不是根据之前的缓存字幕配的,是部分配音正确,部分配音错误。...
💬 3[Last reply:4 months ago] 是的,根本原因极大概率是剪映的语音识别错误,而非 pyVideoTrans 的配音错误。核心原因分析:验证方法正确:你检查了 pyVideoTrans 输出文件夹中的 .srt 字幕文件,内容是正确的。这直接证明了 pyVideoTrans 的翻译和字幕生成环节工作正常。问题转移:当你在剪映中再次进行“字幕识别”时,剪映是在对你导入的最终视频的音频轨道进行独立的语音识别。如果剪映识别出的字幕是错的...2408:**:c896 Posted at: 4 months ago -
#4081 TaskCfgSTT(is_cuda=True, uuid='4505dc1d94', cache_folder='C:/SOFT/pyvideotrans/tmp/46596/4505dc1d94', target_dir='c:/soft/pyvideotrans/output/recogn', source_language=None, source_...
💬 3[Last reply:4 months ago] 这是由于 FunASR 模型在软件内部的注册路径与您实际存放的路径不匹配导致的。错误 AssertionError: FunASRNano is not registered 表明软件在内部注册表中找不到名为 "FunASRNano" 的模型条目,即使文件已存在。解决方案:检查模型文件夹命名规则:软件从 HuggingFace 下载模型时,会遵循特定的文件夹命名规则。对于 FunASR 模型,正确...14.212.**1 Posted at: 4 months ago -
#4080 配音不根据我提供的字幕配...
💬 19[Last reply:4 months ago] 是的,v3.98 版本内置了 DeepSeek 翻译渠道的试用配置。您可以直接使用,但请注意:试用额度有限:内置的 API Key 是公用的,有并发和额度限制,可能很快用完或被他人用尽导致失败。效果可能不稳定:由于是公共密钥,请求过多时可能被限流或返回错误。最佳实践:尽快注册您自己的 DeepSeek 账户,获取个人专属的 API Key。在软件中,点击 菜单 -> 翻译设置 -> D...95.85.**9 Posted at: 4 months ago -
#4078 Voxcmptts配音出现重复音...
💬 17[Last reply:4 months ago] 这是由于软件内部渠道配置错误或缓存导致的。渠道代码“20”在软件内部被硬编码为 F5-TTS,即使您界面上选择了 VoxCPM-TTS,软件仍错误地调用了 F5-TTS 的逻辑。解决方案:清理软件配置缓存:完全关闭 pyVideoTrans。删除软件安装目录下的 config.json 文件(如果存在)。重新启动 pyVideoTrans,软件会生成新的默认配置。重新配置 VoxCPM-TTS:启...182.107.**6 Posted at: 4 months ago -
#4079 Advanced Drums - 4. Percussion Loops.ts没有识别出字幕,请检查是否包含人类说话声音,以及说话语言是否和你选择的原始语言匹配...
💬 1[Last reply:4 months ago] 该视频文件“Advanced Drums - 4. Percussion Loops.ts”未被识别出字幕,提示需要检查是否包含人声以及语言选择是否正确。核心原因:该文件很可能是一个纯音乐/打击乐循环视频,不包含人类说话声音。软件的核心功能是识别语音并转为文字,如果音频中只有乐器声、节奏声而无清晰人声,语音识别模型将无法提取有效文字。解决方案:确认视频内容:请先使用播放器打开该视频,确认其中是否真...182.100.**8 Posted at: 4 months ago -
#4077 TaskCfgSTT(is_cuda=False, uuid='5c87c4068e', cache_folder='D:/win-pyvideotrans-v3.99/tmp/6748/5c87c4068e', target_dir='D:/win-pyvideotrans-v3.99/output/recogn', source_language=Non...
💬 1[Last reply:4 months ago] 这是由于内存或显存不足导致阿里FunASR本地模型(paraformer-zh)在语音识别阶段进程崩溃。解决方案:降低资源消耗:在“菜单-工具-高级选项-语音识别参数”中,尝试将“最长语音持续秒数”调小(例如设为3-5秒),以减少单次处理的数据量。检查并关闭其他占用内存/显存的程序,确保有足够资源供软件使用。更换模型:如果上述方法无效,建议改用对资源要求更低的语音识别渠道。对于中文视频,可以尝试:...39.188.**5 Posted at: 4 months ago -
#4076 FileNotFoundError: [Errno 2] No such file or directory: 'C:/Users/Administrator/AppData/Local/Temp/360zip$Temp/360$0/win-videotrans-v3.84/videotrans/cfg.json'...
💬 1[Last reply:4 months ago] This error occurs because you are trying to run the software directly from within the compressed archive (e.g., a .7z or .zip file), which is not allowed.The error message indicates that the program i...2408:**:dcbb Posted at: 4 months ago -
#4075 Getting available roles, please wait and re-select....
💬 1[Last reply:4 months ago] This error occurs because the software is being run directly from within a compressed archive (e.g., a .zip or .7z file) or a temporary directory, which prevents it from accessing and saving necessary...2408:**:dcbb Posted at: 4 months ago -
#4074 requests.exceptions.ProxyError: HTTPSConnectionPool(host='translate.google.com', port=443): Max retries exceeded with url: /m?sl=zh-cn&tl=vi&hl=vi&q=%E8%BF%99%E6%AC%BE%E6%89%8B%E6%...
💬 1[Last reply:4 months ago] 这是由于网络代理设置不正确或代理服务未运行导致的。软件尝试通过代理连接 Google 翻译服务,但代理服务器拒绝了连接。解决方案:检查您的代理客户端(如 VPN、Clash 等)是否正在运行,并确认其本地监听端口号。在主界面的“网络代理地址”文本框中,填入正确的代理地址,格式应为 http://127.0.0.1:端口号(例如 http://127.0.0.1:10808)。如果您没有可用的代理服...116.16.**8 Posted at: 4 months ago -
#4073 TaskCfgSTT(is_cuda=True, uuid='cbf28bc586', cache_folder='E:/ytrans/tmp/10640/cbf28bc586', target_dir='E:/ytrans/output/recogn', source_language=None, source_language_code=None, so...
💬 1[Last reply:4 months ago] The error KeyError: 'sentence_info' occurs when using the FunASR (local) speech recognition channel. This is typically caused by an issue with the model's output format or a mismatch between...202.150.**3 Posted at: 4 months ago -
#4072 软件3.98版本可以多角色跨语种克隆吗?...
💬 6[Last reply:4 months ago] 克隆 本身就是使用原语音的音色进行配音,是否能够跨语种要视所选配音渠道,qwen-tts(本地)支持中英跨语种,index-tts也支持中英,其他渠道一般都是固定一种...95.85.**9 Posted at: 4 months ago -
#4071 TaskCfgVTT(is_cuda=True, uuid='2bd78abc16', cache_folder='D:/win-pyvideotrans-v3.98-329/tmp/28944/2bd78abc16', target_dir='/ymnas/跨境/tk视频/丰唇膏/已剪/无字幕/西班牙语/0414-1-1-mp4', source_lang...
💬 1[Last reply:4 months ago] 这是由于显存或内存不足导致的语音识别进程崩溃。解决方案:检查并调整 GPU 设置:确认已正确安装 CUDA 12.8 和 cuDNN 9.x。在软件主界面右上角,取消勾选“二次识别”。同时处理多个视频时,二次识别会占用大量显存。在 菜单 -> 工具/选项 -> 高级选项 中,将 GPU同时任务数[重启生效] 设为 1,然后重启软件。降低模型和参数以节省资源:将语音识别模型从 base ...91.199.**9 Posted at: 4 months ago -
#4070 This usually indicates a problem with the package or the build environment. Press any key to continue . . ....
💬 1[Last reply:4 months ago] 这是由于软件安装路径包含中文字符或特殊符号,导致依赖包无法正确加载。解决方案:将软件解压到非系统盘的纯英文路径下,例如 D:\pyVideoTrans。确保路径中不包含中文、空格或特殊符号。重新双击 sp.exe 运行。请查阅相关文档:常见错误与解决方法...218.8.**3 Posted at: 4 months ago -
#4068 TaskCfgSTT(is_cuda=True, uuid='437f3ba732', cache_folder='D:/Software/pyvideotrans/tmp/50340/437f3ba732', target_dir='D:/Software/pyvideotrans/output/recogn', source_language=None,...
💬 1[Last reply:4 months ago] 这是由于显存或内存不足导致的。使用 faster-whisper(本地) 的 large-v3 模型进行语音识别时,该模型需要较大的显存(建议10GB以上)或内存(建议16GB以上)。错误信息显示进程池被意外终止,这是资源耗尽的典型表现。解决方案:使用更小的模型:在主界面的语音识别渠道右侧,将模型从 large-v3 更换为 medium、small 或 base。large-v3 模型对硬件要求...146.19.**6 Posted at: 4 months ago -
#4067 TaskCfgSTT(is_cuda=True, uuid='015483d275', cache_folder='E:/ytrans/tmp/3636/015483d275', target_dir='E:/ytrans/output/recogn', source_language=None, source_language_code=None, sou...
💬 1[Last reply:4 months ago] This error is caused by insufficient GPU memory (VRAM) when using the faster-whisper model with CUDA acceleration.Solutions:Disable "Secondary Recognition": If you have "Secondary Recognition" enabled...202.150.**3 Posted at: 4 months ago -
#4066 TaskCfgVTT(is_cuda=True, uuid='70961f1ce3', cache_folder='D:/pyvideotrans/tmp/18196/70961f1ce3', target_dir='C:/Users/Administrator/Downloads/_video_out/Kids Realise They Accidenta...
💬 1[Last reply:4 months ago] 这是由于显存或内存不足导致的。错误信息明确指出“可能内存或显存不足 [GPU0]”,并且使用了 large-v3-turbo 模型,该模型对显存要求较高。解决方案如下:使用更小的模型:在语音识别渠道的下拉菜单中,将模型从 large-v3-turbo 更换为 medium、small 或 base。large-v3 系列模型最低需要约 10GB 显存。调整高级设置以降低显存占用:点击 菜单 -&g...114.249.**8 Posted at: 4 months ago -
#4065 TaskCfgVTT(is_cuda=True, uuid='3d958ad971', cache_folder='D:/pyvideotrans/tmp/6324/3d958ad971', target_dir='C:/Users/Administrator/Downloads/_video_out/Kids Realise They Accidental...
💬 1[Last reply:4 months ago] 这是由于显存或内存不足导致语音识别进程崩溃。从日志可见,你使用了 faster-whisper(本地) 的 large-v3-turbo 模型,并启用了 CUDA 加速 (is_cuda=True),但进程池被意外终止,提示可能内存或显存不足。解决方案:降低模型大小:在语音识别下拉菜单中,将模型从 large-v3-turbo 更换为更小的模型,例如 medium 或 small。large-v3...206.237.**6 Posted at: 4 months ago -
#4064 piper-tts的国内下载地址...
💬 1[Last reply:4 months ago] Piper-TTS 的模型文件需要从 GitHub 或 HuggingFace 下载,国内访问可能不稳定。你可以尝试以下方法获取模型:手动下载模型文件:访问 Piper-TTS 的 GitHub 仓库发布页:https://github.com/rhasspy/piper/releases找到并下载名为 piper_voice-en-gb-alan-low.tar.gz 或你所需语言/音色的 .t...182.107.**6 Posted at: 4 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.