-
#4303 日文语音转录用哪个模型,怎么样在选项界面设置,能使字幕字数最多...
💬 1[Last reply:4 months ago] 日文语音转录推荐使用 HuggingFace_ASR 渠道,选择针对日语优化的模型。要让生成的每一条字幕包含更多文字(减少断句),需要调整语音活动检测(VAD)相关参数。推荐模型免费本地模型:HuggingFace_ASR → 选择 kotoba-whisper(专为日语设计的 Whisper 微调模型)或 reazon-research/japanese-wav2vec2-large-rs35k...38.244**9 Posted at: 4 months ago -
#4302 无法连接当前api...
💬 1[Last reply:4 months ago] 无法连接API通常由网络问题、代理未设置或API密钥/地址配置错误引起。检查网络代理:如果你在中国大陆使用海外服务(Google、OpenAI、Gemini等),需要配置代理。在主界面“网络代理地址”填入 http://127.0.0.1:xxxx(xxxx为代理端口),留空默认直连。确认API地址和密钥:前往菜单栏对应的设置面板(如翻译设置、TTS设置),检查 Base URL 是否完整(例如 ...67.209**2 Posted at: 4 months ago -
#4301 TaskCfgSTT(is_cuda=True, uuid='5a504ecb90', cache_folder='D:/win-pyvideotrans-v3.99-420/tmp/11380/5a504ecb90', target_dir='D:/win-pyvideotrans-v3.99-420/output/recogn', source_lang...
💬 1[Last reply:4 months ago] Faster-Whisper-XXL 作为外部独立程序,在 PyInstaller 打包的 .exe 中运行时会因环境隔离、依赖缺失等原因无法正常调用。该渠道仅支持在源码部署下使用,或将其作为独立工具先转录出字幕再导入。解决方案(二选一)改用源码部署运行 pyVideoTrans按照官方文档 Mac/Linux 或 Windows 源码部署(需自行查阅)执行 uv sync 并启动 uv run ...38.135**4 Posted at: 4 months ago -
#4300 如何验证cuda和cuDNN是否已安装成功?...
💬 1[Last reply:4 months ago] 在 Windows 上验证 CUDA 和 cuDNN 是否成功安装,请打开命令提示符 (CMD) 并执行以下命令:检查 CUDA 版本 输入 nvcc -V,如果能显示比如 release 12.8 之类的版本信息,说明 CUDA 工具包已正确安装并可被系统找到。若提示“不是内部或外部命令”,则需确认 CUDA 的 bin 目录是否添加到了系统环境变量 PATH 中(通常为 C:\Program...2409**f62e Posted at: 4 months ago -
#4299 urllib.error.URLError: <urlopen error Tunnel connection failed: 404 Not Found>...
💬 1[Last reply:4 months ago] 这是因网络代理配置错误导致的模型下载失败。软件通过代理连接时收到 404 响应,说明代理地址无效或代理服务未启动。解决方法:在主界面找到“网络代理地址”输入框。如果确实不需要代理,请清空该项(留空即可)。若必须使用代理,请确认代理服务已运行,且地址格式正确(如 http://127.0.0.1:10809),端口号需与你的代理客户端一致。修改后重新开始任务。请查阅相关文档:网络代理地址...188.253**2 Posted at: 4 months ago -
#4297 一直卡在分离人声...
💬 5[Last reply:4 months ago] 根据您的操作系统选择部署方式:Windows 重新部署下载完整包:从官网下载最新的 .7z 完整包(不要只下载补丁包)。解压到纯英文路径:例如 D:\pyVideoTrans,路径中不能包含中文、空格或特殊符号,也不要解压到 C:\Program Files 等需要管理员权限的目录。启动:进入解压目录,双击 sp.exe 即可。首次启动需等待几十秒加载模块。清理旧配置(可选):如果想彻底干净重装,...67.209**2 Posted at: 4 months ago -
#4296 TaskCfgTTS(is_cuda=True, uuid='6dd97c8122', cache_folder='C:/Users/rudra/Downloads/win-pyvideotrans-v3.99-420/tmp/66440/6dd97c8122', target_dir='C:/Users/rudra/Downloads/win-pyvide...
💬 1[Last reply:4 months ago] This error occurs when Edge-TTS fails to synthesize audio, usually due to rate limiting or incorrect parameters (e.g., unsupported voice/language combination). The Microsoft service may temporarily bl...103.37**3 Posted at: 4 months ago -
#4295 必须选择视频文件=system:Windows-10-10.0.26100-SP0version:v3.99frozen:Truelanguage:zhroot_dir:E:/软件下载/tss/win-pyvideotrans-v3.99-......
💬 1[Last reply:4 months ago] 这是由于所选文件路径可能包含特殊符号,或文件路径/名称过长触发了系统限制,导致软件未能正确识别为有效的视频文件输入。请按以下步骤排查:检查文件命名:确保视频文件名和存放路径中不含中文、表情符、空格或其他特殊符号(如 ?, *, @ 等)。缩短文件路径:Windows 系统对命令行长度有限制(通常约 200 字符)。请将视频文件移动到一个路径较浅的文件夹(例如 D:\videos),并将其重命名为简...2a09**e2 Posted at: 4 months ago -
#4294 RuntimeError: 7f399ef109 split no voice error:while opening encoder - maybe incorrect parameters such as bit_rate, rate, width or height. sending frames to consumers: Generic error...
💬 1[Last reply:4 months ago] 这是由于 ffmpeg 编码器参数错误导致,通常与硬件编码兼容性问题有关。请尝试以下步骤:在菜单栏 工具/选项 -> 高级选项 -> 视频输出控制 中,勾选 强制软编码视频。这会让 ffmpeg 改用 CPU 软编码,避免硬件编码器参数不匹配,兼容性更好。确认原始视频的分辨率(宽、高)均为偶数,若为奇数,可用其他工具转换后再处理,否则编码器可能无法打开。尝试暂时不嵌入硬字幕,只生成配音...240e**6ee1 Posted at: 4 months ago -
#4293 videotrans.util.help_ffmpeg._FFprobeInternalError: [mov,mp4,m4a,3gp,3g2,mj2 @ 0000023d4f9775c0] moov atom not found D:/win-pyvideotrans-v3.99-420/tmp/8844/aadb998457/novoice.mp4: I...
💬 1[Last reply:4 months ago] 无声视频文件 novoice.mp4 损坏或不完整,导致 ffprobe 无法解析其时长(moov atom 缺失)。这通常是因为中间文件写入异常,可能由磁盘空间不足、临时文件夹路径过长或包含特殊符号、或处理过程意外中断引起。解决步骤:关闭软件,手动删除安装目录下的 tmp 文件夹内所有内容(或仅删除出错视频对应的 D:/win-pyvideotrans-v3.99-420/tmp/8844 目录...240e**6ee1 Posted at: 4 months ago -
#4291 能否支持8K视频,265编码操作...
💬 1[Last reply:4 months ago] pyVideoTrans 支持 265 编码,您可以在 菜单-工具-高级选项-264/265编码 中选择 265。该软件通过调用 FFmpeg 进行编解码,理论上支持 8K 分辨率,但实际处理性能受限于您的硬件配置(尤其是 CPU/GPU 与内存)。8K 视频处理将消耗大量计算资源和时间,且可能因路径过长或临时文件过大导致失败。建议先将 8K 视频转换为更易处理的中间格式,或确保系统有足够的磁盘空...2602**888 Posted at: 4 months ago -
#4290 TaskCfgVTT(is_cuda=True, uuid='51deecdac8', cache_folder='D:/pyvideotrans/tmp/1124/51deecdac8', target_dir='C:/Users/ab291/Desktop/test/_video_out/0420-mp4', source_language='日语', ...
💬 1[Last reply:4 months ago] 这是启用 CUDA 加速后,由于 CUDA 运行库版本与显卡驱动不兼容,或显卡架构过旧,导致 cuBLAS 运算失败引发的错误,常见于 50 系新显卡或未正确安装 CUDA 12.8 的环境。如果无法通过更新驱动解决,可在软件主界面取消勾选“CUDA 加速”,改用 CPU 处理(速度会变慢)。更新显卡驱动,访问 NVIDIA 官网下载并安装最新驱动。安装软件内置支持的 CUDA 12.8,并下载对...223.104**2 Posted at: 4 months ago -
#4289 请问下软件支持对原视频中的字幕擦除吗...
💬 1[Last reply:4 months ago] 不支持。pyVideoTrans 是一款通过分析音频轨道进行翻译与配音的工具,不具备图像处理或视频画面编辑能力,无法擦除视频画面中已存在的硬字幕。如果你需要提取或处理视频画面中的硬字幕,可以使用基于视觉大模型的独立工具。可以参考:请查阅相关文档:GVS 硬字幕AI提取...122.118**5 Posted at: 4 months ago -
#4288 No available channel for model gpt-4o-transcribe under group openai_azure (distributor) (request id: 2026042604245472124631518udNsAn)...
💬 1[Last reply:4 months ago] 该错误表示在 Azure OpenAI 渠道下找不到模型 gpt-4o-transcribe,通常是因为填写的模型名称不对,或 Azure 账号下未部署支持语音转写的模型。请先进行以下排查:登录 Azure OpenAI Studio,确认已部署一个支持语音识别的模型(如 gpt-4o-realtime-preview 或 whisper 系列),部署时的“部署名”才是软件中应填写的 模型名称。检...221.216**9 Posted at: 4 months ago -
#4287 将rubberband作为环境变量加入...
💬 1[Last reply:4 months ago] rubberband 是用于音频时间伸缩的处理库,pyVideoTrans 在进行视频翻译的“配音加速”或“视频慢速”等音画对齐操作时可能会自动调用它。若程序提示找不到 rubberband,通常需要将其可执行文件的路径添加至系统 PATH 环境变量中。以下是各平台添加环境变量的通用方法:Windows(假设 rubberband 可执行文件位于 D:\rubberband\bin):按 Win ...2409**f62e Posted at: 4 months ago -
#4286 TaskCfgVTT(is_cuda=True, uuid='1d257c6b51', cache_folder='D:/win-pyvideotrans-v3.99-420/tmp/2100/1d257c6b51', target_dir='F:/Youtube/Tubedown Download/2026-04-26/PolyPaint/_video_o...
💬 1[Last reply:4 months ago] 这是由于磁盘空间不足导致的,处理视频过程中产生的临时文件占满了硬盘。手动清理临时文件:打开文件管理器,进入软件安装目录(如 D:/win-pyvideotrans-v3.99-420/),找到并删除 tmp 文件夹。正常关闭软件时会自动清理这些缓存。检查磁盘剩余空间:确保视频输出目录(F:/Youtube/Tubedown Download/...)以及软件所在盘符(D:)有足够的可用空间,建议预...2409**f62e Posted at: 4 months ago -
#4284 使用qwen3-tts-flash-2025-11-27,模型监控中限流错误很多,怎么设置...
💬 3[Last reply:4 months ago] 120RPM限制意味着每分钟最多120次请求,即每秒2次。若配音请求本身的处理时间很短,即使开单线程也可能瞬间连续发送导致超限。按以下方案调整:打开 菜单 → 工具/选项 → 高级选项,在【字幕配音调整】区域:并发配音线程数:设为 1。配音后暂停秒:建议先设为 1 秒(每秒至多1次请求,远低于2次)。若仍有少量限流,可逐步提高到 2-3 秒;若运行一段时间完全稳定,可尝试降至 0.5 秒,但需观察...240e**fbaa Posted at: 4 months ago -
#4285 不存在参考音频 L:/video Lingo/f5-tts/参考音频...
💬 1[Last reply:4 months ago] 这是因为参考音频文件未放置在软件要求的目录下,或路径填写不正确。F5-TTS 等渠道要求参考音频必须放在软件安装目录的 f5-tts 文件夹内,软件只会从这个文件夹读取音频文件。解决方案:将你需要用作参考的音频文件(如 .wav 或 .mp3)复制到软件根目录下的 f5-tts 文件夹中。如果该文件夹不存在,请手动创建。打开软件,进入 菜单 → TTS设置 → F5-TTS,在参考音频选择列表中找...111.78**8 Posted at: 4 months ago -
#4282 TaskCfgSTT(is_cuda=True, uuid='3ef002e9fb', cache_folder='D:/win-pyvideotrans-v3.95/tmp/26756/3ef002e9fb', target_dir='D:/win-pyvideotrans-v3.95/output/recogn', source_language=Non...
💬 1[Last reply:4 months ago] 该错误因 openai-whisper 依赖的 numba/llvmlite 库与当前打包环境不兼容导致,常见于预打包版对特定 CPU 或 CUDA 组合的兼容性问题。官方库内的语音识别推荐使用 faster-whisper(本地) 渠道,其稳定性与速度更优。 解决方案(按顺序尝试):更换语音识别渠道:在主界面将“语音识别”下拉框改为 faster-whisper(本地),并选择相同模型(如 l...36.142**1 Posted at: 4 months ago -
#4281 不存在参考音频 D:/BaiduNetdiskDownload/f5-tts/ھەيز مىقدارىغا سەل قارىماڭ ھەيز مىقدارىڭىز ئاز بولسا باشقىلارغا قارىغاندا تېز قېرىپ كېتىشىڭىز مۇمكىن ....
💬 1[Last reply:4 months ago] 这是因为 F5-TTS 等配音渠道要求参考音频必须放置在软件安装目录下的 f5-tts 文件夹内,而你指定的路径 D:/BaiduNetdiskDownload/f5-tts/... 无法被软件正确识别(该路径不存在或不在软件根目录下)。另外,参考音频文件名包含维吾尔/阿拉伯语字符,在 Windows 上极易因编码问题导致读取失败。解决方案:将你的参考音频文件复制到软件根目录下的 f5-tts 文...2409**3443 Posted at: 4 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.