-
#6092 VAD选tenvad还是silero?...
💬 1[Last reply:29 days ago] VAD 的选择取决于你的场景:推荐优先使用 Silero-VAD,它基于深度学习,对语音边界的判断更精准,尤其适合背景噪声较大或需要高质量的语音识别场景。如果你对处理速度要求极高且硬件资源有限(如纯 CPU 环境),可尝试 WebRTC VAD(你提到的“tenvad”可能是指 WebRTC VAD),它更快但精度略低。 两种 VAD 均可在「菜单→工具→高级选项→语音识别参数」中切换,建议先使...210.79.**6 Posted at: 29 days ago -
#6091 生成出来的字幕文件,时间轴错乱(比如 字幕生成到00:13:29后,又突然跳到 00:00:00),这是什么 原因?...
💬 1[Last reply:29 days ago] 这种时间轴跳跃通常是原始视频的音频流存在多轨或异常导致的,例如视频包含多个音频轨道、合并片段时的时间戳不连续,或语音识别(VAD)在切片时遇到了非标准音频格式,导致生成的字幕时间戳被重置。请先确认以下 3 点:检查视频音频流:用播放器或 ffprobe 查看视频是否含有多个音频轨道,只保留一个主音轨。关闭“清理已生成”:如果之前生成过缓存,建议勾选主界面的“清理已生成”重新处理,避免旧的错误缓存干...220.203.**4 Posted at: 29 days ago -
#6090 The supported API model names are deepseek-v4-pro or deepseek-v4-flash, but you passed deepseek-chat.https://api.deepsee......
💬 1[Last reply:29 days ago] 错误原因:你在 DeepSeek 翻译渠道配置中使用了旧的模型名称 deepseek-chat,而当前软件支持的 DeepSeek 模型为 deepseek-v4-pro 或 deepseek-v4-flash。解决方法:打开软件,点击顶部菜单 翻译设置 → 选择 DeepSeek 渠道。在模型名称(Model)输入框中,将 deepseek-chat 改为 deepseek-v4-pro 或 d...210.79.**6 Posted at: 29 days ago -
#6089 下载仓库里的Distil-Large-V3.5-CT2有很多文件,怎么直接下载到一个文件夹下?...
💬 1[Last reply:29 days ago] 这是 Distil-Large-V3.5-CT2 模型(用于 faster-whisper 语音识别),需要手动下载到 软件目录/models/models--distil-whisper--distil-large-v3.5-ct2/ 文件夹。请按照以下步骤操作:打开 Hugging Face 仓库页面:https://huggingface.co/distil-whisper/distil-l...210.79.**6 Posted at: 29 days ago -
#6088 如果要卸载软件,重新安装新版本,如何保留原来的设置?只能重新一个一个设置吗?...
💬 1[Last reply:29 days ago] 解决方案只需备份并恢复配置文件即可保留所有设置,无需重新逐个配置。操作步骤:备份配置文件: 在卸载旧版本前,找到软件安装目录下的 videotrans/ 文件夹,复制 以下两个核心 JSON 文件到安全位置(如桌面):params.json(保存 API 密钥、偏好设置等)cfg.json(保存高级选项等)卸载旧版本(直接删除整个软件目录即可,无注册表残留)。安装新版本: 下载完整包并解压到同...210.79.**6 Posted at: 29 days ago -
#6086 Distil-Large-V3.5-CT2 和Distil-Large-V3哪个好用?...
💬 1[Last reply:29 days ago] Distil-Large-V3.5-CT2 是较新的蒸馏模型,体积更小、速度更快,且质量通常优于 Distil-Large-V3。如果你追求速度与准确度的平衡,优先选择 Distil-Large-V3.5-CT2。两者均只支持英语发音视频。...210.79.**6 Posted at: 29 days ago -
#6085 语音识别阶段出错[faster-whisper(本地内置)] Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: t......
💬 1[Last reply:29 days ago] 这是由于升级到 v4.05/v4.06 后,transformers 库版本与旧代码残留文件冲突导致的 tensorflow_text 后端映射错误。解决方案:关闭软件。前往官方下载页面,获取当前最新版本的完整包(约 2.6GB,非补丁包),全量解压到一个新的目录(例如 D:\pyVideoTrans)。如果你之前已有配置文件(videotrans/params.json 等),可将其复制到新目录...210.79.**6 Posted at: 29 days ago -
#6083 HuggingFace_ASR 语音识别渠道支持AMD显卡加速吗...
💬 3[Last reply:29 days ago] 根据核心知识库,目前唯一支持 AMD 显卡加速的语音识别渠道是 Whisper.net。需要满足以下条件:仅支持 Windows 平台。安装额外依赖:执行 uv sync --extra dotnet 安装 pythonnet>=3.0.1。使用 Vulkan 后端进行加速。需下载 .bin 格式的 ggml 模型文件,存放到 models/ 目录下。此渠道不支持 VAD 预分割和热词功能;...240e:**:6988 Posted at: 29 days ago -
#6082 语音识别阶段出错[阿里FunASR(本地内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:29 days ago] 阿里FunASR(本地内置) 渠道仍完全支持。当前报错是因为模型文件自动下载时连接阿里魔塔仓库失败。请手动下载 FunASR 模型文件,解压后放到软件目录的 models/ 下:下载地址:https://modelscope.cn/models/himyworld/videotrans/resolve/master/funasr.zip将 funasr.zip 解压,得到 funasr 文件夹将该...2607:**:5a09 Posted at: 29 days ago -
#6081 [Clone-Voice] 该渠道需另行部署并启动后可用self.api_url='http://127.0.0.1:9988'...
💬 1[Last reply:29 days ago] ...223.109.**1 Posted at: 29 days ago -
#6079 No CUDA detected. Check NVIDIA GPU/Drivers. See Help -> CUDA....
💬 1[Last reply:29 days ago] The error "No CUDA detected" means the software cannot find a usable CUDA environment. This typically occurs due to one of the following reasons:No NVIDIA GPU – CUDA acceleration requires an NVIDIA gr...102.64.**5 Posted at: 29 days ago -
#6078 使用转录并翻译字幕功能(无配音)时,生成出的中英字幕与原始视频声音画面不同步,差别太远,是怎么回事?...
💬 1[Last reply:29 days ago] 使用"转录并翻译字幕"(无配音)时,字幕与画面不同步的根本原因是语音识别(ASR)阶段生成的时间轴不精确。由于不涉及配音时长变化,同步问题完全由ASR的VAD切分和模型准确性决定。常见原因和解决方案:VAD切割参数不当:导致字幕的开始/结束时间偏离实际说话时间。进入 菜单 → 工具 → 高级选项 → 语音识别参数检查「最长语音持续秒数」(建议 8-15)和「最短语音持续毫秒」(建议 200-500...220.203.**4 Posted at: 29 days ago -
#6077 翻译字幕阶段出错 [DeepSeek] 请求参数不正确:Error code: 400 - {'error': {'message': 'The supported API model names are deepseek-v4-pro or deepseek-v4-flash, but you passed deepseek-chat.', 'type':...
💬 1[Last reply:29 days ago] 核心原因是 DeepSeek 更新的模型命名规则:你当前使用的 deepseek-chat 已被废弃,必须改为官方要求的 deepseek-v4-pro 或 deepseek-v4-flash。解决方法点击软件顶部菜单 翻译设置 → 选择 DeepSeek 渠道页面。在“模型”输入框中将 deepseek-chat 手动修改为 deepseek-v4-pro(推荐)或 deepseek-v4-fl...117.182.**1 Posted at: 29 days ago -
#6076 Response ended prematurely:{'text': '你好啊我的朋友', 'role': 'cosy.wav', 'filename': 'H:/pyvideotrans/tmp/31272/1784953427.555445-gptsovits.wav', 'tts_type': 12}...
💬 1[Last reply:1 month ago] 根据报错,Response ended prematurely 表明软件向 CosyVoice API 发送请求时,服务端在返回数据过程中连接中断,通常由以下原因导致:CosyVoice 服务未正常启动或已崩溃:请检查你是否已自行部署并运行了 CosyVoice 的 WebUI 或 API 服务。该错误常见于服务未完全加载便退出,或处理请求时内部出错。API 地址配置错误:在 菜单 → TTS 设...240e:**:6988 Posted at: 1 month ago -
#6075 4,07 omnivoice速度慢...
💬 1[Last reply:1 month ago] OmniVoice-TTS 是本地内置模型,速度慢通常由以下原因导致:未启用 GPU 加速:本地 TTS 模型极依赖 NVIDIA 显卡。请确保已勾选主界面的「CUDA加速」并正确安装 CUDA 12.8+ 与 cuDNN 9.11+。模型体积较大:OmniVoice 模型默认下载的可能是完整版,首次运行或显存不足时会退化为 CPU 处理。可尝试在高级选项中降低模型精度(如 float16)。并发...104.28.**1 Posted at: 1 month ago -
#6074 在软件根目录下的 videotrans/ 文件夹中新建一个纯文本文件命名为 newlang.txt 无效...
💬 3[Last reply:1 month ago] 新增目标语言需要修改源代码中的语言配置,并非简单的文本文件。请按照以下步骤操作:打开 videotrans/language/ 文件夹,找到对应的语言JSON文件(如 zh.json 或 en.json),在 language_data 中添加新的语言代码和显示名称。打开 videotrans/configure/contants.py,在 language_code_list 列表中追加该语言代...104.28.**1 Posted at: 1 month ago -
#6073 uv syncResolved 426 packages in 1.84s × Failed to build pynini==2.1.6 ├─▶ The build backend returned an error ╰─▶ Cal......
💬 9[Last reply:1 month ago] 该错误是因为缺少 openfst 库导致的,与软件核心功能无关。请按以下步骤解决:安装 openfst(macOS 使用 Homebrew):brew install openfst清理缓存并重新安装(避免使用旧的损坏缓存):uv cache clean uv sync如果仍失败,尝试禁用 pynini 依赖(pynini 并非 pyVideoTrans v4.05 必需,可能是多余依赖导致):打...104.28.**1 Posted at: 1 month ago -
#6072 {"detail":"Not Found"}self.api_url='http://127.0.0.1:9874/tts':{'text': '你好啊我的朋友', 'role': 'cosy.wav', 'filename': 'H:/p......
💬 1[Last reply:1 month ago] 您的错误 {"detail":"Not Found"} 说明 pyVideoTrans 向 http://127.0.0.1:9874/tts 发送请求时,该 URL 在本地的 TTS 服务中不存在。核心原因: 您使用的自部署 TTS 服务(很可能是 GPT-SoVITS)没有启动正确的 API 接口,或端口/路径填写错误。解决方案:确认 GPT-SoVI...240e:**:3d82 Posted at: 1 month ago -
#6071 Error code: 400 - {'error': {'message': 'The supported API model names are deepseek-v4-pro or deepseek-v4-flash, but you passed deepseek-chat.', 'type': 'invalid_request_error', 'p...
💬 1[Last reply:1 month ago] 这是由于你使用的 DeepSeek 模型名 deepseek-chat 已经过时,DeepSeek 官方已更换为新版模型名称。软件 v3.78 版本中的模型列表未及时更新,导致提交了错误的模型名。解决方法:推荐升级软件:下载最新版 v4.07(完整包或补丁包),新版已自动更新 DeepSeek 模型列表,无需手动修改。手动修改(若不升级):打开软件 菜单 → 翻译设置 → DeepSeek。将 模...2409:**:90b Posted at: 1 month ago -
#6070 所选模型不存在,请先下载模型到 D:/whispercpp/models 目录下Traceback (most recent call last):...
💬 1[Last reply:1 month ago] 这个问题是因为 Whisper.cpp 渠道所需的模型文件未找到。软件默认要求将 .bin 格式的 ggml 模型(如 ggml-tiny.bin)放在软件目录下的 models/ 文件夹内。但你的日志显示查找路径是 D:/whispercpp/models,说明你可能在高级选项中自定义了模型存放路径,而该目录下缺少模型文件。解决方案:检查模型存放路径 打开 菜单 → 工具 → 高级选项 → 语...240e:**:3d82 Posted at: 1 month ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.