-
#6096 :Traceback (most recent call last): File...
💬 1[Last reply:2 months ago] FailedOperation.UserNotRegistered 表明腾讯云翻译服务尚未开通。请按以下步骤操作:登录 腾讯云控制台,进入机器翻译产品页面。点击“开通服务”,按指引完成实名认证并开通 TMT(机器翻译)服务。回到 pyVideoTrans,在 菜单 → 翻译设置 → 腾讯翻译 中确认 SecretId 和 SecretKey 已正确填写,且余额充足。完成后重启翻译任务即可。...2408**5b1a Posted at: 2 months ago -
#6095 ('Connection aborted.', ConnectionResetError(10054, '远程主机强迫关闭了一个现有的连接。', None, 10054, None))[字节语音大模型极速版, Google(免费), Elevenlabs.io]Traceback (most recent call last):...
💬 1[Last reply:2 months ago] 这是由于网络连接被微软翻译服务强制中断导致的,通常是因为短时间内请求过于频繁触发了限流。打开 菜单 → 工具/选项 → 高级选项 → 字幕翻译调整。将 传统翻译渠道每批字幕行数 降低为 1-3。将 翻译后暂停秒 设置为 5-10 秒。如果还使用了多目标语言翻译,在高级选项中关闭多任务并行,设为串行。请查阅相关文档:Microsoft翻译使用说明...2408**5b1a Posted at: 2 months ago -
#6094 Expected parameter logits (Tensor of shape (1, 51866)) of distribution Categorical(logits: torch.Size([1, 51866])) to satisfy the constraint IndependentConstraint(Real(), 1), but f...
💬 1[Last reply:2 months ago] 这个报错是由于显存不足或模型/音频数据异常导致 openai-whisper 在推理时产生了 NaN 值(logits 全部为 NaN)。请按以下步骤依次排查:降低模型尺寸:当前使用 large-v3 需要至少 10GB 以上显存。请切换到 medium 或 small 模型,或改用 faster-whisper 渠道的 large-v3(更省显存)。关闭 GPU 加速测试:取消勾选 CUDA 加...240e**f888 Posted at: 2 months ago -
#6093 语音阈值和非语音阈值多少合适?...
💬 1[Last reply:2 months ago] 语音阈值控制VAD判定语音的灵敏性,推荐默认值 0.5。调低(如0.2)会更灵敏但易把噪音误判为语音,调高(如0.8)则相反。 非语音阈值控制对静音/噪音的判断,建议也默认 0.5,调低可减少文本“幻觉”但可能漏掉部分有效语音。 如果需要进一步细化,请根据实际转录结果微调:若识别出的字幕含有大量噪音文字,可适当提高语音阈值/降低非语音阈值;若字幕缺漏严重,则反向调整。 由于这两个数值高度依赖...210.79**6 Posted at: 2 months ago -
#6092 VAD选tenvad还是silero?...
💬 1[Last reply:2 months ago] VAD 的选择取决于你的场景:推荐优先使用 Silero-VAD,它基于深度学习,对语音边界的判断更精准,尤其适合背景噪声较大或需要高质量的语音识别场景。如果你对处理速度要求极高且硬件资源有限(如纯 CPU 环境),可尝试 WebRTC VAD(你提到的“tenvad”可能是指 WebRTC VAD),它更快但精度略低。 两种 VAD 均可在「菜单→工具→高级选项→语音识别参数」中切换,建议先使...210.79**6 Posted at: 2 months ago -
#6091 生成出来的字幕文件,时间轴错乱(比如 字幕生成到00:13:29后,又突然跳到 00:00:00),这是什么 原因?...
💬 1[Last reply:2 months ago] 这种时间轴跳跃通常是原始视频的音频流存在多轨或异常导致的,例如视频包含多个音频轨道、合并片段时的时间戳不连续,或语音识别(VAD)在切片时遇到了非标准音频格式,导致生成的字幕时间戳被重置。请先确认以下 3 点:检查视频音频流:用播放器或 ffprobe 查看视频是否含有多个音频轨道,只保留一个主音轨。关闭“清理已生成”:如果之前生成过缓存,建议勾选主界面的“清理已生成”重新处理,避免旧的错误缓存干...220.203**4 Posted at: 2 months ago -
#6090 The supported API model names are deepseek-v4-pro or deepseek-v4-flash, but you passed deepseek-chat.https://api.deepsee......
💬 1[Last reply:2 months ago] 错误原因:你在 DeepSeek 翻译渠道配置中使用了旧的模型名称 deepseek-chat,而当前软件支持的 DeepSeek 模型为 deepseek-v4-pro 或 deepseek-v4-flash。解决方法:打开软件,点击顶部菜单 翻译设置 → 选择 DeepSeek 渠道。在模型名称(Model)输入框中,将 deepseek-chat 改为 deepseek-v4-pro 或 d...210.79**6 Posted at: 2 months ago -
#6089 下载仓库里的Distil-Large-V3.5-CT2有很多文件,怎么直接下载到一个文件夹下?...
💬 1[Last reply:2 months ago] 这是 Distil-Large-V3.5-CT2 模型(用于 faster-whisper 语音识别),需要手动下载到 软件目录/models/models--distil-whisper--distil-large-v3.5-ct2/ 文件夹。请按照以下步骤操作:打开 Hugging Face 仓库页面:https://huggingface.co/distil-whisper/distil-l...210.79**6 Posted at: 2 months ago -
#6088 如果要卸载软件,重新安装新版本,如何保留原来的设置?只能重新一个一个设置吗?...
💬 1[Last reply:2 months ago] 解决方案只需备份并恢复配置文件即可保留所有设置,无需重新逐个配置。操作步骤:备份配置文件: 在卸载旧版本前,找到软件安装目录下的 videotrans/ 文件夹,复制 以下两个核心 JSON 文件到安全位置(如桌面):params.json(保存 API 密钥、偏好设置等)cfg.json(保存高级选项等)卸载旧版本(直接删除整个软件目录即可,无注册表残留)。安装新版本: 下载完整包并解压到同...210.79**6 Posted at: 2 months ago -
#6086 Distil-Large-V3.5-CT2 和Distil-Large-V3哪个好用?...
💬 1[Last reply:2 months ago] Distil-Large-V3.5-CT2 是较新的蒸馏模型,体积更小、速度更快,且质量通常优于 Distil-Large-V3。如果你追求速度与准确度的平衡,优先选择 Distil-Large-V3.5-CT2。两者均只支持英语发音视频。...210.79**6 Posted at: 2 months ago -
#6085 语音识别阶段出错[faster-whisper(本地内置)] Subprocess Error: Backend should be defined in the BACKENDS_MAPPING. Offending backend: t......
💬 1[Last reply:2 months ago] 这是由于升级到 v4.05/v4.06 后,transformers 库版本与旧代码残留文件冲突导致的 tensorflow_text 后端映射错误。解决方案:关闭软件。前往官方下载页面,获取当前最新版本的完整包(约 2.6GB,非补丁包),全量解压到一个新的目录(例如 D:\pyVideoTrans)。如果你之前已有配置文件(videotrans/params.json 等),可将其复制到新目录...210.79**6 Posted at: 2 months ago -
#6083 HuggingFace_ASR 语音识别渠道支持AMD显卡加速吗...
💬 3[Last reply:2 months ago] 根据核心知识库,目前唯一支持 AMD 显卡加速的语音识别渠道是 Whisper.net。需要满足以下条件:仅支持 Windows 平台。安装额外依赖:执行 uv sync --extra dotnet 安装 pythonnet>=3.0.1。使用 Vulkan 后端进行加速。需下载 .bin 格式的 ggml 模型文件,存放到 models/ 目录下。此渠道不支持 VAD 预分割和热词功能;...240e**6988 Posted at: 2 months ago -
#6082 语音识别阶段出错[阿里FunASR(本地内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:2 months ago] 阿里FunASR(本地内置) 渠道仍完全支持。当前报错是因为模型文件自动下载时连接阿里魔塔仓库失败。请手动下载 FunASR 模型文件,解压后放到软件目录的 models/ 下:下载地址:https://modelscope.cn/models/himyworld/videotrans/resolve/master/funasr.zip将 funasr.zip 解压,得到 funasr 文件夹将该...2607**5a09 Posted at: 2 months ago -
#6081 [Clone-Voice] 该渠道需另行部署并启动后可用self.api_url='http://127.0.0.1:9988'...
💬 1[Last reply:2 months ago] ...223.109**1 Posted at: 2 months ago -
#6079 No CUDA detected. Check NVIDIA GPU/Drivers. See Help -> CUDA....
💬 1[Last reply:2 months ago] The error "No CUDA detected" means the software cannot find a usable CUDA environment. This typically occurs due to one of the following reasons:No NVIDIA GPU – CUDA acceleration requires an NVIDIA gr...102.64**5 Posted at: 2 months ago -
#6078 使用转录并翻译字幕功能(无配音)时,生成出的中英字幕与原始视频声音画面不同步,差别太远,是怎么回事?...
💬 1[Last reply:2 months ago] 使用"转录并翻译字幕"(无配音)时,字幕与画面不同步的根本原因是语音识别(ASR)阶段生成的时间轴不精确。由于不涉及配音时长变化,同步问题完全由ASR的VAD切分和模型准确性决定。常见原因和解决方案:VAD切割参数不当:导致字幕的开始/结束时间偏离实际说话时间。进入 菜单 → 工具 → 高级选项 → 语音识别参数检查「最长语音持续秒数」(建议 8-15)和「最短语音持续毫秒」(建议 200-500...220.203**4 Posted at: 2 months ago -
#6077 翻译字幕阶段出错 [DeepSeek] 请求参数不正确:Error code: 400 - {'error': {'message': 'The supported API model names are deepseek-v4-pro or deepseek-v4-flash, but you passed deepseek-chat.', 'type':...
💬 1[Last reply:2 months ago] 核心原因是 DeepSeek 更新的模型命名规则:你当前使用的 deepseek-chat 已被废弃,必须改为官方要求的 deepseek-v4-pro 或 deepseek-v4-flash。解决方法点击软件顶部菜单 翻译设置 → 选择 DeepSeek 渠道页面。在“模型”输入框中将 deepseek-chat 手动修改为 deepseek-v4-pro(推荐)或 deepseek-v4-fl...117.182**1 Posted at: 2 months ago -
#6076 Response ended prematurely:{'text': '你好啊我的朋友', 'role': 'cosy.wav', 'filename': 'H:/pyvideotrans/tmp/31272/1784953427.555445-gptsovits.wav', 'tts_type': 12}...
💬 1[Last reply:2 months ago] 根据报错,Response ended prematurely 表明软件向 CosyVoice API 发送请求时,服务端在返回数据过程中连接中断,通常由以下原因导致:CosyVoice 服务未正常启动或已崩溃:请检查你是否已自行部署并运行了 CosyVoice 的 WebUI 或 API 服务。该错误常见于服务未完全加载便退出,或处理请求时内部出错。API 地址配置错误:在 菜单 → TTS 设...240e**6988 Posted at: 2 months ago -
#6075 4,07 omnivoice速度慢...
💬 1[Last reply:2 months ago] OmniVoice-TTS 是本地内置模型,速度慢通常由以下原因导致:未启用 GPU 加速:本地 TTS 模型极依赖 NVIDIA 显卡。请确保已勾选主界面的「CUDA加速」并正确安装 CUDA 12.8+ 与 cuDNN 9.11+。模型体积较大:OmniVoice 模型默认下载的可能是完整版,首次运行或显存不足时会退化为 CPU 处理。可尝试在高级选项中降低模型精度(如 float16)。并发...104.28**1 Posted at: 2 months ago -
#6074 在软件根目录下的 videotrans/ 文件夹中新建一个纯文本文件命名为 newlang.txt 无效...
💬 3[Last reply:2 months ago] 新增目标语言需要修改源代码中的语言配置,并非简单的文本文件。请按照以下步骤操作:打开 videotrans/language/ 文件夹,找到对应的语言JSON文件(如 zh.json 或 en.json),在 language_data 中添加新的语言代码和显示名称。打开 videotrans/configure/contants.py,在 language_code_list 列表中追加该语言代...104.28**1 Posted at: 2 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.