-
#6917 [WinError 5] 拒绝访问。: 'D:\\翻译成品\\111-mp4':D:\翻译成品\111-mp4Traceback (most recent call last):...
💬 1[Last reply:1 hour ago] 核心原因是 Windows 系统拒绝创建输出目录 D:\翻译成品\111-mp4,通常是目录已存在但被占用(如正在被其他程序打开)、磁盘权限不足,或路径中带中文导致兼容性问题。解决方案更换输出目录:点击「输出到...」按钮,选择到一个全英文、无特殊符号的简单路径(例如 D:\out\111-mp4),建议不要直接使用含中文的目录。清理占用:关闭所有可能打开该文件夹的窗口或软件(如图片查看器、播放器...111.17.**5 Posted at: 1 hour ago -
#6916 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:2 hours ago] This is caused by Microsoft changing their free translation API endpoint. The https://edge.microsoft.com/translate/auth URL no longer exists, and your current version (v4.07) does not include the upda...2001:**:9dab Posted at: 2 hours ago -
#6915 <urlopen error [Errno 11001] getaddrinfo failed>:Traceback (most recent call last): File...
💬 1[Last reply:3 hours ago] 此报错 socket.gaierror: [Errno 11001] getaddrinfo failed 的底层原因是 DNS 解析失败,软件无法解析模型下载服务器的域名。从日志看,你配置了一个格式错误的代理地址:http=127.0.0.1:7897;https=127.0.0.1:7897;socks=127.0.0.1:7897这种格式并非软件要求的正确格式,会导致所有网络请求失败。解决方...188.253.**1 Posted at: 3 hours ago -
#6914 faster-whisper +large-v3 显卡是2060S .通用设置选择VAD: silero语音阈值: 0.5非语音阈值: 0.6最长语音持续(秒): 10最短语音持续(毫秒): 500二次识别最长语音持续(秒): 2二次识别最......
💬 5[Last reply:4 hours ago] 您说的现象(一条字幕内堆积大量文字)确实和 Whisper预分割音频 与 合并过短字幕 有一定关联,但主要原因不是它们本身,而是 VAD(语音活动检测)没有在句子间隙正确切分,导致一整段长音频被当作一条连续语音送入模型,模型因此输出一长串文字。Whisper预分割音频:这个选项的作用是在静音处把音频提前切成小段,本意是让句子更短。它不会主动把文字堆积在一起,反而应该减少长句。如果预分割没生效,恰恰...182.147.**2 Posted at: 4 hours ago -
#6913 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3000) must match the existing size (47284) at non-singleton dimension 1. Target sizes: [128, 3000]. Tensor sizes: [...
💬 23[Last reply:4 hours ago] Whisper预分割音频、合并过短字幕、启用上下文感知 这三个选项的作用不同,针对你的掉句子问题各有意义,但也要注意它们的代价:Whisper预分割音频 这个选项会让软件在把音频送入Whisper模型之前,先按静音段或一定时长切分成较均匀的短片段。如果不切分,一大段音频(比如几十秒)会被当作一个整体送入模型,模型在有限显存内处理时容易因为太长而截断,导致后半段漏识、掉句子。切分后每个片段长度可控...182.147.**2 Posted at: 5 hours ago -
#6912 语音识别阶段出错[Huggingface_ASR(内置)] The expanded size of the tensor (3092) must match the existing size (3000) at non-singleton dimension 1. Target sizes: [128, 3092]. Tensor sizes: [1...
💬 1[Last reply:5 hours ago] 核心原因是 Huggingface_ASR(内置) 渠道中的 kotoba-tech/kotoba-whisper-v2.0 模型与当前软件内置的 transformers 管道存在兼容性问题,当输入音频特征长度与模型期望长度不一致时,会触发张量填充维度错误(3092 vs 3000)。解决方案(按优先级):更换为其他日语识别模型:在 Huggingface_ASR 渠道的模型列表中选择 reaz...182.147.**2 Posted at: 5 hours ago -
#6911 语音识别阶段出错[Huggingface_ASR(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:5 hours ago] 这是由于自动从 HuggingFace 下载模型时网络连接超时(WinError 10060)导致的,HuggingFace 国内访问不稳定,自动下载失败。请按以下步骤手动下载模型并放置到正确位置:步骤 1:下载模型文件访问以下地址,下载该仓库内的所有文件:https://huggingface.co/reazon-research/japanese-wav2vec2-large-rs35kh/t...182.147.**2 Posted at: 5 hours ago -
#6910 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:5 hours ago] 该错误是微软免费翻译接口已变更/关闭导致的 404。您当前所用版本为 v4.06,该接口已不可用。另外,您虽选择了“Google(免费)”,但国内无法直连 Google 时会自动回退到微软翻译,而微软翻译现已失效,因此报错。解决方案(二选一):升级软件:前往官网或 GitHub 下载并替换为 v4.09 及以上版本(若非最新,请再覆盖最新补丁包),随后重新执行翻译。更换翻译渠道:在翻译渠道下拉框中...240e:**:d27f Posted at: 5 hours ago -
#6909 语音识别阶段出错[Huggingface_ASR(内置)] 自动下载模型失败,你可以点击 【查看帮助教程】 了解如何手动下载...
💬 1[Last reply:6 hours ago] 该报错是网络连接中断导致 Huggingface 模型(kotoba-tech/kotoba-whisper-v2.0)自动下载失败。模型体积较大(约1.5GB),在下载过程中连接被服务端关闭,属于典型的国内网络环境问题。请手动下载模型:打开以下地址,下载该模型目录下的所有文件:官方源:https://huggingface.co/kotoba-tech/kotoba-whisper-v2.0/t...182.147.**2 Posted at: 6 hours ago -
#6908 Thinking level is not supported for this model.:Traceback (most recent call last): File...
💬 1[Last reply:8 hours ago] 该错误是因为 Gemini 翻译渠道启用了“思考级别”(Thinking level)参数,但您当前选择的 Gemini 模型不支持该参数,导致 Google API 返回 400 错误。解决方法(任选其一):打开 菜单 -> 翻译设置 -> Gemini,将“思考级别”设为“无”或关闭思考模式,保存后重试。更换为支持思考级别的模型(如 gemini-2.5-flash 或 gemin...45.125.**7 Posted at: 8 hours ago -
#6907 [DEBUG] 开始语音识别:渠道0[DEBUG] [新进程任务 开始:STT use large-v3][DEBUG] 任务参数:kwargs={'detect_language': 'en', 'model_name': 'large-......
💬 23[Last reply:8 hours ago] 请先确认“一直没变过”是指什么:是 final_video_with_freeze_lastend.mp4 的文件大小长时间不再增长,还是主界面的进度条一直停滞不动?如果是文件大小不变且 CPU 占用率明显下降,可能 ffmpeg 已完成编码,但软件正在进行最后的文件移动或收尾;如果 CPU 仍保持高占用,则可能是 ffmpeg 进程卡死。请打开软件安装目录下的 logs/ 文件夹,找到最新日期的...203.10.**4 Posted at: 10 hours ago -
#6906 create File "openai\_base_client.py", line 1332, in post File "openai\_base_client.py", line 1105, in requestopenai.In......
💬 1[Last reply:10 hours ago] 这是你使用的本地大模型(如 llama-server)返回了不符合 OpenAI 兼容接口预期格式的内容导致的 500 错误。通常是因为模型本身能力较弱,未能严格按照要求输出格式,或输出中混入了额外文本、换行、XML 标签等,导致解析失败。解决方法更换更强大的翻译模型 本地小模型(7B 级及以下)指令跟随能力较弱,极易输出格式错误。建议改用 DeepSeek、GPT-4o 等旗舰在线模型,或使用...103.99.**8 Posted at: 10 hours ago -
#6905 [DEBUG] OmniVoice-TTS本地内置渠道,is_cuda=False[DEBUG] 配音成功1个,失败0个[DEBUG] 分离背景声和人声成功[spleeter],耗时: 13.459s[DEBUG] 开始加载 faster-......
💬 3[Last reply:11 hours ago] 日志中的 OmniVoice-TTS 显示 is_cuda=False 属于正常现象:OmniVoice-TTS 目前不支持 CUDA 加速,而 faster-whisper 环节已正常启用 CUDA(is_cuda=True)。两者互不影响。如果您遇到的问题并非 CUDA 相关,请具体说明:是任务中断报错了?进度卡住?还是结果异常?请提供软件安装目录 logs/ 下最新日志文件末尾约30行内容或...103.99.**8 Posted at: 11 hours ago -
#6904 Application started at 2026-08-27 11:27:55 [DEBUG] 上次缓存的角色:No,字幕嵌入类型:1,发音语言:英语,目标语言:简体中文,目标语言代码:zh-cn,模型:large-v3,TTS渠道[......
💬 7[Last reply:11 hours ago] 日志显示任务已成功进入最终合成阶段,正在执行 ffmpeg 命令将无声视频、配音和字幕合并为最终视频。当前命令使用 libx264 软编码、crf 23、preset medium,并且通过 tpad 在视频末尾克隆一帧以延长画面(用于对齐配音时长)。这是正常的处理流程,对于长视频或高分辨率视频,重新编码耗时较长,容易让人误以为卡住。判断是否真卡住的方法:观察任务管理器中的 CPU 占用率——若 ...203.10.**4 Posted at: 11 hours ago -
#6903 现在使用的是 faster-whisper + large-v3.图中配置是现在的设置。还是会出现漏句子...
💬 7[Last reply:11 hours ago] 当前的参数组合已比较合理:发音语言明确指定为日文(避免自动检测误判)、重复惩罚降至 1.5、合并过短字幕已勾选。请先使用该配置重新处理同一视频,观察是否仍有漏句。如果仍然漏句,建议按优先级尝试以下调整:更换识别渠道(针对日语更优)使用 openai-whisper(内置),模型选 large-v3(对日语识别效果通常优于 faster-whisper 的同一模型)。或使用 parakeet日语(内...182.147.**2 Posted at: 12 hours ago -
#6902 Your subscription has a failed or incomplete payment. Complete the latest invoice to continue usage.:Traceback (most recent call last):...
💬 3[Last reply:12 hours ago] 视频翻译是一个复杂流水线,涉及“语音转录、字幕翻译、语音合成”三大阶段,而每个阶段又集成了多种本地AI模型和在线API服务。你看到报错多,本质上是这些环节中任何一个都有可能出问题,具体原因包括:本地AI模型:模型体积大,需要在线下载,容易受网络、代理影响;运行还依赖 GPU 加速和显存,显存不足会直接报错;模型本身智能程度也影响结果。在线API:需要正确的密钥、权限、余额,还受网络连接(VPN/区...103.219.**3 Posted at: 12 hours ago -
#6897 使用该模型 开头就掉了很多句子!!!!...
💬 57[Last reply:12 hours ago] 现在使用的是 faster-whisper + large-v3 图中配置是现在的设置。还是会出现漏句子...182.147.**2 Posted at: 20 hours ago -
#6901 合并阶段出错 最后一步字幕配音嵌入时出错Traceback (most recent call last):...
💬 1[Last reply:13 hours ago] 该报错是输出目标路径异常导致的。最后一步合并时程序尝试将临时文件移动到目标目录,但 Windows 系统找不到目标路径,常见原因是输出路径中含有中文、特殊符号(如【卡卡】)或路径过长,触发 Windows 260 字符路径限制。解决方法将源视频移动到浅层纯英文目录,例如 D:/video/mydemo.mp4,避免中文、空格和特殊符号。在主界面不要点击输出到...自定义输出目录,使用软件默认的 _...163.125.**0 Posted at: 13 hours ago -
#6900 404 Client Error: Not Found for url: https://edge.microsoft.com/translate/authTraceback (most recent call last):...
💬 1[Last reply:14 hours ago] 该报错的原因是微软免费翻译接口已变更关闭,旧版本(v4.04)无法兼容,导致获取鉴权令牌失败(404)。请按以下步骤解决:升级软件到最新版 v4.11(或至少 v4.09+),重新下载完整包或补丁包覆盖安装。若升级后仍报错,可改用其他翻译渠道:免费本地方案:选择 M2M100(内置),首次使用会在线下载模型。高质方案:申请 DeepSeek API Key,在 菜单→翻译设置→DeepSeek 中...117.67.**1 Posted at: 14 hours ago -
#6899 语音识别阶段出错[faster-whisper(内置)] mkl_malloc: failed to allocate memory,Traceback (most recent call last): File...
💬 1[Last reply:14 hours ago] 核心原因:mkl_malloc: failed to allocate memory 是 Intel MKL 库在加载 faster-whisper 的 large-v3-turbo 模型时内存分配失败。由于你未启用 CUDA 加速(纯 CPU 模式),模型需完整加载进系统内存,large-v3-turbo 模型体积较大,当系统可用 RAM 不足或内存碎片严重时就会触发此错误。解决办法(按优先级尝...2408:**:79ca Posted at: 14 hours ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.