-
#5005 我只选择了一个视频,怎么同时有两个运行啊,生成语音的时候TTS dubbing 两个,这个是什么意思...
💬 3[Last reply:3 months ago] 中文字幕在 1920×1080 分辨率下,建议单行字符数控制在 20 个以内(含标点)。该值是 pyVideoTrans 的默认参数,位于“菜单→工具/选项→高级选项→字幕声音画面对齐→中日韩字幕单行字符数”中。原因是:超过 20 字容易超出画面安全区,导致字幕被裁切或阅读困难;1920 像素宽度下,选择合适的字体和字号(默认字号约 24~30px),20 个中文字符已能覆盖大部分观看距离的清晰辨...2a14**28 Posted at: 3 months ago -
#5002 videotrans.configure.excepts.DubbingSrtError: None...
💬 1[Last reply:3 months ago] 试听配音失败,错误信息为空,通常由以下几种情况之一导致:未选择目标语言:必须先在主界面的目标语言下拉框中选择一种语言,配音角色下拉框才会激活。未选择配音角色:选定目标语言后,需在配音角色下拉框中选择一个具体的发音人。TTS 渠道配置缺失:如果使用的不是免费 Edge-TTS,而是第三方配音渠道(如 GPT-SoVITS、F5-TTS、Azure 等),请确保已在菜单 → TTS 设置中正确填写 A...2409**9937 Posted at: 3 months ago -
#5001 保留视频原本的背景音怎么设置...
💬 1[Last reply:3 months ago] 保留原视频背景音,推荐使用“分离人声+重新嵌入背景声”的方式,既能提升语音识别准确率,又能完整保留背景音。设置步骤:点击主界面上的 “设置更多参数...”。在弹出的窗口中:勾选 分离人声背景声(该步骤会提取出纯人声和纯背景伴奏,对CPU有一定消耗)。勾选 重新嵌入背景声(必须配合上一步,在最终合成时将原背景音混合回去)。可选调整 背景音量(默认0.8倍,数值1为原音量)。如果不希望做分离处理,直接...45.139**9 Posted at: 3 months ago -
#5000 TypeError: '>' not supported between instances of 'int' and 'str'...
💬 1[Last reply:3 months ago] This error indicates a type mismatch in the Deepgram API response, likely because the deepgram_captions library expected an integer but received a string (e.g., a timestamp value).Possible causes and ...191.6**6 Posted at: 3 months ago -
#4996 在我提供srt字幕的情况下如何批量处理视频翻译...
💬 9[Last reply:3 months ago] 这是正常现象。软件基于 PySide6,主界面组件较多,首次加载需初始化,耗时一般在 5 秒到 2 分钟 不等,取决于电脑性能。如感觉过慢,可检查以下几点:确认软件路径只包含英文和数字,无中文、空格或特殊符号(例如 D:\pyVideoTrans)。暂时关闭杀毒软件或将其加入白名单,避免误拦截导致加载阻塞。若覆盖过升级包后变慢,请重新下载完整软件包解压,再覆盖升级包。等待时间通常随后续启动会略有缩...45.202**8 Posted at: 3 months ago -
#4998 TaskCfgVTT(is_cuda=False, uuid='31cfa55a4b', cache_folder='D:/win-pyvideotrans-v3.97-0304/tmp/14524/31cfa55a4b', target_dir='D:/2222/Molecular Biology,Genetic & Biochemistry,分子生物学、...
💬 1[Last reply:3 months ago] 问题核心原因:文件路径过长且包含中文、逗号、空格、& 等特殊字符,导致 ffmpeg 或文件复制操作找不到目标文件,最终合并失败。解决方案:移动视频:将视频文件从 D:/2222/Molecular Biology,Genetic & Biochemistry,分子生物学、遗传学与生物化学/ 移动到 浅层纯英文目录(如 D:/videos/),并重命名为简短英文名(例如 glu...123.202**0 Posted at: 3 months ago -
#4997 AttributeError: 'NoneType' object has no attribute 'keys'...
💬 1[Last reply:3 months ago] 这是由于GPT-SoVITS配音渠道的配置参数返回为空(None),导致代码尝试访问其keys时出错。可能原因与解决方法:GPT-SoVITS API地址未填写或服务未启动前往顶部菜单 → TTS设置 → GPT-SoVITS,确认 API地址 已正确填写(形如 http://127.0.0.1:9880)确保已独立启动GPT-SoVITS服务,终端窗口保持运行状态参考音频文件名填写错误参考音频需...129.128**3 Posted at: 3 months ago -
#4995 使用本地模型对llm重新断句发生超时...
💬 1[Last reply:3 months ago] LLM 重新断句的超时时间在软件中没有独立的可调参数,默认底层 HTTP 请求超时约为 5 分钟。由于本地 API 服务通常处理较慢(尤其是小模型或资源不足时),容易触发此超时。临时缓解方案(基于现有多数调整)减少每批字幕行数:在“菜单 → 工具/选项 → 高级选项 → 通用设置”中,将“LLM重新断句每批字幕行数”降低到 5-10 行。这能缩短单次请求的响应时间,降低超时概率。增加翻译后暂停秒数...240e**6c6e Posted at: 3 months ago -
#4994 RuntimeError: cuBLAS failed with status CUBLAS_STATUS_NOT_SUPPORTED...
💬 1[Last reply:3 months ago] This error is caused by a CUDA/cuBLAS version incompatibility. The waft of CUBLAS_STATUS_NOT_SUPPORTED indicates the cuBLAS library installed on your system does not support the operation being attemp...14.191**7 Posted at: 3 months ago -
#4987 TaskCfgVTT(uuid='faee3044f2', name='D:/kkUcXE.mp4', dirname='D:/', noextname='kkUcXE', basename='kkUcXE.mp4', ext='mp4', target_dir='E:/kkUcXE-mp4', cache_folder='D:/BaiduNetdiskDo...
💬 5[Last reply:3 months ago] 不同步的根本原因:不同语言表达同一意思时,音节数和语法结构不同,导致配音时长必然变化。例如一句2秒的中文翻译成英文后配音可能变成4秒,直接播放必然与画面和口型错位。即使开启了音频加速/视频慢速,也仅能部分修正,无法完美对齐。要提高同步质量,请按以下顺序检查设置:务必勾选「二次识别」:在主界面右上角。它会针对生成的配音音频重新语音转录,生成时间轴精确且简短的字幕,确保字幕与配音严格对齐。仅适用于嵌入...104.160**9 Posted at: 3 months ago -
#4991 TaskCfgVTT(uuid='8dfd14a5a2', name='D:/视频制作/PX4/PX4 Ultimate Tuning Guide- Part 3 The Rate PID Controller.mp4', dirname='D:/视频制作/PX4', noextname='PX4 Ultimate Tuning Guide- Part 3 ...
💬 1[Last reply:3 months ago] 模型文件 model.bin 下载不完整,导致读取失败。您使用的模型是 distil-large-v3.5,文件已损坏。关闭软件,删除 models/models--distil-whisper--distil-large-v3.5-ct2 文件夹(在软件根目录下)。按以下步骤手动下载完整模型:在 models/ 目录下新建文件夹 models--distil-whisper--distil-la...2603**54ba Posted at: 3 months ago -
#4990 之前也明明启用了 合并过短字幕到邻近,为什么还是会出现1毫秒的字幕?...
💬 1[Last reply:3 months ago] 出现 1 毫秒的字幕,通常是因为“最短语音持续毫秒”设置值过低,导致软件不认为该字幕为“过短”,从而跳过了合并逻辑。解决方案增大最短语音持续毫秒:进入 菜单 → 工具 → 高级选项 → 语音识别参数,将 最短语音持续毫秒 设为 500 或 1000(单位毫秒)。这样时长低于该值的字幕会被尝试合并到相邻字幕。确认合并选项已开启:确保同一页面的 合并过短字幕到邻近 复选框处于 勾选 状态。检查其他可能...103.172**8 Posted at: 3 months ago -
#4947 LLM重新断句问题好多~!...
💬 33[Last reply:3 months ago] 之前也明明启用了 合并过短字幕到邻近,为什么还是会出现1毫秒的字幕?...2409**2f92 Posted at: 3 months ago -
#4989 TaskCfgVTT(uuid='7d122abc39', name='F:/music/moledic/【电子音乐】如何写旋律-p01-80.mp4', dirname='F:/music/moledic', noextname='【电子音乐】如何写旋律-p01-80', basename='【电子音乐】如何写旋律-p01-80.mp4', ext='mp...
💬 3[Last reply:3 months ago] 从你提供的日志来看,这段内容只显示了批量视频预处理和语音识别阶段的正常运行日志(包括 FFmpeg 提取无声视频、openai-whisper 识别、LLM 重新断句等),并没有出现合并阶段的错误。你之前遇到的 end-edit.srt 无效问题,可能是在后续某个视频(如 p39-p48 中的某一个)的“二次识别”或“字幕嵌入”阶段发生的,但当前日志未捕捉到那段报错。建议操作确认具体出错的视频:请...202.184**7 Posted at: 3 months ago -
#4988 为什么我用Deepseek翻译API翻译视频就会在合并阶段报错,我用本地就不会呢...
💬 1[Last reply:3 months ago] DeepSeek 翻译 API 在合并阶段报错,通常是因为其返回的翻译结果格式不规范(例如含有多余换行、特殊字符或格式错乱),导致生成的字幕文件被破坏,ffmpeg 合成时无法解析。解决方案(按推荐顺序尝试):取消“发送完整字幕” 在主界面翻译渠道区域,取消勾选“发送完整字幕”,改为按行逐条翻译,减少格式出错的概率。降低并发请求量 点击菜单 工具/选项 → 高级选项 → 字幕翻译调整,将 AI...77.93**0 Posted at: 3 months ago -
#4985 None语音识别阶段出错:faster-whisper(本地),翻译字幕阶段出错:Google(免 费),配音阶段出错:Edge-TTS(免费) Traceback (most recent call last): File"videotrans(task)only_one.py",line 47,in run Filevieorastaktraceate....
💬 21[Last reply:3 months ago] 这个 non-negative timestamp expected 错误在 faster-whisper 处理某些特定视频时偶发,根本原因是音频 VAD 分割后产生了负的时间戳(可能由于音频片段过短、纯静音或 ffmpeg 解码异常导致)。你已经尝试了更改路径、手动放置模型,但问题仍存在,说明这个视频文件与 faster-whisper 的 VAD 预处理不兼容。请按以下顺序彻底解决:立即执行(...104.160**9 Posted at: 3 months ago -
#4984 TaskCfgSTT(uuid='1405fca7b7', name='D:/ZJJ/Desktop/素材/德国搭便车-副本.mp4', dirname='D:/ZJJ/Desktop/素材', noextname='德国搭便车-副本', basename='德国搭便车-副本.mp4', ext='mp4', target_dir='D:/win-pyvid...
💬 29[Last reply:3 months ago] 原因在于软件内部对这两个功能使用了不同的 max_tokens 默认值:翻译功能:读取您在翻译渠道设置面板中填写的 max_tokens 值(如 8192),所以能成功调用。LLM 重新断句功能:代码内部硬编码了 max_tokens = 65536,不读取您在翻译渠道设置的 max_tokens 值。而您使用的模型(如 DeepSeek)限制 max_tokens ≤ 32768,因此请求被拒绝...2406**970a Posted at: 3 months ago -
#4983 如何下载驱动,支持cuda...
💬 7[Last reply:3 months ago] 软件无法打开,请按以下步骤排查和解决:1. 检查文件路径:确保软件解压到的目录只包含英文和数字,不能有中文、空格或特殊符号(例如 D:\pyVideoTrans 正确,D:\视频 工具 错误)。2. 删除配置文件重置:进入软件根目录,找到 videotrans/params.json 和 videotrans/cfg.json 两个文件(或直接删除整个 videotrans 下的 params.j...183.199**7 Posted at: 3 months ago -
#4986 opening input: Illegal byte sequence opening input file E:/codex安装与使用/pyvideotrans/tmp/16360/vas-tmp_audio-1780650720.7885778.wav. opening input files: Illegal byte sequence...
💬 1[Last reply:3 months ago] 该错误是由于文件路径中包含中文字符和空格(E:/codex安装与使用/pyvideotrans/...)导致 FFmpeg 无法解析非法字节序列。解决方法移动软件目录:将整个 pyvideotrans 文件夹移动到纯英文且无空格短路径,例如 D:\pyVideoTrans。清理缓存:移动后删除原路径下的 tmp/ 文件夹,或再次勾选主界面上的 清理已生成 重新处理。重命名输入文件:确保输入视频文件...151.242**2 Posted at: 3 months ago -
#4982 TaskCfgVTT(uuid='724416a535', name='C:/Users/yue/Desktop/1000.mp4', dirname='C:/Users/yue/Desktop', noextname='1000', basename='1000.mp4', ext='mp4', target_dir='C:/Users/yue/Deskt...
💬 1[Last reply:3 months ago] 语音识别阶段未返回任何结果,说明 faster-whisper(base) 模型未能从音频中提取出有效文本。常见原因包括:音频中无人声、原始语言选择错误、模型下载不完整,或背景噪声干扰导致无声输出。请按以下步骤排查:验证视频音轨:用播放器打开 1000.mp4,确认视频确实包含人类说话声,且语言为简体中文。如果只有背景音乐或无语音,软件无法处理。临时关闭附加功能:当前开启了“降噪”和“分离人声背景...240e**473e Posted at: 3 months ago
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.