#7808 F5-TTS 软件自动下载的模型,是不是只支持 中英文视频克隆 配音

2603**b0 Posted at: 1 hour ago

F5-TTS 软件自动下载的模型,是不是只支持 中英文视频克隆 配音

11 Replies

#1 DeepSeek reply at 1 hour ago

是。

F5-TTS(内置)官方内置模型仅支持中英双语配音与音色克隆;若需日语、法语、德语、俄语、意大利语、西班牙语、印地语、阿拉伯语、土耳其语、越南语等,需手动下载对应语言模型并放入指定目录(正式版模型体积通常为 1.35G~5.6G)。

如需翻译/克隆到其他语言,可改用支持语种更多的克隆渠道,例如:

  • OmniVoice-TTS(内置):支持所有语言
  • Qwen-TTS(内置):中英日韩等 10+ 种
  • Confucius-TTS(内置):14 种语言
  • Higgs-audio-v3(内置):多语言
  • VoxCPM-TTS(本地API):30 种左右
  • CosyVoice(本地API):中英日韩等 10+ 种

请查阅相关文档:

#2 2603**b0 reply at 1 hour ago

image
D:\pyvideotrans413\models\models--SWivid--F5-TTS
下载好的德、法语文件是放到这个文件夹下面吗

#3 DeepSeek reply at 1 hour ago

不是。

德语、法语模型不是放到 models--SWivid--F5-TTS 文件夹下,而是各自独立存放在 models 目录下的对应文件夹中。

正确存放位置如下:

规律:存放路径就是把模型的显示名称(如 hvoss-techfak/F5-TTS-German)中的 / 替换为 --,放到 models 目录下。

三者的关系是并列同级,互不覆盖:

D:\pyvideotrans413\models\
├── models--SWivid--F5-TTS\             ← 中英文默认模型
├── models--hvoss-techfak--F5-TTS-German\   ← 德语模型
└── models--RASPIAUDIO--F5-French-MixedSpeakers-reduced\  ← 法语模型

请查阅相关文档:

#4 2603**b0 reply at 57 minutes ago

image
这个下面吗

#5 DeepSeek reply at 56 minutes ago

是的,就是这个位置。从你的截图看,models 目录下已经有 models--SWivid--F5-TTS,说明路径结构正确。德语、法语模型不要放进 models--SWivid--F5-TTS 内部,而是在 models 目录下与它并列新建两个文件夹,最终结构如下:D:\pyvideotrans413\models\
├── models--SWivid--F5-TTS\ ← 已存在(中英文)
├── models--hvoss-techfak--F5-TTS-German\ ← 新建,放德语模型
└── models--RASPIAUDIO--F5-French-MixedSpeakers-reduced\ ← 新建,放法语模型操作步骤:1. 在 D:\pyvideotrans413\models 下新建文件夹,名字必须是 models--hvoss-techfak--F5-TTS-German

  1. 把德语模型的所有文件直接放进去(注意:不要再套一层 F5-TTS-German 目录)
  2. 同样在 models 下新建 models--RASPIAUDIO--F5-French-MixedSpeakers-reduced,把法语模型所有文件直接放进去注意事项:- 文件夹名字要一字不差(注意是两个短横线 --,不是下划线或空格)
  3. 模型文件(如 model.safetensors、vocab.txt 等)要直接放在该文件夹内,不要多套一层子目录
  4. 手动下载时注意别让浏览器把同名文件重命名为 xxx(2).safetensors,如有请改回原名请查阅相关文档:手动下载模型
#6 2603**b0 reply at 56 minutes ago

如果是德语视频,他就会自动调下这个文件夹的模型吗

#7 DeepSeek reply at 55 minutes ago

不是自动的。

软件不会因为视频是德语就自动去那个文件夹加载模型,需要你手动在配音渠道那里做对应操作。

原理说明:F5-TTS 内置了多个语言的模型,但同一时间只加载一个模型文件。

软件不会根据视频语言自动切换模型,你必须手动指定要用的语言/模型。

正确操作:1.

配音渠道选择「F5-TTS(内置)」2.

在 F5-TTS 的配音角色下拉框中,选择德语对应的角色(通常会带有德语语言标识)。

选中后才代表本次任务会加载德语模型目录里的模型执行配音。

如果下拉框里没有出现德语角色:- 说明德语模型没放对位置,或文件夹名不对,软件扫描不到;- 请检查是否放进了 D:\pyvideotrans413\models\models--hvoss-techfak--F5-TTS-German 且文件直接在该层(没有多套子目录)- 放好后重启软件,再看角色列表。

另外提醒:语音识别(把德语视频转成字幕)和配音(F5-TTS)是两回事。

识别德语的发音语言要单独在「语音识别」那里选德语渠道/模型;F5-TTS 只负责第 4 步配音。

两者不要混淆。

请查阅相关文档:
F5-TTS(内置)
文字配音所有渠道

#8 2603**b0 reply at 51 minutes ago

image
现在对了吗

#9 DeepSeek reply at 51 minutes ago

对的,现在位置正确。

从截图看:- models 目录下已经有 F5-TTS-German 文件夹- 里面的文件(config.json、ckpts、vocab.txt 等)是直接放在该层,没有再套多余子目录这个结构符合软件要求。

文件夹名方面再确认一下:应确认为 models--hvoss-techfak--F5-TTS-German(两个短横线 -- 分隔),如果截图里显示的简称是缩写,建议按实际完整名核对一次。

接下来:1.

重启软件2.

配音渠道选「F5-TTS(内置)」3.

在配音角色下拉框里找德语角色,能选到即代表加载成功4.

若找不到德语角色,请把该文件夹的完整名称发出来确认请查阅相关文档:
F5-TTS(内置)

#10 2603**b0 reply at 44 minutes ago

image
这样才对吧

#11 DeepSeek reply at 44 minutes ago

对的,这样才正确。

你的完整路径是:D:\pyvideotrans413\models\models--hvoss-techfak--F5-TTS-German\里面的文件直接放在这一层,名字完全符合软件要求。

同时请确认以下几点:1.

F5-TTS 中英文默认模型仍在独立文件夹内,即 D:\pyvideotrans413\models\models--SWivid--F5-TTS\F5TTS_v1_Base,两者并列不冲突。

2.

德语模型里的所有文件(config.json、ckpts、vocab.txt 等)都必须下全,缺文件会加载失败。

3.

放好后重启软件,再在 F5-TTS(内置) 的配音角色下拉框里选择德语角色。

请查阅相关文档:
手动下载模型
F5-TTS(内置)

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource