#6211 我用kokoro本地API怎么用呢,我的本地API音色很多和默认的那几个配不上,无法识别。

2408:8362* Posted at: 7 hours ago

我用kokoro本地API怎么用呢,我的本地API音色很多和默认的那几个配不上,无法识别。

19 Replies

Kokoro 本地 API 的角色列表是软件内置的,无法自动同步你本地部署端新增的全部音色,所以会出现“本地音色很多但软件里只有默认几个、无法识别”的情况。

解决方案

  1. 关闭 pyVideoTrans,找到软件目录下的 videotrans/voicejson/ 文件夹。
  2. 找到 Kokoro 对应的 JSON 角色列表文件(通常文件名含 kokoro,例如 kokoro.json)。
  3. 用文本编辑器打开该文件,将你本地 Kokoro 服务中实际可用的音色名称/ID,按原有 JSON 格式追加或修改进去。
  4. 保存文件后重启软件,再到「配音角色」下拉框中刷新查看。
注意:Kokoro 渠道属于本地自行部署 API 渠道,需先确保你在 菜单 -> TTS 设置 中已填写并保存本地 Kokoro 的 API 地址,且该服务已正常启动。

若修改后仍出现“无法识别”报错,请提供软件安装目录下 logs/ 文件夹中最新的日志文件底部约 30 行报错信息,我帮你进一步确认。

请查阅相关文档:

没有kokoro的json文件

没有找到 Kokoro 对应的 JSON 文件,说明该渠道可能未内置独立的音色列表文件,或文件名与渠道名不完全一致(例如 kokoro-tts.jsonkokorotts.json 等)。请按以下步骤排查:

  1. 打开软件目录下的 videotrans/voicejson/ 文件夹,查看里面所有 .json 文件,确认是否有名字包含 kokoro 的文件;
  2. 确保在 菜单 -> TTS 设置 中已正确填写并保存 Kokoro 本地 API 地址,且该服务已启动;
  3. 如果确认没有任何 Kokoro 相关 JSON 文件,请不要手动新建文件,因为软件可能不会自动加载未注册的配置,强行创建反而可能引发其他问题。

暂无法确定该渠道角色列表在无 JSON 文件时的具体加载方式。请提供软件左上角的版本号,以及 logs/ 目录下最新日志文件底部约 30 行报错内容,以便进一步分析。

请查阅相关文档:

还是没找到kokoro相关文件,API地址怎么确定是否正确呢,
Traceback (most recent call last):
File "videotrans\tts\_base.py", line 217, in _item_task
File "tenacity\__init__.py", line 338, in wrapped_f
File "tenacity\__init__.py", line 477, in call
File "tenacity\__init__.py", line 378, in iter
File "tenacity\__init__.py", line 400, in
File "concurrent\futures\_base.py", line 451, in result
File "concurrent\futures\_base.py", line 403, in __get_result
File "tenacity\__init__.py", line 480, in call
File "videotrans\tts\_kokoro.py", line 37, in _run
videotrans.configure.excepts.StopTask: [Kokoro-TTS] 该渠道需另行部署并启动后可用
self.api_url='http://0.0.0.0:7860/v1/audio/speech'
[https://pyvideotrans.com/kokorotts]

核心原因是 API 地址填写了 0.0.0.0,这会导致软件无法正常连接本地 Kokoro 服务,因此报错“该渠道需另行部署并启动后可用”。请将所有本地服务的 API 地址中的 0.0.0.0 替换为 127.0.0.1

解决方案:

  1. 打开 菜单 -> TTS 设置 -> Kokoro-TTS,将 API 地址由 http://0.0.0.0:7860/v1/audio/speech 改为 http://127.0.0.1:7860/v1/audio/speech,保存。
  2. 确认本地 Kokoro 服务已正常启动,并监听在 7860 端口。
  3. 验证 API 地址是否正确:在浏览器中访问 http://127.0.0.1:7860/v1/audio/speech,如能正常响应(或返回错误 JSON 而非连接失败),则说明服务可用。
  4. 重启软件后重新执行任务。

如果仍无法识别音色,请提供软件左上角的版本号,以及修改后最新的日志文件底部约 30 行报错内容。

请查阅相关文档:

http://127.0.0.1:7860/v1/audio/speech不能正常响应 如何解决

你访问的 /v1/audio/speech 是 POST 接口,直接在浏览器地址栏用 GET 访问,即使服务正常启动也通常会返回 405 Method Not Allowed404 Not Found,这属于“不能正常响应”的正常现象;但如果浏览器显示“无法访问此网站”或“连接被拒绝”,则说明服务未启动或端口不正确。请按以下步骤排查:1. 确认 Kokoro 本地服务是否已部署并成功启动,启动后通常会在终端显示监听地址如 http://127.0.0.1:7860。如果没有启动,请先根据 Kokoro 项目的部署文档自行部署并启动服务,pyVideoTrans 不负责部署该服务。2. 如果服务已启动但仍无法连接,用命令行测试 POST 接口,例如 Windows 下打开 CMD 执行:curl -X POST http://127.0.0.1:7860/v1/audio/speech -H "Content-Type: application/json" -d "{\"text\":\"test\"}",如果能返回音频数据或 JSON 输出(而非连接失败),则说明服务正常。3. 检查防火墙/安全软件是否拦截了本地端口,或更换端口后重新在软件中填写。4. 如果使用 Docker 或远程服务器部署,请填写实际的服务器 IP 而非 127.0.0.1。请先确认你的 Kokoro 服务到底是否启动成功。如果服务确实正常,再提供你完整的最新日志文件底部约 30 行报错内容,以及软件左上角版本号,以便进一步分析。请查阅相关文档:Kokoro-TTS 渠道说明

你是说webUI吗 我启动本地kokoro后他自动弹出http://localhost:7860/这个网址 可以在里面配音

你启动的 http://localhost:7860/ 是 Gradio WebUI 界面,它提供的是网页交互配音,而 pyVideoTrans 的 Kokoro-TTS 渠道需要的是 OpenAI 兼容的 HTTP API 接口(如 /v1/audio/speech)。WebUI 能打开不代表对应 API 路由已启用。请确认你部署的 Kokoro 是否支持启动独立的 API 服务:1. 查看 Kokoro 项目的部署文档,确认是否需要额外参数启动 API 模式(例如 --api 或运行 api.py),而不是仅启动 WebUI。2. 访问 http://127.0.0.1:7860/docshttp://127.0.0.1:7860/openapi.json,检查是否存在 /v1/audio/speech 路径。若不存在,则说明当前服务未提供该接口,pyVideoTrans 无法直接调用。3. 如果确认你的 Kokoro 版本不支持 OpenAI 兼容 API,则无法使用软件内置的 Kokoro-TTS 渠道,需改用其他支持该接口的部署方式或选择其他配音渠道。4. 如果你的 Kokoro 确实支持 API 但路径不同,请按实际可用路径填写,例如可能是 /v1/audio/speech/tts,以服务文档为准。如果仍无法解决,请提供:你的 Kokoro 具体部署方式/项目名称,软件左上角版本号,以及 logs/ 目录下最新日志底部约 30 行内容。请查阅相关文档:Kokoro-TTS 渠道说明

http://localhost:7860/ 这是我自动弹出的网址

只弹出 WebUI 界面是正常的,但 pyVideoTrans 的 Kokoro-TTS 渠道要求的是 OpenAI 兼容的 HTTP API 接口,而不是 Gradio WebUI 页面。如果你的本地 Kokoro 服务仅提供了网页交互配音,没有提供 /v1/audio/speech 接口,软件自然无法调用。请确认你的 Kokoro 项目是否支持启动 API 服务(例如运行 api.py 或添加 --api 参数),具体查看该项目文档。启动 API 模式后,将 API 地址填写为 http://127.0.0.1:7860/v1/audio/speech(不要用 0.0.0.0)。如果该项目只支持 WebUI 而不提供该 API,则无法使用软件内置的 Kokoro-TTS 渠道,需要更换其他支持 OpenAI 兼容接口的本地 TTS 部署方式,或改用其他配音渠道。如果确认你的 Kokoro 版本已提供 API 服务但仍无法使用,请提供:你的 Kokoro 具体部署项目名称、软件左上角版本号,以及 logs/ 目录下最新日志底部约 30 行内容,以便进一步分析。

我看作者接入了小说自动阅读 应该是支持api把?

知识库中没有关于“kokoro 接入小说自动阅读”的任何信息,无法据此判断你的部署版本是否支持 API。是否存在 API 接口取决于你具体部署的 Kokoro 项目本身,请直接查阅该项目在 GitHub/包管理器中的官方文档,确认是否提供 HTTP API(如 /v1/audio/speech)及启动 API 模式的方法。如果文档中没有 API 相关内容,或没有明确给出 OpenAI 兼容接口,则无法在 pyVideoTrans 中使用内置 Kokoro-TTS 渠道,需要更换其他支持该接口的本地 TTS 服务,或改用其他配音渠道。如果确认项目支持 API 但仍无法调用,请提供:你的 Kokoro 项目名称/仓库地址、软件左上角版本号,以及 logs/ 目录下最新日志底部约 30 行报错内容。

这是作者写的 接口格式:http://localhost:9880/?text=你好,测试一下&speaker=参考音频/trump.wav&speed=1.0

你提供的接口格式是 GET 请求,而 pyVideoTrans 内置的 Kokoro-TTS 渠道默认调用的是 OpenAI 兼容的 POST /v1/audio/speech 接口,两者不匹配,所以软件无法识别和调用。解决方案:1. 检查你的 Kokoro 项目是否同时提供 OpenAI 兼容 POST 接口(如 http://localhost:9880/v1/audio/speech),若提供,请在软件中填写该地址。2. 如果不提供,则可以改用软件中的「自定义TTS-API」渠道:自行编写一个本地中转服务,将 pyVideoTrans 发出的请求转换为这个 GET 格式并返回音频。具体对接规范请查阅自定义TTS-API文档。3. 若不愿编写中转服务,建议更换其他支持 OpenAI 兼容接口的本地 TTS 部署方式,或改用其他配音渠道(如 Qwen3-TTS / OmniVoice / Edge-TTS 等)。如果以上操作后仍无法解决,请提供你的 Kokoro 项目名称/仓库地址、软件左上角版本号,以及 logs/ 目录下最新日志底部约 30 行报错内容,以便进一步分析。请查阅相关文档:自定义TTS-API

有没有简单有效测试我是否具备API的方法

最简单的测试方法:在浏览器地址栏直接输入你提供的接口地址,例如:http://127.0.0.1:9880/?text=你好,测试一下&speaker=参考音频/trump.wav&speed=1.0 如果浏览器能返回一个音频文件(表现为下载音频或直接播放),说明该 API 可用。但需要明确:这个接口是 GET 格式,而 pyVideoTrans 内置的 Kokoro-TTS 渠道要求的是 OpenAI 兼容的 POST 接口(如 /v1/audio/speech),格式不匹配,因此即使该 API 可访问,软件内置的 Kokoro-TTS 也无法直接调用。如需使用这个 GET 接口,请使用「自定义 TTS-API」渠道,参照文档编写一个中转服务,或改用其他支持 OpenAI 兼容接口的本地 TTS 方案。请查阅相关文档:自定义TTS-API

自定义tts会影响我api模型的配音速度性能吗

自定义 TTS-API 的性能影响取决于你编写的中转服务实现方式,知识库中没有关于该渠道对配音速度/性能影响的具体说明。通常情况下,中转服务会引入一层额外的本地网络请求,但影响大小主要取决于中转脚本本身的开销,以及实际 TTS 服务的响应速度。如果你使用高效的本地转发脚本,通常不会对语音生成速度造成明显影响;如果中转脚本逻辑复杂、或与 TTS 服务之间增加了不必要的网络跳转,则可能带来一定延迟。因此,实际速度请以你部署后的表现为准。如需更具体的信息,请查阅自定义 TTS-API 文档中的对接规范,并参考你的本地服务部署情况。请查阅相关文档:自定义TTS-API

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource