#6106 Subprocess Error: Unrecognized configuration class <class 'NoneType'> for this kind of AutoModel: AutoModel.Model type s

2a09:bac5* Posted at: 1 hour ago

Subprocess Error: Unrecognized configuration class for this kind of AutoModel: AutoModel.
Model type should be one of AfmoeConfig, Aimv2Config, Aimv2VisionConfig, AlbertConfig, AlignConfig, AltCLIPConfig, ApertusConfig, ArceeConfig, AriaConfig, AriaTextConfig, ASTConfig, AudioFlamingo3Config, AudioFlamingo3EncoderConfig, AutoformerConfig, AyaVisionConfig, BambaConfig, BarkConfig, BartConfig, BeitConfig, BertConfig, BertGenerationConfig, BigBirdConfig, BigBirdPegasusConfig, BioGptConfig, BitConfig, BitNetConfig, BlenderbotConfig, BlenderbotSmallConfig, BlipConfig, Blip2Config, Blip2QFormerConfig, BloomConfig, BltConfig, BridgeTowerConfig, BrosConfig, CamembertConfig, CanineConfig, ChameleonConfig, ChineseCLIPConfig, ChineseCLIPVisionConfig, ClapConfig, CLIPConfig, CLIPTextConfig, CLIPVisionConfig, CLIPSegConfig, ClvpConfig, LlamaConfig, CodeGenConfig, CohereConfig, Cohere2Config, Cohere2VisionConfig, ConditionalDetrConfig, ConvBertConfig, ConvNextConfig, ConvNextV2Config, CpmAntConfig
......
SiglipConfig, Siglip2Config, Siglip2VisionConfig, SiglipVisionConfig, SmolLM3Config, SmolVLMConfig, SmolVLMVisionConfig, SolarOpenConfig, Speech2TextConfig, SpeechT5Config, SplinterConfig, SqueezeBertConfig, StableLmConfig, Starcoder2Config, SwiftFormerConfig, SwinConfig, Swin2SRConfig, Swinv2Config, SwitchTransformersConfig, T5Config, T5GemmaConfig, T5Gemma2Config, T5Gemma2EncoderConfig, TableTransformerConfig, TapasConfig, TextNetConfig, TimeSeriesTransformerConfig, TimesFmConfig, TimesFm2_5Config, TimesformerConfig, TimmBackboneConfig, TimmWrapperConfig, TvpConfig, UdopConfig, UMT5Config, UniSpeechConfig, UniSpeechSatConfig, UnivNetConfig, VaultGemmaConfig, VibeVoiceAcousticTokenizerConfig, VibeVoiceAcousticTokenizerDecoderConfig, VibeVoiceAcousticTokenizerEncoderConfig, VibeVoiceAsrConfig, VideoLlama3Config, VideoLlama3VisionConfig, VideoLlavaConfig, VideoMAEConfig, ViltConfig, VipLlavaConfig, VisionTextDualEncoderConfig, VisualBertConfig, ViTConfig, ViTMAEConfig, ViTMSNConfig, VitDetConfig, VitsConfig, VivitConfig, VJEPA2Config, VoxtralConfig, VoxtralEncoderConfig, VoxtralRealtimeConfig, VoxtralRealtimeEncoderConfig, VoxtralRealtimeTextConfig, Wav2Vec2Config, Wav2Vec2BertConfig, Wav2Vec2ConformerConfig, WavLMConfig, WhisperConfig, XCLIPConfig, XcodecConfig, XGLMConfig, XLMConfig, XLMRobertaConfig, XLMRobertaXLConfig, XLNetConfig, xLSTMConfig, XmodConfig, YolosConfig, YosoConfig, YoutuConfig, ZambaConfig, Zamba2Config, OmniVoiceConfig.

cfg=[TaskCfgVTT]当前工作模式: 翻译视频或音频 单视频模式
原始输入文件名: E:/videoplayback.m4a,
输出结果保存到文件夹: E:/_video_out/videoplayback-m4a,
临时文件夹: E:/A4.7/tmp/38668/ef72c28102
未选 清理已存在
已选 启用CUDA加速
未选 降噪
语音识别:Qwen-ASR(本地内置), model_name: 1.7B, 发音语言: 英语, 断句方式:默认断句
翻译渠道:Hy-MT2-1.8B(本地内置),原始语言:英语,目标语言:简体中文, 已选 发送完整字幕
配音渠道:OmniVoice(本地内置), 角色:clone, 配音语言:简体中文, 未选 二次语音识别
音量:+0%, 语速:+0%, 未选 音频加速, 未选 视频慢速
未选 移除字幕间空隙, 已选 强制对齐字幕和声音
字幕: 嵌入软字幕
代理地址:


=
system:Windows-10-10.0.26200-SP0
version:v4.07
frozen:True
language:zh
root_dir:E:/A4.7

1 Replies

该错误是由于 OmniVoice 本地模型文件缺失、损坏或未被正确识别导致的。AutoModel 在加载时未能找到正确的配置类,通常意味着模型目录不完整或 Hugging Face 缓存异常。

解决方案:

  1. 检查 软件目录/models/models--k2-fsa--OmniVoice 文件夹是否存在且不为空。如果缺失,请手动下载模型:

  2. 如果该文件夹已存在,尝试删除并重新下载(自动下载可能不完整)。
  3. 如果仍有问题,请提供 logs/ 目录下最新日志文件(复制底部约30行)以便进一步分析。

请查阅相关文档:

Post Your Reply
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Dondate via PayPal

Related resource