#7127 Faster-whisper [1] めっちゃ可愛いじゃん 性格悪くて騙されまくるやんって俺やらせてくれるやつって会うでしょ?で会って金取られてバイバイ えぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇ

139.202**7 Posted at: 4 hours ago

Faster-whisper [1] めっちゃ可愛いじゃん 性格悪くて騙されまくるやんって俺やらせてくれるやつって会うでしょ?で会って金取られてバイバイ えぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇぇ
Faster-whisper [2] いいと思うよなにこれ?時間 stop app?面白そうじゃんちょっとこれで遊んでみようと説明するのめんどくさいからとにかく楽しもうぜ透けてる可愛いブラだねーきれいじゃんびっくりするだろうなこれ今動かしたらどんな反応するんだろうなちょっと一回動かしてみようかな
Faster-whisper [3] 動け!いいおっぱいだねーなんでだと思う?きれいなおっぱい感じるのかな?気持ちいいのかな?動け!やめてほしいの?やめてくださいってやだやめなーいなめて?動け!いいじゃんもっとやってよねえ好きでしょこれ?好きじゃないの?
Faster-whisper [4] しゃぶってよほらほらほらいいじゃん嫌なの?止まれ!気持ちいいでしょ?殺されるとあいつも呼んでやろうかな?こっちこっち!え?すげーだろ動いてないの?そうなんだよ俺実はさ時間を止めれるようになったんだよ
Faster-whisper [5] あ、そうだ?まあまあまあまあまあまあまあ説明するの難しいからさとにかく楽しもうよやっぱ可愛いないい音だよ好きしような人はとんないとなえ?いろいろやっちゃったよやっちゃった?まだやっちゃってないんだけどさやっちゃってないんだよ
Faster-whisper [6] しもかねるって言うよ?なんだけどさ着させたくて?何それ?レオタード?うん!スタイルいいからさ!脱げ脱げ脱げ!いかねーよ!よいしょ!やばいよな!こんなの?そりゃ最高だよ!よいしょ!よいしょ!よいしょ!動かすこともできるの?できるでしょ?
Faster-whisper [7] ちょっと動かしてみるか?動け!
Faster-whisper [8] やっぱり遊んでるからな!つんばりなってからな!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ!よいしょ
这是怎么回事啊!!!!faster whisper和large V3

3 Replies

#1 DeepSeek reply at 4 hours ago

这种现象是 Whisper 系列模型(尤其是 large-v3)在遇到背景噪声、语速过快或 VAD 切片不当时,容易产生的“幻觉/重复”输出,表现为整段整段地重复同一个词或音节。这不是模型损坏,而是参数与音频环境不匹配导致的。

解决方案

  1. 进入高级选项调整识别参数(菜单 → 工具 → 高级选项 → 语音识别参数):

    • 关闭“启用上下文感知” —— 此选项容易诱发重复和幻觉。
    • 增大“重复惩罚” —— 可适当调至 1.5~2.0,有效减少重复。
    • 减小“文本压缩率(compression ratio threshold)” —— 从默认值往小调(如 1.8 → 1.5)。
    • 降低“采样温度(temperature)” —— 调至 0 或 0.1,让输出更稳定。
    • 适当提高“非语音阈值”,减少把噪声识别成语音的概率。
  2. 更换更均衡的模型
    建议改用 large-v3-turbo,它比 large-v3 更快、幻觉更少,识别质量也足够高。在语音识别渠道的模型下拉框中选择 large-v3-turbo 即可。
  3. 优化输入音频

    • 在主界面勾选 “降噪”“分离人声背景声”,排除背景干扰后再识别。
    • 如果是在“语音转录”独立面板中使用,同样可先对音频做降噪处理。
  4. 若仍有问题
    请检查日志(logs/ 目录)中是否有 CUDA out of memory 或模型下载不完整的错误。显存不足也可能导致输出异常。

请查阅相关文档:

#2 139.202**7 reply at 4 hours ago

语音阈值是0.3 非语音0.4 日语

#3 DeepSeek reply at 4 hours ago

你当前设的 VAD 参数组合(语音阈值0.3、非语音阈值0.4)容易让过多碎片被误判为语音,Whisper 会在这些无效/噪声片段上产生幻觉式的重复输出。请按以下方式调整:

  1. 将“语音阈值”调高到 0.5~0.6,减少噪声被当成语音。
  2. 将“非语音阈值”调低到 0.2~0.3,且必须小于语音阈值,否则判断逻辑会混乱。
  3. 勾选主界面的“降噪”或“分离人声背景声”,排除背景干扰再识别。
  4. 模型建议改为 large-v3-turbo,比 large-v3 在日语上出现重复的几率更低。
  5. 若仍有重复,在“高级选项 → 语音识别参数”里:关闭“启用上下文感知”,将“重复惩罚”设为 1.5~2.0,将“采样温度”设为 0

调整后重新测试即可。

请查阅相关文档:

Thinking...
Post Your Reply
If you have more than 50 messages, you will no longer receive an automatic reply. Please ask a new question!
Open source and free maintenance is not easy. If this project is helpful to you, please consider making a small donation to help the project continue to maintain and update.

Dondate via ko-fi.com

Related resource