🎙️ Whisper-Wu 吴语语音识别

Whisper-Wu V09 — 基于 openai/whisper-small 微调的吴语(上海话/宁波话/苏州话等)语音识别与翻译模型。

  • 基座模型(Base Model):openai/whisper-small
  • 微调方式:LoRA(Low-Rank Adaptation,低秩适配)
  • 训练策略:阶跃训练(Staircase Training)— ASR 声学预训练 + AST 翻译微调
  • 训练数据:WenetSpeech-Wu-Bench(ASR 4,851条 + AST 3,000条)
  • 当前 CER(字错率):0.3467(V01→V09 共 9 个版本迭代)

上传一段吴语音频,或直接用麦克风录音,体验识别效果。 支持格式:WAV、MP3、WebM、OGG、FLAC 等。

📦 模型权重:kaiwang0574/whisper-wu

乡音属于大众,文明不设藩篱。
我们用代码,为古老的语脉续写数字索引。