Whisper-Wu V09 — 基于 openai/whisper-small 微调的吴语(上海话/宁波话/苏州话等)语音识别与翻译模型。
- 基座模型(Base Model):openai/whisper-small
- 微调方式:LoRA(Low-Rank Adaptation,低秩适配)
- 训练策略:阶跃训练(Staircase Training)— ASR 声学预训练 + AST 翻译微调
- 训练数据:WenetSpeech-Wu-Bench(ASR 4,851条 + AST 3,000条)
- 当前 CER(字错率):0.3467(V01→V09 共 9 个版本迭代)
上传一段吴语音频,或直接用麦克风录音,体验识别效果。
支持格式:WAV、MP3、WebM、OGG、FLAC 等。
📦 模型权重:kaiwang0574/whisper-wu