Whisper Medium Uzbek v1 by Kotibai & Rubai Team Developed by Kotibai & Rubai Team Uzbek Automatic Speech Recognition (ASR) model fine tuned from Whisper Medium. Model Description Base Model : OpenAI Whisper Medium (769M parameters) Language : Uzbek (uz) Training Data : ~1,600 hours of Uzbek audio Precision : BF16 Script : Latin (handles Russian loanwords in Latin script: "brat", "davay", "prosto", etc.) Evaluation Results Category WER Overall 16.7% Clean Speech ~6 11% Noisy/Augmented ~12 24% Dialects ~16 25% Evaluated on 1,864 samples across 8 diverse test sets. Usage Using Transformers Using Pipeline Training Trained in 3 stages using curriculum learning: Stage Hours Foundation 725h Robustness 394h Domain Adaptation 474h Intended Use Uzbek speech to text transcription Voice assistants and dictation Media transcription and subtitling Limitations Performance degrades on very noisy audio May struggle with heavy code switching Optimized for Uzbek only License Apache 2.0
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy