Fine tuned XLSR 53 large model for speech recognition in Dutch Fine tuned facebook/wav2vec2 large xlsr 53 on Dutch using the train and validation splits of Common Voice 6.1 and CSS10. When using this model, make sure that your speech input is sampled at 16kHz. This model has been fine tuned thanks to the GPU credits generously given by the OVHcloud :) The script used for training can be found here: https://github.com/jonatasgrosman/wav2vec2 sprint Usage The model can be used directly (without a language model) as follows... Using the HuggingSound library: Writing your own inference script: Reference Prediction DE ABORIGINALS ZIJN DE OORSPRONKELIJKE BEWONERS VAN AUSTRALIË. DE ABBORIGENALS ZIJN DE OORSPRONKELIJKE BEWONERS VAN AUSTRALIË MIJN TOETSENBORD ZIT VOL STOF. MIJN TOETSENBORD ZIT VOL STOF ZE HAD DE BANK BESCHADIGD MET HAAR SKATEBOARD. ZE HAD DE BANK BESCHADIGD MET HAAR SCHEETBOORD WAAR LAAT JIJ JE ONDERHOUD DOEN? WAAR LAAT JIJ HET ONDERHOUD DOEN NA HET LEZEN VAN VELE BEOORDELINGEN HAD ZE EINDELIJK HAAR OOG LATEN VALLEN OP EEN LAPTOP MET EEN QWERTY TOETSENBORD. NA HET LEZEN VAN VELE BEOORDELINGEN HAD ZE EINDELIJK HAAR OOG LATEN VALLEN OP EEN LAPTOP MET EEN QUERTITOETSEMBORD DE…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy