Table of Contents Dataset Description Overview Data Distribution How to Use Standard Loading Streaming Dataset Structure Data Instance Data Fields Data Splits Reference Dataset Card for YODAS Granary Repository: NeMo speech data processor: Granary Paper: Granary: Speech Recognition and Translation Dataset in 25 European Languages Shared by: ESPnet Dataset Description YODAS Granary is a curated subset of the larger nvidia/Granary dataset, focusing on high quality pseudo labeled speech data for Automatic Speech Recognition (ASR) and Automatic Speech Translation (AST) across 23 European languages. Overview Derived from the espnet/yodas2 corpus, YODAS Granary provides high quality pseudo labeled speech data, focusing on two core tasks: Automatic Speech Recognition (ASR) : covers 23 European languages, with pseudo labeled transcriptions generated using the Systran/faster whisper large v3 model, post processed to restore punctuation and capitalization using Qwen/Qwen2.5 7B Instruct , and filtered for quality. Automatic Speech Translation (AST) : covers 22 non English languages and consists of high quality translations into English, generated from ASR subset using the utter project/EuroLL…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy