Dataset Card for librispeech asr Table of Contents Dataset Description Dataset Summary Supported Tasks and Leaderboards Languages Dataset Structure Data Instances Data Fields Data Splits Dataset Creation Curation Rationale Source Data Annotations Personal and Sensitive Information Considerations for Using the Data Social Impact of Dataset Discussion of Biases Other Known Limitations Additional Information Dataset Curators Licensing Information Citation Information Contributions Dataset Description Homepage: LibriSpeech ASR corpus Repository: [Needs More Information] Paper: LibriSpeech: An ASR Corpus Based On Public Domain Audio Books Leaderboard: The 🤗 Speech Bench Point of Contact: Daniel Povey Dataset Summary LibriSpeech is a corpus of approximately 1000 hours of 16kHz read English speech, prepared by Vassil Panayotov with the assistance of Daniel Povey. The data is derived from read audiobooks from the LibriVox project, and has been carefully segmented and aligned. Supported Tasks and Leaderboards automatic speech recognition , audio speaker identification : The dataset can be used to train a model for Automatic Speech Recognition (ASR). The model is presented with an audio fil…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy