Dataset Card for BEIR Benchmark Table of Contents Dataset Description Dataset Summary Supported Tasks and Leaderboards Languages Dataset Structure Data Instances Data Fields Data Splits Dataset Creation Curation Rationale Source Data Annotations Personal and Sensitive Information Considerations for Using the Data Social Impact of Dataset Discussion of Biases Other Known Limitations Additional Information Dataset Curators Licensing Information Citation Information Contributions Dataset Description Homepage: https://github.com/UKPLab/beir Repository: https://github.com/UKPLab/beir Paper: https://openreview.net/forum?id=wCu6T5xFjeJ Leaderboard: https://docs.google.com/spreadsheets/d/1L8aACyPaXrL8iEelJLGqlMqXKPX2oSP R10pZoy77Ns Point of Contact: nandan.thakur@uwaterloo.ca Dataset Summary BEIR is a heterogeneous benchmark that has been built from 18 diverse datasets representing 9 information retrieval tasks: Fact checking: FEVER, Climate FEVER, SciFact Question Answering: NQ, HotpotQA, FiQA 2018 Bio Medical IR: TREC COVID, BioASQ, NFCorpus News Retrieval: TREC NEWS, Robust04 Argument Retrieval: Touche 2020, ArguAna Duplicate Question Retrieval: Quora, CqaDupstack Citation Prediction: S…
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy