Dataset Card for BEIR Benchmark nfcorpus is one of the datasets from the Bio Medical Retrieval task within BEIR, measuring the retrieval of scientific articles for a given query about a nutritional fact. Dataset Description Homepage: https://beir.ai Repository: https://beir.ai Paper: https://openreview.net/forum?id=wCu6T5xFjeJ Leaderboard: https://docs.google.com/spreadsheets/d/1L8aACyPaXrL8iEelJLGqlMqXKPX2oSP R10pZoy77Ns Point of Contact: nandan.thakur@uwaterloo.ca Dataset Summary BEIR is a heterogeneous benchmark built from 18 diverse datasets representing 9 information retrieval tasks. Fact checking: FEVER, Climate FEVER, SciFact Question Answering: NQ, HotpotQA, FiQA 2018 Bio Medical IR: TREC COVID, BioASQ, NFCorpus News Retrieval: TREC NEWS, Robust04 Argument Retrieval: Touche 2020, ArguAna Duplicate Question Retrieval: Quora, CqaDupstack Citation Prediction: SCIDOCS Tweet Retrieval: Signal 1M Entity Retrieval: DBPedia This nfcorpus subset is the Argument Retrieval task within BEIR. Languages All tasks are in English ( en ). Dataset Structure This dataset uses the standard BEIR retrieval layout and includes: corpus : one row per document with id , title , text queries : one ro…
Runs entirely in your browser via DuckDB-Wasm — this dataset's real data file is loaded once, then queried locally. Nothing is sent to a server.
We use cookies for essential functionality and analytics. You can accept or reject analytics cookies.Cookie policy