ai4bharat/MSMARCO-XI
Dataset em destaque no Hugging Face — 11.4 mil downloads. MS MARCO Translations Dataset Dataset Description This dataset contains the MS MARCO dataset translated into various Indic languages.
Hugging Face · Datasets
·ai4bharat
·
·↓ 11412
·♥ 18
O dataset ai4bharat/MSMARCO-XI está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Downloads: 11.4 mil · Curtidas: 18
Sobre o dataset
MS MARCO Translations Dataset Dataset Description This dataset contains the MS MARCO dataset translated into various Indic languages.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("ai4bharat/MSMARCO-XI")
print(ds)
print(ds["train"][0])
// relacionados
Leia também
Blog
Flight attendants freaked out that Google is buying tons of Spirit employee data
Blog
Anthropic says any lab can now let a language model agent run the whole protein design stack
Blog
Valid Per-Field Selective Risk Control for Document Extraction: Three Failure Modes, a Validity Ladder, and When Conditioning Pays
Blog