Dataset LLMs & Texto

rajpurkar/squad

Dataset com 10 mil – 100 mil exemplos — 212.0 mil downloads no Hugging Face. Dataset Card for SQuAD Dataset Summary Stanford Question Answering Dataset (SQuAD) is a reading comprehension dataset, consisting of questions posed b…

Hugging Face · Datasets ·rajpurkar · ·↓ 212020 ·♥ 460

O dataset rajpurkar/squad está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 10 mil – 100 mil exemplos
  • Tarefas: perguntas e respostas
  • Idiomas: inglês
  • Licença: CC BY-SA 4.0
  • Downloads: 212.0 mil · Curtidas: 460

Sobre o dataset

Dataset Card for SQuAD Dataset Summary Stanford Question Answering Dataset (SQuAD) is a reading comprehension dataset, consisting of questions posed by crowdworkers on a set of Wikipedia articles, where the answer to every question is a segment of text, or span, from the corresponding reading passage, or the question might be unanswerable.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("rajpurkar/squad")
print(ds)
print(ds["train"][0])

Tags

question-answering

Explorar o dataset no Hugging Face →

compartilhar: