rajpurkar/squad
Dataset com 10 mil – 100 mil exemplos — 212.0 mil downloads no Hugging Face. Dataset Card for SQuAD Dataset Summary Stanford Question Answering Dataset (SQuAD) is a reading comprehension dataset, consisting of questions posed b…
O dataset rajpurkar/squad está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 10 mil – 100 mil exemplos
- Tarefas: perguntas e respostas
- Idiomas: inglês
- Licença: CC BY-SA 4.0
- Downloads: 212.0 mil · Curtidas: 460
Sobre o dataset
Dataset Card for SQuAD Dataset Summary Stanford Question Answering Dataset (SQuAD) is a reading comprehension dataset, consisting of questions posed by crowdworkers on a set of Wikipedia articles, where the answer to every question is a segment of text, or span, from the corresponding reading passage, or the question might be unanswerable.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("rajpurkar/squad")
print(ds)
print(ds["train"][0])Tags
question-answering
Leia também
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos