Dataset LLMs & Texto

Idavidrein/gpqa

Dataset com menos de mil exemplos — 102.7 mil downloads no Hugging Face. Dataset Card for GPQA GPQA is a multiple-choice, Q&A dataset of very hard questions written and validated by experts in biology, physics, and chemistr…

Hugging Face · Datasets ·Idavidrein · ·↓ 102712 ·♥ 494

O dataset Idavidrein/gpqa está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: menos de mil exemplos
  • Tarefas: perguntas e respostas, geração de texto
  • Idiomas: inglês
  • Licença: CC BY 4.0
  • Downloads: 102.7 mil · Curtidas: 494

Sobre o dataset

Dataset Card for GPQA GPQA is a multiple-choice, Q&A dataset of very hard questions written and validated by experts in biology, physics, and chemistry.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("Idavidrein/gpqa")
print(ds)
print(ds["train"][0])

Tags

question-answering text-generation open-domain-qa open-book-qa multiple-choice-qa

Explorar o dataset no Hugging Face →

compartilhar: