Dataset LLMs & Texto

stanfordnlp/imdb

Dataset com 10 mil – 100 mil exemplos — 180.6 mil downloads no Hugging Face. Dataset Card for "imdb" Dataset Summary Large Movie Review Dataset.

Hugging Face · Datasets ·stanfordnlp · ·↓ 180584 ·♥ 471

O dataset stanfordnlp/imdb está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 10 mil – 100 mil exemplos
  • Tarefas: classificação de texto
  • Idiomas: inglês
  • Licença: proprietária / outra
  • Downloads: 180.6 mil · Curtidas: 471

Sobre o dataset

Dataset Card for "imdb" Dataset Summary Large Movie Review Dataset.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("stanfordnlp/imdb")
print(ds)
print(ds["train"][0])

Tags

text-classification

Explorar o dataset no Hugging Face →

compartilhar: