biglam/british-library-book-images

Dataset com 1 – 10 milhões de exemplos — 1.1 mil downloads no Hugging Face. British Library Book Images 1,080,814 images cut out of 49,455 digitised books (65,227 volumes, ~25 million pages) published between c.

Hugging Face · Datasets ·biglam · ·↓ 1077 ·♥ 20

O dataset biglam/british-library-book-images está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 1 – 10 milhões de exemplos
  • Tarefas: classificação de imagem, descrição de imagem, geração de imagem
  • Formato/modalidade: imagem
  • Licença: CC0 (domínio público)
  • Downloads: 1.1 mil · Curtidas: 20

Sobre o dataset

British Library Book Images 1,080,814 images cut out of 49,455 digitised books (65,227 volumes, ~25 million pages) published between c.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

Como é um dataset grande, vale carregar em modo streaming (sem baixar tudo):

from datasets import load_dataset

ds = load_dataset("biglam/british-library-book-images", split="train", streaming=True)
for exemplo in ds.take(3):
    print(exemplo)

Tags

image-classification image-to-text text-to-image image digital-humanities-research glam book-illustration

Explorar o dataset no Hugging Face →

compartilhar: