jasperai/monet

Dataset com 100 milhões – 1 bilhão de exemplos — 178.1 mil downloads no Hugging Face. Dataset Card for MONET MONET (Massive, Open, Non-redundant and Enriched Text-to-image dataset) is a large-scale, curated image-text dataset designed f…

Hugging Face · Datasets ·jasperai · ·↓ 178124 ·♥ 151

O dataset jasperai/monet está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 100 milhões – 1 bilhão de exemplos
  • Tarefas: geração de imagem, image feature extraction, zero shot image classification
  • Idiomas: inglês
  • Licença: Apache 2.0
  • Downloads: 178.1 mil · Curtidas: 151

Sobre o dataset

Dataset Card for MONET MONET (Massive, Open, Non-redundant and Enriched Text-to-image dataset) is a large-scale, curated image-text dataset designed for training text-to-image (T2I) systems.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

Como é um dataset grande, vale carregar em modo streaming (sem baixar tudo):

from datasets import load_dataset

ds = load_dataset("jasperai/monet", split="train", streaming=True)
for exemplo in ds.take(3):
    print(exemplo)

Tags

text-to-image image-feature-extraction zero-shot-image-classification image-text multimodal captioning synthetic-data

Explorar o dataset no Hugging Face →

compartilhar: