jasperai/monet
Dataset com 100 milhões – 1 bilhão de exemplos — 178.1 mil downloads no Hugging Face. Dataset Card for MONET MONET (Massive, Open, Non-redundant and Enriched Text-to-image dataset) is a large-scale, curated image-text dataset designed f…
O dataset jasperai/monet está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 100 milhões – 1 bilhão de exemplos
- Tarefas: geração de imagem, image feature extraction, zero shot image classification
- Idiomas: inglês
- Licença: Apache 2.0
- Downloads: 178.1 mil · Curtidas: 151
Sobre o dataset
Dataset Card for MONET MONET (Massive, Open, Non-redundant and Enriched Text-to-image dataset) is a large-scale, curated image-text dataset designed for training text-to-image (T2I) systems.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
Como é um dataset grande, vale carregar em modo streaming (sem baixar tudo):
from datasets import load_dataset
ds = load_dataset("jasperai/monet", split="train", streaming=True)
for exemplo in ds.take(3):
print(exemplo)Tags
text-to-image image-feature-extraction zero-shot-image-classification image-text multimodal captioning synthetic-data