Dataset
LLMs & Texto
nvidia/Nemotron-Personas-USA
Dataset com 1 – 10 milhões de exemplos — 14.3 mil downloads no Hugging Face. Nemotron-Personas-USA A compound AI approach to personas grounded in real-world distributions v1.
Hugging Face · Datasets
·nvidia
·
·↓ 14286
·♥ 335
O dataset nvidia/Nemotron-Personas-USA está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 1 – 10 milhões de exemplos
- Tarefas: geração de texto
- Idiomas: inglês
- Licença: CC BY 4.0
- Downloads: 14.3 mil · Curtidas: 335
Sobre o dataset
Nemotron-Personas-USA A compound AI approach to personas grounded in real-world distributions v1.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
Como é um dataset grande, vale carregar em modo streaming (sem baixar tudo):
from datasets import load_dataset
ds = load_dataset("nvidia/Nemotron-Personas-USA", split="train", streaming=True)
for exemplo in ds.take(3):
print(exemplo)Tags
text-generation synthetic personas NVIDIA datadesigner
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo