nvidia/Nemotron-Personas-Korea
Dataset com 1 – 10 milhões de exemplos — 13.1 mil downloads no Hugging Face. Nemotron-Personas-Korea 우리나라 실제 분포에 기반한 합성 페르소나를 위한 복합 AI 시스템 A compound AI approach to personas g…
O dataset nvidia/Nemotron-Personas-Korea está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 1 – 10 milhões de exemplos
- Tarefas: geração de texto
- Idiomas: coreano
- Licença: CC BY 4.0
- Downloads: 13.1 mil · Curtidas: 513
Sobre o dataset
Nemotron-Personas-Korea 우리나라 실제 분포에 기반한 합성 페르소나를 위한 복합 AI 시스템 A compound AI approach to personas grounded in real-world distributions 데이터셋 개요 (Overview) Nemotron-Personas-Korea는 대한민국의 실제 인구통계학적·지리적·성격 특성 분포를 기반으로 합성된 오픈소스 페르소나 데이터셋(CC BY 4.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
Como é um dataset grande, vale carregar em modo streaming (sem baixar tudo):
from datasets import load_dataset
ds = load_dataset("nvidia/Nemotron-Personas-Korea", split="train", streaming=True)
for exemplo in ds.take(3):
print(exemplo)Tags
text-generation synthetic personas NVIDIA Korean datadesigner