Dataset
LLMs & Texto
IIGroup/X-Coder-SFT-376k
Dataset com 100 mil – 1 milhão de exemplos — 1.3 mil downloads no Hugging Face. X-Coder: Advancing Competitive Programming with Fully Synthetic Tasks, Solutions, and Tests Dataset Overview X-Coder-SFT-376k is a large-scale, fully…
Hugging Face · Datasets
·IIGroup
·
·↓ 1272
·♥ 20
O dataset IIGroup/X-Coder-SFT-376k está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 100 mil – 1 milhão de exemplos
- Tarefas: geração de texto
- Idiomas: inglês
- Licença: MIT
- Downloads: 1.3 mil · Curtidas: 20
Sobre o dataset
X-Coder: Advancing Competitive Programming with Fully Synthetic Tasks, Solutions, and Tests Dataset Overview X-Coder-SFT-376k is a large-scale, fully synthetic dataset for advancing competitive programming.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("IIGroup/X-Coder-SFT-376k")
print(ds)
print(ds["train"][0])Tags
text-generation code
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo