Dataset LLMs & Texto

IIGroup/X-Coder-SFT-376k

Dataset com 100 mil – 1 milhão de exemplos — 1.3 mil downloads no Hugging Face. X-Coder: Advancing Competitive Programming with Fully Synthetic Tasks, Solutions, and Tests Dataset Overview X-Coder-SFT-376k is a large-scale, fully…

Hugging Face · Datasets ·IIGroup · ·↓ 1272 ·♥ 20

O dataset IIGroup/X-Coder-SFT-376k está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 100 mil – 1 milhão de exemplos
  • Tarefas: geração de texto
  • Idiomas: inglês
  • Licença: MIT
  • Downloads: 1.3 mil · Curtidas: 20

Sobre o dataset

X-Coder: Advancing Competitive Programming with Fully Synthetic Tasks, Solutions, and Tests Dataset Overview X-Coder-SFT-376k is a large-scale, fully synthetic dataset for advancing competitive programming.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("IIGroup/X-Coder-SFT-376k")
print(ds)
print(ds["train"][0])

Tags

text-generation code

Explorar o dataset no Hugging Face →

compartilhar: