Dataset LLMs & Texto

ianncity/GLM-5.2-Conversation

Dataset com 10 mil – 100 mil exemplos — 1.7 mil downloads no Hugging Face. GLM-5.2 · Conversation-50000x 50,000x traces distilled from GLM-5.2 on High reasoning Token Count: 120M Distribution: Speaking domains: •Greetings…

Hugging Face · Datasets ·ianncity · ·↓ 1670 ·♥ 36

O dataset ianncity/GLM-5.2-Conversation está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: 10 mil – 100 mil exemplos
  • Tarefas: geração de texto, perguntas e respostas
  • Idiomas: inglês
  • Licença: Apache 2.0
  • Downloads: 1.7 mil · Curtidas: 36

Sobre o dataset

GLM-5.2 · Conversation-50000x 50,000x traces distilled from GLM-5.2 on High reasoning Token Count: 120M Distribution: Speaking domains: •Greetings •Customer Support •Step by step explanations •Motivational language •Logical Questions •Creative Writing STEM: •Algebra, calculus, quantum mechanics concepts •Astromony and astrophysics •Datascience and machine learning •Biology Programming:… See the full description on the dataset page: https://huggingface.co/datasets/ianncity/GLM-5.2-Conversation.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("ianncity/GLM-5.2-Conversation")
print(ds)
print(ds["train"][0])

Tags

text-generation question-answering reasoning chain-of-thought science physics chemistry biology

Explorar o dataset no Hugging Face →

compartilhar: