ianncity/GLM-5.2-Conversation
Dataset com 10 mil – 100 mil exemplos — 1.7 mil downloads no Hugging Face. GLM-5.2 · Conversation-50000x 50,000x traces distilled from GLM-5.2 on High reasoning Token Count: 120M Distribution: Speaking domains: •Greetings…
O dataset ianncity/GLM-5.2-Conversation está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: 10 mil – 100 mil exemplos
- Tarefas: geração de texto, perguntas e respostas
- Idiomas: inglês
- Licença: Apache 2.0
- Downloads: 1.7 mil · Curtidas: 36
Sobre o dataset
GLM-5.2 · Conversation-50000x 50,000x traces distilled from GLM-5.2 on High reasoning Token Count: 120M Distribution: Speaking domains: •Greetings •Customer Support •Step by step explanations •Motivational language •Logical Questions •Creative Writing STEM: •Algebra, calculus, quantum mechanics concepts •Astromony and astrophysics •Datascience and machine learning •Biology Programming:… See the full description on the dataset page: https://huggingface.co/datasets/ianncity/GLM-5.2-Conversation.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("ianncity/GLM-5.2-Conversation")
print(ds)
print(ds["train"][0])Tags
text-generation question-answering reasoning chain-of-thought science physics chemistry biology