Dataset
LLMs & Texto
tencent/workbuddy-bench
Dataset com menos de mil exemplos — 684 downloads no Hugging Face. WorkBuddy Bench — Datasets The task datasets for WorkBuddy Bench, a benchmark for evaluating coding agents on real-world developer, PM, algo, QA, op…
Hugging Face · Datasets
·tencent
·
·↓ 684
·♥ 8
O dataset tencent/workbuddy-bench está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.
Ficha do dataset
- Tamanho: menos de mil exemplos
- Tarefas: geração de texto
- Idiomas: inglês, chinês
- Licença: proprietária / outra
- Downloads: 684 · Curtidas: 8
Sobre o dataset
WorkBuddy Bench — Datasets The task datasets for WorkBuddy Bench, a benchmark for evaluating coding agents on real-world developer, PM, algo, QA, ops, and security work.
Como carregar
Use a biblioteca datasets do Hugging Face:
pip install -U datasets
from datasets import load_dataset
ds = load_dataset("tencent/workbuddy-bench")
print(ds)
print(ds["train"][0])Tags
text-generation code agent benchmark swe security