Dataset LLMs & Texto

tencent/workbuddy-bench

Dataset com menos de mil exemplos — 684 downloads no Hugging Face. WorkBuddy Bench — Datasets The task datasets for WorkBuddy Bench, a benchmark for evaluating coding agents on real-world developer, PM, algo, QA, op…

Hugging Face · Datasets ·tencent · ·↓ 684 ·♥ 8

O dataset tencent/workbuddy-bench está entre os destaques do Hugging Face — dados que alimentam o treinamento e a avaliação dos modelos do momento.

Ficha do dataset

  • Tamanho: menos de mil exemplos
  • Tarefas: geração de texto
  • Idiomas: inglês, chinês
  • Licença: proprietária / outra
  • Downloads: 684 · Curtidas: 8

Sobre o dataset

WorkBuddy Bench — Datasets The task datasets for WorkBuddy Bench, a benchmark for evaluating coding agents on real-world developer, PM, algo, QA, ops, and security work.

Como carregar

Use a biblioteca datasets do Hugging Face:

pip install -U datasets

from datasets import load_dataset

ds = load_dataset("tencent/workbuddy-bench")
print(ds)
print(ds["train"][0])

Tags

text-generation code agent benchmark swe security

Explorar o dataset no Hugging Face →

compartilhar: