Blog
LLMs & Texto
GPT e Claude falharam nos testes financeiros da Bridgewater porque as respostas corretas nunca foram públicas
A Bridgewater e a Thinking Machines Lab — a startup da ex-CTO da OpenAI, Mira Murati — fizeram o fine-tuning de um modelo Qwen3-235B para tarefas financeiras. De acordo com os próprios testes delas, o modelo atinge 84,7 por cento de acurácia, superando Gemini, Claude e GPT a cerca de um quatorze avos do custo. Os números não foram verificados por ninguém de fora das duas empresas, no entanto. O artigo GPT e Claude falharam nos testes financeiros da Bridgewater porque as respostas corretas nunca foram públicas apareceu primeiro no The Decoder...
The Decoder
·Maximilian Schreiner
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo