Blog
LLMs & Texto
As métricas de avaliação detectam erros em traduções do chinês clássico para o inglês?
arXiv:2608.08283v1 Tipo de anúncio: novo Resumo: Embora os grandes modelos de linguagem consigam traduzir alguns idiomas históricos surpreendentemente bem, sua utilidade em fluxos de trabalho de humanidades digitais é limitada pela falta de uma avaliação confiável. Investigamos se as métricas de avaliação automática existentes, desenvolvidas para idiomas modernos, são confiáveis nesse contexto, usando a tradução do chinês clássico para o inglês como um estudo de caso. Apresentamos um arcabouço de diagnóstico baseado em pares mínimos que capturam t...
arXiv cs.CL
·Osvaldo Quinjica, Eric Bennett, Xinchen Yang, Andrew Schonebaum, Marine Carpuat
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo