Fuzzing Unificado de Alucinações para Grandes Modelos de Linguagem Multimodais
arXiv:2608.07525v1 Tipo de anúncio: novo Resumo: A alucinação continua sendo um desafio persistente para os Grandes Modelos de Linguagem Multimodais (MLLMs), limitando severamente sua confiabilidade em aplicações de alto risco. As avaliações existentes, predominantemente baseadas em benchmarks estáticos, sofrem com uma cobertura taxonômica restrita e uma rápida saturação de desempenho, deixando de refletir a robustez dos modelos em cenários do mundo real em constante evolução. Para preencher essa lacuna, apresentamos um framework de avaliação sistemático que integra um abrangente...
arXiv cs.CL
·Pengfei Zhou, Jiajun Song, Zhiwei Tang, Yixing Ma, Xiaopeng Peng, Donghui Si, Yuhang Xu, Huiqi Song, Yiyuan Miao, Yichen Qian, Weihua Chen, Wangbo Zhao, Bohan Zhuang, Jiasheng Tang, Yang You
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo