CaRE: Protocolo de Avaliação de Remascaramento Ciente de Computação para Modelos de Linguagem por Difusão Mascarada

arXiv:2607.24763v1 Tipo de Anúncio: novo Resumo: Os modelos de linguagem por difusão mascarada (MDLMs) estão avançando rapidamente, mas os padrões de avaliação necessários para interpretar de forma confiável seu progresso não acompanharam esse ritmo. Apesar de os MDLMs estarem se tornando competitivos com os modelos de linguagem autorregressivos, sete artigos recentes sobre remascaramento avaliam sob configurações incompatíveis, variando contagens nominais de passos, métricas e temperaturas de amostragem sem controlar conjuntamente esses fatores, o que torna seus rankings de estratégias amplamente incomp...

arXiv cs.AI ·Yash Shah, Abhijit Chakraborty, Vivek Gupta ·
compartilhar: