Archer: Reuso Adaptativo de Estados Ocultos em Cache para Reversão Eficiente em Modelos de Linguagem por Difusão
arXiv:2608.08086v1 Tipo de anúncio: novo Resumo: Modelos de linguagem por difusão (DLMs) refinam iterativamente uma sequência, permitindo que previsões anteriores sejam revisadas à medida que o contexto evolui. Essa capacidade de reversão os distingue da geração autorregressiva irreversível, mas torna a inferência custosa. Cada atualização de remoção de ruído altera o contexto global, forçando o recálculo tanto dos estados do prompt quanto da resposta, mesmo que apenas os tokens de resposta sejam revisáveis. O cache de chave-valor (KV) poderia reduzir esse custo, porém co...
arXiv cs.CL
·Xuning He, Zinan Sheng, Yongding Tao, Huanyu Liu, Ge Li, Xue Jiang, Yihong Dong
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo