NeuPAT: Ajuste de Alocação de Plasticidade Ciente de Neurônios para MLLMs que Preservam a Linguagem
arXiv:2608.08107v1 Tipo de anúncio: novo Resumo: A expansão multimodal de grandes modelos de linguagem (LLMs) possibilita novas capacidades perceptivas, mas frequentemente compromete a inteligência linguística adquirida durante o pré-treinamento. Neste trabalho, investigamos esse fenômeno sob a perspectiva da dinâmica de adaptação interna e descobrimos que os neurônios em LLMs pré-treinados exibem plasticidade heterogênea durante o aprendizado multimodal: alguns neurônios são cruciais para preservar as capacidades linguísticas, enquanto outros são m...
arXiv cs.CL
·Jiayue Jin, Jingwei Zhang, Chen Wang, Jing Liu, Longteng Guo
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo