Blog
LLMs & Texto
Multi-Head Recurrent Memory Agents
arXiv:2607.01523v1 Tipo de anúncio: novo Resumo: Agentes de memória recorrente estendem LLMs para contextos arbitrariamente longos ao consolidar iterativamente a entrada em uma janela de memória de tamanho fixo. Apesar de sua escalabilidade, esses agentes apresentam um problema de confiabilidade bem documentado: o desempenho de ponta a ponta degrada sistematicamente à medida que o comprimento do contexto cresce. Diagnosticamos essa falha decompondo o desempenho em dois fatores — captura de memória e retenção de memória — e confirmamos quantitativamente que a retenção é o dominante...
arXiv cs.LG
·Jiatong Li, Samuel Yeh, Sharon Li
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo