CMU-Drive e V2V-VLA: Direção Cooperativa Multiagente Unificada com Benchmark de Raciocínio e Modelos de Visão-Linguagem-Ação Veículo-a-Veículo
arXiv:2608.07621v1 Tipo de anúncio: novo Resumo: Modelos de Visão-Linguagem-Ação (VLA) alcançaram recentemente um desempenho impressionante na direção autônoma de ponta a ponta, mas as abordagens existentes são projetadas principalmente para um único agente individual de direção autônoma, com suporte limitado para percepção, raciocínio e planejamento cooperativos. Apresentamos o Cooperative Multi-agent Unified Driving with Reasoning (CMU-Drive), um benchmark de ciclo fechado de ponta a ponta para avaliar a direção autônoma cooperativa com...
arXiv cs.AI
·Hsu-kuang Chiu, Stephen F. Smith
·
// relacionados
Leia também
Editorial
O modelo que continua aprendendo depois de entregue: dentro do Macaron-V1
Blog
Novo Nordisk e AWS levam IA agêntica à descoberta de medicamentos
Blog
Nvidia garante o valor de seus próprios chips para destravar US$ 500 bilhões em financiamento de infraestrutura de IA
Modelo