MultiView-Bench: Um Benchmark de Diagnóstico para Integração Multivista Centrada no Mundo em VLMs
arXiv:2607.08970v1 Tipo de anúncio: novo Resumo: Benchmarks recentes para VLMs avaliam, em grande parte, a percepção de vista única ou de vistas limitadas, deixando sem teste a capacidade cognitiva central de integrar observações entre diferentes pontos de vista em um modelo mental 3D coerente e centrado no mundo (alocêntrico). Apresentamos o MultiView-Bench, um benchmark de diagnóstico expressamente projetado para avaliar a integração multivista para a compreensão holística de cenas 3D. Diferentemente dos conjuntos de dados existentes, que se concentram no mapeamento em nível de pixel ou em na...
arXiv cs.CV
·Hantao Zhang, Jinru Sui, Ed Li, Dirk Bergemann, Zhuoran Yang
·
// relacionados
Leia também
Blog
Flight attendants freaked out that Google is buying tons of Spirit employee data
Blog
Anthropic says any lab can now let a language model agent run the whole protein design stack
Blog
Valid Per-Field Selective Risk Control for Document Extraction: Three Failure Modes, a Validity Ladder, and When Conditioning Pays
Blog