LocalNav: Distilling Frontier VLMs and Embodied RL for On-Device Object Goal Navigation
arXiv:2606.27871v1 Announce Type: new Abstract: Vision Language Models (VLMs) have emerged in the robotic domain as a powerful tool that enables environmental perception with language context, serving as a catalyst for open-vocabulary tasks like ObjectNav. Yet, their computational footprint typically confines them to cloud execution, hindering low-latency inference with local deployment on resource-constrained robots. To address this challenge, we present a distillation strategy that transfers c...
arXiv cs.RO
·Nicolas Baumann, Liam Boyle, Pu Deng, Edoardo Ghignone, Boyang Sun, Marc Pollefeys, Luca Benini, Michele Magno
·
// relacionados
Leia também
Blog
O Thinking Machines Lab, de Mira Murati, apresenta os argumentos técnicos para uma IA centrada no ser humano e construída sobre pesos de modelo personalizáveis
Blog
Grupos terroristas estão usando todos os principais chatbots de IA para planejamento de ataques e desenvolvimento de armas
Blog
O modelo de mundo Orca, da China, se equipara a sistemas robóticos especializados sem nunca ter visto um único rótulo de ação
Blog