// radar de ia

Visão Computacional

Papers, modelos e datasets em alta no Hugging Face, além do blog oficial — com leitura editorial em português.

Blog Visão Computacional

CVKD-UDA: Cross-View Knowledge Distillation for 3D Unsupervised Domain Adaptive Segmentation

arXiv:2607.10087v1 Announce Type: new Abstract: 3D unsupervised domain adaptive (UDA) segmentation mitigates the high cost of manual annotations of the new domain data. Self-training has emerged as the dominant approach in this area, where its success heavily depends on a well-initialized warm-up model to generate reliable pseudo labels. However, existing methods often depend on source supervision or output-level adversarial alignment to obtain the warm-up model, which suffer from limited genera...

14.07.2026
Blog Robótica & RL

A Biomimetic Myoelectric Tentacle Prosthesis with Sensorless Object Detection and Vibrotactile Feedback

arXiv:2607.09807v1 Announce Type: new Abstract: This paper presents the design and evaluation of a myoelectric tentacle-shaped prosthesis integrating electromyographic (EMG) control, sensorless object detection, and vibrotactile feedback. The objective was to develop a responsive and intuitive assistive device that adapts to various object shapes while providing sensory feedback to the user. The system relies on EMG signals to control the motion of a flexible, biomimetic structure whose curling ...

14.07.2026
Blog Visão Computacional

UniPose9D: Universal Category-Agnostic Object Pose Estimation

arXiv:2607.09985v1 Announce Type: new Abstract: Object pose estimation is a fundamental problem in 3D vision. Although recent state-of-the-art approaches achieve strong performance, they often overfit to existing benchmarks and exhibit limited generalization to novel categories and unseen scenes. We propose UniPose9D, a category-agnostic foundation model for 9D object pose estimation: given an instance mask/ROI and either an RGB-D observation or an RGB image with predicted depth, the model estim...

14.07.2026
Blog Visão Computacional

Event Burst Trigger: um ataque de backdoor de disponibilidade contra detecção de objetos por SNN baseada em eventos

arXiv:2607.09115v1 Tipo de anúncio: novo Resumo: A visão baseada em eventos e as redes neurais de pulsos (SNNs) vêm sendo cada vez mais adotadas para inteligência de borda sob rígidas restrições de latência e energia. No entanto, a vulnerabilidade dos modelos de detecção de objetos por SNN baseada em eventos a ataques de backdoor de disponibilidade permanece insuficientemente estudada. Este artigo apresenta o Event Burst Trigger (EBT), um ataque de backdoor de disponibilidade que tem como alvo modelos de detecção de objetos baseados em SNN. O EBT injeta gatilhos baseados em eventos cuidadosamente elaborados...

13.07.2026
Blog Dados & Embeddings

Segmentação e reconhecimento de fonemas por meio do Mapeamento de Ativação Fonológica

arXiv:2607.09020v1 Tipo de anúncio: cruzado Resumo: A segmentação e o reconhecimento de fonemas são tarefas intrinsecamente relacionadas, mas as abordagens modernas normalmente as modelam de forma separada. Nós defendemos que a estrutura fonética já está latente nas representações dos modelos de fala autossupervisionados (S3Ms), e basta apenas direcioná-los para resolver ambas as tarefas. Nós utilizamos o Mapeamento de Ativação Fonológica baseado em S3M (SPAM), que mapeia cada quadro de representação do S3M para um vetor de ativações de características fonológicas, como v...

13.07.2026
Blog Visão Computacional

Ancoragem Adaptativa de Trajetórias Latentes para Condensação de Datasets de Segmentação de Ações

arXiv:2607.09081v1 Tipo de anúncio: novo Resumo: A condensação de datasets para segmentação de ações sintetiza representações compactas e informativas de datasets de vídeo longos e não editados. A abordagem existente depende de Variational Autoencoders e de uma otimização latente iterativa; ela é computacionalmente cara e sofre com reconstruções excessivamente suavizadas e restrições temporais rígidas. Este artigo propõe deslocar o paradigma de condensação da inversão baseada em otimização para o mapeamento latente determinístico...

13.07.2026
Blog LLMs & Texto

On Locality and Length Generalization in Visual Reasoning

arXiv:2607.09061v1 Announce Type: new Abstract: A striking feature of the human visual system is that it ingests visual information through a series of local foveated glimpses, rather than a single global computation. This makes human vision distinctly different from most popular computer vision models in use today, which input images globally and in a single shot. A natural question therefore is whether local, sequential vision models may provide any fundamental computational benefits in additi...

13.07.2026
350 itens no radar