Learning to Fold: prizewinning solution at LeHome Challenge 2026 (1st place online, 2nd offline)
A vision-language-action policy improved with reinforcement learning uses shared network predictions for success estimation and advantage calculation in bimanual garment folding, e…
Hugging Face · Daily Papers
·Ilia Larchenko
·
·▲ 4 upvotes
Este artigo está em destaque na seleção diária de papers do Hugging Face, curada pela comunidade de pesquisa em IA.
Autores: Ilia Larchenko
- 4 upvotes da comunidade
- Temas: vision-language-action policy, reinforcement-learning loop, value function, advantage estimation, live failure detection, candidate selection
Resumo
Resumo original (em inglês), extraído do paper:
A vision-language-action policy improved with reinforcement learning uses shared network predictions for success estimation and advantage calculation in bimanual garment folding, employing established RL techniques with novel optimization and deployment strategies.Onde ler
// relacionados
Leia também
Editorial
RynnValue: o relógio do vídeo como recompensa para robôs
Blog
Anthropic aplica marca d'água a todas as saídas do Claude globalmente, com marcas que "podem persistir mesmo após alguma edição"
Blog
webAI lança TwIL-LM: uma família de modelos de lógica formal de 1,7B e 3B para autoformalização em hardware local
Blog