Hugging Face daily papers·11d agoActionPiece: Rethinking Action Tokenization for Autoregressive Vision-Language-Action Models#benchmark#imitation-learning#quantization1
arXiv cs.AI / cs.LG / cs.CL·15d agoDynin-Robotics: Omnimodal Unified Diffusion Vision-Language-Action Model#diffusion-models#foundation-models#masked-diffusionAI research1
Hugging Face daily papers·16d agoBreaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models#foundation-models#generalization#libero
Hugging Face daily papers·16d agoDynin-Robotics: Omnimodal Unified Diffusion Vision-Language-Action Model#masked-diffusion#open-x-embodiment#robotics1
Hugging Face daily papers·19d agoTANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model#humanoid-robotics#navigation#reinforcement-learning1
Hugging Face daily papers·20d agoMeasuring Language Transfer in Robot Policies: Adding Greek to a Cosmos3 Vision-Language-Action Policy#cosmos3#evaluation-methodology#low-resource-languages1
Hugging Face daily papers·22d agoMobileVLA-R1 2.0: RL-Enhanced Reasoning for Mobile Robot Control#chain-of-thought#embodied-ai#mobile-robots1
Hugging Face daily papers·23d agoRoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks?#benchmark#embodied-ai#long-horizon-planning