Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

61 to 120 of 3,242

  1. Learning Options for Compositional Motor Control with Adapter Banks

    Sreejan Kumar, Marcelo Mattar, Lea Duncker

    cs.LGcs.ROq-bio.NCarXiv:2609.17042v12026
  2. EVOLVE-VLA: Test-Time Training from Environment Feedback for Vision-Language-Action Models

    Zechen Bai, Chen Gao, Mike Zheng Shou

    cs.ROcs.CVarXiv:2512.14666v12025
  3. Motion planning in high dimensional spaces hybridizing RRT and HAR via position-direction decoupling

    Frederic Cazals, Nelson Feyeux

    cs.ROarXiv:2609.16810v12026
  4. IL-ACT: Imitation Learning with Adaptive Cartesian Tracking Control for a 30-ton Excavator

    Mehdi Heydari Shahna, Seihun Kim, Soyi Jung +3

    cs.ROarXiv:2609.16696v12026
  5. SpaceTools: Tool-Augmented Spatial Reasoning via Double Interactive RL

    Siyi Chen, Mikaela Angelina Uy, Chan Hee Song +6

    cs.CVcs.ROarXiv:2512.04069v22025
  6. Nonlinear MPC for Quadrotor Fault-Tolerant Control

    Fang Nan, Sihao Sun, Philipp Foehn +1

    cs.ROarXiv:2109.12886v22021
  7. Fingers as Legs: Learning Self-Supported Locomotion and Manipulation with an Anthropomorphic Hand

    Amirhossein Kazemipour, Hehui Zheng, Robert Katzschmann

    cs.ROeess.SYarXiv:2609.17172v12026
  8. Reinforcing Action Policies by Prophesying

    Jiahui Zhang, Ze Huang, Chun Gu +2

    cs.ROarXiv:2511.20633v22025
  9. LIBRE: The Multiple 3D LiDAR Dataset

    Alexander Carballo, Jacob Lambert, Abraham Monrroy-Cano +6

    cs.ROcs.CVarXiv:2003.06129v22020
  10. CoAdapt: An LLM-based Framework for Adaptive Collaborative Perception in IIoT Robotic Swarms

    Houssam Hajj Hassan, Antonia Maria Masucci, Lynda Zitoune +1

    cs.AIcs.ROarXiv:2609.16852v12026
  11. The Revisiting Problem in Simultaneous Localization and Mapping: A Survey on Visual Loop Closure Detection

    Konstantinos A. Tsintotas, Loukas Bampis, Antonios Gasteratos

    cs.ROarXiv:2204.12831v32022
  12. World Models for Embodied Intelligence: From Plausible to Controllable to Actionable

    Nanjie Yao, Hao Wang, Chong Cheng +10

    cs.ROcs.AIarXiv:2609.16697v12026
  13. Beyond Gestures: Estimating Full Hand Pose and Contact Forces from Wrist-Worn Pressure Sensor Array

    Svetoslav Kolev, Lingni Ma, Michael Goesele +3

    cs.HCcs.ROarXiv:2609.16518v12026
  14. GenAug: Retargeting behaviors to unseen situations via Generative Augmentation

    Zoey Chen, Sho Kiami, Abhishek Gupta +1

    cs.ROarXiv:2302.06671v22023
  15. Continual Learning for Traversability Prediction with Uncertainty-Aware Adaptation

    Hojin Lee, Yunho Lee, Daniel A Duecker +1

    cs.ROcs.AIcs.LGarXiv:2609.17141v12026
  16. A Multi-Vehicle Dataset with Camera, LiDAR, and Radar Sensors and Scanned 3D Models for Custom Auto-Annotation using RTK-GNSS

    Philipp Berthold, Bianca Forkel, Mirko Maehlisch

    cs.ROcs.AIcs.CVarXiv:2609.12871v12026
  17. Multi-Objective Agent-Based Model Predictive Controller for Plug-and-Play Vehicle Control

    Jiaming Zhong, Ladan Khoshnevisan, Shucheng Huang +3

    cs.ROarXiv:2609.12108v12026
  18. Differentiable Mesh State Estimation via Factor Graph Inference for Deformable Object Reconstruction

    Lidia Al-Zogbi, Fangjie Li, Samuel Tobin +13

    cs.ROcs.CVarXiv:2609.16686v12026
  19. Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model

    John Won, Kyungmin Lee, Huiwon Jang +2

    cs.CVcs.ROarXiv:2510.27607v32025
  20. FluxVLA Engine: A One-Stop VLA Engineering Platform for Embodied Intelligence

    Yinhao Li, Weixin Mao, Zihan Lan +21

    cs.ROcs.AIarXiv:2609.17210v12026
  21. gradSim: Differentiable simulation for system identification and visuomotor control

    Krishna Murthy Jatavallabhula, Miles Macklin, Florian Golemo +11

    cs.CVcs.AIcs.LGarXiv:2104.02646v12021
  22. TEMPO: Learning Temporal Context for Dynamic Robot Manipulation

    Zhenyang Feng, Jimin Heo, Erik B. Sudderth +1

    cs.ROcs.CVcs.LGarXiv:2609.16864v12026
  23. Seeing What Matters: Visual Cue Guided Video Planning for Generalizable Robot Navigation

    Hojin Lee, Sizhe Lester Li, Maximilian Hilger +4

    cs.ROcs.AIcs.CVarXiv:2609.16737v12026
  24. DexNDM: Closing the Reality Gap for Dexterous In-Hand Rotation via Joint-Wise Neural Dynamics Model

    Xueyi Liu, He Wang, Li Yi

    cs.ROcs.CVarXiv:2510.08556v12025
  25. RobResilience: Implementing and Evaluating a Resilience Framework for Cyber-Physical Embodied Systems

    Gysella Imrell, Emanuele Miotto, Mahya Mohammadi Kashani +2

    cs.CRcs.ROeess.SYarXiv:2609.17349v12026
  26. HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation

    Shuanghao Bai, Meng Li, Xinyuan Lv +14

    cs.ROarXiv:2604.07993v22026
  27. HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness

    Yang Chen, Lirong Che, Zhenyu Huang +7

    cs.ROarXiv:2609.15195v12026
  28. Sentinel-VLA: A Metacognitive VLA Model with Active Status Monitoring for Dynamic Reasoning and Error Recovery

    Wenhao Li, Xiu Su, Dan Niu +6

    cs.ROarXiv:2605.01191v22026
  29. GraspNeRF: Multiview-based 6-DoF Grasp Detection for Transparent and Specular Objects Using Generalizable NeRF

    Qiyu Dai, Yan Zhu, Yiran Geng +3

    cs.ROcs.CVarXiv:2210.06575v32022
  30. EVA: Aligning Video World Models with Executable Robot Actions via Inverse Dynamics Rewards

    Ruixiang Wang, Qingming Liu, Yueci Deng +3

    cs.ROcs.AIarXiv:2603.17808v22026
  31. DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving

    Pengxuan Yang, Yupeng Zheng, Deheng Qian +11

    cs.LGcs.ROarXiv:2603.24587v22026
  32. FlexiTac: A Low-Cost, Open-Source, Scalable Tactile Sensing Solution for Robotic Systems

    Binghao Huang, Yunzhu Li

    cs.ROcs.AIcs.LGarXiv:2604.28156v12026
  33. Modality-Autoregressive World-Action Models

    Adam Hung, Bardienus P. Duisterhof, Deva Ramanan +1

    cs.ROarXiv:2609.17524v12026
  34. Maximum Entropy Gain Exploration for Long Horizon Multi-goal Reinforcement Learning

    Silviu Pitis, Harris Chan, Stephen Zhao +2

    cs.LGcs.AIcs.ROarXiv:2007.02832v12020
  35. Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation

    Yunhai Feng, Jiaming Han, Zhuoran Yang +3

    cs.ROcs.AIcs.LGarXiv:2502.16707v12025
  36. PhysBrain 1.5: From Vision-Language Models to Physical Foundation Models

    DeepCybo Team, Yu Bin, Haipeng Cao +51

    cs.CVcs.ROarXiv:2609.14973v12026
  37. Estimating Uncertain Spatial Relationships in Robotics

    Randall Smith, Matthew Self, Peter Cheeseman

    cs.AIcs.ROarXiv:1304.3111v22013
  38. Breaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models

    Jianman Lin, Shailesh Shailesh, Zhongyi Luo +1

    cs.ROarXiv:2609.12641v12026
  39. Task-Embedded Control Networks for Few-Shot Imitation Learning

    Stephen James, Michael Bloesch, Andrew J. Davison

    cs.ROcs.AIcs.CVarXiv:1810.03237v12018
  40. Verifier-free Test-Time Sampling for Vision-Language-Action Models

    Suhyeok Jang, Dongyoung Kim, Changyeon Kim +2

    cs.ROcs.AIcs.LGarXiv:2510.05681v22025
  41. MINERVA: How Small Can a Manipulation Policy Be and Still Solve LIBERO?

    Kohei Sendai, Tatsuya Matsushima, Yusuke Iwasawa

    cs.ROarXiv:2609.03715v12026
  42. MesaTask: Towards Task-Driven Tabletop Scene Generation via 3D Spatial Reasoning

    Jinkun Hao, Naifu Liang, Zhen Luo +8

    cs.CVcs.ROarXiv:2509.22281v12025
  43. Panoramic Affordance Prediction

    Zixin Zhang, Chenfei Liao, Hongfei Zhang +10

    cs.CVcs.ROarXiv:2603.15558v12026
  44. LaS-Comp: Zero-shot 3D Completion with Latent-Spatial Consistency

    Weilong Yan, Haipeng Li, Hao Xu +4

    cs.CVcs.ROarXiv:2602.18735v22026
  45. PlannerRFT: Reinforcing Diffusion Planners through Closed-Loop and Sample-Efficient Fine-Tuning

    Hongchen Li, Tianyu Li, Jiazhi Yang +10

    cs.ROarXiv:2601.12901v12026
  46. SceneWeaver: All-in-One 3D Scene Synthesis with an Extensible and Self-Reflective Agent

    Yandan Yang, Baoxiong Jia, Shujie Zhang +1

    cs.GRcs.CVcs.LGarXiv:2509.20414v22025
  47. SQN: Weakly-Supervised Semantic Segmentation of Large-Scale 3D Point Clouds

    Qingyong Hu, Bo Yang, Guangchi Fang +4

    cs.CVcs.AIcs.ROarXiv:2104.04891v32021
  48. SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics

    Mustafa Shukor, Dana Aubakirova, Francesco Capuano +11

    cs.LGcs.ROarXiv:2506.01844v12025
  49. Multi-Task Reinforcement Learning with Context-based Representations

    Shagun Sodhani, Amy Zhang, Joelle Pineau

    cs.LGcs.AIcs.ROarXiv:2102.06177v22021
  50. Learning coordinated badminton skills for legged manipulators

    Yuntao Ma, Andrei Cramariuc, Farbod Farshidian +1

    cs.ROcs.LGarXiv:2505.22974v22025
  51. Training Strategies for Efficient Embodied Reasoning

    William Chen, Suneel Belkhale, Suvir Mirchandani +4

    cs.ROarXiv:2505.08243v22025
  52. Multi-expert learning of adaptive legged locomotion

    Chuanyu Yang, Kai Yuan, Qiuguo Zhu +2

    cs.ROcs.AIcs.LGarXiv:2012.05810v12020
  53. Grasp Pose Detection in Point Clouds

    Andreas ten Pas, Marcus Gualtieri, Kate Saenko +1

    cs.ROarXiv:1706.09911v12017
  54. Robust Adversarial Reinforcement Learning

    Lerrel Pinto, James Davidson, Rahul Sukthankar +1

    cs.LGcs.AIcs.MAarXiv:1703.02702v12017
  55. DemoGen: Synthetic Demonstration Generation for Data-Efficient Visuomotor Policy Learning

    Zhengrong Xue, Shuying Deng, Zhenyang Chen +3

    cs.ROarXiv:2502.16932v12025
  56. Linear vs Nonlinear MPC for Trajectory Tracking Applied to Rotary Wing Micro Aerial Vehicles

    Mina Kamel, Michael Burri, Roland Siegwart

    cs.ROarXiv:1611.09240v22016
  57. AWAC: Accelerating Online Reinforcement Learning with Offline Datasets

    Ashvin Nair, Abhishek Gupta, Murtaza Dalal +1

    cs.LGcs.ROstat.MLarXiv:2006.09359v62020
  58. SUN: Reaching for Novelty in Reinforcement Learning

    Wenyan Yang, Arsenii Mustafin, Dominik Baumann +2

    cs.LGcs.AIcs.ROarXiv:2609.08642v12026
  59. HOVER: Versatile Neural Whole-Body Controller for Humanoid Robots

    Tairan He, Wenli Xiao, Toru Lin +9

    cs.ROarXiv:2410.21229v22024
  60. One Word, Different Action: A Real-Robot Benchmark for Language-Conditioned Embodied Reasoning

    Yiwei Liu, Luwei Yang, Shunbo Lei

    cs.ROarXiv:2609.05260v12026