Robotics
Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
61 to 120 of 3,242
Learning Options for Compositional Motor Control with Adapter Banks
Sreejan Kumar, Marcelo Mattar, Lea Duncker
cs.LGcs.ROq-bio.NCarXiv:2609.17042v12026EVOLVE-VLA: Test-Time Training from Environment Feedback for Vision-Language-Action Models
Zechen Bai, Chen Gao, Mike Zheng Shou
cs.ROcs.CVarXiv:2512.14666v12025Motion planning in high dimensional spaces hybridizing RRT and HAR via position-direction decoupling
Frederic Cazals, Nelson Feyeux
cs.ROarXiv:2609.16810v12026IL-ACT: Imitation Learning with Adaptive Cartesian Tracking Control for a 30-ton Excavator
Mehdi Heydari Shahna, Seihun Kim, Soyi Jung +3
cs.ROarXiv:2609.16696v12026SpaceTools: Tool-Augmented Spatial Reasoning via Double Interactive RL
Siyi Chen, Mikaela Angelina Uy, Chan Hee Song +6
cs.CVcs.ROarXiv:2512.04069v22025Nonlinear MPC for Quadrotor Fault-Tolerant Control
Fang Nan, Sihao Sun, Philipp Foehn +1
cs.ROarXiv:2109.12886v22021Fingers as Legs: Learning Self-Supported Locomotion and Manipulation with an Anthropomorphic Hand
Amirhossein Kazemipour, Hehui Zheng, Robert Katzschmann
cs.ROeess.SYarXiv:2609.17172v12026Reinforcing Action Policies by Prophesying
Jiahui Zhang, Ze Huang, Chun Gu +2
cs.ROarXiv:2511.20633v22025LIBRE: The Multiple 3D LiDAR Dataset
Alexander Carballo, Jacob Lambert, Abraham Monrroy-Cano +6
cs.ROcs.CVarXiv:2003.06129v22020CoAdapt: An LLM-based Framework for Adaptive Collaborative Perception in IIoT Robotic Swarms
Houssam Hajj Hassan, Antonia Maria Masucci, Lynda Zitoune +1
cs.AIcs.ROarXiv:2609.16852v12026The Revisiting Problem in Simultaneous Localization and Mapping: A Survey on Visual Loop Closure Detection
Konstantinos A. Tsintotas, Loukas Bampis, Antonios Gasteratos
cs.ROarXiv:2204.12831v32022World Models for Embodied Intelligence: From Plausible to Controllable to Actionable
Nanjie Yao, Hao Wang, Chong Cheng +10
cs.ROcs.AIarXiv:2609.16697v12026Beyond Gestures: Estimating Full Hand Pose and Contact Forces from Wrist-Worn Pressure Sensor Array
Svetoslav Kolev, Lingni Ma, Michael Goesele +3
cs.HCcs.ROarXiv:2609.16518v12026GenAug: Retargeting behaviors to unseen situations via Generative Augmentation
Zoey Chen, Sho Kiami, Abhishek Gupta +1
cs.ROarXiv:2302.06671v22023Continual Learning for Traversability Prediction with Uncertainty-Aware Adaptation
Hojin Lee, Yunho Lee, Daniel A Duecker +1
cs.ROcs.AIcs.LGarXiv:2609.17141v12026A Multi-Vehicle Dataset with Camera, LiDAR, and Radar Sensors and Scanned 3D Models for Custom Auto-Annotation using RTK-GNSS
Philipp Berthold, Bianca Forkel, Mirko Maehlisch
cs.ROcs.AIcs.CVarXiv:2609.12871v12026Multi-Objective Agent-Based Model Predictive Controller for Plug-and-Play Vehicle Control
Jiaming Zhong, Ladan Khoshnevisan, Shucheng Huang +3
cs.ROarXiv:2609.12108v12026Differentiable Mesh State Estimation via Factor Graph Inference for Deformable Object Reconstruction
Lidia Al-Zogbi, Fangjie Li, Samuel Tobin +13
cs.ROcs.CVarXiv:2609.16686v12026Dual-Stream Diffusion for World-Model Augmented Vision-Language-Action Model
John Won, Kyungmin Lee, Huiwon Jang +2
cs.CVcs.ROarXiv:2510.27607v32025FluxVLA Engine: A One-Stop VLA Engineering Platform for Embodied Intelligence
Yinhao Li, Weixin Mao, Zihan Lan +21
cs.ROcs.AIarXiv:2609.17210v12026gradSim: Differentiable simulation for system identification and visuomotor control
Krishna Murthy Jatavallabhula, Miles Macklin, Florian Golemo +11
cs.CVcs.AIcs.LGarXiv:2104.02646v12021TEMPO: Learning Temporal Context for Dynamic Robot Manipulation
Zhenyang Feng, Jimin Heo, Erik B. Sudderth +1
cs.ROcs.CVcs.LGarXiv:2609.16864v12026Seeing What Matters: Visual Cue Guided Video Planning for Generalizable Robot Navigation
Hojin Lee, Sizhe Lester Li, Maximilian Hilger +4
cs.ROcs.AIcs.CVarXiv:2609.16737v12026DexNDM: Closing the Reality Gap for Dexterous In-Hand Rotation via Joint-Wise Neural Dynamics Model
Xueyi Liu, He Wang, Li Yi
cs.ROcs.CVarXiv:2510.08556v12025RobResilience: Implementing and Evaluating a Resilience Framework for Cyber-Physical Embodied Systems
Gysella Imrell, Emanuele Miotto, Mahya Mohammadi Kashani +2
cs.CRcs.ROeess.SYarXiv:2609.17349v12026HEX: Humanoid-Aligned Experts for Cross-Embodiment Whole-Body Manipulation
Shuanghao Bai, Meng Li, Xinyuan Lv +14
cs.ROarXiv:2604.07993v22026HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness
Yang Chen, Lirong Che, Zhenyu Huang +7
cs.ROarXiv:2609.15195v12026Sentinel-VLA: A Metacognitive VLA Model with Active Status Monitoring for Dynamic Reasoning and Error Recovery
Wenhao Li, Xiu Su, Dan Niu +6
cs.ROarXiv:2605.01191v22026GraspNeRF: Multiview-based 6-DoF Grasp Detection for Transparent and Specular Objects Using Generalizable NeRF
Qiyu Dai, Yan Zhu, Yiran Geng +3
cs.ROcs.CVarXiv:2210.06575v32022EVA: Aligning Video World Models with Executable Robot Actions via Inverse Dynamics Rewards
Ruixiang Wang, Qingming Liu, Yueci Deng +3
cs.ROcs.AIarXiv:2603.17808v22026DreamerAD: Efficient Reinforcement Learning via Latent World Model for Autonomous Driving
Pengxuan Yang, Yupeng Zheng, Deheng Qian +11
cs.LGcs.ROarXiv:2603.24587v22026FlexiTac: A Low-Cost, Open-Source, Scalable Tactile Sensing Solution for Robotic Systems
Binghao Huang, Yunzhu Li
cs.ROcs.AIcs.LGarXiv:2604.28156v12026Modality-Autoregressive World-Action Models
Adam Hung, Bardienus P. Duisterhof, Deva Ramanan +1
cs.ROarXiv:2609.17524v12026Maximum Entropy Gain Exploration for Long Horizon Multi-goal Reinforcement Learning
Silviu Pitis, Harris Chan, Stephen Zhao +2
cs.LGcs.AIcs.ROarXiv:2007.02832v12020Reflective Planning: Vision-Language Models for Multi-Stage Long-Horizon Robotic Manipulation
Yunhai Feng, Jiaming Han, Zhuoran Yang +3
cs.ROcs.AIcs.LGarXiv:2502.16707v12025PhysBrain 1.5: From Vision-Language Models to Physical Foundation Models
DeepCybo Team, Yu Bin, Haipeng Cao +51
cs.CVcs.ROarXiv:2609.14973v12026Estimating Uncertain Spatial Relationships in Robotics
Randall Smith, Matthew Self, Peter Cheeseman
cs.AIcs.ROarXiv:1304.3111v22013Breaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models
Jianman Lin, Shailesh Shailesh, Zhongyi Luo +1
cs.ROarXiv:2609.12641v12026Task-Embedded Control Networks for Few-Shot Imitation Learning
Stephen James, Michael Bloesch, Andrew J. Davison
cs.ROcs.AIcs.CVarXiv:1810.03237v12018Verifier-free Test-Time Sampling for Vision-Language-Action Models
Suhyeok Jang, Dongyoung Kim, Changyeon Kim +2
cs.ROcs.AIcs.LGarXiv:2510.05681v22025MINERVA: How Small Can a Manipulation Policy Be and Still Solve LIBERO?
Kohei Sendai, Tatsuya Matsushima, Yusuke Iwasawa
cs.ROarXiv:2609.03715v12026MesaTask: Towards Task-Driven Tabletop Scene Generation via 3D Spatial Reasoning
Jinkun Hao, Naifu Liang, Zhen Luo +8
cs.CVcs.ROarXiv:2509.22281v12025Panoramic Affordance Prediction
Zixin Zhang, Chenfei Liao, Hongfei Zhang +10
cs.CVcs.ROarXiv:2603.15558v12026LaS-Comp: Zero-shot 3D Completion with Latent-Spatial Consistency
Weilong Yan, Haipeng Li, Hao Xu +4
cs.CVcs.ROarXiv:2602.18735v22026PlannerRFT: Reinforcing Diffusion Planners through Closed-Loop and Sample-Efficient Fine-Tuning
Hongchen Li, Tianyu Li, Jiazhi Yang +10
cs.ROarXiv:2601.12901v12026SceneWeaver: All-in-One 3D Scene Synthesis with an Extensible and Self-Reflective Agent
Yandan Yang, Baoxiong Jia, Shujie Zhang +1
cs.GRcs.CVcs.LGarXiv:2509.20414v22025SQN: Weakly-Supervised Semantic Segmentation of Large-Scale 3D Point Clouds
Qingyong Hu, Bo Yang, Guangchi Fang +4
cs.CVcs.AIcs.ROarXiv:2104.04891v32021SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
Mustafa Shukor, Dana Aubakirova, Francesco Capuano +11
cs.LGcs.ROarXiv:2506.01844v12025Multi-Task Reinforcement Learning with Context-based Representations
Shagun Sodhani, Amy Zhang, Joelle Pineau
cs.LGcs.AIcs.ROarXiv:2102.06177v22021Learning coordinated badminton skills for legged manipulators
Yuntao Ma, Andrei Cramariuc, Farbod Farshidian +1
cs.ROcs.LGarXiv:2505.22974v22025Training Strategies for Efficient Embodied Reasoning
William Chen, Suneel Belkhale, Suvir Mirchandani +4
cs.ROarXiv:2505.08243v22025Multi-expert learning of adaptive legged locomotion
Chuanyu Yang, Kai Yuan, Qiuguo Zhu +2
cs.ROcs.AIcs.LGarXiv:2012.05810v12020Grasp Pose Detection in Point Clouds
Andreas ten Pas, Marcus Gualtieri, Kate Saenko +1
cs.ROarXiv:1706.09911v12017Robust Adversarial Reinforcement Learning
Lerrel Pinto, James Davidson, Rahul Sukthankar +1
cs.LGcs.AIcs.MAarXiv:1703.02702v12017DemoGen: Synthetic Demonstration Generation for Data-Efficient Visuomotor Policy Learning
Zhengrong Xue, Shuying Deng, Zhenyang Chen +3
cs.ROarXiv:2502.16932v12025Linear vs Nonlinear MPC for Trajectory Tracking Applied to Rotary Wing Micro Aerial Vehicles
Mina Kamel, Michael Burri, Roland Siegwart
cs.ROarXiv:1611.09240v22016AWAC: Accelerating Online Reinforcement Learning with Offline Datasets
Ashvin Nair, Abhishek Gupta, Murtaza Dalal +1
cs.LGcs.ROstat.MLarXiv:2006.09359v62020SUN: Reaching for Novelty in Reinforcement Learning
Wenyan Yang, Arsenii Mustafin, Dominik Baumann +2
cs.LGcs.AIcs.ROarXiv:2609.08642v12026HOVER: Versatile Neural Whole-Body Controller for Humanoid Robots
Tairan He, Wenli Xiao, Toru Lin +9
cs.ROarXiv:2410.21229v22024One Word, Different Action: A Real-Robot Benchmark for Language-Conditioned Embodied Reasoning
Yiwei Liu, Luwei Yang, Shunbo Lei
cs.ROarXiv:2609.05260v12026