Robotics
Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
1,021 to 1,080 of 3,238
Act3D: 3D Feature Field Transformers for Multi-Task Robotic Manipulation
Theophile Gervet, Zhou Xian, Nikolaos Gkanatsios +1
cs.ROcs.AIcs.LGarXiv:2306.17817v22023SMILE: Smooth Motion for Improved Long-Horizon VLA Execution
Jongwoo Park, E-Ro Nguyen, Kanchana Ranasinghe +3
cs.ROarXiv:2608.29432v12026DexMachina: Functional Retargeting for Bimanual Dexterous Manipulation
Zhao Mandi, Yifan Hou, Dieter Fox +3
cs.ROcs.AIcs.LGarXiv:2505.24853v12025GeoVLA: Empowering 3D Representations in Vision-Language-Action Models
Lin Sun, Bin Xie, Yingfei Liu +3
cs.ROarXiv:2508.09071v22025ResMimic: From General Motion Tracking to Humanoid Whole-body Loco-Manipulation via Residual Learning
Siheng Zhao, Yanjie Ze, Yue Wang +4
cs.ROcs.LGarXiv:2510.05070v22025Training-Free Action Correction for VLA Model Failures via Language Feedback
Owen Kwon, Pablo Ortega-Kral, Arthur Bucker +1
cs.ROcs.AIarXiv:2608.29967v12026ROI-based Robotic Grasp Detection for Object Overlapping Scenes
Hanbo Zhang, Xuguang Lan, Site Bai +3
cs.ROarXiv:1808.10313v62018JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy
Tianle Zhang, Zhihao Yuan, Dafeng Chi +59
cs.ROarXiv:2604.20100v22026GelSight Wedge: Measuring High-Resolution 3D Contact Geometry with a Compact Robot Finger
Shaoxiong Wang, Yu She, Branden Romero +1
cs.ROcs.CVarXiv:2106.08851v12021Asynchronous Cooperative Online Learning for Multi-Robot Control under Computational Delays
Xiaobing Dai, Zewen Yang, Wei Ren +1
cs.LGcs.MAcs.ROarXiv:2608.29562v12026Real2Render2Real: Scaling Robot Data Without Dynamics Simulation or Robot Hardware
Justin Yu, Letian Fu, Huang Huang +5
cs.ROarXiv:2505.09601v12025AnyTouch: Learning Unified Static-Dynamic Representation across Multiple Visuo-tactile Sensors
Ruoxuan Feng, Jiangyu Hu, Wenke Xia +5
cs.LGcs.CVcs.ROarXiv:2502.12191v32025VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators
Hengtao Li, Pengxiang Ding, Runze Suo +8
cs.ROcs.CVarXiv:2510.00406v12025Learning Robust Autonomous Navigation and Locomotion for Wheeled-Legged Robots
Joonho Lee, Marko Bjelonic, Alexander Reske +3
cs.ROcs.LGeess.SYarXiv:2405.01792v12024DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving
Anqing Jiang, Yu Gao, Zhigang Sun +11
cs.AIcs.CVcs.ROarXiv:2505.19381v42025Blind Dexterity: Whole-Body Humanoid Manipulation via Pure Proprioception
Aditya Bhatt, Oleg Kaidanov, Puze Liu +1
cs.ROarXiv:2608.29487v12026Efficient Continuous-Time SLAM for 3D Lidar-Based Online Mapping
David Droeschel, Sven Behnke
cs.ROarXiv:1810.06802v12018VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation
Chaofan Zhang, Peng Hao, Xiaoge Cao +3
cs.ROarXiv:2505.09577v12025Confidence Regularized Self-Training
Yang Zou, Zhiding Yu, Xiaofeng Liu +2
cs.CVcs.LGcs.MMarXiv:1908.09822v32019SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation
Youqiang Gui, Yuxuan Zhou, Shen Cheng +4
cs.ROarXiv:2603.05117v42026Risk-Aware Decision-Making for Autonomous Overtaking: A World Model-Based Mixture-of-Experts Framework
Yongzhi Liu, Sunan Zhang, Jinchang Xu +4
cs.ROcs.AIcs.LGarXiv:2609.00385v12026Hume: Introducing System-2 Thinking in Visual-Language-Action Model
Haoming Song, Delin Qu, Yuanqi Yao +9
cs.ROcs.AIarXiv:2505.21432v42025CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion
Ralf Römer, Yi Zhang, Yuming Li +1
cs.ROcs.LGarXiv:2601.09512v22026A Survey on Active Simultaneous Localization and Mapping: State of the Art and New Frontiers
Julio A. Placed, Jared Strader, Henry Carrillo +4
cs.ROarXiv:2207.00254v22022Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies
Chen Xu, Tony Khuong Nguyen, Emma Dixon +7
cs.ROcs.AIcs.LGarXiv:2503.08558v32025Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on Humanoids
Toru Lin, Kartik Sachdev, Linxi Fan +2
cs.ROcs.AIcs.CVarXiv:2502.20396v22025HITTER: A HumanoId Table TEnnis Robot via Hierarchical Planning and Learning
Zhi Su, Bike Zhang, Nima Rahmanian +5
cs.ROarXiv:2508.21043v22025CIG-RL: Curiosity-Driven Information-Guided Reinforcement Learning for Source Term Estimation in Uncertain Environments
Junhee Lee, Seunghwan Kim, Hongro Jang +4
cs.ROarXiv:2608.30673v12026Humanoid Locomotion and Manipulation: Current Progress and Challenges in Control, Planning, and Learning
Zhaoyuan Gu, Junheng Li, Wenlan Shen +15
cs.ROarXiv:2501.02116v22025InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
Shuai Yang, Hao Li, Bin Wang +7
cs.ROcs.CVarXiv:2507.17520v22025Any6D: Model-free 6D Pose Estimation of Novel Objects
Taeyeop Lee, Bowen Wen, Minjun Kang +3
cs.CVcs.AIcs.ROarXiv:2503.18673v22025Integrating Traffic Noise Emission Modelling into Variable Speed Limit Control
Jiawen Meng, John Pravin Arockiasamy, Alexey Vinel
cs.ROarXiv:2609.01339v12026Mimic Intent, Not Just Trajectories
Renming Huang, Chendong Zeng, Wenjing Tang +3
cs.ROarXiv:2602.08602v32026Point Policy: Unifying Observations and Actions with Key Points for Robot Manipulation
Siddhant Haldar, Lerrel Pinto
cs.ROarXiv:2502.20391v12025Monocular Semantic Occupancy Grid Mapping with Convolutional Variational Encoder-Decoder Networks
Chenyang Lu, Marinus Jacobus Gerardus van de Molengraft, Gijs Dubbelman
cs.ROcs.CVarXiv:1804.02176v32018Context-Aware Intelligent Vehicles
Liangkai Liu, Shuyao Shi, Mingke Wang +4
cs.ROcs.ETeess.SYarXiv:2609.00682v12026Robust Autonomy Emerges from Self-Play
Marco Cusumano-Towner, David Hafner, Alex Hertzberg +9
cs.LGcs.AIcs.ROarXiv:2502.03349v12025Keep Rollin' - Whole-Body Motion Control and Planning for Wheeled Quadrupedal Robots
Marko Bjelonic, C. Dario Bellicoso, Yvain de Viragh +4
cs.ROarXiv:1809.03557v22018A Review of Surface Haptics:Enabling Tactile Effects on Touch Surfaces
Cagatay Basdogan, Frederic Giraud, Vincent Levesque +1
cs.HCcs.ROarXiv:2004.13864v12020CLONE: Closed-Loop Whole-Body Humanoid Teleoperation for Long-Horizon Tasks
Yixuan Li, Yutang Lin, Jieming Cui +4
cs.ROarXiv:2506.08931v22025PD-VLA: Accelerating Vision-Language-Action Model Integrated with Action Chunking via Parallel Decoding
Wenxuan Song, Jiayi Chen, Pengxiang Ding +9
cs.ROcs.CVarXiv:2503.02310v22025Efficient Optical flow and Stereo Vision for Velocity Estimation and Obstacle Avoidance on an Autonomous Pocket Drone
Kimberly McGuire, Guido de Croon, Christophe De Wagter +2
cs.ROarXiv:1612.06702v22016DexGrasp Anything: Towards Universal Robotic Dexterous Grasping with Physics Awareness
Yiming Zhong, Qi Jiang, Jingyi Yu +1
cs.CVcs.AIcs.ROarXiv:2503.08257v22025BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
Peiyan Li, Yixiang Chen, Hongtao Wu +6
cs.ROcs.AIarXiv:2506.07961v22025VGGT-SLAM 2.0: Real-time Dense Feed-forward Scene Reconstruction
Dominic Maggio, Luca Carlone
cs.CVcs.ROarXiv:2601.19887v22026Learning Generalizable Robotic Reward Functions from "In-The-Wild" Human Videos
Annie S. Chen, Suraj Nair, Chelsea Finn
cs.ROcs.AIcs.CVarXiv:2103.16817v12021An informative path planning framework for UAV-based terrain monitoring
Marija Popovic, Teresa Vidal-Calleja, Gregory Hitz +4
cs.ROarXiv:1809.03870v32018VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers
Yating Wang, Haoyi Zhu, Mingyu Liu +3
cs.ROcs.CVarXiv:2507.01016v12025TrackVLA: Embodied Visual Tracking in the Wild
Shaoan Wang, Jiazhao Zhang, Minghan Li +7
cs.ROcs.CVarXiv:2505.23189v12025DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting
Yuxuan Gao, Shiqi Zhang, Yedong Shen +6
cs.ROarXiv:2608.29749v12026Generalized Trajectory Scoring for End-to-end Multimodal Planning
Zhenxin Li, Wenhao Yao, Zi Wang +7
cs.ROcs.CVarXiv:2506.06664v12025Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
Rui Shao, Wei Li, Lingsen Zhang +4
cs.ROcs.CVarXiv:2508.13073v32025Module Number Adaptive Visual Shape Control for Serial Modular Soft Robots
Kyohei Akamine, Takato Horii, Yusuke Sakaue +1
cs.ROarXiv:2608.29547v12026Urban Driver: Learning to Drive from Real-world Demonstrations Using Policy Gradients
Oliver Scheel, Luca Bergamini, Maciej Wołczyk +2
cs.ROcs.AIcs.CVarXiv:2109.13333v12021Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
Tianbao Xie, Siheng Zhao, Chen Henry Wu +5
cs.LGcs.AIcs.CLarXiv:2309.11489v32023ApexNav: An Adaptive Exploration Strategy for Zero-Shot Object Navigation with Target-centric Semantic Fusion
Mingjie Zhang, Yuheng Du, Chengkai Wu +4
cs.ROarXiv:2504.14478v32025A Survey on Vision-Language-Action Models for Autonomous Driving
Sicong Jiang, Zilin Huang, Kangan Qian +17
cs.CVcs.AIcs.ROarXiv:2506.24044v12025Motubrain: An Advanced World Action Model for Robot Control
Motubrain Team, Chendong Xiang, Fan Bao +17
cs.ROarXiv:2604.27792v52026UAVs Meet LLMs: Overviews and Perspectives Toward Agentic Low-Altitude Mobility
Yonglin Tian, Fei Lin, Yiduo Li +11
cs.ROcs.AIarXiv:2501.02341v22025Humanoid Policy ~ Human Policy
Ri-Zhao Qiu, Shiqi Yang, Xuxin Cheng +12
cs.ROcs.AIcs.CVarXiv:2503.13441v32025