Robotics
Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
961 to 1,020 of 3,237
Igniting VLMs toward the Embodied Space
Andy Zhai, Brae Liu, Bruno Fang +17
cs.ROarXiv:2509.11766v12025Deep Drone Acrobatics
Elia Kaufmann, Antonio Loquercio, René Ranftl +3
cs.ROarXiv:2006.05768v22020An Integrated Framework of Decision Making and Motion Planning for Autonomous Vehicles Considering Social Behaviors
Peng Hang, Chen Lv, Chao Huang +3
eess.SYcs.ROarXiv:2005.11059v12020Reinforced Imitation: Sample Efficient Deep Reinforcement Learning for Map-less Navigation by Leveraging Prior Demonstrations
Mark Pfeiffer, Samarth Shukla, Matteo Turchetta +4
cs.ROarXiv:1805.07095v22018Emotion in Reinforcement Learning Agents and Robots: A Survey
Thomas M. Moerland, Joost Broekens, Catholijn M. Jonker
cs.LGcs.AIcs.HCarXiv:1705.05172v12017Waypoint Models for Instruction-guided Navigation in Continuous Environments
Jacob Krantz, Aaron Gokaslan, Dhruv Batra +2
cs.CVcs.CLcs.ROarXiv:2110.02207v12021ARTEMIS: Autoregressive End-to-End Trajectory Planning with Mixture of Experts for Autonomous Driving
Renju Feng, Ning Xi, Duanfeng Chu +6
cs.ROarXiv:2504.19580v22025ReWiND: Language-Guided Rewards Teach Robot Policies without New Demonstrations
Jiahui Zhang, Yusen Luo, Abrar Anwar +5
cs.ROarXiv:2505.10911v22025Dual Process Motion Planning
Jiayi Yan, Francesco Fabiano, Alessandro Abate
cs.AIcs.ROarXiv:2609.01260v12026Driving on Registers
Ellington Kirby, Alexandre Boulch, Yihong Xu +11
cs.CVcs.AIcs.ROarXiv:2601.05083v22026WorldEval: World Model as Real-World Robot Policies Evaluator
Yaxuan Li, Yichen Zhu, Junjie Wen +2
cs.ROcs.CVcs.LGarXiv:2505.19017v12025GENMO: A GENeralist Model for Human MOtion
Jiefeng Li, Jinkun Cao, Haotian Zhang +4
cs.GRcs.AIcs.CVarXiv:2505.01425v12025Tactical Rewind: Self-Correction via Backtracking in Vision-and-Language Navigation
Liyiming Ke, Xiujun Li, Yonatan Bisk +6
cs.CLcs.CVcs.LGarXiv:1903.02547v22019Novel Demonstration Generation with Gaussian Splatting Enables Robust One-Shot Manipulation
Sizhe Yang, Wenye Yu, Jia Zeng +5
cs.ROarXiv:2504.13175v12025Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision
Xiaofeng Han, Shunpeng Chen, Zenghuang Fu +9
cs.ROcs.CVarXiv:2504.02477v32025Global Planning for Contact-Rich Manipulation via Local Smoothing of Quasi-dynamic Contact Models
Tao Pang, H. J. Terry Suh, Lujie Yang +1
cs.ROarXiv:2206.10787v22022Recovery RL: Safe Reinforcement Learning with Learned Recovery Zones
Brijen Thananjeyan, Ashwin Balakrishna, Suraj Nair +7
cs.LGcs.AIcs.ROarXiv:2010.15920v22020PORCA: Modeling and Planning for Autonomous Driving among Many Pedestrians
Yuanfu Luo, Panpan Cai, Aniket Bera +3
cs.ROarXiv:1805.11833v22018AGM: Achievement-Grounded Memory for Closed-Loop Agents with Frozen VLA Policies
Hongbo Gao, Zeyu Ni, Xin Wen +2
cs.ROcs.AIarXiv:2608.29537v12026Masquerade: Learning from In-the-wild Human Videos using Data-Editing
Marion Lepert, Jiaying Fang, Jeannette Bohg
cs.ROarXiv:2508.09976v12025URLB: Unsupervised Reinforcement Learning Benchmark
Michael Laskin, Denis Yarats, Hao Liu +6
cs.LGcs.AIcs.ROarXiv:2110.15191v12021Toward Trustworthy Robot-Assisted Sliding Palpation for Shallow Vessel Localisation with a Calibrated Digital Twin
Piotr Blaszyk, Wen Fan, Kaizhong Deng +2
cs.ROarXiv:2608.29396v12026Ross3D: Reconstructive Visual Instruction Tuning with 3D-Awareness
Haochen Wang, Yucheng Zhao, Tiancai Wang +3
cs.CVcs.AIcs.CLarXiv:2504.01901v12025Generalizable Multi-Agent Planning from Signal Temporal Logic Specifications via Diffusion
Joe Eappen, Zikang Xiong, Shreyash S. Iyengar +1
cs.MAcs.AIcs.ROarXiv:2608.29490v12026Self-Aware Active Learning Enables Continual Improvement in Autonomous Driving
Dong Hu, Chao Huang, Carman K. M. Lee +1
cs.ROarXiv:2608.29772v12026RoboVerse: Towards a Unified Platform, Dataset and Benchmark for Scalable and Generalizable Robot Learning
Haoran Geng, Feishi Wang, Songlin Wei +34
cs.ROarXiv:2504.18904v12025A Survey: Learning Embodied Intelligence from Physical Simulators and World Models
Xiaoxiao Long, Qingrui Zhao, Kaiwen Zhang +15
cs.ROarXiv:2507.00917v32025A Wearable Pneumatic Device for Continuous, Closed-Loop, Bidirectional Tactile Interaction
Cosima du Pasquier, Aliyah Smith, Serin Huber +5
cs.ROarXiv:2609.00612v12026Summaries:한국어VidBot: Learning Generalizable 3D Actions from In-the-Wild 2D Human Videos for Zero-Shot Robotic Manipulation
Hanzhi Chen, Boyang Sun, Anran Zhang +2
cs.ROcs.CVarXiv:2503.07135v22025A new closed-loop output error method for parameter identification of robot dynamics
Maxime Gautier, Alexandre Janot, Pierre-Olivier Vandanjon
cs.ROarXiv:1009.4556v12010CGFM-Nav: Cognitive Graph-Field Memory for Semantic-Guided Lifelong Multimodal Embodied Navigation
Yuxiang Xiao, Xibei Chen, Xin Zhou +3
cs.ROcs.AIarXiv:2608.29114v12026AVID: Learning Multi-Stage Tasks via Pixel-Level Translation of Human Videos
Laura Smith, Nikita Dhawan, Marvin Zhang +2
cs.ROcs.CVcs.LGarXiv:1912.04443v32019WMNav: Integrating Vision-Language Models into World Models for Object Goal Navigation
Dujun Nie, Xianda Guo, Yiqun Duan +2
cs.CVcs.ROarXiv:2503.02247v52025Multimodal Probabilistic Model-Based Planning for Human-Robot Interaction
Edward Schmerling, Karen Leung, Wolf Vollprecht +1
cs.ROcs.LGarXiv:1710.09483v12017Beyond Object Selection:Markerless Gaze-based Robot Placement at Arbitrary Position
Yuzhi Lai, William Marx, Shenghai Yuan +3
cs.ROarXiv:2609.00478v12026Kimodo: Scaling Controllable Human Motion Generation
Davis Rempe, Mathis Petrovich, Ye Yuan +21
cs.CVcs.GRcs.ROarXiv:2603.15546v12026Not All Agreement Counts as Corroboration: Provenance-Conserving Multi-View Fusion for Typed Action Admission in Human-Robot Collaboration
Zekai Jin, Hanrong Zhang, Yihong Tang +3
cs.ROcs.AIarXiv:2609.01662v12026Urban Driving with Conditional Imitation Learning
Jeffrey Hawke, Richard Shen, Corina Gurau +8
cs.CVcs.AIcs.LGarXiv:1912.00177v22019EmbodiedScan: A Holistic Multi-Modal 3D Perception Suite Towards Embodied AI
Tai Wang, Xiaohan Mao, Chenming Zhu +11
cs.CVcs.AIcs.ROarXiv:2312.16170v12023On the Limitations of Representing Functions on Sets
Edward Wagstaff, Fabian B. Fuchs, Martin Engelcke +2
cs.LGcs.AIcs.NEarXiv:1901.09006v22019Scaling Proprioceptive-Visual Learning with Heterogeneous Pre-trained Transformers
Lirui Wang, Xinlei Chen, Jialiang Zhao +1
cs.ROcs.CVcs.LGarXiv:2409.20537v120243D and 4D World Modeling: A Survey
Lingdong Kong, Yu Yang, Jianbiao Mei +20
cs.CVcs.ROarXiv:2509.07996v42025Federated Learning in the Sky: Joint Power Allocation and Scheduling with UAV Swarms
Tengchan Zeng, Omid Semiari, Mohammad Mozaffari +3
cs.LGcs.ITcs.ROarXiv:2002.08196v22020Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)
Zhenjie Yang, Xiaosong Jia, Qifeng Li +3
cs.ROcs.AIcs.CVarXiv:2505.16394v22025Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning
Juntao Ren, Priya Sundaresan, Dorsa Sadigh +2
cs.ROcs.AIcs.LGarXiv:2501.06994v22025PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation
Wenlong Huang, Yu-Wei Chao, Arsalan Mousavian +4
cs.ROcs.AIcs.CVarXiv:2601.03782v12026Elevation Mapping for Locomotion and Navigation using GPU
Takahiro Miki, Lorenz Wellhausen, Ruben Grandia +3
cs.ROarXiv:2204.12876v12022PAVE: Predictive Alignment and Value-Guided Evolution for World-Action Policies
Botong Zhao, Fang Yu, Tim Yu +3
cs.ROcs.AIarXiv:2608.30378v22026CometVLA: Co-Training on an Embodied Data Pyramid towards Physical Understanding
Hanwen Wan, Dafeng Chi, Linbo Zhai +6
cs.ROarXiv:2608.30289v12026CanonNav: Disentangling Navigation Behavior from Camera Geometry in Cross-Platform Visual Navigation
Dong-Wook Kim, Ji-Hoon Hwang, E-In Son +2
cs.ROarXiv:2608.30242v12026$Ψ_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation
Songlin Wei, Hongyi Jing, Boqian Li +12
cs.ROarXiv:2603.12263v12026OmniVTLA: Vision-Tactile-Language-Action Models with Semantic-Aligned Tactile Sensing
Zhengxue Cheng, Yiqian Zhang, Anni Tang +5
cs.ROarXiv:2508.08706v32025UniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning
Weikang Wan, Haoran Geng, Yun Liu +4
cs.ROcs.CVarXiv:2304.00464v22023Act3D: 3D Feature Field Transformers for Multi-Task Robotic Manipulation
Theophile Gervet, Zhou Xian, Nikolaos Gkanatsios +1
cs.ROcs.AIcs.LGarXiv:2306.17817v22023SMILE: Smooth Motion for Improved Long-Horizon VLA Execution
Jongwoo Park, E-Ro Nguyen, Kanchana Ranasinghe +3
cs.ROarXiv:2608.29432v12026DexMachina: Functional Retargeting for Bimanual Dexterous Manipulation
Zhao Mandi, Yifan Hou, Dieter Fox +3
cs.ROcs.AIcs.LGarXiv:2505.24853v12025GeoVLA: Empowering 3D Representations in Vision-Language-Action Models
Lin Sun, Bin Xie, Yingfei Liu +3
cs.ROarXiv:2508.09071v22025ResMimic: From General Motion Tracking to Humanoid Whole-body Loco-Manipulation via Residual Learning
Siheng Zhao, Yanjie Ze, Yue Wang +4
cs.ROcs.LGarXiv:2510.05070v22025Training-Free Action Correction for VLA Model Failures via Language Feedback
Owen Kwon, Pablo Ortega-Kral, Arthur Bucker +1
cs.ROcs.AIarXiv:2608.29967v12026ROI-based Robotic Grasp Detection for Object Overlapping Scenes
Hanbo Zhang, Xuguang Lan, Site Bai +3
cs.ROarXiv:1808.10313v62018