Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

961 to 1,020 of 3,237

  1. Igniting VLMs toward the Embodied Space

    Andy Zhai, Brae Liu, Bruno Fang +17

    cs.ROarXiv:2509.11766v12025
  2. Deep Drone Acrobatics

    Elia Kaufmann, Antonio Loquercio, René Ranftl +3

    cs.ROarXiv:2006.05768v22020
  3. An Integrated Framework of Decision Making and Motion Planning for Autonomous Vehicles Considering Social Behaviors

    Peng Hang, Chen Lv, Chao Huang +3

    eess.SYcs.ROarXiv:2005.11059v12020
  4. Reinforced Imitation: Sample Efficient Deep Reinforcement Learning for Map-less Navigation by Leveraging Prior Demonstrations

    Mark Pfeiffer, Samarth Shukla, Matteo Turchetta +4

    cs.ROarXiv:1805.07095v22018
  5. Emotion in Reinforcement Learning Agents and Robots: A Survey

    Thomas M. Moerland, Joost Broekens, Catholijn M. Jonker

    cs.LGcs.AIcs.HCarXiv:1705.05172v12017
  6. Waypoint Models for Instruction-guided Navigation in Continuous Environments

    Jacob Krantz, Aaron Gokaslan, Dhruv Batra +2

    cs.CVcs.CLcs.ROarXiv:2110.02207v12021
  7. ARTEMIS: Autoregressive End-to-End Trajectory Planning with Mixture of Experts for Autonomous Driving

    Renju Feng, Ning Xi, Duanfeng Chu +6

    cs.ROarXiv:2504.19580v22025
  8. ReWiND: Language-Guided Rewards Teach Robot Policies without New Demonstrations

    Jiahui Zhang, Yusen Luo, Abrar Anwar +5

    cs.ROarXiv:2505.10911v22025
  9. Dual Process Motion Planning

    Jiayi Yan, Francesco Fabiano, Alessandro Abate

    cs.AIcs.ROarXiv:2609.01260v12026
  10. Driving on Registers

    Ellington Kirby, Alexandre Boulch, Yihong Xu +11

    cs.CVcs.AIcs.ROarXiv:2601.05083v22026
  11. WorldEval: World Model as Real-World Robot Policies Evaluator

    Yaxuan Li, Yichen Zhu, Junjie Wen +2

    cs.ROcs.CVcs.LGarXiv:2505.19017v12025
  12. GENMO: A GENeralist Model for Human MOtion

    Jiefeng Li, Jinkun Cao, Haotian Zhang +4

    cs.GRcs.AIcs.CVarXiv:2505.01425v12025
  13. Tactical Rewind: Self-Correction via Backtracking in Vision-and-Language Navigation

    Liyiming Ke, Xiujun Li, Yonatan Bisk +6

    cs.CLcs.CVcs.LGarXiv:1903.02547v22019
  14. Novel Demonstration Generation with Gaussian Splatting Enables Robust One-Shot Manipulation

    Sizhe Yang, Wenye Yu, Jia Zeng +5

    cs.ROarXiv:2504.13175v12025
  15. Multimodal Fusion and Vision-Language Models: A Survey for Robot Vision

    Xiaofeng Han, Shunpeng Chen, Zenghuang Fu +9

    cs.ROcs.CVarXiv:2504.02477v32025
  16. Global Planning for Contact-Rich Manipulation via Local Smoothing of Quasi-dynamic Contact Models

    Tao Pang, H. J. Terry Suh, Lujie Yang +1

    cs.ROarXiv:2206.10787v22022
  17. Recovery RL: Safe Reinforcement Learning with Learned Recovery Zones

    Brijen Thananjeyan, Ashwin Balakrishna, Suraj Nair +7

    cs.LGcs.AIcs.ROarXiv:2010.15920v22020
  18. PORCA: Modeling and Planning for Autonomous Driving among Many Pedestrians

    Yuanfu Luo, Panpan Cai, Aniket Bera +3

    cs.ROarXiv:1805.11833v22018
  19. AGM: Achievement-Grounded Memory for Closed-Loop Agents with Frozen VLA Policies

    Hongbo Gao, Zeyu Ni, Xin Wen +2

    cs.ROcs.AIarXiv:2608.29537v12026
  20. Masquerade: Learning from In-the-wild Human Videos using Data-Editing

    Marion Lepert, Jiaying Fang, Jeannette Bohg

    cs.ROarXiv:2508.09976v12025
  21. URLB: Unsupervised Reinforcement Learning Benchmark

    Michael Laskin, Denis Yarats, Hao Liu +6

    cs.LGcs.AIcs.ROarXiv:2110.15191v12021
  22. Toward Trustworthy Robot-Assisted Sliding Palpation for Shallow Vessel Localisation with a Calibrated Digital Twin

    Piotr Blaszyk, Wen Fan, Kaizhong Deng +2

    cs.ROarXiv:2608.29396v12026
  23. Ross3D: Reconstructive Visual Instruction Tuning with 3D-Awareness

    Haochen Wang, Yucheng Zhao, Tiancai Wang +3

    cs.CVcs.AIcs.CLarXiv:2504.01901v12025
  24. Generalizable Multi-Agent Planning from Signal Temporal Logic Specifications via Diffusion

    Joe Eappen, Zikang Xiong, Shreyash S. Iyengar +1

    cs.MAcs.AIcs.ROarXiv:2608.29490v12026
  25. Self-Aware Active Learning Enables Continual Improvement in Autonomous Driving

    Dong Hu, Chao Huang, Carman K. M. Lee +1

    cs.ROarXiv:2608.29772v12026
  26. RoboVerse: Towards a Unified Platform, Dataset and Benchmark for Scalable and Generalizable Robot Learning

    Haoran Geng, Feishi Wang, Songlin Wei +34

    cs.ROarXiv:2504.18904v12025
  27. A Survey: Learning Embodied Intelligence from Physical Simulators and World Models

    Xiaoxiao Long, Qingrui Zhao, Kaiwen Zhang +15

    cs.ROarXiv:2507.00917v32025
  28. A Wearable Pneumatic Device for Continuous, Closed-Loop, Bidirectional Tactile Interaction

    Cosima du Pasquier, Aliyah Smith, Serin Huber +5

    cs.ROarXiv:2609.00612v12026
    Summaries:한국어
  29. VidBot: Learning Generalizable 3D Actions from In-the-Wild 2D Human Videos for Zero-Shot Robotic Manipulation

    Hanzhi Chen, Boyang Sun, Anran Zhang +2

    cs.ROcs.CVarXiv:2503.07135v22025
  30. A new closed-loop output error method for parameter identification of robot dynamics

    Maxime Gautier, Alexandre Janot, Pierre-Olivier Vandanjon

    cs.ROarXiv:1009.4556v12010
  31. CGFM-Nav: Cognitive Graph-Field Memory for Semantic-Guided Lifelong Multimodal Embodied Navigation

    Yuxiang Xiao, Xibei Chen, Xin Zhou +3

    cs.ROcs.AIarXiv:2608.29114v12026
  32. AVID: Learning Multi-Stage Tasks via Pixel-Level Translation of Human Videos

    Laura Smith, Nikita Dhawan, Marvin Zhang +2

    cs.ROcs.CVcs.LGarXiv:1912.04443v32019
  33. WMNav: Integrating Vision-Language Models into World Models for Object Goal Navigation

    Dujun Nie, Xianda Guo, Yiqun Duan +2

    cs.CVcs.ROarXiv:2503.02247v52025
  34. Multimodal Probabilistic Model-Based Planning for Human-Robot Interaction

    Edward Schmerling, Karen Leung, Wolf Vollprecht +1

    cs.ROcs.LGarXiv:1710.09483v12017
  35. Beyond Object Selection:Markerless Gaze-based Robot Placement at Arbitrary Position

    Yuzhi Lai, William Marx, Shenghai Yuan +3

    cs.ROarXiv:2609.00478v12026
  36. Kimodo: Scaling Controllable Human Motion Generation

    Davis Rempe, Mathis Petrovich, Ye Yuan +21

    cs.CVcs.GRcs.ROarXiv:2603.15546v12026
  37. Not All Agreement Counts as Corroboration: Provenance-Conserving Multi-View Fusion for Typed Action Admission in Human-Robot Collaboration

    Zekai Jin, Hanrong Zhang, Yihong Tang +3

    cs.ROcs.AIarXiv:2609.01662v12026
  38. Urban Driving with Conditional Imitation Learning

    Jeffrey Hawke, Richard Shen, Corina Gurau +8

    cs.CVcs.AIcs.LGarXiv:1912.00177v22019
  39. EmbodiedScan: A Holistic Multi-Modal 3D Perception Suite Towards Embodied AI

    Tai Wang, Xiaohan Mao, Chenming Zhu +11

    cs.CVcs.AIcs.ROarXiv:2312.16170v12023
  40. On the Limitations of Representing Functions on Sets

    Edward Wagstaff, Fabian B. Fuchs, Martin Engelcke +2

    cs.LGcs.AIcs.NEarXiv:1901.09006v22019
  41. Scaling Proprioceptive-Visual Learning with Heterogeneous Pre-trained Transformers

    Lirui Wang, Xinlei Chen, Jialiang Zhao +1

    cs.ROcs.CVcs.LGarXiv:2409.20537v12024
  42. 3D and 4D World Modeling: A Survey

    Lingdong Kong, Yu Yang, Jianbiao Mei +20

    cs.CVcs.ROarXiv:2509.07996v42025
  43. Federated Learning in the Sky: Joint Power Allocation and Scheduling with UAV Swarms

    Tengchan Zeng, Omid Semiari, Mohammad Mozaffari +3

    cs.LGcs.ITcs.ROarXiv:2002.08196v22020
  44. Raw2Drive: Reinforcement Learning with Aligned World Models for End-to-End Autonomous Driving (in CARLA v2)

    Zhenjie Yang, Xiaosong Jia, Qifeng Li +3

    cs.ROcs.AIcs.CVarXiv:2505.16394v22025
  45. Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning

    Juntao Ren, Priya Sundaresan, Dorsa Sadigh +2

    cs.ROcs.AIcs.LGarXiv:2501.06994v22025
  46. PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation

    Wenlong Huang, Yu-Wei Chao, Arsalan Mousavian +4

    cs.ROcs.AIcs.CVarXiv:2601.03782v12026
  47. Elevation Mapping for Locomotion and Navigation using GPU

    Takahiro Miki, Lorenz Wellhausen, Ruben Grandia +3

    cs.ROarXiv:2204.12876v12022
  48. PAVE: Predictive Alignment and Value-Guided Evolution for World-Action Policies

    Botong Zhao, Fang Yu, Tim Yu +3

    cs.ROcs.AIarXiv:2608.30378v22026
  49. CometVLA: Co-Training on an Embodied Data Pyramid towards Physical Understanding

    Hanwen Wan, Dafeng Chi, Linbo Zhai +6

    cs.ROarXiv:2608.30289v12026
  50. CanonNav: Disentangling Navigation Behavior from Camera Geometry in Cross-Platform Visual Navigation

    Dong-Wook Kim, Ji-Hoon Hwang, E-In Son +2

    cs.ROarXiv:2608.30242v12026
  51. $Ψ_0$: An Open Foundation Model Towards Universal Humanoid Loco-Manipulation

    Songlin Wei, Hongyi Jing, Boqian Li +12

    cs.ROarXiv:2603.12263v12026
  52. OmniVTLA: Vision-Tactile-Language-Action Models with Semantic-Aligned Tactile Sensing

    Zhengxue Cheng, Yiqian Zhang, Anni Tang +5

    cs.ROarXiv:2508.08706v32025
  53. UniDexGrasp++: Improving Dexterous Grasping Policy Learning via Geometry-aware Curriculum and Iterative Generalist-Specialist Learning

    Weikang Wan, Haoran Geng, Yun Liu +4

    cs.ROcs.CVarXiv:2304.00464v22023
  54. Act3D: 3D Feature Field Transformers for Multi-Task Robotic Manipulation

    Theophile Gervet, Zhou Xian, Nikolaos Gkanatsios +1

    cs.ROcs.AIcs.LGarXiv:2306.17817v22023
  55. SMILE: Smooth Motion for Improved Long-Horizon VLA Execution

    Jongwoo Park, E-Ro Nguyen, Kanchana Ranasinghe +3

    cs.ROarXiv:2608.29432v12026
  56. DexMachina: Functional Retargeting for Bimanual Dexterous Manipulation

    Zhao Mandi, Yifan Hou, Dieter Fox +3

    cs.ROcs.AIcs.LGarXiv:2505.24853v12025
  57. GeoVLA: Empowering 3D Representations in Vision-Language-Action Models

    Lin Sun, Bin Xie, Yingfei Liu +3

    cs.ROarXiv:2508.09071v22025
  58. ResMimic: From General Motion Tracking to Humanoid Whole-body Loco-Manipulation via Residual Learning

    Siheng Zhao, Yanjie Ze, Yue Wang +4

    cs.ROcs.LGarXiv:2510.05070v22025
  59. Training-Free Action Correction for VLA Model Failures via Language Feedback

    Owen Kwon, Pablo Ortega-Kral, Arthur Bucker +1

    cs.ROcs.AIarXiv:2608.29967v12026
  60. ROI-based Robotic Grasp Detection for Object Overlapping Scenes

    Hanbo Zhang, Xuguang Lan, Site Bai +3

    cs.ROarXiv:1808.10313v62018