Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

841 to 900 of 3,243

  1. ProxPI: Proximal Prior Injection for Sampling-Based MPC under Learned-Prior Mismatch

    Euncheol Im, Myotaeg Lim, Yisoo Lee

    cs.ROeess.SYarXiv:2609.00941v12026
  2. AnyTouch 2: General Optical Tactile Representation Learning For Dynamic Tactile Perception

    Ruoxuan Feng, Yuxuan Zhou, Siyu Mei +6

    cs.ROcs.AIcs.CVarXiv:2602.09617v12026
  3. AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control

    Peng Xu, Zhengnan Deng, Jiayan Deng +2

    cs.CVcs.AIcs.ROarXiv:2603.14363v12026
  4. Topological Planning with Transformers for Vision-and-Language Navigation

    Kevin Chen, Junshen K. Chen, Jo Chuang +2

    cs.ROcs.AIcs.CLarXiv:2012.05292v12020
  5. AME-2: Agile and Generalized Legged Locomotion via Attention-Based Neural Map Encoding

    Chong Zhang, Victor Klemm, Fan Yang +1

    cs.ROarXiv:2601.08485v22026
  6. Learning to Generalize Across Long-Horizon Tasks from Human Demonstrations

    Ajay Mandlekar, Danfei Xu, Roberto Martín-Martín +2

    cs.ROcs.AIcs.LGarXiv:2003.06085v22020
  7. TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation

    Yujie Zang, Yuhang Zheng, Xian Nie +7

    cs.ROarXiv:2606.11184v12026
  8. HumanEgo: Zero-Shot Robot Learning from Minutes of Human Egocentric Videos

    Zhi Wang, Botao He, Kelin Yu +4

    cs.ROcs.AIcs.CVarXiv:2605.24934v22026
  9. REFACTOR-VLA: Unsupervised Library Learning of Typed Motor Programs

    Riyaaz Shaik, Chandru Venkataraman

    cs.LGcs.AIcs.ROarXiv:2609.01215v12026
  10. T-Rex: Tactile-Reactive Dexterous Manipulation

    Dantong Niu, Zhuoyang Liu, Zekai Wang +31

    cs.ROarXiv:2606.17055v22026
  11. A Degradation-Tolerance Benchmark for Camera-Only End-to-End Driving

    Haohua Que, Handong Yao

    cs.ROarXiv:2608.29005v12026
  12. Automatic LQR Tuning Based on Gaussian Process Global Optimization

    Alonso Marco, Philipp Hennig, Jeannette Bohg +2

    cs.ROcs.LGeess.SYarXiv:1605.01950v12016
  13. Coding What Matters: A Semantic-Aware Memory Interface for Energy-Efficient Perception in Autonomous Vehicles

    Haohua Que, Handong Yao

    cs.ROarXiv:2608.29000v12026
  14. DOGlove: Dexterous Manipulation with a Low-Cost Open-Source Haptic Force Feedback Glove

    Han Zhang, Songbo Hu, Zhecheng Yuan +1

    cs.ROarXiv:2502.07730v12025
  15. GrandTour: A Legged Robotics Dataset in the Wild for Multi-Modal Perception and State Estimation

    Turcan Tuna, Jonas Frey, Frank Fu +5

    cs.ROarXiv:2602.18164v32026
  16. Pretrained Vision-Language-Action Models are Surprisingly Resistant to Forgetting in Continual Learning

    Huihan Liu, Changyeon Kim, Bo Liu +2

    cs.LGcs.AIcs.ROarXiv:2603.03818v22026
  17. Fail2Drive: Benchmarking Closed-Loop Driving Generalization

    Simon Gerstenecker, Andreas Geiger, Katrin Renz

    cs.ROcs.CVarXiv:2604.08535v12026
  18. LAP: Language-Action Pre-Training Enables Zero-shot Cross-Embodiment Transfer

    Lihan Zha, Asher J. Hancock, Mingtong Zhang +5

    cs.ROcs.AIarXiv:2602.10556v22026
  19. DexWild: Dexterous Human Interactions for In-the-Wild Robot Policies

    Tony Tao, Mohan Kumar Srirama, Jason Jingzhou Liu +2

    cs.ROcs.AIcs.CVarXiv:2505.07813v22025
  20. CLAP: Contrastive Latent Action Pretraining for Learning Vision-Language-Action Models from Human Videos

    Chubin Zhang, Jianan Wang, Zifeng Gao +5

    cs.ROcs.CVarXiv:2601.04061v22026
  21. ReMem-VLA: Empowering Vision-Language-Action Model with Memory via Dual-Level Recurrent Queries

    Hang Li, Fengyi Shen, Dong Chen +6

    cs.ROarXiv:2603.12942v12026
  22. Steerable Vision-Language-Action Policies for Embodied Reasoning and Hierarchical Control

    William Chen, Jagdeep Singh Bhatia, Catherine Glossop +6

    cs.ROarXiv:2602.13193v32026
  23. Vehicle Drift Emergence: Continuous Evolution from Grip Driving to the Handling Limit via Boundary Exploration Learning Model Predictive Control

    Sheng Zhao, Binh-Minh Nguyen, Hangyu Lu +1

    cs.ROarXiv:2608.28723v12026
  24. GANav: Efficient Terrain Segmentation for Robot Navigation in Unstructured Outdoor Environments

    Tianrui Guan, Divya Kothandaraman, Rohan Chandra +3

    cs.ROcs.CVarXiv:2103.04233v52021
  25. Bridging Semantics and Physics with Constrained LLMs for Safe and Trustworthy Robotic Manipulation

    Wenhao Hong, Lan Wei, Dandan Zhang

    cs.ROarXiv:2608.29379v12026
  26. FACTR: Force-Attending Curriculum Training for Contact-Rich Policy Learning

    Jason Jingzhou Liu, Yulong Li, Kenneth Shaw +3

    cs.ROcs.AIcs.CVarXiv:2502.17432v22025
  27. FTP-1: A Generalist Foundation Tactile Policy Across Tactile Sensors for Contact-Rich Manipulation

    Chengbo Yuan, Zicheng Zhang, Mingjie Zhou +14

    cs.ROarXiv:2606.13102v22026
  28. Teacher algorithms for curriculum learning of Deep RL in continuously parameterized environments

    Rémy Portelas, Cédric Colas, Katja Hofmann +1

    cs.LGcs.ROstat.MLarXiv:1910.07224v12019
  29. SpatialCoT: Advancing Spatial Reasoning through Coordinate Alignment and Chain-of-Thought for Embodied Task Planning

    Yuecheng Liu, Dafeng Chi, Shiguang Wu +13

    cs.ROcs.AIcs.CVarXiv:2501.10074v32025
  30. MyoSuite -- A contact-rich simulation suite for musculoskeletal motor control

    Vittorio Caggiano, Huawei Wang, Guillaume Durandau +2

    cs.ROcs.AIcs.LGarXiv:2205.13600v12022
  31. Hiking in the Wild: A Scalable Perceptive Parkour Framework for Humanoids

    Shaoting Zhu, Ziwen Zhuang, Mengjie Zhao +2

    cs.ROcs.AIarXiv:2601.07718v12026
  32. When Vision Overrides Language: Evaluating and Mitigating Counterfactual Failures in VLAs

    Yu Fang, Yuchun Feng, Dong Jing +5

    cs.CVcs.ROarXiv:2602.17659v22026
  33. OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation

    Yushan Liu, Peibo Sun, Shoujie Li +7

    cs.ROarXiv:2605.06481v12026
  34. Large Language Models for Multi-Robot Systems: A Survey

    Peihan Li, Zijian An, Shams Abrar +1

    cs.ROcs.AIarXiv:2502.03814v52025
  35. TextOp: Real-time Interactive Text-Driven Humanoid Robot Motion Generation and Control

    Weiji Xie, Jiakun Zheng, Jinrui Han +4

    cs.ROcs.AIarXiv:2602.07439v12026
  36. Heterogeneous Policy Networks for Composite Robot Team Communication and Coordination

    Esmaeil Seraj, Rohan Paleja, Luis Pimentel +7

    cs.ROcs.MAarXiv:2606.20962v12026
  37. Deep Reinforcement Learning for Autonomous Driving

    Sen Wang, Daoyuan Jia, Xinshuo Weng

    cs.CVcs.LGcs.ROarXiv:1811.11329v32018
  38. Forecasting Trajectory and Behavior of Road-Agents Using Spectral Clustering in Graph-LSTMs

    Rohan Chandra, Tianrui Guan, Srujan Panuganti +4

    cs.ROarXiv:1912.01118v22019
  39. Generalizing Safety Beyond Collision-Avoidance via Latent-Space Reachability Analysis

    Kensuke Nakamura, Lasse Peters, Andrea Bajcsy

    cs.ROcs.LGarXiv:2502.00935v32025
  40. CoT-Drive: Efficient Motion Forecasting for Autonomous Driving with LLMs and Chain-of-Thought Prompting

    Haicheng Liao, Hanlin Kong, Bonan Wang +5

    cs.CVcs.AIcs.ROarXiv:2503.07234v12025
  41. SoFar: Language-Grounded Orientation Bridges Spatial Reasoning and Object Manipulation

    Zekun Qi, Wenyao Zhang, Yufei Ding +15

    cs.ROcs.AIcs.CVarXiv:2502.13143v22025
  42. RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics

    Chan Hee Song, Valts Blukis, Jonathan Tremblay +3

    cs.CVcs.AIcs.CLarXiv:2411.16537v52024
  43. DIAL: Decoupling Intent and Action via Latent World Modeling for End-to-End VLA

    Yi Chen, Yuying Ge, Hui Zhou +3

    cs.ROcs.AIcs.CVarXiv:2603.29844v22026
  44. Contrast-Free Autonomous Navigation of Untethered Endovascular Microrobots Using Single-Plane Fluoroscopy

    Husnu Halid Alabay, Tuan-Anh Le, Ping Wang +1

    cs.ROarXiv:2608.30220v12026
  45. Beyond Sight: Finetuning Generalist Robot Policies with Heterogeneous Sensors via Language Grounding

    Joshua Jones, Oier Mees, Carmelo Sferrazza +3

    cs.ROcs.AIarXiv:2501.04693v32025
  46. UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation

    Oleg Sautenkov, Yasheerah Yaqoot, Artem Lykov +7

    cs.ROcs.AIcs.CVarXiv:2501.05014v22025
  47. Rethinking Language's Role in Efficient VLA for Autonomous Vehicles: Toward Smarter, Trustworthy Driving

    Tongfei Guo, Lili Su

    cs.ROarXiv:2608.30144v12026
  48. DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models

    Zhide Zhong, Junfeng Li, Junjie He +10

    cs.CVcs.ROarXiv:2603.22280v12026
  49. Humanoid-VLA: Towards Universal Humanoid Control with Visual Integration

    Pengxiang Ding, Jianfei Ma, Xinyang Tong +13

    cs.ROcs.CVarXiv:2502.14795v22025
  50. Trajectory Prediction for Autonomous Driving: Progress, Limitations, and Future Directions

    Nadya Abdel Madjid, Abdulrahman Ahmad, Murad Mebrahtu +7

    cs.ROcs.AIcs.CVarXiv:2503.03262v32025
  51. Learning Getting-Up Policies for Real-World Humanoid Robots

    Xialin He, Runpei Dong, Zixuan Chen +1

    cs.ROcs.LGarXiv:2502.12152v22025
  52. Machine Learning-Aided Operations and Communications of Unmanned Aerial Vehicles: A Contemporary Survey

    Harrison Kurunathan, Hailong Huang, Kai Li +2

    cs.ROcs.CVcs.LGarXiv:2211.04324v12022
  53. DALL-E-Bot: Introducing Web-Scale Diffusion Models to Robotics

    Ivan Kapelyukh, Vitalis Vosylius, Edward Johns

    cs.ROcs.CVcs.LGarXiv:2210.02438v32022
  54. End-to-End Deep Reinforcement Learning for Lane Keeping Assist

    Ahmad El Sallab, Mohammed Abdou, Etienne Perot +1

    stat.MLcs.LGcs.ROarXiv:1612.04340v12016
  55. EnerVerse: Envisioning Embodied Future Space for Robotics Manipulation

    Siyuan Huang, Liliang Chen, Pengfei Zhou +8

    cs.ROcs.CVcs.LGarXiv:2501.01895v32025
  56. A0: An Affordance-Aware Hierarchical Model for General Robotic Manipulation

    Rongtao Xu, Jian Zhang, Minghao Guo +11

    cs.ROarXiv:2504.12636v52025
  57. Detecting Unexpected Obstacles for Self-Driving Cars: Fusing Deep Learning and Geometric Modeling

    Sebastian Ramos, Stefan Gehrig, Peter Pinggera +2

    cs.CVcs.ROarXiv:1612.06573v12016
  58. RoboClaw: An Agentic Framework for Scalable Long-Horizon Robotic Tasks

    Ruiying Li, Yunlang Zhou, YuYao Zhu +15

    cs.ROcs.AIarXiv:2603.11558v32026
  59. In-the-Wild Compliant Manipulation with UMI-FT

    Hojung Choi, Yifan Hou, Chuer Pan +5

    cs.ROarXiv:2601.09988v12026
  60. AutoEval: Autonomous Evaluation of Generalist Robot Manipulation Policies in the Real World

    Zhiyuan Zhou, Pranav Atreya, You Liang Tan +2

    cs.ROcs.AIarXiv:2503.24278v22025