Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

1,021 to 1,080 of 3,238

  1. Act3D: 3D Feature Field Transformers for Multi-Task Robotic Manipulation

    Theophile Gervet, Zhou Xian, Nikolaos Gkanatsios +1

    cs.ROcs.AIcs.LGarXiv:2306.17817v22023
  2. SMILE: Smooth Motion for Improved Long-Horizon VLA Execution

    Jongwoo Park, E-Ro Nguyen, Kanchana Ranasinghe +3

    cs.ROarXiv:2608.29432v12026
  3. DexMachina: Functional Retargeting for Bimanual Dexterous Manipulation

    Zhao Mandi, Yifan Hou, Dieter Fox +3

    cs.ROcs.AIcs.LGarXiv:2505.24853v12025
  4. GeoVLA: Empowering 3D Representations in Vision-Language-Action Models

    Lin Sun, Bin Xie, Yingfei Liu +3

    cs.ROarXiv:2508.09071v22025
  5. ResMimic: From General Motion Tracking to Humanoid Whole-body Loco-Manipulation via Residual Learning

    Siheng Zhao, Yanjie Ze, Yue Wang +4

    cs.ROcs.LGarXiv:2510.05070v22025
  6. Training-Free Action Correction for VLA Model Failures via Language Feedback

    Owen Kwon, Pablo Ortega-Kral, Arthur Bucker +1

    cs.ROcs.AIarXiv:2608.29967v12026
  7. ROI-based Robotic Grasp Detection for Object Overlapping Scenes

    Hanbo Zhang, Xuguang Lan, Site Bai +3

    cs.ROarXiv:1808.10313v62018
  8. JoyAI-RA 0.1: A Foundation Model for Robotic Autonomy

    Tianle Zhang, Zhihao Yuan, Dafeng Chi +59

    cs.ROarXiv:2604.20100v22026
  9. GelSight Wedge: Measuring High-Resolution 3D Contact Geometry with a Compact Robot Finger

    Shaoxiong Wang, Yu She, Branden Romero +1

    cs.ROcs.CVarXiv:2106.08851v12021
  10. Asynchronous Cooperative Online Learning for Multi-Robot Control under Computational Delays

    Xiaobing Dai, Zewen Yang, Wei Ren +1

    cs.LGcs.MAcs.ROarXiv:2608.29562v12026
  11. Real2Render2Real: Scaling Robot Data Without Dynamics Simulation or Robot Hardware

    Justin Yu, Letian Fu, Huang Huang +5

    cs.ROarXiv:2505.09601v12025
  12. AnyTouch: Learning Unified Static-Dynamic Representation across Multiple Visuo-tactile Sensors

    Ruoxuan Feng, Jiangyu Hu, Wenke Xia +5

    cs.LGcs.CVcs.ROarXiv:2502.12191v32025
  13. VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators

    Hengtao Li, Pengxiang Ding, Runze Suo +8

    cs.ROcs.CVarXiv:2510.00406v12025
  14. Learning Robust Autonomous Navigation and Locomotion for Wheeled-Legged Robots

    Joonho Lee, Marko Bjelonic, Alexander Reske +3

    cs.ROcs.LGeess.SYarXiv:2405.01792v12024
  15. DiffVLA: Vision-Language Guided Diffusion Planning for Autonomous Driving

    Anqing Jiang, Yu Gao, Zhigang Sun +11

    cs.AIcs.CVcs.ROarXiv:2505.19381v42025
  16. Blind Dexterity: Whole-Body Humanoid Manipulation via Pure Proprioception

    Aditya Bhatt, Oleg Kaidanov, Puze Liu +1

    cs.ROarXiv:2608.29487v12026
  17. Efficient Continuous-Time SLAM for 3D Lidar-Based Online Mapping

    David Droeschel, Sven Behnke

    cs.ROarXiv:1810.06802v12018
  18. VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation

    Chaofan Zhang, Peng Hao, Xiaoge Cao +3

    cs.ROarXiv:2505.09577v12025
  19. Confidence Regularized Self-Training

    Yang Zou, Zhiding Yu, Xiaofeng Liu +2

    cs.CVcs.LGcs.MMarXiv:1908.09822v32019
  20. SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation

    Youqiang Gui, Yuxuan Zhou, Shen Cheng +4

    cs.ROarXiv:2603.05117v42026
  21. Risk-Aware Decision-Making for Autonomous Overtaking: A World Model-Based Mixture-of-Experts Framework

    Yongzhi Liu, Sunan Zhang, Jinchang Xu +4

    cs.ROcs.AIcs.LGarXiv:2609.00385v12026
  22. Hume: Introducing System-2 Thinking in Visual-Language-Action Model

    Haoming Song, Delin Qu, Yuanqi Yao +9

    cs.ROcs.AIarXiv:2505.21432v42025
  23. CLARE: Continual Learning for Vision-Language-Action Models via Autonomous Adapter Routing and Expansion

    Ralf Römer, Yi Zhang, Yuming Li +1

    cs.ROcs.LGarXiv:2601.09512v22026
  24. A Survey on Active Simultaneous Localization and Mapping: State of the Art and New Frontiers

    Julio A. Placed, Jared Strader, Henry Carrillo +4

    cs.ROarXiv:2207.00254v22022
  25. Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies

    Chen Xu, Tony Khuong Nguyen, Emma Dixon +7

    cs.ROcs.AIcs.LGarXiv:2503.08558v32025
  26. Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on Humanoids

    Toru Lin, Kartik Sachdev, Linxi Fan +2

    cs.ROcs.AIcs.CVarXiv:2502.20396v22025
  27. HITTER: A HumanoId Table TEnnis Robot via Hierarchical Planning and Learning

    Zhi Su, Bike Zhang, Nima Rahmanian +5

    cs.ROarXiv:2508.21043v22025
  28. CIG-RL: Curiosity-Driven Information-Guided Reinforcement Learning for Source Term Estimation in Uncertain Environments

    Junhee Lee, Seunghwan Kim, Hongro Jang +4

    cs.ROarXiv:2608.30673v12026
  29. Humanoid Locomotion and Manipulation: Current Progress and Challenges in Control, Planning, and Learning

    Zhaoyuan Gu, Junheng Li, Wenlan Shen +15

    cs.ROarXiv:2501.02116v22025
  30. InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation

    Shuai Yang, Hao Li, Bin Wang +7

    cs.ROcs.CVarXiv:2507.17520v22025
  31. Any6D: Model-free 6D Pose Estimation of Novel Objects

    Taeyeop Lee, Bowen Wen, Minjun Kang +3

    cs.CVcs.AIcs.ROarXiv:2503.18673v22025
  32. Integrating Traffic Noise Emission Modelling into Variable Speed Limit Control

    Jiawen Meng, John Pravin Arockiasamy, Alexey Vinel

    cs.ROarXiv:2609.01339v12026
  33. Mimic Intent, Not Just Trajectories

    Renming Huang, Chendong Zeng, Wenjing Tang +3

    cs.ROarXiv:2602.08602v32026
  34. Point Policy: Unifying Observations and Actions with Key Points for Robot Manipulation

    Siddhant Haldar, Lerrel Pinto

    cs.ROarXiv:2502.20391v12025
  35. Monocular Semantic Occupancy Grid Mapping with Convolutional Variational Encoder-Decoder Networks

    Chenyang Lu, Marinus Jacobus Gerardus van de Molengraft, Gijs Dubbelman

    cs.ROcs.CVarXiv:1804.02176v32018
  36. Context-Aware Intelligent Vehicles

    Liangkai Liu, Shuyao Shi, Mingke Wang +4

    cs.ROcs.ETeess.SYarXiv:2609.00682v12026
  37. Robust Autonomy Emerges from Self-Play

    Marco Cusumano-Towner, David Hafner, Alex Hertzberg +9

    cs.LGcs.AIcs.ROarXiv:2502.03349v12025
  38. Keep Rollin' - Whole-Body Motion Control and Planning for Wheeled Quadrupedal Robots

    Marko Bjelonic, C. Dario Bellicoso, Yvain de Viragh +4

    cs.ROarXiv:1809.03557v22018
  39. A Review of Surface Haptics:Enabling Tactile Effects on Touch Surfaces

    Cagatay Basdogan, Frederic Giraud, Vincent Levesque +1

    cs.HCcs.ROarXiv:2004.13864v12020
  40. CLONE: Closed-Loop Whole-Body Humanoid Teleoperation for Long-Horizon Tasks

    Yixuan Li, Yutang Lin, Jieming Cui +4

    cs.ROarXiv:2506.08931v22025
  41. PD-VLA: Accelerating Vision-Language-Action Model Integrated with Action Chunking via Parallel Decoding

    Wenxuan Song, Jiayi Chen, Pengxiang Ding +9

    cs.ROcs.CVarXiv:2503.02310v22025
  42. Efficient Optical flow and Stereo Vision for Velocity Estimation and Obstacle Avoidance on an Autonomous Pocket Drone

    Kimberly McGuire, Guido de Croon, Christophe De Wagter +2

    cs.ROarXiv:1612.06702v22016
  43. DexGrasp Anything: Towards Universal Robotic Dexterous Grasping with Physics Awareness

    Yiming Zhong, Qi Jiang, Jingyi Yu +1

    cs.CVcs.AIcs.ROarXiv:2503.08257v22025
  44. BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models

    Peiyan Li, Yixiang Chen, Hongtao Wu +6

    cs.ROcs.AIarXiv:2506.07961v22025
  45. VGGT-SLAM 2.0: Real-time Dense Feed-forward Scene Reconstruction

    Dominic Maggio, Luca Carlone

    cs.CVcs.ROarXiv:2601.19887v22026
  46. Learning Generalizable Robotic Reward Functions from "In-The-Wild" Human Videos

    Annie S. Chen, Suraj Nair, Chelsea Finn

    cs.ROcs.AIcs.CVarXiv:2103.16817v12021
  47. An informative path planning framework for UAV-based terrain monitoring

    Marija Popovic, Teresa Vidal-Calleja, Gregory Hitz +4

    cs.ROarXiv:1809.03870v32018
  48. VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers

    Yating Wang, Haoyi Zhu, Mingyu Liu +3

    cs.ROcs.CVarXiv:2507.01016v12025
  49. TrackVLA: Embodied Visual Tracking in the Wild

    Shaoan Wang, Jiazhao Zhang, Minghan Li +7

    cs.ROcs.CVarXiv:2505.23189v12025
  50. DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting

    Yuxuan Gao, Shiqi Zhang, Yedong Shen +6

    cs.ROarXiv:2608.29749v12026
  51. Generalized Trajectory Scoring for End-to-end Multimodal Planning

    Zhenxin Li, Wenhao Yao, Zi Wang +7

    cs.ROcs.CVarXiv:2506.06664v12025
  52. Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey

    Rui Shao, Wei Li, Lingsen Zhang +4

    cs.ROcs.CVarXiv:2508.13073v32025
  53. Module Number Adaptive Visual Shape Control for Serial Modular Soft Robots

    Kyohei Akamine, Takato Horii, Yusuke Sakaue +1

    cs.ROarXiv:2608.29547v12026
  54. Urban Driver: Learning to Drive from Real-world Demonstrations Using Policy Gradients

    Oliver Scheel, Luca Bergamini, Maciej Wołczyk +2

    cs.ROcs.AIcs.CVarXiv:2109.13333v12021
  55. Text2Reward: Reward Shaping with Language Models for Reinforcement Learning

    Tianbao Xie, Siheng Zhao, Chen Henry Wu +5

    cs.LGcs.AIcs.CLarXiv:2309.11489v32023
  56. ApexNav: An Adaptive Exploration Strategy for Zero-Shot Object Navigation with Target-centric Semantic Fusion

    Mingjie Zhang, Yuheng Du, Chengkai Wu +4

    cs.ROarXiv:2504.14478v32025
  57. A Survey on Vision-Language-Action Models for Autonomous Driving

    Sicong Jiang, Zilin Huang, Kangan Qian +17

    cs.CVcs.AIcs.ROarXiv:2506.24044v12025
  58. Motubrain: An Advanced World Action Model for Robot Control

    Motubrain Team, Chendong Xiang, Fan Bao +17

    cs.ROarXiv:2604.27792v52026
  59. UAVs Meet LLMs: Overviews and Perspectives Toward Agentic Low-Altitude Mobility

    Yonglin Tian, Fei Lin, Yiduo Li +11

    cs.ROcs.AIarXiv:2501.02341v22025
  60. Humanoid Policy ~ Human Policy

    Ri-Zhao Qiu, Shiqi Yang, Xuxin Cheng +12

    cs.ROcs.AIcs.CVarXiv:2503.13441v32025