Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

1 to 60 of 3,241

  1. TeLoGraF: Temporal Logic Planning via Graph-encoded Flow Matching

    Yue Meng, Chuchu Fan

    cs.ROcs.AIcs.FLarXiv:2505.00562v12025
  2. GRAPE: Generalizing Robot Policy via Preference Alignment

    Zijian Zhang, Kaiyuan Zheng, Zhaorun Chen +7

    cs.ROcs.CVcs.LGarXiv:2411.19309v22024
  3. Vision-Language-Action Safety: Threats, Challenges, Evaluations, and Mechanisms

    Qi Li, Bo Yin, Weiqi Huang +6

    cs.ROarXiv:2604.23775v22026
  4. ArtVIP: Articulated Digital Assets of Visual Realism, Modular Interaction, and Physical Fidelity for Robot Learning

    Zhao Jin, Zhengping Che, Tao Li +10

    cs.ROarXiv:2506.04941v32025
  5. Habitat-Web: Learning Embodied Object-Search Strategies from Human Demonstrations at Scale

    Ram Ramrakhya, Eric Undersander, Dhruv Batra +1

    cs.AIcs.CVcs.ROarXiv:2204.03514v22022
  6. Social Interactions for Autonomous Driving: A Review and Perspectives

    Wenshuo Wang, Letian Wang, Chengyuan Zhang +2

    cs.ROcs.HCarXiv:2208.07541v52022
  7. Reaching the Limit in Autonomous Racing: Optimal Control versus Reinforcement Learning

    Yunlong Song, Angel Romero, Matthias Mueller +2

    cs.ROcs.LGarXiv:2310.10943v22023
  8. Large Language Models for Robotics: A Survey

    Fanlong Zeng, Wensheng Gan, Zezheng Huai +5

    cs.ROcs.AIarXiv:2311.07226v22023
  9. Memory-Bound but Not Bandwidth-Limited: The Physical AI Inference Gap in Batch-1 LLM Decode

    Josef Chen

    cs.ARcs.AIcs.DCarXiv:2605.30571v12026
  10. Learning High-Speed Flight in the Wild

    Antonio Loquercio, Elia Kaufmann, René Ranftl +3

    cs.ROcs.LGeess.SYarXiv:2110.05113v12021
  11. Implicit Behavioral Cloning

    Pete Florence, Corey Lynch, Andy Zeng +7

    cs.ROcs.CVcs.LGarXiv:2109.00137v12021
  12. From Multi-Fisheye Sensing to Panoramic Perception: A Parallax-Aware Onboard Platform for Ultra-Low-Altitude UAVs

    Dun Dai, Ze Lu, Cheng He +2

    cs.ROarXiv:2609.02319v12026
  13. A Dynamic Toolkit for Transmission Characteristics of Precision Reducers with Explicit Contact Geometry

    Jiacheng Miao, Chao Liu, Qiliang Wang +2

    cs.ROeess.SYarXiv:2604.02387v22026
  14. World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry

    Yuejiang Liu, Fan Feng, Lingjing Kong +6

    cs.LGcs.AIcs.ROarXiv:2604.01985v22026
  15. Background-Free Objectness Learning for Class-Agnostic Detection

    Dania Batool, Liliana Lo Presti, Marco La Cascia +1

    cs.CVcs.AIcs.ROarXiv:2608.29232v12026
  16. Continuous-Time Gaussian Process Motion Planning via Probabilistic Inference

    Mustafa Mukadam, Jing Dong, Xinyan Yan +2

    cs.ROarXiv:1707.07383v32017
  17. From Small Talk to Rapport: Exploring Robot Self-Disclosure in Collaborative Tasks

    Kaitlynn Taylor Pineda, Anvii Mishra, Brian Chien +4

    cs.ROarXiv:2608.28154v12026
    Summaries:日本語
  18. VIP: Variation-based Iterative-learning Planning for Robotic Navigation

    Shuli Lv, Pengda Mao, Chen Min +4

    cs.ROarXiv:2608.24618v12026
  19. MapAnything: Universal Feed-Forward Metric 3D Reconstruction

    Nikhil Keetha, Norman Müller, Johannes Schönberger +14

    cs.CVcs.AIcs.LGarXiv:2509.13414v32025
  20. VLA-Adapter: An Effective Paradigm for Tiny-Scale Vision-Language-Action Model

    Yihao Wang, Pengxiang Ding, Lingxiao Li +13

    cs.ROarXiv:2509.09372v22025
  21. HAF: Adapting Generalist VLAs to Humanoid Whole-Body Loco-manipulation via Hierarchical Action Flow and Spectral Latent RL

    Langzhe Gu, Chengkai Hou, Meng Li +14

    cs.ROcs.AIarXiv:2608.16837v12026
  22. SimLingo: Vision-Only Closed-Loop Autonomous Driving with Language-Action Alignment

    Katrin Renz, Long Chen, Elahe Arani +1

    cs.CVcs.ROarXiv:2503.09594v12025
  23. Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills

    Gaytri Jena, Kapil Wanaskar, Vinija Jain +3

    cs.ROcs.AIarXiv:2608.01851v12026
  24. Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model

    Xinghang Li, Jun Guo, Qiwei Li +21

    cs.ROcs.AIarXiv:2607.11643v12026
  25. RoboTALES: Learning Reasoning-Guided Robot Policies via Task-Aligned Simulated Futures

    Hanan Gani, Tejal Kulkarni, Madhoolika Chodavarapu +2

    cs.ROarXiv:2607.06018v12026
  26. Velocity/Position Integration Formula (I): Application to In-flight Coarse Alignment

    Yuanxin Wu, Xianfei Pan

    cs.ROarXiv:1207.1550v12012
  27. World Action Models: A Survey

    Qiuhong Shen, Shihua Zhang, Yue Liao +5

    cs.ROcs.CVarXiv:2606.20781v12026
  28. SkyJEPA: Learning Long-Horizon World Models for Zero-Shot Sim-to-Real Control of Quadrotors

    Pratyaksh Rao, Wancong Zhang, Randall Balestriero +2

    cs.ROcs.LGarXiv:2606.23444v22026
  29. Visual Representation Learning with Stochastic Frame Prediction

    Huiwon Jang, Dongyoung Kim, Junsu Kim +3

    cs.CVcs.AIcs.LGarXiv:2406.07398v22024
  30. Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware

    Tony Z. Zhao, Vikash Kumar, Sergey Levine +1

    cs.ROcs.LGarXiv:2304.13705v12023
  31. Automating the Design of Embodied Agent Architectures

    Jian Zhou, Sihao Lin, Jin Li +3

    cs.ROcs.AIcs.LGarXiv:2606.30111v22026
  32. DynaFLIP: Rethinking Robotics Perception via Tri-Modal-Dynamics Guided Representation

    Jusuk Lee, Seungjae Lee, Jonghun Shin +6

    cs.ROcs.LGarXiv:2605.30350v12026
  33. Efficient Differentiable Simulation of Articulated Bodies

    Yi-Ling Qiao, Junbang Liang, Vladlen Koltun +1

    cs.LGcs.GRcs.ROarXiv:2109.07719v12021
  34. WAVE-Go: World-Model Navigation with Adaptive Execution for Wheel-Legged Robots

    Mingyi Li, Ji Li, Zhihao Ouyang +2

    cs.ROarXiv:2609.18193v12026
  35. Real-Time Service Robot Replanning via Simple Button Interaction for Improved Task Success and User Experience

    Ryo Terashima, Yuga Yano, Koshun Arimura +1

    cs.ROcs.HCarXiv:2609.17541v12026
  36. Human-Centric Grasp State Assessment: Toward Transferring Subjective Evaluation to Robots

    Ryohei Kobayashi, Kosei Isomoto, Yuga Yano +2

    cs.ROarXiv:2609.17540v12026
  37. PRISM: Predictive Representation of Interaction Style and Motion for Social Robot Navigation

    Bo-Han Chen, Hiromu Taketsugu, Norimichi Ukita

    cs.CVcs.ROarXiv:2609.18125v12026
  38. WholeBodyWAM: Learning Whole-Body World Action Models with Scalable Motion Priors

    Bowei Zhang, Qiyao Zhang, Shuanghao Bai +8

    cs.ROarXiv:2609.18197v12026
  39. In-Context Robot Learning with VLM Agents

    Dongzhou Cheng, Taoran Yi, Ye Fang +12

    cs.CVcs.ROarXiv:2609.19138v12026
  40. Energy-Regularized Imitation Learning for Force- and Work-Aware Robotic Manipulation

    Toshiki Otani, Hiromu Taketsugu, Norimichi Ukita

    cs.ROcs.CVarXiv:2609.18164v12026
  41. MVP-LAM: Learning Action-Centric Latent Action via Cross-Viewpoint Reconstruction

    Jung Min Lee, Dohyeok Lee, Seokhun Ju +5

    cs.ROcs.CVarXiv:2602.03668v32026
  42. Beyond Pixel Similarity: Task-Aware Evaluation of GAN-Based Synthetic Sonar Data for Robotic Perception

    Hannan Ejaz Keen, Muhammad Moazam Fraz, Karsten Berns

    cs.ROcs.CVcs.LGarXiv:2609.18100v12026
  43. An Efficient Algorithm for Minimum-Pressure Growth Planning of Vine Robots

    Andres C. Torres, Tobia Marcucci, Elliot W. Hawkes

    cs.ROarXiv:2609.18070v12026
  44. Characterizing Replay Retention Under Dynamics Shift in Model-Based Reinforcement Learning

    Everest Yang, Skye Thompson, George D. Konidaris

    cs.ROcs.LGarXiv:2609.18167v12026
  45. Act2Goal: From World Model To General Goal-conditioned Policy

    Pengfei Zhou, Liliang Chen, Shengcong Chen +5

    cs.ROcs.AIarXiv:2512.23541v12025
  46. Convergence and Consistency Analysis for A 3D Invariant-EKF SLAM

    Teng Zhang, Kanzhi Wu, Jingwei Song +2

    cs.ROarXiv:1702.06680v12017
  47. Fetch My Beer: Synthetic-to-real Hierarchical Policy for Smooth Pick-and-place

    Yingyue Li, Chenyangguang Zhang, Ruida Zhang +3

    cs.ROarXiv:2609.18119v12026
  48. A Comprehensive Review of Generative Physical Artificial Intelligence

    Satyam Gaba, Krutiksinh Rana, Siva Sai +2

    cs.ROcs.AIcs.CLarXiv:2609.18111v12026
  49. Residual Fault Adaptation for Dexterous In-Hand Manipulation Under Runtime Joint Faults

    Linan Deng, Xing Liu, Lin Hong +4

    cs.ROarXiv:2609.17404v12026
  50. LOTUSim-Energy: A Maritime Simulator for Human-Drone Interaction in Autonomous Offshore Operation \& Maintenance

    Juliette Grosset, Marie Dubromel, Hélène Lechêne +2

    cs.ROarXiv:2609.17124v12026
  51. Rethinking Visual Embodiment Dependence in Visuomotor Policies

    Hongjie Fang, Yuxuan Lu, Chenxi Wang +8

    cs.ROarXiv:2609.16815v12026
  52. Exact Fusion and Coordinated Exploration in Multi-Robot Active Inference

    Peng Wu, Mohsen Imani, Amidu Kamara +3

    cs.ROcs.MAarXiv:2609.17384v12026
  53. Offline Reinforcement Learning from Images with Latent Space Models

    Rafael Rafailov, Tianhe Yu, Aravind Rajeswaran +1

    cs.LGcs.AIcs.ROarXiv:2012.11547v12020
  54. Discrete Diffusion for Reflective Vision-Language-Action Models in Autonomous Driving

    Pengxiang Li, Yinan Zheng, Yue Wang +6

    cs.ROcs.AIcs.CLarXiv:2509.20109v12025
  55. ActionPiece: Rethinking Action Tokenization for Autoregressive Vision-Language-Action Models

    Shijie Lian, Bin Yu, Zhaolong Shen +5

    cs.ROcs.AIcs.CLarXiv:2609.18487v12026
  56. Gaussian Processes for Modelling Spatial Fields with Robot Swarms

    Guillermo Legarda Herranz, Gianpiero Francesca, Mauro Birattari

    cs.ROarXiv:2609.17463v12026
  57. Scenario-Independent Criticality Assessment and Prediction for Vulnerable Road Users in Autonomous Driving

    Jörg Gamerdinger, Victor Schwarzenberger, Philipp Schmid +2

    cs.ROcs.CVcs.CYarXiv:2609.11947v12026
  58. General Evaluation for Instruction Conditioned Navigation using Dynamic Time Warping

    Gabriel Ilharco, Vihan Jain, Alexander Ku +2

    cs.ROcs.AIcs.CLarXiv:1907.05446v22019
  59. SensatUrban: Learning Semantics from Urban-Scale Photogrammetric Point Clouds

    Qingyong Hu, Bo Yang, Sheikh Khalid +3

    cs.CVcs.ROarXiv:2201.04494v12022
  60. Learning Options for Compositional Motor Control with Adapter Banks

    Sreejan Kumar, Marcelo Mattar, Lea Duncker

    cs.LGcs.ROq-bio.NCarXiv:2609.17042v12026