Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

181 to 240 of 3,242

  1. FARM: Reading Failure Signals from the Internal Predictive States of a Frozen Robotic World Model

    Haoran Pei, Mingrui Luo, Senbao Wang +4

    cs.ROarXiv:2609.11445v12026
  2. Safety-aware Skill Adaptation for Reinforcement Learning in Dynamic Environments

    A K M Nadimul Haque, Sheila Sutjipto, Marc G. Carmichael +1

    cs.ROarXiv:2609.11433v12026
  3. SwarmNxt: Open-source Software-Hardware Platform for Fast and Agile Aerial Swarms

    Charbel Toumieh, Niel Mistry, Benjamin Jarvis +4

    cs.ROarXiv:2609.11382v12026
  4. GeoTrussRover: Morphological Computation with Contact-Semantic Control Primitives

    Muyuan Ma, Yi Zhang, Yang Yang +12

    cs.ROcs.GRcs.NEarXiv:2609.11361v12026
  5. Morphology-Aware Human Motion Retargeting for Wheeled-Humanoid Loco-Manipulation

    Chenbo Xia, Chao Ye

    cs.ROarXiv:2609.11357v12026
  6. Modular Kinematic Reduction of Closed-Chain Mechanisms Using Path Assembly and Defect Homotopy

    Mohammad Dastranj, Jouni Mattila

    cs.ROarXiv:2609.11338v12026
  7. 2AM: Grounding Agent-Side Memory as Guidance for Steerable Action Models in Long-Horizon Manipulation

    Yutong Hu, Fengjiao Chen, Xuezhi Cao +1

    cs.ROcs.AIarXiv:2609.11308v12026
  8. Beyond Noise Steering: Dual-Latent Space Reinforcement Learning for Generative Robot Policy

    Pengfei Zhang, Teng Sun, Xianchao Xiu

    cs.ROarXiv:2609.11270v12026
  9. RIDE: Relocalization-Informed Depth Estimation with 3D Gaussian Splatting

    Jiarong Lian, Zhe Xiao, Zhaoyang Zhang +2

    cs.ROarXiv:2609.11079v12026
  10. Harness Robotic OS: A Unified Embodied-Agent Runtime for Closed-Loop Quadruped Inspection

    Yaoyuan Yan, Zhiyou Heng, Haoxiang Jie +3

    cs.ROarXiv:2609.11225v12026
  11. Freehand Sketching for End-User Programming of Robot Swarms

    Riwa Karam, Ian Kuo, Magnus Egerstedt

    cs.ROeess.SYarXiv:2609.11078v12026
  12. Gait-Dependent Effects on Quadruped Locomotion for Load-Carrying using Passive Mechanism

    Giovanni B. Dessy, Claudio Semini, Victor Barasuol

    cs.ROarXiv:2609.11059v12026
  13. LTLDiff: Finite Linear Temporal Logic-Guided Data Generation and Diffusion Policies for Multi-agent Robotic Manipulation

    Chuhan Meng, Haiyan Yin

    cs.ROarXiv:2609.11043v12026
  14. VLA-R1: Enhancing Reasoning in Vision-Language-Action Models

    Angen Ye, Zeyu Zhang, Boyuan Wang +3

    cs.CVcs.ROarXiv:2510.01623v12025
  15. Planning along Differentiable Charts of Constraint Manifolds with General-Purpose IK Solvers

    Thomas Cohn, Seiji Shaw, Harel Biggie +3

    cs.ROarXiv:2609.10905v12026
  16. Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization

    Nikita Kachaev, Mikhail Kolosov, Daniil Zelezetsky +2

    cs.LGcs.AIcs.ROarXiv:2510.25616v12025
  17. Expressive Robotic Pianist: Mastering Complex Piano Repertoire with Graph-Mimic and Musical Dynamics

    Yanhong Liang, Xianwei Liu, Chaojie Fu +7

    cs.ROarXiv:2609.10844v12026
  18. ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMs

    Yizhan Li, Jianxin You, Mengyang Xiong +5

    cs.ROcs.AIarXiv:2609.10895v12026
  19. Nav-R1: Reasoning and Navigation in Embodied Scenes

    Qingxiang Liu, Ting Huang, Zeyu Zhang +1

    cs.ROcs.CVarXiv:2509.10884v12025
  20. Lie-Algebraic Bell Recurrences for Arbitrary-Order Twist Jets and Parallel-Mechanism Closure

    Daniel Condurache

    cs.ROarXiv:2609.10748v12026
  21. When Information is Worth the Risk: Behavioral Valuation for Hazardous Robotic Exploration

    Alkesh K. Srivastava, Aamodh Suresh, Carlos Nieto-Granda +1

    cs.ROarXiv:2609.10726v12026
  22. IMLE-VLA: Fast Single-Step Action Generation for Vision-Language-Action Policies

    Kian Hosseinkhani, Qinhe Peng, George Shramko +6

    cs.ROcs.CVarXiv:2609.10915v12026
  23. MC-DeTra: Motion-Consistent Joint Object Detection and Socially-Aware Trajectory Forecasting in Bird's-Eye-View Images

    Vladislav Diuzhev, Dmitry Yudin

    cs.CVcs.ROarXiv:2609.11717v12026
  24. STyLuS*: A Temporal Logic Optimal Control Synthesis Algorithm for Large-Scale Multi-Robot Systems

    Yiannis Kantaros, Michael M. Zavlanos

    cs.ROarXiv:1809.08345v32018
  25. VLSA: Vision-Language-Action Models with Plug-and-Play Safety Constraint Layer

    Songqiao Hu, Zeyi Liu, Shuang Liu +5

    cs.ROeess.SYarXiv:2512.11891v22025
  26. Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process

    Jiayi Chen, Wenxuan Song, Pengxiang Ding +5

    cs.ROcs.CVarXiv:2511.01718v22025
  27. Residual Off-Policy RL for Finetuning Behavior Cloning Policies

    Lars Ankile, Zhenyu Jiang, Rocky Duan +3

    cs.ROcs.LGarXiv:2509.19301v22025
  28. SimScale: Learning to Drive via Real-World Simulation at Scale

    Haochen Tian, Tianyu Li, Haochen Liu +11

    cs.CVcs.ROarXiv:2511.23369v32025
  29. Control Design along Trajectories with Sums of Squares Programming

    Anirudha Majumdar, Amir Ali Ahmadi, Russ Tedrake

    cs.ROeess.SYmath.OCarXiv:1210.0888v12012
  30. MiMo-Embodied: X-Embodied Foundation Model Technical Report

    Xiaoshuai Hao, Lei Zhou, Zhijian Huang +41

    cs.ROcs.CLcs.CVarXiv:2511.16518v22025
  31. Particle Filter Networks with Application to Visual Localization

    Peter Karkus, David Hsu, Wee Sun Lee

    cs.ROcs.AIcs.CVarXiv:1805.08975v32018
  32. PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image

    Ziang Cao, Fangzhou Hong, Zhaoxi Chen +2

    cs.CVcs.ROarXiv:2511.13648v12025
  33. Evaluation of Vision-Language Models Across Diverse Coastal Environments

    Seth Knoop, Chad R. Samuelson, Gabriel R. Slade +2

    cs.CVcs.ROarXiv:2609.10855v12026
  34. GRADE: Single-Frame Generative Radar Depth Estimation Under Visual Degradation

    Bin Zhao, Patrick Chiou, Nakul Garg

    cs.CVcs.ROarXiv:2609.10756v12026
  35. ORCH: Organizational Principles Enable Collective Intelligence in Embodied AI

    Zhengran Ji, Jonathan Hyun, Boyuan Chen

    cs.MAcs.AIcs.LGarXiv:2609.11737v12026
  36. Evaluating Gemini Robotics Policies in a Veo World Simulator

    Gemini Robotics Team, Krzysztof Choromanski, Coline Devin +20

    cs.ROcs.AIcs.CVarXiv:2512.10675v22025
  37. Reflex-Informed Neuromuscular Reinforcement Learning for Muscle-Driven Locomotion

    Jian Zhou, Xingyu Zhang, Rui Ma +3

    cs.ROcs.GRcs.LGarXiv:2609.11733v12026
  38. Dream2Flow: Bridging Video Generation and Open-World Manipulation with 3D Object Flow

    Karthik Dharmarajan, Wenlong Huang, Jiajun Wu +2

    cs.ROcs.AIcs.CVarXiv:2512.24766v12025
  39. Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents

    Yixian Zhang, Huanming Zhang, Feng Gao +13

    cs.ROarXiv:2607.08448v42026
  40. GR-RL: Going Dexterous and Precise for Long-Horizon Robotic Manipulation

    Yunfei Li, Xiao Ma, Jiafeng Xu +18

    cs.ROcs.LGarXiv:2512.01801v32025
  41. WMPO: World Model-based Policy Optimization for Vision-Language-Action Models

    Fangqi Zhu, Zhengyang Yan, Zicong Hong +3

    cs.ROcs.AIarXiv:2511.09515v12025
  42. Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation

    Huajie Tan, Sixiang Chen, Yijie Xu +12

    cs.ROarXiv:2512.23703v12025
  43. Testing Between the Test Cases: Proving End-to-End Steering in Conditions You Never Drove

    Menuka Ghalan, Charles Rodgers, Zachary D. Asher

    cs.ROcs.LGarXiv:2609.10951v12026
  44. GigaWorld-0: World Models as Data Engine to Empower Embodied AI

    GigaWorld Team, Angen Ye, Boyuan Wang +22

    cs.CVcs.ROarXiv:2511.19861v22025
  45. VLA-0: Building State-of-the-Art VLAs with Zero Modification

    Ankit Goyal, Hugo Hadfield, Xuning Yang +2

    cs.ROcs.AIarXiv:2510.13054v12025
  46. ObstaDiff: Generalizable Diffusion Policy Learning via Obstacle-aware Representations

    Jiawen Wang, Kevin Yao, Khalid Jawed

    cs.ROcs.LGarXiv:2609.10918v12026
  47. HuRo: Robotizing Human Videos for Scalable VLA Pretraining

    Jinho Jeong, Se June Joo, Jaehyun Kang +4

    cs.ROcs.CVcs.LGarXiv:2609.10706v12026
  48. LoGG3D-Net: Locally Guided Global Descriptor Learning for 3D Place Recognition

    Kavisha Vidanapathirana, Milad Ramezani, Peyman Moghadam +2

    cs.CVcs.ROarXiv:2109.08336v32021
  49. Adaptive Bridge: A Proxy-Based Decoupling Layer for Mitigating DDS Backpressure in ROS 2

    Kaushalraj Puwar, B. Thangaraju

    cs.NIcs.ROarXiv:2608.15380v22026
  50. Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction

    Hongyi Chen, Tony Dong, Tiancheng Wu +7

    cs.ROcs.CVarXiv:2602.09013v22026
  51. Simulation-based reinforcement learning for real-world autonomous driving

    Błażej Osiński, Adam Jakubowski, Piotr Miłoś +4

    cs.LGcs.AIcs.ROarXiv:1911.12905v42019
  52. Learning Reward Functions by Integrating Human Demonstrations and Preferences

    Malayandi Palan, Nicholas C. Landolfi, Gleb Shevchuk +1

    cs.ROcs.AIarXiv:1906.08928v12019
  53. Dexterous Imitation Made Easy: A Learning-Based Framework for Efficient Dexterous Manipulation

    Sridhar Pandian Arunachalam, Sneha Silwal, Ben Evans +1

    cs.ROcs.AIcs.CVarXiv:2203.13251v12022
  54. Stable Language Guidance for Vision-Language-Action Models

    Zhihao Zhan, Yuhao Chen, Jiaying Zhou +5

    cs.ROcs.CLarXiv:2601.04052v22026
  55. Cascaded Incremental Nonlinear Dynamic Inversion Control for MAV Disturbance Rejection

    Ewoud J. J. Smeur, Guido C. H. E. de Croon, Qiping Chu

    cs.ROarXiv:1701.07254v22017
  56. Tune to Learn: How Controller Gains Shape Robot Policy Learning

    Antonia Bronars, Younghyo Park, Pulkit Agrawal

    cs.ROarXiv:2604.02523v12026
  57. LaneAF: Robust Multi-Lane Detection with Affinity Fields

    Hala Abualsaud, Sean Liu, David Lu +3

    cs.CVcs.ROarXiv:2103.12040v42021
  58. MemoryWAM: Efficient World Action Modeling with Persistent Memory

    Sizhe Yang, Juncheng Mu, Tianming Wei +8

    cs.ROarXiv:2606.20562v12026
  59. A Real-Time Game Theoretic Planner for Autonomous Two-Player Drone Racing

    Riccardo Spica, Davide Falanga, Eric Cristofalo +3

    cs.ROarXiv:1801.02302v22018
  60. A Distributed Control Framework of Multiple Unmanned Aerial Vehicles for Dynamic Wildfire Tracking

    Huy Xuan Pham, Hung Manh La, David Feil-Seifer +1

    cs.ROarXiv:1803.07926v12018