Robotics
Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
181 to 240 of 3,242
FARM: Reading Failure Signals from the Internal Predictive States of a Frozen Robotic World Model
Haoran Pei, Mingrui Luo, Senbao Wang +4
cs.ROarXiv:2609.11445v12026Safety-aware Skill Adaptation for Reinforcement Learning in Dynamic Environments
A K M Nadimul Haque, Sheila Sutjipto, Marc G. Carmichael +1
cs.ROarXiv:2609.11433v12026SwarmNxt: Open-source Software-Hardware Platform for Fast and Agile Aerial Swarms
Charbel Toumieh, Niel Mistry, Benjamin Jarvis +4
cs.ROarXiv:2609.11382v12026GeoTrussRover: Morphological Computation with Contact-Semantic Control Primitives
Muyuan Ma, Yi Zhang, Yang Yang +12
cs.ROcs.GRcs.NEarXiv:2609.11361v12026Morphology-Aware Human Motion Retargeting for Wheeled-Humanoid Loco-Manipulation
Chenbo Xia, Chao Ye
cs.ROarXiv:2609.11357v12026Modular Kinematic Reduction of Closed-Chain Mechanisms Using Path Assembly and Defect Homotopy
Mohammad Dastranj, Jouni Mattila
cs.ROarXiv:2609.11338v120262AM: Grounding Agent-Side Memory as Guidance for Steerable Action Models in Long-Horizon Manipulation
Yutong Hu, Fengjiao Chen, Xuezhi Cao +1
cs.ROcs.AIarXiv:2609.11308v12026Beyond Noise Steering: Dual-Latent Space Reinforcement Learning for Generative Robot Policy
Pengfei Zhang, Teng Sun, Xianchao Xiu
cs.ROarXiv:2609.11270v12026RIDE: Relocalization-Informed Depth Estimation with 3D Gaussian Splatting
Jiarong Lian, Zhe Xiao, Zhaoyang Zhang +2
cs.ROarXiv:2609.11079v12026Harness Robotic OS: A Unified Embodied-Agent Runtime for Closed-Loop Quadruped Inspection
Yaoyuan Yan, Zhiyou Heng, Haoxiang Jie +3
cs.ROarXiv:2609.11225v12026Freehand Sketching for End-User Programming of Robot Swarms
Riwa Karam, Ian Kuo, Magnus Egerstedt
cs.ROeess.SYarXiv:2609.11078v12026Gait-Dependent Effects on Quadruped Locomotion for Load-Carrying using Passive Mechanism
Giovanni B. Dessy, Claudio Semini, Victor Barasuol
cs.ROarXiv:2609.11059v12026LTLDiff: Finite Linear Temporal Logic-Guided Data Generation and Diffusion Policies for Multi-agent Robotic Manipulation
Chuhan Meng, Haiyan Yin
cs.ROarXiv:2609.11043v12026VLA-R1: Enhancing Reasoning in Vision-Language-Action Models
Angen Ye, Zeyu Zhang, Boyuan Wang +3
cs.CVcs.ROarXiv:2510.01623v12025Planning along Differentiable Charts of Constraint Manifolds with General-Purpose IK Solvers
Thomas Cohn, Seiji Shaw, Harel Biggie +3
cs.ROarXiv:2609.10905v12026Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization
Nikita Kachaev, Mikhail Kolosov, Daniil Zelezetsky +2
cs.LGcs.AIcs.ROarXiv:2510.25616v12025Expressive Robotic Pianist: Mastering Complex Piano Repertoire with Graph-Mimic and Musical Dynamics
Yanhong Liang, Xianwei Liu, Chaojie Fu +7
cs.ROarXiv:2609.10844v12026ReactHuman: A Physics-Grounded Benchmark for Human-Like Reactive Decision-Making in Embodied Multimodal LLMs
Yizhan Li, Jianxin You, Mengyang Xiong +5
cs.ROcs.AIarXiv:2609.10895v12026Nav-R1: Reasoning and Navigation in Embodied Scenes
Qingxiang Liu, Ting Huang, Zeyu Zhang +1
cs.ROcs.CVarXiv:2509.10884v12025Lie-Algebraic Bell Recurrences for Arbitrary-Order Twist Jets and Parallel-Mechanism Closure
Daniel Condurache
cs.ROarXiv:2609.10748v12026When Information is Worth the Risk: Behavioral Valuation for Hazardous Robotic Exploration
Alkesh K. Srivastava, Aamodh Suresh, Carlos Nieto-Granda +1
cs.ROarXiv:2609.10726v12026IMLE-VLA: Fast Single-Step Action Generation for Vision-Language-Action Policies
Kian Hosseinkhani, Qinhe Peng, George Shramko +6
cs.ROcs.CVarXiv:2609.10915v12026MC-DeTra: Motion-Consistent Joint Object Detection and Socially-Aware Trajectory Forecasting in Bird's-Eye-View Images
Vladislav Diuzhev, Dmitry Yudin
cs.CVcs.ROarXiv:2609.11717v12026STyLuS*: A Temporal Logic Optimal Control Synthesis Algorithm for Large-Scale Multi-Robot Systems
Yiannis Kantaros, Michael M. Zavlanos
cs.ROarXiv:1809.08345v32018VLSA: Vision-Language-Action Models with Plug-and-Play Safety Constraint Layer
Songqiao Hu, Zeyi Liu, Shuang Liu +5
cs.ROeess.SYarXiv:2512.11891v22025Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process
Jiayi Chen, Wenxuan Song, Pengxiang Ding +5
cs.ROcs.CVarXiv:2511.01718v22025Residual Off-Policy RL for Finetuning Behavior Cloning Policies
Lars Ankile, Zhenyu Jiang, Rocky Duan +3
cs.ROcs.LGarXiv:2509.19301v22025SimScale: Learning to Drive via Real-World Simulation at Scale
Haochen Tian, Tianyu Li, Haochen Liu +11
cs.CVcs.ROarXiv:2511.23369v32025Control Design along Trajectories with Sums of Squares Programming
Anirudha Majumdar, Amir Ali Ahmadi, Russ Tedrake
cs.ROeess.SYmath.OCarXiv:1210.0888v12012MiMo-Embodied: X-Embodied Foundation Model Technical Report
Xiaoshuai Hao, Lei Zhou, Zhijian Huang +41
cs.ROcs.CLcs.CVarXiv:2511.16518v22025Particle Filter Networks with Application to Visual Localization
Peter Karkus, David Hsu, Wee Sun Lee
cs.ROcs.AIcs.CVarXiv:1805.08975v32018PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
Ziang Cao, Fangzhou Hong, Zhaoxi Chen +2
cs.CVcs.ROarXiv:2511.13648v12025Evaluation of Vision-Language Models Across Diverse Coastal Environments
Seth Knoop, Chad R. Samuelson, Gabriel R. Slade +2
cs.CVcs.ROarXiv:2609.10855v12026GRADE: Single-Frame Generative Radar Depth Estimation Under Visual Degradation
Bin Zhao, Patrick Chiou, Nakul Garg
cs.CVcs.ROarXiv:2609.10756v12026ORCH: Organizational Principles Enable Collective Intelligence in Embodied AI
Zhengran Ji, Jonathan Hyun, Boyuan Chen
cs.MAcs.AIcs.LGarXiv:2609.11737v12026Evaluating Gemini Robotics Policies in a Veo World Simulator
Gemini Robotics Team, Krzysztof Choromanski, Coline Devin +20
cs.ROcs.AIcs.CVarXiv:2512.10675v22025Reflex-Informed Neuromuscular Reinforcement Learning for Muscle-Driven Locomotion
Jian Zhou, Xingyu Zhang, Rui Ma +3
cs.ROcs.GRcs.LGarXiv:2609.11733v12026Dream2Flow: Bridging Video Generation and Open-World Manipulation with 3D Object Flow
Karthik Dharmarajan, Wenlong Huang, Jiajun Wu +2
cs.ROcs.AIcs.CVarXiv:2512.24766v12025Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents
Yixian Zhang, Huanming Zhang, Feng Gao +13
cs.ROarXiv:2607.08448v42026GR-RL: Going Dexterous and Precise for Long-Horizon Robotic Manipulation
Yunfei Li, Xiao Ma, Jiafeng Xu +18
cs.ROcs.LGarXiv:2512.01801v32025WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
Fangqi Zhu, Zhengyang Yan, Zicong Hong +3
cs.ROcs.AIarXiv:2511.09515v12025Robo-Dopamine: General Process Reward Modeling for High-Precision Robotic Manipulation
Huajie Tan, Sixiang Chen, Yijie Xu +12
cs.ROarXiv:2512.23703v12025Testing Between the Test Cases: Proving End-to-End Steering in Conditions You Never Drove
Menuka Ghalan, Charles Rodgers, Zachary D. Asher
cs.ROcs.LGarXiv:2609.10951v12026GigaWorld-0: World Models as Data Engine to Empower Embodied AI
GigaWorld Team, Angen Ye, Boyuan Wang +22
cs.CVcs.ROarXiv:2511.19861v22025VLA-0: Building State-of-the-Art VLAs with Zero Modification
Ankit Goyal, Hugo Hadfield, Xuning Yang +2
cs.ROcs.AIarXiv:2510.13054v12025ObstaDiff: Generalizable Diffusion Policy Learning via Obstacle-aware Representations
Jiawen Wang, Kevin Yao, Khalid Jawed
cs.ROcs.LGarXiv:2609.10918v12026HuRo: Robotizing Human Videos for Scalable VLA Pretraining
Jinho Jeong, Se June Joo, Jaehyun Kang +4
cs.ROcs.CVcs.LGarXiv:2609.10706v12026LoGG3D-Net: Locally Guided Global Descriptor Learning for 3D Place Recognition
Kavisha Vidanapathirana, Milad Ramezani, Peyman Moghadam +2
cs.CVcs.ROarXiv:2109.08336v32021Adaptive Bridge: A Proxy-Based Decoupling Layer for Mitigating DDS Backpressure in ROS 2
Kaushalraj Puwar, B. Thangaraju
cs.NIcs.ROarXiv:2608.15380v22026Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction
Hongyi Chen, Tony Dong, Tiancheng Wu +7
cs.ROcs.CVarXiv:2602.09013v22026Simulation-based reinforcement learning for real-world autonomous driving
Błażej Osiński, Adam Jakubowski, Piotr Miłoś +4
cs.LGcs.AIcs.ROarXiv:1911.12905v42019Learning Reward Functions by Integrating Human Demonstrations and Preferences
Malayandi Palan, Nicholas C. Landolfi, Gleb Shevchuk +1
cs.ROcs.AIarXiv:1906.08928v12019Dexterous Imitation Made Easy: A Learning-Based Framework for Efficient Dexterous Manipulation
Sridhar Pandian Arunachalam, Sneha Silwal, Ben Evans +1
cs.ROcs.AIcs.CVarXiv:2203.13251v12022Stable Language Guidance for Vision-Language-Action Models
Zhihao Zhan, Yuhao Chen, Jiaying Zhou +5
cs.ROcs.CLarXiv:2601.04052v22026Cascaded Incremental Nonlinear Dynamic Inversion Control for MAV Disturbance Rejection
Ewoud J. J. Smeur, Guido C. H. E. de Croon, Qiping Chu
cs.ROarXiv:1701.07254v22017Tune to Learn: How Controller Gains Shape Robot Policy Learning
Antonia Bronars, Younghyo Park, Pulkit Agrawal
cs.ROarXiv:2604.02523v12026LaneAF: Robust Multi-Lane Detection with Affinity Fields
Hala Abualsaud, Sean Liu, David Lu +3
cs.CVcs.ROarXiv:2103.12040v42021MemoryWAM: Efficient World Action Modeling with Persistent Memory
Sizhe Yang, Juncheng Mu, Tianming Wei +8
cs.ROarXiv:2606.20562v12026A Real-Time Game Theoretic Planner for Autonomous Two-Player Drone Racing
Riccardo Spica, Davide Falanga, Eric Cristofalo +3
cs.ROarXiv:1801.02302v22018A Distributed Control Framework of Multiple Unmanned Aerial Vehicles for Dynamic Wildfire Tracking
Huy Xuan Pham, Hung Manh La, David Feil-Seifer +1
cs.ROarXiv:1803.07926v12018