Robotics
Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,001 to 3,060 of 3,241
LIO-SAM: Tightly-coupled Lidar Inertial Odometry via Smoothing and Mapping
Tixiao Shan, Brendan Englot, Drew Meyers +3
cs.ROarXiv:2007.00258v32020CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving
Yifan Wang
cs.ROcs.AIarXiv:2606.02641v12026RoboSemanticBench: Diagnosing Semantic Grounding in Action Prediction for VLA Models
Bin Yu, Yao Zhang, Haishan Liu +9
cs.ROarXiv:2606.02277v12026AFUN: Towards an Affordance Foundation Model for Functionality Understanding
Zhaoning Wang, Yi Zhong, Jiawei Fu +2
cs.ROcs.CVarXiv:2606.02551v12026SEAOTTER: Sensor Embedded Autoencoding with One-Time Transcode for Efficient Reconstruction
Dan Jacobellis, Neeraja J. Yadwadkar
eess.IVcs.CVcs.LGarXiv:2606.03940v12026RobotValues: Evaluating Household Robots When Human Values Conflict
Jongwook Han, Hyeongjin Kim, Yohan Jo
cs.ROcs.AIarXiv:2606.03312v12026CIPER: A Unified Framework for Cross-view Image-retrieval and Pose-estimation
Yurim Jeon, Dongseong Seo, Seung-Woo Seo
cs.CVcs.ROarXiv:2606.05011v12026Open3D: A Modern Library for 3D Data Processing
Qian-Yi Zhou, Jaesik Park, Vladlen Koltun
cs.CVcs.GRcs.ROarXiv:1801.09847v12018Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning
Ziyang Yao, Haochen Liu, Yuncheng Jiang +10
cs.ROarXiv:2606.05645v22026Dream to Control: Learning Behaviors by Latent Imagination
Danijar Hafner, Timothy Lillicrap, Jimmy Ba +1
cs.LGcs.AIcs.ROarXiv:1912.01603v32019Learning Dexterous In-Hand Manipulation
OpenAI, Marcin Andrychowicz, Bowen Baker +14
cs.LGcs.AIcs.ROarXiv:1808.00177v52018Robots Need More than VLA and World Models
Elis Karcini, Faisal Mehrban, Quang Nguyen +6
cs.ROarXiv:2606.06556v12026Learning Hand-Eye Coordination for Robotic Grasping with Deep Learning and Large-Scale Data Collection
Sergey Levine, Peter Pastor, Alex Krizhevsky +1
cs.LGcs.AIcs.CVarXiv:1603.02199v42016Deep Learning for 3D Point Clouds: A Survey
Yulan Guo, Hanyun Wang, Qingyong Hu +3
cs.CVcs.LGcs.ROarXiv:1912.12033v22019PoseCNN: A Convolutional Neural Network for 6D Object Pose Estimation in Cluttered Scenes
Yu Xiang, Tanner Schmidt, Venkatraman Narayanan +1
cs.CVcs.ROarXiv:1711.00199v32017Deep Reinforcement Learning for Autonomous Driving: A Survey
B Ravi Kiran, Ibrahim Sobh, Victor Talpaert +4
cs.LGcs.AIcs.ROarXiv:2002.00444v22020LIMMT: Less is More for Motion Tracking
Yu Guan, Zekun Qi, Chenghuai Lin +7
cs.ROarXiv:2606.06953v12026AirSim: High-Fidelity Visual and Physical Simulation for Autonomous Vehicles
Shital Shah, Debadeepta Dey, Chris Lovett +1
cs.ROcs.AIcs.CVarXiv:1705.05065v22017Robotic Policy Adaptation via Weight-Space Meta-Learning
Christian Bianchi, Siamak Yousefi, Alessio Sampieri +4
cs.ROcs.CVcs.LGarXiv:2606.07217v12026OASIS: From Simulation Data Collection to Real-World Humanoid Loco-Manipulation
Zehao Yu, Jiakun Zheng, Weiji Xie +4
cs.ROarXiv:2606.08548v12026Revisiting Articulated Parts Perception in Robot Manipulation
Xiaoqian Wu, Yejie Guo, Xiaoyang Chen +3
cs.ROcs.CVarXiv:2606.08103v12026RT-1: Robotics Transformer for Real-World Control at Scale
Anthony Brohan, Noah Brown, Justice Carbajal +48
cs.ROcs.AIcs.CLarXiv:2212.06817v22022TBD-VLA: Temporal Block Diffusion Vision Language Action Model
Sung-Wook Lee, Xuhui Kang, Yen-Ling Kuo
cs.CVcs.ROarXiv:2606.07895v12026Hindsight Experience Replay
Marcin Andrychowicz, Filip Wolski, Alex Ray +7
cs.LGcs.AIcs.NEarXiv:1707.01495v32017Event-based Vision: A Survey
Guillermo Gallego, Tobi Delbruck, Garrick Orchard +8
cs.CVcs.AIcs.LGarXiv:1904.08405v32019GOAG: Generative and Object-Agnostic Grasp Planner for Dexterous Robotic Manipulation
Julien Merand, Boris Meden, Mathieu Grossard +1
cs.ROcs.AIarXiv:2608.19759v12026CoToGrasp: Contact-Topology-Conditioned Dexterous Grasp Synthesis via Canonical Workspace Learning
Julien Merand, Boris Meden, Liming Chen +1
cs.ROcs.AIarXiv:2608.19776v12026OpenVLA: An Open-Source Vision-Language-Action Model
Moo Jin Kim, Karl Pertsch, Siddharth Karamcheti +15
cs.ROcs.LGarXiv:2406.09246v32024$τ_0$-VLA: a Hierarchical Robot Foundation Model with World-Model-Guided Test-Time Computation
Xiaowei Cai, Yunuo Cai, Bingao Chen +36
cs.ROarXiv:2608.16885v12026PaLM-E: An Embodied Multimodal Language Model
Danny Driess, Fei Xia, Mehdi S. M. Sajjadi +19
cs.LGcs.AIcs.ROarXiv:2303.03378v12023Do As I Can, Not As I Say: Grounding Language in Robotic Affordances
Michael Ahn, Anthony Brohan, Noah Brown +42
cs.ROcs.CLcs.LGarXiv:2204.01691v22022Algorithm-Architecture Co-Design for Efficient VLA Inference via Speculative Inference and Verification
Chunyu Qi, Zhuoran Song, Jian Weng +6
cs.ROcs.AIarXiv:2608.15636v12026INTACT: Isomorphic Intent-to-Action Learning for Search-Free World Models
Junhan Sun, Hao Zhao, Guofeng Zhang
cs.ROarXiv:2607.26056v12026Orienteering Problem with Uncertain Time-Varying Rewards: Framework and Benchmark for Everyday Service Robotics
Masafumi Endo, Kohei Honda, Yuu Jinnai +1
cs.ROcs.AIarXiv:2608.18672v12026The Role of Grid Cells in Reducing Spatial Aliasing in Hippocampal Place Representations
Alexander Johnson, Obadah Ghizawi, Ali A. Minai
cs.NEcs.AIcs.ROarXiv:2608.18569v12026A Metamorphic Artificial Age Score Decision-Support Prototype for Flight-Log-Based Drone Propeller Health Monitoring
Seyma Yaman Kayadibi
cs.AIcs.ROarXiv:2608.18088v12026Orbit-Planner: Towards Latent World Models for On-Orbit Obstacle Avoidance of Satellite Agents
Zhijian Li, Chao Ren, Peijin Wang +1
cs.ROcs.AIarXiv:2608.16651v12026MotionGS-SLAM: Event-Modulated Gaussian Splatting for Motion-Blur Robust SLAM
Zhiqiang Hu, Shouren Huang, Masatoshi Ishikawa
cs.ROcs.AIcs.CVarXiv:2608.15024v12026World-to-Wrist: Task-Conditioned Future Wrist Modeling for Fine-Grained Robot Manipulation
Yuhao Pan, Haosong Peng, Zhengshen Zhang +8
cs.ROcs.CVarXiv:2608.05369v12026SG-WAM: Self-Guided World Modeling in Geometry-Aware Policy Space
Ruiteng Zhao, Zhengshen Zhang, Yue Su +6
cs.ROcs.CVarXiv:2608.01397v12026RL$^2$-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models
Derek Ming Siang Tan, Shailesh Shailesh, Srikrishna Iyer +4
cs.ROarXiv:2607.26991v22026Deform360: A Massive Multi-view Visuotactile Dataset for Deformable World Models
Hongyu Li, Wanjia Fu, Xiaoyan Cong +11
cs.ROcs.CVarXiv:2607.05390v12026Summaries:한국어ACID: Action Consistency via Inverse Dynamics for Planning with World Models
Gawon Seo, Dongwon Kim, Suha Kwak
cs.ROcs.AIcs.CVarXiv:2607.02403v12026ShotcreteDepth: A Bi-modal Dataset for Robust Robotic Depth Perception in Shotcrete Construction Environments
Jakub Gregorek, Lars Arnold Dethlefsen, Patrick Schmidt +3
cs.ROarXiv:2606.23152v12026Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System
Jiazhao Zhang, Gengze Zhou, Hale Yin +32
cs.ROcs.CVarXiv:2606.18112v32026MotionVLA: Vision-Language-Action Model for Humanoid Motion
Nonghai Zhang, Siyu Zhai, Yanjun Li +5
cs.CVcs.ROarXiv:2606.15142v12026NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation
NVIDIA, :, Aarti Basant +32
cs.CVcs.AIcs.ROarXiv:2606.03159v22026LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding
Shihao Wang, Shilong Liu, Yuanguo Kuang +10
cs.CVcs.AIcs.LGarXiv:2605.27365v22026nuScenes: A multimodal dataset for autonomous driving
Holger Caesar, Varun Bankiti, Alex H. Lang +7
cs.LGcs.CVcs.ROarXiv:1903.11027v52019FollowUpBot: An LLM-Based Conversational Robot for Automatic Postoperative Follow-up
Chen Chen, Jianing Yin, Jiannong Cao +5
cs.HCcs.CLcs.ROarXiv:2507.15502v12025RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control
Anthony Brohan, Noah Brown, Justice Carbajal +51
cs.ROcs.CLcs.CVarXiv:2307.15818v12023Domain Randomization for Transferring Deep Neural Networks from Simulation to the Real World
Josh Tobin, Rachel Fong, Alex Ray +3
cs.ROcs.LGarXiv:1703.06907v12017H2R-Bench: Benchmarking Human-to-Robot Manipulation Video Generation in World Models
Dingyi Rong, Yue Shi, Chaofan Ma +6
cs.ROcs.CVarXiv:2608.13049v12026RLDX-1 Technical Report
Dongyoung Kim, Huiwon Jang, Myungkyu Koo +65
cs.ROcs.AIcs.LGarXiv:2605.03269v22026Summaries:한국어Low-Rank Dynamics-Effective Latent Carriers for Counterfactual Rollout in Learned World Models
Yang Liu, Yuming Chen
cs.ROcs.AIarXiv:2608.15156v12026Domain Arithmetic: One-Shot VLA Adaptation under Environmental Shifts
Taewook Kang, Taeheon Kim, Donghyun Shin +1
cs.ROcs.CVcs.LGarXiv:2607.00666v12026SoftVTBench: A Deformation-Aware Visuo-Tactile Dataset and Benchmark for Deformable-Object Manipulation
Bowen Jing, Mingxin Wang, Ruiyang Hao +15
cs.ROarXiv:2608.18701v12026Multimodal Rapport Estimation in Real-World HRI
Akihiro Sakuramoto, Takato Hayashi, Ryo Miyoshi +2
cs.HCcs.CLcs.ROarXiv:2608.18401v12026End-to-End Training of Deep Visuomotor Policies
Sergey Levine, Chelsea Finn, Trevor Darrell +1
cs.LGcs.CVcs.ROarXiv:1504.00702v52015ADEPT: Accelerating Dexterity via Pre-Training and Post-Training using Reinforcement Learning
Jayjun Lee, Jessica Yin, Asif Rana +7
cs.ROcs.AIarXiv:2608.19182v12026