Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,001 to 3,060 of 3,241

  1. LIO-SAM: Tightly-coupled Lidar Inertial Odometry via Smoothing and Mapping

    Tixiao Shan, Brendan Englot, Drew Meyers +3

    cs.ROarXiv:2007.00258v32020
  2. CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving

    Yifan Wang

    cs.ROcs.AIarXiv:2606.02641v12026
  3. RoboSemanticBench: Diagnosing Semantic Grounding in Action Prediction for VLA Models

    Bin Yu, Yao Zhang, Haishan Liu +9

    cs.ROarXiv:2606.02277v12026
  4. AFUN: Towards an Affordance Foundation Model for Functionality Understanding

    Zhaoning Wang, Yi Zhong, Jiawei Fu +2

    cs.ROcs.CVarXiv:2606.02551v12026
  5. SEAOTTER: Sensor Embedded Autoencoding with One-Time Transcode for Efficient Reconstruction

    Dan Jacobellis, Neeraja J. Yadwadkar

    eess.IVcs.CVcs.LGarXiv:2606.03940v12026
  6. RobotValues: Evaluating Household Robots When Human Values Conflict

    Jongwook Han, Hyeongjin Kim, Yohan Jo

    cs.ROcs.AIarXiv:2606.03312v12026
  7. CIPER: A Unified Framework for Cross-view Image-retrieval and Pose-estimation

    Yurim Jeon, Dongseong Seo, Seung-Woo Seo

    cs.CVcs.ROarXiv:2606.05011v12026
  8. Open3D: A Modern Library for 3D Data Processing

    Qian-Yi Zhou, Jaesik Park, Vladlen Koltun

    cs.CVcs.GRcs.ROarXiv:1801.09847v12018
  9. Discrete-WAM: Unified Discrete Vision-Action Token Editing for World-Policy Learning

    Ziyang Yao, Haochen Liu, Yuncheng Jiang +10

    cs.ROarXiv:2606.05645v22026
  10. Dream to Control: Learning Behaviors by Latent Imagination

    Danijar Hafner, Timothy Lillicrap, Jimmy Ba +1

    cs.LGcs.AIcs.ROarXiv:1912.01603v32019
  11. Learning Dexterous In-Hand Manipulation

    OpenAI, Marcin Andrychowicz, Bowen Baker +14

    cs.LGcs.AIcs.ROarXiv:1808.00177v52018
  12. Robots Need More than VLA and World Models

    Elis Karcini, Faisal Mehrban, Quang Nguyen +6

    cs.ROarXiv:2606.06556v12026
  13. Learning Hand-Eye Coordination for Robotic Grasping with Deep Learning and Large-Scale Data Collection

    Sergey Levine, Peter Pastor, Alex Krizhevsky +1

    cs.LGcs.AIcs.CVarXiv:1603.02199v42016
  14. Deep Learning for 3D Point Clouds: A Survey

    Yulan Guo, Hanyun Wang, Qingyong Hu +3

    cs.CVcs.LGcs.ROarXiv:1912.12033v22019
  15. PoseCNN: A Convolutional Neural Network for 6D Object Pose Estimation in Cluttered Scenes

    Yu Xiang, Tanner Schmidt, Venkatraman Narayanan +1

    cs.CVcs.ROarXiv:1711.00199v32017
  16. Deep Reinforcement Learning for Autonomous Driving: A Survey

    B Ravi Kiran, Ibrahim Sobh, Victor Talpaert +4

    cs.LGcs.AIcs.ROarXiv:2002.00444v22020
  17. LIMMT: Less is More for Motion Tracking

    Yu Guan, Zekun Qi, Chenghuai Lin +7

    cs.ROarXiv:2606.06953v12026
  18. AirSim: High-Fidelity Visual and Physical Simulation for Autonomous Vehicles

    Shital Shah, Debadeepta Dey, Chris Lovett +1

    cs.ROcs.AIcs.CVarXiv:1705.05065v22017
  19. Robotic Policy Adaptation via Weight-Space Meta-Learning

    Christian Bianchi, Siamak Yousefi, Alessio Sampieri +4

    cs.ROcs.CVcs.LGarXiv:2606.07217v12026
  20. OASIS: From Simulation Data Collection to Real-World Humanoid Loco-Manipulation

    Zehao Yu, Jiakun Zheng, Weiji Xie +4

    cs.ROarXiv:2606.08548v12026
  21. Revisiting Articulated Parts Perception in Robot Manipulation

    Xiaoqian Wu, Yejie Guo, Xiaoyang Chen +3

    cs.ROcs.CVarXiv:2606.08103v12026
  22. RT-1: Robotics Transformer for Real-World Control at Scale

    Anthony Brohan, Noah Brown, Justice Carbajal +48

    cs.ROcs.AIcs.CLarXiv:2212.06817v22022
  23. TBD-VLA: Temporal Block Diffusion Vision Language Action Model

    Sung-Wook Lee, Xuhui Kang, Yen-Ling Kuo

    cs.CVcs.ROarXiv:2606.07895v12026
  24. Hindsight Experience Replay

    Marcin Andrychowicz, Filip Wolski, Alex Ray +7

    cs.LGcs.AIcs.NEarXiv:1707.01495v32017
  25. Event-based Vision: A Survey

    Guillermo Gallego, Tobi Delbruck, Garrick Orchard +8

    cs.CVcs.AIcs.LGarXiv:1904.08405v32019
  26. GOAG: Generative and Object-Agnostic Grasp Planner for Dexterous Robotic Manipulation

    Julien Merand, Boris Meden, Mathieu Grossard +1

    cs.ROcs.AIarXiv:2608.19759v12026
  27. CoToGrasp: Contact-Topology-Conditioned Dexterous Grasp Synthesis via Canonical Workspace Learning

    Julien Merand, Boris Meden, Liming Chen +1

    cs.ROcs.AIarXiv:2608.19776v12026
  28. OpenVLA: An Open-Source Vision-Language-Action Model

    Moo Jin Kim, Karl Pertsch, Siddharth Karamcheti +15

    cs.ROcs.LGarXiv:2406.09246v32024
  29. $τ_0$-VLA: a Hierarchical Robot Foundation Model with World-Model-Guided Test-Time Computation

    Xiaowei Cai, Yunuo Cai, Bingao Chen +36

    cs.ROarXiv:2608.16885v12026
  30. PaLM-E: An Embodied Multimodal Language Model

    Danny Driess, Fei Xia, Mehdi S. M. Sajjadi +19

    cs.LGcs.AIcs.ROarXiv:2303.03378v12023
  31. Do As I Can, Not As I Say: Grounding Language in Robotic Affordances

    Michael Ahn, Anthony Brohan, Noah Brown +42

    cs.ROcs.CLcs.LGarXiv:2204.01691v22022
  32. Algorithm-Architecture Co-Design for Efficient VLA Inference via Speculative Inference and Verification

    Chunyu Qi, Zhuoran Song, Jian Weng +6

    cs.ROcs.AIarXiv:2608.15636v12026
  33. INTACT: Isomorphic Intent-to-Action Learning for Search-Free World Models

    Junhan Sun, Hao Zhao, Guofeng Zhang

    cs.ROarXiv:2607.26056v12026
  34. Orienteering Problem with Uncertain Time-Varying Rewards: Framework and Benchmark for Everyday Service Robotics

    Masafumi Endo, Kohei Honda, Yuu Jinnai +1

    cs.ROcs.AIarXiv:2608.18672v12026
  35. The Role of Grid Cells in Reducing Spatial Aliasing in Hippocampal Place Representations

    Alexander Johnson, Obadah Ghizawi, Ali A. Minai

    cs.NEcs.AIcs.ROarXiv:2608.18569v12026
  36. A Metamorphic Artificial Age Score Decision-Support Prototype for Flight-Log-Based Drone Propeller Health Monitoring

    Seyma Yaman Kayadibi

    cs.AIcs.ROarXiv:2608.18088v12026
  37. Orbit-Planner: Towards Latent World Models for On-Orbit Obstacle Avoidance of Satellite Agents

    Zhijian Li, Chao Ren, Peijin Wang +1

    cs.ROcs.AIarXiv:2608.16651v12026
  38. MotionGS-SLAM: Event-Modulated Gaussian Splatting for Motion-Blur Robust SLAM

    Zhiqiang Hu, Shouren Huang, Masatoshi Ishikawa

    cs.ROcs.AIcs.CVarXiv:2608.15024v12026
  39. World-to-Wrist: Task-Conditioned Future Wrist Modeling for Fine-Grained Robot Manipulation

    Yuhao Pan, Haosong Peng, Zhengshen Zhang +8

    cs.ROcs.CVarXiv:2608.05369v12026
  40. SG-WAM: Self-Guided World Modeling in Geometry-Aware Policy Space

    Ruiteng Zhao, Zhengshen Zhang, Yue Su +6

    cs.ROcs.CVarXiv:2608.01397v12026
  41. RL$^2$-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models

    Derek Ming Siang Tan, Shailesh Shailesh, Srikrishna Iyer +4

    cs.ROarXiv:2607.26991v22026
  42. Deform360: A Massive Multi-view Visuotactile Dataset for Deformable World Models

    Hongyu Li, Wanjia Fu, Xiaoyan Cong +11

    cs.ROcs.CVarXiv:2607.05390v12026
    Summaries:한국어
  43. ACID: Action Consistency via Inverse Dynamics for Planning with World Models

    Gawon Seo, Dongwon Kim, Suha Kwak

    cs.ROcs.AIcs.CVarXiv:2607.02403v12026
  44. ShotcreteDepth: A Bi-modal Dataset for Robust Robotic Depth Perception in Shotcrete Construction Environments

    Jakub Gregorek, Lars Arnold Dethlefsen, Patrick Schmidt +3

    cs.ROarXiv:2606.23152v12026
  45. Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System

    Jiazhao Zhang, Gengze Zhou, Hale Yin +32

    cs.ROcs.CVarXiv:2606.18112v32026
  46. MotionVLA: Vision-Language-Action Model for Humanoid Motion

    Nonghai Zhang, Siyu Zhai, Yanjun Li +5

    cs.CVcs.ROarXiv:2606.15142v12026
  47. NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation

    NVIDIA, :, Aarti Basant +32

    cs.CVcs.AIcs.ROarXiv:2606.03159v22026
  48. LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding

    Shihao Wang, Shilong Liu, Yuanguo Kuang +10

    cs.CVcs.AIcs.LGarXiv:2605.27365v22026
  49. nuScenes: A multimodal dataset for autonomous driving

    Holger Caesar, Varun Bankiti, Alex H. Lang +7

    cs.LGcs.CVcs.ROarXiv:1903.11027v52019
  50. FollowUpBot: An LLM-Based Conversational Robot for Automatic Postoperative Follow-up

    Chen Chen, Jianing Yin, Jiannong Cao +5

    cs.HCcs.CLcs.ROarXiv:2507.15502v12025
  51. RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control

    Anthony Brohan, Noah Brown, Justice Carbajal +51

    cs.ROcs.CLcs.CVarXiv:2307.15818v12023
  52. Domain Randomization for Transferring Deep Neural Networks from Simulation to the Real World

    Josh Tobin, Rachel Fong, Alex Ray +3

    cs.ROcs.LGarXiv:1703.06907v12017
  53. H2R-Bench: Benchmarking Human-to-Robot Manipulation Video Generation in World Models

    Dingyi Rong, Yue Shi, Chaofan Ma +6

    cs.ROcs.CVarXiv:2608.13049v12026
  54. RLDX-1 Technical Report

    Dongyoung Kim, Huiwon Jang, Myungkyu Koo +65

    cs.ROcs.AIcs.LGarXiv:2605.03269v22026
    Summaries:한국어
  55. Low-Rank Dynamics-Effective Latent Carriers for Counterfactual Rollout in Learned World Models

    Yang Liu, Yuming Chen

    cs.ROcs.AIarXiv:2608.15156v12026
  56. Domain Arithmetic: One-Shot VLA Adaptation under Environmental Shifts

    Taewook Kang, Taeheon Kim, Donghyun Shin +1

    cs.ROcs.CVcs.LGarXiv:2607.00666v12026
  57. SoftVTBench: A Deformation-Aware Visuo-Tactile Dataset and Benchmark for Deformable-Object Manipulation

    Bowen Jing, Mingxin Wang, Ruiyang Hao +15

    cs.ROarXiv:2608.18701v12026
  58. Multimodal Rapport Estimation in Real-World HRI

    Akihiro Sakuramoto, Takato Hayashi, Ryo Miyoshi +2

    cs.HCcs.CLcs.ROarXiv:2608.18401v12026
  59. End-to-End Training of Deep Visuomotor Policies

    Sergey Levine, Chelsea Finn, Trevor Darrell +1

    cs.LGcs.CVcs.ROarXiv:1504.00702v52015
  60. ADEPT: Accelerating Dexterity via Pre-Training and Post-Training using Reinforcement Learning

    Jayjun Lee, Jessica Yin, Asif Rana +7

    cs.ROcs.AIarXiv:2608.19182v12026