Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

2,881 to 2,940 of 3,243

  1. Teaching is a Process: The TOSS Framework for Modeling Human Teaching Decisions in Human-Interactive Robot Learning

    Bernhard Hilpert, Kim Baraka, Joost Broekens

    cs.ROcs.HCarXiv:2608.21083v12026
  2. Fast Coordinated Bimanual Motion Planning With Hard Constraints

    Borna Paro, Luka Petrović, Ivan Marković

    cs.ROarXiv:2608.20946v12026
  3. Pneumatic Units for Logic-based Sequential Excitation (PULSE) in Wearable Haptic Devices

    Jessica Healey, Anoush Sepehri, Michael T. Tolley +1

    cs.HCcs.ROarXiv:2608.20626v12026
  4. SceneSmith: Agentic Generation of Simulation-Ready Indoor Scenes

    Nicholas Pfaff, Thomas Cohn, Sergey Zakharov +2

    cs.ROcs.AIcs.CVarXiv:2602.09153v22026
  5. ABot-N0: Technical Report on the VLA Foundation Model for Versatile Embodied Navigation

    Zedong Chu, Shichao Xie, Xiaolong Wu +41

    cs.ROcs.AIcs.CVarXiv:2602.11598v12026
  6. Continuous Deep Q-Learning with Model-based Acceleration

    Shixiang Gu, Timothy Lillicrap, Ilya Sutskever +1

    cs.LGcs.AIcs.ROarXiv:1603.00748v12016
  7. PhysCaP: Grounding Code-as-Policy Agent with Physics-Informed Exploration

    Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang +8

    cs.ROarXiv:2608.21031v12026
  8. A Safety-Driven Architectural Framework for Fail-Operational Drone Swarms in Critical Missions

    Luiz Giacomossi, Zafer Yigit, Marwan Shakarna +4

    eess.SYcs.MAcs.ROarXiv:2608.20906v12026
  9. Hybrid Roller-Jamming Gripper for Object Acquisition and Retention Under Pose Uncertainty

    Yijie Ren, Guillaume Gourmelen, Hiroyasu Iwata

    cs.ROarXiv:2608.20962v12026
  10. World Guidance: World Modeling in Condition Space for Action Generation

    Yue Su, Sijin Chen, Haixin Shi +7

    cs.ROcs.CVarXiv:2602.22010v12026
  11. TaPeR: Probabilistic Recovery of Sparse Task Precedence Graphs from a Handful of Demonstrations

    Adrian Röfer, Karla Stepanova, Abhinav Valada

    cs.ROarXiv:2608.21035v12026
  12. ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models

    Linqing Zhong, Yi Liu, Yifei Wei +4

    cs.ROarXiv:2601.11404v22026
  13. BagelVLA: Enhancing Long-Horizon Manipulation via Interleaved Vision-Language-Action Generation

    Yucheng Hu, Jianke Zhang, Yuanfei Luo +9

    cs.ROarXiv:2602.09849v22026
  14. ABot-PhysWorld: Interactive World Foundation Model for Robotic Manipulation with Physics Alignment

    Yuzhi Chen, Ronghan Chen, Dongjie Huo +11

    cs.CVcs.ROarXiv:2603.23376v22026
  15. RynnBrain: Open Embodied Foundation Models

    Ronghao Dang, Jiayan Guo, Bohan Hou +23

    cs.ROarXiv:2602.14979v12026
  16. A Multimodal Anomaly Detector for Robot-Assisted Feeding Using an LSTM-based Variational Autoencoder

    Daehyung Park, Yuuna Hoshi, Charles C. Kemp

    cs.ROcs.LGarXiv:1711.00614v12017
  17. Rethinking Video Generation Model for the Embodied World

    Yufan Deng, Zilin Pan, Hongyu Zhang +6

    cs.CVcs.AIcs.ROarXiv:2601.15282v12026
  18. Sim-to-Real Transfer in Deep Reinforcement Learning for Robotics: a Survey

    Wenshuai Zhao, Jorge Peña Queralta, Tomi Westerlund

    cs.LGcs.ROarXiv:2009.13303v22020
  19. Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models

    Zhuoyuan Li, Rui Zhao, Jin Wang +5

    cs.CVcs.ROarXiv:2608.21247v12026
  20. ViTacPhys: Physical Property-Aware Grasping from Human Visual-Tactile Demonstrations

    Yiwen Liu, Yujun Zhu, Kui Jia +3

    cs.ROarXiv:2608.21355v12026
  21. DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation

    Haozhe Xie, Beichen Wen, Jiarui Zheng +4

    cs.ROcs.CVarXiv:2601.22153v12026
  22. Nonlinear Model Predictive Control for Trajectory Tracking of Differentially Flat Fixed-Wing Aerial Systems

    Nishanth Bobbili, Pratyaksh Rao, Luca Morando +2

    cs.ROarXiv:2608.20655v12026
    Summaries:한국어
  23. TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics

    Shirui Chen, Cole Harrison, Ying-Chun Lee +6

    cs.ROcs.AIcs.LGarXiv:2602.19313v22026
  24. Multi-Modal Traffic Sign Detection with Semantic Attributes for Autonomous Driving

    Meda Lazar, Sourab Sridhar, Shashwata Gupta +3

    cs.CVcs.ROarXiv:2608.20874v12026
  25. PCN: Point Completion Network

    Wentao Yuan, Tejas Khot, David Held +2

    cs.CVcs.ROarXiv:1808.00671v32018
  26. Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution

    Rui Cai, Jun Guo, Xinze He +20

    cs.ROcs.LGarXiv:2602.12684v22026
  27. Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning

    Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1

    cs.LGcs.AIcs.ROarXiv:1708.02596v22017
  28. RISE: Self-Improving Robot Policy with Compositional World Model

    Jiazhi Yang, Kunyang Lin, Jinwei Li +10

    cs.ROarXiv:2602.11075v22026
  29. SAGE: Scalable Agentic 3D Scene Generation for Embodied AI

    Hongchi Xia, Xuan Li, Zhaoshuo Li +9

    cs.CVcs.ROarXiv:2602.10116v22026
  30. RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies

    Yinpei Dai, Hongze Fu, Jayjun Lee +6

    cs.ROcs.AIarXiv:2603.04639v32026
  31. FAST-LIO: A Fast, Robust LiDAR-inertial Odometry Package by Tightly-Coupled Iterated Kalman Filter

    Wei Xu, Fu Zhang

    cs.ROarXiv:2010.08196v32020
  32. RoboBrain 2.5: Depth in Sight, Time in Mind

    Huajie Tan, Enshen Zhou, Zhiyu Li +32

    cs.ROarXiv:2601.14352v12026
  33. Being-H0.5: Scaling Human-Centric Robot Learning for Cross-Embodiment Generalization

    Hao Luo, Ye Wang, Wanpeng Zhang +9

    cs.ROarXiv:2601.12993v12026
  34. Causal World Modeling for Robot Control

    Lin Li, Qihang Zhang, Yiming Luo +9

    cs.CVcs.ROarXiv:2601.21998v22026
  35. VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model

    Jingwen Sun, Wenyao Zhang, Zekun Qi +6

    cs.ROcs.CVarXiv:2602.10098v22026
  36. Hydra-0: Action Flow for Generalist World Modeling and Control

    Hongyu Li, Bowen Wen, Xinghao Zhu +8

    cs.ROarXiv:2608.18077v12026
  37. ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning

    Yandan Yang, Shuang Zeng, Tong Lin +11

    cs.CVcs.CLcs.ROarXiv:2602.11236v22026
  38. A Pragmatic VLA Foundation Model

    Wei Wu, Fan Lu, Yunnan Wang +22

    cs.ROcs.CVarXiv:2601.18692v42026
  39. Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning

    Moo Jin Kim, Yihuai Gao, Tsung-Yi Lin +8

    cs.AIcs.ROarXiv:2601.16163v12026
  40. DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos

    Shenyuan Gao, William Liang, Kaiyuan Zheng +27

    cs.ROcs.AIcs.CVarXiv:2602.06949v12026
  41. World Action Models are Zero-shot Policies

    Seonghyeon Ye, Yunhao Ge, Kaiyuan Zheng +33

    cs.ROcs.CVcs.LGarXiv:2602.15922v12026
  42. Do World Action Models Generalize Better than VLAs? A Robustness Study

    Zhanguang Zhang, Zhiyuan Li, Behnam Rahmati +11

    cs.ROarXiv:2603.22078v52026
  43. UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving

    Yongkang Li, Lijun Zhou, Sixu Yan +11

    cs.CVcs.ROarXiv:2604.02190v12026
  44. DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning

    Yang Zhou, Xiaofeng Wang, Hao Shao +8

    cs.CVcs.AIcs.ROarXiv:2604.01765v12026
  45. Action Images: End-to-End Policy Learning via Multiview Video Generation

    Haoyu Zhen, Zixian Gao, Qiao Sun +7

    cs.CVcs.ROarXiv:2604.06168v22026
  46. MoRight: Motion Control Done Right

    Shaowei Liu, Xuanchi Ren, Tianchang Shen +5

    cs.CVcs.AIcs.GRarXiv:2604.07348v12026
  47. SIM1: Physics-Aligned Simulator as Zero-Shot Data Scaler in Deformable Worlds

    Yunsong Zhou, Hangxu Liu, Xuekun Jiang +12

    cs.ROcs.AIcs.CVarXiv:2604.08544v22026
  48. ViVa: A Video-Generative Value Model for Robot Reinforcement Learning

    Jindi Lv, Hao Li, Jie Li +11

    cs.ROcs.AIarXiv:2604.08168v22026
  49. 3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding

    Makanjuola Ogunleye, Eman Abdelrahman, Ismini Lourentzou

    cs.CVcs.AIcs.LGarXiv:2604.08645v12026
  50. Solving Physics Olympiad via Reinforcement Learning on Physics Simulators

    Mihir Prabhudesai, Aryan Satpathy, Yangmin Li +6

    cs.LGcs.AIcs.CVarXiv:2604.11805v12026
  51. LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment

    Dujun Nie, Fengjiao Chen, Qi Lv +4

    cs.CVcs.ROarXiv:2604.11689v12026
  52. Habitat-GS: A High-Fidelity Navigation Simulator with Dynamic Gaussian Splatting

    Ziyuan Xia, Jingyi Xu, Chong Cui +9

    cs.ROcs.CVarXiv:2604.12626v12026
  53. RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies

    Jenai Xuning Yang, Rishit Dagli, Alex Zook +5

    cs.ROcs.AIarXiv:2604.09860v42026
  54. Learning Versatile Humanoid Manipulation with Touch Dreaming

    Yaru Niu, Zhenlong Fang, Binghong Chen +8

    cs.ROarXiv:2604.13015v32026
  55. HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System

    Tianshuo Yang, Guanyu Chen, Yutian Chen +8

    cs.CVcs.AIcs.ROarXiv:2604.14125v22026
  56. Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation

    Jinghui Lu, Jiayi Guan, Zhijian Huang +47

    cs.CVcs.CLcs.ROarXiv:2604.18486v32026
  57. Rethinking Demonstration Unlearning in Imitation Learning for Robotics

    Jiazhuo Li, Yu Zhang, Yiming Fei +4

    cs.ROcs.LGarXiv:2608.20784v12026
  58. Cortex 2.0: Grounding World Models in Real-World Industrial Deployment

    Adriana Aida, Walid Amer, Katarina Bankovic +25

    cs.ROcs.AIarXiv:2604.20246v12026
  59. UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling

    Boyu Chen, Yi Chen, Lu Qiu +3

    cs.ROcs.AIarXiv:2604.19734v12026
  60. dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model

    Yaxuan Li, Zhongyi Zhou, Yefei Chen +2

    cs.ROarXiv:2604.22152v12026