Robotics
Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
2,881 to 2,940 of 3,243
Teaching is a Process: The TOSS Framework for Modeling Human Teaching Decisions in Human-Interactive Robot Learning
Bernhard Hilpert, Kim Baraka, Joost Broekens
cs.ROcs.HCarXiv:2608.21083v12026Fast Coordinated Bimanual Motion Planning With Hard Constraints
Borna Paro, Luka Petrović, Ivan Marković
cs.ROarXiv:2608.20946v12026Pneumatic Units for Logic-based Sequential Excitation (PULSE) in Wearable Haptic Devices
Jessica Healey, Anoush Sepehri, Michael T. Tolley +1
cs.HCcs.ROarXiv:2608.20626v12026SceneSmith: Agentic Generation of Simulation-Ready Indoor Scenes
Nicholas Pfaff, Thomas Cohn, Sergey Zakharov +2
cs.ROcs.AIcs.CVarXiv:2602.09153v22026ABot-N0: Technical Report on the VLA Foundation Model for Versatile Embodied Navigation
Zedong Chu, Shichao Xie, Xiaolong Wu +41
cs.ROcs.AIcs.CVarXiv:2602.11598v12026Continuous Deep Q-Learning with Model-based Acceleration
Shixiang Gu, Timothy Lillicrap, Ilya Sutskever +1
cs.LGcs.AIcs.ROarXiv:1603.00748v12016PhysCaP: Grounding Code-as-Policy Agent with Physics-Informed Exploration
Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang +8
cs.ROarXiv:2608.21031v12026A Safety-Driven Architectural Framework for Fail-Operational Drone Swarms in Critical Missions
Luiz Giacomossi, Zafer Yigit, Marwan Shakarna +4
eess.SYcs.MAcs.ROarXiv:2608.20906v12026Hybrid Roller-Jamming Gripper for Object Acquisition and Retention Under Pose Uncertainty
Yijie Ren, Guillaume Gourmelen, Hiroyasu Iwata
cs.ROarXiv:2608.20962v12026World Guidance: World Modeling in Condition Space for Action Generation
Yue Su, Sijin Chen, Haixin Shi +7
cs.ROcs.CVarXiv:2602.22010v12026TaPeR: Probabilistic Recovery of Sparse Task Precedence Graphs from a Handful of Demonstrations
Adrian Röfer, Karla Stepanova, Abhinav Valada
cs.ROarXiv:2608.21035v12026ACoT-VLA: Action Chain-of-Thought for Vision-Language-Action Models
Linqing Zhong, Yi Liu, Yifei Wei +4
cs.ROarXiv:2601.11404v22026BagelVLA: Enhancing Long-Horizon Manipulation via Interleaved Vision-Language-Action Generation
Yucheng Hu, Jianke Zhang, Yuanfei Luo +9
cs.ROarXiv:2602.09849v22026ABot-PhysWorld: Interactive World Foundation Model for Robotic Manipulation with Physics Alignment
Yuzhi Chen, Ronghan Chen, Dongjie Huo +11
cs.CVcs.ROarXiv:2603.23376v22026RynnBrain: Open Embodied Foundation Models
Ronghao Dang, Jiayan Guo, Bohan Hou +23
cs.ROarXiv:2602.14979v12026A Multimodal Anomaly Detector for Robot-Assisted Feeding Using an LSTM-based Variational Autoencoder
Daehyung Park, Yuuna Hoshi, Charles C. Kemp
cs.ROcs.LGarXiv:1711.00614v12017Rethinking Video Generation Model for the Embodied World
Yufan Deng, Zilin Pan, Hongyu Zhang +6
cs.CVcs.AIcs.ROarXiv:2601.15282v12026Sim-to-Real Transfer in Deep Reinforcement Learning for Robotics: a Survey
Wenshuai Zhao, Jorge Peña Queralta, Tomi Westerlund
cs.LGcs.ROarXiv:2009.13303v22020Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models
Zhuoyuan Li, Rui Zhao, Jin Wang +5
cs.CVcs.ROarXiv:2608.21247v12026ViTacPhys: Physical Property-Aware Grasping from Human Visual-Tactile Demonstrations
Yiwen Liu, Yujun Zhu, Kui Jia +3
cs.ROarXiv:2608.21355v12026DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
Haozhe Xie, Beichen Wen, Jiarui Zheng +4
cs.ROcs.CVarXiv:2601.22153v12026Nonlinear Model Predictive Control for Trajectory Tracking of Differentially Flat Fixed-Wing Aerial Systems
Nishanth Bobbili, Pratyaksh Rao, Luca Morando +2
cs.ROarXiv:2608.20655v12026Summaries:한국어TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
Shirui Chen, Cole Harrison, Ying-Chun Lee +6
cs.ROcs.AIcs.LGarXiv:2602.19313v22026Multi-Modal Traffic Sign Detection with Semantic Attributes for Autonomous Driving
Meda Lazar, Sourab Sridhar, Shashwata Gupta +3
cs.CVcs.ROarXiv:2608.20874v12026PCN: Point Completion Network
Wentao Yuan, Tejas Khot, David Held +2
cs.CVcs.ROarXiv:1808.00671v32018Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution
Rui Cai, Jun Guo, Xinze He +20
cs.ROcs.LGarXiv:2602.12684v22026Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning
Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1
cs.LGcs.AIcs.ROarXiv:1708.02596v22017RISE: Self-Improving Robot Policy with Compositional World Model
Jiazhi Yang, Kunyang Lin, Jinwei Li +10
cs.ROarXiv:2602.11075v22026SAGE: Scalable Agentic 3D Scene Generation for Embodied AI
Hongchi Xia, Xuan Li, Zhaoshuo Li +9
cs.CVcs.ROarXiv:2602.10116v22026RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies
Yinpei Dai, Hongze Fu, Jayjun Lee +6
cs.ROcs.AIarXiv:2603.04639v32026FAST-LIO: A Fast, Robust LiDAR-inertial Odometry Package by Tightly-Coupled Iterated Kalman Filter
Wei Xu, Fu Zhang
cs.ROarXiv:2010.08196v32020RoboBrain 2.5: Depth in Sight, Time in Mind
Huajie Tan, Enshen Zhou, Zhiyu Li +32
cs.ROarXiv:2601.14352v12026Being-H0.5: Scaling Human-Centric Robot Learning for Cross-Embodiment Generalization
Hao Luo, Ye Wang, Wanpeng Zhang +9
cs.ROarXiv:2601.12993v12026Causal World Modeling for Robot Control
Lin Li, Qihang Zhang, Yiming Luo +9
cs.CVcs.ROarXiv:2601.21998v22026VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
Jingwen Sun, Wenyao Zhang, Zekun Qi +6
cs.ROcs.CVarXiv:2602.10098v22026Hydra-0: Action Flow for Generalist World Modeling and Control
Hongyu Li, Bowen Wen, Xinghao Zhu +8
cs.ROarXiv:2608.18077v12026ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning
Yandan Yang, Shuang Zeng, Tong Lin +11
cs.CVcs.CLcs.ROarXiv:2602.11236v22026A Pragmatic VLA Foundation Model
Wei Wu, Fan Lu, Yunnan Wang +22
cs.ROcs.CVarXiv:2601.18692v42026Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning
Moo Jin Kim, Yihuai Gao, Tsung-Yi Lin +8
cs.AIcs.ROarXiv:2601.16163v12026DreamDojo: A Generalist Robot World Model from Large-Scale Human Videos
Shenyuan Gao, William Liang, Kaiyuan Zheng +27
cs.ROcs.AIcs.CVarXiv:2602.06949v12026World Action Models are Zero-shot Policies
Seonghyeon Ye, Yunhao Ge, Kaiyuan Zheng +33
cs.ROcs.CVcs.LGarXiv:2602.15922v12026Do World Action Models Generalize Better than VLAs? A Robustness Study
Zhanguang Zhang, Zhiyuan Li, Behnam Rahmati +11
cs.ROarXiv:2603.22078v52026UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
Yongkang Li, Lijun Zhou, Sixu Yan +11
cs.CVcs.ROarXiv:2604.02190v12026DriveDreamer-Policy: A Geometry-Grounded World-Action Model for Unified Generation and Planning
Yang Zhou, Xiaofeng Wang, Hao Shao +8
cs.CVcs.AIcs.ROarXiv:2604.01765v12026Action Images: End-to-End Policy Learning via Multiview Video Generation
Haoyu Zhen, Zixian Gao, Qiao Sun +7
cs.CVcs.ROarXiv:2604.06168v22026MoRight: Motion Control Done Right
Shaowei Liu, Xuanchi Ren, Tianchang Shen +5
cs.CVcs.AIcs.GRarXiv:2604.07348v12026SIM1: Physics-Aligned Simulator as Zero-Shot Data Scaler in Deformable Worlds
Yunsong Zhou, Hangxu Liu, Xuekun Jiang +12
cs.ROcs.AIcs.CVarXiv:2604.08544v22026ViVa: A Video-Generative Value Model for Robot Reinforcement Learning
Jindi Lv, Hao Li, Jie Li +11
cs.ROcs.AIarXiv:2604.08168v220263D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding
Makanjuola Ogunleye, Eman Abdelrahman, Ismini Lourentzou
cs.CVcs.AIcs.LGarXiv:2604.08645v12026Solving Physics Olympiad via Reinforcement Learning on Physics Simulators
Mihir Prabhudesai, Aryan Satpathy, Yangmin Li +6
cs.LGcs.AIcs.CVarXiv:2604.11805v12026LARY: A Latent Action Representation Yielding Benchmark for Generalizable Vision-to-Action Alignment
Dujun Nie, Fengjiao Chen, Qi Lv +4
cs.CVcs.ROarXiv:2604.11689v12026Habitat-GS: A High-Fidelity Navigation Simulator with Dynamic Gaussian Splatting
Ziyuan Xia, Jingyi Xu, Chong Cui +9
cs.ROcs.CVarXiv:2604.12626v12026RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies
Jenai Xuning Yang, Rishit Dagli, Alex Zook +5
cs.ROcs.AIarXiv:2604.09860v42026Learning Versatile Humanoid Manipulation with Touch Dreaming
Yaru Niu, Zhenlong Fang, Binghong Chen +8
cs.ROarXiv:2604.13015v32026HiVLA: A Visual-Grounded-Centric Hierarchical Embodied Manipulation System
Tianshuo Yang, Guanyu Chen, Yutian Chen +8
cs.CVcs.AIcs.ROarXiv:2604.14125v22026Xiaomi OneVL: One-Step Latent Reasoning and Planning with Vision-Language Explanation
Jinghui Lu, Jiayi Guan, Zhijian Huang +47
cs.CVcs.CLcs.ROarXiv:2604.18486v32026Rethinking Demonstration Unlearning in Imitation Learning for Robotics
Jiazhuo Li, Yu Zhang, Yiming Fei +4
cs.ROcs.LGarXiv:2608.20784v12026Cortex 2.0: Grounding World Models in Real-World Industrial Deployment
Adriana Aida, Walid Amer, Katarina Bankovic +25
cs.ROcs.AIarXiv:2604.20246v12026UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling
Boyu Chen, Yi Chen, Lu Qiu +3
cs.ROcs.AIarXiv:2604.19734v12026dWorldEval: Scalable Robotic Policy Evaluation via Discrete Diffusion World Model
Yaxuan Li, Zhongyi Zhou, Yefei Chen +2
cs.ROarXiv:2604.22152v12026