Robotics

Papers filed under cs.RO on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

2,581 to 2,640 of 3,243

  1. Modelling Uncertainty in Deep Learning for Camera Relocalization

    Alex Kendall, Roberto Cipolla

    cs.CVcs.ROarXiv:1509.05909v22015
  2. Visual Reinforcement Learning with Imagined Goals

    Ashvin Nair, Vitchyr Pong, Murtaza Dalal +3

    cs.LGcs.CVcs.ROarXiv:1807.04742v22018
  3. BehaviorWorldGen: Closing the Loop between Action Models and World Simulators via Controllable Behavior-Aware Structured World Generation

    Jiaqi Wang, Zhuo Zhang, Haining Guan +15

    cs.ROcs.CVarXiv:2608.22187v12026
  4. Curiosity-driven Exploration by Self-supervised Prediction

    Deepak Pathak, Pulkit Agrawal, Alexei A. Efros +1

    cs.LGcs.AIcs.CVarXiv:1705.05363v12017
  5. Variance-Guided Spatial Attention Fusion for Robust End-to-End Driving under Asymmetric Sensor Degradation

    Weizhi Tao, Zengwang Jin, Xiao Wang +1

    cs.CVcs.ROarXiv:2608.24366v12026
  6. An LSTM Network for Highway Trajectory Prediction

    Florent Altché, Arnaud de La Fortelle

    cs.ROcs.LGarXiv:1801.07962v12018
  7. Interpreting Control Latents for System Identification via Conditional Flow Matching

    Dingqi Zhang, Ruiqi Zhang, Mark W. Mueller

    cs.ROarXiv:2608.23887v12026
  8. DenseTNT: End-to-end Trajectory Prediction from Dense Goal Sets

    Junru Gu, Chen Sun, Hang Zhao

    cs.CVcs.ROarXiv:2108.09640v22021
  9. Learning to Poke by Poking: Experiential Learning of Intuitive Physics

    Pulkit Agrawal, Ashvin Nair, Pieter Abbeel +2

    cs.CVcs.AIcs.ROarXiv:1606.07419v22016
  10. TONAV: Task-Oriented Navigation and Action-Velocity Chunk Learning for Articulated Object Quadrupedal Mobile Manipulation

    Haoran Lin, Mingyu Yang, Pengfei Qi +6

    cs.ROcs.CVarXiv:2608.22296v12026
  11. Coverage Planning for Robotic Tooth Preparation in Densely Constrained Environments

    Yunwen Li, Chen Chen, Xiangjie Yan +4

    cs.ROarXiv:2608.24155v12026
  12. Trajectory-Level Continuous Action Representation for Robotic Manipulation

    Tong Yang, Jingkai Jia, Yuecheng Xu +3

    cs.ROarXiv:2608.24111v12026
  13. Beyond the Nav-Graph: Vision-and-Language Navigation in Continuous Environments

    Jacob Krantz, Erik Wijmans, Arjun Majumdar +2

    cs.CVcs.CLcs.ROarXiv:2004.02857v22020
  14. Resilience Matters for Embodied Agents System: New Metrics, Systematic Evaluation, and Optimization

    Yapeng Liu, Yuanzhao Zhai, Xudong Gong +4

    cs.ROcs.AIarXiv:2608.23839v12026
  15. Pointing-VLA: Typed Spatial Grounding Interfaces for Vision-Language-Action Manipulation

    Xiwen Chen, Zelin Li, Zhiruo Zhou +3

    cs.ROcs.AIcs.CVarXiv:2608.23138v12026
  16. Dynamical System-Based Imitation Learning and Neuroadaptive Control for Trajectory Recovery in Autonomous Ships

    Yeyson A. Becerra-Mora, José Ángel Acosta

    eess.SYcs.ROarXiv:2608.23924v12026
  17. CoDrift: Compositional Drifting for Offline Reinforcement Learning

    Xiewei Ni, Ruofeng Mei, Xiangyu Xu

    cs.LGcs.ROarXiv:2608.23939v12026
  18. Unbiased Offline Evaluation of Contextual-bandit-based News Article Recommendation Algorithms

    Lihong Li, Wei Chu, John Langford +1

    cs.LGcs.AIcs.ROarXiv:1003.5956v22010
  19. One-Shot Visual Imitation Learning via Meta-Learning

    Chelsea Finn, Tianhe Yu, Tianhao Zhang +2

    cs.LGcs.AIcs.CVarXiv:1709.04905v12017
  20. INTERACTION Dataset: An INTERnational, Adversarial and Cooperative moTION Dataset in Interactive Driving Scenarios with Semantic Maps

    Wei Zhan, Liting Sun, Di Wang +8

    cs.ROcs.CVcs.LGarXiv:1910.03088v12019
  21. Event-based Vision meets Deep Learning on Steering Prediction for Self-driving Cars

    Ana I. Maqueda, Antonio Loquercio, Guillermo Gallego +2

    cs.CVcs.LGcs.ROarXiv:1804.01310v12018
  22. Think Only When Needed: Prompt-Authority Control for Selective Slow-Path Intervention in Vision-Language-Action Manipulation

    Zhiruo Zhou, Zelin Li, Xiwen Chen +4

    cs.ROcs.AIcs.CVarXiv:2608.23224v12026
  23. An Empirical Evaluation of Deep Learning on Highway Driving

    Brody Huval, Tao Wang, Sameep Tandon +10

    cs.ROcs.CVarXiv:1504.01716v32015
  24. GaussianWAM: Distilling Geometry and Semantics from 3D Gaussian Fields into World-Action Models

    Zijian Zhang, Yuqing Jiang, Weitao Zhou +6

    cs.ROarXiv:2608.24714v12026
  25. Robust Slip Detection and Material Classification via Spatiotemporal Transformers on a Uniformly-Illuminated Visuo-Tactile Sensor

    Ziyang Ma, Yuhao Sun, Zichen Ai +2

    cs.ROarXiv:2608.24162v12026
  26. Fast Marching Tree: a Fast Marching Sampling-Based Method for Optimal Motion Planning in Many Dimensions

    Lucas Janson, Edward Schmerling, Ashley Clark +1

    cs.ROarXiv:1306.3532v42013
  27. TrAct: Bridging Robot Control and Visual Prediction with Visual Tracks

    Zhi Cao, Howard Ji, Kevin Zhang +4

    cs.ROarXiv:2608.24101v12026
  28. The Multi Vehicle Stereo Event Camera Dataset: An Event Camera Dataset for 3D Perception

    Alex Zihao Zhu, Dinesh Thakur, Tolga Ozaslan +3

    cs.ROarXiv:1801.10202v22018
  29. Motion Planning Among Dynamic, Decision-Making Agents with Deep Reinforcement Learning

    Michael Everett, Yu Fan Chen, Jonathan P. How

    cs.ROcs.AIcs.LGarXiv:1805.01956v12018
  30. Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion

    Boyuan Chen, Diego Marti Monso, Yilun Du +3

    cs.LGcs.CVcs.ROarXiv:2407.01392v42024
  31. Closing the Sim-to-Real Loop: Adapting Simulation Randomization with Real World Experience

    Yevgen Chebotar, Ankur Handa, Viktor Makoviychuk +4

    cs.ROcs.LGarXiv:1810.05687v42018
  32. Learning to Explore using Active Neural SLAM

    Devendra Singh Chaplot, Dhiraj Gandhi, Saurabh Gupta +2

    cs.CVcs.AIcs.LGarXiv:2004.05155v12020
  33. Spatio-Temporal Graph Transformer Networks for Pedestrian Trajectory Prediction

    Cunjun Yu, Xiao Ma, Jiawei Ren +2

    cs.CVcs.LGcs.ROarXiv:2005.08514v22020
  34. Visual Language Maps for Robot Navigation

    Chenguang Huang, Oier Mees, Andy Zeng +1

    cs.ROcs.AIcs.CLarXiv:2210.05714v42022
  35. Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots

    Cheng Chi, Zhenjia Xu, Chuer Pan +5

    cs.ROarXiv:2402.10329v32024
  36. GAIA-1: A Generative World Model for Autonomous Driving

    Anthony Hu, Lloyd Russell, Hudson Yeo +5

    cs.CVcs.AIcs.ROarXiv:2309.17080v12023
  37. Learning to Act While Waiting: RL Finetuning of Generalist Robot Policies Under Inference Latency

    Brian Zhu, Momen Khalil, E Harrison +17

    cs.ROcs.LGarXiv:2608.23831v12026
  38. GigaBrain-0.7: Scaling Embodied Foundation Models to Emergent Capabilities with a Three-System Architecture

    GigaBrain Team, Angen Ye, Axiang Sun +56

    cs.ROarXiv:2608.15875v12026
  39. Behavior Trees in Robotics and AI: An Introduction

    Michele Colledanchise, Petter Ögren

    cs.ROcs.AIarXiv:1709.00084v62017
  40. Fiber Bragg Grating Whiskers for Bioinspired Hydrodynamic Perception on Underwater Robots

    Hao Li, Tianyu Tu, Siyue Yao +7

    cs.ROarXiv:2608.24724v12026
  41. Do Robotic World Models Really Follow Actions? Diagnosing and Aligning Action-Conditioned Generation for Policy Learning

    Sixiang Chen, Jiaming Liu, Jixian Wu +7

    cs.ROcs.CVarXiv:2608.24885v12026
  42. Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research

    Matthias Plappert, Marcin Andrychowicz, Alex Ray +9

    cs.LGcs.AIcs.ROarXiv:1802.09464v22018
  43. Kimera: an Open-Source Library for Real-Time Metric-Semantic Localization and Mapping

    Antoni Rosinol, Marcus Abate, Yun Chang +1

    cs.ROcs.CVarXiv:1910.02490v32019
  44. Reinforced Cross-Modal Matching and Self-Supervised Imitation Learning for Vision-Language Navigation

    Xin Wang, Qiuyuan Huang, Asli Celikyilmaz +5

    cs.CVcs.AIcs.CLarXiv:1811.10092v22018
  45. Latent Action as Intention Enables Efficient Future Imagination for World Action Models

    Xiang Li, Yupeng Zheng, Songen Gu +10

    cs.ROarXiv:2608.24882v12026
  46. $(\text{DNN})^2$: Doubly Non-Negative Relaxations for Deep Neural Networks

    Hanna Jiamei Zhang, Alan Papalia, Michael Everett +1

    cs.LGcs.ROeess.SYarXiv:2608.24743v12026
  47. Residual Reinforcement Learning for Robot Control

    Tobias Johannink, Shikhar Bahl, Ashvin Nair +6

    cs.ROcs.LGarXiv:1812.03201v22018
  48. Learning Synergies between Pushing and Grasping with Self-supervised Deep Reinforcement Learning

    Andy Zeng, Shuran Song, Stefan Welker +3

    cs.ROcs.AIcs.CVarXiv:1803.09956v32018
  49. Vehicle Detection from 3D Lidar Using Fully Convolutional Network

    Bo Li, Tianlei Zhang, Tian Xia

    cs.CVcs.ROarXiv:1608.07916v12016
  50. Closing the Loop for Robotic Grasping: A Real-time, Generative Grasp Synthesis Approach

    Douglas Morrison, Peter Corke, Jürgen Leitner

    cs.ROarXiv:1804.05172v22018
  51. NeuralParker: A Reinforcement Learning Planner for Irregular Parking Environments

    Zihan Wang, Bai Huang, Yang Guan +4

    cs.ROcs.LGarXiv:2608.24485v12026
  52. CARO: Contact-Agnostic Residual Observation for Zero-Shot Robust Quadruped Locomotion

    Zihan Yang, Shixuan Han, Kexin Guo +1

    cs.ROarXiv:2608.24217v12026
  53. Learning to Adapt in Dynamic, Real-World Environments Through Meta-Reinforcement Learning

    Anusha Nagabandi, Ignasi Clavera, Simin Liu +4

    cs.LGcs.ROstat.MLarXiv:1803.11347v62018
  54. NVIDIA Cosmos-H-Dreams: Real-Time Generative Physics Simulation for Surgical Robotics

    Javier Gamazo Tejero, Lukas Zbinden, Keyur Sheth +7

    cs.ROarXiv:2608.24199v12026
  55. Trusted Polytopic Action Sets for Fast Planning in Underactuated Systems

    Akshay Jaitly, Siavash Farzan

    eess.SYcs.ROarXiv:2608.24019v12026
  56. Fiber Optic Sensing Glove for High Performance Dexterous Manipulation Capture

    J. D. Peiffer, Taylor Niehues, Li Guan +2

    cs.ROarXiv:2608.24572v12026
  57. A Durable Vision-Based Tactile Fingertip for Robotic Manipulation

    F. Richard Cottrell, Megha H. Tippur, Edward H. Adelson

    cs.ROarXiv:2608.24242v12026
  58. EgoActor: Grounding Task Planning into Spatial-aware Egocentric Actions for Humanoid Robots via Visual-Language Models

    Yu Bai, MingMing Yu, Chaojie Li +3

    cs.ROcs.CVarXiv:2602.04515v12026
  59. LLM+P: Empowering Large Language Models with Optimal Planning Proficiency

    Bo Liu, Yuqian Jiang, Xiaohan Zhang +4

    cs.AIcs.ROarXiv:2304.11477v32023
  60. LangMap: A Human-Verified Benchmark for Hierarchical Open-Vocabulary Goal Navigation

    Bo Miao, Weijia Liu, Jun Luo +8

    cs.CVcs.ROarXiv:2602.02220v22026