Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
54,361 to 54,420 of 61,178
DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation
Haozhe Xie, Beichen Wen, Jiarui Zheng +4
cs.ROcs.CVarXiv:2601.22153v12026Kernels for Vector-Valued Functions: a Review
Mauricio A. Alvarez, Lorenzo Rosasco, Neil D. Lawrence
stat.MLcs.AImath.STarXiv:1106.6251v22011Nonlinear Model Predictive Control for Trajectory Tracking of Differentially Flat Fixed-Wing Aerial Systems
Nishanth Bobbili, Pratyaksh Rao, Luca Morando +2
cs.ROarXiv:2608.20655v12026Summaries:한국어MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification
MiroMind Team, S. Bai, L. Bing +41
cs.CLcs.AIcs.IRarXiv:2603.15726v12026Solaris: Building a Multiplayer Video World Model in Minecraft
Georgy Savva, Oscar Michel, Daohan Lu +6
cs.CVarXiv:2602.22208v22026Beyond the Traceback: Using LLMs for Adaptive Explanations of Programming Errors
Alexandru-Radu Moraru, Shreyan Biswas, Ujwal Gadiraju
cs.SEcs.HCarXiv:2608.20896v12026A Transformer-Based Siamese Network for Change Detection
Wele Gedara Chaminda Bandara, Vishal M. Patel
cs.CVarXiv:2201.01293v72022Vision Transformers for Single Image Dehazing
Yuda Song, Zhuqing He, Hui Qian +1
cs.CVarXiv:2204.03883v12022UI-Venus-1.5 Technical Report
Venus Team, Changlong Gao, Zhangxuan Gu +24
cs.CVcs.AIcs.CLarXiv:2602.09082v22026Infinite-World: Scaling Interactive World Models to 1000-Frame Horizons via Pose-Free Hierarchical Memory
Ruiqi Wu, Xuanhua He, Meng Cheng +8
cs.CVcs.AIarXiv:2602.02393v22026TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
Shirui Chen, Cole Harrison, Ying-Chun Lee +6
cs.ROcs.AIcs.LGarXiv:2602.19313v22026Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
Haoming Meng, Kexin Huang, Shaohang Wei +6
cs.CLcs.AIcs.LGarXiv:2603.22446v12026FeUdal Networks for Hierarchical Reinforcement Learning
Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul +4
cs.AIarXiv:1703.01161v22017Selective Classification for Deep Neural Networks
Yonatan Geifman, Ran El-Yaniv
cs.LGcs.AIarXiv:1705.08500v22017GridDehazeNet: Attention-Based Multi-Scale Network for Image Dehazing
Xiaohong Liu, Yongrui Ma, Zhihao Shi +1
cs.CVeess.IVarXiv:1908.03245v12019Gen-Searcher: Reinforcing Agentic Search for Image Generation
Kaituo Feng, Manyuan Zhang, Shuang Chen +7
cs.CVarXiv:2603.28767v32026A General Theoretical Paradigm to Understand Learning from Human Preferences
Mohammad Gheshlaghi Azar, Mark Rowland, Bilal Piot +4
cs.AIcs.LGstat.MLarXiv:2310.12036v22023FFJORD: Free-form Continuous Dynamics for Scalable Reversible Generative Models
Will Grathwohl, Ricky T. Q. Chen, Jesse Bettencourt +2
cs.LGcs.CVstat.MLarXiv:1810.01367v32018Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation
Yuval Kirstain, Adam Polyak, Uriel Singer +3
cs.CVcs.AIarXiv:2305.01569v22023FireRed-Image-Edit-1.0 Technical Report
Super Intelligence Team, Changhao Qiao, Chao Hui +16
cs.CVeess.IVarXiv:2602.13344v22026Disentangling and Unifying Graph Convolutions for Skeleton-Based Action Recognition
Ziyu Liu, Hongwen Zhang, Zhenghao Chen +2
cs.CVarXiv:2003.14111v22020Multi-Modal Traffic Sign Detection with Semantic Attributes for Autonomous Driving
Meda Lazar, Sourab Sridhar, Shashwata Gupta +3
cs.CVcs.ROarXiv:2608.20874v12026Deep Kernel Learning
Andrew Gordon Wilson, Zhiting Hu, Ruslan Salakhutdinov +1
cs.LGcs.AIstat.MEarXiv:1511.02222v12015Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond
Jingfeng Yang, Hongye Jin, Ruixiang Tang +5
cs.CLcs.AIcs.LGarXiv:2304.13712v22023PCN: Point Completion Network
Wentao Yuan, Tejas Khot, David Held +2
cs.CVcs.ROarXiv:1808.00671v32018MedCLIP: Contrastive Learning from Unpaired Medical Images and Text
Zifeng Wang, Zhenbang Wu, Dinesh Agarwal +1
cs.CVcs.CLarXiv:2210.10163v12022Vector Quantized Diffusion Model for Text-to-Image Synthesis
Shuyang Gu, Dong Chen, Jianmin Bao +5
cs.CVcs.LGarXiv:2111.14822v32021Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations
Peiyi Wang, Lei Li, Zhihong Shao +6
cs.AIcs.CLcs.LGarXiv:2312.08935v32023RepPoints: Point Set Representation for Object Detection
Ze Yang, Shaohui Liu, Han Hu +2
cs.CVarXiv:1904.11490v22019OmniWeaving: Towards Unified Video Generation with Free-form Composition and Reasoning
Kaihang Pan, Qi Tian, Jianwei Zhang +11
cs.CVarXiv:2603.24458v22026IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse
Yushi Bai, Qian Dong, Ting Jiang +5
cs.CLcs.LGarXiv:2603.12201v12026EvoScientist: Towards Multi-Agent Evolving AI Scientists for End-to-End Scientific Discovery
Yougang Lyu, Xi Zhang, Xinhao Yi +9
cs.CLarXiv:2603.08127v12026Show Your Work: Scratchpads for Intermediate Computation with Language Models
Maxwell Nye, Anders Johan Andreassen, Guy Gur-Ari +9
cs.LGcs.NEarXiv:2112.00114v12021STRIP: A Defence Against Trojan Attacks on Deep Neural Networks
Yansong Gao, Chang Xu, Derui Wang +3
cs.CRarXiv:1902.06531v22019SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents
Yuhang Wang, Yuling Shi, Mo Yang +7
cs.SEcs.CLarXiv:2601.16746v42026Recognition-Conditioned Reasoning: A Training-Free Multimodal-LLM Pipeline for Fine-Grained Micro-Action Understanding
Fengshun Wang, Jin'ang Han, Zhigang Tu
cs.CVcs.MMarXiv:2608.21022v12026eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers
Yogesh Balaji, Seungjun Nah, Xun Huang +10
cs.CVcs.LGarXiv:2211.01324v52022In-Context Retrieval-Augmented Language Models
Ori Ram, Yoav Levine, Itay Dalmedigos +4
cs.CLcs.IRarXiv:2302.00083v32023Beyond Mean Frametime: Time-Series Signatures for XR Timing Analysis
Marvin Thäns, Marc Erich Latoschik
cs.HCarXiv:2608.20861v12026BabyVision: Visual Reasoning Beyond Language
Liang Chen, Weichu Xie, Yiyan Liang +27
cs.CVcs.CLarXiv:2601.06521v22026The Belief Update Gate: Separating Inertia from Learning in Human-AI Interaction
Shreyan Biswas, Alexander Erlei, Ujwal Gadiraju
cs.HCarXiv:2608.20828v12026Feature Hashing for Large Scale Multitask Learning
Kilian Weinberger, Anirban Dasgupta, Josh Attenberg +2
cs.AIarXiv:0902.2206v52009V-DPM: 4D Video Reconstruction with Dynamic Point Maps
Edgar Sucar, Eldar Insafutdinov, Zihang Lai +1
cs.CVarXiv:2601.09499v12026OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework
Peng Wang, An Yang, Rui Men +7
cs.CVcs.CLarXiv:2202.03052v22022Beyond Nyquist: Efficient Sampling of Sparse Bandlimited Signals
Joel A. Tropp, Jason N. Laska, Marco F. Duarte +2
cs.ITarXiv:0902.0026v22009Endless Terminals: Scaling RL Environments for Terminal Agents
Kanishk Gandhi, Shivam Garg, Noah D. Goodman +1
cs.LGcs.CLarXiv:2601.16443v32026LayoutLM: Pre-training of Text and Layout for Document Image Understanding
Yiheng Xu, Minghao Li, Lei Cui +3
cs.CLarXiv:1912.13318v52019Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution
Rui Cai, Jun Guo, Xinze He +20
cs.ROcs.LGarXiv:2602.12684v22026The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale
Guilherme Penedo, Hynek Kydlíček, Loubna Ben allal +5
cs.CLarXiv:2406.17557v22024KoViDoRe: Korean Visual Document Retrieval
Yongbin Choi, Yongwoo Song, Mujeen Sung
cs.IRcs.CVarXiv:2608.20840v12026Video-to-Video Synthesis
Ting-Chun Wang, Ming-Yu Liu, Jun-Yan Zhu +4
cs.CVcs.GRcs.LGarXiv:1808.06601v22018Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning
Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1
cs.LGcs.AIcs.ROarXiv:1708.02596v22017Comparative Study of CNN and RNN for Natural Language Processing
Wenpeng Yin, Katharina Kann, Mo Yu +1
cs.CLarXiv:1702.01923v12017MV2GF: Multi-view Pedestrian Detection with a Visual Geometric Foundation Model
Taiga Yamane, Satoshi Suzuki, Ryo Masumura +4
cs.CVarXiv:2608.20639v12026EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience
Taofeng Xue, Chong Peng, Mianqiu Huang +13
cs.AIarXiv:2601.15876v22026Spatial-Temporal Fusion Graph Neural Networks for Traffic Flow Forecasting
Mengzhang Li, Zhanxing Zhu
cs.LGcs.AIarXiv:2012.09641v22020OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data
Yuwen Du, Rui Ye, Shuo Tang +4
cs.AIcs.CLarXiv:2603.15594v12026Learning to reinforcement learn
Jane X Wang, Zeb Kurth-Nelson, Dhruva Tirumala +6
cs.LGcs.AIstat.MLarXiv:1611.05763v32016Conformalized Quantile Regression
Yaniv Romano, Evan Patterson, Emmanuel J. Candès
stat.MEstat.MLarXiv:1905.03222v12019Interactive Attention Networks for Aspect-Level Sentiment Classification
Dehong Ma, Sujian Li, Xiaodong Zhang +1
cs.AIcs.CLarXiv:1709.00893v12017