Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

54,361 to 54,420 of 61,178

  1. DynamicVLA: A Vision-Language-Action Model for Dynamic Object Manipulation

    Haozhe Xie, Beichen Wen, Jiarui Zheng +4

    cs.ROcs.CVarXiv:2601.22153v12026
  2. Kernels for Vector-Valued Functions: a Review

    Mauricio A. Alvarez, Lorenzo Rosasco, Neil D. Lawrence

    stat.MLcs.AImath.STarXiv:1106.6251v22011
  3. Nonlinear Model Predictive Control for Trajectory Tracking of Differentially Flat Fixed-Wing Aerial Systems

    Nishanth Bobbili, Pratyaksh Rao, Luca Morando +2

    cs.ROarXiv:2608.20655v12026
    Summaries:한국어
  4. MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification

    MiroMind Team, S. Bai, L. Bing +41

    cs.CLcs.AIcs.IRarXiv:2603.15726v12026
  5. Solaris: Building a Multiplayer Video World Model in Minecraft

    Georgy Savva, Oscar Michel, Daohan Lu +6

    cs.CVarXiv:2602.22208v22026
  6. Beyond the Traceback: Using LLMs for Adaptive Explanations of Programming Errors

    Alexandru-Radu Moraru, Shreyan Biswas, Ujwal Gadiraju

    cs.SEcs.HCarXiv:2608.20896v12026
  7. A Transformer-Based Siamese Network for Change Detection

    Wele Gedara Chaminda Bandara, Vishal M. Patel

    cs.CVarXiv:2201.01293v72022
  8. Vision Transformers for Single Image Dehazing

    Yuda Song, Zhuqing He, Hui Qian +1

    cs.CVarXiv:2204.03883v12022
  9. UI-Venus-1.5 Technical Report

    Venus Team, Changlong Gao, Zhangxuan Gu +24

    cs.CVcs.AIcs.CLarXiv:2602.09082v22026
  10. Infinite-World: Scaling Interactive World Models to 1000-Frame Horizons via Pose-Free Hierarchical Memory

    Ruiqi Wu, Xuanhua He, Meng Cheng +8

    cs.CVcs.AIarXiv:2602.02393v22026
  11. TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics

    Shirui Chen, Cole Harrison, Ying-Chun Lee +6

    cs.ROcs.AIcs.LGarXiv:2602.19313v22026
  12. Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs

    Haoming Meng, Kexin Huang, Shaohang Wei +6

    cs.CLcs.AIcs.LGarXiv:2603.22446v12026
  13. FeUdal Networks for Hierarchical Reinforcement Learning

    Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul +4

    cs.AIarXiv:1703.01161v22017
  14. Selective Classification for Deep Neural Networks

    Yonatan Geifman, Ran El-Yaniv

    cs.LGcs.AIarXiv:1705.08500v22017
  15. GridDehazeNet: Attention-Based Multi-Scale Network for Image Dehazing

    Xiaohong Liu, Yongrui Ma, Zhihao Shi +1

    cs.CVeess.IVarXiv:1908.03245v12019
  16. Gen-Searcher: Reinforcing Agentic Search for Image Generation

    Kaituo Feng, Manyuan Zhang, Shuang Chen +7

    cs.CVarXiv:2603.28767v32026
  17. A General Theoretical Paradigm to Understand Learning from Human Preferences

    Mohammad Gheshlaghi Azar, Mark Rowland, Bilal Piot +4

    cs.AIcs.LGstat.MLarXiv:2310.12036v22023
  18. FFJORD: Free-form Continuous Dynamics for Scalable Reversible Generative Models

    Will Grathwohl, Ricky T. Q. Chen, Jesse Bettencourt +2

    cs.LGcs.CVstat.MLarXiv:1810.01367v32018
  19. Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation

    Yuval Kirstain, Adam Polyak, Uriel Singer +3

    cs.CVcs.AIarXiv:2305.01569v22023
  20. FireRed-Image-Edit-1.0 Technical Report

    Super Intelligence Team, Changhao Qiao, Chao Hui +16

    cs.CVeess.IVarXiv:2602.13344v22026
  21. Disentangling and Unifying Graph Convolutions for Skeleton-Based Action Recognition

    Ziyu Liu, Hongwen Zhang, Zhenghao Chen +2

    cs.CVarXiv:2003.14111v22020
  22. Multi-Modal Traffic Sign Detection with Semantic Attributes for Autonomous Driving

    Meda Lazar, Sourab Sridhar, Shashwata Gupta +3

    cs.CVcs.ROarXiv:2608.20874v12026
  23. Deep Kernel Learning

    Andrew Gordon Wilson, Zhiting Hu, Ruslan Salakhutdinov +1

    cs.LGcs.AIstat.MEarXiv:1511.02222v12015
  24. Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond

    Jingfeng Yang, Hongye Jin, Ruixiang Tang +5

    cs.CLcs.AIcs.LGarXiv:2304.13712v22023
  25. PCN: Point Completion Network

    Wentao Yuan, Tejas Khot, David Held +2

    cs.CVcs.ROarXiv:1808.00671v32018
  26. MedCLIP: Contrastive Learning from Unpaired Medical Images and Text

    Zifeng Wang, Zhenbang Wu, Dinesh Agarwal +1

    cs.CVcs.CLarXiv:2210.10163v12022
  27. Vector Quantized Diffusion Model for Text-to-Image Synthesis

    Shuyang Gu, Dong Chen, Jianmin Bao +5

    cs.CVcs.LGarXiv:2111.14822v32021
  28. Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations

    Peiyi Wang, Lei Li, Zhihong Shao +6

    cs.AIcs.CLcs.LGarXiv:2312.08935v32023
  29. RepPoints: Point Set Representation for Object Detection

    Ze Yang, Shaohui Liu, Han Hu +2

    cs.CVarXiv:1904.11490v22019
  30. OmniWeaving: Towards Unified Video Generation with Free-form Composition and Reasoning

    Kaihang Pan, Qi Tian, Jianwei Zhang +11

    cs.CVarXiv:2603.24458v22026
  31. IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse

    Yushi Bai, Qian Dong, Ting Jiang +5

    cs.CLcs.LGarXiv:2603.12201v12026
  32. EvoScientist: Towards Multi-Agent Evolving AI Scientists for End-to-End Scientific Discovery

    Yougang Lyu, Xi Zhang, Xinhao Yi +9

    cs.CLarXiv:2603.08127v12026
  33. Show Your Work: Scratchpads for Intermediate Computation with Language Models

    Maxwell Nye, Anders Johan Andreassen, Guy Gur-Ari +9

    cs.LGcs.NEarXiv:2112.00114v12021
  34. STRIP: A Defence Against Trojan Attacks on Deep Neural Networks

    Yansong Gao, Chang Xu, Derui Wang +3

    cs.CRarXiv:1902.06531v22019
  35. SWE-Pruner: Self-Adaptive Context Pruning for Coding Agents

    Yuhang Wang, Yuling Shi, Mo Yang +7

    cs.SEcs.CLarXiv:2601.16746v42026
  36. Recognition-Conditioned Reasoning: A Training-Free Multimodal-LLM Pipeline for Fine-Grained Micro-Action Understanding

    Fengshun Wang, Jin'ang Han, Zhigang Tu

    cs.CVcs.MMarXiv:2608.21022v12026
  37. eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers

    Yogesh Balaji, Seungjun Nah, Xun Huang +10

    cs.CVcs.LGarXiv:2211.01324v52022
  38. In-Context Retrieval-Augmented Language Models

    Ori Ram, Yoav Levine, Itay Dalmedigos +4

    cs.CLcs.IRarXiv:2302.00083v32023
  39. Beyond Mean Frametime: Time-Series Signatures for XR Timing Analysis

    Marvin Thäns, Marc Erich Latoschik

    cs.HCarXiv:2608.20861v12026
  40. BabyVision: Visual Reasoning Beyond Language

    Liang Chen, Weichu Xie, Yiyan Liang +27

    cs.CVcs.CLarXiv:2601.06521v22026
  41. The Belief Update Gate: Separating Inertia from Learning in Human-AI Interaction

    Shreyan Biswas, Alexander Erlei, Ujwal Gadiraju

    cs.HCarXiv:2608.20828v12026
  42. Feature Hashing for Large Scale Multitask Learning

    Kilian Weinberger, Anirban Dasgupta, Josh Attenberg +2

    cs.AIarXiv:0902.2206v52009
  43. V-DPM: 4D Video Reconstruction with Dynamic Point Maps

    Edgar Sucar, Eldar Insafutdinov, Zihang Lai +1

    cs.CVarXiv:2601.09499v12026
  44. OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    Peng Wang, An Yang, Rui Men +7

    cs.CVcs.CLarXiv:2202.03052v22022
  45. Beyond Nyquist: Efficient Sampling of Sparse Bandlimited Signals

    Joel A. Tropp, Jason N. Laska, Marco F. Duarte +2

    cs.ITarXiv:0902.0026v22009
  46. Endless Terminals: Scaling RL Environments for Terminal Agents

    Kanishk Gandhi, Shivam Garg, Noah D. Goodman +1

    cs.LGcs.CLarXiv:2601.16443v32026
  47. LayoutLM: Pre-training of Text and Layout for Document Image Understanding

    Yiheng Xu, Minghao Li, Lei Cui +3

    cs.CLarXiv:1912.13318v52019
  48. Xiaomi-Robotics-0: An Open-Sourced Vision-Language-Action Model with Real-Time Execution

    Rui Cai, Jun Guo, Xinze He +20

    cs.ROcs.LGarXiv:2602.12684v22026
  49. The FineWeb Datasets: Decanting the Web for the Finest Text Data at Scale

    Guilherme Penedo, Hynek Kydlíček, Loubna Ben allal +5

    cs.CLarXiv:2406.17557v22024
  50. KoViDoRe: Korean Visual Document Retrieval

    Yongbin Choi, Yongwoo Song, Mujeen Sung

    cs.IRcs.CVarXiv:2608.20840v12026
  51. Video-to-Video Synthesis

    Ting-Chun Wang, Ming-Yu Liu, Jun-Yan Zhu +4

    cs.CVcs.GRcs.LGarXiv:1808.06601v22018
  52. Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning

    Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1

    cs.LGcs.AIcs.ROarXiv:1708.02596v22017
  53. Comparative Study of CNN and RNN for Natural Language Processing

    Wenpeng Yin, Katharina Kann, Mo Yu +1

    cs.CLarXiv:1702.01923v12017
  54. MV2GF: Multi-view Pedestrian Detection with a Visual Geometric Foundation Model

    Taiga Yamane, Satoshi Suzuki, Ryo Masumura +4

    cs.CVarXiv:2608.20639v12026
  55. EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience

    Taofeng Xue, Chong Peng, Mianqiu Huang +13

    cs.AIarXiv:2601.15876v22026
  56. Spatial-Temporal Fusion Graph Neural Networks for Traffic Flow Forecasting

    Mengzhang Li, Zhanxing Zhu

    cs.LGcs.AIarXiv:2012.09641v22020
  57. OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data

    Yuwen Du, Rui Ye, Shuo Tang +4

    cs.AIcs.CLarXiv:2603.15594v12026
  58. Learning to reinforcement learn

    Jane X Wang, Zeb Kurth-Nelson, Dhruva Tirumala +6

    cs.LGcs.AIstat.MLarXiv:1611.05763v32016
  59. Conformalized Quantile Regression

    Yaniv Romano, Evan Patterson, Emmanuel J. Candès

    stat.MEstat.MLarXiv:1905.03222v12019
  60. Interactive Attention Networks for Aspect-Level Sentiment Classification

    Dehong Ma, Sujian Li, Xiaodong Zhang +1

    cs.AIcs.CLarXiv:1709.00893v12017