Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
54,601 to 54,660 of 61,348
Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Lai Wei, Liangbo He, Jun Lan +9
cs.CVcs.AIcs.CLarXiv:2602.11858v22026Hindsight Credit Assignment for Long-Horizon LLM Agents
Hui-Ze Tan, Xiao-Wen Yang, Hao Chen +7
cs.LGcs.AIarXiv:2603.08754v12026Summaries:简体中文RISE: Adaptive Imagination for World Action Models
Hongbo Lu, Liang Yao, Chenghao He +5
cs.CVarXiv:2608.20430v12026The Secrecy Capacity of the MIMO Wiretap Channel
Frédérique Oggier, Babak Hassibi
cs.ITcs.CRarXiv:0710.1920v12007BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View
Junjie Huang, Guan Huang, Zheng Zhu +2
cs.CVarXiv:2112.11790v32021Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
Zhaoyang Wang, Canwen Xu, Boyi Liu +5
cs.AIcs.CLcs.LGarXiv:2602.10090v32026Communities in Networks
Mason A. Porter, Jukka-Pekka Onnela, Peter J. Mucha
physics.soc-phcond-mat.stat-mechcs.CYarXiv:0902.3788v22009RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation
Sunzhu Li, Jiale Zhao, Miteto Wei +6
cs.AIarXiv:2601.08430v22026NRC-Canada: Building the State-of-the-Art in Sentiment Analysis of Tweets
Saif M. Mohammad, Svetlana Kiritchenko, Xiaodan Zhu
cs.CLarXiv:1308.6242v12013Lift, Associate, and Fuse: A Decision-Centric Framework for 2D-to-3D Foundation Model Transfer
Wentao Sun, Yiping Chen, John S. Zelek +1
cs.CVarXiv:2608.20659v12026Large Language Model based Multi-Agents: A Survey of Progress and Challenges
Taicheng Guo, Xiuying Chen, Yaqi Wang +5
cs.CLcs.AIcs.MAarXiv:2402.01680v22024Context Forcing: Consistent Autoregressive Video Generation with Long Context
Shuo Chen, Cong Wei, Sun Sun +5
cs.CVarXiv:2602.06028v12026Pre-Trained Models: Past, Present and Future
Xu Han, Zhengyan Zhang, Ning Ding +21
cs.AIcs.CLarXiv:2106.07139v32021How Much Knowledge Can You Pack Into the Parameters of a Language Model?
Adam Roberts, Colin Raffel, Noam Shazeer
cs.CLcs.LGstat.MLarXiv:2002.08910v42020Beyond Language Modeling: An Exploration of Multimodal Pretraining
Shengbang Tong, David Fan, John Nguyen +18
cs.CVarXiv:2603.03276v12026A Dataset-Centric Benchmark of Deep Learning Methods for Grape Leaf Disease Classification and Detection
Petar Canoski, Vlatko Spasev, Ivica Dimitrovski +2
cs.CVarXiv:2608.20608v12026Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models
Wenxuan Huang, Yu Zeng, Qiuchen Wang +14
cs.CVcs.AIarXiv:2601.22060v32026Deep Packet: A Novel Approach For Encrypted Traffic Classification Using Deep Learning
Mohammad Lotfollahi, Ramin Shirali Hossein Zade, Mahdi Jafari Siavoshani +1
cs.LGcs.CRcs.NIarXiv:1709.02656v32017TS2Vec: Towards Universal Representation of Time Series
Zhihan Yue, Yujing Wang, Juanyong Duan +4
cs.LGcs.AIarXiv:2106.10466v42021Dynamic Filter Networks
Bert De Brabandere, Xu Jia, Tinne Tuytelaars +1
cs.LGcs.CVarXiv:1605.09673v22016Grounded-Exo2Ego: Structured Semantic Grounding for Robust Exocentric-to-Egocentric Video Generation
Shengze Wang, Michael Stengel, Tianye Li +5
cs.CVarXiv:2608.20534v12026RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies
Yinpei Dai, Hongze Fu, Jayjun Lee +6
cs.ROcs.AIarXiv:2603.04639v32026Snapshot Ensembles: Train 1, get M for free
Gao Huang, Yixuan Li, Geoff Pleiss +3
cs.LGarXiv:1704.00109v12017A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces
Mingxuan Du, Benfeng Xu, Chiwei Zhu +4
cs.CLarXiv:2602.03442v12026Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs
Miao Xiong, Zhiyuan Hu, Xinyang Lu +4
cs.CLarXiv:2306.13063v22023LoopFormer: Elastic-Depth Looped Transformers for Latent Reasoning via Shortcut Modulation
Ahmadreza Jeddi, Marco Ciccone, Babak Taati
cs.CLarXiv:2602.11451v12026FAST-LIO: A Fast, Robust LiDAR-inertial Odometry Package by Tightly-Coupled Iterated Kalman Filter
Wei Xu, Fu Zhang
cs.ROarXiv:2010.08196v32020Natural-Language Agent Harnesses
Linyue Pan, Lexiao Zou, Shuo Guo +2
cs.CLcs.AIarXiv:2603.25723v22026Kimi K2.5: Visual Agentic Intelligence
Kimi Team, Tongtong Bai, Yifan Bai +334
cs.CLcs.AIcs.LGarXiv:2602.02276v22026Summaries:한국어Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes
Yuqian Fu, Haohuan Huang, Kaiwen Jiang +4
cs.LGcs.AIcs.CLarXiv:2603.25562v22026Meta-Harness: End-to-End Optimization of Model Harnesses
Yoonho Lee, Roshen Nair, Qizheng Zhang +3
cs.AIarXiv:2603.28052v12026MOVA: Towards Scalable and Synchronized Video-Audio Generation
SII-OpenMOSS Team, :, Donghua Yu +39
cs.CVcs.SDarXiv:2602.08794v22026Summaries:한국어Towards a Science of AI Agent Reliability
Stephan Rabanser, Sayash Kapoor, Peter Kirgis +3
cs.AIcs.CYcs.LGarXiv:2602.16666v32026RoboBrain 2.5: Depth in Sight, Time in Mind
Huajie Tan, Enshen Zhou, Zhiyu Li +32
cs.ROarXiv:2601.14352v12026Scaling Text-to-Image Diffusion Transformers with Representation Autoencoders
Shengbang Tong, Boyang Zheng, Ziteng Wang +7
cs.CVarXiv:2601.16208v12026Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation
Wenkai Yang, Weijie Liu, Ruobing Xie +3
cs.LGcs.AIcs.CLarXiv:2602.12125v22026Agent Skills: A Data-Driven Analysis of Claude Skills for Extending Large Language Model Functionality
George Ling, Shanshan Zhong, Richard Huang
cs.SEcs.SIarXiv:2602.08004v12026DeepSeek-OCR 2: Visual Causal Flow
Haoran Wei, Yaofeng Sun, Yukun Li
cs.CVarXiv:2601.20552v12026PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing
Cheng Cui, Ting Sun, Suyin Liang +12
cs.CVarXiv:2601.21957v22026LLaDA2.1: Speeding Up Text Diffusion via Token Editing
Tiwei Bie, Maosong Cao, Xiang Cao +47
cs.LGcs.AIarXiv:2602.08676v32026Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation
Hongzhou Zhu, Min Zhao, Guande He +3
cs.CVarXiv:2602.02214v52026Self-Distillation Enables Continual Learning
Idan Shenfeld, Mehul Damani, Jonas Hübotter +1
cs.LGarXiv:2601.19897v22026Summaries:한국어SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks
Xiangyi Li, Yimin Liu, Wenbo Chen +75
cs.AIarXiv:2602.12670v42026Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills
Jingwei Ni, Yihao Liu, Xinpeng Liu +7
cs.AIarXiv:2603.25158v52026GigaWorld-Policy: An Efficient Action-Centered World--Action Model
Angen Ye, Boyuan Wang, Chaojun Ni +21
cs.CVarXiv:2603.17240v22026Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding
Christopher Clark, Jieyu Zhang, Zixian Ma +18
cs.CVcs.AIarXiv:2601.10611v42026Agent Skills in the Wild: An Empirical Study of Security Vulnerabilities at Scale
Yi Liu, Weizhe Wang, Ruitao Feng +5
cs.CRcs.AIcs.CLarXiv:2601.10338v12026DFlash: Block Diffusion for Flash Speculative Decoding
Jian Chen, Yesheng Liang, Zhijian Liu
cs.CLarXiv:2602.06036v22026Qwen3-TTS Technical Report
Hangrui Hu, Xinfa Zhu, Ting He +13
cs.SDcs.CLeess.ASarXiv:2601.15621v12026Summaries:简体中文Being-H0.5: Scaling Human-Centric Robot Learning for Cross-Embodiment Generalization
Hao Luo, Ye Wang, Wanpeng Zhang +9
cs.ROarXiv:2601.12993v12026Numina-Lean-Agent: An Open and General Agentic Reasoning System for Formal Mathematics
Junqi Liu, Zihao Zhou, Zekai Zhu +10
cs.AIarXiv:2601.14027v12026SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning
Peng Xia, Jianwen Chen, Hanyang Wang +10
cs.LGarXiv:2602.08234v12026CRISP: Compressed Reasoning via Iterative Self-Policy Distillation
Hejian Sang, Yuanda Xu, Zhengze Zhou +3
cs.LGarXiv:2603.05433v72026Causal World Modeling for Robot Control
Lin Li, Qihang Zhang, Yiming Luo +9
cs.CVcs.ROarXiv:2601.21998v22026CUDA Agent: Large-Scale Agentic RL for High-Performance CUDA Kernel Generation
Weinan Dai, Hanlin Wu, Qiying Yu +13
cs.LGcs.AIarXiv:2602.24286v12026SkillNet: Create, Evaluate, and Connect AI Skills
Yuan Liang, Ruobin Zhong, Haoming Xu +47
cs.AIcs.CLcs.CVarXiv:2603.04448v22026CL-bench: A Benchmark for Context Learning
Shihan Dou, Ming Zhang, Zhangyue Yin +24
cs.CLarXiv:2602.03587v12026One-step Latent-free Image Generation with Pixel Mean Flows
Yiyang Lu, Susie Lu, Qiao Sun +6
cs.CVarXiv:2601.22158v32026Helios: Real Real-Time Long Video Generation Model
Shenghai Yuan, Yuanyang Yin, Zongjian Li +3
cs.CVarXiv:2603.04379v12026VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model
Jingwen Sun, Wenyao Zhang, Zekun Qi +6
cs.ROcs.CVarXiv:2602.10098v22026