Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

54,301 to 54,360 of 61,093

  1. Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

    Lai Wei, Liangbo He, Jun Lan +9

    cs.CVcs.AIcs.CLarXiv:2602.11858v22026
  2. Hindsight Credit Assignment for Long-Horizon LLM Agents

    Hui-Ze Tan, Xiao-Wen Yang, Hao Chen +7

    cs.LGcs.AIarXiv:2603.08754v12026
    Summaries:简体中文
  3. RISE: Adaptive Imagination for World Action Models

    Hongbo Lu, Liang Yao, Chenghao He +5

    cs.CVarXiv:2608.20430v12026
  4. The Secrecy Capacity of the MIMO Wiretap Channel

    Frédérique Oggier, Babak Hassibi

    cs.ITcs.CRarXiv:0710.1920v12007
  5. BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View

    Junjie Huang, Guan Huang, Zheng Zhu +2

    cs.CVarXiv:2112.11790v32021
  6. Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning

    Zhaoyang Wang, Canwen Xu, Boyi Liu +5

    cs.AIcs.CLcs.LGarXiv:2602.10090v32026
  7. Communities in Networks

    Mason A. Porter, Jukka-Pekka Onnela, Peter J. Mucha

    physics.soc-phcond-mat.stat-mechcs.CYarXiv:0902.3788v22009
  8. RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation

    Sunzhu Li, Jiale Zhao, Miteto Wei +6

    cs.AIarXiv:2601.08430v22026
  9. NRC-Canada: Building the State-of-the-Art in Sentiment Analysis of Tweets

    Saif M. Mohammad, Svetlana Kiritchenko, Xiaodan Zhu

    cs.CLarXiv:1308.6242v12013
  10. Lift, Associate, and Fuse: A Decision-Centric Framework for 2D-to-3D Foundation Model Transfer

    Wentao Sun, Yiping Chen, John S. Zelek +1

    cs.CVarXiv:2608.20659v12026
  11. Large Language Model based Multi-Agents: A Survey of Progress and Challenges

    Taicheng Guo, Xiuying Chen, Yaqi Wang +5

    cs.CLcs.AIcs.MAarXiv:2402.01680v22024
  12. Context Forcing: Consistent Autoregressive Video Generation with Long Context

    Shuo Chen, Cong Wei, Sun Sun +5

    cs.CVarXiv:2602.06028v12026
  13. Pre-Trained Models: Past, Present and Future

    Xu Han, Zhengyan Zhang, Ning Ding +21

    cs.AIcs.CLarXiv:2106.07139v32021
  14. How Much Knowledge Can You Pack Into the Parameters of a Language Model?

    Adam Roberts, Colin Raffel, Noam Shazeer

    cs.CLcs.LGstat.MLarXiv:2002.08910v42020
  15. Beyond Language Modeling: An Exploration of Multimodal Pretraining

    Shengbang Tong, David Fan, John Nguyen +18

    cs.CVarXiv:2603.03276v12026
  16. A Dataset-Centric Benchmark of Deep Learning Methods for Grape Leaf Disease Classification and Detection

    Petar Canoski, Vlatko Spasev, Ivica Dimitrovski +2

    cs.CVarXiv:2608.20608v12026
  17. Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models

    Wenxuan Huang, Yu Zeng, Qiuchen Wang +14

    cs.CVcs.AIarXiv:2601.22060v32026
  18. Deep Packet: A Novel Approach For Encrypted Traffic Classification Using Deep Learning

    Mohammad Lotfollahi, Ramin Shirali Hossein Zade, Mahdi Jafari Siavoshani +1

    cs.LGcs.CRcs.NIarXiv:1709.02656v32017
  19. TS2Vec: Towards Universal Representation of Time Series

    Zhihan Yue, Yujing Wang, Juanyong Duan +4

    cs.LGcs.AIarXiv:2106.10466v42021
  20. Dynamic Filter Networks

    Bert De Brabandere, Xu Jia, Tinne Tuytelaars +1

    cs.LGcs.CVarXiv:1605.09673v22016
  21. Grounded-Exo2Ego: Structured Semantic Grounding for Robust Exocentric-to-Egocentric Video Generation

    Shengze Wang, Michael Stengel, Tianye Li +5

    cs.CVarXiv:2608.20534v12026
  22. RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies

    Yinpei Dai, Hongze Fu, Jayjun Lee +6

    cs.ROcs.AIarXiv:2603.04639v32026
  23. Snapshot Ensembles: Train 1, get M for free

    Gao Huang, Yixuan Li, Geoff Pleiss +3

    cs.LGarXiv:1704.00109v12017
  24. A-RAG: Scaling Agentic Retrieval-Augmented Generation via Hierarchical Retrieval Interfaces

    Mingxuan Du, Benfeng Xu, Chiwei Zhu +4

    cs.CLarXiv:2602.03442v12026
  25. Can LLMs Express Their Uncertainty? An Empirical Evaluation of Confidence Elicitation in LLMs

    Miao Xiong, Zhiyuan Hu, Xinyang Lu +4

    cs.CLarXiv:2306.13063v22023
  26. LoopFormer: Elastic-Depth Looped Transformers for Latent Reasoning via Shortcut Modulation

    Ahmadreza Jeddi, Marco Ciccone, Babak Taati

    cs.CLarXiv:2602.11451v12026
  27. FAST-LIO: A Fast, Robust LiDAR-inertial Odometry Package by Tightly-Coupled Iterated Kalman Filter

    Wei Xu, Fu Zhang

    cs.ROarXiv:2010.08196v32020
  28. Natural-Language Agent Harnesses

    Linyue Pan, Lexiao Zou, Shuo Guo +2

    cs.CLcs.AIarXiv:2603.25723v22026
  29. Kimi K2.5: Visual Agentic Intelligence

    Kimi Team, Tongtong Bai, Yifan Bai +334

    cs.CLcs.AIcs.LGarXiv:2602.02276v22026
    Summaries:한국어
  30. Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes

    Yuqian Fu, Haohuan Huang, Kaiwen Jiang +4

    cs.LGcs.AIcs.CLarXiv:2603.25562v22026
  31. Meta-Harness: End-to-End Optimization of Model Harnesses

    Yoonho Lee, Roshen Nair, Qizheng Zhang +3

    cs.AIarXiv:2603.28052v12026
  32. MOVA: Towards Scalable and Synchronized Video-Audio Generation

    SII-OpenMOSS Team, :, Donghua Yu +39

    cs.CVcs.SDarXiv:2602.08794v22026
    Summaries:한국어
  33. Towards a Science of AI Agent Reliability

    Stephan Rabanser, Sayash Kapoor, Peter Kirgis +3

    cs.AIcs.CYcs.LGarXiv:2602.16666v32026
  34. RoboBrain 2.5: Depth in Sight, Time in Mind

    Huajie Tan, Enshen Zhou, Zhiyu Li +32

    cs.ROarXiv:2601.14352v12026
  35. Scaling Text-to-Image Diffusion Transformers with Representation Autoencoders

    Shengbang Tong, Boyang Zheng, Ziteng Wang +7

    cs.CVarXiv:2601.16208v12026
  36. Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation

    Wenkai Yang, Weijie Liu, Ruobing Xie +3

    cs.LGcs.AIcs.CLarXiv:2602.12125v22026
  37. Agent Skills: A Data-Driven Analysis of Claude Skills for Extending Large Language Model Functionality

    George Ling, Shanshan Zhong, Richard Huang

    cs.SEcs.SIarXiv:2602.08004v12026
  38. DeepSeek-OCR 2: Visual Causal Flow

    Haoran Wei, Yaofeng Sun, Yukun Li

    cs.CVarXiv:2601.20552v12026
  39. PaddleOCR-VL-1.5: Towards a Multi-Task 0.9B VLM for Robust In-the-Wild Document Parsing

    Cheng Cui, Ting Sun, Suyin Liang +12

    cs.CVarXiv:2601.21957v22026
  40. LLaDA2.1: Speeding Up Text Diffusion via Token Editing

    Tiwei Bie, Maosong Cao, Xiang Cao +47

    cs.LGcs.AIarXiv:2602.08676v32026
  41. Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation

    Hongzhou Zhu, Min Zhao, Guande He +3

    cs.CVarXiv:2602.02214v52026
  42. Self-Distillation Enables Continual Learning

    Idan Shenfeld, Mehul Damani, Jonas Hübotter +1

    cs.LGarXiv:2601.19897v22026
    Summaries:한국어
  43. SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks

    Xiangyi Li, Yimin Liu, Wenbo Chen +75

    cs.AIarXiv:2602.12670v42026
  44. Trace2Skill: Distill Trajectory-Local Lessons into Transferable Agent Skills

    Jingwei Ni, Yihao Liu, Xinpeng Liu +7

    cs.AIarXiv:2603.25158v52026
  45. GigaWorld-Policy: An Efficient Action-Centered World--Action Model

    Angen Ye, Boyuan Wang, Chaojun Ni +21

    cs.CVarXiv:2603.17240v22026
  46. Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding

    Christopher Clark, Jieyu Zhang, Zixian Ma +18

    cs.CVcs.AIarXiv:2601.10611v42026
  47. Agent Skills in the Wild: An Empirical Study of Security Vulnerabilities at Scale

    Yi Liu, Weizhe Wang, Ruitao Feng +5

    cs.CRcs.AIcs.CLarXiv:2601.10338v12026
  48. DFlash: Block Diffusion for Flash Speculative Decoding

    Jian Chen, Yesheng Liang, Zhijian Liu

    cs.CLarXiv:2602.06036v22026
  49. Qwen3-TTS Technical Report

    Hangrui Hu, Xinfa Zhu, Ting He +13

    cs.SDcs.CLeess.ASarXiv:2601.15621v12026
    Summaries:简体中文
  50. Being-H0.5: Scaling Human-Centric Robot Learning for Cross-Embodiment Generalization

    Hao Luo, Ye Wang, Wanpeng Zhang +9

    cs.ROarXiv:2601.12993v12026
  51. Numina-Lean-Agent: An Open and General Agentic Reasoning System for Formal Mathematics

    Junqi Liu, Zihao Zhou, Zekai Zhu +10

    cs.AIarXiv:2601.14027v12026
  52. SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning

    Peng Xia, Jianwen Chen, Hanyang Wang +10

    cs.LGarXiv:2602.08234v12026
  53. CRISP: Compressed Reasoning via Iterative Self-Policy Distillation

    Hejian Sang, Yuanda Xu, Zhengze Zhou +3

    cs.LGarXiv:2603.05433v72026
  54. Causal World Modeling for Robot Control

    Lin Li, Qihang Zhang, Yiming Luo +9

    cs.CVcs.ROarXiv:2601.21998v22026
  55. CUDA Agent: Large-Scale Agentic RL for High-Performance CUDA Kernel Generation

    Weinan Dai, Hanlin Wu, Qiying Yu +13

    cs.LGcs.AIarXiv:2602.24286v12026
  56. SkillNet: Create, Evaluate, and Connect AI Skills

    Yuan Liang, Ruobin Zhong, Haoming Xu +47

    cs.AIcs.CLcs.CVarXiv:2603.04448v22026
  57. CL-bench: A Benchmark for Context Learning

    Shihan Dou, Ming Zhang, Zhangyue Yin +24

    cs.CLarXiv:2602.03587v12026
  58. One-step Latent-free Image Generation with Pixel Mean Flows

    Yiyang Lu, Susie Lu, Qiao Sun +6

    cs.CVarXiv:2601.22158v32026
  59. Helios: Real Real-Time Long Video Generation Model

    Shenghai Yuan, Yuanyang Yin, Zongjian Li +3

    cs.CVarXiv:2603.04379v12026
  60. VLA-JEPA: Enhancing Vision-Language-Action Model with Latent World Model

    Jingwen Sun, Wenyao Zhang, Zekun Qi +6

    cs.ROcs.CVarXiv:2602.10098v22026