Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

58,141 to 58,200 of 61,393

  1. Decentralized Multi-Agent Systems with Shared Context

    Yuzhen Mao, Azalia Mirhoseini

    cs.MAcs.AIarXiv:2606.10662v12026
  2. WebChallenger: A Reliable and Efficient Generalist Web Agent

    Jayoo Hwang, Xiaowen Zhang, Vedant Padwal

    cs.CLarXiv:2606.10423v12026
  3. WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces

    Wanli Li, Bowen Zhou, Yunyao Yu +4

    cs.AIarXiv:2606.09426v32026
  4. DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning

    Lingyong Yan, Can Xu, Yukun Zhao +13

    cs.AIarXiv:2606.07299v12026
  5. Towards Retrieving Interaction Spaces for Agentic Search

    Shengyao Zhuang, Yuansheng Ni, Hengxin Fun +2

    cs.IRarXiv:2606.06880v12026
    Summaries:한국어
  6. Direct 3D-Aware Object Insertion via Decomposed Visual Proxies

    Jingbo Gong, Yikai Wang, Yushi Lan +6

    cs.CVcs.AIcs.LGarXiv:2606.06601v12026
  7. Unsupervised Skill Discovery for Agentic Data Analysis

    Zhisong Qiu, Kangqi Song, Shengwei Tang +4

    cs.AIcs.CLcs.LGarXiv:2606.06416v12026
  8. Compress-Distill: Reasoning Trace Compression for Efficient Knowledge Distillation

    Maxime Griot, Paul Steven Scotti, Tanishq Mathew Abraham

    cs.LGcs.CLarXiv:2606.05988v12026
  9. Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data

    XiuYu Zhang, Yi Shan, Junfeng Fang +1

    cs.CLarXiv:2606.05122v12026
  10. The Meta-Agent Challenge: Are Current Agents Capable of Autonomous Agent Development?

    Xinyu Lu, Tianshu Wang, Pengbo Wang +8

    cs.AIcs.CLarXiv:2606.04455v12026
  11. Skill-RM: Unifying Heterogeneous Evaluation Criteria via Agent Skill

    Tao Chen, Gangwei Jiang, Pengyu Cheng +10

    cs.LGcs.CLarXiv:2606.03980v12026
  12. AAD-1: Asymmetric Adversarial Distillation for One-Step Autoregressive Video Generation

    Haobo Li, Yanhong Zeng, Yunhong Lu +6

    cs.CVarXiv:2606.03972v22026
  13. NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation

    NVIDIA, :, Aarti Basant +32

    cs.CVcs.AIcs.ROarXiv:2606.03159v22026
  14. EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning

    Guhong Chen, Yingcheng Shi, Yongbin Li +6

    cs.AIarXiv:2606.03108v22026
  15. Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbation and Reward Modeling

    Seojeong Park, Jiho Choi, Junyong Kang +3

    cs.CVcs.AIarXiv:2606.02578v12026
  16. Policy and World Modeling Co-Training for Language Agents

    Ning Lu, Baijiong Lin, Shengcai Liu +9

    cs.LGcs.AIarXiv:2606.02388v12026
  17. Trust Region On-Policy Distillation

    Xingrun Xing, Haoqing Wang, Boyan Gao +2

    cs.LGcs.CLarXiv:2606.01249v32026
  18. RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes

    Leyi Wu, Yifan Zhao, Jinjie Zhang +11

    cs.CVarXiv:2606.00828v12026
  19. GGT-100K: Generative Ground Truth for Generalizable Real-World Image Restoration

    Xiangtao Kong, Jixin Zhao, Lingchen Sun +2

    cs.CVarXiv:2605.31039v22026
  20. OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration

    Xinchen Zhang, Bowei Liu, Jiale Liu +7

    cs.CLcs.AIcs.CVarXiv:2605.28805v12026
  21. GEM: Generative Supervision Helps Embodied Intelligence

    Ruowen Zhao, Bangguo Li, Zuyan Liu +9

    cs.CVarXiv:2605.28548v12026
  22. Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations

    Sachin Kumar

    cs.CLcs.AIcs.LGarXiv:2605.27958v12026
  23. LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding

    Shihao Wang, Shilong Liu, Yuanguo Kuang +10

    cs.CVcs.AIcs.LGarXiv:2605.27365v22026
  24. Gemini Embedding 2: A Native Multimodal Embedding Model from Gemini

    Madhuri Shanbhogue, Zhe Li, Shanfeng Zhang +86

    cs.CVarXiv:2605.27295v12026
    Summaries:한국어
  25. When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges

    Parth Darshan, Abhishek Divekar

    cs.CLcs.AIcs.LGarXiv:2605.26046v22026
  26. AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions

    Jingwei Sun, Jianing Zhu, Yuanyi Li +3

    cs.AIarXiv:2605.25707v12026
  27. CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM

    Yubo Li, Yidi Miao

    cs.LGcs.AIarXiv:2605.24786v12026
  28. Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution

    Hongbo Wang, Huaibo Huang, Pin Wang +3

    cs.CVcs.AIarXiv:2605.23264v22026
  29. AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild

    Baiyu Chen, Zechen Li, Wilson Wongso +5

    cs.CVcs.AIcs.CLarXiv:2605.22715v22026
  30. Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents

    Asaf Yehudai, Lilach Eden, Michal Shmueli-Scheuer

    cs.CLcs.AIarXiv:2605.22608v12026
  31. Segment Anything with Motion, Geometry, and Semantic Adaptation for Complex Nonlinear Visual Object Tracking

    Deyi Zhu, Yuji Wang, Yong Liu +4

    cs.CVarXiv:2605.22538v12026
  32. Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill Ensembles

    Jinyang Wu, Guocheng Zhai, Ruihan Jin +7

    cs.LGcs.CLarXiv:2605.22177v12026
  33. The Illusion of Reasoning: Exposing Evasive Data Contamination in LLMs via Zero-CoT Truncation

    Yifan Lan, Yuanpu Cao, Hanyu Wang +2

    cs.LGcs.AIarXiv:2605.21856v12026
  34. ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison

    Tianle Li, Xuyang Shen, Yan Ma +7

    cs.LGcs.AIcs.CVarXiv:2605.20278v22026
  35. PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents

    Zhuohan Gu, Qizheng Zhang, Omar Khattab +1

    cs.AIcs.CLcs.LGarXiv:2605.19932v12026
  36. GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment

    Minxuan Lv, Tiehua Mei, Tanlong Du +9

    cs.CLarXiv:2605.19577v12026
  37. Artifact-Bench: Evaluating MLLMs on Detecting and Assessing the Artifacts of AI-Generated Videos

    Yuqi Tang, Yang Shi, Zhuoran Zhang +21

    cs.CVarXiv:2605.18984v12026
  38. Evaluating Cognitive Age Alignment in Interactive AI Agents

    Yifan Shen, Jiawen Zhang, Jian Xu +4

    cs.AIarXiv:2605.17894v12026
  39. Self-Improving CAD Generation Agents with Finite Element Analysis as Feedback

    Guijin Son, Jehyun Park, Seyeon Park +2

    cs.GRcs.CLarXiv:2605.17448v22026
  40. When Vision Speaks for Sound

    Xiaofei Wen, Wenjie Jacky Mo, Xingyu Fu +6

    cs.CVcs.SDarXiv:2605.16403v12026
  41. PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control

    Jingxuan Wei, Xi Bai, Shan Liu +8

    cs.AIarXiv:2605.15963v12026
  42. Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution

    Han Li, Jinyu Tian, Rili Feng +10

    cs.AIarXiv:2605.15301v12026
  43. SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer

    Haoyi Zhu, Haozhe Liu, Yuyang Zhao +6

    cs.CVarXiv:2605.15178v12026
    Summaries:한국어
  44. Nexus : An Agentic Framework for Time Series Forecasting

    Sarkar Snigdha Sarathi Das, Palash Goyal, Mihir Parmar +6

    cs.AIcs.CLcs.LGarXiv:2605.14389v12026
  45. Auditing Agent Harness Safety

    Chengzhi Liu, Yichen Guo, Yepeng Liu +8

    cs.CLcs.CYarXiv:2605.14271v22026
  46. EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents

    Jiaqi Liu, Xinyu Ye, Peng Xia +4

    cs.LGcs.AIarXiv:2605.13941v12026
  47. Learning, Fast and Slow: Towards LLMs That Adapt Continually

    Rishabh Tiwari, Kusha Sareen, Lakshya A Agrawal +6

    cs.LGcs.AIarXiv:2605.12484v22026
  48. ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents

    Xuhao Hu, Xi Zhang, Haiyang Xu +6

    cs.AIarXiv:2605.12481v12026
    Summaries:한국어
  49. $δ$-mem: Efficient Online Memory for Large Language Models

    Jingdi Lei, Di Zhang, Junxian Li +7

    cs.AIarXiv:2605.12357v12026
  50. Learning Agentic Policy from Action Guidance

    Yuxiang Ji, Zengbin Wang, Yong Wang +6

    cs.CLarXiv:2605.12004v12026
  51. The Many Faces of On-Policy Distillation: Pitfalls, Mechanisms, and Fixes

    Siqi Zhu, Xuyan Ye, Hongyu Lu +2

    cs.AIarXiv:2605.11182v22026
    Summaries:한국어
  52. Rethinking Agentic Search with Pi-Serini: Is Lexical Retrieval Sufficient?

    Tz-Huan Hsu, Jheng-Hong Yang, Jimmy Lin

    cs.IRcs.AIcs.CLarXiv:2605.10848v12026
  53. WorldReasonBench: Human-Aligned Stress Testing of Video Generators as Future World-State Predictors

    Keming Wu, Yijing Cui, Wenhan Xue +11

    cs.CVarXiv:2605.10434v12026
  54. Metal-Sci: A Scientific Compute Benchmark for Evolutionary LLM Kernel Search on Apple Silicon

    Víctor Gallego

    cs.LGcs.AIcs.DCarXiv:2605.09708v22026
  55. Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models

    Yicheng Ji, Zhizhou Zhong, Jun Zhang +7

    cs.CVarXiv:2605.09681v12026
  56. Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction

    Ngoc Bui, Hieu Trung Nguyen, Arman Cohan +1

    cs.LGarXiv:2605.09649v12026
  57. MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments

    Giridhar Ganapavarapu, Dhaval Patel

    cs.AIcs.MAarXiv:2605.09131v12026
  58. Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs

    Guijin Son, Seungone Kim, Catherine Arnett +73

    cs.CLarXiv:2605.09063v32026
  59. CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models

    Joowon Kim, Seungho Shin, Joonhyung Park +1

    cs.CVarXiv:2605.08735v12026
  60. RewardHarness: Self-Evolving Agentic Post-Training

    Yuxuan Zhang, Penghui Du, Bo Li +11

    cs.AIcs.CLcs.CVarXiv:2605.08703v12026