Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
58,141 to 58,200 of 61,393
Decentralized Multi-Agent Systems with Shared Context
Yuzhen Mao, Azalia Mirhoseini
cs.MAcs.AIarXiv:2606.10662v12026WebChallenger: A Reliable and Efficient Generalist Web Agent
Jayoo Hwang, Xiaowen Zhang, Vedant Padwal
cs.CLarXiv:2606.10423v12026WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces
Wanli Li, Bowen Zhou, Yunyao Yu +4
cs.AIarXiv:2606.09426v32026DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning
Lingyong Yan, Can Xu, Yukun Zhao +13
cs.AIarXiv:2606.07299v12026Towards Retrieving Interaction Spaces for Agentic Search
Shengyao Zhuang, Yuansheng Ni, Hengxin Fun +2
cs.IRarXiv:2606.06880v12026Summaries:한국어Direct 3D-Aware Object Insertion via Decomposed Visual Proxies
Jingbo Gong, Yikai Wang, Yushi Lan +6
cs.CVcs.AIcs.LGarXiv:2606.06601v12026Unsupervised Skill Discovery for Agentic Data Analysis
Zhisong Qiu, Kangqi Song, Shengwei Tang +4
cs.AIcs.CLcs.LGarXiv:2606.06416v12026Compress-Distill: Reasoning Trace Compression for Efficient Knowledge Distillation
Maxime Griot, Paul Steven Scotti, Tanishq Mathew Abraham
cs.LGcs.CLarXiv:2606.05988v12026Self-Evaluation Is Already There: Eliciting Latent Judge Calibration in Base LLMs with Minimal Data
XiuYu Zhang, Yi Shan, Junfeng Fang +1
cs.CLarXiv:2606.05122v12026The Meta-Agent Challenge: Are Current Agents Capable of Autonomous Agent Development?
Xinyu Lu, Tianshu Wang, Pengbo Wang +8
cs.AIcs.CLarXiv:2606.04455v12026Skill-RM: Unifying Heterogeneous Evaluation Criteria via Agent Skill
Tao Chen, Gangwei Jiang, Pengyu Cheng +10
cs.LGcs.CLarXiv:2606.03980v12026AAD-1: Asymmetric Adversarial Distillation for One-Step Autoregressive Video Generation
Haobo Li, Yanhong Zeng, Yunhong Lu +6
cs.CVarXiv:2606.03972v22026NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation
NVIDIA, :, Aarti Basant +32
cs.CVcs.AIcs.ROarXiv:2606.03159v22026EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning
Guhong Chen, Yingcheng Shi, Yongbin Li +6
cs.AIarXiv:2606.03108v22026Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbation and Reward Modeling
Seojeong Park, Jiho Choi, Junyong Kang +3
cs.CVcs.AIarXiv:2606.02578v12026Policy and World Modeling Co-Training for Language Agents
Ning Lu, Baijiong Lin, Shengcai Liu +9
cs.LGcs.AIarXiv:2606.02388v12026Trust Region On-Policy Distillation
Xingrun Xing, Haoqing Wang, Boyan Gao +2
cs.LGcs.CLarXiv:2606.01249v32026RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes
Leyi Wu, Yifan Zhao, Jinjie Zhang +11
cs.CVarXiv:2606.00828v12026GGT-100K: Generative Ground Truth for Generalizable Real-World Image Restoration
Xiangtao Kong, Jixin Zhao, Lingchen Sun +2
cs.CVarXiv:2605.31039v22026OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration
Xinchen Zhang, Bowei Liu, Jiale Liu +7
cs.CLcs.AIcs.CVarXiv:2605.28805v12026GEM: Generative Supervision Helps Embodied Intelligence
Ruowen Zhao, Bangguo Li, Zuyan Liu +9
cs.CVarXiv:2605.28548v12026Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations
Sachin Kumar
cs.CLcs.AIcs.LGarXiv:2605.27958v12026LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding
Shihao Wang, Shilong Liu, Yuanguo Kuang +10
cs.CVcs.AIcs.LGarXiv:2605.27365v22026Gemini Embedding 2: A Native Multimodal Embedding Model from Gemini
Madhuri Shanbhogue, Zhe Li, Shanfeng Zhang +86
cs.CVarXiv:2605.27295v12026Summaries:한국어When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges
Parth Darshan, Abhishek Divekar
cs.CLcs.AIcs.LGarXiv:2605.26046v22026AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions
Jingwei Sun, Jianing Zhu, Yuanyi Li +3
cs.AIarXiv:2605.25707v12026CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM
Yubo Li, Yidi Miao
cs.LGcs.AIarXiv:2605.24786v12026Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution
Hongbo Wang, Huaibo Huang, Pin Wang +3
cs.CVcs.AIarXiv:2605.23264v22026AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild
Baiyu Chen, Zechen Li, Wilson Wongso +5
cs.CVcs.AIcs.CLarXiv:2605.22715v22026Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents
Asaf Yehudai, Lilach Eden, Michal Shmueli-Scheuer
cs.CLcs.AIarXiv:2605.22608v12026Segment Anything with Motion, Geometry, and Semantic Adaptation for Complex Nonlinear Visual Object Tracking
Deyi Zhu, Yuji Wang, Yong Liu +4
cs.CVarXiv:2605.22538v12026Maestro: Reinforcement Learning to Orchestrate Hierarchical Model-Skill Ensembles
Jinyang Wu, Guocheng Zhai, Ruihan Jin +7
cs.LGcs.CLarXiv:2605.22177v12026The Illusion of Reasoning: Exposing Evasive Data Contamination in LLMs via Zero-CoT Truncation
Yifan Lan, Yuanpu Cao, Hanyu Wang +2
cs.LGcs.AIarXiv:2605.21856v12026ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison
Tianle Li, Xuyang Shen, Yan Ma +7
cs.LGcs.AIcs.CVarXiv:2605.20278v22026PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
Zhuohan Gu, Qizheng Zhang, Omar Khattab +1
cs.AIcs.CLcs.LGarXiv:2605.19932v12026GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment
Minxuan Lv, Tiehua Mei, Tanlong Du +9
cs.CLarXiv:2605.19577v12026Artifact-Bench: Evaluating MLLMs on Detecting and Assessing the Artifacts of AI-Generated Videos
Yuqi Tang, Yang Shi, Zhuoran Zhang +21
cs.CVarXiv:2605.18984v12026Evaluating Cognitive Age Alignment in Interactive AI Agents
Yifan Shen, Jiawen Zhang, Jian Xu +4
cs.AIarXiv:2605.17894v12026Self-Improving CAD Generation Agents with Finite Element Analysis as Feedback
Guijin Son, Jehyun Park, Seyeon Park +2
cs.GRcs.CLarXiv:2605.17448v22026When Vision Speaks for Sound
Xiaofei Wen, Wenjie Jacky Mo, Xingyu Fu +6
cs.CVcs.SDarXiv:2605.16403v12026PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control
Jingxuan Wei, Xi Bai, Shan Liu +8
cs.AIarXiv:2605.15963v12026Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution
Han Li, Jinyu Tian, Rili Feng +10
cs.AIarXiv:2605.15301v12026SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
Haoyi Zhu, Haozhe Liu, Yuyang Zhao +6
cs.CVarXiv:2605.15178v12026Summaries:한국어Nexus : An Agentic Framework for Time Series Forecasting
Sarkar Snigdha Sarathi Das, Palash Goyal, Mihir Parmar +6
cs.AIcs.CLcs.LGarXiv:2605.14389v12026Auditing Agent Harness Safety
Chengzhi Liu, Yichen Guo, Yepeng Liu +8
cs.CLcs.CYarXiv:2605.14271v22026EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
Jiaqi Liu, Xinyu Ye, Peng Xia +4
cs.LGcs.AIarXiv:2605.13941v12026Learning, Fast and Slow: Towards LLMs That Adapt Continually
Rishabh Tiwari, Kusha Sareen, Lakshya A Agrawal +6
cs.LGcs.AIarXiv:2605.12484v22026ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents
Xuhao Hu, Xi Zhang, Haiyang Xu +6
cs.AIarXiv:2605.12481v12026Summaries:한국어$δ$-mem: Efficient Online Memory for Large Language Models
Jingdi Lei, Di Zhang, Junxian Li +7
cs.AIarXiv:2605.12357v12026Learning Agentic Policy from Action Guidance
Yuxiang Ji, Zengbin Wang, Yong Wang +6
cs.CLarXiv:2605.12004v12026The Many Faces of On-Policy Distillation: Pitfalls, Mechanisms, and Fixes
Siqi Zhu, Xuyan Ye, Hongyu Lu +2
cs.AIarXiv:2605.11182v22026Summaries:한국어Rethinking Agentic Search with Pi-Serini: Is Lexical Retrieval Sufficient?
Tz-Huan Hsu, Jheng-Hong Yang, Jimmy Lin
cs.IRcs.AIcs.CLarXiv:2605.10848v12026WorldReasonBench: Human-Aligned Stress Testing of Video Generators as Future World-State Predictors
Keming Wu, Yijing Cui, Wenhan Xue +11
cs.CVarXiv:2605.10434v12026Metal-Sci: A Scientific Compute Benchmark for Evolutionary LLM Kernel Search on Apple Silicon
Víctor Gallego
cs.LGcs.AIcs.DCarXiv:2605.09708v22026Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
Yicheng Ji, Zhizhou Zhong, Jun Zhang +7
cs.CVarXiv:2605.09681v12026Make Each Token Count: Towards Improving Long-Context Performance with KV Cache Eviction
Ngoc Bui, Hieu Trung Nguyen, Arman Cohan +1
cs.LGarXiv:2605.09649v12026MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments
Giridhar Ganapavarapu, Dhaval Patel
cs.AIcs.MAarXiv:2605.09131v12026Soohak: A Mathematician-Curated Benchmark for Evaluating Research-level Math Capabilities of LLMs
Guijin Son, Seungone Kim, Catherine Arnett +73
cs.CLarXiv:2605.09063v32026CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models
Joowon Kim, Seungho Shin, Joonhyung Park +1
cs.CVarXiv:2605.08735v12026RewardHarness: Self-Evolving Agentic Post-Training
Yuxuan Zhang, Penghui Du, Bo Li +11
cs.AIcs.CLcs.CVarXiv:2605.08703v12026