Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
58,081 to 58,140 of 61,389
Deform360: A Massive Multi-view Visuotactile Dataset for Deformable World Models
Hongyu Li, Wanjia Fu, Xiaoyan Cong +11
cs.ROcs.CVarXiv:2607.05390v12026Summaries:한국어Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation
Haozhe Wang, Weijia Feng, Jinpeng Yu +8
cs.CVcs.AIarXiv:2607.05382v42026OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers
Siyuan Li, Jiabao Pan, Yumou Liu +9
cs.LGcs.AIarXiv:2607.04033v12026Summaries:한국어PointDiT: Pixel-Space Diffusion for Monocular Geometry Estimation
Haofei Xu, Rundi Wu, Philipp Henzler +7
cs.CVarXiv:2607.02515v12026Interpretation-Oriented Cloud Removal via Observation-Anchored Residual Flow with Geo-Contextual Alignment
Ziyao Wang, Maonan Wang, Yucheng He +5
cs.CVarXiv:2607.02471v12026ACID: Action Consistency via Inverse Dynamics for Planning with World Models
Gawon Seo, Dongwon Kim, Suha Kwak
cs.ROcs.AIcs.CVarXiv:2607.02403v12026Optimizing Visual Generative Models via Distribution-wise Rewards
Ruihang Li, Mengde Xu, Shuyang Gu +4
cs.LGcs.CVarXiv:2607.02291v12026Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification
Yunhao Feng, Ruixiao Lin, Ming Wen +12
cs.AIarXiv:2607.01793v22026CausalMix: Data Mixture as Causal Inference for Language Model Training
Zinan Tang, Yukun Zhang, Shaomian Zheng +6
cs.LGcs.AIcs.CLarXiv:2607.01104v12026Valdi: Value Diffusion World Models
Christopher Lindenberg, Kashyap Chitta
cs.LGcs.AIarXiv:2607.00917v12026NoPA: Non-Parametric Online 3D Scene Graph Generation
Qi Xun Yeo, Seungjun Lee, Yan Li +1
cs.CVarXiv:2607.00529v12026PixelEyes: Decoupling Perception and Reasoning for Pinpoint Visual Evidence Seeking
Dengxian Gong, Yuanzheng Wu, Haobo Yuan +11
cs.CVarXiv:2607.00115v12026MemLearner: Learning to Query Context memory for Video World Models
Jiwen Yu, Jianxiong Gao, Jianhong Bai +7
cs.CVarXiv:2606.31734v12026TACO: Tool-Augmented Credit Optimization for Agentic Tool Use
Mingkuan Feng, Jinyang Wu, Hao Gu +5
cs.MAarXiv:2606.30251v12026Summaries:한국어Monte Carlo Energy Aggregation for Mobile 3D Gaussian Splatting
Xiaobiao Du, YuAn Wang, Hao Li +3
cs.CVarXiv:2606.30017v12026GUICrafter: Weakly-Supervised GUI Agent Leveraging Massive Unannotated Screenshots
Sunqi Fan, Lingshan Chen, Runqi Yin +4
cs.AIcs.CLcs.CVarXiv:2606.29705v12026PoseShield: Neural Collision Fields for Human Self-Collision Resolution
Zhengyuan Li, Zeyun Deng, Yifan Shen +7
cs.CVarXiv:2606.29686v22026Bridging VideoQA and Video-Guided Agentic Tasks via Generalized Keyframe Extraction
Sunqi Fan, Qingle Liu, Runqi Yin +2
cs.CVcs.AIarXiv:2606.29445v12026Summaries:한국어EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting
Junwei Luo, Shuai Yuan, Zhenya Yang +3
cs.AIcs.CVarXiv:2606.27277v12026RedVox: Safety and Fairness Gaps in Speech Models Across Languages
Beatrice Savoldi, Sara Papi, Wafa Aissa +2
cs.CLarXiv:2606.26968v12026What the LLM Should Not Say: Boundary-Aware Context Grounding for A Seven-Channel EEG Agent
Zhiyuan Xu, Yueqing Dai, Junling Li +1
cs.AIarXiv:2606.26519v22026ShutterMuse: Capture-Time Photography Guidance with MLLMs
Jiayu Li, Yixiao Fang, Tianyu Hu +5
cs.CVarXiv:2606.25763v12026Summaries:한국어V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning
Haoxiang Sun, Zhihang Yi, Langxuan Deng +6
cs.CVarXiv:2606.25319v12026MEMPROBE: Probing Long-Term Agent Memory via Hidden User-State Recovery
Enze Ma, Yufan Zhou, Wei-Chieh Huang +7
cs.CLarXiv:2606.24595v12026FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning
Xirui Li, Zhe Liu, Xiaoqing Ye +4
cs.AIarXiv:2606.24231v12026Summaries:한국어Lift4D: Harmonizing Single-View 3D Estimation for 4D Reconstruction In-the-Wild
Yehonathan Litman, Xiaoxuan Ma, Manan Shah +4
cs.CVarXiv:2606.23688v12026Semantic Browsing: Controllable Diversity for Image Generation
Sara Dorfman, Maya Vishnevsky, Omer Dahary +2
cs.CVcs.AIcs.GRarXiv:2606.23679v12026Summaries:한국어Safe Few-Step Generation via Velocity Editing
Yujin Choi, Jaehong Yoon
cs.CVcs.CYarXiv:2606.23267v12026ShotcreteDepth: A Bi-modal Dataset for Robust Robotic Depth Perception in Shotcrete Construction Environments
Jakub Gregorek, Lars Arnold Dethlefsen, Patrick Schmidt +3
cs.ROarXiv:2606.23152v12026CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents
Zhanbo Hua, Yifan Yao, Weihao Xie +14
cs.AIarXiv:2606.22883v12026FedOT: Ownership Verification and Leakage Tracing via Watermarks for Federated LDMs
Wenlong Cheng, Yuan Gan, Yunqiu Xu +1
cs.CVarXiv:2606.22875v12026RaysUp: Ultra-light Universal Feature Upsampling via Geometry-Aware Ray Representation
Yuchuan Ding, Linfei Li, Lin Zhang +1
cs.CVarXiv:2606.22749v12026Summaries:한국어CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learning in Knowledge-Intensive Tasks
Ashwin Vinod, Ying Ding, Elias Stengel-Eskin
cs.CLcs.AIarXiv:2606.21777v12026SkillHarness: Harnessing Safe Skills for Computer-Use Agents
Yurun Chen, Biao Yi, Keting Yin +1
cs.AIcs.CLcs.CRarXiv:2606.20636v12026LedgerAgent: Structured State for Policy-Adherent Tool-Calling Agents
Md Nayem Uddin, Amir Saeidi, Eduardo Blanco +1
cs.AIcs.CLarXiv:2606.20529v12026Distill Once, Adapt Life-Long: Exploring Dataset Distillation for Continual Test-Time Adaptation
Hyun-Kurl Jang, Jihun Kim, Hyeokjun Kweon +1
cs.CVarXiv:2606.20196v22026WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents
Yehang Zhang, Jianchong Su, Haojian Huang +7
cs.AIarXiv:2606.18847v12026Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System
Jiazhao Zhang, Gengze Zhou, Hale Yin +32
cs.ROcs.CVarXiv:2606.18112v32026OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation
Guibin Zhang, Xun Xu, Yanwei Yue +4
cs.CLarXiv:2606.17628v12026MemSlides: A Hierarchical Memory Driven Agent Framework for Personalized Slide Generation with Multi-turn Local Revision
Ye Jin, Yangyang Xu, Jun Zhu +1
cs.CLcs.HCcs.MAarXiv:2606.17162v12026Context-Aware RL for Agentic and Multimodal LLMs
Peiyang Xu, Bangzheng Li, Sijia Liu +4
cs.CLcs.CVarXiv:2606.17053v12026Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models
Yanming Zhang, Yihan Bian, Jingyuan Qi +3
cs.CLarXiv:2606.16700v12026LectūraAgents: A Multi-Agent Framework for Adaptive Personalized AI-Assisted Learning and Embodied Teaching
Jaward Sesay, Yue Yu, Siwei Dong +1
cs.CLcs.AIcs.HCarXiv:2606.16428v32026MotionVLA: Vision-Language-Action Model for Humanoid Motion
Nonghai Zhang, Siyu Zhai, Yanjun Li +5
cs.CVcs.ROarXiv:2606.15142v12026Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion
Yi Lu, Zhuofeng Li, Ping Nie +7
cs.AIcs.CLarXiv:2606.14885v12026VISTA: View-Consistent Self-Verified Training for GUI Grounding
Xinyu Qiu, Yunzhu Zhang, Heng Jia +3
cs.AIarXiv:2606.14579v12026Running the Gauntlet: Re-evaluating the Capabilities of Agents Beyond Familiar Environments
Mykola Vysotskyi, Runqi Lin, Grzegorz Biziel +22
cs.LGarXiv:2606.14397v22026Summaries:한국어Aligning Quantum Operators with Large Language Models
Rogerio Feris, Yunchao Liu, Pengyuan Li +2
quant-phcs.AIarXiv:2606.13811v22026ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages
Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya +2
cs.CLcs.AIarXiv:2606.13572v22026High-Fidelity Two-Step Image Generation via Teacher-Aligned End-to-End Distillation
Dongyang Liu, Ruoyi Du, David Liu +7
cs.CVarXiv:2606.12575v12026Claw-SWE-Bench: A Benchmark for Evaluating OpenClaw-style Agent Harnesses on Coding Tasks
Mengyu Zheng, Kai Han, Boxun Li +13
cs.LGcs.CLarXiv:2606.12344v12026Measuring Epistemic Resilience of LLMs Under Misleading Medical Context
Hongjian Zhou, Xinyu Zou, Jinge Wu +19
cs.CLarXiv:2606.12291v22026Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code
Yitong Zhang, Shiteng Lu, Jia Li
cs.CRcs.AIcs.CLarXiv:2606.11817v12026Data Journalist Agent: Transforming Data into Verifiable Multimodal Stories
Kevin Qinghong Lin, Batu EI, Yuhong Shi +3
cs.CVcs.CLcs.CYarXiv:2606.11176v12026N-GRPO: Embedding-Level Neighbor Mixing for Enhanced Policy Optimization
Xukun Zhu, Hang Yu, Peng Di +1
cs.LGcs.CLarXiv:2606.10768v12026When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models
Sai Kartheek Reddy Kasu, Nils Lukas, Samuele Poppi
cs.AIcs.CLcs.LGarXiv:2606.10740v22026Decentralized Multi-Agent Systems with Shared Context
Yuzhen Mao, Azalia Mirhoseini
cs.MAcs.AIarXiv:2606.10662v12026WebChallenger: A Reliable and Efficient Generalist Web Agent
Jayoo Hwang, Xiaowen Zhang, Vedant Padwal
cs.CLarXiv:2606.10423v12026WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces
Wanli Li, Bowen Zhou, Yunyao Yu +4
cs.AIarXiv:2606.09426v32026DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning
Lingyong Yan, Can Xu, Yukun Zhao +13
cs.AIarXiv:2606.07299v12026