Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

58,081 to 58,140 of 61,389

  1. Deform360: A Massive Multi-view Visuotactile Dataset for Deformable World Models

    Hongyu Li, Wanjia Fu, Xiaoyan Cong +11

    cs.ROcs.CVarXiv:2607.05390v12026
    Summaries:한국어
  2. Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation

    Haozhe Wang, Weijia Feng, Jinpeng Yu +8

    cs.CVcs.AIarXiv:2607.05382v42026
  3. OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers

    Siyuan Li, Jiabao Pan, Yumou Liu +9

    cs.LGcs.AIarXiv:2607.04033v12026
    Summaries:한국어
  4. PointDiT: Pixel-Space Diffusion for Monocular Geometry Estimation

    Haofei Xu, Rundi Wu, Philipp Henzler +7

    cs.CVarXiv:2607.02515v12026
  5. Interpretation-Oriented Cloud Removal via Observation-Anchored Residual Flow with Geo-Contextual Alignment

    Ziyao Wang, Maonan Wang, Yucheng He +5

    cs.CVarXiv:2607.02471v12026
  6. ACID: Action Consistency via Inverse Dynamics for Planning with World Models

    Gawon Seo, Dongwon Kim, Suha Kwak

    cs.ROcs.AIcs.CVarXiv:2607.02403v12026
  7. Optimizing Visual Generative Models via Distribution-wise Rewards

    Ruihang Li, Mengde Xu, Shuyang Gu +4

    cs.LGcs.CVarXiv:2607.02291v12026
  8. Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification

    Yunhao Feng, Ruixiao Lin, Ming Wen +12

    cs.AIarXiv:2607.01793v22026
  9. CausalMix: Data Mixture as Causal Inference for Language Model Training

    Zinan Tang, Yukun Zhang, Shaomian Zheng +6

    cs.LGcs.AIcs.CLarXiv:2607.01104v12026
  10. Valdi: Value Diffusion World Models

    Christopher Lindenberg, Kashyap Chitta

    cs.LGcs.AIarXiv:2607.00917v12026
  11. NoPA: Non-Parametric Online 3D Scene Graph Generation

    Qi Xun Yeo, Seungjun Lee, Yan Li +1

    cs.CVarXiv:2607.00529v12026
  12. PixelEyes: Decoupling Perception and Reasoning for Pinpoint Visual Evidence Seeking

    Dengxian Gong, Yuanzheng Wu, Haobo Yuan +11

    cs.CVarXiv:2607.00115v12026
  13. MemLearner: Learning to Query Context memory for Video World Models

    Jiwen Yu, Jianxiong Gao, Jianhong Bai +7

    cs.CVarXiv:2606.31734v12026
  14. TACO: Tool-Augmented Credit Optimization for Agentic Tool Use

    Mingkuan Feng, Jinyang Wu, Hao Gu +5

    cs.MAarXiv:2606.30251v12026
    Summaries:한국어
  15. Monte Carlo Energy Aggregation for Mobile 3D Gaussian Splatting

    Xiaobiao Du, YuAn Wang, Hao Li +3

    cs.CVarXiv:2606.30017v12026
  16. GUICrafter: Weakly-Supervised GUI Agent Leveraging Massive Unannotated Screenshots

    Sunqi Fan, Lingshan Chen, Runqi Yin +4

    cs.AIcs.CLcs.CVarXiv:2606.29705v12026
  17. PoseShield: Neural Collision Fields for Human Self-Collision Resolution

    Zhengyuan Li, Zeyun Deng, Yifan Shen +7

    cs.CVarXiv:2606.29686v22026
  18. Bridging VideoQA and Video-Guided Agentic Tasks via Generalized Keyframe Extraction

    Sunqi Fan, Qingle Liu, Runqi Yin +2

    cs.CVcs.AIarXiv:2606.29445v12026
    Summaries:한국어
  19. EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting

    Junwei Luo, Shuai Yuan, Zhenya Yang +3

    cs.AIcs.CVarXiv:2606.27277v12026
  20. RedVox: Safety and Fairness Gaps in Speech Models Across Languages

    Beatrice Savoldi, Sara Papi, Wafa Aissa +2

    cs.CLarXiv:2606.26968v12026
  21. What the LLM Should Not Say: Boundary-Aware Context Grounding for A Seven-Channel EEG Agent

    Zhiyuan Xu, Yueqing Dai, Junling Li +1

    cs.AIarXiv:2606.26519v22026
  22. ShutterMuse: Capture-Time Photography Guidance with MLLMs

    Jiayu Li, Yixiao Fang, Tianyu Hu +5

    cs.CVarXiv:2606.25763v12026
    Summaries:한국어
  23. V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning

    Haoxiang Sun, Zhihang Yi, Langxuan Deng +6

    cs.CVarXiv:2606.25319v12026
  24. MEMPROBE: Probing Long-Term Agent Memory via Hidden User-State Recovery

    Enze Ma, Yufan Zhou, Wei-Chieh Huang +7

    cs.CLarXiv:2606.24595v12026
  25. FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning

    Xirui Li, Zhe Liu, Xiaoqing Ye +4

    cs.AIarXiv:2606.24231v12026
    Summaries:한국어
  26. Lift4D: Harmonizing Single-View 3D Estimation for 4D Reconstruction In-the-Wild

    Yehonathan Litman, Xiaoxuan Ma, Manan Shah +4

    cs.CVarXiv:2606.23688v12026
  27. Semantic Browsing: Controllable Diversity for Image Generation

    Sara Dorfman, Maya Vishnevsky, Omer Dahary +2

    cs.CVcs.AIcs.GRarXiv:2606.23679v12026
    Summaries:한국어
  28. Safe Few-Step Generation via Velocity Editing

    Yujin Choi, Jaehong Yoon

    cs.CVcs.CYarXiv:2606.23267v12026
  29. ShotcreteDepth: A Bi-modal Dataset for Robust Robotic Depth Perception in Shotcrete Construction Environments

    Jakub Gregorek, Lars Arnold Dethlefsen, Patrick Schmidt +3

    cs.ROarXiv:2606.23152v12026
  30. CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents

    Zhanbo Hua, Yifan Yao, Weihao Xie +14

    cs.AIarXiv:2606.22883v12026
  31. FedOT: Ownership Verification and Leakage Tracing via Watermarks for Federated LDMs

    Wenlong Cheng, Yuan Gan, Yunqiu Xu +1

    cs.CVarXiv:2606.22875v12026
  32. RaysUp: Ultra-light Universal Feature Upsampling via Geometry-Aware Ray Representation

    Yuchuan Ding, Linfei Li, Lin Zhang +1

    cs.CVarXiv:2606.22749v12026
    Summaries:한국어
  33. CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learning in Knowledge-Intensive Tasks

    Ashwin Vinod, Ying Ding, Elias Stengel-Eskin

    cs.CLcs.AIarXiv:2606.21777v12026
  34. SkillHarness: Harnessing Safe Skills for Computer-Use Agents

    Yurun Chen, Biao Yi, Keting Yin +1

    cs.AIcs.CLcs.CRarXiv:2606.20636v12026
  35. LedgerAgent: Structured State for Policy-Adherent Tool-Calling Agents

    Md Nayem Uddin, Amir Saeidi, Eduardo Blanco +1

    cs.AIcs.CLarXiv:2606.20529v12026
  36. Distill Once, Adapt Life-Long: Exploring Dataset Distillation for Continual Test-Time Adaptation

    Hyun-Kurl Jang, Jihun Kim, Hyeokjun Kweon +1

    cs.CVarXiv:2606.20196v22026
  37. WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents

    Yehang Zhang, Jianchong Su, Haojian Huang +7

    cs.AIarXiv:2606.18847v12026
  38. Qwen-RobotNav Technical Report: A Scalable Navigation Model Designed for an Agentic Navigation System

    Jiazhao Zhang, Gengze Zhou, Hale Yin +32

    cs.ROcs.CVarXiv:2606.18112v32026
  39. OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation

    Guibin Zhang, Xun Xu, Yanwei Yue +4

    cs.CLarXiv:2606.17628v12026
  40. MemSlides: A Hierarchical Memory Driven Agent Framework for Personalized Slide Generation with Multi-turn Local Revision

    Ye Jin, Yangyang Xu, Jun Zhu +1

    cs.CLcs.HCcs.MAarXiv:2606.17162v12026
  41. Context-Aware RL for Agentic and Multimodal LLMs

    Peiyang Xu, Bangzheng Li, Sijia Liu +4

    cs.CLcs.CVarXiv:2606.17053v12026
  42. Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models

    Yanming Zhang, Yihan Bian, Jingyuan Qi +3

    cs.CLarXiv:2606.16700v12026
  43. LectūraAgents: A Multi-Agent Framework for Adaptive Personalized AI-Assisted Learning and Embodied Teaching

    Jaward Sesay, Yue Yu, Siwei Dong +1

    cs.CLcs.AIcs.HCarXiv:2606.16428v32026
  44. MotionVLA: Vision-Language-Action Model for Humanoid Motion

    Nonghai Zhang, Siyu Zhai, Yanjun Li +5

    cs.CVcs.ROarXiv:2606.15142v12026
  45. Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion

    Yi Lu, Zhuofeng Li, Ping Nie +7

    cs.AIcs.CLarXiv:2606.14885v12026
  46. VISTA: View-Consistent Self-Verified Training for GUI Grounding

    Xinyu Qiu, Yunzhu Zhang, Heng Jia +3

    cs.AIarXiv:2606.14579v12026
  47. Running the Gauntlet: Re-evaluating the Capabilities of Agents Beyond Familiar Environments

    Mykola Vysotskyi, Runqi Lin, Grzegorz Biziel +22

    cs.LGarXiv:2606.14397v22026
    Summaries:한국어
  48. Aligning Quantum Operators with Large Language Models

    Rogerio Feris, Yunchao Liu, Pengyuan Li +2

    quant-phcs.AIarXiv:2606.13811v22026
  49. ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages

    Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya +2

    cs.CLcs.AIarXiv:2606.13572v22026
  50. High-Fidelity Two-Step Image Generation via Teacher-Aligned End-to-End Distillation

    Dongyang Liu, Ruoyi Du, David Liu +7

    cs.CVarXiv:2606.12575v12026
  51. Claw-SWE-Bench: A Benchmark for Evaluating OpenClaw-style Agent Harnesses on Coding Tasks

    Mengyu Zheng, Kai Han, Boxun Li +13

    cs.LGcs.CLarXiv:2606.12344v12026
  52. Measuring Epistemic Resilience of LLMs Under Misleading Medical Context

    Hongjian Zhou, Xinyu Zou, Jinge Wu +19

    cs.CLarXiv:2606.12291v22026
  53. Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

    Yitong Zhang, Shiteng Lu, Jia Li

    cs.CRcs.AIcs.CLarXiv:2606.11817v12026
  54. Data Journalist Agent: Transforming Data into Verifiable Multimodal Stories

    Kevin Qinghong Lin, Batu EI, Yuhong Shi +3

    cs.CVcs.CLcs.CYarXiv:2606.11176v12026
  55. N-GRPO: Embedding-Level Neighbor Mixing for Enhanced Policy Optimization

    Xukun Zhu, Hang Yu, Peng Di +1

    cs.LGcs.CLarXiv:2606.10768v12026
  56. When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models

    Sai Kartheek Reddy Kasu, Nils Lukas, Samuele Poppi

    cs.AIcs.CLcs.LGarXiv:2606.10740v22026
  57. Decentralized Multi-Agent Systems with Shared Context

    Yuzhen Mao, Azalia Mirhoseini

    cs.MAcs.AIarXiv:2606.10662v12026
  58. WebChallenger: A Reliable and Efficient Generalist Web Agent

    Jayoo Hwang, Xiaowen Zhang, Vedant Padwal

    cs.CLarXiv:2606.10423v12026
  59. WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces

    Wanli Li, Bowen Zhou, Yunyao Yu +4

    cs.AIarXiv:2606.09426v32026
  60. DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning

    Lingyong Yan, Can Xu, Yukun Zhao +13

    cs.AIarXiv:2606.07299v12026