Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

13,801 to 13,860 of 15,291

  1. Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation

    Haozhe Wang, Weijia Feng, Jinpeng Yu +8

    cs.CVcs.AIarXiv:2607.05382v42026
  2. OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers

    Siyuan Li, Jiabao Pan, Yumou Liu +9

    cs.LGcs.AIarXiv:2607.04033v12026
    Summaries:한국어
  3. ACID: Action Consistency via Inverse Dynamics for Planning with World Models

    Gawon Seo, Dongwon Kim, Suha Kwak

    cs.ROcs.AIcs.CVarXiv:2607.02403v12026
  4. Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification

    Yunhao Feng, Ruixiao Lin, Ming Wen +12

    cs.AIarXiv:2607.01793v22026
  5. CausalMix: Data Mixture as Causal Inference for Language Model Training

    Zinan Tang, Yukun Zhang, Shaomian Zheng +6

    cs.LGcs.AIcs.CLarXiv:2607.01104v12026
  6. Valdi: Value Diffusion World Models

    Christopher Lindenberg, Kashyap Chitta

    cs.LGcs.AIarXiv:2607.00917v12026
  7. GUICrafter: Weakly-Supervised GUI Agent Leveraging Massive Unannotated Screenshots

    Sunqi Fan, Lingshan Chen, Runqi Yin +4

    cs.AIcs.CLcs.CVarXiv:2606.29705v12026
  8. Bridging VideoQA and Video-Guided Agentic Tasks via Generalized Keyframe Extraction

    Sunqi Fan, Qingle Liu, Runqi Yin +2

    cs.CVcs.AIarXiv:2606.29445v12026
    Summaries:한국어
  9. EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting

    Junwei Luo, Shuai Yuan, Zhenya Yang +3

    cs.AIcs.CVarXiv:2606.27277v12026
  10. What the LLM Should Not Say: Boundary-Aware Context Grounding for A Seven-Channel EEG Agent

    Zhiyuan Xu, Yueqing Dai, Junling Li +1

    cs.AIarXiv:2606.26519v22026
  11. FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning

    Xirui Li, Zhe Liu, Xiaoqing Ye +4

    cs.AIarXiv:2606.24231v12026
    Summaries:한국어
  12. Semantic Browsing: Controllable Diversity for Image Generation

    Sara Dorfman, Maya Vishnevsky, Omer Dahary +2

    cs.CVcs.AIcs.GRarXiv:2606.23679v12026
    Summaries:한국어
  13. CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents

    Zhanbo Hua, Yifan Yao, Weihao Xie +14

    cs.AIarXiv:2606.22883v12026
  14. CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learning in Knowledge-Intensive Tasks

    Ashwin Vinod, Ying Ding, Elias Stengel-Eskin

    cs.CLcs.AIarXiv:2606.21777v12026
  15. SkillHarness: Harnessing Safe Skills for Computer-Use Agents

    Yurun Chen, Biao Yi, Keting Yin +1

    cs.AIcs.CLcs.CRarXiv:2606.20636v12026
  16. LedgerAgent: Structured State for Policy-Adherent Tool-Calling Agents

    Md Nayem Uddin, Amir Saeidi, Eduardo Blanco +1

    cs.AIcs.CLarXiv:2606.20529v12026
  17. WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents

    Yehang Zhang, Jianchong Su, Haojian Huang +7

    cs.AIarXiv:2606.18847v12026
  18. LectūraAgents: A Multi-Agent Framework for Adaptive Personalized AI-Assisted Learning and Embodied Teaching

    Jaward Sesay, Yue Yu, Siwei Dong +1

    cs.CLcs.AIcs.HCarXiv:2606.16428v32026
  19. Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion

    Yi Lu, Zhuofeng Li, Ping Nie +7

    cs.AIcs.CLarXiv:2606.14885v12026
  20. VISTA: View-Consistent Self-Verified Training for GUI Grounding

    Xinyu Qiu, Yunzhu Zhang, Heng Jia +3

    cs.AIarXiv:2606.14579v12026
  21. Aligning Quantum Operators with Large Language Models

    Rogerio Feris, Yunchao Liu, Pengyuan Li +2

    quant-phcs.AIarXiv:2606.13811v22026
  22. ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages

    Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya +2

    cs.CLcs.AIarXiv:2606.13572v22026
  23. Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code

    Yitong Zhang, Shiteng Lu, Jia Li

    cs.CRcs.AIcs.CLarXiv:2606.11817v12026
  24. When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models

    Sai Kartheek Reddy Kasu, Nils Lukas, Samuele Poppi

    cs.AIcs.CLcs.LGarXiv:2606.10740v22026
  25. Decentralized Multi-Agent Systems with Shared Context

    Yuzhen Mao, Azalia Mirhoseini

    cs.MAcs.AIarXiv:2606.10662v12026
  26. WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces

    Wanli Li, Bowen Zhou, Yunyao Yu +4

    cs.AIarXiv:2606.09426v32026
  27. DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning

    Lingyong Yan, Can Xu, Yukun Zhao +13

    cs.AIarXiv:2606.07299v12026
  28. Direct 3D-Aware Object Insertion via Decomposed Visual Proxies

    Jingbo Gong, Yikai Wang, Yushi Lan +6

    cs.CVcs.AIcs.LGarXiv:2606.06601v12026
  29. Unsupervised Skill Discovery for Agentic Data Analysis

    Zhisong Qiu, Kangqi Song, Shengwei Tang +4

    cs.AIcs.CLcs.LGarXiv:2606.06416v12026
  30. The Meta-Agent Challenge: Are Current Agents Capable of Autonomous Agent Development?

    Xinyu Lu, Tianshu Wang, Pengbo Wang +8

    cs.AIcs.CLarXiv:2606.04455v12026
  31. NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation

    NVIDIA, :, Aarti Basant +32

    cs.CVcs.AIcs.ROarXiv:2606.03159v22026
  32. EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning

    Guhong Chen, Yingcheng Shi, Yongbin Li +6

    cs.AIarXiv:2606.03108v22026
  33. Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbation and Reward Modeling

    Seojeong Park, Jiho Choi, Junyong Kang +3

    cs.CVcs.AIarXiv:2606.02578v12026
  34. Policy and World Modeling Co-Training for Language Agents

    Ning Lu, Baijiong Lin, Shengcai Liu +9

    cs.LGcs.AIarXiv:2606.02388v12026
  35. OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration

    Xinchen Zhang, Bowei Liu, Jiale Liu +7

    cs.CLcs.AIcs.CVarXiv:2605.28805v12026
  36. Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations

    Sachin Kumar

    cs.CLcs.AIcs.LGarXiv:2605.27958v12026
  37. LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding

    Shihao Wang, Shilong Liu, Yuanguo Kuang +10

    cs.CVcs.AIcs.LGarXiv:2605.27365v22026
  38. When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges

    Parth Darshan, Abhishek Divekar

    cs.CLcs.AIcs.LGarXiv:2605.26046v22026
  39. AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions

    Jingwei Sun, Jianing Zhu, Yuanyi Li +3

    cs.AIarXiv:2605.25707v12026
  40. CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM

    Yubo Li, Yidi Miao

    cs.LGcs.AIarXiv:2605.24786v12026
  41. Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution

    Hongbo Wang, Huaibo Huang, Pin Wang +3

    cs.CVcs.AIarXiv:2605.23264v22026
  42. AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild

    Baiyu Chen, Zechen Li, Wilson Wongso +5

    cs.CVcs.AIcs.CLarXiv:2605.22715v22026
  43. Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents

    Asaf Yehudai, Lilach Eden, Michal Shmueli-Scheuer

    cs.CLcs.AIarXiv:2605.22608v12026
  44. The Illusion of Reasoning: Exposing Evasive Data Contamination in LLMs via Zero-CoT Truncation

    Yifan Lan, Yuanpu Cao, Hanyu Wang +2

    cs.LGcs.AIarXiv:2605.21856v12026
  45. ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison

    Tianle Li, Xuyang Shen, Yan Ma +7

    cs.LGcs.AIcs.CVarXiv:2605.20278v22026
  46. PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents

    Zhuohan Gu, Qizheng Zhang, Omar Khattab +1

    cs.AIcs.CLcs.LGarXiv:2605.19932v12026
  47. Evaluating Cognitive Age Alignment in Interactive AI Agents

    Yifan Shen, Jiawen Zhang, Jian Xu +4

    cs.AIarXiv:2605.17894v12026
  48. PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control

    Jingxuan Wei, Xi Bai, Shan Liu +8

    cs.AIarXiv:2605.15963v12026
  49. Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution

    Han Li, Jinyu Tian, Rili Feng +10

    cs.AIarXiv:2605.15301v12026
  50. Nexus : An Agentic Framework for Time Series Forecasting

    Sarkar Snigdha Sarathi Das, Palash Goyal, Mihir Parmar +6

    cs.AIcs.CLcs.LGarXiv:2605.14389v12026
  51. EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents

    Jiaqi Liu, Xinyu Ye, Peng Xia +4

    cs.LGcs.AIarXiv:2605.13941v12026
  52. Learning, Fast and Slow: Towards LLMs That Adapt Continually

    Rishabh Tiwari, Kusha Sareen, Lakshya A Agrawal +6

    cs.LGcs.AIarXiv:2605.12484v22026
  53. ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents

    Xuhao Hu, Xi Zhang, Haiyang Xu +6

    cs.AIarXiv:2605.12481v12026
    Summaries:한국어
  54. $δ$-mem: Efficient Online Memory for Large Language Models

    Jingdi Lei, Di Zhang, Junxian Li +7

    cs.AIarXiv:2605.12357v12026
  55. The Many Faces of On-Policy Distillation: Pitfalls, Mechanisms, and Fixes

    Siqi Zhu, Xuyan Ye, Hongyu Lu +2

    cs.AIarXiv:2605.11182v22026
    Summaries:한국어
  56. Rethinking Agentic Search with Pi-Serini: Is Lexical Retrieval Sufficient?

    Tz-Huan Hsu, Jheng-Hong Yang, Jimmy Lin

    cs.IRcs.AIcs.CLarXiv:2605.10848v12026
  57. Metal-Sci: A Scientific Compute Benchmark for Evolutionary LLM Kernel Search on Apple Silicon

    Víctor Gallego

    cs.LGcs.AIcs.DCarXiv:2605.09708v22026
  58. MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments

    Giridhar Ganapavarapu, Dhaval Patel

    cs.AIcs.MAarXiv:2605.09131v12026
  59. RewardHarness: Self-Evolving Agentic Post-Training

    Yuxuan Zhang, Penghui Du, Bo Li +11

    cs.AIcs.CLcs.CVarXiv:2605.08703v12026
  60. Flow-OPD: On-Policy Distillation for Flow Matching Models

    Zhen Fang, Wenxuan Huang, Yu Zeng +8

    cs.CVcs.AIarXiv:2605.08063v52026
    Summaries:한국어