Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
13,801 to 13,860 of 15,291
Search Beyond What Can Be Taught: Evolving the Knowledge Boundary in Agentic Visual Generation
Haozhe Wang, Weijia Feng, Jinpeng Yu +8
cs.CVcs.AIarXiv:2607.05382v42026OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers
Siyuan Li, Jiabao Pan, Yumou Liu +9
cs.LGcs.AIarXiv:2607.04033v12026Summaries:한국어ACID: Action Consistency via Inverse Dynamics for Planning with World Models
Gawon Seo, Dongwon Kim, Suha Kwak
cs.ROcs.AIcs.CVarXiv:2607.02403v12026Safety Testing LLM Agents at Scale: From Risk Discovery to Evidence-Grounded Verification
Yunhao Feng, Ruixiao Lin, Ming Wen +12
cs.AIarXiv:2607.01793v22026CausalMix: Data Mixture as Causal Inference for Language Model Training
Zinan Tang, Yukun Zhang, Shaomian Zheng +6
cs.LGcs.AIcs.CLarXiv:2607.01104v12026Valdi: Value Diffusion World Models
Christopher Lindenberg, Kashyap Chitta
cs.LGcs.AIarXiv:2607.00917v12026GUICrafter: Weakly-Supervised GUI Agent Leveraging Massive Unannotated Screenshots
Sunqi Fan, Lingshan Chen, Runqi Yin +4
cs.AIcs.CLcs.CVarXiv:2606.29705v12026Bridging VideoQA and Video-Guided Agentic Tasks via Generalized Keyframe Extraction
Sunqi Fan, Qingle Liu, Runqi Yin +2
cs.CVcs.AIarXiv:2606.29445v12026Summaries:한국어EO-WM: A Physically Informed World Model for Probabilistic Earth Observation Forecasting
Junwei Luo, Shuai Yuan, Zhenya Yang +3
cs.AIcs.CVarXiv:2606.27277v12026What the LLM Should Not Say: Boundary-Aware Context Grounding for A Seven-Channel EEG Agent
Zhiyuan Xu, Yueqing Dai, Junling Li +1
cs.AIarXiv:2606.26519v22026FlowR2A: Learning Reward-to-Action Distribution for Multimodal Driving Planning
Xirui Li, Zhe Liu, Xiaoqing Ye +4
cs.AIarXiv:2606.24231v12026Summaries:한국어Semantic Browsing: Controllable Diversity for Image Generation
Sara Dorfman, Maya Vishnevsky, Omer Dahary +2
cs.CVcs.AIcs.GRarXiv:2606.23679v12026Summaries:한국어CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents
Zhanbo Hua, Yifan Yao, Weihao Xie +14
cs.AIarXiv:2606.22883v12026CalVerT: Augmenting Agents with Calibrated Verifier Telemetry Improves Action and Learning in Knowledge-Intensive Tasks
Ashwin Vinod, Ying Ding, Elias Stengel-Eskin
cs.CLcs.AIarXiv:2606.21777v12026SkillHarness: Harnessing Safe Skills for Computer-Use Agents
Yurun Chen, Biao Yi, Keting Yin +1
cs.AIcs.CLcs.CRarXiv:2606.20636v12026LedgerAgent: Structured State for Policy-Adherent Tool-Calling Agents
Md Nayem Uddin, Amir Saeidi, Eduardo Blanco +1
cs.AIcs.CLarXiv:2606.20529v12026WorldLines: Benchmarking and Modeling Long-Horizon Stateful Embodied Agents
Yehang Zhang, Jianchong Su, Haojian Huang +7
cs.AIarXiv:2606.18847v12026LectūraAgents: A Multi-Agent Framework for Adaptive Personalized AI-Assisted Learning and Embodied Teaching
Jaward Sesay, Yue Yu, Siwei Dong +1
cs.CLcs.AIcs.HCarXiv:2606.16428v32026Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion
Yi Lu, Zhuofeng Li, Ping Nie +7
cs.AIcs.CLarXiv:2606.14885v12026VISTA: View-Consistent Self-Verified Training for GUI Grounding
Xinyu Qiu, Yunzhu Zhang, Heng Jia +3
cs.AIarXiv:2606.14579v12026Aligning Quantum Operators with Large Language Models
Rogerio Feris, Yunchao Liu, Pengyuan Li +2
quant-phcs.AIarXiv:2606.13811v22026ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages
Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya +2
cs.CLcs.AIarXiv:2606.13572v22026Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code
Yitong Zhang, Shiteng Lu, Jia Li
cs.CRcs.AIcs.CLarXiv:2606.11817v12026When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models
Sai Kartheek Reddy Kasu, Nils Lukas, Samuele Poppi
cs.AIcs.CLcs.LGarXiv:2606.10740v22026Decentralized Multi-Agent Systems with Shared Context
Yuzhen Mao, Azalia Mirhoseini
cs.MAcs.AIarXiv:2606.10662v12026WeaveBench: A Long-Horizon, Real-World Benchmark for Computer-Use Agents with Hybrid Interfaces
Wanli Li, Bowen Zhou, Yunyao Yu +4
cs.AIarXiv:2606.09426v32026DuMate-DeepResearch: An Auditable Multi-Agent System with Recursive Search and Rubric-Grounded Reasoning
Lingyong Yan, Can Xu, Yukun Zhao +13
cs.AIarXiv:2606.07299v12026Direct 3D-Aware Object Insertion via Decomposed Visual Proxies
Jingbo Gong, Yikai Wang, Yushi Lan +6
cs.CVcs.AIcs.LGarXiv:2606.06601v12026Unsupervised Skill Discovery for Agentic Data Analysis
Zhisong Qiu, Kangqi Song, Shengwei Tang +4
cs.AIcs.CLcs.LGarXiv:2606.06416v12026The Meta-Agent Challenge: Are Current Agents Capable of Autonomous Agent Development?
Xinyu Lu, Tianshu Wang, Pengbo Wang +8
cs.AIcs.CLarXiv:2606.04455v12026NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation
NVIDIA, :, Aarti Basant +32
cs.CVcs.AIcs.ROarXiv:2606.03159v22026EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning
Guhong Chen, Yingcheng Shi, Yongbin Li +6
cs.AIarXiv:2606.03108v22026Mitigating Perceptual Judgment Bias in Multimodal LLM-as-a-Judge via Perceptual Perturbation and Reward Modeling
Seojeong Park, Jiho Choi, Junyong Kang +3
cs.CVcs.AIarXiv:2606.02578v12026Policy and World Modeling Co-Training for Language Agents
Ning Lu, Baijiong Lin, Shengcai Liu +9
cs.LGcs.AIarXiv:2606.02388v12026OmniVerifier-M1: Multimodal Meta-Verifier with Explicit Structured Recalibration
Xinchen Zhang, Bowei Liu, Jiale Liu +7
cs.CLcs.AIcs.CVarXiv:2605.28805v12026Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations
Sachin Kumar
cs.CLcs.AIcs.LGarXiv:2605.27958v12026LocateAnything: Fast and High-Quality Vision-Language Grounding with Parallel Box Decoding
Shihao Wang, Shilong Liu, Yuanguo Kuang +10
cs.CVcs.AIcs.LGarXiv:2605.27365v22026When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges
Parth Darshan, Abhishek Divekar
cs.CLcs.AIcs.LGarXiv:2605.26046v22026AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions
Jingwei Sun, Jianing Zhu, Yuanyi Li +3
cs.AIarXiv:2605.25707v12026CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM
Yubo Li, Yidi Miao
cs.LGcs.AIarXiv:2605.24786v12026Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution
Hongbo Wang, Huaibo Huang, Pin Wang +3
cs.CVcs.AIarXiv:2605.23264v22026AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild
Baiyu Chen, Zechen Li, Wilson Wongso +5
cs.CVcs.AIcs.CLarXiv:2605.22715v22026Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents
Asaf Yehudai, Lilach Eden, Michal Shmueli-Scheuer
cs.CLcs.AIarXiv:2605.22608v12026The Illusion of Reasoning: Exposing Evasive Data Contamination in LLMs via Zero-CoT Truncation
Yifan Lan, Yuanpu Cao, Hanyu Wang +2
cs.LGcs.AIarXiv:2605.21856v12026ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison
Tianle Li, Xuyang Shen, Yan Ma +7
cs.LGcs.AIcs.CVarXiv:2605.20278v22026PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
Zhuohan Gu, Qizheng Zhang, Omar Khattab +1
cs.AIcs.CLcs.LGarXiv:2605.19932v12026Evaluating Cognitive Age Alignment in Interactive AI Agents
Yifan Shen, Jiawen Zhang, Jian Xu +4
cs.AIarXiv:2605.17894v12026PAGER: Bridging the Semantic-Execution Gap in Point-Precise Geometric GUI Control
Jingxuan Wei, Xi Bai, Shan Liu +8
cs.AIarXiv:2605.15963v12026Solvita: Enhancing Large Language Models for Competitive Programming via Agentic Evolution
Han Li, Jinyu Tian, Rili Feng +10
cs.AIarXiv:2605.15301v12026Nexus : An Agentic Framework for Time Series Forecasting
Sarkar Snigdha Sarathi Das, Palash Goyal, Mihir Parmar +6
cs.AIcs.CLcs.LGarXiv:2605.14389v12026EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
Jiaqi Liu, Xinyu Ye, Peng Xia +4
cs.LGcs.AIarXiv:2605.13941v12026Learning, Fast and Slow: Towards LLMs That Adapt Continually
Rishabh Tiwari, Kusha Sareen, Lakshya A Agrawal +6
cs.LGcs.AIarXiv:2605.12484v22026ToolCUA: Towards Optimal GUI-Tool Path Orchestration for Computer Use Agents
Xuhao Hu, Xi Zhang, Haiyang Xu +6
cs.AIarXiv:2605.12481v12026Summaries:한국어$δ$-mem: Efficient Online Memory for Large Language Models
Jingdi Lei, Di Zhang, Junxian Li +7
cs.AIarXiv:2605.12357v12026The Many Faces of On-Policy Distillation: Pitfalls, Mechanisms, and Fixes
Siqi Zhu, Xuyan Ye, Hongyu Lu +2
cs.AIarXiv:2605.11182v22026Summaries:한국어Rethinking Agentic Search with Pi-Serini: Is Lexical Retrieval Sufficient?
Tz-Huan Hsu, Jheng-Hong Yang, Jimmy Lin
cs.IRcs.AIcs.CLarXiv:2605.10848v12026Metal-Sci: A Scientific Compute Benchmark for Evolutionary LLM Kernel Search on Apple Silicon
Víctor Gallego
cs.LGcs.AIcs.DCarXiv:2605.09708v22026MCP-Cosmos: World Model-Augmented Agents for Complex Task Execution in MCP Environments
Giridhar Ganapavarapu, Dhaval Patel
cs.AIcs.MAarXiv:2605.09131v12026RewardHarness: Self-Evolving Agentic Post-Training
Yuxuan Zhang, Penghui Du, Bo Li +11
cs.AIcs.CLcs.CVarXiv:2605.08703v12026Flow-OPD: On-Policy Distillation for Flow Matching Models
Zhen Fang, Wenxuan Huang, Yu Zeng +8
cs.CVcs.AIarXiv:2605.08063v52026Summaries:한국어