Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

14,461 to 14,520 of 15,390

  1. Overcoming Dynamics-Blindness: Training-Free Pace-and-Path Correction for VLA Models

    Yanyan Zhang, Chaoda Song, Vikash Singh +6

    cs.ROcs.AIcs.CVarXiv:2605.11459v22026
  2. GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions

    Junho Kim, Xu Cao, Houze Yang +6

    cs.CVcs.AIarXiv:2605.15764v12026
  3. SaaSBench: Exploring the Boundaries of Coding Agents in Long-Horizon Enterprise SaaS Engineering

    Qingnan Ren, Shun Zou, Shiting Huang +11

    cs.SEcs.AIarXiv:2605.17526v12026
  4. Guava: An Effective and Universal Harness for Embodied Manipulation

    Haowen Liu, Xirui Li, Shaoxiong Yao +5

    cs.ROcs.AIarXiv:2606.18363v12026
  5. SENSE: Satellite-based ENergy Synthesis for Sustainable Environment

    Kailai Sun, Mingyi He, Heye Huang +5

    cs.CVcs.AIarXiv:2605.18101v12026
  6. SciAtlas: A Large-Scale Knowledge Graph for Automated Scientific Research

    Shuofei Qiao, Yunxiang Wei, Jiazheng Fan +8

    cs.AIcs.CLcs.IRarXiv:2605.22878v12026
  7. Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning

    Banghao Chi, Yining Xie, Mingyuan Wu +9

    cs.AIarXiv:2605.22642v12026
  8. Interactive Evaluation Requires a Design Science

    Keyang Xuan, Peiyang Song, Pan Lu +10

    cs.AIarXiv:2605.17829v12026
  9. MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems

    Hyunji Lee, Justin Chih-Yao Chen, Joykirat Singh +3

    cs.CLcs.AIarXiv:2605.18565v22026
  10. Mem-$π$: Adaptive Memory through Learning When and What to Generate

    Xiaoqiang Wang, Chao Wang, Hadi Nekoei +5

    cs.CLcs.AIarXiv:2605.21463v12026
  11. Evaluating Temporal Semantic Caching and Workflow Optimization in Agentic Plan-Execute Pipelines

    Alimurtaza Mustafa Merchant, Krish Veera, Sajal Kumar Goyla +3

    cs.AIarXiv:2605.20630v12026
  12. ACL-Verbatim: hallucination-free question answering for research

    Gábor Recski, Szilveszter Tóth, Nadia Verdha +2

    cs.CLcs.AIcs.SEarXiv:2605.21102v12026
  13. SceneAligner: 3D-Grounded Floorplan Localization in the Wild

    Junhyeong Cho, Ruojin Cai, Hadar Averbuch-Elor

    cs.CVcs.AIcs.LGarXiv:2605.22581v12026
  14. The Expense of Seeing: Attaining Trustworthy Multimodal Reasoning Within the Monolithic Paradigm

    Karan Goyal

    cs.CVcs.AIarXiv:2604.20665v22026
  15. ETCHR: Editing To Clarify and Harness Reasoning

    Beichen Zhang, Yuhong Liu, Jinsong Li +3

    cs.CVcs.AIcs.CLarXiv:2605.23897v12026
  16. SkillEvolBench: Benchmarking the Evolution from Episodic Experience to Procedural Skills

    Yingtie Lei, Zhongwei Wan, Jiankun Zhang +13

    cs.AIarXiv:2605.24117v12026
  17. Breaking the Chains of Probability: Neutrosophic Logic as a New Framework for Epistemic Uncertainty in Large Language Models

    Maikel Yelandi Leyva-Vázquez, Florentin Smarandache

    cs.AIcs.CLcs.LGarXiv:2605.24053v12026
  18. SPACENUM: Revisiting Spatial Numerical Understanding in VLMs

    Jianshu Zhang, Yijiang Li, Huifeixin Chen +4

    cs.AIarXiv:2605.23898v12026
  19. Measuring the Depth of LLM Unlearning via Activation Patching

    Jaeung Lee, Dohyun Kim, Jaemin Jo

    cs.CLcs.AIcs.LGarXiv:2605.24614v12026
  20. AnyMo: Scaling Any-Modality Conditional Motion Generation with Masked Modeling

    Yiheng Li, Zhuo Li, Ruibing Hou +4

    cs.CVcs.AIarXiv:2605.29488v22026
  21. Beyond 3D VQAs: Injecting 3D Spatial Priors into Vision-Language Models for Enhanced Geometric Reasoning

    Chun-Hsiao Yeh, Shengyi Qian, Manchen Wang +3

    cs.CVcs.AIarXiv:2605.30231v12026
  22. How LoRA Remembers? A Parametric Memory Law for LLM Finetuning

    Ziwen Xu, Haiwen Hong, Linsong Yu +4

    cs.CLcs.AIcs.CVarXiv:2605.30260v12026
  23. A Multi-AI-agent Framework Enabling End-to-end Finite Element Analysis for Solid Mechanics Problems

    Titu Ranjan Sarker, Muhammed Jawaad Zulqernine, Ling Yue +3

    cs.AIarXiv:2606.00138v12026
  24. PEAM: Parametric Embodied Agent Memory through Contrastive Internalization of Experience in Minecraft

    Yuchen Guo, Junli Gong, Weicheng Wang +3

    cs.AIarXiv:2605.27762v22026
  25. Lost in Sampling: Assessing Lexical Reachability in LLMs via the Word Coverage Score (WCS)

    Samer Awad, Javier Conde, Carlos Arriaga +3

    cs.CLcs.AIarXiv:2605.27268v12026
  26. SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control

    Zhida Zhang, Jie Ma, Zhan Peng +5

    cs.CVcs.AIarXiv:2605.27891v12026
  27. CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists

    Junlin Yang, Dylan Zhang, Xiangchen Song +7

    cs.AIcs.CLarXiv:2605.26029v22026
  28. Xetrieval: Mechanistically Explaining Dense Retrieval

    Zhixin Cai, Jun Bai, Yang Liu +7

    cs.AIcs.IRarXiv:2605.29507v12026
  29. Exploring Autonomous Agentic Data Engineering for Model Specialization

    Yujie Luo, Xiangyuan Ru, Jingsheng Zheng +10

    cs.CLcs.AIcs.IRarXiv:2605.30407v22026
  30. SAAS: Self-Aware Reinforcement Learning for Over-Search Mitigation in Agentic Search

    Yunbo Tang, Chengyi Yang, Shiyu Liu +4

    cs.AIcs.CLcs.LGarXiv:2605.29796v32026
  31. VLM3: Vision Language Models Are Native 3D Learners

    Zhipeng Cai, Zhuang Liu, Yunyang Xiong +3

    cs.CVcs.AIarXiv:2605.30561v12026
  32. Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents

    Ziyan Liu, Zhezheng Hao, Yeqiu Chen +7

    cs.AIarXiv:2605.30159v12026
  33. Trust-Region Behavior Blending for On-Policy Distillation

    Daniil Plyusov, Alexey Gorbatovski, Alexey Malakhov +4

    cs.LGcs.AIarXiv:2605.31159v12026
  34. MindZero: Learning Online Mental Reasoning With Zero Annotations

    Shunchi Zhang, Jin Lu, Chuanyang Jin +3

    cs.AIcs.MAarXiv:2606.00240v12026
  35. Benchmarking AI Agents for Addressing Scientific Challenges Across Scales

    Tianyu Liu, Allen Xin Wang, Antonia Panescu +30

    cs.AIcs.LGarXiv:2606.12736v12026
  36. Risk Under Pressure: Compute-Aware Evaluation of Adversarial Robustness in Language Models

    Malikeh Ehghaghi, Boglárka Ecsedi, Marsha Chechik +1

    cs.LGcs.AIcs.CRarXiv:2606.11409v12026
  37. SysEvolve: An AI-native, safe, autonomous adversarial attack-defense co-evolutionary system

    Yuhan Meng, Shaofei Li, Jionghao Huang +8

    cs.CRcs.AIcs.MAarXiv:2608.15012v12026
  38. A Temporal Reasoning Benchmarking Framework for LRMs via Difficulty-controlled and Dynamic Test Generation

    Shide Zhou, Kailong Wang, Ling Shi +1

    cs.SEcs.AIarXiv:2607.04784v12026
  39. QuantumNovelty: A Skill-Orchestrating Language Agent for Referee-Style Review and Patentability Screening of Quantum Papers and Patents

    Shlomo Kashani

    physics.soc-phcs.AIcs.CYarXiv:2608.16900v12026
  40. Shape Operator PCA: Curvature-Aware Projections for Geometric Machine Learning

    Alexandre L. M. Levada

    cs.LGcs.AIcs.CVarXiv:2608.15313v12026
  41. Hierarchical Agentic Incident Response with Digital-Twin-Validated Attack Inference

    Yiran Gao, Juntao Chen, Tao Li

    cs.CRcs.AIarXiv:2608.15016v12026
  42. Funnel of Thoughts: Efficient Test-Time Scaling via Early Voting and Rollout Pruning

    Chanhee Park, Sungbin Han, Jeongho Yoon +2

    cs.AIarXiv:2608.15065v12026
  43. TAHB: A Comprehensive Benchmark for Text-Attributed Hypergraph Learning

    David Yoon Suk Kang, JungHyun Kim, Juhyun Jeon +1

    cs.AIarXiv:2608.15055v12026
  44. LLMs Can Predict Failure Risk, But Struggle to Predict Which Collaboration Protocol Pays Off: Cost-Aware Protocol Routing Across Reasoning Tasks

    Chih-Hsuan Yang, Jingyan Jiang, Cheng-Hau Yang +4

    cs.AIcs.CLcs.LGarXiv:2608.14927v12026
  45. Small Models Scout Bottleneck Order for Large-Model Data Control

    Seungmin Choi, Jiwon Sung, Muhammad Umer +4

    cs.AIarXiv:2608.14936v12026
  46. LongDocBench: Benchmarking TOC Hierarchy and Contextual Relationship Recovery in Long Documents

    Yuefeng Zou, Yichen Lu, Jingxiao Yang +5

    cs.AIarXiv:2608.15064v12026
  47. Wiola 13M, a Gated Spiral Attention Architecture for Parameter Efficient Small Language Models

    Aryuemaan Kumar Chowdhury, Praveen Oosa, Vineesha Reddy

    cs.CLcs.AIarXiv:2608.14604v12026
  48. Workspace Topology as an Attack Vector in Agentic Coding Assistants

    Alexandre G. R. Day, Pradeep Yadlapalli, Sriram Venkatapathy +9

    cs.CRcs.AIcs.CLarXiv:2608.14876v12026
  49. Prompting is not enough: supervised baselines and leakage control for measuring shared decision-making with LLMs in pediatric encounters

    Bernardo Modenesi, Jody Lin, Kimberly Kaphingst +4

    cs.CLcs.AIcs.LGarXiv:2608.14792v12026
  50. A Framework for Using and Evaluating LLMs as Surrogate Experts in Security Surveys: Reliability, Bias, and Implications

    Despoina Giarimpampa, Roland Meier, Tegawendé F. Bissyandé +2

    cs.CYcs.AIarXiv:2608.16893v12026
  51. What If AI Carried Her Imagination? Black Girls as Creators in an AI Storytelling Weekend Program

    Chun Li, Lauren Brown, Hubert Asare +5

    cs.CYcs.AIarXiv:2608.16896v12026
  52. Catching Hallucinated Citations in Video-LLM Question Answering: A Self-Verification Pipeline and Verifier Ablation Study

    Yogesh Kumar

    cs.CVcs.AIarXiv:2608.15574v12026
  53. CityReal: Human-Aligned Urban Behavior and City Dynamics Simulation with Large-Scale LLM Agents

    Nicolas Bougie, Xiaotong Ye, Narimasa Watanabe

    physics.soc-phcs.AIcs.MAarXiv:2608.16897v12026
  54. Schema-Agnostic Graph Reasoning Agent for Hybrid Knowledge Graphs

    Marius Dragic, Ruben Ifrah, Alexandre Rio

    cs.AIcs.CLcs.DBarXiv:2608.15834v12026
  55. Navigation-Informed Embeddings: Dense-Retriever Adaptation from Agent Search Traces

    Shrey Shah, Levent Ozgur

    cs.AIarXiv:2608.15956v12026
  56. AI, Brain Death Detection, and Islamic Law

    Muhammad Aurangzeb Ahmad

    cs.CYcs.AIarXiv:2608.16903v12026
  57. LLM Safety Alignment in Low-Resource Languages: A Systematic Literature Review

    Valdini Douglace Lemofouet, Blessing Ngozi Uzor, Paula Chikaodinaka Anyanwu +9

    cs.CLcs.AIcs.LGarXiv:2608.14626v12026
  58. Potential of ChatGPT in predicting stock market trends based on Twitter Sentiment Analysis

    Ummara Mumtaz, Summaya Mumtaz

    q-fin.STcs.AIcs.CLarXiv:2311.06273v12023
  59. KnowSim: Evaluating Information Calibration in LLM Assistants with User Simulators that Learn

    Yoonjoo Lee, Hyoungwook Jin, Tae Soo Kim +3

    cs.AIcs.CLcs.HCarXiv:2608.17150v12026
  60. CETalk: Continuous Valence-Arousal Control for Audio-Driven 3D Talking Head Generation

    Peng Jia, Li Dai, Zhen Xiao +2

    cs.CVcs.AIarXiv:2608.15110v12026