Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
14,461 to 14,520 of 15,390
Overcoming Dynamics-Blindness: Training-Free Pace-and-Path Correction for VLA Models
Yanyan Zhang, Chaoda Song, Vikash Singh +6
cs.ROcs.AIcs.CVarXiv:2605.11459v22026GRASP: Learning to Ground Social Reasoning in Multi-Person Non-Verbal Interactions
Junho Kim, Xu Cao, Houze Yang +6
cs.CVcs.AIarXiv:2605.15764v12026SaaSBench: Exploring the Boundaries of Coding Agents in Long-Horizon Enterprise SaaS Engineering
Qingnan Ren, Shun Zou, Shiting Huang +11
cs.SEcs.AIarXiv:2605.17526v12026Guava: An Effective and Universal Harness for Embodied Manipulation
Haowen Liu, Xirui Li, Shaoxiong Yao +5
cs.ROcs.AIarXiv:2606.18363v12026SENSE: Satellite-based ENergy Synthesis for Sustainable Environment
Kailai Sun, Mingyi He, Heye Huang +5
cs.CVcs.AIarXiv:2605.18101v12026SciAtlas: A Large-Scale Knowledge Graph for Automated Scientific Research
Shuofei Qiao, Yunxiang Wei, Jiazheng Fan +8
cs.AIcs.CLcs.IRarXiv:2605.22878v12026Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning
Banghao Chi, Yining Xie, Mingyuan Wu +9
cs.AIarXiv:2605.22642v12026Interactive Evaluation Requires a Design Science
Keyang Xuan, Peiyang Song, Pan Lu +10
cs.AIarXiv:2605.17829v12026MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems
Hyunji Lee, Justin Chih-Yao Chen, Joykirat Singh +3
cs.CLcs.AIarXiv:2605.18565v22026Mem-$π$: Adaptive Memory through Learning When and What to Generate
Xiaoqiang Wang, Chao Wang, Hadi Nekoei +5
cs.CLcs.AIarXiv:2605.21463v12026Evaluating Temporal Semantic Caching and Workflow Optimization in Agentic Plan-Execute Pipelines
Alimurtaza Mustafa Merchant, Krish Veera, Sajal Kumar Goyla +3
cs.AIarXiv:2605.20630v12026ACL-Verbatim: hallucination-free question answering for research
Gábor Recski, Szilveszter Tóth, Nadia Verdha +2
cs.CLcs.AIcs.SEarXiv:2605.21102v12026SceneAligner: 3D-Grounded Floorplan Localization in the Wild
Junhyeong Cho, Ruojin Cai, Hadar Averbuch-Elor
cs.CVcs.AIcs.LGarXiv:2605.22581v12026The Expense of Seeing: Attaining Trustworthy Multimodal Reasoning Within the Monolithic Paradigm
Karan Goyal
cs.CVcs.AIarXiv:2604.20665v22026ETCHR: Editing To Clarify and Harness Reasoning
Beichen Zhang, Yuhong Liu, Jinsong Li +3
cs.CVcs.AIcs.CLarXiv:2605.23897v12026SkillEvolBench: Benchmarking the Evolution from Episodic Experience to Procedural Skills
Yingtie Lei, Zhongwei Wan, Jiankun Zhang +13
cs.AIarXiv:2605.24117v12026Breaking the Chains of Probability: Neutrosophic Logic as a New Framework for Epistemic Uncertainty in Large Language Models
Maikel Yelandi Leyva-Vázquez, Florentin Smarandache
cs.AIcs.CLcs.LGarXiv:2605.24053v12026SPACENUM: Revisiting Spatial Numerical Understanding in VLMs
Jianshu Zhang, Yijiang Li, Huifeixin Chen +4
cs.AIarXiv:2605.23898v12026Measuring the Depth of LLM Unlearning via Activation Patching
Jaeung Lee, Dohyun Kim, Jaemin Jo
cs.CLcs.AIcs.LGarXiv:2605.24614v12026AnyMo: Scaling Any-Modality Conditional Motion Generation with Masked Modeling
Yiheng Li, Zhuo Li, Ruibing Hou +4
cs.CVcs.AIarXiv:2605.29488v22026Beyond 3D VQAs: Injecting 3D Spatial Priors into Vision-Language Models for Enhanced Geometric Reasoning
Chun-Hsiao Yeh, Shengyi Qian, Manchen Wang +3
cs.CVcs.AIarXiv:2605.30231v12026How LoRA Remembers? A Parametric Memory Law for LLM Finetuning
Ziwen Xu, Haiwen Hong, Linsong Yu +4
cs.CLcs.AIcs.CVarXiv:2605.30260v12026A Multi-AI-agent Framework Enabling End-to-end Finite Element Analysis for Solid Mechanics Problems
Titu Ranjan Sarker, Muhammed Jawaad Zulqernine, Ling Yue +3
cs.AIarXiv:2606.00138v12026PEAM: Parametric Embodied Agent Memory through Contrastive Internalization of Experience in Minecraft
Yuchen Guo, Junli Gong, Weicheng Wang +3
cs.AIarXiv:2605.27762v22026Lost in Sampling: Assessing Lexical Reachability in LLMs via the Word Coverage Score (WCS)
Samer Awad, Javier Conde, Carlos Arriaga +3
cs.CLcs.AIarXiv:2605.27268v12026SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control
Zhida Zhang, Jie Ma, Zhan Peng +5
cs.CVcs.AIarXiv:2605.27891v12026CausaLab: A Scalable Environment for Interactive Causal Discovery Toward AI Scientists
Junlin Yang, Dylan Zhang, Xiangchen Song +7
cs.AIcs.CLarXiv:2605.26029v22026Xetrieval: Mechanistically Explaining Dense Retrieval
Zhixin Cai, Jun Bai, Yang Liu +7
cs.AIcs.IRarXiv:2605.29507v12026Exploring Autonomous Agentic Data Engineering for Model Specialization
Yujie Luo, Xiangyuan Ru, Jingsheng Zheng +10
cs.CLcs.AIcs.IRarXiv:2605.30407v22026SAAS: Self-Aware Reinforcement Learning for Over-Search Mitigation in Agentic Search
Yunbo Tang, Chengyi Yang, Shiyu Liu +4
cs.AIcs.CLcs.LGarXiv:2605.29796v32026VLM3: Vision Language Models Are Native 3D Learners
Zhipeng Cai, Zhuang Liu, Yunyang Xiong +3
cs.CVcs.AIarXiv:2605.30561v12026Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents
Ziyan Liu, Zhezheng Hao, Yeqiu Chen +7
cs.AIarXiv:2605.30159v12026Trust-Region Behavior Blending for On-Policy Distillation
Daniil Plyusov, Alexey Gorbatovski, Alexey Malakhov +4
cs.LGcs.AIarXiv:2605.31159v12026MindZero: Learning Online Mental Reasoning With Zero Annotations
Shunchi Zhang, Jin Lu, Chuanyang Jin +3
cs.AIcs.MAarXiv:2606.00240v12026Benchmarking AI Agents for Addressing Scientific Challenges Across Scales
Tianyu Liu, Allen Xin Wang, Antonia Panescu +30
cs.AIcs.LGarXiv:2606.12736v12026Risk Under Pressure: Compute-Aware Evaluation of Adversarial Robustness in Language Models
Malikeh Ehghaghi, Boglárka Ecsedi, Marsha Chechik +1
cs.LGcs.AIcs.CRarXiv:2606.11409v12026SysEvolve: An AI-native, safe, autonomous adversarial attack-defense co-evolutionary system
Yuhan Meng, Shaofei Li, Jionghao Huang +8
cs.CRcs.AIcs.MAarXiv:2608.15012v12026A Temporal Reasoning Benchmarking Framework for LRMs via Difficulty-controlled and Dynamic Test Generation
Shide Zhou, Kailong Wang, Ling Shi +1
cs.SEcs.AIarXiv:2607.04784v12026QuantumNovelty: A Skill-Orchestrating Language Agent for Referee-Style Review and Patentability Screening of Quantum Papers and Patents
Shlomo Kashani
physics.soc-phcs.AIcs.CYarXiv:2608.16900v12026Shape Operator PCA: Curvature-Aware Projections for Geometric Machine Learning
Alexandre L. M. Levada
cs.LGcs.AIcs.CVarXiv:2608.15313v12026Hierarchical Agentic Incident Response with Digital-Twin-Validated Attack Inference
Yiran Gao, Juntao Chen, Tao Li
cs.CRcs.AIarXiv:2608.15016v12026Funnel of Thoughts: Efficient Test-Time Scaling via Early Voting and Rollout Pruning
Chanhee Park, Sungbin Han, Jeongho Yoon +2
cs.AIarXiv:2608.15065v12026TAHB: A Comprehensive Benchmark for Text-Attributed Hypergraph Learning
David Yoon Suk Kang, JungHyun Kim, Juhyun Jeon +1
cs.AIarXiv:2608.15055v12026LLMs Can Predict Failure Risk, But Struggle to Predict Which Collaboration Protocol Pays Off: Cost-Aware Protocol Routing Across Reasoning Tasks
Chih-Hsuan Yang, Jingyan Jiang, Cheng-Hau Yang +4
cs.AIcs.CLcs.LGarXiv:2608.14927v12026Small Models Scout Bottleneck Order for Large-Model Data Control
Seungmin Choi, Jiwon Sung, Muhammad Umer +4
cs.AIarXiv:2608.14936v12026LongDocBench: Benchmarking TOC Hierarchy and Contextual Relationship Recovery in Long Documents
Yuefeng Zou, Yichen Lu, Jingxiao Yang +5
cs.AIarXiv:2608.15064v12026Wiola 13M, a Gated Spiral Attention Architecture for Parameter Efficient Small Language Models
Aryuemaan Kumar Chowdhury, Praveen Oosa, Vineesha Reddy
cs.CLcs.AIarXiv:2608.14604v12026Workspace Topology as an Attack Vector in Agentic Coding Assistants
Alexandre G. R. Day, Pradeep Yadlapalli, Sriram Venkatapathy +9
cs.CRcs.AIcs.CLarXiv:2608.14876v12026Prompting is not enough: supervised baselines and leakage control for measuring shared decision-making with LLMs in pediatric encounters
Bernardo Modenesi, Jody Lin, Kimberly Kaphingst +4
cs.CLcs.AIcs.LGarXiv:2608.14792v12026A Framework for Using and Evaluating LLMs as Surrogate Experts in Security Surveys: Reliability, Bias, and Implications
Despoina Giarimpampa, Roland Meier, Tegawendé F. Bissyandé +2
cs.CYcs.AIarXiv:2608.16893v12026What If AI Carried Her Imagination? Black Girls as Creators in an AI Storytelling Weekend Program
Chun Li, Lauren Brown, Hubert Asare +5
cs.CYcs.AIarXiv:2608.16896v12026Catching Hallucinated Citations in Video-LLM Question Answering: A Self-Verification Pipeline and Verifier Ablation Study
Yogesh Kumar
cs.CVcs.AIarXiv:2608.15574v12026CityReal: Human-Aligned Urban Behavior and City Dynamics Simulation with Large-Scale LLM Agents
Nicolas Bougie, Xiaotong Ye, Narimasa Watanabe
physics.soc-phcs.AIcs.MAarXiv:2608.16897v12026Schema-Agnostic Graph Reasoning Agent for Hybrid Knowledge Graphs
Marius Dragic, Ruben Ifrah, Alexandre Rio
cs.AIcs.CLcs.DBarXiv:2608.15834v12026Navigation-Informed Embeddings: Dense-Retriever Adaptation from Agent Search Traces
Shrey Shah, Levent Ozgur
cs.AIarXiv:2608.15956v12026AI, Brain Death Detection, and Islamic Law
Muhammad Aurangzeb Ahmad
cs.CYcs.AIarXiv:2608.16903v12026LLM Safety Alignment in Low-Resource Languages: A Systematic Literature Review
Valdini Douglace Lemofouet, Blessing Ngozi Uzor, Paula Chikaodinaka Anyanwu +9
cs.CLcs.AIcs.LGarXiv:2608.14626v12026Potential of ChatGPT in predicting stock market trends based on Twitter Sentiment Analysis
Ummara Mumtaz, Summaya Mumtaz
q-fin.STcs.AIcs.CLarXiv:2311.06273v12023KnowSim: Evaluating Information Calibration in LLM Assistants with User Simulators that Learn
Yoonjoo Lee, Hyoungwook Jin, Tae Soo Kim +3
cs.AIcs.CLcs.HCarXiv:2608.17150v12026CETalk: Continuous Valence-Arousal Control for Audio-Driven 3D Talking Head Generation
Peng Jia, Li Dai, Zhen Xiao +2
cs.CVcs.AIarXiv:2608.15110v12026