Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,521 to 11,580 of 15,222
Language-based Trial and Error Falls Behind in the Era of Experience
Haoyu Wang, Guozheng Ma, Shugang Cui +7
cs.AIarXiv:2601.21754v32026Where Cognition Lives: Dissecting Emergent from Computed Function in a Minimal Complete Cognitive Architecture
Francisco M. Arrabal-Campos, Francisco G. Montoya, Alfredo Alcayde +1
cs.AIcs.CLcs.LGarXiv:2608.22347v12026Multi-Modal Fusion Transformer for End-to-End Autonomous Driving
Aditya Prakash, Kashyap Chitta, Andreas Geiger
cs.CVcs.AIcs.LGarXiv:2104.09224v12021Variational Information Distillation for Knowledge Transfer
Sungsoo Ahn, Shell Xu Hu, Andreas Damianou +2
cs.CVcs.AIcs.LGarXiv:1904.05835v12019RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference
Arpit Singh Gautam, Saurabh Jha
cs.LGcs.AIarXiv:2603.17891v12026Physical Agentic AI: An Architecture for Orchestrating a Robot Crew with LLMs
Xinyuan Liu, Eren Sadikoglu, Riana Chatterjee +1
cs.ROcs.AIcs.MAarXiv:2608.22657v12026Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules
Florian Rottach, Sebastian Schieferdecker, William Rudman +2
cs.LGcs.AIarXiv:2608.22642v12026The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models
Taebong Kim, Youngsik Hong, Minsik Kim +3
cs.LGcs.AIarXiv:2608.22876v12026Assessing Domain-Level Susceptibility to Emergent Misalignment from Narrow Finetuning
Abhishek Mishra, Mugilan Arulvanan, Reshma Ashok +3
cs.AIarXiv:2602.00298v12026Universal Intelligence: A Definition of Machine Intelligence
Shane Legg, Marcus Hutter
cs.AIarXiv:0712.3329v12007Scaling Small Agents Through Strategy Auctions
Lisa Alazraki, William F. Shen, Yoram Bachrach +1
cs.MAcs.AIcs.CLarXiv:2602.02751v32026Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards
Mel Vecerik, Todd Hester, Jonathan Scholz +7
cs.AIarXiv:1707.08817v22017WideSeek: Advancing Wide Research via Multi-Agent Scaling
Ziyang Huang, Haolin Ren, Xiaowei Yuan +6
cs.CLcs.AIcs.IRarXiv:2602.02636v12026FIRE-Bench: Evaluating AI Agents on the Rediscovery of Scientific Insights
Zhen Wang, Fan Bai, Zhongyan Luo +9
cs.AIarXiv:2602.02905v22026Beyond Fixed Frames: Dynamic Character-Aligned Speech Tokenization
Luca Della Libera, Cem Subakan, Mirco Ravanelli
cs.LGcs.AIcs.SDarXiv:2601.23174v22026VATT: Transformers for Multimodal Self-Supervised Learning from Raw Video, Audio and Text
Hassan Akbari, Liangzhe Yuan, Rui Qian +4
cs.CVcs.AIcs.LGarXiv:2104.11178v32021Coalition-Aware Skill Reliability for Self-Evolving Agents
Qiyan Zhao, Xiaofeng Zhang, Bo Liu +11
cs.AIarXiv:2608.22610v12026Can LLM Agents Be CFOs? Benchmarking Long-Horizon Resource Allocation in an Uncertain Enterprise Environment
Yi Han, Yan Wang, Lingfei Qian +12
cs.AIarXiv:2603.23638v22026Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
Zhipeng Chen, Xiaobo Qin, Wayne Xin Zhao +2
cs.CLcs.AIarXiv:2602.00759v12026Making Avatars Interact: Towards Text-Driven Human-Object Interaction for Controllable Talking Avatars
Youliang Zhang, Zhengguang Zhou, Zhentao Yu +11
cs.CVcs.AIcs.CLarXiv:2602.01538v12026On the Limits of Layer Pruning for Generative Reasoning in Large Language Models
Safal Shrestha, Anubhav Shrestha, Aadim Nepal +2
cs.LGcs.AIarXiv:2602.01997v42026Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models
Wei Liu, Peijie Yu, Michele Orini +2
cs.AIcs.CLcs.DBarXiv:2602.02039v22026Emergent Tool Use From Multi-Agent Autocurricula
Bowen Baker, Ingmar Kanitscheider, Todor Markov +4
cs.LGcs.AIcs.MAarXiv:1909.07528v22019NetConfArena: An Executable Benchmark for LLM Agents in Closed-Loop Network Configuration
Chang Liu, Xiaohui Xie, Xinyi Chen +1
cs.NIcs.AIarXiv:2608.23179v12026From Features to Actions: Explainability in Traditional and Agentic AI Systems
Sindhuja Chaduvula, Jessee Ho, Kina Kim +6
cs.AIarXiv:2602.06841v42026EgoSchema: A Diagnostic Benchmark for Very Long-form Video Language Understanding
Karttikeya Mangalam, Raiymbek Akshulakov, Jitendra Malik
cs.CVcs.AIcs.CLarXiv:2308.09126v12023ProAct: Agentic Lookahead in Interactive Environments
Yangbin Yu, Mingyu Yang, Junyou Li +9
cs.AIarXiv:2602.05327v12026Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference
Benjamin Warner, Antoine Chaffin, Benjamin Clavié +11
cs.CLcs.AIarXiv:2412.13663v22024SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models
Hyeonbeom Choi, Daechul Ahn, Youhan Lee +3
cs.ROcs.AIcs.LGarXiv:2602.04208v22026Cognitive Mapping and Planning for Visual Navigation
Saurabh Gupta, Varun Tolani, James Davidson +3
cs.CVcs.AIcs.LGarXiv:1702.03920v32017LQ-Nets: Learned Quantization for Highly Accurate and Compact Deep Neural Networks
Dongqing Zhang, Jiaolong Yang, Dongqiangzi Ye +1
cs.CVcs.AIarXiv:1807.10029v12018A-CPES: A Reference Framework for Agentic AI in Cyber-Physical Energy Systems
Xiaoyu Zhang, Qiuye Sun, Jiachen Xu +2
cs.AIarXiv:2608.22672v12026Language Chain in Alignment: Cross-Lingual Ranking Preference Optimization
Seungyoon Lee, Minhyuk Kim, Jungseob Lee +1
cs.CLcs.AIarXiv:2608.23149v12026MemFly: On-the-Fly Memory Optimization via Information Bottleneck
Zhenyuan Zhang, Xianzhang Jia, Zhiqin Yang +4
cs.AIcs.LGarXiv:2602.07885v22026Toward Effective and Reliable LLM Agents via Dynamic Ontology
Xiaohui Zhang, Zequn Sun, Chengyuan Yang +3
cs.AIarXiv:2608.22974v12026Quantized Evolution Strategies: High-precision Fine-tuning of Quantized LLMs at Low-precision Cost
Yinggan Xu, Kajetan Schweighofer, Risto Miikkulainen +1
cs.LGcs.AIarXiv:2602.03120v22026SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers
Keyang Xuan, Pengda Wang, Chongrui Ye +3
cs.AIcs.CLarXiv:2602.05115v12026Secure Code Generation via Online Reinforcement Learning with Vulnerability Reward Model
Tianyi Wu, Mingzhe Du, Yue Liu +4
cs.CRcs.AIcs.CLarXiv:2602.07422v12026compar:IA: The French Government's LLM arena to collect French-language human prompts and preference data
Lucie Termignon, Simonas Zilinskas, Hadrien Pélissier +3
cs.CLcs.AIarXiv:2602.06669v12026iGRPO: Self-Feedback-Driven LLM Reasoning
Ali Hatamizadeh, Shrimai Prabhumoye, Igor Gitman +5
cs.AIarXiv:2602.09000v12026Artificial Immune Systems
Uwe Aickelin, Dipankar Dasgupta
cs.AIcs.NEarXiv:0910.4899v12009ChatGPT: Jack of all trades, master of none
Jan Kocoń, Igor Cichecki, Oliwier Kaszyca +17
cs.CLcs.AIcs.CYarXiv:2302.10724v42023RACO: Reliability-Aware Coarse-Goal Optimization for Inspection-Oriented UAV Vision-Language Navigation
Sen Wang, Yiming Sun, Jiaxuan He +1
cs.ROcs.AIcs.CVarXiv:2608.22678v12026Mitigating Reasoning-Induced Misalignment via Safety-Direction Penalty
Yipeng Zhao, Qishun Yang, Shenzhe Zhu +2
cs.AIcs.CLarXiv:2608.23497v12026Multimodal Fact-Level Attribution for Verifiable Reasoning
David Wan, Han Wang, Ziyang Wang +3
cs.CLcs.AIcs.CVarXiv:2602.11509v22026Exploring Models and Data for Image Question Answering
Mengye Ren, Ryan Kiros, Richard Zemel
cs.LGcs.AIcs.CLarXiv:1505.02074v42015LLM-Planner: Few-Shot Grounded Planning for Embodied Agents with Large Language Models
Chan Hee Song, Jiaman Wu, Clayton Washington +3
cs.AIcs.CLcs.CVarXiv:2212.04088v32022SenTSR-Bench: Thinking with Injected Knowledge for Time-Series Reasoning
Zelin He, Boran Han, Xiyuan Zhang +10
cs.LGcs.AIcs.CLarXiv:2602.19455v12026Expert Gate: Lifelong Learning with a Network of Experts
Rahaf Aljundi, Punarjay Chakravarty, Tinne Tuytelaars
cs.CVcs.AIstat.MLarXiv:1611.06194v22016Curriculum Learning for Reinforcement Learning Domains: A Framework and Survey
Sanmit Narvekar, Bei Peng, Matteo Leonetti +3
cs.LGcs.AIstat.MLarXiv:2003.04960v22020Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
Jiachen Zhu, Lingyu Yang, Rong Shan +6
cs.AIcs.LGarXiv:2604.09574v12026GEBench: Benchmarking Image Generation Models as GUI Environments
Haodong Li, Jingwei Wu, Quan Sun +14
cs.AIcs.CVarXiv:2602.09007v22026Reasoning about Entailment with Neural Attention
Tim Rocktäschel, Edward Grefenstette, Karl Moritz Hermann +2
cs.CLcs.AIcs.LGarXiv:1509.06664v42015ClinAlign: Scaling Healthcare Alignment from Clinician Preference
Shiwei Lyu, Xidong Wang, Lei Liu +6
cs.AIarXiv:2602.09653v22026Learning to Configure Agentic AI Systems
Aditya Taparia, Som Sagar, Ransalu Senanayake
cs.AIarXiv:2602.11574v32026Decoding as Optimisation on the Probability Simplex: From Top-K to Top-P (Nucleus) to Best-of-K Samplers
Xiaotong Ji, Rasul Tutunov, Matthieu Zimmer +1
cs.LGcs.AIarXiv:2602.18292v22026Decoding ML Decision: An Agentic Reasoning Framework for Large-Scale Ranking System
Longfei Yun, Yihan Wu, Haoran Liu +11
cs.AIarXiv:2602.18640v22026SEAM: Shot Entity-Attribute Memory for Consistent Short-Drama Generation at Scale
Jiaqi Liu, Maolin Ran, Xiaoyang Lu +5
cs.AIarXiv:2608.22725v12026TAPE: Tool-Guided Adaptive Planning and Constrained Execution in Language Model Agents
Jongwon Jeong, Jungtaek Kim, Kangwook Lee
cs.AIarXiv:2602.19633v12026The Art of Efficient Reasoning: Data, Reward, and Optimization
Taiqiang Wu, Zenan Xu, Bo Zhou +1
cs.CLcs.AIarXiv:2602.20945v32026