Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,521 to 11,580 of 15,222

  1. Language-based Trial and Error Falls Behind in the Era of Experience

    Haoyu Wang, Guozheng Ma, Shugang Cui +7

    cs.AIarXiv:2601.21754v32026
  2. Where Cognition Lives: Dissecting Emergent from Computed Function in a Minimal Complete Cognitive Architecture

    Francisco M. Arrabal-Campos, Francisco G. Montoya, Alfredo Alcayde +1

    cs.AIcs.CLcs.LGarXiv:2608.22347v12026
  3. Multi-Modal Fusion Transformer for End-to-End Autonomous Driving

    Aditya Prakash, Kashyap Chitta, Andreas Geiger

    cs.CVcs.AIcs.LGarXiv:2104.09224v12021
  4. Variational Information Distillation for Knowledge Transfer

    Sungsoo Ahn, Shell Xu Hu, Andreas Damianou +2

    cs.CVcs.AIcs.LGarXiv:1904.05835v12019
  5. RAMP: Reinforcement Adaptive Mixed Precision Quantization for Efficient On Device LLM Inference

    Arpit Singh Gautam, Saurabh Jha

    cs.LGcs.AIarXiv:2603.17891v12026
  6. Physical Agentic AI: An Architecture for Orchestrating a Robot Crew with LLMs

    Xinyuan Liu, Eren Sadikoglu, Riana Chatterjee +1

    cs.ROcs.AIcs.MAarXiv:2608.22657v12026
  7. Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules

    Florian Rottach, Sebastian Schieferdecker, William Rudman +2

    cs.LGcs.AIarXiv:2608.22642v12026
  8. The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models

    Taebong Kim, Youngsik Hong, Minsik Kim +3

    cs.LGcs.AIarXiv:2608.22876v12026
  9. Assessing Domain-Level Susceptibility to Emergent Misalignment from Narrow Finetuning

    Abhishek Mishra, Mugilan Arulvanan, Reshma Ashok +3

    cs.AIarXiv:2602.00298v12026
  10. Universal Intelligence: A Definition of Machine Intelligence

    Shane Legg, Marcus Hutter

    cs.AIarXiv:0712.3329v12007
  11. Scaling Small Agents Through Strategy Auctions

    Lisa Alazraki, William F. Shen, Yoram Bachrach +1

    cs.MAcs.AIcs.CLarXiv:2602.02751v32026
  12. Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards

    Mel Vecerik, Todd Hester, Jonathan Scholz +7

    cs.AIarXiv:1707.08817v22017
  13. WideSeek: Advancing Wide Research via Multi-Agent Scaling

    Ziyang Huang, Haolin Ren, Xiaowei Yuan +6

    cs.CLcs.AIcs.IRarXiv:2602.02636v12026
  14. FIRE-Bench: Evaluating AI Agents on the Rediscovery of Scientific Insights

    Zhen Wang, Fan Bai, Zhongyan Luo +9

    cs.AIarXiv:2602.02905v22026
  15. Beyond Fixed Frames: Dynamic Character-Aligned Speech Tokenization

    Luca Della Libera, Cem Subakan, Mirco Ravanelli

    cs.LGcs.AIcs.SDarXiv:2601.23174v22026
  16. VATT: Transformers for Multimodal Self-Supervised Learning from Raw Video, Audio and Text

    Hassan Akbari, Liangzhe Yuan, Rui Qian +4

    cs.CVcs.AIcs.LGarXiv:2104.11178v32021
  17. Coalition-Aware Skill Reliability for Self-Evolving Agents

    Qiyan Zhao, Xiaofeng Zhang, Bo Liu +11

    cs.AIarXiv:2608.22610v12026
  18. Can LLM Agents Be CFOs? Benchmarking Long-Horizon Resource Allocation in an Uncertain Enterprise Environment

    Yi Han, Yan Wang, Lingfei Qian +12

    cs.AIarXiv:2603.23638v22026
  19. Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning

    Zhipeng Chen, Xiaobo Qin, Wayne Xin Zhao +2

    cs.CLcs.AIarXiv:2602.00759v12026
  20. Making Avatars Interact: Towards Text-Driven Human-Object Interaction for Controllable Talking Avatars

    Youliang Zhang, Zhengguang Zhou, Zhentao Yu +11

    cs.CVcs.AIcs.CLarXiv:2602.01538v12026
  21. On the Limits of Layer Pruning for Generative Reasoning in Large Language Models

    Safal Shrestha, Anubhav Shrestha, Aadim Nepal +2

    cs.LGcs.AIarXiv:2602.01997v42026
  22. Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models

    Wei Liu, Peijie Yu, Michele Orini +2

    cs.AIcs.CLcs.DBarXiv:2602.02039v22026
  23. Emergent Tool Use From Multi-Agent Autocurricula

    Bowen Baker, Ingmar Kanitscheider, Todor Markov +4

    cs.LGcs.AIcs.MAarXiv:1909.07528v22019
  24. NetConfArena: An Executable Benchmark for LLM Agents in Closed-Loop Network Configuration

    Chang Liu, Xiaohui Xie, Xinyi Chen +1

    cs.NIcs.AIarXiv:2608.23179v12026
  25. From Features to Actions: Explainability in Traditional and Agentic AI Systems

    Sindhuja Chaduvula, Jessee Ho, Kina Kim +6

    cs.AIarXiv:2602.06841v42026
  26. EgoSchema: A Diagnostic Benchmark for Very Long-form Video Language Understanding

    Karttikeya Mangalam, Raiymbek Akshulakov, Jitendra Malik

    cs.CVcs.AIcs.CLarXiv:2308.09126v12023
  27. ProAct: Agentic Lookahead in Interactive Environments

    Yangbin Yu, Mingyu Yang, Junyou Li +9

    cs.AIarXiv:2602.05327v12026
  28. Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference

    Benjamin Warner, Antoine Chaffin, Benjamin Clavié +11

    cs.CLcs.AIarXiv:2412.13663v22024
  29. SCALE: Self-uncertainty Conditioned Adaptive Looking and Execution for Vision-Language-Action Models

    Hyeonbeom Choi, Daechul Ahn, Youhan Lee +3

    cs.ROcs.AIcs.LGarXiv:2602.04208v22026
  30. Cognitive Mapping and Planning for Visual Navigation

    Saurabh Gupta, Varun Tolani, James Davidson +3

    cs.CVcs.AIcs.LGarXiv:1702.03920v32017
  31. LQ-Nets: Learned Quantization for Highly Accurate and Compact Deep Neural Networks

    Dongqing Zhang, Jiaolong Yang, Dongqiangzi Ye +1

    cs.CVcs.AIarXiv:1807.10029v12018
  32. A-CPES: A Reference Framework for Agentic AI in Cyber-Physical Energy Systems

    Xiaoyu Zhang, Qiuye Sun, Jiachen Xu +2

    cs.AIarXiv:2608.22672v12026
  33. Language Chain in Alignment: Cross-Lingual Ranking Preference Optimization

    Seungyoon Lee, Minhyuk Kim, Jungseob Lee +1

    cs.CLcs.AIarXiv:2608.23149v12026
  34. MemFly: On-the-Fly Memory Optimization via Information Bottleneck

    Zhenyuan Zhang, Xianzhang Jia, Zhiqin Yang +4

    cs.AIcs.LGarXiv:2602.07885v22026
  35. Toward Effective and Reliable LLM Agents via Dynamic Ontology

    Xiaohui Zhang, Zequn Sun, Chengyuan Yang +3

    cs.AIarXiv:2608.22974v12026
  36. Quantized Evolution Strategies: High-precision Fine-tuning of Quantized LLMs at Low-precision Cost

    Yinggan Xu, Kajetan Schweighofer, Risto Miikkulainen +1

    cs.LGcs.AIarXiv:2602.03120v22026
  37. SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers

    Keyang Xuan, Pengda Wang, Chongrui Ye +3

    cs.AIcs.CLarXiv:2602.05115v12026
  38. Secure Code Generation via Online Reinforcement Learning with Vulnerability Reward Model

    Tianyi Wu, Mingzhe Du, Yue Liu +4

    cs.CRcs.AIcs.CLarXiv:2602.07422v12026
  39. compar:IA: The French Government's LLM arena to collect French-language human prompts and preference data

    Lucie Termignon, Simonas Zilinskas, Hadrien Pélissier +3

    cs.CLcs.AIarXiv:2602.06669v12026
  40. iGRPO: Self-Feedback-Driven LLM Reasoning

    Ali Hatamizadeh, Shrimai Prabhumoye, Igor Gitman +5

    cs.AIarXiv:2602.09000v12026
  41. Artificial Immune Systems

    Uwe Aickelin, Dipankar Dasgupta

    cs.AIcs.NEarXiv:0910.4899v12009
  42. ChatGPT: Jack of all trades, master of none

    Jan Kocoń, Igor Cichecki, Oliwier Kaszyca +17

    cs.CLcs.AIcs.CYarXiv:2302.10724v42023
  43. RACO: Reliability-Aware Coarse-Goal Optimization for Inspection-Oriented UAV Vision-Language Navigation

    Sen Wang, Yiming Sun, Jiaxuan He +1

    cs.ROcs.AIcs.CVarXiv:2608.22678v12026
  44. Mitigating Reasoning-Induced Misalignment via Safety-Direction Penalty

    Yipeng Zhao, Qishun Yang, Shenzhe Zhu +2

    cs.AIcs.CLarXiv:2608.23497v12026
  45. Multimodal Fact-Level Attribution for Verifiable Reasoning

    David Wan, Han Wang, Ziyang Wang +3

    cs.CLcs.AIcs.CVarXiv:2602.11509v22026
  46. Exploring Models and Data for Image Question Answering

    Mengye Ren, Ryan Kiros, Richard Zemel

    cs.LGcs.AIcs.CLarXiv:1505.02074v42015
  47. LLM-Planner: Few-Shot Grounded Planning for Embodied Agents with Large Language Models

    Chan Hee Song, Jiaman Wu, Clayton Washington +3

    cs.AIcs.CLcs.CVarXiv:2212.04088v32022
  48. SenTSR-Bench: Thinking with Injected Knowledge for Time-Series Reasoning

    Zelin He, Boran Han, Xiyuan Zhang +10

    cs.LGcs.AIcs.CLarXiv:2602.19455v12026
  49. Expert Gate: Lifelong Learning with a Network of Experts

    Rahaf Aljundi, Punarjay Chakravarty, Tinne Tuytelaars

    cs.CVcs.AIstat.MLarXiv:1611.06194v22016
  50. Curriculum Learning for Reinforcement Learning Domains: A Framework and Survey

    Sanmit Narvekar, Bei Peng, Matteo Leonetti +3

    cs.LGcs.AIstat.MLarXiv:2003.04960v22020
  51. Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization

    Jiachen Zhu, Lingyu Yang, Rong Shan +6

    cs.AIcs.LGarXiv:2604.09574v12026
  52. GEBench: Benchmarking Image Generation Models as GUI Environments

    Haodong Li, Jingwei Wu, Quan Sun +14

    cs.AIcs.CVarXiv:2602.09007v22026
  53. Reasoning about Entailment with Neural Attention

    Tim Rocktäschel, Edward Grefenstette, Karl Moritz Hermann +2

    cs.CLcs.AIcs.LGarXiv:1509.06664v42015
  54. ClinAlign: Scaling Healthcare Alignment from Clinician Preference

    Shiwei Lyu, Xidong Wang, Lei Liu +6

    cs.AIarXiv:2602.09653v22026
  55. Learning to Configure Agentic AI Systems

    Aditya Taparia, Som Sagar, Ransalu Senanayake

    cs.AIarXiv:2602.11574v32026
  56. Decoding as Optimisation on the Probability Simplex: From Top-K to Top-P (Nucleus) to Best-of-K Samplers

    Xiaotong Ji, Rasul Tutunov, Matthieu Zimmer +1

    cs.LGcs.AIarXiv:2602.18292v22026
  57. Decoding ML Decision: An Agentic Reasoning Framework for Large-Scale Ranking System

    Longfei Yun, Yihan Wu, Haoran Liu +11

    cs.AIarXiv:2602.18640v22026
  58. SEAM: Shot Entity-Attribute Memory for Consistent Short-Drama Generation at Scale

    Jiaqi Liu, Maolin Ran, Xiaoyang Lu +5

    cs.AIarXiv:2608.22725v12026
  59. TAPE: Tool-Guided Adaptive Planning and Constrained Execution in Language Model Agents

    Jongwon Jeong, Jungtaek Kim, Kangwook Lee

    cs.AIarXiv:2602.19633v12026
  60. The Art of Efficient Reasoning: Data, Reward, and Optimization

    Taiqiang Wu, Zenan Xu, Bo Zhou +1

    cs.CLcs.AIarXiv:2602.20945v32026