Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

13,561 to 13,620 of 15,364

  1. Learning to Communicate with Deep Multi-Agent Reinforcement Learning

    Jakob N. Foerster, Yannis M. Assael, Nando de Freitas +1

    cs.AIcs.LGcs.MAarXiv:1605.06676v22016
  2. Edge Intelligence: Paving the Last Mile of Artificial Intelligence with Edge Computing

    Zhi Zhou, Xu Chen, En Li +3

    cs.DCcs.AIcs.NIarXiv:1905.10083v12019
  3. CURV: Enhancing Chart Understanding Through Curriculum Visual Grounded Reasoning

    Xuehang Guo, Pingyue Zhang, Ruiyi Zhang +6

    cs.CVcs.AIcs.CLarXiv:2608.02833v12026
  4. MLREF: Efficient Module Reuse for Reward Design in Reinforcement Learning via Large Language Models

    Chenglin Liu, Xun Wang, Ruishuo Chen +2

    cs.LGcs.AIcs.CLarXiv:2608.18827v12026
  5. HarnessRisk: A Lifecycle-Oriented Benchmark for Agent Harness Safety

    Yajing Bai, Jinhao Duan, Jie Peng +4

    cs.CRcs.AIarXiv:2608.17597v12026
  6. OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models

    Qiushi Sun, Kanzhi Cheng, Yian Wang +20

    cs.AIcs.CLcs.CVarXiv:2607.28609v22026
  7. Towards Diverse Scientific Hypothesis Search with Large Language Models

    Haorui Wang, Parshin Shojaee, Kazem Meidani +7

    cs.LGcs.AIarXiv:2606.10587v12026
  8. Environment-free Synthetic Data Generation for API-Calling Agents

    Seanie Lee, Sanjoy Chowdhury, Chao Jiang +5

    cs.AIarXiv:2607.16900v22026
  9. TriGlue: a Biology-Inspired Generative Model for Generating Molecular Glue-Induced Ternary Complex

    Yuliang Yan, Shuo Yan, Haochun Tang +2

    cs.LGcs.AIarXiv:2607.22143v22026
  10. PolicyShiftGuard: Benchmarking and Improving Policy-Adaptive Image Guardrails

    Mingyang Song, Luxin Xu, Haoyu Sun +3

    cs.CVcs.AIcs.CLarXiv:2607.05910v12026
  11. Bridging Interleaved Multi-Modal Reasoning as a Unified Decision Process

    Zican Hu, Xuyang Hu, Yiming Liu +10

    cs.AIarXiv:2607.03748v12026
  12. ENPIRE: Agentic Robot Policy Self-Improvement in the Real World

    Wenli Xiao, Jia Xie, Tonghe Zhang +14

    cs.AIarXiv:2606.19980v12026
  13. AutoLLMResearch: Training Research Agents for Automating LLM Experiment Configuration - Learning from Cheap, Optimizing Expensive

    Taicheng Guo, Nitesh V. Chawla, Olaf Wiest +1

    cs.AIcs.CLcs.LGarXiv:2605.11518v22026
  14. Benchmark Everything Everywhere All at Once

    Shiyun Xiong, Dongming Wu, Peiwen Sun +5

    cs.AIarXiv:2606.06462v12026
  15. $π$-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows

    Haoran Zhang, Luxin Xu, Zhilin Wang +11

    cs.AIarXiv:2605.14678v32026
  16. Continual Harness: Online Adaptation for Self-Improving Foundation Agents

    Seth Karten, Joel Zhang, Tersoo Upaa +5

    cs.LGcs.AIarXiv:2605.09998v12026
  17. Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key

    Tianle Wang, Zhaoyang Wang, Guangchen Lan +4

    cs.AIcs.CLarXiv:2605.06638v32026
  18. Prompt-Activation Duality: Improving Activation Steering via Attention-Level Interventions

    Diancheng Kang, Zheyuan Liu, Ningshan Ma +3

    cs.CLcs.AIarXiv:2605.10664v22026
  19. Ego4D: Around the World in 3,000 Hours of Egocentric Video

    Kristen Grauman, Andrew Westbury, Eugene Byrne +82

    cs.CVcs.AIarXiv:2110.07058v32021
  20. GLM: General Language Model Pretraining with Autoregressive Blank Infilling

    Zhengxiao Du, Yujie Qian, Xiao Liu +4

    cs.CLcs.AIcs.LGarXiv:2103.10360v22021
  21. The Rise and Potential of Large Language Model Based Agents: A Survey

    Zhiheng Xi, Wenxiang Chen, Xin Guo +26

    cs.AIcs.CLarXiv:2309.07864v32023
  22. Distilling LLM Feedback for Lean Theorem Proving

    Gaetan Narozniak, Gérard Biau, Rémi Munos +2

    cs.AIarXiv:2605.30861v12026
  23. Representation over Routing: Diagnosing Temporal Routing Pathologies in Multi-Timescale PPO

    Jing Sun

    cs.LGcs.AIarXiv:2604.13517v42026
  24. Ensemble deep learning: A review

    M. A. Ganaie, Minghui Hu, A. K. Malik +2

    cs.LGcs.AIcs.CVarXiv:2104.02395v32021
  25. The Shape of Addition: Geometric Structures of Arithmetic in Large Language Models

    Liuyuan Wen, Xun Zhu, Lihao Huang +2

    cs.LGcs.AIarXiv:2606.03645v12026
  26. Honest Lying: Understanding Memory Confabulation in Reflexive Agents

    Prakhar Dixit, Sadia Kamal, Tim Oates

    cs.LGcs.AIarXiv:2605.29463v22026
  27. SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes

    Tianhui Liu, Jie Feng, Zhiheng Zheng +6

    cs.CVcs.AIcs.CLarXiv:2605.31148v12026
  28. Learning Latent Dynamics for Planning from Pixels

    Danijar Hafner, Timothy Lillicrap, Ian Fischer +4

    cs.LGcs.AIstat.MLarXiv:1811.04551v52018
  29. KAN: Kolmogorov-Arnold Networks

    Ziming Liu, Yixuan Wang, Sachin Vaidya +5

    cs.LGcond-mat.dis-nncs.AIarXiv:2404.19756v52024
  30. Critic-R: Improving Agentic Search using Instruction-tuned Retrievers with Natural Language Introspective Feedback

    Md Zarif Ul Alam, Alireza Salemi, Hamed Zamani

    cs.IRcs.AIarXiv:2606.00590v12026
  31. On the Limits of LLM Adaptability: Impact of Model-Internalized Priors on Annotation Task Performance

    Etienne Casanova, Rafal Kocielnik, R. Michael Alvarez

    cs.CLcs.AIcs.LGarXiv:2606.00467v12026
  32. Identifying the Best Machine Learning Algorithms for Brain Tumor Segmentation, Progression Assessment, and Overall Survival Prediction in the BRATS Challenge

    Spyridon Bakas, Mauricio Reyes, Andras Jakab +424

    cs.CVcs.AIcs.LGarXiv:1811.02629v32018
  33. Habitat: A Platform for Embodied AI Research

    Manolis Savva, Abhishek Kadian, Oleksandr Maksymets +9

    cs.CVcs.AIcs.CLarXiv:1904.01201v22019
  34. Who Annotates in NLP? A Large-scale Assessment of Human Annotation Reporting between 2018 and 2025

    Maria Kunilovskaya, Gagan Bhatia, Lisa Sophie Albertelli +10

    cs.CLcs.AIarXiv:2606.02255v12026
    Summaries:한국어
  35. DOT-MoE: Differentiable Optimal Transport for MoEfication

    Udbhav Bamba, Arnav Chavan, Aryamaan Thakur +2

    cs.LGcs.AIarXiv:2606.01666v12026
  36. Absorbing Complexity: An Interaction-Native Knowledge Harness for Financial LLM Agents

    Ailiya Borjigin, Igor Stadnyk, Ben Bilski +4

    cs.AIcs.CEarXiv:2606.01886v12026
  37. Alias-Free Generative Adversarial Networks

    Tero Karras, Miika Aittala, Samuli Laine +4

    cs.CVcs.AIcs.LGarXiv:2106.12423v42021
    Summaries:한국어
  38. Spider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to-SQL Task

    Tao Yu, Rui Zhang, Kai Yang +9

    cs.CLcs.AIarXiv:1809.08887v52018
  39. FVSpec: Real-World Property-Based Tests as Lean Challenges

    Quinn Dougherty, Max von Hippel, Simon Henniger +2

    cs.SEcs.AIarXiv:2606.01008v22026
  40. An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models

    Mingzhong Sun, Teresa Yeo, Armando Solar-Lezama +1

    cs.AIcs.CLcs.LGarXiv:2606.01462v12026
  41. ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs

    Yujia Qin, Shihao Liang, Yining Ye +16

    cs.AIcs.CLcs.LGarXiv:2307.16789v22023
  42. CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving

    Yifan Wang

    cs.ROcs.AIarXiv:2606.02641v12026
  43. Students' Voices on Generative AI: Perceptions, Benefits, and Challenges in Higher Education

    Cecilia Ka Yuk Chan, Wenjie Hu

    cs.CYcs.AIarXiv:2305.00290v12023
  44. Joint Agent Memory and Exploration Learning via Novelty Signals

    Shizuo Tian, Xiaohong Weng, Rui Kong +9

    cs.AIarXiv:2606.01528v12026
  45. LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-Tuning for Agentic Language Models

    Prateek Kumar Sikdar

    cs.CLcs.AIcs.LGarXiv:2606.01838v12026
  46. Return of Frustratingly Easy Domain Adaptation

    Baochen Sun, Jiashi Feng, Kate Saenko

    cs.CVcs.AIcs.LGarXiv:1511.05547v22015
  47. Graph Convolutional Networks for Text Classification

    Liang Yao, Chengsheng Mao, Yuan Luo

    cs.CLcs.AIarXiv:1809.05679v32018
  48. MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?

    Xinyu Che, Junqi Xiong, Yunfei Ge +10

    cs.CLcs.AIcs.LGarXiv:2606.01993v12026
  49. AgentCL: Toward Rigorous Evaluation of Continual Learning in Language Agents

    Yiheng Shu, Bernal Jiménez Gutiérrez, Saisri Padmaja Jonnalagedda +3

    cs.AIcs.CLarXiv:2606.02461v22026
  50. Agentic Chain-of-Thought Steering for Efficient and Controllable LLM Reasoning

    Yu Xia, Zhouhang Xie, Xin Xu +4

    cs.CLcs.AIarXiv:2606.03965v12026
  51. Large Language Models Hack Rewards, and Society

    Wei Liu, Xinyi Mou, Hanqi Yan +2

    cs.LGcs.AIcs.CLarXiv:2606.04075v22026
  52. Improving Factuality and Reasoning in Language Models through Multiagent Debate

    Yilun Du, Shuang Li, Antonio Torralba +2

    cs.CLcs.AIcs.CVarXiv:2305.14325v12023
  53. SynCred-Bench: Benchmarking Synthetic Credibility in AI-Generated Visual Misinformation

    Junxiao Yang, Minghao Zhang, Xiaoce Wang +4

    cs.CVcs.AIarXiv:2606.03348v12026
  54. Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them

    Mirac Suzgun, Nathan Scales, Nathanael Schärli +8

    cs.CLcs.AIarXiv:2210.09261v12022
  55. Qwen-Image-Flash: Beyond Objective Design

    Tianhe Wu, Kun Yan, Zikai Zhou +21

    cs.CVcs.AIcs.GRarXiv:2606.03746v22026
  56. Memory Aware Synapses: Learning what (not) to forget

    Rahaf Aljundi, Francesca Babiloni, Mohamed Elhoseiny +2

    cs.CVcs.AIstat.MLarXiv:1711.09601v42017
  57. The Shadow Price of Reasoning: Economic Perspective on Optimal Budget Allocation for LLMs

    Xu Wan, Speed Zhu, Jianwei Cai +4

    cs.AIarXiv:2606.03092v22026
  58. Self-critical Sequence Training for Image Captioning

    Steven J. Rennie, Etienne Marcheret, Youssef Mroueh +2

    cs.LGcs.AIcs.CVarXiv:1612.00563v22016
  59. Steady-Forcing: Balancing Spatial Persistence and Motion Continuity in Long-Horizon Nature Video Diffusion

    Matiur Rahman Minar, Seunghun Oh, GangHyeon Jeong +1

    cs.CVcs.AIcs.LGarXiv:2606.14732v12026
  60. Weight Normalization: A Simple Reparameterization to Accelerate Training of Deep Neural Networks

    Tim Salimans, Diederik P. Kingma

    cs.LGcs.AIcs.NEarXiv:1602.07868v32016