Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
13,561 to 13,620 of 15,364
Learning to Communicate with Deep Multi-Agent Reinforcement Learning
Jakob N. Foerster, Yannis M. Assael, Nando de Freitas +1
cs.AIcs.LGcs.MAarXiv:1605.06676v22016Edge Intelligence: Paving the Last Mile of Artificial Intelligence with Edge Computing
Zhi Zhou, Xu Chen, En Li +3
cs.DCcs.AIcs.NIarXiv:1905.10083v12019CURV: Enhancing Chart Understanding Through Curriculum Visual Grounded Reasoning
Xuehang Guo, Pingyue Zhang, Ruiyi Zhang +6
cs.CVcs.AIcs.CLarXiv:2608.02833v12026MLREF: Efficient Module Reuse for Reward Design in Reinforcement Learning via Large Language Models
Chenglin Liu, Xun Wang, Ruishuo Chen +2
cs.LGcs.AIcs.CLarXiv:2608.18827v12026HarnessRisk: A Lifecycle-Oriented Benchmark for Agent Harness Safety
Yajing Bai, Jinhao Duan, Jie Peng +4
cs.CRcs.AIarXiv:2608.17597v12026OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models
Qiushi Sun, Kanzhi Cheng, Yian Wang +20
cs.AIcs.CLcs.CVarXiv:2607.28609v22026Towards Diverse Scientific Hypothesis Search with Large Language Models
Haorui Wang, Parshin Shojaee, Kazem Meidani +7
cs.LGcs.AIarXiv:2606.10587v12026Environment-free Synthetic Data Generation for API-Calling Agents
Seanie Lee, Sanjoy Chowdhury, Chao Jiang +5
cs.AIarXiv:2607.16900v22026TriGlue: a Biology-Inspired Generative Model for Generating Molecular Glue-Induced Ternary Complex
Yuliang Yan, Shuo Yan, Haochun Tang +2
cs.LGcs.AIarXiv:2607.22143v22026PolicyShiftGuard: Benchmarking and Improving Policy-Adaptive Image Guardrails
Mingyang Song, Luxin Xu, Haoyu Sun +3
cs.CVcs.AIcs.CLarXiv:2607.05910v12026Bridging Interleaved Multi-Modal Reasoning as a Unified Decision Process
Zican Hu, Xuyang Hu, Yiming Liu +10
cs.AIarXiv:2607.03748v12026ENPIRE: Agentic Robot Policy Self-Improvement in the Real World
Wenli Xiao, Jia Xie, Tonghe Zhang +14
cs.AIarXiv:2606.19980v12026AutoLLMResearch: Training Research Agents for Automating LLM Experiment Configuration - Learning from Cheap, Optimizing Expensive
Taicheng Guo, Nitesh V. Chawla, Olaf Wiest +1
cs.AIcs.CLcs.LGarXiv:2605.11518v22026Benchmark Everything Everywhere All at Once
Shiyun Xiong, Dongming Wu, Peiwen Sun +5
cs.AIarXiv:2606.06462v12026$π$-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
Haoran Zhang, Luxin Xu, Zhilin Wang +11
cs.AIarXiv:2605.14678v32026Continual Harness: Online Adaptation for Self-Improving Foundation Agents
Seth Karten, Joel Zhang, Tersoo Upaa +5
cs.LGcs.AIarXiv:2605.09998v12026Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key
Tianle Wang, Zhaoyang Wang, Guangchen Lan +4
cs.AIcs.CLarXiv:2605.06638v32026Prompt-Activation Duality: Improving Activation Steering via Attention-Level Interventions
Diancheng Kang, Zheyuan Liu, Ningshan Ma +3
cs.CLcs.AIarXiv:2605.10664v22026Ego4D: Around the World in 3,000 Hours of Egocentric Video
Kristen Grauman, Andrew Westbury, Eugene Byrne +82
cs.CVcs.AIarXiv:2110.07058v32021GLM: General Language Model Pretraining with Autoregressive Blank Infilling
Zhengxiao Du, Yujie Qian, Xiao Liu +4
cs.CLcs.AIcs.LGarXiv:2103.10360v22021The Rise and Potential of Large Language Model Based Agents: A Survey
Zhiheng Xi, Wenxiang Chen, Xin Guo +26
cs.AIcs.CLarXiv:2309.07864v32023Distilling LLM Feedback for Lean Theorem Proving
Gaetan Narozniak, Gérard Biau, Rémi Munos +2
cs.AIarXiv:2605.30861v12026Representation over Routing: Diagnosing Temporal Routing Pathologies in Multi-Timescale PPO
Jing Sun
cs.LGcs.AIarXiv:2604.13517v42026Ensemble deep learning: A review
M. A. Ganaie, Minghui Hu, A. K. Malik +2
cs.LGcs.AIcs.CVarXiv:2104.02395v32021The Shape of Addition: Geometric Structures of Arithmetic in Large Language Models
Liuyuan Wen, Xun Zhu, Lihao Huang +2
cs.LGcs.AIarXiv:2606.03645v12026Honest Lying: Understanding Memory Confabulation in Reflexive Agents
Prakhar Dixit, Sadia Kamal, Tim Oates
cs.LGcs.AIarXiv:2605.29463v22026SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes
Tianhui Liu, Jie Feng, Zhiheng Zheng +6
cs.CVcs.AIcs.CLarXiv:2605.31148v12026Learning Latent Dynamics for Planning from Pixels
Danijar Hafner, Timothy Lillicrap, Ian Fischer +4
cs.LGcs.AIstat.MLarXiv:1811.04551v52018KAN: Kolmogorov-Arnold Networks
Ziming Liu, Yixuan Wang, Sachin Vaidya +5
cs.LGcond-mat.dis-nncs.AIarXiv:2404.19756v52024Critic-R: Improving Agentic Search using Instruction-tuned Retrievers with Natural Language Introspective Feedback
Md Zarif Ul Alam, Alireza Salemi, Hamed Zamani
cs.IRcs.AIarXiv:2606.00590v12026On the Limits of LLM Adaptability: Impact of Model-Internalized Priors on Annotation Task Performance
Etienne Casanova, Rafal Kocielnik, R. Michael Alvarez
cs.CLcs.AIcs.LGarXiv:2606.00467v12026Identifying the Best Machine Learning Algorithms for Brain Tumor Segmentation, Progression Assessment, and Overall Survival Prediction in the BRATS Challenge
Spyridon Bakas, Mauricio Reyes, Andras Jakab +424
cs.CVcs.AIcs.LGarXiv:1811.02629v32018Habitat: A Platform for Embodied AI Research
Manolis Savva, Abhishek Kadian, Oleksandr Maksymets +9
cs.CVcs.AIcs.CLarXiv:1904.01201v22019Who Annotates in NLP? A Large-scale Assessment of Human Annotation Reporting between 2018 and 2025
Maria Kunilovskaya, Gagan Bhatia, Lisa Sophie Albertelli +10
cs.CLcs.AIarXiv:2606.02255v12026Summaries:한국어DOT-MoE: Differentiable Optimal Transport for MoEfication
Udbhav Bamba, Arnav Chavan, Aryamaan Thakur +2
cs.LGcs.AIarXiv:2606.01666v12026Absorbing Complexity: An Interaction-Native Knowledge Harness for Financial LLM Agents
Ailiya Borjigin, Igor Stadnyk, Ben Bilski +4
cs.AIcs.CEarXiv:2606.01886v12026Alias-Free Generative Adversarial Networks
Tero Karras, Miika Aittala, Samuli Laine +4
cs.CVcs.AIcs.LGarXiv:2106.12423v42021Summaries:한국어Spider: A Large-Scale Human-Labeled Dataset for Complex and Cross-Domain Semantic Parsing and Text-to-SQL Task
Tao Yu, Rui Zhang, Kai Yang +9
cs.CLcs.AIarXiv:1809.08887v52018FVSpec: Real-World Property-Based Tests as Lean Challenges
Quinn Dougherty, Max von Hippel, Simon Henniger +2
cs.SEcs.AIarXiv:2606.01008v22026An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models
Mingzhong Sun, Teresa Yeo, Armando Solar-Lezama +1
cs.AIcs.CLcs.LGarXiv:2606.01462v12026ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs
Yujia Qin, Shihao Liang, Yining Ye +16
cs.AIcs.CLcs.LGarXiv:2307.16789v22023CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving
Yifan Wang
cs.ROcs.AIarXiv:2606.02641v12026Students' Voices on Generative AI: Perceptions, Benefits, and Challenges in Higher Education
Cecilia Ka Yuk Chan, Wenjie Hu
cs.CYcs.AIarXiv:2305.00290v12023Joint Agent Memory and Exploration Learning via Novelty Signals
Shizuo Tian, Xiaohong Weng, Rui Kong +9
cs.AIarXiv:2606.01528v12026LayerRoute: Input-Conditioned Adaptive Layer Skipping via LoRA Fine-Tuning for Agentic Language Models
Prateek Kumar Sikdar
cs.CLcs.AIcs.LGarXiv:2606.01838v12026Return of Frustratingly Easy Domain Adaptation
Baochen Sun, Jiashi Feng, Kate Saenko
cs.CVcs.AIcs.LGarXiv:1511.05547v22015Graph Convolutional Networks for Text Classification
Liang Yao, Chengsheng Mao, Yuan Luo
cs.CLcs.AIarXiv:1809.05679v32018MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?
Xinyu Che, Junqi Xiong, Yunfei Ge +10
cs.CLcs.AIcs.LGarXiv:2606.01993v12026AgentCL: Toward Rigorous Evaluation of Continual Learning in Language Agents
Yiheng Shu, Bernal Jiménez Gutiérrez, Saisri Padmaja Jonnalagedda +3
cs.AIcs.CLarXiv:2606.02461v22026Agentic Chain-of-Thought Steering for Efficient and Controllable LLM Reasoning
Yu Xia, Zhouhang Xie, Xin Xu +4
cs.CLcs.AIarXiv:2606.03965v12026Large Language Models Hack Rewards, and Society
Wei Liu, Xinyi Mou, Hanqi Yan +2
cs.LGcs.AIcs.CLarXiv:2606.04075v22026Improving Factuality and Reasoning in Language Models through Multiagent Debate
Yilun Du, Shuang Li, Antonio Torralba +2
cs.CLcs.AIcs.CVarXiv:2305.14325v12023SynCred-Bench: Benchmarking Synthetic Credibility in AI-Generated Visual Misinformation
Junxiao Yang, Minghao Zhang, Xiaoce Wang +4
cs.CVcs.AIarXiv:2606.03348v12026Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them
Mirac Suzgun, Nathan Scales, Nathanael Schärli +8
cs.CLcs.AIarXiv:2210.09261v12022Qwen-Image-Flash: Beyond Objective Design
Tianhe Wu, Kun Yan, Zikai Zhou +21
cs.CVcs.AIcs.GRarXiv:2606.03746v22026Memory Aware Synapses: Learning what (not) to forget
Rahaf Aljundi, Francesca Babiloni, Mohamed Elhoseiny +2
cs.CVcs.AIstat.MLarXiv:1711.09601v42017The Shadow Price of Reasoning: Economic Perspective on Optimal Budget Allocation for LLMs
Xu Wan, Speed Zhu, Jianwei Cai +4
cs.AIarXiv:2606.03092v22026Self-critical Sequence Training for Image Captioning
Steven J. Rennie, Etienne Marcheret, Youssef Mroueh +2
cs.LGcs.AIcs.CVarXiv:1612.00563v22016Steady-Forcing: Balancing Spatial Persistence and Motion Continuity in Long-Horizon Nature Video Diffusion
Matiur Rahman Minar, Seunghun Oh, GangHyeon Jeong +1
cs.CVcs.AIcs.LGarXiv:2606.14732v12026Weight Normalization: A Simple Reparameterization to Accelerate Training of Deep Neural Networks
Tim Salimans, Diederik P. Kingma
cs.LGcs.AIcs.NEarXiv:1602.07868v32016