Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
4,381 to 4,440 of 15,271
MAGMA: A Multi-Graph based Agentic Memory Architecture for AI Agents
Dongming Jiang, Yi Li, Guanpeng Li +1
cs.AIarXiv:2601.03236v22026ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models
Chonghan Qin, Xiachong Feng, Weitao Ma +2
cs.AIarXiv:2604.08064v22026VOID: Video Object and Interaction Deletion
Saman Motamed, William Harvey, Benjamin Klein +3
cs.CVcs.AIarXiv:2604.02296v12026Self- and Other-Labels Induce Bidirectional Bias in LLM Judges
Songeun Chae, Min Kim, Donghoon Jung +2
cs.CLcs.AIarXiv:2608.18091v12026Unified Panoramic Geometry Estimation via Multi-View Foundation Models
Vukasin Bozic, Isidora Slavkovic, Dominik Narnhofer +4
cs.CVcs.AIarXiv:2605.26368v22026Risk-Aware Decision-Making for Autonomous Overtaking: A World Model-Based Mixture-of-Experts Framework
Yongzhi Liu, Sunan Zhang, Jinchang Xu +4
cs.ROcs.AIcs.LGarXiv:2609.00385v12026Coronavirus Optimization Algorithm: A Success-History Adaptive Evolutionary Framework with Archive-Assisted Search and Stagnation Recovery for Global Optimization
Hari Mohan Pandey
cs.NEcs.AIcs.CCarXiv:2608.23847v12026A2DINOv3: Rethinking Multi-Modal Object Detection via Socialized Collaboration
Jiekang Feng, Zhihe Fan, Yunqi Zhu +5
cs.CVcs.AIarXiv:2608.21099v12026Hume: Introducing System-2 Thinking in Visual-Language-Action Model
Haoming Song, Delin Qu, Yuanqi Yao +9
cs.ROcs.AIarXiv:2505.21432v42025FinFraudBench: A Heterogeneous Graph Benchmark for Financial Fraud Detection
Yixuan Chen, Hongyu Zhan, Jie Sheng +5
cs.LGcs.AIarXiv:2608.15177v12026JarvisBench: Always-on Intelligence Between Humans and Agents
Chen Chen, Zhehuai Chen
cs.AIarXiv:2608.14870v12026Panoptic Pairwise Distortion Graph
Muhammad Kamran Janjua, Abdul Wahab, Bahador Rashidi
cs.CVcs.AIcs.LGarXiv:2604.11004v12026Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity
Jiayi Zhang, Simon Yu, Derek Chong +4
cs.CLcs.AIarXiv:2510.01171v42025Reinforced Latent Reasoning for LLM-based Recommendation
Yang Zhang, Wenxin Xu, Xiaoyan Zhao +4
cs.AIarXiv:2505.19092v22025Self-rewarding correction for mathematical reasoning
Wei Xiong, Hanning Zhang, Chenlu Ye +3
cs.AIcs.LGarXiv:2502.19613v12025Cognitive Science in the era of Artificial Intelligence: A roadmap for reverse-engineering the infant language-learner
Emmanuel Dupoux
cs.CLcs.AIcs.LGarXiv:1607.08723v42016International AI Safety Report
Yoshua Bengio, Sören Mindermann, Daniel Privitera +93
cs.CYcs.AIcs.LGarXiv:2501.17805v12025Personalizing Dialogue Agents: I have a dog, do you have pets too?
Saizheng Zhang, Emily Dinan, Jack Urbanek +3
cs.AIcs.CLarXiv:1801.07243v52018A Systematic Survey of Automatic Prompt Optimization Techniques
Kiran Ramnath, Kang Zhou, Sheng Guan +18
cs.CLcs.AIarXiv:2502.16923v22025MineCEraft: Evaluating Language Models as Construction Engineers in the World of Minecraft
Sewoong Lee, Risham Sidhu, Julia Hockenmaier +1
cs.AIarXiv:2608.28884v12026Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies
Chen Xu, Tony Khuong Nguyen, Emma Dixon +7
cs.ROcs.AIcs.LGarXiv:2503.08558v32025Fairness in Recommender Systems: Research Landscape and Future Directions
Yashar Deldjoo, Dietmar Jannach, Alejandro Bellogin +2
cs.IRcs.AIarXiv:2205.11127v42022OrcaLoca: An LLM Agent Framework for Software Issue Localization
Zhongming Yu, Hejia Zhang, Yujie Zhao +4
cs.SEcs.AIarXiv:2502.00350v22025Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on Humanoids
Toru Lin, Kartik Sachdev, Linxi Fan +2
cs.ROcs.AIcs.CVarXiv:2502.20396v22025A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
Zixuan Ke, Fangkai Jiao, Yifei Ming +9
cs.AIcs.CLarXiv:2504.09037v42025Provably Efficient Federated Reinforcement Learning with Linear Function Approximation and Logarithmic Communication Cost
Zihang Liang, Haochen Zhang, Lingzhou Xue
stat.MLcs.AIcs.LGarXiv:2609.00193v12026EGT-KG: Evidence-Grounded Typed KG Retrieval for Practical Scientific QA with Small Language Models
Muran Yu, Jiechao Gao, Yuandong Pan +5
cs.AIarXiv:2609.00479v12026An Introduction to Causal Reinforcement Learning
Elias Bareinboim, Junzhe Zhang, Sanghack Lee
cs.AIarXiv:2606.24160v12026Sustainable LLM Inference for Edge AI: Evaluating Quantized LLMs for Energy Efficiency, Output Accuracy, and Inference Latency
Erik Johannes Husom, Arda Goknil, Merve Astekin +5
cs.CYcs.AIcs.CLarXiv:2504.03360v12025MAPoRL: Multi-Agent Post-Co-Training for Collaborative Large Language Models with Reinforcement Learning
Chanwoo Park, Seungju Han, Xingzhi Guo +3
cs.AIarXiv:2502.18439v22025StarCraft Micromanagement with Reinforcement Learning and Curriculum Transfer Learning
Kun Shao, Yuanheng Zhu, Dongbin Zhao
cs.AIcs.LGcs.MAarXiv:1804.00810v12018Towards a Belief-Based World Model for LLM Agents
Shubham Kumar, Harshit Kumar, Narendra Ahuja +1
cs.AIarXiv:2609.00455v12026Process Reward Models for LLM Agents: Practical Framework and Directions
Sanjiban Choudhury
cs.LGcs.AIarXiv:2502.10325v12025RestoreBench: Can AI Agents Restore Power Flow Convergence?
Riccardo Mansutti, Andrea Pomarico, Robert Jakob +3
cs.AIeess.SYarXiv:2609.00384v12026Gradient Alignment in Physics-informed Neural Networks: A Second-Order Optimization Perspective
Sifan Wang, Ananyae Kumar Bhartari, Bowen Li +1
cs.LGcs.AIphysics.comp-pharXiv:2502.00604v22025Don't Overthink it. Preferring Shorter Thinking Chains for Improved LLM Reasoning
Michael Hassid, Gabriel Synnaeve, Yossi Adi +1
cs.CLcs.AIarXiv:2505.17813v22025Monte Carlo Tree Search for Comprehensive Exploration in LLM-Based Automatic Heuristic Design
Zhi Zheng, Zhuoliang Xie, Zhenkun Wang +1
cs.AIarXiv:2501.08603v32025El Agente: An Autonomous Agent for Quantum Chemistry
Yunheng Zou, Austin H. Cheng, Abdulrahman Aldossary +13
cs.AIcs.LGcs.MAarXiv:2505.02484v22025Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents
Yuanchen Bei, Tianxin Wei, Xuying Ning +7
cs.CLcs.AIarXiv:2601.03515v12026Multi-Objective Bayesian Optimization over High-Dimensional Search Spaces
Samuel Daulton, David Eriksson, Maximilian Balandat +1
cs.LGcs.AImath.OCarXiv:2109.10964v42021Knowledge Distillation under Teacher Misspecification: An Order-Parameter Analysis of the Gap between Teacher Mimicry and Task Performance
Kazuyuki Hara, Hideitsu Hino
cs.LGcs.AIarXiv:2608.29472v12026Any6D: Model-free 6D Pose Estimation of Novel Objects
Taeyeop Lee, Bowen Wen, Minjun Kang +3
cs.CVcs.AIcs.ROarXiv:2503.18673v22025Autellix: An Efficient Serving Engine for LLM Agents as General Programs
Michael Luo, Xiaoxiang Shi, Colin Cai +8
cs.LGcs.AIcs.DCarXiv:2502.13965v12025Generalized Interpolating Discrete Diffusion
Dimitri von Rütte, Janis Fluri, Yuhui Ding +3
cs.CLcs.AIcs.LGarXiv:2503.04482v22025OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety
Sanidhya Vijayvargiya, Aditya Bharat Soni, Xuhui Zhou +4
cs.AIarXiv:2507.06134v22025MELON: Provable Defense Against Indirect Prompt Injection Attacks in AI Agents
Kaijie Zhu, Xianjun Yang, Jindong Wang +2
cs.CRcs.AIarXiv:2502.05174v42025On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following Rerankers
Vignesh Prabhakar, Jialing Pan, Anil Babu Ankisettipalli
cs.LGcs.AIarXiv:2609.01947v12026OutageDiT: A Generative Foundation Model for Power Outage Forecasting and Scenario Simulation
Yunqin Zhu, Feng Qiu, Yao Xie
cs.LGcs.AIarXiv:2609.01896v12026Import What You Need: Learning When and How to Augment EHR Graphs with External Knowledge
Chen Chen, Mohsen Nayebi Kerdabadi, Dongjie Wang +2
cs.LGcs.AIarXiv:2609.01839v12026Decoding Visual Neural Representations by Multimodal Learning of Brain-Visual-Linguistic Features
Changde Du, Kaicheng Fu, Jinpeng Li +1
cs.CVcs.AIcs.MMarXiv:2210.06756v22022SagaLLM: Context Management, Validation, and Transaction Guarantees for Multi-Agent LLM Planning
Edward Y. Chang, Longling Geng
cs.AIarXiv:2503.11951v32025Path Planning for Masked Diffusion Model Sampling
Fred Zhangzhi Peng, Zachary Bezemek, Sawan Patel +5
cs.LGcs.AIarXiv:2502.03540v52025LLMs4OL: Large Language Models for Ontology Learning
Hamed Babaei Giglou, Jennifer D'Souza, Sören Auer
cs.AIcs.CLcs.ITarXiv:2307.16648v22023SkillGLoW: Procedural-Family Skill Consolidation for Self-Improving Agents on Long-Horizon Task Streams
Ao Yan, Xin Zhang, Jiawei Du +1
cs.AIarXiv:2609.02217v12026Recent Advances in Discrete Speech Tokens: A Review
Yiwei Guo, Zhihan Li, Hankun Wang +7
eess.AScs.AIcs.MMarXiv:2502.06490v42025A Framework for Human Evaluation of Large Language Models in Healthcare Derived from Literature Review
Thomas Yu Chow Tam, Sonish Sivarajkumar, Sumit Kapoor +12
cs.CLcs.AIarXiv:2405.02559v22024SIoU Loss: More Powerful Learning for Bounding Box Regression
Zhora Gevorgyan
cs.CVcs.AIarXiv:2205.12740v12022DRIFT: Dynamic Rule-Based Defense with Injection Isolation for Securing LLM Agents
Hao Li, Xiaogeng Liu, Hung-Chun Chiu +3
cs.CRcs.AIarXiv:2506.12104v32025Ethical and social risks of harm from Language Models
Laura Weidinger, John Mellor, Maribeth Rauh +20
cs.CLcs.AIcs.CYarXiv:2112.04359v12021RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
Zijing Zhang, Ziyang Chen, Mingxiao Li +2
cs.LGcs.AIarXiv:2507.22844v12025