Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

4,381 to 4,440 of 15,271

  1. MAGMA: A Multi-Graph based Agentic Memory Architecture for AI Agents

    Dongming Jiang, Yi Li, Guanpeng Li +1

    cs.AIarXiv:2601.03236v22026
  2. ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models

    Chonghan Qin, Xiachong Feng, Weitao Ma +2

    cs.AIarXiv:2604.08064v22026
  3. VOID: Video Object and Interaction Deletion

    Saman Motamed, William Harvey, Benjamin Klein +3

    cs.CVcs.AIarXiv:2604.02296v12026
  4. Self- and Other-Labels Induce Bidirectional Bias in LLM Judges

    Songeun Chae, Min Kim, Donghoon Jung +2

    cs.CLcs.AIarXiv:2608.18091v12026
  5. Unified Panoramic Geometry Estimation via Multi-View Foundation Models

    Vukasin Bozic, Isidora Slavkovic, Dominik Narnhofer +4

    cs.CVcs.AIarXiv:2605.26368v22026
  6. Risk-Aware Decision-Making for Autonomous Overtaking: A World Model-Based Mixture-of-Experts Framework

    Yongzhi Liu, Sunan Zhang, Jinchang Xu +4

    cs.ROcs.AIcs.LGarXiv:2609.00385v12026
  7. Coronavirus Optimization Algorithm: A Success-History Adaptive Evolutionary Framework with Archive-Assisted Search and Stagnation Recovery for Global Optimization

    Hari Mohan Pandey

    cs.NEcs.AIcs.CCarXiv:2608.23847v12026
  8. A2DINOv3: Rethinking Multi-Modal Object Detection via Socialized Collaboration

    Jiekang Feng, Zhihe Fan, Yunqi Zhu +5

    cs.CVcs.AIarXiv:2608.21099v12026
  9. Hume: Introducing System-2 Thinking in Visual-Language-Action Model

    Haoming Song, Delin Qu, Yuanqi Yao +9

    cs.ROcs.AIarXiv:2505.21432v42025
  10. FinFraudBench: A Heterogeneous Graph Benchmark for Financial Fraud Detection

    Yixuan Chen, Hongyu Zhan, Jie Sheng +5

    cs.LGcs.AIarXiv:2608.15177v12026
  11. JarvisBench: Always-on Intelligence Between Humans and Agents

    Chen Chen, Zhehuai Chen

    cs.AIarXiv:2608.14870v12026
  12. Panoptic Pairwise Distortion Graph

    Muhammad Kamran Janjua, Abdul Wahab, Bahador Rashidi

    cs.CVcs.AIcs.LGarXiv:2604.11004v12026
  13. Verbalized Sampling: How to Mitigate Mode Collapse and Unlock LLM Diversity

    Jiayi Zhang, Simon Yu, Derek Chong +4

    cs.CLcs.AIarXiv:2510.01171v42025
  14. Reinforced Latent Reasoning for LLM-based Recommendation

    Yang Zhang, Wenxin Xu, Xiaoyan Zhao +4

    cs.AIarXiv:2505.19092v22025
  15. Self-rewarding correction for mathematical reasoning

    Wei Xiong, Hanning Zhang, Chenlu Ye +3

    cs.AIcs.LGarXiv:2502.19613v12025
  16. Cognitive Science in the era of Artificial Intelligence: A roadmap for reverse-engineering the infant language-learner

    Emmanuel Dupoux

    cs.CLcs.AIcs.LGarXiv:1607.08723v42016
  17. International AI Safety Report

    Yoshua Bengio, Sören Mindermann, Daniel Privitera +93

    cs.CYcs.AIcs.LGarXiv:2501.17805v12025
  18. Personalizing Dialogue Agents: I have a dog, do you have pets too?

    Saizheng Zhang, Emily Dinan, Jack Urbanek +3

    cs.AIcs.CLarXiv:1801.07243v52018
  19. A Systematic Survey of Automatic Prompt Optimization Techniques

    Kiran Ramnath, Kang Zhou, Sheng Guan +18

    cs.CLcs.AIarXiv:2502.16923v22025
  20. MineCEraft: Evaluating Language Models as Construction Engineers in the World of Minecraft

    Sewoong Lee, Risham Sidhu, Julia Hockenmaier +1

    cs.AIarXiv:2608.28884v12026
  21. Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies

    Chen Xu, Tony Khuong Nguyen, Emma Dixon +7

    cs.ROcs.AIcs.LGarXiv:2503.08558v32025
  22. Fairness in Recommender Systems: Research Landscape and Future Directions

    Yashar Deldjoo, Dietmar Jannach, Alejandro Bellogin +2

    cs.IRcs.AIarXiv:2205.11127v42022
  23. OrcaLoca: An LLM Agent Framework for Software Issue Localization

    Zhongming Yu, Hejia Zhang, Yujie Zhao +4

    cs.SEcs.AIarXiv:2502.00350v22025
  24. Sim-to-Real Reinforcement Learning for Vision-Based Dexterous Manipulation on Humanoids

    Toru Lin, Kartik Sachdev, Linxi Fan +2

    cs.ROcs.AIcs.CVarXiv:2502.20396v22025
  25. A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems

    Zixuan Ke, Fangkai Jiao, Yifei Ming +9

    cs.AIcs.CLarXiv:2504.09037v42025
  26. Provably Efficient Federated Reinforcement Learning with Linear Function Approximation and Logarithmic Communication Cost

    Zihang Liang, Haochen Zhang, Lingzhou Xue

    stat.MLcs.AIcs.LGarXiv:2609.00193v12026
  27. EGT-KG: Evidence-Grounded Typed KG Retrieval for Practical Scientific QA with Small Language Models

    Muran Yu, Jiechao Gao, Yuandong Pan +5

    cs.AIarXiv:2609.00479v12026
  28. An Introduction to Causal Reinforcement Learning

    Elias Bareinboim, Junzhe Zhang, Sanghack Lee

    cs.AIarXiv:2606.24160v12026
  29. Sustainable LLM Inference for Edge AI: Evaluating Quantized LLMs for Energy Efficiency, Output Accuracy, and Inference Latency

    Erik Johannes Husom, Arda Goknil, Merve Astekin +5

    cs.CYcs.AIcs.CLarXiv:2504.03360v12025
  30. MAPoRL: Multi-Agent Post-Co-Training for Collaborative Large Language Models with Reinforcement Learning

    Chanwoo Park, Seungju Han, Xingzhi Guo +3

    cs.AIarXiv:2502.18439v22025
  31. StarCraft Micromanagement with Reinforcement Learning and Curriculum Transfer Learning

    Kun Shao, Yuanheng Zhu, Dongbin Zhao

    cs.AIcs.LGcs.MAarXiv:1804.00810v12018
  32. Towards a Belief-Based World Model for LLM Agents

    Shubham Kumar, Harshit Kumar, Narendra Ahuja +1

    cs.AIarXiv:2609.00455v12026
  33. Process Reward Models for LLM Agents: Practical Framework and Directions

    Sanjiban Choudhury

    cs.LGcs.AIarXiv:2502.10325v12025
  34. RestoreBench: Can AI Agents Restore Power Flow Convergence?

    Riccardo Mansutti, Andrea Pomarico, Robert Jakob +3

    cs.AIeess.SYarXiv:2609.00384v12026
  35. Gradient Alignment in Physics-informed Neural Networks: A Second-Order Optimization Perspective

    Sifan Wang, Ananyae Kumar Bhartari, Bowen Li +1

    cs.LGcs.AIphysics.comp-pharXiv:2502.00604v22025
  36. Don't Overthink it. Preferring Shorter Thinking Chains for Improved LLM Reasoning

    Michael Hassid, Gabriel Synnaeve, Yossi Adi +1

    cs.CLcs.AIarXiv:2505.17813v22025
  37. Monte Carlo Tree Search for Comprehensive Exploration in LLM-Based Automatic Heuristic Design

    Zhi Zheng, Zhuoliang Xie, Zhenkun Wang +1

    cs.AIarXiv:2501.08603v32025
  38. El Agente: An Autonomous Agent for Quantum Chemistry

    Yunheng Zou, Austin H. Cheng, Abdulrahman Aldossary +13

    cs.AIcs.LGcs.MAarXiv:2505.02484v22025
  39. Mem-Gallery: Benchmarking Multimodal Long-Term Conversational Memory for MLLM Agents

    Yuanchen Bei, Tianxin Wei, Xuying Ning +7

    cs.CLcs.AIarXiv:2601.03515v12026
  40. Multi-Objective Bayesian Optimization over High-Dimensional Search Spaces

    Samuel Daulton, David Eriksson, Maximilian Balandat +1

    cs.LGcs.AImath.OCarXiv:2109.10964v42021
  41. Knowledge Distillation under Teacher Misspecification: An Order-Parameter Analysis of the Gap between Teacher Mimicry and Task Performance

    Kazuyuki Hara, Hideitsu Hino

    cs.LGcs.AIarXiv:2608.29472v12026
  42. Any6D: Model-free 6D Pose Estimation of Novel Objects

    Taeyeop Lee, Bowen Wen, Minjun Kang +3

    cs.CVcs.AIcs.ROarXiv:2503.18673v22025
  43. Autellix: An Efficient Serving Engine for LLM Agents as General Programs

    Michael Luo, Xiaoxiang Shi, Colin Cai +8

    cs.LGcs.AIcs.DCarXiv:2502.13965v12025
  44. Generalized Interpolating Discrete Diffusion

    Dimitri von Rütte, Janis Fluri, Yuhui Ding +3

    cs.CLcs.AIcs.LGarXiv:2503.04482v22025
  45. OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety

    Sanidhya Vijayvargiya, Aditya Bharat Soni, Xuhui Zhou +4

    cs.AIarXiv:2507.06134v22025
  46. MELON: Provable Defense Against Indirect Prompt Injection Attacks in AI Agents

    Kaijie Zhu, Xianjun Yang, Jindong Wang +2

    cs.CRcs.AIarXiv:2502.05174v42025
  47. On-Policy Distillation Meets Off-Policy GRPO: Training Compact Instruction-Following Rerankers

    Vignesh Prabhakar, Jialing Pan, Anil Babu Ankisettipalli

    cs.LGcs.AIarXiv:2609.01947v12026
  48. OutageDiT: A Generative Foundation Model for Power Outage Forecasting and Scenario Simulation

    Yunqin Zhu, Feng Qiu, Yao Xie

    cs.LGcs.AIarXiv:2609.01896v12026
  49. Import What You Need: Learning When and How to Augment EHR Graphs with External Knowledge

    Chen Chen, Mohsen Nayebi Kerdabadi, Dongjie Wang +2

    cs.LGcs.AIarXiv:2609.01839v12026
  50. Decoding Visual Neural Representations by Multimodal Learning of Brain-Visual-Linguistic Features

    Changde Du, Kaicheng Fu, Jinpeng Li +1

    cs.CVcs.AIcs.MMarXiv:2210.06756v22022
  51. SagaLLM: Context Management, Validation, and Transaction Guarantees for Multi-Agent LLM Planning

    Edward Y. Chang, Longling Geng

    cs.AIarXiv:2503.11951v32025
  52. Path Planning for Masked Diffusion Model Sampling

    Fred Zhangzhi Peng, Zachary Bezemek, Sawan Patel +5

    cs.LGcs.AIarXiv:2502.03540v52025
  53. LLMs4OL: Large Language Models for Ontology Learning

    Hamed Babaei Giglou, Jennifer D'Souza, Sören Auer

    cs.AIcs.CLcs.ITarXiv:2307.16648v22023
  54. SkillGLoW: Procedural-Family Skill Consolidation for Self-Improving Agents on Long-Horizon Task Streams

    Ao Yan, Xin Zhang, Jiawei Du +1

    cs.AIarXiv:2609.02217v12026
  55. Recent Advances in Discrete Speech Tokens: A Review

    Yiwei Guo, Zhihan Li, Hankun Wang +7

    eess.AScs.AIcs.MMarXiv:2502.06490v42025
  56. A Framework for Human Evaluation of Large Language Models in Healthcare Derived from Literature Review

    Thomas Yu Chow Tam, Sonish Sivarajkumar, Sumit Kapoor +12

    cs.CLcs.AIarXiv:2405.02559v22024
  57. SIoU Loss: More Powerful Learning for Bounding Box Regression

    Zhora Gevorgyan

    cs.CVcs.AIarXiv:2205.12740v12022
  58. DRIFT: Dynamic Rule-Based Defense with Injection Isolation for Securing LLM Agents

    Hao Li, Xiaogeng Liu, Hung-Chun Chiu +3

    cs.CRcs.AIarXiv:2506.12104v32025
  59. Ethical and social risks of harm from Language Models

    Laura Weidinger, John Mellor, Maribeth Rauh +20

    cs.CLcs.AIcs.CYarXiv:2112.04359v12021
  60. RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents

    Zijing Zhang, Ziyang Chen, Mingxiao Li +2

    cs.LGcs.AIarXiv:2507.22844v12025