Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

3,721 to 3,780 of 15,437

  1. Active Context Compression: Autonomous Memory Management in LLM Agents

    Nikhil Verma

    cs.AIarXiv:2601.07190v12026
  2. Graph-based Agent Memory: Taxonomy, Techniques, and Applications

    Chang Yang, Chuang Zhou, Yilin Xiao +15

    cs.AIarXiv:2602.05665v12026
  3. Real Money, Fake Models: Deceptive Model Claims in Shadow APIs

    Yage Zhang, Yukun Jiang, Zeyuan Chen +3

    cs.CRcs.AIcs.SEarXiv:2603.01919v22026
  4. SWE-bench Goes Live!

    Linghao Zhang, Shilin He, Chaoyun Zhang +12

    cs.SEcs.AIcs.CLarXiv:2505.23419v22025
  5. PALR: Personalization Aware LLMs for Recommendation

    Fan Yang, Zheng Chen, Ziyan Jiang +3

    cs.IRcs.AIcs.CLarXiv:2305.07622v32023
  6. Exploring Silicon-Based Societies: An Early Study of the Moltbook Agent Community

    Yu-Zheng Lin, Bono Po-Jen Shih, Hsuan-Ying Alessandra Chien +6

    cs.MAcs.AIcs.CYarXiv:2602.02613v42026
  7. Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing

    Yelysei Bondarenko, Markus Nagel, Tijmen Blankevoort

    cs.LGcs.AIcs.CLarXiv:2306.12929v22023
  8. Collider-Bench: Benchmarking AI Agents with Particle Physics Analysis Reproduction

    Darius A. Faroughy, Sofia Palacios Schweitzer, Ian Pang +2

    cs.LGcs.AIhep-exarXiv:2605.13950v12026
  9. Large-scale online deanonymization with LLMs

    Simon Lermen, Daniel Paleka, Joshua Swanson +3

    cs.CRcs.AIcs.LGarXiv:2602.16800v22026
  10. StructMem: Structured Memory for Long-Horizon Behavior in LLMs

    Buqiang Xu, Yijun Chen, Jizhan Fang +5

    cs.CLcs.AIcs.IRarXiv:2604.21748v12026
  11. Enhancing SAE-based Steering via Neighbor Integrated Feature Selection

    Yutian Liu, Xu Wang, Difan Zou

    cs.AIarXiv:2608.28806v12026
  12. Compound Deception in Elite Peer Review: A Failure Mode Taxonomy of 100 Fabricated Citations at NeurIPS 2025

    Samar Ansari

    cs.DLcs.AIarXiv:2602.05930v12026
  13. DexterityGen: Foundation Controller for Unprecedented Dexterity

    Zhao-Heng Yin, Changhao Wang, Luis Pineda +11

    cs.ROcs.AIcs.LGarXiv:2502.04307v12025
  14. MathScale: Scaling Instruction Tuning for Mathematical Reasoning

    Zhengyang Tang, Xingxing Zhang, Benyou Wang +1

    cs.CLcs.AIcs.LGarXiv:2403.02884v12024
  15. One-Class Adversarial Nets for Fraud Detection

    Panpan Zheng, Shuhan Yuan, Xintao Wu +2

    cs.LGcs.AIcs.CRarXiv:1803.01798v22018
  16. MatCha: Enhancing Visual Language Pretraining with Math Reasoning and Chart Derendering

    Fangyu Liu, Francesco Piccinno, Syrine Krichene +6

    cs.CLcs.AIcs.CVarXiv:2212.09662v22022
  17. When MOE Meets LLMs: Parameter Efficient Fine-tuning for Multi-task Medical Applications

    Qidong Liu, Xian Wu, Xiangyu Zhao +4

    cs.CLcs.AIarXiv:2310.18339v22023
  18. One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing

    Adheesh Sunil Juvekar, Onkar Kishor Susladkar, Kiet A. Nguyen +6

    cs.CVcs.AIarXiv:2609.04190v12026
  19. This human study did not involve human subjects: Validating LLM simulations as behavioral evidence

    Jessica Hullman, David Broska, Huaman Sun +1

    cs.AIarXiv:2602.15785v12026
  20. On the Plasticity Collapse in Continual Machine Unlearning

    Yingdan Shi, Xiang Xu, Kaize Ding +2

    cs.LGcs.AIarXiv:2608.29513v12026
  21. Consistent feature attribution for tree ensembles

    Scott M. Lundberg, Su-In Lee

    cs.AIcs.LGstat.MLarXiv:1706.06060v62017
  22. Multi-Scale Representation Learning for Spatial Feature Distributions using Grid Cells

    Gengchen Mai, Krzysztof Janowicz, Bo Yan +3

    cs.CVcs.AIcs.LGarXiv:2003.00824v12020
  23. Balance of Benchmarks: Semantic Density Reweighting for Benchmark Multiplicity and Task-Conditioned Evaluation

    Jhen-Ke Lin

    cs.AIcs.CLcs.LGarXiv:2608.30044v12026
  24. BetterV: Controlled Verilog Generation with Discriminative Guidance

    Zehua Pei, Hui-Ling Zhen, Mingxuan Yuan +2

    cs.AIcs.PLarXiv:2402.03375v32024
  25. Tweet2Vec: Learning Tweet Embeddings Using Character-level CNN-LSTM Encoder-Decoder

    Soroush Vosoughi, Prashanth Vijayaraghavan, Deb Roy

    cs.CLcs.AIcs.NEarXiv:1607.07514v12016
  26. When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation

    Mubashara Akhtar, Anka Reuel, Prajna Soni +34

    cs.AIarXiv:2602.16763v42026
  27. Empirical Study of Off-Policy Policy Evaluation for Reinforcement Learning

    Cameron Voloshin, Hoang M. Le, Nan Jiang +1

    cs.LGcs.AIcs.ROarXiv:1911.06854v32019
  28. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    Xiang Fang, Wanlong Fang, Changshuo Wang

    cs.CVcs.AIarXiv:2605.26501v12026
  29. LingoQA: Visual Question Answering for Autonomous Driving

    Ana-Maria Marcu, Long Chen, Jan Hünermann +9

    cs.ROcs.AIcs.CVarXiv:2312.14115v42023
  30. Hybrid Offline-Online Multi-Agent Decision Transformers for Wireless Resource Management

    Yiming Zhang, Kun Yang, Cong Shen +1

    eess.SYcs.AIarXiv:2608.28878v12026
  31. Adaptive Memory Admission Control for LLM Agents

    Guilin Zhang, Wei Jiang, Xiejiashan Wang +5

    cs.AIcs.CLcs.MAarXiv:2603.04549v12026
  32. AgentTrace: A Structured Logging Framework for Agent System Observability

    Adam AlSayyad, Kelvin Yuxiang Huang, Richik Pal

    cs.SEcs.AIarXiv:2602.10133v12026
  33. RoboPhys-3D: A Comprehensive Embodied World Model Evaluation via 3D Reconstruction

    Tianyi Wang, Jiazhou Chen, Yiming Xu +7

    cs.ROcs.AIcs.CVarXiv:2608.28718v12026
  34. Automated Researchers Can Mitigate Well-characterized Alignment Failures

    Chen Yueh-Han, Jiaxin Wen, Jan Hendrik Kirchner

    cs.AIcs.CLarXiv:2608.28945v32026
  35. On the Impact of AGENTS.md Files on the Efficiency of AI Coding Agents

    Jai Lal Lulla, Seyedmoein Mohsenimofidi, Matthias Galster +3

    cs.SEcs.AIcs.ETarXiv:2601.20404v22026
  36. ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding

    Hangjie Yuan, Yichen Qian, Zhiwei Tang +21

    cs.CVcs.AIcs.CLarXiv:2607.24743v22026
  37. An AI system to help scientists write expert-level empirical software

    Eser Aygün, Anastasiya Belyaeva, Gheorghe Comanici +39

    cs.AIq-bio.QMarXiv:2509.06503v32025
  38. Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning Network

    Lucas Qingyang Fang, Tiyao Liu, Jinhao Jing +4

    cs.LGcs.AIarXiv:2609.01952v12026
  39. Agent-Sentry: Bounding LLM Agents via Execution Provenance

    Rohan Sequeira, Stavros Damianakis, Umar Iqbal +1

    cs.CRcs.AIarXiv:2603.22868v22026
  40. Extracting books from production language models

    Ahmed Ahmed, A. Feder Cooper, Sanmi Koyejo +1

    cs.CLcs.AIcs.LGarXiv:2601.02671v12026
  41. Public-Sharing Labels and Verbatim Field Egress in an MCP-to-A2A Agent Configuration: A Controlled Multi-Model Study

    Arpan Kumar Mahapatra

    cs.CRcs.AIarXiv:2609.01693v12026
  42. Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection

    Lixing Lin, Juli You, Yue Li +4

    cs.CRcs.AIarXiv:2605.24834v12026
  43. Danus: Orchestrating Mathematical Reasoning Agents with Fact-Graph Memory

    Jihao Liu, Guoxiong Gao, Zeming Sun +8

    cs.AIcs.CLcs.MAarXiv:2607.06447v22026
  44. Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training

    Yangyi Fang, Jiaye Lin, Xiaoliang Fu +4

    cs.AIarXiv:2602.19225v12026
  45. Zeta-Lite: A Concurrent, Branchable In-Browser SQL Database for Agentic Memory

    Gene Zhang

    cs.DBcs.AIarXiv:2609.01818v12026
  46. Solver-Aided Verification of Policy Compliance in Tool-Augmented LLM Agents

    Cailin Winston, Claris Winston, René Just

    cs.SEcs.AIarXiv:2603.20449v12026
  47. Flow caching for autoregressive video generation

    Yuexiao Ma, Xuzhe Zheng, Jing Xu +9

    cs.CVcs.AIarXiv:2602.10825v12026
  48. Dictionary-Guided Mutation Operators for Automated HDL Repair

    Maisha Mastora, Dean Sullivan

    cs.ETcs.AIcs.ARarXiv:2609.01775v12026
  49. The Memory Curse: How Expanded Recall Erodes Cooperative Intent in LLM Agents

    Jiayuan Liu, Tianqin Li, Shiyi Du +7

    cs.CLcs.AIcs.GTarXiv:2605.08060v12026
  50. Epistemic Sybil Resistance: Multiplying AI Agents Without Multiplying Evidence

    Marc Bara

    cs.AIcs.MAarXiv:2609.01873v12026
  51. Computational Hermeneutics: Evaluating generative AI as a cultural technology

    Cody Kommers, Ruth Ahnert, Maria Antoniak +35

    cs.AIcs.CYarXiv:2604.16403v12026
  52. The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory Agents

    Jundong Hu, Shekar Ramachandran

    cs.AIcs.CLarXiv:2609.01852v12026
  53. Atomix: Timely, Transactional Tool Use for Reliable Agentic Workflows

    Bardia Mohammadi, Nearchos Potamitis, Lars Klein +2

    cs.LGcs.AIcs.DCarXiv:2602.14849v22026
  54. When Does Information Sharing Improve Decentralized Discovery? Aggregation, Independent Rescue, and Equilibrium Selection

    Yohei Nakajima

    cs.AIcs.GTarXiv:2609.01814v12026
  55. How RLHF Amplifies Sycophancy

    Itai Shapira, Gerdus Benade, Ariel D. Procaccia

    cs.AIarXiv:2602.01002v12026
  56. MiroFlow: Towards High-Performance and Robust Open-Source Agent Framework for General Deep Research Tasks

    Shiqian Su, Sen Xing, Xuan Dong +13

    cs.AIarXiv:2602.22808v12026
  57. Diamond Maps: Efficient Reward Alignment via Stochastic Flow Maps

    Peter Holderrieth, Douglas Chen, Luca Eyring +7

    cs.LGcs.AIarXiv:2602.05993v32026
  58. The Orchestration of Multi-Agent Systems: Architectures, Protocols, and Enterprise Adoption

    Apoorva Adimulam, Rajesh Gupta, Sumit Kumar

    cs.MAcs.AIarXiv:2601.13671v12026
  59. LEDITS++: Limitless Image Editing using Text-to-Image Models

    Manuel Brack, Felix Friedrich, Katharina Kornmeier +4

    cs.CVcs.AIcs.HCarXiv:2311.16711v22023
  60. SIMAC: A Semantic-Driven Integrated Multimodal Sensing And Communication Framework

    Yubo Peng, Luping Xiang, Kun Yang +3

    cs.LGcs.AIeess.SParXiv:2503.08726v12025