Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,721 to 3,780 of 15,437
Active Context Compression: Autonomous Memory Management in LLM Agents
Nikhil Verma
cs.AIarXiv:2601.07190v12026Graph-based Agent Memory: Taxonomy, Techniques, and Applications
Chang Yang, Chuang Zhou, Yilin Xiao +15
cs.AIarXiv:2602.05665v12026Real Money, Fake Models: Deceptive Model Claims in Shadow APIs
Yage Zhang, Yukun Jiang, Zeyuan Chen +3
cs.CRcs.AIcs.SEarXiv:2603.01919v22026SWE-bench Goes Live!
Linghao Zhang, Shilin He, Chaoyun Zhang +12
cs.SEcs.AIcs.CLarXiv:2505.23419v22025PALR: Personalization Aware LLMs for Recommendation
Fan Yang, Zheng Chen, Ziyan Jiang +3
cs.IRcs.AIcs.CLarXiv:2305.07622v32023Exploring Silicon-Based Societies: An Early Study of the Moltbook Agent Community
Yu-Zheng Lin, Bono Po-Jen Shih, Hsuan-Ying Alessandra Chien +6
cs.MAcs.AIcs.CYarXiv:2602.02613v42026Quantizable Transformers: Removing Outliers by Helping Attention Heads Do Nothing
Yelysei Bondarenko, Markus Nagel, Tijmen Blankevoort
cs.LGcs.AIcs.CLarXiv:2306.12929v22023Collider-Bench: Benchmarking AI Agents with Particle Physics Analysis Reproduction
Darius A. Faroughy, Sofia Palacios Schweitzer, Ian Pang +2
cs.LGcs.AIhep-exarXiv:2605.13950v12026Large-scale online deanonymization with LLMs
Simon Lermen, Daniel Paleka, Joshua Swanson +3
cs.CRcs.AIcs.LGarXiv:2602.16800v22026StructMem: Structured Memory for Long-Horizon Behavior in LLMs
Buqiang Xu, Yijun Chen, Jizhan Fang +5
cs.CLcs.AIcs.IRarXiv:2604.21748v12026Enhancing SAE-based Steering via Neighbor Integrated Feature Selection
Yutian Liu, Xu Wang, Difan Zou
cs.AIarXiv:2608.28806v12026Compound Deception in Elite Peer Review: A Failure Mode Taxonomy of 100 Fabricated Citations at NeurIPS 2025
Samar Ansari
cs.DLcs.AIarXiv:2602.05930v12026DexterityGen: Foundation Controller for Unprecedented Dexterity
Zhao-Heng Yin, Changhao Wang, Luis Pineda +11
cs.ROcs.AIcs.LGarXiv:2502.04307v12025MathScale: Scaling Instruction Tuning for Mathematical Reasoning
Zhengyang Tang, Xingxing Zhang, Benyou Wang +1
cs.CLcs.AIcs.LGarXiv:2403.02884v12024One-Class Adversarial Nets for Fraud Detection
Panpan Zheng, Shuhan Yuan, Xintao Wu +2
cs.LGcs.AIcs.CRarXiv:1803.01798v22018MatCha: Enhancing Visual Language Pretraining with Math Reasoning and Chart Derendering
Fangyu Liu, Francesco Piccinno, Syrine Krichene +6
cs.CLcs.AIcs.CVarXiv:2212.09662v22022When MOE Meets LLMs: Parameter Efficient Fine-tuning for Multi-task Medical Applications
Qidong Liu, Xian Wu, Xiangyu Zhao +4
cs.CLcs.AIarXiv:2310.18339v22023One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing
Adheesh Sunil Juvekar, Onkar Kishor Susladkar, Kiet A. Nguyen +6
cs.CVcs.AIarXiv:2609.04190v12026This human study did not involve human subjects: Validating LLM simulations as behavioral evidence
Jessica Hullman, David Broska, Huaman Sun +1
cs.AIarXiv:2602.15785v12026On the Plasticity Collapse in Continual Machine Unlearning
Yingdan Shi, Xiang Xu, Kaize Ding +2
cs.LGcs.AIarXiv:2608.29513v12026Consistent feature attribution for tree ensembles
Scott M. Lundberg, Su-In Lee
cs.AIcs.LGstat.MLarXiv:1706.06060v62017Multi-Scale Representation Learning for Spatial Feature Distributions using Grid Cells
Gengchen Mai, Krzysztof Janowicz, Bo Yan +3
cs.CVcs.AIcs.LGarXiv:2003.00824v12020Balance of Benchmarks: Semantic Density Reweighting for Benchmark Multiplicity and Task-Conditioned Evaluation
Jhen-Ke Lin
cs.AIcs.CLcs.LGarXiv:2608.30044v12026BetterV: Controlled Verilog Generation with Discriminative Guidance
Zehua Pei, Hui-Ling Zhen, Mingxuan Yuan +2
cs.AIcs.PLarXiv:2402.03375v32024Tweet2Vec: Learning Tweet Embeddings Using Character-level CNN-LSTM Encoder-Decoder
Soroush Vosoughi, Prashanth Vijayaraghavan, Deb Roy
cs.CLcs.AIcs.NEarXiv:1607.07514v12016When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation
Mubashara Akhtar, Anka Reuel, Prajna Soni +34
cs.AIarXiv:2602.16763v42026Empirical Study of Off-Policy Policy Evaluation for Reinforcement Learning
Cameron Voloshin, Hoang M. Le, Nan Jiang +1
cs.LGcs.AIcs.ROarXiv:1911.06854v32019Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization
Xiang Fang, Wanlong Fang, Changshuo Wang
cs.CVcs.AIarXiv:2605.26501v12026LingoQA: Visual Question Answering for Autonomous Driving
Ana-Maria Marcu, Long Chen, Jan Hünermann +9
cs.ROcs.AIcs.CVarXiv:2312.14115v42023Hybrid Offline-Online Multi-Agent Decision Transformers for Wireless Resource Management
Yiming Zhang, Kun Yang, Cong Shen +1
eess.SYcs.AIarXiv:2608.28878v12026Adaptive Memory Admission Control for LLM Agents
Guilin Zhang, Wei Jiang, Xiejiashan Wang +5
cs.AIcs.CLcs.MAarXiv:2603.04549v12026AgentTrace: A Structured Logging Framework for Agent System Observability
Adam AlSayyad, Kelvin Yuxiang Huang, Richik Pal
cs.SEcs.AIarXiv:2602.10133v12026RoboPhys-3D: A Comprehensive Embodied World Model Evaluation via 3D Reconstruction
Tianyi Wang, Jiazhou Chen, Yiming Xu +7
cs.ROcs.AIcs.CVarXiv:2608.28718v12026Automated Researchers Can Mitigate Well-characterized Alignment Failures
Chen Yueh-Han, Jiaxin Wen, Jan Hendrik Kirchner
cs.AIcs.CLarXiv:2608.28945v32026On the Impact of AGENTS.md Files on the Efficiency of AI Coding Agents
Jai Lal Lulla, Seyedmoein Mohsenimofidi, Matthias Galster +3
cs.SEcs.AIcs.ETarXiv:2601.20404v22026ClinFusion: A Vision-Centric Multimodal LLM System for Holistic Medical Understanding
Hangjie Yuan, Yichen Qian, Zhiwei Tang +21
cs.CVcs.AIcs.CLarXiv:2607.24743v22026An AI system to help scientists write expert-level empirical software
Eser Aygün, Anastasiya Belyaeva, Gheorghe Comanici +39
cs.AIq-bio.QMarXiv:2509.06503v32025Convergence Theory of Knowledge Distillation in Asynchronous P2P Gossip Learning Network
Lucas Qingyang Fang, Tiyao Liu, Jinhao Jing +4
cs.LGcs.AIarXiv:2609.01952v12026Agent-Sentry: Bounding LLM Agents via Execution Provenance
Rohan Sequeira, Stavros Damianakis, Umar Iqbal +1
cs.CRcs.AIarXiv:2603.22868v22026Extracting books from production language models
Ahmed Ahmed, A. Feder Cooper, Sanmi Koyejo +1
cs.CLcs.AIcs.LGarXiv:2601.02671v12026Public-Sharing Labels and Verbatim Field Egress in an MCP-to-A2A Agent Configuration: A Controlled Multi-Model Study
Arpan Kumar Mahapatra
cs.CRcs.AIarXiv:2609.01693v12026Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection
Lixing Lin, Juli You, Yue Li +4
cs.CRcs.AIarXiv:2605.24834v12026Danus: Orchestrating Mathematical Reasoning Agents with Fact-Graph Memory
Jihao Liu, Guoxiong Gao, Zeming Sun +8
cs.AIcs.CLcs.MAarXiv:2607.06447v22026Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training
Yangyi Fang, Jiaye Lin, Xiaoliang Fu +4
cs.AIarXiv:2602.19225v12026Zeta-Lite: A Concurrent, Branchable In-Browser SQL Database for Agentic Memory
Gene Zhang
cs.DBcs.AIarXiv:2609.01818v12026Solver-Aided Verification of Policy Compliance in Tool-Augmented LLM Agents
Cailin Winston, Claris Winston, René Just
cs.SEcs.AIarXiv:2603.20449v12026Flow caching for autoregressive video generation
Yuexiao Ma, Xuzhe Zheng, Jing Xu +9
cs.CVcs.AIarXiv:2602.10825v12026Dictionary-Guided Mutation Operators for Automated HDL Repair
Maisha Mastora, Dean Sullivan
cs.ETcs.AIcs.ARarXiv:2609.01775v12026The Memory Curse: How Expanded Recall Erodes Cooperative Intent in LLM Agents
Jiayuan Liu, Tianqin Li, Shiyi Du +7
cs.CLcs.AIcs.GTarXiv:2605.08060v12026Epistemic Sybil Resistance: Multiplying AI Agents Without Multiplying Evidence
Marc Bara
cs.AIcs.MAarXiv:2609.01873v12026Computational Hermeneutics: Evaluating generative AI as a cultural technology
Cody Kommers, Ruth Ahnert, Maria Antoniak +35
cs.AIcs.CYarXiv:2604.16403v12026The Memory Trust Gap: Capability-Dependent Failures in Persistent-Memory Agents
Jundong Hu, Shekar Ramachandran
cs.AIcs.CLarXiv:2609.01852v12026Atomix: Timely, Transactional Tool Use for Reliable Agentic Workflows
Bardia Mohammadi, Nearchos Potamitis, Lars Klein +2
cs.LGcs.AIcs.DCarXiv:2602.14849v22026When Does Information Sharing Improve Decentralized Discovery? Aggregation, Independent Rescue, and Equilibrium Selection
Yohei Nakajima
cs.AIcs.GTarXiv:2609.01814v12026How RLHF Amplifies Sycophancy
Itai Shapira, Gerdus Benade, Ariel D. Procaccia
cs.AIarXiv:2602.01002v12026MiroFlow: Towards High-Performance and Robust Open-Source Agent Framework for General Deep Research Tasks
Shiqian Su, Sen Xing, Xuan Dong +13
cs.AIarXiv:2602.22808v12026Diamond Maps: Efficient Reward Alignment via Stochastic Flow Maps
Peter Holderrieth, Douglas Chen, Luca Eyring +7
cs.LGcs.AIarXiv:2602.05993v32026The Orchestration of Multi-Agent Systems: Architectures, Protocols, and Enterprise Adoption
Apoorva Adimulam, Rajesh Gupta, Sumit Kumar
cs.MAcs.AIarXiv:2601.13671v12026LEDITS++: Limitless Image Editing using Text-to-Image Models
Manuel Brack, Felix Friedrich, Katharina Kornmeier +4
cs.CVcs.AIcs.HCarXiv:2311.16711v22023SIMAC: A Semantic-Driven Integrated Multimodal Sensing And Communication Framework
Yubo Peng, Luping Xiang, Kun Yang +3
cs.LGcs.AIeess.SParXiv:2503.08726v12025