Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
12,361 to 12,420 of 15,247
Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design
Bin Zhu, Qianghuai Jia, Tian Lan +6
cs.CLcs.AIarXiv:2603.28376v12026Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory
Haozhen Zhang, Haodong Yue, Tao Feng +8
cs.CLcs.AIcs.LGarXiv:2602.06025v32026daVinci-Dev: Agent-native Mid-training for Software Engineering
Ji Zeng, Dayuan Fu, Tiantian Mi +14
cs.SEcs.AIarXiv:2601.18418v22026GLIGEN: Open-Set Grounded Text-to-Image Generation
Yuheng Li, Haotian Liu, Qingyang Wu +5
cs.CVcs.AIcs.CLarXiv:2301.07093v22023Illuminating search spaces by mapping elites
Jean-Baptiste Mouret, Jeff Clune
cs.AIcs.NEcs.ROarXiv:1504.04909v12015Discovering Language Model Behaviors with Model-Written Evaluations
Ethan Perez, Sam Ringer, Kamilė Lukošiūtė +60
cs.CLcs.AIcs.LGarXiv:2212.09251v12022Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Training
Yixin Liu, Yue Yu, DiJia Su +7
cs.AIcs.CLcs.LGarXiv:2603.12246v12026Good SFT Optimizes for SFT, Better SFT Prepares for Reinforcement Learning
Dylan Zhang, Yufeng Xu, Haojin Wang +2
cs.LGcs.AIcs.CLarXiv:2602.01058v22026GlimpRouter: Efficient Collaborative Inference by Glimpsing One Token of Thoughts
Wenhao Zeng, Xuteng Zhang, Yuling Shi +4
cs.AIarXiv:2601.05110v32026Experiential Reinforcement Learning
Taiwei Shi, Sihao Chen, Bowen Jiang +3
cs.LGcs.AIarXiv:2602.13949v12026What Matters in Learning from Offline Human Demonstrations for Robot Manipulation
Ajay Mandlekar, Danfei Xu, Josiah Wong +7
cs.ROcs.AIcs.LGarXiv:2108.03298v22021Budget-Constrained Agentic Large Language Models: Intention-Based Planning for Costly Tool Use
Hanbing Liu, Chunhao Tian, Nan An +4
cs.AIcs.LGarXiv:2602.11541v12026HISA: Efficient Hierarchical Indexing for Fine-Grained Sparse Attention
Yufei Xu, Fanxu Meng, Fan Jiang +11
cs.LGcs.AIarXiv:2603.28458v32026DLLM-Searcher: Adapting Diffusion Large Language Model for Search Agents
Jiahao Zhao, Shaoxuan Xu, Zhongxiang Sun +6
cs.AIcs.LGarXiv:2602.07035v12026Thinking in Uncertainty: Mitigating Hallucinations in MLRMs with Latent Entropy-Aware Decoding
Zhongxing Xu, Zhonghua Wang, Zhe Qian +10
cs.CVcs.AIarXiv:2603.13366v12026Semantic Search over 9 Million Mathematical Theorems
Luke Alexander, Eric Leonen, Sophie Szeto +5
cs.IRcs.AImath.HOarXiv:2602.05216v22026Visual Generation Unlocks Human-Like Reasoning through Multimodal World Models
Jialong Wu, Xiaoying Zhang, Hongyi Yuan +7
cs.AIarXiv:2601.19834v12026FlashPrefill: Instantaneous Pattern Discovery and Thresholding for Ultra-Fast Long-Context Prefilling
Qihang Fan, Huaibo Huang, Zhiying Wu +3
cs.CLcs.AIarXiv:2603.06199v12026Mano: Restriking Manifold Optimization for LLM Training
Yufei Gu, Zeke Xie
cs.LGcs.AIarXiv:2601.23000v12026Sim-to-Real: Learning Agile Locomotion For Quadruped Robots
Jie Tan, Tingnan Zhang, Erwin Coumans +5
cs.ROcs.AIarXiv:1804.10332v22018Sparsity in Deep Learning: Pruning and growth for efficient inference and training in neural networks
Torsten Hoefler, Dan Alistarh, Tal Ben-Nun +2
cs.LGcs.AIcs.ARarXiv:2102.00554v12021$τ$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains
Shunyu Yao, Noah Shinn, Pedram Razavi +1
cs.AIcs.CLarXiv:2406.12045v12024Educational data mining and learning analytics: An updated survey
C. Romero, S. Ventura
cs.HCcs.AIarXiv:2402.07956v12024Does the Whole Exceed its Parts? The Effect of AI Explanations on Complementary Team Performance
Gagan Bansal, Tongshuang Wu, Joyce Zhou +5
cs.AIcs.CLcs.HCarXiv:2006.14779v32020Training Diffusion Models with Reinforcement Learning
Kevin Black, Michael Janner, Yilun Du +2
cs.LGcs.AIcs.CVarXiv:2305.13301v42023Deep Predictive Coding Networks for Video Prediction and Unsupervised Learning
William Lotter, Gabriel Kreiman, David Cox
cs.LGcs.AIcs.CVarXiv:1605.08104v52016Deep, Convolutional, and Recurrent Models for Human Activity Recognition using Wearables
Nils Y. Hammerla, Shane Halloran, Thomas Ploetz
cs.LGcs.AIcs.HCarXiv:1604.08880v12016According to Me: Long-Term Personalized Referential Memory QA
Jingbiao Mei, Jinghong Chen, Guangyu Yang +3
cs.AIcs.CLcs.CVarXiv:2603.01990v12026Effect of Confidence and Explanation on Accuracy and Trust Calibration in AI-Assisted Decision Making
Yunfeng Zhang, Q. Vera Liao, Rachel K. E. Bellamy
cs.AIcs.HCarXiv:2001.02114v12020From Narrow to Panoramic Vision: Attention-Guided Cold-Start Reshapes Multimodal Reasoning
Ruilin Luo, Chufan Shi, Yizhen Zhang +10
cs.CVcs.AIarXiv:2603.03825v12026Physical Simulator In-the-Loop Video Generation
Lin Geng Foo, Mark He Huang, Alexandros Lattas +3
cs.CVcs.AIcs.GRarXiv:2603.06408v12026Photographic Image Synthesis with Cascaded Refinement Networks
Qifeng Chen, Vladlen Koltun
cs.CVcs.AIcs.GRarXiv:1707.09405v12017A Survey of Data Augmentation Approaches for NLP
Steven Y. Feng, Varun Gangal, Jason Wei +4
cs.CLcs.AIcs.LGarXiv:2105.03075v52021HY3D-Bench: Generation of 3D Assets
Team Hunyuan3D, :, Bowen Zhang +22
cs.CVcs.AIarXiv:2602.03907v12026A Simple Baseline for Bayesian Uncertainty in Deep Learning
Wesley Maddox, Timur Garipov, Pavel Izmailov +2
cs.LGcs.AIcs.CVarXiv:1902.02476v22019WebWorld: A Large-Scale World Model for Web Agent Training
Zikai Xiao, Jianhong Tu, Chuhang Zou +7
cs.AIarXiv:2602.14721v12026Questioning the AI: Informing Design Practices for Explainable AI User Experiences
Q. Vera Liao, Daniel Gruen, Sarah Miller
cs.HCcs.AIcs.LGarXiv:2001.02478v32020Safe Reinforcement Learning via Shielding
Mohammed Alshiekh, Roderick Bloem, Ruediger Ehlers +3
cs.LOcs.AIcs.LGarXiv:1708.08611v22017Agentic Uncertainty Quantification
Jiaxin Zhang, Prafulla Kumar Choubey, Kung-Hsiang Huang +2
cs.AIcs.CLarXiv:2601.15703v12026RLBench: The Robot Learning Benchmark & Learning Environment
Stephen James, Zicong Ma, David Rovick Arrojo +1
cs.ROcs.AIcs.CVarXiv:1909.12271v12019Firefly Algorithm: Recent Advances and Applications
Xin-She Yang, Xingshi He
math.OCcs.AIarXiv:1308.3898v12013Safety Verification of Deep Neural Networks
Xiaowei Huang, Marta Kwiatkowska, Sen Wang +1
cs.AIcs.LGstat.MLarXiv:1610.06940v32016RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
Yinjie Wang, Tianbao Xie, Ke Shen +2
cs.LGcs.AIcs.CLarXiv:2602.02488v12026Deep Big Simple Neural Nets Excel on Handwritten Digit Recognition
Dan Claudiu Ciresan, Ueli Meier, Luca Maria Gambardella +1
cs.NEcs.AIarXiv:1003.0358v12010Autonomous Agents Coordinating Distributed Discovery Through Emergent Artifact Exchange
Fiona Y. Wang, Lee Marom, Subhadeep Pal +4
cs.AIcond-mat.dis-nncs.LGarXiv:2603.14312v12026Efficient Low-rank Multimodal Fusion with Modality-Specific Factors
Zhun Liu, Ying Shen, Varun Bharadhwaj Lakshminarasimhan +3
cs.AIcs.LGstat.MLarXiv:1806.00064v12018CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models
Nikita Nangia, Clara Vania, Rasika Bhalerao +1
cs.CLcs.AIarXiv:2010.00133v12020Meta-Learning with Implicit Gradients
Aravind Rajeswaran, Chelsea Finn, Sham Kakade +1
cs.LGcs.AImath.OCarXiv:1909.04630v12019Learning to Continually Learn via Meta-learning Agentic Memory Designs
Yiming Xiong, Shengran Hu, Jeff Clune
cs.AIarXiv:2602.07755v12026ProRL Agent: Rollout-as-a-Service for RL Training of Multi-Turn LLM Agents
Hao Zhang, Mingjie Liu, Shaokun Zhang +10
cs.AIarXiv:2603.18815v12026Emergence of Locomotion Behaviours in Rich Environments
Nicolas Heess, Dhruva TB, Srinivasan Sriram +9
cs.AIarXiv:1707.02286v22017LOCA-bench: Benchmarking Language Agents Under Controllable and Extreme Context Growth
Weihao Zeng, Yuzhen Huang, Junxian He
cs.AIarXiv:2602.07962v12026OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG
Fengran Mo, Zhan Su, Yuchen Hui +6
cs.CLcs.AIcs.IRarXiv:2601.09028v22026Memory Caching: RNNs with Growing Memory
Ali Behrouz, Zeman Li, Yuan Deng +3
cs.LGcs.AIarXiv:2602.24281v12026F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World
Ziyin Zhang, Zihan Liao, Hang Yu +2
cs.CLcs.AIarXiv:2603.19223v12026VTAM: Video-Tactile-Action Models for Complex Physical Interaction Beyond VLAs
Haoran Yuan, Weigang Yi, Zhenyu Zhang +9
cs.ROcs.AIcs.CVarXiv:2603.23481v12026Ignore Previous Prompt: Attack Techniques For Language Models
Fábio Perez, Ian Ribeiro
cs.CLcs.AIarXiv:2211.09527v12022Kitsune: An Ensemble of Autoencoders for Online Network Intrusion Detection
Yisroel Mirsky, Tomer Doitshman, Yuval Elovici +1
cs.CRcs.AIcs.LGarXiv:1802.09089v22018Scaling Embeddings Outperforms Scaling Experts in Language Models
Hong Liu, Jiaqi Zhang, Chao Wang +13
cs.CLcs.AIcs.LGarXiv:2601.21204v22026Effective Strategies for Asynchronous Software Engineering Agents
Jiayi Geng, Graham Neubig
cs.CLcs.AIarXiv:2603.21489v22026