Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,361 to 12,420 of 15,247

  1. Marco DeepResearch: Unlocking Efficient Deep Research Agents via Verification-Centric Design

    Bin Zhu, Qianghuai Jia, Tian Lan +6

    cs.CLcs.AIarXiv:2603.28376v12026
  2. Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory

    Haozhen Zhang, Haodong Yue, Tao Feng +8

    cs.CLcs.AIcs.LGarXiv:2602.06025v32026
  3. daVinci-Dev: Agent-native Mid-training for Software Engineering

    Ji Zeng, Dayuan Fu, Tiantian Mi +14

    cs.SEcs.AIarXiv:2601.18418v22026
  4. GLIGEN: Open-Set Grounded Text-to-Image Generation

    Yuheng Li, Haotian Liu, Qingyang Wu +5

    cs.CVcs.AIcs.CLarXiv:2301.07093v22023
  5. Illuminating search spaces by mapping elites

    Jean-Baptiste Mouret, Jeff Clune

    cs.AIcs.NEcs.ROarXiv:1504.04909v12015
  6. Discovering Language Model Behaviors with Model-Written Evaluations

    Ethan Perez, Sam Ringer, Kamilė Lukošiūtė +60

    cs.CLcs.AIcs.LGarXiv:2212.09251v12022
  7. Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Training

    Yixin Liu, Yue Yu, DiJia Su +7

    cs.AIcs.CLcs.LGarXiv:2603.12246v12026
  8. Good SFT Optimizes for SFT, Better SFT Prepares for Reinforcement Learning

    Dylan Zhang, Yufeng Xu, Haojin Wang +2

    cs.LGcs.AIcs.CLarXiv:2602.01058v22026
  9. GlimpRouter: Efficient Collaborative Inference by Glimpsing One Token of Thoughts

    Wenhao Zeng, Xuteng Zhang, Yuling Shi +4

    cs.AIarXiv:2601.05110v32026
  10. Experiential Reinforcement Learning

    Taiwei Shi, Sihao Chen, Bowen Jiang +3

    cs.LGcs.AIarXiv:2602.13949v12026
  11. What Matters in Learning from Offline Human Demonstrations for Robot Manipulation

    Ajay Mandlekar, Danfei Xu, Josiah Wong +7

    cs.ROcs.AIcs.LGarXiv:2108.03298v22021
  12. Budget-Constrained Agentic Large Language Models: Intention-Based Planning for Costly Tool Use

    Hanbing Liu, Chunhao Tian, Nan An +4

    cs.AIcs.LGarXiv:2602.11541v12026
  13. HISA: Efficient Hierarchical Indexing for Fine-Grained Sparse Attention

    Yufei Xu, Fanxu Meng, Fan Jiang +11

    cs.LGcs.AIarXiv:2603.28458v32026
  14. DLLM-Searcher: Adapting Diffusion Large Language Model for Search Agents

    Jiahao Zhao, Shaoxuan Xu, Zhongxiang Sun +6

    cs.AIcs.LGarXiv:2602.07035v12026
  15. Thinking in Uncertainty: Mitigating Hallucinations in MLRMs with Latent Entropy-Aware Decoding

    Zhongxing Xu, Zhonghua Wang, Zhe Qian +10

    cs.CVcs.AIarXiv:2603.13366v12026
  16. Semantic Search over 9 Million Mathematical Theorems

    Luke Alexander, Eric Leonen, Sophie Szeto +5

    cs.IRcs.AImath.HOarXiv:2602.05216v22026
  17. Visual Generation Unlocks Human-Like Reasoning through Multimodal World Models

    Jialong Wu, Xiaoying Zhang, Hongyi Yuan +7

    cs.AIarXiv:2601.19834v12026
  18. FlashPrefill: Instantaneous Pattern Discovery and Thresholding for Ultra-Fast Long-Context Prefilling

    Qihang Fan, Huaibo Huang, Zhiying Wu +3

    cs.CLcs.AIarXiv:2603.06199v12026
  19. Mano: Restriking Manifold Optimization for LLM Training

    Yufei Gu, Zeke Xie

    cs.LGcs.AIarXiv:2601.23000v12026
  20. Sim-to-Real: Learning Agile Locomotion For Quadruped Robots

    Jie Tan, Tingnan Zhang, Erwin Coumans +5

    cs.ROcs.AIarXiv:1804.10332v22018
  21. Sparsity in Deep Learning: Pruning and growth for efficient inference and training in neural networks

    Torsten Hoefler, Dan Alistarh, Tal Ben-Nun +2

    cs.LGcs.AIcs.ARarXiv:2102.00554v12021
  22. $τ$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains

    Shunyu Yao, Noah Shinn, Pedram Razavi +1

    cs.AIcs.CLarXiv:2406.12045v12024
  23. Educational data mining and learning analytics: An updated survey

    C. Romero, S. Ventura

    cs.HCcs.AIarXiv:2402.07956v12024
  24. Does the Whole Exceed its Parts? The Effect of AI Explanations on Complementary Team Performance

    Gagan Bansal, Tongshuang Wu, Joyce Zhou +5

    cs.AIcs.CLcs.HCarXiv:2006.14779v32020
  25. Training Diffusion Models with Reinforcement Learning

    Kevin Black, Michael Janner, Yilun Du +2

    cs.LGcs.AIcs.CVarXiv:2305.13301v42023
  26. Deep Predictive Coding Networks for Video Prediction and Unsupervised Learning

    William Lotter, Gabriel Kreiman, David Cox

    cs.LGcs.AIcs.CVarXiv:1605.08104v52016
  27. Deep, Convolutional, and Recurrent Models for Human Activity Recognition using Wearables

    Nils Y. Hammerla, Shane Halloran, Thomas Ploetz

    cs.LGcs.AIcs.HCarXiv:1604.08880v12016
  28. According to Me: Long-Term Personalized Referential Memory QA

    Jingbiao Mei, Jinghong Chen, Guangyu Yang +3

    cs.AIcs.CLcs.CVarXiv:2603.01990v12026
  29. Effect of Confidence and Explanation on Accuracy and Trust Calibration in AI-Assisted Decision Making

    Yunfeng Zhang, Q. Vera Liao, Rachel K. E. Bellamy

    cs.AIcs.HCarXiv:2001.02114v12020
  30. From Narrow to Panoramic Vision: Attention-Guided Cold-Start Reshapes Multimodal Reasoning

    Ruilin Luo, Chufan Shi, Yizhen Zhang +10

    cs.CVcs.AIarXiv:2603.03825v12026
  31. Physical Simulator In-the-Loop Video Generation

    Lin Geng Foo, Mark He Huang, Alexandros Lattas +3

    cs.CVcs.AIcs.GRarXiv:2603.06408v12026
  32. Photographic Image Synthesis with Cascaded Refinement Networks

    Qifeng Chen, Vladlen Koltun

    cs.CVcs.AIcs.GRarXiv:1707.09405v12017
  33. A Survey of Data Augmentation Approaches for NLP

    Steven Y. Feng, Varun Gangal, Jason Wei +4

    cs.CLcs.AIcs.LGarXiv:2105.03075v52021
  34. HY3D-Bench: Generation of 3D Assets

    Team Hunyuan3D, :, Bowen Zhang +22

    cs.CVcs.AIarXiv:2602.03907v12026
  35. A Simple Baseline for Bayesian Uncertainty in Deep Learning

    Wesley Maddox, Timur Garipov, Pavel Izmailov +2

    cs.LGcs.AIcs.CVarXiv:1902.02476v22019
  36. WebWorld: A Large-Scale World Model for Web Agent Training

    Zikai Xiao, Jianhong Tu, Chuhang Zou +7

    cs.AIarXiv:2602.14721v12026
  37. Questioning the AI: Informing Design Practices for Explainable AI User Experiences

    Q. Vera Liao, Daniel Gruen, Sarah Miller

    cs.HCcs.AIcs.LGarXiv:2001.02478v32020
  38. Safe Reinforcement Learning via Shielding

    Mohammed Alshiekh, Roderick Bloem, Ruediger Ehlers +3

    cs.LOcs.AIcs.LGarXiv:1708.08611v22017
  39. Agentic Uncertainty Quantification

    Jiaxin Zhang, Prafulla Kumar Choubey, Kung-Hsiang Huang +2

    cs.AIcs.CLarXiv:2601.15703v12026
  40. RLBench: The Robot Learning Benchmark & Learning Environment

    Stephen James, Zicong Ma, David Rovick Arrojo +1

    cs.ROcs.AIcs.CVarXiv:1909.12271v12019
  41. Firefly Algorithm: Recent Advances and Applications

    Xin-She Yang, Xingshi He

    math.OCcs.AIarXiv:1308.3898v12013
  42. Safety Verification of Deep Neural Networks

    Xiaowei Huang, Marta Kwiatkowska, Sen Wang +1

    cs.AIcs.LGstat.MLarXiv:1610.06940v32016
  43. RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System

    Yinjie Wang, Tianbao Xie, Ke Shen +2

    cs.LGcs.AIcs.CLarXiv:2602.02488v12026
  44. Deep Big Simple Neural Nets Excel on Handwritten Digit Recognition

    Dan Claudiu Ciresan, Ueli Meier, Luca Maria Gambardella +1

    cs.NEcs.AIarXiv:1003.0358v12010
  45. Autonomous Agents Coordinating Distributed Discovery Through Emergent Artifact Exchange

    Fiona Y. Wang, Lee Marom, Subhadeep Pal +4

    cs.AIcond-mat.dis-nncs.LGarXiv:2603.14312v12026
  46. Efficient Low-rank Multimodal Fusion with Modality-Specific Factors

    Zhun Liu, Ying Shen, Varun Bharadhwaj Lakshminarasimhan +3

    cs.AIcs.LGstat.MLarXiv:1806.00064v12018
  47. CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models

    Nikita Nangia, Clara Vania, Rasika Bhalerao +1

    cs.CLcs.AIarXiv:2010.00133v12020
  48. Meta-Learning with Implicit Gradients

    Aravind Rajeswaran, Chelsea Finn, Sham Kakade +1

    cs.LGcs.AImath.OCarXiv:1909.04630v12019
  49. Learning to Continually Learn via Meta-learning Agentic Memory Designs

    Yiming Xiong, Shengran Hu, Jeff Clune

    cs.AIarXiv:2602.07755v12026
  50. ProRL Agent: Rollout-as-a-Service for RL Training of Multi-Turn LLM Agents

    Hao Zhang, Mingjie Liu, Shaokun Zhang +10

    cs.AIarXiv:2603.18815v12026
  51. Emergence of Locomotion Behaviours in Rich Environments

    Nicolas Heess, Dhruva TB, Srinivasan Sriram +9

    cs.AIarXiv:1707.02286v22017
  52. LOCA-bench: Benchmarking Language Agents Under Controllable and Extreme Context Growth

    Weihao Zeng, Yuzhen Huang, Junxian He

    cs.AIarXiv:2602.07962v12026
  53. OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG

    Fengran Mo, Zhan Su, Yuchen Hui +6

    cs.CLcs.AIcs.IRarXiv:2601.09028v22026
  54. Memory Caching: RNNs with Growing Memory

    Ali Behrouz, Zeman Li, Yuan Deng +3

    cs.LGcs.AIarXiv:2602.24281v12026
  55. F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World

    Ziyin Zhang, Zihan Liao, Hang Yu +2

    cs.CLcs.AIarXiv:2603.19223v12026
  56. VTAM: Video-Tactile-Action Models for Complex Physical Interaction Beyond VLAs

    Haoran Yuan, Weigang Yi, Zhenyu Zhang +9

    cs.ROcs.AIcs.CVarXiv:2603.23481v12026
  57. Ignore Previous Prompt: Attack Techniques For Language Models

    Fábio Perez, Ian Ribeiro

    cs.CLcs.AIarXiv:2211.09527v12022
  58. Kitsune: An Ensemble of Autoencoders for Online Network Intrusion Detection

    Yisroel Mirsky, Tomer Doitshman, Yuval Elovici +1

    cs.CRcs.AIcs.LGarXiv:1802.09089v22018
  59. Scaling Embeddings Outperforms Scaling Experts in Language Models

    Hong Liu, Jiaqi Zhang, Chao Wang +13

    cs.CLcs.AIcs.LGarXiv:2601.21204v22026
  60. Effective Strategies for Asynchronous Software Engineering Agents

    Jiayi Geng, Graham Neubig

    cs.CLcs.AIarXiv:2603.21489v22026