Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,601 to 12,660 of 15,328

  1. Continuous Deep Q-Learning with Model-based Acceleration

    Shixiang Gu, Timothy Lillicrap, Ilya Sutskever +1

    cs.LGcs.AIcs.ROarXiv:1603.00748v12016
  2. Hyperagents

    Jenny Zhang, Bingchen Zhao, Wannan Yang +5

    cs.AIarXiv:2603.19461v12026
  3. How AI Impacts Skill Formation

    Judy Hanwen Shen, Alex Tamkin

    cs.CYcs.AIcs.HCarXiv:2601.20245v22026
  4. ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers

    Songyang Liu, Chaozhuo Li, Chenxu Wang +8

    cs.CRcs.AIarXiv:2603.24414v12026
  5. Toward Ultra-Long-Horizon Agentic Science: Cognitive Accumulation for Machine Learning Engineering

    Xinyu Zhu, Yuzhu Cai, Zexi Liu +8

    cs.AIarXiv:2601.10402v52026
  6. MuSiQue: Multihop Questions via Single-hop Question Composition

    Harsh Trivedi, Niranjan Balasubramanian, Tushar Khot +1

    cs.CLcs.AIarXiv:2108.00573v32021
  7. Anatomy of Agentic Memory: Taxonomy and Empirical Analysis of Evaluation and System Limitations

    Dongming Jiang, Yi Li, Songtao Wei +8

    cs.CLcs.AIarXiv:2602.19320v22026
  8. VIBEVOICE-ASR Technical Report

    Zhiliang Peng, Jianwei Yu, Yaoyao Chang +21

    cs.SDcs.AIeess.ASarXiv:2601.18184v22026
  9. Large Language Model Reasoning Failures

    Peiyang Song, Pengrui Han, Noah Goodman

    cs.AIcs.CLcs.LGarXiv:2602.06176v12026
  10. OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning

    Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins +10

    cs.AIcs.CLcs.IRarXiv:2603.08655v12026
  11. QTRAN: Learning to Factorize with Transformation for Cooperative Multi-Agent Reinforcement Learning

    Kyunghwan Son, Daewoo Kim, Wan Ju Kang +2

    cs.LGcs.AIcs.MAarXiv:1905.05408v12019
  12. Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

    Ailin Huang, Ang Li, Aobo Kong +213

    cs.CLcs.AIarXiv:2602.10604v22026
  13. OmniGAIA: Towards Native Omni-Modal AI Agents

    Xiaoxi Li, Wenxiang Jiao, Jiarui Jin +10

    cs.AIcs.CLcs.CVarXiv:2602.22897v32026
  14. AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration

    Jianhao Ruan, Zhihao Xu, Yiran Peng +9

    cs.AIcs.CLarXiv:2602.03786v22026
  15. DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints

    Yinger Zhang, Shutong Jiang, Renhao Li +6

    cs.AIcs.CLarXiv:2601.18137v12026
  16. HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding

    Haowei Zhang, Shudong Yang, Jinlan Fu +2

    cs.CVcs.AIcs.CLarXiv:2601.14724v42026
  17. AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security

    Dongrui Liu, Qihan Ren, Chen Qian +40

    cs.AIcs.CCcs.CLarXiv:2601.18491v22026
  18. Dr. Zero: Self-Evolving Search Agents without Training Data

    Zhenrui Yue, Kartikeya Upasani, Xianjun Yang +5

    cs.AIarXiv:2601.07055v22026
  19. Rethinking Video Generation Model for the Embodied World

    Yufan Deng, Zilin Pan, Hongyu Zhang +6

    cs.CVcs.AIcs.ROarXiv:2601.15282v12026
  20. AIDev: Studying AI Coding Agents on GitHub

    Hao Li, Haoxiang Zhang, Ahmed E. Hassan

    cs.SEcs.AIarXiv:2602.09185v12026
  21. AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations

    Minjun Zhu, Zhen Lin, Yixuan Weng +6

    cs.AIcs.CLcs.CVarXiv:2602.03828v22026
  22. Revisiting the Platonic Representation Hypothesis: An Aristotelian View

    Fabian Gröger, Shuo Wen, Maria Brbić

    cs.LGcs.AIcs.CVarXiv:2602.14486v22026
  23. A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models

    Wenqi Fan, Yujuan Ding, Liangbo Ning +5

    cs.CLcs.AIcs.IRarXiv:2405.06211v32024
  24. CUA-Skill: Develop Skills for Computer Using Agent

    Tianyi Chen, Yinheng Li, Michael Solodko +12

    cs.AIarXiv:2601.21123v22026
  25. Kernels for Vector-Valued Functions: a Review

    Mauricio A. Alvarez, Lorenzo Rosasco, Neil D. Lawrence

    stat.MLcs.AImath.STarXiv:1106.6251v22011
  26. MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification

    MiroMind Team, S. Bai, L. Bing +41

    cs.CLcs.AIcs.IRarXiv:2603.15726v12026
  27. UI-Venus-1.5 Technical Report

    Venus Team, Changlong Gao, Zhangxuan Gu +24

    cs.CVcs.AIcs.CLarXiv:2602.09082v22026
  28. Infinite-World: Scaling Interactive World Models to 1000-Frame Horizons via Pose-Free Hierarchical Memory

    Ruiqi Wu, Xuanhua He, Meng Cheng +8

    cs.CVcs.AIarXiv:2602.02393v22026
  29. TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics

    Shirui Chen, Cole Harrison, Ying-Chun Lee +6

    cs.ROcs.AIcs.LGarXiv:2602.19313v22026
  30. Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs

    Haoming Meng, Kexin Huang, Shaohang Wei +6

    cs.CLcs.AIcs.LGarXiv:2603.22446v12026
  31. FeUdal Networks for Hierarchical Reinforcement Learning

    Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul +4

    cs.AIarXiv:1703.01161v22017
  32. Selective Classification for Deep Neural Networks

    Yonatan Geifman, Ran El-Yaniv

    cs.LGcs.AIarXiv:1705.08500v22017
  33. A General Theoretical Paradigm to Understand Learning from Human Preferences

    Mohammad Gheshlaghi Azar, Mark Rowland, Bilal Piot +4

    cs.AIcs.LGstat.MLarXiv:2310.12036v22023
  34. Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation

    Yuval Kirstain, Adam Polyak, Uriel Singer +3

    cs.CVcs.AIarXiv:2305.01569v22023
  35. Deep Kernel Learning

    Andrew Gordon Wilson, Zhiting Hu, Ruslan Salakhutdinov +1

    cs.LGcs.AIstat.MEarXiv:1511.02222v12015
  36. Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond

    Jingfeng Yang, Hongye Jin, Ruixiang Tang +5

    cs.CLcs.AIcs.LGarXiv:2304.13712v22023
  37. Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations

    Peiyi Wang, Lei Li, Zhihong Shao +6

    cs.AIcs.CLcs.LGarXiv:2312.08935v32023
  38. Feature Hashing for Large Scale Multitask Learning

    Kilian Weinberger, Anirban Dasgupta, Josh Attenberg +2

    cs.AIarXiv:0902.2206v52009
  39. Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning

    Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1

    cs.LGcs.AIcs.ROarXiv:1708.02596v22017
  40. EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience

    Taofeng Xue, Chong Peng, Mianqiu Huang +13

    cs.AIarXiv:2601.15876v22026
  41. Spatial-Temporal Fusion Graph Neural Networks for Traffic Flow Forecasting

    Mengzhang Li, Zhanxing Zhu

    cs.LGcs.AIarXiv:2012.09641v22020
  42. OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data

    Yuwen Du, Rui Ye, Shuo Tang +4

    cs.AIcs.CLarXiv:2603.15594v12026
  43. Learning to reinforcement learn

    Jane X Wang, Zeb Kurth-Nelson, Dhruva Tirumala +6

    cs.LGcs.AIstat.MLarXiv:1611.05763v32016
  44. Interactive Attention Networks for Aspect-Level Sentiment Classification

    Dehong Ma, Sujian Li, Xiaodong Zhang +1

    cs.AIcs.CLarXiv:1709.00893v12017
  45. A Survey on Large Language Models for Code Generation

    Juyong Jiang, Fan Wang, Jiasi Shen +2

    cs.CLcs.AIcs.SEarXiv:2406.00515v22024
  46. Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance

    Yiqi Lin, Guoqiang Liang, Ziyun Zeng +3

    cs.CVcs.AIarXiv:2603.02175v42026
  47. Men Also Like Shopping: Reducing Gender Bias Amplification using Corpus-level Constraints

    Jieyu Zhao, Tianlu Wang, Mark Yatskar +2

    cs.AIcs.CLcs.CVarXiv:1707.09457v12017
  48. REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents

    Zheng Chu, Xiao Wang, Jack Hong +11

    cs.AIcs.CLarXiv:2602.14234v12026
  49. Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

    Lai Wei, Liangbo He, Jun Lan +9

    cs.CVcs.AIcs.CLarXiv:2602.11858v22026
  50. Hindsight Credit Assignment for Long-Horizon LLM Agents

    Hui-Ze Tan, Xiao-Wen Yang, Hao Chen +7

    cs.LGcs.AIarXiv:2603.08754v12026
    Summaries:简体中文
  51. Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning

    Zhaoyang Wang, Canwen Xu, Boyi Liu +5

    cs.AIcs.CLcs.LGarXiv:2602.10090v32026
  52. RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation

    Sunzhu Li, Jiale Zhao, Miteto Wei +6

    cs.AIarXiv:2601.08430v22026
  53. Large Language Model based Multi-Agents: A Survey of Progress and Challenges

    Taicheng Guo, Xiuying Chen, Yaqi Wang +5

    cs.CLcs.AIcs.MAarXiv:2402.01680v22024
  54. Pre-Trained Models: Past, Present and Future

    Xu Han, Zhengyan Zhang, Ning Ding +21

    cs.AIcs.CLarXiv:2106.07139v32021
  55. Vision-DeepResearch: Incentivizing DeepResearch Capability in Multimodal Large Language Models

    Wenxuan Huang, Yu Zeng, Qiuchen Wang +14

    cs.CVcs.AIarXiv:2601.22060v32026
  56. TS2Vec: Towards Universal Representation of Time Series

    Zhihan Yue, Yujing Wang, Juanyong Duan +4

    cs.LGcs.AIarXiv:2106.10466v42021
  57. RoboMME: Benchmarking and Understanding Memory for Robotic Generalist Policies

    Yinpei Dai, Hongze Fu, Jayjun Lee +6

    cs.ROcs.AIarXiv:2603.04639v32026
  58. Natural-Language Agent Harnesses

    Linyue Pan, Lexiao Zou, Shuo Guo +2

    cs.CLcs.AIarXiv:2603.25723v22026
  59. Kimi K2.5: Visual Agentic Intelligence

    Kimi Team, Tongtong Bai, Yifan Bai +334

    cs.CLcs.AIcs.LGarXiv:2602.02276v22026
    Summaries:한국어
  60. Revisiting On-Policy Distillation: Empirical Failure Modes and Simple Fixes

    Yuqian Fu, Haohuan Huang, Kaiwen Jiang +4

    cs.LGcs.AIcs.CLarXiv:2603.25562v22026