Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,721 to 12,780 of 15,455

  1. FeatureBench: Benchmarking Agentic Coding for Complex Feature Development

    Qixing Zhou, Jiacheng Zhang, Haiyang Wang +9

    cs.SEcs.AIarXiv:2602.10975v12026
  2. LoL: Longer than Longer, Scaling Video Generation to Hour

    Justin Cui, Jie Wu, Ming Li +6

    cs.CVcs.AIarXiv:2601.16914v12026
  3. Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation

    Zhuolin Yang, Zihan Liu, Yang Chen +14

    cs.CLcs.AIcs.LGarXiv:2603.19220v22026
  4. $τ$-Knowledge: Evaluating Conversational Agents over Unstructured Knowledge

    Quan Shi, Alexandra Zytek, Pedram Razavi +2

    cs.AIcs.CLcs.IRarXiv:2603.04370v12026
  5. Reinforcement-aware Knowledge Distillation for LLM Reasoning

    Zhaoyang Zhang, Shuli Jiang, Yantao Shen +6

    cs.LGcs.AIarXiv:2602.22495v32026
  6. Rethinking the Trust Region in LLM Reinforcement Learning

    Penghui Qi, Xiangxin Zhou, Zichen Liu +4

    cs.LGcs.AIcs.CLarXiv:2602.04879v32026
  7. Scalable Power Sampling: Unlocking Efficient, Training-Free Reasoning for LLMs via Distribution Sharpening

    Xiaotong Ji, Rasul Tutunov, Matthieu Zimmer +1

    cs.LGcs.AIarXiv:2601.21590v12026
  8. Continuous Deep Q-Learning with Model-based Acceleration

    Shixiang Gu, Timothy Lillicrap, Ilya Sutskever +1

    cs.LGcs.AIcs.ROarXiv:1603.00748v12016
  9. Hyperagents

    Jenny Zhang, Bingchen Zhao, Wannan Yang +5

    cs.AIarXiv:2603.19461v12026
  10. How AI Impacts Skill Formation

    Judy Hanwen Shen, Alex Tamkin

    cs.CYcs.AIcs.HCarXiv:2601.20245v22026
  11. ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers

    Songyang Liu, Chaozhuo Li, Chenxu Wang +8

    cs.CRcs.AIarXiv:2603.24414v12026
  12. Toward Ultra-Long-Horizon Agentic Science: Cognitive Accumulation for Machine Learning Engineering

    Xinyu Zhu, Yuzhu Cai, Zexi Liu +8

    cs.AIarXiv:2601.10402v52026
  13. MuSiQue: Multihop Questions via Single-hop Question Composition

    Harsh Trivedi, Niranjan Balasubramanian, Tushar Khot +1

    cs.CLcs.AIarXiv:2108.00573v32021
  14. Anatomy of Agentic Memory: Taxonomy and Empirical Analysis of Evaluation and System Limitations

    Dongming Jiang, Yi Li, Songtao Wei +8

    cs.CLcs.AIarXiv:2602.19320v22026
  15. VIBEVOICE-ASR Technical Report

    Zhiliang Peng, Jianwei Yu, Yaoyao Chang +21

    cs.SDcs.AIeess.ASarXiv:2601.18184v22026
  16. Large Language Model Reasoning Failures

    Peiyang Song, Pengrui Han, Noah Goodman

    cs.AIcs.CLcs.LGarXiv:2602.06176v12026
  17. OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning

    Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins +10

    cs.AIcs.CLcs.IRarXiv:2603.08655v12026
  18. QTRAN: Learning to Factorize with Transformation for Cooperative Multi-Agent Reinforcement Learning

    Kyunghwan Son, Daewoo Kim, Wan Ju Kang +2

    cs.LGcs.AIcs.MAarXiv:1905.05408v12019
  19. Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters

    Ailin Huang, Ang Li, Aobo Kong +213

    cs.CLcs.AIarXiv:2602.10604v22026
  20. OmniGAIA: Towards Native Omni-Modal AI Agents

    Xiaoxi Li, Wenxiang Jiao, Jiarui Jin +10

    cs.AIcs.CLcs.CVarXiv:2602.22897v32026
  21. AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration

    Jianhao Ruan, Zhihao Xu, Yiran Peng +9

    cs.AIcs.CLarXiv:2602.03786v22026
  22. DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints

    Yinger Zhang, Shutong Jiang, Renhao Li +6

    cs.AIcs.CLarXiv:2601.18137v12026
  23. HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding

    Haowei Zhang, Shudong Yang, Jinlan Fu +2

    cs.CVcs.AIcs.CLarXiv:2601.14724v42026
  24. AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security

    Dongrui Liu, Qihan Ren, Chen Qian +40

    cs.AIcs.CCcs.CLarXiv:2601.18491v22026
  25. Dr. Zero: Self-Evolving Search Agents without Training Data

    Zhenrui Yue, Kartikeya Upasani, Xianjun Yang +5

    cs.AIarXiv:2601.07055v22026
  26. Rethinking Video Generation Model for the Embodied World

    Yufan Deng, Zilin Pan, Hongyu Zhang +6

    cs.CVcs.AIcs.ROarXiv:2601.15282v12026
  27. AIDev: Studying AI Coding Agents on GitHub

    Hao Li, Haoxiang Zhang, Ahmed E. Hassan

    cs.SEcs.AIarXiv:2602.09185v12026
  28. AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations

    Minjun Zhu, Zhen Lin, Yixuan Weng +6

    cs.AIcs.CLcs.CVarXiv:2602.03828v22026
  29. Revisiting the Platonic Representation Hypothesis: An Aristotelian View

    Fabian Gröger, Shuo Wen, Maria Brbić

    cs.LGcs.AIcs.CVarXiv:2602.14486v22026
  30. A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models

    Wenqi Fan, Yujuan Ding, Liangbo Ning +5

    cs.CLcs.AIcs.IRarXiv:2405.06211v32024
  31. CUA-Skill: Develop Skills for Computer Using Agent

    Tianyi Chen, Yinheng Li, Michael Solodko +12

    cs.AIarXiv:2601.21123v22026
  32. Kernels for Vector-Valued Functions: a Review

    Mauricio A. Alvarez, Lorenzo Rosasco, Neil D. Lawrence

    stat.MLcs.AImath.STarXiv:1106.6251v22011
  33. MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification

    MiroMind Team, S. Bai, L. Bing +41

    cs.CLcs.AIcs.IRarXiv:2603.15726v12026
  34. UI-Venus-1.5 Technical Report

    Venus Team, Changlong Gao, Zhangxuan Gu +24

    cs.CVcs.AIcs.CLarXiv:2602.09082v22026
  35. Infinite-World: Scaling Interactive World Models to 1000-Frame Horizons via Pose-Free Hierarchical Memory

    Ruiqi Wu, Xuanhua He, Meng Cheng +8

    cs.CVcs.AIarXiv:2602.02393v22026
  36. TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics

    Shirui Chen, Cole Harrison, Ying-Chun Lee +6

    cs.ROcs.AIcs.LGarXiv:2602.19313v22026
  37. Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs

    Haoming Meng, Kexin Huang, Shaohang Wei +6

    cs.CLcs.AIcs.LGarXiv:2603.22446v12026
  38. FeUdal Networks for Hierarchical Reinforcement Learning

    Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul +4

    cs.AIarXiv:1703.01161v22017
  39. Selective Classification for Deep Neural Networks

    Yonatan Geifman, Ran El-Yaniv

    cs.LGcs.AIarXiv:1705.08500v22017
  40. A General Theoretical Paradigm to Understand Learning from Human Preferences

    Mohammad Gheshlaghi Azar, Mark Rowland, Bilal Piot +4

    cs.AIcs.LGstat.MLarXiv:2310.12036v22023
  41. Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation

    Yuval Kirstain, Adam Polyak, Uriel Singer +3

    cs.CVcs.AIarXiv:2305.01569v22023
  42. Deep Kernel Learning

    Andrew Gordon Wilson, Zhiting Hu, Ruslan Salakhutdinov +1

    cs.LGcs.AIstat.MEarXiv:1511.02222v12015
  43. Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond

    Jingfeng Yang, Hongye Jin, Ruixiang Tang +5

    cs.CLcs.AIcs.LGarXiv:2304.13712v22023
  44. Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations

    Peiyi Wang, Lei Li, Zhihong Shao +6

    cs.AIcs.CLcs.LGarXiv:2312.08935v32023
  45. Feature Hashing for Large Scale Multitask Learning

    Kilian Weinberger, Anirban Dasgupta, Josh Attenberg +2

    cs.AIarXiv:0902.2206v52009
  46. Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning

    Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1

    cs.LGcs.AIcs.ROarXiv:1708.02596v22017
  47. EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience

    Taofeng Xue, Chong Peng, Mianqiu Huang +13

    cs.AIarXiv:2601.15876v22026
  48. Spatial-Temporal Fusion Graph Neural Networks for Traffic Flow Forecasting

    Mengzhang Li, Zhanxing Zhu

    cs.LGcs.AIarXiv:2012.09641v22020
  49. OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data

    Yuwen Du, Rui Ye, Shuo Tang +4

    cs.AIcs.CLarXiv:2603.15594v12026
  50. Learning to reinforcement learn

    Jane X Wang, Zeb Kurth-Nelson, Dhruva Tirumala +6

    cs.LGcs.AIstat.MLarXiv:1611.05763v32016
  51. Interactive Attention Networks for Aspect-Level Sentiment Classification

    Dehong Ma, Sujian Li, Xiaodong Zhang +1

    cs.AIcs.CLarXiv:1709.00893v12017
  52. A Survey on Large Language Models for Code Generation

    Juyong Jiang, Fan Wang, Jiasi Shen +2

    cs.CLcs.AIcs.SEarXiv:2406.00515v22024
  53. Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance

    Yiqi Lin, Guoqiang Liang, Ziyun Zeng +3

    cs.CVcs.AIarXiv:2603.02175v42026
  54. Men Also Like Shopping: Reducing Gender Bias Amplification using Corpus-level Constraints

    Jieyu Zhao, Tianlu Wang, Mark Yatskar +2

    cs.AIcs.CLcs.CVarXiv:1707.09457v12017
  55. REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents

    Zheng Chu, Xiao Wang, Jack Hong +11

    cs.AIcs.CLarXiv:2602.14234v12026
  56. Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

    Lai Wei, Liangbo He, Jun Lan +9

    cs.CVcs.AIcs.CLarXiv:2602.11858v22026
  57. Hindsight Credit Assignment for Long-Horizon LLM Agents

    Hui-Ze Tan, Xiao-Wen Yang, Hao Chen +7

    cs.LGcs.AIarXiv:2603.08754v12026
    Summaries:简体中文
  58. Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning

    Zhaoyang Wang, Canwen Xu, Boyi Liu +5

    cs.AIcs.CLcs.LGarXiv:2602.10090v32026
  59. RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation

    Sunzhu Li, Jiale Zhao, Miteto Wei +6

    cs.AIarXiv:2601.08430v22026
  60. Large Language Model based Multi-Agents: A Survey of Progress and Challenges

    Taicheng Guo, Xiuying Chen, Yaqi Wang +5

    cs.CLcs.AIcs.MAarXiv:2402.01680v22024