Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
12,721 to 12,780 of 15,455
FeatureBench: Benchmarking Agentic Coding for Complex Feature Development
Qixing Zhou, Jiacheng Zhang, Haiyang Wang +9
cs.SEcs.AIarXiv:2602.10975v12026LoL: Longer than Longer, Scaling Video Generation to Hour
Justin Cui, Jie Wu, Ming Li +6
cs.CVcs.AIarXiv:2601.16914v12026Nemotron-Cascade 2: Post-Training LLMs with Cascade RL and Multi-Domain On-Policy Distillation
Zhuolin Yang, Zihan Liu, Yang Chen +14
cs.CLcs.AIcs.LGarXiv:2603.19220v22026$τ$-Knowledge: Evaluating Conversational Agents over Unstructured Knowledge
Quan Shi, Alexandra Zytek, Pedram Razavi +2
cs.AIcs.CLcs.IRarXiv:2603.04370v12026Reinforcement-aware Knowledge Distillation for LLM Reasoning
Zhaoyang Zhang, Shuli Jiang, Yantao Shen +6
cs.LGcs.AIarXiv:2602.22495v32026Rethinking the Trust Region in LLM Reinforcement Learning
Penghui Qi, Xiangxin Zhou, Zichen Liu +4
cs.LGcs.AIcs.CLarXiv:2602.04879v32026Scalable Power Sampling: Unlocking Efficient, Training-Free Reasoning for LLMs via Distribution Sharpening
Xiaotong Ji, Rasul Tutunov, Matthieu Zimmer +1
cs.LGcs.AIarXiv:2601.21590v12026Continuous Deep Q-Learning with Model-based Acceleration
Shixiang Gu, Timothy Lillicrap, Ilya Sutskever +1
cs.LGcs.AIcs.ROarXiv:1603.00748v12016Hyperagents
Jenny Zhang, Bingchen Zhao, Wannan Yang +5
cs.AIarXiv:2603.19461v12026How AI Impacts Skill Formation
Judy Hanwen Shen, Alex Tamkin
cs.CYcs.AIcs.HCarXiv:2601.20245v22026ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers
Songyang Liu, Chaozhuo Li, Chenxu Wang +8
cs.CRcs.AIarXiv:2603.24414v12026Toward Ultra-Long-Horizon Agentic Science: Cognitive Accumulation for Machine Learning Engineering
Xinyu Zhu, Yuzhu Cai, Zexi Liu +8
cs.AIarXiv:2601.10402v52026MuSiQue: Multihop Questions via Single-hop Question Composition
Harsh Trivedi, Niranjan Balasubramanian, Tushar Khot +1
cs.CLcs.AIarXiv:2108.00573v32021Anatomy of Agentic Memory: Taxonomy and Empirical Analysis of Evaluation and System Limitations
Dongming Jiang, Yi Li, Songtao Wei +8
cs.CLcs.AIarXiv:2602.19320v22026VIBEVOICE-ASR Technical Report
Zhiliang Peng, Jianwei Yu, Yaoyao Chang +21
cs.SDcs.AIeess.ASarXiv:2601.18184v22026Large Language Model Reasoning Failures
Peiyang Song, Pengrui Han, Noah Goodman
cs.AIcs.CLcs.LGarXiv:2602.06176v12026OfficeQA Pro: An Enterprise Benchmark for End-to-End Grounded Reasoning
Krista Opsahl-Ong, Arnav Singhvi, Jasmine Collins +10
cs.AIcs.CLcs.IRarXiv:2603.08655v12026QTRAN: Learning to Factorize with Transformation for Cooperative Multi-Agent Reinforcement Learning
Kyunghwan Son, Daewoo Kim, Wan Ju Kang +2
cs.LGcs.AIcs.MAarXiv:1905.05408v12019Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters
Ailin Huang, Ang Li, Aobo Kong +213
cs.CLcs.AIarXiv:2602.10604v22026OmniGAIA: Towards Native Omni-Modal AI Agents
Xiaoxi Li, Wenxiang Jiao, Jiarui Jin +10
cs.AIcs.CLcs.CVarXiv:2602.22897v32026AOrchestra: Automating Sub-Agent Creation for Agentic Orchestration
Jianhao Ruan, Zhihao Xu, Yiran Peng +9
cs.AIcs.CLarXiv:2602.03786v22026DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
Yinger Zhang, Shutong Jiang, Renhao Li +6
cs.AIcs.CLarXiv:2601.18137v12026HERMES: KV Cache as Hierarchical Memory for Efficient Streaming Video Understanding
Haowei Zhang, Shudong Yang, Jinlan Fu +2
cs.CVcs.AIcs.CLarXiv:2601.14724v42026AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security
Dongrui Liu, Qihan Ren, Chen Qian +40
cs.AIcs.CCcs.CLarXiv:2601.18491v22026Dr. Zero: Self-Evolving Search Agents without Training Data
Zhenrui Yue, Kartikeya Upasani, Xianjun Yang +5
cs.AIarXiv:2601.07055v22026Rethinking Video Generation Model for the Embodied World
Yufan Deng, Zilin Pan, Hongyu Zhang +6
cs.CVcs.AIcs.ROarXiv:2601.15282v12026AIDev: Studying AI Coding Agents on GitHub
Hao Li, Haoxiang Zhang, Ahmed E. Hassan
cs.SEcs.AIarXiv:2602.09185v12026AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations
Minjun Zhu, Zhen Lin, Yixuan Weng +6
cs.AIcs.CLcs.CVarXiv:2602.03828v22026Revisiting the Platonic Representation Hypothesis: An Aristotelian View
Fabian Gröger, Shuo Wen, Maria Brbić
cs.LGcs.AIcs.CVarXiv:2602.14486v22026A Survey on RAG Meeting LLMs: Towards Retrieval-Augmented Large Language Models
Wenqi Fan, Yujuan Ding, Liangbo Ning +5
cs.CLcs.AIcs.IRarXiv:2405.06211v32024CUA-Skill: Develop Skills for Computer Using Agent
Tianyi Chen, Yinheng Li, Michael Solodko +12
cs.AIarXiv:2601.21123v22026Kernels for Vector-Valued Functions: a Review
Mauricio A. Alvarez, Lorenzo Rosasco, Neil D. Lawrence
stat.MLcs.AImath.STarXiv:1106.6251v22011MiroThinker-1.7 & H1: Towards Heavy-Duty Research Agents via Verification
MiroMind Team, S. Bai, L. Bing +41
cs.CLcs.AIcs.IRarXiv:2603.15726v12026UI-Venus-1.5 Technical Report
Venus Team, Changlong Gao, Zhangxuan Gu +24
cs.CVcs.AIcs.CLarXiv:2602.09082v22026Infinite-World: Scaling Interactive World Models to 1000-Frame Horizons via Pose-Free Hierarchical Memory
Ruiqi Wu, Xuanhua He, Meng Cheng +8
cs.CVcs.AIarXiv:2602.02393v22026TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics
Shirui Chen, Cole Harrison, Ying-Chun Lee +6
cs.ROcs.AIcs.LGarXiv:2602.19313v22026Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
Haoming Meng, Kexin Huang, Shaohang Wei +6
cs.CLcs.AIcs.LGarXiv:2603.22446v12026FeUdal Networks for Hierarchical Reinforcement Learning
Alexander Sasha Vezhnevets, Simon Osindero, Tom Schaul +4
cs.AIarXiv:1703.01161v22017Selective Classification for Deep Neural Networks
Yonatan Geifman, Ran El-Yaniv
cs.LGcs.AIarXiv:1705.08500v22017A General Theoretical Paradigm to Understand Learning from Human Preferences
Mohammad Gheshlaghi Azar, Mark Rowland, Bilal Piot +4
cs.AIcs.LGstat.MLarXiv:2310.12036v22023Pick-a-Pic: An Open Dataset of User Preferences for Text-to-Image Generation
Yuval Kirstain, Adam Polyak, Uriel Singer +3
cs.CVcs.AIarXiv:2305.01569v22023Deep Kernel Learning
Andrew Gordon Wilson, Zhiting Hu, Ruslan Salakhutdinov +1
cs.LGcs.AIstat.MEarXiv:1511.02222v12015Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and Beyond
Jingfeng Yang, Hongye Jin, Ruixiang Tang +5
cs.CLcs.AIcs.LGarXiv:2304.13712v22023Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations
Peiyi Wang, Lei Li, Zhihong Shao +6
cs.AIcs.CLcs.LGarXiv:2312.08935v32023Feature Hashing for Large Scale Multitask Learning
Kilian Weinberger, Anirban Dasgupta, Josh Attenberg +2
cs.AIarXiv:0902.2206v52009Neural Network Dynamics for Model-Based Deep Reinforcement Learning with Model-Free Fine-Tuning
Anusha Nagabandi, Gregory Kahn, Ronald S. Fearing +1
cs.LGcs.AIcs.ROarXiv:1708.02596v22017EvoCUA: Evolving Computer Use Agents via Learning from Scalable Synthetic Experience
Taofeng Xue, Chong Peng, Mianqiu Huang +13
cs.AIarXiv:2601.15876v22026Spatial-Temporal Fusion Graph Neural Networks for Traffic Flow Forecasting
Mengzhang Li, Zhanxing Zhu
cs.LGcs.AIarXiv:2012.09641v22020OpenSeeker: Democratizing Frontier Search Agents by Fully Open-Sourcing Training Data
Yuwen Du, Rui Ye, Shuo Tang +4
cs.AIcs.CLarXiv:2603.15594v12026Learning to reinforcement learn
Jane X Wang, Zeb Kurth-Nelson, Dhruva Tirumala +6
cs.LGcs.AIstat.MLarXiv:1611.05763v32016Interactive Attention Networks for Aspect-Level Sentiment Classification
Dehong Ma, Sujian Li, Xiaodong Zhang +1
cs.AIcs.CLarXiv:1709.00893v12017A Survey on Large Language Models for Code Generation
Juyong Jiang, Fan Wang, Jiasi Shen +2
cs.CLcs.AIcs.SEarXiv:2406.00515v22024Kiwi-Edit: Versatile Video Editing via Instruction and Reference Guidance
Yiqi Lin, Guoqiang Liang, Ziyun Zeng +3
cs.CVcs.AIarXiv:2603.02175v42026Men Also Like Shopping: Reducing Gender Bias Amplification using Corpus-level Constraints
Jieyu Zhao, Tianlu Wang, Mark Yatskar +2
cs.AIcs.CLcs.CVarXiv:1707.09457v12017REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents
Zheng Chu, Xiao Wang, Jack Hong +11
cs.AIcs.CLarXiv:2602.14234v12026Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception
Lai Wei, Liangbo He, Jun Lan +9
cs.CVcs.AIcs.CLarXiv:2602.11858v22026Hindsight Credit Assignment for Long-Horizon LLM Agents
Hui-Ze Tan, Xiao-Wen Yang, Hao Chen +7
cs.LGcs.AIarXiv:2603.08754v12026Summaries:简体中文Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
Zhaoyang Wang, Canwen Xu, Boyi Liu +5
cs.AIcs.CLcs.LGarXiv:2602.10090v32026RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation
Sunzhu Li, Jiale Zhao, Miteto Wei +6
cs.AIarXiv:2601.08430v22026Large Language Model based Multi-Agents: A Survey of Progress and Challenges
Taicheng Guo, Xiuying Chen, Yaqi Wang +5
cs.CLcs.AIcs.MAarXiv:2402.01680v22024