Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
601 to 660 of 15,328
Meta-World+: An Improved, Standardized, RL Benchmark
Reginald McLean, Evangelos Chatzaroulas, Luc McCutcheon +9
cs.AIcs.LGarXiv:2505.11289v22025AI for Games in the Foundation Model Era
Meng Luo, Yanlin Li, Hao Li +7
cs.AIarXiv:2609.16679v12026Estimating Uncertain Spatial Relationships in Robotics
Randall Smith, Matthew Self, Peter Cheeseman
cs.AIcs.ROarXiv:1304.3111v22013ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents
Shuhan Xue, Jianyuan Zhong, Ziyuan Nan +10
cs.AIcs.CLarXiv:2609.17523v12026Wukong: Towards a Scaling Law for Large-Scale Recommendation
Buyun Zhang, Liang Luo, Yuxin Chen +12
cs.LGcs.AIarXiv:2403.02545v42024CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement
Sherif Abdulatif, Ruizhe Cao, Bin Yang
cs.SDcs.AIcs.LGarXiv:2209.11112v32022Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs
Yi Zhang, Bolin Ni, Xin-Sheng Chen +7
cs.CVcs.AIarXiv:2510.13795v42025Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation
Koutian Wu, Junjie Zhou, Ergan Shang +5
cs.AIcs.IRarXiv:2609.11115v22026Agentic Memory Enhanced Recursive Reasoning for Root Cause Localization in Microservices
Lingzhe Zhang, Tong Jia, Yunpeng Zhai +5
cs.SEcs.AIarXiv:2601.02732v12026AttnLRP: Attention-Aware Layer-Wise Relevance Propagation for Transformers
Reduan Achtibat, Sayed Mohammad Vakilzadeh Hatefi, Maximilian Dreyer +4
cs.CLcs.AIcs.CVarXiv:2402.05602v22024Ghostbuster: Detecting Text Ghostwritten by Large Language Models
Vivek Verma, Eve Fleisig, Nicholas Tomlin +1
cs.CLcs.AIarXiv:2305.15047v32023Task-Embedded Control Networks for Few-Shot Imitation Learning
Stephen James, Michael Bloesch, Andrew J. Davison
cs.ROcs.AIcs.CVarXiv:1810.03237v12018Verifier-free Test-Time Sampling for Vision-Language-Action Models
Suhyeok Jang, Dongyoung Kim, Changyeon Kim +2
cs.ROcs.AIcs.LGarXiv:2510.05681v22025RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems
Yuxiao Qu, Anikait Singh, Yoonho Lee +4
cs.AIcs.CLcs.LGarXiv:2510.02263v12025Nemotron-Math: Efficient Long-Context Distillation of Mathematical Reasoning from Multi-Mode Supervision
Wei Du, Shubham Toshniwal, Branislav Kisacanin +7
cs.AIarXiv:2512.15489v12025AnimeCeleb: Large-Scale Animation CelebHeads Dataset for Head Reenactment
Kangyeol Kim, Sunghyun Park, Jaeseong Lee +3
cs.AIcs.CVarXiv:2111.07640v22021TrustJudge: Inconsistencies of LLM-as-a-Judge and How to Alleviate Them
Yidong Wang, Yunze Song, Tingyuan Zhu +11
cs.AIcs.CLarXiv:2509.21117v22025Local Updates, Global Learning (LUGL): Playing Games with non-incremental Learners
David Milec, Spyridon Samothrakis, Michael Fairbank +1
cs.LGcs.AIarXiv:2609.03660v12026ClaimReceipt: Verifying Evidence Sufficiency and Coverage in Agent Evaluations
Peiying Zhu, Sidi Chang
cs.AIcs.CRcs.MAarXiv:2609.01992v12026Spec2Twin-Chain: Orchestrating Bi-Level Optimization with LLMs for Blockchain Digital Twin Construction
Haoting Zhang, Haoxian Chen, Jiayuan Sheng +4
cs.AIarXiv:2608.30050v12026ScienceFlow: A long-horizon agent for ML research, scientific discovery and beyond
Mingming Zhao, Jiqian Dong, Kangping Xu +16
cs.AIarXiv:2608.14354v12026AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research
Marjan Moodi, Xuankang Zhu, Fernando De Mesentier Silva +2
cs.AIarXiv:2608.11216v12026From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement
Qinsi Wang, Jing Shi, Huazheng Wang +8
cs.AIarXiv:2607.23802v22026KWBench: Measuring Unprompted Problem Recognition in Knowledge Work
Ankit Maloo
cs.AIcs.GTarXiv:2604.15760v12026Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs
Nimrod Shabtay, Moshe Kimhi, Artem Spector +5
cs.CVcs.AIarXiv:2603.16932v12026LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
Hongye Jin, Xiaotian Han, Jingfeng Yang +5
cs.CLcs.AIcs.LGarXiv:2401.01325v32024Mamba: Linear-Time Sequence Modeling with Selective State Spaces
Albert Gu, Tri Dao
cs.LGcs.AIarXiv:2312.00752v22023Summaries:한국어Symbolic Discovery of Optimization Algorithms
Xiangning Chen, Chen Liang, Da Huang +9
cs.LGcs.AIcs.CLarXiv:2302.06675v42023Bias Out-of-the-Box: An Empirical Analysis of Intersectional Occupational Biases in Popular Generative Language Models
Hannah Kirk, Yennie Jun, Haider Iqbal +5
cs.CLcs.AIarXiv:2102.04130v32021Transfer Learning for Named-Entity Recognition with Neural Networks
Ji Young Lee, Franck Dernoncourt, Peter Szolovits
cs.CLcs.AIcs.NEarXiv:1705.06273v12017Domain Generalization using Causal Matching
Divyat Mahajan, Shruti Tople, Amit Sharma
cs.LGcs.AIstat.MLarXiv:2006.07500v32020Ming-Flash-Omni: A Sparse, Unified Architecture for Multimodal Perception and Generation
Inclusion AI, :, Bowen Ma +73
cs.CVcs.AIarXiv:2510.24821v32025When Modalities Conflict: How Unimodal Reasoning Uncertainty Governs Preference Dynamics in MLLMs
Zhuoran Zhang, Tengyue Wang, Xilin Gong +4
cs.AIarXiv:2511.02243v12025Multi-Agent Actor-Critic with Hierarchical Graph Attention Network
Heechang Ryu, Hayong Shin, Jinkyoo Park
cs.LGcs.AIcs.MAarXiv:1909.12557v22019Shaping capabilities with token-level data filtering
Neil Rathi, Alec Radford
cs.LGcs.AIcs.CLarXiv:2601.21571v22026Reinforcement Learning via Self-Distillation
Jonas Hübotter, Frederike Lübeck, Lejs Behric +8
cs.LGcs.AIarXiv:2601.20802v22026Agentic Reasoning for Large Language Models
Tianxin Wei, Ting-Wei Li, Zhining Liu +26
cs.AIcs.CLarXiv:2601.12538v12026ExpSeek: Self-Triggered Experience Seeking for Web Agents
Wenyuan Zhang, Xinghua Zhang, Haiyang Yu +5
cs.CLcs.AIarXiv:2601.08605v22026StackPlanner: A Centralized Hierarchical Multi-Agent System with Task-Experience Memory Management
Ruizhe Zhang, Xinke Jiang, Zhibang Yang +12
cs.AIarXiv:2601.05890v22026Stronger Normalization-Free Transformers
Mingzhi Chen, Taiming Lu, Jiachen Zhu +2
cs.LGcs.AIcs.CLarXiv:2512.10938v22025SQN: Weakly-Supervised Semantic Segmentation of Large-Scale 3D Point Clouds
Qingyong Hu, Bo Yang, Guangchi Fang +4
cs.CVcs.AIcs.ROarXiv:2104.04891v32021Adapting Language Models for Zero-shot Learning by Meta-tuning on Dataset and Prompt Collections
Ruiqi Zhong, Kristy Lee, Zheng Zhang +1
cs.CLcs.AIarXiv:2104.04670v52021Establishing Best Practices for Building Rigorous Agentic Benchmarks
Yuxuan Zhu, Tengjun Jin, Yada Pruksachatkun +22
cs.AIarXiv:2507.02825v52025SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
Bo Liu, Leon Guertler, Simon Yu +9
cs.AIcs.CLcs.LGarXiv:2506.24119v32025Improving and Simplifying Pattern Exploiting Training
Derek Tam, Rakesh R Menon, Mohit Bansal +2
cs.CLcs.AIcs.LGarXiv:2103.11955v32021Measuring Mathematical Problem Solving With the MATH Dataset
Dan Hendrycks, Collin Burns, Saurav Kadavath +5
cs.LGcs.AIcs.CLarXiv:2103.03874v22021Counterfactual Zero-Shot and Open-Set Visual Recognition
Zhongqi Yue, Tan Wang, Hanwang Zhang +2
cs.CVcs.AIarXiv:2103.00887v12021Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models
James Chua, Jan Betley, Mia Taylor +1
cs.LGcs.AIcs.CLarXiv:2506.13206v22025DeepVideo-R1: Video Reinforcement Fine-Tuning via Difficulty-aware Regressive GRPO
Jinyoung Park, Jeehye Na, Jinyoung Kim +1
cs.CVcs.AIarXiv:2506.07464v52025Transformer in Transformer
Kai Han, An Xiao, Enhua Wu +3
cs.CVcs.AIarXiv:2103.00112v32021Multi-Task Reinforcement Learning with Context-based Representations
Shagun Sodhani, Amy Zhang, Joelle Pineau
cs.LGcs.AIcs.ROarXiv:2102.06177v22021Tree-CNN: A Hierarchical Deep Convolutional Neural Network for Incremental Learning
Deboleena Roy, Priyadarshini Panda, Kaushik Roy
cs.CVcs.AIeess.IVarXiv:1802.05800v32018Efficient Exploration through Bayesian Deep Q-Networks
Kamyar Azizzadenesheli, Animashree Anandkumar
cs.AIcs.LGstat.MLarXiv:1802.04412v42018PointCNN: Convolution On $\mathcal{X}$-Transformed Points
Yangyan Li, Rui Bu, Mingchao Sun +3
cs.CVcs.AIcs.GRarXiv:1801.07791v52018TorchMD: A deep learning framework for molecular simulations
Stefan Doerr, Maciej Majewsk, Adrià Pérez +5
physics.chem-phcs.AIarXiv:2012.12106v12020Seed1.5-VL Technical Report
Dong Guo, Faming Wu, Feida Zhu +194
cs.CVcs.AIarXiv:2505.07062v12025Multi-expert learning of adaptive legged locomotion
Chuanyu Yang, Kai Yuan, Qiuguo Zhu +2
cs.ROcs.AIcs.LGarXiv:2012.05810v12020On the Binding Problem in Artificial Neural Networks
Klaus Greff, Sjoerd van Steenkiste, Jürgen Schmidhuber
cs.NEcs.AIcs.LGarXiv:2012.05208v12020Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents
Christian Schroeder de Witt, Klaudia Krawiecka, Igor Krawczuk +21
cs.CRcs.AIcs.MAarXiv:2505.02077v22025Reinforcement Learning for Reasoning in Large Language Models with One Training Example
Yiping Wang, Qing Yang, Zhiyuan Zeng +11
cs.LGcs.AIcs.CLarXiv:2504.20571v32025