Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
481 to 540 of 15,190
Local Updates, Global Learning (LUGL): Playing Games with non-incremental Learners
David Milec, Spyridon Samothrakis, Michael Fairbank +1
cs.LGcs.AIarXiv:2609.03660v12026ClaimReceipt: Verifying Evidence Sufficiency and Coverage in Agent Evaluations
Peiying Zhu, Sidi Chang
cs.AIcs.CRcs.MAarXiv:2609.01992v12026Spec2Twin-Chain: Orchestrating Bi-Level Optimization with LLMs for Blockchain Digital Twin Construction
Haoting Zhang, Haoxian Chen, Jiayuan Sheng +4
cs.AIarXiv:2608.30050v12026ScienceFlow: A long-horizon agent for ML research, scientific discovery and beyond
Mingming Zhao, Jiqian Dong, Kangping Xu +16
cs.AIarXiv:2608.14354v12026AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research
Marjan Moodi, Xuankang Zhu, Fernando De Mesentier Silva +2
cs.AIarXiv:2608.11216v12026From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement
Qinsi Wang, Jing Shi, Huazheng Wang +8
cs.AIarXiv:2607.23802v22026KWBench: Measuring Unprompted Problem Recognition in Knowledge Work
Ankit Maloo
cs.AIcs.GTarXiv:2604.15760v12026Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs
Nimrod Shabtay, Moshe Kimhi, Artem Spector +5
cs.CVcs.AIarXiv:2603.16932v12026LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning
Hongye Jin, Xiaotian Han, Jingfeng Yang +5
cs.CLcs.AIcs.LGarXiv:2401.01325v32024Mamba: Linear-Time Sequence Modeling with Selective State Spaces
Albert Gu, Tri Dao
cs.LGcs.AIarXiv:2312.00752v22023Summaries:한국어Symbolic Discovery of Optimization Algorithms
Xiangning Chen, Chen Liang, Da Huang +9
cs.LGcs.AIcs.CLarXiv:2302.06675v42023Bias Out-of-the-Box: An Empirical Analysis of Intersectional Occupational Biases in Popular Generative Language Models
Hannah Kirk, Yennie Jun, Haider Iqbal +5
cs.CLcs.AIarXiv:2102.04130v32021Transfer Learning for Named-Entity Recognition with Neural Networks
Ji Young Lee, Franck Dernoncourt, Peter Szolovits
cs.CLcs.AIcs.NEarXiv:1705.06273v12017Domain Generalization using Causal Matching
Divyat Mahajan, Shruti Tople, Amit Sharma
cs.LGcs.AIstat.MLarXiv:2006.07500v32020Ming-Flash-Omni: A Sparse, Unified Architecture for Multimodal Perception and Generation
Inclusion AI, :, Bowen Ma +73
cs.CVcs.AIarXiv:2510.24821v32025When Modalities Conflict: How Unimodal Reasoning Uncertainty Governs Preference Dynamics in MLLMs
Zhuoran Zhang, Tengyue Wang, Xilin Gong +4
cs.AIarXiv:2511.02243v12025Multi-Agent Actor-Critic with Hierarchical Graph Attention Network
Heechang Ryu, Hayong Shin, Jinkyoo Park
cs.LGcs.AIcs.MAarXiv:1909.12557v22019Shaping capabilities with token-level data filtering
Neil Rathi, Alec Radford
cs.LGcs.AIcs.CLarXiv:2601.21571v22026Reinforcement Learning via Self-Distillation
Jonas Hübotter, Frederike Lübeck, Lejs Behric +8
cs.LGcs.AIarXiv:2601.20802v22026Agentic Reasoning for Large Language Models
Tianxin Wei, Ting-Wei Li, Zhining Liu +26
cs.AIcs.CLarXiv:2601.12538v12026ExpSeek: Self-Triggered Experience Seeking for Web Agents
Wenyuan Zhang, Xinghua Zhang, Haiyang Yu +5
cs.CLcs.AIarXiv:2601.08605v22026StackPlanner: A Centralized Hierarchical Multi-Agent System with Task-Experience Memory Management
Ruizhe Zhang, Xinke Jiang, Zhibang Yang +12
cs.AIarXiv:2601.05890v22026Stronger Normalization-Free Transformers
Mingzhi Chen, Taiming Lu, Jiachen Zhu +2
cs.LGcs.AIcs.CLarXiv:2512.10938v22025SQN: Weakly-Supervised Semantic Segmentation of Large-Scale 3D Point Clouds
Qingyong Hu, Bo Yang, Guangchi Fang +4
cs.CVcs.AIcs.ROarXiv:2104.04891v32021Adapting Language Models for Zero-shot Learning by Meta-tuning on Dataset and Prompt Collections
Ruiqi Zhong, Kristy Lee, Zheng Zhang +1
cs.CLcs.AIarXiv:2104.04670v52021Establishing Best Practices for Building Rigorous Agentic Benchmarks
Yuxuan Zhu, Tengjun Jin, Yada Pruksachatkun +22
cs.AIarXiv:2507.02825v52025SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
Bo Liu, Leon Guertler, Simon Yu +9
cs.AIcs.CLcs.LGarXiv:2506.24119v32025Improving and Simplifying Pattern Exploiting Training
Derek Tam, Rakesh R Menon, Mohit Bansal +2
cs.CLcs.AIcs.LGarXiv:2103.11955v32021Measuring Mathematical Problem Solving With the MATH Dataset
Dan Hendrycks, Collin Burns, Saurav Kadavath +5
cs.LGcs.AIcs.CLarXiv:2103.03874v22021Counterfactual Zero-Shot and Open-Set Visual Recognition
Zhongqi Yue, Tan Wang, Hanwang Zhang +2
cs.CVcs.AIarXiv:2103.00887v12021Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models
James Chua, Jan Betley, Mia Taylor +1
cs.LGcs.AIcs.CLarXiv:2506.13206v22025DeepVideo-R1: Video Reinforcement Fine-Tuning via Difficulty-aware Regressive GRPO
Jinyoung Park, Jeehye Na, Jinyoung Kim +1
cs.CVcs.AIarXiv:2506.07464v52025Transformer in Transformer
Kai Han, An Xiao, Enhua Wu +3
cs.CVcs.AIarXiv:2103.00112v32021Multi-Task Reinforcement Learning with Context-based Representations
Shagun Sodhani, Amy Zhang, Joelle Pineau
cs.LGcs.AIcs.ROarXiv:2102.06177v22021Tree-CNN: A Hierarchical Deep Convolutional Neural Network for Incremental Learning
Deboleena Roy, Priyadarshini Panda, Kaushik Roy
cs.CVcs.AIeess.IVarXiv:1802.05800v32018Efficient Exploration through Bayesian Deep Q-Networks
Kamyar Azizzadenesheli, Animashree Anandkumar
cs.AIcs.LGstat.MLarXiv:1802.04412v42018PointCNN: Convolution On $\mathcal{X}$-Transformed Points
Yangyan Li, Rui Bu, Mingchao Sun +3
cs.CVcs.AIcs.GRarXiv:1801.07791v52018TorchMD: A deep learning framework for molecular simulations
Stefan Doerr, Maciej Majewsk, Adrià Pérez +5
physics.chem-phcs.AIarXiv:2012.12106v12020Seed1.5-VL Technical Report
Dong Guo, Faming Wu, Feida Zhu +194
cs.CVcs.AIarXiv:2505.07062v12025Multi-expert learning of adaptive legged locomotion
Chuanyu Yang, Kai Yuan, Qiuguo Zhu +2
cs.ROcs.AIcs.LGarXiv:2012.05810v12020On the Binding Problem in Artificial Neural Networks
Klaus Greff, Sjoerd van Steenkiste, Jürgen Schmidhuber
cs.NEcs.AIcs.LGarXiv:2012.05208v12020Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents
Christian Schroeder de Witt, Klaudia Krawiecka, Igor Krawczuk +21
cs.CRcs.AIcs.MAarXiv:2505.02077v22025Reinforcement Learning for Reasoning in Large Language Models with One Training Example
Yiping Wang, Qing Yang, Zhiyuan Zeng +11
cs.LGcs.AIcs.CLarXiv:2504.20571v32025DARLA: Improving Zero-Shot Transfer in Reinforcement Learning
Irina Higgins, Arka Pal, Andrei A. Rusu +6
stat.MLcs.AIcs.LGarXiv:1707.08475v22017Outcome-Oriented Predictive Process Monitoring: Review and Benchmark
Irene Teinemaa, Marlon Dumas, Marcello La Rosa +1
cs.AIarXiv:1707.06766v42017PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding
Jang Hyun Cho, Andrea Madotto, Effrosyni Mavroudi +26
cs.CVcs.AIcs.LGarXiv:2504.13180v32025Video-Bench: Human-Aligned Video Generation Benchmark
Hui Han, Siyuan Li, Jiaqi Chen +10
cs.CVcs.AIarXiv:2504.04907v22025Value-Decomposition Networks For Cooperative Multi-Agent Learning
Peter Sunehag, Guy Lever, Audrunas Gruslys +8
cs.AIarXiv:1706.05296v12017Recurrent computations for visual pattern completion
Hanlin Tang, Martin Schrimpf, Bill Lotter +6
q-bio.NCcs.AIcs.CVarXiv:1706.02240v22017When Deep Reinforcement Learning Meets Federated Learning: Intelligent Multi-Timescale Resource Management for Multi-access Edge Computing in 5G Ultra Dense Network
Shuai Yu, Xu Chen, Zhi Zhou +2
cs.NIcs.AIcs.DCarXiv:2009.10601v12020Towards Scientific Intelligence: A Survey of LLM-based Scientific Agents
Shuo Ren, Can Xie, Pu Jian +3
cs.AIcs.MAarXiv:2503.24047v32025Measuring AI Ability to Complete Long Software Tasks
Thomas Kwa, Ben West, Joel Becker +23
cs.AIcs.LGarXiv:2503.14499v42025Generative Artificial Intelligence: Evolving Technology, Growing Societal Impact, and Opportunities for Information Systems Research
Veda C. Storey, Wei Thoo Yue, J. Leon Zhao +1
cs.CYcs.AIcs.LGarXiv:2503.05770v12025RobustFill: Neural Program Learning under Noisy I/O
Jacob Devlin, Jonathan Uesato, Surya Bhupatiraju +3
cs.AIarXiv:1703.07469v12017Autonomous Chemical Mechanistic Discovery through Agentic Reasoning and Validation
Dong Li, Sixuan Mi, Zihao Ye +10
cs.AIarXiv:2609.11147v12026Robust Adversarial Reinforcement Learning
Lerrel Pinto, James Davidson, Rahul Sukthankar +1
cs.LGcs.AIcs.MAarXiv:1703.02702v12017Aligning AI With Shared Human Values
Dan Hendrycks, Collin Burns, Steven Basart +4
cs.CYcs.AIcs.CLarXiv:2008.02275v62020Demonstrating specification gaming in reasoning models
Alexander Bondarenko, Denis Volk, Dmitrii Volkov +1
cs.AIarXiv:2502.13295v32025AcFlow: Controlling Text-to-Image Diffusion Transformers via Learned Conditional Activation Flow
Junran Wang, Zehao Jin, Tianyu Luan +1
cs.CVcs.AIarXiv:2609.10723v12026Learn&Fuzz: Machine Learning for Input Fuzzing
Patrice Godefroid, Hila Peleg, Rishabh Singh
cs.AIcs.CRcs.LGarXiv:1701.07232v12017