Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

481 to 540 of 15,190

  1. Local Updates, Global Learning (LUGL): Playing Games with non-incremental Learners

    David Milec, Spyridon Samothrakis, Michael Fairbank +1

    cs.LGcs.AIarXiv:2609.03660v12026
  2. ClaimReceipt: Verifying Evidence Sufficiency and Coverage in Agent Evaluations

    Peiying Zhu, Sidi Chang

    cs.AIcs.CRcs.MAarXiv:2609.01992v12026
  3. Spec2Twin-Chain: Orchestrating Bi-Level Optimization with LLMs for Blockchain Digital Twin Construction

    Haoting Zhang, Haoxian Chen, Jiayuan Sheng +4

    cs.AIarXiv:2608.30050v12026
  4. ScienceFlow: A long-horizon agent for ML research, scientific discovery and beyond

    Mingming Zhao, Jiqian Dong, Kangping Xu +16

    cs.AIarXiv:2608.14354v12026
  5. AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research

    Marjan Moodi, Xuankang Zhu, Fernando De Mesentier Silva +2

    cs.AIarXiv:2608.11216v12026
  6. From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement

    Qinsi Wang, Jing Shi, Huazheng Wang +8

    cs.AIarXiv:2607.23802v22026
  7. KWBench: Measuring Unprompted Problem Recognition in Knowledge Work

    Ankit Maloo

    cs.AIcs.GTarXiv:2604.15760v12026
  8. Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs

    Nimrod Shabtay, Moshe Kimhi, Artem Spector +5

    cs.CVcs.AIarXiv:2603.16932v12026
  9. LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning

    Hongye Jin, Xiaotian Han, Jingfeng Yang +5

    cs.CLcs.AIcs.LGarXiv:2401.01325v32024
  10. Mamba: Linear-Time Sequence Modeling with Selective State Spaces

    Albert Gu, Tri Dao

    cs.LGcs.AIarXiv:2312.00752v22023
    Summaries:한국어
  11. Symbolic Discovery of Optimization Algorithms

    Xiangning Chen, Chen Liang, Da Huang +9

    cs.LGcs.AIcs.CLarXiv:2302.06675v42023
  12. Bias Out-of-the-Box: An Empirical Analysis of Intersectional Occupational Biases in Popular Generative Language Models

    Hannah Kirk, Yennie Jun, Haider Iqbal +5

    cs.CLcs.AIarXiv:2102.04130v32021
  13. Transfer Learning for Named-Entity Recognition with Neural Networks

    Ji Young Lee, Franck Dernoncourt, Peter Szolovits

    cs.CLcs.AIcs.NEarXiv:1705.06273v12017
  14. Domain Generalization using Causal Matching

    Divyat Mahajan, Shruti Tople, Amit Sharma

    cs.LGcs.AIstat.MLarXiv:2006.07500v32020
  15. Ming-Flash-Omni: A Sparse, Unified Architecture for Multimodal Perception and Generation

    Inclusion AI, :, Bowen Ma +73

    cs.CVcs.AIarXiv:2510.24821v32025
  16. When Modalities Conflict: How Unimodal Reasoning Uncertainty Governs Preference Dynamics in MLLMs

    Zhuoran Zhang, Tengyue Wang, Xilin Gong +4

    cs.AIarXiv:2511.02243v12025
  17. Multi-Agent Actor-Critic with Hierarchical Graph Attention Network

    Heechang Ryu, Hayong Shin, Jinkyoo Park

    cs.LGcs.AIcs.MAarXiv:1909.12557v22019
  18. Shaping capabilities with token-level data filtering

    Neil Rathi, Alec Radford

    cs.LGcs.AIcs.CLarXiv:2601.21571v22026
  19. Reinforcement Learning via Self-Distillation

    Jonas Hübotter, Frederike Lübeck, Lejs Behric +8

    cs.LGcs.AIarXiv:2601.20802v22026
  20. Agentic Reasoning for Large Language Models

    Tianxin Wei, Ting-Wei Li, Zhining Liu +26

    cs.AIcs.CLarXiv:2601.12538v12026
  21. ExpSeek: Self-Triggered Experience Seeking for Web Agents

    Wenyuan Zhang, Xinghua Zhang, Haiyang Yu +5

    cs.CLcs.AIarXiv:2601.08605v22026
  22. StackPlanner: A Centralized Hierarchical Multi-Agent System with Task-Experience Memory Management

    Ruizhe Zhang, Xinke Jiang, Zhibang Yang +12

    cs.AIarXiv:2601.05890v22026
  23. Stronger Normalization-Free Transformers

    Mingzhi Chen, Taiming Lu, Jiachen Zhu +2

    cs.LGcs.AIcs.CLarXiv:2512.10938v22025
  24. SQN: Weakly-Supervised Semantic Segmentation of Large-Scale 3D Point Clouds

    Qingyong Hu, Bo Yang, Guangchi Fang +4

    cs.CVcs.AIcs.ROarXiv:2104.04891v32021
  25. Adapting Language Models for Zero-shot Learning by Meta-tuning on Dataset and Prompt Collections

    Ruiqi Zhong, Kristy Lee, Zheng Zhang +1

    cs.CLcs.AIarXiv:2104.04670v52021
  26. Establishing Best Practices for Building Rigorous Agentic Benchmarks

    Yuxuan Zhu, Tengjun Jin, Yada Pruksachatkun +22

    cs.AIarXiv:2507.02825v52025
  27. SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning

    Bo Liu, Leon Guertler, Simon Yu +9

    cs.AIcs.CLcs.LGarXiv:2506.24119v32025
  28. Improving and Simplifying Pattern Exploiting Training

    Derek Tam, Rakesh R Menon, Mohit Bansal +2

    cs.CLcs.AIcs.LGarXiv:2103.11955v32021
  29. Measuring Mathematical Problem Solving With the MATH Dataset

    Dan Hendrycks, Collin Burns, Saurav Kadavath +5

    cs.LGcs.AIcs.CLarXiv:2103.03874v22021
  30. Counterfactual Zero-Shot and Open-Set Visual Recognition

    Zhongqi Yue, Tan Wang, Hanwang Zhang +2

    cs.CVcs.AIarXiv:2103.00887v12021
  31. Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models

    James Chua, Jan Betley, Mia Taylor +1

    cs.LGcs.AIcs.CLarXiv:2506.13206v22025
  32. DeepVideo-R1: Video Reinforcement Fine-Tuning via Difficulty-aware Regressive GRPO

    Jinyoung Park, Jeehye Na, Jinyoung Kim +1

    cs.CVcs.AIarXiv:2506.07464v52025
  33. Transformer in Transformer

    Kai Han, An Xiao, Enhua Wu +3

    cs.CVcs.AIarXiv:2103.00112v32021
  34. Multi-Task Reinforcement Learning with Context-based Representations

    Shagun Sodhani, Amy Zhang, Joelle Pineau

    cs.LGcs.AIcs.ROarXiv:2102.06177v22021
  35. Tree-CNN: A Hierarchical Deep Convolutional Neural Network for Incremental Learning

    Deboleena Roy, Priyadarshini Panda, Kaushik Roy

    cs.CVcs.AIeess.IVarXiv:1802.05800v32018
  36. Efficient Exploration through Bayesian Deep Q-Networks

    Kamyar Azizzadenesheli, Animashree Anandkumar

    cs.AIcs.LGstat.MLarXiv:1802.04412v42018
  37. PointCNN: Convolution On $\mathcal{X}$-Transformed Points

    Yangyan Li, Rui Bu, Mingchao Sun +3

    cs.CVcs.AIcs.GRarXiv:1801.07791v52018
  38. TorchMD: A deep learning framework for molecular simulations

    Stefan Doerr, Maciej Majewsk, Adrià Pérez +5

    physics.chem-phcs.AIarXiv:2012.12106v12020
  39. Seed1.5-VL Technical Report

    Dong Guo, Faming Wu, Feida Zhu +194

    cs.CVcs.AIarXiv:2505.07062v12025
  40. Multi-expert learning of adaptive legged locomotion

    Chuanyu Yang, Kai Yuan, Qiuguo Zhu +2

    cs.ROcs.AIcs.LGarXiv:2012.05810v12020
  41. On the Binding Problem in Artificial Neural Networks

    Klaus Greff, Sjoerd van Steenkiste, Jürgen Schmidhuber

    cs.NEcs.AIcs.LGarXiv:2012.05208v12020
  42. Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents

    Christian Schroeder de Witt, Klaudia Krawiecka, Igor Krawczuk +21

    cs.CRcs.AIcs.MAarXiv:2505.02077v22025
  43. Reinforcement Learning for Reasoning in Large Language Models with One Training Example

    Yiping Wang, Qing Yang, Zhiyuan Zeng +11

    cs.LGcs.AIcs.CLarXiv:2504.20571v32025
  44. DARLA: Improving Zero-Shot Transfer in Reinforcement Learning

    Irina Higgins, Arka Pal, Andrei A. Rusu +6

    stat.MLcs.AIcs.LGarXiv:1707.08475v22017
  45. Outcome-Oriented Predictive Process Monitoring: Review and Benchmark

    Irene Teinemaa, Marlon Dumas, Marcello La Rosa +1

    cs.AIarXiv:1707.06766v42017
  46. PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding

    Jang Hyun Cho, Andrea Madotto, Effrosyni Mavroudi +26

    cs.CVcs.AIcs.LGarXiv:2504.13180v32025
  47. Video-Bench: Human-Aligned Video Generation Benchmark

    Hui Han, Siyuan Li, Jiaqi Chen +10

    cs.CVcs.AIarXiv:2504.04907v22025
  48. Value-Decomposition Networks For Cooperative Multi-Agent Learning

    Peter Sunehag, Guy Lever, Audrunas Gruslys +8

    cs.AIarXiv:1706.05296v12017
  49. Recurrent computations for visual pattern completion

    Hanlin Tang, Martin Schrimpf, Bill Lotter +6

    q-bio.NCcs.AIcs.CVarXiv:1706.02240v22017
  50. When Deep Reinforcement Learning Meets Federated Learning: Intelligent Multi-Timescale Resource Management for Multi-access Edge Computing in 5G Ultra Dense Network

    Shuai Yu, Xu Chen, Zhi Zhou +2

    cs.NIcs.AIcs.DCarXiv:2009.10601v12020
  51. Towards Scientific Intelligence: A Survey of LLM-based Scientific Agents

    Shuo Ren, Can Xie, Pu Jian +3

    cs.AIcs.MAarXiv:2503.24047v32025
  52. Measuring AI Ability to Complete Long Software Tasks

    Thomas Kwa, Ben West, Joel Becker +23

    cs.AIcs.LGarXiv:2503.14499v42025
  53. Generative Artificial Intelligence: Evolving Technology, Growing Societal Impact, and Opportunities for Information Systems Research

    Veda C. Storey, Wei Thoo Yue, J. Leon Zhao +1

    cs.CYcs.AIcs.LGarXiv:2503.05770v12025
  54. RobustFill: Neural Program Learning under Noisy I/O

    Jacob Devlin, Jonathan Uesato, Surya Bhupatiraju +3

    cs.AIarXiv:1703.07469v12017
  55. Autonomous Chemical Mechanistic Discovery through Agentic Reasoning and Validation

    Dong Li, Sixuan Mi, Zihao Ye +10

    cs.AIarXiv:2609.11147v12026
  56. Robust Adversarial Reinforcement Learning

    Lerrel Pinto, James Davidson, Rahul Sukthankar +1

    cs.LGcs.AIcs.MAarXiv:1703.02702v12017
  57. Aligning AI With Shared Human Values

    Dan Hendrycks, Collin Burns, Steven Basart +4

    cs.CYcs.AIcs.CLarXiv:2008.02275v62020
  58. Demonstrating specification gaming in reasoning models

    Alexander Bondarenko, Denis Volk, Dmitrii Volkov +1

    cs.AIarXiv:2502.13295v32025
  59. AcFlow: Controlling Text-to-Image Diffusion Transformers via Learned Conditional Activation Flow

    Junran Wang, Zehao Jin, Tianyu Luan +1

    cs.CVcs.AIarXiv:2609.10723v12026
  60. Learn&Fuzz: Machine Learning for Input Fuzzing

    Patrice Godefroid, Hila Peleg, Rishabh Singh

    cs.AIcs.CRcs.LGarXiv:1701.07232v12017