Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

601 to 660 of 15,328

  1. Meta-World+: An Improved, Standardized, RL Benchmark

    Reginald McLean, Evangelos Chatzaroulas, Luc McCutcheon +9

    cs.AIcs.LGarXiv:2505.11289v22025
  2. AI for Games in the Foundation Model Era

    Meng Luo, Yanlin Li, Hao Li +7

    cs.AIarXiv:2609.16679v12026
  3. Estimating Uncertain Spatial Relationships in Robotics

    Randall Smith, Matthew Self, Peter Cheeseman

    cs.AIcs.ROarXiv:1304.3111v22013
  4. ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents

    Shuhan Xue, Jianyuan Zhong, Ziyuan Nan +10

    cs.AIcs.CLarXiv:2609.17523v12026
  5. Wukong: Towards a Scaling Law for Large-Scale Recommendation

    Buyun Zhang, Liang Luo, Yuxin Chen +12

    cs.LGcs.AIarXiv:2403.02545v42024
  6. CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement

    Sherif Abdulatif, Ruizhe Cao, Bin Yang

    cs.SDcs.AIcs.LGarXiv:2209.11112v32022
  7. Bee: A High-Quality Corpus and Full-Stack Suite to Unlock Advanced Fully Open MLLMs

    Yi Zhang, Bolin Ni, Xin-Sheng Chen +7

    cs.CVcs.AIarXiv:2510.13795v42025
  8. Benchmark Radar: A Living Database and Search Engine for AI Benchmarks and Evaluation

    Koutian Wu, Junjie Zhou, Ergan Shang +5

    cs.AIcs.IRarXiv:2609.11115v22026
  9. Agentic Memory Enhanced Recursive Reasoning for Root Cause Localization in Microservices

    Lingzhe Zhang, Tong Jia, Yunpeng Zhai +5

    cs.SEcs.AIarXiv:2601.02732v12026
  10. AttnLRP: Attention-Aware Layer-Wise Relevance Propagation for Transformers

    Reduan Achtibat, Sayed Mohammad Vakilzadeh Hatefi, Maximilian Dreyer +4

    cs.CLcs.AIcs.CVarXiv:2402.05602v22024
  11. Ghostbuster: Detecting Text Ghostwritten by Large Language Models

    Vivek Verma, Eve Fleisig, Nicholas Tomlin +1

    cs.CLcs.AIarXiv:2305.15047v32023
  12. Task-Embedded Control Networks for Few-Shot Imitation Learning

    Stephen James, Michael Bloesch, Andrew J. Davison

    cs.ROcs.AIcs.CVarXiv:1810.03237v12018
  13. Verifier-free Test-Time Sampling for Vision-Language-Action Models

    Suhyeok Jang, Dongyoung Kim, Changyeon Kim +2

    cs.ROcs.AIcs.LGarXiv:2510.05681v22025
  14. RLAD: Training LLMs to Discover Abstractions for Solving Reasoning Problems

    Yuxiao Qu, Anikait Singh, Yoonho Lee +4

    cs.AIcs.CLcs.LGarXiv:2510.02263v12025
  15. Nemotron-Math: Efficient Long-Context Distillation of Mathematical Reasoning from Multi-Mode Supervision

    Wei Du, Shubham Toshniwal, Branislav Kisacanin +7

    cs.AIarXiv:2512.15489v12025
  16. AnimeCeleb: Large-Scale Animation CelebHeads Dataset for Head Reenactment

    Kangyeol Kim, Sunghyun Park, Jaeseong Lee +3

    cs.AIcs.CVarXiv:2111.07640v22021
  17. TrustJudge: Inconsistencies of LLM-as-a-Judge and How to Alleviate Them

    Yidong Wang, Yunze Song, Tingyuan Zhu +11

    cs.AIcs.CLarXiv:2509.21117v22025
  18. Local Updates, Global Learning (LUGL): Playing Games with non-incremental Learners

    David Milec, Spyridon Samothrakis, Michael Fairbank +1

    cs.LGcs.AIarXiv:2609.03660v12026
  19. ClaimReceipt: Verifying Evidence Sufficiency and Coverage in Agent Evaluations

    Peiying Zhu, Sidi Chang

    cs.AIcs.CRcs.MAarXiv:2609.01992v12026
  20. Spec2Twin-Chain: Orchestrating Bi-Level Optimization with LLMs for Blockchain Digital Twin Construction

    Haoting Zhang, Haoxian Chen, Jiayuan Sheng +4

    cs.AIarXiv:2608.30050v12026
  21. ScienceFlow: A long-horizon agent for ML research, scientific discovery and beyond

    Mingming Zhao, Jiqian Dong, Kangping Xu +16

    cs.AIarXiv:2608.14354v12026
  22. AutoWorldModel-Bench: A State-Centric Benchmark for Automated World-Model Research

    Marjan Moodi, Xuankang Zhu, Fernando De Mesentier Silva +2

    cs.AIarXiv:2608.11216v12026
  23. From RLVR to RLSVR: Task Transformation Induces Self-Verifiable Rewards for Open-Ended LLM Self-Improvement

    Qinsi Wang, Jing Shi, Huazheng Wang +8

    cs.AIarXiv:2607.23802v22026
  24. KWBench: Measuring Unprompted Problem Recognition in Knowledge Work

    Ankit Maloo

    cs.AIcs.GTarXiv:2604.15760v12026
  25. Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs

    Nimrod Shabtay, Moshe Kimhi, Artem Spector +5

    cs.CVcs.AIarXiv:2603.16932v12026
  26. LLM Maybe LongLM: Self-Extend LLM Context Window Without Tuning

    Hongye Jin, Xiaotian Han, Jingfeng Yang +5

    cs.CLcs.AIcs.LGarXiv:2401.01325v32024
  27. Mamba: Linear-Time Sequence Modeling with Selective State Spaces

    Albert Gu, Tri Dao

    cs.LGcs.AIarXiv:2312.00752v22023
    Summaries:한국어
  28. Symbolic Discovery of Optimization Algorithms

    Xiangning Chen, Chen Liang, Da Huang +9

    cs.LGcs.AIcs.CLarXiv:2302.06675v42023
  29. Bias Out-of-the-Box: An Empirical Analysis of Intersectional Occupational Biases in Popular Generative Language Models

    Hannah Kirk, Yennie Jun, Haider Iqbal +5

    cs.CLcs.AIarXiv:2102.04130v32021
  30. Transfer Learning for Named-Entity Recognition with Neural Networks

    Ji Young Lee, Franck Dernoncourt, Peter Szolovits

    cs.CLcs.AIcs.NEarXiv:1705.06273v12017
  31. Domain Generalization using Causal Matching

    Divyat Mahajan, Shruti Tople, Amit Sharma

    cs.LGcs.AIstat.MLarXiv:2006.07500v32020
  32. Ming-Flash-Omni: A Sparse, Unified Architecture for Multimodal Perception and Generation

    Inclusion AI, :, Bowen Ma +73

    cs.CVcs.AIarXiv:2510.24821v32025
  33. When Modalities Conflict: How Unimodal Reasoning Uncertainty Governs Preference Dynamics in MLLMs

    Zhuoran Zhang, Tengyue Wang, Xilin Gong +4

    cs.AIarXiv:2511.02243v12025
  34. Multi-Agent Actor-Critic with Hierarchical Graph Attention Network

    Heechang Ryu, Hayong Shin, Jinkyoo Park

    cs.LGcs.AIcs.MAarXiv:1909.12557v22019
  35. Shaping capabilities with token-level data filtering

    Neil Rathi, Alec Radford

    cs.LGcs.AIcs.CLarXiv:2601.21571v22026
  36. Reinforcement Learning via Self-Distillation

    Jonas Hübotter, Frederike Lübeck, Lejs Behric +8

    cs.LGcs.AIarXiv:2601.20802v22026
  37. Agentic Reasoning for Large Language Models

    Tianxin Wei, Ting-Wei Li, Zhining Liu +26

    cs.AIcs.CLarXiv:2601.12538v12026
  38. ExpSeek: Self-Triggered Experience Seeking for Web Agents

    Wenyuan Zhang, Xinghua Zhang, Haiyang Yu +5

    cs.CLcs.AIarXiv:2601.08605v22026
  39. StackPlanner: A Centralized Hierarchical Multi-Agent System with Task-Experience Memory Management

    Ruizhe Zhang, Xinke Jiang, Zhibang Yang +12

    cs.AIarXiv:2601.05890v22026
  40. Stronger Normalization-Free Transformers

    Mingzhi Chen, Taiming Lu, Jiachen Zhu +2

    cs.LGcs.AIcs.CLarXiv:2512.10938v22025
  41. SQN: Weakly-Supervised Semantic Segmentation of Large-Scale 3D Point Clouds

    Qingyong Hu, Bo Yang, Guangchi Fang +4

    cs.CVcs.AIcs.ROarXiv:2104.04891v32021
  42. Adapting Language Models for Zero-shot Learning by Meta-tuning on Dataset and Prompt Collections

    Ruiqi Zhong, Kristy Lee, Zheng Zhang +1

    cs.CLcs.AIarXiv:2104.04670v52021
  43. Establishing Best Practices for Building Rigorous Agentic Benchmarks

    Yuxuan Zhu, Tengjun Jin, Yada Pruksachatkun +22

    cs.AIarXiv:2507.02825v52025
  44. SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning

    Bo Liu, Leon Guertler, Simon Yu +9

    cs.AIcs.CLcs.LGarXiv:2506.24119v32025
  45. Improving and Simplifying Pattern Exploiting Training

    Derek Tam, Rakesh R Menon, Mohit Bansal +2

    cs.CLcs.AIcs.LGarXiv:2103.11955v32021
  46. Measuring Mathematical Problem Solving With the MATH Dataset

    Dan Hendrycks, Collin Burns, Saurav Kadavath +5

    cs.LGcs.AIcs.CLarXiv:2103.03874v22021
  47. Counterfactual Zero-Shot and Open-Set Visual Recognition

    Zhongqi Yue, Tan Wang, Hanwang Zhang +2

    cs.CVcs.AIarXiv:2103.00887v12021
  48. Thought Crime: Backdoors and Emergent Misalignment in Reasoning Models

    James Chua, Jan Betley, Mia Taylor +1

    cs.LGcs.AIcs.CLarXiv:2506.13206v22025
  49. DeepVideo-R1: Video Reinforcement Fine-Tuning via Difficulty-aware Regressive GRPO

    Jinyoung Park, Jeehye Na, Jinyoung Kim +1

    cs.CVcs.AIarXiv:2506.07464v52025
  50. Transformer in Transformer

    Kai Han, An Xiao, Enhua Wu +3

    cs.CVcs.AIarXiv:2103.00112v32021
  51. Multi-Task Reinforcement Learning with Context-based Representations

    Shagun Sodhani, Amy Zhang, Joelle Pineau

    cs.LGcs.AIcs.ROarXiv:2102.06177v22021
  52. Tree-CNN: A Hierarchical Deep Convolutional Neural Network for Incremental Learning

    Deboleena Roy, Priyadarshini Panda, Kaushik Roy

    cs.CVcs.AIeess.IVarXiv:1802.05800v32018
  53. Efficient Exploration through Bayesian Deep Q-Networks

    Kamyar Azizzadenesheli, Animashree Anandkumar

    cs.AIcs.LGstat.MLarXiv:1802.04412v42018
  54. PointCNN: Convolution On $\mathcal{X}$-Transformed Points

    Yangyan Li, Rui Bu, Mingchao Sun +3

    cs.CVcs.AIcs.GRarXiv:1801.07791v52018
  55. TorchMD: A deep learning framework for molecular simulations

    Stefan Doerr, Maciej Majewsk, Adrià Pérez +5

    physics.chem-phcs.AIarXiv:2012.12106v12020
  56. Seed1.5-VL Technical Report

    Dong Guo, Faming Wu, Feida Zhu +194

    cs.CVcs.AIarXiv:2505.07062v12025
  57. Multi-expert learning of adaptive legged locomotion

    Chuanyu Yang, Kai Yuan, Qiuguo Zhu +2

    cs.ROcs.AIcs.LGarXiv:2012.05810v12020
  58. On the Binding Problem in Artificial Neural Networks

    Klaus Greff, Sjoerd van Steenkiste, Jürgen Schmidhuber

    cs.NEcs.AIcs.LGarXiv:2012.05208v12020
  59. Open Challenges in Multi-Agent Security: Towards Secure Systems of Interacting AI Agents

    Christian Schroeder de Witt, Klaudia Krawiecka, Igor Krawczuk +21

    cs.CRcs.AIcs.MAarXiv:2505.02077v22025
  60. Reinforcement Learning for Reasoning in Large Language Models with One Training Example

    Yiping Wang, Qing Yang, Zhiyuan Zeng +11

    cs.LGcs.AIcs.CLarXiv:2504.20571v32025