Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,421 to 12,480 of 15,235

  1. MemOCR: Layout-Aware Visual Memory for Efficient Long-Horizon Reasoning

    Yaorui Shi, Shugui Liu, Yu Yang +7

    cs.AIarXiv:2601.21468v52026
  2. TSRBench: A Comprehensive Multi-task Multi-modal Time Series Reasoning Benchmark for Generalist Models

    Fangxu Yu, Xingang Guo, Lingzhi Yuan +6

    cs.AIcs.LGarXiv:2601.18744v22026
  3. Automatic Chain of Thought Prompting in Large Language Models

    Zhuosheng Zhang, Aston Zhang, Mu Li +1

    cs.CLcs.AIarXiv:2210.03493v12022
  4. GraphRNN: Generating Realistic Graphs with Deep Auto-regressive Models

    Jiaxuan You, Rex Ying, Xiang Ren +2

    cs.LGcs.AIcs.SIarXiv:1802.08773v32018
  5. Reasoning Models Struggle to Control their Chains of Thought

    Chen Yueh-Han, Robert McCarthy, Bruce W. Lee +5

    cs.AIarXiv:2603.05706v12026
  6. Uncertainty Quantification in LLM Agents: Foundations, Emerging Challenges, and Opportunities

    Changdae Oh, Seongheon Park, To Eun Kim +8

    cs.AIarXiv:2602.05073v32026
  7. QuantaAlpha: An Evolutionary Framework for LLM-Driven Alpha Mining

    Jun Han, Shuo Zhang, Wei Li +14

    q-fin.STcs.AIq-fin.CParXiv:2602.07085v32026
  8. ScaleEnv: Scaling Environment Synthesis from Scratch for Generalist Interactive Tool-Use Agent Training

    Dunwei Tu, Hongyan Hao, Hansi Yang +10

    cs.AIarXiv:2602.06820v12026
  9. The PokeAgent Challenge: Competitive and Long-Context Learning at Scale

    Seth Karten, Jake Grigsby, Tersoo Upaa +28

    cs.LGcs.AIarXiv:2603.15563v22026
  10. On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation

    Kexin Huang, Haoming Meng, Junkang Wu +10

    cs.LGcs.AIarXiv:2603.22117v12026
  11. Safe Model-based Reinforcement Learning with Stability Guarantees

    Felix Berkenkamp, Matteo Turchetta, Angela P. Schoellig +1

    stat.MLcs.AIcs.LGarXiv:1705.08551v32017
  12. Toward Controlled Generation of Text

    Zhiting Hu, Zichao Yang, Xiaodan Liang +2

    cs.LGcs.AIcs.CLarXiv:1703.00955v42017
  13. Distributional Reinforcement Learning with Quantile Regression

    Will Dabney, Mark Rowland, Marc G. Bellemare +1

    cs.AIcs.LGstat.MLarXiv:1710.10044v12017
  14. DeepPresenter: Environment-Grounded Reflection for Agentic Presentation Generation

    Hao Zheng, Guozhao Mo, Xinru Yan +7

    cs.AIarXiv:2602.22839v32026
  15. Relation-Shape Convolutional Neural Network for Point Cloud Analysis

    Yongcheng Liu, Bin Fan, Shiming Xiang +1

    cs.CVcs.AIcs.CGarXiv:1904.07601v32019
  16. AgenticPay: A Multi-Agent LLM Negotiation System for Buyer-Seller Transactions

    Xianyang Liu, Shangding Gu, Dawn Song

    cs.AIcs.LGarXiv:2602.06008v12026
  17. Building Effective AI Coding Agents for the Terminal: Scaffolding, Harness, Context Engineering, and Lessons Learned

    Nghi D. Q. Bui

    cs.AIarXiv:2603.05344v32026
  18. InfoGraph: Unsupervised and Semi-supervised Graph-Level Representation Learning via Mutual Information Maximization

    Fan-Yun Sun, Jordan Hoffmann, Vikas Verma +1

    cs.LGcs.AIstat.MLarXiv:1908.01000v32019
  19. VLANeXt: Recipes for Building Strong VLA Models

    Xiao-Ming Wu, Bin Fan, Kang Liao +6

    cs.CVcs.AIcs.ROarXiv:2602.18532v22026
  20. Semi-Autonomous Formalization of the Vlasov-Maxwell-Landau Equilibrium

    Vasily Ilin

    cs.AImath.APmath.LOarXiv:2603.15929v22026
  21. On Detecting Adversarial Perturbations

    Jan Hendrik Metzen, Tim Genewein, Volker Fischer +1

    stat.MLcs.AIcs.CVarXiv:1702.04267v22017
  22. Learning Native Continuation for Action Chunking Flow Policies

    Yufeng Liu, Hang Yu, Juntu Zhao +9

    cs.ROcs.AIarXiv:2602.12978v22026
  23. MONAI: An open-source framework for deep learning in healthcare

    M. Jorge Cardoso, Wenqi Li, Richard Brown +54

    cs.LGcs.AIcs.CVarXiv:2211.02701v12022
  24. Hybrid Linear Attention Done Right: Efficient Distillation and Effective Architectures for Extremely Long Contexts

    Yingfa Chen, Zhen Leng Thai, Zihan Zhou +6

    cs.CLcs.AIcs.LGarXiv:2601.22156v12026
  25. On Evaluation of Embodied Navigation Agents

    Peter Anderson, Angel Chang, Devendra Singh Chaplot +8

    cs.AIcs.CVcs.LGarXiv:1807.06757v12018
  26. InternAgent-1.5: A Unified Agentic Framework for Long-Horizon Autonomous Scientific Discovery

    Shiyang Feng, Runmin Ma, Xiangchao Yan +54

    cs.AIarXiv:2602.08990v12026
  27. Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models

    Yu Zeng, Wenxuan Huang, Zhen Fang +14

    cs.CVcs.AIcs.CLarXiv:2602.02185v22026
  28. HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences

    Yusuke Sakai, Hidetaka Kamigaito, Taro Watanabe

    cs.CLcs.AIcs.DLarXiv:2601.18724v12026
  29. Does Your Reasoning Model Implicitly Know When to Stop Thinking?

    Zixuan Huang, Xin Xia, Yuxi Ren +11

    cs.AIarXiv:2602.08354v52026
  30. Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook

    Ming Li, Xirui Li, Tianyi Zhou

    cs.CLcs.AIcs.CYarXiv:2602.14299v22026
  31. Out of Sight but Not Out of Mind: Hybrid Memory for Dynamic Video World Models

    Kaijin Chen, Dingkang Liang, Xin Zhou +4

    cs.CVcs.AIarXiv:2603.25716v22026
  32. Graph Convolutional Policy Network for Goal-Directed Molecular Graph Generation

    Jiaxuan You, Bowen Liu, Rex Ying +2

    cs.LGcs.AIstat.MLarXiv:1806.02473v32018
  33. Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification

    Yuxuan Wan, Tianqing Fang, Zaitang Li +5

    cs.AIarXiv:2601.15808v22026
  34. SimToolReal: An Object-Centric Policy for Zero-Shot Dexterous Tool Manipulation

    Kushal Kedia, Tyler Ga Wei Lum, Jeannette Bohg +1

    cs.ROcs.AIarXiv:2602.16863v22026
  35. CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents

    Hanna Foerster, Tom Blanchard, Kristina Nikolić +6

    cs.AIarXiv:2601.09923v32026
  36. RealWonder: Real-Time Physical Action-Conditioned Video Generation

    Wei Liu, Ziyu Chen, Zizhang Li +3

    cs.CVcs.AIcs.GRarXiv:2603.05449v12026
  37. AutoWebWorld: Synthesizing Infinite Verifiable Web Environments via Finite State Machines

    Yifan Wu, Yiran Peng, Yiyu Chen +12

    cs.AIcs.SEarXiv:2602.14296v12026
  38. EnhanceNet: Single Image Super-Resolution Through Automated Texture Synthesis

    Mehdi S. M. Sajjadi, Bernhard Schölkopf, Michael Hirsch

    cs.CVcs.AIstat.MLarXiv:1612.07919v22016
  39. MOSS-TTS Technical Report

    Yitian Gong, Botian Jiang, Yiwei Zhao +23

    cs.SDcs.AIcs.CLarXiv:2603.18090v22026
  40. COMET: Commonsense Transformers for Automatic Knowledge Graph Construction

    Antoine Bosselut, Hannah Rashkin, Maarten Sap +3

    cs.CLcs.AIarXiv:1906.05317v22019
  41. Real-Time Aligned Reward Model beyond Semantics

    Zixuan Huang, Xin Xia, Yuxi Ren +10

    cs.AIarXiv:2601.22664v42026
  42. Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes

    Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh +6

    cs.CLcs.AIcs.LGarXiv:2305.02301v22023
  43. Instruction-Following Evaluation for Large Language Models

    Jeffrey Zhou, Tianjian Lu, Swaroop Mishra +5

    cs.CLcs.AIcs.LGarXiv:2311.07911v12023
  44. PACED: Distillation and On-Policy Self-Distillation at the Frontier of Student Competence

    Yuanda Xu, Hejian Sang, Zhengze Zhou +2

    cs.AIcs.LGarXiv:2603.11178v32026
  45. SATzilla: Portfolio-based Algorithm Selection for SAT

    Lin Xu, Frank Hutter, Holger H. Hoos +1

    cs.AIarXiv:1111.2249v12011
  46. Code2World: A GUI World Model via Renderable Code Generation

    Yuhao Zheng, Li'an Zhong, Yi Wang +6

    cs.CVcs.AIcs.CLarXiv:2602.09856v12026
  47. Theory of Space: Can Foundation Models Construct Spatial Beliefs through Active Exploration?

    Pingyue Zhang, Zihan Huang, Yue Wang +11

    cs.AIcs.CLcs.LGarXiv:2602.07055v12026
  48. VTC-Bench: Evaluating Agentic Multimodal Models via Compositional Visual Tool Chaining

    Xuanyu Zhu, Yuhao Dong, Rundong Wang +9

    cs.AIarXiv:2603.15030v22026
  49. Deep Reinforcement Learning for Multi-Agent Systems: A Review of Challenges, Solutions and Applications

    Thanh Thi Nguyen, Ngoc Duy Nguyen, Saeid Nahavandi

    cs.LGcs.AIcs.MAarXiv:1812.11794v22018
  50. From Static Templates to Dynamic Runtime Graphs: A Survey of Workflow Optimization for LLM Agents

    Ling Yue, Kushal Raj Bhandari, Ching-Yun Ko +6

    cs.AIcs.CLarXiv:2603.22386v12026
  51. CLI-Gym: Scalable CLI Task Generation via Agentic Environment Inversion

    Yusong Lin, Haiyang Wang, Shuzhe Wu +4

    cs.AIarXiv:2602.10999v12026
  52. RubricBench: Aligning Model-Generated Rubrics with Human Standards

    Qiyuan Zhang, Junyi Zhou, Yufei Wang +8

    cs.AIarXiv:2603.01562v22026
  53. Large Language Models: A Survey

    Shervin Minaee, Tomas Mikolov, Narjes Nikzad +4

    cs.CLcs.AIarXiv:2402.06196v32024
  54. TermiGen: High-Fidelity Environment and Robust Trajectory Synthesis for Terminal Agents

    Kaijie Zhu, Yuzhou Nie, Yijiang Li +10

    cs.AIarXiv:2602.07274v12026
  55. Self-Hinting Language Models Enhance Reinforcement Learning

    Baohao Liao, Hanze Dong, Xinxing Xu +2

    cs.LGcs.AIcs.CLarXiv:2602.03143v12026
  56. ViDoRe V3: A Comprehensive Evaluation of Retrieval Augmented Generation in Complex Real-World Scenarios

    António Loison, Quentin Macé, Antoine Edy +7

    cs.AIcs.CVarXiv:2601.08620v22026
  57. A Diagram Is Worth A Dozen Images

    Aniruddha Kembhavi, Mike Salvato, Eric Kolve +3

    cs.CVcs.AIarXiv:1603.07396v12016
  58. LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries

    Shijie Lian, Bin Yu, Xiaopeng Lin +6

    cs.AIcs.CLcs.CVarXiv:2601.15197v72026
  59. Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning

    Chi-Pin Huang, Yunze Man, Zhiding Yu +4

    cs.CVcs.AIcs.LGarXiv:2601.09708v22026
  60. Fish Audio S2 Technical Report

    Shijia Liao, Yuxuan Wang, Songting Liu +11

    cs.SDcs.AIcs.CLarXiv:2603.08823v22026