Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
12,421 to 12,480 of 15,235
MemOCR: Layout-Aware Visual Memory for Efficient Long-Horizon Reasoning
Yaorui Shi, Shugui Liu, Yu Yang +7
cs.AIarXiv:2601.21468v52026TSRBench: A Comprehensive Multi-task Multi-modal Time Series Reasoning Benchmark for Generalist Models
Fangxu Yu, Xingang Guo, Lingzhi Yuan +6
cs.AIcs.LGarXiv:2601.18744v22026Automatic Chain of Thought Prompting in Large Language Models
Zhuosheng Zhang, Aston Zhang, Mu Li +1
cs.CLcs.AIarXiv:2210.03493v12022GraphRNN: Generating Realistic Graphs with Deep Auto-regressive Models
Jiaxuan You, Rex Ying, Xiang Ren +2
cs.LGcs.AIcs.SIarXiv:1802.08773v32018Reasoning Models Struggle to Control their Chains of Thought
Chen Yueh-Han, Robert McCarthy, Bruce W. Lee +5
cs.AIarXiv:2603.05706v12026Uncertainty Quantification in LLM Agents: Foundations, Emerging Challenges, and Opportunities
Changdae Oh, Seongheon Park, To Eun Kim +8
cs.AIarXiv:2602.05073v32026QuantaAlpha: An Evolutionary Framework for LLM-Driven Alpha Mining
Jun Han, Shuo Zhang, Wei Li +14
q-fin.STcs.AIq-fin.CParXiv:2602.07085v32026ScaleEnv: Scaling Environment Synthesis from Scratch for Generalist Interactive Tool-Use Agent Training
Dunwei Tu, Hongyan Hao, Hansi Yang +10
cs.AIarXiv:2602.06820v12026The PokeAgent Challenge: Competitive and Long-Context Learning at Scale
Seth Karten, Jake Grigsby, Tersoo Upaa +28
cs.LGcs.AIarXiv:2603.15563v22026On the Direction of RLVR Updates for LLM Reasoning: Identification and Exploitation
Kexin Huang, Haoming Meng, Junkang Wu +10
cs.LGcs.AIarXiv:2603.22117v12026Safe Model-based Reinforcement Learning with Stability Guarantees
Felix Berkenkamp, Matteo Turchetta, Angela P. Schoellig +1
stat.MLcs.AIcs.LGarXiv:1705.08551v32017Toward Controlled Generation of Text
Zhiting Hu, Zichao Yang, Xiaodan Liang +2
cs.LGcs.AIcs.CLarXiv:1703.00955v42017Distributional Reinforcement Learning with Quantile Regression
Will Dabney, Mark Rowland, Marc G. Bellemare +1
cs.AIcs.LGstat.MLarXiv:1710.10044v12017DeepPresenter: Environment-Grounded Reflection for Agentic Presentation Generation
Hao Zheng, Guozhao Mo, Xinru Yan +7
cs.AIarXiv:2602.22839v32026Relation-Shape Convolutional Neural Network for Point Cloud Analysis
Yongcheng Liu, Bin Fan, Shiming Xiang +1
cs.CVcs.AIcs.CGarXiv:1904.07601v32019AgenticPay: A Multi-Agent LLM Negotiation System for Buyer-Seller Transactions
Xianyang Liu, Shangding Gu, Dawn Song
cs.AIcs.LGarXiv:2602.06008v12026Building Effective AI Coding Agents for the Terminal: Scaffolding, Harness, Context Engineering, and Lessons Learned
Nghi D. Q. Bui
cs.AIarXiv:2603.05344v32026InfoGraph: Unsupervised and Semi-supervised Graph-Level Representation Learning via Mutual Information Maximization
Fan-Yun Sun, Jordan Hoffmann, Vikas Verma +1
cs.LGcs.AIstat.MLarXiv:1908.01000v32019VLANeXt: Recipes for Building Strong VLA Models
Xiao-Ming Wu, Bin Fan, Kang Liao +6
cs.CVcs.AIcs.ROarXiv:2602.18532v22026Semi-Autonomous Formalization of the Vlasov-Maxwell-Landau Equilibrium
Vasily Ilin
cs.AImath.APmath.LOarXiv:2603.15929v22026On Detecting Adversarial Perturbations
Jan Hendrik Metzen, Tim Genewein, Volker Fischer +1
stat.MLcs.AIcs.CVarXiv:1702.04267v22017Learning Native Continuation for Action Chunking Flow Policies
Yufeng Liu, Hang Yu, Juntu Zhao +9
cs.ROcs.AIarXiv:2602.12978v22026MONAI: An open-source framework for deep learning in healthcare
M. Jorge Cardoso, Wenqi Li, Richard Brown +54
cs.LGcs.AIcs.CVarXiv:2211.02701v12022Hybrid Linear Attention Done Right: Efficient Distillation and Effective Architectures for Extremely Long Contexts
Yingfa Chen, Zhen Leng Thai, Zihan Zhou +6
cs.CLcs.AIcs.LGarXiv:2601.22156v12026On Evaluation of Embodied Navigation Agents
Peter Anderson, Angel Chang, Devendra Singh Chaplot +8
cs.AIcs.CVcs.LGarXiv:1807.06757v12018InternAgent-1.5: A Unified Agentic Framework for Long-Horizon Autonomous Scientific Discovery
Shiyang Feng, Runmin Ma, Xiangchao Yan +54
cs.AIarXiv:2602.08990v12026Vision-DeepResearch Benchmark: Rethinking Visual and Textual Search for Multimodal Large Language Models
Yu Zeng, Wenxuan Huang, Zhen Fang +14
cs.CVcs.AIcs.CLarXiv:2602.02185v22026HalluCitation Matters: Revealing the Impact of Hallucinated References with 300 Hallucinated Papers in ACL Conferences
Yusuke Sakai, Hidetaka Kamigaito, Taro Watanabe
cs.CLcs.AIcs.DLarXiv:2601.18724v12026Does Your Reasoning Model Implicitly Know When to Stop Thinking?
Zixuan Huang, Xin Xia, Yuxi Ren +11
cs.AIarXiv:2602.08354v52026Does Socialization Emerge in AI Agent Society? A Case Study of Moltbook
Ming Li, Xirui Li, Tianyi Zhou
cs.CLcs.AIcs.CYarXiv:2602.14299v22026Out of Sight but Not Out of Mind: Hybrid Memory for Dynamic Video World Models
Kaijin Chen, Dingkang Liang, Xin Zhou +4
cs.CVcs.AIarXiv:2603.25716v22026Graph Convolutional Policy Network for Goal-Directed Molecular Graph Generation
Jiaxuan You, Bowen Liu, Rex Ying +2
cs.LGcs.AIstat.MLarXiv:1806.02473v32018Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification
Yuxuan Wan, Tianqing Fang, Zaitang Li +5
cs.AIarXiv:2601.15808v22026SimToolReal: An Object-Centric Policy for Zero-Shot Dexterous Tool Manipulation
Kushal Kedia, Tyler Ga Wei Lum, Jeannette Bohg +1
cs.ROcs.AIarXiv:2602.16863v22026CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents
Hanna Foerster, Tom Blanchard, Kristina Nikolić +6
cs.AIarXiv:2601.09923v32026RealWonder: Real-Time Physical Action-Conditioned Video Generation
Wei Liu, Ziyu Chen, Zizhang Li +3
cs.CVcs.AIcs.GRarXiv:2603.05449v12026AutoWebWorld: Synthesizing Infinite Verifiable Web Environments via Finite State Machines
Yifan Wu, Yiran Peng, Yiyu Chen +12
cs.AIcs.SEarXiv:2602.14296v12026EnhanceNet: Single Image Super-Resolution Through Automated Texture Synthesis
Mehdi S. M. Sajjadi, Bernhard Schölkopf, Michael Hirsch
cs.CVcs.AIstat.MLarXiv:1612.07919v22016MOSS-TTS Technical Report
Yitian Gong, Botian Jiang, Yiwei Zhao +23
cs.SDcs.AIcs.CLarXiv:2603.18090v22026COMET: Commonsense Transformers for Automatic Knowledge Graph Construction
Antoine Bosselut, Hannah Rashkin, Maarten Sap +3
cs.CLcs.AIarXiv:1906.05317v22019Real-Time Aligned Reward Model beyond Semantics
Zixuan Huang, Xin Xia, Yuxi Ren +10
cs.AIarXiv:2601.22664v42026Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes
Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh +6
cs.CLcs.AIcs.LGarXiv:2305.02301v22023Instruction-Following Evaluation for Large Language Models
Jeffrey Zhou, Tianjian Lu, Swaroop Mishra +5
cs.CLcs.AIcs.LGarXiv:2311.07911v12023PACED: Distillation and On-Policy Self-Distillation at the Frontier of Student Competence
Yuanda Xu, Hejian Sang, Zhengze Zhou +2
cs.AIcs.LGarXiv:2603.11178v32026SATzilla: Portfolio-based Algorithm Selection for SAT
Lin Xu, Frank Hutter, Holger H. Hoos +1
cs.AIarXiv:1111.2249v12011Code2World: A GUI World Model via Renderable Code Generation
Yuhao Zheng, Li'an Zhong, Yi Wang +6
cs.CVcs.AIcs.CLarXiv:2602.09856v12026Theory of Space: Can Foundation Models Construct Spatial Beliefs through Active Exploration?
Pingyue Zhang, Zihan Huang, Yue Wang +11
cs.AIcs.CLcs.LGarXiv:2602.07055v12026VTC-Bench: Evaluating Agentic Multimodal Models via Compositional Visual Tool Chaining
Xuanyu Zhu, Yuhao Dong, Rundong Wang +9
cs.AIarXiv:2603.15030v22026Deep Reinforcement Learning for Multi-Agent Systems: A Review of Challenges, Solutions and Applications
Thanh Thi Nguyen, Ngoc Duy Nguyen, Saeid Nahavandi
cs.LGcs.AIcs.MAarXiv:1812.11794v22018From Static Templates to Dynamic Runtime Graphs: A Survey of Workflow Optimization for LLM Agents
Ling Yue, Kushal Raj Bhandari, Ching-Yun Ko +6
cs.AIcs.CLarXiv:2603.22386v12026CLI-Gym: Scalable CLI Task Generation via Agentic Environment Inversion
Yusong Lin, Haiyang Wang, Shuzhe Wu +4
cs.AIarXiv:2602.10999v12026RubricBench: Aligning Model-Generated Rubrics with Human Standards
Qiyuan Zhang, Junyi Zhou, Yufei Wang +8
cs.AIarXiv:2603.01562v22026Large Language Models: A Survey
Shervin Minaee, Tomas Mikolov, Narjes Nikzad +4
cs.CLcs.AIarXiv:2402.06196v32024TermiGen: High-Fidelity Environment and Robust Trajectory Synthesis for Terminal Agents
Kaijie Zhu, Yuzhou Nie, Yijiang Li +10
cs.AIarXiv:2602.07274v12026Self-Hinting Language Models Enhance Reinforcement Learning
Baohao Liao, Hanze Dong, Xinxing Xu +2
cs.LGcs.AIcs.CLarXiv:2602.03143v12026ViDoRe V3: A Comprehensive Evaluation of Retrieval Augmented Generation in Complex Real-World Scenarios
António Loison, Quentin Macé, Antoine Edy +7
cs.AIcs.CVarXiv:2601.08620v22026A Diagram Is Worth A Dozen Images
Aniruddha Kembhavi, Mike Salvato, Eric Kolve +3
cs.CVcs.AIarXiv:1603.07396v12016LangForce: Bayesian Decomposition of Vision Language Action Models via Latent Action Queries
Shijie Lian, Bin Yu, Xiaopeng Lin +6
cs.AIcs.CLcs.CVarXiv:2601.15197v72026Fast-ThinkAct: Efficient Vision-Language-Action Reasoning via Verbalizable Latent Planning
Chi-Pin Huang, Yunze Man, Zhiding Yu +4
cs.CVcs.AIcs.LGarXiv:2601.09708v22026Fish Audio S2 Technical Report
Shijia Liao, Yuxuan Wang, Songting Liu +11
cs.SDcs.AIcs.CLarXiv:2603.08823v22026