Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
14,821 to 14,880 of 15,269
MetaReason: Precise Interleaved Multimodal Reasoning via Editing Meta Information for Solving Geometry Problems
Penghao Yin, Haomin Wang, Qihong Tang +3
cs.CVcs.AIcs.MMarXiv:2608.15006v12026RETRACE: Resilience-Guided Trait-Conditioned Craving Estimation from Wearable Physiology in Opioid Use Disorder
Yi Xiao, Harshit Sharma, Dessa Bergen-Cico +1
cs.AIarXiv:2608.14947v12026Divergent-Convergent Reasoning: Scaling Test-Time Compute through Structured Solution Synthesis
Bo Wen, Yuhao Chen, Erhan Bilal +3
cs.AIarXiv:2608.15303v12026LongRCA Bench: Diagnosing Responsible Roles and Root Causes in Long-Horizon Agent Failures
Yunfei Zhang, Boyu Feng, Changhua Pei +14
cs.AIcs.SEarXiv:2608.15242v12026A Unified Backbone--Expert Framework with Relation-Token and Residual--Classifier Interfaces for Automatic Modulation Recognition
Zhixiang Deng, Houbiao Li, Zongyong Cui
cs.CVcs.AIarXiv:2608.15160v12026Generative data assimilation highlights fronts as key regulators of ocean energy cascade
Scott A. Martin, Georgy E. Manucharyan, Patrice Klein
physics.ao-phcs.AIarXiv:2608.14955v12026Prior Audit-Repair Context Shifts LLM Verifier Thresholds Toward Leniency
Parsa Mazaheri, Kasra Mazaheri
cs.AIcs.CLarXiv:2608.16003v12026MoE Router-Guided Clustering for Heterogeneous Federated Instruction Tuning
Ankita Sharma, Bahar Farahani, Sanaz Rahimi Moosavi +3
cs.AIarXiv:2608.15311v12026PhaseLoRA: Control-Regime-Conditioned Low-Rank Adaptation for Continuous-Action Vision-Language-Action Policies
Yufei Guo, Yinan Wu, Haoran Duan +2
cs.ROcs.AIarXiv:2608.15285v12026Understanding Cognition-Induced Risks in Agentic AI Systems
Guanchu Wang, Qinuo Li, Mengnan Du +2
cs.AIarXiv:2608.15304v12026VibeWorlding: Can Multimodal Agents Construct 3D Open Worlds End-to-End?
Yansong Ning, Jingwen Ye, Zhongkai Wu +5
cs.AIarXiv:2608.15265v12026Drive, Pack, Fly: The Travelling Thief Problem with Drone
Kabir Murjani, Abhay Sobhanan
cs.AIcs.NEmath.OCarXiv:2608.16435v12026Learn What's Left, Not What's Mastered: Saturation Aware Advantage Reweighting for Multi-Reward Policy Optimization
Yixuan Wang, Yifei Chen, Haichao Zhang +6
cs.LGcs.AIarXiv:2608.16072v12026ClawGym II: Exploring Black-Box RL on Agent Harness
Huatong Song, Fei Bai, Ming Yang +17
cs.CLcs.AIcs.LGarXiv:2608.16798v12026Fewer Clarifications, Better Code: Benchmarking Cross-Session Personalized Ambiguity Adaptation in Coding Assistants
Zijian Xu, Wenshuo Zhang, Zisen Qin +4
cs.AIcs.HCarXiv:2607.26611v12026ICAE-Bench: Evaluating Coding Agents as Interactive Project Builders
Zhongyuan Peng, Dan Huang, Chuyu Zhang +8
cs.AIarXiv:2607.21217v12026Factorized Hypothesis Search for Evidence-to-Taxonomy Retrieval
Linhai Ma, Ethan F. Wei, Xueqing Peng +3
cs.CLcs.AIarXiv:2608.06614v12026Stop Indexing at Full Precision: Revisiting Clustering for Vector Embeddings
Leonardo Kuffo, Peter Boncz
cs.DBcs.AIcs.LGarXiv:2608.14648v12026Summaries:한국어ShadowDancer: Teaching Video World Models Any Action by Learning Unified Dynamics Representations from a Video and Its Shadow
Jin Cao, Zian Meng, Kaipeng Zhang
cs.CVcs.AIcs.LGarXiv:2607.28362v12026Algorithm Design and Physician Liability
Shujie Luan, Shubhranshu Singh, Tinglong Dai
cs.AIecon.THarXiv:2608.13618v12026GraphVid: Interactive Graph-Controllable Video Generation
Vedant Shah, Onkar Susladkar, Tushar Prakash +5
cs.CVcs.AIarXiv:2607.21580v12026From Fixed Grids to Moving Particles:A Transferable Latent Operator for Fluid Dynamics
Meng Li, Chuqi Chen, Zhengqing Gao +4
cs.LGcs.AIcs.GRarXiv:2608.14120v12026SLPO: Scaling Latent Reasoning via a Surrogate Policy
Runyang You, Zhiyuan Liu, Yongqi Li +1
cs.CLcs.AIcs.LGarXiv:2607.19691v22026Cross-Disciplinary Taxonomy and Modeling of Misunderstanding Generation, Amplification, and Detection, from Pragmatics to AI Agents
Babak Abbaschian
cs.AIcs.CLcs.HCarXiv:2608.13604v12026FilmBench: A Film-Grade Benchmark for Cinematic Video Generation
Shengyi Wang, Niantong Li, Guangzheng Hu +27
cs.CVcs.AIarXiv:2607.24241v22026How Compliant is Sepsis Treatment? An Expert-Guided Neuro-symbolic Pipeline for Generating Clinical Compliance Insights
Himanshu Tripathi, Kaushik Roy, Subash Neupane +1
cs.AIcs.SCarXiv:2608.13617v12026Training-Free Knowledge Transfer Across Model Scales through Activation-Guided Pruning
Jiahe Fan, Si Chen, Yinghao Hou +2
cs.LGcs.AIarXiv:2608.13596v12026SWE-Touch: Benchmarking Coding Agents When Users Touch the Code
Yuqiao Tan, Jinxiang Meng, Fangyu Lei +4
cs.SEcs.AIcs.CLarXiv:2608.02499v12026Complementary Matrix-Gated QKAN Fast-Weight Programmers for Quantum Dynamics Forecasting
Kuo-Chung Peng, Samuel Yen-Chi Chen, Jiun-Cheng Jiang +14
quant-phcs.AIcs.LGarXiv:2607.27945v12026Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions
Qingfang Liu, Qiao Jin, Joe D. Menke +2
cs.IRcs.AIcs.CLarXiv:2608.13786v12026From BERT to Frontier Agents: Eight Years of Language-Model Progress, the Collapse of the Capability-Cost Curve, and the Rise of Task-Targeted Models
Pranav Kumar Kaliaperumal
cs.LGcs.AIarXiv:2608.13675v12026GROVE: Growing and Reasoning over Temporally Stratified Memory from Streaming Video Experience
Sitong Gong, Caixin Kang, Tianyu Yan +7
cs.CVcs.AIarXiv:2608.02392v22026Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions
Pengyu Zhu, Lijun Li, Longju Yang +2
cs.AIarXiv:2607.20891v22026Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR
Yongjin Yang, Jiarui Liu, Yinghui He +3
cs.AIarXiv:2606.25178v22026GRPO, Dr. GRPO, and DAPO Are Three Operations on One Number: The Group-Standard-Deviation Identity
Yong Yi Bay, Kathleen A. Yearick
cs.LGcs.AIcs.CLarXiv:2607.00152v12026AC-ODM: Actor--Critic Online Data Mixing for Sample-Efficient LLM Pretraining
Jing Ma, Chenhao Dang, Mingjie Liao
cs.LGcs.AIarXiv:2505.23878v22025PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages
Daryna Dementieva, Nikolay Babakov, Kathy Hämmerl +14
cs.CLcs.AIarXiv:2607.05992v12026GRASP: GRanularity-Aware Search Policy for Agentic RAG
Varun Gandhi, Jaewook Lee, Shantanu Todmal +4
cs.AIcs.IRarXiv:2607.10463v12026Self-Guided Test-Time Training for Long-Context LLMs
Xinyu Zhu, Zhe Xu, Xiaohan Wei +10
cs.CLcs.AIarXiv:2607.09415v12026CausalDS: Benchmarking Causal Reasoning in Data-Science Agents
Andrej Leban, Yuekai Sun
cs.AIcs.CLcs.LGarXiv:2607.08093v12026OmniTacTune: Policy-Agnostic Real-World RL for Tactile Residual Adaptation of Visual Policies
Kelin Yu, Haode Zhang, Harish Ravichandar +2
cs.ROcs.AIarXiv:2607.03723v12026From Raw Experience to Skill Consumption: A Systematic Study of Model-Generated Agent Skills
Zisu Huang, Jingwen Xu, Yifan Yang +13
cs.AIarXiv:2605.23899v12026AOHP: An Open-Source OS-Level Agent Harness for Personalized, Efficient and Secure Interaction
Shanhui Zhao, Jiacheng Liu, Guohong Liu +13
cs.AIcs.OSarXiv:2606.23449v12026ReasoningLens: Hierarchical Visualization and Diagnostic Auditing for Large Reasoning Models
Jun Zhang, Jiasheng Zheng, Boxi Cao +5
cs.CLcs.AIarXiv:2606.23404v12026ReNIO: Reweighting Negative Trajectory Importance for LLM On-Policy Distillation
Chen Lin, Kedi Chen, Wei Zhang
cs.LGcs.AIarXiv:2606.23104v12026TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agents
Jiaqi Wang, Wenhao Zhang, Weijie Shi +2
cs.LGcs.AIarXiv:2604.24005v32026Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
Qiuyue Wang, Mingsheng Li, Jian Guan +37
cs.ROcs.AIcs.CLarXiv:2605.30280v22026Self-Distilled Agentic Reinforcement Learning
Zhengxi Lu, Zhiyuan Yao, Zhuowen Han +8
cs.LGcs.AIcs.CLarXiv:2605.15155v12026LaWAM: Latent World Action Models for Efficient Dynamics-Aware Robot Policies
Jialei Chen, Kai Wang, Kang Chen +9
cs.ROcs.AIarXiv:2606.15768v12026AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration
Jiaqi Liu, Shi Qiu, Mairui Li +33
cs.AIarXiv:2605.20025v22026Code as Agent Harness
Xuying Ning, Katherine Tieu, Dongqi Fu +39
cs.CLcs.AIarXiv:2605.18747v12026Filter, Then Reweight: Rethinking Optimization Granularity in On-Policy Distillation
Yuying Li, Leqi Zheng, Yongzi Yu +6
cs.LGcs.AIcs.CLarXiv:2606.02684v22026MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
Huawei Lin, Peng Li, Jie Song +2
cs.AIcs.CLcs.LGarXiv:2605.27366v22026From Storage to Experience: A Survey on the Evolution of LLM Agent Memory Mechanisms
Jinghao Luo, Yuchen Tian, Chuxue Cao +6
cs.AIcs.CLarXiv:2605.06716v12026Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising
Jun Guo, Qiwei Li, Peiyan Li +7
cs.ROcs.AIcs.CVarXiv:2604.26694v22026From Context to Skills: Can Language Models Learn from Context Skillfully?
Shuzheng Si, Haozhe Zhao, Yu Lei +10
cs.AIarXiv:2604.27660v42026SkillOpt: Executive Strategy for Self-Evolving Agent Skills
Yifan Yang, Ziyang Gong, Weiquan Huang +12
cs.AIcs.CLarXiv:2605.23904v22026AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
Yuchao Gu, Guian Fang, Yuxin Jiang +4
cs.CVcs.AIarXiv:2605.13724v12026AI co-mathematician: Accelerating mathematicians with agentic AI
Daniel Zheng, Ingrid von Glehn, Yori Zwols +15
cs.AIarXiv:2605.06651v22026KL for a KL: On-Policy Distillation with Control Variate Baseline
Minjae Oh, Sangjun Song, Gyubin Choi +2
cs.LGcs.AIcs.CLarXiv:2605.07865v12026