Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

14,821 to 14,880 of 15,269

  1. MetaReason: Precise Interleaved Multimodal Reasoning via Editing Meta Information for Solving Geometry Problems

    Penghao Yin, Haomin Wang, Qihong Tang +3

    cs.CVcs.AIcs.MMarXiv:2608.15006v12026
  2. RETRACE: Resilience-Guided Trait-Conditioned Craving Estimation from Wearable Physiology in Opioid Use Disorder

    Yi Xiao, Harshit Sharma, Dessa Bergen-Cico +1

    cs.AIarXiv:2608.14947v12026
  3. Divergent-Convergent Reasoning: Scaling Test-Time Compute through Structured Solution Synthesis

    Bo Wen, Yuhao Chen, Erhan Bilal +3

    cs.AIarXiv:2608.15303v12026
  4. LongRCA Bench: Diagnosing Responsible Roles and Root Causes in Long-Horizon Agent Failures

    Yunfei Zhang, Boyu Feng, Changhua Pei +14

    cs.AIcs.SEarXiv:2608.15242v12026
  5. A Unified Backbone--Expert Framework with Relation-Token and Residual--Classifier Interfaces for Automatic Modulation Recognition

    Zhixiang Deng, Houbiao Li, Zongyong Cui

    cs.CVcs.AIarXiv:2608.15160v12026
  6. Generative data assimilation highlights fronts as key regulators of ocean energy cascade

    Scott A. Martin, Georgy E. Manucharyan, Patrice Klein

    physics.ao-phcs.AIarXiv:2608.14955v12026
  7. Prior Audit-Repair Context Shifts LLM Verifier Thresholds Toward Leniency

    Parsa Mazaheri, Kasra Mazaheri

    cs.AIcs.CLarXiv:2608.16003v12026
  8. MoE Router-Guided Clustering for Heterogeneous Federated Instruction Tuning

    Ankita Sharma, Bahar Farahani, Sanaz Rahimi Moosavi +3

    cs.AIarXiv:2608.15311v12026
  9. PhaseLoRA: Control-Regime-Conditioned Low-Rank Adaptation for Continuous-Action Vision-Language-Action Policies

    Yufei Guo, Yinan Wu, Haoran Duan +2

    cs.ROcs.AIarXiv:2608.15285v12026
  10. Understanding Cognition-Induced Risks in Agentic AI Systems

    Guanchu Wang, Qinuo Li, Mengnan Du +2

    cs.AIarXiv:2608.15304v12026
  11. VibeWorlding: Can Multimodal Agents Construct 3D Open Worlds End-to-End?

    Yansong Ning, Jingwen Ye, Zhongkai Wu +5

    cs.AIarXiv:2608.15265v12026
  12. Drive, Pack, Fly: The Travelling Thief Problem with Drone

    Kabir Murjani, Abhay Sobhanan

    cs.AIcs.NEmath.OCarXiv:2608.16435v12026
  13. Learn What's Left, Not What's Mastered: Saturation Aware Advantage Reweighting for Multi-Reward Policy Optimization

    Yixuan Wang, Yifei Chen, Haichao Zhang +6

    cs.LGcs.AIarXiv:2608.16072v12026
  14. ClawGym II: Exploring Black-Box RL on Agent Harness

    Huatong Song, Fei Bai, Ming Yang +17

    cs.CLcs.AIcs.LGarXiv:2608.16798v12026
  15. Fewer Clarifications, Better Code: Benchmarking Cross-Session Personalized Ambiguity Adaptation in Coding Assistants

    Zijian Xu, Wenshuo Zhang, Zisen Qin +4

    cs.AIcs.HCarXiv:2607.26611v12026
  16. ICAE-Bench: Evaluating Coding Agents as Interactive Project Builders

    Zhongyuan Peng, Dan Huang, Chuyu Zhang +8

    cs.AIarXiv:2607.21217v12026
  17. Factorized Hypothesis Search for Evidence-to-Taxonomy Retrieval

    Linhai Ma, Ethan F. Wei, Xueqing Peng +3

    cs.CLcs.AIarXiv:2608.06614v12026
  18. Stop Indexing at Full Precision: Revisiting Clustering for Vector Embeddings

    Leonardo Kuffo, Peter Boncz

    cs.DBcs.AIcs.LGarXiv:2608.14648v12026
    Summaries:한국어
  19. ShadowDancer: Teaching Video World Models Any Action by Learning Unified Dynamics Representations from a Video and Its Shadow

    Jin Cao, Zian Meng, Kaipeng Zhang

    cs.CVcs.AIcs.LGarXiv:2607.28362v12026
  20. Algorithm Design and Physician Liability

    Shujie Luan, Shubhranshu Singh, Tinglong Dai

    cs.AIecon.THarXiv:2608.13618v12026
  21. GraphVid: Interactive Graph-Controllable Video Generation

    Vedant Shah, Onkar Susladkar, Tushar Prakash +5

    cs.CVcs.AIarXiv:2607.21580v12026
  22. From Fixed Grids to Moving Particles:A Transferable Latent Operator for Fluid Dynamics

    Meng Li, Chuqi Chen, Zhengqing Gao +4

    cs.LGcs.AIcs.GRarXiv:2608.14120v12026
  23. SLPO: Scaling Latent Reasoning via a Surrogate Policy

    Runyang You, Zhiyuan Liu, Yongqi Li +1

    cs.CLcs.AIcs.LGarXiv:2607.19691v22026
  24. Cross-Disciplinary Taxonomy and Modeling of Misunderstanding Generation, Amplification, and Detection, from Pragmatics to AI Agents

    Babak Abbaschian

    cs.AIcs.CLcs.HCarXiv:2608.13604v12026
  25. FilmBench: A Film-Grade Benchmark for Cinematic Video Generation

    Shengyi Wang, Niantong Li, Guangzheng Hu +27

    cs.CVcs.AIarXiv:2607.24241v22026
  26. How Compliant is Sepsis Treatment? An Expert-Guided Neuro-symbolic Pipeline for Generating Clinical Compliance Insights

    Himanshu Tripathi, Kaushik Roy, Subash Neupane +1

    cs.AIcs.SCarXiv:2608.13617v12026
  27. Training-Free Knowledge Transfer Across Model Scales through Activation-Guided Pruning

    Jiahe Fan, Si Chen, Yinghao Hou +2

    cs.LGcs.AIarXiv:2608.13596v12026
  28. SWE-Touch: Benchmarking Coding Agents When Users Touch the Code

    Yuqiao Tan, Jinxiang Meng, Fangyu Lei +4

    cs.SEcs.AIcs.CLarXiv:2608.02499v12026
  29. Complementary Matrix-Gated QKAN Fast-Weight Programmers for Quantum Dynamics Forecasting

    Kuo-Chung Peng, Samuel Yen-Chi Chen, Jiun-Cheng Jiang +14

    quant-phcs.AIcs.LGarXiv:2607.27945v12026
  30. Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions

    Qingfang Liu, Qiao Jin, Joe D. Menke +2

    cs.IRcs.AIcs.CLarXiv:2608.13786v12026
  31. From BERT to Frontier Agents: Eight Years of Language-Model Progress, the Collapse of the Capability-Cost Curve, and the Rise of Task-Targeted Models

    Pranav Kumar Kaliaperumal

    cs.LGcs.AIarXiv:2608.13675v12026
  32. GROVE: Growing and Reasoning over Temporally Stratified Memory from Streaming Video Experience

    Sitong Gong, Caixin Kang, Tianyu Yan +7

    cs.CVcs.AIarXiv:2608.02392v22026
  33. Is Deep Research Reliable? Misleading Knowledge Induces False Conclusions

    Pengyu Zhu, Lijun Li, Longju Yang +2

    cs.AIarXiv:2607.20891v22026
  34. Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR

    Yongjin Yang, Jiarui Liu, Yinghui He +3

    cs.AIarXiv:2606.25178v22026
  35. GRPO, Dr. GRPO, and DAPO Are Three Operations on One Number: The Group-Standard-Deviation Identity

    Yong Yi Bay, Kathleen A. Yearick

    cs.LGcs.AIcs.CLarXiv:2607.00152v12026
  36. AC-ODM: Actor--Critic Online Data Mixing for Sample-Efficient LLM Pretraining

    Jing Ma, Chenhao Dang, Mingjie Liao

    cs.LGcs.AIarXiv:2505.23878v22025
  37. PluraMath: Extending Mathematical Reasoning Evaluation Beyond High-Resource Languages

    Daryna Dementieva, Nikolay Babakov, Kathy Hämmerl +14

    cs.CLcs.AIarXiv:2607.05992v12026
  38. GRASP: GRanularity-Aware Search Policy for Agentic RAG

    Varun Gandhi, Jaewook Lee, Shantanu Todmal +4

    cs.AIcs.IRarXiv:2607.10463v12026
  39. Self-Guided Test-Time Training for Long-Context LLMs

    Xinyu Zhu, Zhe Xu, Xiaohan Wei +10

    cs.CLcs.AIarXiv:2607.09415v12026
  40. CausalDS: Benchmarking Causal Reasoning in Data-Science Agents

    Andrej Leban, Yuekai Sun

    cs.AIcs.CLcs.LGarXiv:2607.08093v12026
  41. OmniTacTune: Policy-Agnostic Real-World RL for Tactile Residual Adaptation of Visual Policies

    Kelin Yu, Haode Zhang, Harish Ravichandar +2

    cs.ROcs.AIarXiv:2607.03723v12026
  42. From Raw Experience to Skill Consumption: A Systematic Study of Model-Generated Agent Skills

    Zisu Huang, Jingwen Xu, Yifan Yang +13

    cs.AIarXiv:2605.23899v12026
  43. AOHP: An Open-Source OS-Level Agent Harness for Personalized, Efficient and Secure Interaction

    Shanhui Zhao, Jiacheng Liu, Guohong Liu +13

    cs.AIcs.OSarXiv:2606.23449v12026
  44. ReasoningLens: Hierarchical Visualization and Diagnostic Auditing for Large Reasoning Models

    Jun Zhang, Jiasheng Zheng, Boxi Cao +5

    cs.CLcs.AIarXiv:2606.23404v12026
  45. ReNIO: Reweighting Negative Trajectory Importance for LLM On-Policy Distillation

    Chen Lin, Kedi Chen, Wei Zhang

    cs.LGcs.AIarXiv:2606.23104v12026
  46. TCOD: Exploring Temporal Curriculum in On-Policy Distillation for Multi-turn Autonomous Agents

    Jiaqi Wang, Wenhao Zhang, Weijie Shi +2

    cs.LGcs.AIarXiv:2604.24005v32026
  47. Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments

    Qiuyue Wang, Mingsheng Li, Jian Guan +37

    cs.ROcs.AIcs.CLarXiv:2605.30280v22026
  48. Self-Distilled Agentic Reinforcement Learning

    Zhengxi Lu, Zhiyuan Yao, Zhuowen Han +8

    cs.LGcs.AIcs.CLarXiv:2605.15155v12026
  49. LaWAM: Latent World Action Models for Efficient Dynamics-Aware Robot Policies

    Jialei Chen, Kai Wang, Kang Chen +9

    cs.ROcs.AIarXiv:2606.15768v12026
  50. AutoResearchClaw: Self-Reinforcing Autonomous Research with Human-AI Collaboration

    Jiaqi Liu, Shi Qiu, Mairui Li +33

    cs.AIarXiv:2605.20025v22026
  51. Code as Agent Harness

    Xuying Ning, Katherine Tieu, Dongqi Fu +39

    cs.CLcs.AIarXiv:2605.18747v12026
  52. Filter, Then Reweight: Rethinking Optimization Granularity in On-Policy Distillation

    Yuying Li, Leqi Zheng, Yongzi Yu +6

    cs.LGcs.AIcs.CLarXiv:2606.02684v22026
  53. MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation

    Huawei Lin, Peng Li, Jie Song +2

    cs.AIcs.CLcs.LGarXiv:2605.27366v22026
  54. From Storage to Experience: A Survey on the Evolution of LLM Agent Memory Mechanisms

    Jinghao Luo, Yuchen Tian, Chuxue Cao +6

    cs.AIcs.CLarXiv:2605.06716v12026
  55. Unified 4D World Action Modeling from Video Priors with Asynchronous Denoising

    Jun Guo, Qiwei Li, Peiyan Li +7

    cs.ROcs.AIcs.CVarXiv:2604.26694v22026
  56. From Context to Skills: Can Language Models Learn from Context Skillfully?

    Shuzheng Si, Haozhe Zhao, Yu Lei +10

    cs.AIarXiv:2604.27660v42026
  57. SkillOpt: Executive Strategy for Self-Evolving Agent Skills

    Yifan Yang, Ziyang Gong, Weiquan Huang +12

    cs.AIcs.CLarXiv:2605.23904v22026
  58. AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation

    Yuchao Gu, Guian Fang, Yuxin Jiang +4

    cs.CVcs.AIarXiv:2605.13724v12026
  59. AI co-mathematician: Accelerating mathematicians with agentic AI

    Daniel Zheng, Ingrid von Glehn, Yori Zwols +15

    cs.AIarXiv:2605.06651v22026
  60. KL for a KL: On-Policy Distillation with Control Variate Baseline

    Minjae Oh, Sangjun Song, Gyubin Choi +2

    cs.LGcs.AIcs.CLarXiv:2605.07865v12026