Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,061 to 12,120 of 15,271

  1. Meissa: Multi-modal Medical Agentic Intelligence

    Yixiong Chen, Xinyi Bai, Yue Pan +2

    cs.AIarXiv:2603.09018v12026
  2. Multimodal Prompt Learning with Irregular EHRs for Robust Monitoring of Critical Care Patients

    Yixin Yang, Yueyang Sun, Weichen Liu +2

    cs.AIarXiv:2608.21941v12026
  3. One-Step Evolution for Long-Time Extrapolation: An Error-Bound-Informed and Prior-Guided Neural Residual Framework for Autonomous PDEs

    Maqun Zhang, Feng Gao, Wankun Chen +3

    cs.AIcs.LGarXiv:2608.22026v12026
  4. SPILLage: Agentic Oversharing on the Web

    Jaechul Roh, Eugene Bagdasarian, Hamed Haddadi +1

    cs.AIarXiv:2602.13516v12026
  5. SPAR-Hate: An Auditor-Guided Multi-Agent Framework for Bilingual Hate Speech Parsing

    Yifan Lyu, Dianqing Lin, Xinran Li +2

    cs.AIarXiv:2608.22018v12026
  6. AudioLDM: Text-to-Audio Generation with Latent Diffusion Models

    Haohe Liu, Zehua Chen, Yi Yuan +5

    cs.SDcs.AIcs.MMarXiv:2301.12503v32023
    Summaries:简体中文
  7. Redteaming Leading Arabic LLMs with ASAS

    Fidaa Abed, Haidar Khan, M Saiful Bari +2

    cs.AIarXiv:2608.21985v12026
  8. HalluHard: A Hard Multi-Turn Hallucination Benchmark

    Dongyang Fan, Sebastien Delsad, Nicolas Flammarion +1

    cs.AIcs.CLarXiv:2602.01031v12026
  9. Exposing the Systematic Vulnerability of Open-Weight Models to Prefill Attacks

    Lukas Struppek, Adam Gleave, Kellin Pelrine

    cs.CRcs.AIcs.CLarXiv:2602.14689v12026
  10. Beyond Similarity: Heterogeneous Graph Learning for Multi-Objective Food Substitution in Charitable Food Agencies

    Naimur Rahman Chowdhury, Limon Bin Hossain

    cs.AIarXiv:2608.21979v12026
  11. Closed-loop AI achieves certifiable engineering design

    Tianyi Yu, Chengxing Tao, Haoxuan Shen +8

    cs.AIarXiv:2608.21976v12026
  12. Repo2Skill-Evo: Repository Skills Go Stale in Silence

    Chenyuan Duan, Ge Shi, Zineng Mao +10

    cs.AIcs.SEarXiv:2608.21964v12026
  13. SSDi8: Accurate and Efficient 8-bit Quantization for State Space Duality

    Hyunwoo Kim, Byoungchan Ko, Minseok Kang +5

    cs.AIarXiv:2608.21952v12026
  14. A Large-Scale Car Dataset for Fine-Grained Categorization and Verification

    Linjie Yang, Ping Luo, Chen Change Loy +1

    cs.CVcs.AIarXiv:1506.08959v22015
  15. RE-TRAC: REcursive TRAjectory Compression for Deep Search Agents

    Jialiang Zhu, Gongrui Zhang, Xiaolong Ma +17

    cs.CLcs.AIarXiv:2602.02486v12026
  16. PixelGen: Improving Pixel Diffusion with Perceptual Supervision

    Zehong Ma, Ruihan Xu, Shiliang Zhang

    cs.CVcs.AIarXiv:2602.02493v22026
  17. TessIndex: Capability Verified Identity System for the Agent Economy

    Mehul Goenka, Tejas Pathak, Siddharth Asthana

    cs.AIcs.CRcs.MAarXiv:2608.21942v12026
  18. PIRA-Bench: A Transition from Reactive GUI Agents to GUI-based Proactive Intent Recommendation Agents

    Yuxiang Chai, Shunye Tang, Han Xiao +2

    cs.AIarXiv:2603.08013v12026
  19. graph2vec: Learning Distributed Representations of Graphs

    Annamalai Narayanan, Mahinthan Chandramohan, Rajasekar Venkatesan +3

    cs.AIcs.CLcs.CRarXiv:1707.05005v12017
  20. On Randomness in Agentic Evals

    Bjarni Haukur Bjarnason, André Silva, Martin Monperrus

    cs.LGcs.AIcs.SEarXiv:2602.07150v32026
  21. Omni-R1: Towards the Unified Generative Paradigm for Multimodal Reasoning

    Dongjie Cheng, Yongqi Li, Zhixin Ma +5

    cs.AIarXiv:2601.09536v22026
  22. Consistency Is Not Coherence: Orientation Search for Certified Alignments Between 4D Defence Upper Ontologies

    Fabio Rovai

    cs.AIcs.DBcs.LOarXiv:2608.21914v12026
  23. GameDevBench: Evaluating Agentic Capabilities Through Game Development

    Wayne Chi, Yixiong Fang, Arnav Yayavaram +8

    cs.AIcs.CLcs.SEarXiv:2602.11103v22026
  24. CoPE-VideoLM: Leveraging Codec Primitives For Efficient Video Language Modeling

    Sayan Deb Sarkar, Rémi Pautrat, Ondrej Miksik +4

    cs.CVcs.AIcs.CLarXiv:2602.13191v22026
  25. AI Watchdog: Agent Interfaces for Detecting and Defending Against Manipulative Dark Patterns in AI Conversations

    Rachel Poonsiriwong, Chayapatr, Archiwaranguprok +4

    cs.AIcs.HCarXiv:2608.21841v12026
  26. SIN-Bench: Tracing Native Evidence Chains in Long-Context Multimodal Scientific Interleaved Literature

    Yiming Ren, Junjie Wang, Yuxin Meng +11

    cs.CLcs.AIcs.MMarXiv:2601.10108v12026
  27. Learning a Generative Meta-Model of LLM Activations

    Grace Luo, Jiahai Feng, Trevor Darrell +2

    cs.LGcs.AIcs.CLarXiv:2602.06964v12026
  28. ESCRAG-R1: Retrieval-Augmented Reinforcement Learning for Emotional Support Conversation

    Weichu Liu, Yuxuan Hu, Yirong Sun +6

    cs.AIarXiv:2608.21925v12026
  29. Steer2Adapt: Dynamically Composing Steering Vectors Elicits Efficient Adaptation of LLMs

    Pengrui Han, Xueqiang Xu, Keyang Xuan +12

    cs.AIcs.CLcs.LGarXiv:2602.07276v12026
  30. FocusUI: Efficient UI Grounding via Position-Preserving Visual Token Selection

    Mingyu Ouyang, Kevin Qinghong Lin, Mike Zheng Shou +1

    cs.CVcs.AIcs.CLarXiv:2601.03928v12026
  31. Training Needs Trustworthy Worlds: Verified Synthetic Web Environments for Agent Learning

    Chenghao Zhang, Canran Xiao, SaiSai Hu +1

    cs.AIarXiv:2608.21898v12026
  32. FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance

    Lingjiao Chen, Matei Zaharia, James Zou

    cs.LGcs.AIcs.CLarXiv:2305.05176v12023
  33. Yi: Open Foundation Models by 01.AI

    01. AI, :, Alex Young +30

    cs.CLcs.AIarXiv:2403.04652v32024
  34. From Solver Feedback to Faithful Plans: Multi-Role Reinforcement Learning for Symbolic Planning

    Chenghao Zhang, Yikai Mao, Shanqi Liu +3

    cs.AIarXiv:2608.21897v12026
  35. DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning

    Wenhan Xiong, Thien Hoang, William Yang Wang

    cs.CLcs.AIarXiv:1707.06690v32017
  36. MHLA: Restoring Expressivity of Linear Attention via Token-Level Multi-Head

    Kewei Zhang, Ye Huang, Yufan Deng +5

    cs.CVcs.AIarXiv:2601.07832v22026
  37. HiMA-MDD: A Hierarchical Multi-Agent Harness for Interpretable Multimodal Depression Detection in Clinical Interviews

    Ao Chen, Xiaojiang Peng

    cs.AIarXiv:2608.21868v12026
  38. Is ChatGPT a General-Purpose Natural Language Processing Task Solver?

    Chengwei Qin, Aston Zhang, Zhuosheng Zhang +3

    cs.CLcs.AIarXiv:2302.06476v32023
  39. LLM4LLM: Bridging Kernel Benchmarks and Real Deployment via Closed-Loop Agentic Optimization

    Hui Zeng, Pengfei Yang, Yanxin Chen +2

    cs.AIarXiv:2608.21836v12026
  40. Domain Adaptation: Learning Bounds and Algorithms

    Yishay Mansour, Mehryar Mohri, Afshin Rostamizadeh

    cs.LGcs.AIarXiv:0902.3430v32009
  41. Spectral Attention Steering for Prompt Highlighting

    Weixian Waylon Li, Yuchen Niu, Yongxin Yang +3

    cs.CLcs.AIarXiv:2603.01281v12026
  42. Whose Opinions Do Language Models Reflect?

    Shibani Santurkar, Esin Durmus, Faisal Ladhak +3

    cs.CLcs.AIcs.CYarXiv:2303.17548v12023
  43. Beyond Success and Failure: Length-Aware Contrastive Learning for GUI Agents

    Chengyang Gu, Le Zhang, Jingbo Zhou +6

    cs.AIarXiv:2608.21830v12026
  44. CoF-T2I: Video Models as Pure Visual Reasoners for Text-to-Image Generation

    Chengzhuo Tong, Mingkun Chang, Shenglong Zhang +12

    cs.CVcs.AIarXiv:2601.10061v12026
  45. Rethinking Coarse-to-Fine Approach in Single Image Deblurring

    Sung-Jin Cho, Seo-Won Ji, Jun-Pyo Hong +2

    cs.CVcs.AIarXiv:2108.05054v22021
  46. Hints, Critics, and Teachers: Prior Injection for Sparse-Reward RL in Vision-Language Math Reasoning

    Qiqian Fu

    cs.AIcs.LGarXiv:2608.21811v12026
  47. ToolPRMBench: Evaluating and Advancing Process Reward Models for Tool-using Agents

    Dawei Li, Yuguang Yao, Zhen Tan +2

    cs.AIcs.SEarXiv:2601.12294v12026
  48. Paper2Rebuttal: A Multi-Agent Framework for Transparent Author Response Assistance

    Qianli Ma, Chang Guo, Zhiheng Tian +4

    cs.AIarXiv:2601.14171v22026
  49. Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation

    Lorenz Kuhn, Yarin Gal, Sebastian Farquhar

    cs.CLcs.AIcs.LGarXiv:2302.09664v32023
  50. AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models

    Wanjun Zhong, Ruixiang Cui, Yiduo Guo +6

    cs.CLcs.AIarXiv:2304.06364v22023
  51. VisAdj: Learning Adjacency Matrices from Node-Link Images

    Jiahao Xie, Guangmo Tong

    cs.AIcs.CVcs.LGarXiv:2608.21825v12026
  52. Scientific Image Synthesis: Benchmarking, Methodologies, and Downstream Utility

    Honglin Lin, Chonghan Qin, Zheng Liu +7

    cs.CVcs.AIarXiv:2601.17027v12026
  53. HIRA: A Human-in-the-Loop Retrieval-Augmented Cascade for Document Classification in Regulated Industries

    Shangxuan Tian, Yanhui Chen, Carlos Queiroz

    cs.AIcs.CVcs.IRarXiv:2608.21792v12026
  54. Contrastive Learning for Compact Single Image Dehazing

    Haiyan Wu, Yanyun Qu, Shaohui Lin +5

    cs.CVcs.AIarXiv:2104.09367v12021
  55. AACR-Bench: Evaluating Automatic Code Review with Holistic Repository-Level Context

    Lei Zhang, Yongda Yu, Minghui Yu +11

    cs.SEcs.AIarXiv:2601.19494v32026
  56. Physics-Knowledge-Guided Hybrid Neural Learning for Arctic Sea Ice Concentration Evolution and Short-Range Prediction

    Maqun Zhang, Feng Gao, Wankun Chen +3

    cs.AIarXiv:2608.21767v12026
  57. GLTR: Statistical Detection and Visualization of Generated Text

    Sebastian Gehrmann, Hendrik Strobelt, Alexander M. Rush

    cs.CLcs.AIcs.HCarXiv:1906.04043v12019
  58. What Does CLIP Learn for Regional Geolocalization? Probing Visual Cues and Scene Configuration After Adaptation

    Changyu Lee, Yeonsoo Park, Abdullah Alfarrarjeh +1

    cs.AIcs.CEcs.CVarXiv:2608.21761v12026
  59. ECHO: A Cognitively Inspired, Auditable Memory Plane for Long-Horizon Agents

    Yu Qian, Hong Miao, Boyang Guo +5

    cs.AIarXiv:2608.21755v12026
  60. Ask or Answer: A Decision Framework for Multi-Turn Health Misinformation Intervention

    Xiaoying Song, Anirban Saha Anik, Jinyu Liu +3

    cs.AIarXiv:2608.21721v12026