Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

7,261 to 7,320 of 15,507

  1. SWE-bench Multimodal: Do AI Systems Generalize to Visual Software Domains?

    John Yang, Carlos E. Jimenez, Alex L. Zhang +10

    cs.CLcs.AIcs.SEarXiv:2410.03859v12024
  2. Examining the Vulnerability of Multi-Agent Medical Systems to Human Interventions for Clinical Reasoning

    Benjamin C Liu, Dillon Mehta, Rishi Malhotra +7

    cs.AIarXiv:2609.02191v12026
  3. SLAPS: Self-Supervision Improves Structure Learning for Graph Neural Networks

    Bahare Fatemi, Layla El Asri, Seyed Mehran Kazemi

    cs.LGcs.AIarXiv:2102.05034v22021
  4. Rethinking Efficient Lane Detection via Curve Modeling

    Zhengyang Feng, Shaohua Guo, Xin Tan +3

    cs.CVcs.AIcs.LGarXiv:2203.02431v22022
  5. Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation

    Mingyuan Zhou, Huangjie Zheng, Zhendong Wang +2

    cs.LGcs.AIcs.CVarXiv:2404.04057v32024
  6. Algorithmic recourse under imperfect causal knowledge: a probabilistic approach

    Amir-Hossein Karimi, Julius von Kügelgen, Bernhard Schölkopf +1

    cs.LGcs.AIstat.MLarXiv:2006.06831v32020
  7. Towards Semantic Segmentation of Urban-Scale 3D Point Clouds: A Dataset, Benchmarks and Challenges

    Qingyong Hu, Bo Yang, Sheikh Khalid +3

    cs.CVcs.AIcs.ROarXiv:2009.03137v32020
  8. Discriminative World Models for Web Agents

    Kelvin Li, Dhruv Pendharkar, Anish Pahilajani +6

    cs.AIcs.LGarXiv:2609.02885v12026
  9. Enabling Language Models to Fill in the Blanks

    Chris Donahue, Mina Lee, Percy Liang

    cs.CLcs.AIcs.LGarXiv:2005.05339v22020
  10. HyFlex: A Benchmark Framework for Cross-domain Heuristic Search

    Edmund Burke, Tim Curtois, Matthew Hyde +2

    cs.AIarXiv:1107.5462v12011
  11. In-context Reinforcement Learning with Algorithm Distillation

    Michael Laskin, Luyu Wang, Junhyuk Oh +11

    cs.LGcs.AIarXiv:2210.14215v12022
  12. ToolACE: Winning the Points of LLM Function Calling

    Weiwen Liu, Xu Huang, Xingshan Zeng +24

    cs.LGcs.AIcs.CLarXiv:2409.00920v22024
  13. Case-based Reasoning for Natural Language Queries over Knowledge Bases

    Rajarshi Das, Manzil Zaheer, Dung Thai +6

    cs.CLcs.AIcs.LGarXiv:2104.08762v22021
  14. When to use parametric models in reinforcement learning?

    Hado van Hasselt, Matteo Hessel, John Aslanides

    cs.LGcs.AIstat.MLarXiv:1906.05243v12019
  15. SatCLIP: Global, General-Purpose Location Embeddings with Satellite Imagery

    Konstantin Klemmer, Esther Rolf, Caleb Robinson +2

    cs.CVcs.AIcs.CYarXiv:2311.17179v32023
  16. Distinguish Confusing Law Articles for Legal Judgment Prediction

    Nuo Xu, Pinghui Wang, Long Chen +3

    cs.CLcs.AIarXiv:2004.02557v32020
  17. Beyond Context Windows: Persistent Discovery Context for Data-Centric Agents

    Jalal Mahmud

    cs.AIcs.IRarXiv:2609.02129v12026
  18. RIDE: Rewarding Impact-Driven Exploration for Procedurally-Generated Environments

    Roberta Raileanu, Tim Rocktäschel

    cs.LGcs.AIarXiv:2002.12292v22020
  19. The Off-Switch Game

    Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1

    cs.AIarXiv:1611.08219v32016
  20. Towards Trustworthy Autonomous Robots: An Explainable AI-Based Decision Framework

    Cagri Temel

    cs.ROcs.AIarXiv:2609.02861v12026
  21. Deep Q-Learning based Reinforcement Learning Approach for Network Intrusion Detection

    Hooman Alavizadeh, Julian Jang-Jaccard, Hootan Alavizadeh

    cs.CRcs.AIarXiv:2111.13978v12021
  22. Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects

    Yuheng Cheng, Ceyao Zhang, Zhengwen Zhang +8

    cs.AIcs.MAarXiv:2401.03428v12024
  23. CBraMod: A Criss-Cross Brain Foundation Model for EEG Decoding

    Jiquan Wang, Sha Zhao, Zhiling Luo +5

    eess.SPcs.AIcs.LGarXiv:2412.07236v62024
  24. Cycle Consistent Adversarial Denoising Network for Multiphase Coronary CT Angiography

    Eunhee Kang, Hyun Jung Koo, Dong Hyun Yang +2

    cs.CVcs.AIcs.LGarXiv:1806.09748v32018
  25. Using Natural Language for Reward Shaping in Reinforcement Learning

    Prasoon Goyal, Scott Niekum, Raymond J. Mooney

    cs.LGcs.AIstat.MLarXiv:1903.02020v22019
  26. Towards a Rigorous Evaluation of XAI Methods on Time Series

    Udo Schlegel, Hiba Arnout, Mennatallah El-Assady +2

    cs.LGcs.AIarXiv:1909.07082v22019
  27. SINE: SINgle Image Editing with Text-to-Image Diffusion Models

    Zhixing Zhang, Ligong Han, Arnab Ghosh +2

    cs.CVcs.AIarXiv:2212.04489v22022
  28. Generative Adversarial Transformers

    Drew A. Hudson, C. Lawrence Zitnick

    cs.CVcs.AIcs.CLarXiv:2103.01209v42021
  29. Alpha-CLIP: A CLIP Model Focusing on Wherever You Want

    Zeyi Sun, Ye Fang, Tong Wu +6

    cs.CVcs.AIcs.CLarXiv:2312.03818v22023
  30. CORA: Adapting CLIP for Open-Vocabulary Detection with Region Prompting and Anchor Pre-Matching

    Xiaoshi Wu, Feng Zhu, Rui Zhao +1

    cs.CVcs.AIarXiv:2303.13076v12023
  31. CGMH: Constrained Sentence Generation by Metropolis-Hastings Sampling

    Ning Miao, Hao Zhou, Lili Mou +2

    cs.CLcs.AIcs.LGarXiv:1811.10996v12018
  32. How do World Models and Policies Compose in LLM Agents? A Joint Spectral and Behavioral Account

    Ruize Xu, Xiao Yu, Yujin Tang +2

    cs.LGcs.AIcs.CLarXiv:2608.30067v12026
  33. Deep Reinforcement Learning for Imbalanced Classification

    Enlu Lin, Qiong Chen, Xiaoming Qi

    cs.LGcs.AIstat.MLarXiv:1901.01379v12019
  34. GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities

    Sreyan Ghosh, Sonal Kumar, Ashish Seth +6

    cs.SDcs.AIcs.CLarXiv:2406.11768v12024
  35. Deep Online Learning via Meta-Learning: Continual Adaptation for Model-Based RL

    Anusha Nagabandi, Chelsea Finn, Sergey Levine

    cs.LGcs.AIcs.ROarXiv:1812.07671v22018
  36. S-LoRA: Serving Thousands of Concurrent LoRA Adapters

    Ying Sheng, Shiyi Cao, Dacheng Li +9

    cs.LGcs.AIcs.DCarXiv:2311.03285v32023
  37. Virtual-Taobao: Virtualizing Real-world Online Retail Environment for Reinforcement Learning

    Jing-Cheng Shi, Yang Yu, Qing Da +2

    cs.AIarXiv:1805.10000v12018
  38. Interactive Gibson Benchmark (iGibson 0.5): A Benchmark for Interactive Navigation in Cluttered Environments

    Fei Xia, William B. Shen, Chengshu Li +6

    cs.ROcs.AIcs.CVarXiv:1910.14442v32019
  39. Explainable AI is Dead, Long Live Explainable AI! Hypothesis-driven decision support

    Tim Miller

    cs.AIcs.HCarXiv:2302.12389v32023
  40. Influence Is Not Authority: When Causal Guardrail Signals Make Legitimate Tool Use Look Like an Attack in Tool-Using LLM Agents

    Tanzim Ahad, Ismail Hossain, Md Jahangir Alam +3

    cs.CRcs.AIarXiv:2608.29942v12026
  41. Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes

    Nathan Kallus, Masatoshi Uehara

    cs.LGcs.AIstat.MLarXiv:1908.08526v32019
  42. Capacity and Trainability in Recurrent Neural Networks

    Jasmine Collins, Jascha Sohl-Dickstein, David Sussillo

    stat.MLcs.AIcs.LGarXiv:1611.09913v32016
  43. Aff-Wild2: Extending the Aff-Wild Database for Affect Recognition

    Dimitrios Kollias, Stefanos Zafeiriou

    cs.CVcs.AIcs.LGarXiv:1811.07770v22018
  44. EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers

    Qingyan Guo, Rui Wang, Junliang Guo +6

    cs.CLcs.AIarXiv:2309.08532v32023
  45. SLCA: Slow Learner with Classifier Alignment for Continual Learning on a Pre-trained Model

    Gengwei Zhang, Liyuan Wang, Guoliang Kang +2

    cs.CVcs.AIcs.LGarXiv:2303.05118v42023
  46. How to Index Item IDs for Recommendation Foundation Models

    Wenyue Hua, Shuyuan Xu, Yingqiang Ge +1

    cs.IRcs.AIcs.CLarXiv:2305.06569v62023
  47. CrossNER: Evaluating Cross-Domain Named Entity Recognition

    Zihan Liu, Yan Xu, Tiezheng Yu +5

    cs.CLcs.AIarXiv:2012.04373v22020
  48. Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning

    Jianlan Luo, Charles Xu, Jeffrey Wu +1

    cs.ROcs.AIarXiv:2410.21845v32024
  49. WMLLM: Self-Evolving Optimization Agents via Predict-Then-Act World Modeling

    Zhongzheng Li, Qingsong Ran, Shikun Feng +5

    cs.LGcs.AIarXiv:2609.01608v12026
  50. MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution Shifts

    Matteo Greco, Anudeex Shetty, Andrea Tagarelli +1

    cs.CLcs.AIcs.CYarXiv:2609.02379v12026
  51. Rethinking with Retrieval: Faithful Large Language Model Inference

    Hangfeng He, Hongming Zhang, Dan Roth

    cs.CLcs.AIarXiv:2301.00303v12022
  52. Harms of Gender Exclusivity and Challenges in Non-Binary Representation in Language Technologies

    Sunipa Dev, Masoud Monajatipoor, Anaelia Ovalle +3

    cs.CLcs.AIcs.LGarXiv:2108.12084v22021
  53. Evaluating the Performance of Large Language Models on GAOKAO Benchmark

    Xiaotian Zhang, Chunyang Li, Yi Zong +12

    cs.CLcs.AIarXiv:2305.12474v42023
  54. Knowing Is Not Enough: Information Retrievability as a Precondition to Effective LLM Oversight

    Xinyu Fu, Narayan Ramasubbu, Dennis Galletta

    cs.HCcs.AIarXiv:2609.01976v12026
  55. What Matters in Language Conditioned Robotic Imitation Learning over Unstructured Data

    Oier Mees, Lukas Hermann, Wolfram Burgard

    cs.ROcs.AIcs.CLarXiv:2204.06252v22022
  56. Finding Alignments Between Interpretable Causal Variables and Distributed Neural Representations

    Atticus Geiger, Zhengxuan Wu, Christopher Potts +2

    cs.AIarXiv:2303.02536v42023
  57. HiPoly: a hierarchical polymer-native AI framework for property prediction and generative design

    Ge Sun, Gervasio Zaldivar, Yuan Tian +5

    physics.chem-phcond-mat.mtrl-scics.AIarXiv:2609.02746v12026
  58. A Bi-model based RNN Semantic Frame Parsing Model for Intent Detection and Slot Filling

    Yu Wang, Yilin Shen, Hongxia Jin

    cs.CLcs.AIcs.LGarXiv:1812.10235v12018
  59. EvalDetectBench: A Benchmark for Measuring Evaluation Awareness in Frontier Language Models

    Xinning Li, Kemunto Ochwang'i, Aryasomayajula Ram Bharadwaj +2

    cs.AIcs.CLarXiv:2609.01611v12026
  60. The Prompt Report: A Systematic Survey of Prompt Engineering Techniques

    Sander Schulhoff, Michael Ilie, Nishant Balepur +28

    cs.CLcs.AIarXiv:2406.06608v62024