Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,961 to 7,020 of 15,198
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
Mingyuan Zhou, Huangjie Zheng, Zhendong Wang +2
cs.LGcs.AIcs.CVarXiv:2404.04057v32024Algorithmic recourse under imperfect causal knowledge: a probabilistic approach
Amir-Hossein Karimi, Julius von Kügelgen, Bernhard Schölkopf +1
cs.LGcs.AIstat.MLarXiv:2006.06831v32020Towards Semantic Segmentation of Urban-Scale 3D Point Clouds: A Dataset, Benchmarks and Challenges
Qingyong Hu, Bo Yang, Sheikh Khalid +3
cs.CVcs.AIcs.ROarXiv:2009.03137v32020Discriminative World Models for Web Agents
Kelvin Li, Dhruv Pendharkar, Anish Pahilajani +6
cs.AIcs.LGarXiv:2609.02885v12026Enabling Language Models to Fill in the Blanks
Chris Donahue, Mina Lee, Percy Liang
cs.CLcs.AIcs.LGarXiv:2005.05339v22020HyFlex: A Benchmark Framework for Cross-domain Heuristic Search
Edmund Burke, Tim Curtois, Matthew Hyde +2
cs.AIarXiv:1107.5462v12011In-context Reinforcement Learning with Algorithm Distillation
Michael Laskin, Luyu Wang, Junhyuk Oh +11
cs.LGcs.AIarXiv:2210.14215v12022ToolACE: Winning the Points of LLM Function Calling
Weiwen Liu, Xu Huang, Xingshan Zeng +24
cs.LGcs.AIcs.CLarXiv:2409.00920v22024Case-based Reasoning for Natural Language Queries over Knowledge Bases
Rajarshi Das, Manzil Zaheer, Dung Thai +6
cs.CLcs.AIcs.LGarXiv:2104.08762v22021When to use parametric models in reinforcement learning?
Hado van Hasselt, Matteo Hessel, John Aslanides
cs.LGcs.AIstat.MLarXiv:1906.05243v12019SatCLIP: Global, General-Purpose Location Embeddings with Satellite Imagery
Konstantin Klemmer, Esther Rolf, Caleb Robinson +2
cs.CVcs.AIcs.CYarXiv:2311.17179v32023Distinguish Confusing Law Articles for Legal Judgment Prediction
Nuo Xu, Pinghui Wang, Long Chen +3
cs.CLcs.AIarXiv:2004.02557v32020Beyond Context Windows: Persistent Discovery Context for Data-Centric Agents
Jalal Mahmud
cs.AIcs.IRarXiv:2609.02129v12026RIDE: Rewarding Impact-Driven Exploration for Procedurally-Generated Environments
Roberta Raileanu, Tim Rocktäschel
cs.LGcs.AIarXiv:2002.12292v22020The Off-Switch Game
Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1
cs.AIarXiv:1611.08219v32016Towards Trustworthy Autonomous Robots: An Explainable AI-Based Decision Framework
Cagri Temel
cs.ROcs.AIarXiv:2609.02861v12026Deep Q-Learning based Reinforcement Learning Approach for Network Intrusion Detection
Hooman Alavizadeh, Julian Jang-Jaccard, Hootan Alavizadeh
cs.CRcs.AIarXiv:2111.13978v12021Exploring Large Language Model based Intelligent Agents: Definitions, Methods, and Prospects
Yuheng Cheng, Ceyao Zhang, Zhengwen Zhang +8
cs.AIcs.MAarXiv:2401.03428v12024CBraMod: A Criss-Cross Brain Foundation Model for EEG Decoding
Jiquan Wang, Sha Zhao, Zhiling Luo +5
eess.SPcs.AIcs.LGarXiv:2412.07236v62024Cycle Consistent Adversarial Denoising Network for Multiphase Coronary CT Angiography
Eunhee Kang, Hyun Jung Koo, Dong Hyun Yang +2
cs.CVcs.AIcs.LGarXiv:1806.09748v32018Using Natural Language for Reward Shaping in Reinforcement Learning
Prasoon Goyal, Scott Niekum, Raymond J. Mooney
cs.LGcs.AIstat.MLarXiv:1903.02020v22019Towards a Rigorous Evaluation of XAI Methods on Time Series
Udo Schlegel, Hiba Arnout, Mennatallah El-Assady +2
cs.LGcs.AIarXiv:1909.07082v22019SINE: SINgle Image Editing with Text-to-Image Diffusion Models
Zhixing Zhang, Ligong Han, Arnab Ghosh +2
cs.CVcs.AIarXiv:2212.04489v22022Generative Adversarial Transformers
Drew A. Hudson, C. Lawrence Zitnick
cs.CVcs.AIcs.CLarXiv:2103.01209v42021Alpha-CLIP: A CLIP Model Focusing on Wherever You Want
Zeyi Sun, Ye Fang, Tong Wu +6
cs.CVcs.AIcs.CLarXiv:2312.03818v22023CORA: Adapting CLIP for Open-Vocabulary Detection with Region Prompting and Anchor Pre-Matching
Xiaoshi Wu, Feng Zhu, Rui Zhao +1
cs.CVcs.AIarXiv:2303.13076v12023CGMH: Constrained Sentence Generation by Metropolis-Hastings Sampling
Ning Miao, Hao Zhou, Lili Mou +2
cs.CLcs.AIcs.LGarXiv:1811.10996v12018How do World Models and Policies Compose in LLM Agents? A Joint Spectral and Behavioral Account
Ruize Xu, Xiao Yu, Yujin Tang +2
cs.LGcs.AIcs.CLarXiv:2608.30067v12026Deep Reinforcement Learning for Imbalanced Classification
Enlu Lin, Qiong Chen, Xiaoming Qi
cs.LGcs.AIstat.MLarXiv:1901.01379v12019GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities
Sreyan Ghosh, Sonal Kumar, Ashish Seth +6
cs.SDcs.AIcs.CLarXiv:2406.11768v12024Deep Online Learning via Meta-Learning: Continual Adaptation for Model-Based RL
Anusha Nagabandi, Chelsea Finn, Sergey Levine
cs.LGcs.AIcs.ROarXiv:1812.07671v22018S-LoRA: Serving Thousands of Concurrent LoRA Adapters
Ying Sheng, Shiyi Cao, Dacheng Li +9
cs.LGcs.AIcs.DCarXiv:2311.03285v32023Virtual-Taobao: Virtualizing Real-world Online Retail Environment for Reinforcement Learning
Jing-Cheng Shi, Yang Yu, Qing Da +2
cs.AIarXiv:1805.10000v12018Interactive Gibson Benchmark (iGibson 0.5): A Benchmark for Interactive Navigation in Cluttered Environments
Fei Xia, William B. Shen, Chengshu Li +6
cs.ROcs.AIcs.CVarXiv:1910.14442v32019Explainable AI is Dead, Long Live Explainable AI! Hypothesis-driven decision support
Tim Miller
cs.AIcs.HCarXiv:2302.12389v32023Influence Is Not Authority: When Causal Guardrail Signals Make Legitimate Tool Use Look Like an Attack in Tool-Using LLM Agents
Tanzim Ahad, Ismail Hossain, Md Jahangir Alam +3
cs.CRcs.AIarXiv:2608.29942v12026Double Reinforcement Learning for Efficient Off-Policy Evaluation in Markov Decision Processes
Nathan Kallus, Masatoshi Uehara
cs.LGcs.AIstat.MLarXiv:1908.08526v32019Capacity and Trainability in Recurrent Neural Networks
Jasmine Collins, Jascha Sohl-Dickstein, David Sussillo
stat.MLcs.AIcs.LGarXiv:1611.09913v32016Aff-Wild2: Extending the Aff-Wild Database for Affect Recognition
Dimitrios Kollias, Stefanos Zafeiriou
cs.CVcs.AIcs.LGarXiv:1811.07770v22018EvoPrompt: Connecting LLMs with Evolutionary Algorithms Yields Powerful Prompt Optimizers
Qingyan Guo, Rui Wang, Junliang Guo +6
cs.CLcs.AIarXiv:2309.08532v32023SLCA: Slow Learner with Classifier Alignment for Continual Learning on a Pre-trained Model
Gengwei Zhang, Liyuan Wang, Guoliang Kang +2
cs.CVcs.AIcs.LGarXiv:2303.05118v42023How to Index Item IDs for Recommendation Foundation Models
Wenyue Hua, Shuyuan Xu, Yingqiang Ge +1
cs.IRcs.AIcs.CLarXiv:2305.06569v62023CrossNER: Evaluating Cross-Domain Named Entity Recognition
Zihan Liu, Yan Xu, Tiezheng Yu +5
cs.CLcs.AIarXiv:2012.04373v22020Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning
Jianlan Luo, Charles Xu, Jeffrey Wu +1
cs.ROcs.AIarXiv:2410.21845v32024WMLLM: Self-Evolving Optimization Agents via Predict-Then-Act World Modeling
Zhongzheng Li, Qingsong Ran, Shikun Feng +5
cs.LGcs.AIarXiv:2609.01608v12026MultiGhostBench: A Multilingual Benchmark for Long-Form LLM-Generated Text Attribution under Distribution Shifts
Matteo Greco, Anudeex Shetty, Andrea Tagarelli +1
cs.CLcs.AIcs.CYarXiv:2609.02379v12026Rethinking with Retrieval: Faithful Large Language Model Inference
Hangfeng He, Hongming Zhang, Dan Roth
cs.CLcs.AIarXiv:2301.00303v12022Harms of Gender Exclusivity and Challenges in Non-Binary Representation in Language Technologies
Sunipa Dev, Masoud Monajatipoor, Anaelia Ovalle +3
cs.CLcs.AIcs.LGarXiv:2108.12084v22021Evaluating the Performance of Large Language Models on GAOKAO Benchmark
Xiaotian Zhang, Chunyang Li, Yi Zong +12
cs.CLcs.AIarXiv:2305.12474v42023Knowing Is Not Enough: Information Retrievability as a Precondition to Effective LLM Oversight
Xinyu Fu, Narayan Ramasubbu, Dennis Galletta
cs.HCcs.AIarXiv:2609.01976v12026What Matters in Language Conditioned Robotic Imitation Learning over Unstructured Data
Oier Mees, Lukas Hermann, Wolfram Burgard
cs.ROcs.AIcs.CLarXiv:2204.06252v22022Finding Alignments Between Interpretable Causal Variables and Distributed Neural Representations
Atticus Geiger, Zhengxuan Wu, Christopher Potts +2
cs.AIarXiv:2303.02536v42023HiPoly: a hierarchical polymer-native AI framework for property prediction and generative design
Ge Sun, Gervasio Zaldivar, Yuan Tian +5
physics.chem-phcond-mat.mtrl-scics.AIarXiv:2609.02746v12026A Bi-model based RNN Semantic Frame Parsing Model for Intent Detection and Slot Filling
Yu Wang, Yilin Shen, Hongxia Jin
cs.CLcs.AIcs.LGarXiv:1812.10235v12018EvalDetectBench: A Benchmark for Measuring Evaluation Awareness in Frontier Language Models
Xinning Li, Kemunto Ochwang'i, Aryasomayajula Ram Bharadwaj +2
cs.AIcs.CLarXiv:2609.01611v12026The Prompt Report: A Systematic Survey of Prompt Engineering Techniques
Sander Schulhoff, Michael Ilie, Nishant Balepur +28
cs.CLcs.AIarXiv:2406.06608v62024text2ql: Multi-Target Natural Language Querying via a Language-Agnostic Intermediate Representation
Ritesh Kumar
cs.CLcs.AIcs.DBarXiv:2609.02115v12026Batch Active Learning at Scale
Gui Citovsky, Giulia DeSalvo, Claudio Gentile +4
cs.LGcs.AIarXiv:2107.14263v12021MineTRACE: An Evidence-Grounded Interactive Reasoning System for Mineral Prospectivity
Yiran Zhang, Jinwen Liu, Daniel Su +7
cs.AIarXiv:2609.02060v12026Percolation Dynamics in Optimization : Variance Cascades and Discrete Scale Invariance
Sai Niranjan Ramachandran, Suvrit Sra
cs.LGcond-mat.dis-nncond-mat.stat-mecharXiv:2609.02373v12026