Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,861 to 10,920 of 15,489
Aligning Human Sense: Calibrated Distributional Reward Learning for Video Generation
Nai-Xin Zhai, Weihua Cheng, Dexu Yu +9
cs.CVcs.AIarXiv:2608.21425v12026Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing
Israt Moyeen Noumi, Tarannum Ahmed Nowshin, Md. Mehedi Hasan Nipu +3
cs.CLcs.AIcs.CRarXiv:2608.21423v12026COCO: A Platform for Comparing Continuous Optimizers in a Black-Box Setting
Nikolaus Hansen, Anne Auger, Raymond Ros +3
cs.AIcs.MSmath.NAarXiv:1603.08785v42016Operational digital twin clinics enable task-based evaluation of embodied AI
Xinyuan Wu, Jingrao Zhang, Mengdi Xu +3
cs.ROcs.AIarXiv:2608.21416v12026Mitigating Bias in Large Vision-Language Models via Counterfactual Ensemble Decoding
Yisong Xiao, Aishan Liu, Yongxin Huang +6
cs.CLcs.AIarXiv:2608.21415v12026Constructing Predictive Surgical Path for AI-based Capsulorhexis Skill Transfer
Mohammad Javad Ahmadi, Hamid D. Taghirad
cs.ROcs.AIcs.LGarXiv:2608.21441v12026Deep Decentralized Multi-task Multi-Agent Reinforcement Learning under Partial Observability
Shayegan Omidshafiei, Jason Pazis, Christopher Amato +2
cs.LGcs.AIcs.MAarXiv:1703.06182v42017Essentially No Barriers in Neural Network Energy Landscape
Felix Draxler, Kambis Veschgini, Manfred Salmhofer +1
stat.MLcs.AIcs.LGarXiv:1803.00885v52018Geo-VLA: Geometry-Aware Vision-Language-Action Planning via Internalization of Map Semantics
Ran Chen, Jiaxing Ren, Zhikun Zhang +3
cs.ROcs.AIarXiv:2608.21440v12026Causal Networks: Semantics and Expressiveness
Tom S. Verma, Judea Pearl
cs.AIarXiv:1304.2379v12013When Does AI for PDEs Yield Scientific Evidence?
Wenshuo Wang
cs.AIarXiv:2608.22504v12026LLMs for Survey Text Analysis - A Performance Comparison Between Humans and GPT-5 on Inductive Content Analysis
Leonardo Bergmann, Renata Gheorghiu, Ana Gvritishvili +3
cs.AIcs.CLcs.HCarXiv:2608.22417v12026Multi-Task Learning for Non-Canonical Phoneme Recognition via Articulatory Feature Decomposition
Sophia Riaz, Haoze Zheng, Amos Roche +5
cs.SDcs.AIarXiv:2608.22273v12026CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents
Jiaxuan Luo, Zhanfeng Liao, Jiayao Teng +1
cs.AIarXiv:2608.22577v22026Billion-scale Commodity Embedding for E-commerce Recommendation in Alibaba
Jizhe Wang, Pipei Huang, Huan Zhao +3
cs.IRcs.AIarXiv:1803.02349v22018TorchIO: A Python library for efficient loading, preprocessing, augmentation and patch-based sampling of medical images in deep learning
Fernando Pérez-García, Rachel Sparks, Sébastien Ourselin
eess.IVcs.AIcs.CVarXiv:2003.04696v52020presto: Efficient, Training-free, and Open-world Object Placement via Imaginary Search
Weixuan Ding, Shang Liu, Hanyu Pei +1
cs.CVcs.AIarXiv:2608.21543v12026Macro-Operator Generation and Predicate Selection for TAMP Operator Learning
Can Emir Bora, Emre Ugur
cs.ROcs.AIarXiv:2608.23629v12026Frame-Recurrent Video Super-Resolution
Mehdi S. M. Sajjadi, Raviteja Vemulapalli, Matthew Brown
cs.CVcs.AIstat.MLarXiv:1801.04590v42018Complexity Induction: Compositional Generalization via Structured Label Distortion
Aleksandr Abramov
cs.CVcs.AIcs.LGarXiv:2608.21464v12026Semantic Reasoning Denoising: Correcting Language Model Reasoning with Semantic Operators
Yujiao Yang
cs.CLcs.AIcs.LGarXiv:2608.22090v12026Learning Implicit Constitutive Laws for Dynamic 3D Gaussian Splatting from Monocular Videos
Xiaoyang Liu, Kai Han
cs.CVcs.AIarXiv:2608.22102v12026On the Utility of Learning about Humans for Human-AI Coordination
Micah Carroll, Rohin Shah, Mark K. Ho +4
cs.LGcs.AIcs.HCarXiv:1910.05789v22019Anchoring Bias: A Persistent Fairness Backdoor Attack against MLLMs under Continual Learning
Yuyang Luo, Kai Shu
cs.LGcs.AIarXiv:2608.21577v12026BLIP-Diffusion: Pre-trained Subject Representation for Controllable Text-to-Image Generation and Editing
Dongxu Li, Junnan Li, Steven C. H. Hoi
cs.CVcs.AIarXiv:2305.14720v22023SpAtten: Efficient Sparse Attention Architecture with Cascade Token and Head Pruning
Hanrui Wang, Zhekai Zhang, Song Han
cs.ARcs.AIcs.CLarXiv:2012.09852v32020Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video Models
Yuanhao Ban, Jiaqi Feng, Hengguang Zhou +3
cs.CVcs.AIarXiv:2608.19556v12026An efficient framework for learning sentence representations
Lajanugen Logeswaran, Honglak Lee
cs.CLcs.AIcs.LGarXiv:1803.02893v12018Learning Sequence Encoders for Temporal Knowledge Graph Completion
Alberto García-Durán, Sebastijan Dumančić, Mathias Niepert
cs.AIcs.CLarXiv:1809.03202v12018GPTs are GPTs: An Early Look at the Labor Market Impact Potential of Large Language Models
Tyna Eloundou, Sam Manning, Pamela Mishkin +1
econ.GNcs.AIcs.CYarXiv:2303.10130v52023Variance Driven Exploration: A Provable and Efficient Methodology for Pure Exploration in Highly Stochastic Environments
Khang Luong, Nam Nguyen, Hoang Ta +2
cs.LGcs.AIstat.MLarXiv:2608.21995v12026Multi-attention Recurrent Network for Human Communication Comprehension
Amir Zadeh, Paul Pu Liang, Soujanya Poria +3
cs.AIcs.CLcs.LGarXiv:1802.00923v12018FigmaTrace: Capturing Creative Nuances in Human Figma Design Workflows
Darshan Deshpande, Yoshinari Fujinuma, Martyna Markiewicz +5
cs.CVcs.AIarXiv:2608.21460v12026SynEHR: Joint Modeling Inter-visit Temporal Evolution and Intra-visit Clinical Structure for Longitudinal EHR Synthesis
Ximiao Li, Lin Jiang, Rongchao Xu +3
cs.LGcs.AIarXiv:2608.21673v12026Pruned Traffic Trees: Native Semantic Compression with a Protocol-Structured Model Family for Encrypted Traffic Classification
Yuantu Luo, Jun Tao, Xiangyu Xu +2
cs.NIcs.AIarXiv:2608.21874v12026TASSO: TAsk-Specific Subspace Optimization for Continual Learning of Vision-Language Models
Chang Sun, Francesco Barbato, Matteo Caligiuri +1
cs.CVcs.AIarXiv:2608.21487v12026VoiceMem: Streaming Dual-Brain Memory for Real-Time Interaction
Zhifei Xie, Jiaqi Lang, Ze An +7
eess.AScs.AIcs.IRarXiv:2608.26005v12026Memory-Based Model Editing at Scale
Eric Mitchell, Charles Lin, Antoine Bosselut +2
cs.AIcs.CLarXiv:2206.06520v12022Elastic KV Cache for LLM Serving:A Working Reclamation Mechanism, and Why Chunked Prefill Already Closes the Gap
Sathishkumar Sivashanmugam
cs.ARcs.AIarXiv:2608.23658v12026Learning High-Precision Bounding Box for Rotated Object Detection via Kullback-Leibler Divergence
Xue Yang, Xiaojiang Yang, Jirui Yang +4
cs.CVcs.AIcs.LGarXiv:2106.01883v52021MOMENT: A Family of Open Time-series Foundation Models
Mononito Goswami, Konrad Szafer, Arjun Choudhry +3
cs.LGcs.AIarXiv:2402.03885v32024Text Matching as Image Recognition
Liang Pang, Yanyan Lan, Jiafeng Guo +3
cs.CLcs.AIarXiv:1602.06359v12016CAI-DLLM: Convergence Aware Inference for Diffusion Language Models
Farhana Amin, Sabiha Afroz, Dimitrios S. Nikolopoulos
cs.AIarXiv:2608.22646v12026PatchGate: Narrowing the Verbalization Gap with Intrinsic Object Inventories in Frozen Vision-Language Models
Jihyung Ko, Eunji Jung, Hyeongsub Kim +4
cs.CVcs.AIcs.CLarXiv:2608.21819v12026LiteEvent-AE: Lightweight Autoencoder for Event-Based Vision on Low-Latency Energy-Constrained Edge Devices
Riadul Islam, Joey Mule, Dhandeep Challagundla +3
cs.CVcs.AIeess.IVarXiv:2608.21764v12026How much of a measured AI preference is the model, and how much is the instrument?
Jason Hung
cs.AIarXiv:2608.23641v12026PathVQA: 30000+ Questions for Medical Visual Question Answering
Xuehai He, Yichen Zhang, Luntian Mou +2
cs.CLcs.AIarXiv:2003.10286v12020Single-Image Depth Perception in the Wild
Weifeng Chen, Zhao Fu, Dawei Yang +1
cs.CVcs.AIarXiv:1604.03901v22016A Survey on Conversational Recommender Systems
Dietmar Jannach, Ahtsham Manzoor, Wanling Cai +1
cs.HCcs.AIcs.IRarXiv:2004.00646v22020Efficient and Accurate Estimation of Lipschitz Constants for Deep Neural Networks
Mahyar Fazlyab, Alexander Robey, Hamed Hassani +2
cs.LGcs.AImath.OCarXiv:1906.04893v22019Variational Reasoning for Question Answering with Knowledge Graph
Yuyu Zhang, Hanjun Dai, Zornitsa Kozareva +2
cs.LGcs.AIcs.CLarXiv:1709.04071v52017Constructing Datasets for Multi-hop Reading Comprehension Across Documents
Johannes Welbl, Pontus Stenetorp, Sebastian Riedel
cs.CLcs.AIarXiv:1710.06481v22017SAINT: Improved Neural Networks for Tabular Data via Row Attention and Contrastive Pre-Training
Gowthami Somepalli, Micah Goldblum, Avi Schwarzschild +2
cs.LGcs.AIstat.MLarXiv:2106.01342v12021Sigmoid Attention as a Better Substrate for Learned KV Cache Eviction
Isaac, Li
cs.LGcs.AIarXiv:2608.23296v12026Retrieval-Augmented Classification of Environmental Mitigations in Hydropower Licensing Documents
Hong-Jun Yoon, Tom Ruggles, Joanna Lee +1
cs.IRcs.AIarXiv:2608.23241v12026Hierarchy-Aware Supervised Uncertainty Estimation for Black-box LLM Taxonomic Reasoning
Shuting Xie, Nathaniel Lesperance, Graham W. Taylor
cs.LGcs.AIarXiv:2608.22839v12026EviSafe: Evidence-Grounded Safety Evaluation for Vision-Language Models
Xuetong Li, Gaofeng Liu
cs.AIarXiv:2608.23313v12026Does Rank Still Matter? Position Bias When AI Agents Shop on Our Behalf
Davood Wadi, Yu Ma
cs.AIecon.GNarXiv:2608.22697v12026Explainable Artificial Intelligence (XAI) 2.0: A Manifesto of Open Challenges and Interdisciplinary Research Directions
Luca Longo, Mario Brcic, Federico Cabitza +16
cs.AIarXiv:2310.19775v12023Forgotten in Weights, Recovered by Tools: Agentic Tool Unlearning for LLM Agents
Baicheng Chen, Zheyuan Liu, Jingyu Zhang +4
cs.CLcs.AIarXiv:2608.21544v12026