Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,861 to 10,920 of 15,489

  1. Aligning Human Sense: Calibrated Distributional Reward Learning for Video Generation

    Nai-Xin Zhai, Weihua Cheng, Dexu Yu +9

    cs.CVcs.AIarXiv:2608.21425v12026
  2. Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing

    Israt Moyeen Noumi, Tarannum Ahmed Nowshin, Md. Mehedi Hasan Nipu +3

    cs.CLcs.AIcs.CRarXiv:2608.21423v12026
  3. COCO: A Platform for Comparing Continuous Optimizers in a Black-Box Setting

    Nikolaus Hansen, Anne Auger, Raymond Ros +3

    cs.AIcs.MSmath.NAarXiv:1603.08785v42016
  4. Operational digital twin clinics enable task-based evaluation of embodied AI

    Xinyuan Wu, Jingrao Zhang, Mengdi Xu +3

    cs.ROcs.AIarXiv:2608.21416v12026
  5. Mitigating Bias in Large Vision-Language Models via Counterfactual Ensemble Decoding

    Yisong Xiao, Aishan Liu, Yongxin Huang +6

    cs.CLcs.AIarXiv:2608.21415v12026
  6. Constructing Predictive Surgical Path for AI-based Capsulorhexis Skill Transfer

    Mohammad Javad Ahmadi, Hamid D. Taghirad

    cs.ROcs.AIcs.LGarXiv:2608.21441v12026
  7. Deep Decentralized Multi-task Multi-Agent Reinforcement Learning under Partial Observability

    Shayegan Omidshafiei, Jason Pazis, Christopher Amato +2

    cs.LGcs.AIcs.MAarXiv:1703.06182v42017
  8. Essentially No Barriers in Neural Network Energy Landscape

    Felix Draxler, Kambis Veschgini, Manfred Salmhofer +1

    stat.MLcs.AIcs.LGarXiv:1803.00885v52018
  9. Geo-VLA: Geometry-Aware Vision-Language-Action Planning via Internalization of Map Semantics

    Ran Chen, Jiaxing Ren, Zhikun Zhang +3

    cs.ROcs.AIarXiv:2608.21440v12026
  10. Causal Networks: Semantics and Expressiveness

    Tom S. Verma, Judea Pearl

    cs.AIarXiv:1304.2379v12013
  11. When Does AI for PDEs Yield Scientific Evidence?

    Wenshuo Wang

    cs.AIarXiv:2608.22504v12026
  12. LLMs for Survey Text Analysis - A Performance Comparison Between Humans and GPT-5 on Inductive Content Analysis

    Leonardo Bergmann, Renata Gheorghiu, Ana Gvritishvili +3

    cs.AIcs.CLcs.HCarXiv:2608.22417v12026
  13. Multi-Task Learning for Non-Canonical Phoneme Recognition via Articulatory Feature Decomposition

    Sophia Riaz, Haoze Zheng, Amos Roche +5

    cs.SDcs.AIarXiv:2608.22273v12026
  14. CausalCache: Conditional High-Fidelity Restoration for Long-Horizon GUI Agents

    Jiaxuan Luo, Zhanfeng Liao, Jiayao Teng +1

    cs.AIarXiv:2608.22577v22026
  15. Billion-scale Commodity Embedding for E-commerce Recommendation in Alibaba

    Jizhe Wang, Pipei Huang, Huan Zhao +3

    cs.IRcs.AIarXiv:1803.02349v22018
  16. TorchIO: A Python library for efficient loading, preprocessing, augmentation and patch-based sampling of medical images in deep learning

    Fernando Pérez-García, Rachel Sparks, Sébastien Ourselin

    eess.IVcs.AIcs.CVarXiv:2003.04696v52020
  17. presto: Efficient, Training-free, and Open-world Object Placement via Imaginary Search

    Weixuan Ding, Shang Liu, Hanyu Pei +1

    cs.CVcs.AIarXiv:2608.21543v12026
  18. Macro-Operator Generation and Predicate Selection for TAMP Operator Learning

    Can Emir Bora, Emre Ugur

    cs.ROcs.AIarXiv:2608.23629v12026
  19. Frame-Recurrent Video Super-Resolution

    Mehdi S. M. Sajjadi, Raviteja Vemulapalli, Matthew Brown

    cs.CVcs.AIstat.MLarXiv:1801.04590v42018
  20. Complexity Induction: Compositional Generalization via Structured Label Distortion

    Aleksandr Abramov

    cs.CVcs.AIcs.LGarXiv:2608.21464v12026
  21. Semantic Reasoning Denoising: Correcting Language Model Reasoning with Semantic Operators

    Yujiao Yang

    cs.CLcs.AIcs.LGarXiv:2608.22090v12026
  22. Learning Implicit Constitutive Laws for Dynamic 3D Gaussian Splatting from Monocular Videos

    Xiaoyang Liu, Kai Han

    cs.CVcs.AIarXiv:2608.22102v12026
  23. On the Utility of Learning about Humans for Human-AI Coordination

    Micah Carroll, Rohin Shah, Mark K. Ho +4

    cs.LGcs.AIcs.HCarXiv:1910.05789v22019
  24. Anchoring Bias: A Persistent Fairness Backdoor Attack against MLLMs under Continual Learning

    Yuyang Luo, Kai Shu

    cs.LGcs.AIarXiv:2608.21577v12026
  25. BLIP-Diffusion: Pre-trained Subject Representation for Controllable Text-to-Image Generation and Editing

    Dongxu Li, Junnan Li, Steven C. H. Hoi

    cs.CVcs.AIarXiv:2305.14720v22023
  26. SpAtten: Efficient Sparse Attention Architecture with Cascade Token and Head Pruning

    Hanrui Wang, Zhekai Zhang, Song Han

    cs.ARcs.AIcs.CLarXiv:2012.09852v32020
  27. Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video Models

    Yuanhao Ban, Jiaqi Feng, Hengguang Zhou +3

    cs.CVcs.AIarXiv:2608.19556v12026
  28. An efficient framework for learning sentence representations

    Lajanugen Logeswaran, Honglak Lee

    cs.CLcs.AIcs.LGarXiv:1803.02893v12018
  29. Learning Sequence Encoders for Temporal Knowledge Graph Completion

    Alberto García-Durán, Sebastijan Dumančić, Mathias Niepert

    cs.AIcs.CLarXiv:1809.03202v12018
  30. GPTs are GPTs: An Early Look at the Labor Market Impact Potential of Large Language Models

    Tyna Eloundou, Sam Manning, Pamela Mishkin +1

    econ.GNcs.AIcs.CYarXiv:2303.10130v52023
  31. Variance Driven Exploration: A Provable and Efficient Methodology for Pure Exploration in Highly Stochastic Environments

    Khang Luong, Nam Nguyen, Hoang Ta +2

    cs.LGcs.AIstat.MLarXiv:2608.21995v12026
  32. Multi-attention Recurrent Network for Human Communication Comprehension

    Amir Zadeh, Paul Pu Liang, Soujanya Poria +3

    cs.AIcs.CLcs.LGarXiv:1802.00923v12018
  33. FigmaTrace: Capturing Creative Nuances in Human Figma Design Workflows

    Darshan Deshpande, Yoshinari Fujinuma, Martyna Markiewicz +5

    cs.CVcs.AIarXiv:2608.21460v12026
  34. SynEHR: Joint Modeling Inter-visit Temporal Evolution and Intra-visit Clinical Structure for Longitudinal EHR Synthesis

    Ximiao Li, Lin Jiang, Rongchao Xu +3

    cs.LGcs.AIarXiv:2608.21673v12026
  35. Pruned Traffic Trees: Native Semantic Compression with a Protocol-Structured Model Family for Encrypted Traffic Classification

    Yuantu Luo, Jun Tao, Xiangyu Xu +2

    cs.NIcs.AIarXiv:2608.21874v12026
  36. TASSO: TAsk-Specific Subspace Optimization for Continual Learning of Vision-Language Models

    Chang Sun, Francesco Barbato, Matteo Caligiuri +1

    cs.CVcs.AIarXiv:2608.21487v12026
  37. VoiceMem: Streaming Dual-Brain Memory for Real-Time Interaction

    Zhifei Xie, Jiaqi Lang, Ze An +7

    eess.AScs.AIcs.IRarXiv:2608.26005v12026
  38. Memory-Based Model Editing at Scale

    Eric Mitchell, Charles Lin, Antoine Bosselut +2

    cs.AIcs.CLarXiv:2206.06520v12022
  39. Elastic KV Cache for LLM Serving:A Working Reclamation Mechanism, and Why Chunked Prefill Already Closes the Gap

    Sathishkumar Sivashanmugam

    cs.ARcs.AIarXiv:2608.23658v12026
  40. Learning High-Precision Bounding Box for Rotated Object Detection via Kullback-Leibler Divergence

    Xue Yang, Xiaojiang Yang, Jirui Yang +4

    cs.CVcs.AIcs.LGarXiv:2106.01883v52021
  41. MOMENT: A Family of Open Time-series Foundation Models

    Mononito Goswami, Konrad Szafer, Arjun Choudhry +3

    cs.LGcs.AIarXiv:2402.03885v32024
  42. Text Matching as Image Recognition

    Liang Pang, Yanyan Lan, Jiafeng Guo +3

    cs.CLcs.AIarXiv:1602.06359v12016
  43. CAI-DLLM: Convergence Aware Inference for Diffusion Language Models

    Farhana Amin, Sabiha Afroz, Dimitrios S. Nikolopoulos

    cs.AIarXiv:2608.22646v12026
  44. PatchGate: Narrowing the Verbalization Gap with Intrinsic Object Inventories in Frozen Vision-Language Models

    Jihyung Ko, Eunji Jung, Hyeongsub Kim +4

    cs.CVcs.AIcs.CLarXiv:2608.21819v12026
  45. LiteEvent-AE: Lightweight Autoencoder for Event-Based Vision on Low-Latency Energy-Constrained Edge Devices

    Riadul Islam, Joey Mule, Dhandeep Challagundla +3

    cs.CVcs.AIeess.IVarXiv:2608.21764v12026
  46. How much of a measured AI preference is the model, and how much is the instrument?

    Jason Hung

    cs.AIarXiv:2608.23641v12026
  47. PathVQA: 30000+ Questions for Medical Visual Question Answering

    Xuehai He, Yichen Zhang, Luntian Mou +2

    cs.CLcs.AIarXiv:2003.10286v12020
  48. Single-Image Depth Perception in the Wild

    Weifeng Chen, Zhao Fu, Dawei Yang +1

    cs.CVcs.AIarXiv:1604.03901v22016
  49. A Survey on Conversational Recommender Systems

    Dietmar Jannach, Ahtsham Manzoor, Wanling Cai +1

    cs.HCcs.AIcs.IRarXiv:2004.00646v22020
  50. Efficient and Accurate Estimation of Lipschitz Constants for Deep Neural Networks

    Mahyar Fazlyab, Alexander Robey, Hamed Hassani +2

    cs.LGcs.AImath.OCarXiv:1906.04893v22019
  51. Variational Reasoning for Question Answering with Knowledge Graph

    Yuyu Zhang, Hanjun Dai, Zornitsa Kozareva +2

    cs.LGcs.AIcs.CLarXiv:1709.04071v52017
  52. Constructing Datasets for Multi-hop Reading Comprehension Across Documents

    Johannes Welbl, Pontus Stenetorp, Sebastian Riedel

    cs.CLcs.AIarXiv:1710.06481v22017
  53. SAINT: Improved Neural Networks for Tabular Data via Row Attention and Contrastive Pre-Training

    Gowthami Somepalli, Micah Goldblum, Avi Schwarzschild +2

    cs.LGcs.AIstat.MLarXiv:2106.01342v12021
  54. Sigmoid Attention as a Better Substrate for Learned KV Cache Eviction

    Isaac, Li

    cs.LGcs.AIarXiv:2608.23296v12026
  55. Retrieval-Augmented Classification of Environmental Mitigations in Hydropower Licensing Documents

    Hong-Jun Yoon, Tom Ruggles, Joanna Lee +1

    cs.IRcs.AIarXiv:2608.23241v12026
  56. Hierarchy-Aware Supervised Uncertainty Estimation for Black-box LLM Taxonomic Reasoning

    Shuting Xie, Nathaniel Lesperance, Graham W. Taylor

    cs.LGcs.AIarXiv:2608.22839v12026
  57. EviSafe: Evidence-Grounded Safety Evaluation for Vision-Language Models

    Xuetong Li, Gaofeng Liu

    cs.AIarXiv:2608.23313v12026
  58. Does Rank Still Matter? Position Bias When AI Agents Shop on Our Behalf

    Davood Wadi, Yu Ma

    cs.AIecon.GNarXiv:2608.22697v12026
  59. Explainable Artificial Intelligence (XAI) 2.0: A Manifesto of Open Challenges and Interdisciplinary Research Directions

    Luca Longo, Mario Brcic, Federico Cabitza +16

    cs.AIarXiv:2310.19775v12023
  60. Forgotten in Weights, Recovered by Tools: Agentic Tool Unlearning for LLM Agents

    Baicheng Chen, Zheyuan Liu, Jingyu Zhang +4

    cs.CLcs.AIarXiv:2608.21544v12026