Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,641 to 11,700 of 15,237

  1. Nudging Hidden States: Training-Free Model Steering for Chain-of-Thought Reasoning in Large Audio-Language Models

    Lok-Lam Ieong, Chia-Chien Chen, Chih-Kai Yang +3

    cs.SDcs.AIcs.CLarXiv:2603.14636v12026
  2. HANSARD: A Reference Architecture for Forensic Readiness, Runtime Witnessing, and Graded Attribution in Autonomous Multi-Agent AI Systems

    Christos Sardianos, Iliana Pla, Vasilis Efthymiou +4

    cs.AIarXiv:2608.22512v12026
  3. FlashSampling: Fast and Memory-Efficient Exact Sampling

    Tomas Ruiz, Zhen Qin, Yifan Zhang +3

    cs.LGcs.AIcs.CLarXiv:2603.15854v22026
  4. DiSAN: Directional Self-Attention Network for RNN/CNN-Free Language Understanding

    Tao Shen, Tianyi Zhou, Guodong Long +3

    cs.CLcs.AIarXiv:1709.04696v32017
  5. Residual Stream Duality in Modern Transformer Architectures

    Yifan Zhang

    cs.LGcs.AIcs.CLarXiv:2603.16039v22026
  6. HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning

    Shenzhi Wang, Shixuan Liu, Jing Zhou +8

    cs.CVcs.AIcs.CLarXiv:2603.17024v22026
  7. Multiscale Switch for Semi-Supervised and Contrastive Learning in Medical Ultrasound Image Segmentation

    Jingguo Qu, Xinyang Han, Yao Pu +8

    cs.CVcs.AIarXiv:2603.18655v12026
  8. Reasoning over mathematical objects: on-policy reward modeling and test time aggregation

    Pranjal Aggarwal, Marjan Ghazvininejad, Seungone Kim +18

    cs.AIcs.CLarXiv:2603.18886v12026
  9. Generalized Discrete Diffusion from Snapshots

    Oussama Zekri, Théo Uscidda, Nicolas Boullé +1

    stat.MLcs.AIcs.CLarXiv:2603.21342v12026
  10. QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation

    Ali Slim, Haydar Hamieh, Jawad Kotaich +5

    cs.LGcs.AIcs.PLarXiv:2604.08570v22026
  11. What Proves You Wrong: Benchmarking Language Models on Falsifiable Research Ideation

    Ziyue Wang, Aomufei Yuan, Yiran Yao +10

    cs.CLcs.AIarXiv:2608.22948v12026
  12. TimeMixer: Decomposable Multiscale Mixing for Time Series Forecasting

    Shiyu Wang, Haixu Wu, Xiaoming Shi +5

    cs.LGcs.AIarXiv:2405.14616v12024
  13. Neural Audio Synthesis of Musical Notes with WaveNet Autoencoders

    Jesse Engel, Cinjon Resnick, Adam Roberts +4

    cs.LGcs.AIcs.SDarXiv:1704.01279v12017
  14. Triplet2Track: A Hierarchical System with Object-Centric Representations for Reliable Long-Horizon Manipulation

    Jianxiang Liu, Gaojing Zhang, Chuan Wen +4

    cs.ROcs.AIarXiv:2608.22800v12026
  15. SA-Net: Shuffle Attention for Deep Convolutional Neural Networks

    Qing-Long Zhang Yu-Bin Yang

    cs.CVcs.AIarXiv:2102.00240v12021
  16. When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning

    Zhengxian Wu, Kai Shi, Chuanrui Zhang +10

    cs.CVcs.AIarXiv:2603.21289v22026
  17. Muse: Text-To-Image Generation via Masked Generative Transformers

    Huiwen Chang, Han Zhang, Jarred Barber +9

    cs.CVcs.AIcs.LGarXiv:2301.00704v12023
  18. Ego2Web: A Web Agent Benchmark Grounded in Egocentric Videos

    Shoubin Yu, Lei Shu, Antoine Yang +6

    cs.CVcs.AIcs.CLarXiv:2603.22529v12026
  19. EVA: Efficient Reinforcement Learning for End-to-End Video Agent

    Yaolun Zhang, Ruohui Wang, Jiahao Wang +6

    cs.CVcs.AIcs.CLarXiv:2603.22918v22026
  20. Neural Probabilistic Logic Programming in DeepProbLog

    Robin Manhaeve, Sebastijan Dumančić, Angelika Kimmig +2

    cs.AIarXiv:1907.08194v22019
  21. The LAMA Planner: Guiding Cost-Based Anytime Planning with Landmarks

    Silvia Richter, Matthias Westphal

    cs.AIarXiv:1401.3839v12014
  22. EEG-Based Emotion Recognition Using Regularized Graph Neural Networks

    Peixiang Zhong, Di Wang, Chunyan Miao

    cs.CVcs.AIcs.HCarXiv:1907.07835v42019
  23. On the Non-decoupling of Supervised Fine-tuning and Reinforcement Learning in Post-training

    Xueyan Niu, Bo Bai, Wei Han +1

    cs.LGcs.AIcs.ITarXiv:2601.07389v22026
  24. On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models

    Chongyang Zhao, Mingsong Li, Haodong Lu +1

    cs.LGcs.AIarXiv:2603.27481v12026
  25. Motion Attribution for Video Generation

    Xindi Wu, Despoina Paschalidou, Jun Gao +5

    cs.CVcs.AIcs.LGarXiv:2601.08828v22026
  26. Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning

    Zhiyuan Hu, Yunhai Hu, Juncheng Liu +9

    cs.AIcs.CLarXiv:2601.09667v22026
  27. Walking on the DARKSIDE

    Aldo Gangemi, Emanuele Bottazzi

    cs.AIcs.LOarXiv:2608.23370v12026
  28. Concepts for Securing Agentic AI Coding and the Terok Environment

    Jiří Vyskočil, Franz Pöschel, Andreas Knüpfer

    cs.AIcs.SEarXiv:2608.22930v12026
  29. CARLA-Air: Fly Drones Inside a CARLA World -- A Unified Infrastructure for Air-Ground Embodied Intelligence

    Tianle Zeng, Yanci Wen, Hong Zhang

    cs.ROcs.AIcs.CVarXiv:2603.28032v22026
  30. GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agents

    Yunzhe Wang, Runhui Xu, Kexin Zheng +4

    cs.CLcs.AIcs.CVarXiv:2603.24329v22026
  31. Proxy reliance in large language model decisions is uncalibrated to predictive evidence

    Zengqing Wu, Chuan Xiao

    cs.AIcs.CLcs.CYarXiv:2608.22887v12026
  32. Cooperative Inverse Reinforcement Learning

    Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1

    cs.AIarXiv:1606.03137v42016
  33. Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

    Gwen Yidou-Weng, Edward Sun, Tianyi Ma +5

    cs.ROcs.AIarXiv:2608.22149v12026
  34. Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding

    Changjiang Jiang, Qiannian Zhao, Lei Xin +3

    cs.AIarXiv:2608.22429v12026
  35. Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development

    Zhongying Deng, Cheng Tang, Ziyan Huang +124

    cs.CVcs.AIarXiv:2603.27460v12026
  36. Using Large Language Models to Simulate Multiple Humans and Replicate Human Subject Studies

    Gati Aher, Rosa I. Arriaga, Adam Tauman Kalai

    cs.CLcs.AIcs.LGarXiv:2208.10264v52022
  37. Socially Aware Motion Planning with Deep Reinforcement Learning

    Yu Fan Chen, Michael Everett, Miao Liu +1

    cs.ROcs.AIcs.HCarXiv:1703.08862v22017
  38. Multi-Winner Voting with Argumentative Ballots

    Ryuta Arisaka, Hirotaka Ono

    cs.GTcs.AIarXiv:2608.23247v12026
  39. Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI

    Santhosh K. Ramakrishnan, Aaron Gokaslan, Erik Wijmans +10

    cs.CVcs.AIarXiv:2109.08238v12021
  40. M^4olGen: Multi-Agent, Multi-Stage Molecular Generation under Precise Multi-Property Constraints

    Yizhan Li, Florence Cloutier, Sifan Wu +5

    cs.AIcs.MAarXiv:2601.10131v22026
  41. WorldFlow3D: Flowing Through 3D Distributions for Unbounded World Generation

    Amogh Joshi, Julian Ost, Felix Heide

    cs.CVcs.AIcs.GRarXiv:2603.29089v12026
  42. Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video

    Mohammad Sadra Rajabi, Aanuoluwapo Ojelade, Sunwook Kim +1

    cs.CVcs.AIcs.CLarXiv:2608.22586v12026
  43. MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models

    Zecheng Tang, Baibei Ji, Ruoxi Sun +7

    cs.CLcs.AIarXiv:2601.11969v22026
  44. ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development

    Jie Yang, Honglin Guo, Li Ji +11

    cs.SEcs.AIcs.CLarXiv:2601.11077v12026
  45. Extend3D: Town-Scale 3D Generation

    Seungwoo Yoon, Jinmo Kim, Jaesik Park

    cs.CVcs.AIarXiv:2603.29387v12026
  46. Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking

    Abdul Ghafoor, Muhammad Arslan Manzoor, Yufang Hou

    cs.CLcs.AIarXiv:2608.23047v12026
  47. Diffusion In Diffusion: Reclaiming Global Coherence in Semi-Autoregressive Diffusion

    Linrui Ma, Yufei Cui, Kai Han +1

    cs.LGcs.AIarXiv:2601.13599v22026
  48. SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support

    Ahnaf Atef Choudhury, Ramkrishna Saha

    cs.CLcs.AIarXiv:2608.22802v12026
  49. TVQA: Localized, Compositional Video Question Answering

    Jie Lei, Licheng Yu, Mohit Bansal +1

    cs.CLcs.AIcs.CVarXiv:1809.01696v22018
  50. Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation

    Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6

    cs.AIcs.CLarXiv:2601.14691v22026
  51. SkillAlchemy: Open-World Agent Skill Creation

    Hengjun Wang, Shuyue Wei, Boyi Liu +2

    cs.AIarXiv:2608.23417v12026
  52. The Responsibility Vacuum: Organizational Failure in Scaled Agent Systems

    Oleg Romanchuk, Roman Bondar

    cs.AIeess.SYarXiv:2601.15059v12026
  53. OpenVision 3: A Family of Unified Visual Encoder for Both Understanding and Generation

    Letian Zhang, Sucheng Ren, Yanqing Liu +9

    eess.IVcs.AIarXiv:2601.15369v22026
  54. SONIC-O1: A Real-World Benchmark for Evaluating Multimodal Large Language Models on Audio-Video Understanding

    Ahmed Y. Radwan, Christos Emmanouilidis, Hina Tabassum +2

    cs.AIcs.CVarXiv:2601.21666v22026
  55. Adaptive Item-based Collaborative Structures via Noise Rescheduling in Diffusion for Generative Recommendation

    Jiaqi Wang, Tianying Liu, Heng Chang +3

    cs.IRcs.AIarXiv:2608.23400v12026
  56. Spanish Pre-trained BERT Model and Evaluation Data

    José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3

    cs.CLcs.AIcs.LGarXiv:2308.02976v12023
  57. SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

    Deyao Hong, Yizhe Chi, Wenyi Li +7

    cs.CLcs.AIcs.SEarXiv:2608.23564v12026
  58. Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains

    Miguel Contreras, Scott Siegel, Subhash Nerella +30

    cs.CLcs.AIarXiv:2608.22622v12026
  59. RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind

    Zhitao He, Zongwei Lyu, Yi R Fung

    cs.CLcs.AIarXiv:2601.15715v32026
  60. SySeVR: A Framework for Using Deep Learning to Detect Software Vulnerabilities

    Zhen Li, Deqing Zou, Shouhuai Xu +3

    cs.LGcs.AIcs.CRarXiv:1807.06756v32018