Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,641 to 11,700 of 15,237
Nudging Hidden States: Training-Free Model Steering for Chain-of-Thought Reasoning in Large Audio-Language Models
Lok-Lam Ieong, Chia-Chien Chen, Chih-Kai Yang +3
cs.SDcs.AIcs.CLarXiv:2603.14636v12026HANSARD: A Reference Architecture for Forensic Readiness, Runtime Witnessing, and Graded Attribution in Autonomous Multi-Agent AI Systems
Christos Sardianos, Iliana Pla, Vasilis Efthymiou +4
cs.AIarXiv:2608.22512v12026FlashSampling: Fast and Memory-Efficient Exact Sampling
Tomas Ruiz, Zhen Qin, Yifan Zhang +3
cs.LGcs.AIcs.CLarXiv:2603.15854v22026DiSAN: Directional Self-Attention Network for RNN/CNN-Free Language Understanding
Tao Shen, Tianyi Zhou, Guodong Long +3
cs.CLcs.AIarXiv:1709.04696v32017Residual Stream Duality in Modern Transformer Architectures
Yifan Zhang
cs.LGcs.AIcs.CLarXiv:2603.16039v22026HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning
Shenzhi Wang, Shixuan Liu, Jing Zhou +8
cs.CVcs.AIcs.CLarXiv:2603.17024v22026Multiscale Switch for Semi-Supervised and Contrastive Learning in Medical Ultrasound Image Segmentation
Jingguo Qu, Xinyang Han, Yao Pu +8
cs.CVcs.AIarXiv:2603.18655v12026Reasoning over mathematical objects: on-policy reward modeling and test time aggregation
Pranjal Aggarwal, Marjan Ghazvininejad, Seungone Kim +18
cs.AIcs.CLarXiv:2603.18886v12026Generalized Discrete Diffusion from Snapshots
Oussama Zekri, Théo Uscidda, Nicolas Boullé +1
stat.MLcs.AIcs.CLarXiv:2603.21342v12026QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation
Ali Slim, Haydar Hamieh, Jawad Kotaich +5
cs.LGcs.AIcs.PLarXiv:2604.08570v22026What Proves You Wrong: Benchmarking Language Models on Falsifiable Research Ideation
Ziyue Wang, Aomufei Yuan, Yiran Yao +10
cs.CLcs.AIarXiv:2608.22948v12026TimeMixer: Decomposable Multiscale Mixing for Time Series Forecasting
Shiyu Wang, Haixu Wu, Xiaoming Shi +5
cs.LGcs.AIarXiv:2405.14616v12024Neural Audio Synthesis of Musical Notes with WaveNet Autoencoders
Jesse Engel, Cinjon Resnick, Adam Roberts +4
cs.LGcs.AIcs.SDarXiv:1704.01279v12017Triplet2Track: A Hierarchical System with Object-Centric Representations for Reliable Long-Horizon Manipulation
Jianxiang Liu, Gaojing Zhang, Chuan Wen +4
cs.ROcs.AIarXiv:2608.22800v12026SA-Net: Shuffle Attention for Deep Convolutional Neural Networks
Qing-Long Zhang Yu-Bin Yang
cs.CVcs.AIarXiv:2102.00240v12021When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning
Zhengxian Wu, Kai Shi, Chuanrui Zhang +10
cs.CVcs.AIarXiv:2603.21289v22026Muse: Text-To-Image Generation via Masked Generative Transformers
Huiwen Chang, Han Zhang, Jarred Barber +9
cs.CVcs.AIcs.LGarXiv:2301.00704v12023Ego2Web: A Web Agent Benchmark Grounded in Egocentric Videos
Shoubin Yu, Lei Shu, Antoine Yang +6
cs.CVcs.AIcs.CLarXiv:2603.22529v12026EVA: Efficient Reinforcement Learning for End-to-End Video Agent
Yaolun Zhang, Ruohui Wang, Jiahao Wang +6
cs.CVcs.AIcs.CLarXiv:2603.22918v22026Neural Probabilistic Logic Programming in DeepProbLog
Robin Manhaeve, Sebastijan Dumančić, Angelika Kimmig +2
cs.AIarXiv:1907.08194v22019The LAMA Planner: Guiding Cost-Based Anytime Planning with Landmarks
Silvia Richter, Matthias Westphal
cs.AIarXiv:1401.3839v12014EEG-Based Emotion Recognition Using Regularized Graph Neural Networks
Peixiang Zhong, Di Wang, Chunyan Miao
cs.CVcs.AIcs.HCarXiv:1907.07835v42019On the Non-decoupling of Supervised Fine-tuning and Reinforcement Learning in Post-training
Xueyan Niu, Bo Bai, Wei Han +1
cs.LGcs.AIcs.ITarXiv:2601.07389v22026On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models
Chongyang Zhao, Mingsong Li, Haodong Lu +1
cs.LGcs.AIarXiv:2603.27481v12026Motion Attribution for Video Generation
Xindi Wu, Despoina Paschalidou, Jun Gao +5
cs.CVcs.AIcs.LGarXiv:2601.08828v22026Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning
Zhiyuan Hu, Yunhai Hu, Juncheng Liu +9
cs.AIcs.CLarXiv:2601.09667v22026Walking on the DARKSIDE
Aldo Gangemi, Emanuele Bottazzi
cs.AIcs.LOarXiv:2608.23370v12026Concepts for Securing Agentic AI Coding and the Terok Environment
Jiří Vyskočil, Franz Pöschel, Andreas Knüpfer
cs.AIcs.SEarXiv:2608.22930v12026CARLA-Air: Fly Drones Inside a CARLA World -- A Unified Infrastructure for Air-Ground Embodied Intelligence
Tianle Zeng, Yanci Wen, Hong Zhang
cs.ROcs.AIcs.CVarXiv:2603.28032v22026GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agents
Yunzhe Wang, Runhui Xu, Kexin Zheng +4
cs.CLcs.AIcs.CVarXiv:2603.24329v22026Proxy reliance in large language model decisions is uncalibrated to predictive evidence
Zengqing Wu, Chuan Xiao
cs.AIcs.CLcs.CYarXiv:2608.22887v12026Cooperative Inverse Reinforcement Learning
Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1
cs.AIarXiv:1606.03137v42016Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints
Gwen Yidou-Weng, Edward Sun, Tianyi Ma +5
cs.ROcs.AIarXiv:2608.22149v12026Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding
Changjiang Jiang, Qiannian Zhao, Lei Xin +3
cs.AIarXiv:2608.22429v12026Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development
Zhongying Deng, Cheng Tang, Ziyan Huang +124
cs.CVcs.AIarXiv:2603.27460v12026Using Large Language Models to Simulate Multiple Humans and Replicate Human Subject Studies
Gati Aher, Rosa I. Arriaga, Adam Tauman Kalai
cs.CLcs.AIcs.LGarXiv:2208.10264v52022Socially Aware Motion Planning with Deep Reinforcement Learning
Yu Fan Chen, Michael Everett, Miao Liu +1
cs.ROcs.AIcs.HCarXiv:1703.08862v22017Multi-Winner Voting with Argumentative Ballots
Ryuta Arisaka, Hirotaka Ono
cs.GTcs.AIarXiv:2608.23247v12026Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI
Santhosh K. Ramakrishnan, Aaron Gokaslan, Erik Wijmans +10
cs.CVcs.AIarXiv:2109.08238v12021M^4olGen: Multi-Agent, Multi-Stage Molecular Generation under Precise Multi-Property Constraints
Yizhan Li, Florence Cloutier, Sifan Wu +5
cs.AIcs.MAarXiv:2601.10131v22026WorldFlow3D: Flowing Through 3D Distributions for Unbounded World Generation
Amogh Joshi, Julian Ost, Felix Heide
cs.CVcs.AIcs.GRarXiv:2603.29089v12026Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video
Mohammad Sadra Rajabi, Aanuoluwapo Ojelade, Sunwook Kim +1
cs.CVcs.AIcs.CLarXiv:2608.22586v12026MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
Zecheng Tang, Baibei Ji, Ruoxi Sun +7
cs.CLcs.AIarXiv:2601.11969v22026ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
Jie Yang, Honglin Guo, Li Ji +11
cs.SEcs.AIcs.CLarXiv:2601.11077v12026Extend3D: Town-Scale 3D Generation
Seungwoo Yoon, Jinmo Kim, Jaesik Park
cs.CVcs.AIarXiv:2603.29387v12026Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking
Abdul Ghafoor, Muhammad Arslan Manzoor, Yufang Hou
cs.CLcs.AIarXiv:2608.23047v12026Diffusion In Diffusion: Reclaiming Global Coherence in Semi-Autoregressive Diffusion
Linrui Ma, Yufei Cui, Kai Han +1
cs.LGcs.AIarXiv:2601.13599v22026SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support
Ahnaf Atef Choudhury, Ramkrishna Saha
cs.CLcs.AIarXiv:2608.22802v12026TVQA: Localized, Compositional Video Question Answering
Jie Lei, Licheng Yu, Mohit Bansal +1
cs.CLcs.AIcs.CVarXiv:1809.01696v22018Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6
cs.AIcs.CLarXiv:2601.14691v22026SkillAlchemy: Open-World Agent Skill Creation
Hengjun Wang, Shuyue Wei, Boyi Liu +2
cs.AIarXiv:2608.23417v12026The Responsibility Vacuum: Organizational Failure in Scaled Agent Systems
Oleg Romanchuk, Roman Bondar
cs.AIeess.SYarXiv:2601.15059v12026OpenVision 3: A Family of Unified Visual Encoder for Both Understanding and Generation
Letian Zhang, Sucheng Ren, Yanqing Liu +9
eess.IVcs.AIarXiv:2601.15369v22026SONIC-O1: A Real-World Benchmark for Evaluating Multimodal Large Language Models on Audio-Video Understanding
Ahmed Y. Radwan, Christos Emmanouilidis, Hina Tabassum +2
cs.AIcs.CVarXiv:2601.21666v22026Adaptive Item-based Collaborative Structures via Noise Rescheduling in Diffusion for Generative Recommendation
Jiaqi Wang, Tianying Liu, Heng Chang +3
cs.IRcs.AIarXiv:2608.23400v12026Spanish Pre-trained BERT Model and Evaluation Data
José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3
cs.CLcs.AIcs.LGarXiv:2308.02976v12023SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?
Deyao Hong, Yizhe Chi, Wenyi Li +7
cs.CLcs.AIcs.SEarXiv:2608.23564v12026Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains
Miguel Contreras, Scott Siegel, Subhash Nerella +30
cs.CLcs.AIarXiv:2608.22622v12026RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind
Zhitao He, Zongwei Lyu, Yi R Fung
cs.CLcs.AIarXiv:2601.15715v32026SySeVR: A Framework for Using Deep Learning to Detect Software Vulnerabilities
Zhen Li, Deqing Zou, Shouhuai Xu +3
cs.LGcs.AIcs.CRarXiv:1807.06756v32018