Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,821 to 11,880 of 15,439
LLM-based Agents for Forecasting and Prediction: Methods, Training, Evaluation, and Applications
Xiaogang Xu, Jiaqi Tang, Jianmin Chen +12
cs.AIarXiv:2608.23058v12026HybridStitch: Pixel and Timestep Level Model Stitching for Diffusion Acceleration
Desen Sun, Jason Hon, Jintao Zhang +1
cs.CVcs.AIarXiv:2603.07815v12026Your AI, On a Dial: Controlling Investment Bias in LLMs with a Single Neuron
Sahong Park, Suhwan Park, Hoyoung Lee +8
cs.AIcs.CLq-fin.GNarXiv:2608.22852v12026In-Context Reinforcement Learning for Tool Use in Large Language Models
Yaoqi Ye, Yiran Zhao, Keyu Duan +4
cs.AIarXiv:2603.08068v12026ConvergeFlow: Language Flow with Provable Convergence to Token Embeddings
Na Li, Yuchen Jiao, Changxiao Cai +1
cs.CLcs.AIcs.LGarXiv:2608.23551v12026Robustness Analysis of Agentic AI to Inconsistent and Incomplete Tool Responses
Jiachen Xu, Torben Bach Pedersen, Zhongming Yao +2
cs.AIarXiv:2608.22676v12026Are Video Reasoning Models Ready to Go Outside?
Yangfan He, Changgyu Boo, Jaehong Yoon
cs.CVcs.AIarXiv:2603.10652v32026$V_{0.5}$: Generalist Value Model as a Prior for Sparse RL Rollouts
Yi-Kai Zhang, Yueqing Sun, Hongyan Hao +4
cs.LGcs.AIcs.CLarXiv:2603.10848v12026Think While Watching: Online Streaming Segment-Level Memory for Multi-Turn Video Reasoning in Multimodal Large Language Models
Lu Wang, Zhuoran Jin, Yupu Hao +4
cs.CVcs.AIcs.CLarXiv:2603.11896v12026FINER: MLLMs Hallucinate under Fine-grained Negative Queries
Rui Xiao, Sanghwan Kim, Yongqin Xian +2
cs.CVcs.AIarXiv:2603.17662v12026Ask, Attend and Answer: Exploring Question-Guided Spatial Attention for Visual Question Answering
Huijuan Xu, Kate Saenko
cs.CVcs.AIcs.CLarXiv:1511.05234v22015VisionCoach: Reinforcing Grounded Video Reasoning via Visual-Perception Prompting
Daeun Lee, Shoubin Yu, Yue Zhang +1
cs.CVcs.AIarXiv:2603.14659v22026Power-Performance Characterization of TinyML Systems
Yujie Zhang, Dhananjaya Wijerathne, Zhaoying Li +1
cs.LGcs.AIarXiv:2608.21646v12026Mitigating Object Hallucinations in Large Vision-Language Models through Visual Contrastive Decoding
Sicong Leng, Hang Zhang, Guanzheng Chen +4
cs.CVcs.AIcs.CLarXiv:2311.16922v12023Learning Discourse-level Diversity for Neural Dialog Models using Conditional Variational Autoencoders
Tiancheng Zhao, Ran Zhao, Maxine Eskenazi
cs.CLcs.AIarXiv:1703.10960v32017Efficient Attention: Attention with Linear Complexities
Zhuoran Shen, Mingyuan Zhang, Haiyu Zhao +2
cs.CVcs.AIcs.LGarXiv:1812.01243v102018Alignment Makes Language Models Normative, Not Descriptive
Eilam Shapira, Moshe Tennenholtz, Roi Reichart
cs.CLcs.AIcs.GTarXiv:2603.17218v22026The Retriever Should Remember: Experience-Amortized Reranking for Long-Term Agent Memory
Qi Feng, Chris Ding, Jicong Fan
cs.AIarXiv:2608.22767v12026Using cognitive psychology to understand GPT-3
Marcel Binz, Eric Schulz
cs.CLcs.AIcs.LGarXiv:2206.14576v12022Cheers: Decoupling Patch Details from Semantic Representations Enables Unified Multimodal Comprehension and Generation
Yichen Zhang, Da Peng, Zonghao Guo +19
cs.CVcs.AIarXiv:2603.12793v12026Explaining Explanations in AI
Brent Mittelstadt, Chris Russell, Sandra Wachter
cs.AIarXiv:1811.01439v12018Nudging Hidden States: Training-Free Model Steering for Chain-of-Thought Reasoning in Large Audio-Language Models
Lok-Lam Ieong, Chia-Chien Chen, Chih-Kai Yang +3
cs.SDcs.AIcs.CLarXiv:2603.14636v12026HANSARD: A Reference Architecture for Forensic Readiness, Runtime Witnessing, and Graded Attribution in Autonomous Multi-Agent AI Systems
Christos Sardianos, Iliana Pla, Vasilis Efthymiou +4
cs.AIarXiv:2608.22512v12026FlashSampling: Fast and Memory-Efficient Exact Sampling
Tomas Ruiz, Zhen Qin, Yifan Zhang +3
cs.LGcs.AIcs.CLarXiv:2603.15854v22026DiSAN: Directional Self-Attention Network for RNN/CNN-Free Language Understanding
Tao Shen, Tianyi Zhou, Guodong Long +3
cs.CLcs.AIarXiv:1709.04696v32017Residual Stream Duality in Modern Transformer Architectures
Yifan Zhang
cs.LGcs.AIcs.CLarXiv:2603.16039v22026HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning
Shenzhi Wang, Shixuan Liu, Jing Zhou +8
cs.CVcs.AIcs.CLarXiv:2603.17024v22026Multiscale Switch for Semi-Supervised and Contrastive Learning in Medical Ultrasound Image Segmentation
Jingguo Qu, Xinyang Han, Yao Pu +8
cs.CVcs.AIarXiv:2603.18655v12026Reasoning over mathematical objects: on-policy reward modeling and test time aggregation
Pranjal Aggarwal, Marjan Ghazvininejad, Seungone Kim +18
cs.AIcs.CLarXiv:2603.18886v12026Generalized Discrete Diffusion from Snapshots
Oussama Zekri, Théo Uscidda, Nicolas Boullé +1
stat.MLcs.AIcs.CLarXiv:2603.21342v12026QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation
Ali Slim, Haydar Hamieh, Jawad Kotaich +5
cs.LGcs.AIcs.PLarXiv:2604.08570v22026What Proves You Wrong: Benchmarking Language Models on Falsifiable Research Ideation
Ziyue Wang, Aomufei Yuan, Yiran Yao +10
cs.CLcs.AIarXiv:2608.22948v12026TimeMixer: Decomposable Multiscale Mixing for Time Series Forecasting
Shiyu Wang, Haixu Wu, Xiaoming Shi +5
cs.LGcs.AIarXiv:2405.14616v12024Neural Audio Synthesis of Musical Notes with WaveNet Autoencoders
Jesse Engel, Cinjon Resnick, Adam Roberts +4
cs.LGcs.AIcs.SDarXiv:1704.01279v12017Triplet2Track: A Hierarchical System with Object-Centric Representations for Reliable Long-Horizon Manipulation
Jianxiang Liu, Gaojing Zhang, Chuan Wen +4
cs.ROcs.AIarXiv:2608.22800v12026SA-Net: Shuffle Attention for Deep Convolutional Neural Networks
Qing-Long Zhang Yu-Bin Yang
cs.CVcs.AIarXiv:2102.00240v12021When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning
Zhengxian Wu, Kai Shi, Chuanrui Zhang +10
cs.CVcs.AIarXiv:2603.21289v22026Muse: Text-To-Image Generation via Masked Generative Transformers
Huiwen Chang, Han Zhang, Jarred Barber +9
cs.CVcs.AIcs.LGarXiv:2301.00704v12023Ego2Web: A Web Agent Benchmark Grounded in Egocentric Videos
Shoubin Yu, Lei Shu, Antoine Yang +6
cs.CVcs.AIcs.CLarXiv:2603.22529v12026EVA: Efficient Reinforcement Learning for End-to-End Video Agent
Yaolun Zhang, Ruohui Wang, Jiahao Wang +6
cs.CVcs.AIcs.CLarXiv:2603.22918v22026Neural Probabilistic Logic Programming in DeepProbLog
Robin Manhaeve, Sebastijan Dumančić, Angelika Kimmig +2
cs.AIarXiv:1907.08194v22019The LAMA Planner: Guiding Cost-Based Anytime Planning with Landmarks
Silvia Richter, Matthias Westphal
cs.AIarXiv:1401.3839v12014EEG-Based Emotion Recognition Using Regularized Graph Neural Networks
Peixiang Zhong, Di Wang, Chunyan Miao
cs.CVcs.AIcs.HCarXiv:1907.07835v42019On the Non-decoupling of Supervised Fine-tuning and Reinforcement Learning in Post-training
Xueyan Niu, Bo Bai, Wei Han +1
cs.LGcs.AIcs.ITarXiv:2601.07389v22026On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models
Chongyang Zhao, Mingsong Li, Haodong Lu +1
cs.LGcs.AIarXiv:2603.27481v12026Motion Attribution for Video Generation
Xindi Wu, Despoina Paschalidou, Jun Gao +5
cs.CVcs.AIcs.LGarXiv:2601.08828v22026Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning
Zhiyuan Hu, Yunhai Hu, Juncheng Liu +9
cs.AIcs.CLarXiv:2601.09667v22026Walking on the DARKSIDE
Aldo Gangemi, Emanuele Bottazzi
cs.AIcs.LOarXiv:2608.23370v12026Concepts for Securing Agentic AI Coding and the Terok Environment
Jiří Vyskočil, Franz Pöschel, Andreas Knüpfer
cs.AIcs.SEarXiv:2608.22930v12026CARLA-Air: Fly Drones Inside a CARLA World -- A Unified Infrastructure for Air-Ground Embodied Intelligence
Tianle Zeng, Yanci Wen, Hong Zhang
cs.ROcs.AIcs.CVarXiv:2603.28032v22026GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agents
Yunzhe Wang, Runhui Xu, Kexin Zheng +4
cs.CLcs.AIcs.CVarXiv:2603.24329v22026Proxy reliance in large language model decisions is uncalibrated to predictive evidence
Zengqing Wu, Chuan Xiao
cs.AIcs.CLcs.CYarXiv:2608.22887v12026Cooperative Inverse Reinforcement Learning
Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1
cs.AIarXiv:1606.03137v42016Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints
Gwen Yidou-Weng, Edward Sun, Tianyi Ma +5
cs.ROcs.AIarXiv:2608.22149v12026Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding
Changjiang Jiang, Qiannian Zhao, Lei Xin +3
cs.AIarXiv:2608.22429v12026Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development
Zhongying Deng, Cheng Tang, Ziyan Huang +124
cs.CVcs.AIarXiv:2603.27460v12026Using Large Language Models to Simulate Multiple Humans and Replicate Human Subject Studies
Gati Aher, Rosa I. Arriaga, Adam Tauman Kalai
cs.CLcs.AIcs.LGarXiv:2208.10264v52022Socially Aware Motion Planning with Deep Reinforcement Learning
Yu Fan Chen, Michael Everett, Miao Liu +1
cs.ROcs.AIcs.HCarXiv:1703.08862v22017Multi-Winner Voting with Argumentative Ballots
Ryuta Arisaka, Hirotaka Ono
cs.GTcs.AIarXiv:2608.23247v12026Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI
Santhosh K. Ramakrishnan, Aaron Gokaslan, Erik Wijmans +10
cs.CVcs.AIarXiv:2109.08238v12021