Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,821 to 11,880 of 15,439

  1. LLM-based Agents for Forecasting and Prediction: Methods, Training, Evaluation, and Applications

    Xiaogang Xu, Jiaqi Tang, Jianmin Chen +12

    cs.AIarXiv:2608.23058v12026
  2. HybridStitch: Pixel and Timestep Level Model Stitching for Diffusion Acceleration

    Desen Sun, Jason Hon, Jintao Zhang +1

    cs.CVcs.AIarXiv:2603.07815v12026
  3. Your AI, On a Dial: Controlling Investment Bias in LLMs with a Single Neuron

    Sahong Park, Suhwan Park, Hoyoung Lee +8

    cs.AIcs.CLq-fin.GNarXiv:2608.22852v12026
  4. In-Context Reinforcement Learning for Tool Use in Large Language Models

    Yaoqi Ye, Yiran Zhao, Keyu Duan +4

    cs.AIarXiv:2603.08068v12026
  5. ConvergeFlow: Language Flow with Provable Convergence to Token Embeddings

    Na Li, Yuchen Jiao, Changxiao Cai +1

    cs.CLcs.AIcs.LGarXiv:2608.23551v12026
  6. Robustness Analysis of Agentic AI to Inconsistent and Incomplete Tool Responses

    Jiachen Xu, Torben Bach Pedersen, Zhongming Yao +2

    cs.AIarXiv:2608.22676v12026
  7. Are Video Reasoning Models Ready to Go Outside?

    Yangfan He, Changgyu Boo, Jaehong Yoon

    cs.CVcs.AIarXiv:2603.10652v32026
  8. $V_{0.5}$: Generalist Value Model as a Prior for Sparse RL Rollouts

    Yi-Kai Zhang, Yueqing Sun, Hongyan Hao +4

    cs.LGcs.AIcs.CLarXiv:2603.10848v12026
  9. Think While Watching: Online Streaming Segment-Level Memory for Multi-Turn Video Reasoning in Multimodal Large Language Models

    Lu Wang, Zhuoran Jin, Yupu Hao +4

    cs.CVcs.AIcs.CLarXiv:2603.11896v12026
  10. FINER: MLLMs Hallucinate under Fine-grained Negative Queries

    Rui Xiao, Sanghwan Kim, Yongqin Xian +2

    cs.CVcs.AIarXiv:2603.17662v12026
  11. Ask, Attend and Answer: Exploring Question-Guided Spatial Attention for Visual Question Answering

    Huijuan Xu, Kate Saenko

    cs.CVcs.AIcs.CLarXiv:1511.05234v22015
  12. VisionCoach: Reinforcing Grounded Video Reasoning via Visual-Perception Prompting

    Daeun Lee, Shoubin Yu, Yue Zhang +1

    cs.CVcs.AIarXiv:2603.14659v22026
  13. Power-Performance Characterization of TinyML Systems

    Yujie Zhang, Dhananjaya Wijerathne, Zhaoying Li +1

    cs.LGcs.AIarXiv:2608.21646v12026
  14. Mitigating Object Hallucinations in Large Vision-Language Models through Visual Contrastive Decoding

    Sicong Leng, Hang Zhang, Guanzheng Chen +4

    cs.CVcs.AIcs.CLarXiv:2311.16922v12023
  15. Learning Discourse-level Diversity for Neural Dialog Models using Conditional Variational Autoencoders

    Tiancheng Zhao, Ran Zhao, Maxine Eskenazi

    cs.CLcs.AIarXiv:1703.10960v32017
  16. Efficient Attention: Attention with Linear Complexities

    Zhuoran Shen, Mingyuan Zhang, Haiyu Zhao +2

    cs.CVcs.AIcs.LGarXiv:1812.01243v102018
  17. Alignment Makes Language Models Normative, Not Descriptive

    Eilam Shapira, Moshe Tennenholtz, Roi Reichart

    cs.CLcs.AIcs.GTarXiv:2603.17218v22026
  18. The Retriever Should Remember: Experience-Amortized Reranking for Long-Term Agent Memory

    Qi Feng, Chris Ding, Jicong Fan

    cs.AIarXiv:2608.22767v12026
  19. Using cognitive psychology to understand GPT-3

    Marcel Binz, Eric Schulz

    cs.CLcs.AIcs.LGarXiv:2206.14576v12022
  20. Cheers: Decoupling Patch Details from Semantic Representations Enables Unified Multimodal Comprehension and Generation

    Yichen Zhang, Da Peng, Zonghao Guo +19

    cs.CVcs.AIarXiv:2603.12793v12026
  21. Explaining Explanations in AI

    Brent Mittelstadt, Chris Russell, Sandra Wachter

    cs.AIarXiv:1811.01439v12018
  22. Nudging Hidden States: Training-Free Model Steering for Chain-of-Thought Reasoning in Large Audio-Language Models

    Lok-Lam Ieong, Chia-Chien Chen, Chih-Kai Yang +3

    cs.SDcs.AIcs.CLarXiv:2603.14636v12026
  23. HANSARD: A Reference Architecture for Forensic Readiness, Runtime Witnessing, and Graded Attribution in Autonomous Multi-Agent AI Systems

    Christos Sardianos, Iliana Pla, Vasilis Efthymiou +4

    cs.AIarXiv:2608.22512v12026
  24. FlashSampling: Fast and Memory-Efficient Exact Sampling

    Tomas Ruiz, Zhen Qin, Yifan Zhang +3

    cs.LGcs.AIcs.CLarXiv:2603.15854v22026
  25. DiSAN: Directional Self-Attention Network for RNN/CNN-Free Language Understanding

    Tao Shen, Tianyi Zhou, Guodong Long +3

    cs.CLcs.AIarXiv:1709.04696v32017
  26. Residual Stream Duality in Modern Transformer Architectures

    Yifan Zhang

    cs.LGcs.AIcs.CLarXiv:2603.16039v22026
  27. HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning

    Shenzhi Wang, Shixuan Liu, Jing Zhou +8

    cs.CVcs.AIcs.CLarXiv:2603.17024v22026
  28. Multiscale Switch for Semi-Supervised and Contrastive Learning in Medical Ultrasound Image Segmentation

    Jingguo Qu, Xinyang Han, Yao Pu +8

    cs.CVcs.AIarXiv:2603.18655v12026
  29. Reasoning over mathematical objects: on-policy reward modeling and test time aggregation

    Pranjal Aggarwal, Marjan Ghazvininejad, Seungone Kim +18

    cs.AIcs.CLarXiv:2603.18886v12026
  30. Generalized Discrete Diffusion from Snapshots

    Oussama Zekri, Théo Uscidda, Nicolas Boullé +1

    stat.MLcs.AIcs.CLarXiv:2603.21342v12026
  31. QuanBench+: A Unified Multi-Framework Benchmark for LLM-Based Quantum Code Generation

    Ali Slim, Haydar Hamieh, Jawad Kotaich +5

    cs.LGcs.AIcs.PLarXiv:2604.08570v22026
  32. What Proves You Wrong: Benchmarking Language Models on Falsifiable Research Ideation

    Ziyue Wang, Aomufei Yuan, Yiran Yao +10

    cs.CLcs.AIarXiv:2608.22948v12026
  33. TimeMixer: Decomposable Multiscale Mixing for Time Series Forecasting

    Shiyu Wang, Haixu Wu, Xiaoming Shi +5

    cs.LGcs.AIarXiv:2405.14616v12024
  34. Neural Audio Synthesis of Musical Notes with WaveNet Autoencoders

    Jesse Engel, Cinjon Resnick, Adam Roberts +4

    cs.LGcs.AIcs.SDarXiv:1704.01279v12017
  35. Triplet2Track: A Hierarchical System with Object-Centric Representations for Reliable Long-Horizon Manipulation

    Jianxiang Liu, Gaojing Zhang, Chuan Wen +4

    cs.ROcs.AIarXiv:2608.22800v12026
  36. SA-Net: Shuffle Attention for Deep Convolutional Neural Networks

    Qing-Long Zhang Yu-Bin Yang

    cs.CVcs.AIarXiv:2102.00240v12021
  37. When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning

    Zhengxian Wu, Kai Shi, Chuanrui Zhang +10

    cs.CVcs.AIarXiv:2603.21289v22026
  38. Muse: Text-To-Image Generation via Masked Generative Transformers

    Huiwen Chang, Han Zhang, Jarred Barber +9

    cs.CVcs.AIcs.LGarXiv:2301.00704v12023
  39. Ego2Web: A Web Agent Benchmark Grounded in Egocentric Videos

    Shoubin Yu, Lei Shu, Antoine Yang +6

    cs.CVcs.AIcs.CLarXiv:2603.22529v12026
  40. EVA: Efficient Reinforcement Learning for End-to-End Video Agent

    Yaolun Zhang, Ruohui Wang, Jiahao Wang +6

    cs.CVcs.AIcs.CLarXiv:2603.22918v22026
  41. Neural Probabilistic Logic Programming in DeepProbLog

    Robin Manhaeve, Sebastijan Dumančić, Angelika Kimmig +2

    cs.AIarXiv:1907.08194v22019
  42. The LAMA Planner: Guiding Cost-Based Anytime Planning with Landmarks

    Silvia Richter, Matthias Westphal

    cs.AIarXiv:1401.3839v12014
  43. EEG-Based Emotion Recognition Using Regularized Graph Neural Networks

    Peixiang Zhong, Di Wang, Chunyan Miao

    cs.CVcs.AIcs.HCarXiv:1907.07835v42019
  44. On the Non-decoupling of Supervised Fine-tuning and Reinforcement Learning in Post-training

    Xueyan Niu, Bo Bai, Wei Han +1

    cs.LGcs.AIcs.ITarXiv:2601.07389v22026
  45. On Token's Dilemma: Dynamic MoE with Drift-Aware Token Assignment for Continual Learning of Large Vision Language Models

    Chongyang Zhao, Mingsong Li, Haodong Lu +1

    cs.LGcs.AIarXiv:2603.27481v12026
  46. Motion Attribution for Video Generation

    Xindi Wu, Despoina Paschalidou, Jun Gao +5

    cs.CVcs.AIcs.LGarXiv:2601.08828v22026
  47. Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning

    Zhiyuan Hu, Yunhai Hu, Juncheng Liu +9

    cs.AIcs.CLarXiv:2601.09667v22026
  48. Walking on the DARKSIDE

    Aldo Gangemi, Emanuele Bottazzi

    cs.AIcs.LOarXiv:2608.23370v12026
  49. Concepts for Securing Agentic AI Coding and the Terok Environment

    Jiří Vyskočil, Franz Pöschel, Andreas Knüpfer

    cs.AIcs.SEarXiv:2608.22930v12026
  50. CARLA-Air: Fly Drones Inside a CARLA World -- A Unified Infrastructure for Air-Ground Embodied Intelligence

    Tianle Zeng, Yanci Wen, Hong Zhang

    cs.ROcs.AIcs.CVarXiv:2603.28032v22026
  51. GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agents

    Yunzhe Wang, Runhui Xu, Kexin Zheng +4

    cs.CLcs.AIcs.CVarXiv:2603.24329v22026
  52. Proxy reliance in large language model decisions is uncalibrated to predictive evidence

    Zengqing Wu, Chuan Xiao

    cs.AIcs.CLcs.CYarXiv:2608.22887v12026
  53. Cooperative Inverse Reinforcement Learning

    Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1

    cs.AIarXiv:1606.03137v42016
  54. Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

    Gwen Yidou-Weng, Edward Sun, Tianyi Ma +5

    cs.ROcs.AIarXiv:2608.22149v12026
  55. Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding

    Changjiang Jiang, Qiannian Zhao, Lei Xin +3

    cs.AIarXiv:2608.22429v12026
  56. Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development

    Zhongying Deng, Cheng Tang, Ziyan Huang +124

    cs.CVcs.AIarXiv:2603.27460v12026
  57. Using Large Language Models to Simulate Multiple Humans and Replicate Human Subject Studies

    Gati Aher, Rosa I. Arriaga, Adam Tauman Kalai

    cs.CLcs.AIcs.LGarXiv:2208.10264v52022
  58. Socially Aware Motion Planning with Deep Reinforcement Learning

    Yu Fan Chen, Michael Everett, Miao Liu +1

    cs.ROcs.AIcs.HCarXiv:1703.08862v22017
  59. Multi-Winner Voting with Argumentative Ballots

    Ryuta Arisaka, Hirotaka Ono

    cs.GTcs.AIarXiv:2608.23247v12026
  60. Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI

    Santhosh K. Ramakrishnan, Aaron Gokaslan, Erik Wijmans +10

    cs.CVcs.AIarXiv:2109.08238v12021