Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,581 to 11,640 of 15,410
Beyond Length Scaling: Synergizing Breadth and Depth for Generative Reward Models
Qiyuan Zhang, Yufei Wang, Tianhe Wu +5
cs.AIarXiv:2603.01571v12026DynaMoE: Dynamic Token-Level Expert Activation with Layer-Wise Adaptive Capacity for Mixture-of-Experts Neural Networks
Gökdeniz Gülmez
cs.LGcs.AIarXiv:2603.01697v12026Research Priorities for Robust and Beneficial Artificial Intelligence
Stuart Russell, Daniel Dewey, Max Tegmark
cs.AIstat.MLarXiv:1602.03506v12016T2S-Bench & Structure-of-Thought: Benchmarking and Prompting Comprehensive Text-to-Structure Reasoning
Qinsi Wang, Hancheng Ye, Jinhee Kim +12
cs.CLcs.AIarXiv:2603.03790v12026Don't Just Assume; Look and Answer: Overcoming Priors for Visual Question Answering
Aishwarya Agrawal, Dhruv Batra, Devi Parikh +1
cs.CVcs.AIcs.CLarXiv:1712.00377v22017Overcoming Catastrophic Forgetting by Incremental Moment Matching
Sang-Woo Lee, Jin-Hwa Kim, Jaehyun Jun +2
cs.LGcs.AIarXiv:1703.08475v32017Are Emergent Abilities of Large Language Models a Mirage?
Rylan Schaeffer, Brando Miranda, Sanmi Koyejo
cs.AIcs.LGarXiv:2304.15004v22023Scaling Agentic Capabilities, Not Context: Efficient Reinforcement Finetuning for Large Toolspaces
Karan Gupta, Pranav Vajreshwari, Yash Pandya +3
cs.LGcs.AIarXiv:2603.06713v12026SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning
Zhaohan Meng, Zaiqiao Meng, Siwei Liu +3
cs.CLcs.AIcs.CEarXiv:2608.22132v12026Deep Learning for Computational Chemistry
Garrett B. Goh, Nathan O. Hodas, Abhinav Vishnu
stat.MLcs.AIcs.CEarXiv:1701.04503v12017Analyzing and Mitigating Cross-Lingual Degradation in Multilingual Medical VQA
Jingbo Wang, Sendong Zhao, Haochun Wang +2
cs.AIarXiv:2608.22363v12026SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement
Subramanyam Sahoo, Aman Chadha, Vinija Jain +1
cs.AIcs.CLcs.LGarXiv:2603.06333v12026Invertible Residual Networks
Jens Behrmann, Will Grathwohl, Ricky T. Q. Chen +2
cs.LGcs.AIcs.CVarXiv:1811.00995v32018BrandFusion: A Multi-Agent Framework for Seamless Brand Integration in Text-to-Video Generation
Zihao Zhu, Ruotong Wang, Siwei Lyu +2
cs.CVcs.AIarXiv:2603.02816v22026DeepSAGE: Stage-Aware Reinforcement Learning for Structured CBT Counseling Dialogue
Qi Zhang, Heajun An, Prakriti Dumaru +4
cs.AIarXiv:2608.22615v12026Probabilistic Model-Agnostic Meta-Learning
Chelsea Finn, Kelvin Xu, Sergey Levine
cs.LGcs.AIstat.MLarXiv:1806.02817v22018HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
The Viet Bui, Wenjun Li, Yong Liu
cs.AIcs.CLarXiv:2603.04750v12026Weakly supervised concept Bottleneck Learning for Robust Two stage Object centric visual reasoning
Sparsh Tiwari, Gesina Schwalbe, Bettina Finzel
cs.AIarXiv:2608.22584v12026DreamCAD: Scaling Multi-modal CAD Generation using Differentiable Parametric Surfaces
Mohammad Sadil Khan, Muhammad Usama, Rolandos Alexandros Potamias +4
cs.CVcs.AIarXiv:2603.05607v22026TensorFlow Lite Micro: Embedded Machine Learning on TinyML Systems
Robert David, Jared Duke, Advait Jain +10
cs.LGcs.AIarXiv:2010.08678v32020DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking
Akash Haridas, Utkarsh Saxena, Parsa Ashrafi Fashi +3
cs.CVcs.AIcs.LGarXiv:2603.06351v22026Concept-Guided Fine-Tuning: Steering ViTs away from Spurious Correlations to Improve Robustness
Yehonatan Elisha, Oren Barkan, Noam Koenigstein
cs.CVcs.AIcs.LGarXiv:2603.08309v22026Deep Tabular Research via Continual Experience-Driven Execution
Junnan Dong, Chuang Zhou, Zheng Yuan +7
cs.AIarXiv:2603.09151v22026Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
Jaeik Kim, Woojin Kim, Jihwan Hong +8
cs.CLcs.AIarXiv:2604.00007v12026EMPIRE: Explicit Manipulation Planning as a Learnable Intermediate Representation for Egocentric Hand-Motion Forecasting
Wen Wang, Ruibing Hou, Hong Chang +2
cs.ROcs.AIarXiv:2608.22449v12026Entropy Search for Information-Efficient Global Optimization
Philipp Hennig, Christian J. Schuler
stat.MLcs.AIarXiv:1112.1217v12011Compiler-First State Space Duality and Portable $O(1)$ Autoregressive Caching for Inference
Cosmo Santoni, Anmol Thapar
cs.LGcs.AIcs.DCarXiv:2603.09555v22026Visualizing Deep Neural Network Decisions: Prediction Difference Analysis
Luisa M Zintgraf, Taco S Cohen, Tameem Adel +1
cs.CVcs.AIarXiv:1702.04595v12017Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context
Keivan Alizadeh, Parshin Shojaee, Minsik Cho +1
cs.CLcs.AIcs.LGarXiv:2603.15653v12026Doubly Robust Off-policy Value Evaluation for Reinforcement Learning
Nan Jiang, Lihong Li
cs.LGcs.AIeess.SYarXiv:1511.03722v32015A Survey and Critique of Multiagent Deep Reinforcement Learning
Pablo Hernandez-Leal, Bilal Kartal, Matthew E. Taylor
cs.MAcs.AIcs.LGarXiv:1810.05587v32018BiCLIP: Domain Canonicalization via Structured Geometric Transformation
Pranav Mantini, Shishir K. Shah
cs.CVcs.AIcs.CLarXiv:2603.08942v22026The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness
Subramanyam Sahoo, Aman Chadha, Vinija Jain +1
cs.AIcs.CLcs.CYarXiv:2603.09200v12026From Anecdotal Evidence to Quantitative Evaluation Methods: A Systematic Review on Evaluating Explainable AI
Meike Nauta, Jan Trienes, Shreyasi Pathak +6
cs.AIarXiv:2201.08164v32022Towards a Neural Debugger for Python
Maximilian Beck, Jonas Gehring, Jannik Kossen +1
cs.LGcs.AIcs.SEarXiv:2603.09951v12026End-to-end Structure-Aware Convolutional Networks for Knowledge Base Completion
Chao Shang, Yun Tang, Jing Huang +3
cs.AIcs.CLarXiv:1811.04441v22018MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization
Chenyang Zhu, Hongxiang Li, Xiu Li +1
cs.CVcs.AIcs.CLarXiv:2603.12743v12026A Comprehensive Survey on Pretrained Foundation Models: A History from BERT to ChatGPT
Ce Zhou, Qian Li, Chen Li +16
cs.AIcs.CLcs.LGarXiv:2302.09419v32023V2M-Zero: Zero-Pair Time-Aligned Video-to-Music Generation
Yan-Bo Lin, Jonah Casebeer, Long Mai +3
cs.CVcs.AIcs.LGarXiv:2603.11042v22026Test-Time Strategies for More Efficient and Accurate Agentic RAG
Brian Zhang, Deepti Guntur, Zhiyang Zuo +7
cs.IRcs.AIarXiv:2603.12396v12026Synthesizing the preferred inputs for neurons in neural networks via deep generator networks
Anh Nguyen, Alexey Dosovitskiy, Jason Yosinski +2
cs.NEcs.AIcs.CVarXiv:1605.09304v52016ECG-Reasoning-Benchmark: A Benchmark for Evaluating Clinical Reasoning Capabilities in ECG Interpretation
Jungwoo Oh, Hyunseung Chung, Junhee Lee +6
cs.LGcs.AIcs.CLarXiv:2603.14326v12026A Multi-World Approach to Question Answering about Real-World Scenes based on Uncertain Input
Mateusz Malinowski, Mario Fritz
cs.AIcs.CLcs.CVarXiv:1410.0210v42014Learning to Ask: Neural Question Generation for Reading Comprehension
Xinya Du, Junru Shao, Claire Cardie
cs.CLcs.AIarXiv:1705.00106v12017AgriIR: A Scalable Framework for Domain-Specific Knowledge Retrieval
Shuvam Banerji Seal, Aheli Poddar, Alok Mishra +1
cs.IRcs.AIarXiv:2604.16353v12026Loc3R-VLM: Language-based Localization and 3D Reasoning with Vision-Language Models
Kevin Qu, Haozhe Qi, Mihai Dusmanu +3
cs.CVcs.AIcs.CLarXiv:2603.18002v12026s2n-bignum-bench: A practical benchmark for evaluating low-level code reasoning of LLMs
Balaji Rao, John Harrison, Soonho Kong +2
cs.PLcs.AIcs.CRarXiv:2603.14628v22026Socratic Models: Composing Zero-Shot Multimodal Reasoning with Language
Andy Zeng, Maria Attarian, Brian Ichter +10
cs.CVcs.AIcs.CLarXiv:2204.00598v22022AdapterTune: Zero-Initialized Low-Rank Adapters for Frozen Vision Transformers
Salim Khazem
cs.CVcs.AIcs.LGarXiv:2603.14706v12026ReactMotion: Generating Reactive Listener Motions from Speaker Utterance
Cheng Luo, Bizhu Wu, Bing Li +5
cs.CVcs.AIcs.HCarXiv:2603.15083v12026One-Shot Imitation Learning
Yan Duan, Marcin Andrychowicz, Bradly C. Stadie +5
cs.AIcs.LGcs.NEarXiv:1703.07326v32017EG-ARSA: An Expert-Grounded Open Model for Visual Road Safety Auditing in Low-Resource Settings
Md Thamed Bin Zaman Chowdhury, Moazzem Hossain
cs.CVcs.AIarXiv:2608.23563v12026AgentFormer: Agent-Aware Transformers for Socio-Temporal Multi-Agent Forecasting
Ye Yuan, Xinshuo Weng, Yanglan Ou +1
cs.AIcs.CVcs.LGarXiv:2103.14023v32021From Masks to Pixels and Meaning: A New Taxonomy, Benchmark, and Metrics for VLM Image Tampering
Xinyi Shang, Yi Tang, Jiacheng Cui +9
cs.CVcs.AIcs.LGarXiv:2603.20193v12026What's the Catch? Evaluating Temporal Consistency in Vision-Language Models
Marek Hradil, Danae Sánchez Villegas
cs.CLcs.AIcs.CVarXiv:2608.23474v22026Unified Spatio-Temporal Token Scoring for Efficient Video VLMs
Jianrui Zhang, Yue Yang, Rohun Tripathi +5
cs.CVcs.AIcs.LGarXiv:2603.18004v12026Reasoning or Rhetoric? An Empirical Analysis of Moral Reasoning Explanations in Large Language Models
Aryan Kasat, Smriti Singh, Aman Chadha +1
cs.AIarXiv:2603.21854v12026LLM-Based Selection of Incongruent Verbal and Nonverbal Behavior for Virtual Humans
Parisa Ghanad Torshizi, Stacy Marsella
cs.AIcs.HCcs.ROarXiv:2608.22731v12026HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering
Dan Ben-Ami, Gabriele Serussi, Kobi Cohen +1
cs.CVcs.AIarXiv:2603.18558v22026Compositional Visual Generation with Composable Diffusion Models
Nan Liu, Shuang Li, Yilun Du +2
cs.CVcs.AIcs.LGarXiv:2206.01714v62022