Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,581 to 11,640 of 15,410

  1. Beyond Length Scaling: Synergizing Breadth and Depth for Generative Reward Models

    Qiyuan Zhang, Yufei Wang, Tianhe Wu +5

    cs.AIarXiv:2603.01571v12026
  2. DynaMoE: Dynamic Token-Level Expert Activation with Layer-Wise Adaptive Capacity for Mixture-of-Experts Neural Networks

    Gökdeniz Gülmez

    cs.LGcs.AIarXiv:2603.01697v12026
  3. Research Priorities for Robust and Beneficial Artificial Intelligence

    Stuart Russell, Daniel Dewey, Max Tegmark

    cs.AIstat.MLarXiv:1602.03506v12016
  4. T2S-Bench & Structure-of-Thought: Benchmarking and Prompting Comprehensive Text-to-Structure Reasoning

    Qinsi Wang, Hancheng Ye, Jinhee Kim +12

    cs.CLcs.AIarXiv:2603.03790v12026
  5. Don't Just Assume; Look and Answer: Overcoming Priors for Visual Question Answering

    Aishwarya Agrawal, Dhruv Batra, Devi Parikh +1

    cs.CVcs.AIcs.CLarXiv:1712.00377v22017
  6. Overcoming Catastrophic Forgetting by Incremental Moment Matching

    Sang-Woo Lee, Jin-Hwa Kim, Jaehyun Jun +2

    cs.LGcs.AIarXiv:1703.08475v32017
  7. Are Emergent Abilities of Large Language Models a Mirage?

    Rylan Schaeffer, Brando Miranda, Sanmi Koyejo

    cs.AIcs.LGarXiv:2304.15004v22023
  8. Scaling Agentic Capabilities, Not Context: Efficient Reinforcement Finetuning for Large Toolspaces

    Karan Gupta, Pranav Vajreshwari, Yash Pandya +3

    cs.LGcs.AIarXiv:2603.06713v12026
  9. SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning

    Zhaohan Meng, Zaiqiao Meng, Siwei Liu +3

    cs.CLcs.AIcs.CEarXiv:2608.22132v12026
  10. Deep Learning for Computational Chemistry

    Garrett B. Goh, Nathan O. Hodas, Abhinav Vishnu

    stat.MLcs.AIcs.CEarXiv:1701.04503v12017
  11. Analyzing and Mitigating Cross-Lingual Degradation in Multilingual Medical VQA

    Jingbo Wang, Sendong Zhao, Haochun Wang +2

    cs.AIarXiv:2608.22363v12026
  12. SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement

    Subramanyam Sahoo, Aman Chadha, Vinija Jain +1

    cs.AIcs.CLcs.LGarXiv:2603.06333v12026
  13. Invertible Residual Networks

    Jens Behrmann, Will Grathwohl, Ricky T. Q. Chen +2

    cs.LGcs.AIcs.CVarXiv:1811.00995v32018
  14. BrandFusion: A Multi-Agent Framework for Seamless Brand Integration in Text-to-Video Generation

    Zihao Zhu, Ruotong Wang, Siwei Lyu +2

    cs.CVcs.AIarXiv:2603.02816v22026
  15. DeepSAGE: Stage-Aware Reinforcement Learning for Structured CBT Counseling Dialogue

    Qi Zhang, Heajun An, Prakriti Dumaru +4

    cs.AIarXiv:2608.22615v12026
  16. Probabilistic Model-Agnostic Meta-Learning

    Chelsea Finn, Kelvin Xu, Sergey Levine

    cs.LGcs.AIstat.MLarXiv:1806.02817v22018
  17. HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel

    The Viet Bui, Wenjun Li, Yong Liu

    cs.AIcs.CLarXiv:2603.04750v12026
  18. Weakly supervised concept Bottleneck Learning for Robust Two stage Object centric visual reasoning

    Sparsh Tiwari, Gesina Schwalbe, Bettina Finzel

    cs.AIarXiv:2608.22584v12026
  19. DreamCAD: Scaling Multi-modal CAD Generation using Differentiable Parametric Surfaces

    Mohammad Sadil Khan, Muhammad Usama, Rolandos Alexandros Potamias +4

    cs.CVcs.AIarXiv:2603.05607v22026
  20. TensorFlow Lite Micro: Embedded Machine Learning on TinyML Systems

    Robert David, Jared Duke, Advait Jain +10

    cs.LGcs.AIarXiv:2010.08678v32020
  21. DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking

    Akash Haridas, Utkarsh Saxena, Parsa Ashrafi Fashi +3

    cs.CVcs.AIcs.LGarXiv:2603.06351v22026
  22. Concept-Guided Fine-Tuning: Steering ViTs away from Spurious Correlations to Improve Robustness

    Yehonatan Elisha, Oren Barkan, Noam Koenigstein

    cs.CVcs.AIcs.LGarXiv:2603.08309v22026
  23. Deep Tabular Research via Continual Experience-Driven Execution

    Junnan Dong, Chuang Zhou, Zheng Yuan +7

    cs.AIarXiv:2603.09151v22026
  24. Dynin-Omni: Omnimodal Unified Large Diffusion Language Model

    Jaeik Kim, Woojin Kim, Jihwan Hong +8

    cs.CLcs.AIarXiv:2604.00007v12026
  25. EMPIRE: Explicit Manipulation Planning as a Learnable Intermediate Representation for Egocentric Hand-Motion Forecasting

    Wen Wang, Ruibing Hou, Hong Chang +2

    cs.ROcs.AIarXiv:2608.22449v12026
  26. Entropy Search for Information-Efficient Global Optimization

    Philipp Hennig, Christian J. Schuler

    stat.MLcs.AIarXiv:1112.1217v12011
  27. Compiler-First State Space Duality and Portable $O(1)$ Autoregressive Caching for Inference

    Cosmo Santoni, Anmol Thapar

    cs.LGcs.AIcs.DCarXiv:2603.09555v22026
  28. Visualizing Deep Neural Network Decisions: Prediction Difference Analysis

    Luisa M Zintgraf, Taco S Cohen, Tameem Adel +1

    cs.CVcs.AIarXiv:1702.04595v12017
  29. Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context

    Keivan Alizadeh, Parshin Shojaee, Minsik Cho +1

    cs.CLcs.AIcs.LGarXiv:2603.15653v12026
  30. Doubly Robust Off-policy Value Evaluation for Reinforcement Learning

    Nan Jiang, Lihong Li

    cs.LGcs.AIeess.SYarXiv:1511.03722v32015
  31. A Survey and Critique of Multiagent Deep Reinforcement Learning

    Pablo Hernandez-Leal, Bilal Kartal, Matthew E. Taylor

    cs.MAcs.AIcs.LGarXiv:1810.05587v32018
  32. BiCLIP: Domain Canonicalization via Structured Geometric Transformation

    Pranav Mantini, Shishir K. Shah

    cs.CVcs.AIcs.CLarXiv:2603.08942v22026
  33. The Reasoning Trap -- Logical Reasoning as a Mechanistic Pathway to Situational Awareness

    Subramanyam Sahoo, Aman Chadha, Vinija Jain +1

    cs.AIcs.CLcs.CYarXiv:2603.09200v12026
  34. From Anecdotal Evidence to Quantitative Evaluation Methods: A Systematic Review on Evaluating Explainable AI

    Meike Nauta, Jan Trienes, Shreyasi Pathak +6

    cs.AIarXiv:2201.08164v32022
  35. Towards a Neural Debugger for Python

    Maximilian Beck, Jonas Gehring, Jannik Kossen +1

    cs.LGcs.AIcs.SEarXiv:2603.09951v12026
  36. End-to-end Structure-Aware Convolutional Networks for Knowledge Base Completion

    Chao Shang, Yun Tang, Jing Huang +3

    cs.AIcs.CLarXiv:1811.04441v22018
  37. MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization

    Chenyang Zhu, Hongxiang Li, Xiu Li +1

    cs.CVcs.AIcs.CLarXiv:2603.12743v12026
  38. A Comprehensive Survey on Pretrained Foundation Models: A History from BERT to ChatGPT

    Ce Zhou, Qian Li, Chen Li +16

    cs.AIcs.CLcs.LGarXiv:2302.09419v32023
  39. V2M-Zero: Zero-Pair Time-Aligned Video-to-Music Generation

    Yan-Bo Lin, Jonah Casebeer, Long Mai +3

    cs.CVcs.AIcs.LGarXiv:2603.11042v22026
  40. Test-Time Strategies for More Efficient and Accurate Agentic RAG

    Brian Zhang, Deepti Guntur, Zhiyang Zuo +7

    cs.IRcs.AIarXiv:2603.12396v12026
  41. Synthesizing the preferred inputs for neurons in neural networks via deep generator networks

    Anh Nguyen, Alexey Dosovitskiy, Jason Yosinski +2

    cs.NEcs.AIcs.CVarXiv:1605.09304v52016
  42. ECG-Reasoning-Benchmark: A Benchmark for Evaluating Clinical Reasoning Capabilities in ECG Interpretation

    Jungwoo Oh, Hyunseung Chung, Junhee Lee +6

    cs.LGcs.AIcs.CLarXiv:2603.14326v12026
  43. A Multi-World Approach to Question Answering about Real-World Scenes based on Uncertain Input

    Mateusz Malinowski, Mario Fritz

    cs.AIcs.CLcs.CVarXiv:1410.0210v42014
  44. Learning to Ask: Neural Question Generation for Reading Comprehension

    Xinya Du, Junru Shao, Claire Cardie

    cs.CLcs.AIarXiv:1705.00106v12017
  45. AgriIR: A Scalable Framework for Domain-Specific Knowledge Retrieval

    Shuvam Banerji Seal, Aheli Poddar, Alok Mishra +1

    cs.IRcs.AIarXiv:2604.16353v12026
  46. Loc3R-VLM: Language-based Localization and 3D Reasoning with Vision-Language Models

    Kevin Qu, Haozhe Qi, Mihai Dusmanu +3

    cs.CVcs.AIcs.CLarXiv:2603.18002v12026
  47. s2n-bignum-bench: A practical benchmark for evaluating low-level code reasoning of LLMs

    Balaji Rao, John Harrison, Soonho Kong +2

    cs.PLcs.AIcs.CRarXiv:2603.14628v22026
  48. Socratic Models: Composing Zero-Shot Multimodal Reasoning with Language

    Andy Zeng, Maria Attarian, Brian Ichter +10

    cs.CVcs.AIcs.CLarXiv:2204.00598v22022
  49. AdapterTune: Zero-Initialized Low-Rank Adapters for Frozen Vision Transformers

    Salim Khazem

    cs.CVcs.AIcs.LGarXiv:2603.14706v12026
  50. ReactMotion: Generating Reactive Listener Motions from Speaker Utterance

    Cheng Luo, Bizhu Wu, Bing Li +5

    cs.CVcs.AIcs.HCarXiv:2603.15083v12026
  51. One-Shot Imitation Learning

    Yan Duan, Marcin Andrychowicz, Bradly C. Stadie +5

    cs.AIcs.LGcs.NEarXiv:1703.07326v32017
  52. EG-ARSA: An Expert-Grounded Open Model for Visual Road Safety Auditing in Low-Resource Settings

    Md Thamed Bin Zaman Chowdhury, Moazzem Hossain

    cs.CVcs.AIarXiv:2608.23563v12026
  53. AgentFormer: Agent-Aware Transformers for Socio-Temporal Multi-Agent Forecasting

    Ye Yuan, Xinshuo Weng, Yanglan Ou +1

    cs.AIcs.CVcs.LGarXiv:2103.14023v32021
  54. From Masks to Pixels and Meaning: A New Taxonomy, Benchmark, and Metrics for VLM Image Tampering

    Xinyi Shang, Yi Tang, Jiacheng Cui +9

    cs.CVcs.AIcs.LGarXiv:2603.20193v12026
  55. What's the Catch? Evaluating Temporal Consistency in Vision-Language Models

    Marek Hradil, Danae Sánchez Villegas

    cs.CLcs.AIcs.CVarXiv:2608.23474v22026
  56. Unified Spatio-Temporal Token Scoring for Efficient Video VLMs

    Jianrui Zhang, Yue Yang, Rohun Tripathi +5

    cs.CVcs.AIcs.LGarXiv:2603.18004v12026
  57. Reasoning or Rhetoric? An Empirical Analysis of Moral Reasoning Explanations in Large Language Models

    Aryan Kasat, Smriti Singh, Aman Chadha +1

    cs.AIarXiv:2603.21854v12026
  58. LLM-Based Selection of Incongruent Verbal and Nonverbal Behavior for Virtual Humans

    Parisa Ghanad Torshizi, Stacy Marsella

    cs.AIcs.HCcs.ROarXiv:2608.22731v12026
  59. HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering

    Dan Ben-Ami, Gabriele Serussi, Kobi Cohen +1

    cs.CVcs.AIarXiv:2603.18558v22026
  60. Compositional Visual Generation with Composable Diffusion Models

    Nan Liu, Shuang Li, Yilun Du +2

    cs.CVcs.AIcs.LGarXiv:2206.01714v62022