Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

10,981 to 11,040 of 15,502

  1. VIMA: General Robot Manipulation with Multimodal Prompts

    Yunfan Jiang, Agrim Gupta, Zichen Zhang +7

    cs.ROcs.AIcs.LGarXiv:2210.03094v22022
  2. PonderPounce: A Pretrained MLLM as an Episode Context Engine for Robot Control

    Suhwan Choi, Jaeyoon Jung, Sungkyung Kim +2

    cs.ROcs.AIarXiv:2608.24115v12026
  3. Parason: Revealing Subtask and Trial Parallelism in LLM Reasoning

    Zhengyang Zhang, Zijian Zhang, Jiaxuan Gao +4

    cs.AIarXiv:2608.24658v12026
  4. Mode Regularized Generative Adversarial Networks

    Tong Che, Yanran Li, Athul Paul Jacob +2

    cs.LGcs.AIcs.CVarXiv:1612.02136v52016
  5. ToolRobustBench: Stage-Wise Perturbation Evaluation and Failure Diagnosis for Tool-Calling Agents

    YiShan Zheng, Yuan Wu, Yi Chang

    cs.SEcs.AIarXiv:2608.23635v12026
  6. ChainPrune: Evaluating and Reducing Redundancy in Long Chain-of-Thought Reasoning

    Weihang Pan, Zhengxu Yu, Yuxiang Zhang +5

    cs.LGcs.AIarXiv:2608.21860v12026
  7. Unsupervised Discovery of Mid-Level Discriminative Patches

    Saurabh Singh, Abhinav Gupta, Alexei A. Efros

    cs.CVcs.AIcs.LGarXiv:1205.3137v22012
  8. ExplainGuard: A Zero Trust Framework for Post-Hoc Explanation Integrity Guarantees in Blackbox XAI Models

    Maraz Mia, Shovan Roy, Mir Mehedi A. Pritom +1

    cs.CRcs.AIarXiv:2608.21803v12026
  9. A survey detection channel overrides the pixels in an astronomical foundation model, and biases tomographic mean redshifts

    Ihor Kendiukhov

    cs.AIastro-ph.IMarXiv:2608.23626v12026
  10. Lexical Perturbations Disrupt LLM Reasoning: An Empirical Study of Attention Diversion

    Jiaqian Zhu, Yang Zhang, Junhua Ding +1

    cs.CLcs.AIcs.LGarXiv:2608.22140v12026
  11. A Thorough Examination of the CNN/Daily Mail Reading Comprehension Task

    Danqi Chen, Jason Bolton, Christopher D. Manning

    cs.CLcs.AIarXiv:1606.02858v22016
  12. Brax -- A Differentiable Physics Engine for Large Scale Rigid Body Simulation

    C. Daniel Freeman, Erik Frey, Anton Raichuk +3

    cs.ROcs.AIarXiv:2106.13281v12021
  13. WAM-OPD: On-Policy Distillation for World Action Models

    Liuhaichen Yang, Zhuang Jiang, Chenchao Sheng +1

    cs.AIcs.ROarXiv:2608.22364v12026
  14. Progressively Learning Heterogeneous Skills in a Unified Latent Space

    Yue-Yi Zhang, Ming Gong, Linpu He +2

    cs.CVcs.AIcs.ROarXiv:2608.23258v12026
  15. Maximum a Posteriori Policy Optimisation

    Abbas Abdolmaleki, Jost Tobias Springenberg, Yuval Tassa +3

    cs.LGcs.AIcs.ITarXiv:1806.06920v12018
  16. Fast Model Editing at Scale

    Eric Mitchell, Charles Lin, Antoine Bosselut +2

    cs.LGcs.AIcs.CLarXiv:2110.11309v22021
  17. Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?

    Christian Schroeder de Witt, Tarun Gupta, Denys Makoviichuk +4

    cs.AIarXiv:2011.09533v12020
  18. AgentWeave: Routing Before Reasoning for Efficient Function Calling in Tool-Rich Language Models

    Saurav Singla, Aarav Singla, Advik Gupta +1

    cs.AIcs.CLarXiv:2608.23078v12026
  19. Dynabench: Rethinking Benchmarking in NLP

    Douwe Kiela, Max Bartolo, Yixin Nie +16

    cs.CLcs.AIarXiv:2104.14337v12021
  20. Compositional Chain-of-Relations for Faithful Knowledge Graph Question Answering with Large Language Models

    Chenhui Liu, Jianpeng Zhou, Jiahai Wang

    cs.AIarXiv:2608.22762v12026
  21. Imagination-Augmented Agents for Deep Reinforcement Learning

    Théophane Weber, Sébastien Racanière, David P. Reichert +12

    cs.LGcs.AIstat.MLarXiv:1707.06203v22017
  22. Enhancing the Transferability of Adversarial Attacks through Variance Tuning

    Xiaosen Wang, Kun He

    cs.AIarXiv:2103.15571v32021
  23. ShardMeter: Sharded and Geo-Distributed Training Without the Guesswork

    Tim Beringer, Patrick Diem, Felix Wolf +1

    cs.DCcs.AIarXiv:2608.23840v12026
  24. Confidently Wrong, Silently So: Auditing Undetectable Failures of a Deployed On-Device Language Model

    Shashwat Pandey, Satwik Pandey, Suresh Raghu

    cs.SEcs.AIarXiv:2608.23663v12026
  25. An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation

    Max Schäfer, Sarah Nadi, Aryaz Eghbali +1

    cs.SEcs.AIarXiv:2302.06527v42023
  26. Exploit More, Explore Smarter for Budget-Constrained Agentic Search

    Haoyang Fang, Bernie Wang

    cs.AIcs.LGarXiv:2608.23848v12026
  27. Benchmarking Retrieval-Augmented Generation for Medicine

    Guangzhi Xiong, Qiao Jin, Zhiyong Lu +1

    cs.CLcs.AIarXiv:2402.13178v22024
  28. Serving Masked Diffusion LLMs: Characterization and Design Principles from Real Hardware

    Farhana Amin, Sabiha Afroz, Mona Moghadampanah +1

    cs.AIarXiv:2608.23807v12026
  29. T-LESS: An RGB-D Dataset for 6D Pose Estimation of Texture-less Objects

    Tomas Hodan, Pavel Haluza, Stepan Obdrzalek +3

    cs.CVcs.AIcs.ROarXiv:1701.05498v12017
  30. A Behavior-Guided Online Probabilistic Forecasting Method for Electric vehicle Charging Loads

    Chenghan Li, Qingxiang Liu, Yinliang Xu +1

    cs.AIarXiv:2608.24441v12026
  31. Do Spoken Language Models Hear Speech as They Read Text? Bridging Structural Gaps Between Speech and Text

    Hyeonyu Kim, Hwayeon Kim, Youngwon Choi +2

    cs.CLcs.AIarXiv:2608.22908v12026
  32. Function-Level Execution Feedback for Code Preference Optimization

    Idris Nechnech, Sehwan Kim, Jimin Seo +4

    cs.AIcs.SEarXiv:2608.23632v12026
  33. Machine Comprehension Using Match-LSTM and Answer Pointer

    Shuohang Wang, Jing Jiang

    cs.CLcs.AIarXiv:1608.07905v22016
  34. Agentic-MME: What Agentic Capability Really Brings to Multimodal Intelligence?

    Qianshan Wei, Yishan Yang, Siyi Wang +12

    cs.AIarXiv:2604.03016v12026
  35. Mathematical Capabilities of ChatGPT

    Simon Frieder, Luca Pinchetti, Alexis Chevalier +5

    cs.LGcs.AIcs.CLarXiv:2301.13867v22023
  36. LLMs are Few-Shot Decision-Makers: Generalized Context-Aware Microgrid Frequency Control through Prompt Decision Transformer

    Xu Yang, Chenhui Lin, Haotian Liu +3

    eess.SYcs.AIarXiv:2608.21858v12026
  37. Score-based diffusion models for accelerated MRI

    Hyungjin Chung, Jong Chul Ye

    eess.IVcs.AIcs.CVarXiv:2110.05243v32021
  38. LLM Agents Perform Controlled Experiments Using Simulation Models

    Yuchen Xia, Michael Weyrich, Nasser Jazdi +6

    cs.AIcs.CLcs.MAarXiv:2608.23622v12026
  39. Where World Models Break: Natural-Input Failure Discovery

    Zhanpeng Shi, Zi Liang, Rong Feng +3

    cs.AIarXiv:2608.22421v12026
  40. TAT-QA: A Question Answering Benchmark on a Hybrid of Tabular and Textual Content in Finance

    Fengbin Zhu, Wenqiang Lei, Youcheng Huang +5

    cs.CLcs.AIarXiv:2105.07624v22021
  41. How Much Regularization Survives Averaging? Update Masking in Federated Learning

    Wenhao Yan, Fu Kuroda, Yucheng Jin +1

    cs.LGcs.AIarXiv:2608.23286v22026
  42. Data Mixing as Mixture Experiment: Response Surface Methodology and Optimal Design for Large Language Model Pretraining

    Yicheng Mao, Hongru Du

    cs.AIstat.MLarXiv:2608.23922v12026
  43. Restoring Without Forgetting: Continual Learning Across Image Degradations

    Alif Ashrafee, Bartosz Krawczyk

    cs.CVcs.AIcs.LGarXiv:2608.23799v12026
  44. AI Agents Push Humans Out of the Loop

    Margaret Mitchell, Avijit Ghosh, Samir Passi

    cs.AIcs.HCarXiv:2608.23642v12026
  45. Beyond Static Interpretability: Anticipating Post-SFT Mechanisms from Pre-SFT Parameters for Better Tuning

    Hang Chen, Jiaying Zhu, Wenya Wang

    cs.LGcs.AIcs.CLarXiv:2608.24482v12026
  46. Simthesizer: An Agent-Driven Simulation Framework for LLM Serving Systems

    Wonung Kim, Hyunmin Choi, Minsu Kim +3

    cs.ARcs.AIarXiv:2608.24650v12026
  47. Variational Inference of Disentangled Latent Concepts from Unlabeled Observations

    Abhishek Kumar, Prasanna Sattigeri, Avinash Balakrishnan

    cs.LGcs.AIcs.CVarXiv:1711.00848v32017
  48. Predicting Radiologist Expertise from 3D Gaze Patterns During CT Interpretation

    Leila Khaertdinova, Anna Anikina, Claudia Mello-Thoms +1

    cs.CVcs.AIcs.LGarXiv:2608.23836v12026
  49. FLARE: A Systematic, Uncertainty-Aware Framework for Evidence-Based Adoption of Artificial Intelligence in Healthcare

    Jacob Idoko, Siddhartha Paudel, Mariana Bento +2

    cs.AIarXiv:2608.23643v12026
  50. Learning Invariant Representations for Reinforcement Learning without Reconstruction

    Amy Zhang, Rowan McAllister, Roberto Calandra +2

    cs.LGcs.AIstat.MLarXiv:2006.10742v22020
  51. ET-BERT: A Contextualized Datagram Representation with Pre-training Transformers for Encrypted Traffic Classification

    Xinjie Lin, Gang Xiong, Gaopeng Gou +3

    cs.CRcs.AIcs.NIarXiv:2202.06335v22022
  52. PsychJail: Exploring Psychological Jailbreaks via Multi-Turn Persuasion of LLM Policies

    Zeyu Feng, Qingyu Wu, Yuzhe Luo +1

    cs.AIarXiv:2608.23028v12026
  53. API-Bank: A Comprehensive Benchmark for Tool-Augmented LLMs

    Minghao Li, Yingxiu Zhao, Bowen Yu +6

    cs.CLcs.AIarXiv:2304.08244v22023
  54. Counterfactual Visual Explanations

    Yash Goyal, Ziyan Wu, Jan Ernst +3

    cs.LGcs.AIcs.CVarXiv:1904.07451v22019
  55. SA-RSQ: A Versatile Sparse Representation Framework for Multi-modal Recommender Systems

    Xiang Wang, Shigang Quan, Tingzhen Chang +5

    cs.AIarXiv:2608.22979v22026
  56. Improving the matrix multiplication exponent with modern optimization and AlphaEvolve

    Emilien Dupont, Marvin Eisenberger, Borislav Kozlovskii +7

    cs.DScs.AIcs.CCarXiv:2608.16884v12026
  57. LongTraceRL: Learning Long-Context Reasoning from Search Agent Trajectories with Rubric Rewards

    Nianyi Lin, Jiajie Zhang, Lei Hou +1

    cs.CLcs.AIcs.LGarXiv:2605.31584v12026
  58. Segment Anything

    Alexander Kirillov, Eric Mintun, Nikhila Ravi +9

    cs.CVcs.AIcs.LGarXiv:2304.02643v12023
  59. Averaging Weights Leads to Wider Optima and Better Generalization

    Pavel Izmailov, Dmitrii Podoprikhin, Timur Garipov +2

    cs.LGcs.AIcs.CVarXiv:1803.05407v32018
  60. Curiosity-driven Exploration by Self-supervised Prediction

    Deepak Pathak, Pulkit Agrawal, Alexei A. Efros +1

    cs.LGcs.AIcs.CVarXiv:1705.05363v12017