Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,981 to 11,040 of 15,502
VIMA: General Robot Manipulation with Multimodal Prompts
Yunfan Jiang, Agrim Gupta, Zichen Zhang +7
cs.ROcs.AIcs.LGarXiv:2210.03094v22022PonderPounce: A Pretrained MLLM as an Episode Context Engine for Robot Control
Suhwan Choi, Jaeyoon Jung, Sungkyung Kim +2
cs.ROcs.AIarXiv:2608.24115v12026Parason: Revealing Subtask and Trial Parallelism in LLM Reasoning
Zhengyang Zhang, Zijian Zhang, Jiaxuan Gao +4
cs.AIarXiv:2608.24658v12026Mode Regularized Generative Adversarial Networks
Tong Che, Yanran Li, Athul Paul Jacob +2
cs.LGcs.AIcs.CVarXiv:1612.02136v52016ToolRobustBench: Stage-Wise Perturbation Evaluation and Failure Diagnosis for Tool-Calling Agents
YiShan Zheng, Yuan Wu, Yi Chang
cs.SEcs.AIarXiv:2608.23635v12026ChainPrune: Evaluating and Reducing Redundancy in Long Chain-of-Thought Reasoning
Weihang Pan, Zhengxu Yu, Yuxiang Zhang +5
cs.LGcs.AIarXiv:2608.21860v12026Unsupervised Discovery of Mid-Level Discriminative Patches
Saurabh Singh, Abhinav Gupta, Alexei A. Efros
cs.CVcs.AIcs.LGarXiv:1205.3137v22012ExplainGuard: A Zero Trust Framework for Post-Hoc Explanation Integrity Guarantees in Blackbox XAI Models
Maraz Mia, Shovan Roy, Mir Mehedi A. Pritom +1
cs.CRcs.AIarXiv:2608.21803v12026A survey detection channel overrides the pixels in an astronomical foundation model, and biases tomographic mean redshifts
Ihor Kendiukhov
cs.AIastro-ph.IMarXiv:2608.23626v12026Lexical Perturbations Disrupt LLM Reasoning: An Empirical Study of Attention Diversion
Jiaqian Zhu, Yang Zhang, Junhua Ding +1
cs.CLcs.AIcs.LGarXiv:2608.22140v12026A Thorough Examination of the CNN/Daily Mail Reading Comprehension Task
Danqi Chen, Jason Bolton, Christopher D. Manning
cs.CLcs.AIarXiv:1606.02858v22016Brax -- A Differentiable Physics Engine for Large Scale Rigid Body Simulation
C. Daniel Freeman, Erik Frey, Anton Raichuk +3
cs.ROcs.AIarXiv:2106.13281v12021WAM-OPD: On-Policy Distillation for World Action Models
Liuhaichen Yang, Zhuang Jiang, Chenchao Sheng +1
cs.AIcs.ROarXiv:2608.22364v12026Progressively Learning Heterogeneous Skills in a Unified Latent Space
Yue-Yi Zhang, Ming Gong, Linpu He +2
cs.CVcs.AIcs.ROarXiv:2608.23258v12026Maximum a Posteriori Policy Optimisation
Abbas Abdolmaleki, Jost Tobias Springenberg, Yuval Tassa +3
cs.LGcs.AIcs.ITarXiv:1806.06920v12018Fast Model Editing at Scale
Eric Mitchell, Charles Lin, Antoine Bosselut +2
cs.LGcs.AIcs.CLarXiv:2110.11309v22021Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?
Christian Schroeder de Witt, Tarun Gupta, Denys Makoviichuk +4
cs.AIarXiv:2011.09533v12020AgentWeave: Routing Before Reasoning for Efficient Function Calling in Tool-Rich Language Models
Saurav Singla, Aarav Singla, Advik Gupta +1
cs.AIcs.CLarXiv:2608.23078v12026Dynabench: Rethinking Benchmarking in NLP
Douwe Kiela, Max Bartolo, Yixin Nie +16
cs.CLcs.AIarXiv:2104.14337v12021Compositional Chain-of-Relations for Faithful Knowledge Graph Question Answering with Large Language Models
Chenhui Liu, Jianpeng Zhou, Jiahai Wang
cs.AIarXiv:2608.22762v12026Imagination-Augmented Agents for Deep Reinforcement Learning
Théophane Weber, Sébastien Racanière, David P. Reichert +12
cs.LGcs.AIstat.MLarXiv:1707.06203v22017Enhancing the Transferability of Adversarial Attacks through Variance Tuning
Xiaosen Wang, Kun He
cs.AIarXiv:2103.15571v32021ShardMeter: Sharded and Geo-Distributed Training Without the Guesswork
Tim Beringer, Patrick Diem, Felix Wolf +1
cs.DCcs.AIarXiv:2608.23840v12026Confidently Wrong, Silently So: Auditing Undetectable Failures of a Deployed On-Device Language Model
Shashwat Pandey, Satwik Pandey, Suresh Raghu
cs.SEcs.AIarXiv:2608.23663v12026An Empirical Evaluation of Using Large Language Models for Automated Unit Test Generation
Max Schäfer, Sarah Nadi, Aryaz Eghbali +1
cs.SEcs.AIarXiv:2302.06527v42023Exploit More, Explore Smarter for Budget-Constrained Agentic Search
Haoyang Fang, Bernie Wang
cs.AIcs.LGarXiv:2608.23848v12026Benchmarking Retrieval-Augmented Generation for Medicine
Guangzhi Xiong, Qiao Jin, Zhiyong Lu +1
cs.CLcs.AIarXiv:2402.13178v22024Serving Masked Diffusion LLMs: Characterization and Design Principles from Real Hardware
Farhana Amin, Sabiha Afroz, Mona Moghadampanah +1
cs.AIarXiv:2608.23807v12026T-LESS: An RGB-D Dataset for 6D Pose Estimation of Texture-less Objects
Tomas Hodan, Pavel Haluza, Stepan Obdrzalek +3
cs.CVcs.AIcs.ROarXiv:1701.05498v12017A Behavior-Guided Online Probabilistic Forecasting Method for Electric vehicle Charging Loads
Chenghan Li, Qingxiang Liu, Yinliang Xu +1
cs.AIarXiv:2608.24441v12026Do Spoken Language Models Hear Speech as They Read Text? Bridging Structural Gaps Between Speech and Text
Hyeonyu Kim, Hwayeon Kim, Youngwon Choi +2
cs.CLcs.AIarXiv:2608.22908v12026Function-Level Execution Feedback for Code Preference Optimization
Idris Nechnech, Sehwan Kim, Jimin Seo +4
cs.AIcs.SEarXiv:2608.23632v12026Machine Comprehension Using Match-LSTM and Answer Pointer
Shuohang Wang, Jing Jiang
cs.CLcs.AIarXiv:1608.07905v22016Agentic-MME: What Agentic Capability Really Brings to Multimodal Intelligence?
Qianshan Wei, Yishan Yang, Siyi Wang +12
cs.AIarXiv:2604.03016v12026Mathematical Capabilities of ChatGPT
Simon Frieder, Luca Pinchetti, Alexis Chevalier +5
cs.LGcs.AIcs.CLarXiv:2301.13867v22023LLMs are Few-Shot Decision-Makers: Generalized Context-Aware Microgrid Frequency Control through Prompt Decision Transformer
Xu Yang, Chenhui Lin, Haotian Liu +3
eess.SYcs.AIarXiv:2608.21858v12026Score-based diffusion models for accelerated MRI
Hyungjin Chung, Jong Chul Ye
eess.IVcs.AIcs.CVarXiv:2110.05243v32021LLM Agents Perform Controlled Experiments Using Simulation Models
Yuchen Xia, Michael Weyrich, Nasser Jazdi +6
cs.AIcs.CLcs.MAarXiv:2608.23622v12026Where World Models Break: Natural-Input Failure Discovery
Zhanpeng Shi, Zi Liang, Rong Feng +3
cs.AIarXiv:2608.22421v12026TAT-QA: A Question Answering Benchmark on a Hybrid of Tabular and Textual Content in Finance
Fengbin Zhu, Wenqiang Lei, Youcheng Huang +5
cs.CLcs.AIarXiv:2105.07624v22021How Much Regularization Survives Averaging? Update Masking in Federated Learning
Wenhao Yan, Fu Kuroda, Yucheng Jin +1
cs.LGcs.AIarXiv:2608.23286v22026Data Mixing as Mixture Experiment: Response Surface Methodology and Optimal Design for Large Language Model Pretraining
Yicheng Mao, Hongru Du
cs.AIstat.MLarXiv:2608.23922v12026Restoring Without Forgetting: Continual Learning Across Image Degradations
Alif Ashrafee, Bartosz Krawczyk
cs.CVcs.AIcs.LGarXiv:2608.23799v12026AI Agents Push Humans Out of the Loop
Margaret Mitchell, Avijit Ghosh, Samir Passi
cs.AIcs.HCarXiv:2608.23642v12026Beyond Static Interpretability: Anticipating Post-SFT Mechanisms from Pre-SFT Parameters for Better Tuning
Hang Chen, Jiaying Zhu, Wenya Wang
cs.LGcs.AIcs.CLarXiv:2608.24482v12026Simthesizer: An Agent-Driven Simulation Framework for LLM Serving Systems
Wonung Kim, Hyunmin Choi, Minsu Kim +3
cs.ARcs.AIarXiv:2608.24650v12026Variational Inference of Disentangled Latent Concepts from Unlabeled Observations
Abhishek Kumar, Prasanna Sattigeri, Avinash Balakrishnan
cs.LGcs.AIcs.CVarXiv:1711.00848v32017Predicting Radiologist Expertise from 3D Gaze Patterns During CT Interpretation
Leila Khaertdinova, Anna Anikina, Claudia Mello-Thoms +1
cs.CVcs.AIcs.LGarXiv:2608.23836v12026FLARE: A Systematic, Uncertainty-Aware Framework for Evidence-Based Adoption of Artificial Intelligence in Healthcare
Jacob Idoko, Siddhartha Paudel, Mariana Bento +2
cs.AIarXiv:2608.23643v12026Learning Invariant Representations for Reinforcement Learning without Reconstruction
Amy Zhang, Rowan McAllister, Roberto Calandra +2
cs.LGcs.AIstat.MLarXiv:2006.10742v22020ET-BERT: A Contextualized Datagram Representation with Pre-training Transformers for Encrypted Traffic Classification
Xinjie Lin, Gang Xiong, Gaopeng Gou +3
cs.CRcs.AIcs.NIarXiv:2202.06335v22022PsychJail: Exploring Psychological Jailbreaks via Multi-Turn Persuasion of LLM Policies
Zeyu Feng, Qingyu Wu, Yuzhe Luo +1
cs.AIarXiv:2608.23028v12026API-Bank: A Comprehensive Benchmark for Tool-Augmented LLMs
Minghao Li, Yingxiu Zhao, Bowen Yu +6
cs.CLcs.AIarXiv:2304.08244v22023Counterfactual Visual Explanations
Yash Goyal, Ziyan Wu, Jan Ernst +3
cs.LGcs.AIcs.CVarXiv:1904.07451v22019SA-RSQ: A Versatile Sparse Representation Framework for Multi-modal Recommender Systems
Xiang Wang, Shigang Quan, Tingzhen Chang +5
cs.AIarXiv:2608.22979v22026Improving the matrix multiplication exponent with modern optimization and AlphaEvolve
Emilien Dupont, Marvin Eisenberger, Borislav Kozlovskii +7
cs.DScs.AIcs.CCarXiv:2608.16884v12026LongTraceRL: Learning Long-Context Reasoning from Search Agent Trajectories with Rubric Rewards
Nianyi Lin, Jiajie Zhang, Lei Hou +1
cs.CLcs.AIcs.LGarXiv:2605.31584v12026Segment Anything
Alexander Kirillov, Eric Mintun, Nikhila Ravi +9
cs.CVcs.AIcs.LGarXiv:2304.02643v12023Averaging Weights Leads to Wider Optima and Better Generalization
Pavel Izmailov, Dmitrii Podoprikhin, Timur Garipov +2
cs.LGcs.AIcs.CVarXiv:1803.05407v32018Curiosity-driven Exploration by Self-supervised Prediction
Deepak Pathak, Pulkit Agrawal, Alexei A. Efros +1
cs.LGcs.AIcs.CVarXiv:1705.05363v12017