Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
181 to 240 of 15,222
Social Chemistry 101: Learning to Reason about Social and Moral Norms
Maxwell Forbes, Jena D. Hwang, Vered Shwartz +2
cs.CLcs.AIarXiv:2011.00620v32020When Entropy Is Not Enough: Reclaiming Lost Semantics in LLM Output Length Prediction
Feiyang Ren, Shengtao Wen, Lingbing Guo +3
cs.AIarXiv:2608.15592v12026Open Question Answering over Tables and Text
Wenhu Chen, Ming-Wei Chang, Eva Schlinger +2
cs.CLcs.AIarXiv:2010.10439v22020Dynamic Early Exit in Reasoning Models
Chenxu Yang, Qingyi Si, Yongjie Duan +6
cs.CLcs.AIarXiv:2504.15895v32025DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning
Zhiwei He, Tian Liang, Jiahao Xu +12
cs.CLcs.AIarXiv:2504.11456v22025SEAL: Steerable Reasoning Calibration of Large Language Models for Free
Runjin Chen, Zhenyu Zhang, Junyuan Hong +2
cs.CLcs.AIarXiv:2504.07986v32025The Quality of Claude AI-authored Python Tests Is Not Weaker Than Human-authored Tests
Douglas J. Leith
cs.SEcs.AIarXiv:2608.15188v12026Calibrated Trust, Not Sharper Prediction: An Empirical Test of Uncertainty Fusion
Surya Saka
cs.LGcs.AIcs.CLarXiv:2608.14617v12026Plausible but Not Valid: A Psychometric Audit of LLMs as Synthetic Survey Respondents
Mantas Lukauskas, Viktorija Šarkauskaitė
cs.CYcs.AIcs.CLarXiv:2608.14606v12026HiCo-GS: Hierarchical Context Aggregation and Geometric Consistency for Octree Gaussian Splatting
Wei Zhang, Shengkai Yu, Shiqiang Gong +3
cs.CVcs.AIarXiv:2608.14136v12026MedAgent-Pro: Towards Evidence-based Multi-modal Medical Diagnosis via Reasoning Agentic Workflow
Ziyue Wang, Junde Wu, Linghan Cai +4
cs.AIarXiv:2503.18968v32025Online Bayesian Goal Inference for Boundedly-Rational Planning Agents
Tan Zhi-Xuan, Jordyn L. Mann, Tom Silver +2
cs.AIarXiv:2006.07532v22020TokenSqueeze: Performance-Preserving Compression for Reasoning LLMs
Yuxiang Zhang, Zhengxu Yu, Weihang Pan +5
cs.LGcs.AIarXiv:2511.13223v12025TxAgent: An AI Agent for Therapeutic Reasoning Across a Universe of Tools
Shanghua Gao, Richard Zhu, Zhenglun Kong +5
cs.AIcs.LGarXiv:2503.10970v12025Evidence-RL: Towards Evidence-intensive Visual Reasoning
Haojie Huang, Xinlei Yu, Chengming Xu +6
cs.CVcs.AIarXiv:2608.08021v12026Multi-Agent Forensic Reasoning for Generalizable Deepfake Video Detection
Xuechao Zou, Shun Zhang, Kai Li +6
cs.CVcs.AIcs.MAarXiv:2608.06865v12026EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning
Zishan Xu, Zhiyuan Yao, Yuxin Chen +9
cs.AIarXiv:2608.06197v12026Dataset Distillation with Neural Characteristic Function: A Minmax Perspective
Shaobo Wang, Yicun Yang, Zhiyuan Liu +4
cs.CVcs.AIcs.LGarXiv:2502.20653v12025Summaries:한국어Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills
Gaytri Jena, Kapil Wanaskar, Vinija Jain +3
cs.ROcs.AIarXiv:2608.01851v12026CollabLLM: From Passive Responders to Active Collaborators
Shirley Wu, Michel Galley, Baolin Peng +7
cs.AIarXiv:2502.00640v32025Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought
Violet Xiang, Charlie Snell, Kanishk Gandhi +11
cs.AIcs.CLarXiv:2501.04682v12025Reasoning Denoiser: Denoising Reasoning Traces for Hallucination Detection in Large Reasoning Models
Junlin Fang, Do Nguyen-Thanh, Xiaogang Xu +2
cs.AIcs.LGarXiv:2607.22098v12026Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback
Yucheng Zhou, Lingran Song, Jianbing Shen
cs.CLcs.AIcs.CVarXiv:2501.01377v22025Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model
Xinghang Li, Jun Guo, Qiwei Li +21
cs.ROcs.AIarXiv:2607.11643v12026OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations
Linke Ouyang, Yuan Qu, Hongbin Zhou +17
cs.CVcs.AIcs.IRarXiv:2412.07626v22024Frontier Models are Capable of In-context Scheming
Alexander Meinke, Bronson Schoen, Jérémy Scheurer +3
cs.AIcs.LGarXiv:2412.04984v22024Church: a language for generative models
Noah Goodman, Vikash Mansinghka, Daniel M. Roy +2
cs.PLcs.AIcs.LOarXiv:1206.3255v22012Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning
Wenzheng Zeng, Siyi Jiao, Chen Gao +2
cs.CVcs.AIcs.MMarXiv:2607.02963v12026VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement
Seohyun Lee, Seoung Choi, Dohwan Ko +2
cs.CVcs.AIarXiv:2607.00446v12026Large Language Model-Brained GUI Agents: A Survey
Chaoyun Zhang, Shilin He, Jiaxu Qian +10
cs.AIcs.CLcs.HCarXiv:2411.18279v122024Beyond IID: How General Are Tabular Foundation Models, Really?
Lennart Purucker, Andrej Tschalzev, Nick Erickson +7
cs.LGcs.AIarXiv:2606.30410v12026Summaries:한국어PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation
Shaowei Liu, Zhongzheng Ren, Saurabh Gupta +1
cs.CVcs.AIcs.LGarXiv:2409.18964v12024LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts
Yijia Xiao, Edward Sun, Tianyu Liu +1
cs.AIcs.CLcs.CVarXiv:2407.04973v12024A Survey on Knowledge Graphs: Representation, Acquisition and Applications
Shaoxiong Ji, Shirui Pan, Erik Cambria +2
cs.CLcs.AIarXiv:2002.00388v42020Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
Xin Lai, Zhuotao Tian, Yukang Chen +3
cs.LGcs.AIcs.CLarXiv:2406.18629v12024OR-Bench: An Over-Refusal Benchmark for Large Language Models
Justin Cui, Wei-Lin Chiang, Ion Stoica +1
cs.CLcs.AIarXiv:2405.20947v52024SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering
John Yang, Carlos E. Jimenez, Alexander Wettig +4
cs.SEcs.AIcs.CLarXiv:2405.15793v32024GUI vs. CLI: Execution Bottlenecks in Screen-Only and Skill-Mediated Computer-Use Agents
Xiao Zhou, Siyue Zhang, Yilun Zhao +4
cs.AIarXiv:2606.24551v12026CAVEWOMAN: How Large Language Models Behave Under Linguistic Input and Output Compression
Morayo Danielle Adeyemi, Ryan A. Rossi, Franck Dernoncourt
cs.CLcs.AIcs.LGarXiv:2606.24083v12026LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding
Mostafa Elhoushi, Akshat Shrivastava, Diana Liskovich +10
cs.CLcs.AIcs.LGarXiv:2404.16710v42024ControlNet++: Improving Conditional Controls with Efficient Consistency Feedback
Ming Li, Taojiannan Yang, Huafeng Kuang +4
cs.CVcs.AIcs.LGarXiv:2404.07987v42024Where Did It Go Wrong? Process-Level Evaluation of Web Agents with Semantic State Tracking
Jiwan Chung, JiHyuk Byun, Vibhav Vineet +1
cs.AIcs.LGarXiv:2606.15673v22026CODA-BENCH: Can Code Agents Handle Data-Intensive Tasks?
Yuxin Zhang, Ju Fan, Meihao Fan +2
cs.AIcs.CLarXiv:2606.15300v12026Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey
Zhichen Dong, Zhanhui Zhou, Chao Yang +2
cs.CLcs.AIcs.CYarXiv:2402.09283v32024From Chatbot to Digital Colleague: The Paradigm Shift Toward Persistent Autonomous AI
Yongheng Zhang, Ziang Liu, Jiaxuan Zhu +17
cs.AIarXiv:2606.14502v22026SPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models
Dongyang Liu, Renrui Zhang, Longtian Qiu +16
cs.CVcs.AIcs.CLarXiv:2402.05935v32024Reliable Fine-Grained Evaluation of Natural Language Math Proofs
Wenjie Ma, Andrei Cojocaru, Neel Kolhe +6
cs.CLcs.AIarXiv:2510.13888v22025Improving Factual Consistency of Abstractive Summarization via Question Answering
Feng Nan, Cicero Nogueira dos Santos, Henghui Zhu +7
cs.CLcs.AIarXiv:2105.04623v12021Emoti-Attack: Zero-Perturbation Adversarial Attacks on NLP Systems via Emoji Sequences
Yangshijie Zhang
cs.AIcs.CLcs.CRarXiv:2502.17392v12025A Principle of Targeted Intervention for Multi-Agent Reinforcement Learning
Anjie Liu, Jianhong Wang, Samuel Kaski +2
cs.AIcs.LGcs.MAarXiv:2510.17697v42025Fair Transfer of Multiple Style Attributes in Text
Karan Dabas, Nishtha Madan, Vijay Arya +3
cs.CLcs.AIcs.LGarXiv:2001.06693v12020Training Language Models with Language Feedback
Jérémy Scheurer, Jon Ander Campos, Jun Shern Chan +3
cs.CLcs.AIcs.LGarXiv:2204.14146v42022Brain-Inspired Stochastic Joint Embedding Representation Learning
Makoto Yamada, Kian Ming A. Chai, Ayoub Rhim +3
cs.CVcs.AIcs.LGarXiv:2505.11129v22025Rainier: Reinforced Knowledge Introspector for Commonsense Question Answering
Jiacheng Liu, Skyler Hallinan, Ximing Lu +4
cs.CLcs.AIarXiv:2210.03078v22022Visual Representation Learning with Stochastic Frame Prediction
Huiwon Jang, Dongyoung Kim, Junsu Kim +3
cs.CVcs.AIcs.LGarXiv:2406.07398v22024DeepSeek-V3 Technical Report
DeepSeek-AI, Aixin Liu, Bei Feng +197
cs.CLcs.AIarXiv:2412.19437v22024Graph-of-Skills: Dependency-Aware Structural Retrieval for Massive Agent Skills
Dawei Liu, Zongxia Li, Hongyang Du +4
cs.AIarXiv:2604.05333v42026VeOmni: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo
Qianli Ma, Yaowei Zheng, Zhelun Shi +9
cs.CLcs.AIcs.DCarXiv:2508.02317v32025Detecting Socially Abnormal Highway Driving Behaviors via Recurrent Graph Attention Networks
Yue Hu, Yuhang Zhang, Yanbing Wang +1
cs.AIarXiv:2304.11513v12023Zoom In, Reason Out: Efficient Far-field Anomaly Detection in Expressway Surveillance Videos via Focused VLM Reasoning Guided by Bayesian Inference
Xiaowei Mao, Bowen Sui, Weijie Zhang +7
cs.CVcs.AIarXiv:2604.23724v42026