Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

181 to 240 of 15,222

  1. Social Chemistry 101: Learning to Reason about Social and Moral Norms

    Maxwell Forbes, Jena D. Hwang, Vered Shwartz +2

    cs.CLcs.AIarXiv:2011.00620v32020
  2. When Entropy Is Not Enough: Reclaiming Lost Semantics in LLM Output Length Prediction

    Feiyang Ren, Shengtao Wen, Lingbing Guo +3

    cs.AIarXiv:2608.15592v12026
  3. Open Question Answering over Tables and Text

    Wenhu Chen, Ming-Wei Chang, Eva Schlinger +2

    cs.CLcs.AIarXiv:2010.10439v22020
  4. Dynamic Early Exit in Reasoning Models

    Chenxu Yang, Qingyi Si, Yongjie Duan +6

    cs.CLcs.AIarXiv:2504.15895v32025
  5. DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning

    Zhiwei He, Tian Liang, Jiahao Xu +12

    cs.CLcs.AIarXiv:2504.11456v22025
  6. SEAL: Steerable Reasoning Calibration of Large Language Models for Free

    Runjin Chen, Zhenyu Zhang, Junyuan Hong +2

    cs.CLcs.AIarXiv:2504.07986v32025
  7. The Quality of Claude AI-authored Python Tests Is Not Weaker Than Human-authored Tests

    Douglas J. Leith

    cs.SEcs.AIarXiv:2608.15188v12026
  8. Calibrated Trust, Not Sharper Prediction: An Empirical Test of Uncertainty Fusion

    Surya Saka

    cs.LGcs.AIcs.CLarXiv:2608.14617v12026
  9. Plausible but Not Valid: A Psychometric Audit of LLMs as Synthetic Survey Respondents

    Mantas Lukauskas, Viktorija Šarkauskaitė

    cs.CYcs.AIcs.CLarXiv:2608.14606v12026
  10. HiCo-GS: Hierarchical Context Aggregation and Geometric Consistency for Octree Gaussian Splatting

    Wei Zhang, Shengkai Yu, Shiqiang Gong +3

    cs.CVcs.AIarXiv:2608.14136v12026
  11. MedAgent-Pro: Towards Evidence-based Multi-modal Medical Diagnosis via Reasoning Agentic Workflow

    Ziyue Wang, Junde Wu, Linghan Cai +4

    cs.AIarXiv:2503.18968v32025
  12. Online Bayesian Goal Inference for Boundedly-Rational Planning Agents

    Tan Zhi-Xuan, Jordyn L. Mann, Tom Silver +2

    cs.AIarXiv:2006.07532v22020
  13. TokenSqueeze: Performance-Preserving Compression for Reasoning LLMs

    Yuxiang Zhang, Zhengxu Yu, Weihang Pan +5

    cs.LGcs.AIarXiv:2511.13223v12025
  14. TxAgent: An AI Agent for Therapeutic Reasoning Across a Universe of Tools

    Shanghua Gao, Richard Zhu, Zhenglun Kong +5

    cs.AIcs.LGarXiv:2503.10970v12025
  15. Evidence-RL: Towards Evidence-intensive Visual Reasoning

    Haojie Huang, Xinlei Yu, Chengming Xu +6

    cs.CVcs.AIarXiv:2608.08021v12026
  16. Multi-Agent Forensic Reasoning for Generalizable Deepfake Video Detection

    Xuechao Zou, Shun Zhang, Kai Li +6

    cs.CVcs.AIcs.MAarXiv:2608.06865v12026
  17. EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning

    Zishan Xu, Zhiyuan Yao, Yuxin Chen +9

    cs.AIarXiv:2608.06197v12026
  18. Dataset Distillation with Neural Characteristic Function: A Minmax Perspective

    Shaobo Wang, Yicun Yang, Zhiyuan Liu +4

    cs.CVcs.AIcs.LGarXiv:2502.20653v12025
    Summaries:한국어
  19. Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills

    Gaytri Jena, Kapil Wanaskar, Vinija Jain +3

    cs.ROcs.AIarXiv:2608.01851v12026
  20. CollabLLM: From Passive Responders to Active Collaborators

    Shirley Wu, Michel Galley, Baolin Peng +7

    cs.AIarXiv:2502.00640v32025
  21. Towards System 2 Reasoning in LLMs: Learning How to Think With Meta Chain-of-Thought

    Violet Xiang, Charlie Snell, Kanishk Gandhi +11

    cs.AIcs.CLarXiv:2501.04682v12025
  22. Reasoning Denoiser: Denoising Reasoning Traces for Hallucination Detection in Large Reasoning Models

    Junlin Fang, Do Nguyen-Thanh, Xiaogang Xu +2

    cs.AIcs.LGarXiv:2607.22098v12026
  23. Improving Medical Large Vision-Language Models with Abnormal-Aware Feedback

    Yucheng Zhou, Lingran Song, Jianbing Shen

    cs.CLcs.AIcs.CVarXiv:2501.01377v22025
  24. Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model

    Xinghang Li, Jun Guo, Qiwei Li +21

    cs.ROcs.AIarXiv:2607.11643v12026
  25. OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations

    Linke Ouyang, Yuan Qu, Hongbin Zhou +17

    cs.CVcs.AIcs.IRarXiv:2412.07626v22024
  26. Frontier Models are Capable of In-context Scheming

    Alexander Meinke, Bronson Schoen, Jérémy Scheurer +3

    cs.AIcs.LGarXiv:2412.04984v22024
  27. Church: a language for generative models

    Noah Goodman, Vikash Mansinghka, Daniel M. Roy +2

    cs.PLcs.AIcs.LOarXiv:1206.3255v22012
  28. Parallelized Autoregressive Decoding for Omni-Modal Dense Video Captioning

    Wenzheng Zeng, Siyi Jiao, Chen Gao +2

    cs.CVcs.AIcs.MMarXiv:2607.02963v12026
  29. VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement

    Seohyun Lee, Seoung Choi, Dohwan Ko +2

    cs.CVcs.AIarXiv:2607.00446v12026
  30. Large Language Model-Brained GUI Agents: A Survey

    Chaoyun Zhang, Shilin He, Jiaxu Qian +10

    cs.AIcs.CLcs.HCarXiv:2411.18279v122024
  31. Beyond IID: How General Are Tabular Foundation Models, Really?

    Lennart Purucker, Andrej Tschalzev, Nick Erickson +7

    cs.LGcs.AIarXiv:2606.30410v12026
    Summaries:한국어
  32. PhysGen: Rigid-Body Physics-Grounded Image-to-Video Generation

    Shaowei Liu, Zhongzheng Ren, Saurabh Gupta +1

    cs.CVcs.AIcs.LGarXiv:2409.18964v12024
  33. LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts

    Yijia Xiao, Edward Sun, Tianyu Liu +1

    cs.AIcs.CLcs.CVarXiv:2407.04973v12024
  34. A Survey on Knowledge Graphs: Representation, Acquisition and Applications

    Shaoxiong Ji, Shirui Pan, Erik Cambria +2

    cs.CLcs.AIarXiv:2002.00388v42020
  35. Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs

    Xin Lai, Zhuotao Tian, Yukang Chen +3

    cs.LGcs.AIcs.CLarXiv:2406.18629v12024
  36. OR-Bench: An Over-Refusal Benchmark for Large Language Models

    Justin Cui, Wei-Lin Chiang, Ion Stoica +1

    cs.CLcs.AIarXiv:2405.20947v52024
  37. SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering

    John Yang, Carlos E. Jimenez, Alexander Wettig +4

    cs.SEcs.AIcs.CLarXiv:2405.15793v32024
  38. GUI vs. CLI: Execution Bottlenecks in Screen-Only and Skill-Mediated Computer-Use Agents

    Xiao Zhou, Siyue Zhang, Yilun Zhao +4

    cs.AIarXiv:2606.24551v12026
  39. CAVEWOMAN: How Large Language Models Behave Under Linguistic Input and Output Compression

    Morayo Danielle Adeyemi, Ryan A. Rossi, Franck Dernoncourt

    cs.CLcs.AIcs.LGarXiv:2606.24083v12026
  40. LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding

    Mostafa Elhoushi, Akshat Shrivastava, Diana Liskovich +10

    cs.CLcs.AIcs.LGarXiv:2404.16710v42024
  41. ControlNet++: Improving Conditional Controls with Efficient Consistency Feedback

    Ming Li, Taojiannan Yang, Huafeng Kuang +4

    cs.CVcs.AIcs.LGarXiv:2404.07987v42024
  42. Where Did It Go Wrong? Process-Level Evaluation of Web Agents with Semantic State Tracking

    Jiwan Chung, JiHyuk Byun, Vibhav Vineet +1

    cs.AIcs.LGarXiv:2606.15673v22026
  43. CODA-BENCH: Can Code Agents Handle Data-Intensive Tasks?

    Yuxin Zhang, Ju Fan, Meihao Fan +2

    cs.AIcs.CLarXiv:2606.15300v12026
  44. Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey

    Zhichen Dong, Zhanhui Zhou, Chao Yang +2

    cs.CLcs.AIcs.CYarXiv:2402.09283v32024
  45. From Chatbot to Digital Colleague: The Paradigm Shift Toward Persistent Autonomous AI

    Yongheng Zhang, Ziang Liu, Jiaxuan Zhu +17

    cs.AIarXiv:2606.14502v22026
  46. SPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models

    Dongyang Liu, Renrui Zhang, Longtian Qiu +16

    cs.CVcs.AIcs.CLarXiv:2402.05935v32024
  47. Reliable Fine-Grained Evaluation of Natural Language Math Proofs

    Wenjie Ma, Andrei Cojocaru, Neel Kolhe +6

    cs.CLcs.AIarXiv:2510.13888v22025
  48. Improving Factual Consistency of Abstractive Summarization via Question Answering

    Feng Nan, Cicero Nogueira dos Santos, Henghui Zhu +7

    cs.CLcs.AIarXiv:2105.04623v12021
  49. Emoti-Attack: Zero-Perturbation Adversarial Attacks on NLP Systems via Emoji Sequences

    Yangshijie Zhang

    cs.AIcs.CLcs.CRarXiv:2502.17392v12025
  50. A Principle of Targeted Intervention for Multi-Agent Reinforcement Learning

    Anjie Liu, Jianhong Wang, Samuel Kaski +2

    cs.AIcs.LGcs.MAarXiv:2510.17697v42025
  51. Fair Transfer of Multiple Style Attributes in Text

    Karan Dabas, Nishtha Madan, Vijay Arya +3

    cs.CLcs.AIcs.LGarXiv:2001.06693v12020
  52. Training Language Models with Language Feedback

    Jérémy Scheurer, Jon Ander Campos, Jun Shern Chan +3

    cs.CLcs.AIcs.LGarXiv:2204.14146v42022
  53. Brain-Inspired Stochastic Joint Embedding Representation Learning

    Makoto Yamada, Kian Ming A. Chai, Ayoub Rhim +3

    cs.CVcs.AIcs.LGarXiv:2505.11129v22025
  54. Rainier: Reinforced Knowledge Introspector for Commonsense Question Answering

    Jiacheng Liu, Skyler Hallinan, Ximing Lu +4

    cs.CLcs.AIarXiv:2210.03078v22022
  55. Visual Representation Learning with Stochastic Frame Prediction

    Huiwon Jang, Dongyoung Kim, Junsu Kim +3

    cs.CVcs.AIcs.LGarXiv:2406.07398v22024
  56. DeepSeek-V3 Technical Report

    DeepSeek-AI, Aixin Liu, Bei Feng +197

    cs.CLcs.AIarXiv:2412.19437v22024
  57. Graph-of-Skills: Dependency-Aware Structural Retrieval for Massive Agent Skills

    Dawei Liu, Zongxia Li, Hongyang Du +4

    cs.AIarXiv:2604.05333v42026
  58. VeOmni: Scaling Any Modality Model Training with Model-Centric Distributed Recipe Zoo

    Qianli Ma, Yaowei Zheng, Zhelun Shi +9

    cs.CLcs.AIcs.DCarXiv:2508.02317v32025
  59. Detecting Socially Abnormal Highway Driving Behaviors via Recurrent Graph Attention Networks

    Yue Hu, Yuhang Zhang, Yanbing Wang +1

    cs.AIarXiv:2304.11513v12023
  60. Zoom In, Reason Out: Efficient Far-field Anomaly Detection in Expressway Surveillance Videos via Focused VLM Reasoning Guided by Bayesian Inference

    Xiaowei Mao, Bowen Sui, Weijie Zhang +7

    cs.CVcs.AIarXiv:2604.23724v42026