Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

5,161 to 5,220 of 15,179

  1. CordisBench: Can Language Models Reason About Component Lifecycles in Dynamic Agent Harnesses?

    Damien Sileo, Dimitri Kachler

    cs.CLcs.AIarXiv:2609.01600v12026
  2. The Hitchhiker's Guide to Agentic AI: From Foundations to Systems

    Haggai Roitman

    cs.AIcs.CLcs.IRarXiv:2606.24937v22026
    Summaries:한국어
  3. Agentic Large Language Models, a survey

    Aske Plaat, Max van Duijn, Niki van Stein +3

    cs.AIcs.CLcs.LGarXiv:2503.23037v32025
  4. InstructMesh: Selective Refinement of Generative 3D Models for Fabrication

    Faraz Faruqi, Ahmed Katary, Demircan Tas +10

    cs.AIarXiv:2608.28534v12026
  5. Twin Worlds: Equivariance-Based Abstention for Evidence-Grounded Reasoning

    Vy Nguyen, Ziqi Xu, Jeffrey Chan +5

    cs.CLcs.AIcs.LGarXiv:2608.28018v12026
  6. Why Didn't It Check? Unsupported Final Claims and Their Repair in Two Tool-Equipped Language Models

    Justin Bronder

    cs.AIcs.CLarXiv:2608.27768v12026
  7. SpecMind: Enabling Spectrum Intelligence via Multi-Agent Hybrid Retrieval-Augmented Generation

    Songwei Dong, Bingyan Lu, Makayla Kienlen +2

    cs.AIarXiv:2609.00427v12026
  8. PACEShop: Evaluating Personalized, Actionable, Compositional, and Evidence-grounded Shopping Assistants

    Weimin Lyu, Chen Luo, Guangrui Li +9

    cs.CLcs.AIarXiv:2608.26180v12026
  9. On Scope Classification and Current Knowledge-Editing Benchmarks: A Negative Result, with INLAY as a Gradient-Free Case Study

    Aditya Pratap Singh

    cs.CLcs.AIcs.LGarXiv:2608.26292v12026
  10. When Composition Doesn't Add Up: Humans Identifying Defects in AI-Generated Images

    Ruoqi Hu, Chulin Zhao, Jiashuo Chang +2

    cs.CVcs.AIarXiv:2608.25933v12026
  11. Repair Is Nearly Generation: Multilingual Program Repair with LLMs

    Harshit Joshi, José Cambronero, Sumit Gulwani +3

    cs.SEcs.AIcs.PLarXiv:2208.11640v32022
  12. VINCENT: Validated Interaction Network for Cross-drug Explanation of Therapeutics

    Fan-Sheng Chuang, Xuchen Li, Yujing Bian +1

    cs.LGcs.AIarXiv:2608.25841v12026
  13. Multi-Behavior Hypergraph-Enhanced Transformer for Sequential Recommendation

    Yuhao Yang, Chao Huang, Lianghao Xia +3

    cs.IRcs.AIarXiv:2207.05584v22022
  14. TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models

    Mark YU, Wenbo Hu, Jinbo Xing +1

    cs.CVcs.AIcs.GRarXiv:2503.05638v12025
  15. Right Diagnoses, Decorative Reasoning:A Perturbation Audit of Medical Chain-of-Thought

    Mengzhu Xu, Jifan Gao, Xia Jiang +2

    cs.AIarXiv:2608.24790v12026
  16. Neurosymbolic Alignment for Physiologically-Safe Clinical Language Models

    Abdulhady Abas Abdullah, Erik Cambria, Milena Zivkovic

    cs.AIarXiv:2608.24534v12026
  17. Learning Language Games through Interaction

    Sida I. Wang, Percy Liang, Christopher D. Manning

    cs.CLcs.AIarXiv:1606.02447v12016
  18. HMGCLIP: Heterogeneous Multi-Granularity Contrastive Learning for E-commerce Representation Learning

    Qiuyu Zhu, Yi Gao, Zhichao Wan +1

    cs.AIarXiv:2608.24467v12026
  19. HBQ: Hierarchical Scaling Block Quantization with Hardware-Efficiency-Aware Design for Accurate LLM Inference

    Chun-Ting Chen, Dongmin Han, Hangyeol Mun +6

    cs.LGcs.AIcs.ARarXiv:2609.00450v12026
  20. ReproAgent: Contract-Guided Paper-to-Code Reproduction

    Xue Hu, Zewei Pan, Zhongyuan Wang +3

    cs.AIcs.SEarXiv:2608.24291v12026
  21. IndexTTS2: A Breakthrough in Emotionally Expressive and Duration-Controlled Auto-Regressive Zero-Shot Text-to-Speech

    Siyi Zhou, Yiquan Zhou, Yi He +4

    cs.CLcs.AIcs.SDarXiv:2506.21619v22025
  22. UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning

    Zhengxi Lu, Yuxiang Chai, Yaxuan Guo +7

    cs.AIarXiv:2503.21620v52025
  23. The Multilingual FrameNet Corpus

    Beatrice Fiumanò, Nicolas Lazzari, Simone Paolo Ponzetto +1

    cs.CLcs.AIarXiv:2608.23037v12026
  24. Improving Few-Step Language Flows with Untied Self-Conditioning

    Bocheng Li, Linli Xu

    cs.CLcs.AIcs.LGarXiv:2608.22244v12026
  25. GenCoord: Skill-Path Commitments under Private Information

    Peng He, Junning Zhu, Haohan Yuan +1

    cs.AIarXiv:2608.22055v12026
  26. Dissecting Neuro-Symbolic Quality Assurance for Synthetic Oncology Data Generation

    Laxmigayathri Challa, Yuhan Zhou, Ana Cleveland +1

    cs.AIarXiv:2608.22085v12026
  27. Beyond Recall: Behavioral Specification as an Interpretive Layer for AI Personalization

    Aarik Gulaya

    cs.CLcs.AIcs.HCarXiv:2605.28969v22026
  28. Vis-Poison: Poisoning Visual Knowledge in Multimodal Retrieval-Augmented Generation

    Rujin Liang, Zhongpu Chen, Yuhao Lei +1

    cs.CVcs.AIarXiv:2608.20756v12026
  29. Stress-Testing the Reasoning Competence of LLMs With Proofs Under Minimal Formalism

    Konstantine Arkoudas, Serafim Batzoglou

    cs.LOcs.AIarXiv:2605.12524v12026
  30. Towards Quantifying Benchmark Optimization in ASR Models

    Theo Lebryk, David Ayllon, Alice Baird +3

    cs.SDcs.AIarXiv:2608.19936v12026
  31. FastKernels: Benchmarking GPU Kernel Generation in Production

    Gabriele Oliaro, Yichao Fu, May Jiang +5

    cs.LGcs.AIcs.CLarXiv:2605.23215v12026
  32. From Storage to Access: Verifiable Activation of Parametric Knowledge in LLMs via Explicit Priming and Implicit Reasoning

    Zuocheng Ying, Yang Yang, Yumou Wu +6

    cs.CLcs.AIcs.LGarXiv:2608.18581v12026
  33. COMIC: Reference-Aware Safety Gating for Multimodal Large Language Models

    Md Abdullahil Oaphy, Anhao Xiang, Zongxing Xie +3

    cs.CRcs.AIarXiv:2608.17234v12026
  34. Memory OS of AI Agent

    Jiazheng Kang, Mingming Ji, Zhe Zhao +1

    cs.AIarXiv:2506.06326v12025
    Summaries:한국어
  35. Pre-training Visual Dexterity in Simulation

    Sarthak Kamat, Adam Rashid, Satvik Sharma +4

    cs.ROcs.AIcs.CVarXiv:2608.15917v12026
  36. RAGas: Retrieval-Augmented Gas Optimization for Smart Contracts with Continuous Knowledge Integration

    Yishun Wang, Wenjin Yi, Wenkai Li +2

    cs.AIarXiv:2608.15857v12026
  37. RLCascadeRouter: Quality-Estimator-Free Cascade Routing via Reinforcement Learning

    Shihong Huang, Shengjie Wang, Hong Ma +1

    cs.AIarXiv:2608.15817v12026
  38. The Unwritten Benchmark: A New Challenge for Multimodal Machine Learning in Abstract Perceptual Reasoning

    Garima Arya Yadav, Nilay Yilmaz, Yezhou Yang

    cs.AIcs.CVarXiv:2608.14558v12026
  39. Cura 1T: Specialized Model for Agentic Healthcare

    actAVA AI, :, Haolin Chen +9

    cs.AIarXiv:2607.15314v22026
  40. Think, Act, Build: An Agentic Framework with Vision Language Models for Zero-Shot 3D Visual Grounding

    Haibo Wang, Zihao Lin, Zhiyang Xu +1

    cs.CVcs.AIarXiv:2604.00528v22026
  41. HealthAgentBench: A Unified Benchmark Suite of Realistic Agentic Healthcare Environments for Challenging Frontier AI Agents

    Qianchu Liu, Sheng Zhang, Guanghui Qin +16

    cs.AIcs.CLcs.CVarXiv:2606.31179v12026
    Summaries:한국어
  42. SpatialClaw: Rethinking Action Interface for Agentic Spatial Reasoning

    Seokju Cho, Ryo Hachiuma, Abhishek Badki +8

    cs.CVcs.AIarXiv:2606.13673v12026
  43. Conditional Hypothesis Generation for LLM-Based Text Analysis with Researcher-Specified Covariates

    Paiheng Xu, Jing Liu, Wei Ai

    cs.CLcs.AIarXiv:2606.03029v12026
  44. CroCo: Cross-Lingual Contrastive Preference Tuning on Self-Generations

    Mike Zhang, Ali Basirat, Desmond Elliott

    cs.CLcs.AIarXiv:2605.26293v12026
  45. MobileGym: A Verifiable and Highly Parallel Simulation Platform for Mobile GUI Agent Research

    Dingbang Wu, Rui Hao, Haiyang Wang +8

    cs.AIcs.CLarXiv:2605.26114v22026
  46. Foundation Protocol: A Coordination Layer for Agentic Society

    Bang Liu, Yongfeng Gu, Jiayi Zhang +26

    cs.AIarXiv:2605.23218v12026
  47. CHI-Bench: Can AI Agents Automate End-to-End, Long-Horizon, Policy-Rich Healthcare Workflows?

    Haolin Chen, Deon Metelski, Leon Qi +30

    cs.CLcs.AIarXiv:2605.16679v22026
  48. TriPlay-RL: Tri-Role Self-Play Reinforcement Learning for LLM Safety Alignment

    Zhewen Tan, Wenhan Yu, Jianfeng Si +9

    cs.LGcs.AIarXiv:2601.18292v22026
  49. KV Packet: Recomputation-Free Context-Independent KV Caching for LLMs

    Chuangtao Chen, Grace Li Zhang, Xunzhao Yin +3

    cs.LGcs.AIarXiv:2604.13226v22026
  50. LightMem: Lightweight and Efficient Memory-Augmented Generation

    Jizhan Fang, Xinle Deng, Haoming Xu +9

    cs.CLcs.AIcs.CVarXiv:2510.18866v42025
  51. Type-Checked Compliance: Deterministic Guardrails for Agentic Financial Systems Using Lean 4 Theorem Proving

    Devakh Rashie, Veda Rashi

    cs.LOcs.AIcs.CRarXiv:2604.01483v12026
  52. REVERE: Reflective Evolving Research Engineer

    Balaji Dinesh Gangireddi, Aniketh Garikaparthi, Manasi Patwardhan +1

    cs.SEcs.AIarXiv:2603.20667v22026
  53. Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models

    Isha Puri, Mehul Damani, Idan Shenfeld +3

    cs.LGcs.AIcs.CLarXiv:2603.24844v12026
  54. Memento-Skills: Let Agents Design Agents

    Huichi Zhou, Siyuan Guo, Anjie Liu +14

    cs.AIcs.CLcs.LGarXiv:2603.18743v12026
  55. Vision-Language-Action Models for Robotics: A Review Towards Real-World Applications

    Kento Kawaharazuka, Jihoon Oh, Jun Yamada +2

    cs.ROcs.AIcs.CVarXiv:2510.07077v12025
  56. Designing ECG Monitoring Healthcare System with Federated Transfer Learning and Explainable AI

    Ali Raza, Kim Phuc Tran, Ludovic Koehl +1

    cs.LGcs.AIeess.SParXiv:2105.12497v22021
  57. Unified Vision-Language Modeling via Concept Space Alignment

    Yifu Qiu, Paul-Ambroise Duquenne, Holger Schwenk

    cs.CVcs.AIcs.CLarXiv:2603.01096v12026
  58. A Mixed Diet Makes DINO An Omnivorous Vision Encoder

    Rishabh Kabra, Maks Ovsjanikov, Drew A. Hudson +5

    cs.CVcs.AIarXiv:2602.24181v22026
  59. DREAM: Deep Research Evaluation with Agentic Metrics

    Elad Ben Avraham, Changhao Li, Ron Dorfman +8

    cs.AIarXiv:2602.18940v12026
  60. Implicit Intelligence -- Evaluating Agents on What Users Don't Say

    Ved Sirdeshmukh, Marc Wetter

    cs.AIarXiv:2602.20424v12026