Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,761 to 11,820 of 15,327

  1. Cooperative Inverse Reinforcement Learning

    Dylan Hadfield-Menell, Anca Dragan, Pieter Abbeel +1

    cs.AIarXiv:1606.03137v42016
  2. Meta-Ctrl: Guaranteed Plan Generation by Decoupling Syntactic and Semantic Constraints

    Gwen Yidou-Weng, Edward Sun, Tianyi Ma +5

    cs.ROcs.AIarXiv:2608.22149v12026
  3. Think with Structured Grounding: Perceptual Reinforcement Learning for Chart and Visual-Tabular Understanding

    Changjiang Jiang, Qiannian Zhao, Lei Xin +3

    cs.AIarXiv:2608.22429v12026
  4. Project Imaging-X: A Survey of 1000+ Open-Access Medical Imaging Datasets for Foundation Model Development

    Zhongying Deng, Cheng Tang, Ziyan Huang +124

    cs.CVcs.AIarXiv:2603.27460v12026
  5. Using Large Language Models to Simulate Multiple Humans and Replicate Human Subject Studies

    Gati Aher, Rosa I. Arriaga, Adam Tauman Kalai

    cs.CLcs.AIcs.LGarXiv:2208.10264v52022
  6. Socially Aware Motion Planning with Deep Reinforcement Learning

    Yu Fan Chen, Michael Everett, Miao Liu +1

    cs.ROcs.AIcs.HCarXiv:1703.08862v22017
  7. Multi-Winner Voting with Argumentative Ballots

    Ryuta Arisaka, Hirotaka Ono

    cs.GTcs.AIarXiv:2608.23247v12026
  8. Habitat-Matterport 3D Dataset (HM3D): 1000 Large-scale 3D Environments for Embodied AI

    Santhosh K. Ramakrishnan, Aaron Gokaslan, Erik Wijmans +10

    cs.CVcs.AIarXiv:2109.08238v12021
  9. M^4olGen: Multi-Agent, Multi-Stage Molecular Generation under Precise Multi-Property Constraints

    Yizhan Li, Florence Cloutier, Sifan Wu +5

    cs.AIcs.MAarXiv:2601.10131v22026
  10. WorldFlow3D: Flowing Through 3D Distributions for Unbounded World Generation

    Amogh Joshi, Julian Ost, Felix Heide

    cs.CVcs.AIcs.GRarXiv:2603.29089v12026
  11. Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video

    Mohammad Sadra Rajabi, Aanuoluwapo Ojelade, Sunwook Kim +1

    cs.CVcs.AIcs.CLarXiv:2608.22586v12026
  12. MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models

    Zecheng Tang, Baibei Ji, Ruoxi Sun +7

    cs.CLcs.AIarXiv:2601.11969v22026
  13. ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development

    Jie Yang, Honglin Guo, Li Ji +11

    cs.SEcs.AIcs.CLarXiv:2601.11077v12026
  14. Extend3D: Town-Scale 3D Generation

    Seungwoo Yoon, Jinmo Kim, Jaesik Park

    cs.CVcs.AIarXiv:2603.29387v12026
  15. Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking

    Abdul Ghafoor, Muhammad Arslan Manzoor, Yufang Hou

    cs.CLcs.AIarXiv:2608.23047v12026
  16. Diffusion In Diffusion: Reclaiming Global Coherence in Semi-Autoregressive Diffusion

    Linrui Ma, Yufei Cui, Kai Han +1

    cs.LGcs.AIarXiv:2601.13599v22026
  17. SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support

    Ahnaf Atef Choudhury, Ramkrishna Saha

    cs.CLcs.AIarXiv:2608.22802v12026
  18. TVQA: Localized, Compositional Video Question Answering

    Jie Lei, Licheng Yu, Mohit Bansal +1

    cs.CLcs.AIcs.CVarXiv:1809.01696v22018
  19. Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation

    Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6

    cs.AIcs.CLarXiv:2601.14691v22026
  20. SkillAlchemy: Open-World Agent Skill Creation

    Hengjun Wang, Shuyue Wei, Boyi Liu +2

    cs.AIarXiv:2608.23417v12026
  21. The Responsibility Vacuum: Organizational Failure in Scaled Agent Systems

    Oleg Romanchuk, Roman Bondar

    cs.AIeess.SYarXiv:2601.15059v12026
  22. OpenVision 3: A Family of Unified Visual Encoder for Both Understanding and Generation

    Letian Zhang, Sucheng Ren, Yanqing Liu +9

    eess.IVcs.AIarXiv:2601.15369v22026
  23. SONIC-O1: A Real-World Benchmark for Evaluating Multimodal Large Language Models on Audio-Video Understanding

    Ahmed Y. Radwan, Christos Emmanouilidis, Hina Tabassum +2

    cs.AIcs.CVarXiv:2601.21666v22026
  24. Adaptive Item-based Collaborative Structures via Noise Rescheduling in Diffusion for Generative Recommendation

    Jiaqi Wang, Tianying Liu, Heng Chang +3

    cs.IRcs.AIarXiv:2608.23400v12026
  25. Spanish Pre-trained BERT Model and Evaluation Data

    José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3

    cs.CLcs.AIcs.LGarXiv:2308.02976v12023
  26. SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

    Deyao Hong, Yizhe Chi, Wenyi Li +7

    cs.CLcs.AIcs.SEarXiv:2608.23564v12026
  27. Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains

    Miguel Contreras, Scott Siegel, Subhash Nerella +30

    cs.CLcs.AIarXiv:2608.22622v12026
  28. RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind

    Zhitao He, Zongwei Lyu, Yi R Fung

    cs.CLcs.AIarXiv:2601.15715v32026
  29. SySeVR: A Framework for Using Deep Learning to Detect Software Vulnerabilities

    Zhen Li, Deqing Zou, Shouhuai Xu +3

    cs.LGcs.AIcs.CRarXiv:1807.06756v32018
  30. Embodied Question Answering

    Abhishek Das, Samyak Datta, Georgia Gkioxari +3

    cs.CVcs.AIcs.CLarXiv:1711.11543v22017
  31. POOL: Propagated Uncertainty Over Lookalikes

    Rounak Sharma, Ananya B. Sai, Soumyabrata Pal

    cs.AIarXiv:2608.23086v12026
  32. Hyperspherical Autoencoder for High-Fidelity Image Reconstruction and Generation

    Hun Chang, Byunghee Cha, Jong Chul Ye

    cs.CVcs.AIcs.LGarXiv:2601.22904v22026
  33. Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training

    Shengrui Li, Fei Zhao, Kaiyan Zhao +6

    cs.CLcs.AIarXiv:2602.00747v32026
  34. Beyond Pixels: Visual Metaphor Transfer via Schema-Driven Agentic Reasoning

    Yu Xu, Yuxin Zhang, Juan Cao +5

    cs.CVcs.AIarXiv:2602.01335v12026
  35. You Need an Encoder for Native Position-Independent Caching

    Shiju Zhao, Junhao Hu, Jiaqi Zheng +1

    cs.LGcs.AIarXiv:2602.01519v12026
  36. Breaking the Static Graph: Context-Aware Traversal for Robust Retrieval-Augmented Generation

    Kwun Hang Lau, Fangyuan Zhang, Boyu Ruan +4

    cs.CLcs.AIarXiv:2602.01965v12026
  37. From Inertia to Objectivity: Improving Deep Research Agents with Noise Isolation

    Xiangxin Zhang, Zhanwei Zhang, Zhihang Fu +2

    cs.AIarXiv:2608.23045v12026
  38. SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation

    Mu Huang, Hui Wang, Kerui Ren +5

    cs.ROcs.AIcs.CVarXiv:2602.02402v22026
  39. The Measurement Revolution? Credible Measurement and Inference in the Age of AI

    Melissa Dell, Ashesh Rambachan

    econ.GNcs.AIstat.AParXiv:2608.23524v12026
  40. Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation

    Ziru Chen, Dongdong Chen, Ruinan Jin +3

    cs.LGcs.AIcs.CLarXiv:2602.03806v12026
  41. EarthVerse: Benchmarking Scientific Agents Across Dynamic Earth Systems and Natural Hazards

    Zhiqing Cui, Xinxiang Yin, Yihong Tang +11

    cs.AIarXiv:2608.23525v12026
  42. Scaling Up Your Kernels to 31x31: Revisiting Large Kernel Design in CNNs

    Xiaohan Ding, Xiangyu Zhang, Yizhuang Zhou +3

    cs.CVcs.AIcs.LGarXiv:2203.06717v42022
  43. TransFuser: Imitation with Transformer-Based Sensor Fusion for Autonomous Driving

    Kashyap Chitta, Aditya Prakash, Bernhard Jaeger +3

    cs.CVcs.AIcs.LGarXiv:2205.15997v12022
  44. From Data to Behavior: Predicting Unintended Model Behaviors Before Training

    Mengru Wang, Zhenqian Xu, Junfeng Fang +4

    cs.LGcs.AIcs.CLarXiv:2602.04735v12026
  45. The Compaction Cliff in Long-Running AI Agent Memory

    Saber Zerhoudi, Jelena Mitrovic, Michael Granitzer

    cs.AIcs.IRarXiv:2608.22752v12026
  46. Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards

    Kirill Pavlenko, Alexander Golubev, Simon Karasik +1

    cs.LGcs.AIcs.CLarXiv:2602.10231v12026
  47. Learning to Drive in a Day

    Alex Kendall, Jeffrey Hawke, David Janz +6

    cs.LGcs.AIcs.ROarXiv:1807.00412v22018
  48. Attribute2Image: Conditional Image Generation from Visual Attributes

    Xinchen Yan, Jimei Yang, Kihyuk Sohn +1

    cs.LGcs.AIcs.CVarXiv:1512.00570v22015
  49. MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering

    Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu

    cs.CLcs.AIcs.LGarXiv:2203.14371v12022
  50. Towards Expert-Level Medical Question Answering with Large Language Models

    Karan Singhal, Tao Tu, Juraj Gottweis +28

    cs.CLcs.AIcs.LGarXiv:2305.09617v12023
  51. Aster: Autonomous Scientific Discovery over 20x Faster Than Existing Methods

    Emmett Bicker

    cs.AIarXiv:2602.07040v12026
  52. OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis

    Luca Zedda, Andrea Loddo, Cecilia Di Ruberto

    cs.CVcs.AIarXiv:2602.04547v12026
  53. Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review

    Lixiang Yan, Lele Sha, Linxuan Zhao +6

    cs.CLcs.AIcs.CYarXiv:2303.13379v22023
  54. Effective Reasoning Chains Reduce Intrinsic Dimensionality

    Archiki Prasad, Mandar Joshi, Kenton Lee +2

    cs.CLcs.AIcs.LGarXiv:2602.09276v22026
  55. LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space

    Jinghui Zhang, Lang Gao, Ao Li +5

    cs.CLcs.AIarXiv:2608.23124v12026
  56. ANCHOR: Branch-Point Data Generation for GUI Agents

    Jinbiao Wei, Yilun Zhao, Kangqi Ni +1

    cs.AIarXiv:2602.07153v22026
  57. When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models

    Jiacheng Hou, Yining Sun, Ruochong Jin +4

    cs.CVcs.AIarXiv:2602.10179v22026
  58. Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation

    Yan Wang, Yi Han, Lingfei Qian +11

    cs.AIcs.CEarXiv:2602.16990v22026
  59. Prism: Spectral-Aware Block-Sparse Attention

    Xinghao Wang, Pengyu Wang, Xiaoran Liu +4

    cs.CLcs.AIcs.CVarXiv:2602.08426v22026
  60. MotionCrafter: Dense Geometry and Motion Reconstruction with a 4D VAE

    Ruijie Zhu, Jiahao Lu, Wenbo Hu +4

    cs.CVcs.AIcs.CGarXiv:2602.08961v22026