Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,881 to 11,940 of 15,439

  1. M^4olGen: Multi-Agent, Multi-Stage Molecular Generation under Precise Multi-Property Constraints

    Yizhan Li, Florence Cloutier, Sifan Wu +5

    cs.AIcs.MAarXiv:2601.10131v22026
  2. WorldFlow3D: Flowing Through 3D Distributions for Unbounded World Generation

    Amogh Joshi, Julian Ost, Felix Heide

    cs.CVcs.AIcs.GRarXiv:2603.29089v12026
  3. Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video

    Mohammad Sadra Rajabi, Aanuoluwapo Ojelade, Sunwook Kim +1

    cs.CVcs.AIcs.CLarXiv:2608.22586v12026
  4. MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models

    Zecheng Tang, Baibei Ji, Ruoxi Sun +7

    cs.CLcs.AIarXiv:2601.11969v22026
  5. ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development

    Jie Yang, Honglin Guo, Li Ji +11

    cs.SEcs.AIcs.CLarXiv:2601.11077v12026
  6. Extend3D: Town-Scale 3D Generation

    Seungwoo Yoon, Jinmo Kim, Jaesik Park

    cs.CVcs.AIarXiv:2603.29387v12026
  7. Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking

    Abdul Ghafoor, Muhammad Arslan Manzoor, Yufang Hou

    cs.CLcs.AIarXiv:2608.23047v12026
  8. Diffusion In Diffusion: Reclaiming Global Coherence in Semi-Autoregressive Diffusion

    Linrui Ma, Yufei Cui, Kai Han +1

    cs.LGcs.AIarXiv:2601.13599v22026
  9. SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support

    Ahnaf Atef Choudhury, Ramkrishna Saha

    cs.CLcs.AIarXiv:2608.22802v12026
  10. TVQA: Localized, Compositional Video Question Answering

    Jie Lei, Licheng Yu, Mohit Bansal +1

    cs.CLcs.AIcs.CVarXiv:1809.01696v22018
  11. Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation

    Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6

    cs.AIcs.CLarXiv:2601.14691v22026
  12. SkillAlchemy: Open-World Agent Skill Creation

    Hengjun Wang, Shuyue Wei, Boyi Liu +2

    cs.AIarXiv:2608.23417v12026
  13. The Responsibility Vacuum: Organizational Failure in Scaled Agent Systems

    Oleg Romanchuk, Roman Bondar

    cs.AIeess.SYarXiv:2601.15059v12026
  14. OpenVision 3: A Family of Unified Visual Encoder for Both Understanding and Generation

    Letian Zhang, Sucheng Ren, Yanqing Liu +9

    eess.IVcs.AIarXiv:2601.15369v22026
  15. SONIC-O1: A Real-World Benchmark for Evaluating Multimodal Large Language Models on Audio-Video Understanding

    Ahmed Y. Radwan, Christos Emmanouilidis, Hina Tabassum +2

    cs.AIcs.CVarXiv:2601.21666v22026
  16. Adaptive Item-based Collaborative Structures via Noise Rescheduling in Diffusion for Generative Recommendation

    Jiaqi Wang, Tianying Liu, Heng Chang +3

    cs.IRcs.AIarXiv:2608.23400v12026
  17. Spanish Pre-trained BERT Model and Evaluation Data

    José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3

    cs.CLcs.AIcs.LGarXiv:2308.02976v12023
  18. SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

    Deyao Hong, Yizhe Chi, Wenyi Li +7

    cs.CLcs.AIcs.SEarXiv:2608.23564v12026
  19. Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains

    Miguel Contreras, Scott Siegel, Subhash Nerella +30

    cs.CLcs.AIarXiv:2608.22622v12026
  20. RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind

    Zhitao He, Zongwei Lyu, Yi R Fung

    cs.CLcs.AIarXiv:2601.15715v32026
  21. SySeVR: A Framework for Using Deep Learning to Detect Software Vulnerabilities

    Zhen Li, Deqing Zou, Shouhuai Xu +3

    cs.LGcs.AIcs.CRarXiv:1807.06756v32018
  22. Embodied Question Answering

    Abhishek Das, Samyak Datta, Georgia Gkioxari +3

    cs.CVcs.AIcs.CLarXiv:1711.11543v22017
  23. POOL: Propagated Uncertainty Over Lookalikes

    Rounak Sharma, Ananya B. Sai, Soumyabrata Pal

    cs.AIarXiv:2608.23086v12026
  24. Hyperspherical Autoencoder for High-Fidelity Image Reconstruction and Generation

    Hun Chang, Byunghee Cha, Jong Chul Ye

    cs.CVcs.AIcs.LGarXiv:2601.22904v22026
  25. Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training

    Shengrui Li, Fei Zhao, Kaiyan Zhao +6

    cs.CLcs.AIarXiv:2602.00747v32026
  26. Beyond Pixels: Visual Metaphor Transfer via Schema-Driven Agentic Reasoning

    Yu Xu, Yuxin Zhang, Juan Cao +5

    cs.CVcs.AIarXiv:2602.01335v12026
  27. You Need an Encoder for Native Position-Independent Caching

    Shiju Zhao, Junhao Hu, Jiaqi Zheng +1

    cs.LGcs.AIarXiv:2602.01519v12026
  28. Breaking the Static Graph: Context-Aware Traversal for Robust Retrieval-Augmented Generation

    Kwun Hang Lau, Fangyuan Zhang, Boyu Ruan +4

    cs.CLcs.AIarXiv:2602.01965v12026
  29. From Inertia to Objectivity: Improving Deep Research Agents with Noise Isolation

    Xiangxin Zhang, Zhanwei Zhang, Zhihang Fu +2

    cs.AIarXiv:2608.23045v12026
  30. SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation

    Mu Huang, Hui Wang, Kerui Ren +5

    cs.ROcs.AIcs.CVarXiv:2602.02402v22026
  31. The Measurement Revolution? Credible Measurement and Inference in the Age of AI

    Melissa Dell, Ashesh Rambachan

    econ.GNcs.AIstat.AParXiv:2608.23524v12026
  32. Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation

    Ziru Chen, Dongdong Chen, Ruinan Jin +3

    cs.LGcs.AIcs.CLarXiv:2602.03806v12026
  33. EarthVerse: Benchmarking Scientific Agents Across Dynamic Earth Systems and Natural Hazards

    Zhiqing Cui, Xinxiang Yin, Yihong Tang +11

    cs.AIarXiv:2608.23525v12026
  34. Scaling Up Your Kernels to 31x31: Revisiting Large Kernel Design in CNNs

    Xiaohan Ding, Xiangyu Zhang, Yizhuang Zhou +3

    cs.CVcs.AIcs.LGarXiv:2203.06717v42022
  35. TransFuser: Imitation with Transformer-Based Sensor Fusion for Autonomous Driving

    Kashyap Chitta, Aditya Prakash, Bernhard Jaeger +3

    cs.CVcs.AIcs.LGarXiv:2205.15997v12022
  36. From Data to Behavior: Predicting Unintended Model Behaviors Before Training

    Mengru Wang, Zhenqian Xu, Junfeng Fang +4

    cs.LGcs.AIcs.CLarXiv:2602.04735v12026
  37. The Compaction Cliff in Long-Running AI Agent Memory

    Saber Zerhoudi, Jelena Mitrovic, Michael Granitzer

    cs.AIcs.IRarXiv:2608.22752v12026
  38. Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards

    Kirill Pavlenko, Alexander Golubev, Simon Karasik +1

    cs.LGcs.AIcs.CLarXiv:2602.10231v12026
  39. Learning to Drive in a Day

    Alex Kendall, Jeffrey Hawke, David Janz +6

    cs.LGcs.AIcs.ROarXiv:1807.00412v22018
  40. Attribute2Image: Conditional Image Generation from Visual Attributes

    Xinchen Yan, Jimei Yang, Kihyuk Sohn +1

    cs.LGcs.AIcs.CVarXiv:1512.00570v22015
  41. MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering

    Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu

    cs.CLcs.AIcs.LGarXiv:2203.14371v12022
  42. Towards Expert-Level Medical Question Answering with Large Language Models

    Karan Singhal, Tao Tu, Juraj Gottweis +28

    cs.CLcs.AIcs.LGarXiv:2305.09617v12023
  43. Aster: Autonomous Scientific Discovery over 20x Faster Than Existing Methods

    Emmett Bicker

    cs.AIarXiv:2602.07040v12026
  44. OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis

    Luca Zedda, Andrea Loddo, Cecilia Di Ruberto

    cs.CVcs.AIarXiv:2602.04547v12026
  45. Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review

    Lixiang Yan, Lele Sha, Linxuan Zhao +6

    cs.CLcs.AIcs.CYarXiv:2303.13379v22023
  46. Effective Reasoning Chains Reduce Intrinsic Dimensionality

    Archiki Prasad, Mandar Joshi, Kenton Lee +2

    cs.CLcs.AIcs.LGarXiv:2602.09276v22026
  47. LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space

    Jinghui Zhang, Lang Gao, Ao Li +5

    cs.CLcs.AIarXiv:2608.23124v12026
  48. ANCHOR: Branch-Point Data Generation for GUI Agents

    Jinbiao Wei, Yilun Zhao, Kangqi Ni +1

    cs.AIarXiv:2602.07153v22026
  49. When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models

    Jiacheng Hou, Yining Sun, Ruochong Jin +4

    cs.CVcs.AIarXiv:2602.10179v22026
  50. Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation

    Yan Wang, Yi Han, Lingfei Qian +11

    cs.AIcs.CEarXiv:2602.16990v22026
  51. Prism: Spectral-Aware Block-Sparse Attention

    Xinghao Wang, Pengyu Wang, Xiaoran Liu +4

    cs.CLcs.AIcs.CVarXiv:2602.08426v22026
  52. MotionCrafter: Dense Geometry and Motion Reconstruction with a 4D VAE

    Ruijie Zhu, Jiahao Lu, Wenbo Hu +4

    cs.CVcs.AIcs.CGarXiv:2602.08961v22026
  53. Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory

    Hao Zhou, Minlie Huang, Tianyang Zhang +2

    cs.CLcs.AIarXiv:1704.01074v42017
  54. ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation

    Zihan Yang, Shuyuan Tu, Licheng Zhang +3

    cs.CVcs.AIarXiv:2602.09014v12026
  55. Evaluating SAT Solver Metrics as Predictors of Human-Perceived Nonogram Difficulty

    Changdao He, Yibing Ju, Jonathan Calver +1

    cs.HCcs.AIarXiv:2608.23300v12026
  56. Reasoning-Augmented Representations for Multimodal Retrieval

    Jianrui Zhang, Anirudh Sundara Rajan, Brandon Han +3

    cs.IRcs.AIcs.CVarXiv:2602.07125v12026
  57. Reinforcement Learning in Healthcare: A Survey

    Chao Yu, Jiming Liu, Shamim Nemati

    cs.LGcs.AIarXiv:1908.08796v42019
  58. VidVec: Unlocking Video MLLM Embeddings for Video-Text Retrieval

    Issar Tzachor, Dvir Samuel, Rami Ben-Ari

    cs.CVcs.AIarXiv:2602.08099v12026
  59. C-Pack: Packed Resources For General Chinese Embeddings

    Shitao Xiao, Zheng Liu, Peitian Zhang +3

    cs.CLcs.AIcs.IRarXiv:2309.07597v52023
  60. Spectral Temporal Graph Neural Network for Multivariate Time-series Forecasting

    Defu Cao, Yujing Wang, Juanyong Duan +8

    cs.LGcs.AIarXiv:2103.07719v12021