Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,881 to 11,940 of 15,439
M^4olGen: Multi-Agent, Multi-Stage Molecular Generation under Precise Multi-Property Constraints
Yizhan Li, Florence Cloutier, Sifan Wu +5
cs.AIcs.MAarXiv:2601.10131v22026WorldFlow3D: Flowing Through 3D Distributions for Unbounded World Generation
Amogh Joshi, Julian Ost, Felix Heide
cs.CVcs.AIcs.GRarXiv:2603.29089v12026Vision-Language Models for Occupational Physical Exposure Assessment: Estimating External Hand Forces in Manual Material Handling Tasks from RGB Video
Mohammad Sadra Rajabi, Aanuoluwapo Ojelade, Sunwook Kim +1
cs.CVcs.AIcs.CLarXiv:2608.22586v12026MemoryRewardBench: Benchmarking Reward Models for Long-Term Memory Management in Large Language Models
Zecheng Tang, Baibei Ji, Ruoxi Sun +7
cs.CLcs.AIarXiv:2601.11969v22026ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
Jie Yang, Honglin Guo, Li Ji +11
cs.SEcs.AIcs.CLarXiv:2601.11077v12026Extend3D: Town-Scale 3D Generation
Seungwoo Yoon, Jinmo Kim, Jaesik Park
cs.CVcs.AIarXiv:2603.29387v12026Beyond Verdicts: A Graph-Based Analysis of Human and LLM Reasoning in Scientific Fact-Checking
Abdul Ghafoor, Muhammad Arslan Manzoor, Yufang Hou
cs.CLcs.AIarXiv:2608.23047v12026Diffusion In Diffusion: Reclaiming Global Coherence in Semi-Autoregressive Diffusion
Linrui Ma, Yufei Cui, Kai Han +1
cs.LGcs.AIarXiv:2601.13599v22026SDoH-Aware Narrative Anchoring Bias in Medical LLMs for Trustworthy Clinical Decision Support
Ahnaf Atef Choudhury, Ramkrishna Saha
cs.CLcs.AIarXiv:2608.22802v12026TVQA: Localized, Compositional Video Question Answering
Jie Lei, Licheng Yu, Mohit Bansal +1
cs.CLcs.AIcs.CVarXiv:1809.01696v22018Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
Muhammad Khalifa, Lajanugen Logeswaran, Jaekyeom Kim +6
cs.AIcs.CLarXiv:2601.14691v22026SkillAlchemy: Open-World Agent Skill Creation
Hengjun Wang, Shuyue Wei, Boyi Liu +2
cs.AIarXiv:2608.23417v12026The Responsibility Vacuum: Organizational Failure in Scaled Agent Systems
Oleg Romanchuk, Roman Bondar
cs.AIeess.SYarXiv:2601.15059v12026OpenVision 3: A Family of Unified Visual Encoder for Both Understanding and Generation
Letian Zhang, Sucheng Ren, Yanqing Liu +9
eess.IVcs.AIarXiv:2601.15369v22026SONIC-O1: A Real-World Benchmark for Evaluating Multimodal Large Language Models on Audio-Video Understanding
Ahmed Y. Radwan, Christos Emmanouilidis, Hina Tabassum +2
cs.AIcs.CVarXiv:2601.21666v22026Adaptive Item-based Collaborative Structures via Noise Rescheduling in Diffusion for Generative Recommendation
Jiaqi Wang, Tianying Liu, Heng Chang +3
cs.IRcs.AIarXiv:2608.23400v12026Spanish Pre-trained BERT Model and Evaluation Data
José Cañete, Gabriel Chaperon, Rodrigo Fuentes +3
cs.CLcs.AIcs.LGarXiv:2308.02976v12023SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?
Deyao Hong, Yizhe Chi, Wenyi Li +7
cs.CLcs.AIcs.SEarXiv:2608.23564v12026Teaching LLMs How ICU Physicians Approach Clinical Reasoning Through OMOP-Aligned Retrieval Improves Reasoning Across Clinical Domains
Miguel Contreras, Scott Siegel, Subhash Nerella +30
cs.CLcs.AIarXiv:2608.22622v12026RebuttalAgent: Strategic Persuasion in Academic Rebuttal via Theory of Mind
Zhitao He, Zongwei Lyu, Yi R Fung
cs.CLcs.AIarXiv:2601.15715v32026SySeVR: A Framework for Using Deep Learning to Detect Software Vulnerabilities
Zhen Li, Deqing Zou, Shouhuai Xu +3
cs.LGcs.AIcs.CRarXiv:1807.06756v32018Embodied Question Answering
Abhishek Das, Samyak Datta, Georgia Gkioxari +3
cs.CVcs.AIcs.CLarXiv:1711.11543v22017POOL: Propagated Uncertainty Over Lookalikes
Rounak Sharma, Ananya B. Sai, Soumyabrata Pal
cs.AIarXiv:2608.23086v12026Hyperspherical Autoencoder for High-Fidelity Image Reconstruction and Generation
Hun Chang, Byunghee Cha, Jong Chul Ye
cs.CVcs.AIcs.LGarXiv:2601.22904v22026Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
Shengrui Li, Fei Zhao, Kaiyan Zhao +6
cs.CLcs.AIarXiv:2602.00747v32026Beyond Pixels: Visual Metaphor Transfer via Schema-Driven Agentic Reasoning
Yu Xu, Yuxin Zhang, Juan Cao +5
cs.CVcs.AIarXiv:2602.01335v12026You Need an Encoder for Native Position-Independent Caching
Shiju Zhao, Junhao Hu, Jiaqi Zheng +1
cs.LGcs.AIarXiv:2602.01519v12026Breaking the Static Graph: Context-Aware Traversal for Robust Retrieval-Augmented Generation
Kwun Hang Lau, Fangyuan Zhang, Boyu Ruan +4
cs.CLcs.AIarXiv:2602.01965v12026From Inertia to Objectivity: Improving Deep Research Agents with Noise Isolation
Xiangxin Zhang, Zhanwei Zhang, Zhihang Fu +2
cs.AIarXiv:2608.23045v12026SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation
Mu Huang, Hui Wang, Kerui Ren +5
cs.ROcs.AIcs.CVarXiv:2602.02402v22026The Measurement Revolution? Credible Measurement and Inference in the Age of AI
Melissa Dell, Ashesh Rambachan
econ.GNcs.AIstat.AParXiv:2608.23524v12026Bridging Online and Offline RL: Contextual Bandit Learning for Multi-Turn Code Generation
Ziru Chen, Dongdong Chen, Ruinan Jin +3
cs.LGcs.AIcs.CLarXiv:2602.03806v12026EarthVerse: Benchmarking Scientific Agents Across Dynamic Earth Systems and Natural Hazards
Zhiqing Cui, Xinxiang Yin, Yihong Tang +11
cs.AIarXiv:2608.23525v12026Scaling Up Your Kernels to 31x31: Revisiting Large Kernel Design in CNNs
Xiaohan Ding, Xiangyu Zhang, Yizhuang Zhou +3
cs.CVcs.AIcs.LGarXiv:2203.06717v42022TransFuser: Imitation with Transformer-Based Sensor Fusion for Autonomous Driving
Kashyap Chitta, Aditya Prakash, Bernhard Jaeger +3
cs.CVcs.AIcs.LGarXiv:2205.15997v12022From Data to Behavior: Predicting Unintended Model Behaviors Before Training
Mengru Wang, Zhenqian Xu, Junfeng Fang +4
cs.LGcs.AIcs.CLarXiv:2602.04735v12026The Compaction Cliff in Long-Running AI Agent Memory
Saber Zerhoudi, Jelena Mitrovic, Michael Granitzer
cs.AIcs.IRarXiv:2608.22752v12026Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards
Kirill Pavlenko, Alexander Golubev, Simon Karasik +1
cs.LGcs.AIcs.CLarXiv:2602.10231v12026Learning to Drive in a Day
Alex Kendall, Jeffrey Hawke, David Janz +6
cs.LGcs.AIcs.ROarXiv:1807.00412v22018Attribute2Image: Conditional Image Generation from Visual Attributes
Xinchen Yan, Jimei Yang, Kihyuk Sohn +1
cs.LGcs.AIcs.CVarXiv:1512.00570v22015MedMCQA : A Large-scale Multi-Subject Multi-Choice Dataset for Medical domain Question Answering
Ankit Pal, Logesh Kumar Umapathi, Malaikannan Sankarasubbu
cs.CLcs.AIcs.LGarXiv:2203.14371v12022Towards Expert-Level Medical Question Answering with Large Language Models
Karan Singhal, Tao Tu, Juraj Gottweis +28
cs.CLcs.AIcs.LGarXiv:2305.09617v12023Aster: Autonomous Scientific Discovery over 20x Faster Than Existing Methods
Emmett Bicker
cs.AIarXiv:2602.07040v12026OmniRad: A Radiological Foundation Model for Multi-Task Medical Image Analysis
Luca Zedda, Andrea Loddo, Cecilia Di Ruberto
cs.CVcs.AIarXiv:2602.04547v12026Practical and Ethical Challenges of Large Language Models in Education: A Systematic Scoping Review
Lixiang Yan, Lele Sha, Linxuan Zhao +6
cs.CLcs.AIcs.CYarXiv:2303.13379v22023Effective Reasoning Chains Reduce Intrinsic Dimensionality
Archiki Prasad, Mandar Joshi, Kenton Lee +2
cs.CLcs.AIcs.LGarXiv:2602.09276v22026LITERARYBIGFIVE: Author-Personalized Text Generation in a Unified Interpretable Space
Jinghui Zhang, Lang Gao, Ao Li +5
cs.CLcs.AIarXiv:2608.23124v12026ANCHOR: Branch-Point Data Generation for GUI Agents
Jinbiao Wei, Yilun Zhao, Kangqi Ni +1
cs.AIarXiv:2602.07153v22026When the Prompt Becomes Visual: Vision-Centric Jailbreak Attacks for Large Image Editing Models
Jiacheng Hou, Yining Sun, Ruochong Jin +4
cs.CVcs.AIarXiv:2602.10179v22026Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation
Yan Wang, Yi Han, Lingfei Qian +11
cs.AIcs.CEarXiv:2602.16990v22026Prism: Spectral-Aware Block-Sparse Attention
Xinghao Wang, Pengyu Wang, Xiaoran Liu +4
cs.CLcs.AIcs.CVarXiv:2602.08426v22026MotionCrafter: Dense Geometry and Motion Reconstruction with a 4D VAE
Ruijie Zhu, Jiahao Lu, Wenbo Hu +4
cs.CVcs.AIcs.CGarXiv:2602.08961v22026Emotional Chatting Machine: Emotional Conversation Generation with Internal and External Memory
Hao Zhou, Minlie Huang, Tianyang Zhang +2
cs.CLcs.AIarXiv:1704.01074v42017ArcFlow: Unleashing 2-Step Text-to-Image Generation via High-Precision Non-Linear Flow Distillation
Zihan Yang, Shuyuan Tu, Licheng Zhang +3
cs.CVcs.AIarXiv:2602.09014v12026Evaluating SAT Solver Metrics as Predictors of Human-Perceived Nonogram Difficulty
Changdao He, Yibing Ju, Jonathan Calver +1
cs.HCcs.AIarXiv:2608.23300v12026Reasoning-Augmented Representations for Multimodal Retrieval
Jianrui Zhang, Anirudh Sundara Rajan, Brandon Han +3
cs.IRcs.AIcs.CVarXiv:2602.07125v12026Reinforcement Learning in Healthcare: A Survey
Chao Yu, Jiming Liu, Shamim Nemati
cs.LGcs.AIarXiv:1908.08796v42019VidVec: Unlocking Video MLLM Embeddings for Video-Text Retrieval
Issar Tzachor, Dvir Samuel, Rami Ben-Ari
cs.CVcs.AIarXiv:2602.08099v12026C-Pack: Packed Resources For General Chinese Embeddings
Shitao Xiao, Zheng Liu, Peitian Zhang +3
cs.CLcs.AIcs.IRarXiv:2309.07597v52023Spectral Temporal Graph Neural Network for Multivariate Time-series Forecasting
Defu Cao, Yujing Wang, Juanyong Duan +8
cs.LGcs.AIarXiv:2103.07719v12021