Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
901 to 960 of 15,209
OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and General Recipe
Kaichen Zhang, Keming Wu, Zuhao Yang +6
cs.AIcs.CLarXiv:2511.16334v42025Scaling Agent Learning via Experience Synthesis
Zhaorun Chen, Zhuokai Zhao, Kai Zhang +15
cs.AIarXiv:2511.03773v22025Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model Cells
Narcis Marincat
cs.AIarXiv:2609.11365v12026RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention Detection
Xingyi He, Ziwei Wang, Dongrui Wu
cs.AIarXiv:2609.11372v12026Chasing the Tail: Effective Rubric-based Reward Modeling for Large Language Model Post-Training
Junkai Zhang, Zihao Wang, Lin Gui +7
cs.LGcs.AIarXiv:2509.21500v32025Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM Reasoning
Bincheng Gu, Min Gao, Zongwei Wang +3
cs.AIarXiv:2609.11393v12026A deep learning framework for quality assessment and restoration in video endoscopy
Sharib Ali, Felix Zhou, Adam Bailey +4
cs.CVcs.AIarXiv:1904.07073v12019Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model Collaboration
Yilin Zhang, Han Jiang, Cai Xu +2
cs.AIarXiv:2609.11446v12026LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case Study
Jorge López-Varela, J. Ignacio Hidalgo, José-Manuel Muñoz +6
cs.AIarXiv:2609.11431v12026Magenta: Closing the Loop Between Mathematical Reasoning and Lean Verification
Joshua Ong Jun Leang, Haonan Li, Zheng Zhao +6
cs.AIarXiv:2609.11319v12026AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business Model
Paul Darius Mandl, Peter Mandl, Martin Häusl
cs.AIarXiv:2609.11321v12026Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State Decoding
Ziwei Wang, Xingyi He, Hongbin Wang +3
cs.AIarXiv:2609.11341v12026Discovering Reinforcement Learning Algorithms
Junhyuk Oh, Matteo Hessel, Wojciech M. Czarnecki +4
cs.LGcs.AIarXiv:2007.08794v32020Mr.LHDR: A Benchmark for Multimodal Real-World Long-Horizon Deep Research Agents
Minghao Guo, Meng Cao, Sui Zhao +10
cs.AIarXiv:2609.11318v12026VeriGuard: Enhancing LLM Agent Safety via Verified Code Generation
Lesly Miculicich, Mihir Parmar, Hamid Palangi +4
cs.SEcs.AIcs.CRarXiv:2510.05156v12025Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language Models
Yixiang Liu, Zhongxing Xu, Zhonghua Wang +1
cs.AIarXiv:2609.11315v12026NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty Assessment
Guoqiang Zhang, Kexin Tan, Ming Zhang +12
cs.AIarXiv:2609.11234v12026Off-Target Effects of Response-Style Alignment in a Korean 27B Language Model
Hyojung Han
cs.AIarXiv:2609.11291v12026VideoScore2: Think before You Score in Generative Video Evaluation
Xuan He, Dongfu Jiang, Ping Nie +21
cs.CVcs.AIcs.CLarXiv:2509.22799v12025Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal Agents
Jiaqiang Li, Yajie Yang, Zhiheng Xi +15
cs.AIarXiv:2609.11243v12026Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business Data
Benjamin Gruenbaum, Doron Porat, Assaf Natanzon +4
cs.AIarXiv:2609.11286v12026TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times
Jintao Zhang, Kaiwen Zheng, Kai Jiang +5
cs.CVcs.AIcs.LGarXiv:2512.16093v12025Fara-7B: An Efficient Agentic Model for Computer Use
Ahmed Awadallah, Yash Lara, Raghav Magazine +9
cs.AIcs.CLcs.CVarXiv:2511.19663v12025An AI-Powered Culturally Aware Chatbot for Stress Detection and Wellness Support among Pakistani University Students Using NLP and Machine Learning
Muhammad Fahad Bashir, Muhammad Afzal
cs.AIarXiv:2609.11199v12026MedSAM3: Delving into Segment Anything with Medical Concepts
Anglin Liu, Rundong Xue, Xu R. Cao +5
cs.CVcs.AIarXiv:2511.19046v12025Debate-to-Skill: Capability-Bound Process Supervision for Industrial Query-to-Agent Annotation
Shiyu Zhang, Leisheng Cheng, Huifu Li
cs.AIarXiv:2609.11176v12026Breaking Predictions Is Not Enough: Specified-Foil Counterfactuals for Temporal Graphs
Minwoo Yu, Young-guk Ha
cs.AIarXiv:2609.11170v12026Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment
Jiayu Huang, Zichen Tang, Qianhui Ling +2
cs.AIarXiv:2609.11185v12026MOSAIC: Query-Aware Exploration Policy Adaptation for GraphRAG
EunKyeong Lee, Kyeong-Jin Oh, Jinwon Kim +4
cs.AIarXiv:2609.11065v12026The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures
Divyanshu Kumar, Rohith HN, Nitin Aravind Birur +2
cs.AIarXiv:2609.11030v12026When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents
Qinzhen Ma, Ruihai Wu
cs.AIarXiv:2609.10873v12026Automating Quadratic Unconstrained Binary Optimization (QUBO) Formulation Generation from Natural Language
Niloy Kumar Mondal, Md Rizwan Parvez
cs.AIarXiv:2609.10629v12026Fork Where the Model Changes Its Mind: Belief-Shift Branching for Tree-Structured Reinforcement Learning
Bin Lei, Yu Li, Prafulla Kumar Choubey +7
cs.AIarXiv:2609.11061v12026Probabilistic Focal Search: Accelerating Bounded-Suboptimal Search via Lower-Bound Advancement
Minh Vu Duc, Trung Le Huu, Hà Minh Hoàng +3
cs.AIarXiv:2609.10584v12026Particle Filter Networks with Application to Visual Localization
Peter Karkus, David Hsu, Wee Sun Lee
cs.ROcs.AIcs.CVarXiv:1805.08975v32018AIP: Agent Identity Protocol for Verifiable Delegation Across MCP and A2A
Sunil Prakash
cs.CRcs.AIarXiv:2603.24775v12026Generating Long Videos of Dynamic Scenes
Brooks, Tim, Hellsten, Janne, Aittala, Miika +6
cs.CVcs.AIcs.LGarXiv:2206.03429v22022GRIPNet: Gaussian Radial Intensity Prior Guided Architecture for Pulmonary Nodule Detection in CT
Yang, Haojie, Su, Ran
cs.CVcs.AIarXiv:2609.11312v12026A Definition of AGI
Hendrycks, Dan, Song, Dawn, Szegedy, Christian +30
cs.AIcs.LGarXiv:2510.18212v32025Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
Ling Team, Anqi Shen, Baihui Li +101
cs.CLcs.AIarXiv:2510.18855v22025Budget-Aware Tool Use Enables Effective Agent Scaling
Tengxiao Liu, Zifeng Wang, Jin Miao +12
cs.AIarXiv:2511.17006v22025DeepHeart: Semi-Supervised Sequence Learning for Cardiovascular Risk Prediction
Brandon Ballinger, Johnson Hsieh, Avesh Singh +8
cs.LGcs.AIstat.MLarXiv:1802.02511v12018The Choice of Divergence: A Neglected Key to Mitigating Diversity Collapse in Reinforcement Learning with Verifiable Reward
Long Li, Zhijian Zhou, Jiaran Hao +9
cs.LGcs.AIarXiv:2509.07430v42025HALDETECT at ImageEval 2026 Shared Tasks: Answer-First Contrastive Grounding with QLoRA
Syed Mohaiminul Hoque, Md Sakhawat Hossain
cs.CVcs.AIarXiv:2609.11236v12026UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
Ye Liu, Zongyang Ma, Junfu Pu +4
cs.CVcs.AIarXiv:2509.18094v42025Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward
Eshwar Reddy M, Sourav Karmakar
cs.AIcs.LGarXiv:2609.09776v12026From Evaluation to Enhancement: Benchmarking and Improving Think-with-Video Reasoning for Video Generative Models
Meng Luo, Yicheng Liu, Jiahao Wang +5
cs.CVcs.AIarXiv:2609.11242v12026Explainable AI for clinical and remote health applications: a survey on tabular and time series data
Flavio Di Martino, Franca Delmastro
cs.LGcs.AIarXiv:2209.06528v12022VitaBench: Benchmarking LLM Agents with Versatile Interactive Tasks in Real-world Applications
Wei He, Yueqing Sun, Hongyan Hao +13
cs.CLcs.AIarXiv:2509.26490v22025Stabilizing Reinforcement Learning with LLMs: Formulation and Practices
Chujie Zheng, Kai Dang, Bowen Yu +10
cs.LGcs.AIcs.CLarXiv:2512.01374v32025Beyond Visual Quality: Evaluating Physical Consistency under Ego-Motion with EgoGenEval
Yilin Long, Chenming Zhu, Zitang Gou +2
cs.CVcs.AIarXiv:2609.11172v12026Your Agent May Misevolve: Emergent Risks in Self-evolving LLM Agents
Shuai Shao, Qihan Ren, Chen Qian +8
cs.AIcs.CLcs.LGarXiv:2509.26354v22025Beyond Benchmarks: Using VLMs to Reveal Systematic Classification Failures Under Real World Conditions
Dieuwertje Alblas, Alma M. Liezenga, Jan Erik van Woerden +3
cs.CVcs.AIcs.ETarXiv:2609.11126v12026Scaling LLM Multi-turn RL with End-to-end Summarization-based Context Management
Miao Lu, Weiwei Sun, Weihua Du +4
cs.CLcs.AIcs.LGarXiv:2510.06727v12025Toward Interpretable Multimodal Fusion: Heat Conduction Modeling for Hyperspectral and LiDAR Joint Classification
Kan Wei, Jiahui Cui, Jing Yao +3
cs.CVcs.AIarXiv:2609.11040v12026Premise Selection for Theorem Proving by Deep Graph Embedding
Mingzhe Wang, Yihe Tang, Jian Wang +1
cs.AIcs.LGcs.LOarXiv:1709.09994v12017AI and 6G into the Metaverse: Fundamentals, Challenges and Future Research Trends
Muhammad Zawish, Fayaz Ali Dharejo, Sunder Ali Khowaja +4
cs.AIcs.HCcs.NIarXiv:2208.10921v22022KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems
Hancheng Ye, Zhengqi Gao, Mingyuan Ma +8
cs.MAcs.AIstat.MLarXiv:2510.12872v22025Black-Box On-Policy Distillation of Large Language Models
Tianzhu Ye, Li Dong, Zewen Chi +3
cs.CLcs.AIarXiv:2511.10643v32025Prosperity before Collapse: How Far Can Off-Policy RL Reach with Stale Data on LLMs?
Haizhong Zheng, Jiawei Zhao, Beidi Chen
cs.LGcs.AIarXiv:2510.01161v22025