Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

901 to 960 of 15,209

  1. OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and General Recipe

    Kaichen Zhang, Keming Wu, Zuhao Yang +6

    cs.AIcs.CLarXiv:2511.16334v42025
  2. Scaling Agent Learning via Experience Synthesis

    Zhaorun Chen, Zhuokai Zhao, Kai Zhang +15

    cs.AIarXiv:2511.03773v22025
  3. Portable Semantics, Private Dialects: Reuse and Negative Transfer in Latent Communication Between Language-Model Cells

    Narcis Marincat

    cs.AIarXiv:2609.11365v12026
  4. RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal Fusion Network for Auditory Attention Detection

    Xingyi He, Ziwei Wang, Dongrui Wu

    cs.AIarXiv:2609.11372v12026
  5. Chasing the Tail: Effective Rubric-based Reward Modeling for Large Language Model Post-Training

    Junkai Zhang, Zihao Wang, Lin Gui +7

    cs.LGcs.AIarXiv:2509.21500v32025
  6. Beyond Confidence: Stability-Aware Test-Time Adaptation for LLM Reasoning

    Bincheng Gu, Min Gao, Zongwei Wang +3

    cs.AIarXiv:2609.11393v12026
  7. A deep learning framework for quality assessment and restoration in video endoscopy

    Sharib Ali, Felix Zhou, Adam Bailey +4

    cs.CVcs.AIarXiv:1904.07073v12019
  8. Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model Collaboration

    Yilin Zhang, Han Jiang, Cai Xu +2

    cs.AIarXiv:2609.11446v12026
  9. LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case Study

    Jorge López-Varela, J. Ignacio Hidalgo, José-Manuel Muñoz +6

    cs.AIarXiv:2609.11431v12026
  10. Magenta: Closing the Loop Between Mathematical Reasoning and Lean Verification

    Joshua Ong Jun Leang, Haonan Li, Zheng Zhao +6

    cs.AIarXiv:2609.11319v12026
  11. AI Exposure and AI Resilience: A Two-Dimensional Assessment Framework for Software and Software-Based Business Model

    Paul Darius Mandl, Peter Mandl, Martin Häusl

    cs.AIarXiv:2609.11321v12026
  12. Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State Decoding

    Ziwei Wang, Xingyi He, Hongbin Wang +3

    cs.AIarXiv:2609.11341v12026
  13. Discovering Reinforcement Learning Algorithms

    Junhyuk Oh, Matteo Hessel, Wojciech M. Czarnecki +4

    cs.LGcs.AIarXiv:2007.08794v32020
  14. Mr.LHDR: A Benchmark for Multimodal Real-World Long-Horizon Deep Research Agents

    Minghao Guo, Meng Cao, Sui Zhao +10

    cs.AIarXiv:2609.11318v12026
  15. VeriGuard: Enhancing LLM Agent Safety via Verified Code Generation

    Lesly Miculicich, Mihir Parmar, Hamid Palangi +4

    cs.SEcs.AIcs.CRarXiv:2510.05156v12025
  16. Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language Models

    Yixiang Liu, Zhongxing Xu, Zhonghua Wang +1

    cs.AIarXiv:2609.11315v12026
  17. NovGauge: A Fine-Grained Benchmark for Diagnosing LLMs' Capability in Paper Novelty Assessment

    Guoqiang Zhang, Kexin Tan, Ming Zhang +12

    cs.AIarXiv:2609.11234v12026
  18. Off-Target Effects of Response-Style Alignment in a Korean 27B Language Model

    Hyojung Han

    cs.AIarXiv:2609.11291v12026
  19. VideoScore2: Think before You Score in Generative Video Evaluation

    Xuan He, Dongfu Jiang, Ping Nie +21

    cs.CVcs.AIcs.CLarXiv:2509.22799v12025
  20. Sci-MMR: Benchmarking Multi-Step Evidence-Grounded Scientific Reasoning in Multimodal Agents

    Jiaqiang Li, Yajie Yang, Zhiheng Xi +15

    cs.AIarXiv:2609.11243v12026
  21. Generating a Consistent Enterprise: Synthesis and Reference-Free Evaluation of Multi-System Business Data

    Benjamin Gruenbaum, Doron Porat, Assaf Natanzon +4

    cs.AIarXiv:2609.11286v12026
  22. TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times

    Jintao Zhang, Kaiwen Zheng, Kai Jiang +5

    cs.CVcs.AIcs.LGarXiv:2512.16093v12025
  23. Fara-7B: An Efficient Agentic Model for Computer Use

    Ahmed Awadallah, Yash Lara, Raghav Magazine +9

    cs.AIcs.CLcs.CVarXiv:2511.19663v12025
  24. An AI-Powered Culturally Aware Chatbot for Stress Detection and Wellness Support among Pakistani University Students Using NLP and Machine Learning

    Muhammad Fahad Bashir, Muhammad Afzal

    cs.AIarXiv:2609.11199v12026
  25. MedSAM3: Delving into Segment Anything with Medical Concepts

    Anglin Liu, Rundong Xue, Xu R. Cao +5

    cs.CVcs.AIarXiv:2511.19046v12025
  26. Debate-to-Skill: Capability-Bound Process Supervision for Industrial Query-to-Agent Annotation

    Shiyu Zhang, Leisheng Cheng, Huifu Li

    cs.AIarXiv:2609.11176v12026
  27. Breaking Predictions Is Not Enough: Specified-Foil Counterfactuals for Temporal Graphs

    Minwoo Yu, Young-guk Ha

    cs.AIarXiv:2609.11170v12026
  28. Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment

    Jiayu Huang, Zichen Tang, Qianhui Ling +2

    cs.AIarXiv:2609.11185v12026
  29. MOSAIC: Query-Aware Exploration Policy Adaptation for GraphRAG

    EunKyeong Lee, Kyeong-Jin Oh, Jinwon Kim +4

    cs.AIarXiv:2609.11065v12026
  30. The Agent Incident Registry: Toward Preventing Repeated AI Agent Failures

    Divyanshu Kumar, Rohith HN, Nitin Aravind Birur +2

    cs.AIarXiv:2609.11030v12026
  31. When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents

    Qinzhen Ma, Ruihai Wu

    cs.AIarXiv:2609.10873v12026
  32. Automating Quadratic Unconstrained Binary Optimization (QUBO) Formulation Generation from Natural Language

    Niloy Kumar Mondal, Md Rizwan Parvez

    cs.AIarXiv:2609.10629v12026
  33. Fork Where the Model Changes Its Mind: Belief-Shift Branching for Tree-Structured Reinforcement Learning

    Bin Lei, Yu Li, Prafulla Kumar Choubey +7

    cs.AIarXiv:2609.11061v12026
  34. Probabilistic Focal Search: Accelerating Bounded-Suboptimal Search via Lower-Bound Advancement

    Minh Vu Duc, Trung Le Huu, Hà Minh Hoàng +3

    cs.AIarXiv:2609.10584v12026
  35. Particle Filter Networks with Application to Visual Localization

    Peter Karkus, David Hsu, Wee Sun Lee

    cs.ROcs.AIcs.CVarXiv:1805.08975v32018
  36. AIP: Agent Identity Protocol for Verifiable Delegation Across MCP and A2A

    Sunil Prakash

    cs.CRcs.AIarXiv:2603.24775v12026
  37. Generating Long Videos of Dynamic Scenes

    Brooks, Tim, Hellsten, Janne, Aittala, Miika +6

    cs.CVcs.AIcs.LGarXiv:2206.03429v22022
  38. GRIPNet: Gaussian Radial Intensity Prior Guided Architecture for Pulmonary Nodule Detection in CT

    Yang, Haojie, Su, Ran

    cs.CVcs.AIarXiv:2609.11312v12026
  39. A Definition of AGI

    Hendrycks, Dan, Song, Dawn, Szegedy, Christian +30

    cs.AIcs.LGarXiv:2510.18212v32025
  40. Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model

    Ling Team, Anqi Shen, Baihui Li +101

    cs.CLcs.AIarXiv:2510.18855v22025
  41. Budget-Aware Tool Use Enables Effective Agent Scaling

    Tengxiao Liu, Zifeng Wang, Jin Miao +12

    cs.AIarXiv:2511.17006v22025
  42. DeepHeart: Semi-Supervised Sequence Learning for Cardiovascular Risk Prediction

    Brandon Ballinger, Johnson Hsieh, Avesh Singh +8

    cs.LGcs.AIstat.MLarXiv:1802.02511v12018
  43. The Choice of Divergence: A Neglected Key to Mitigating Diversity Collapse in Reinforcement Learning with Verifiable Reward

    Long Li, Zhijian Zhou, Jiaran Hao +9

    cs.LGcs.AIarXiv:2509.07430v42025
  44. HALDETECT at ImageEval 2026 Shared Tasks: Answer-First Contrastive Grounding with QLoRA

    Syed Mohaiminul Hoque, Md Sakhawat Hossain

    cs.CVcs.AIarXiv:2609.11236v12026
  45. UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning

    Ye Liu, Zongyang Ma, Junfu Pu +4

    cs.CVcs.AIarXiv:2509.18094v42025
  46. Proof-Carrying Cognition: Closing the Verification Gap with Reality-Settled Reward

    Eshwar Reddy M, Sourav Karmakar

    cs.AIcs.LGarXiv:2609.09776v12026
  47. From Evaluation to Enhancement: Benchmarking and Improving Think-with-Video Reasoning for Video Generative Models

    Meng Luo, Yicheng Liu, Jiahao Wang +5

    cs.CVcs.AIarXiv:2609.11242v12026
  48. Explainable AI for clinical and remote health applications: a survey on tabular and time series data

    Flavio Di Martino, Franca Delmastro

    cs.LGcs.AIarXiv:2209.06528v12022
  49. VitaBench: Benchmarking LLM Agents with Versatile Interactive Tasks in Real-world Applications

    Wei He, Yueqing Sun, Hongyan Hao +13

    cs.CLcs.AIarXiv:2509.26490v22025
  50. Stabilizing Reinforcement Learning with LLMs: Formulation and Practices

    Chujie Zheng, Kai Dang, Bowen Yu +10

    cs.LGcs.AIcs.CLarXiv:2512.01374v32025
  51. Beyond Visual Quality: Evaluating Physical Consistency under Ego-Motion with EgoGenEval

    Yilin Long, Chenming Zhu, Zitang Gou +2

    cs.CVcs.AIarXiv:2609.11172v12026
  52. Your Agent May Misevolve: Emergent Risks in Self-evolving LLM Agents

    Shuai Shao, Qihan Ren, Chen Qian +8

    cs.AIcs.CLcs.LGarXiv:2509.26354v22025
  53. Beyond Benchmarks: Using VLMs to Reveal Systematic Classification Failures Under Real World Conditions

    Dieuwertje Alblas, Alma M. Liezenga, Jan Erik van Woerden +3

    cs.CVcs.AIcs.ETarXiv:2609.11126v12026
  54. Scaling LLM Multi-turn RL with End-to-end Summarization-based Context Management

    Miao Lu, Weiwei Sun, Weihua Du +4

    cs.CLcs.AIcs.LGarXiv:2510.06727v12025
  55. Toward Interpretable Multimodal Fusion: Heat Conduction Modeling for Hyperspectral and LiDAR Joint Classification

    Kan Wei, Jiahui Cui, Jing Yao +3

    cs.CVcs.AIarXiv:2609.11040v12026
  56. Premise Selection for Theorem Proving by Deep Graph Embedding

    Mingzhe Wang, Yihe Tang, Jian Wang +1

    cs.AIcs.LGcs.LOarXiv:1709.09994v12017
  57. AI and 6G into the Metaverse: Fundamentals, Challenges and Future Research Trends

    Muhammad Zawish, Fayaz Ali Dharejo, Sunder Ali Khowaja +4

    cs.AIcs.HCcs.NIarXiv:2208.10921v22022
  58. KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems

    Hancheng Ye, Zhengqi Gao, Mingyuan Ma +8

    cs.MAcs.AIstat.MLarXiv:2510.12872v22025
  59. Black-Box On-Policy Distillation of Large Language Models

    Tianzhu Ye, Li Dong, Zewen Chi +3

    cs.CLcs.AIarXiv:2511.10643v32025
  60. Prosperity before Collapse: How Far Can Off-Policy RL Reach with Stale Data on LLMs?

    Haizhong Zheng, Jiawei Zhao, Beidi Chen

    cs.LGcs.AIarXiv:2510.01161v22025