Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

5,521 to 5,580 of 15,403

  1. Industrial Internet of Things Intelligence Empowering Smart Manufacturing: A Literature Review

    Yujiao Hu, Qingmin Jia, Yuao Yao +6

    cs.AIcs.CYarXiv:2312.16174v22023
  2. TTCS: Test-Time Curriculum Synthesis for Self-Evolving

    Chengyi Yang, Zhishang Xiang, Yunbo Tang +5

    cs.LGcs.AIcs.CLarXiv:2601.22628v12026
  3. REASONING GYM: Reasoning Environments for Reinforcement Learning with Verifiable Rewards

    Zafir Stojanovski, Oliver Stanley, Joe Sharratt +4

    cs.LGcs.AIcs.CLarXiv:2505.24760v22025
  4. A Mechanistic View on Video Generation as World Models: State and Dynamics

    Luozhou Wang, Zhifei Chen, Yihua Du +11

    cs.CVcs.AIarXiv:2601.17067v12026
  5. Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge

    Yao Tang, Li Dong, Yaru Hao +3

    cs.CLcs.AIcs.LGarXiv:2601.08808v12026
  6. Reinforcement Learning with Action Chunking

    Qiyang Li, Zhiyuan Zhou, Sergey Levine

    cs.LGcs.AIcs.ROarXiv:2507.07969v42025
  7. VIBE: Visual Instruction Based Editor

    Grigorii Alekseenko, Aleksandr Gordeev, Irina Tolstykh +7

    cs.CVcs.AIcs.LGarXiv:2601.02242v12026
  8. GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving

    Lloyd Russell, Anthony Hu, Lorenzo Bertoni +4

    cs.CVcs.AIcs.ROarXiv:2503.20523v12025
  9. OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction

    Lujie Yang, Xiaoyu Huang, Zhen Wu +6

    cs.ROcs.AIcs.LGarXiv:2509.26633v32025
  10. MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents

    Kunlun Zhu, Hongyi Du, Zhaochen Hong +8

    cs.MAcs.AIcs.CLarXiv:2503.01935v12025
  11. Distributed Implicit Harm: A Compositional Safety Blind Spot in MLLM-Based Video Moderation

    Ruotong Wang, Zihao Zhu, Siwei Lyu +2

    cs.CVcs.AIarXiv:2609.00206v12026
  12. Learning a visuomotor controller for real world robotic grasping using simulated depth images

    Ulrich Viereck, Andreas ten Pas, Kate Saenko +1

    cs.ROcs.AIarXiv:1706.04652v32017
  13. PaliGemma: A versatile 3B VLM for transfer

    Lucas Beyer, Andreas Steiner, André Susano Pinto +32

    cs.CVcs.AIcs.CLarXiv:2407.07726v22024
  14. ReFT: Representation Finetuning for Language Models

    Zhengxuan Wu, Aryaman Arora, Zheng Wang +4

    cs.CLcs.AIcs.LGarXiv:2404.03592v32024
  15. V-STaR: Training Verifiers for Self-Taught Reasoners

    Arian Hosseini, Xingdi Yuan, Nikolay Malkin +3

    cs.LGcs.AIcs.CLarXiv:2402.06457v22024
  16. Advancements in Generative AI: A Comprehensive Review of GANs, GPT, Autoencoders, Diffusion Model, and Transformers

    Staphord Bengesi, Hoda El-Sayed, Md Kamruzzaman Sarker +3

    cs.LGcs.AIarXiv:2311.10242v22023
  17. Convolutional Recurrent Neural Networks for Small-Footprint Keyword Spotting

    Sercan O. Arik, Markus Kliegl, Rewon Child +5

    cs.CLcs.AIcs.LGarXiv:1703.05390v32017
  18. Large Language Models as Optimizers

    Chengrun Yang, Xuezhi Wang, Yifeng Lu +4

    cs.LGcs.AIcs.CLarXiv:2309.03409v32023
  19. LIMR: Less is More for RL Scaling

    Xuefeng Li, Haoyang Zou, Pengfei Liu

    cs.LGcs.AIcs.CLarXiv:2502.11886v12025
  20. A Comprehensive Survey of Deep Transfer Learning for Anomaly Detection in Industrial Time Series: Methods, Applications, and Directions

    Peng Yan, Ahmed Abdulkadir, Paul-Philipp Luley +4

    cs.LGcs.AIarXiv:2307.05638v22023
  21. Language is All a Graph Needs

    Ruosong Ye, Caiqi Zhang, Runhui Wang +2

    cs.CLcs.AIcs.IRarXiv:2308.07134v52023
  22. Is Self-Repair a Silver Bullet for Code Generation?

    Theo X. Olausson, Jeevana Priya Inala, Chenglong Wang +2

    cs.CLcs.AIcs.PLarXiv:2306.09896v52023
  23. Can Language Models Solve Graph Problems in Natural Language?

    Heng Wang, Shangbin Feng, Tianxing He +3

    cs.CLcs.AIarXiv:2305.10037v32023
  24. Open-vocabulary Queryable Scene Representations for Real World Planning

    Boyuan Chen, Fei Xia, Brian Ichter +5

    cs.ROcs.AIcs.CVarXiv:2209.09874v22022
  25. Data Augmentation techniques in time series domain: A survey and taxonomy

    Guillermo Iglesias, Edgar Talavera, Ángel González-Prieto +2

    cs.LGcs.AIarXiv:2206.13508v42022
  26. Towards Unified Conversational Recommender Systems via Knowledge-Enhanced Prompt Learning

    Xiaolei Wang, Kun Zhou, Ji-Rong Wen +1

    cs.CLcs.AIcs.IRarXiv:2206.09363v12022
  27. Deep ROC Analysis and AUC as Balanced Average Accuracy to Improve Model Selection, Understanding and Interpretation

    André M. Carrington, Douglas G. Manuel, Paul W. Fieguth +9

    stat.MEcs.AIcs.LGarXiv:2103.11357v12021
  28. Distributional Soft Actor-Critic: Off-Policy Reinforcement Learning for Addressing Value Estimation Errors

    Jingliang Duan, Yang Guan, Shengbo Eben Li +2

    cs.LGcs.AIeess.SYarXiv:2001.02811v32020
  29. Attributed Graph Clustering via Adaptive Graph Convolution

    Xiaotong Zhang, Han Liu, Qimai Li +1

    cs.LGcs.AIstat.MLarXiv:1906.01210v12019
  30. Adversarial Attack and Defense on Graph Data: A Survey

    Lichao Sun, Yingtong Dou, Carl Yang +5

    cs.CRcs.AIcs.SIarXiv:1812.10528v42018
  31. Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty

    Mehul Damani, Isha Puri, Stewart Slocum +4

    cs.LGcs.AIcs.CLarXiv:2507.16806v22025
  32. Flow: A Modular Learning Framework for Mixed Autonomy Traffic

    Cathy Wu, Aboudy Kreidieh, Kanaad Parvate +2

    cs.AIcs.ROeess.SYarXiv:1710.05465v42017
  33. MedSAM2: Segment Anything in 3D Medical Images and Videos

    Jun Ma, Zongxin Yang, Sumin Kim +6

    eess.IVcs.AIcs.CVarXiv:2504.03600v12025
  34. Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation

    Junyan Ye, Dongzhi Jiang, Zihao Wang +9

    cs.CVcs.AIcs.CLarXiv:2508.09987v12025
  35. RoboCasa365: A Large-Scale Simulation Framework for Training and Benchmarking Generalist Robots

    Soroush Nasiriany, Sepehr Nasiriany, Abhiram Maddukuri +1

    cs.ROcs.AIcs.LGarXiv:2603.04356v12026
  36. OVO-Bench: How Far is Your Video-LLMs from Real-World Online Video Understanding?

    Yifei Li, Junbo Niu, Ziyang Miao +12

    cs.CVcs.AIarXiv:2501.05510v22025
  37. Subliminal Learning: Language models transmit behavioral traits via hidden signals in data

    Alex Cloud, Minh Le, James Chua +5

    cs.LGcs.AIarXiv:2507.14805v12025
  38. Do generative video models understand physical principles?

    Saman Motamed, Laura Culp, Kevin Swersky +2

    cs.CVcs.AIcs.GRarXiv:2501.09038v32025
  39. Safe Reinforcement Learning with Model Uncertainty Estimates

    Björn Lütjens, Michael Everett, Jonathan P. How

    cs.ROcs.AIcs.LGarXiv:1810.08700v22018
  40. WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization

    Zhengwei Tao, Jialong Wu, Wenbiao Yin +10

    cs.CLcs.AIarXiv:2507.15061v12025
  41. See What You Are Told: Visual Attention Sink in Large Multimodal Models

    Seil Kang, Jinyeong Kim, Junhyeok Kim +1

    cs.CVcs.AIarXiv:2503.03321v12025
  42. NeoRed: A Knowledge-Logic-Alignment Multimodal Large Language Model for Neonatal Respiratory Disease Diagnosis

    Yinan Liu, Hongtai Xia, Haoran Xu +3

    cs.AIarXiv:2609.03527v12026
    Summaries:한국어
  43. Verify Before You Distill: Prompt-Level Teacher Gating for On-Policy Distillation

    Zhiwei Zhang, Zechen Sun, Fei Zhao +6

    cs.LGcs.AIcs.CLarXiv:2609.02998v12026
  44. A Two-Stage Learning PINN Approach for Solving the Inverse Problem of the 1D Porous Medium Equation

    Noura Al Helwani, Sophie Moufawad, Nabil Nassif

    math.OCcs.AIarXiv:2608.16475v12026
  45. Agentic Empirical Asset Pricing: Methodological Foundations

    Yingjian Pan, Xiaowei Ding, Kay Giesecke

    cs.AIcs.LGq-fin.STarXiv:2609.00731v12026
    Summaries:한국어
  46. Training Alignment Auditors via Reinforcement Learning

    Paul Rosu, Rowan Wang

    cs.AIcs.LGarXiv:2608.25460v12026
  47. Functional compatibility as a determinant of persistent neural learning

    Hossein Javidnia

    cs.LGcs.AIarXiv:2608.22462v22026
  48. EviDx: Evidence-Aware Active Diagnosis with Scaffolded LLM Agents

    Lihang Zeng, Shaoting Zhang, Xiaofan Zhang

    cs.AIarXiv:2608.24570v12026
  49. Self-Evolving Curriculum for LLM Reasoning

    Xiaoyin Chen, Jiarui Lu, Minsu Kim +6

    cs.AIcs.LGarXiv:2505.14970v42025
  50. The Empire, Long Divided, Must Unite: Architectural Convergence in Three LLM Agent Harnesses

    Dai Jiahong

    cs.SEcs.AIcs.CEarXiv:2608.23953v12026
  51. Length-Adaptive Decoding for Masked Diffusion Machine Translation

    Yan Zhan, Mengkai Hou, Wanting Zhang +1

    cs.CLcs.AIcs.LGarXiv:2608.22274v12026
  52. CRS-Bench: A Reference-Relative Reliability Benchmark for Medical Image Encoders

    Xingtao Lin, Hangqi Ren, Caiwan Sun +1

    eess.IVcs.AIcs.CVarXiv:2608.22059v12026
  53. GuardianBench: A Same-Scene Instruction-Contrastive Benchmark for Latent Contextual Risk in Embodied AI

    Zhesheng Zhang, Jiahao Lu, Wei Liu +8

    cs.AIcs.CLcs.ROarXiv:2608.21928v12026
  54. DreamBench-SWE: A Multi-Session Memory-Hygiene Benchmark for Software Agents

    Sarthak Singh

    cs.AIcs.SEarXiv:2608.20664v12026
  55. FlavourBench: Ranking Frontier Language Models with Executable Culinary Ground Truth

    Josef Chen, Erim Hayretci

    cs.AIcs.CYcs.LGarXiv:2608.20574v12026
  56. ReWEIGH the Evidence: Calibrating Token-Level Ordinal Visual Evidence to Mitigate Hallucinations in Large Vision-Language Models

    Jihae Jeong, Junha Choi, Hwanjo Yu

    cs.CVcs.AIcs.CLarXiv:2608.19075v12026
  57. Denoising-Aware Inversion: Revealing Privacy Risks in Noise-Protected Text Embeddings

    Yubo Wang, Shujie Cui, James Bailey +5

    cs.LGcs.AIcs.CRarXiv:2608.18610v12026
  58. Physics-Unrolled Neural Operator for Wireless Field Modeling

    Rafid Umayer Murshed, Saif Ur Rahman, Mingyue Tang +1

    cs.LGcs.AIarXiv:2608.18495v12026
  59. SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation

    Keyu Tu, Zhuowei Chen, Mengqi Huang +4

    cs.CVcs.AIarXiv:2608.17426v12026
  60. Cross-Model Memory Transfer via Target-Side Reader Adaptation

    Mingyuan Li, Guangsheng Yu, Xu Wang +1

    cs.CLcs.AIarXiv:2608.17050v12026