Artificial Intelligence

Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,301 to 6,360 of 15,404

  1. TabLLM: Few-shot Classification of Tabular Data with Large Language Models

    Stefan Hegselmann, Alejandro Buendia, Hunter Lang +3

    cs.CLcs.AIarXiv:2210.10723v22022
  2. Pure Transformers are Powerful Graph Learners

    Jinwoo Kim, Tien Dat Nguyen, Seonwoo Min +4

    cs.LGcs.AIarXiv:2207.02505v22022
  3. UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning

    Haoming Wang, Haoyang Zou, Huatong Song +109

    cs.AIcs.CLcs.CVarXiv:2509.02544v22025
  4. Solving Quantitative Reasoning Problems with Language Models

    Aitor Lewkowycz, Anders Andreassen, David Dohan +11

    cs.CLcs.AIcs.LGarXiv:2206.14858v22022
  5. EmbeddingGemma: Powerful and Lightweight Text Representations

    Henrique Schechter Vera, Sahil Dua, Biao Zhang +86

    cs.CLcs.AIarXiv:2509.20354v32025
  6. Improving Graph Collaborative Filtering with Neighborhood-enriched Contrastive Learning

    Zihan Lin, Changxin Tian, Yupeng Hou +1

    cs.IRcs.AIarXiv:2202.06200v22022
  7. TransMorph: Transformer for unsupervised medical image registration

    Junyu Chen, Eric C. Frey, Yufan He +3

    eess.IVcs.AIcs.CVarXiv:2111.10480v62021
  8. MultiBench: Multiscale Benchmarks for Multimodal Representation Learning

    Paul Pu Liang, Yiwei Lyu, Xiang Fan +9

    cs.LGcs.AIcs.CLarXiv:2107.07502v22021
  9. Preservation of the Global Knowledge by Not-True Distillation in Federated Learning

    Gihun Lee, Minchan Jeong, Yongjin Shin +2

    cs.LGcs.AIcs.CVarXiv:2106.03097v52021
  10. MITRE at SemEval-2016 Task 6: Transfer Learning for Stance Detection

    Guido Zarrella, Amy Marsh

    cs.AIcs.CLarXiv:1606.03784v12016
  11. STAN: Spatio-Temporal Attention Network for Next Location Recommendation

    Yingtao Luo, Qiang Liu, Zhaocheng Liu

    cs.IRcs.AIarXiv:2102.04095v12021
  12. On the eigenvector bias of Fourier feature networks: From regression to solving multi-scale PDEs with physics-informed neural networks

    Sifan Wang, Hanwen Wang, Paris Perdikaris

    cs.LGcs.AIstat.MLarXiv:2012.10047v12020
  13. QPLEX: Duplex Dueling Multi-Agent Q-Learning

    Jianhao Wang, Zhizhou Ren, Terry Liu +2

    cs.LGcs.AIcs.MAarXiv:2008.01062v32020
  14. Decision-Making with Auto-Encoding Variational Bayes

    Romain Lopez, Pierre Boyeau, Nir Yosef +2

    stat.MLcs.AIcs.LGarXiv:2002.07217v32020
  15. Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning

    Tianhe Yu, Deirdre Quillen, Zhanpeng He +7

    cs.LGcs.AIcs.ROarXiv:1910.10897v22019
  16. Graph Neural Tangent Kernel: Fusing Graph Neural Networks with Graph Kernels

    Simon S. Du, Kangcheng Hou, Barnabás Póczos +3

    cs.LGcs.AIcs.CVarXiv:1905.13192v22019
  17. Text Classification Algorithms: A Survey

    Kamran Kowsari, Kiana Jafari Meimandi, Mojtaba Heidarysafa +3

    cs.LGcs.AIcs.CLarXiv:1904.08067v52019
  18. Deep Reinforcement Learning for Sepsis Treatment

    Aniruddh Raghu, Matthieu Komorowski, Imran Ahmed +3

    cs.AIcs.LGarXiv:1711.09602v12017
  19. Mercury: Ultra-Fast Language Models Based on Diffusion

    Inception Labs, Samar Khanna, Siddhant Kharbanda +10

    cs.CLcs.AIcs.LGarXiv:2506.17298v12025
  20. A Survey on Traffic Signal Control Methods

    Hua Wei, Guanjie Zheng, Vikash Gayah +1

    cs.LGcs.AIstat.MLarXiv:1904.08117v32019
  21. Three scenarios for continual learning

    Gido M. van de Ven, Andreas S. Tolias

    cs.LGcs.AIcs.CVarXiv:1904.07734v12019
  22. Large Batch Optimization for Deep Learning: Training BERT in 76 minutes

    Yang You, Jing Li, Sashank Reddi +7

    cs.LGcs.AIcs.CLarXiv:1904.00962v52019
  23. Soft Actor-Critic Algorithms and Applications

    Tuomas Haarnoja, Aurick Zhou, Kristian Hartikainen +8

    cs.LGcs.AIcs.ROarXiv:1812.05905v22018
  24. The relativistic discriminator: a key element missing from standard GAN

    Alexia Jolicoeur-Martineau

    cs.LGcs.AIcs.CRarXiv:1807.00734v32018
  25. Understanding Batch Normalization

    Johan Bjorck, Carla Gomes, Bart Selman +1

    cs.LGcs.AIstat.MLarXiv:1806.02375v42018
  26. Deep Sequence Learning with Auxiliary Information for Traffic Prediction

    Binbing Liao, Jingqing Zhang, Chao Wu +5

    cs.CVcs.AIarXiv:1806.07380v12018
  27. TADAM: Task dependent adaptive metric for improved few-shot learning

    Boris N. Oreshkin, Pau Rodriguez, Alexandre Lacoste

    cs.LGcs.AIcs.CVarXiv:1805.10123v42018
  28. Data-Efficient Hierarchical Reinforcement Learning

    Ofir Nachum, Shixiang Gu, Honglak Lee +1

    cs.LGcs.AIstat.MLarXiv:1805.08296v42018
  29. Selective Experience Replay for Lifelong Learning

    David Isele, Akansel Cosgun

    cs.AIarXiv:1802.10269v12018
  30. Mean Field Multi-Agent Reinforcement Learning

    Yaodong Yang, Rui Luo, Minne Li +3

    cs.MAcs.AIcs.LGarXiv:1802.05438v52018
  31. Reasoning with Latent Thoughts: On the Power of Looped Transformers

    Nikunj Saunshi, Nishanth Dikkala, Zhiyuan Li +2

    cs.CLcs.AIcs.LGarXiv:2502.17416v12025
  32. Deep Learning for Physical Processes: Incorporating Prior Scientific Knowledge

    Emmanuel de Bezenac, Arthur Pajot, Patrick Gallinari

    cs.AIcs.LGstat.MLarXiv:1711.07970v22017
  33. $Q$- and $A$-Learning Methods for Estimating Optimal Dynamic Treatment Regimes

    Phillip J. Schulte, Anastasios A. Tsiatis, Eric B. Laber +1

    stat.MEcs.AIarXiv:1202.4177v32012
  34. Ensembles of Multiple Models and Architectures for Robust Brain Tumour Segmentation

    Konstantinos Kamnitsas, Wenjia Bai, Enzo Ferrante +8

    cs.CVcs.AIcs.LGarXiv:1711.01468v12017
  35. A systematic study of the class imbalance problem in convolutional neural networks

    Mateusz Buda, Atsuto Maki, Maciej A. Mazurowski

    cs.CVcs.AIcs.LGarXiv:1710.05381v22017
  36. Safe and Nested Subgame Solving for Imperfect-Information Games

    Noam Brown, Tuomas Sandholm

    cs.AIcs.GTarXiv:1705.02955v32017
  37. Minimax Regret Bounds for Reinforcement Learning

    Mohammad Gheshlaghi Azar, Ian Osband, Rémi Munos

    stat.MLcs.AIcs.LGarXiv:1703.05449v22017
  38. Bridging the Gap Between Value and Policy Based Reinforcement Learning

    Ofir Nachum, Mohammad Norouzi, Kelvin Xu +1

    cs.AIcs.LGstat.MLarXiv:1702.08892v32017
  39. MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent

    Hongli Yu, Tinghong Chen, Jiangtao Feng +8

    cs.CLcs.AIcs.LGarXiv:2507.02259v22025
  40. Generative Adversarial Imitation Learning

    Jonathan Ho, Stefano Ermon

    cs.LGcs.AIarXiv:1606.03476v12016
  41. Unifying Count-Based Exploration and Intrinsic Motivation

    Marc G. Bellemare, Sriram Srinivasan, Georg Ostrovski +3

    cs.AIcs.LGstat.MLarXiv:1606.01868v22016
  42. Adversarial Feature Learning

    Jeff Donahue, Philipp Krähenbühl, Trevor Darrell

    cs.LGcs.AIcs.CVarXiv:1605.09782v72016
  43. Efficient Multi-Scale 3D CNN with Fully Connected CRF for Accurate Brain Lesion Segmentation

    Konstantinos Kamnitsas, Christian Ledig, Virginia F. J. Newcombe +5

    cs.CVcs.AIarXiv:1603.05959v32016
  44. DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments

    Yuxiang Zheng, Dayuan Fu, Xiangkun Hu +4

    cs.AIcs.CLcs.LGarXiv:2504.03160v42025
  45. Gated Graph Sequence Neural Networks

    Yujia Li, Daniel Tarlow, Marc Brockschmidt +1

    cs.LGcs.AIcs.NEarXiv:1511.05493v42015
  46. The Ubuntu Dialogue Corpus: A Large Dataset for Research in Unstructured Multi-Turn Dialogue Systems

    Ryan Lowe, Nissan Pow, Iulian Serban +1

    cs.CLcs.AIcs.LGarXiv:1506.08909v32015
  47. Hinge-Loss Markov Random Fields and Probabilistic Soft Logic

    Stephen H. Bach, Matthias Broecheler, Bert Huang +1

    cs.LGcs.AIstat.MLarXiv:1505.04406v32015
  48. Learning Dependency-Based Compositional Semantics

    Percy Liang, Michael I. Jordan, Dan Klein

    cs.AIarXiv:1109.6841v12011
  49. HiLRP: Toward One Trustworthy Explanation for Vision Transformer: Conservation-Valid Attribution via Attention Primitives

    Sathiyamohan Nishankar, Pubudu Sanjeewani, Asanka Perera +1

    cs.CVcs.AIarXiv:2609.01282v12026
  50. StainPresetNet: Stain Preset Network for Fast Multi-to-Multi Stain Normalization

    Hongtao Kang, Die Luo, Li Chen +4

    cs.CVcs.AIarXiv:2609.01146v12026
  51. Adaptive Submodularity: Theory and Applications in Active Learning and Stochastic Optimization

    Daniel Golovin, Andreas Krause

    cs.LGcs.AIcs.DSarXiv:1003.3967v52010
  52. HVI: A New Color Space for Low-light Image Enhancement

    Qingsen Yan, Yixu Feng, Cheng Zhang +6

    cs.CVcs.AIcs.LGarXiv:2502.20272v22025
  53. Monkeypox Skin Lesion Detection Using Deep Learning Models: A Feasibility Study

    Shams Nafisa Ali, Md. Tazuddin Ahmed, Joydip Paul +4

    cs.CVcs.AIeess.IVarXiv:2207.03342v12022
  54. Solaris: Towards Interfaces That Are Generated, Not Coded

    Yuval Alaluf, Omri Avrahami, Guy Bukchin Leshem +18

    cs.CVcs.AIarXiv:2609.00776v12026
  55. AgentFactory: Towards Automated Agentic System Design and Optimization

    Enci Zhang, Haofeng Wang, Yuesheng Zhu +2

    cs.AIarXiv:2609.01045v12026
  56. WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation

    Yuwei Niu, Munan Ning, Mengren Zheng +9

    cs.CVcs.AIcs.CLarXiv:2503.07265v42025
  57. Machine Learning for Wireless Connectivity and Security of Cellular-Connected UAVs

    Ursula Challita, Aidin Ferdowsi, Mingzhe Chen +1

    cs.ITcs.AIarXiv:1804.05348v32018
  58. Scalable Best-of-N Selection for Large Language Models via Self-Certainty

    Zhewei Kang, Xuandong Zhao, Dawn Song

    cs.CLcs.AIcs.LGarXiv:2502.18581v32025
  59. SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution

    Yuxiang Wei, Olivier Duchenne, Jade Copet +6

    cs.SEcs.AIcs.CLarXiv:2502.18449v22025
  60. Instella-MoE Technical Report

    Jiang Liu, Sudhanshu Ranjan, Prakamya Mishra +10

    cs.CLcs.AIarXiv:2609.00791v12026