Artificial Intelligence
Papers filed under cs.AI on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,301 to 6,360 of 15,404
TabLLM: Few-shot Classification of Tabular Data with Large Language Models
Stefan Hegselmann, Alejandro Buendia, Hunter Lang +3
cs.CLcs.AIarXiv:2210.10723v22022Pure Transformers are Powerful Graph Learners
Jinwoo Kim, Tien Dat Nguyen, Seonwoo Min +4
cs.LGcs.AIarXiv:2207.02505v22022UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning
Haoming Wang, Haoyang Zou, Huatong Song +109
cs.AIcs.CLcs.CVarXiv:2509.02544v22025Solving Quantitative Reasoning Problems with Language Models
Aitor Lewkowycz, Anders Andreassen, David Dohan +11
cs.CLcs.AIcs.LGarXiv:2206.14858v22022EmbeddingGemma: Powerful and Lightweight Text Representations
Henrique Schechter Vera, Sahil Dua, Biao Zhang +86
cs.CLcs.AIarXiv:2509.20354v32025Improving Graph Collaborative Filtering with Neighborhood-enriched Contrastive Learning
Zihan Lin, Changxin Tian, Yupeng Hou +1
cs.IRcs.AIarXiv:2202.06200v22022TransMorph: Transformer for unsupervised medical image registration
Junyu Chen, Eric C. Frey, Yufan He +3
eess.IVcs.AIcs.CVarXiv:2111.10480v62021MultiBench: Multiscale Benchmarks for Multimodal Representation Learning
Paul Pu Liang, Yiwei Lyu, Xiang Fan +9
cs.LGcs.AIcs.CLarXiv:2107.07502v22021Preservation of the Global Knowledge by Not-True Distillation in Federated Learning
Gihun Lee, Minchan Jeong, Yongjin Shin +2
cs.LGcs.AIcs.CVarXiv:2106.03097v52021MITRE at SemEval-2016 Task 6: Transfer Learning for Stance Detection
Guido Zarrella, Amy Marsh
cs.AIcs.CLarXiv:1606.03784v12016STAN: Spatio-Temporal Attention Network for Next Location Recommendation
Yingtao Luo, Qiang Liu, Zhaocheng Liu
cs.IRcs.AIarXiv:2102.04095v12021On the eigenvector bias of Fourier feature networks: From regression to solving multi-scale PDEs with physics-informed neural networks
Sifan Wang, Hanwen Wang, Paris Perdikaris
cs.LGcs.AIstat.MLarXiv:2012.10047v12020QPLEX: Duplex Dueling Multi-Agent Q-Learning
Jianhao Wang, Zhizhou Ren, Terry Liu +2
cs.LGcs.AIcs.MAarXiv:2008.01062v32020Decision-Making with Auto-Encoding Variational Bayes
Romain Lopez, Pierre Boyeau, Nir Yosef +2
stat.MLcs.AIcs.LGarXiv:2002.07217v32020Meta-World: A Benchmark and Evaluation for Multi-Task and Meta Reinforcement Learning
Tianhe Yu, Deirdre Quillen, Zhanpeng He +7
cs.LGcs.AIcs.ROarXiv:1910.10897v22019Graph Neural Tangent Kernel: Fusing Graph Neural Networks with Graph Kernels
Simon S. Du, Kangcheng Hou, Barnabás Póczos +3
cs.LGcs.AIcs.CVarXiv:1905.13192v22019Text Classification Algorithms: A Survey
Kamran Kowsari, Kiana Jafari Meimandi, Mojtaba Heidarysafa +3
cs.LGcs.AIcs.CLarXiv:1904.08067v52019Deep Reinforcement Learning for Sepsis Treatment
Aniruddh Raghu, Matthieu Komorowski, Imran Ahmed +3
cs.AIcs.LGarXiv:1711.09602v12017Mercury: Ultra-Fast Language Models Based on Diffusion
Inception Labs, Samar Khanna, Siddhant Kharbanda +10
cs.CLcs.AIcs.LGarXiv:2506.17298v12025A Survey on Traffic Signal Control Methods
Hua Wei, Guanjie Zheng, Vikash Gayah +1
cs.LGcs.AIstat.MLarXiv:1904.08117v32019Three scenarios for continual learning
Gido M. van de Ven, Andreas S. Tolias
cs.LGcs.AIcs.CVarXiv:1904.07734v12019Large Batch Optimization for Deep Learning: Training BERT in 76 minutes
Yang You, Jing Li, Sashank Reddi +7
cs.LGcs.AIcs.CLarXiv:1904.00962v52019Soft Actor-Critic Algorithms and Applications
Tuomas Haarnoja, Aurick Zhou, Kristian Hartikainen +8
cs.LGcs.AIcs.ROarXiv:1812.05905v22018The relativistic discriminator: a key element missing from standard GAN
Alexia Jolicoeur-Martineau
cs.LGcs.AIcs.CRarXiv:1807.00734v32018Understanding Batch Normalization
Johan Bjorck, Carla Gomes, Bart Selman +1
cs.LGcs.AIstat.MLarXiv:1806.02375v42018Deep Sequence Learning with Auxiliary Information for Traffic Prediction
Binbing Liao, Jingqing Zhang, Chao Wu +5
cs.CVcs.AIarXiv:1806.07380v12018TADAM: Task dependent adaptive metric for improved few-shot learning
Boris N. Oreshkin, Pau Rodriguez, Alexandre Lacoste
cs.LGcs.AIcs.CVarXiv:1805.10123v42018Data-Efficient Hierarchical Reinforcement Learning
Ofir Nachum, Shixiang Gu, Honglak Lee +1
cs.LGcs.AIstat.MLarXiv:1805.08296v42018Selective Experience Replay for Lifelong Learning
David Isele, Akansel Cosgun
cs.AIarXiv:1802.10269v12018Mean Field Multi-Agent Reinforcement Learning
Yaodong Yang, Rui Luo, Minne Li +3
cs.MAcs.AIcs.LGarXiv:1802.05438v52018Reasoning with Latent Thoughts: On the Power of Looped Transformers
Nikunj Saunshi, Nishanth Dikkala, Zhiyuan Li +2
cs.CLcs.AIcs.LGarXiv:2502.17416v12025Deep Learning for Physical Processes: Incorporating Prior Scientific Knowledge
Emmanuel de Bezenac, Arthur Pajot, Patrick Gallinari
cs.AIcs.LGstat.MLarXiv:1711.07970v22017$Q$- and $A$-Learning Methods for Estimating Optimal Dynamic Treatment Regimes
Phillip J. Schulte, Anastasios A. Tsiatis, Eric B. Laber +1
stat.MEcs.AIarXiv:1202.4177v32012Ensembles of Multiple Models and Architectures for Robust Brain Tumour Segmentation
Konstantinos Kamnitsas, Wenjia Bai, Enzo Ferrante +8
cs.CVcs.AIcs.LGarXiv:1711.01468v12017A systematic study of the class imbalance problem in convolutional neural networks
Mateusz Buda, Atsuto Maki, Maciej A. Mazurowski
cs.CVcs.AIcs.LGarXiv:1710.05381v22017Safe and Nested Subgame Solving for Imperfect-Information Games
Noam Brown, Tuomas Sandholm
cs.AIcs.GTarXiv:1705.02955v32017Minimax Regret Bounds for Reinforcement Learning
Mohammad Gheshlaghi Azar, Ian Osband, Rémi Munos
stat.MLcs.AIcs.LGarXiv:1703.05449v22017Bridging the Gap Between Value and Policy Based Reinforcement Learning
Ofir Nachum, Mohammad Norouzi, Kelvin Xu +1
cs.AIcs.LGstat.MLarXiv:1702.08892v32017MemAgent: Reshaping Long-Context LLM with Multi-Conv RL-based Memory Agent
Hongli Yu, Tinghong Chen, Jiangtao Feng +8
cs.CLcs.AIcs.LGarXiv:2507.02259v22025Generative Adversarial Imitation Learning
Jonathan Ho, Stefano Ermon
cs.LGcs.AIarXiv:1606.03476v12016Unifying Count-Based Exploration and Intrinsic Motivation
Marc G. Bellemare, Sriram Srinivasan, Georg Ostrovski +3
cs.AIcs.LGstat.MLarXiv:1606.01868v22016Adversarial Feature Learning
Jeff Donahue, Philipp Krähenbühl, Trevor Darrell
cs.LGcs.AIcs.CVarXiv:1605.09782v72016Efficient Multi-Scale 3D CNN with Fully Connected CRF for Accurate Brain Lesion Segmentation
Konstantinos Kamnitsas, Christian Ledig, Virginia F. J. Newcombe +5
cs.CVcs.AIarXiv:1603.05959v32016DeepResearcher: Scaling Deep Research via Reinforcement Learning in Real-world Environments
Yuxiang Zheng, Dayuan Fu, Xiangkun Hu +4
cs.AIcs.CLcs.LGarXiv:2504.03160v42025Gated Graph Sequence Neural Networks
Yujia Li, Daniel Tarlow, Marc Brockschmidt +1
cs.LGcs.AIcs.NEarXiv:1511.05493v42015The Ubuntu Dialogue Corpus: A Large Dataset for Research in Unstructured Multi-Turn Dialogue Systems
Ryan Lowe, Nissan Pow, Iulian Serban +1
cs.CLcs.AIcs.LGarXiv:1506.08909v32015Hinge-Loss Markov Random Fields and Probabilistic Soft Logic
Stephen H. Bach, Matthias Broecheler, Bert Huang +1
cs.LGcs.AIstat.MLarXiv:1505.04406v32015Learning Dependency-Based Compositional Semantics
Percy Liang, Michael I. Jordan, Dan Klein
cs.AIarXiv:1109.6841v12011HiLRP: Toward One Trustworthy Explanation for Vision Transformer: Conservation-Valid Attribution via Attention Primitives
Sathiyamohan Nishankar, Pubudu Sanjeewani, Asanka Perera +1
cs.CVcs.AIarXiv:2609.01282v12026StainPresetNet: Stain Preset Network for Fast Multi-to-Multi Stain Normalization
Hongtao Kang, Die Luo, Li Chen +4
cs.CVcs.AIarXiv:2609.01146v12026Adaptive Submodularity: Theory and Applications in Active Learning and Stochastic Optimization
Daniel Golovin, Andreas Krause
cs.LGcs.AIcs.DSarXiv:1003.3967v52010HVI: A New Color Space for Low-light Image Enhancement
Qingsen Yan, Yixu Feng, Cheng Zhang +6
cs.CVcs.AIcs.LGarXiv:2502.20272v22025Monkeypox Skin Lesion Detection Using Deep Learning Models: A Feasibility Study
Shams Nafisa Ali, Md. Tazuddin Ahmed, Joydip Paul +4
cs.CVcs.AIeess.IVarXiv:2207.03342v12022Solaris: Towards Interfaces That Are Generated, Not Coded
Yuval Alaluf, Omri Avrahami, Guy Bukchin Leshem +18
cs.CVcs.AIarXiv:2609.00776v12026AgentFactory: Towards Automated Agentic System Design and Optimization
Enci Zhang, Haofeng Wang, Yuesheng Zhu +2
cs.AIarXiv:2609.01045v12026WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation
Yuwei Niu, Munan Ning, Mengren Zheng +9
cs.CVcs.AIcs.CLarXiv:2503.07265v42025Machine Learning for Wireless Connectivity and Security of Cellular-Connected UAVs
Ursula Challita, Aidin Ferdowsi, Mingzhe Chen +1
cs.ITcs.AIarXiv:1804.05348v32018Scalable Best-of-N Selection for Large Language Models via Self-Certainty
Zhewei Kang, Xuandong Zhao, Dawn Song
cs.CLcs.AIcs.LGarXiv:2502.18581v32025SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution
Yuxiang Wei, Olivier Duchenne, Jade Copet +6
cs.SEcs.AIcs.CLarXiv:2502.18449v22025Instella-MoE Technical Report
Jiang Liu, Sudhanshu Ranjan, Prakamya Mishra +10
cs.CLcs.AIarXiv:2609.00791v12026