Machine Learning

Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,541 to 9,600 of 20,005

  1. Warm Up Cold-start Advertisements: Improving CTR Predictions via Learning to Learn ID Embeddings

    Feiyang Pan, Shuokai Li, Xiang Ao +2

    cs.LGcs.IRstat.MLarXiv:1904.11547v12019
  2. Likelihood Regret: An Out-of-Distribution Detection Score For Variational Auto-encoder

    Zhisheng Xiao, Qing Yan, Yali Amit

    cs.LGcs.CVstat.MLarXiv:2003.02977v32020
  3. Poisoning Attacks to Graph-Based Recommender Systems

    Minghong Fang, Guolei Yang, Neil Zhenqiang Gong +1

    cs.IRcs.CRcs.LGarXiv:1809.04127v12018
  4. Sub-seasonal forecasting with a large ensemble of deep-learning weather prediction models

    Jonathan A. Weyn, Dale R. Durran, Rich Caruana +1

    physics.ao-phcs.LGarXiv:2102.05107v12021
  5. Multi-scale Domain-adversarial Multiple-instance CNN for Cancer Subtype Classification with Unannotated Histopathological Images

    Noriaki Hashimoto, Daisuke Fukushima, Ryoichi Koga +7

    cs.CVcs.LGeess.IVarXiv:2001.01599v22020
  6. Advancing Spiking Neural Networks towards Deep Residual Learning

    Yifan Hu, Lei Deng, Yujie Wu +2

    cs.NEcs.LGarXiv:2112.08954v32021
  7. LAFITE: Towards Language-Free Training for Text-to-Image Generation

    Yufan Zhou, Ruiyi Zhang, Changyou Chen +6

    cs.CVcs.LGarXiv:2111.13792v32021
  8. Tagged Back-Translation

    Isaac Caswell, Ciprian Chelba, David Grangier

    cs.CLcs.LGarXiv:1906.06442v12019
  9. BackdoorBench: A Comprehensive Benchmark of Backdoor Learning

    Baoyuan Wu, Hongrui Chen, Mingda Zhang +4

    cs.LGcs.CRarXiv:2206.12654v22022
  10. Deep Successor Reinforcement Learning

    Tejas D. Kulkarni, Ardavan Saeedi, Simanta Gautam +1

    stat.MLcs.AIcs.LGarXiv:1606.02396v12016
  11. SMELT: Scaling Laws for Compute-Matched MoE Looped Transformers

    Shaowen Wang, Ge Zhang, Kairong Luo +6

    cs.LGarXiv:2609.01343v12026
  12. SemEval-2017 Task 3: Community Question Answering

    Preslav Nakov, Doris Hoogeveen, Lluís Màrquez +4

    cs.CLcs.AIcs.IRarXiv:1912.00730v12019
  13. Scalable Fair Clustering

    Arturs Backurs, Piotr Indyk, Krzysztof Onak +3

    cs.DScs.LGarXiv:1902.03519v22019
  14. Kolmogorov-Arnold Networks are Radial Basis Function Networks

    Ziyao Li

    cs.LGcs.AIarXiv:2405.06721v12024
  15. Dynamic Model Pruning with Feedback

    Tao Lin, Sebastian U. Stich, Luis Barba +2

    cs.LGstat.MLarXiv:2006.07253v12020
  16. Cloze Test Helps: Effective Video Anomaly Detection via Learning to Complete Video Events

    Guang Yu, Siqi Wang, Zhiping Cai +4

    cs.CVcs.LGeess.IVarXiv:2008.11988v12020
  17. Document-level Relation Extraction as Semantic Segmentation

    Ningyu Zhang, Xiang Chen, Xin Xie +6

    cs.CLcs.AIcs.CVarXiv:2106.03618v22021
  18. DICE: Leveraging Sparsification for Out-of-Distribution Detection

    Yiyou Sun, Yixuan Li

    cs.LGarXiv:2111.09805v22021
  19. Convolutional Neural Fabrics

    Shreyas Saxena, Jakob Verbeek

    cs.CVcs.LGcs.NEarXiv:1606.02492v42016
  20. Spectral Methods for Data Science: A Statistical Perspective

    Yuxin Chen, Yuejie Chi, Jianqing Fan +1

    stat.MLcs.ITcs.LGarXiv:2012.08496v22020
  21. Graph Backdoor

    Zhaohan Xi, Ren Pang, Shouling Ji +1

    cs.LGcs.CRstat.MLarXiv:2006.11890v52020
  22. RanPAC: Random Projections and Pre-trained Models for Continual Learning

    Mark D. McDonnell, Dong Gong, Amin Parveneh +2

    cs.LGcs.CVarXiv:2307.02251v32023
  23. Bandits with concave rewards and convex knapsacks

    Shipra Agrawal, Nikhil R. Devanur

    cs.LGarXiv:1402.5758v12014
  24. PointDAN: A Multi-Scale 3D Domain Adaption Network for Point Cloud Representation

    Can Qin, Haoxuan You, Lichen Wang +2

    cs.CVcs.LGarXiv:1911.02744v12019
  25. Bayesian Optimization with Gradients

    Jian Wu, Matthias Poloczek, Andrew Gordon Wilson +1

    stat.MLcs.AIcs.LGarXiv:1703.04389v32017
  26. Adaptive Quantization for Deep Neural Network

    Yiren Zhou, Seyed-Mohsen Moosavi-Dezfooli, Ngai-Man Cheung +1

    cs.LGstat.MLarXiv:1712.01048v12017
  27. Cross-domain Contrastive Learning for Unsupervised Domain Adaptation

    Rui Wang, Zuxuan Wu, Zejia Weng +3

    cs.CVcs.AIcs.LGarXiv:2106.05528v22021
  28. A comparison of LSTM and GRU networks for learning symbolic sequences

    Roberto Cahuantzi, Xinye Chen, Stefan Güttel

    cs.LGcs.NEarXiv:2107.02248v32021
  29. Energy Demand Prediction with Federated Learning for Electric Vehicle Networks

    Yuris Mulya Saputra, Dinh Thai Hoang, Diep N. Nguyen +3

    eess.SPcs.LGarXiv:1909.00907v12019
  30. EM^2Mem: Event-Centric Multimodal Memory for Large Language Models

    Yijun Chen, Yaqi Zheng, Yanya Li +11

    cs.CLcs.AIcs.LGarXiv:2609.00551v12026
  31. Event Representations for Automated Story Generation with Deep Neural Nets

    Lara J. Martin, Prithviraj Ammanabrolu, Xinyu Wang +4

    cs.CLcs.AIcs.LGarXiv:1706.01331v32017
  32. An Embarrassingly Simple Approach for Trojan Attack in Deep Neural Networks

    Ruixiang Tang, Mengnan Du, Ninghao Liu +2

    cs.CRcs.LGarXiv:2006.08131v22020
  33. Open-Ended Learning Leads to Generally Capable Agents

    Open Ended Learning Team, Adam Stooke, Anuj Mahajan +15

    cs.LGcs.AIcs.MAarXiv:2107.12808v22021
  34. General Pitfalls of Model-Agnostic Interpretation Methods for Machine Learning Models

    Christoph Molnar, Gunnar König, Julia Herbinger +6

    stat.MLcs.LGarXiv:2007.04131v22020
  35. Minimax bounds for watermarked and masked recursive discrete distribution estimation

    Millen Kanabar, Michael Gastpar

    cs.ITcs.LGmath.STarXiv:2608.31091v12026
  36. Segmentation of Bovid Dentition Under Imperfect Annotations: A Comparative Study of Convolutional and Attention Models

    Keith G. Mills, Evan B. Sanders, Gregory J. Matthews +1

    cs.CVcs.LGarXiv:2608.31052v12026
  37. Global Context Vision Transformers

    Ali Hatamizadeh, Hongxu Yin, Greg Heinrich +2

    cs.CVcs.AIcs.LGarXiv:2206.09959v52022
  38. Machine Unlearning for Random Forests

    Jonathan Brophy, Daniel Lowd

    cs.LGstat.MLarXiv:2009.05567v22020
  39. MCP: Learning Composable Hierarchical Control with Multiplicative Compositional Policies

    Xue Bin Peng, Michael Chang, Grace Zhang +2

    cs.LGstat.MLarXiv:1905.09808v12019
  40. Implementing neural network mixed-effects models in Template Model Builder (TMB)

    Nan Zheng, Hoi Yiu Cheung, Vibhu Sharma +2

    stat.MLcs.LGarXiv:2608.31133v12026
  41. "Train classical, deploy quantum" requires rethinking generalization

    Snehal Raj, Natansh Mathur, Alejandro Perdomo-Ortiz

    quant-phcs.LGarXiv:2608.31117v12026
  42. Deep Learning for Insider Threat Detection: Review, Challenges and Opportunities

    Shuhan Yuan, Xintao Wu

    cs.CRcs.LGarXiv:2005.12433v12020
  43. LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware Engineering

    Gopi Krishnan Rajbahadur, Amir M. Ebrahimi, Boyuan Chen +1

    cs.SEcs.AIcs.LGarXiv:2608.31102v12026
  44. One Adapter, Many Tasks: Task-Conditioned Feature Transformations for Continual Learning

    Yunxiang Fu, Meng Lou, Yizhou Yu

    cs.CVcs.LGarXiv:2608.31096v12026
  45. Making Risk Minimization Tolerant to Label Noise

    Aritra Ghosh, Naresh Manwani, P. S. Sastry

    cs.LGarXiv:1403.3610v22014
  46. PhishDef: URL Names Say It All

    Anh Le, Athina Markopoulou, Michalis Faloutsos

    cs.CRcs.LGcs.NIarXiv:1009.2275v12010
  47. An Intersectional Definition of Fairness

    James Foulds, Rashidul Islam, Kamrun Naher Keya +1

    cs.LGcs.CYstat.MLarXiv:1807.08362v32018
  48. Deep Bayesian Active Learning for Natural Language Processing: Results of a Large-Scale Empirical Study

    Aditya Siddhant, Zachary C. Lipton

    cs.CLcs.LGstat.MLarXiv:1808.05697v32018
  49. WaveFake: A Data Set to Facilitate Audio Deepfake Detection

    Joel Frank, Lea Schönherr

    cs.LGcs.CRcs.SDarXiv:2111.02813v12021
  50. Cost-Efficient Large Language Model Serving for Multi-turn Conversations with CachedAttention

    Bin Gao, Zhuomin He, Puru Sharma +6

    cs.CLcs.LGarXiv:2403.19708v32024
  51. On the Importance of Noise Scheduling for Diffusion Models

    Ting Chen

    cs.CVcs.GRcs.LGarXiv:2301.10972v42023
  52. Driving on Memory

    Christian Löwens, Thorben Funke, Alexandru Paul Condurache

    cs.CVcs.LGcs.ROarXiv:2608.31029v12026
  53. Over-the-Air Federated Learning from Heterogeneous Data

    Tomer Sery, Nir Shlezinger, Kobi Cohen +1

    cs.LGcs.ITstat.MLarXiv:2009.12787v22020
  54. Fit without fear: remarkable mathematical phenomena of deep learning through the prism of interpolation

    Mikhail Belkin

    stat.MLcs.LGmath.STarXiv:2105.14368v12021
  55. Zero-Shot Out-of-Distribution Detection Based on the Pre-trained Model CLIP

    Sepideh Esmaeilpour, Bing Liu, Eric Robertson +1

    cs.CVcs.LGarXiv:2109.02748v32021
  56. Outlier Suppression: Pushing the Limit of Low-bit Transformer Language Models

    Xiuying Wei, Yunchen Zhang, Xiangguo Zhang +5

    cs.LGarXiv:2209.13325v32022
  57. Uncertainty Weighted Actor-Critic for Offline Reinforcement Learning

    Yue Wu, Shuangfei Zhai, Nitish Srivastava +4

    cs.LGarXiv:2105.08140v12021
  58. Safety Screening for Voltage Control in Active Distribution Grids via Distributionally Robust Conformal Screening

    Sarra Bouchkati, Petros Ellinas, Adriana Geisler +4

    eess.SYcs.AIcs.LGarXiv:2608.30889v12026
  59. CoJEPA: Combining Contrastive Learning and JEPA for Global-Local Music Representations

    Gabriel Meseguer-Brocal, Yuexuan Kong, Romain Hennequin

    cs.SDcs.AIcs.LGarXiv:2608.30974v12026
  60. Learning JPEG Compression Artifacts for Image Manipulation Detection and Localization

    Myung-Joon Kwon, Seung-Hun Nam, In-Jae Yu +2

    eess.IVcs.CVcs.LGarXiv:2108.12947v22021