Machine Learning

Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

9,421 to 9,480 of 20,192

  1. Bitwise Neural Networks

    Minje Kim, Paris Smaragdis

    cs.LGcs.AIcs.NEarXiv:1601.06071v12016
  2. Does Writing with Language Models Reduce Content Diversity?

    Vishakh Padmakumar, He He

    cs.CLcs.CYcs.HCarXiv:2309.05196v32023
  3. SOFT: Softmax-free Transformer with Linear Complexity

    Jiachen Lu, Jinghan Yao, Junge Zhang +6

    cs.CVcs.AIcs.LGarXiv:2110.11945v32021
  4. Criteria for Classifying Forecasting Methods

    Tim Januschowski, Jan Gasthaus, Yuyang Wang +4

    stat.MLcs.LGarXiv:2212.03523v12022
  5. Implicit Deep Learning

    Laurent El Ghaoui, Fangda Gu, Bertrand Travacca +2

    cs.LGmath.OCstat.MLarXiv:1908.06315v42019
  6. Safe Policy Improvement with Baseline Bootstrapping

    Romain Laroche, Paul Trichelair, Rémi Tachet des Combes

    cs.LGcs.AIstat.MLarXiv:1712.06924v52017
  7. SlowMo: Improving Communication-Efficient Distributed SGD with Slow Momentum

    Jianyu Wang, Vinayak Tantia, Nicolas Ballas +1

    cs.LGcs.DCmath.OCarXiv:1910.00643v22019
  8. The Surprising Effectiveness of Representation Learning for Visual Imitation

    Jyothish Pari, Nur Muhammad Shafiullah, Sridhar Pandian Arunachalam +1

    cs.ROcs.AIcs.CVarXiv:2112.01511v22021
  9. Defensive Quantization: When Efficiency Meets Robustness

    Ji Lin, Chuang Gan, Song Han

    cs.LGcs.CVstat.MLarXiv:1904.08444v12019
  10. Stochastic Normalizing Flows

    Hao Wu, Jonas Köhler, Frank Noé

    stat.MLcs.LGphysics.chem-pharXiv:2002.06707v32020
  11. Collaborative Fairness in Federated Learning

    Lingjuan Lyu, Xinyi Xu, Qian Wang

    cs.LGcs.DCstat.MLarXiv:2008.12161v22020
  12. Learning Optimal Solutions for Extremely Fast AC Optimal Power Flow

    Ahmed Zamzam, Kyri Baker

    cs.LGeess.SPeess.SYarXiv:1910.01213v12019
  13. CRFL: Certifiably Robust Federated Learning against Backdoor Attacks

    Chulin Xie, Minghao Chen, Pin-Yu Chen +1

    cs.LGarXiv:2106.08283v12021
  14. Prompting Large Language Models with Speech Recognition Abilities

    Yassir Fathullah, Chunyang Wu, Egor Lakomkin +9

    eess.AScs.AIcs.CLarXiv:2307.11795v12023
  15. Reading Between the Lines: Modeling User Behavior and Costs in AI-Assisted Programming

    Hussein Mozannar, Gagan Bansal, Adam Fourney +1

    cs.SEcs.HCcs.LGarXiv:2210.14306v52022
  16. XNOR-Net++: Improved Binary Neural Networks

    Adrian Bulat, Georgios Tzimiropoulos

    cs.CVcs.LGeess.IVarXiv:1909.13863v12019
  17. Communication Complexity of Distributed Convex Learning and Optimization

    Yossi Arjevani, Ohad Shamir

    cs.LGmath.OCstat.MLarXiv:1506.01900v22015
  18. Fast Distributed Inference Serving for Large Language Models

    Bingyang Wu, Yinmin Zhong, Zili Zhang +6

    cs.LGcs.DCarXiv:2305.05920v32023
  19. LargeST: A Benchmark Dataset for Large-Scale Traffic Forecasting

    Xu Liu, Yutong Xia, Yuxuan Liang +7

    cs.LGarXiv:2306.08259v22023
  20. Learning to Walk in the Real World with Minimal Human Effort

    Sehoon Ha, Peng Xu, Zhenyu Tan +2

    cs.ROcs.AIcs.LGarXiv:2002.08550v32020
  21. On the Quantitative Analysis of Decoder-Based Generative Models

    Yuhuai Wu, Yuri Burda, Ruslan Salakhutdinov +1

    cs.LGarXiv:1611.04273v22016
  22. APQ: Joint Search for Network Architecture, Pruning and Quantization Policy

    Tianzhe Wang, Kuan Wang, Han Cai +3

    cs.LGcs.CVstat.MLarXiv:2006.08509v12020
  23. Leveraging Grammar and Reinforcement Learning for Neural Program Synthesis

    Rudy Bunel, Matthew Hausknecht, Jacob Devlin +2

    cs.LGstat.MLarXiv:1805.04276v22018
  24. SciReC: Diagnostic Evaluation of Multimodal, Multi-Turn Relational Reasoning with Adaptive Interaction

    Nilay Yilmaz, Naga Sai Abhiram Kusumba, Stella Wenxing Liu +1

    cs.CLcs.AIcs.LGarXiv:2608.27461v12026
  25. Self-supervised Learning for Human Activity Recognition Using 700,000 Person-days of Wearable Data

    Hang Yuan, Shing Chan, Andrew P. Creagh +4

    eess.SPcs.AIcs.LGarXiv:2206.02909v32022
  26. Talk like a Graph: Encoding Graphs for Large Language Models

    Bahare Fatemi, Jonathan Halcrow, Bryan Perozzi

    cs.LGarXiv:2310.04560v12023
  27. Temporal Attention augmented Bilinear Network for Financial Time-Series Data Analysis

    Dat Thanh Tran, Alexandros Iosifidis, Juho Kanniainen +1

    cs.CEcs.LGq-fin.CParXiv:1712.00975v12017
  28. Training Sparse Neural Networks

    Suraj Srinivas, Akshayvarun Subramanya, R. Venkatesh Babu

    cs.CVcs.LGarXiv:1611.06694v12016
  29. Towards Realistic Individual Recourse and Actionable Explanations in Black-Box Decision Making Systems

    Shalmali Joshi, Oluwasanmi Koyejo, Warut Vijitbenjaronk +2

    cs.LGstat.MLarXiv:1907.09615v12019
  30. Compositional Explanations of Neurons

    Jesse Mu, Jacob Andreas

    cs.LGcs.AIcs.CLarXiv:2006.14032v22020
  31. Sticking the Landing: Simple, Lower-Variance Gradient Estimators for Variational Inference

    Geoffrey Roeder, Yuhuai Wu, David Duvenaud

    stat.MLcs.LGarXiv:1703.09194v32017
  32. Convergence Rate of Frank-Wolfe for Non-Convex Objectives

    Simon Lacoste-Julien

    math.OCcs.LGmath.NAarXiv:1607.00345v12016
  33. Benchmarking the Spectrum of Agent Capabilities

    Danijar Hafner

    cs.AIcs.LGarXiv:2109.06780v22021
  34. Adversarial Example Does Good: Preventing Painting Imitation from Diffusion Models via Adversarial Examples

    Chumeng Liang, Xiaoyu Wu, Yang Hua +6

    cs.CVcs.AIcs.CRarXiv:2302.04578v22023
  35. Generative Adversarial Network for Medical Images (MI-GAN)

    Talha Iqbal, Hazrat Ali

    cs.LGcs.CVeess.IVarXiv:1810.00551v12018
  36. A Kernel Theory of Modern Data Augmentation

    Tri Dao, Albert Gu, Alexander J. Ratner +3

    cs.LGstat.MLarXiv:1803.06084v22018
  37. Wasserstein Adversarial Examples via Projected Sinkhorn Iterations

    Eric Wong, Frank R. Schmidt, J. Zico Kolter

    cs.LGstat.MLarXiv:1902.07906v22019
  38. Sequence Tutor: Conservative Fine-Tuning of Sequence Generation Models with KL-control

    Natasha Jaques, Shixiang Gu, Dzmitry Bahdanau +3

    cs.LGcs.AIarXiv:1611.02796v92016
  39. An Experimental Analysis of Attack Classification Using Machine Learning in IoT Networks

    Andrew Churcher, Rehmat Ullah, Jawad Ahmad +6

    cs.CRcs.LGarXiv:2101.12270v12021
  40. Benchmarking Keyword Spotting Efficiency on Neuromorphic Hardware

    Peter Blouw, Xuan Choo, Eric Hunsberger +1

    cs.LGstat.MLarXiv:1812.01739v22018
  41. Ternary Neural Networks for Resource-Efficient AI Applications

    Hande Alemdar, Vincent Leroy, Adrien Prost-Boucle +1

    cs.LGcs.AIcs.NEarXiv:1609.00222v22016
  42. MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages

    Jack FitzGerald, Christopher Hench, Charith Peris +13

    cs.CLcs.AIcs.LGarXiv:2204.08582v22022
  43. NetLLM: Adapting Large Language Models for Networking

    Duo Wu, Xianda Wang, Yaqi Qiao +4

    cs.NIcs.LGarXiv:2402.02338v32024
  44. Understanding the Origins of Bias in Word Embeddings

    Marc-Etienne Brunet, Colleen Alkalay-Houlihan, Ashton Anderson +1

    cs.LGcs.CYstat.MLarXiv:1810.03611v22018
  45. Barnes-Hut-SNE

    Laurens van der Maaten

    cs.LGcs.CVstat.MLarXiv:1301.3342v22013
  46. Robust Imitation of Diverse Behaviors

    Ziyu Wang, Josh Merel, Scott Reed +3

    cs.LGarXiv:1707.02747v22017
  47. Denoising Criterion for Variational Auto-Encoding Framework

    Daniel Jiwoong Im, Sungjin Ahn, Roland Memisevic +1

    cs.LGarXiv:1511.06406v22015
  48. Generalization and Regularization in DQN

    Jesse Farebrother, Marlos C. Machado, Michael Bowling

    cs.LGcs.AIstat.MLarXiv:1810.00123v32018
  49. Boosting Few-Shot Learning With Adaptive Margin Loss

    Aoxue Li, Weiran Huang, Xu Lan +3

    cs.CVcs.LGstat.MLarXiv:2005.13826v12020
  50. Robust Online Hamiltonian Learning

    Christopher E. Granade, Christopher Ferrie, Nathan Wiebe +1

    quant-phcs.LGarXiv:1207.1655v22012
  51. Learning Symmetric and Low-energy Locomotion

    Wenhao Yu, Greg Turk, C. Karen Liu

    cs.LGcs.GRcs.ROarXiv:1801.08093v32018
  52. From Parity to Preference-based Notions of Fairness in Classification

    Muhammad Bilal Zafar, Isabel Valera, Manuel Gomez Rodriguez +2

    stat.MLcs.LGarXiv:1707.00010v22017
  53. Generative Adversarial User Model for Reinforcement Learning Based Recommendation System

    Xinshi Chen, Shuang Li, Hui Li +3

    cs.LGcs.IRstat.MLarXiv:1812.10613v32018
  54. Generative Adversarial Minority Oversampling

    Sankha Subhra Mullick, Shounak Datta, Swagatam Das

    cs.CVcs.LGarXiv:1903.09730v32019
  55. ALICE: Towards Understanding Adversarial Learning for Joint Distribution Matching

    Chunyuan Li, Hao Liu, Changyou Chen +4

    stat.MLcs.AIcs.CVarXiv:1709.01215v22017
  56. Generative Causal Explanations for Graph Neural Networks

    Wanyu Lin, Hao Lan, Baochun Li

    cs.LGarXiv:2104.06643v22021
  57. Model Agnostic Supervised Local Explanations

    Gregory Plumb, Denali Molitor, Ameet Talwalkar

    cs.LGstat.MLarXiv:1807.02910v32018
  58. A Neural Autoregressive Approach to Collaborative Filtering

    Yin Zheng, Bangsheng Tang, Wenkui Ding +1

    cs.IRcs.LGstat.MLarXiv:1605.09477v12016
  59. Multi-Task Cross-Lingual Sequence Tagging from Scratch

    Zhilin Yang, Ruslan Salakhutdinov, William Cohen

    cs.CLcs.LGarXiv:1603.06270v22016
  60. CANet: An Unsupervised Intrusion Detection System for High Dimensional CAN Bus Data

    Markus Hanselmann, Thilo Strauss, Katharina Dormann +1

    cs.CRcs.LGeess.SParXiv:1906.02492v12019