Machine Learning

Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

13,921 to 13,980 of 20,192

  1. Visual Classification via Description from Large Language Models

    Sachit Menon, Carl Vondrick

    cs.CVcs.LGarXiv:2210.07183v22022
  2. Local Differential Privacy based Federated Learning for Internet of Things

    Yang Zhao, Jun Zhao, Mengmeng Yang +5

    cs.CRcs.LGarXiv:2004.08856v22020
  3. Predicting Station-level Hourly Demands in a Large-scale Bike-sharing Network: A Graph Convolutional Neural Network Approach

    Lei Lin, Zhengbing He, Srinivas Peeta

    stat.MLcs.LGarXiv:1712.04997v22017
  4. Arrive and Survive: Scaling Safe Goal-Conditioned Policy Learning from One-Bit Failure Signals

    Guopeng Li, Yiyang Duan, Yiru Jiao +1

    cs.LGcs.ROarXiv:2608.26571v12026
  5. Making Latent Evolution Explicit: Operator-Structured Transitions for World Action Models

    Xiaoxiao Lu, Yunlong Dong, Jiahao Shi +1

    cs.LGarXiv:2608.27259v12026
  6. Spectral Norm Regularization for Improving the Generalizability of Deep Learning

    Yuichi Yoshida, Takeru Miyato

    stat.MLcs.LGarXiv:1705.10941v12017
  7. Word Representations via Gaussian Embedding

    Luke Vilnis, Andrew McCallum

    cs.CLcs.LGarXiv:1412.6623v42014
  8. Exponentially Weighted Moving Average Charts for Detecting Concept Drift

    Gordon J. Ross, Niall M. Adams, Dimitris K. Tasoulis +1

    stat.MLcs.LGstat.AParXiv:1212.6018v12012
  9. Optimal Brain Compression: A Framework for Accurate Post-Training Quantization and Pruning

    Elias Frantar, Sidak Pal Singh, Dan Alistarh

    cs.LGarXiv:2208.11580v22022
  10. PEBBLE: Feedback-Efficient Interactive Reinforcement Learning via Relabeling Experience and Unsupervised Pre-training

    Kimin Lee, Laura Smith, Pieter Abbeel

    cs.LGcs.AIarXiv:2106.05091v12021
  11. Experience-driven Networking: A Deep Reinforcement Learning based Approach

    Zhiyuan Xu, Jian Tang, Jingsong Meng +4

    cs.NIcs.AIcs.LGarXiv:1801.05757v12018
  12. Deep Variational Bayes Filters: Unsupervised Learning of State Space Models from Raw Data

    Maximilian Karl, Maximilian Soelch, Justin Bayer +1

    stat.MLcs.LGeess.SYarXiv:1605.06432v32016
  13. A Survey of Deep Meta-Learning

    Mike Huisman, Jan N. van Rijn, Aske Plaat

    cs.LGcs.AIstat.MLarXiv:2010.03522v22020
  14. RMP-SNN: Residual Membrane Potential Neuron for Enabling Deeper High-Accuracy and Low-Latency Spiking Neural Network

    Bing Han, Gopalakrishnan Srinivasan, Kaushik Roy

    cs.NEcs.CVcs.LGarXiv:2003.01811v22020
  15. Uncertainty-Based Offline Reinforcement Learning with Diversified Q-Ensemble

    Gaon An, Seungyong Moon, Jang-Hyun Kim +1

    cs.LGcs.AIarXiv:2110.01548v22021
  16. Hyperbolic Image Embeddings

    Valentin Khrulkov, Leyla Mirvakhabova, Evgeniya Ustinova +2

    cs.CVcs.LGarXiv:1904.02239v22019
  17. High Dimensional Bayesian Optimisation and Bandits via Additive Models

    Kirthevasan Kandasamy, Jeff Schneider, Barnabas Poczos

    stat.MLcs.LGarXiv:1503.01673v32015
  18. Learnable latent embeddings for joint behavioral and neural analysis

    Steffen Schneider, Jin Hwa Lee, Mackenzie Weygandt Mathis

    cs.LGq-bio.NCq-bio.QMarXiv:2204.00673v22022
  19. InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image Generation

    Xingchao Liu, Xiwen Zhang, Jianzhu Ma +2

    cs.LGcs.CVarXiv:2309.06380v22023
  20. Mitigating Neural Network Overconfidence with Logit Normalization

    Hongxin Wei, Renchunzi Xie, Hao Cheng +3

    cs.LGarXiv:2205.09310v22022
  21. Identity Matters in Deep Learning

    Moritz Hardt, Tengyu Ma

    cs.LGcs.NEstat.MLarXiv:1611.04231v32016
  22. MimicGen: A Data Generation System for Scalable Robot Learning using Human Demonstrations

    Ajay Mandlekar, Soroush Nasiriany, Bowen Wen +5

    cs.ROcs.AIcs.CVarXiv:2310.17596v12023
  23. Beyond Parity: Fairness Objectives for Collaborative Filtering

    Sirui Yao, Bert Huang

    cs.IRcs.AIcs.LGarXiv:1705.08804v22017
  24. Preserving Statistical Validity in Adaptive Data Analysis

    Cynthia Dwork, Vitaly Feldman, Moritz Hardt +3

    cs.LGcs.DSarXiv:1411.2664v32014
  25. DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models

    Yung-Sung Chuang, Yujia Xie, Hongyin Luo +3

    cs.CLcs.AIcs.LGarXiv:2309.03883v22023
  26. What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning

    Wei Liu, Weihao Zeng, Keqing He +2

    cs.CLcs.AIcs.LGarXiv:2312.15685v22023
  27. Programmatically Interpretable Reinforcement Learning

    Abhinav Verma, Vijayaraghavan Murali, Rishabh Singh +2

    cs.LGcs.AIcs.PLarXiv:1804.02477v32018
  28. The Contextual Loss for Image Transformation with Non-Aligned Data

    Roey Mechrez, Itamar Talmi, Lihi Zelnik-Manor

    cs.CVcs.LGarXiv:1803.02077v42018
  29. Decoupled Neural Interfaces using Synthetic Gradients

    Max Jaderberg, Wojciech Marian Czarnecki, Simon Osindero +4

    cs.LGarXiv:1608.05343v22016
  30. Computing a Nonnegative Matrix Factorization -- Provably

    Sanjeev Arora, Rong Ge, Ravi Kannan +1

    cs.DScs.LGarXiv:1111.0952v12011
  31. BANANAS: Bayesian Optimization with Neural Architectures for Neural Architecture Search

    Colin White, Willie Neiswanger, Yash Savani

    cs.LGcs.NEstat.MLarXiv:1910.11858v32019
  32. Neural Lyapunov Control

    Ya-Chien Chang, Nima Roohi, Sicun Gao

    cs.LGcs.NEcs.ROarXiv:2005.00611v42020
  33. Bridging short- and medium-range weather forecasting with machine learning

    Timothy A. Smith, Mariah Pope, Sergey Frolov +4

    physics.ao-phcs.LGarXiv:2608.26822v12026
  34. Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models

    Samuel Marks, Can Rager, Eric J. Michaud +3

    cs.LGcs.AIcs.CLarXiv:2403.19647v32024
  35. Self-Supervised Representation Learning: Introduction, Advances and Challenges

    Linus Ericsson, Henry Gouk, Chen Change Loy +1

    cs.LGcs.CVstat.MLarXiv:2110.09327v12021
  36. Highly Scalable Deep Learning Training System with Mixed-Precision: Training ImageNet in Four Minutes

    Xianyan Jia, Shutao Song, Wei He +11

    cs.LGcs.DCstat.MLarXiv:1807.11205v12018
  37. MultiMAE: Multi-modal Multi-task Masked Autoencoders

    Roman Bachmann, David Mizrahi, Andrei Atanov +1

    cs.CVcs.LGarXiv:2204.01678v12022
  38. PromptSource: An Integrated Development Environment and Repository for Natural Language Prompts

    Stephen H. Bach, Victor Sanh, Zheng-Xin Yong +24

    cs.LGcs.CLarXiv:2202.01279v32022
  39. Real-World Humanoid Locomotion with Reinforcement Learning

    Ilija Radosavovic, Tete Xiao, Bike Zhang +3

    cs.ROcs.LGarXiv:2303.03381v22023
  40. Heterogeneous Graph Neural Networks for Malicious Account Detection

    Ziqi Liu, Chaochao Chen, Xinxing Yang +3

    cs.LGcs.CRstat.MLarXiv:2002.12307v12020
  41. CURE: Code-Aware Neural Machine Translation for Automatic Program Repair

    Nan Jiang, Thibaud Lutellier, Lin Tan

    cs.SEcs.AIcs.LGarXiv:2103.00073v42021
  42. Adversarial Neuron Pruning Purifies Backdoored Deep Models

    Dongxian Wu, Yisen Wang

    cs.LGcs.CRcs.CVarXiv:2110.14430v12021
  43. DRUM: End-To-End Differentiable Rule Mining On Knowledge Graphs

    Ali Sadeghian, Mohammadreza Armandpour, Patrick Ding +1

    cs.LGcs.LOstat.MLarXiv:1911.00055v12019
  44. You Only Look at One Sequence: Rethinking Transformer in Vision through Object Detection

    Yuxin Fang, Bencheng Liao, Xinggang Wang +5

    cs.CVcs.AIcs.LGarXiv:2106.00666v32021
  45. MetricGAN: Generative Adversarial Networks based Black-box Metric Scores Optimization for Speech Enhancement

    Szu-Wei Fu, Chien-Feng Liao, Yu Tsao +1

    cs.SDcs.LGeess.ASarXiv:1905.04874v12019
  46. StarGAN-VC: Non-parallel many-to-many voice conversion with star generative adversarial networks

    Hirokazu Kameoka, Takuhiro Kaneko, Kou Tanaka +1

    cs.SDcs.LGeess.ASarXiv:1806.02169v22018
  47. A Reliable Effective Terascale Linear Learning System

    Alekh Agarwal, Olivier Chapelle, Miroslav Dudik +1

    cs.LGstat.MLarXiv:1110.4198v32011
  48. Analytic-DPM: an Analytic Estimate of the Optimal Reverse Variance in Diffusion Probabilistic Models

    Fan Bao, Chongxuan Li, Jun Zhu +1

    cs.LGarXiv:2201.06503v32022
  49. Descent-to-Delete: Gradient-Based Methods for Machine Unlearning

    Seth Neel, Aaron Roth, Saeed Sharifi-Malvajerdi

    stat.MLcs.LGarXiv:2007.02923v12020
  50. How Language Models Organize and Structure Moral Knowledge

    Orion Reblitz-Richardson

    cs.CLcs.AIcs.LGarXiv:2608.27402v12026
  51. Anomaly Detection using One-Class Neural Networks

    Raghavendra Chalapathy, Aditya Krishna Menon, Sanjay Chawla

    cs.LGcs.NEstat.MLarXiv:1802.06360v22018
  52. Learning a Continuous Sepsis Severity Score Without Hour-by-Hour Supervision: A Two-Site Retrospective Study

    Kevin Zhu, Ryan Zhang, Baraa Abed +18

    cs.AIcs.LGarXiv:2608.27421v12026
  53. Interpretability of machine learning based prediction models in healthcare

    Gregor Stiglic, Primoz Kocbek, Nino Fijacko +3

    cs.LGstat.MLarXiv:2002.08596v22020
  54. Entity-Based Knowledge Conflicts in Question Answering

    Shayne Longpre, Kartik Perisetla, Anthony Chen +3

    cs.CLcs.LGarXiv:2109.05052v22021
  55. High-Quality Self-Supervised Deep Image Denoising

    Samuli Laine, Tero Karras, Jaakko Lehtinen +1

    cs.LGcs.CVcs.NEarXiv:1901.10277v32019
  56. Deduplicating Training Data Mitigates Privacy Risks in Language Models

    Nikhil Kandpal, Eric Wallace, Colin Raffel

    cs.CRcs.CLcs.LGarXiv:2202.06539v32022
  57. IntentNet: Learning to Predict Intention from Raw Sensor Data

    Sergio Casas, Wenjie Luo, Raquel Urtasun

    cs.ROcs.AIcs.CVarXiv:2101.07907v12021
  58. Graph Clustering with Graph Neural Networks

    Anton Tsitsulin, John Palowitch, Bryan Perozzi +1

    cs.LGcs.SIstat.MLarXiv:2006.16904v32020
  59. Delving into Deep Imbalanced Regression

    Yuzhe Yang, Kaiwen Zha, Ying-Cong Chen +2

    cs.LGcs.AIcs.CVarXiv:2102.09554v22021
  60. Character-Level Language Modeling with Deeper Self-Attention

    Rami Al-Rfou, Dokook Choe, Noah Constant +2

    cs.CLcs.AIcs.LGarXiv:1808.04444v22018