Machine Learning
Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
13,921 to 13,980 of 20,192
Visual Classification via Description from Large Language Models
Sachit Menon, Carl Vondrick
cs.CVcs.LGarXiv:2210.07183v22022Local Differential Privacy based Federated Learning for Internet of Things
Yang Zhao, Jun Zhao, Mengmeng Yang +5
cs.CRcs.LGarXiv:2004.08856v22020Predicting Station-level Hourly Demands in a Large-scale Bike-sharing Network: A Graph Convolutional Neural Network Approach
Lei Lin, Zhengbing He, Srinivas Peeta
stat.MLcs.LGarXiv:1712.04997v22017Arrive and Survive: Scaling Safe Goal-Conditioned Policy Learning from One-Bit Failure Signals
Guopeng Li, Yiyang Duan, Yiru Jiao +1
cs.LGcs.ROarXiv:2608.26571v12026Making Latent Evolution Explicit: Operator-Structured Transitions for World Action Models
Xiaoxiao Lu, Yunlong Dong, Jiahao Shi +1
cs.LGarXiv:2608.27259v12026Spectral Norm Regularization for Improving the Generalizability of Deep Learning
Yuichi Yoshida, Takeru Miyato
stat.MLcs.LGarXiv:1705.10941v12017Word Representations via Gaussian Embedding
Luke Vilnis, Andrew McCallum
cs.CLcs.LGarXiv:1412.6623v42014Exponentially Weighted Moving Average Charts for Detecting Concept Drift
Gordon J. Ross, Niall M. Adams, Dimitris K. Tasoulis +1
stat.MLcs.LGstat.AParXiv:1212.6018v12012Optimal Brain Compression: A Framework for Accurate Post-Training Quantization and Pruning
Elias Frantar, Sidak Pal Singh, Dan Alistarh
cs.LGarXiv:2208.11580v22022PEBBLE: Feedback-Efficient Interactive Reinforcement Learning via Relabeling Experience and Unsupervised Pre-training
Kimin Lee, Laura Smith, Pieter Abbeel
cs.LGcs.AIarXiv:2106.05091v12021Experience-driven Networking: A Deep Reinforcement Learning based Approach
Zhiyuan Xu, Jian Tang, Jingsong Meng +4
cs.NIcs.AIcs.LGarXiv:1801.05757v12018Deep Variational Bayes Filters: Unsupervised Learning of State Space Models from Raw Data
Maximilian Karl, Maximilian Soelch, Justin Bayer +1
stat.MLcs.LGeess.SYarXiv:1605.06432v32016A Survey of Deep Meta-Learning
Mike Huisman, Jan N. van Rijn, Aske Plaat
cs.LGcs.AIstat.MLarXiv:2010.03522v22020RMP-SNN: Residual Membrane Potential Neuron for Enabling Deeper High-Accuracy and Low-Latency Spiking Neural Network
Bing Han, Gopalakrishnan Srinivasan, Kaushik Roy
cs.NEcs.CVcs.LGarXiv:2003.01811v22020Uncertainty-Based Offline Reinforcement Learning with Diversified Q-Ensemble
Gaon An, Seungyong Moon, Jang-Hyun Kim +1
cs.LGcs.AIarXiv:2110.01548v22021Hyperbolic Image Embeddings
Valentin Khrulkov, Leyla Mirvakhabova, Evgeniya Ustinova +2
cs.CVcs.LGarXiv:1904.02239v22019High Dimensional Bayesian Optimisation and Bandits via Additive Models
Kirthevasan Kandasamy, Jeff Schneider, Barnabas Poczos
stat.MLcs.LGarXiv:1503.01673v32015Learnable latent embeddings for joint behavioral and neural analysis
Steffen Schneider, Jin Hwa Lee, Mackenzie Weygandt Mathis
cs.LGq-bio.NCq-bio.QMarXiv:2204.00673v22022InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image Generation
Xingchao Liu, Xiwen Zhang, Jianzhu Ma +2
cs.LGcs.CVarXiv:2309.06380v22023Mitigating Neural Network Overconfidence with Logit Normalization
Hongxin Wei, Renchunzi Xie, Hao Cheng +3
cs.LGarXiv:2205.09310v22022Identity Matters in Deep Learning
Moritz Hardt, Tengyu Ma
cs.LGcs.NEstat.MLarXiv:1611.04231v32016MimicGen: A Data Generation System for Scalable Robot Learning using Human Demonstrations
Ajay Mandlekar, Soroush Nasiriany, Bowen Wen +5
cs.ROcs.AIcs.CVarXiv:2310.17596v12023Beyond Parity: Fairness Objectives for Collaborative Filtering
Sirui Yao, Bert Huang
cs.IRcs.AIcs.LGarXiv:1705.08804v22017Preserving Statistical Validity in Adaptive Data Analysis
Cynthia Dwork, Vitaly Feldman, Moritz Hardt +3
cs.LGcs.DSarXiv:1411.2664v32014DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
Yung-Sung Chuang, Yujia Xie, Hongyin Luo +3
cs.CLcs.AIcs.LGarXiv:2309.03883v22023What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
Wei Liu, Weihao Zeng, Keqing He +2
cs.CLcs.AIcs.LGarXiv:2312.15685v22023Programmatically Interpretable Reinforcement Learning
Abhinav Verma, Vijayaraghavan Murali, Rishabh Singh +2
cs.LGcs.AIcs.PLarXiv:1804.02477v32018The Contextual Loss for Image Transformation with Non-Aligned Data
Roey Mechrez, Itamar Talmi, Lihi Zelnik-Manor
cs.CVcs.LGarXiv:1803.02077v42018Decoupled Neural Interfaces using Synthetic Gradients
Max Jaderberg, Wojciech Marian Czarnecki, Simon Osindero +4
cs.LGarXiv:1608.05343v22016Computing a Nonnegative Matrix Factorization -- Provably
Sanjeev Arora, Rong Ge, Ravi Kannan +1
cs.DScs.LGarXiv:1111.0952v12011BANANAS: Bayesian Optimization with Neural Architectures for Neural Architecture Search
Colin White, Willie Neiswanger, Yash Savani
cs.LGcs.NEstat.MLarXiv:1910.11858v32019Neural Lyapunov Control
Ya-Chien Chang, Nima Roohi, Sicun Gao
cs.LGcs.NEcs.ROarXiv:2005.00611v42020Bridging short- and medium-range weather forecasting with machine learning
Timothy A. Smith, Mariah Pope, Sergey Frolov +4
physics.ao-phcs.LGarXiv:2608.26822v12026Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models
Samuel Marks, Can Rager, Eric J. Michaud +3
cs.LGcs.AIcs.CLarXiv:2403.19647v32024Self-Supervised Representation Learning: Introduction, Advances and Challenges
Linus Ericsson, Henry Gouk, Chen Change Loy +1
cs.LGcs.CVstat.MLarXiv:2110.09327v12021Highly Scalable Deep Learning Training System with Mixed-Precision: Training ImageNet in Four Minutes
Xianyan Jia, Shutao Song, Wei He +11
cs.LGcs.DCstat.MLarXiv:1807.11205v12018MultiMAE: Multi-modal Multi-task Masked Autoencoders
Roman Bachmann, David Mizrahi, Andrei Atanov +1
cs.CVcs.LGarXiv:2204.01678v12022PromptSource: An Integrated Development Environment and Repository for Natural Language Prompts
Stephen H. Bach, Victor Sanh, Zheng-Xin Yong +24
cs.LGcs.CLarXiv:2202.01279v32022Real-World Humanoid Locomotion with Reinforcement Learning
Ilija Radosavovic, Tete Xiao, Bike Zhang +3
cs.ROcs.LGarXiv:2303.03381v22023Heterogeneous Graph Neural Networks for Malicious Account Detection
Ziqi Liu, Chaochao Chen, Xinxing Yang +3
cs.LGcs.CRstat.MLarXiv:2002.12307v12020CURE: Code-Aware Neural Machine Translation for Automatic Program Repair
Nan Jiang, Thibaud Lutellier, Lin Tan
cs.SEcs.AIcs.LGarXiv:2103.00073v42021Adversarial Neuron Pruning Purifies Backdoored Deep Models
Dongxian Wu, Yisen Wang
cs.LGcs.CRcs.CVarXiv:2110.14430v12021DRUM: End-To-End Differentiable Rule Mining On Knowledge Graphs
Ali Sadeghian, Mohammadreza Armandpour, Patrick Ding +1
cs.LGcs.LOstat.MLarXiv:1911.00055v12019You Only Look at One Sequence: Rethinking Transformer in Vision through Object Detection
Yuxin Fang, Bencheng Liao, Xinggang Wang +5
cs.CVcs.AIcs.LGarXiv:2106.00666v32021MetricGAN: Generative Adversarial Networks based Black-box Metric Scores Optimization for Speech Enhancement
Szu-Wei Fu, Chien-Feng Liao, Yu Tsao +1
cs.SDcs.LGeess.ASarXiv:1905.04874v12019StarGAN-VC: Non-parallel many-to-many voice conversion with star generative adversarial networks
Hirokazu Kameoka, Takuhiro Kaneko, Kou Tanaka +1
cs.SDcs.LGeess.ASarXiv:1806.02169v22018A Reliable Effective Terascale Linear Learning System
Alekh Agarwal, Olivier Chapelle, Miroslav Dudik +1
cs.LGstat.MLarXiv:1110.4198v32011Analytic-DPM: an Analytic Estimate of the Optimal Reverse Variance in Diffusion Probabilistic Models
Fan Bao, Chongxuan Li, Jun Zhu +1
cs.LGarXiv:2201.06503v32022Descent-to-Delete: Gradient-Based Methods for Machine Unlearning
Seth Neel, Aaron Roth, Saeed Sharifi-Malvajerdi
stat.MLcs.LGarXiv:2007.02923v12020How Language Models Organize and Structure Moral Knowledge
Orion Reblitz-Richardson
cs.CLcs.AIcs.LGarXiv:2608.27402v12026Anomaly Detection using One-Class Neural Networks
Raghavendra Chalapathy, Aditya Krishna Menon, Sanjay Chawla
cs.LGcs.NEstat.MLarXiv:1802.06360v22018Learning a Continuous Sepsis Severity Score Without Hour-by-Hour Supervision: A Two-Site Retrospective Study
Kevin Zhu, Ryan Zhang, Baraa Abed +18
cs.AIcs.LGarXiv:2608.27421v12026Interpretability of machine learning based prediction models in healthcare
Gregor Stiglic, Primoz Kocbek, Nino Fijacko +3
cs.LGstat.MLarXiv:2002.08596v22020Entity-Based Knowledge Conflicts in Question Answering
Shayne Longpre, Kartik Perisetla, Anthony Chen +3
cs.CLcs.LGarXiv:2109.05052v22021High-Quality Self-Supervised Deep Image Denoising
Samuli Laine, Tero Karras, Jaakko Lehtinen +1
cs.LGcs.CVcs.NEarXiv:1901.10277v32019Deduplicating Training Data Mitigates Privacy Risks in Language Models
Nikhil Kandpal, Eric Wallace, Colin Raffel
cs.CRcs.CLcs.LGarXiv:2202.06539v32022IntentNet: Learning to Predict Intention from Raw Sensor Data
Sergio Casas, Wenjie Luo, Raquel Urtasun
cs.ROcs.AIcs.CVarXiv:2101.07907v12021Graph Clustering with Graph Neural Networks
Anton Tsitsulin, John Palowitch, Bryan Perozzi +1
cs.LGcs.SIstat.MLarXiv:2006.16904v32020Delving into Deep Imbalanced Regression
Yuzhe Yang, Kaiwen Zha, Ying-Cong Chen +2
cs.LGcs.AIcs.CVarXiv:2102.09554v22021Character-Level Language Modeling with Deeper Self-Attention
Rami Al-Rfou, Dokook Choe, Noah Constant +2
cs.CLcs.AIcs.LGarXiv:1808.04444v22018