Machine Learning
Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
421 to 480 of 20,454
MuProp: Unbiased Backpropagation for Stochastic Neural Networks
Shixiang Gu, Sergey Levine, Ilya Sutskever +1
cs.LGarXiv:1511.05176v32015Gaussian Process Upper Confidence Bound Achieves Nearly-Optimal Regret in Noise-Free Gaussian Process Bandits
Shogo Iwazaki
cs.LGarXiv:2502.19006v22025Can AutoML outperform humans? An evaluation on popular OpenML datasets using AutoML Benchmark
Marc Hanussek, Matthias Blohm, Maximilien Kintz
cs.LGstat.MLarXiv:2009.01564v22020Learning diverse attacks on large language models for robust red-teaming and safety tuning
Seanie Lee, Minsu Kim, Lynn Cherif +8
cs.CLcs.CRcs.LGarXiv:2405.18540v32024Directed Diffusion: Direct Control of Object Placement through Attention Guidance
Wan-Duo Kurt Ma, J. P. Lewis, Avisek Lahiri +2
cs.CVcs.GRcs.LGarXiv:2302.13153v32023Aggregated Momentum: Stability Through Passive Damping
James Lucas, Shengyang Sun, Richard Zemel +1
cs.LGcs.AImath.OCarXiv:1804.00325v32018Attacking the Trusted Imagination: Oracle-Level Integrity Attacks on Imagine-then-Act World Models
Linghan Chen, Kaiyan Ji, Minyu Guo
cs.LGcs.AIcs.CRarXiv:2606.22966v12026Self-Supervised Graph Representation Learning via Global Context Prediction
Zhen Peng, Yixiang Dong, Minnan Luo +2
cs.LGstat.MLarXiv:2003.01604v12020Tomayto, Tomahto. Beyond Token-level Answer Equivalence for Question Answering Evaluation
Jannis Bulian, Christian Buck, Wojciech Gajewski +2
cs.CLcs.LGarXiv:2202.07654v22022A theory of continuous generative flow networks
Salem Lahlou, Tristan Deleu, Pablo Lemos +6
cs.LGstat.MLarXiv:2301.12594v22023Reparameterizable Subset Sampling via Continuous Relaxations
Sang Michael Xie, Stefano Ermon
cs.LGstat.MLarXiv:1901.10517v52019MaskLLM: Learnable Semi-Structured Sparsity for Large Language Models
Gongfan Fang, Hongxu Yin, Saurav Muralidharan +5
cs.AIcs.CLcs.LGarXiv:2409.17481v22024Optimal and Adaptive Algorithms for Online Boosting
Alina Beygelzimer, Satyen Kale, Haipeng Luo
cs.LGarXiv:1502.02651v12015Measuring In-Context Computation Complexity via Hidden State Prediction
Vincent Herrmann, Róbert Csordás, Jürgen Schmidhuber
cs.LGarXiv:2503.13431v12025Image Generation Via Minimizing Fr\'echet Distance in Discriminator Feature Space
Khoa D. Doan, Saurav Manchanda, Fengjiao Wang +3
cs.CVcs.LGeess.IVarXiv:2003.11774v22020A Comprehensive Benchmark of Machine and Deep Learning Across Diverse Tabular Datasets
Assaf Shmuel, Oren Glickman, Teddy Lazebnik
cs.LGcs.AIarXiv:2408.14817v12024TabReD: Analyzing Pitfalls and Filling the Gaps in Tabular Deep Learning Benchmarks
Ivan Rubachev, Nikolay Kartashev, Yury Gorishniy +1
cs.LGarXiv:2406.19380v42024fev-bench: A Realistic Benchmark for Time Series Forecasting
Oleksandr Shchur, Abdul Fatir Ansari, Caner Turkmen +5
cs.LGarXiv:2509.26468v42025A Closer Look at Deep Learning Methods on Tabular Datasets
Han-Jia Ye, Si-Yang Liu, Hao-Run Cai +2
cs.LGarXiv:2407.00956v42024Unreflected Use of Tabular Data Repositories Can Undermine Research Quality
Andrej Tschalzev, Lennart Purucker, Stefan Lüdtke +3
cs.LGarXiv:2503.09159v12025TetraJet-v2: Accurate NVFP4 Training for Large Language Models with Oscillation Suppression and Outlier Control
Yuxiang Chen, Yifan Liu, Xiaoming Xu +5
cs.LGcs.AIarXiv:2510.27527v32025Distinguishing the Knowable from the Unknowable with Language Models
Gustaf Ahdritz, Tian Qin, Nikhil Vyas +2
cs.LGcs.AIcs.CLarXiv:2402.03563v22024TruthRL: Incentivizing Truthful LLMs via Reinforcement Learning
Zhepei Wei, Xiao Yang, Kai Sun +12
cs.CLcs.AIcs.LGarXiv:2509.25760v22025blob loss: instance imbalance aware loss functions for semantic segmentation
Florian Kofler, Suprosanna Shit, Ivan Ezhov +14
cs.CVcs.LGeess.IVarXiv:2205.08209v32022Representation Learning for Grounded Spatial Reasoning
Michael Janner, Karthik Narasimhan, Regina Barzilay
cs.CLcs.AIcs.LGarXiv:1707.03938v22017Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation
Yi Yang, Cong Qin, Xiaodan Liu +8
cs.LGcs.AIcs.CLarXiv:2608.04788v12026Scalable Second Order Optimization for Deep Learning
Rohan Anil, Vineet Gupta, Tomer Koren +2
cs.LGmath.OCstat.MLarXiv:2002.09018v22020Syntactic and Semantic Control of Large Language Models via Sequential Monte Carlo
João Loula, Benjamin LeBrun, Li Du +12
cs.CLcs.AIcs.LGarXiv:2504.13139v22025Is Private Learning Possible with Instance Encoding?
Nicholas Carlini, Samuel Deng, Sanjam Garg +6
cs.CRcs.CVcs.LGarXiv:2011.05315v22020The Alignment Problem in Constrained Code Generation
Matteo Biagiola, Jahrim Gabriele Cesario, Luca Di Grazia +2
cs.SEcs.LGcs.PLarXiv:2606.21619v12026CRUST-Bench: A Comprehensive Benchmark for C-to-safe-Rust Transpilation
Anirudh Khatry, Robert Zhang, Jia Pan +4
cs.SEcs.CLcs.LGarXiv:2504.15254v32025Guiding LLMs The Right Way: Fast, Non-Invasive Constrained Generation
Luca Beurer-Kellner, Marc Fischer, Martin Vechev
cs.LGcs.CLarXiv:2403.06988v12024Explaining Question Answering Models through Text Generation
Veronica Latcinnik, Jonathan Berant
cs.CLcs.AIcs.LGarXiv:2004.05569v12020Knowledge-Grounded Self-Rationalization via Extractive and Natural Language Explanations
Bodhisattwa Prasad Majumder, Oana-Maria Camburu, Thomas Lukasiewicz +1
cs.CLcs.AIcs.LGarXiv:2106.13876v42021Goal Driven Discovery of Distributional Differences via Language Descriptions
Ruiqi Zhong, Peter Zhang, Steve Li +3
cs.CLcs.AIcs.LGarXiv:2302.14233v22023Sum-max Submodular Bandits
Stephen Pasteris, Alberto Rumi, Fabio Vitale +1
cs.LGarXiv:2311.05975v12023A Meta-Learning Approach for Graph Representation Learning in Multi-Task Settings
Davide Buffelli, Fabio Vandin
cs.LGcs.AIarXiv:2012.06755v12020Lossless Acceleration for Seq2seq Generation with Aggressive Decoding
Tao Ge, Heming Xia, Xin Sun +2
cs.CLcs.LGarXiv:2205.10350v12022On the insufficiency of existing momentum schemes for Stochastic Optimization
Rahul Kidambi, Praneeth Netrapalli, Prateek Jain +1
cs.LGmath.OCstat.MLarXiv:1803.05591v22018Evaluating Machine Unlearning via Epistemic Uncertainty
Alexander Becker, Thomas Liebig
cs.LGarXiv:2208.10836v22022TimeDP: Learning to Generate Multi-Domain Time Series with Domain Prompts
Yu-Hao Huang, Chang Xu, Yueying Wu +2
cs.LGcs.AIarXiv:2501.05403v12025Reliable Graph Neural Networks via Robust Aggregation
Simon Geisler, Daniel Zügner, Stephan Günnemann
cs.LGstat.MLarXiv:2010.15651v12020Efficient Online Data Mixing For Language Model Pre-Training
Alon Albalak, Liangming Pan, Colin Raffel +1
cs.CLcs.LGarXiv:2312.02406v22023Language models scale reliably with over-training and on downstream tasks
Samir Yitzhak Gadre, Georgios Smyrnis, Vaishaal Shankar +22
cs.CLcs.LGarXiv:2403.08540v22024GES: Generalized Exponential Splatting for Efficient Radiance Field Rendering
Abdullah Hamdi, Luke Melas-Kyriazi, Jinjie Mai +5
cs.CVcs.GRcs.LGarXiv:2402.10128v22024Pathways on the Image Manifold: Image Editing via Video Generation
Noam Rotstein, Gal Yona, Daniel Silver +3
cs.CVcs.AIcs.LGarXiv:2411.16819v42024Model-Preserving Adaptive Rounding
Albert Tseng, Zhaofeng Sun, Christopher De Sa
cs.LGcs.AIarXiv:2505.22988v32025AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning
Jianguo Zhang, Tian Lan, Rithesh Murthy +15
cs.AIcs.CLcs.LGarXiv:2402.15506v42024Collaborative Unsupervised Visual Representation Learning from Decentralized Data
Weiming Zhuang, Xin Gan, Yonggang Wen +2
cs.DCcs.AIcs.CVarXiv:2108.06492v12021FAHT: An Adaptive Fairness-aware Decision Tree Classifier
Wenbin Zhang, Eirini Ntoutsi
cs.LGcs.AIstat.MLarXiv:1907.07237v12019DiscoGen: Procedural Generation of Algorithm Discovery Tasks in Machine Learning
Alexander D. Goldie, Zilin Wang, Adrian Hayler +17
cs.LGcs.AIarXiv:2603.17863v22026All SMILES Variational Autoencoder
Zaccary Alperstein, Artem Cherkasov, Jason Tyler Rolfe
cs.LGstat.MLarXiv:1905.13343v22019Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
Zijian Guo, Weichao Zhou, Wenchao Li
cs.LGcs.AIarXiv:2402.17217v22024DenseFormer: Enhancing Information Flow in Transformers via Depth Weighted Averaging
Matteo Pagliardini, Amirkeivan Mohtashami, Francois Fleuret +1
cs.CLcs.LGarXiv:2402.02622v22024Training a Generally Curious Agent
Fahim Tajwar, Yiding Jiang, Abitha Thankaraj +4
cs.LGcs.AIcs.CLarXiv:2502.17543v42025Evaluating and Enhancing Large Language Models for Novelty Assessment in Scholarly Publications
Ethan Lin, Zhiyuan Peng, Yi Fang
cs.CLcs.AIcs.IRarXiv:2409.16605v12024CryoBench: Diverse and challenging datasets for the heterogeneity problem in cryo-EM
Minkyu Jeon, Rishwanth Raghu, Miro Astore +6
cs.CVcs.AIcs.CEarXiv:2408.05526v22024Mixture of neural fields for heterogeneous reconstruction in cryo-EM
Axel Levy, Rishwanth Raghu, David Shustin +5
cs.LGarXiv:2412.09420v12024RAP: Retrieval-Augmented Personalization for Multimodal Large Language Models
Haoran Hao, Jiaming Han, Changsheng Li +2
cs.CVcs.AIcs.CLarXiv:2410.13360v32024POLY-HOOT: Monte-Carlo Planning in Continuous Space MDPs with Non-Asymptotic Analysis
Weichao Mao, Kaiqing Zhang, Qiaomin Xie +1
cs.AIcs.LGarXiv:2006.04672v22020