Machine Learning
Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
5,761 to 5,820 of 20,188
Do LLMs Know Your Neighborhood? Auditing LLM Priors for Neighborhood-Level Mobility Prediction and Structural Alignment
Saad Mohammad Abrar, Eesha Kurella, Arnav Dadarya +3
cs.LGcs.CYarXiv:2609.00345v12026Global disease monitoring and forecasting with Wikipedia
Nicholas Generous, Geoffrey Fairchild, Alina Deshpande +2
cs.SIcs.LGphysics.soc-pharXiv:1405.3612v22014Deep Learning for Source Code Modeling and Generation: Models, Applications and Challenges
Triet H. M. Le, Hao Chen, M. Ali Babar
cs.SEcs.AIcs.LGarXiv:2002.05442v12020Near Optimal Behavior via Approximate State Abstraction
David Abel, D. Ellis Hershkowitz, Michael L. Littman
cs.LGcs.AIarXiv:1701.04113v12017Reinforcing General Reasoning without Verifiers
Xiangxin Zhou, Zichen Liu, Anya Sims +6
cs.LGcs.CLarXiv:2505.21493v12025Iterative Normalization: Beyond Standardization towards Efficient Whitening
Lei Huang, Yi Zhou, Fan Zhu +2
cs.CVcs.LGarXiv:1904.03441v12019Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
Haozhen Zhang, Tao Feng, Jiaxuan You
cs.CLcs.AIcs.LGarXiv:2506.09033v32025Whoever Started the Interference Should End It: Guiding Data-Free Model Merging via Task Vectors
Runxi Cheng, Feng Xiong, Yongxian Wei +2
cs.LGarXiv:2503.08099v22025Convergence of Gradient Descent on Separable Data
Mor Shpigel Nacson, Jason D. Lee, Suriya Gunasekar +3
stat.MLcs.LGarXiv:1803.01905v32018Rethinking embedding coupling in pre-trained language models
Hyung Won Chung, Thibault Févry, Henry Tsai +2
cs.CLcs.LGarXiv:2010.12821v12020NeuroPriv: Adversarial Representation Learning for Privacy in Wearable EEG Systems
Sarmistha Sarna Gomasta, Bhawana Chhaglani, Prashant Shenoy
cs.CRcs.HCcs.LGarXiv:2609.00390v12026SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models
Thinh Pham, Nguyen Nguyen, Pratibha Zunjare +3
cs.CLcs.AIcs.LGarXiv:2506.01062v42025Incorporating Domain Knowledge into Deep Neural Networks
Tirtharaj Dash, Sharad Chitlangia, Aditya Ahuja +1
cs.NEcs.AIcs.LGarXiv:2103.00180v22021Active Learning on a Budget: Opposite Strategies Suit High and Low Budgets
Guy Hacohen, Avihu Dekel, Daphna Weinshall
cs.LGarXiv:2202.02794v42022Nemotron-H: A Family of Accurate and Efficient Hybrid Mamba-Transformer Models
NVIDIA, :, Aaron Blakeman +198
cs.CLcs.AIcs.LGarXiv:2504.03624v42025Neural Prompt Search
Yuanhan Zhang, Kaiyang Zhou, Ziwei Liu
cs.CVcs.AIcs.LGarXiv:2206.04673v22022Multi-fidelity Bayesian Neural Networks: Algorithms and Applications
Xuhui Meng, Hessam Babaee, George Em Karniadakis
cs.LGphysics.comp-pharXiv:2012.13294v12020Reinforcement Learning for Reasoning in Small LLMs: What Works and What Doesn't
Quy-Anh Dang, Chris Ngo
cs.LGcs.CLarXiv:2503.16219v22025Benchmarking Reinforcement Learning Algorithms on Real-World Robots
A. Rupam Mahmood, Dmytro Korenkevych, Gautham Vasan +2
cs.LGcs.AIcs.ROarXiv:1809.07731v12018DISTAL: Distillation and Self-Supervised Pretraining for Structure-Agnostic Materials Property Prediction
Weiran Wang, Xintong Huo, Yueying Wang +7
cs.LGcs.AIcs.ETarXiv:2609.00059v12026Learning from the Worst: Dynamically Generated Datasets to Improve Online Hate Detection
Bertie Vidgen, Tristan Thrush, Zeerak Waseem +1
cs.CLcs.LGarXiv:2012.15761v22020P3Depth: Monocular Depth Estimation with a Piecewise Planarity Prior
Vaishakh Patil, Christos Sakaridis, Alexander Liniger +1
cs.CVcs.AIcs.LGarXiv:2204.02091v12022Parameterized quantum circuits as machine learning models
Marcello Benedetti, Erika Lloyd, Stefan Sack +1
quant-phcs.LGarXiv:1906.07682v22019State-specific protein-ligand complex structure prediction with a multi-scale deep generative model
Zhuoran Qiao, Weili Nie, Arash Vahdat +2
q-bio.QMcs.LGq-bio.BMarXiv:2209.15171v22022Open-environment Machine Learning
Zhi-Hua Zhou
cs.LGarXiv:2206.00423v22022Robbing the Fed: Directly Obtaining Private Data in Federated Learning with Modified Models
Liam Fowl, Jonas Geiping, Wojtek Czaja +2
cs.LGcs.CRarXiv:2110.13057v22021Neural Embeddings of Graphs in Hyperbolic Space
Benjamin Paul Chamberlain, James Clough, Marc Peter Deisenroth
stat.MLcs.LGarXiv:1705.10359v12017AgentPRM: Process Reward Models for LLM Agents via Step-Wise Promise and Progress
Zhiheng Xi, Chenyang Liao, Guanyu Li +12
cs.CLcs.IRcs.LGarXiv:2511.08325v12025Proximity Forest: An effective and scalable distance-based classifier for time series
Benjamin Lucas, Ahmed Shifaz, Charlotte Pelletier +5
cs.LGstat.MLarXiv:1808.10594v22018Improving Vision-Language-Action Model with Online Reinforcement Learning
Yanjiang Guo, Jianke Zhang, Xiaoyu Chen +4
cs.ROcs.CVcs.LGarXiv:2501.16664v12025ReNFT: Repairing Mode Collapse in Reward Post-Training via Internal Probability-Mass Recalibration
Yuchen Bao, Chao Wen, Haowei Wang +10
cs.LGcs.AIcs.CVarXiv:2609.00061v12026MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning
Zhaopeng Feng, Shaosheng Cao, Jiahan Ren +7
cs.CLcs.AIcs.LGarXiv:2504.10160v12025Hidden relationships in a document-derived property graph: top-k chunk embeddings and inverse-distance weighting over a dynamically evolving ontology
Bilge Kaan Karamete, Hunter Casten
cs.CEcs.LGarXiv:2609.00387v12026Dense Weak Hiding: Closing Complexity Gaps in Nonconvex and PL Finite-Sum Optimization under Individual Smoothness
Yuxing Peng, Zhiqing Tang, Weijia Jia
cs.DScs.LGmath.OCarXiv:2609.00045v12026PhaseLink: A Deep Learning Approach to Seismic Phase Association
Zachary E. Ross, Yisong Yue, Men-Andrin Meier +2
cs.LGphysics.geo-phstat.MLarXiv:1809.02880v22018Deep Model Compression: Distilling Knowledge from Noisy Teachers
Bharat Bhusan Sau, Vineeth N. Balasubramanian
cs.LGarXiv:1610.09650v22016A Multi-Branch Feature Fusion Approach for Health Misinformation Detection and Propagation
Mkululi Sikosana, Sean Maudsley-Barton, Oluwaseun Ajao
cs.LGcs.SIarXiv:2609.00403v12026Atom of Thoughts for Markov LLM Test-Time Scaling
Fengwei Teng, Quan Shi, Zhaoyang Yu +4
cs.CLcs.AIcs.LGarXiv:2502.12018v42025An Incentive Mechanism for Federated Learning in Wireless Cellular network: An Auction Approach
Tra Huong Thi Le, Nguyen H. Tran, Yan Kyaw Tun +4
cs.LGcs.GTcs.NIarXiv:2009.10269v12020Geometry-aware Latent Autoregressive Generative Model for PDEs in Complex Domains
Zi Wang, Minghui Xu, Tapan Mukerji
cs.LGcs.AIarXiv:2609.00297v12026ReinFlow: Fine-tuning Flow Matching Policy with Online Reinforcement Learning
Tonghe Zhang, Chao Yu, Sichang Su +1
cs.ROcs.LGarXiv:2505.22094v72025ASGO: Adaptive Structured Gradient Optimization
Kang An, Yuxing Liu, Rui Pan +4
cs.LGmath.OCarXiv:2503.20762v32025FourCastNet 3: A geometric approach to probabilistic machine-learning weather forecasting at scale
Boris Bonev, Thorsten Kurth, Ankur Mahesh +7
cs.LGphysics.ao-pharXiv:2507.12144v22025Maximizing Confidence Alone Improves Reasoning
Mihir Prabhudesai, Lili Chen, Alex Ippoliti +3
cs.LGcs.AIarXiv:2505.22660v42025Neural probabilistic motor primitives for humanoid control
Josh Merel, Leonard Hasenclever, Alexandre Galashov +5
cs.LGcs.AIcs.ROarXiv:1811.11711v22018Variable Compliance Control for Robotic Peg-in-Hole Assembly: A Deep Reinforcement Learning Approach
Cristian C. Beltran-Hernandez, Damien Petit, Ixchel G. Ramirez-Alpizar +1
cs.ROcs.LGarXiv:2008.10224v32020Learning from Reward-Free Offline Data: A Case for Planning with Latent Dynamics Models
Vlad Sobal, Wancong Zhang, Kyunghyun Cho +3
cs.LGarXiv:2502.14819v42025Learning Neural Causal Models from Unknown Interventions
Nan Rosemary Ke, Olexa Bilaniuk, Anirudh Goyal +6
stat.MLcs.AIcs.LGarXiv:1910.01075v22019A Mean Field Theory of Batch Normalization
Greg Yang, Jeffrey Pennington, Vinay Rao +2
cs.NEcond-mat.dis-nncs.LGarXiv:1902.08129v22019DTC: Deep Tracking Control
Fabian Jenelten, Junzhe He, Farbod Farshidian +1
cs.ROcs.LGeess.SYarXiv:2309.15462v22023Random Forest-Informed Cellular Automaton for Large-Scale Wildfire Spread Modelling
Siyu Chen, Esha Saha, Hao Wang
stat.APcs.LGarXiv:2609.01675v12026Hard Sample Aware Network for Contrastive Deep Graph Clustering
Yue Liu, Xihong Yang, Sihang Zhou +7
cs.LGcs.AIarXiv:2212.08665v32022Ten Architectures, One Error: Shared Failure Modes in Hyperspectral Classification under Spatially Disjoint Evaluation
Ehsan Faghih, Fatemeh Ashrafi, Marguerite Moore +1
cs.CVcs.LGarXiv:2609.01786v12026TeMP: Temporal Message Passing for Temporal Knowledge Graph Completion
Jiapeng Wu, Meng Cao, Jackie Chi Kit Cheung +1
cs.LGcs.AIcs.CLarXiv:2010.03526v12020Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?
Zhiyuan Zeng, Qinyuan Cheng, Zhangyue Yin +2
cs.LGcs.AIcs.CLarXiv:2502.12215v22025Reinforcement Learning and Rule-Based Peer-to-Peer Pricing in Residential PV-BES Communities
Pablo Benalcazar, Maciej Kalka, Wilian Guamán +1
cs.LGcs.CYarXiv:2609.01680v12026Linked Component Analysis from Matrices to High Order Tensors: Applications to Biomedical Data
Guoxu Zhou, Qibin Zhao, Yu Zhang +3
cs.CEcs.LGmath.NAarXiv:1508.07416v12015Learning Human Identity from Motion Patterns
Natalia Neverova, Christian Wolf, Griffin Lacey +4
cs.LGcs.CVcs.NEarXiv:1511.03908v42015AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench
Edan Toledo, Karen Hambardzumyan, Martin Josifoski +22
cs.AIcs.LGarXiv:2507.02554v22025Decentralized Federated Learning through Proxy Model Sharing
Shivam Kalra, Junfeng Wen, Jesse C. Cresswell +2
cs.LGarXiv:2111.11343v22021