Machine Learning

Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

5,761 to 5,820 of 20,188

  1. Do LLMs Know Your Neighborhood? Auditing LLM Priors for Neighborhood-Level Mobility Prediction and Structural Alignment

    Saad Mohammad Abrar, Eesha Kurella, Arnav Dadarya +3

    cs.LGcs.CYarXiv:2609.00345v12026
  2. Global disease monitoring and forecasting with Wikipedia

    Nicholas Generous, Geoffrey Fairchild, Alina Deshpande +2

    cs.SIcs.LGphysics.soc-pharXiv:1405.3612v22014
  3. Deep Learning for Source Code Modeling and Generation: Models, Applications and Challenges

    Triet H. M. Le, Hao Chen, M. Ali Babar

    cs.SEcs.AIcs.LGarXiv:2002.05442v12020
  4. Near Optimal Behavior via Approximate State Abstraction

    David Abel, D. Ellis Hershkowitz, Michael L. Littman

    cs.LGcs.AIarXiv:1701.04113v12017
  5. Reinforcing General Reasoning without Verifiers

    Xiangxin Zhou, Zichen Liu, Anya Sims +6

    cs.LGcs.CLarXiv:2505.21493v12025
  6. Iterative Normalization: Beyond Standardization towards Efficient Whitening

    Lei Huang, Yi Zhou, Fan Zhu +2

    cs.CVcs.LGarXiv:1904.03441v12019
  7. Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning

    Haozhen Zhang, Tao Feng, Jiaxuan You

    cs.CLcs.AIcs.LGarXiv:2506.09033v32025
  8. Whoever Started the Interference Should End It: Guiding Data-Free Model Merging via Task Vectors

    Runxi Cheng, Feng Xiong, Yongxian Wei +2

    cs.LGarXiv:2503.08099v22025
  9. Convergence of Gradient Descent on Separable Data

    Mor Shpigel Nacson, Jason D. Lee, Suriya Gunasekar +3

    stat.MLcs.LGarXiv:1803.01905v32018
  10. Rethinking embedding coupling in pre-trained language models

    Hyung Won Chung, Thibault Févry, Henry Tsai +2

    cs.CLcs.LGarXiv:2010.12821v12020
  11. NeuroPriv: Adversarial Representation Learning for Privacy in Wearable EEG Systems

    Sarmistha Sarna Gomasta, Bhawana Chhaglani, Prashant Shenoy

    cs.CRcs.HCcs.LGarXiv:2609.00390v12026
  12. SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models

    Thinh Pham, Nguyen Nguyen, Pratibha Zunjare +3

    cs.CLcs.AIcs.LGarXiv:2506.01062v42025
  13. Incorporating Domain Knowledge into Deep Neural Networks

    Tirtharaj Dash, Sharad Chitlangia, Aditya Ahuja +1

    cs.NEcs.AIcs.LGarXiv:2103.00180v22021
  14. Active Learning on a Budget: Opposite Strategies Suit High and Low Budgets

    Guy Hacohen, Avihu Dekel, Daphna Weinshall

    cs.LGarXiv:2202.02794v42022
  15. Nemotron-H: A Family of Accurate and Efficient Hybrid Mamba-Transformer Models

    NVIDIA, :, Aaron Blakeman +198

    cs.CLcs.AIcs.LGarXiv:2504.03624v42025
  16. Neural Prompt Search

    Yuanhan Zhang, Kaiyang Zhou, Ziwei Liu

    cs.CVcs.AIcs.LGarXiv:2206.04673v22022
  17. Multi-fidelity Bayesian Neural Networks: Algorithms and Applications

    Xuhui Meng, Hessam Babaee, George Em Karniadakis

    cs.LGphysics.comp-pharXiv:2012.13294v12020
  18. Reinforcement Learning for Reasoning in Small LLMs: What Works and What Doesn't

    Quy-Anh Dang, Chris Ngo

    cs.LGcs.CLarXiv:2503.16219v22025
  19. Benchmarking Reinforcement Learning Algorithms on Real-World Robots

    A. Rupam Mahmood, Dmytro Korenkevych, Gautham Vasan +2

    cs.LGcs.AIcs.ROarXiv:1809.07731v12018
  20. DISTAL: Distillation and Self-Supervised Pretraining for Structure-Agnostic Materials Property Prediction

    Weiran Wang, Xintong Huo, Yueying Wang +7

    cs.LGcs.AIcs.ETarXiv:2609.00059v12026
  21. Learning from the Worst: Dynamically Generated Datasets to Improve Online Hate Detection

    Bertie Vidgen, Tristan Thrush, Zeerak Waseem +1

    cs.CLcs.LGarXiv:2012.15761v22020
  22. P3Depth: Monocular Depth Estimation with a Piecewise Planarity Prior

    Vaishakh Patil, Christos Sakaridis, Alexander Liniger +1

    cs.CVcs.AIcs.LGarXiv:2204.02091v12022
  23. Parameterized quantum circuits as machine learning models

    Marcello Benedetti, Erika Lloyd, Stefan Sack +1

    quant-phcs.LGarXiv:1906.07682v22019
  24. State-specific protein-ligand complex structure prediction with a multi-scale deep generative model

    Zhuoran Qiao, Weili Nie, Arash Vahdat +2

    q-bio.QMcs.LGq-bio.BMarXiv:2209.15171v22022
  25. Open-environment Machine Learning

    Zhi-Hua Zhou

    cs.LGarXiv:2206.00423v22022
  26. Robbing the Fed: Directly Obtaining Private Data in Federated Learning with Modified Models

    Liam Fowl, Jonas Geiping, Wojtek Czaja +2

    cs.LGcs.CRarXiv:2110.13057v22021
  27. Neural Embeddings of Graphs in Hyperbolic Space

    Benjamin Paul Chamberlain, James Clough, Marc Peter Deisenroth

    stat.MLcs.LGarXiv:1705.10359v12017
  28. AgentPRM: Process Reward Models for LLM Agents via Step-Wise Promise and Progress

    Zhiheng Xi, Chenyang Liao, Guanyu Li +12

    cs.CLcs.IRcs.LGarXiv:2511.08325v12025
  29. Proximity Forest: An effective and scalable distance-based classifier for time series

    Benjamin Lucas, Ahmed Shifaz, Charlotte Pelletier +5

    cs.LGstat.MLarXiv:1808.10594v22018
  30. Improving Vision-Language-Action Model with Online Reinforcement Learning

    Yanjiang Guo, Jianke Zhang, Xiaoyu Chen +4

    cs.ROcs.CVcs.LGarXiv:2501.16664v12025
  31. ReNFT: Repairing Mode Collapse in Reward Post-Training via Internal Probability-Mass Recalibration

    Yuchen Bao, Chao Wen, Haowei Wang +10

    cs.LGcs.AIcs.CVarXiv:2609.00061v12026
  32. MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning

    Zhaopeng Feng, Shaosheng Cao, Jiahan Ren +7

    cs.CLcs.AIcs.LGarXiv:2504.10160v12025
  33. Hidden relationships in a document-derived property graph: top-k chunk embeddings and inverse-distance weighting over a dynamically evolving ontology

    Bilge Kaan Karamete, Hunter Casten

    cs.CEcs.LGarXiv:2609.00387v12026
  34. Dense Weak Hiding: Closing Complexity Gaps in Nonconvex and PL Finite-Sum Optimization under Individual Smoothness

    Yuxing Peng, Zhiqing Tang, Weijia Jia

    cs.DScs.LGmath.OCarXiv:2609.00045v12026
  35. PhaseLink: A Deep Learning Approach to Seismic Phase Association

    Zachary E. Ross, Yisong Yue, Men-Andrin Meier +2

    cs.LGphysics.geo-phstat.MLarXiv:1809.02880v22018
  36. Deep Model Compression: Distilling Knowledge from Noisy Teachers

    Bharat Bhusan Sau, Vineeth N. Balasubramanian

    cs.LGarXiv:1610.09650v22016
  37. A Multi-Branch Feature Fusion Approach for Health Misinformation Detection and Propagation

    Mkululi Sikosana, Sean Maudsley-Barton, Oluwaseun Ajao

    cs.LGcs.SIarXiv:2609.00403v12026
  38. Atom of Thoughts for Markov LLM Test-Time Scaling

    Fengwei Teng, Quan Shi, Zhaoyang Yu +4

    cs.CLcs.AIcs.LGarXiv:2502.12018v42025
  39. An Incentive Mechanism for Federated Learning in Wireless Cellular network: An Auction Approach

    Tra Huong Thi Le, Nguyen H. Tran, Yan Kyaw Tun +4

    cs.LGcs.GTcs.NIarXiv:2009.10269v12020
  40. Geometry-aware Latent Autoregressive Generative Model for PDEs in Complex Domains

    Zi Wang, Minghui Xu, Tapan Mukerji

    cs.LGcs.AIarXiv:2609.00297v12026
  41. ReinFlow: Fine-tuning Flow Matching Policy with Online Reinforcement Learning

    Tonghe Zhang, Chao Yu, Sichang Su +1

    cs.ROcs.LGarXiv:2505.22094v72025
  42. ASGO: Adaptive Structured Gradient Optimization

    Kang An, Yuxing Liu, Rui Pan +4

    cs.LGmath.OCarXiv:2503.20762v32025
  43. FourCastNet 3: A geometric approach to probabilistic machine-learning weather forecasting at scale

    Boris Bonev, Thorsten Kurth, Ankur Mahesh +7

    cs.LGphysics.ao-pharXiv:2507.12144v22025
  44. Maximizing Confidence Alone Improves Reasoning

    Mihir Prabhudesai, Lili Chen, Alex Ippoliti +3

    cs.LGcs.AIarXiv:2505.22660v42025
  45. Neural probabilistic motor primitives for humanoid control

    Josh Merel, Leonard Hasenclever, Alexandre Galashov +5

    cs.LGcs.AIcs.ROarXiv:1811.11711v22018
  46. Variable Compliance Control for Robotic Peg-in-Hole Assembly: A Deep Reinforcement Learning Approach

    Cristian C. Beltran-Hernandez, Damien Petit, Ixchel G. Ramirez-Alpizar +1

    cs.ROcs.LGarXiv:2008.10224v32020
  47. Learning from Reward-Free Offline Data: A Case for Planning with Latent Dynamics Models

    Vlad Sobal, Wancong Zhang, Kyunghyun Cho +3

    cs.LGarXiv:2502.14819v42025
  48. Learning Neural Causal Models from Unknown Interventions

    Nan Rosemary Ke, Olexa Bilaniuk, Anirudh Goyal +6

    stat.MLcs.AIcs.LGarXiv:1910.01075v22019
  49. A Mean Field Theory of Batch Normalization

    Greg Yang, Jeffrey Pennington, Vinay Rao +2

    cs.NEcond-mat.dis-nncs.LGarXiv:1902.08129v22019
  50. DTC: Deep Tracking Control

    Fabian Jenelten, Junzhe He, Farbod Farshidian +1

    cs.ROcs.LGeess.SYarXiv:2309.15462v22023
  51. Random Forest-Informed Cellular Automaton for Large-Scale Wildfire Spread Modelling

    Siyu Chen, Esha Saha, Hao Wang

    stat.APcs.LGarXiv:2609.01675v12026
  52. Hard Sample Aware Network for Contrastive Deep Graph Clustering

    Yue Liu, Xihong Yang, Sihang Zhou +7

    cs.LGcs.AIarXiv:2212.08665v32022
  53. Ten Architectures, One Error: Shared Failure Modes in Hyperspectral Classification under Spatially Disjoint Evaluation

    Ehsan Faghih, Fatemeh Ashrafi, Marguerite Moore +1

    cs.CVcs.LGarXiv:2609.01786v12026
  54. TeMP: Temporal Message Passing for Temporal Knowledge Graph Completion

    Jiapeng Wu, Meng Cao, Jackie Chi Kit Cheung +1

    cs.LGcs.AIcs.CLarXiv:2010.03526v12020
  55. Revisiting the Test-Time Scaling of o1-like Models: Do they Truly Possess Test-Time Scaling Capabilities?

    Zhiyuan Zeng, Qinyuan Cheng, Zhangyue Yin +2

    cs.LGcs.AIcs.CLarXiv:2502.12215v22025
  56. Reinforcement Learning and Rule-Based Peer-to-Peer Pricing in Residential PV-BES Communities

    Pablo Benalcazar, Maciej Kalka, Wilian Guamán +1

    cs.LGcs.CYarXiv:2609.01680v12026
  57. Linked Component Analysis from Matrices to High Order Tensors: Applications to Biomedical Data

    Guoxu Zhou, Qibin Zhao, Yu Zhang +3

    cs.CEcs.LGmath.NAarXiv:1508.07416v12015
  58. Learning Human Identity from Motion Patterns

    Natalia Neverova, Christian Wolf, Griffin Lacey +4

    cs.LGcs.CVcs.NEarXiv:1511.03908v42015
  59. AI Research Agents for Machine Learning: Search, Exploration, and Generalization in MLE-bench

    Edan Toledo, Karen Hambardzumyan, Martin Josifoski +22

    cs.AIcs.LGarXiv:2507.02554v22025
  60. Decentralized Federated Learning through Proxy Model Sharing

    Shivam Kalra, Junfeng Wen, Jesse C. Cresswell +2

    cs.LGarXiv:2111.11343v22021