Machine Learning

Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

6,301 to 6,360 of 20,193

  1. MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining

    LLM-Core Xiaomi, :, Bingquan Xia +62

    cs.CLcs.AIcs.LGarXiv:2505.07608v22025
  2. Large-Scale Multilingual Speech Recognition with a Streaming End-to-End Model

    Anjuli Kannan, Arindrima Datta, Tara N. Sainath +6

    eess.AScs.LGcs.SDarXiv:1909.05330v12019
  3. Combining Deep Reinforcement Learning and Search for Imperfect-Information Games

    Noam Brown, Anton Bakhtin, Adam Lerer +1

    cs.GTcs.AIcs.LGarXiv:2007.13544v22020
  4. Back to the Drawing Board: A Critical Evaluation of Poisoning Attacks on Production Federated Learning

    Virat Shejwalkar, Amir Houmansadr, Peter Kairouz +1

    cs.LGcs.CRcs.DCarXiv:2108.10241v22021
  5. Swin Transformer: Hierarchical Vision Transformer using Shifted Windows

    Ze Liu, Yutong Lin, Yue Cao +5

    cs.CVcs.LGarXiv:2103.14030v22021
  6. DeepSpeed Inference: Enabling Efficient Inference of Transformer Models at Unprecedented Scale

    Reza Yazdani Aminabadi, Samyam Rajbhandari, Minjia Zhang +8

    cs.LGcs.DCcs.PFarXiv:2207.00032v12022
  7. Evaluation of Neural Architectures Trained with Square Loss vs Cross-Entropy in Classification Tasks

    Like Hui, Mikhail Belkin

    cs.LGstat.MLarXiv:2006.07322v52020
  8. Fair k-Center Clustering for Data Summarization

    Matthäus Kleindessner, Pranjal Awasthi, Jamie Morgenstern

    stat.MLcs.DScs.LGarXiv:1901.08628v22019
  9. SBERT-WK: A Sentence Embedding Method by Dissecting BERT-based Word Models

    Bin Wang, C. -C. Jay Kuo

    cs.CLcs.LGcs.MMarXiv:2002.06652v22020
  10. Multivariate Industrial Time Series with Cyber-Attack Simulation: Fault Detection Using an LSTM-based Predictive Data Model

    Pavel Filonov, Andrey Lavrentyev, Artem Vorontsov

    cs.LGstat.MLarXiv:1612.06676v22016
  11. An Unsupervised Sentence Embedding Method by Mutual Information Maximization

    Yan Zhang, Ruidan He, Zuozhu Liu +2

    cs.CLcs.LGarXiv:2009.12061v22020
  12. Competence-based Multimodal Curriculum Learning for Medical Report Generation

    Fenglin Liu, Shen Ge, Yuexian Zou +1

    cs.CLcs.CVcs.LGarXiv:2206.14579v32022
  13. Graph Neural News Recommendation with Long-term and Short-term Interest Modeling

    Linmei Hu, Chen Li, Chuan Shi +2

    cs.IRcs.CLcs.LGarXiv:1910.14025v22019
  14. Diffusion Adversarial Post-Training for One-Step Video Generation

    Shanchuan Lin, Xin Xia, Yuxi Ren +3

    cs.CVcs.AIcs.LGarXiv:2501.08316v32025
  15. Discriminative Active Learning

    Daniel Gissin, Shai Shalev-Shwartz

    cs.LGstat.MLarXiv:1907.06347v12019
  16. Reinforcement-Learning based Portfolio Management with Augmented Asset Movement Prediction States

    Yunan Ye, Hengzhi Pei, Boxin Wang +4

    q-fin.PMcs.LGstat.MLarXiv:2002.05780v12020
  17. EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos

    Ruihan Yang, Qinxi Yu, Yecheng Wu +12

    cs.ROcs.AIcs.CVarXiv:2507.12440v32025
  18. Hamiltonian Graph Networks with ODE Integrators

    Alvaro Sanchez-Gonzalez, Victor Bapst, Kyle Cranmer +1

    cs.LGphysics.comp-pharXiv:1909.12790v12019
  19. Open Set Domain Adaptation: Theoretical Bound and Algorithm

    Zhen Fang, Jie Lu, Feng Liu +2

    cs.LGstat.MLarXiv:1907.08375v22019
  20. Transolver++: An Accurate Neural Solver for PDEs on Million-Scale Geometries

    Huakun Luo, Haixu Wu, Hang Zhou +4

    cs.LGarXiv:2502.02414v22025
  21. Stability and Generalization of Learning Algorithms that Converge to Global Optima

    Zachary Charles, Dimitris Papailiopoulos

    stat.MLcs.ITcs.LGarXiv:1710.08402v12017
  22. Dynamic Chunking for End-to-End Hierarchical Sequence Modeling

    Sukjun Hwang, Brandon Wang, Albert Gu

    cs.LGarXiv:2507.07955v22025
  23. Process Reward Models That Think

    Muhammad Khalifa, Rishabh Agarwal, Lajanugen Logeswaran +5

    cs.LGcs.AIcs.CLarXiv:2504.16828v52025
  24. The multi-armed bandit problem with covariates

    Vianney Perchet, Philippe Rigollet

    math.STcs.LGstat.MLarXiv:1110.6084v32011
  25. MemoryGraft: Persistent Compromise of LLM Agents via Poisoned Experience Retrieval

    Saksham Sahai Srivastava, Haoyu He

    cs.CRcs.AIcs.LGarXiv:2512.16962v12025
  26. Transformer Language Models without Positional Encodings Still Learn Positional Information

    Adi Haviv, Ori Ram, Ofir Press +2

    cs.CLcs.AIcs.LGarXiv:2203.16634v22022
  27. Aether: Geometric-Aware Unified World Modeling

    Aether Team, Haoyi Zhu, Yifan Wang +8

    cs.CVcs.AIcs.LGarXiv:2503.18945v32025
  28. R1-Omni: Explainable Omni-Multimodal Emotion Recognition with Reinforcement Learning

    Jiaxing Zhao, Xihan Wei, Liefeng Bo

    cs.LGcs.CVarXiv:2503.05379v22025
  29. Mostly Exploration-Free Algorithms for Contextual Bandits

    Hamsa Bastani, Mohsen Bayati, Khashayar Khosravi

    stat.MLcs.LGarXiv:1704.09011v82017
  30. SSP: Semantic Space Projection for Knowledge Graph Embedding with Text Descriptions

    Han Xiao, Minlie Huang, Xiaoyan Zhu

    cs.CLcs.LGarXiv:1604.04835v32016
  31. Stable Prediction across Unknown Environments

    Kun Kuang, Ruoxuan Xiong, Peng Cui +2

    cs.LGstat.MLarXiv:1806.06270v22018
  32. MCPTox: A Benchmark for Tool Poisoning Attack on Real-World MCP Servers

    Zhiqiang Wang, Yichao Gao, Yanting Wang +6

    cs.CRcs.LGarXiv:2508.14925v12025
  33. Class-Agnostic Counting

    Erika Lu, Weidi Xie, Andrew Zisserman

    cs.CVcs.LGarXiv:1811.00472v12018
  34. A Closer Look at Smoothness in Domain Adversarial Training

    Harsh Rangwani, Sumukh K Aithal, Mayank Mishra +2

    cs.LGcs.CVarXiv:2206.08213v12022
  35. GuardReasoner: Towards Reasoning-based LLM Safeguards

    Yue Liu, Hongcheng Gao, Shengfang Zhai +9

    cs.CRcs.AIcs.LGarXiv:2501.18492v22025
  36. The Road Less Scheduled

    Aaron Defazio, Xingyu Alice Yang, Harsh Mehta +3

    cs.LGcs.AImath.OCarXiv:2405.15682v42024
  37. OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting

    Xing Hu, Yuan Cheng, Dawei Yang +6

    cs.LGcs.AIarXiv:2501.13987v12025
  38. Learning Invariant Representations with Local Transformations

    Kihyuk Sohn, Honglak Lee

    cs.LGcs.CVstat.MLarXiv:1206.6418v12012
  39. Scaling up Masked Diffusion Models on Text

    Shen Nie, Fengqi Zhu, Chao Du +5

    cs.AIcs.CLcs.LGarXiv:2410.18514v32024
  40. DARTS-: Robustly Stepping out of Performance Collapse Without Indicators

    Xiangxiang Chu, Xiaoxing Wang, Bo Zhang +3

    cs.LGcs.AIcs.CVarXiv:2009.01027v22020
  41. Scaling Spatial Intelligence with Multimodal Foundation Models

    Zhongang Cai, Ruisi Wang, Chenyang Gu +26

    cs.CVcs.AIcs.LGarXiv:2511.13719v42025
  42. KAN-ODEs: Kolmogorov-Arnold Network Ordinary Differential Equations for Learning Dynamical Systems and Hidden Physics

    Benjamin C. Koenig, Suyong Kim, Sili Deng

    cs.LGarXiv:2407.04192v32024
  43. Understanding Reasoning in Thinking Language Models via Steering Vectors

    Constantin Venhoff, Iván Arcuschin, Philip Torr +2

    cs.LGcs.AIarXiv:2506.18167v42025
  44. What Can We Learn from Collective Human Opinions on Natural Language Inference Data?

    Yixin Nie, Xiang Zhou, Mohit Bansal

    cs.CLcs.AIcs.LGarXiv:2010.03532v22020
  45. CRAFT: Fine-Tuning Pre-hoc Explainability in AI-native 6G RAN

    Pranshav Gajjar, Vijay K Shah

    cs.LGarXiv:2609.00590v12026
  46. VLASH: Real-Time VLAs via Future-State-Aware Asynchronous Inference

    Jiaming Tang, Yufei Sun, Yilong Zhao +7

    cs.ROcs.AIcs.LGarXiv:2512.01031v22025
  47. Memento: Fine-tuning LLM Agents without Fine-tuning LLMs

    Huichi Zhou, Yihang Chen, Siyuan Guo +8

    cs.LGcs.CLarXiv:2508.16153v22025
  48. Guarantees for Spectral Clustering with Fairness Constraints

    Matthäus Kleindessner, Samira Samadi, Pranjal Awasthi +1

    stat.MLcs.DScs.LGarXiv:1901.08668v22019
  49. Neural Transfer Learning for Repairing Security Vulnerabilities in C Code

    Zimin Chen, Steve Kommrusch, Martin Monperrus

    cs.SEcs.CRcs.LGarXiv:2104.08308v32021
  50. One-Shot Object Detection with Co-Attention and Co-Excitation

    Ting-I Hsieh, Yi-Chen Lo, Hwann-Tzong Chen +1

    cs.CVcs.LGeess.IVarXiv:1911.12529v12019
  51. Differential Privacy for Functions and Functional Data

    Rob Hall, Alessandro Rinaldo, Larry Wasserman

    stat.MLcs.LGarXiv:1203.2570v12012
  52. Training Neural Machine Translation To Apply Terminology Constraints

    Georgiana Dinu, Prashant Mathur, Marcello Federico +1

    cs.CLcs.AIcs.LGarXiv:1906.01105v22019
  53. One-Pass AUC Optimization

    Wei Gao, Rong Jin, Shenghuo Zhu +1

    cs.LGarXiv:1305.1363v22013
  54. Learning from Failure: Training Debiased Classifier from Biased Classifier

    Junhyun Nam, Hyuntak Cha, Sungsoo Ahn +2

    cs.LGstat.MLarXiv:2007.02561v22020
  55. Spatio-Temporal Wind Speed Forecasting using Graph Networks and Novel Transformer Architectures

    Lars Ødegaard Bentsen, Narada Dilp Warakagoda, Roy Stenbro +1

    cs.LGcs.AIarXiv:2208.13585v22022
  56. S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models

    Muzhi Dai, Chenxu Yang, Qingyi Si

    cs.AIcs.LGarXiv:2505.07686v22025
  57. Zebra-CoT: A Dataset for Interleaved Vision Language Reasoning

    Ang Li, Charles Wang, Deqing Fu +9

    cs.CVcs.CLcs.LGarXiv:2507.16746v22025
  58. Coarse-Graining Auto-Encoders for Molecular Dynamics

    Wujie Wang, Rafael Gómez-Bombarelli

    physics.chem-phcs.LGstat.MLarXiv:1812.02706v22018
  59. Bayesian parameter estimation using conditional variational autoencoders for gravitational-wave astronomy

    Hunter Gabbard, Chris Messenger, Ik Siong Heng +2

    astro-ph.IMcs.LGgr-qcarXiv:1909.06296v42019
  60. How many images do I need? Understanding how sample size per class affects deep learning model performance metrics for balanced designs in autonomous wildlife monitoring

    Saleh Shahinfar, Paul Meek, Greg Falzon

    cs.CVcs.AIcs.LGarXiv:2010.08186v12020