Machine Learning
Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
6,301 to 6,360 of 20,193
MiMo: Unlocking the Reasoning Potential of Language Model -- From Pretraining to Posttraining
LLM-Core Xiaomi, :, Bingquan Xia +62
cs.CLcs.AIcs.LGarXiv:2505.07608v22025Large-Scale Multilingual Speech Recognition with a Streaming End-to-End Model
Anjuli Kannan, Arindrima Datta, Tara N. Sainath +6
eess.AScs.LGcs.SDarXiv:1909.05330v12019Combining Deep Reinforcement Learning and Search for Imperfect-Information Games
Noam Brown, Anton Bakhtin, Adam Lerer +1
cs.GTcs.AIcs.LGarXiv:2007.13544v22020Back to the Drawing Board: A Critical Evaluation of Poisoning Attacks on Production Federated Learning
Virat Shejwalkar, Amir Houmansadr, Peter Kairouz +1
cs.LGcs.CRcs.DCarXiv:2108.10241v22021Swin Transformer: Hierarchical Vision Transformer using Shifted Windows
Ze Liu, Yutong Lin, Yue Cao +5
cs.CVcs.LGarXiv:2103.14030v22021DeepSpeed Inference: Enabling Efficient Inference of Transformer Models at Unprecedented Scale
Reza Yazdani Aminabadi, Samyam Rajbhandari, Minjia Zhang +8
cs.LGcs.DCcs.PFarXiv:2207.00032v12022Evaluation of Neural Architectures Trained with Square Loss vs Cross-Entropy in Classification Tasks
Like Hui, Mikhail Belkin
cs.LGstat.MLarXiv:2006.07322v52020Fair k-Center Clustering for Data Summarization
Matthäus Kleindessner, Pranjal Awasthi, Jamie Morgenstern
stat.MLcs.DScs.LGarXiv:1901.08628v22019SBERT-WK: A Sentence Embedding Method by Dissecting BERT-based Word Models
Bin Wang, C. -C. Jay Kuo
cs.CLcs.LGcs.MMarXiv:2002.06652v22020Multivariate Industrial Time Series with Cyber-Attack Simulation: Fault Detection Using an LSTM-based Predictive Data Model
Pavel Filonov, Andrey Lavrentyev, Artem Vorontsov
cs.LGstat.MLarXiv:1612.06676v22016An Unsupervised Sentence Embedding Method by Mutual Information Maximization
Yan Zhang, Ruidan He, Zuozhu Liu +2
cs.CLcs.LGarXiv:2009.12061v22020Competence-based Multimodal Curriculum Learning for Medical Report Generation
Fenglin Liu, Shen Ge, Yuexian Zou +1
cs.CLcs.CVcs.LGarXiv:2206.14579v32022Graph Neural News Recommendation with Long-term and Short-term Interest Modeling
Linmei Hu, Chen Li, Chuan Shi +2
cs.IRcs.CLcs.LGarXiv:1910.14025v22019Diffusion Adversarial Post-Training for One-Step Video Generation
Shanchuan Lin, Xin Xia, Yuxi Ren +3
cs.CVcs.AIcs.LGarXiv:2501.08316v32025Discriminative Active Learning
Daniel Gissin, Shai Shalev-Shwartz
cs.LGstat.MLarXiv:1907.06347v12019Reinforcement-Learning based Portfolio Management with Augmented Asset Movement Prediction States
Yunan Ye, Hengzhi Pei, Boxin Wang +4
q-fin.PMcs.LGstat.MLarXiv:2002.05780v12020EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos
Ruihan Yang, Qinxi Yu, Yecheng Wu +12
cs.ROcs.AIcs.CVarXiv:2507.12440v32025Hamiltonian Graph Networks with ODE Integrators
Alvaro Sanchez-Gonzalez, Victor Bapst, Kyle Cranmer +1
cs.LGphysics.comp-pharXiv:1909.12790v12019Open Set Domain Adaptation: Theoretical Bound and Algorithm
Zhen Fang, Jie Lu, Feng Liu +2
cs.LGstat.MLarXiv:1907.08375v22019Transolver++: An Accurate Neural Solver for PDEs on Million-Scale Geometries
Huakun Luo, Haixu Wu, Hang Zhou +4
cs.LGarXiv:2502.02414v22025Stability and Generalization of Learning Algorithms that Converge to Global Optima
Zachary Charles, Dimitris Papailiopoulos
stat.MLcs.ITcs.LGarXiv:1710.08402v12017Dynamic Chunking for End-to-End Hierarchical Sequence Modeling
Sukjun Hwang, Brandon Wang, Albert Gu
cs.LGarXiv:2507.07955v22025Process Reward Models That Think
Muhammad Khalifa, Rishabh Agarwal, Lajanugen Logeswaran +5
cs.LGcs.AIcs.CLarXiv:2504.16828v52025The multi-armed bandit problem with covariates
Vianney Perchet, Philippe Rigollet
math.STcs.LGstat.MLarXiv:1110.6084v32011MemoryGraft: Persistent Compromise of LLM Agents via Poisoned Experience Retrieval
Saksham Sahai Srivastava, Haoyu He
cs.CRcs.AIcs.LGarXiv:2512.16962v12025Transformer Language Models without Positional Encodings Still Learn Positional Information
Adi Haviv, Ori Ram, Ofir Press +2
cs.CLcs.AIcs.LGarXiv:2203.16634v22022Aether: Geometric-Aware Unified World Modeling
Aether Team, Haoyi Zhu, Yifan Wang +8
cs.CVcs.AIcs.LGarXiv:2503.18945v32025R1-Omni: Explainable Omni-Multimodal Emotion Recognition with Reinforcement Learning
Jiaxing Zhao, Xihan Wei, Liefeng Bo
cs.LGcs.CVarXiv:2503.05379v22025Mostly Exploration-Free Algorithms for Contextual Bandits
Hamsa Bastani, Mohsen Bayati, Khashayar Khosravi
stat.MLcs.LGarXiv:1704.09011v82017SSP: Semantic Space Projection for Knowledge Graph Embedding with Text Descriptions
Han Xiao, Minlie Huang, Xiaoyan Zhu
cs.CLcs.LGarXiv:1604.04835v32016Stable Prediction across Unknown Environments
Kun Kuang, Ruoxuan Xiong, Peng Cui +2
cs.LGstat.MLarXiv:1806.06270v22018MCPTox: A Benchmark for Tool Poisoning Attack on Real-World MCP Servers
Zhiqiang Wang, Yichao Gao, Yanting Wang +6
cs.CRcs.LGarXiv:2508.14925v12025Class-Agnostic Counting
Erika Lu, Weidi Xie, Andrew Zisserman
cs.CVcs.LGarXiv:1811.00472v12018A Closer Look at Smoothness in Domain Adversarial Training
Harsh Rangwani, Sumukh K Aithal, Mayank Mishra +2
cs.LGcs.CVarXiv:2206.08213v12022GuardReasoner: Towards Reasoning-based LLM Safeguards
Yue Liu, Hongcheng Gao, Shengfang Zhai +9
cs.CRcs.AIcs.LGarXiv:2501.18492v22025The Road Less Scheduled
Aaron Defazio, Xingyu Alice Yang, Harsh Mehta +3
cs.LGcs.AImath.OCarXiv:2405.15682v42024OstQuant: Refining Large Language Model Quantization with Orthogonal and Scaling Transformations for Better Distribution Fitting
Xing Hu, Yuan Cheng, Dawei Yang +6
cs.LGcs.AIarXiv:2501.13987v12025Learning Invariant Representations with Local Transformations
Kihyuk Sohn, Honglak Lee
cs.LGcs.CVstat.MLarXiv:1206.6418v12012Scaling up Masked Diffusion Models on Text
Shen Nie, Fengqi Zhu, Chao Du +5
cs.AIcs.CLcs.LGarXiv:2410.18514v32024DARTS-: Robustly Stepping out of Performance Collapse Without Indicators
Xiangxiang Chu, Xiaoxing Wang, Bo Zhang +3
cs.LGcs.AIcs.CVarXiv:2009.01027v22020Scaling Spatial Intelligence with Multimodal Foundation Models
Zhongang Cai, Ruisi Wang, Chenyang Gu +26
cs.CVcs.AIcs.LGarXiv:2511.13719v42025KAN-ODEs: Kolmogorov-Arnold Network Ordinary Differential Equations for Learning Dynamical Systems and Hidden Physics
Benjamin C. Koenig, Suyong Kim, Sili Deng
cs.LGarXiv:2407.04192v32024Understanding Reasoning in Thinking Language Models via Steering Vectors
Constantin Venhoff, Iván Arcuschin, Philip Torr +2
cs.LGcs.AIarXiv:2506.18167v42025What Can We Learn from Collective Human Opinions on Natural Language Inference Data?
Yixin Nie, Xiang Zhou, Mohit Bansal
cs.CLcs.AIcs.LGarXiv:2010.03532v22020CRAFT: Fine-Tuning Pre-hoc Explainability in AI-native 6G RAN
Pranshav Gajjar, Vijay K Shah
cs.LGarXiv:2609.00590v12026VLASH: Real-Time VLAs via Future-State-Aware Asynchronous Inference
Jiaming Tang, Yufei Sun, Yilong Zhao +7
cs.ROcs.AIcs.LGarXiv:2512.01031v22025Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
Huichi Zhou, Yihang Chen, Siyuan Guo +8
cs.LGcs.CLarXiv:2508.16153v22025Guarantees for Spectral Clustering with Fairness Constraints
Matthäus Kleindessner, Samira Samadi, Pranjal Awasthi +1
stat.MLcs.DScs.LGarXiv:1901.08668v22019Neural Transfer Learning for Repairing Security Vulnerabilities in C Code
Zimin Chen, Steve Kommrusch, Martin Monperrus
cs.SEcs.CRcs.LGarXiv:2104.08308v32021One-Shot Object Detection with Co-Attention and Co-Excitation
Ting-I Hsieh, Yi-Chen Lo, Hwann-Tzong Chen +1
cs.CVcs.LGeess.IVarXiv:1911.12529v12019Differential Privacy for Functions and Functional Data
Rob Hall, Alessandro Rinaldo, Larry Wasserman
stat.MLcs.LGarXiv:1203.2570v12012Training Neural Machine Translation To Apply Terminology Constraints
Georgiana Dinu, Prashant Mathur, Marcello Federico +1
cs.CLcs.AIcs.LGarXiv:1906.01105v22019One-Pass AUC Optimization
Wei Gao, Rong Jin, Shenghuo Zhu +1
cs.LGarXiv:1305.1363v22013Learning from Failure: Training Debiased Classifier from Biased Classifier
Junhyun Nam, Hyuntak Cha, Sungsoo Ahn +2
cs.LGstat.MLarXiv:2007.02561v22020Spatio-Temporal Wind Speed Forecasting using Graph Networks and Novel Transformer Architectures
Lars Ødegaard Bentsen, Narada Dilp Warakagoda, Roy Stenbro +1
cs.LGcs.AIarXiv:2208.13585v22022S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models
Muzhi Dai, Chenxu Yang, Qingyi Si
cs.AIcs.LGarXiv:2505.07686v22025Zebra-CoT: A Dataset for Interleaved Vision Language Reasoning
Ang Li, Charles Wang, Deqing Fu +9
cs.CVcs.CLcs.LGarXiv:2507.16746v22025Coarse-Graining Auto-Encoders for Molecular Dynamics
Wujie Wang, Rafael Gómez-Bombarelli
physics.chem-phcs.LGstat.MLarXiv:1812.02706v22018Bayesian parameter estimation using conditional variational autoencoders for gravitational-wave astronomy
Hunter Gabbard, Chris Messenger, Ik Siong Heng +2
astro-ph.IMcs.LGgr-qcarXiv:1909.06296v42019How many images do I need? Understanding how sample size per class affects deep learning model performance metrics for balanced designs in autonomous wildlife monitoring
Saleh Shahinfar, Paul Meek, Greg Falzon
cs.CVcs.AIcs.LGarXiv:2010.08186v12020