Machine Learning
Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
5,641 to 5,700 of 19,988
Text Capability Loss in Vision-Language Adaptation: An Attention-Sink Diagnosis
Minsik Choi, Geewook Kim, Young Geun Kim
cs.LGarXiv:2609.00746v12026Web Price Extraction: State of the Art and an Adaptive Browserless Implementation
Evgeniia Kositsyna, Jorge Lloret-Gazo
cs.IRcs.LGcs.NEarXiv:2609.01030v12026A Bayesian Sampling Approach to Exploration in Reinforcement Learning
John Asmuth, Lihong Li, Michael L. Littman +2
cs.LGarXiv:1205.2664v12012Learning Optimal and Fair Decision Trees for Non-Discriminative Decision-Making
Sina Aghaei, Mohammad Javad Azizi, Phebe Vayanos
cs.LGstat.MLarXiv:1903.10598v12019VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
Siyu Xu, Yunke Wang, Chenghao Xia +3
cs.ROcs.CVcs.LGarXiv:2502.02175v22025Energy Considerations of Large Language Model Inference and Efficiency Optimizations
Jared Fernandez, Clara Na, Vashisth Tiwari +3
cs.CLcs.LGarXiv:2504.17674v12025Adapting Auxiliary Losses Using Gradient Similarity
Yunshu Du, Wojciech M. Czarnecki, Siddhant M. Jayakumar +3
stat.MLcs.LGarXiv:1812.02224v22018SpecReason: Fast and Accurate Inference-Time Compute via Speculative Reasoning
Rui Pan, Yinwei Dai, Zhihao Zhang +3
cs.LGcs.AIarXiv:2504.07891v22025DMCP: Differentiable Markov Channel Pruning for Neural Networks
Shaopeng Guo, Yujie Wang, Quanquan Li +1
cs.CVcs.LGarXiv:2005.03354v22020Scaling Video Analytics on Constrained Edge Nodes
Christopher Canel, Thomas Kim, Giulio Zhou +5
cs.CVcs.LGcs.PFarXiv:1905.13536v12019Energy-Based Learning for Scene Graph Generation
Mohammed Suhail, Abhay Mittal, Behjat Siddiquie +4
cs.CVcs.LGarXiv:2103.02221v12021SEAgent: Self-Evolving Computer Use Agent with Autonomous Learning from Experience
Zeyi Sun, Ziyu Liu, Yuhang Zang +5
cs.AIcs.CLcs.CVarXiv:2508.04700v22025Matched Queries for Curvature and Density at Branching Junctions
Ziqi Zhao, Qingjian Ni
stat.MLcs.LGarXiv:2609.01319v12026Tunable Efficient Unitary Neural Networks (EUNN) and their application to RNNs
Li Jing, Yichen Shen, Tena Dubček +5
cs.LGcs.NEstat.MLarXiv:1612.05231v32016OverThink: Slowdown Attacks on Reasoning LLMs
Abhinav Kumar, Jaechul Roh, Ali Naseh +4
cs.LGcs.CRarXiv:2502.02542v42025AdaMuon: Adaptive Muon Optimizer
Chongjie Si, Debing Zhang, Wei Shen
cs.LGarXiv:2507.11005v32025Natural Neural Networks
Guillaume Desjardins, Karen Simonyan, Razvan Pascanu +1
stat.MLcs.LGcs.NEarXiv:1507.00210v12015Fair Diffusion: Instructing Text-to-Image Generation Models on Fairness
Felix Friedrich, Manuel Brack, Lukas Struppek +4
cs.LGcs.AIcs.CVarXiv:2302.10893v32023Quantum Sparse Autoencoders for Q-Matrix Estimation in Cognitive Diagnosis
Arif Hassan Zidan, Yi Pan, Bowen Guo +5
cs.LGarXiv:2609.01537v12026HarmoCore: Functional Latent Diffusion for Sparse Reconstruction of Oscillatory Wave Fields
Lihao Chen, Xinyu Zhang, Panqi Chen +4
cs.LGcs.CEarXiv:2609.00679v12026MM-Spatial: Exploring 3D Spatial Understanding in Multimodal LLMs
Erik Daxberger, Nina Wenzel, David Griffiths +8
cs.CVcs.CLcs.LGarXiv:2503.13111v22025Radial Attention: $O(n\log n)$ Sparse Attention with Energy Decay for Long Video Generation
Xingyang Li, Muyang Li, Tianle Cai +11
cs.CVcs.AIcs.LGarXiv:2506.19852v22025Rethinking Learnability in Offline Data-driven Optimization
Chao Qian, Chen-Guang Wang, Rong-Xi Tan +1
cs.LGcs.AIcs.NEarXiv:2609.01493v22026What's Behind PPO's Collapse in Long-CoT? Value Optimization Holds the Secret
Yufeng Yuan, Yu Yue, Ruofei Zhu +2
cs.LGarXiv:2503.01491v12025Estimation from Pairwise Comparisons: Sharp Minimax Bounds with Topology Dependence
Nihar B. Shah, Sivaraman Balakrishnan, Joseph Bradley +3
cs.LGcs.ITstat.MLarXiv:1505.01462v12015Fully Parameterized Quantile Function for Distributional Reinforcement Learning
Derek Yang, Li Zhao, Zichuan Lin +3
cs.LGcs.AIstat.MLarXiv:1911.02140v32019A survey of algorithmic recourse: definitions, formulations, solutions, and prospects
Amir-Hossein Karimi, Gilles Barthe, Bernhard Schölkopf +1
cs.LGcs.AIstat.MLarXiv:2010.04050v22020ReasonIR: Training Retrievers for Reasoning Tasks
Rulin Shao, Rui Qiao, Varsha Kishore +8
cs.AIcs.CLcs.IRarXiv:2504.20595v12025TxGemma: Efficient and Agentic LLMs for Therapeutics
Eric Wang, Samuel Schmidgall, Paul F. Jaeger +6
cs.AIcs.CLcs.LGarXiv:2504.06196v12025Learn-by-interact: A Data-Centric Framework for Self-Adaptive Agents in Realistic Environments
Hongjin Su, Ruoxi Sun, Jinsung Yoon +3
cs.LGcs.AIarXiv:2501.10893v12025Gluon: Making Muon & Scion Great Again! (Bridging Theory and Practice of LMO-based Optimizers for LLMs)
Artem Riabinin, Egor Shulgin, Kaja Gruntkowska +1
cs.LGmath.OCstat.MLarXiv:2505.13416v12025Adversarial Laser Beam: Effective Physical-World Attack to DNNs in a Blink
Ranjie Duan, Xiaofeng Mao, A. K. Qin +4
cs.LGcs.AIcs.CRarXiv:2103.06504v12021MINE: Towards Continuous Depth MPI with NeRF for Novel View Synthesis
Jiaxin Li, Zijian Feng, Qi She +3
cs.CVcs.GRcs.LGarXiv:2103.14910v32021Self-Training Elicits Concise Reasoning in Large Language Models
Tergel Munkhbat, Namgyu Ho, Seo Hyun Kim +3
cs.CLcs.AIcs.LGarXiv:2502.20122v32025Voice Separation with an Unknown Number of Multiple Speakers
Eliya Nachmani, Yossi Adi, Lior Wolf
eess.AScs.LGcs.SDarXiv:2003.01531v42020Vision-Language-Guided Pseudo-Labels for Unsupervised Domain Adaptation in Semantic Segmentation for Waste Sorting
Udo Schlegel, Shubhangi, Gabriel Dax +3
cs.CVcs.AIcs.LGarXiv:2609.00898v12026Missing Data Imputation using Optimal Transport
Boris Muzellec, Julie Josse, Claire Boyer +1
stat.MLcs.LGarXiv:2002.03860v32020PaSa: An LLM Agent for Comprehensive Academic Paper Search
Yichen He, Guanhua Huang, Peiyuan Feng +4
cs.IRcs.LGarXiv:2501.10120v22025Solving Schrödinger Bridges via Maximum Likelihood
Francisco Vargas, Pierre Thodoroff, Neil D. Lawrence +1
stat.MLcs.LGarXiv:2106.02081v92021FlowDPS: Flow-Driven Posterior Sampling for Inverse Problems
Jeongsol Kim, Bryan Sangwoo Kim, Jong Chul Ye
cs.CVcs.AIcs.LGarXiv:2503.08136v12025Transformers are Graph Neural Networks
Chaitanya K. Joshi
cs.LGcs.AIarXiv:2506.22084v12025Learning with Good Feature Representations in Bandits and in RL with a Generative Model
Tor Lattimore, Csaba Szepesvari, Gellert Weisz
stat.MLcs.LGarXiv:1911.07676v22019AgentRewardBench: Evaluating Automatic Evaluations of Web Agent Trajectories
Xing Han Lù, Amirhossein Kazemnejad, Nicholas Meade +7
cs.LGcs.AIcs.CLarXiv:2504.08942v22025Real-time Traffic Accident Risk Prediction based on Frequent Pattern Tree
Lei Lin, Qian Wang, Adel W. Sadek
stat.APcs.LGarXiv:1701.05691v22017RL-100: Performant Robotic Manipulation with Real-World Reinforcement Learning
Kun Lei, Huanyu Li, Dongjie Yu +6
cs.ROcs.AIcs.LGarXiv:2510.14830v42025Machine Learning with Knowledge Constraints for Process Optimization of Open-Air Perovskite Solar Cell Manufacturing
Zhe Liu, Nicholas Rolston, Austin C. Flick +4
cs.LGphysics.app-pharXiv:2110.01387v42021Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting
Howard Chen, Noam Razin, Karthik Narasimhan +1
cs.LGcs.CLarXiv:2510.18874v32025Learning to Predict the Cosmological Structure Formation
Siyu He, Yin Li, Yu Feng +4
astro-ph.COcs.AIcs.LGarXiv:1811.06533v22018Reasoning-SQL: Reinforcement Learning with SQL Tailored Partial Rewards for Reasoning-Enhanced Text-to-SQL
Mohammadreza Pourreza, Shayan Talaei, Ruoxi Sun +5
cs.LGcs.AIcs.DBarXiv:2503.23157v22025GPT Takes the Bar Exam
Michael Bommarito, Daniel Martin Katz
cs.CLcs.AIcs.LGarXiv:2212.14402v12022From Pixels to Torques: Policy Learning with Deep Dynamical Models
Niklas Wahlström, Thomas B. Schön, Marc Peter Deisenroth
stat.MLcs.LGcs.ROarXiv:1502.02251v32015LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs
Yunhui Xia, Wei Shen, Yan Wang +5
cs.LGcs.CLcs.SEarXiv:2504.14655v12025A PSO and Pattern Search based Memetic Algorithm for SVMs Parameters Optimization
Yukun Bao, Zhongyi Hu, Tao Xiong
cs.LGcs.AIcs.NEarXiv:1401.1926v12014StreamRL: Scalable, Heterogeneous, and Elastic RL for LLMs with Disaggregated Stream Generation
Yinmin Zhong, Zili Zhang, Xiaoniu Song +11
cs.LGcs.DCarXiv:2504.15930v12025CAMEL: A Weakly Supervised Learning Framework for Histopathology Image Segmentation
Gang Xu, Zhigang Song, Zhuo Sun +6
eess.IVcs.CVcs.LGarXiv:1908.10555v12019Quad-networks: unsupervised learning to rank for interest point detection
Nikolay Savinov, Akihito Seki, Lubor Ladicky +2
cs.CVcs.LGcs.NEarXiv:1611.07571v22016TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators
Jianling Li, Shangzhan Li, Zhenye Gao +9
cs.CLcs.LGarXiv:2502.14752v12025Federated Neural Collaborative Filtering
Vasileios Perifanis, Pavlos S. Efraimidis
cs.IRcs.CRcs.LGarXiv:2106.04405v22021Knowledge Graph Embedding: A Survey from the Perspective of Representation Spaces
Jiahang Cao, Jinyuan Fang, Zaiqiao Meng +1
cs.LGcs.AIcs.CLarXiv:2211.03536v22022On the Adversarial Robustness of Multi-Modal Foundation Models
Christian Schlarmann, Matthias Hein
cs.LGcs.AIcs.CRarXiv:2308.10741v12023