Machine Learning
Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
3,961 to 4,020 of 20,221
Audio Spectrogram Representations for Processing with Convolutional Neural Networks
L. Wyse
cs.SDcs.LGcs.MMarXiv:1706.09559v12017Variance Reduction for Policy Gradient with Action-Dependent Factorized Baselines
Cathy Wu, Aravind Rajeswaran, Yan Duan +5
cs.LGcs.AIstat.MLarXiv:1803.07246v12018Modular Deep Recurrent Neural Network: Application to Quadrotors
Nima Mohajerin, Steven L. Waslander
cs.LGarXiv:2609.04339v12026Full Stack Optimization of Transformer Inference: a Survey
Sehoon Kim, Coleman Hooper, Thanakul Wattanawong +9
cs.CLcs.LGarXiv:2302.14017v12023Lost in Execution: On the Multilingual Robustness of Tool Calling in Large Language Models
Zheng Luo, T Pranav Kutralingam, Ogochukwu N Okoani +3
cs.CLcs.AIcs.LGarXiv:2601.05366v22026When Should We Introduce Safety Interventions During Pretraining?
Dylan Sam, Sachin Goyal, Pratyush Maini +2
cs.LGarXiv:2601.07087v22026A Long Short-Term Memory Recurrent Neural Network Framework for Network Traffic Matrix Prediction
Abdelhadi Azzouni, Guy Pujolle
cs.NIcs.LGarXiv:1705.05690v32017Understanding Domain Randomization for Sim-to-real Transfer
Xiaoyu Chen, Jiachen Hu, Chi Jin +2
cs.LGarXiv:2110.03239v22021Do People Engage Cognitively with AI? Impact of AI Assistance on Incidental Learning
Krzysztof Z. Gajos, Lena Mamykina
cs.HCcs.AIcs.LGarXiv:2202.05402v12022Meta-Tracker: Fast and Robust Online Adaptation for Visual Object Trackers
Eunbyung Park, Alexander C. Berg
cs.CVcs.LGarXiv:1801.03049v22018High Accuracy Android Malware Detection Using Ensemble Learning
Suleiman Y. Yerima, Sakir Sezer, Igor Muttik
cs.CRcs.LGarXiv:1608.00835v12016RadioDiff-Flux: Efficient Radio Map Construction via Generative Denoise Diffusion Model Trajectory Midpoint Reuse
Xiucheng Wang, Peilin Zheng, Honggang Jia +4
cs.LGeess.SParXiv:2601.02790v12026Semantic-Aware Implicit Neural Audio-Driven Video Portrait Generation
Xian Liu, Yinghao Xu, Qianyi Wu +3
cs.CVcs.GRcs.LGarXiv:2201.07786v12022Graph-Based Financial Fraud Detection with Calibrated Risk Scoring and Structural Regularization
Yunfei Nie, Jiawei Wang, Ruobing Yan +3
cs.LGarXiv:2605.12782v12026Breaking the Limit of Graph Neural Networks by Improving the Assortativity of Graphs with Local Mixing Patterns
Susheel Suresh, Vinith Budde, Jennifer Neville +2
cs.LGcs.SIarXiv:2106.06586v12021Long-Short Transformer: Efficient Transformers for Language and Vision
Chen Zhu, Wei Ping, Chaowei Xiao +4
cs.CVcs.CLcs.LGarXiv:2107.02192v32021Using DUCK-Net for Polyp Image Segmentation
Razvan-Gabriel Dumitru, Darius Peteleaza, Catalin Craciun
cs.CVcs.LGarXiv:2311.02239v12023Disentangling Task Conflicts in Multi-Task LoRA via Orthogonal Gradient Projection
Ziyu Yang, Guibin Chen, Yuxin Yang +2
cs.LGcs.AIcs.CLarXiv:2601.09684v12026Generative AI collective behavior needs an interactionist paradigm
Laura Ferrarotti, Gian Maria Campedelli, Roberto Dessì +7
cs.AIcs.CYcs.HCarXiv:2601.10567v12026Graph Anomaly Detection via Multi-Scale Contrastive Learning Networks with Augmented View
Jingcan Duan, Siwei Wang, Pei Zhang +5
cs.LGarXiv:2212.00535v22022Learning with Confident Examples: Rank Pruning for Robust Classification with Noisy Labels
Curtis G. Northcutt, Tailin Wu, Isaac L. Chuang
stat.MLcs.LGarXiv:1705.01936v32017DevBench: A Realistic, Developer-Informed Benchmark for Code Generation Models
Adarsh Kumarappan, Pareesa Ameneh Golnari, Wen Wen +5
cs.LGcs.AIcs.SEarXiv:2601.11895v32026Boundary-Seeking Generative Adversarial Networks
R Devon Hjelm, Athul Paul Jacob, Tong Che +3
stat.MLcs.LGarXiv:1702.08431v42017RMDL: Random Multimodel Deep Learning for Classification
Kamran Kowsari, Mojtaba Heidarysafa, Donald E. Brown +2
cs.LGcs.AIcs.CVarXiv:1805.01890v22018Reinforcement Learning for Quantum Technology
Marin Bukov, Florian Marquardt
quant-phcond-mat.quant-gascond-mat.stat-mecharXiv:2601.18953v12026Self-Attention Between Datapoints: Going Beyond Individual Input-Output Pairs in Deep Learning
Jannik Kossen, Neil Band, Clare Lyle +3
cs.LGstat.MLarXiv:2106.02584v22021WHEN FLUE MEETS FLANG: Benchmarks and Large Pre-trained Language Model for Financial Domain
Raj Sanjay Shah, Kunal Chawla, Dheeraj Eidnani +7
cs.CLcs.AIcs.LGarXiv:2211.00083v12022MM-OpenFGL: A Comprehensive Benchmark for Multimodal Federated Graph Learning
Xunkai Li, Yuming Ai, Yinlin Zhu +7
cs.LGarXiv:2601.22416v12026Interpretation of Natural Language Rules in Conversational Machine Reading
Marzieh Saeidi, Max Bartolo, Patrick Lewis +5
cs.CLcs.LGstat.MLarXiv:1809.01494v12018Detecting and interpreting myocardial infarction using fully convolutional neural networks
Nils Strodthoff, Claas Strodthoff
cs.CYcs.LGstat.MLarXiv:1806.07385v22018Diverse mini-batch Active Learning
Fedor Zhdanov
cs.LGstat.MLarXiv:1901.05954v12019InceptionGCN: Receptive Field Aware Graph Convolutional Network for Disease Prediction
Anees Kazi, Shayan shekarforoush, S. Arvind krishna +6
cs.LGstat.MLarXiv:1903.04233v12019Few-Shot Learning with Localization in Realistic Settings
Davis Wertheimer, Bharath Hariharan
cs.CVcs.AIcs.LGarXiv:1904.08502v22019Context-Aware Convolutional Neural Network for Grading of Colorectal Cancer Histology Images
Muhammad Shaban, Ruqayya Awan, Muhammad Moazam Fraz +3
eess.IVcs.LGstat.MLarXiv:1907.09478v12019RubRIX: Rubric-Driven Risk Mitigation in Caregiver-AI Interactions
Drishti Goel, Jeongah Lee, Qiuyue Joy Zhong +5
cs.HCcs.AIcs.CLarXiv:2601.13235v12026Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow
Yangyang Zhong, Yanmei Gu, Zhengqing Zang +14
cs.CLcs.AIcs.LGarXiv:2601.15593v22026SpiralFormer: Looped Transformers Can Learn Hierarchical Dependencies via Multi-Resolution Recursion
Chengting Yu, Xiaobo Shu, Yadao Wang +8
cs.LGarXiv:2602.11698v22026Scaling Deep Contrastive Learning Batch Size under Memory Limited Setup
Luyu Gao, Yunyi Zhang, Jiawei Han +1
cs.LGcs.CLcs.IRarXiv:2101.06983v22021Covariance Matrix Adaptation for the Rapid Illumination of Behavior Space
Matthew C. Fontaine, Julian Togelius, Stefanos Nikolaidis +1
cs.LGstat.MLarXiv:1912.02400v22019If Influence Functions are the Answer, Then What is the Question?
Juhan Bae, Nathan Ng, Alston Lo +2
cs.LGstat.MLarXiv:2209.05364v12022MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models
Yang Shi, Yifeng Xie, Minzhe Guo +6
cs.CVcs.AIcs.LGarXiv:2601.03331v22026Anomaly Detection in Dynamic Graphs via Transformer
Yixin Liu, Shirui Pan, Yu Guang Wang +4
cs.LGarXiv:2106.09876v22021Probability-Entropy Calibration: An Elastic Indicator for Adaptive Fine-tuning
Wenhao Yu, Shaohang Wei, Jiahong Liu +5
cs.LGcs.AIarXiv:2602.01745v22026The Robust Manifold Defense: Adversarial Training using Generative Models
Ajil Jalal, Andrew Ilyas, Constantinos Daskalakis +1
cs.CVcs.CRcs.LGarXiv:1712.09196v52017Match-SRNN: Modeling the Recursive Matching Structure with Spatial RNN
Shengxian Wan, Yanyan Lan, Jun Xu +3
cs.CLcs.AIcs.LGarXiv:1604.04378v12016SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
Chuhan Wang, Xintong Li, Jennifer Yuntong Zhang +5
cs.CVcs.CLcs.LGarXiv:2601.05600v12026Beyond Precision: Training-Inference Mismatch is an Optimization Problem and Simple LR Scheduling Fixes It
Yaxiang Zhang, Yingru Li, Jiacai Liu +4
cs.LGcs.AIarXiv:2602.01826v12026SpinalNet: Deep Neural Network with Gradual Input
H M Dipu Kabir, Moloud Abdar, Seyed Mohammad Jafar Jalali +4
cs.CVcs.LGcs.NEarXiv:2007.03347v32020Unsupervised Anomaly Localization using Variational Auto-Encoders
David Zimmerer, Fabian Isensee, Jens Petersen +2
cs.LGeess.IVstat.MLarXiv:1907.02796v22019NextMem: Towards Latent Factual Memory for LLM-based Agents
Zeyu Zhang, Rui Li, Xiaoyan Zhao +4
cs.AIcs.IRcs.LGarXiv:2603.15634v12026Channel-Aware Adversarial Attacks Against Deep Learning-Based Wireless Signal Classifiers
Brian Kim, Yalin E. Sagduyu, Kemal Davaslioglu +2
eess.SPcs.LGcs.NIarXiv:2005.05321v32020Small Language Models: Survey, Measurements, and Insights
Zhenyan Lu, Xiang Li, Dongqi Cai +5
cs.CLcs.AIcs.LGarXiv:2409.15790v32024Nested Slice Sampling: Vectorized Nested Sampling for GPU-Accelerated Inference
David Yallup, Namu Kroupa, Will Handley
stat.COcs.LGstat.MLarXiv:2601.23252v22026Do Latent-CoT Models Think Step-by-Step? A Mechanistic Study on Sequential Reasoning Tasks
Jia Liang, Liangming Pan
cs.AIcs.LGarXiv:2602.00449v12026Inductive Biases and Variable Creation in Self-Attention Mechanisms
Benjamin L. Edelman, Surbhi Goel, Sham Kakade +1
cs.LGstat.MLarXiv:2110.10090v22021Penalizing Gradient Norm for Efficiently Improving Generalization in Deep Learning
Yang Zhao, Hao Zhang, Xiuyuan Hu
cs.LGcs.AIarXiv:2202.03599v32022Between Pure and Approximate Differential Privacy
Thomas Steinke, Jonathan Ullman
cs.DScs.CRcs.LGarXiv:1501.06095v12015NeRS: Neural Reflectance Surfaces for Sparse-view 3D Reconstruction in the Wild
Jason Y. Zhang, Gengshan Yang, Shubham Tulsiani +1
cs.CVcs.LGarXiv:2110.07604v32021Training verified learners with learned verifiers
Krishnamurthy Dvijotham, Sven Gowal, Robert Stanforth +4
cs.LGstat.MLarXiv:1805.10265v22018Online 3D Bin Packing with Constrained Deep Reinforcement Learning
Hang Zhao, Qijin She, Chenyang Zhu +2
cs.LGstat.MLarXiv:2006.14978v52020