Machine Learning

Papers filed under cs.LG on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

13,441 to 13,500 of 20,219

  1. Document Embedding with Paragraph Vectors

    Andrew M. Dai, Christopher Olah, Quoc V. Le

    cs.CLcs.AIcs.LGarXiv:1507.07998v12015
  2. Achieving Open Vocabulary Neural Machine Translation with Hybrid Word-Character Models

    Minh-Thang Luong, Christopher D. Manning

    cs.CLcs.LGarXiv:1604.00788v22016
  3. Evaluating Explainable AI: Which Algorithmic Explanations Help Users Predict Model Behavior?

    Peter Hase, Mohit Bansal

    cs.CLcs.AIcs.LGarXiv:2005.01831v12020
  4. A3T-GCN: Attention Temporal Graph Convolutional Network for Traffic Forecasting

    Jiawei Zhu, Yujiao Song, Ling Zhao +1

    cs.LGstat.MLarXiv:2006.11583v12020
  5. Opponent Modeling in Deep Reinforcement Learning

    He He, Jordan Boyd-Graber, Kevin Kwok +1

    cs.LGarXiv:1609.05559v12016
  6. A Convex Framework for Fair Regression

    Richard Berk, Hoda Heidari, Shahin Jabbari +5

    cs.LGstat.MLarXiv:1706.02409v12017
  7. Scalable Methods for 8-bit Training of Neural Networks

    Ron Banner, Itay Hubara, Elad Hoffer +1

    cs.LGstat.MLarXiv:1805.11046v32018
  8. Multi-Agent Reinforcement Learning is a Sequence Modeling Problem

    Muning Wen, Jakub Grudzien Kuba, Runji Lin +4

    cs.MAcs.LGarXiv:2205.14953v32022
  9. RealFusion: 360° Reconstruction of Any Object from a Single Image

    Luke Melas-Kyriazi, Christian Rupprecht, Iro Laina +1

    cs.CVcs.AIcs.LGarXiv:2302.10663v22023
  10. Your Diffusion Model is Secretly a Zero-Shot Classifier

    Alexander C. Li, Mihir Prabhudesai, Shivam Duggal +2

    cs.LGcs.AIcs.CVarXiv:2303.16203v32023
  11. DeepCAD: A Deep Generative Network for Computer-Aided Design Models

    Rundi Wu, Chang Xiao, Changxi Zheng

    cs.CVcs.GRcs.LGarXiv:2105.09492v22021
  12. CityFlow: A Multi-Agent Reinforcement Learning Environment for Large Scale City Traffic Scenario

    Huichu Zhang, Siyuan Feng, Chang Liu +7

    cs.MAcs.LGarXiv:1905.05217v12019
  13. Pre-training Enhanced Spatial-temporal Graph Neural Network for Multivariate Time Series Forecasting

    Zezhi Shao, Zhao Zhang, Fei Wang +1

    cs.LGarXiv:2206.09113v22022
  14. DeepCas: an End-to-end Predictor of Information Cascades

    Cheng Li, Jiaqi Ma, Xiaoxiao Guo +1

    cs.SIcs.LGarXiv:1611.05373v12016
  15. Just Interpolate: Kernel "Ridgeless" Regression Can Generalize

    Tengyuan Liang, Alexander Rakhlin

    math.STcs.LGstat.MLarXiv:1808.00387v22018
  16. Learning Task-Oriented Communication for Edge Inference: An Information Bottleneck Approach

    Jiawei Shao, Yuyi Mao, Jun Zhang

    eess.SPcs.LGarXiv:2102.04170v32021
  17. On Completeness-aware Concept-Based Explanations in Deep Neural Networks

    Chih-Kuan Yeh, Been Kim, Sercan O. Arik +3

    cs.LGstat.MLarXiv:1910.07969v62019
  18. Sparse Networks from Scratch: Faster Training without Losing Performance

    Tim Dettmers, Luke Zettlemoyer

    cs.LGcs.NEstat.MLarXiv:1907.04840v22019
  19. Poseidon: An Efficient Communication Architecture for Distributed Deep Learning on GPU Clusters

    Hao Zhang, Zeyu Zheng, Shizhen Xu +7

    cs.LGcs.CVcs.DCarXiv:1706.03292v12017
  20. GAMENet: Graph Augmented MEmory Networks for Recommending Medication Combination

    Junyuan Shang, Cao Xiao, Tengfei Ma +2

    cs.AIcs.LGstat.MLarXiv:1809.01852v32018
  21. The Design Space of E(3)-Equivariant Atom-Centered Interatomic Potentials

    Ilyes Batatia, Simon Batzner, Dávid Péter Kovács +6

    stat.MLcond-mat.mtrl-scics.LGarXiv:2205.06643v22022
  22. Social Biases in NLP Models as Barriers for Persons with Disabilities

    Ben Hutchinson, Vinodkumar Prabhakaran, Emily Denton +3

    cs.CLcs.AIcs.LGarXiv:2005.00813v12020
  23. Lessons from Archives: Strategies for Collecting Sociocultural Data in Machine Learning

    Eun Seo Jo, Timnit Gebru

    cs.LGcs.AIcs.CYarXiv:1912.10389v12019
  24. Pros and Cons of GAN Evaluation Measures: New Developments

    Ali Borji

    cs.LGcs.AIcs.CVarXiv:2103.09396v32021
  25. Meta-Gradient Reinforcement Learning

    Zhongwen Xu, Hado van Hasselt, David Silver

    cs.LGcs.AIstat.MLarXiv:1805.09801v12018
  26. Concept Whitening for Interpretable Image Recognition

    Zhi Chen, Yijie Bei, Cynthia Rudin

    cs.LGcs.AIcs.CVarXiv:2002.01650v52020
  27. Prismatic VLMs: Investigating the Design Space of Visually-Conditioned Language Models

    Siddharth Karamcheti, Suraj Nair, Ashwin Balakrishna +3

    cs.CVcs.AIcs.CLarXiv:2402.07865v22024
  28. MOSNet: Deep Learning based Objective Assessment for Voice Conversion

    Chen-Chou Lo, Szu-Wei Fu, Wen-Chin Huang +4

    cs.SDcs.LGeess.ASarXiv:1904.08352v32019
  29. Recent Advances in Convolutional Neural Network Acceleration

    Qianru Zhang, Meng Zhang, Tinghuan Chen +3

    cs.LGstat.MLarXiv:1807.08596v12018
  30. A Survey on Oversmoothing in Graph Neural Networks

    T. Konstantin Rusch, Michael M. Bronstein, Siddhartha Mishra

    cs.LGarXiv:2303.10993v12023
  31. Exploiting Cyclic Symmetry in Convolutional Neural Networks

    Sander Dieleman, Jeffrey De Fauw, Koray Kavukcuoglu

    cs.LGcs.CVcs.NEarXiv:1602.02660v22016
  32. Compacting, Picking and Growing for Unforgetting Continual Learning

    Steven C. Y. Hung, Cheng-Hao Tu, Cheng-En Wu +3

    cs.LGstat.MLarXiv:1910.06562v32019
  33. Task2Vec: Task Embedding for Meta-Learning

    Alessandro Achille, Michael Lam, Rahul Tewari +5

    cs.LGcs.AIstat.MLarXiv:1902.03545v12019
  34. Negative Margin Matters: Understanding Margin in Few-shot Classification

    Bin Liu, Yue Cao, Yutong Lin +4

    cs.CVcs.LGstat.MLarXiv:2003.12060v12020
  35. Approximate Data Deletion from Machine Learning Models

    Zachary Izzo, Mary Anne Smart, Kamalika Chaudhuri +1

    cs.LGstat.MLarXiv:2002.10077v22020
  36. The choice of scaling technique matters for classification performance

    Lucas B. V. de Amorim, George D. C. Cavalcanti, Rafael M. O. Cruz

    cs.LGarXiv:2212.12343v12022
  37. Meta Learning Shared Hierarchies

    Kevin Frans, Jonathan Ho, Xi Chen +2

    cs.LGarXiv:1710.09767v12017
  38. Lipschitz-Margin Training: Scalable Certification of Perturbation Invariance for Deep Neural Networks

    Yusuke Tsuzuku, Issei Sato, Masashi Sugiyama

    cs.CVcs.LGstat.MLarXiv:1802.04034v32018
  39. Whitening Sentence Representations for Better Semantics and Faster Retrieval

    Jianlin Su, Jiarun Cao, Weijie Liu +1

    cs.CLcs.AIcs.LGarXiv:2103.15316v12021
  40. Structure-Aware Transformer for Graph Representation Learning

    Dexiong Chen, Leslie O'Bray, Karsten Borgwardt

    stat.MLcs.LGarXiv:2202.03036v32022
  41. PacGAN: The power of two samples in generative adversarial networks

    Zinan Lin, Ashish Khetan, Giulia Fanti +1

    cs.LGcs.ITstat.MLarXiv:1712.04086v32017
  42. Query-Efficient Hard-label Black-box Attack:An Optimization-based Approach

    Minhao Cheng, Thong Le, Pin-Yu Chen +3

    cs.LGcs.AIstat.MLarXiv:1807.04457v12018
  43. Learning from History: Modeling Temporal Knowledge Graphs with Sequential Copy-Generation Networks

    Cunchao Zhu, Muhao Chen, Changjun Fan +2

    cs.AIcs.CLcs.LGarXiv:2012.08492v22020
  44. Data Poisoning Attacks on Factorization-Based Collaborative Filtering

    Bo Li, Yining Wang, Aarti Singh +1

    cs.LGcs.CRcs.IRarXiv:1608.08182v22016
  45. Long Range Language Modeling via Gated State Spaces

    Harsh Mehta, Ankit Gupta, Ashok Cutkosky +1

    cs.LGcs.CLarXiv:2206.13947v32022
  46. Towards Biologically Plausible Deep Learning

    Yoshua Bengio, Dong-Hyun Lee, Jorg Bornschein +2

    cs.LGarXiv:1502.04156v32015
  47. MegaScale: Scaling Large Language Model Training to More Than 10,000 GPUs

    Ziheng Jiang, Haibin Lin, Yinmin Zhong +29

    cs.LGcs.DCarXiv:2402.15627v12024
  48. Addressing Failure Prediction by Learning Model Confidence

    Charles Corbière, Nicolas Thome, Avner Bar-Hen +2

    cs.CVcs.LGstat.MLarXiv:1910.04851v22019
  49. Dataset Distillation

    Tongzhou Wang, Jun-Yan Zhu, Antonio Torralba +1

    cs.LGstat.MLarXiv:1811.10959v32018
  50. Large-scale Multi-label Text Classification - Revisiting Neural Networks

    Jinseok Nam, Jungi Kim, Eneldo Loza Mencía +2

    cs.LGarXiv:1312.5419v32013
  51. A Meta-Transfer Objective for Learning to Disentangle Causal Mechanisms

    Yoshua Bengio, Tristan Deleu, Nasim Rahaman +5

    cs.LGstat.MLarXiv:1901.10912v22019
  52. Deep Stereo using Adaptive Thin Volume Representation with Uncertainty Awareness

    Shuo Cheng, Zexiang Xu, Shilin Zhu +4

    cs.CVcs.LGcs.ROarXiv:1911.12012v22019
  53. Feature relevance quantification in explainable AI: A causal problem

    Dominik Janzing, Lenon Minorics, Patrick Blöbaum

    stat.MLcs.LGarXiv:1910.13413v22019
  54. NAVSIM: Data-Driven Non-Reactive Autonomous Vehicle Simulation and Benchmarking

    Daniel Dauner, Marcel Hallgarten, Tianyu Li +9

    cs.CVcs.AIcs.LGarXiv:2406.15349v22024
  55. Can language models learn from explanations in context?

    Andrew K. Lampinen, Ishita Dasgupta, Stephanie C. Y. Chan +6

    cs.CLcs.AIcs.LGarXiv:2204.02329v42022
  56. A Point-of-Prescription Safety-Check System for Adverse Drug Reactions in Rural Bangladeshi Hospitals: A Feasibility Study

    Shahir Abdullah

    cs.HCcs.LGarXiv:2608.27239v12026
  57. Spatio-Temporal Meta-Graph Learning for Traffic Forecasting

    Renhe Jiang, Zhaonan Wang, Jiawei Yong +6

    cs.LGcs.AIarXiv:2211.14701v42022
  58. A Connection between Generative Adversarial Networks, Inverse Reinforcement Learning, and Energy-Based Models

    Chelsea Finn, Paul Christiano, Pieter Abbeel +1

    cs.LGcs.AIarXiv:1611.03852v32016
  59. Attribute Prototype Network for Zero-Shot Learning

    Wenjia Xu, Yongqin Xian, Jiuniu Wang +2

    cs.CVcs.LGarXiv:2008.08290v42020
  60. Generative Semantic Scene Completion

    Shi Chen, Weifeng Ge

    cs.CVcs.LGcs.ROarXiv:2608.26737v12026