Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
23,641 to 23,700 of 61,428
Learning Longer-term Dependencies in RNNs with Auxiliary Losses
Trieu H. Trinh, Andrew M. Dai, Minh-Thang Luong +1
cs.LGcs.AIstat.MLarXiv:1803.00144v32018The opportunities and risks of large language models in mental health
Hannah R. Lawrence, Renee A. Schneider, Susan B. Rubin +3
cs.CLcs.AIcs.CYarXiv:2403.14814v32024Uncertainty Quantification in Complex Simulation Models Using Ensemble Copula Coupling
Roman Schefzik, Thordis L. Thorarinsdottir, Tilmann Gneiting
stat.MEarXiv:1302.7149v22013We Can Detect Your Bias: Predicting the Political Ideology of News Articles
Ramy Baly, Giovanni Da San Martino, James Glass +1
cs.CLarXiv:2010.05338v12020Sheaves, Cosheaves and Applications
Justin Curry
math.ATmath.RTarXiv:1303.3255v22013LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning
Bo Liu, Yifeng Zhu, Chongkai Gao +4
cs.AIarXiv:2306.03310v22023Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models
Soham De, Samuel L. Smith, Anushan Fernando +14
cs.LGcs.CLarXiv:2402.19427v12024Stochastic Quasi-Newton Methods for Nonconvex Stochastic Optimization
Xiao Wang, Shiqian Ma, Donald Goldfarb +1
math.OCcs.LGmath.NAarXiv:1607.01231v42016Joint Transmit Beamforming and Receive Power Splitting for MISO SWIPT Systems
Qingjiang Shi, Liang Liu, Weiqiang Xu +1
cs.ITarXiv:1304.0062v32013Statistical Rejection Sampling Improves Preference Optimization
Tianqi Liu, Yao Zhao, Rishabh Joshi +4
cs.CLarXiv:2309.06657v22023Reweighted Wake-Sleep
Jörg Bornschein, Yoshua Bengio
cs.LGarXiv:1406.2751v42014Dense Process Supervision for Search Agents via Fact Utility Estimation
Rongzhi Zhu, Xiangyu Liu, Yi Liu +7
cs.CLcs.LGarXiv:2609.00833v12026High-threshold and low-overhead fault-tolerant quantum memory
Sergey Bravyi, Andrew W. Cross, Jay M. Gambetta +3
quant-phcs.ETarXiv:2308.07915v22023Efficient Memory Management for Large Language Model Serving with PagedAttention
Woosuk Kwon, Zhuohan Li, Siyuan Zhuang +6
cs.LGcs.DCarXiv:2309.06180v120233D Gaussian Splatting for Real-Time Radiance Field Rendering
Bernhard Kerbl, Georgios Kopanas, Thomas Leimkühler +1
cs.GRcs.CVarXiv:2308.04079v12023NodeFormer: A Scalable Graph Structure Learning Transformer for Node Classification
Qitian Wu, Wentao Zhao, Zenan Li +2
cs.LGcs.AIarXiv:2306.08385v12023QuIP: 2-Bit Quantization of Large Language Models With Guarantees
Jerry Chee, Yaohui Cai, Volodymyr Kuleshov +1
cs.LGcs.CLarXiv:2307.13304v22023AnyTeleop: A General Vision-Based Dexterous Robot Arm-Hand Teleoperation System
Yuzhe Qin, Wei Yang, Binghao Huang +5
cs.ROcs.CVcs.LGarXiv:2307.04577v32023A Race Track Trapped-Ion Quantum Processor
S. A. Moses, C. H. Baldwin, M. S. Allman +93
quant-pharXiv:2305.03828v22023Extending Context Window of Large Language Models via Positional Interpolation
Shouyuan Chen, Sherman Wong, Liangjian Chen +1
cs.CLcs.AIcs.LGarXiv:2306.15595v22023Confidence sets for persistence diagrams
Brittany Terese Fasy, Fabrizio Lecci, Alessandro Rinaldo +3
math.STcs.CGcs.LGarXiv:1303.7117v32013Chameleon: Plug-and-Play Compositional Reasoning with Large Language Models
Pan Lu, Baolin Peng, Hao Cheng +5
cs.CLcs.AIcs.CVarXiv:2304.09842v32023Resurrecting Recurrent Neural Networks for Long Sequences
Antonio Orvieto, Samuel L Smith, Albert Gu +4
cs.LGarXiv:2303.06349v12023Larger language models do in-context learning differently
Jerry Wei, Jason Wei, Yi Tay +8
cs.CLarXiv:2303.03846v22023Cross-Entropy Loss Functions: Theoretical Analysis and Applications
Anqi Mao, Mehryar Mohri, Yutao Zhong
cs.LGstat.MLarXiv:2304.07288v22023Goal-Conditioned Imitation Learning using Score-based Diffusion Policies
Moritz Reuss, Maximilian Li, Xiaogang Jia +1
cs.LGcs.ROarXiv:2304.02532v22023One Fits All:Power General Time Series Analysis by Pretrained LM
Tian Zhou, PeiSong Niu, Xue Wang +2
cs.LGcs.AIarXiv:2302.11939v62023GBM Volumetry using the 3D Slicer Medical Image Computing Platform
Jan Egger, Tina Kapur, Andriy Fedorov +7
cs.CVarXiv:1303.0964v12013Nerfstudio: A Modular Framework for Neural Radiance Field Development
Matthew Tancik, Ethan Weber, Evonne Ng +10
cs.CVcs.GRarXiv:2302.04264v420233DShape2VecSet: A 3D Shape Representation for Neural Fields and Generative Diffusion Models
Biao Zhang, Jiapeng Tang, Matthias Niessner +1
cs.CVcs.GRarXiv:2301.11445v32023Galactica: A Large Language Model for Science
Ross Taylor, Marcin Kardas, Guillem Cucurull +6
cs.CLstat.MLarXiv:2211.09085v12022ADBench: Anomaly Detection Benchmark
Songqiao Han, Xiyang Hu, Hailiang Huang +2
cs.LGcs.AIarXiv:2206.09426v22022Score Jacobian Chaining: Lifting Pretrained 2D Diffusion Models for 3D Generation
Haochen Wang, Xiaodan Du, Jiahao Li +2
cs.CVcs.LGarXiv:2212.00774v12022An Introductory Study on Time Series Modeling and Forecasting
Ratnadip Adhikari, R. K. Agrawal
cs.LGstat.MLarXiv:1302.6613v12013MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
Yuxin Zuo, Shang Qu, Yifei Li +6
cs.AIcs.CLcs.CVarXiv:2501.18362v32025Scaling Instruction-Finetuned Language Models
Hyung Won Chung, Le Hou, Shayne Longpre +32
cs.LGcs.CLarXiv:2210.11416v52022Sampling Algorithms and Coresets for Lp Regression
Anirban Dasgupta, Petros Drineas, Boulos Harb +2
cs.DSarXiv:0707.1714v12007TabLLM: Few-shot Classification of Tabular Data with Large Language Models
Stefan Hegselmann, Alejandro Buendia, Hunter Lang +3
cs.CLcs.AIarXiv:2210.10723v22022Regularized rank-based estimation of high-dimensional nonparanormal graphical models
Lingzhou Xue, Hui Zou
math.STarXiv:1302.3082v12013DPM-Solver++: Fast Solver for Guided Sampling of Diffusion Probabilistic Models
Cheng Lu, Yuhao Zhou, Fan Bao +3
cs.LGcs.CVarXiv:2211.01095v32022Analytic and Algorithmic Aspects of Generalized Harmonic Sums and Polylogarithms
Jakob Ablinger, Johannes Blümlein, Carsten Schneider
math-phcs.SChep-pharXiv:1302.0378v12013Pure Transformers are Powerful Graph Learners
Jinwoo Kim, Tien Dat Nguyen, Seonwoo Min +4
cs.LGcs.AIarXiv:2207.02505v22022Optimal rates of convergence for sparse covariance matrix estimation
T. Tony Cai, Harrison H. Zhou
math.STarXiv:1302.3030v12013UI-TARS-2 Technical Report: Advancing GUI Agent with Multi-Turn Reinforcement Learning
Haoming Wang, Haoyang Zou, Huatong Song +109
cs.AIcs.CLcs.CVarXiv:2509.02544v22025Solving Quantitative Reasoning Problems with Language Models
Aitor Lewkowycz, Anders Andreassen, David Dohan +11
cs.CLcs.AIcs.LGarXiv:2206.14858v22022The Fishyscapes Benchmark: Measuring Blind Spots in Semantic Segmentation
Hermann Blum, Paul-Edouard Sarlin, Juan Nieto +2
cs.CVarXiv:1904.03215v42019HorNet: Efficient High-Order Spatial Interactions with Recursive Gated Convolutions
Yongming Rao, Wenliang Zhao, Yansong Tang +3
cs.CVarXiv:2207.14284v32022EmbeddingGemma: Powerful and Lightweight Text Representations
Henrique Schechter Vera, Sahil Dua, Biao Zhang +86
cs.CLcs.AIarXiv:2509.20354v32025Deep Impact: Unintended consequences of journal rank
Björn Brembs, Marcus Munafò
cs.DLphysics.soc-phstat.OTarXiv:1301.3748v32013MonoSDF: Exploring Monocular Geometric Cues for Neural Implicit Surface Reconstruction
Zehao Yu, Songyou Peng, Michael Niemeyer +2
cs.CVarXiv:2206.00665v22022Measuring the Carbon Intensity of AI in Cloud Instances
Jesse Dodge, Taylor Prewitt, Remi Tachet Des Combes +7
cs.LGarXiv:2206.05229v12022Robust subspace clustering
Mahdi Soltanolkotabi, Ehsan Elhamifar, Emmanuel J. Candès
cs.LGcs.ITmath.OCarXiv:1301.2603v32013DPM-Solver: A Fast ODE Solver for Diffusion Probabilistic Model Sampling in Around 10 Steps
Cheng Lu, Yuhao Zhou, Fan Bao +3
cs.LGstat.MLarXiv:2206.00927v32022Overcoming catastrophic forgetting in neural networks
Brandon Shuen Yi Loke, Filippo Quadri, Gabriel Vivanco +2
cs.LGcs.IRarXiv:2507.10485v12025A high-resolution canopy height model of the Earth
Nico Lang, Walter Jetz, Konrad Schindler +1
cs.CVcs.LGeess.IVarXiv:2204.08322v12022Towards Metrical Reconstruction of Human Faces
Wojciech Zielonka, Timo Bolkart, Justus Thies
cs.CVarXiv:2204.06607v22022When and why PINNs fail to train: A neural tangent kernel perspective
Sifan Wang, Xinling Yu, Paris Perdikaris
cs.LGmath.NAstat.MLarXiv:2007.14527v12020GeoDiff: a Geometric Diffusion Model for Molecular Conformation Generation
Minkai Xu, Lantao Yu, Yang Song +3
cs.LGq-bio.QMarXiv:2203.02923v12022Geo-Indistinguishability: Differential Privacy for Location-Based Systems
Miguel E. Andrés, Nicolás E. Bordenabe, Konstantinos Chatzikokolakis +1
cs.CRarXiv:1212.1984v32012Fine-Tuning can Distort Pretrained Features and Underperform Out-of-Distribution
Ananya Kumar, Aditi Raghunathan, Robbie Jones +2
cs.LGcs.CVarXiv:2202.10054v12022