Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
54,241 to 54,300 of 61,393
Deep Learning Scaling is Predictable, Empirically
Joel Hestness, Sharan Narang, Newsha Ardalani +6
cs.LGstat.MLarXiv:1712.00409v12017Joint 2D-3D-Semantic Data for Indoor Scene Understanding
Iro Armeni, Sasha Sax, Amir R. Zamir +1
cs.CVcs.ROarXiv:1702.01105v22017Tiny Aya: Bridging Scale and Multilingual Depth
Alejandro R. Salamanca, Diana Abagyan, Daniel D'souza +23
cs.CLarXiv:2603.11510v12026Sparse Light Field Sampling Improves Casual 3D and 4D Reconstruction
Shamus Li, Ruiming Cao, Laura Waller +2
eess.IVcs.CVarXiv:2608.20602v12026VM-UNet: Vision Mamba UNet for Medical Image Segmentation
Jiacheng Ruan, Jincheng Li, Suncheng Xiang
eess.IVcs.CVarXiv:2402.02491v22024LongCLI-Bench: A Preliminary Benchmark and Study for Long-horizon Agentic Programming in Command-Line Interfaces
Yukang Feng, Jianwen Sun, Zelai Yang +16
cs.SEcs.MAarXiv:2602.14337v22026Graph Convolutional Policy Network for Goal-Directed Molecular Graph Generation
Jiaxuan You, Bowen Liu, Rex Ying +2
cs.LGcs.AIstat.MLarXiv:1806.02473v32018Workplace Surveillance and Insider Threat Risk Management: Legal Limits and Privacy Harms
Haywood Gelman, John D. Hastings, Suvineetha Herath +1
cs.CRarXiv:2608.21205v12026Enabling Threshold Custody for the Lightning Network with Nested Threshold Multi-Signatures
Paul Gerhart, Nadav Kohen, Jesse Posner +1
cs.CRarXiv:2608.20705v12026Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification
Yuxuan Wan, Tianqing Fang, Zaitang Li +5
cs.AIarXiv:2601.15808v22026Fair Resource Allocation in Federated Learning
Tian Li, Maziar Sanjabi, Ahmad Beirami +1
cs.LGstat.MLarXiv:1905.10497v22019SimToolReal: An Object-Centric Policy for Zero-Shot Dexterous Tool Manipulation
Kushal Kedia, Tyler Ga Wei Lum, Jeannette Bohg +1
cs.ROcs.AIarXiv:2602.16863v22026Training deep neural networks for the inverse design of nanophotonic structures
Dianjing Liu, Yixuan Tan, Erfan Khoram +1
physics.opticsphysics.app-pharXiv:1710.04724v32017Cuckoo Search: Recent Advances and Applications
Xin-She Yang, Suash Deb
math.OCcs.NEnlin.AOarXiv:1408.5316v12014NeSAM: Neuro-Symbolic Kinodynamics with Soil Adaptation for Off-Road Mobility
Chenhui Pan, Tong Xu, Francesco Cancelliere +1
cs.ROarXiv:2608.21330v12026Look, Listen and Learn
Relja Arandjelović, Andrew Zisserman
cs.CVcs.LGarXiv:1705.08168v22017Circle Loss: A Unified Perspective of Pair Similarity Optimization
Yifan Sun, Changmao Cheng, Yuhan Zhang +4
cs.CVarXiv:2002.10857v22020CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents
Hanna Foerster, Tom Blanchard, Kristina Nikolić +6
cs.AIarXiv:2601.09923v32026Multiple Object Tracking: A Literature Review
Wenhan Luo, Junliang Xing, Anton Milan +3
cs.CVarXiv:1409.7618v52014VisionTrim: Unified Vision Token Compression for Training-Free MLLM Acceleration
Hanxun Yu, Wentong Li, Xuan Qu +3
cs.CVarXiv:2601.22674v32026Unsupervised Cross-Domain Image Generation
Yaniv Taigman, Adam Polyak, Lior Wolf
cs.CVarXiv:1611.02200v12016Aristotelian Manifolds: Leveraging Platonic Perceptual Features for Backpropagation Free Rapid Concept Learning
Michael Karnes, Alper Yilmaz
cs.CVarXiv:2608.20682v12026RealWonder: Real-Time Physical Action-Conditioned Video Generation
Wei Liu, Ziyu Chen, Zizhang Li +3
cs.CVcs.AIcs.GRarXiv:2603.05449v12026Adversarial Examples for Semantic Segmentation and Object Detection
Cihang Xie, Jianyu Wang, Zhishuai Zhang +3
cs.CVarXiv:1703.08603v32017Circuit elements with memory: memristors, memcapacitors and meminductors
Massimiliano Di Ventra, Yuriy V. Pershin, Leon O. Chua
cond-mat.mes-hallarXiv:0901.3682v12009A review of deep learning in medical imaging: Imaging traits, technology trends, case studies with progress highlights, and future promises
S. Kevin Zhou, Hayit Greenspan, Christos Davatzikos +6
cs.CVeess.IVarXiv:2008.09104v22020Unsupervised Cross-lingual Representation Learning for Speech Recognition
Alexis Conneau, Alexei Baevski, Ronan Collobert +2
cs.CLcs.LGcs.SDarXiv:2006.13979v22020MM-Zero: Self-Evolving Multi-Model Vision Language Models From Zero Data
Zongxia Li, Hongyang Du, Chengsong Huang +8
cs.CVcs.LGarXiv:2603.09206v12026Recent Advances in Open Set Recognition: A Survey
Chuanxing Geng, Sheng-jun Huang, Songcan Chen
cs.LGstat.MLarXiv:1811.08581v42018TraceGrant: A Contract-Governed Security Framework for the Task-Effect Lifecycle of Networked LLM Agents
Bohao Liao, Jingchao Wang, Qipeng Song +3
cs.CRarXiv:2608.21126v12026DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation
Jiaxiang Tang, Jiawei Ren, Hang Zhou +2
cs.CVarXiv:2309.16653v22023AutoWebWorld: Synthesizing Infinite Verifiable Web Environments via Finite State Machines
Yifan Wu, Yiran Peng, Yiyu Chen +12
cs.AIcs.SEarXiv:2602.14296v12026SWE-World: Building Software Engineering Agents in Docker-Free Environments
Shuang Sun, Huatong Song, Lisheng Huang +11
cs.SEcs.CLarXiv:2602.03419v12026EnhanceNet: Single Image Super-Resolution Through Automated Texture Synthesis
Mehdi S. M. Sajjadi, Bernhard Schölkopf, Michael Hirsch
cs.CVcs.AIstat.MLarXiv:1612.07919v22016Bootstrapping Mutual Attestation with Kleene's Second Recursion Theorem
Takuma Imamura
cs.CRmath.LOarXiv:2608.20671v12026MOSS-TTS Technical Report
Yitian Gong, Botian Jiang, Yiwei Zhao +23
cs.SDcs.AIcs.CLarXiv:2603.18090v22026DetectoRS: Detecting Objects with Recursive Feature Pyramid and Switchable Atrous Convolution
Siyuan Qiao, Liang-Chieh Chen, Alan Yuille
cs.CVarXiv:2006.02334v22020Anchoring Instruction Outside Mask: Exact Reference Caching for Efficient In-Context Diffusion Transformers
Yangshuai Liu, Zheming Li, Jiaao Li +4
cs.CVarXiv:2608.21229v12026STEP3-VL-10B Technical Report
Ailin Huang, Chengyuan Yao, Chunrui Han +90
cs.CVarXiv:2601.09668v22026COMET: Commonsense Transformers for Automatic Knowledge Graph Construction
Antoine Bosselut, Hannah Rashkin, Maarten Sap +3
cs.CLcs.AIarXiv:1906.05317v22019Concurrent Spatial and Channel Squeeze & Excitation in Fully Convolutional Networks
Abhijit Guha Roy, Nassir Navab, Christian Wachinger
cs.CVarXiv:1803.02579v22018A VLM Answer Is Not an Anomaly Score: Rank Compression in Training-Free Video Anomaly Detection
Inpyo Song, Jangwon Lee
cs.CVarXiv:2608.21244v12026Efficient Autoregressive Video Diffusion with Dummy Head
Hang Guo, Zhaoyang Jia, Jiahao Li +5
cs.CVarXiv:2601.20499v12026Real-Time Aligned Reward Model beyond Semantics
Zixuan Huang, Xin Xia, Yuxi Ren +10
cs.AIarXiv:2601.22664v42026BiFormer: Vision Transformer with Bi-Level Routing Attention
Lei Zhu, Xinjiang Wang, Zhanghan Ke +2
cs.CVarXiv:2303.08810v12023Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes
Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh +6
cs.CLcs.AIcs.LGarXiv:2305.02301v22023Order Matters: Sequence to sequence for sets
Oriol Vinyals, Samy Bengio, Manjunath Kudlur
stat.MLcs.CLcs.LGarXiv:1511.06391v42015A Universal Graph Deep Learning Interatomic Potential for the Periodic Table
Chi Chen, Shyue Ping Ong
cond-mat.mtrl-sciphysics.chem-pharXiv:2202.02450v22022Instruction-Following Evaluation for Large Language Models
Jeffrey Zhou, Tianjian Lu, Swaroop Mishra +5
cs.CLcs.AIcs.LGarXiv:2311.07911v12023On Deep Multi-View Representation Learning: Objectives and Optimization
Weiran Wang, Raman Arora, Karen Livescu +1
cs.LGarXiv:1602.01024v12016DiGS-Avatar: Single-Image Animatable 3D Human Reconstruction via UV-Space Diffusion
Jiakun Li, Li Fang, Hao Zhu +4
cs.CVarXiv:2608.20759v12026Multimodal OCR: Parse Anything from Documents
Handong Zheng, Yumeng Li, Kaile Zhang +22
cs.CVarXiv:2603.13032v22026Gradient-based Hyperparameter Optimization through Reversible Learning
Dougal Maclaurin, David Duvenaud, Ryan P. Adams
stat.MLcs.LGarXiv:1502.03492v32015PACED: Distillation and On-Policy Self-Distillation at the Frontier of Student Competence
Yuanda Xu, Hejian Sang, Zhengze Zhou +2
cs.AIcs.LGarXiv:2603.11178v32026SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks
Mingqian Feng, Xiaodong Liu, Weiwei Yang +4
cs.CLarXiv:2602.06854v22026SATzilla: Portfolio-based Algorithm Selection for SAT
Lin Xu, Frank Hutter, Holger H. Hoos +1
cs.AIarXiv:1111.2249v12011Code2World: A GUI World Model via Renderable Code Generation
Yuhao Zheng, Li'an Zhong, Yi Wang +6
cs.CVcs.AIcs.CLarXiv:2602.09856v12026Theory of Space: Can Foundation Models Construct Spatial Beliefs through Active Exploration?
Pingyue Zhang, Zihan Huang, Yue Wang +11
cs.AIcs.CLcs.LGarXiv:2602.07055v12026LiveWorld: Simulating Out-of-Sight Dynamics in Generative Video World Models
Zicheng Duan, Jiatong Xia, Zeyu Zhang +7
cs.CVarXiv:2603.07145v22026Motion 3-to-4: 3D Motion Reconstruction for 4D Synthesis
Hongyuan Chen, Xingyu Chen, Youjia Zhang +2
cs.CVarXiv:2601.14253v12026