Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
51,001 to 51,060 of 61,393
Modeling Temporal Dependencies in High-Dimensional Sequences: Application to Polyphonic Music Generation and Transcription
Nicolas Boulanger-Lewandowski, Yoshua Bengio, Pascal Vincent
cs.LGcs.SDstat.MLarXiv:1206.6392v12012DriveGPT4: Interpretable End-to-end Autonomous Driving via Large Language Model
Zhenhua Xu, Yujia Zhang, Enze Xie +5
cs.CVcs.ROarXiv:2310.01412v52023From Perception to Action: An Interactive Benchmark for Vision Reasoning
Yuhao Wu, Maojia Song, Yihuai Lan +8
cs.CVarXiv:2602.21015v12026OCR-Agent: Agentic OCR with Capability and Memory Reflection
Shimin Wen, Zeyu Zhang, Xingdou Bian +5
cs.CVarXiv:2602.21053v12026Pre-Decoding Acoustic Triage for Budgeted Vision-Language Captioning of Untrimmed Egocentric Video
Masoud Jalayer, Changyi Li, Yu Xiao
cs.CVcs.AIcs.SDarXiv:2608.22359v12026Question Answering with Subgraph Embeddings
Antoine Bordes, Sumit Chopra, Jason Weston
cs.CLarXiv:1406.3676v32014Bayesian treed Gaussian process models with an application to computer modeling
Robert B. Gramacy, Herbert K. H. Lee
stat.MEstat.APstat.COarXiv:0710.4536v102007Low-Shot Learning from Imaginary Data
Yu-Xiong Wang, Ross Girshick, Martial Hebert +1
cs.CVarXiv:1801.05401v22018Reducing Transformer Depth on Demand with Structured Dropout
Angela Fan, Edouard Grave, Armand Joulin
cs.LGcs.CLstat.MLarXiv:1909.11556v12019SANE: State Anomaly Neutralization for Stable Extreme-Context Delta-Rule Models
Qingwen Lin, Boyan Xu, Xiao Liu +2
cs.LGcs.AIarXiv:2608.22354v22026VecGlypher: Unified Vector Glyph Generation with Language Models
Xiaoke Huang, Bhavul Gauri, Kam Woh Ng +12
cs.CLarXiv:2602.21461v12026BMN: Boundary-Matching Network for Temporal Action Proposal Generation
Tianwei Lin, Xiao Liu, Xin Li +2
cs.CVarXiv:1907.09702v12019Recovered in Translation: Efficient Pipeline for Automated Translation of Benchmarks and Datasets
Hanna Yukhymenko, Anton Alexandrov, Martin Vechev
cs.CLcs.AIcs.LGarXiv:2602.22207v12026Learning from the Test: Self-Referential Differential Testing for Deep RL Agents
Junda He, Jieke Shi, Zhou Yang +2
cs.SEcs.AIcs.LGarXiv:2608.22284v12026MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning
Jun Chen, Deyao Zhu, Xiaoqian Shen +7
cs.CVarXiv:2310.09478v32023veScale-FSDP: Flexible and High-Performance FSDP at Scale
Zezhou Wang, Youjie Li, Zhiqi Lin +9
cs.DCcs.AIcs.LGarXiv:2602.22437v32026Text-to-SQL Empowered by Large Language Models: A Benchmark Evaluation
Dawei Gao, Haibin Wang, Yaliang Li +4
cs.DBcs.CLcs.LGarXiv:2308.15363v42023AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-or-Reject Pruning
Yutong Wang, Siyuan Xiong, Xuebo Liu +4
cs.AIcs.CLarXiv:2602.23258v22026Mollified Value Learning
Hrishikesh Viswanath, Juanwu Lu, S. Talha Bukhari +4
cs.LGcs.ROarXiv:2602.23280v22026DySCo: Dynamically consistent data-driven downscaling of extremes in climate projections
S. Stamatelopoulos, M. Wang, I. Lopez-Gomez +5
cs.LGmath.NAphysics.ao-pharXiv:2608.21998v12026SGDC: Structurally-Guided Dynamic Convolution for Medical Image Segmentation
Bo Shi, Wei-ping Zhu, M. N. S. Swamy
eess.IVcs.CVarXiv:2602.23496v12026Unsupervised Learning of Sentence Embeddings using Compositional n-Gram Features
Matteo Pagliardini, Prakhar Gupta, Martin Jaggi
cs.CLcs.AIcs.IRarXiv:1703.02507v32017Accelerating Masked Image Generation by Learning Latent Controlled Dynamics
Kaiwen Zhu, Quansheng Zeng, Yuandong Pu +8
cs.CVarXiv:2602.23996v12026Generalizable Knowledge Distillation from Vision Foundation Models for Semantic Segmentation
Chonghua Lv, Dong Zhao, Shuang Wang +4
cs.CVarXiv:2603.02554v12026Learning Generative Models with Sinkhorn Divergences
Aude Genevay, Gabriel Peyré, Marco Cuturi
stat.MLarXiv:1706.00292v32017BEVFusion: A Simple and Robust LiDAR-Camera Fusion Framework
Tingting Liang, Hongwei Xie, Kaicheng Yu +6
cs.CVarXiv:2205.13790v32022Online World Modeling Enables Real-World Inverse Reinforcement Learning from Observation
Tyler Han, Bat Nemekhbold, Siyang Shen +6
cs.ROarXiv:2602.24121v22026Hide-and-Seek: Forcing a Network to be Meticulous for Weakly-supervised Object and Action Localization
Krishna Kumar Singh, Yong Jae Lee
cs.CVarXiv:1704.04232v22017Beyond Length Scaling: Synergizing Breadth and Depth for Generative Reward Models
Qiyuan Zhang, Yufei Wang, Tianhe Wu +5
cs.AIarXiv:2603.01571v12026Scalable Variational Gaussian Process Classification
James Hensman, Alex Matthews, Zoubin Ghahramani
stat.MLarXiv:1411.2005v12014Scalable Global Optimization via Local Bayesian Optimization
David Eriksson, Michael Pearce, Jacob R Gardner +2
cs.LGstat.MLarXiv:1910.01739v42019DynaMoE: Dynamic Token-Level Expert Activation with Layer-Wise Adaptive Capacity for Mixture-of-Experts Neural Networks
Gökdeniz Gülmez
cs.LGcs.AIarXiv:2603.01697v12026PageRank beyond the Web
David F. Gleich
cs.SIcs.CEmath.NAarXiv:1407.5107v12014Research Priorities for Robust and Beneficial Artificial Intelligence
Stuart Russell, Daniel Dewey, Max Tegmark
cs.AIstat.MLarXiv:1602.03506v12016Enabling Wireless Power Transfer in Cellular Networks: Architecture, Modeling and Deployment
Kaibin Huang, Vincent K. N. Lau
cs.ITarXiv:1207.5640v12012Learning Spectral Representations of Code through Latent Graph Learning for Generalizable Cross-Language Code Clone Detection
Mohsen Hesamolhokama, Ali Sadeghi, Kousha Moeini +3
cs.SEarXiv:2608.22383v12026T2S-Bench & Structure-of-Thought: Benchmarking and Prompting Comprehensive Text-to-Structure Reasoning
Qinsi Wang, Hancheng Ye, Jinhee Kim +12
cs.CLcs.AIarXiv:2603.03790v12026Automated brain extraction of multi-sequence MRI using artificial neural networks
Fabian Isensee, Marianne Schell, Irada Tursunova +10
cs.CVarXiv:1901.11341v22019Code2Math: Can Your Code Agent Effectively Evolve Math Problems Through Exploration?
Dadi Guo, Yuejin Xie, Qingyu Liu +11
cs.CLarXiv:2603.03202v32026Don't Just Assume; Look and Answer: Overcoming Priors for Visual Question Answering
Aishwarya Agrawal, Dhruv Batra, Devi Parikh +1
cs.CVcs.AIcs.CLarXiv:1712.00377v22017A Corpus for Reasoning About Natural Language Grounded in Photographs
Alane Suhr, Stephanie Zhou, Ally Zhang +3
cs.CLcs.CVarXiv:1811.00491v32018Summaries:한국어Order-independent constraint-based causal structure learning
Diego Colombo, Marloes H. Maathuis
stat.MLcs.LGarXiv:1211.3295v22012HDINO: A Concise and Efficient Open-Vocabulary Detector
Hao Zhang, Yiqun Wang, Qinran Lin +2
cs.CVarXiv:2603.02924v12026Overcoming Catastrophic Forgetting by Incremental Moment Matching
Sang-Woo Lee, Jin-Hwa Kim, Jaehyun Jun +2
cs.LGcs.AIarXiv:1703.08475v32017Are Emergent Abilities of Large Language Models a Mirage?
Rylan Schaeffer, Brando Miranda, Sanmi Koyejo
cs.AIcs.LGarXiv:2304.15004v22023OmniCAD: A Large-Scale Benchmark for 3D Spatial Reasoning in Robotics Assemblies
Mingjia Wang, Taiting Lu, Ziwei Dong +25
cs.CVarXiv:2608.22637v12026Progressive Residual Warmup for Language Model Pretraining
Tianhao Chen, Xin Xu, Lu Yin +4
cs.CLarXiv:2603.05369v12026Scaling Agentic Capabilities, Not Context: Efficient Reinforcement Finetuning for Large Toolspaces
Karan Gupta, Pranav Vajreshwari, Yash Pandya +3
cs.LGcs.AIarXiv:2603.06713v12026SSE-Bio: A Structured Self-Evolving Agent with Agentic Retrieval Policy for Multi-Hop Biomedical Reasoning
Zhaohan Meng, Zaiqiao Meng, Siwei Liu +3
cs.CLcs.AIcs.CEarXiv:2608.22132v12026A Probabilistic U-Net for Segmentation of Ambiguous Images
Simon A. A. Kohl, Bernardino Romera-Paredes, Clemens Meyer +6
cs.CVcs.LGcs.NEarXiv:1806.05034v42018Deep Learning for Computational Chemistry
Garrett B. Goh, Nathan O. Hodas, Abhinav Vishnu
stat.MLcs.AIcs.CEarXiv:1701.04503v12017The Event-Camera Dataset and Simulator: Event-based Data for Pose Estimation, Visual Odometry, and SLAM
Elias Mueggler, Henri Rebecq, Guillermo Gallego +2
cs.ROcs.CVarXiv:1610.08336v42016Knowledge Neurons in Pretrained Transformers
Damai Dai, Li Dong, Yaru Hao +3
cs.CLarXiv:2104.08696v22021Analyzing and Mitigating Cross-Lingual Degradation in Multilingual Medical VQA
Jingbo Wang, Sendong Zhao, Haochun Wang +2
cs.AIarXiv:2608.22363v12026SAHOO: Safeguarded Alignment for High-Order Optimization Objectives in Recursive Self-Improvement
Subramanyam Sahoo, Aman Chadha, Vinija Jain +1
cs.AIcs.CLcs.LGarXiv:2603.06333v12026Invertible Residual Networks
Jens Behrmann, Will Grathwohl, Ricky T. Q. Chen +2
cs.LGcs.AIcs.CVarXiv:1811.00995v32018Scaling Vision Transformers to Gigapixel Images via Hierarchical Self-Supervised Learning
Richard J. Chen, Chengkuan Chen, Yicong Li +4
cs.CVarXiv:2206.02647v12022SLER-IR: Spherical Layer-wise Expert Routing for All-in-One Image Restoration
Peng Shurui, Xin Lin, Shi Luo +5
cs.CVarXiv:2603.05940v12026BrandFusion: A Multi-Agent Framework for Seamless Brand Integration in Text-to-Video Generation
Zihao Zhu, Ruotong Wang, Siwei Lyu +2
cs.CVcs.AIarXiv:2603.02816v22026VEEGAN: Reducing Mode Collapse in GANs using Implicit Variational Learning
Akash Srivastava, Lazar Valkov, Chris Russell +2
stat.MLarXiv:1705.07761v32017