Every paper with a summary
Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
12,121 to 12,180 of 61,393
Channel Estimation in MIMO Systems Aided by Microwave Linear Analog Computers (MiLACs)
Qiaosen Zhang, Matteo Nerini, Bruno Clerckx
eess.SPcs.ITarXiv:2601.11438v12026Diverse mini-batch Active Learning
Fedor Zhdanov
cs.LGstat.MLarXiv:1901.05954v12019InceptionGCN: Receptive Field Aware Graph Convolutional Network for Disease Prediction
Anees Kazi, Shayan shekarforoush, S. Arvind krishna +6
cs.LGstat.MLarXiv:1903.04233v12019Few-Shot Learning with Localization in Realistic Settings
Davis Wertheimer, Bharath Hariharan
cs.CVcs.AIcs.LGarXiv:1904.08502v22019From Interpretability Methods to Interpretable Models
Julien Colin, Nuria Oliver, Thomas Serre
cs.CVcs.HCarXiv:2609.05399v12026Context-Aware Convolutional Neural Network for Grading of Colorectal Cancer Histology Images
Muhammad Shaban, Ruqayya Awan, Muhammad Moazam Fraz +3
eess.IVcs.LGstat.MLarXiv:1907.09478v12019Point Attention Network for Semantic Segmentation of 3D Point Clouds
Mingtao Feng, Liang Zhang, Xuefei Lin +2
cs.CVarXiv:1909.12663v12019RubRIX: Rubric-Driven Risk Mitigation in Caregiver-AI Interactions
Drishti Goel, Jeongah Lee, Qiuyue Joy Zhong +5
cs.HCcs.AIcs.CLarXiv:2601.13235v12026Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow
Yangyang Zhong, Yanmei Gu, Zhengqing Zang +14
cs.CLcs.AIcs.LGarXiv:2601.15593v22026CrossDepth: Geometry-Constrained Attention for Generalizable Multi-View Surround Depth Estimation
Samer Abualhanud, Max Mehltretter
cs.CVcs.ROarXiv:2609.05397v12026SpiralFormer: Looped Transformers Can Learn Hierarchical Dependencies via Multi-Resolution Recursion
Chengting Yu, Xiaobo Shu, Yadao Wang +8
cs.LGarXiv:2602.11698v22026Scaling Deep Contrastive Learning Batch Size under Memory Limited Setup
Luyu Gao, Yunyi Zhang, Jiawei Han +1
cs.LGcs.CLcs.IRarXiv:2101.06983v22021Mechanistic Interpretability for Large Language Model Alignment: Progress, Challenges, and Future Directions
Usman Naseem
cs.CLarXiv:2602.11180v12026Neural Wavelet-domain Diffusion for 3D Shape Generation
Ka-Hei Hui, Ruihui Li, Jingyu Hu +1
cs.CVcs.GRarXiv:2209.08725v12022Think-Verify-Revise: Neuro-Symbolic Visual Reasoning with Vision-Language Models and Dynamic Logic Tensor Networks
Homayoun Afshari, Pietro Basci, Alessandro Russo +1
cs.CVarXiv:2609.05388v12026Large language models that replace human participants can harmfully misportray and flatten identity groups
Angelina Wang, Jamie Morgenstern, John P. Dickerson
cs.CYarXiv:2402.01908v32024Point Bridge: 3D Representations for Cross Domain Policy Learning
Siddhant Haldar, Lars Johannsmeier, Lerrel Pinto +4
cs.ROarXiv:2601.16212v42026T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation
Kaiyue Sun, Kaiyi Huang, Xian Liu +4
cs.CVarXiv:2407.14505v22024Weighted Centroid Algorithm for Estimating Primary User Location: Theoretical Analysis and Distributed Implementation
Jun Wang, Paulo Urriza, Yuxing Han +1
cs.PFcs.ITcs.NIarXiv:1011.2313v32010MEOX: Compact Multimodal Mixture-of-Experts for Earth Observation
Mohanad Albughdadi
cs.CVarXiv:2609.05351v12026SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing
Ziyang Ma, Guanrou Yang, Wenxi Chen +19
cs.SDcs.CLcs.MMarXiv:2601.09385v12026A trajectory-based framework for data-driven system analysis and control
Julian Berberich, Frank Allgöwer
eess.SYarXiv:1903.10723v42019MMR-Bench: A Comprehensive Benchmark for Multimodal LLM Routing
Haoxuan Ma, Guannan Lai, Han-Jia Ye
cs.AIarXiv:2601.17814v12026Covariance Matrix Adaptation for the Rapid Illumination of Behavior Space
Matthew C. Fontaine, Julian Togelius, Stefanos Nikolaidis +1
cs.LGstat.MLarXiv:1912.02400v22019One Persona, Many Cues, Different Results: How Sociodemographic Cues Impact LLM Personalization
Franziska Weeber, Vera Neplenbroek, Jan Batzner +1
cs.CLarXiv:2601.18572v32026Scalable Detection of Fossil Palynomorphs in Multifocal Digital Microscopy Images
Abbas Shaikh, Praise Mayor, Patrick Ainlay-Vazquez +7
cs.CVarXiv:2609.05323v12026If Influence Functions are the Answer, Then What is the Question?
Juhan Bae, Nathan Ng, Alston Lo +2
cs.LGstat.MLarXiv:2209.05364v12022Compact Neural Appearance Models for Efficient Gaussian Splatting
Florian Hahlbohm, Jorge Condor, Linus Franke +2
cs.CVcs.GRarXiv:2609.05255v12026Hallucination Begins Where Saliency Drops
Xiaofeng Zhang, Yuanchao Zhu, Chaochen Gu +8
cs.CVarXiv:2601.20279v12026MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models
Yang Shi, Yifeng Xie, Minzhe Guo +6
cs.CVcs.AIcs.LGarXiv:2601.03331v22026PAN++: Towards Efficient and Accurate End-to-End Spotting of Arbitrarily-Shaped Text
Wenhai Wang, Enze Xie, Xiang Li +5
cs.CVarXiv:2105.00405v42021Harvesting Paragraph-Level Question-Answer Pairs from Wikipedia
Xinya Du, Claire Cardie
cs.CLarXiv:1805.05942v12018STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning
Juntong Ni, Shiyu Wang, Qi He +2
cs.CLarXiv:2601.03248v32026Few-Shot Video Recognition via Hierarchical Metric Learning
Jiaxin Zhang, Haoran Gao, Xizhan Gao +3
cs.CVarXiv:2609.05242v12026VideoSet: A Large-Scale Compressed Video Quality Dataset Based on JND Measurement
Haiqiang Wang, Ioannis Katsavounidis, Jiantong Zhou +11
cs.MMarXiv:1701.01500v22017CircuChain: Disentangling Competence and Compliance in LLM Circuit Analysis
Mayank Ravishankara
cs.SEcs.AIarXiv:2602.15037v12026Anomaly Detection in Dynamic Graphs via Transformer
Yixin Liu, Shirui Pan, Yu Guang Wang +4
cs.LGarXiv:2106.09876v22021MovieGraphs: Towards Understanding Human-Centric Situations from Videos
Paul Vicol, Makarand Tapaswi, Lluis Castrejon +1
cs.CVarXiv:1712.06761v22017Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals
Moritz Reuss, Ömer Erdinç Yağmurlu, Fabian Wenzel +1
cs.ROarXiv:2407.05996v12024Probability-Entropy Calibration: An Elastic Indicator for Adaptive Fine-tuning
Wenhao Yu, Shaohang Wei, Jiahong Liu +5
cs.LGcs.AIarXiv:2602.01745v22026Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering
Shuliang Liu, Songbo Yang, Dong Fang +7
cs.CVcs.AIarXiv:2601.05159v12026DocDancer: Towards Agentic Document-Grounded Information Seeking
Qintong Zhang, Xinjie Lv, Jialong Wu +8
cs.CLarXiv:2601.05163v12026The Robust Manifold Defense: Adversarial Training using Generative Models
Ajil Jalal, Andrew Ilyas, Constantinos Daskalakis +1
cs.CVcs.CRcs.LGarXiv:1712.09196v52017Match-SRNN: Modeling the Recursive Matching Structure with Spatial RNN
Shengxian Wan, Yanyan Lan, Jun Xu +3
cs.CLcs.AIcs.LGarXiv:1604.04378v12016SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
Chuhan Wang, Xintong Li, Jennifer Yuntong Zhang +5
cs.CVcs.CLcs.LGarXiv:2601.05600v12026Explanations from Large Language Models Make Small Reasoners Better
Shiyang Li, Jianshu Chen, Yelong Shen +9
cs.CLarXiv:2210.06726v12022Conserved Immune Topology Improves Pathology Foundation Model Generalization for Cross-Cancer MSI-H Prediction
Dasari Naga Raju
cs.CVarXiv:2609.05182v12026Beyond Precision: Training-Inference Mismatch is an Optimization Problem and Simple LR Scheduling Fixes It
Yaxiang Zhang, Yingru Li, Jiacai Liu +4
cs.LGcs.AIarXiv:2602.01826v12026Closed-Loop LLM Discovery of Non-Standard Channel Priors in Vision Models
Tolgay Atinc Uzun, Dmitry Ignatov, Radu Timofte
cs.CVarXiv:2601.08517v22026Towards Privacy-Preserving Visual Recognition via Adversarial Training: A Pilot Study
Zhenyu Wu, Zhangyang Wang, Zhaowen Wang +1
cs.CVarXiv:1807.08379v22018SpinalNet: Deep Neural Network with Gradual Input
H M Dipu Kabir, Moloud Abdar, Seyed Mohammad Jafar Jalali +4
cs.CVcs.LGcs.NEarXiv:2007.03347v32020Training-Free Logical and Structural Anomaly Detection via Calibrated Fusion
Changyi Li, Miao Yu, Kai Dong +1
cs.CVarXiv:2609.05091v12026Multiplex Behavioral Relation Learning for Recommendation via Memory Augmented Transformer Network
Lianghao Xia, Chao Huang, Yong Xu +3
cs.IRcs.AIarXiv:2110.04002v12021Fast Convergence of Stochastic Gradient Descent under a Strong Growth Condition
Mark Schmidt, Nicolas Le Roux
math.OCarXiv:1308.6370v12013Cut to the Mix: Simple Data Augmentation Outperforms Elaborate Ones in Limited Organ Segmentation Datasets
Chang Liu, Fuxin Fan, Annette Schwarz +1
cs.CVarXiv:2602.03555v12026ReCo-KD: Region- and Context-Aware Knowledge Distillation for Efficient 3D Medical Image Segmentation
Qizhen Lan, Yu-Chun Hsu, Nida Saddaf Khan +1
cs.CVarXiv:2601.08301v12026MultiAttenGastro: Multi-Dimensional Attention Augmentation for Gastrointestinal Endoscopy Classification
Sadhana Devarajan, Praveen Kumar Chandaliya, Dhruvin Jashvant Kumar Shah +2
cs.CVarXiv:2609.05070v12026Unsupervised Anomaly Localization using Variational Auto-Encoders
David Zimmerer, Fabian Isensee, Jens Petersen +2
cs.LGeess.IVstat.MLarXiv:1907.02796v22019NextMem: Towards Latent Factual Memory for LLM-based Agents
Zeyu Zhang, Rui Li, Xiaoyan Zhao +4
cs.AIcs.IRcs.LGarXiv:2603.15634v12026PuTR-CouT: Counting-by-Tracking in Camera-Trap Image Sequences
Fagner Cunha, Juan G. Colonna, Eulanda M. dos Santos
cs.CVarXiv:2609.05038v12026