Every paper with a summary

Every arXiv paper Paperlayer has summarized so far. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

12,121 to 12,180 of 61,393

  1. Channel Estimation in MIMO Systems Aided by Microwave Linear Analog Computers (MiLACs)

    Qiaosen Zhang, Matteo Nerini, Bruno Clerckx

    eess.SPcs.ITarXiv:2601.11438v12026
  2. Diverse mini-batch Active Learning

    Fedor Zhdanov

    cs.LGstat.MLarXiv:1901.05954v12019
  3. InceptionGCN: Receptive Field Aware Graph Convolutional Network for Disease Prediction

    Anees Kazi, Shayan shekarforoush, S. Arvind krishna +6

    cs.LGstat.MLarXiv:1903.04233v12019
  4. Few-Shot Learning with Localization in Realistic Settings

    Davis Wertheimer, Bharath Hariharan

    cs.CVcs.AIcs.LGarXiv:1904.08502v22019
  5. From Interpretability Methods to Interpretable Models

    Julien Colin, Nuria Oliver, Thomas Serre

    cs.CVcs.HCarXiv:2609.05399v12026
  6. Context-Aware Convolutional Neural Network for Grading of Colorectal Cancer Histology Images

    Muhammad Shaban, Ruqayya Awan, Muhammad Moazam Fraz +3

    eess.IVcs.LGstat.MLarXiv:1907.09478v12019
  7. Point Attention Network for Semantic Segmentation of 3D Point Clouds

    Mingtao Feng, Liang Zhang, Xuefei Lin +2

    cs.CVarXiv:1909.12663v12019
  8. RubRIX: Rubric-Driven Risk Mitigation in Caregiver-AI Interactions

    Drishti Goel, Jeongah Lee, Qiuyue Joy Zhong +5

    cs.HCcs.AIcs.CLarXiv:2601.13235v12026
  9. Parallelism and Generation Order in Masked Diffusion Language Models: Limits Today, Potential Tomorrow

    Yangyang Zhong, Yanmei Gu, Zhengqing Zang +14

    cs.CLcs.AIcs.LGarXiv:2601.15593v22026
  10. CrossDepth: Geometry-Constrained Attention for Generalizable Multi-View Surround Depth Estimation

    Samer Abualhanud, Max Mehltretter

    cs.CVcs.ROarXiv:2609.05397v12026
  11. SpiralFormer: Looped Transformers Can Learn Hierarchical Dependencies via Multi-Resolution Recursion

    Chengting Yu, Xiaobo Shu, Yadao Wang +8

    cs.LGarXiv:2602.11698v22026
  12. Scaling Deep Contrastive Learning Batch Size under Memory Limited Setup

    Luyu Gao, Yunyi Zhang, Jiawei Han +1

    cs.LGcs.CLcs.IRarXiv:2101.06983v22021
  13. Mechanistic Interpretability for Large Language Model Alignment: Progress, Challenges, and Future Directions

    Usman Naseem

    cs.CLarXiv:2602.11180v12026
  14. Neural Wavelet-domain Diffusion for 3D Shape Generation

    Ka-Hei Hui, Ruihui Li, Jingyu Hu +1

    cs.CVcs.GRarXiv:2209.08725v12022
  15. Think-Verify-Revise: Neuro-Symbolic Visual Reasoning with Vision-Language Models and Dynamic Logic Tensor Networks

    Homayoun Afshari, Pietro Basci, Alessandro Russo +1

    cs.CVarXiv:2609.05388v12026
  16. Large language models that replace human participants can harmfully misportray and flatten identity groups

    Angelina Wang, Jamie Morgenstern, John P. Dickerson

    cs.CYarXiv:2402.01908v32024
  17. Point Bridge: 3D Representations for Cross Domain Policy Learning

    Siddhant Haldar, Lars Johannsmeier, Lerrel Pinto +4

    cs.ROarXiv:2601.16212v42026
  18. T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation

    Kaiyue Sun, Kaiyi Huang, Xian Liu +4

    cs.CVarXiv:2407.14505v22024
  19. Weighted Centroid Algorithm for Estimating Primary User Location: Theoretical Analysis and Distributed Implementation

    Jun Wang, Paulo Urriza, Yuxing Han +1

    cs.PFcs.ITcs.NIarXiv:1011.2313v32010
  20. MEOX: Compact Multimodal Mixture-of-Experts for Earth Observation

    Mohanad Albughdadi

    cs.CVarXiv:2609.05351v12026
  21. SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing

    Ziyang Ma, Guanrou Yang, Wenxi Chen +19

    cs.SDcs.CLcs.MMarXiv:2601.09385v12026
  22. A trajectory-based framework for data-driven system analysis and control

    Julian Berberich, Frank Allgöwer

    eess.SYarXiv:1903.10723v42019
  23. MMR-Bench: A Comprehensive Benchmark for Multimodal LLM Routing

    Haoxuan Ma, Guannan Lai, Han-Jia Ye

    cs.AIarXiv:2601.17814v12026
  24. Covariance Matrix Adaptation for the Rapid Illumination of Behavior Space

    Matthew C. Fontaine, Julian Togelius, Stefanos Nikolaidis +1

    cs.LGstat.MLarXiv:1912.02400v22019
  25. One Persona, Many Cues, Different Results: How Sociodemographic Cues Impact LLM Personalization

    Franziska Weeber, Vera Neplenbroek, Jan Batzner +1

    cs.CLarXiv:2601.18572v32026
  26. Scalable Detection of Fossil Palynomorphs in Multifocal Digital Microscopy Images

    Abbas Shaikh, Praise Mayor, Patrick Ainlay-Vazquez +7

    cs.CVarXiv:2609.05323v12026
  27. If Influence Functions are the Answer, Then What is the Question?

    Juhan Bae, Nathan Ng, Alston Lo +2

    cs.LGstat.MLarXiv:2209.05364v12022
  28. Compact Neural Appearance Models for Efficient Gaussian Splatting

    Florian Hahlbohm, Jorge Condor, Linus Franke +2

    cs.CVcs.GRarXiv:2609.05255v12026
  29. Hallucination Begins Where Saliency Drops

    Xiaofeng Zhang, Yuanchao Zhu, Chaochen Gu +8

    cs.CVarXiv:2601.20279v12026
  30. MMErroR: A Benchmark for Erroneous Reasoning in Vision-Language Models

    Yang Shi, Yifeng Xie, Minzhe Guo +6

    cs.CVcs.AIcs.LGarXiv:2601.03331v22026
  31. PAN++: Towards Efficient and Accurate End-to-End Spotting of Arbitrarily-Shaped Text

    Wenhai Wang, Enze Xie, Xiang Li +5

    cs.CVarXiv:2105.00405v42021
  32. Harvesting Paragraph-Level Question-Answer Pairs from Wikipedia

    Xinya Du, Claire Cardie

    cs.CLarXiv:1805.05942v12018
  33. STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning

    Juntong Ni, Shiyu Wang, Qi He +2

    cs.CLarXiv:2601.03248v32026
  34. Few-Shot Video Recognition via Hierarchical Metric Learning

    Jiaxin Zhang, Haoran Gao, Xizhan Gao +3

    cs.CVarXiv:2609.05242v12026
  35. VideoSet: A Large-Scale Compressed Video Quality Dataset Based on JND Measurement

    Haiqiang Wang, Ioannis Katsavounidis, Jiantong Zhou +11

    cs.MMarXiv:1701.01500v22017
  36. CircuChain: Disentangling Competence and Compliance in LLM Circuit Analysis

    Mayank Ravishankara

    cs.SEcs.AIarXiv:2602.15037v12026
  37. Anomaly Detection in Dynamic Graphs via Transformer

    Yixin Liu, Shirui Pan, Yu Guang Wang +4

    cs.LGarXiv:2106.09876v22021
  38. MovieGraphs: Towards Understanding Human-Centric Situations from Videos

    Paul Vicol, Makarand Tapaswi, Lluis Castrejon +1

    cs.CVarXiv:1712.06761v22017
  39. Multimodal Diffusion Transformer: Learning Versatile Behavior from Multimodal Goals

    Moritz Reuss, Ömer Erdinç Yağmurlu, Fabian Wenzel +1

    cs.ROarXiv:2407.05996v12024
  40. Probability-Entropy Calibration: An Elastic Indicator for Adaptive Fine-tuning

    Wenhao Yu, Shaohang Wei, Jiahong Liu +5

    cs.LGcs.AIarXiv:2602.01745v22026
  41. Vision-Language Introspection: Mitigating Overconfident Hallucinations in MLLMs via Interpretable Bi-Causal Steering

    Shuliang Liu, Songbo Yang, Dong Fang +7

    cs.CVcs.AIarXiv:2601.05159v12026
  42. DocDancer: Towards Agentic Document-Grounded Information Seeking

    Qintong Zhang, Xinjie Lv, Jialong Wu +8

    cs.CLarXiv:2601.05163v12026
  43. The Robust Manifold Defense: Adversarial Training using Generative Models

    Ajil Jalal, Andrew Ilyas, Constantinos Daskalakis +1

    cs.CVcs.CRcs.LGarXiv:1712.09196v52017
  44. Match-SRNN: Modeling the Recursive Matching Structure with Spatial RNN

    Shengxian Wan, Yanyan Lan, Jun Xu +3

    cs.CLcs.AIcs.LGarXiv:1604.04378v12016
  45. SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes

    Chuhan Wang, Xintong Li, Jennifer Yuntong Zhang +5

    cs.CVcs.CLcs.LGarXiv:2601.05600v12026
  46. Explanations from Large Language Models Make Small Reasoners Better

    Shiyang Li, Jianshu Chen, Yelong Shen +9

    cs.CLarXiv:2210.06726v12022
  47. Conserved Immune Topology Improves Pathology Foundation Model Generalization for Cross-Cancer MSI-H Prediction

    Dasari Naga Raju

    cs.CVarXiv:2609.05182v12026
  48. Beyond Precision: Training-Inference Mismatch is an Optimization Problem and Simple LR Scheduling Fixes It

    Yaxiang Zhang, Yingru Li, Jiacai Liu +4

    cs.LGcs.AIarXiv:2602.01826v12026
  49. Closed-Loop LLM Discovery of Non-Standard Channel Priors in Vision Models

    Tolgay Atinc Uzun, Dmitry Ignatov, Radu Timofte

    cs.CVarXiv:2601.08517v22026
  50. Towards Privacy-Preserving Visual Recognition via Adversarial Training: A Pilot Study

    Zhenyu Wu, Zhangyang Wang, Zhaowen Wang +1

    cs.CVarXiv:1807.08379v22018
  51. SpinalNet: Deep Neural Network with Gradual Input

    H M Dipu Kabir, Moloud Abdar, Seyed Mohammad Jafar Jalali +4

    cs.CVcs.LGcs.NEarXiv:2007.03347v32020
  52. Training-Free Logical and Structural Anomaly Detection via Calibrated Fusion

    Changyi Li, Miao Yu, Kai Dong +1

    cs.CVarXiv:2609.05091v12026
  53. Multiplex Behavioral Relation Learning for Recommendation via Memory Augmented Transformer Network

    Lianghao Xia, Chao Huang, Yong Xu +3

    cs.IRcs.AIarXiv:2110.04002v12021
  54. Fast Convergence of Stochastic Gradient Descent under a Strong Growth Condition

    Mark Schmidt, Nicolas Le Roux

    math.OCarXiv:1308.6370v12013
  55. Cut to the Mix: Simple Data Augmentation Outperforms Elaborate Ones in Limited Organ Segmentation Datasets

    Chang Liu, Fuxin Fan, Annette Schwarz +1

    cs.CVarXiv:2602.03555v12026
  56. ReCo-KD: Region- and Context-Aware Knowledge Distillation for Efficient 3D Medical Image Segmentation

    Qizhen Lan, Yu-Chun Hsu, Nida Saddaf Khan +1

    cs.CVarXiv:2601.08301v12026
  57. MultiAttenGastro: Multi-Dimensional Attention Augmentation for Gastrointestinal Endoscopy Classification

    Sadhana Devarajan, Praveen Kumar Chandaliya, Dhruvin Jashvant Kumar Shah +2

    cs.CVarXiv:2609.05070v12026
  58. Unsupervised Anomaly Localization using Variational Auto-Encoders

    David Zimmerer, Fabian Isensee, Jens Petersen +2

    cs.LGeess.IVstat.MLarXiv:1907.02796v22019
  59. NextMem: Towards Latent Factual Memory for LLM-based Agents

    Zeyu Zhang, Rui Li, Xiaoyan Zhao +4

    cs.AIcs.IRcs.LGarXiv:2603.15634v12026
  60. PuTR-CouT: Counting-by-Tracking in Camera-Trap Image Sequences

    Fagner Cunha, Juan G. Colonna, Eulanda M. dos Santos

    cs.CVarXiv:2609.05038v12026