Image and Video Processing
Papers filed under eess.IV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
1,201 to 1,260 of 1,311
Deep Semantic Segmentation of Natural and Medical Images: A Review
Saeid Asgari Taghanaki, Kumar Abhishek, Joseph Paul Cohen +2
cs.CVcs.LGeess.IVarXiv:1910.07655v42019DoubleU-Net: A Deep Convolutional Neural Network for Medical Image Segmentation
Debesh Jha, Michael A. Riegler, Dag Johansen +2
eess.IVcs.CVarXiv:2006.04868v22020HigherHRNet: Scale-Aware Representation Learning for Bottom-Up Human Pose Estimation
Bowen Cheng, Bin Xiao, Jingdong Wang +3
cs.CVcs.LGeess.IVarXiv:1908.10357v32019Single Image Super-Resolution via a Holistic Attention Network
Ben Niu, Weilei Wen, Wenqi Ren +6
eess.IVcs.CVarXiv:2008.08767v12020Multi-Scale Progressive Fusion Network for Single Image Deraining
Kui Jiang, Zhongyuan Wang, Peng Yi +5
cs.CVcs.LGeess.IVarXiv:2003.10985v22020Spanning the Visual Analogy Space with a Weight Basis of LoRAs
Hila Manor, Rinon Gal, Haggai Maron +2
cs.CVcs.AIcs.GRarXiv:2602.15727v22026PadChest: A large chest x-ray image dataset with multi-label annotated reports
Aurelia Bustos, Antonio Pertusa, Jose-Maria Salinas +1
eess.IVcs.CVarXiv:1901.07441v22019Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms
Muyang He, Hanzhong Guo, Junxiong Lin +1
eess.IVcs.CVarXiv:2603.28489v32026COVID-19 Image Data Collection: Prospective Predictions Are the Future
Joseph Paul Cohen, Paul Morrison, Lan Dao +3
q-bio.QMcs.CVcs.LGarXiv:2006.11988v32020DVC: An End-to-end Deep Video Compression Framework
Guo Lu, Wanli Ouyang, Dong Xu +3
eess.IVcs.CVarXiv:1812.00101v32018DM4CT: Benchmarking Diffusion Models for Computed Tomography Reconstruction
Jiayang Shi, Daniel M. Pelt, K. Joost Batenburg
eess.IVcs.AIcs.CVarXiv:2602.18589v12026Neural Style Transfer: A Review
Yongcheng Jing, Yezhou Yang, Zunlei Feng +3
cs.CVcs.NEeess.IVarXiv:1705.04058v72017CHAOS Challenge -- Combined (CT-MR) Healthy Abdominal Organ Segmentation
A. Emre Kavur, N. Sinem Gezer, Mustafa Barış +24
eess.IVcs.CVarXiv:2001.06535v32020COVID-CT-Dataset: A CT Scan Dataset about COVID-19
Xingyi Yang, Xuehai He, Jinyu Zhao +3
cs.LGcs.CVeess.IVarXiv:2003.13865v32020Classification of COVID-19 in chest X-ray images using DeTraC deep convolutional neural network
Asmaa Abbas, Mohammed M. Abdelsamea, Mohamed Medhat Gaber
eess.IVcs.CVcs.LGarXiv:2003.13815v32020The Creation and Detection of Deepfakes: A Survey
Yisroel Mirsky, Wenke Lee
cs.CVcs.LGeess.IVarXiv:2004.11138v32020From Scale to Speed: Adaptive Test-Time Scaling for Image Editing
Xiangyan Qu, Zhenlong Yuan, Jing Tang +9
cs.CVcs.AIcs.LGarXiv:2603.00141v32026A Survey of Modern Deep Learning based Object Detection Models
Syed Sahil Abbas Zaidi, Mohammad Samar Ansari, Asra Aslam +3
cs.CVcs.LGeess.IVarXiv:2104.11892v22021Image Augmentation Is All You Need: Regularizing Deep Reinforcement Learning from Pixels
Ilya Kostrikov, Denis Yarats, Rob Fergus
cs.LGcs.CVeess.IVarXiv:2004.13649v42020FireRed-OCR Technical Report
Hao Wu, Haoran Lou, Xinyue Li +19
cs.CVeess.IVarXiv:2603.01840v12026U-Mamba: Enhancing Long-range Dependency for Biomedical Image Segmentation
Jun Ma, Feifei Li, Bo Wang
eess.IVcs.CVcs.LGarXiv:2401.04722v12024Medical Image Segmentation Review: The success of U-Net
Reza Azad, Ehsan Khodapanah Aghdam, Amelie Rauland +7
eess.IVcs.CVarXiv:2211.14830v12022Designing a Practical Degradation Model for Deep Blind Image Super-Resolution
Kai Zhang, Jingyun Liang, Luc Van Gool +1
eess.IVcs.CVarXiv:2103.14006v22021"Zero-Shot" Super-Resolution using Deep Internal Learning
Assaf Shocher, Nadav Cohen, Michal Irani
cs.CVcs.LGcs.NEarXiv:1712.06087v12017Leveraging Frequency Analysis for Deep Fake Image Recognition
Joel Frank, Thorsten Eisenhofer, Lea Schönherr +3
cs.CVeess.IVarXiv:2003.08685v32020UNeXt: MLP-based Rapid Medical Image Segmentation Network
Jeya Maria Jose Valanarasu, Vishal M. Patel
eess.IVcs.CVarXiv:2203.04967v12022A large annotated medical image dataset for the development and evaluation of segmentation algorithms
Amber L. Simpson, Michela Antonelli, Spyridon Bakas +21
cs.CVeess.IVarXiv:1902.09063v12019Embracing Imperfect Datasets: A Review of Deep Learning Solutions for Medical Image Segmentation
Nima Tajbakhsh, Laura Jeyaseelan, Qian Li +3
eess.IVcs.CVcs.LGarXiv:1908.10454v22019Domain Adaptation for Medical Image Analysis: A Survey
Hao Guan, Mingxia Liu
cs.CVcs.LGeess.IVarXiv:2102.09508v12021Frozen CLIP Priors for Robust Self-Supervised Poisson Inverse Problems
Laura C. Diaz-Delgado, Emmanuel Martinez, Henry Arguello
eess.IVcs.CVarXiv:2608.20524v12026Sparse Light Field Sampling Improves Casual 3D and 4D Reconstruction
Shamus Li, Ruiming Cao, Laura Waller +2
eess.IVcs.CVarXiv:2608.20602v12026VM-UNet: Vision Mamba UNet for Medical Image Segmentation
Jiacheng Ruan, Jincheng Li, Suncheng Xiang
eess.IVcs.CVarXiv:2402.02491v22024A review of deep learning in medical imaging: Imaging traits, technology trends, case studies with progress highlights, and future promises
S. Kevin Zhou, Hayit Greenspan, Christos Davatzikos +6
cs.CVeess.IVarXiv:2008.09104v22020COVID-19 Image Data Collection
Joseph Paul Cohen, Paul Morrison, Lan Dao
eess.IVcs.CVcs.LGarXiv:2003.11597v12020Toward Vision Language Model-based Assessment of Clinical Quality and Usability of LGE-MR Images for Cardiac Ablation Planning
Bipasha Kundu, Abhishek Chaturvedi, Axel W. E. Wismueller +2
eess.IVcs.CVarXiv:2608.21180v12026COVIDX-Net: A Framework of Deep Learning Classifiers to Diagnose COVID-19 in X-Ray Images
Ezz El-Din Hemdan, Marwa A. Shouman, Mohamed Esmail Karar
eess.IVcs.CVcs.LGarXiv:2003.11055v12020A survey of loss functions for semantic segmentation
Shruti Jadon
eess.IVcs.CVcs.LGarXiv:2006.14822v42020GridDehazeNet: Attention-Based Multi-Scale Network for Image Dehazing
Xiaohong Liu, Yongrui Ma, Zhihao Shi +1
cs.CVeess.IVarXiv:1908.03245v12019FireRed-Image-Edit-1.0 Technical Report
Super Intelligence Team, Changhao Qiao, Chao Hui +16
cs.CVeess.IVarXiv:2602.13344v22026Densely Connected Pyramid Dehazing Network
He Zhang, Vishal M. Patel
cs.CVeess.IVarXiv:1803.08396v12018Salt: Self-Consistent Distribution Matching with Cache-Aware Training for Fast Video Generation
Xingtong Ge, Yi Zhang, Yushi Huang +6
cs.CVeess.IVarXiv:2604.03118v22026ECHO: Efficient Chest X-ray Report Generation with One-step Block Diffusion
Lifeng Chen, Tianqi You, Hao Liu +8
cs.LGcs.AIeess.IVarXiv:2604.09450v22026Consistency Models for Fast MRI Reconstruction Using Regularization by Denoising
Merve Gülle, Junno Yun, Yaşar Utku Alçalar +1
eess.IVcs.AIcs.CVarXiv:2608.20561v12026Differentiable Volumetric Rendering: Learning Implicit 3D Representations without 3D Supervision
Michael Niemeyer, Lars Mescheder, Michael Oechsle +1
cs.CVcs.LGeess.IVarXiv:1912.07372v22019Summaries:한국어Activating More Pixels in Image Super-Resolution Transformer
Xiangyu Chen, Xintao Wang, Jiantao Zhou +2
eess.IVcs.CVarXiv:2205.04437v32022PointPainting: Sequential Fusion for 3D Object Detection
Sourabh Vora, Alex H. Lang, Bassam Helou +1
cs.CVcs.LGeess.IVarXiv:1911.10150v22019Inf-Net: Automatic COVID-19 Lung Infection Segmentation from CT Images
Deng-Ping Fan, Tao Zhou, Ge-Peng Ji +5
eess.IVcs.CVcs.LGarXiv:2004.14133v42020ATTN-FIQA: Interpretable Attention-based Face Image Quality Assessment with Vision Transformers
Guray Ozgur, Tahar Chettaoui, Eduarda Caldeira +5
cs.CVeess.IVarXiv:2604.22841v12026MIMIC-CXR-JPG, a large publicly available database of labeled chest radiographs
Alistair E. W. Johnson, Tom J. Pollard, Nathaniel R. Greenbaum +7
cs.CVcs.LGeess.IVarXiv:1901.07042v52019Self-Supervised Learning from Images with a Joint-Embedding Predictive Architecture
Mahmoud Assran, Quentin Duval, Ishan Misra +5
cs.CVcs.AIcs.LGarXiv:2301.08243v32023CoroNet: A deep neural network for detection and diagnosis of COVID-19 from chest x-ray images
Asif Iqbal Khan, Junaid Latief Shah, Mudasir Bhat
eess.IVcs.LGstat.MLarXiv:2004.04931v32020Transformers in Medical Imaging: A Survey
Fahad Shamshad, Salman Khan, Syed Waqas Zamir +4
eess.IVcs.CVarXiv:2201.09873v12022UCTransNet: Rethinking the Skip Connections in U-Net from a Channel-wise Perspective with Transformer
Haonan Wang, Peng Cao, Jiaqi Wang +1
cs.CVcs.LGeess.IVarXiv:2109.04335v32021Plug-and-Play Image Restoration with Deep Denoiser Prior
Kai Zhang, Yawei Li, Wangmeng Zuo +3
eess.IVcs.CVarXiv:2008.13751v22020Learned Image Compression with Discretized Gaussian Mixture Likelihoods and Attention Modules
Zhengxue Cheng, Heming Sun, Masaru Takeuchi +1
eess.IVarXiv:2001.01568v32020LiVeAction: a Lightweight, Versatile, and Asymmetric Neural Codec Design for Real-time Operation
Dan Jacobellis, Neeraja J. Yadwadkar
eess.IVcs.LGcs.MMarXiv:2605.06628v12026Denoising Diffusion Restoration Models
Bahjat Kawar, Michael Elad, Stefano Ermon +1
eess.IVcs.CVcs.LGarXiv:2201.11793v32022ResUNet++: An Advanced Architecture for Medical Image Segmentation
Debesh Jha, Pia H. Smedsrud, Michael A. Riegler +4
eess.IVcs.CVarXiv:1911.07067v12019The Replica Dataset: A Digital Replica of Indoor Spaces
Julian Straub, Thomas Whelan, Lingni Ma +27
cs.CVcs.GReess.IVarXiv:1906.05797v12019Resolution-robust Large Mask Inpainting with Fourier Convolutions
Roman Suvorov, Elizaveta Logacheva, Anton Mashikhin +7
cs.CVeess.IVarXiv:2109.07161v22021