Image and Video Processing

Papers filed under eess.IV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

1,201 to 1,260 of 1,311

  1. Deep Semantic Segmentation of Natural and Medical Images: A Review

    Saeid Asgari Taghanaki, Kumar Abhishek, Joseph Paul Cohen +2

    cs.CVcs.LGeess.IVarXiv:1910.07655v42019
  2. DoubleU-Net: A Deep Convolutional Neural Network for Medical Image Segmentation

    Debesh Jha, Michael A. Riegler, Dag Johansen +2

    eess.IVcs.CVarXiv:2006.04868v22020
  3. HigherHRNet: Scale-Aware Representation Learning for Bottom-Up Human Pose Estimation

    Bowen Cheng, Bin Xiao, Jingdong Wang +3

    cs.CVcs.LGeess.IVarXiv:1908.10357v32019
  4. Single Image Super-Resolution via a Holistic Attention Network

    Ben Niu, Weilei Wen, Wenqi Ren +6

    eess.IVcs.CVarXiv:2008.08767v12020
  5. Multi-Scale Progressive Fusion Network for Single Image Deraining

    Kui Jiang, Zhongyuan Wang, Peng Yi +5

    cs.CVcs.LGeess.IVarXiv:2003.10985v22020
  6. Spanning the Visual Analogy Space with a Weight Basis of LoRAs

    Hila Manor, Rinon Gal, Haggai Maron +2

    cs.CVcs.AIcs.GRarXiv:2602.15727v22026
  7. PadChest: A large chest x-ray image dataset with multi-label annotated reports

    Aurelia Bustos, Antonio Pertusa, Jose-Maria Salinas +1

    eess.IVcs.CVarXiv:1901.07441v22019
  8. Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms

    Muyang He, Hanzhong Guo, Junxiong Lin +1

    eess.IVcs.CVarXiv:2603.28489v32026
  9. COVID-19 Image Data Collection: Prospective Predictions Are the Future

    Joseph Paul Cohen, Paul Morrison, Lan Dao +3

    q-bio.QMcs.CVcs.LGarXiv:2006.11988v32020
  10. DVC: An End-to-end Deep Video Compression Framework

    Guo Lu, Wanli Ouyang, Dong Xu +3

    eess.IVcs.CVarXiv:1812.00101v32018
  11. DM4CT: Benchmarking Diffusion Models for Computed Tomography Reconstruction

    Jiayang Shi, Daniel M. Pelt, K. Joost Batenburg

    eess.IVcs.AIcs.CVarXiv:2602.18589v12026
  12. Neural Style Transfer: A Review

    Yongcheng Jing, Yezhou Yang, Zunlei Feng +3

    cs.CVcs.NEeess.IVarXiv:1705.04058v72017
  13. CHAOS Challenge -- Combined (CT-MR) Healthy Abdominal Organ Segmentation

    A. Emre Kavur, N. Sinem Gezer, Mustafa Barış +24

    eess.IVcs.CVarXiv:2001.06535v32020
  14. COVID-CT-Dataset: A CT Scan Dataset about COVID-19

    Xingyi Yang, Xuehai He, Jinyu Zhao +3

    cs.LGcs.CVeess.IVarXiv:2003.13865v32020
  15. Classification of COVID-19 in chest X-ray images using DeTraC deep convolutional neural network

    Asmaa Abbas, Mohammed M. Abdelsamea, Mohamed Medhat Gaber

    eess.IVcs.CVcs.LGarXiv:2003.13815v32020
  16. The Creation and Detection of Deepfakes: A Survey

    Yisroel Mirsky, Wenke Lee

    cs.CVcs.LGeess.IVarXiv:2004.11138v32020
  17. From Scale to Speed: Adaptive Test-Time Scaling for Image Editing

    Xiangyan Qu, Zhenlong Yuan, Jing Tang +9

    cs.CVcs.AIcs.LGarXiv:2603.00141v32026
  18. A Survey of Modern Deep Learning based Object Detection Models

    Syed Sahil Abbas Zaidi, Mohammad Samar Ansari, Asra Aslam +3

    cs.CVcs.LGeess.IVarXiv:2104.11892v22021
  19. Image Augmentation Is All You Need: Regularizing Deep Reinforcement Learning from Pixels

    Ilya Kostrikov, Denis Yarats, Rob Fergus

    cs.LGcs.CVeess.IVarXiv:2004.13649v42020
  20. FireRed-OCR Technical Report

    Hao Wu, Haoran Lou, Xinyue Li +19

    cs.CVeess.IVarXiv:2603.01840v12026
  21. U-Mamba: Enhancing Long-range Dependency for Biomedical Image Segmentation

    Jun Ma, Feifei Li, Bo Wang

    eess.IVcs.CVcs.LGarXiv:2401.04722v12024
  22. Medical Image Segmentation Review: The success of U-Net

    Reza Azad, Ehsan Khodapanah Aghdam, Amelie Rauland +7

    eess.IVcs.CVarXiv:2211.14830v12022
  23. Designing a Practical Degradation Model for Deep Blind Image Super-Resolution

    Kai Zhang, Jingyun Liang, Luc Van Gool +1

    eess.IVcs.CVarXiv:2103.14006v22021
  24. "Zero-Shot" Super-Resolution using Deep Internal Learning

    Assaf Shocher, Nadav Cohen, Michal Irani

    cs.CVcs.LGcs.NEarXiv:1712.06087v12017
  25. Leveraging Frequency Analysis for Deep Fake Image Recognition

    Joel Frank, Thorsten Eisenhofer, Lea Schönherr +3

    cs.CVeess.IVarXiv:2003.08685v32020
  26. UNeXt: MLP-based Rapid Medical Image Segmentation Network

    Jeya Maria Jose Valanarasu, Vishal M. Patel

    eess.IVcs.CVarXiv:2203.04967v12022
  27. A large annotated medical image dataset for the development and evaluation of segmentation algorithms

    Amber L. Simpson, Michela Antonelli, Spyridon Bakas +21

    cs.CVeess.IVarXiv:1902.09063v12019
  28. Embracing Imperfect Datasets: A Review of Deep Learning Solutions for Medical Image Segmentation

    Nima Tajbakhsh, Laura Jeyaseelan, Qian Li +3

    eess.IVcs.CVcs.LGarXiv:1908.10454v22019
  29. Domain Adaptation for Medical Image Analysis: A Survey

    Hao Guan, Mingxia Liu

    cs.CVcs.LGeess.IVarXiv:2102.09508v12021
  30. Frozen CLIP Priors for Robust Self-Supervised Poisson Inverse Problems

    Laura C. Diaz-Delgado, Emmanuel Martinez, Henry Arguello

    eess.IVcs.CVarXiv:2608.20524v12026
  31. Sparse Light Field Sampling Improves Casual 3D and 4D Reconstruction

    Shamus Li, Ruiming Cao, Laura Waller +2

    eess.IVcs.CVarXiv:2608.20602v12026
  32. VM-UNet: Vision Mamba UNet for Medical Image Segmentation

    Jiacheng Ruan, Jincheng Li, Suncheng Xiang

    eess.IVcs.CVarXiv:2402.02491v22024
  33. A review of deep learning in medical imaging: Imaging traits, technology trends, case studies with progress highlights, and future promises

    S. Kevin Zhou, Hayit Greenspan, Christos Davatzikos +6

    cs.CVeess.IVarXiv:2008.09104v22020
  34. COVID-19 Image Data Collection

    Joseph Paul Cohen, Paul Morrison, Lan Dao

    eess.IVcs.CVcs.LGarXiv:2003.11597v12020
  35. Toward Vision Language Model-based Assessment of Clinical Quality and Usability of LGE-MR Images for Cardiac Ablation Planning

    Bipasha Kundu, Abhishek Chaturvedi, Axel W. E. Wismueller +2

    eess.IVcs.CVarXiv:2608.21180v12026
  36. COVIDX-Net: A Framework of Deep Learning Classifiers to Diagnose COVID-19 in X-Ray Images

    Ezz El-Din Hemdan, Marwa A. Shouman, Mohamed Esmail Karar

    eess.IVcs.CVcs.LGarXiv:2003.11055v12020
  37. A survey of loss functions for semantic segmentation

    Shruti Jadon

    eess.IVcs.CVcs.LGarXiv:2006.14822v42020
  38. GridDehazeNet: Attention-Based Multi-Scale Network for Image Dehazing

    Xiaohong Liu, Yongrui Ma, Zhihao Shi +1

    cs.CVeess.IVarXiv:1908.03245v12019
  39. FireRed-Image-Edit-1.0 Technical Report

    Super Intelligence Team, Changhao Qiao, Chao Hui +16

    cs.CVeess.IVarXiv:2602.13344v22026
  40. Densely Connected Pyramid Dehazing Network

    He Zhang, Vishal M. Patel

    cs.CVeess.IVarXiv:1803.08396v12018
  41. Salt: Self-Consistent Distribution Matching with Cache-Aware Training for Fast Video Generation

    Xingtong Ge, Yi Zhang, Yushi Huang +6

    cs.CVeess.IVarXiv:2604.03118v22026
  42. ECHO: Efficient Chest X-ray Report Generation with One-step Block Diffusion

    Lifeng Chen, Tianqi You, Hao Liu +8

    cs.LGcs.AIeess.IVarXiv:2604.09450v22026
  43. Consistency Models for Fast MRI Reconstruction Using Regularization by Denoising

    Merve Gülle, Junno Yun, Yaşar Utku Alçalar +1

    eess.IVcs.AIcs.CVarXiv:2608.20561v12026
  44. Differentiable Volumetric Rendering: Learning Implicit 3D Representations without 3D Supervision

    Michael Niemeyer, Lars Mescheder, Michael Oechsle +1

    cs.CVcs.LGeess.IVarXiv:1912.07372v22019
    Summaries:한국어
  45. Activating More Pixels in Image Super-Resolution Transformer

    Xiangyu Chen, Xintao Wang, Jiantao Zhou +2

    eess.IVcs.CVarXiv:2205.04437v32022
  46. PointPainting: Sequential Fusion for 3D Object Detection

    Sourabh Vora, Alex H. Lang, Bassam Helou +1

    cs.CVcs.LGeess.IVarXiv:1911.10150v22019
  47. Inf-Net: Automatic COVID-19 Lung Infection Segmentation from CT Images

    Deng-Ping Fan, Tao Zhou, Ge-Peng Ji +5

    eess.IVcs.CVcs.LGarXiv:2004.14133v42020
  48. ATTN-FIQA: Interpretable Attention-based Face Image Quality Assessment with Vision Transformers

    Guray Ozgur, Tahar Chettaoui, Eduarda Caldeira +5

    cs.CVeess.IVarXiv:2604.22841v12026
  49. MIMIC-CXR-JPG, a large publicly available database of labeled chest radiographs

    Alistair E. W. Johnson, Tom J. Pollard, Nathaniel R. Greenbaum +7

    cs.CVcs.LGeess.IVarXiv:1901.07042v52019
  50. Self-Supervised Learning from Images with a Joint-Embedding Predictive Architecture

    Mahmoud Assran, Quentin Duval, Ishan Misra +5

    cs.CVcs.AIcs.LGarXiv:2301.08243v32023
  51. CoroNet: A deep neural network for detection and diagnosis of COVID-19 from chest x-ray images

    Asif Iqbal Khan, Junaid Latief Shah, Mudasir Bhat

    eess.IVcs.LGstat.MLarXiv:2004.04931v32020
  52. Transformers in Medical Imaging: A Survey

    Fahad Shamshad, Salman Khan, Syed Waqas Zamir +4

    eess.IVcs.CVarXiv:2201.09873v12022
  53. UCTransNet: Rethinking the Skip Connections in U-Net from a Channel-wise Perspective with Transformer

    Haonan Wang, Peng Cao, Jiaqi Wang +1

    cs.CVcs.LGeess.IVarXiv:2109.04335v32021
  54. Plug-and-Play Image Restoration with Deep Denoiser Prior

    Kai Zhang, Yawei Li, Wangmeng Zuo +3

    eess.IVcs.CVarXiv:2008.13751v22020
  55. Learned Image Compression with Discretized Gaussian Mixture Likelihoods and Attention Modules

    Zhengxue Cheng, Heming Sun, Masaru Takeuchi +1

    eess.IVarXiv:2001.01568v32020
  56. LiVeAction: a Lightweight, Versatile, and Asymmetric Neural Codec Design for Real-time Operation

    Dan Jacobellis, Neeraja J. Yadwadkar

    eess.IVcs.LGcs.MMarXiv:2605.06628v12026
  57. Denoising Diffusion Restoration Models

    Bahjat Kawar, Michael Elad, Stefano Ermon +1

    eess.IVcs.CVcs.LGarXiv:2201.11793v32022
  58. ResUNet++: An Advanced Architecture for Medical Image Segmentation

    Debesh Jha, Pia H. Smedsrud, Michael A. Riegler +4

    eess.IVcs.CVarXiv:1911.07067v12019
  59. The Replica Dataset: A Digital Replica of Indoor Spaces

    Julian Straub, Thomas Whelan, Lingni Ma +27

    cs.CVcs.GReess.IVarXiv:1906.05797v12019
  60. Resolution-robust Large Mask Inpainting with Fourier Convolutions

    Roman Suvorov, Elizaveta Logacheva, Anton Mashikhin +7

    cs.CVeess.IVarXiv:2109.07161v22021