Image and Video Processing

Papers filed under eess.IV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

661 to 720 of 1,301

  1. Generative Adversarial Network for Medical Images (MI-GAN)

    Talha Iqbal, Hazrat Ali

    cs.LGcs.CVeess.IVarXiv:1810.00551v12018
  2. VinDr-Mammo: A large-scale benchmark dataset for computer-aided diagnosis in full-field digital mammography

    Hieu T. Nguyen, Ha Q. Nguyen, Hieu H. Pham +4

    eess.IVcs.CVarXiv:2203.11205v22022
  3. Breaking the Dilemma of Medical Image-to-image Translation

    Lingke Kong, Chenyu Lian, Detian Huang +3

    eess.IVcs.CVarXiv:2110.06465v22021
  4. DeepWiVe: Deep-Learning-Aided Wireless Video Transmission

    Tze-Yang Tung, Deniz Gündüz

    eess.IVcs.LGcs.MMarXiv:2111.13034v12021
  5. Swin2SR: SwinV2 Transformer for Compressed Image Super-Resolution and Restoration

    Marcos V. Conde, Ui-Jin Choi, Maxime Burchi +1

    cs.CVeess.IVarXiv:2209.11345v12022
  6. AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation

    Huawei Wei, Zejun Yang, Zhisheng Wang

    cs.CVcs.GReess.IVarXiv:2403.17694v12024
  7. Fourier Spectrum Discrepancies in Deep Network Generated Images

    Tarik Dzanic, Karan Shah, Freddie Witherden

    eess.IVcs.LGstat.MLarXiv:1911.06465v32019
  8. Multi-Task Recurrent Convolutional Network with Correlation Loss for Surgical Video Analysis

    Yueming Jin, Huaxia Li, Qi Dou +4

    cs.CVcs.LGeess.IVarXiv:1907.06099v12019
  9. Instance-aware, Context-focused, and Memory-efficient Weakly Supervised Object Detection

    Zhongzheng Ren, Zhiding Yu, Xiaodong Yang +4

    cs.CVcs.LGeess.IVarXiv:2004.04725v32020
  10. Diffusion Probabilistic Models beat GANs on Medical Images

    Gustav Müller-Franzes, Jan Moritz Niehues, Firas Khader +8

    eess.IVcs.CVarXiv:2212.07501v12022
  11. Details or Artifacts: A Locally Discriminative Learning Approach to Realistic Image Super-Resolution

    Jie Liang, Hui Zeng, Lei Zhang

    eess.IVcs.CVarXiv:2203.09195v12022
  12. Knowledge Matters: Radiology Report Generation with General and Specific Knowledge

    Shuxin Yang, Xian Wu, Shen Ge +2

    eess.IVcs.CLcs.CVarXiv:2112.15009v22021
  13. Domain Generalization for Medical Imaging Classification with Linear-Dependency Regularization

    Haoliang Li, YuFei Wang, Renjie Wan +3

    cs.CVcs.LGeess.IVarXiv:2009.12829v32020
  14. Deep Optics for Monocular Depth Estimation and 3D Object Detection

    Julie Chang, Gordon Wetzstein

    cs.CVeess.IVarXiv:1904.08601v12019
  15. Handheld Multi-Frame Super-Resolution

    Bartlomiej Wronski, Ignacio Garcia-Dorado, Manfred Ernst +5

    cs.CVeess.IVarXiv:1905.03277v22019
  16. TopologyGAN: Topology Optimization Using Generative Adversarial Networks Based on Physical Fields Over the Initial Domain

    Zhenguo Nie, Tong Lin, Haoliang Jiang +1

    cs.CEcs.AIeess.IVarXiv:2003.04685v22020
  17. Domain Adaptation without Source Data

    Youngeun Kim, Donghyeon Cho, Kyeongtak Han +2

    cs.CVcs.LGeess.IVarXiv:2007.01524v42020
  18. Learning to Predict Layout-to-image Conditional Convolutions for Semantic Image Synthesis

    Xihui Liu, Guojun Yin, Jing Shao +2

    cs.CVcs.LGeess.IVarXiv:1910.06809v32019
  19. Deep learning in ultrasound imaging

    Ruud JG van Sloun, Regev Cohen, Yonina C Eldar

    eess.SPcs.LGeess.IVarXiv:1907.02994v22019
  20. Manifold-Constrained PET Reconstruction with Learned Flow-Matching Priors

    Hengjia Ran, Jie Luo, Yutao Zhu +3

    eess.IVarXiv:2608.29158v12026
  21. Exploring large scale public medical image datasets

    Luke Oakden-Rayner

    eess.IVcs.CVcs.LGarXiv:1907.12720v12019
  22. Multimodal Deep Learning for Uncertainty-Aware Radiation Pneumonitis Risk Prediction

    Jin Yang, Tian Liu, Jing Wang +4

    eess.IVarXiv:2608.28937v12026
  23. Polyp Segmentation in Colonoscopy Images Using Fully Convolutional Network

    Mojtaba Akbari, Majid Mohrekesh, Ebrahim Nasr-Esfahani +4

    eess.IVarXiv:1802.00368v12018
  24. Deep Learning Fundus Image Analysis for Diabetic Retinopathy and Macular Edema Grading

    Jaakko Sahlsten, Joel Jaskari, Jyri Kivinen +4

    eess.IVcs.CVcs.LGarXiv:1904.08764v12019
  25. A Generalized Deep Learning Framework for Whole-Slide Image Segmentation and Analysis

    Mahendra Khened, Avinash Kori, Haran Rajkumar +2

    eess.IVcs.CVcs.LGarXiv:2001.00258v22020
  26. SCoPE-Reg: Efficient Rigid Ultrasound Slice-to-Volume Registration via State-Space Correlation and Closed-Form Pose Estimation

    Niklas Schwarz, Jens Kleesiek, Moritz Rempe

    eess.IVcs.CVarXiv:2608.28715v12026
  27. SemanticPOSS: A Point Cloud Dataset with Large Quantity of Dynamic Instances

    Yancheng Pan, Biao Gao, Jilin Mei +3

    cs.ROcs.CVeess.IVarXiv:2002.09147v12020
  28. A Robust Volumetric Transformer for Accurate 3D Tumor Segmentation

    Himashi Peiris, Munawar Hayat, Zhaolin Chen +2

    eess.IVcs.CVarXiv:2111.13300v22021
  29. Coronary Mask Guided Registration for Continuous Time 4D Cardiac CT Dataset Construction

    Yuang Wang, Shuo Wang, Changyu Chen +12

    eess.IVcs.CVarXiv:2608.28712v12026
  30. From CNN to Transformer: A Review of Medical Image Segmentation Models

    Wenjian Yao, Jiajun Bai, Wei Liao +3

    eess.IVcs.CVcs.LGarXiv:2308.05305v12023
  31. Pothole Detection Based on Disparity Transformation and Road Surface Modeling

    Rui Fan, Umar Ozgunalp, Brett Hosking +2

    cs.CVeess.IVarXiv:1908.00894v32019
  32. Multi-scale Domain-adversarial Multiple-instance CNN for Cancer Subtype Classification with Unannotated Histopathological Images

    Noriaki Hashimoto, Daisuke Fukushima, Ryoichi Koga +7

    cs.CVcs.LGeess.IVarXiv:2001.01599v22020
  33. Cloze Test Helps: Effective Video Anomaly Detection via Learning to Complete Video Events

    Guang Yu, Siqi Wang, Zhiping Cai +4

    cs.CVcs.LGeess.IVarXiv:2008.11988v12020
  34. Automatic Radiology Report Generation based on Multi-view Image Fusion and Medical Concept Enrichment

    Jianbo Yuan, Haofu Liao, Rui Luo +1

    eess.IVcs.CVcs.MMarXiv:1907.09085v22019
  35. Learning JPEG Compression Artifacts for Image Manipulation Detection and Localization

    Myung-Joon Kwon, Seung-Hun Nam, In-Jae Yu +2

    eess.IVcs.CVcs.LGarXiv:2108.12947v22021
  36. RAPIQUE: Rapid and Accurate Video Quality Prediction of User Generated Content

    Zhengzhong Tu, Xiangxu Yu, Yilin Wang +3

    cs.CVcs.MMeess.IVarXiv:2101.10955v22021
  37. Inferring Point Cloud Quality via Graph Similarity

    Qi Yang, Zhan Ma, Yiling Xu +2

    eess.IVcs.MMarXiv:2006.00497v22020
  38. A Review on Deep Learning Techniques for the Diagnosis of Novel Coronavirus (COVID-19)

    Md. Milon Islam, Fakhri Karray, Reda Alhajj +1

    eess.IVcs.CVcs.LGarXiv:2008.04815v12020
  39. ViTGAN: Training GANs with Vision Transformers

    Kwonjoon Lee, Huiwen Chang, Lu Jiang +3

    cs.CVcs.LGeess.IVarXiv:2107.04589v22021
  40. The MYOSAIQ Challenge: Myocardial Segmentation with Automated Infarct Quantification

    Olivier Bernard, William A. Romero R., Cyprien Bouton +24

    eess.IVcs.CVarXiv:2608.29246v12026
  41. Understanding SSIM

    Jim Nilsson, Tomas Akenine-Möller

    eess.IVcs.GRarXiv:2006.13846v22020
  42. PulseGAN: Learning to generate realistic pulse waveforms in remote photoplethysmography

    Rencheng Song, Huan Chen, Juan Cheng +3

    eess.IVarXiv:2006.02699v12020
  43. Recent Advances and New Guidelines on Hyperspectral and Multispectral Image Fusion

    Renwei Dian, Shutao Li, Bin Sun +1

    eess.IVcs.CVarXiv:2008.03426v12020
  44. 70 years of machine learning in geoscience in review

    Jesper Sören Dramsch

    physics.geo-phcs.CVcs.LGarXiv:2006.13311v32020
  45. Predicting COVID-19 Pneumonia Severity on Chest X-ray with Deep Learning

    Joseph Paul Cohen, Lan Dao, Paul Morrison +8

    eess.IVcs.LGq-bio.QMarXiv:2005.11856v32020
  46. High-Throughput Precision Phenotyping of Left Ventricular Hypertrophy with Cardiovascular Deep Learning

    Grant Duffy, Paul P Cheng, Neal Yuan +15

    eess.IVcs.CVcs.LGarXiv:2106.12511v12021
  47. A Background-Agnostic Framework with Adversarial Training for Abnormal Event Detection in Video

    Mariana-Iuliana Georgescu, Radu Tudor Ionescu, Fahad Shahbaz Khan +2

    cs.CVeess.IVarXiv:2008.12328v52020
  48. PREDICT & CLUSTER: Unsupervised Skeleton Based Action Recognition

    Kun Su, Xiulong Liu, Eli Shlizerman

    cs.CVcs.LGeess.IVarXiv:1911.12409v12019
  49. Modality specific U-Net variants for biomedical image segmentation: A survey

    Narinder Singh Punn, Sonali Agarwal

    eess.IVcs.CVarXiv:2107.04537v42021
  50. An Online Plug-and-Play Algorithm for Regularized Image Reconstruction

    Yu Sun, Brendt Wohlberg, Ulugbek S. Kamilov

    cs.CVeess.IVarXiv:1809.04693v12018
  51. Blueprint Separable Residual Network for Efficient Image Super-Resolution

    Zheyuan Li, Yingqi Liu, Xiangyu Chen +4

    cs.CVeess.IVarXiv:2205.05996v12022
  52. Non-local Meets Global: An Iterative Paradigm for Hyperspectral Image Restoration

    Wei He, Quanming Yao, Chao Li +4

    eess.IVcs.CVarXiv:2010.12921v12020
  53. HPLFlowNet: Hierarchical Permutohedral Lattice FlowNet for Scene Flow Estimation on Large-scale Point Clouds

    Xiuye Gu, Yijie Wang, Chongruo wu +2

    cs.CVcs.LGeess.IVarXiv:1906.05332v12019
  54. Global Guidance Network for Breast Lesion Segmentation in Ultrasound Images

    Cheng Xue, Lei Zhu, Huazhu Fu +4

    eess.IVcs.CVcs.LGarXiv:2104.01896v12021
  55. Implicit Neural Representations for Image Compression

    Yannick Strümpler, Janis Postels, Ren Yang +2

    eess.IVcs.CVcs.LGarXiv:2112.04267v22021
  56. MatchFormer: Interleaving Attention in Transformers for Feature Matching

    Qing Wang, Jiaming Zhang, Kailun Yang +2

    cs.CVcs.ROeess.IVarXiv:2203.09645v32022
  57. A Poisson-Gaussian Denoising Dataset with Real Fluorescence Microscopy Images

    Yide Zhang, Yinhao Zhu, Evan Nichols +4

    cs.CVcs.LGeess.IVarXiv:1812.10366v22018
  58. Vibration-Based Damage Detection in Wind Turbine Blades using Phase-Based Motion Estimation and Motion Magnification

    Aral Sarrafi, Zhu Mao, Christopher Niezrecki +1

    eess.IVcs.CVarXiv:1804.00558v12018
  59. Plug-and-Play Algorithms for Large-scale Snapshot Compressive Imaging

    Xin Yuan, Yang Liu, Jinli Suo +1

    eess.IVcs.CVarXiv:2003.13654v22020
  60. Video Compression With Rate-Distortion Autoencoders

    Amirhossein Habibian, Ties van Rozendaal, Jakub M. Tomczak +1

    eess.IVcs.LGstat.MLarXiv:1908.05717v22019