Image and Video Processing

Papers filed under eess.IV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

601 to 660 of 1,302

  1. HyperSIGMA: Hyperspectral Intelligence Comprehension Foundation Model

    Di Wang, Meiqi Hu, Yao Jin +19

    cs.CVeess.IVarXiv:2406.11519v22024
  2. A Critic Evaluation of Methods for COVID-19 Automatic Detection from X-Ray Images

    Gianluca Maguolo, Loris Nanni

    eess.IVcs.CVcs.LGarXiv:2004.12823v42020
  3. KiU-Net: Overcomplete Convolutional Architectures for Biomedical Image and Volumetric Segmentation

    Jeya Maria Jose Valanarasu, Vishwanath A. Sindagi, Ilker Hacihaliloglu +1

    eess.IVcs.CVarXiv:2010.01663v22020
  4. Perceptually Regularized Diffusion Model for Image Super-Resolution

    Chuxiangbo Wang, Pavithra Venkatachalapathy, Ying Liang +4

    eess.IVcs.CVcs.LGarXiv:2609.02016v12026
  5. AP-BSN: Self-Supervised Denoising for Real-World Images via Asymmetric PD and Blind-Spot Network

    Wooseok Lee, Sanghyun Son, Kyoung Mu Lee

    cs.CVeess.IVarXiv:2203.11799v22022
  6. A Realistic Fish-Habitat Dataset to Evaluate Algorithms for Underwater Visual Analysis

    Alzayat Saleh, Issam H. Laradji, Dmitry A. Konovalov +3

    cs.CVcs.LGeess.IVarXiv:2008.12603v12020
  7. Dual Contrastive Learning for Unsupervised Image-to-Image Translation

    Junlin Han, Mehrdad Shoeiby, Lars Petersson +1

    cs.CVeess.IVarXiv:2104.07689v12021
  8. HDR-GAN: HDR Image Reconstruction from Multi-Exposed LDR Images with Large Motions

    Yuzhen Niu, Jianbin Wu, Wenxi Liu +2

    eess.IVcs.CVarXiv:2007.01628v12020
  9. Remote Sensing Image Super-resolution and Object Detection: Benchmark and State of the Art

    Yi Wang, Syed Muhammad Arsalan Bashir, Mahrukh Khan +5

    cs.CVcs.AIcs.LGarXiv:2111.03260v12021
  10. Sanity Checks for Saliency Metrics

    Richard Tomsett, Dan Harborne, Supriyo Chakraborty +2

    cs.LGcs.CVeess.IVarXiv:1912.01451v12019
  11. Benchmarking the Robustness of Semantic Segmentation Models

    Christoph Kamann, Carsten Rother

    cs.CVeess.IVarXiv:1908.05005v32019
  12. CLOTH3D: Clothed 3D Humans

    Hugo Bertiche, Meysam Madadi, Sergio Escalera

    cs.CVcs.LGeess.IVarXiv:1912.02792v22019
  13. Degradation-Aware Unfolding Half-Shuffle Transformer for Spectral Compressive Imaging

    Yuanhao Cai, Jing Lin, Haoqian Wang +5

    eess.IVcs.CVarXiv:2205.10102v32022
  14. CGC-Net: Cell Graph Convolutional Network for Grading of Colorectal Cancer Histology Images

    Yanning Zhou, Simon Graham, Navid Alemi Koohbanani +3

    eess.IVcs.CVarXiv:1909.01068v12019
  15. Sparse Tensor-based Multiscale Representation for Point Cloud Geometry Compression

    Jianqiang Wang, Dandan Ding, Zhu Li +3

    cs.CVeess.IVarXiv:2111.10633v22021
  16. Entroformer: A Transformer-based Entropy Model for Learned Image Compression

    Yichen Qian, Ming Lin, Xiuyu Sun +2

    eess.IVcs.CVarXiv:2202.05492v22022
  17. Cross-Modality Deep Feature Learning for Brain Tumor Segmentation

    Dingwen Zhang, Guohai Huang, Qiang Zhang +3

    eess.IVcs.CVarXiv:2201.02356v12022
  18. Convolutional Dictionary Learning: A Comparative Review and New Algorithms

    Cristina Garcia-Cardona, Brendt Wohlberg

    cs.LGeess.IVstat.MLarXiv:1709.02893v52017
  19. RegNet: Self-Regulated Network for Image Classification

    Jing Xu, Yu Pan, Xinglin Pan +3

    eess.IVcs.CVarXiv:2101.00590v12021
  20. PM2.5-GNN: A Domain Knowledge Enhanced Graph Neural Network For PM2.5 Forecasting

    Shuo Wang, Yanran Li, Jiang Zhang +3

    eess.SPcs.LGeess.IVarXiv:2002.12898v22020
  21. Audio-Visual Segmentation

    Jinxing Zhou, Jianyuan Wang, Jiayi Zhang +7

    cs.CVcs.MMcs.SDarXiv:2207.05042v32022
  22. Unpaired Multi-modal Segmentation via Knowledge Distillation

    Qi Dou, Quande Liu, Pheng Ann Heng +1

    cs.CVeess.IVarXiv:2001.03111v12020
  23. Fully Automatic Wound Segmentation with Deep Convolutional Neural Networks

    Chuanbo Wang, DM Anisuzzaman, Victor Williamson +5

    eess.IVcs.CVarXiv:2010.05855v12020
  24. OctSqueeze: Octree-Structured Entropy Model for LiDAR Compression

    Lila Huang, Shenlong Wang, Kelvin Wong +2

    eess.IVcs.CVarXiv:2005.07178v22020
  25. Blind2Unblind: Self-Supervised Image Denoising with Visible Blind Spots

    Zejin Wang, Jiazheng Liu, Guoqing Li +1

    eess.IVcs.CVarXiv:2203.06967v32022
  26. Spectral band selection for vegetation properties retrieval using Gaussian processes regression

    Jochem Verrelst, Juan Pablo Rivera, Anatoly Gitelson +3

    cs.CVeess.IVstat.AParXiv:2012.08640v12020
  27. Computed Tomography Reconstruction Using Deep Image Prior and Learned Reconstruction Methods

    Daniel Otero Baguer, Johannes Leuschner, Maximilian Schmidt

    eess.IVcs.CVcs.LGarXiv:2003.04989v22020
  28. Radiology Report Generation with a Learned Knowledge Base and Multi-modal Alignment

    Shuxin Yang, Xian Wu, Shen Ge +2

    eess.IVcs.CLcs.CVarXiv:2112.15011v22021
  29. FANet: A Feedback Attention Network for Improved Biomedical Image Segmentation

    Nikhil Kumar Tomar, Debesh Jha, Michael A. Riegler +5

    cs.CVeess.IVarXiv:2103.17235v32021
  30. Residual Attention U-Net for Automated Multi-Class Segmentation of COVID-19 Chest CT Images

    Xiaocong Chen, Lina Yao, Yu Zhang

    eess.IVcs.CVcs.LGarXiv:2004.05645v12020
  31. Ground Truth Evaluation of Neural Network Explanations with CLEVR-XAI

    Leila Arras, Ahmed Osman, Wojciech Samek

    cs.CVcs.LGcs.NEarXiv:2003.07258v22020
  32. Replacing Mobile Camera ISP with a Single Deep Learning Model

    Andrey Ignatov, Luc Van Gool, Radu Timofte

    cs.CVcs.GReess.IVarXiv:2002.05509v12020
  33. A deep active learning system for species identification and counting in camera trap images

    Mohammad Sadegh Norouzzadeh, Dan Morris, Sara Beery +3

    cs.LGcs.CVeess.IVarXiv:1910.09716v12019
  34. Agriculture-Vision: A Large Aerial Image Database for Agricultural Pattern Analysis

    Mang Tik Chiu, Xingqian Xu, Yunchao Wei +12

    cs.CVcs.CYcs.LGarXiv:2001.01306v22020
  35. Distortion Agnostic Deep Watermarking

    Xiyang Luo, Ruohan Zhan, Huiwen Chang +2

    cs.MMcs.CVcs.LGarXiv:2001.04580v12020
  36. Temporally Distributed Networks for Fast Video Semantic Segmentation

    Ping Hu, Fabian Caba Heilbron, Oliver Wang +3

    cs.CVcs.LGcs.MMarXiv:2004.01800v22020
  37. TorchXRayVision: A library of chest X-ray datasets and models

    Joseph Paul Cohen, Joseph D. Viviano, Paul Bertin +8

    eess.IVcs.AIcs.CVarXiv:2111.00595v12021
  38. UNIT-DDPM: UNpaired Image Translation with Denoising Diffusion Probabilistic Models

    Hiroshi Sasaki, Chris G. Willcocks, Toby P. Breckon

    cs.CVcs.LGeess.IVarXiv:2104.05358v12021
  39. COVIDNet-CT: A Tailored Deep Convolutional Neural Network Design for Detection of COVID-19 Cases from Chest CT Images

    Hayden Gunraj, Linda Wang, Alexander Wong

    eess.IVcs.CVcs.LGarXiv:2009.05383v12020
  40. UltraLight VM-UNet: Parallel Vision Mamba Significantly Reduces Parameters for Skin Lesion Segmentation

    Renkai Wu, Yinghao Liu, Pengchen Liang +1

    eess.IVcs.CVarXiv:2403.20035v32024
  41. What Matters in Unsupervised Optical Flow

    Rico Jonschkowski, Austin Stone, Jonathan T. Barron +3

    cs.CVcs.LGeess.IVarXiv:2006.04902v22020
  42. SUNet: Swin Transformer UNet for Image Denoising

    Chi-Mao Fan, Tsung-Jung Liu, Kuan-Hsien Liu

    eess.IVcs.CVcs.LGarXiv:2202.14009v12022
  43. Attention Guided Network for Retinal Image Segmentation

    Shihao Zhang, Huazhu Fu, Yuguang Yan +5

    eess.IVcs.CVarXiv:1907.12930v32019
  44. Robust machine learning segmentation for large-scale analysis of heterogeneous clinical brain MRI datasets

    Benjamin Billot, Colin Magdamo, You Cheng +3

    eess.IVcs.CVarXiv:2209.02032v22022
  45. DeepSeg: Deep Neural Network Framework for Automatic Brain Tumor Segmentation using Magnetic Resonance FLAIR Images

    Ramy A. Zeineldin, Mohamed E. Karar, Jan Coburger +2

    eess.IVcs.CVarXiv:2004.12333v12020
  46. Unsupervised Domain Adaptation in Semantic Segmentation: a Review

    Marco Toldo, Andrea Maracani, Umberto Michieli +1

    cs.CVcs.LGeess.IVarXiv:2005.10876v12020
  47. Swin Transformer for Fast MRI

    Jiahao Huang, Yingying Fang, Yinzhe Wu +6

    eess.IVcs.AIcs.CVarXiv:2201.03230v22022
  48. DeepEDN: A Deep Learning-based Image Encryption and Decryption Network for Internet of Medical Things

    Yi Ding, Guozheng Wu, Dajiang Chen +4

    cs.CRcs.CVeess.IVarXiv:2004.05523v22020
  49. You Only Need Adversarial Supervision for Semantic Image Synthesis

    Vadim Sushko, Edgar Schönfeld, Dan Zhang +3

    cs.CVcs.LGeess.IVarXiv:2012.04781v32020
  50. Boundary-aware Context Neural Network for Medical Image Segmentation

    Ruxin Wang, Shuyuan Chen, Chaojie Ji +2

    eess.IVcs.CVarXiv:2005.00966v12020
  51. Common pitfalls and recommendations for using machine learning to detect and prognosticate for COVID-19 using chest radiographs and CT scans

    Michael Roberts, Derek Driggs, Matthew Thorpe +13

    cs.LGcs.CVeess.IVarXiv:2008.06388v42020
  52. RetinaTrack: Online Single Stage Joint Detection and Tracking

    Zhichao Lu, Vivek Rathod, Ronny Votel +1

    cs.CVcs.LGeess.IVarXiv:2003.13870v12020
  53. Detecting Deep-Fake Videos from Appearance and Behavior

    Shruti Agarwal, Tarek El-Gaaly, Hany Farid +1

    cs.CVcs.LGcs.MMarXiv:2004.14491v12020
  54. CTformer: Convolution-free Token2Token Dilated Vision Transformer for Low-dose CT Denoising

    Dayang Wang, Fenglei Fan, Zhan Wu +3

    eess.IVcs.CVarXiv:2202.13517v12022
  55. OmniRAS: Standardizing Foundation Model Training and Evaluation in Robot-Assisted Surgery

    Leonardo Borgioli, Neil Getty, Wenli Xiu +8

    eess.IVarXiv:2608.31048v12026
  56. ReLViC: Loss-Resilient Learned Video Coding with Dispersed Packetization and Controllable Packet Dependencies

    Xuyang Chen, Daquan Feng, Xianfu Chen +1

    eess.IVcs.MMarXiv:2608.30202v12026
  57. Neural Video Compression with Feature Modulation

    Jiahao Li, Bin Li, Yan Lu

    cs.CVeess.IVarXiv:2402.17414v22024
  58. Transfer Learning from Synthetic to Real-Noise Denoising with Adaptive Instance Normalization

    Yoonsik Kim, Jae Woong Soh, Gu Yong Park +1

    cs.CVeess.IVarXiv:2002.11244v22020
  59. XNOR-Net++: Improved Binary Neural Networks

    Adrian Bulat, Georgios Tzimiropoulos

    cs.CVcs.LGeess.IVarXiv:1909.13863v12019
  60. Real-Time Video Anomaly Detection Using YOLO Pose Estimation and CLIP-Based Semantic Scoring

    Vanodhya G. Warnasooriya, Amir Hajian, Watchara Ruangsang +1

    cs.CVcs.AIeess.IVarXiv:2608.31074v12026