Image and Video Processing

Papers filed under eess.IV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

421 to 480 of 1,306

  1. Collaborative Unsupervised Domain Adaptation for Medical Image Diagnosis

    Yifan Zhang, Ying Wei, Qingyao Wu +4

    cs.CVeess.IVarXiv:2007.07222v12020
  2. Deep Optics for Single-shot High-dynamic-range Imaging

    Christopher A. Metzler, Hayato Ikoma, Yifan Peng +1

    eess.IVcs.CVarXiv:1908.00620v12019
  3. An Explainable 3D Residual Self-Attention Deep Neural Network FOR Joint Atrophy Localization and Alzheimer's Disease Diagnosis using Structural MRI

    Xin Zhang, Liangxiu Han, Wenyong Zhu +2

    eess.IVcs.CVarXiv:2008.04024v22020
  4. Framelet Representation of Tensor Nuclear Norm for Third-Order Tensor Completion

    Tai-Xiang Jiang, Michael K. Ng, Xi-Le Zhao +1

    eess.IVcs.CVarXiv:1909.06982v22019
  5. Prior-Guided Implicit Neural Representations for Single-Subject Diffusion MRI Super-Resolution

    Abdulkader Ghandoura, Marsil Zakour, William Consagra +1

    eess.IVcs.CVarXiv:2609.00981v12026
  6. DuDoRNet: Learning a Dual-Domain Recurrent Network for Fast MRI Reconstruction with Deep T1 Prior

    Bo Zhou, S. Kevin Zhou

    eess.IVcs.CVarXiv:2001.03799v22020
  7. Scaling Video Analytics on Constrained Edge Nodes

    Christopher Canel, Thomas Kim, Giulio Zhou +5

    cs.CVcs.LGcs.PFarXiv:1905.13536v12019
  8. ChatCAD: Interactive Computer-Aided Diagnosis on Medical Image using Large Language Models

    Sheng Wang, Zihao Zhao, Xi Ouyang +2

    cs.CVeess.IVarXiv:2302.07257v12023
  9. Deep Learning in Automated Power Line Inspection: A Review

    Md. Ahasan Atick Faisal, Imene Mecheter, Yazan Qiblawey +3

    cs.CVeess.IVarXiv:2502.07826v12025
  10. CAMEL: A Weakly Supervised Learning Framework for Histopathology Image Segmentation

    Gang Xu, Zhigang Song, Zhuo Sun +6

    eess.IVcs.CVcs.LGarXiv:1908.10555v12019
  11. BRISC: Annotated Dataset for Brain Tumor Segmentation and Classification

    Amirreza Fateh, Yasin Rezvani, Sara Moayedi +4

    eess.IVcs.CVarXiv:2506.14318v52025
  12. AlignSeg: Feature-Aligned Segmentation Networks

    Zilong Huang, Yunchao Wei, Xinggang Wang +3

    cs.CVeess.IVarXiv:2003.00872v22020
  13. Spatial-Adaptive Network for Single Image Denoising

    Meng Chang, Qi Li, Huajun Feng +1

    eess.IVcs.CVarXiv:2001.10291v22020
  14. Multi-Contrast Super-Resolution MRI Through a Progressive Network

    Qing Lyu, Hongming Shan, Ge Wang

    eess.IVcs.LGphysics.med-pharXiv:1908.01612v22019
  15. Dual Cross-Attention for Medical Image Segmentation

    Gorkem Can Ates, Prasoon Mohan, Emrah Celik

    cs.CVcs.LGeess.IVarXiv:2303.17696v12023
  16. Ola: Pushing the Frontiers of Omni-Modal Language Model

    Zuyan Liu, Yuhao Dong, Jiahui Wang +4

    cs.CVcs.CLcs.MMarXiv:2502.04328v32025
  17. A CNN-based methodology for breast cancer diagnosis using thermal images

    Juan Zuluaga-Gomez, Zeina Al Masry, Khaled Benaggoune +2

    cs.CVeess.IVarXiv:1910.13757v12019
  18. Wavelet Diffusion Models are fast and scalable Image Generators

    Hao Phung, Quan Dao, Anh Tran

    cs.CVeess.IVarXiv:2211.16152v22022
  19. Transparency of Deep Neural Networks for Medical Image Analysis: A Review of Interpretability Methods

    Zohaib Salahuddin, Henry C Woodruff, Avishek Chatterjee +1

    eess.IVcs.AIcs.CVarXiv:2111.02398v12021
  20. The spatial anatomy of urban wildfire vulnerability: a spatially validated GeoAI framework reveals the roles of building density and vegetation moisture in structure loss during the 2025 Palisades Fire

    Parastoo Farajpoor, Mohammadreza Narimani

    physics.geo-phcs.LGeess.IVarXiv:2608.22293v12026
  21. Deep learning for cardiac image segmentation: A review

    Chen Chen, Chen Qin, Huaqi Qiu +4

    eess.IVcs.CVcs.LGarXiv:1911.03723v12019
  22. Virtual Multi-view Fusion for 3D Semantic Segmentation

    Abhijit Kundu, Xiaoqi Yin, Alireza Fathi +4

    cs.CVeess.IVarXiv:2007.13138v12020
  23. Skin Lesion Analyser: An Efficient Seven-Way Multi-Class Skin Cancer Classification Using MobileNet

    Saket S. Chaturvedi, Kajol Gupta, Prakash. S. Prasad

    eess.IVcs.CVarXiv:1907.03220v32019
  24. Blindly Assess Quality of In-the-Wild Videos via Quality-aware Pre-training and Motion Perception

    Bowen Li, Weixia Zhang, Meng Tian +2

    eess.IVcs.CVarXiv:2108.08505v22021
  25. Unpaired Learning of Deep Image Denoising

    Xiaohe Wu, Ming Liu, Yue Cao +2

    eess.IVcs.CVarXiv:2008.13711v12020
  26. Unveiling COVID-19 from Chest X-ray with deep learning: a hurdles race with small data

    Enzo Tartaglione, Carlo Alberto Barbano, Claudio Berzovini +2

    eess.IVcs.CVcs.LGarXiv:2004.05405v12020
  27. XingGAN for Person Image Generation

    Hao Tang, Song Bai, Li Zhang +2

    cs.CVcs.LGeess.IVarXiv:2007.09278v12020
  28. Reduced Reference Perceptual Quality Model and Application to Rate Control for 3D Point Cloud Compression

    Qi Liu, Hui Yuan, Raouf Hamzaoui +3

    eess.IVcs.CVarXiv:2011.12688v12020
  29. Boundary-aware Transformers for Skin Lesion Segmentation

    Jiacheng Wang, Lan Wei, Liansheng Wang +3

    eess.IVcs.CVarXiv:2110.03864v12021
  30. Comparing Energy Efficiency of CPU, GPU and FPGA Implementations for Vision Kernels

    Murad Qasaimeh, Kristof Denolf, Jack Lo +3

    cs.CVeess.IVarXiv:1906.11879v12019
  31. Expert-like Bone Ultrasound Segmentation through Expert-in-the-loop Mask-conditioned Progressive Learning

    Arash Tavangar, Larissa K. Chiu, Hamidreza Khodashenas +2

    eess.IVcs.CVarXiv:2609.00473v12026
  32. MEt3R: Measuring Multi-View Consistency in Generated Images

    Mohammad Asim, Christopher Wewer, Thomas Wimmer +2

    cs.CVcs.LGeess.IVarXiv:2501.06336v22025
  33. Iterative Filter Adaptive Network for Single Image Defocus Deblurring

    Junyong Lee, Hyeongseok Son, Jaesung Rim +2

    cs.CVeess.IVarXiv:2108.13610v22021
  34. One-Shot Object Detection with Co-Attention and Co-Excitation

    Ting-I Hsieh, Yi-Chen Lo, Hwann-Tzong Chen +1

    cs.CVcs.LGeess.IVarXiv:1911.12529v12019
  35. Deep reinforcement learning in medical imaging: A literature review

    S. Kevin Zhou, Hoang Ngan Le, Khoa Luu +2

    eess.IVcs.CVcs.LGarXiv:2103.05115v12021
  36. LightBridge: Feed-Forward Generative Relighting for 3D Gaussian Splatting

    Hezhi Cao, Panhao Cheng, huangsheng du +3

    cs.GReess.IVarXiv:2609.02543v12026
  37. A Large Scale Event-based Detection Dataset for Automotive

    Pierre de Tournemire, Davide Nitti, Etienne Perot +2

    cs.CVcs.LGcs.ROarXiv:2001.08499v32020
  38. A Survey on Deep Learning for Neuroimaging-based Brain Disorder Analysis

    Li Zhang, Mingliang Wang, Mingxia Liu +1

    eess.IVcs.CVcs.LGarXiv:2005.04573v12020
  39. Probabilistic Noise2Void: Unsupervised Content-Aware Denoising

    Alexander Krull, Tomas Vicar, Florian Jug

    eess.IVcs.CVarXiv:1906.00651v22019
  40. Bandwidth-Agile Image Transmission with Deep Joint Source-Channel Coding

    David Burth Kurka, Deniz Gündüz

    cs.ITcs.LGeess.IVarXiv:2009.12480v22020
  41. A Technical Overview of AV1

    Jingning Han, Bohan Li, Debargha Mukherjee +12

    eess.IVarXiv:2008.06091v22020
  42. Hyperspectral Image Classification-Traditional to Deep Models: A Survey for Future Prospects

    Muhammad Ahmad, Sidrah Shabbir, Swalpa Kumar Roy +7

    eess.IVcs.CVarXiv:2101.06116v32021
  43. Blockchain-Federated-Learning and Deep Learning Models for COVID-19 detection using CT Imaging

    Rajesh Kumar, Abdullah Aman Khan, Sinmin Zhang +7

    eess.IVcs.CVcs.LGarXiv:2007.06537v22020
  44. Locality and Structure Regularized Low Rank Representation for Hyperspectral Image Classification

    Qi Wang, Xiange He, Xuelong Li

    cs.CVeess.IVarXiv:1905.02488v12019
  45. Deep Learning in Alzheimer's disease: Diagnostic Classification and Prognostic Prediction using Neuroimaging Data

    Taeho Jo, Kwangsik Nho, Andrew J. Saykin

    eess.IVcs.LGstat.MLarXiv:1905.00931v42019
  46. MedSAM2: Segment Anything in 3D Medical Images and Videos

    Jun Ma, Zongxin Yang, Sumin Kim +6

    eess.IVcs.AIcs.CVarXiv:2504.03600v12025
  47. CRS-Bench: A Reference-Relative Reliability Benchmark for Medical Image Encoders

    Xingtao Lin, Hangqi Ren, Caiwan Sun +1

    eess.IVcs.AIcs.CVarXiv:2608.22059v12026
  48. SparseGS: Sparse View Synthesis using 3D Gaussian Splatting

    Haolin Xiong, Sairisheek Muttukuru, Hanyuan Xiao +4

    cs.CVcs.LGeess.IVarXiv:2312.00206v42023
  49. Harnessing Magnitude-Only and Complex Measurements for Improved Dynamic MRI Reconstruction with Learned Priors

    Mahdi Saberi, Yaşar Utku Alçalar, Merve Gülle +2

    eess.IVcs.AIcs.CVarXiv:2608.18036v12026
  50. Feature Reconfiguration With Visual Prior for Medical Lesion Segmentation

    Yinan Liu, Jiankang Hong, Zhen Gao +1

    cs.AIeess.IVarXiv:2609.03535v12026
  51. OCTA-500: A Retinal Dataset for Optical Coherence Tomography Angiography Study

    Mingchao Li, Kun Huang, Qiuzhuo Xu +7

    eess.IVcs.CVarXiv:2012.07261v32020
  52. Country-wide high-resolution vegetation height mapping with Sentinel-2

    Nico Lang, Konrad Schindler, Jan Dirk Wegner

    eess.IVcs.CVcs.LGarXiv:1904.13270v22019
  53. Speck: A Smart event-based Vision Sensor with a low latency 327K Neuron Convolutional Neuronal Network Processing Pipeline

    Ole Richter, Yannan Xing, Michele De Marchi +9

    cs.NEcs.LGeess.IVarXiv:2304.06793v22023
  54. KiU-Net: Towards Accurate Segmentation of Biomedical Images using Over-complete Representations

    Jeya Maria Jose, Vishwanath Sindagi, Ilker Hacihaliloglu +1

    eess.IVcs.CVarXiv:2006.04878v22020
  55. MambaIRv2: Attentive State Space Restoration

    Hang Guo, Yong Guo, Yaohua Zha +5

    eess.IVcs.CVcs.LGarXiv:2411.15269v22024
  56. Repeatability of Multiparametric Prostate MRI Radiomics Features

    Michael Schwier, Joost van Griethuysen, Mark G Vangel +7

    cs.CVeess.IVarXiv:1807.06089v22018
  57. Fruit Detection, Segmentation and 3D Visualisation of Environments in Apple Orchards

    Hanwen Kang, Chao Chen

    cs.CVeess.IVarXiv:1911.12889v12019
  58. Towards Practical Real-Time Neural Video Compression

    Zhaoyang Jia, Bin Li, Jiahao Li +4

    eess.IVcs.CVarXiv:2502.20762v22025
  59. Applications of Deep Learning in Fundus Images: A Review

    Tao Li, Wang Bo, Chunyu Hu +4

    eess.IVcs.CVcs.LGarXiv:2101.09864v12021
  60. Detecting GAN generated Fake Images using Co-occurrence Matrices

    Lakshmanan Nataraj, Tajuddin Manhar Mohammed, Shivkumar Chandrasekaran +4

    cs.CVeess.IVarXiv:1903.06836v22019