Image and Video Processing

Papers filed under eess.IV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

721 to 780 of 1,302

  1. Video Compression With Rate-Distortion Autoencoders

    Amirhossein Habibian, Ties van Rozendaal, Jakub M. Tomczak +1

    eess.IVcs.LGstat.MLarXiv:1908.05717v22019
  2. DeepRED: Deep Image Prior Powered by RED

    Gary Mataev, Michael Elad, Peyman Milanfar

    cs.CVeess.IVarXiv:1903.10176v32019
  3. The Topology ToolKit

    Julien Tierny, Guillaume Favelier, Joshua A. Levine +2

    cs.GRcs.CGcs.CVarXiv:1805.09110v22018
  4. Interpolated Convolutional Networks for 3D Point Cloud Understanding

    Jiageng Mao, Xiaogang Wang, Hongsheng Li

    cs.CVcs.CGeess.IVarXiv:1908.04512v12019
  5. Bi-Temporal Semantic Reasoning for the Semantic Change Detection in HR Remote Sensing Images

    Lei Ding, Haitao Guo, Sicong Liu +3

    cs.CVeess.IVarXiv:2108.06103v42021
  6. Deep Learning Enables Automatic Detection and Segmentation of Brain Metastases on Multi-Sequence MRI

    Endre Grøvik, Darvin Yi, Michael Iv +3

    eess.IVcs.LGstat.MLarXiv:1903.07988v12019
  7. Deep Equilibrium Architectures for Inverse Problems in Imaging

    Davis Gilton, Gregory Ongie, Rebecca Willett

    eess.IVcs.CVarXiv:2102.07944v22021
  8. Neural Image Compression for Gigapixel Histopathology Image Analysis

    David Tellez, Geert Litjens, Jeroen van der Laak +1

    cs.CVeess.IVarXiv:1811.02840v22018
  9. Image Generation from Layout

    Bo Zhao, Lili Meng, Weidong Yin +1

    cs.CVeess.IVarXiv:1811.11389v32018
  10. MedKLIP: Medical Knowledge Enhanced Language-Image Pre-Training in Radiology

    Chaoyi Wu, Xiaoman Zhang, Ya Zhang +2

    eess.IVcs.CLcs.CVarXiv:2301.02228v32023
  11. Automatic heterogeneous quantization of deep neural networks for low-latency inference on the edge for particle detectors

    Claudionor N. Coelho, Aki Kuusela, Shan Li +7

    physics.ins-detcs.LGeess.IVarXiv:2006.10159v32020
  12. StreamingT2V: Consistent, Dynamic, and Extendable Long Video Generation from Text

    Roberto Henschel, Levon Khachatryan, Hayk Poghosyan +5

    cs.CVcs.AIcs.CLarXiv:2403.14773v22024
  13. A complete data processing workflow for CryoET and subtomogram averaging

    Muyuan Chen, James M. Bell, Xiaodong Shi +3

    q-bio.QMeess.IVarXiv:1902.03978v12019
  14. Advancing machine learning for MR image reconstruction with an open competition: Overview of the 2019 fastMRI challenge

    Florian Knoll, Tullie Murrell, Anuroop Sriram +8

    eess.IVcs.CVarXiv:2001.02518v12020
  15. Automated Methods for Detection and Classification Pneumonia based on X-Ray Images Using Deep Learning

    Khalid El Asnaoui, Youness Chawki, Ali Idri

    eess.IVcs.CVarXiv:2003.14363v12020
  16. HDNet: High-resolution Dual-domain Learning for Spectral Compressive Imaging

    Xiaowan Hu, Yuanhao Cai, Jing Lin +5

    eess.IVcs.CVarXiv:2203.02149v22022
  17. AGIQA-3K: An Open Database for AI-Generated Image Quality Assessment

    Chunyi Li, Zicheng Zhang, Haoning Wu +5

    cs.CVcs.AIeess.IVarXiv:2306.04717v22023
  18. LEDNet: Joint Low-light Enhancement and Deblurring in the Dark

    Shangchen Zhou, Chongyi Li, Chen Change Loy

    eess.IVcs.CVarXiv:2202.03373v22022
  19. Federated Learning for Computational Pathology on Gigapixel Whole Slide Images

    Ming Y. Lu, Dehan Kong, Jana Lipkova +5

    eess.IVcs.CVcs.LGarXiv:2009.10190v22020
  20. MedMamba: Vision Mamba for Medical Image Classification

    Yubiao Yue, Zhenzhang Li

    eess.IVcs.CVcs.LGarXiv:2403.03849v52024
  21. A Comparative Study of Fingerprint Image-Quality Estimation Methods

    Fernando Alonso-Fernandez, Julian Fierrez, Javier Ortega-Garcia +4

    cs.CVeess.IVarXiv:2111.07432v12021
  22. Learning for Video Compression with Hierarchical Quality and Recurrent Enhancement

    Ren Yang, Fabian Mentzer, Luc Van Gool +1

    eess.IVcs.CVarXiv:2003.01966v72020
  23. Localizing Visual Sounds the Hard Way

    Honglie Chen, Weidi Xie, Triantafyllos Afouras +3

    cs.CVeess.ASeess.IVarXiv:2104.02691v12021
  24. SGUIE-Net: Semantic Attention Guided Underwater Image Enhancement with Multi-Scale Perception

    Qi Qi, Kunqian Li, Haiyong Zheng +3

    eess.IVcs.CVarXiv:2201.02832v12022
  25. Non-line-of-sight Imaging

    D. Faccio, A. Velten, G. Wetzstein

    physics.opticseess.IVarXiv:2005.08026v12020
  26. DC-UNet: Rethinking the U-Net Architecture with Dual Channel Efficient CNN for Medical Images Segmentation

    Ange Lou, Shuyue Guan, Murray Loew

    eess.IVcs.CVarXiv:2006.00414v12020
  27. Explainable Medical Imaging AI Needs Human-Centered Design: Guidelines and Evidence from a Systematic Review

    Haomin Chen, Catalina Gomez, Chien-Ming Huang +1

    cs.HCcs.CVcs.LGarXiv:2112.12596v42021
  28. Practical Blind Image Denoising via Swin-Conv-UNet and Data Synthesis

    Kai Zhang, Yawei Li, Jingyun Liang +6

    cs.CVcs.GReess.IVarXiv:2203.13278v42022
  29. Practical Full Resolution Learned Lossless Image Compression

    Fabian Mentzer, Eirikur Agustsson, Michael Tschannen +2

    eess.IVcs.CVcs.LGarXiv:1811.12817v32018
  30. An Experimental-based Review of Image Enhancement and Image Restoration Methods for Underwater Imaging

    Yan Wang, Wei Song, Giancarlo Fortino +3

    eess.IVcs.CVcs.MMarXiv:1907.03246v12019
  31. Trustworthy clinical AI solutions: a unified review of uncertainty quantification in deep learning models for medical image analysis

    Benjamin Lambert, Florence Forbes, Alan Tucholka +3

    eess.IVcs.AIcs.CVarXiv:2210.03736v12022
  32. Differential Treatment for Stuff and Things: A Simple Unsupervised Domain Adaptation Method for Semantic Segmentation

    Zhonghao Wang, Mo Yu, Yunchao Wei +5

    cs.CVcs.LGeess.IVarXiv:2003.08040v32020
  33. BRACS: A Dataset for BReAst Carcinoma Subtyping in H&E Histology Images

    Nadia Brancati, Anna Maria Anniciello, Pushpak Pati +10

    q-bio.QMcs.AIcs.CVarXiv:2111.04740v12021
  34. Towards Data-Efficient Learning: A Benchmark for COVID-19 CT Lung and Infection Segmentation

    Jun Ma, Yixin Wang, Xingle An +10

    eess.IVcs.CVcs.LGarXiv:2004.12537v22020
  35. Deep 1D-Convnet for accurate Parkinson disease detection and severity prediction from gait

    Imanne El Maachi, Guillaume-Alexandre Bilodeau, Wassim Bouachir

    cs.LGcs.CVeess.IVarXiv:1910.11509v42019
  36. GNN3DMOT: Graph Neural Network for 3D Multi-Object Tracking with Multi-Feature Learning

    Xinshuo Weng, Yongxin Wang, Yunze Man +1

    cs.CVcs.LGeess.IVarXiv:2006.07327v12020
  37. EDiffSR: An Efficient Diffusion Probabilistic Model for Remote Sensing Image Super-Resolution

    Yi Xiao, Qiangqiang Yuan, Kui Jiang +3

    eess.IVcs.CVarXiv:2310.19288v12023
  38. OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM

    Yutao Hu, Tianbin Li, Quanfeng Lu +4

    eess.IVcs.CVarXiv:2402.09181v22024
  39. Deep Learning for Neuroimaging-based Diagnosis and Rehabilitation of Autism Spectrum Disorder: A Review

    Marjane Khodatars, Afshin Shoeibi, Delaram Sadeghi +12

    cs.LGeess.IVstat.MLarXiv:2007.01285v42020
  40. Transformer for Image Quality Assessment

    Junyong You, Jari Korhonen

    cs.CVcs.LGeess.IVarXiv:2101.01097v22020
  41. Target detection in synthetic aperture radar imagery: a state-of-the-art survey

    Khalid El-Darymli, Peter McGuire, Desmond Power +1

    eess.IVarXiv:1804.04719v12018
  42. Enhanced Invertible Encoding for Learned Image Compression

    Yueqi Xie, Ka Leong Cheng, Qifeng Chen

    eess.IVcs.CVarXiv:2108.03690v12021
  43. Bringing Old Photos Back to Life

    Ziyu Wan, Bo Zhang, Dongdong Chen +4

    cs.CVcs.GReess.IVarXiv:2004.09484v12020
  44. Graph Spectral Image Processing

    Gene Cheung, Enrico Magli, Yuichi Tanaka +1

    eess.IVeess.SParXiv:1801.04749v22018
  45. DU-GAN: Generative Adversarial Networks with Dual-Domain U-Net Based Discriminators for Low-Dose CT Denoising

    Zhizhong Huang, Junping Zhang, Yi Zhang +1

    eess.IVcs.CVphysics.med-pharXiv:2108.10772v22021
  46. S2Looking: A Satellite Side-Looking Dataset for Building Change Detection

    Li Shen, Yao Lu, Hao Chen +6

    cs.CVcs.AIeess.IVarXiv:2107.09244v32021
  47. DO-Conv: Depthwise Over-parameterized Convolutional Layer

    Jinming Cao, Yangyan Li, Mingchao Sun +5

    cs.CVeess.IVarXiv:2006.12030v12020
  48. An Explainable Machine Learning Model for Early Detection of Parkinson's Disease using LIME on DaTscan Imagery

    Pavan Rajkumar Magesh, Richard Delwin Myloth, Rijo Jackson Tom

    cs.CVcs.LGeess.IVarXiv:2008.00238v12020
  49. SNIPS: Solving Noisy Inverse Problems Stochastically

    Bahjat Kawar, Gregory Vaksman, Michael Elad

    eess.IVcs.CVarXiv:2105.14951v22021
  50. Monkeypox virus detection using pre-trained deep learning-based approaches

    Chiranjibi Sitaula, Tej Bahadur Shahi

    eess.IVcs.CVcs.LGarXiv:2209.04444v22022
  51. Image Quality Assessment using Contrastive Learning

    Pavan C. Madhusudana, Neil Birkbeck, Yilin Wang +2

    cs.CVcs.MMeess.IVarXiv:2110.13266v12021
  52. Lossy Image Compression with Conditional Diffusion Models

    Ruihan Yang, Stephan Mandt

    eess.IVcs.CVcs.LGarXiv:2209.06950v82022
  53. Is Someone Speaking? Exploring Long-term Temporal Features for Audio-visual Active Speaker Detection

    Ruijie Tao, Zexu Pan, Rohan Kumar Das +3

    eess.AScs.SDeess.IVarXiv:2107.06592v22021
  54. ArtFlow: Unbiased Image Style Transfer via Reversible Neural Flows

    Jie An, Siyu Huang, Yibing Song +3

    cs.CVeess.IVarXiv:2103.16877v22021
  55. Dual Adversarial Network: Toward Real-world Noise Removal and Noise Generation

    Zongsheng Yue, Qian Zhao, Lei Zhang +1

    cs.CVeess.IVarXiv:2007.05946v12020
  56. BIMCV COVID-19+: a large annotated dataset of RX and CT images from COVID-19 patients

    Maria de la Iglesia Vayá, Jose Manuel Saborit, Joaquim Angel Montell +10

    eess.IVcs.CVcs.LGarXiv:2006.01174v32020
  57. Deep learning-based survival prediction for multiple cancer types using histopathology images

    Ellery Wulczyn, David F. Steiner, Zhaoyang Xu +7

    q-bio.QMcs.LGeess.IVarXiv:1912.07354v12019
  58. Multiscale Point Cloud Geometry Compression

    Jianqiang Wang, Dandan Ding, Zhu Li +1

    eess.IVcs.CVarXiv:2011.03799v12020
  59. Learned Video Compression

    Oren Rippel, Sanjay Nair, Carissa Lew +3

    eess.IVcs.CVcs.LGarXiv:1811.06981v12018
  60. Video Inpainting of Complex Scenes

    Alasdair Newson, Andrés Almansa, Matthieu Fradet +2

    cs.CVcs.MMeess.IVarXiv:1503.05528v22015