Computer Vision and Pattern Recognition

Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,041 to 11,100 of 18,839

  1. Deep Learning for Whole Slide Image Analysis: An Overview

    Neofytos Dimitriou, Ognjen Arandjelović, Peter D Caie

    cs.CVcs.LGeess.IVarXiv:1910.11097v12019
  2. StyleGAN-NADA: CLIP-Guided Domain Adaptation of Image Generators

    Rinon Gal, Or Patashnik, Haggai Maron +2

    cs.CVcs.CLcs.GRarXiv:2108.00946v22021
  3. Image processing

    Franco Rino

    cs.CVarXiv:1409.2413v12014
  4. A Topological Loss Function for Deep-Learning based Image Segmentation using Persistent Homology

    James R. Clough, Nicholas Byrne, Ilkay Oksuz +3

    cs.CVeess.IVarXiv:1910.01877v22019
  5. Combining Fully Convolutional and Recurrent Neural Networks for 3D Biomedical Image Segmentation

    Jianxu Chen, Lin Yang, Yizhe Zhang +2

    cs.CVarXiv:1609.01006v22016
  6. Control of Memory, Active Perception, and Action in Minecraft

    Junhyuk Oh, Valliappa Chockalingam, Satinder Singh +1

    cs.AIcs.CVcs.LGarXiv:1605.09128v12016
  7. MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision

    Ruicheng Wang, Sicheng Xu, Cassie Dai +4

    cs.CVarXiv:2410.19115v32024
  8. ODTrack: Online Dense Temporal Token Learning for Visual Tracking

    Yaozong Zheng, Bineng Zhong, Qihua Liang +3

    cs.CVarXiv:2401.01686v12024
  9. Style Injection in Diffusion: A Training-free Approach for Adapting Large-scale Diffusion Models for Style Transfer

    Jiwoo Chung, Sangeek Hyun, Jae-Pil Heo

    cs.CVarXiv:2312.09008v22023
  10. Object Relational Graph with Teacher-Recommended Learning for Video Captioning

    Ziqi Zhang, Yaya Shi, Chunfeng Yuan +4

    cs.CVcs.CLarXiv:2002.11566v12020
  11. Deep learning from crowds

    Filipe Rodrigues, Francisco Pereira

    stat.MLcs.CVcs.HCarXiv:1709.01779v22017
  12. Habitat 3.0: A Co-Habitat for Humans, Avatars and Robots

    Xavier Puig, Eric Undersander, Andrew Szot +20

    cs.HCcs.AIcs.CVarXiv:2310.13724v12023
  13. Extremely Large Minibatch SGD: Training ResNet-50 on ImageNet in 15 Minutes

    Takuya Akiba, Shuji Suzuki, Keisuke Fukuda

    cs.DCcs.CVcs.LGarXiv:1711.04325v12017
  14. Large-scale weakly-supervised pre-training for video action recognition

    Deepti Ghadiyaram, Matt Feiszli, Du Tran +3

    cs.CVarXiv:1905.00561v12019
  15. 3D Face Reconstruction by Learning from Synthetic Data

    Elad Richardson, Matan Sela, Ron Kimmel

    cs.CVarXiv:1609.04387v22016
  16. Red-Teaming the Stable Diffusion Safety Filter

    Javier Rando, Daniel Paleka, David Lindner +2

    cs.AIcs.CRcs.CVarXiv:2210.04610v52022
  17. Building Cooperative Embodied Agents Modularly with Large Language Models

    Hongxin Zhang, Weihua Du, Jiaming Shan +5

    cs.AIcs.CLcs.CVarXiv:2307.02485v22023
  18. Segmentation-driven 6D Object Pose Estimation

    Yinlin Hu, Joachim Hugonot, Pascal Fua +1

    cs.CVarXiv:1812.02541v32018
  19. Efficient RGB-D Semantic Segmentation for Indoor Scene Analysis

    Daniel Seichter, Mona Köhler, Benjamin Lewandowski +2

    cs.CVcs.LGcs.ROarXiv:2011.06961v32020
  20. 2017 Robotic Instrument Segmentation Challenge

    Max Allan, Alex Shvets, Thomas Kurmann +16

    cs.CVarXiv:1902.06426v22019
  21. Few-Shot Classification with Feature Map Reconstruction Networks

    Davis Wertheimer, Luming Tang, Bharath Hariharan

    cs.CVcs.LGarXiv:2012.01506v22020
  22. H2O: Two Hands Manipulating Objects for First Person Interaction Recognition

    Taein Kwon, Bugra Tekin, Jan Stuhmer +2

    cs.CVarXiv:2104.11181v22021
  23. Text-Attentional Convolutional Neural Networks for Scene Text Detection

    Tong He, Weilin Huang, Yu Qiao +1

    cs.CVarXiv:1510.03283v22015
  24. NeRP: Implicit Neural Representation Learning with Prior Embedding for Sparsely Sampled Image Reconstruction

    Liyue Shen, John Pauly, Lei Xing

    eess.IVcs.CVarXiv:2108.10991v22021
  25. Learning Aerial Image Segmentation from Online Maps

    Pascal Kaiser, Jan Dirk Wegner, Aurelien Lucchi +3

    cs.CVarXiv:1707.06879v12017
  26. Aggregate channel features for multi-view face detection

    Bin Yang, Junjie Yan, Zhen Lei +1

    cs.CVarXiv:1407.4023v22014
  27. A Review on Deep Learning Techniques for Video Prediction

    Sergiu Oprea, Pablo Martinez-Gonzalez, Alberto Garcia-Garcia +4

    cs.CVcs.LGeess.IVarXiv:2004.05214v22020
  28. SPAN: Spatial Pyramid Attention Network forImage Manipulation Localization

    Xuefeng Hu, Zhihan Zhang, Zhenye Jiang +3

    cs.CVarXiv:2009.00726v22020
  29. CNN Explainer: Learning Convolutional Neural Networks with Interactive Visualization

    Zijie J. Wang, Robert Turko, Omar Shaikh +5

    cs.HCcs.AIcs.CVarXiv:2004.15004v32020
  30. Multispectral and Hyperspectral Image Fusion Using a 3-D-Convolutional Neural Network

    Frosti Palsson, Johannes R. Sveinsson, Magnus O. Ulfarsson

    cs.CVstat.MLarXiv:1706.05249v12017
  31. Standardized Assessment of Automatic Segmentation of White Matter Hyperintensities and Results of the WMH Segmentation Challenge

    Hugo J. Kuijf, J. Matthijs Biesbroek, Jeroen de Bresser +41

    cs.CVarXiv:1904.00682v12019
  32. Scene Graph Generation with External Knowledge and Image Reconstruction

    Jiuxiang Gu, Handong Zhao, Zhe Lin +3

    cs.CVarXiv:1904.00560v12019
  33. Weakly-Supervised Semantic Segmentation by Iteratively Mining Common Object Features

    Xiang Wang, Shaodi You, Xi Li +1

    cs.CVarXiv:1806.04659v12018
  34. Learning Local Image Descriptors with Deep Siamese and Triplet Convolutional Networks by Minimising Global Loss Functions

    Vijay Kumar B G, Gustavo Carneiro, Ian Reid

    cs.CVarXiv:1512.09272v22015
  35. Meta-Transfer Learning for Zero-Shot Super-Resolution

    Jae Woong Soh, Sunwoo Cho, Nam Ik Cho

    cs.CVarXiv:2002.12213v12020
  36. Closed-loop Matters: Dual Regression Networks for Single Image Super-Resolution

    Yong Guo, Jian Chen, Jingdong Wang +5

    cs.CVarXiv:2003.07018v42020
  37. MM-Diffusion: Learning Multi-Modal Diffusion Models for Joint Audio and Video Generation

    Ludan Ruan, Yiyang Ma, Huan Yang +6

    cs.CVarXiv:2212.09478v22022
  38. Visformer: The Vision-friendly Transformer

    Zhengsu Chen, Lingxi Xie, Jianwei Niu +3

    cs.CVarXiv:2104.12533v52021
  39. Noisier2Noise: Learning to Denoise from Unpaired Noisy Data

    Nick Moran, Dan Schmidt, Yu Zhong +1

    eess.IVcs.CVarXiv:1910.11908v12019
  40. Federated Adversarial Domain Adaptation

    Xingchao Peng, Zijun Huang, Yizhe Zhu +1

    cs.CVcs.LGarXiv:1911.02054v32019
  41. DARTS+: Improved Differentiable Architecture Search with Early Stopping

    Hanwen Liang, Shifeng Zhang, Jiacheng Sun +4

    cs.CVcs.LGarXiv:1909.06035v22019
  42. Superhuman Accuracy on the SNEMI3D Connectomics Challenge

    Kisuk Lee, Jonathan Zung, Peter Li +2

    cs.CVarXiv:1706.00120v12017
  43. Better Diffusion Models Further Improve Adversarial Training

    Zekai Wang, Tianyu Pang, Chao Du +3

    cs.CVcs.AIcs.CRarXiv:2302.04638v22023
  44. ST-Adapter: Parameter-Efficient Image-to-Video Transfer Learning

    Junting Pan, Ziyi Lin, Xiatian Zhu +2

    cs.CVarXiv:2206.13559v32022
  45. Evaluating Deep Neural Networks Trained on Clinical Images in Dermatology with the Fitzpatrick 17k Dataset

    Matthew Groh, Caleb Harris, Luis Soenksen +5

    cs.CVarXiv:2104.09957v12021
  46. Deep Learning Human Mind for Automated Visual Classification

    Concetto Spampinato, Simone Palazzo, Isaak Kavasidis +3

    cs.CVarXiv:1609.00344v22016
  47. Memory Enhanced Global-Local Aggregation for Video Object Detection

    Yihong Chen, Yue Cao, Han Hu +1

    cs.CVcs.LGeess.IVarXiv:2003.12063v12020
  48. ClearGrasp: 3D Shape Estimation of Transparent Objects for Manipulation

    Shreeyak S. Sajjan, Matthew Moore, Mike Pan +4

    cs.CVcs.ROeess.IVarXiv:1910.02550v22019
  49. Fixing Data Augmentation to Improve Adversarial Robustness

    Sylvestre-Alvise Rebuffi, Sven Gowal, Dan A. Calian +3

    cs.CVcs.LGarXiv:2103.01946v22021
  50. ElasticFace: Elastic Margin Loss for Deep Face Recognition

    Fadi Boutros, Naser Damer, Florian Kirchbuchner +1

    cs.CVarXiv:2109.09416v42021
  51. Learning to Decompose and Disentangle Representations for Video Prediction

    Jun-Ting Hsieh, Bingbin Liu, De-An Huang +2

    cs.LGcs.CVstat.MLarXiv:1806.04166v22018
  52. Conditional Object-Centric Learning from Video

    Thomas Kipf, Gamaleldin F. Elsayed, Aravindh Mahendran +6

    cs.CVcs.LGstat.MLarXiv:2111.12594v22021
  53. Transferring GANs: generating images from limited data

    Yaxing Wang, Chenshen Wu, Luis Herranz +3

    cs.CVarXiv:1805.01677v22018
  54. Cross-task weakly supervised learning from instructional videos

    Dimitri Zhukov, Jean-Baptiste Alayrac, Ramazan Gokberk Cinbis +3

    cs.CVarXiv:1903.08225v22019
  55. Recent Advancements in End-to-End Autonomous Driving using Deep Learning: A Survey

    Pranav Singh Chib, Pravendra Singh

    cs.ROcs.AIcs.CVarXiv:2307.04370v22023
  56. Heterogeneous Memory Enhanced Multimodal Attention Model for Video Question Answering

    Chenyou Fan, Xiaofan Zhang, Shu Zhang +3

    cs.CVarXiv:1904.04357v12019
  57. PyGAD: An Intuitive Genetic Algorithm Python Library

    Ahmed Fawzy Gad

    cs.NEcs.CVcs.LGarXiv:2106.06158v12021
  58. Reading Scene Text in Deep Convolutional Sequences

    Pan He, Weilin Huang, Yu Qiao +2

    cs.CVarXiv:1506.04395v22015
  59. GODIVA: Generating Open-DomaIn Videos from nAtural Descriptions

    Chenfei Wu, Lun Huang, Qianxi Zhang +5

    cs.CVarXiv:2104.14806v12021
  60. Learning Affinity via Spatial Propagation Networks

    Sifei Liu, Shalini De Mello, Jinwei Gu +3

    cs.CVcs.LGarXiv:1710.01020v12017