Computer Vision and Pattern Recognition
Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,041 to 11,100 of 18,839
Deep Learning for Whole Slide Image Analysis: An Overview
Neofytos Dimitriou, Ognjen Arandjelović, Peter D Caie
cs.CVcs.LGeess.IVarXiv:1910.11097v12019StyleGAN-NADA: CLIP-Guided Domain Adaptation of Image Generators
Rinon Gal, Or Patashnik, Haggai Maron +2
cs.CVcs.CLcs.GRarXiv:2108.00946v22021Image processing
Franco Rino
cs.CVarXiv:1409.2413v12014A Topological Loss Function for Deep-Learning based Image Segmentation using Persistent Homology
James R. Clough, Nicholas Byrne, Ilkay Oksuz +3
cs.CVeess.IVarXiv:1910.01877v22019Combining Fully Convolutional and Recurrent Neural Networks for 3D Biomedical Image Segmentation
Jianxu Chen, Lin Yang, Yizhe Zhang +2
cs.CVarXiv:1609.01006v22016Control of Memory, Active Perception, and Action in Minecraft
Junhyuk Oh, Valliappa Chockalingam, Satinder Singh +1
cs.AIcs.CVcs.LGarXiv:1605.09128v12016MoGe: Unlocking Accurate Monocular Geometry Estimation for Open-Domain Images with Optimal Training Supervision
Ruicheng Wang, Sicheng Xu, Cassie Dai +4
cs.CVarXiv:2410.19115v32024ODTrack: Online Dense Temporal Token Learning for Visual Tracking
Yaozong Zheng, Bineng Zhong, Qihua Liang +3
cs.CVarXiv:2401.01686v12024Style Injection in Diffusion: A Training-free Approach for Adapting Large-scale Diffusion Models for Style Transfer
Jiwoo Chung, Sangeek Hyun, Jae-Pil Heo
cs.CVarXiv:2312.09008v22023Object Relational Graph with Teacher-Recommended Learning for Video Captioning
Ziqi Zhang, Yaya Shi, Chunfeng Yuan +4
cs.CVcs.CLarXiv:2002.11566v12020Deep learning from crowds
Filipe Rodrigues, Francisco Pereira
stat.MLcs.CVcs.HCarXiv:1709.01779v22017Habitat 3.0: A Co-Habitat for Humans, Avatars and Robots
Xavier Puig, Eric Undersander, Andrew Szot +20
cs.HCcs.AIcs.CVarXiv:2310.13724v12023Extremely Large Minibatch SGD: Training ResNet-50 on ImageNet in 15 Minutes
Takuya Akiba, Shuji Suzuki, Keisuke Fukuda
cs.DCcs.CVcs.LGarXiv:1711.04325v12017Large-scale weakly-supervised pre-training for video action recognition
Deepti Ghadiyaram, Matt Feiszli, Du Tran +3
cs.CVarXiv:1905.00561v120193D Face Reconstruction by Learning from Synthetic Data
Elad Richardson, Matan Sela, Ron Kimmel
cs.CVarXiv:1609.04387v22016Red-Teaming the Stable Diffusion Safety Filter
Javier Rando, Daniel Paleka, David Lindner +2
cs.AIcs.CRcs.CVarXiv:2210.04610v52022Building Cooperative Embodied Agents Modularly with Large Language Models
Hongxin Zhang, Weihua Du, Jiaming Shan +5
cs.AIcs.CLcs.CVarXiv:2307.02485v22023Segmentation-driven 6D Object Pose Estimation
Yinlin Hu, Joachim Hugonot, Pascal Fua +1
cs.CVarXiv:1812.02541v32018Efficient RGB-D Semantic Segmentation for Indoor Scene Analysis
Daniel Seichter, Mona Köhler, Benjamin Lewandowski +2
cs.CVcs.LGcs.ROarXiv:2011.06961v320202017 Robotic Instrument Segmentation Challenge
Max Allan, Alex Shvets, Thomas Kurmann +16
cs.CVarXiv:1902.06426v22019Few-Shot Classification with Feature Map Reconstruction Networks
Davis Wertheimer, Luming Tang, Bharath Hariharan
cs.CVcs.LGarXiv:2012.01506v22020H2O: Two Hands Manipulating Objects for First Person Interaction Recognition
Taein Kwon, Bugra Tekin, Jan Stuhmer +2
cs.CVarXiv:2104.11181v22021Text-Attentional Convolutional Neural Networks for Scene Text Detection
Tong He, Weilin Huang, Yu Qiao +1
cs.CVarXiv:1510.03283v22015NeRP: Implicit Neural Representation Learning with Prior Embedding for Sparsely Sampled Image Reconstruction
Liyue Shen, John Pauly, Lei Xing
eess.IVcs.CVarXiv:2108.10991v22021Learning Aerial Image Segmentation from Online Maps
Pascal Kaiser, Jan Dirk Wegner, Aurelien Lucchi +3
cs.CVarXiv:1707.06879v12017Aggregate channel features for multi-view face detection
Bin Yang, Junjie Yan, Zhen Lei +1
cs.CVarXiv:1407.4023v22014A Review on Deep Learning Techniques for Video Prediction
Sergiu Oprea, Pablo Martinez-Gonzalez, Alberto Garcia-Garcia +4
cs.CVcs.LGeess.IVarXiv:2004.05214v22020SPAN: Spatial Pyramid Attention Network forImage Manipulation Localization
Xuefeng Hu, Zhihan Zhang, Zhenye Jiang +3
cs.CVarXiv:2009.00726v22020CNN Explainer: Learning Convolutional Neural Networks with Interactive Visualization
Zijie J. Wang, Robert Turko, Omar Shaikh +5
cs.HCcs.AIcs.CVarXiv:2004.15004v32020Multispectral and Hyperspectral Image Fusion Using a 3-D-Convolutional Neural Network
Frosti Palsson, Johannes R. Sveinsson, Magnus O. Ulfarsson
cs.CVstat.MLarXiv:1706.05249v12017Standardized Assessment of Automatic Segmentation of White Matter Hyperintensities and Results of the WMH Segmentation Challenge
Hugo J. Kuijf, J. Matthijs Biesbroek, Jeroen de Bresser +41
cs.CVarXiv:1904.00682v12019Scene Graph Generation with External Knowledge and Image Reconstruction
Jiuxiang Gu, Handong Zhao, Zhe Lin +3
cs.CVarXiv:1904.00560v12019Weakly-Supervised Semantic Segmentation by Iteratively Mining Common Object Features
Xiang Wang, Shaodi You, Xi Li +1
cs.CVarXiv:1806.04659v12018Learning Local Image Descriptors with Deep Siamese and Triplet Convolutional Networks by Minimising Global Loss Functions
Vijay Kumar B G, Gustavo Carneiro, Ian Reid
cs.CVarXiv:1512.09272v22015Meta-Transfer Learning for Zero-Shot Super-Resolution
Jae Woong Soh, Sunwoo Cho, Nam Ik Cho
cs.CVarXiv:2002.12213v12020Closed-loop Matters: Dual Regression Networks for Single Image Super-Resolution
Yong Guo, Jian Chen, Jingdong Wang +5
cs.CVarXiv:2003.07018v42020MM-Diffusion: Learning Multi-Modal Diffusion Models for Joint Audio and Video Generation
Ludan Ruan, Yiyang Ma, Huan Yang +6
cs.CVarXiv:2212.09478v22022Visformer: The Vision-friendly Transformer
Zhengsu Chen, Lingxi Xie, Jianwei Niu +3
cs.CVarXiv:2104.12533v52021Noisier2Noise: Learning to Denoise from Unpaired Noisy Data
Nick Moran, Dan Schmidt, Yu Zhong +1
eess.IVcs.CVarXiv:1910.11908v12019Federated Adversarial Domain Adaptation
Xingchao Peng, Zijun Huang, Yizhe Zhu +1
cs.CVcs.LGarXiv:1911.02054v32019DARTS+: Improved Differentiable Architecture Search with Early Stopping
Hanwen Liang, Shifeng Zhang, Jiacheng Sun +4
cs.CVcs.LGarXiv:1909.06035v22019Superhuman Accuracy on the SNEMI3D Connectomics Challenge
Kisuk Lee, Jonathan Zung, Peter Li +2
cs.CVarXiv:1706.00120v12017Better Diffusion Models Further Improve Adversarial Training
Zekai Wang, Tianyu Pang, Chao Du +3
cs.CVcs.AIcs.CRarXiv:2302.04638v22023ST-Adapter: Parameter-Efficient Image-to-Video Transfer Learning
Junting Pan, Ziyi Lin, Xiatian Zhu +2
cs.CVarXiv:2206.13559v32022Evaluating Deep Neural Networks Trained on Clinical Images in Dermatology with the Fitzpatrick 17k Dataset
Matthew Groh, Caleb Harris, Luis Soenksen +5
cs.CVarXiv:2104.09957v12021Deep Learning Human Mind for Automated Visual Classification
Concetto Spampinato, Simone Palazzo, Isaak Kavasidis +3
cs.CVarXiv:1609.00344v22016Memory Enhanced Global-Local Aggregation for Video Object Detection
Yihong Chen, Yue Cao, Han Hu +1
cs.CVcs.LGeess.IVarXiv:2003.12063v12020ClearGrasp: 3D Shape Estimation of Transparent Objects for Manipulation
Shreeyak S. Sajjan, Matthew Moore, Mike Pan +4
cs.CVcs.ROeess.IVarXiv:1910.02550v22019Fixing Data Augmentation to Improve Adversarial Robustness
Sylvestre-Alvise Rebuffi, Sven Gowal, Dan A. Calian +3
cs.CVcs.LGarXiv:2103.01946v22021ElasticFace: Elastic Margin Loss for Deep Face Recognition
Fadi Boutros, Naser Damer, Florian Kirchbuchner +1
cs.CVarXiv:2109.09416v42021Learning to Decompose and Disentangle Representations for Video Prediction
Jun-Ting Hsieh, Bingbin Liu, De-An Huang +2
cs.LGcs.CVstat.MLarXiv:1806.04166v22018Conditional Object-Centric Learning from Video
Thomas Kipf, Gamaleldin F. Elsayed, Aravindh Mahendran +6
cs.CVcs.LGstat.MLarXiv:2111.12594v22021Transferring GANs: generating images from limited data
Yaxing Wang, Chenshen Wu, Luis Herranz +3
cs.CVarXiv:1805.01677v22018Cross-task weakly supervised learning from instructional videos
Dimitri Zhukov, Jean-Baptiste Alayrac, Ramazan Gokberk Cinbis +3
cs.CVarXiv:1903.08225v22019Recent Advancements in End-to-End Autonomous Driving using Deep Learning: A Survey
Pranav Singh Chib, Pravendra Singh
cs.ROcs.AIcs.CVarXiv:2307.04370v22023Heterogeneous Memory Enhanced Multimodal Attention Model for Video Question Answering
Chenyou Fan, Xiaofan Zhang, Shu Zhang +3
cs.CVarXiv:1904.04357v12019PyGAD: An Intuitive Genetic Algorithm Python Library
Ahmed Fawzy Gad
cs.NEcs.CVcs.LGarXiv:2106.06158v12021Reading Scene Text in Deep Convolutional Sequences
Pan He, Weilin Huang, Yu Qiao +2
cs.CVarXiv:1506.04395v22015GODIVA: Generating Open-DomaIn Videos from nAtural Descriptions
Chenfei Wu, Lun Huang, Qianxi Zhang +5
cs.CVarXiv:2104.14806v12021Learning Affinity via Spatial Propagation Networks
Sifei Liu, Shalini De Mello, Jinwei Gu +3
cs.CVcs.LGarXiv:1710.01020v12017