Computer Vision and Pattern Recognition
Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
8,701 to 8,760 of 18,866
Joint Disentangling and Adaptation for Cross-Domain Person Re-Identification
Yang Zou, Xiaodong Yang, Zhiding Yu +2
cs.CVarXiv:2007.10315v12020PREDICT & CLUSTER: Unsupervised Skeleton Based Action Recognition
Kun Su, Xiulong Liu, Eli Shlizerman
cs.CVcs.LGeess.IVarXiv:1911.12409v12019Learning To Score Olympic Events
Paritosh Parmar, Brendan Tran Morris
cs.CVarXiv:1611.05125v32016Modality specific U-Net variants for biomedical image segmentation: A survey
Narinder Singh Punn, Sonali Agarwal
eess.IVcs.CVarXiv:2107.04537v42021Robust Face Recognition via Adaptive Sparse Representation
Jing Wang, Canyi Lu, Meng Wang +3
cs.CVarXiv:1404.4780v12014Going Deep in Medical Image Analysis: Concepts, Methods, Challenges and Future Directions
Fouzia Altaf, Syed M. S. Islam, Naveed Akhtar +1
cs.CVarXiv:1902.05655v12019Demystifying Contrastive Self-Supervised Learning: Invariances, Augmentations and Dataset Biases
Senthil Purushwalkam, Abhinav Gupta
cs.CVarXiv:2007.13916v22020Simpler is Better: Few-shot Semantic Segmentation with Classifier Weight Transformer
Zhihe Lu, Sen He, Xiatian Zhu +3
cs.CVarXiv:2108.03032v32021LEAP Hand: Low-Cost, Efficient, and Anthropomorphic Hand for Robot Learning
Kenneth Shaw, Ananye Agarwal, Deepak Pathak
cs.ROcs.AIcs.CVarXiv:2309.06440v12023Federated Unlearning via Class-Discriminative Pruning
Junxiao Wang, Song Guo, Xin Xie +1
cs.CVcs.CRcs.DCarXiv:2110.11794v32021Deep Structured Output Learning for Unconstrained Text Recognition
Max Jaderberg, Karen Simonyan, Andrea Vedaldi +1
cs.CVarXiv:1412.5903v52014Generative Dual Adversarial Network for Generalized Zero-shot Learning
He Huang, Changhu Wang, Philip S. Yu +1
cs.CVarXiv:1811.04857v42018Studying Very Low Resolution Recognition Using Deep Networks
Zhangyang Wang, Shiyu Chang, Yingzhen Yang +2
cs.CVcs.AIcs.LGarXiv:1601.04153v22016DeepFactors: Real-Time Probabilistic Dense Monocular SLAM
Jan Czarnowski, Tristan Laidlow, Ronald Clark +1
cs.CVarXiv:2001.05049v12020An Online Plug-and-Play Algorithm for Regularized Image Reconstruction
Yu Sun, Brendt Wohlberg, Ulugbek S. Kamilov
cs.CVeess.IVarXiv:1809.04693v12018Surface Representation for Point Clouds
Haoxi Ran, Jun Liu, Chengjie Wang
cs.CVcs.AIcs.GRarXiv:2205.05740v22022NVILA: Efficient Frontier Visual Language Models
Zhijian Liu, Ligeng Zhu, Baifeng Shi +24
cs.CVarXiv:2412.04468v32024SceneNet: Understanding Real World Indoor Scenes With Synthetic Data
Ankur Handa, Viorica Patraucean, Vijay Badrinarayanan +2
cs.CVarXiv:1511.07041v22015Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer
Shuang Wu, Youtian Lin, Feihu Zhang +5
cs.CVarXiv:2405.14832v22024Learning Delicate Local Representations for Multi-Person Pose Estimation
Yuanhao Cai, Zhicheng Wang, Zhengxiong Luo +7
cs.CVarXiv:2003.04030v32020Blueprint Separable Residual Network for Efficient Image Super-Resolution
Zheyuan Li, Yingqi Liu, Xiangyu Chen +4
cs.CVeess.IVarXiv:2205.05996v12022Deep Video Inpainting
Dahun Kim, Sanghyun Woo, Joon-Young Lee +1
cs.CVarXiv:1905.01639v12019Partial Sum Minimization of Singular Values in Robust PCA: Algorithm and Applications
Tae-Hyun Oh, Yu-Wing Tai, Jean-Charles Bazin +2
cs.CVcs.AIcs.LGarXiv:1503.01444v22015Contrast with Reconstruct: Contrastive 3D Representation Learning Guided by Generative Pretraining
Zekun Qi, Runpei Dong, Guofan Fan +4
cs.CVarXiv:2302.02318v22023Faster AutoAugment: Learning Augmentation Strategies using Backpropagation
Ryuichiro Hataya, Jan Zdenek, Kazuki Yoshizoe +1
cs.CVarXiv:1911.06987v12019AEGNN: Asynchronous Event-based Graph Neural Networks
Simon Schaefer, Daniel Gehrig, Davide Scaramuzza
cs.CVarXiv:2203.17149v32022MeGA-CDA: Memory Guided Attention for Category-Aware Unsupervised Domain Adaptive Object Detection
Vibashan VS, Vikram Gupta, Poojan Oza +2
cs.CVarXiv:2103.04224v22021Non-local Meets Global: An Iterative Paradigm for Hyperspectral Image Restoration
Wei He, Quanming Yao, Chao Li +4
eess.IVcs.CVarXiv:2010.12921v12020MegaSaM: Accurate, Fast, and Robust Structure and Motion from Casual Dynamic Videos
Zhengqi Li, Richard Tucker, Forrester Cole +6
cs.CVarXiv:2412.04463v22024DPGN: Distribution Propagation Graph Network for Few-shot Learning
Ling Yang, Liangliang Li, Zilun Zhang +3
cs.CVarXiv:2003.14247v22020NeRSemble: Multi-view Radiance Field Reconstruction of Human Heads
Tobias Kirschstein, Shenhan Qian, Simon Giebenhain +2
cs.CVarXiv:2305.03027v12023Novel View Synthesis of Dynamic Scenes with Globally Coherent Depths from a Monocular Camera
Jae Shin Yoon, Kihwan Kim, Orazio Gallo +2
cs.CVarXiv:2004.01294v12020VideoLLM-online: Online Video Large Language Model for Streaming Video
Joya Chen, Zhaoyang Lv, Shiwei Wu +7
cs.CVarXiv:2406.11816v12024DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models
Chong Mou, Xintao Wang, Jiechong Song +2
cs.CVarXiv:2307.02421v22023HPLFlowNet: Hierarchical Permutohedral Lattice FlowNet for Scene Flow Estimation on Large-scale Point Clouds
Xiuye Gu, Yijie Wang, Chongruo wu +2
cs.CVcs.LGeess.IVarXiv:1906.05332v12019Mask2Former for Video Instance Segmentation
Bowen Cheng, Anwesa Choudhuri, Ishan Misra +3
cs.CVcs.AIcs.LGarXiv:2112.10764v12021Iterative Answer Prediction with Pointer-Augmented Multimodal Transformers for TextVQA
Ronghang Hu, Amanpreet Singh, Trevor Darrell +1
cs.CVcs.CLarXiv:1911.06258v320193D Point Cloud Processing and Learning for Autonomous Driving
Siheng Chen, Baoan Liu, Chen Feng +2
cs.CVeess.SParXiv:2003.00601v12020Decoders Matter for Semantic Segmentation: Data-Dependent Decoding Enables Flexible Feature Aggregation
Zhi Tian, Tong He, Chunhua Shen +1
cs.CVarXiv:1903.02120v32019Beyond Pixels: A Comprehensive Survey from Bottom-up to Semantic Image Segmentation and Cosegmentation
Hongyuan Zhu, Fanman Meng, Jianfei Cai +1
cs.CVarXiv:1502.00717v12015Real-time object detection method based on improved YOLOv4-tiny
Zicong Jiang, Liquan Zhao, Shuaiyang Li +1
cs.CVcs.AIarXiv:2011.04244v22020A Mutual Learning Method for Salient Object Detection with intertwined Multi-Supervision--Revised
Runmin Wu, Mengyang Feng, Wenlong Guan +3
cs.CVcs.AIarXiv:2509.21363v12025D-FINE: Redefine Regression Task in DETRs as Fine-grained Distribution Refinement
Yansong Peng, Hebei Li, Peixi Wu +3
cs.CVarXiv:2410.13842v12024Global Guidance Network for Breast Lesion Segmentation in Ultrasound Images
Cheng Xue, Lei Zhu, Huazhu Fu +4
eess.IVcs.CVcs.LGarXiv:2104.01896v12021Spatially-Aware Graph Neural Networks for Relational Behavior Forecasting from Sensor Data
Sergio Casas, Cole Gulino, Renjie Liao +1
cs.CVcs.LGcs.ROarXiv:1910.08233v12019Residual Conv-Deconv Grid Network for Semantic Segmentation
Damien Fourure, Rémi Emonet, Elisa Fromont +3
cs.CVarXiv:1707.07958v22017Learning to Balance Specificity and Invariance for In and Out of Domain Generalization
Prithvijit Chattopadhyay, Yogesh Balaji, Judy Hoffman
cs.CVcs.LGarXiv:2008.12839v12020Implicit Neural Representations for Image Compression
Yannick Strümpler, Janis Postels, Ren Yang +2
eess.IVcs.CVcs.LGarXiv:2112.04267v22021Mahotas: Open source software for scriptable computer vision
Luis Pedro Coelho
cs.CVcs.SEarXiv:1211.4907v22012Overcoming Catastrophic Forgetting with Unlabeled Data in the Wild
Kibok Lee, Kimin Lee, Jinwoo Shin +1
cs.CVcs.LGstat.MLarXiv:1903.12648v32019Adversarial Continual Learning
Sayna Ebrahimi, Franziska Meier, Roberto Calandra +2
cs.LGcs.AIcs.CVarXiv:2003.09553v22020HOPE-Net: A Graph-based Model for Hand-Object Pose Estimation
Bardia Doosti, Shujon Naha, Majid Mirbagheri +1
cs.CVarXiv:2004.00060v12020MODNet: Real-Time Trimap-Free Portrait Matting via Objective Decomposition
Zhanghan Ke, Jiayu Sun, Kaican Li +2
cs.CVarXiv:2011.11961v42020NeRO: Neural Geometry and BRDF Reconstruction of Reflective Objects from Multiview Images
Yuan Liu, Peng Wang, Cheng Lin +5
cs.CVcs.GRarXiv:2305.17398v12023'Squeeze & Excite' Guided Few-Shot Segmentation of Volumetric Images
Abhijit Guha Roy, Shayan Siddiqui, Sebastian Pölsterl +2
cs.CVarXiv:1902.01314v22019PaliGemma 2: A Family of Versatile VLMs for Transfer
Andreas Steiner, André Susano Pinto, Michael Tschannen +15
cs.CVarXiv:2412.03555v12024FedMix: Approximation of Mixup under Mean Augmented Federated Learning
Tehrim Yoon, Sumin Shin, Sung Ju Hwang +1
cs.LGcs.AIcs.CVarXiv:2107.00233v12021Constructing Self-motivated Pyramid Curriculums for Cross-Domain Semantic Segmentation: A Non-Adversarial Approach
Qing Lian, Fengmao Lv, Lixin Duan +1
cs.CVarXiv:1908.09547v12019SeqTR: A Simple yet Universal Network for Visual Grounding
Chaoyang Zhu, Yiyi Zhou, Yunhang Shen +7
cs.CVarXiv:2203.16265v22022MatchFormer: Interleaving Attention in Transformers for Feature Matching
Qing Wang, Jiaming Zhang, Kailun Yang +2
cs.CVcs.ROeess.IVarXiv:2203.09645v32022