Computer Vision and Pattern Recognition

Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

8,701 to 8,760 of 18,866

  1. Joint Disentangling and Adaptation for Cross-Domain Person Re-Identification

    Yang Zou, Xiaodong Yang, Zhiding Yu +2

    cs.CVarXiv:2007.10315v12020
  2. PREDICT & CLUSTER: Unsupervised Skeleton Based Action Recognition

    Kun Su, Xiulong Liu, Eli Shlizerman

    cs.CVcs.LGeess.IVarXiv:1911.12409v12019
  3. Learning To Score Olympic Events

    Paritosh Parmar, Brendan Tran Morris

    cs.CVarXiv:1611.05125v32016
  4. Modality specific U-Net variants for biomedical image segmentation: A survey

    Narinder Singh Punn, Sonali Agarwal

    eess.IVcs.CVarXiv:2107.04537v42021
  5. Robust Face Recognition via Adaptive Sparse Representation

    Jing Wang, Canyi Lu, Meng Wang +3

    cs.CVarXiv:1404.4780v12014
  6. Going Deep in Medical Image Analysis: Concepts, Methods, Challenges and Future Directions

    Fouzia Altaf, Syed M. S. Islam, Naveed Akhtar +1

    cs.CVarXiv:1902.05655v12019
  7. Demystifying Contrastive Self-Supervised Learning: Invariances, Augmentations and Dataset Biases

    Senthil Purushwalkam, Abhinav Gupta

    cs.CVarXiv:2007.13916v22020
  8. Simpler is Better: Few-shot Semantic Segmentation with Classifier Weight Transformer

    Zhihe Lu, Sen He, Xiatian Zhu +3

    cs.CVarXiv:2108.03032v32021
  9. LEAP Hand: Low-Cost, Efficient, and Anthropomorphic Hand for Robot Learning

    Kenneth Shaw, Ananye Agarwal, Deepak Pathak

    cs.ROcs.AIcs.CVarXiv:2309.06440v12023
  10. Federated Unlearning via Class-Discriminative Pruning

    Junxiao Wang, Song Guo, Xin Xie +1

    cs.CVcs.CRcs.DCarXiv:2110.11794v32021
  11. Deep Structured Output Learning for Unconstrained Text Recognition

    Max Jaderberg, Karen Simonyan, Andrea Vedaldi +1

    cs.CVarXiv:1412.5903v52014
  12. Generative Dual Adversarial Network for Generalized Zero-shot Learning

    He Huang, Changhu Wang, Philip S. Yu +1

    cs.CVarXiv:1811.04857v42018
  13. Studying Very Low Resolution Recognition Using Deep Networks

    Zhangyang Wang, Shiyu Chang, Yingzhen Yang +2

    cs.CVcs.AIcs.LGarXiv:1601.04153v22016
  14. DeepFactors: Real-Time Probabilistic Dense Monocular SLAM

    Jan Czarnowski, Tristan Laidlow, Ronald Clark +1

    cs.CVarXiv:2001.05049v12020
  15. An Online Plug-and-Play Algorithm for Regularized Image Reconstruction

    Yu Sun, Brendt Wohlberg, Ulugbek S. Kamilov

    cs.CVeess.IVarXiv:1809.04693v12018
  16. Surface Representation for Point Clouds

    Haoxi Ran, Jun Liu, Chengjie Wang

    cs.CVcs.AIcs.GRarXiv:2205.05740v22022
  17. NVILA: Efficient Frontier Visual Language Models

    Zhijian Liu, Ligeng Zhu, Baifeng Shi +24

    cs.CVarXiv:2412.04468v32024
  18. SceneNet: Understanding Real World Indoor Scenes With Synthetic Data

    Ankur Handa, Viorica Patraucean, Vijay Badrinarayanan +2

    cs.CVarXiv:1511.07041v22015
  19. Direct3D: Scalable Image-to-3D Generation via 3D Latent Diffusion Transformer

    Shuang Wu, Youtian Lin, Feihu Zhang +5

    cs.CVarXiv:2405.14832v22024
  20. Learning Delicate Local Representations for Multi-Person Pose Estimation

    Yuanhao Cai, Zhicheng Wang, Zhengxiong Luo +7

    cs.CVarXiv:2003.04030v32020
  21. Blueprint Separable Residual Network for Efficient Image Super-Resolution

    Zheyuan Li, Yingqi Liu, Xiangyu Chen +4

    cs.CVeess.IVarXiv:2205.05996v12022
  22. Deep Video Inpainting

    Dahun Kim, Sanghyun Woo, Joon-Young Lee +1

    cs.CVarXiv:1905.01639v12019
  23. Partial Sum Minimization of Singular Values in Robust PCA: Algorithm and Applications

    Tae-Hyun Oh, Yu-Wing Tai, Jean-Charles Bazin +2

    cs.CVcs.AIcs.LGarXiv:1503.01444v22015
  24. Contrast with Reconstruct: Contrastive 3D Representation Learning Guided by Generative Pretraining

    Zekun Qi, Runpei Dong, Guofan Fan +4

    cs.CVarXiv:2302.02318v22023
  25. Faster AutoAugment: Learning Augmentation Strategies using Backpropagation

    Ryuichiro Hataya, Jan Zdenek, Kazuki Yoshizoe +1

    cs.CVarXiv:1911.06987v12019
  26. AEGNN: Asynchronous Event-based Graph Neural Networks

    Simon Schaefer, Daniel Gehrig, Davide Scaramuzza

    cs.CVarXiv:2203.17149v32022
  27. MeGA-CDA: Memory Guided Attention for Category-Aware Unsupervised Domain Adaptive Object Detection

    Vibashan VS, Vikram Gupta, Poojan Oza +2

    cs.CVarXiv:2103.04224v22021
  28. Non-local Meets Global: An Iterative Paradigm for Hyperspectral Image Restoration

    Wei He, Quanming Yao, Chao Li +4

    eess.IVcs.CVarXiv:2010.12921v12020
  29. MegaSaM: Accurate, Fast, and Robust Structure and Motion from Casual Dynamic Videos

    Zhengqi Li, Richard Tucker, Forrester Cole +6

    cs.CVarXiv:2412.04463v22024
  30. DPGN: Distribution Propagation Graph Network for Few-shot Learning

    Ling Yang, Liangliang Li, Zilun Zhang +3

    cs.CVarXiv:2003.14247v22020
  31. NeRSemble: Multi-view Radiance Field Reconstruction of Human Heads

    Tobias Kirschstein, Shenhan Qian, Simon Giebenhain +2

    cs.CVarXiv:2305.03027v12023
  32. Novel View Synthesis of Dynamic Scenes with Globally Coherent Depths from a Monocular Camera

    Jae Shin Yoon, Kihwan Kim, Orazio Gallo +2

    cs.CVarXiv:2004.01294v12020
  33. VideoLLM-online: Online Video Large Language Model for Streaming Video

    Joya Chen, Zhaoyang Lv, Shiwei Wu +7

    cs.CVarXiv:2406.11816v12024
  34. DragonDiffusion: Enabling Drag-style Manipulation on Diffusion Models

    Chong Mou, Xintao Wang, Jiechong Song +2

    cs.CVarXiv:2307.02421v22023
  35. HPLFlowNet: Hierarchical Permutohedral Lattice FlowNet for Scene Flow Estimation on Large-scale Point Clouds

    Xiuye Gu, Yijie Wang, Chongruo wu +2

    cs.CVcs.LGeess.IVarXiv:1906.05332v12019
  36. Mask2Former for Video Instance Segmentation

    Bowen Cheng, Anwesa Choudhuri, Ishan Misra +3

    cs.CVcs.AIcs.LGarXiv:2112.10764v12021
  37. Iterative Answer Prediction with Pointer-Augmented Multimodal Transformers for TextVQA

    Ronghang Hu, Amanpreet Singh, Trevor Darrell +1

    cs.CVcs.CLarXiv:1911.06258v32019
  38. 3D Point Cloud Processing and Learning for Autonomous Driving

    Siheng Chen, Baoan Liu, Chen Feng +2

    cs.CVeess.SParXiv:2003.00601v12020
  39. Decoders Matter for Semantic Segmentation: Data-Dependent Decoding Enables Flexible Feature Aggregation

    Zhi Tian, Tong He, Chunhua Shen +1

    cs.CVarXiv:1903.02120v32019
  40. Beyond Pixels: A Comprehensive Survey from Bottom-up to Semantic Image Segmentation and Cosegmentation

    Hongyuan Zhu, Fanman Meng, Jianfei Cai +1

    cs.CVarXiv:1502.00717v12015
  41. Real-time object detection method based on improved YOLOv4-tiny

    Zicong Jiang, Liquan Zhao, Shuaiyang Li +1

    cs.CVcs.AIarXiv:2011.04244v22020
  42. A Mutual Learning Method for Salient Object Detection with intertwined Multi-Supervision--Revised

    Runmin Wu, Mengyang Feng, Wenlong Guan +3

    cs.CVcs.AIarXiv:2509.21363v12025
  43. D-FINE: Redefine Regression Task in DETRs as Fine-grained Distribution Refinement

    Yansong Peng, Hebei Li, Peixi Wu +3

    cs.CVarXiv:2410.13842v12024
  44. Global Guidance Network for Breast Lesion Segmentation in Ultrasound Images

    Cheng Xue, Lei Zhu, Huazhu Fu +4

    eess.IVcs.CVcs.LGarXiv:2104.01896v12021
  45. Spatially-Aware Graph Neural Networks for Relational Behavior Forecasting from Sensor Data

    Sergio Casas, Cole Gulino, Renjie Liao +1

    cs.CVcs.LGcs.ROarXiv:1910.08233v12019
  46. Residual Conv-Deconv Grid Network for Semantic Segmentation

    Damien Fourure, Rémi Emonet, Elisa Fromont +3

    cs.CVarXiv:1707.07958v22017
  47. Learning to Balance Specificity and Invariance for In and Out of Domain Generalization

    Prithvijit Chattopadhyay, Yogesh Balaji, Judy Hoffman

    cs.CVcs.LGarXiv:2008.12839v12020
  48. Implicit Neural Representations for Image Compression

    Yannick Strümpler, Janis Postels, Ren Yang +2

    eess.IVcs.CVcs.LGarXiv:2112.04267v22021
  49. Mahotas: Open source software for scriptable computer vision

    Luis Pedro Coelho

    cs.CVcs.SEarXiv:1211.4907v22012
  50. Overcoming Catastrophic Forgetting with Unlabeled Data in the Wild

    Kibok Lee, Kimin Lee, Jinwoo Shin +1

    cs.CVcs.LGstat.MLarXiv:1903.12648v32019
  51. Adversarial Continual Learning

    Sayna Ebrahimi, Franziska Meier, Roberto Calandra +2

    cs.LGcs.AIcs.CVarXiv:2003.09553v22020
  52. HOPE-Net: A Graph-based Model for Hand-Object Pose Estimation

    Bardia Doosti, Shujon Naha, Majid Mirbagheri +1

    cs.CVarXiv:2004.00060v12020
  53. MODNet: Real-Time Trimap-Free Portrait Matting via Objective Decomposition

    Zhanghan Ke, Jiayu Sun, Kaican Li +2

    cs.CVarXiv:2011.11961v42020
  54. NeRO: Neural Geometry and BRDF Reconstruction of Reflective Objects from Multiview Images

    Yuan Liu, Peng Wang, Cheng Lin +5

    cs.CVcs.GRarXiv:2305.17398v12023
  55. 'Squeeze & Excite' Guided Few-Shot Segmentation of Volumetric Images

    Abhijit Guha Roy, Shayan Siddiqui, Sebastian Pölsterl +2

    cs.CVarXiv:1902.01314v22019
  56. PaliGemma 2: A Family of Versatile VLMs for Transfer

    Andreas Steiner, André Susano Pinto, Michael Tschannen +15

    cs.CVarXiv:2412.03555v12024
  57. FedMix: Approximation of Mixup under Mean Augmented Federated Learning

    Tehrim Yoon, Sumin Shin, Sung Ju Hwang +1

    cs.LGcs.AIcs.CVarXiv:2107.00233v12021
  58. Constructing Self-motivated Pyramid Curriculums for Cross-Domain Semantic Segmentation: A Non-Adversarial Approach

    Qing Lian, Fengmao Lv, Lixin Duan +1

    cs.CVarXiv:1908.09547v12019
  59. SeqTR: A Simple yet Universal Network for Visual Grounding

    Chaoyang Zhu, Yiyi Zhou, Yunhang Shen +7

    cs.CVarXiv:2203.16265v22022
  60. MatchFormer: Interleaving Attention in Transformers for Feature Matching

    Qing Wang, Jiaming Zhang, Kailun Yang +2

    cs.CVcs.ROeess.IVarXiv:2203.09645v32022