Computer Vision and Pattern Recognition

Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,641 to 11,700 of 18,866

  1. Decomposition into Low-rank plus Additive Matrices for Background/Foreground Separation: A Review for a Comparative Evaluation with a Large-Scale Dataset

    Thierry Bouwmans, Andrews Sobral, Sajid Javed +2

    cs.CVarXiv:1511.01245v32015
  2. AAU-net: An Adaptive Attention U-net for Breast Lesions Segmentation in Ultrasound Images

    Gongping Chen, Yu Dai, Jianxun Zhang +1

    eess.IVcs.CVcs.LGarXiv:2204.12077v32022
  3. Generalized Focal Loss V2: Learning Reliable Localization Quality Estimation for Dense Object Detection

    Xiang Li, Wenhai Wang, Xiaolin Hu +3

    cs.CVarXiv:2011.12885v12020
  4. Learning Complexity-Aware Cascades for Deep Pedestrian Detection

    Zhaowei Cai, Mohammad Saberian, Nuno Vasconcelos

    cs.CVarXiv:1507.05348v12015
  5. Learning Video Object Segmentation with Visual Memory

    Pavel Tokmakov, Karteek Alahari, Cordelia Schmid

    cs.CVarXiv:1704.05737v22017
  6. MAN: Moment Alignment Network for Natural Language Moment Retrieval via Iterative Graph Adjustment

    Da Zhang, Xiyang Dai, Xin Wang +2

    cs.CVarXiv:1812.00087v22018
  7. Knowledge Distillation Meets Self-Supervision

    Guodong Xu, Ziwei Liu, Xiaoxiao Li +1

    cs.CVarXiv:2006.07114v22020
  8. Pixel-Aware Stable Diffusion for Realistic Image Super-resolution and Personalized Stylization

    Tao Yang, Rongyuan Wu, Peiran Ren +2

    cs.CVarXiv:2308.14469v42023
  9. Label-Free Concept Bottleneck Models

    Tuomas Oikarinen, Subhro Das, Lam M. Nguyen +1

    cs.LGcs.CVarXiv:2304.06129v22023
  10. An introduction to domain adaptation and transfer learning

    Wouter M. Kouw, Marco Loog

    cs.LGcs.CVstat.MLarXiv:1812.11806v22018
  11. LIDAR-Camera Fusion for Road Detection Using Fully Convolutional Neural Networks

    Luca Caltagirone, Mauro Bellone, Lennart Svensson +1

    cs.CVarXiv:1809.07941v12018
  12. Detecting and Preventing Hallucinations in Large Vision Language Models

    Anisha Gunjal, Jihan Yin, Erhan Bas

    cs.CVcs.LGarXiv:2308.06394v32023
  13. Aerial Imagery Pile burn detection using Deep Learning: the FLAME dataset

    Alireza Shamsoshoara, Fatemeh Afghah, Abolfazl Razi +3

    cs.CVcs.AIcs.LGarXiv:2012.14036v12020
  14. Robustness via curvature regularization, and vice versa

    Seyed-Mohsen Moosavi-Dezfooli, Alhussein Fawzi, Jonathan Uesato +1

    cs.LGcs.CVstat.MLarXiv:1811.09716v12018
  15. RELLIS-3D Dataset: Data, Benchmarks and Analysis

    Peng Jiang, Philip Osteen, Maggie Wigness +1

    cs.CVcs.ROarXiv:2011.12954v42020
  16. End-to-End Urban Driving by Imitating a Reinforcement Learning Coach

    Zhejun Zhang, Alexander Liniger, Dengxin Dai +2

    cs.CVcs.ROarXiv:2108.08265v32021
  17. HOTR: End-to-End Human-Object Interaction Detection with Transformers

    Bumsoo Kim, Junhyun Lee, Jaewoo Kang +2

    cs.CVarXiv:2104.13682v12021
  18. Aligning Cyber Space with Physical World: A Comprehensive Survey on Embodied AI

    Yang Liu, Weixing Chen, Yongjie Bai +4

    cs.CVcs.AIcs.LGarXiv:2407.06886v82024
  19. Generative Probabilistic Novelty Detection with Adversarial Autoencoders

    Stanislav Pidhorskyi, Ranya Almohsen, Donald A Adjeroh +1

    cs.CVcs.LGarXiv:1807.02588v22018
  20. Multimodal Contrastive Learning with LIMoE: the Language-Image Mixture of Experts

    Basil Mustafa, Carlos Riquelme, Joan Puigcerver +2

    cs.CVarXiv:2206.02770v12022
  21. A Comprehensive Survey of Scene Graphs: Generation and Application

    Xiaojun Chang, Pengzhen Ren, Pengfei Xu +3

    cs.CVarXiv:2104.01111v52021
  22. Optimizing the Dice Score and Jaccard Index for Medical Image Segmentation: Theory & Practice

    Jeroen Bertels, Tom Eelbode, Maxim Berman +4

    cs.CVcs.LGeess.IVarXiv:1911.01685v12019
  23. Analyzing the Behavior of Visual Question Answering Models

    Aishwarya Agrawal, Dhruv Batra, Devi Parikh

    cs.CLcs.AIcs.CVarXiv:1606.07356v22016
  24. Hierarchical Surface Prediction for 3D Object Reconstruction

    Christian Häne, Shubham Tulsiani, Jitendra Malik

    cs.CVarXiv:1704.00710v22017
  25. Real-time Facial Surface Geometry from Monocular Video on Mobile GPUs

    Yury Kartynnik, Artsiom Ablavatski, Ivan Grishchenko +1

    cs.CVarXiv:1907.06724v12019
  26. Frequency-aware Discriminative Feature Learning Supervised by Single-Center Loss for Face Forgery Detection

    Jiaming Li, Hongtao Xie, Jiahong Li +2

    cs.CVarXiv:2103.09096v12021
  27. Normalized Cut Loss for Weakly-supervised CNN Segmentation

    Meng Tang, Abdelaziz Djelouah, Federico Perazzi +2

    cs.CVarXiv:1804.01346v12018
  28. Exploring Categorical Regularization for Domain Adaptive Object Detection

    Chang-Dong Xu, Xing-Ran Zhao, Xin Jin +1

    cs.CVarXiv:2003.09152v12020
  29. Deep Functional Maps: Structured Prediction for Dense Shape Correspondence

    Or Litany, Tal Remez, Emanuele Rodolà +2

    cs.CVarXiv:1704.08686v22017
  30. MBRS : Enhancing Robustness of DNN-based Watermarking by Mini-Batch of Real and Simulated JPEG Compression

    Zhaoyang Jia, Han Fang, Weiming Zhang

    cs.CVcs.CRarXiv:2108.08211v12021
  31. CoFiNet: Reliable Coarse-to-fine Correspondences for Robust Point Cloud Registration

    Hao Yu, Fu Li, Mahdi Saleh +2

    cs.CVcs.AIarXiv:2110.14076v12021
  32. HyperNeRF: A Higher-Dimensional Representation for Topologically Varying Neural Radiance Fields

    Keunhong Park, Utkarsh Sinha, Peter Hedman +5

    cs.CVcs.GRarXiv:2106.13228v22021
  33. Encoder Based Lifelong Learning

    Amal Rannen Triki, Rahaf Aljundi, Mathew B. Blaschko +1

    cs.CVcs.AIstat.MLarXiv:1704.01920v12017
  34. Adversarial PoseNet: A Structure-aware Convolutional Network for Human Pose Estimation

    Yu Chen, Chunhua Shen, Xiu-Shen Wei +2

    cs.CVarXiv:1705.00389v22017
  35. Tex2Shape: Detailed Full Human Body Geometry From a Single Image

    Thiemo Alldieck, Gerard Pons-Moll, Christian Theobalt +1

    cs.CVarXiv:1904.08645v22019
  36. PixArt-Σ: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation

    Junsong Chen, Chongjian Ge, Enze Xie +7

    cs.CVarXiv:2403.04692v22024
  37. Towards Accurate Scene Text Recognition with Semantic Reasoning Networks

    Deli Yu, Xuan Li, Chengquan Zhang +3

    cs.CVarXiv:2003.12294v12020
  38. Rendering of Eyes for Eye-Shape Registration and Gaze Estimation

    Erroll Wood, Tadas Baltrusaitis, Xucong Zhang +3

    cs.CVarXiv:1505.05916v12015
  39. Multimodal and Multiscale Deep Neural Networks for the Early Diagnosis of Alzheimer's Disease using structural MR and FDG-PET images

    Donghuan Lu, Karteek Popuri, Weiguang Ding +2

    cs.CVarXiv:1710.04782v12017
  40. DeepSense 6G: A Large-Scale Real-World Multi-Modal Sensing and Communication Dataset

    Ahmed Alkhateeb, Gouranga Charan, Tawfik Osman +4

    eess.SPcs.CVcs.LGarXiv:2211.09769v22022
  41. Self-Supervised Pretraining of 3D Features on any Point-Cloud

    Zaiwei Zhang, Rohit Girdhar, Armand Joulin +1

    cs.CVarXiv:2101.02691v12021
  42. Forget-Me-Not: Learning to Forget in Text-to-Image Diffusion Models

    Eric Zhang, Kai Wang, Xingqian Xu +2

    cs.CVcs.AIcs.LGarXiv:2303.17591v12023
  43. Scaling Up to Excellence: Practicing Model Scaling for Photo-Realistic Image Restoration In the Wild

    Fanghua Yu, Jinjin Gu, Zheyuan Li +6

    cs.CVarXiv:2401.13627v22024
  44. Exploring Data-Efficient 3D Scene Understanding with Contrastive Scene Contexts

    Ji Hou, Benjamin Graham, Matthias Nießner +1

    cs.CVarXiv:2012.09165v32020
  45. BioMed-Agent-RL: A Meta Learning, All You Need for Biomedical Applications

    Md Asaduzzaman Jabin, Zihao Wu, Tianming Liu

    cs.LGcs.AIcs.CVarXiv:2608.21864v12026
  46. Target-adaptive CNN-based pansharpening

    Giuseppe Scarpa, Sergio Vitale, Davide Cozzolino

    cs.CVarXiv:1709.06054v32017
  47. A U-Net Based Discriminator for Generative Adversarial Networks

    Edgar Schönfeld, Bernt Schiele, Anna Khoreva

    cs.CVcs.LGeess.IVarXiv:2002.12655v22020
  48. Urban Radiance Fields

    Konstantinos Rematas, Andrew Liu, Pratul P. Srinivasan +4

    cs.CVcs.GRarXiv:2111.14643v12021
  49. Image-to-Image Translation: Methods and Applications

    Yingxue Pang, Jianxin Lin, Tao Qin +1

    cs.CVarXiv:2101.08629v22021
  50. MST++: Multi-stage Spectral-wise Transformer for Efficient Spectral Reconstruction

    Yuanhao Cai, Jing Lin, Zudi Lin +5

    cs.CVarXiv:2204.07908v12022
  51. Training-image based geostatistical inversion using a spatial generative adversarial neural network

    Eric Laloy, Romain Hérault, Diederik Jacques +1

    stat.MLcs.CVphysics.geo-pharXiv:1708.04975v22017
  52. Methods for Segmentation and Classification of Digital Microscopy Tissue Images

    Quoc Dang Vu, Simon Graham, Minh Nguyen Nhat To +11

    cs.CVarXiv:1810.13230v22018
  53. Drawing and Recognizing Chinese Characters with Recurrent Neural Network

    Xu-Yao Zhang, Fei Yin, Yan-Ming Zhang +2

    cs.CVarXiv:1606.06539v12016
  54. Reliable Tuberculosis Detection using Chest X-ray with Deep Learning, Segmentation and Visualization

    Tawsifur Rahman, Amith Khandakar, Muhammad Abdul Kadir +8

    eess.IVcs.CVarXiv:2007.14895v12020
  55. SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation

    Yuying Ge, Sijie Zhao, Jinguo Zhu +6

    cs.CVarXiv:2404.14396v22024
  56. Machine learning methods for histopathological image analysis

    Daisuke Komura, Shumpei Ishikawa

    cs.CVarXiv:1709.00786v22017
  57. Split-Brain Autoencoders: Unsupervised Learning by Cross-Channel Prediction

    Richard Zhang, Phillip Isola, Alexei A. Efros

    cs.CVarXiv:1611.09842v32016
  58. Deep Watershed Transform for Instance Segmentation

    Min Bai, Raquel Urtasun

    cs.CVarXiv:1611.08303v22016
  59. HDNET: Exploiting HD Maps for 3D Object Detection

    Bin Yang, Ming Liang, Raquel Urtasun

    cs.CVarXiv:2012.11704v12020
  60. Using Deep Learning for Image-Based Plant Disease Detection

    Sharada Prasanna Mohanty, David Hughes, Marcel Salathe

    cs.CVarXiv:1604.03169v22016