Computer Vision and Pattern Recognition
Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,641 to 11,700 of 18,866
Decomposition into Low-rank plus Additive Matrices for Background/Foreground Separation: A Review for a Comparative Evaluation with a Large-Scale Dataset
Thierry Bouwmans, Andrews Sobral, Sajid Javed +2
cs.CVarXiv:1511.01245v32015AAU-net: An Adaptive Attention U-net for Breast Lesions Segmentation in Ultrasound Images
Gongping Chen, Yu Dai, Jianxun Zhang +1
eess.IVcs.CVcs.LGarXiv:2204.12077v32022Generalized Focal Loss V2: Learning Reliable Localization Quality Estimation for Dense Object Detection
Xiang Li, Wenhai Wang, Xiaolin Hu +3
cs.CVarXiv:2011.12885v12020Learning Complexity-Aware Cascades for Deep Pedestrian Detection
Zhaowei Cai, Mohammad Saberian, Nuno Vasconcelos
cs.CVarXiv:1507.05348v12015Learning Video Object Segmentation with Visual Memory
Pavel Tokmakov, Karteek Alahari, Cordelia Schmid
cs.CVarXiv:1704.05737v22017MAN: Moment Alignment Network for Natural Language Moment Retrieval via Iterative Graph Adjustment
Da Zhang, Xiyang Dai, Xin Wang +2
cs.CVarXiv:1812.00087v22018Knowledge Distillation Meets Self-Supervision
Guodong Xu, Ziwei Liu, Xiaoxiao Li +1
cs.CVarXiv:2006.07114v22020Pixel-Aware Stable Diffusion for Realistic Image Super-resolution and Personalized Stylization
Tao Yang, Rongyuan Wu, Peiran Ren +2
cs.CVarXiv:2308.14469v42023Label-Free Concept Bottleneck Models
Tuomas Oikarinen, Subhro Das, Lam M. Nguyen +1
cs.LGcs.CVarXiv:2304.06129v22023An introduction to domain adaptation and transfer learning
Wouter M. Kouw, Marco Loog
cs.LGcs.CVstat.MLarXiv:1812.11806v22018LIDAR-Camera Fusion for Road Detection Using Fully Convolutional Neural Networks
Luca Caltagirone, Mauro Bellone, Lennart Svensson +1
cs.CVarXiv:1809.07941v12018Detecting and Preventing Hallucinations in Large Vision Language Models
Anisha Gunjal, Jihan Yin, Erhan Bas
cs.CVcs.LGarXiv:2308.06394v32023Aerial Imagery Pile burn detection using Deep Learning: the FLAME dataset
Alireza Shamsoshoara, Fatemeh Afghah, Abolfazl Razi +3
cs.CVcs.AIcs.LGarXiv:2012.14036v12020Robustness via curvature regularization, and vice versa
Seyed-Mohsen Moosavi-Dezfooli, Alhussein Fawzi, Jonathan Uesato +1
cs.LGcs.CVstat.MLarXiv:1811.09716v12018RELLIS-3D Dataset: Data, Benchmarks and Analysis
Peng Jiang, Philip Osteen, Maggie Wigness +1
cs.CVcs.ROarXiv:2011.12954v42020End-to-End Urban Driving by Imitating a Reinforcement Learning Coach
Zhejun Zhang, Alexander Liniger, Dengxin Dai +2
cs.CVcs.ROarXiv:2108.08265v32021HOTR: End-to-End Human-Object Interaction Detection with Transformers
Bumsoo Kim, Junhyun Lee, Jaewoo Kang +2
cs.CVarXiv:2104.13682v12021Aligning Cyber Space with Physical World: A Comprehensive Survey on Embodied AI
Yang Liu, Weixing Chen, Yongjie Bai +4
cs.CVcs.AIcs.LGarXiv:2407.06886v82024Generative Probabilistic Novelty Detection with Adversarial Autoencoders
Stanislav Pidhorskyi, Ranya Almohsen, Donald A Adjeroh +1
cs.CVcs.LGarXiv:1807.02588v22018Multimodal Contrastive Learning with LIMoE: the Language-Image Mixture of Experts
Basil Mustafa, Carlos Riquelme, Joan Puigcerver +2
cs.CVarXiv:2206.02770v12022A Comprehensive Survey of Scene Graphs: Generation and Application
Xiaojun Chang, Pengzhen Ren, Pengfei Xu +3
cs.CVarXiv:2104.01111v52021Optimizing the Dice Score and Jaccard Index for Medical Image Segmentation: Theory & Practice
Jeroen Bertels, Tom Eelbode, Maxim Berman +4
cs.CVcs.LGeess.IVarXiv:1911.01685v12019Analyzing the Behavior of Visual Question Answering Models
Aishwarya Agrawal, Dhruv Batra, Devi Parikh
cs.CLcs.AIcs.CVarXiv:1606.07356v22016Hierarchical Surface Prediction for 3D Object Reconstruction
Christian Häne, Shubham Tulsiani, Jitendra Malik
cs.CVarXiv:1704.00710v22017Real-time Facial Surface Geometry from Monocular Video on Mobile GPUs
Yury Kartynnik, Artsiom Ablavatski, Ivan Grishchenko +1
cs.CVarXiv:1907.06724v12019Frequency-aware Discriminative Feature Learning Supervised by Single-Center Loss for Face Forgery Detection
Jiaming Li, Hongtao Xie, Jiahong Li +2
cs.CVarXiv:2103.09096v12021Normalized Cut Loss for Weakly-supervised CNN Segmentation
Meng Tang, Abdelaziz Djelouah, Federico Perazzi +2
cs.CVarXiv:1804.01346v12018Exploring Categorical Regularization for Domain Adaptive Object Detection
Chang-Dong Xu, Xing-Ran Zhao, Xin Jin +1
cs.CVarXiv:2003.09152v12020Deep Functional Maps: Structured Prediction for Dense Shape Correspondence
Or Litany, Tal Remez, Emanuele Rodolà +2
cs.CVarXiv:1704.08686v22017MBRS : Enhancing Robustness of DNN-based Watermarking by Mini-Batch of Real and Simulated JPEG Compression
Zhaoyang Jia, Han Fang, Weiming Zhang
cs.CVcs.CRarXiv:2108.08211v12021CoFiNet: Reliable Coarse-to-fine Correspondences for Robust Point Cloud Registration
Hao Yu, Fu Li, Mahdi Saleh +2
cs.CVcs.AIarXiv:2110.14076v12021HyperNeRF: A Higher-Dimensional Representation for Topologically Varying Neural Radiance Fields
Keunhong Park, Utkarsh Sinha, Peter Hedman +5
cs.CVcs.GRarXiv:2106.13228v22021Encoder Based Lifelong Learning
Amal Rannen Triki, Rahaf Aljundi, Mathew B. Blaschko +1
cs.CVcs.AIstat.MLarXiv:1704.01920v12017Adversarial PoseNet: A Structure-aware Convolutional Network for Human Pose Estimation
Yu Chen, Chunhua Shen, Xiu-Shen Wei +2
cs.CVarXiv:1705.00389v22017Tex2Shape: Detailed Full Human Body Geometry From a Single Image
Thiemo Alldieck, Gerard Pons-Moll, Christian Theobalt +1
cs.CVarXiv:1904.08645v22019PixArt-Σ: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation
Junsong Chen, Chongjian Ge, Enze Xie +7
cs.CVarXiv:2403.04692v22024Towards Accurate Scene Text Recognition with Semantic Reasoning Networks
Deli Yu, Xuan Li, Chengquan Zhang +3
cs.CVarXiv:2003.12294v12020Rendering of Eyes for Eye-Shape Registration and Gaze Estimation
Erroll Wood, Tadas Baltrusaitis, Xucong Zhang +3
cs.CVarXiv:1505.05916v12015Multimodal and Multiscale Deep Neural Networks for the Early Diagnosis of Alzheimer's Disease using structural MR and FDG-PET images
Donghuan Lu, Karteek Popuri, Weiguang Ding +2
cs.CVarXiv:1710.04782v12017DeepSense 6G: A Large-Scale Real-World Multi-Modal Sensing and Communication Dataset
Ahmed Alkhateeb, Gouranga Charan, Tawfik Osman +4
eess.SPcs.CVcs.LGarXiv:2211.09769v22022Self-Supervised Pretraining of 3D Features on any Point-Cloud
Zaiwei Zhang, Rohit Girdhar, Armand Joulin +1
cs.CVarXiv:2101.02691v12021Forget-Me-Not: Learning to Forget in Text-to-Image Diffusion Models
Eric Zhang, Kai Wang, Xingqian Xu +2
cs.CVcs.AIcs.LGarXiv:2303.17591v12023Scaling Up to Excellence: Practicing Model Scaling for Photo-Realistic Image Restoration In the Wild
Fanghua Yu, Jinjin Gu, Zheyuan Li +6
cs.CVarXiv:2401.13627v22024Exploring Data-Efficient 3D Scene Understanding with Contrastive Scene Contexts
Ji Hou, Benjamin Graham, Matthias Nießner +1
cs.CVarXiv:2012.09165v32020BioMed-Agent-RL: A Meta Learning, All You Need for Biomedical Applications
Md Asaduzzaman Jabin, Zihao Wu, Tianming Liu
cs.LGcs.AIcs.CVarXiv:2608.21864v12026Target-adaptive CNN-based pansharpening
Giuseppe Scarpa, Sergio Vitale, Davide Cozzolino
cs.CVarXiv:1709.06054v32017A U-Net Based Discriminator for Generative Adversarial Networks
Edgar Schönfeld, Bernt Schiele, Anna Khoreva
cs.CVcs.LGeess.IVarXiv:2002.12655v22020Urban Radiance Fields
Konstantinos Rematas, Andrew Liu, Pratul P. Srinivasan +4
cs.CVcs.GRarXiv:2111.14643v12021Image-to-Image Translation: Methods and Applications
Yingxue Pang, Jianxin Lin, Tao Qin +1
cs.CVarXiv:2101.08629v22021MST++: Multi-stage Spectral-wise Transformer for Efficient Spectral Reconstruction
Yuanhao Cai, Jing Lin, Zudi Lin +5
cs.CVarXiv:2204.07908v12022Training-image based geostatistical inversion using a spatial generative adversarial neural network
Eric Laloy, Romain Hérault, Diederik Jacques +1
stat.MLcs.CVphysics.geo-pharXiv:1708.04975v22017Methods for Segmentation and Classification of Digital Microscopy Tissue Images
Quoc Dang Vu, Simon Graham, Minh Nguyen Nhat To +11
cs.CVarXiv:1810.13230v22018Drawing and Recognizing Chinese Characters with Recurrent Neural Network
Xu-Yao Zhang, Fei Yin, Yan-Ming Zhang +2
cs.CVarXiv:1606.06539v12016Reliable Tuberculosis Detection using Chest X-ray with Deep Learning, Segmentation and Visualization
Tawsifur Rahman, Amith Khandakar, Muhammad Abdul Kadir +8
eess.IVcs.CVarXiv:2007.14895v12020SEED-X: Multimodal Models with Unified Multi-granularity Comprehension and Generation
Yuying Ge, Sijie Zhao, Jinguo Zhu +6
cs.CVarXiv:2404.14396v22024Machine learning methods for histopathological image analysis
Daisuke Komura, Shumpei Ishikawa
cs.CVarXiv:1709.00786v22017Split-Brain Autoencoders: Unsupervised Learning by Cross-Channel Prediction
Richard Zhang, Phillip Isola, Alexei A. Efros
cs.CVarXiv:1611.09842v32016Deep Watershed Transform for Instance Segmentation
Min Bai, Raquel Urtasun
cs.CVarXiv:1611.08303v22016HDNET: Exploiting HD Maps for 3D Object Detection
Bin Yang, Ming Liang, Raquel Urtasun
cs.CVarXiv:2012.11704v12020Using Deep Learning for Image-Based Plant Disease Detection
Sharada Prasanna Mohanty, David Hughes, Marcel Salathe
cs.CVarXiv:1604.03169v22016