Computer Vision and Pattern Recognition
Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
10,741 to 10,800 of 18,795
Image Aesthetic Assessment: An Experimental Survey
Yubin Deng, Chen Change Loy, Xiaoou Tang
cs.CVarXiv:1610.00838v22016Inception Transformer
Chenyang Si, Weihao Yu, Pan Zhou +3
cs.CVcs.AIcs.LGarXiv:2205.12956v22022The SEN1-2 Dataset for Deep Learning in SAR-Optical Data Fusion
Michael Schmitt, Lloyd Haydn Hughes, Xiao Xiang Zhu
cs.CVarXiv:1807.01569v12018GRIP++: Enhanced Graph-based Interaction-aware Trajectory Prediction for Autonomous Driving
Xin Li, Xiaowen Ying, Mooi Choo Chuah
cs.CVcs.ROarXiv:1907.07792v22019Extremely Low Bit Neural Network: Squeeze the Last Bit Out with ADMM
Cong Leng, Hao Li, Shenghuo Zhu +1
cs.CVarXiv:1707.09870v22017Human Pose Regression with Residual Log-likelihood Estimation
Jiefeng Li, Siyuan Bian, Ailing Zeng +4
cs.CVcs.LGarXiv:2107.11291v32021Multi-style Generative Network for Real-time Transfer
Hang Zhang, Kristin Dana
cs.CVarXiv:1703.06953v22017High-Fidelity GAN Inversion for Image Attribute Editing
Tengfei Wang, Yong Zhang, Yanbo Fan +2
cs.CVarXiv:2109.06590v42021SimCVD: Simple Contrastive Voxel-Wise Representation Distillation for Semi-Supervised Medical Image Segmentation
Chenyu You, Yuan Zhou, Ruihan Zhao +2
cs.CVcs.AIcs.LGarXiv:2108.06227v42021High Performance Offline Handwritten Chinese Character Recognition Using GoogLeNet and Directional Feature Maps
Zhuoyao Zhong, Lianwen Jin, Zecheng Xie
cs.CVarXiv:1505.04925v12015Attention-guided Network for Ghost-free High Dynamic Range Imaging
Qingsen Yan, Dong Gong, Qinfeng Shi +4
cs.CVarXiv:1904.10293v12019Multi-Task Convolutional Neural Network for Pose-Invariant Face Recognition
Xi Yin, Xiaoming Liu
cs.CVarXiv:1702.04710v22017Incremental Learning Through Deep Adaptation
Amir Rosenfeld, John K. Tsotsos
cs.CVcs.LGarXiv:1705.04228v22017Fast High-Resolution Image Synthesis with Latent Adversarial Diffusion Distillation
Axel Sauer, Frederic Boesel, Tim Dockhorn +3
cs.CVarXiv:2403.12015v12024PIPAL: a Large-Scale Image Quality Assessment Dataset for Perceptual Image Restoration
Jinjin Gu, Haoming Cai, Haoyu Chen +3
eess.IVcs.CVarXiv:2007.12142v22020IterNet: Retinal Image Segmentation Utilizing Structural Redundancy in Vessel Networks
Liangzhi Li, Manisha Verma, Yuta Nakashima +2
eess.IVcs.CVarXiv:1912.05763v12019AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation
Junyang Wang, Yuhang Wang, Guohai Xu +8
cs.CLcs.CVarXiv:2311.07397v22023MP3: A Unified Model to Map, Perceive, Predict and Plan
Sergio Casas, Abbas Sadat, Raquel Urtasun
cs.ROcs.AIcs.CVarXiv:2101.06806v12021Guiding a Diffusion Model with a Bad Version of Itself
Tero Karras, Miika Aittala, Tuomas Kynkäänniemi +3
cs.CVcs.AIcs.LGarXiv:2406.02507v32024Multi-Modal Knowledge Graph Construction and Application: A Survey
Xiangru Zhu, Zhixu Li, Xiaodan Wang +5
cs.AIcs.CLcs.CVarXiv:2202.05786v22022PaLI-X: On Scaling up a Multilingual Vision and Language Model
Xi Chen, Josip Djolonga, Piotr Padlewski +40
cs.CVcs.CLcs.LGarXiv:2305.18565v12023BinsFormer: Revisiting Adaptive Bins for Monocular Depth Estimation
Zhenyu Li, Xuyang Wang, Xianming Liu +1
cs.CVarXiv:2204.00987v12022Deepfake Video Detection Using Convolutional Vision Transformer
Deressa Wodajo, Solomon Atnafu
cs.CVarXiv:2102.11126v32021Pathologist-level classification of histologic patterns on resected lung adenocarcinoma slides with deep neural networks
Jason W. Wei, Laura J. Tafe, Yevgeniy A. Linnik +3
cs.CVarXiv:1901.11489v12019ViTAEv2: Vision Transformer Advanced by Exploring Inductive Bias for Image Recognition and Beyond
Qiming Zhang, Yufei Xu, Jing Zhang +1
cs.CVarXiv:2202.10108v22022The loss surface of deep and wide neural networks
Quynh Nguyen, Matthias Hein
cs.LGcs.AIcs.CVarXiv:1704.08045v22017DenseNet for Dense Flow
Yi Zhu, Shawn Newsam
cs.CVcs.MMarXiv:1707.06316v12017Imagen Editor and EditBench: Advancing and Evaluating Text-Guided Image Inpainting
Su Wang, Chitwan Saharia, Ceslee Montgomery +11
cs.CVcs.AIarXiv:2212.06909v22022DeLiGAN : Generative Adversarial Networks for Diverse and Limited Data
Swaminathan Gurumurthy, Ravi Kiran Sarvadevabhatla, Venkatesh Babu Radhakrishnan
cs.CVarXiv:1706.02071v12017A Multi-Object Rectified Attention Network for Scene Text Recognition
Canjie Luo, Lianwen Jin, Zenghui Sun
cs.CVarXiv:1901.03003v12019Zero Shot Recognition with Unreliable Attributes
Dinesh Jayaraman, Kristen Grauman
cs.CVstat.MLarXiv:1409.4327v22014Single Image Portrait Relighting
Tiancheng Sun, Jonathan T. Barron, Yun-Ta Tsai +7
cs.GRcs.CVeess.IVarXiv:1905.00824v12019ResT: An Efficient Transformer for Visual Recognition
Qinglong Zhang, Yubin Yang
cs.CVarXiv:2105.13677v52021Learning to Segment Every Thing
Ronghang Hu, Piotr Dollár, Kaiming He +2
cs.CVarXiv:1711.10370v22017COVIDGR dataset and COVID-SDNet methodology for predicting COVID-19 based on Chest X-Ray images
S. Tabik, A. Gómez-Ríos, J. L. Martín-Rodríguez +10
eess.IVcs.CVarXiv:2006.01409v32020DALL-Eval: Probing the Reasoning Skills and Social Biases of Text-to-Image Generation Models
Jaemin Cho, Abhay Zala, Mohit Bansal
cs.CVcs.AIcs.CLarXiv:2202.04053v32022House-GAN: Relational Generative Adversarial Networks for Graph-constrained House Layout Generation
Nelson Nauata, Kai-Hung Chang, Chin-Yi Cheng +2
cs.CVarXiv:2003.06988v12020Context-Aware Emotion Recognition Networks
Jiyoung Lee, Seungryong Kim, Sunok Kim +2
cs.CVcs.HCcs.MMarXiv:1908.05913v12019Deep Image Harmonization
Yi-Hsuan Tsai, Xiaohui Shen, Zhe Lin +3
cs.CVarXiv:1703.00069v12017Online Real-time Multiple Spatiotemporal Action Localisation and Prediction
Gurkirt Singh, Suman Saha, Michael Sapienza +2
cs.CVarXiv:1611.08563v62016Revisiting Video Saliency: A Large-scale Benchmark and a New Model
Wenguan Wang, Jianbing Shen, Fang Guo +2
cs.CVarXiv:1801.07424v32018Real-Time High-Resolution Background Matting
Shanchuan Lin, Andrey Ryabtsev, Soumyadip Sengupta +3
cs.CVarXiv:2012.07810v12020Spatio-Temporal Data Mining: A Survey of Problems and Methods
Gowtham Atluri, Anuj Karpatne, Vipin Kumar
cs.LGcs.AIcs.CVarXiv:1711.04710v22017Detecting Mammals in UAV Images: Best Practices to address a substantially Imbalanced Dataset with Deep Learning
Benjamin Kellenberger, Diego Marcos, Devis Tuia
cs.CVarXiv:1806.11368v12018Improving Black-box Adversarial Attacks with a Transfer-based Prior
Shuyu Cheng, Yinpeng Dong, Tianyu Pang +2
cs.LGcs.CRcs.CVarXiv:1906.06919v32019Image-embodied Knowledge Representation Learning
Ruobing Xie, Zhiyuan Liu, Huanbo Luan +1
cs.CVcs.CLarXiv:1609.07028v22016SPHINX: The Joint Mixing of Weights, Tasks, and Visual Embeddings for Multi-modal Large Language Models
Ziyi Lin, Chris Liu, Renrui Zhang +13
cs.CVcs.AIcs.CLarXiv:2311.07575v12023Geometry Uncertainty Projection Network for Monocular 3D Object Detection
Yan Lu, Xinzhu Ma, Lei Yang +5
cs.CVarXiv:2107.13774v22021Learning to Transfer Examples for Partial Domain Adaptation
Zhangjie Cao, Kaichao You, Mingsheng Long +2
cs.CVarXiv:1903.12230v22019Predicting Semantic Map Representations from Images using Pyramid Occupancy Networks
Thomas Roddick, Roberto Cipolla
cs.CVarXiv:2003.13402v12020Multi-view Contrastive Graph Clustering
Erlin Pan, Zhao Kang
cs.LGcs.AIcs.CVarXiv:2110.11842v12021Fast Vision Transformers with HiLo Attention
Zizheng Pan, Jianfei Cai, Bohan Zhuang
cs.CVcs.AIcs.LGarXiv:2205.13213v52022Unsupervised Deep Slow Feature Analysis for Change Detection in Multi-Temporal Remote Sensing Images
Bo Du, Lixiang Ru, Chen Wu +1
cs.CVarXiv:1812.00645v22018Attention Spiking Neural Networks
Man Yao, Guangshe Zhao, Hengyu Zhang +5
cs.CVarXiv:2209.13929v12022Adversarial Transformation Networks: Learning to Generate Adversarial Examples
Shumeet Baluja, Ian Fischer
cs.NEcs.AIcs.CVarXiv:1703.09387v12017Rank Pooling for Action Recognition
Basura Fernando, Efstratios Gavves, Jose Oramas +2
cs.CVarXiv:1512.01848v22015No Subclass Left Behind: Fine-Grained Robustness in Coarse-Grained Classification Problems
Nimit S. Sohoni, Jared A. Dunnmon, Geoffrey Angus +2
cs.LGcs.CVarXiv:2011.12945v22020CaraNet: Context Axial Reverse Attention Network for Segmentation of Small Medical Objects
Ange Lou, Shuyue Guan, Hanseok Ko +1
eess.IVcs.CVarXiv:2108.07368v32021Thin-Plate Spline Motion Model for Image Animation
Jian Zhao, Hui Zhang
cs.CVarXiv:2203.14367v22022Visual Attention Methods in Deep Learning: An In-Depth Survey
Mohammed Hassanin, Saeed Anwar, Ibrahim Radwan +2
cs.CVcs.AIcs.LGarXiv:2204.07756v32022