Computer Vision and Pattern Recognition
Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
7,501 to 7,560 of 18,841
Pixel Contrastive-Consistent Semi-Supervised Semantic Segmentation
Yuanyi Zhong, Bodi Yuan, Hong Wu +3
cs.CVarXiv:2108.09025v12021Learning to Track from Privileged Target Appearances
Xin Chen, Jiao Xu, Dong Wang +2
cs.CVarXiv:2609.02471v12026Deep Network Flow for Multi-Object Tracking
Samuel Schulter, Paul Vernaza, Wongun Choi +1
cs.CVarXiv:1706.08482v12017Source-Free Class Relearning: Diagnosing Forgetting in Class Unlearning
Zahra Dehghani, Pablo Piantanida, Mohammadhadi Shateri
cs.LGcs.CVarXiv:2609.02018v12026DeepBillboard: Systematic Physical-World Testing of Autonomous Driving Systems
Husheng Zhou, Wei Li, Yuankun Zhu +4
cs.CVarXiv:1812.10812v12018Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion
Xuewu Lin, Tianwei Lin, Zixiang Pei +2
cs.CVarXiv:2211.10581v22022The Diagnosis a Reporter Leaves Unspoken: Surfacing Frozen Tumor Features for Brain-Tumor MRI Reporting
Khawaja Murad ul Hassan, Ruqiyya Adil, Adil Qayyum +4
cs.CVarXiv:2609.02411v12026RVSD: Retrieval Vision Sparse Decoding for Mitigating Visual Hallucinations in Large Vision-Language Models
Canjie Liu, Jiawen Kang, Jinbo Wen +1
cs.CVcs.AIarXiv:2609.02731v12026BlitzNet: A Real-Time Deep Network for Scene Understanding
Nikita Dvornik, Konstantin Shmelkov, Julien Mairal +1
cs.CVarXiv:1708.02813v12017What Makes Good Examples for Visual In-Context Learning?
Yuanhan Zhang, Kaiyang Zhou, Ziwei Liu
cs.CVarXiv:2301.13670v22023ClassSR: A General Framework to Accelerate Super-Resolution Networks by Data Characteristic
Xiangtao Kong, Hengyuan Zhao, Yu Qiao +1
cs.CVarXiv:2103.04039v12021Laplacian Regularized Few-Shot Learning
Imtiaz Masud Ziko, Jose Dolz, Eric Granger +1
cs.LGcs.CVstat.MLarXiv:2006.15486v32020ComboGAN: Unrestrained Scalability for Image Domain Translation
Asha Anoosheh, Eirikur Agustsson, Radu Timofte +1
cs.CVarXiv:1712.06909v12017WiderPerson: A Diverse Dataset for Dense Pedestrian Detection in the Wild
Shifeng Zhang, Yiliang Xie, Jun Wan +3
cs.CVarXiv:1909.12118v12019Neural Feature Search for RGB-Infrared Person Re-Identification
Yehansen Chen, Lin Wan, Zhihang Li +2
cs.CVarXiv:2104.02366v12021InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment
Yuxing Long, Wenzhe Cai, Hongcheng Wang +2
cs.ROcs.AIcs.CLarXiv:2406.04882v12024Clothing Co-Parsing by Joint Image Segmentation and Labeling
Wei Yang, Ping Luo, Liang Lin
cs.CVarXiv:1502.00739v12015SelfRecon: Self Reconstruction Your Digital Avatar from Monocular Video
Boyi Jiang, Yang Hong, Hujun Bao +1
cs.CVcs.GRarXiv:2201.12792v22022The Tsetlin Machine -- A Game Theoretic Bandit Driven Approach to Optimal Pattern Recognition with Propositional Logic
Ole-Christoffer Granmo
cs.AIcs.CVcs.LGarXiv:1804.01508v152018Dense Intrinsic Appearance Flow for Human Pose Transfer
Yining Li, Chen Huang, Chen Change Loy
cs.CVarXiv:1903.11326v12019Signal or Noise? Auditing Rotation-Induced Saliency Drift in Medical and Aerial Imaging
Khawaja Murad ul Hassan, Mehran Ebrahimi
cs.CVcs.AIarXiv:2609.02224v12026Style Augmentation: Data Augmentation via Style Randomization
Philip T. Jackson, Amir Atapour-Abarghouei, Stephen Bonner +2
cs.CVarXiv:1809.05375v22018Source-free Domain Adaptation via Avatar Prototype Generation and Adaptation
Zhen Qiu, Yifan Zhang, Hongbin Lin +4
cs.CVarXiv:2106.15326v12021Rethinking Range View Representation for LiDAR Segmentation
Lingdong Kong, Youquan Liu, Runnan Chen +6
cs.CVcs.ROarXiv:2303.05367v32023Cascade RPN: Delving into High-Quality Region Proposal Network with Adaptive Convolution
Thang Vu, Hyunjun Jang, Trung X. Pham +1
cs.CVarXiv:1909.06720v22019Test-Time Adaptable Neural Networks for Robust Medical Image Segmentation
Neerav Karani, Ertunc Erdil, Krishna Chaitanya +1
eess.IVcs.CVcs.LGarXiv:2004.04668v42020iSDF: Real-Time Neural Signed Distance Fields for Robot Perception
Joseph Ortiz, Alexander Clegg, Jing Dong +4
cs.ROcs.CVarXiv:2204.02296v22022Three-dimensional virtual refocusing of fluorescence microscopy images using deep learning
Yichen Wu, Yair Rivenson, Hongda Wang +5
cs.CVcs.LGphysics.app-pharXiv:1901.11252v22019SimpleTrack: Understanding and Rethinking 3D Multi-object Tracking
Ziqi Pang, Zhichao Li, Naiyan Wang
cs.CVcs.ROarXiv:2111.09621v12021OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on
Yuhao Xu, Tao Gu, Weifeng Chen +1
cs.CVarXiv:2403.01779v22024Mining the Benefits of Two-stage and One-stage HOI Detection
Aixi Zhang, Yue Liao, Si Liu +4
cs.CVarXiv:2108.05077v22021GEN-VLKT: Simplify Association and Enhance Interaction Understanding for HOI Detection
Yue Liao, Aixi Zhang, Miao Lu +3
cs.CVcs.AIarXiv:2203.13954v22022Correlation Adaptive Subspace Segmentation by Trace Lasso
Canyi Lu, Jiashi Feng, Zhouchen Lin +1
cs.CVarXiv:1501.04276v12015USIP: Unsupervised Stable Interest Point Detection from 3D Point Clouds
Jiaxin Li, Gim Hee Lee
cs.CVarXiv:1904.00229v12019Multi-Modal Fusion for End-to-End RGB-T Tracking
Lichao Zhang, Martin Danelljan, Abel Gonzalez-Garcia +2
cs.CVarXiv:1908.11714v12019Universal Adversarial Training
Ali Shafahi, Mahyar Najibi, Zheng Xu +3
cs.CVcs.CRcs.LGarXiv:1811.11304v22018Mask TextSpotter v3: Segmentation Proposal Network for Robust Scene Text Spotting
Minghui Liao, Guan Pang, Jing Huang +2
cs.CVarXiv:2007.09482v12020PlaneNet: Piece-wise Planar Reconstruction from a Single RGB Image
Chen Liu, Jimei Yang, Duygu Ceylan +2
cs.CVarXiv:1804.06278v12018A Good Image Generator Is What You Need for High-Resolution Video Synthesis
Yu Tian, Jian Ren, Menglei Chai +4
cs.CVarXiv:2104.15069v12021TensoIR: Tensorial Inverse Rendering
Haian Jin, Isabella Liu, Peijia Xu +6
cs.CVarXiv:2304.12461v32023End-to-End Wireframe Parsing
Yichao Zhou, Haozhi Qi, Yi Ma
cs.CVarXiv:1905.03246v32019MiM-ISTD: Mamba-in-Mamba for Efficient Infrared Small Target Detection
Tianxiang Chen, Zi Ye, Zhentao Tan +6
cs.CVarXiv:2403.02148v42024Denoising of 3D magnetic resonance images with multi-channel residual learning of convolutional neural network
Dongsheng Jiang, Weiqiang Dou, Luc Vosters +3
cs.CVarXiv:1712.08726v22017XCube: Large-Scale 3D Generative Modeling using Sparse Voxel Hierarchies
Xuanchi Ren, Jiahui Huang, Xiaohui Zeng +3
cs.CVcs.GRcs.LGarXiv:2312.03806v22023NeRF--: Neural Radiance Fields Without Known Camera Parameters
Zirui Wang, Shangzhe Wu, Weidi Xie +2
cs.CVarXiv:2102.07064v42021VIFB: A Visible and Infrared Image Fusion Benchmark
Xingchen Zhang, Ping Ye, Gang Xiao
cs.CVcs.MMarXiv:2002.03322v42020Examining the Impact of Blur on Recognition by Convolutional Networks
Igor Vasiljevic, Ayan Chakrabarti, Gregory Shakhnarovich
cs.CVarXiv:1611.05760v22016Spatial-Temporal Person Re-identification
Guangcong Wang, Jianhuang Lai, Peigen Huang +1
cs.CVarXiv:1812.03282v12018Deep Linear Discriminant Analysis on Fisher Networks: A Hybrid Architecture for Person Re-identification
Lin Wu, Chunhua Shen, Anton van den Hengel
cs.CVarXiv:1606.01595v12016Learnable Graph Convolutional Network and Feature Fusion for Multi-view Learning
Zhaoliang Chen, Lele Fu, Jie Yao +3
cs.CVcs.AIcs.LGarXiv:2211.09155v12022SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time Segmentation
Zhengze Xu, Dongyue Wu, Changqian Yu +3
cs.CVarXiv:2312.17071v22023Factors in Finetuning Deep Model for object detection
Wanli Ouyang, Xiaogang Wang, Cong Zhang +1
cs.CVarXiv:1601.05150v22016Generalizable Brain Tumor Segmentation with Self-Training and Tumor-Aware Deformations
Henrique Zan Grande, Jeovane Honorio Alves, Rayson Laroca +1
cs.CVarXiv:2609.02600v12026U-Net v2: Rethinking the Skip Connections of U-Net for Medical Image Segmentation
Yaopeng Peng, Milan Sonka, Danny Z. Chen
eess.IVcs.CVarXiv:2311.17791v22023Diagnosis of Coronavirus Disease 2019 (COVID-19) with Structured Latent Multi-View Representation Learning
Hengyuan Kang, Liming Xia, Fuhua Yan +8
eess.IVcs.CVcs.LGarXiv:2005.03227v12020AU-AIR: A Multi-modal Unmanned Aerial Vehicle Dataset for Low Altitude Traffic Surveillance
Ilker Bozcan, Erdal Kayacan
cs.CVcs.ROarXiv:2001.11737v22020Relative Camera Pose Estimation Using Convolutional Neural Networks
Iaroslav Melekhov, Juha Ylioinas, Juho Kannala +1
cs.CVarXiv:1702.01381v32017ReCo: Region-Controlled Text-to-Image Generation
Zhengyuan Yang, Jianfeng Wang, Zhe Gan +8
cs.CVarXiv:2211.15518v12022Automated Maize Ear Phenotyping Using 3D Reconstructions
Ritwesh A. Kumar, Som Tripathi, Peja Matthews +5
cs.CVarXiv:2609.01921v12026Mask-RCNN and U-net Ensembled for Nuclei Segmentation
Aarno Oskar Vuola, Saad Ullah Akram, Juho Kannala
cs.CVarXiv:1901.10170v12019