Computer Vision and Pattern Recognition

Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

7,501 to 7,560 of 18,841

  1. Pixel Contrastive-Consistent Semi-Supervised Semantic Segmentation

    Yuanyi Zhong, Bodi Yuan, Hong Wu +3

    cs.CVarXiv:2108.09025v12021
  2. Learning to Track from Privileged Target Appearances

    Xin Chen, Jiao Xu, Dong Wang +2

    cs.CVarXiv:2609.02471v12026
  3. Deep Network Flow for Multi-Object Tracking

    Samuel Schulter, Paul Vernaza, Wongun Choi +1

    cs.CVarXiv:1706.08482v12017
  4. Source-Free Class Relearning: Diagnosing Forgetting in Class Unlearning

    Zahra Dehghani, Pablo Piantanida, Mohammadhadi Shateri

    cs.LGcs.CVarXiv:2609.02018v12026
  5. DeepBillboard: Systematic Physical-World Testing of Autonomous Driving Systems

    Husheng Zhou, Wei Li, Yuankun Zhu +4

    cs.CVarXiv:1812.10812v12018
  6. Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion

    Xuewu Lin, Tianwei Lin, Zixiang Pei +2

    cs.CVarXiv:2211.10581v22022
  7. The Diagnosis a Reporter Leaves Unspoken: Surfacing Frozen Tumor Features for Brain-Tumor MRI Reporting

    Khawaja Murad ul Hassan, Ruqiyya Adil, Adil Qayyum +4

    cs.CVarXiv:2609.02411v12026
  8. RVSD: Retrieval Vision Sparse Decoding for Mitigating Visual Hallucinations in Large Vision-Language Models

    Canjie Liu, Jiawen Kang, Jinbo Wen +1

    cs.CVcs.AIarXiv:2609.02731v12026
  9. BlitzNet: A Real-Time Deep Network for Scene Understanding

    Nikita Dvornik, Konstantin Shmelkov, Julien Mairal +1

    cs.CVarXiv:1708.02813v12017
  10. What Makes Good Examples for Visual In-Context Learning?

    Yuanhan Zhang, Kaiyang Zhou, Ziwei Liu

    cs.CVarXiv:2301.13670v22023
  11. ClassSR: A General Framework to Accelerate Super-Resolution Networks by Data Characteristic

    Xiangtao Kong, Hengyuan Zhao, Yu Qiao +1

    cs.CVarXiv:2103.04039v12021
  12. Laplacian Regularized Few-Shot Learning

    Imtiaz Masud Ziko, Jose Dolz, Eric Granger +1

    cs.LGcs.CVstat.MLarXiv:2006.15486v32020
  13. ComboGAN: Unrestrained Scalability for Image Domain Translation

    Asha Anoosheh, Eirikur Agustsson, Radu Timofte +1

    cs.CVarXiv:1712.06909v12017
  14. WiderPerson: A Diverse Dataset for Dense Pedestrian Detection in the Wild

    Shifeng Zhang, Yiliang Xie, Jun Wan +3

    cs.CVarXiv:1909.12118v12019
  15. Neural Feature Search for RGB-Infrared Person Re-Identification

    Yehansen Chen, Lin Wan, Zhihang Li +2

    cs.CVarXiv:2104.02366v12021
  16. InstructNav: Zero-shot System for Generic Instruction Navigation in Unexplored Environment

    Yuxing Long, Wenzhe Cai, Hongcheng Wang +2

    cs.ROcs.AIcs.CLarXiv:2406.04882v12024
  17. Clothing Co-Parsing by Joint Image Segmentation and Labeling

    Wei Yang, Ping Luo, Liang Lin

    cs.CVarXiv:1502.00739v12015
  18. SelfRecon: Self Reconstruction Your Digital Avatar from Monocular Video

    Boyi Jiang, Yang Hong, Hujun Bao +1

    cs.CVcs.GRarXiv:2201.12792v22022
  19. The Tsetlin Machine -- A Game Theoretic Bandit Driven Approach to Optimal Pattern Recognition with Propositional Logic

    Ole-Christoffer Granmo

    cs.AIcs.CVcs.LGarXiv:1804.01508v152018
  20. Dense Intrinsic Appearance Flow for Human Pose Transfer

    Yining Li, Chen Huang, Chen Change Loy

    cs.CVarXiv:1903.11326v12019
  21. Signal or Noise? Auditing Rotation-Induced Saliency Drift in Medical and Aerial Imaging

    Khawaja Murad ul Hassan, Mehran Ebrahimi

    cs.CVcs.AIarXiv:2609.02224v12026
  22. Style Augmentation: Data Augmentation via Style Randomization

    Philip T. Jackson, Amir Atapour-Abarghouei, Stephen Bonner +2

    cs.CVarXiv:1809.05375v22018
  23. Source-free Domain Adaptation via Avatar Prototype Generation and Adaptation

    Zhen Qiu, Yifan Zhang, Hongbin Lin +4

    cs.CVarXiv:2106.15326v12021
  24. Rethinking Range View Representation for LiDAR Segmentation

    Lingdong Kong, Youquan Liu, Runnan Chen +6

    cs.CVcs.ROarXiv:2303.05367v32023
  25. Cascade RPN: Delving into High-Quality Region Proposal Network with Adaptive Convolution

    Thang Vu, Hyunjun Jang, Trung X. Pham +1

    cs.CVarXiv:1909.06720v22019
  26. Test-Time Adaptable Neural Networks for Robust Medical Image Segmentation

    Neerav Karani, Ertunc Erdil, Krishna Chaitanya +1

    eess.IVcs.CVcs.LGarXiv:2004.04668v42020
  27. iSDF: Real-Time Neural Signed Distance Fields for Robot Perception

    Joseph Ortiz, Alexander Clegg, Jing Dong +4

    cs.ROcs.CVarXiv:2204.02296v22022
  28. Three-dimensional virtual refocusing of fluorescence microscopy images using deep learning

    Yichen Wu, Yair Rivenson, Hongda Wang +5

    cs.CVcs.LGphysics.app-pharXiv:1901.11252v22019
  29. SimpleTrack: Understanding and Rethinking 3D Multi-object Tracking

    Ziqi Pang, Zhichao Li, Naiyan Wang

    cs.CVcs.ROarXiv:2111.09621v12021
  30. OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on

    Yuhao Xu, Tao Gu, Weifeng Chen +1

    cs.CVarXiv:2403.01779v22024
  31. Mining the Benefits of Two-stage and One-stage HOI Detection

    Aixi Zhang, Yue Liao, Si Liu +4

    cs.CVarXiv:2108.05077v22021
  32. GEN-VLKT: Simplify Association and Enhance Interaction Understanding for HOI Detection

    Yue Liao, Aixi Zhang, Miao Lu +3

    cs.CVcs.AIarXiv:2203.13954v22022
  33. Correlation Adaptive Subspace Segmentation by Trace Lasso

    Canyi Lu, Jiashi Feng, Zhouchen Lin +1

    cs.CVarXiv:1501.04276v12015
  34. USIP: Unsupervised Stable Interest Point Detection from 3D Point Clouds

    Jiaxin Li, Gim Hee Lee

    cs.CVarXiv:1904.00229v12019
  35. Multi-Modal Fusion for End-to-End RGB-T Tracking

    Lichao Zhang, Martin Danelljan, Abel Gonzalez-Garcia +2

    cs.CVarXiv:1908.11714v12019
  36. Universal Adversarial Training

    Ali Shafahi, Mahyar Najibi, Zheng Xu +3

    cs.CVcs.CRcs.LGarXiv:1811.11304v22018
  37. Mask TextSpotter v3: Segmentation Proposal Network for Robust Scene Text Spotting

    Minghui Liao, Guan Pang, Jing Huang +2

    cs.CVarXiv:2007.09482v12020
  38. PlaneNet: Piece-wise Planar Reconstruction from a Single RGB Image

    Chen Liu, Jimei Yang, Duygu Ceylan +2

    cs.CVarXiv:1804.06278v12018
  39. A Good Image Generator Is What You Need for High-Resolution Video Synthesis

    Yu Tian, Jian Ren, Menglei Chai +4

    cs.CVarXiv:2104.15069v12021
  40. TensoIR: Tensorial Inverse Rendering

    Haian Jin, Isabella Liu, Peijia Xu +6

    cs.CVarXiv:2304.12461v32023
  41. End-to-End Wireframe Parsing

    Yichao Zhou, Haozhi Qi, Yi Ma

    cs.CVarXiv:1905.03246v32019
  42. MiM-ISTD: Mamba-in-Mamba for Efficient Infrared Small Target Detection

    Tianxiang Chen, Zi Ye, Zhentao Tan +6

    cs.CVarXiv:2403.02148v42024
  43. Denoising of 3D magnetic resonance images with multi-channel residual learning of convolutional neural network

    Dongsheng Jiang, Weiqiang Dou, Luc Vosters +3

    cs.CVarXiv:1712.08726v22017
  44. XCube: Large-Scale 3D Generative Modeling using Sparse Voxel Hierarchies

    Xuanchi Ren, Jiahui Huang, Xiaohui Zeng +3

    cs.CVcs.GRcs.LGarXiv:2312.03806v22023
  45. NeRF--: Neural Radiance Fields Without Known Camera Parameters

    Zirui Wang, Shangzhe Wu, Weidi Xie +2

    cs.CVarXiv:2102.07064v42021
  46. VIFB: A Visible and Infrared Image Fusion Benchmark

    Xingchen Zhang, Ping Ye, Gang Xiao

    cs.CVcs.MMarXiv:2002.03322v42020
  47. Examining the Impact of Blur on Recognition by Convolutional Networks

    Igor Vasiljevic, Ayan Chakrabarti, Gregory Shakhnarovich

    cs.CVarXiv:1611.05760v22016
  48. Spatial-Temporal Person Re-identification

    Guangcong Wang, Jianhuang Lai, Peigen Huang +1

    cs.CVarXiv:1812.03282v12018
  49. Deep Linear Discriminant Analysis on Fisher Networks: A Hybrid Architecture for Person Re-identification

    Lin Wu, Chunhua Shen, Anton van den Hengel

    cs.CVarXiv:1606.01595v12016
  50. Learnable Graph Convolutional Network and Feature Fusion for Multi-view Learning

    Zhaoliang Chen, Lele Fu, Jie Yao +3

    cs.CVcs.AIcs.LGarXiv:2211.09155v12022
  51. SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time Segmentation

    Zhengze Xu, Dongyue Wu, Changqian Yu +3

    cs.CVarXiv:2312.17071v22023
  52. Factors in Finetuning Deep Model for object detection

    Wanli Ouyang, Xiaogang Wang, Cong Zhang +1

    cs.CVarXiv:1601.05150v22016
  53. Generalizable Brain Tumor Segmentation with Self-Training and Tumor-Aware Deformations

    Henrique Zan Grande, Jeovane Honorio Alves, Rayson Laroca +1

    cs.CVarXiv:2609.02600v12026
  54. U-Net v2: Rethinking the Skip Connections of U-Net for Medical Image Segmentation

    Yaopeng Peng, Milan Sonka, Danny Z. Chen

    eess.IVcs.CVarXiv:2311.17791v22023
  55. Diagnosis of Coronavirus Disease 2019 (COVID-19) with Structured Latent Multi-View Representation Learning

    Hengyuan Kang, Liming Xia, Fuhua Yan +8

    eess.IVcs.CVcs.LGarXiv:2005.03227v12020
  56. AU-AIR: A Multi-modal Unmanned Aerial Vehicle Dataset for Low Altitude Traffic Surveillance

    Ilker Bozcan, Erdal Kayacan

    cs.CVcs.ROarXiv:2001.11737v22020
  57. Relative Camera Pose Estimation Using Convolutional Neural Networks

    Iaroslav Melekhov, Juha Ylioinas, Juho Kannala +1

    cs.CVarXiv:1702.01381v32017
  58. ReCo: Region-Controlled Text-to-Image Generation

    Zhengyuan Yang, Jianfeng Wang, Zhe Gan +8

    cs.CVarXiv:2211.15518v12022
  59. Automated Maize Ear Phenotyping Using 3D Reconstructions

    Ritwesh A. Kumar, Som Tripathi, Peja Matthews +5

    cs.CVarXiv:2609.01921v12026
  60. Mask-RCNN and U-net Ensembled for Nuclei Segmentation

    Aarno Oskar Vuola, Saad Ullah Akram, Juho Kannala

    cs.CVarXiv:1901.10170v12019