Computer Vision and Pattern Recognition

Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.

Search paper metadata (including unsummarized papers)

11,341 to 11,400 of 18,866

  1. Generalized Category Discovery

    Sagar Vaze, Kai Han, Andrea Vedaldi +1

    cs.CVcs.LGarXiv:2201.02609v22022
  2. FreeAnchor: Learning to Match Anchors for Visual Object Detection

    Xiaosong Zhang, Fang Wan, Chang Liu +2

    cs.CVcs.LGarXiv:1909.02466v22019
  3. Emergence of Language with Multi-agent Games: Learning to Communicate with Sequences of Symbols

    Serhii Havrylov, Ivan Titov

    cs.LGcs.CLcs.CVarXiv:1705.11192v22017
  4. Adaptive Context Selection for Polyp Segmentation

    Ruifei Zhang, Guanbin Li, Zhen Li +3

    cs.CVarXiv:2301.04799v12023
  5. Unsupervised Domain Adaptation via Structurally Regularized Deep Clustering

    Hui Tang, Ke Chen, Kui Jia

    cs.CVarXiv:2003.08607v12020
  6. COTR: Correspondence Transformer for Matching Across Images

    Wei Jiang, Eduard Trulls, Jan Hosang +2

    cs.CVarXiv:2103.14167v22021
  7. RoboTHOR: An Open Simulation-to-Real Embodied AI Platform

    Matt Deitke, Winson Han, Alvaro Herrasti +10

    cs.CVcs.ROarXiv:2004.06799v12020
  8. Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models

    Songwei Ge, Seungjun Nah, Guilin Liu +7

    cs.CVcs.GRcs.LGarXiv:2305.10474v32023
  9. STAR: A Benchmark for Situated Reasoning in Real-World Videos

    Bo Wu, Shoubin Yu, Zhenfang Chen +2

    cs.AIcs.CLcs.CVarXiv:2405.09711v12024
  10. Hierarchical Bilinear Pooling for Fine-Grained Visual Recognition

    Chaojian Yu, Xinyi Zhao, Qi Zheng +2

    cs.CVarXiv:1807.09915v12018
  11. Parametric Noise Injection: Trainable Randomness to Improve Deep Neural Network Robustness against Adversarial Attack

    Adnan Siraj Rakin, Zhezhi He, Deliang Fan

    cs.LGcs.CRcs.CVarXiv:1811.09310v12018
  12. Toward Fast, Flexible, and Robust Low-Light Image Enhancement

    Long Ma, Tengyu Ma, Risheng Liu +2

    cs.CVarXiv:2204.10137v12022
  13. Bringing a Blurry Frame Alive at High Frame-Rate with an Event Camera

    Liyuan Pan, Cedric Scheerlinck, Xin Yu +3

    cs.CVarXiv:1811.10180v22018
  14. Deep Unsupervised Domain Adaptation: A Review of Recent Advances and Perspectives

    Xiaofeng Liu, Chaehwa Yoo, Fangxu Xing +4

    cs.CVcs.AIcs.LGarXiv:2208.07422v12022
  15. Improved YOLOv5 network for real-time multi-scale traffic sign detection

    Junfan Wang, Yi Chen, Mingyu Gao +1

    cs.CVcs.LGarXiv:2112.08782v22021
  16. Structured Graph Learning for Scalable Subspace Clustering: From Single-view to Multi-view

    Zhao Kang, Zhiping Lin, Xiaofeng Zhu +1

    cs.LGcs.AIcs.CVarXiv:2102.07943v12021
  17. Deep Feature Interpolation for Image Content Changes

    Paul Upchurch, Jacob Gardner, Geoff Pleiss +4

    cs.CVarXiv:1611.05507v22016
  18. Pixel-Level Domain Transfer

    Donggeun Yoo, Namil Kim, Sunggyun Park +2

    cs.CVcs.AIarXiv:1603.07442v32016
  19. DeepICP: An End-to-End Deep Neural Network for 3D Point Cloud Registration

    Weixin Lu, Guowei Wan, Yao Zhou +3

    cs.CVcs.CGcs.GRarXiv:1905.04153v22019
  20. Zero-Shot Visual Imitation

    Deepak Pathak, Parsa Mahmoudieh, Guanghao Luo +7

    cs.LGcs.AIcs.CVarXiv:1804.08606v12018
  21. Changer: Feature Interaction is What You Need for Change Detection

    Sheng Fang, Kaiyu Li, Zhe Li

    cs.CVarXiv:2209.08290v12022
  22. TrafficSim: Learning to Simulate Realistic Multi-Agent Behaviors

    Simon Suo, Sebastian Regalado, Sergio Casas +1

    cs.ROcs.AIcs.CVarXiv:2101.06557v12021
  23. Triplane Meets Gaussian Splatting: Fast and Generalizable Single-View 3D Reconstruction with Transformers

    Zi-Xin Zou, Zhipeng Yu, Yuan-Chen Guo +4

    cs.CVarXiv:2312.09147v22023
  24. On-Device Training Under 256KB Memory

    Ji Lin, Ligeng Zhu, Wei-Ming Chen +3

    cs.CVarXiv:2206.15472v42022
  25. MACE: Mass Concept Erasure in Diffusion Models

    Shilin Lu, Zilan Wang, Leyang Li +2

    cs.CVcs.AIcs.LGarXiv:2403.06135v12024
  26. Deep Learning and Machine Vision for Food Processing: A Survey

    Lili Zhu, Petros Spachos, Erica Pensini +1

    cs.CVcs.LGarXiv:2103.16106v12021
  27. Rotate your Networks: Better Weight Consolidation and Less Catastrophic Forgetting

    Xialei Liu, Marc Masana, Luis Herranz +3

    cs.CVarXiv:1802.02950v42018
  28. Generative Novel View Synthesis with 3D-Aware Diffusion Models

    Eric R. Chan, Koki Nagano, Matthew A. Chan +7

    cs.CVcs.AIcs.GRarXiv:2304.02602v12023
  29. Deep Adversarial Training for Multi-Organ Nuclei Segmentation in Histopathology Images

    Faisal Mahmood, Daniel Borders, Richard Chen +4

    cs.CVarXiv:1810.00236v22018
  30. Perceptual Quality Prediction on Authentically Distorted Images Using a Bag of Features Approach

    Deepti Ghadiyaram, Alan C. Bovik

    cs.CVarXiv:1609.04757v12016
  31. How Well Do Self-Supervised Models Transfer?

    Linus Ericsson, Henry Gouk, Timothy M. Hospedales

    cs.CVarXiv:2011.13377v22020
  32. Multispectral Fusion for Object Detection with Cyclic Fuse-and-Refine Blocks

    Heng Zhang, Elisa Fromont, Sébastien Lefevre +1

    cs.CVarXiv:2009.12664v12020
  33. Gaussian Opacity Fields: Efficient Adaptive Surface Reconstruction in Unbounded Scenes

    Zehao Yu, Torsten Sattler, Andreas Geiger

    cs.CVarXiv:2404.10772v22024
  34. StainGAN: Stain Style Transfer for Digital Histological Images

    M Tarek Shaban, Christoph Baur, Nassir Navab +1

    cs.CVarXiv:1804.01601v12018
  35. Improving Multispectral Pedestrian Detection by Addressing Modality Imbalance Problems

    Kailai Zhou, Linsen Chen, Xun Cao

    cs.CVarXiv:2008.03043v22020
  36. BOP Challenge 2020 on 6D Object Localization

    Tomas Hodan, Martin Sundermeyer, Bertram Drost +5

    cs.CVcs.GRcs.LGarXiv:2009.07378v22020
  37. Asynchronous, Photometric Feature Tracking using Events and Frames

    Daniel Gehrig, Henri Rebecq, Guillermo Gallego +1

    cs.CVcs.ROarXiv:1807.09713v12018
  38. Deep Neural Networks for Anatomical Brain Segmentation

    Alexandre de Brebisson, Giovanni Montana

    cs.CVcs.LGstat.AParXiv:1502.02445v22015
  39. Self-supervised Learning of Motion Capture

    Hsiao-Yu Fish Tung, Hsiao-Wei Tung, Ersin Yumer +1

    cs.CVarXiv:1712.01337v12017
  40. Key.Net: Keypoint Detection by Handcrafted and Learned CNN Filters

    Axel Barroso-Laguna, Edgar Riba, Daniel Ponsa +1

    cs.CVarXiv:1904.00889v32019
  41. CelebV-HQ: A Large-Scale Video Facial Attributes Dataset

    Hao Zhu, Wayne Wu, Wentao Zhu +5

    cs.CVarXiv:2207.12393v12022
  42. LongVILA: Scaling Long-Context Visual Language Models for Long Videos

    Yukang Chen, Fuzhao Xue, Dacheng Li +15

    cs.CVcs.CLarXiv:2408.10188v62024
  43. Modeling and Propagating CNNs in a Tree Structure for Visual Tracking

    Hyeonseob Nam, Mooyeol Baek, Bohyung Han

    cs.CVarXiv:1608.07242v12016
  44. Graduated Non-Convexity for Robust Spatial Perception: From Non-Minimal Solvers to Global Outlier Rejection

    Heng Yang, Pasquale Antonante, Vasileios Tzoumas +1

    cs.CVcs.ROmath.OCarXiv:1909.08605v42019
  45. Inverse Rendering for Complex Indoor Scenes: Shape, Spatially-Varying Lighting and SVBRDF from a Single Image

    Zhengqin Li, Mohammad Shafiei, Ravi Ramamoorthi +2

    cs.CVarXiv:1905.02722v12019
  46. Generalized Source-free Domain Adaptation

    Shiqi Yang, Yaxing Wang, Joost van de Weijer +2

    cs.CVarXiv:2108.01614v22021
  47. Aggregated Contextual Transformations for High-Resolution Image Inpainting

    Yanhong Zeng, Jianlong Fu, Hongyang Chao +1

    cs.CVarXiv:2104.01431v12021
  48. On Regularized Losses for Weakly-supervised CNN Segmentation

    Meng Tang, Federico Perazzi, Abdelaziz Djelouah +3

    cs.CVarXiv:1803.09569v22018
  49. Cross-view Semantic Segmentation for Sensing Surroundings

    Bowen Pan, Jiankai Sun, Ho Yin Tiga Leung +2

    cs.CVeess.IVarXiv:1906.03560v32019
  50. A Comprehensive Analysis of Deep Regression

    Stéphane Lathuilière, Pablo Mesejo, Xavier Alameda-Pineda +1

    cs.CVarXiv:1803.08450v32018
  51. On the uncertainty of self-supervised monocular depth estimation

    Matteo Poggi, Filippo Aleotti, Fabio Tosi +1

    cs.CVarXiv:2005.06209v12020
  52. Large-scale Multi-Modal Pre-trained Models: A Comprehensive Survey

    Xiao Wang, Guangyao Chen, Guangwu Qian +5

    cs.CVcs.AIcs.MMarXiv:2302.10035v32023
  53. Diffusion Probabilistic Modeling for Video Generation

    Ruihan Yang, Prakhar Srivastava, Stephan Mandt

    cs.CVcs.LGstat.MLarXiv:2203.09481v52022
  54. Towards Dropout Training for Convolutional Neural Networks

    Haibing Wu, Xiaodong Gu

    cs.LGcs.CVcs.NEarXiv:1512.00242v12015
  55. Unsupervised Cross-Modality Domain Adaptation of ConvNets for Biomedical Image Segmentations with Adversarial Loss

    Qi Dou, Cheng Ouyang, Cheng Chen +2

    cs.CVarXiv:1804.10916v22018
  56. ScanComplete: Large-Scale Scene Completion and Semantic Segmentation for 3D Scans

    Angela Dai, Daniel Ritchie, Martin Bokeloh +3

    cs.CVarXiv:1712.10215v22017
  57. Alpha-IoU: A Family of Power Intersection over Union Losses for Bounding Box Regression

    Jiabo He, Sarah Erfani, Xingjun Ma +3

    cs.CVarXiv:2110.13675v22021
  58. Adversarial Active Learning for Deep Networks: a Margin Based Approach

    Melanie Ducoffe, Frederic Precioso

    cs.LGcs.CVstat.MLarXiv:1802.09841v12018
  59. Spatially-Attentive Patch-Hierarchical Network for Adaptive Motion Deblurring

    Maitreya Suin, Kuldeep Purohit, A. N. Rajagopalan

    cs.CVeess.IVarXiv:2004.05343v12020
  60. ZSON: Zero-Shot Object-Goal Navigation using Multimodal Goal Embeddings

    Arjun Majumdar, Gunjan Aggarwal, Bhavika Devnani +2

    cs.CVcs.LGcs.ROarXiv:2206.12403v22022