Computer Vision and Pattern Recognition
Papers filed under cs.CV on arXiv, each one already summarized by Paperlayer. Open any of them to read the summary beside the original PDF, with every point linked to the line, figure, or table it came from.
Search paper metadata (including unsummarized papers)
11,341 to 11,400 of 18,866
Generalized Category Discovery
Sagar Vaze, Kai Han, Andrea Vedaldi +1
cs.CVcs.LGarXiv:2201.02609v22022FreeAnchor: Learning to Match Anchors for Visual Object Detection
Xiaosong Zhang, Fang Wan, Chang Liu +2
cs.CVcs.LGarXiv:1909.02466v22019Emergence of Language with Multi-agent Games: Learning to Communicate with Sequences of Symbols
Serhii Havrylov, Ivan Titov
cs.LGcs.CLcs.CVarXiv:1705.11192v22017Adaptive Context Selection for Polyp Segmentation
Ruifei Zhang, Guanbin Li, Zhen Li +3
cs.CVarXiv:2301.04799v12023Unsupervised Domain Adaptation via Structurally Regularized Deep Clustering
Hui Tang, Ke Chen, Kui Jia
cs.CVarXiv:2003.08607v12020COTR: Correspondence Transformer for Matching Across Images
Wei Jiang, Eduard Trulls, Jan Hosang +2
cs.CVarXiv:2103.14167v22021RoboTHOR: An Open Simulation-to-Real Embodied AI Platform
Matt Deitke, Winson Han, Alvaro Herrasti +10
cs.CVcs.ROarXiv:2004.06799v12020Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models
Songwei Ge, Seungjun Nah, Guilin Liu +7
cs.CVcs.GRcs.LGarXiv:2305.10474v32023STAR: A Benchmark for Situated Reasoning in Real-World Videos
Bo Wu, Shoubin Yu, Zhenfang Chen +2
cs.AIcs.CLcs.CVarXiv:2405.09711v12024Hierarchical Bilinear Pooling for Fine-Grained Visual Recognition
Chaojian Yu, Xinyi Zhao, Qi Zheng +2
cs.CVarXiv:1807.09915v12018Parametric Noise Injection: Trainable Randomness to Improve Deep Neural Network Robustness against Adversarial Attack
Adnan Siraj Rakin, Zhezhi He, Deliang Fan
cs.LGcs.CRcs.CVarXiv:1811.09310v12018Toward Fast, Flexible, and Robust Low-Light Image Enhancement
Long Ma, Tengyu Ma, Risheng Liu +2
cs.CVarXiv:2204.10137v12022Bringing a Blurry Frame Alive at High Frame-Rate with an Event Camera
Liyuan Pan, Cedric Scheerlinck, Xin Yu +3
cs.CVarXiv:1811.10180v22018Deep Unsupervised Domain Adaptation: A Review of Recent Advances and Perspectives
Xiaofeng Liu, Chaehwa Yoo, Fangxu Xing +4
cs.CVcs.AIcs.LGarXiv:2208.07422v12022Improved YOLOv5 network for real-time multi-scale traffic sign detection
Junfan Wang, Yi Chen, Mingyu Gao +1
cs.CVcs.LGarXiv:2112.08782v22021Structured Graph Learning for Scalable Subspace Clustering: From Single-view to Multi-view
Zhao Kang, Zhiping Lin, Xiaofeng Zhu +1
cs.LGcs.AIcs.CVarXiv:2102.07943v12021Deep Feature Interpolation for Image Content Changes
Paul Upchurch, Jacob Gardner, Geoff Pleiss +4
cs.CVarXiv:1611.05507v22016Pixel-Level Domain Transfer
Donggeun Yoo, Namil Kim, Sunggyun Park +2
cs.CVcs.AIarXiv:1603.07442v32016DeepICP: An End-to-End Deep Neural Network for 3D Point Cloud Registration
Weixin Lu, Guowei Wan, Yao Zhou +3
cs.CVcs.CGcs.GRarXiv:1905.04153v22019Zero-Shot Visual Imitation
Deepak Pathak, Parsa Mahmoudieh, Guanghao Luo +7
cs.LGcs.AIcs.CVarXiv:1804.08606v12018Changer: Feature Interaction is What You Need for Change Detection
Sheng Fang, Kaiyu Li, Zhe Li
cs.CVarXiv:2209.08290v12022TrafficSim: Learning to Simulate Realistic Multi-Agent Behaviors
Simon Suo, Sebastian Regalado, Sergio Casas +1
cs.ROcs.AIcs.CVarXiv:2101.06557v12021Triplane Meets Gaussian Splatting: Fast and Generalizable Single-View 3D Reconstruction with Transformers
Zi-Xin Zou, Zhipeng Yu, Yuan-Chen Guo +4
cs.CVarXiv:2312.09147v22023On-Device Training Under 256KB Memory
Ji Lin, Ligeng Zhu, Wei-Ming Chen +3
cs.CVarXiv:2206.15472v42022MACE: Mass Concept Erasure in Diffusion Models
Shilin Lu, Zilan Wang, Leyang Li +2
cs.CVcs.AIcs.LGarXiv:2403.06135v12024Deep Learning and Machine Vision for Food Processing: A Survey
Lili Zhu, Petros Spachos, Erica Pensini +1
cs.CVcs.LGarXiv:2103.16106v12021Rotate your Networks: Better Weight Consolidation and Less Catastrophic Forgetting
Xialei Liu, Marc Masana, Luis Herranz +3
cs.CVarXiv:1802.02950v42018Generative Novel View Synthesis with 3D-Aware Diffusion Models
Eric R. Chan, Koki Nagano, Matthew A. Chan +7
cs.CVcs.AIcs.GRarXiv:2304.02602v12023Deep Adversarial Training for Multi-Organ Nuclei Segmentation in Histopathology Images
Faisal Mahmood, Daniel Borders, Richard Chen +4
cs.CVarXiv:1810.00236v22018Perceptual Quality Prediction on Authentically Distorted Images Using a Bag of Features Approach
Deepti Ghadiyaram, Alan C. Bovik
cs.CVarXiv:1609.04757v12016How Well Do Self-Supervised Models Transfer?
Linus Ericsson, Henry Gouk, Timothy M. Hospedales
cs.CVarXiv:2011.13377v22020Multispectral Fusion for Object Detection with Cyclic Fuse-and-Refine Blocks
Heng Zhang, Elisa Fromont, Sébastien Lefevre +1
cs.CVarXiv:2009.12664v12020Gaussian Opacity Fields: Efficient Adaptive Surface Reconstruction in Unbounded Scenes
Zehao Yu, Torsten Sattler, Andreas Geiger
cs.CVarXiv:2404.10772v22024StainGAN: Stain Style Transfer for Digital Histological Images
M Tarek Shaban, Christoph Baur, Nassir Navab +1
cs.CVarXiv:1804.01601v12018Improving Multispectral Pedestrian Detection by Addressing Modality Imbalance Problems
Kailai Zhou, Linsen Chen, Xun Cao
cs.CVarXiv:2008.03043v22020BOP Challenge 2020 on 6D Object Localization
Tomas Hodan, Martin Sundermeyer, Bertram Drost +5
cs.CVcs.GRcs.LGarXiv:2009.07378v22020Asynchronous, Photometric Feature Tracking using Events and Frames
Daniel Gehrig, Henri Rebecq, Guillermo Gallego +1
cs.CVcs.ROarXiv:1807.09713v12018Deep Neural Networks for Anatomical Brain Segmentation
Alexandre de Brebisson, Giovanni Montana
cs.CVcs.LGstat.AParXiv:1502.02445v22015Self-supervised Learning of Motion Capture
Hsiao-Yu Fish Tung, Hsiao-Wei Tung, Ersin Yumer +1
cs.CVarXiv:1712.01337v12017Key.Net: Keypoint Detection by Handcrafted and Learned CNN Filters
Axel Barroso-Laguna, Edgar Riba, Daniel Ponsa +1
cs.CVarXiv:1904.00889v32019CelebV-HQ: A Large-Scale Video Facial Attributes Dataset
Hao Zhu, Wayne Wu, Wentao Zhu +5
cs.CVarXiv:2207.12393v12022LongVILA: Scaling Long-Context Visual Language Models for Long Videos
Yukang Chen, Fuzhao Xue, Dacheng Li +15
cs.CVcs.CLarXiv:2408.10188v62024Modeling and Propagating CNNs in a Tree Structure for Visual Tracking
Hyeonseob Nam, Mooyeol Baek, Bohyung Han
cs.CVarXiv:1608.07242v12016Graduated Non-Convexity for Robust Spatial Perception: From Non-Minimal Solvers to Global Outlier Rejection
Heng Yang, Pasquale Antonante, Vasileios Tzoumas +1
cs.CVcs.ROmath.OCarXiv:1909.08605v42019Inverse Rendering for Complex Indoor Scenes: Shape, Spatially-Varying Lighting and SVBRDF from a Single Image
Zhengqin Li, Mohammad Shafiei, Ravi Ramamoorthi +2
cs.CVarXiv:1905.02722v12019Generalized Source-free Domain Adaptation
Shiqi Yang, Yaxing Wang, Joost van de Weijer +2
cs.CVarXiv:2108.01614v22021Aggregated Contextual Transformations for High-Resolution Image Inpainting
Yanhong Zeng, Jianlong Fu, Hongyang Chao +1
cs.CVarXiv:2104.01431v12021On Regularized Losses for Weakly-supervised CNN Segmentation
Meng Tang, Federico Perazzi, Abdelaziz Djelouah +3
cs.CVarXiv:1803.09569v22018Cross-view Semantic Segmentation for Sensing Surroundings
Bowen Pan, Jiankai Sun, Ho Yin Tiga Leung +2
cs.CVeess.IVarXiv:1906.03560v32019A Comprehensive Analysis of Deep Regression
Stéphane Lathuilière, Pablo Mesejo, Xavier Alameda-Pineda +1
cs.CVarXiv:1803.08450v32018On the uncertainty of self-supervised monocular depth estimation
Matteo Poggi, Filippo Aleotti, Fabio Tosi +1
cs.CVarXiv:2005.06209v12020Large-scale Multi-Modal Pre-trained Models: A Comprehensive Survey
Xiao Wang, Guangyao Chen, Guangwu Qian +5
cs.CVcs.AIcs.MMarXiv:2302.10035v32023Diffusion Probabilistic Modeling for Video Generation
Ruihan Yang, Prakhar Srivastava, Stephan Mandt
cs.CVcs.LGstat.MLarXiv:2203.09481v52022Towards Dropout Training for Convolutional Neural Networks
Haibing Wu, Xiaodong Gu
cs.LGcs.CVcs.NEarXiv:1512.00242v12015Unsupervised Cross-Modality Domain Adaptation of ConvNets for Biomedical Image Segmentations with Adversarial Loss
Qi Dou, Cheng Ouyang, Cheng Chen +2
cs.CVarXiv:1804.10916v22018ScanComplete: Large-Scale Scene Completion and Semantic Segmentation for 3D Scans
Angela Dai, Daniel Ritchie, Martin Bokeloh +3
cs.CVarXiv:1712.10215v22017Alpha-IoU: A Family of Power Intersection over Union Losses for Bounding Box Regression
Jiabo He, Sarah Erfani, Xingjun Ma +3
cs.CVarXiv:2110.13675v22021Adversarial Active Learning for Deep Networks: a Margin Based Approach
Melanie Ducoffe, Frederic Precioso
cs.LGcs.CVstat.MLarXiv:1802.09841v12018Spatially-Attentive Patch-Hierarchical Network for Adaptive Motion Deblurring
Maitreya Suin, Kuldeep Purohit, A. N. Rajagopalan
cs.CVeess.IVarXiv:2004.05343v12020ZSON: Zero-Shot Object-Goal Navigation using Multimodal Goal Embeddings
Arjun Majumdar, Gunjan Aggarwal, Bhavika Devnani +2
cs.CVcs.LGcs.ROarXiv:2206.12403v22022