CVPR 2020 Accepted Papers
The full list of 1,466 papers accepted at CVPR 2020 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 1,131Oral: 335
- Momentum Contrast for Unsupervised Visual Representation LearningOral15,734 citations
- EfficientDet: Scalable and Efficient Object DetectionPoster8,837 citations
- ECA-Net: Efficient Channel Attention for Deep Convolutional Neural NetworksPoster7,872 citations
- Analyzing and Improving the Image Quality of StyleGANPoster7,789 citations
- nuScenes: A Multimodal Dataset for Autonomous DrivingPoster7,379 citations
- GhostNet: More Features From Cheap OperationsPoster4,614 citations
- Scalability in Perception for Autonomous Driving: Waymo Open DatasetPoster3,735 citations
- Self-Training With Noisy Student Improves ImageNet ClassificationPoster3,136 citations
- SuperGlue: Learning Feature Matching With Graph Neural NetworksOral2,892 citations
- BDD100K: A Diverse Driving Dataset for Heterogeneous Multitask LearningOral2,855 citations
- PV-RCNN: Point-Voxel Feature Set Abstraction for 3D Object DetectionPoster2,428 citations
- Bridging the Gap Between Anchor-Based and Anchor-Free Detection via Adaptive Training Sample SelectionOral2,298 citations
- Designing Network Design SpacesPoster2,278 citations
- StarGAN v2: Diverse Image Synthesis for Multiple DomainsPoster2,173 citations
- RandLA-Net: Efficient Semantic Segmentation of Large-Scale Point CloudsOral2,143 citations
- Zero-Reference Deep Curve Estimation for Low-Light Image EnhancementPoster2,093 citations
- Self-Supervised Learning of Pretext-Invariant RepresentationsPoster1,843 citations
- Celeb-DF: A Large-Scale Challenging Dataset for DeepFake ForensicsPoster1,723 citations
- RetinaFace: Single-Shot Multi-Level Face Localisation in the WildPoster1,569 citations
- MaskGAN: Towards Diverse and Interactive Facial Image ManipulationPoster1,388 citations
- X3D: Expanding Architectures for Efficient Video RecognitionOral1,365 citations
- Dynamic Convolution: Attention Over Convolution KernelsOral1,342 citations
- Interpreting the Latent Space of GANs for Semantic Face EditingPoster1,327 citations
- Disentangling and Unifying Graph Convolutions for Skeleton-Based Action RecognitionOral1,312 citations
- Meshed-Memory Transformer for Image CaptioningPoster1,303 citations
- PointRend: Image Segmentation As RenderingOral1,268 citations
- 3DSSD: Point-Based 3D Single Stage Object DetectorOral1,242 citations
- CNN-Generated Images Are Surprisingly Easy to Spot... for NowOral1,237 citations
- VIBE: Video Inference for Human Body Pose and Shape EstimationPoster1,216 citations
- PointPainting: Sequential Fusion for 3D Object DetectionPoster1,183 citations
- Learned Image Compression With Discretized Gaussian Mixture Likelihoods and Attention ModulesPoster1,181 citations
- Circle Loss: A Unified Perspective of Pair Similarity OptimizationOral1,174 citations
- FDA: Fourier Domain Adaptation for Semantic SegmentationPoster1,143 citations
- Exploring Self-Attention for Image RecognitionPoster1,130 citations
- Face X-Ray for More General Face Forgery DetectionOral1,126 citations
- Learning Texture Transformer Network for Image Super-ResolutionPoster1,107 citations
- Point-GNN: Graph Neural Network for 3D Object Detection in a Point CloudPoster1,095 citations
- HigherHRNet: Scale-Aware Representation Learning for Bottom-Up Human Pose EstimationPoster1,075 citations
- Differentiable Volumetric Rendering: Learning Implicit 3D Representations Without 3D SupervisionPoster1,069 citations
- BBN: Bilateral-Branch Network With Cumulative Learning for Long-Tailed Visual RecognitionOral1,043 citations
- HRank: Filter Pruning Using High-Rank Feature MapOral1,040 citations
- Multi-Scale Boosted Dehazing Network With Dense Feature FusionPoster1,034 citations
- Social-STGCNN: A Social Spatio-Temporal Graph Convolutional Neural Network for Human Trajectory PredictionPoster1,032 citations
- Siamese Box Adaptive Network for Visual TrackingPoster1,031 citations
- Semi-Supervised Semantic Segmentation With Cross-Consistency TrainingPoster1,026 citations
- VectorNet: Encoding HD Maps and Agent Dynamics From Vectorized RepresentationPoster1,022 citations
- Skeleton-Based Action Recognition With Shift Graph Convolutional NetworkOral1,008 citations
- DeepEMD: Few-Shot Image Classification With Differentiable Earth Mover's Distance and Structured ClassifiersOral1,005 citations
- SiamCAR: Siamese Fully Convolutional Classification and Regression for Visual TrackingOral980 citations
- Learning Memory-Guided Normality for Anomaly DetectionPoster964 citations
- PIFuHD: Multi-Level Pixel-Aligned Implicit Function for High-Resolution 3D Human DigitizationOral955 citations
- Few-Shot Learning via Embedding Adaptation With Set-to-Set FunctionsPoster940 citations
- Uninformed Students: Student-Teacher Anomaly Detection With Discriminative Latent EmbeddingsPoster926 citations
- ALFRED: A Benchmark for Interpreting Grounded Instructions for Everyday TasksPoster922 citations
- Multi-Scale Interactive Network for Salient Object DetectionPoster917 citations
- Cascade Cost Volume for High-Resolution Multi-View Stereo and Stereo MatchingOral897 citations
- 3D Packing for Self-Supervised Monocular Depth EstimationOral881 citations
- Self-Supervised Equivariant Attention Mechanism for Weakly Supervised Semantic SegmentationOral881 citations
- Unbiased Scene Graph Generation From Biased TrainingOral870 citations
- End-to-End Learning of Visual Representations From Uncurated Instructional VideosOral867 citations
- Multi-Scale Progressive Fusion Network for Single Image DerainingPoster844 citations
- Siam R-CNN: Visual Tracking by Re-DetectionPoster825 citations
- Camouflaged Object DetectionOral806 citations
- Rethinking Classification and Localization for Object DetectionPoster792 citations
- Blindly Assess Image Quality in the Wild Guided by a Self-Adaptive Hyper NetworkPoster788 citations
- Strip Pooling: Rethinking Spatial Pooling for Scene ParsingPoster788 citations
- CenterMask: Real-Time Anchor-Free Instance SegmentationPoster783 citations
- Probabilistic Regression for Visual TrackingPoster783 citations
- Suppressing Uncertainties for Large-Scale Facial Expression RecognitionPoster783 citations
- Panoptic-DeepLab: A Simple, Strong, and Fast Baseline for Bottom-Up Panoptic SegmentationPoster776 citations
- PointASNL: Robust Point Clouds Processing Using Nonlocal Neural Networks With Adaptive SamplingPoster764 citations
- PolarMask: Single Shot Instance Segmentation With Polar RepresentationOral764 citations
- Few-Shot Object Detection With Attention-RPN and Multi-Relation DetectorPoster758 citations
- Deep Unfolding Network for Image Super-ResolutionPoster756 citations
- X-Linear Attention Networks for Image CaptioningPoster746 citations
- SEAN: Image Synthesis With Semantic Region-Adaptive NormalizationOral731 citations
- Sign Language Transformers: Joint End-to-End Sign Language Recognition and TranslationOral726 citations
- TDAN: Temporally-Deformable Alignment Network for Video Super-ResolutionPoster726 citations
- Generalized ODIN: Detecting Out-of-Distribution Image Without Learning From Out-of-Distribution DataPoster725 citations
- Structure Aware Single-Stage 3D Object Detection From Point CloudPoster720 citations
- Revisiting Knowledge Distillation via Label Smoothing RegularizationOral719 citations
- On the Detection of Digital Face ManipulationPoster715 citations
- Relation-Aware Global Attention for Person Re-IdentificationPoster713 citations
- Combating Noisy Labels by Agreement: A Joint Training Method with Co-RegularizationPoster706 citations
- High-Frequency Component Helps Explain the Generalization of Convolutional Neural NetworksOral700 citations
- Adversarial Examples Improve Image RecognitionPoster699 citations
- Dreaming to Distill: Data-Free Knowledge Transfer via DeepInversionOral699 citations
- BlendMask: Top-Down Meets Bottom-Up for Instance SegmentationOral697 citations
- CurricularFace: Adaptive Curriculum Learning Loss for Deep Face RecognitionPoster686 citations
- PULSE: Self-Supervised Photo Upsampling via Latent Space Exploration of Generative ModelsPoster679 citations
- Local Implicit Grid Representations for 3D ScenesPoster659 citations
- From Fidelity to Perceptual Quality: A Semi-Supervised Approach for Low-Light Image EnhancementPoster657 citations
- Image2StyleGAN++: How to Edit the Embedded Images?Poster654 citations
- GraspNet-1Billion: A Large-Scale Benchmark for General Object GraspingPoster650 citations
- Residual Feature Aggregation Network for Image Super-ResolutionPoster645 citations
- TEA: Temporal Excitation and Aggregation for Action RecognitionPoster638 citations
- Semantics-Guided Neural Networks for Efficient Skeleton-Based Human Action RecognitionPoster635 citations
- PolarNet: An Improved Grid Representation for Online LiDAR Point Clouds Semantic SegmentationPoster630 citations
- Distribution-Aware Coordinate Representation for Human Pose EstimationPoster627 citations
- Deep Global RegistrationOral621 citations
- AANet: Adaptive Aggregation Network for Efficient Stereo MatchingPoster620 citations
- Searching Central Difference Convolutional Networks for Face Anti-SpoofingPoster620 citations
- Maintaining Discrimination and Fairness in Class Incremental LearningPoster614 citations
- The Secret Revealer: Generative Model-Inversion Attacks Against Deep Neural NetworksOral614 citations
- PVN3D: A Deep Point-Wise 3D Keypoints Voting Network for 6DoF Pose EstimationPoster613 citations
- Equalization Loss for Long-Tailed Object RecognitionPoster612 citations
- G-TAD: Sub-Graph Localization for Temporal Action DetectionPoster604 citations
- RPM-Net: Robust Point Matching Using Learned FeaturesPoster597 citations
- Few-Shot Class-Incremental LearningOral590 citations
- AugFPN: Improving Multi-Scale Feature Learning for Object DetectionPoster589 citations
- DeeperForensics-1.0: A Large-Scale Dataset for Real-World Face Forgery DetectionPoster586 citations
- SAL: Sign Agnostic Learning of Shapes From Raw DataOral586 citations
- Learning a Neural Solver for Multiple Object TrackingOral579 citations
- Implicit Functions in Feature Space for 3D Shape Reconstruction and CompletionPoster578 citations
- Seeing Through Fog Without Seeing Fog: Deep Multimodal Sensor Fusion in Unseen Adverse WeatherPoster577 citations
- 12-in-1: Multi-Task Vision and Language Representation LearningPoster575 citations
- Learning to Learn Single Domain GeneralizationPoster572 citations
- SAPIEN: A SimulAted Part-Based Interactive ENvironmentOral560 citations
- Learning in the Frequency DomainPoster557 citations
- Eternal Sunshine of the Spotless Net: Selective Forgetting in Deep NetworksPoster556 citations
- High-Order Information Matters: Learning Relation and Topology for Occluded Person Re-IdentificationPoster555 citations
- Improving Convolutional Networks With Self-Calibrated ConvolutionsPoster542 citations
- Adaptive Subspaces for Few-Shot LearningPoster539 citations
- PF-Net: Point Fractal Network for 3D Point Cloud CompletionPoster536 citations
- Recurrent Feature Reasoning for Image InpaintingPoster535 citations
- BlendedMVS: A Large-Scale Dataset for Generalized Multi-View Stereo NetworksPoster534 citations
- Revisiting the Sibling Head in Object DetectorPoster532 citations
- GaitPart: Temporal Part-Based Model for Gait RecognitionPoster529 citations
- D3Feat: Joint Learning of Dense Detection and Description of 3D Local FeaturesOral528 citations
- CoverNet: Multimodal Behavior Prediction Using Trajectory SetsPoster527 citations
- ActBERT: Learning Global-Local Video-Text RepresentationsOral523 citations
- Temporal Pyramid Network for Action RecognitionPoster521 citations
- D3VO: Deep Depth, Deep Pose and Deep Uncertainty for Monocular Visual OdometryOral519 citations
- PointGroup: Dual-Set Point Grouping for 3D Instance SegmentationOral519 citations
- Cross-Domain Correspondence Learning for Exemplar-Based Image TranslationOral515 citations
- Deformable Siamese Attention Networks for Visual Object TrackingPoster513 citations
- ZeroQ: A Novel Zero Shot Quantization FrameworkPoster513 citations
- StegaStamp: Invisible Hyperlinks in Physical PhotographsPoster512 citations
- Unsupervised Person Re-Identification via Multi-Label ClassificationOral512 citations
- SynSin: End-to-End View Synthesis From a Single ImageOral510 citations
- Local Deep Implicit Functions for 3D ShapeOral503 citations
- Deblurring by Realistic BlurringOral495 citations
- Domain Adaptation for Image DehazingPoster489 citations
- Towards Discriminability and Diversity: Batch Nuclear-Norm Maximization Under Label Insufficient SituationsOral489 citations
- Proxy Anchor Loss for Deep Metric LearningPoster486 citations
- Unsupervised Intra-Domain Adaptation for Semantic Segmentation Through Self-SupervisionOral480 citations
- Image Super-Resolution With Cross-Scale Non-Local Attention and Exhaustive Self-Exemplars MiningPoster478 citations
- ABCNet: Real-Time Scene Text Spotting With Adaptive Bezier-Curve NetworkOral474 citations
- StyleRig: Rigging StyleGAN for 3D Control Over Portrait ImagesOral473 citations
- HOnnotate: A Method for 3D Annotation of Hand and Object PosesPoster470 citations
- Multi-Modality Cross Attention Network for Image and Sentence MatchingPoster470 citations
- AutoTrack: Towards High-Performance Visual Tracking for UAV With Automatic Spatio-Temporal RegularizationPoster462 citations
- IMRAM: Iterative Matching With Recurrent Attention Memory for Cross-Modal Image-Text RetrievalPoster461 citations
- A Model-Driven Deep Neural Network for Single Image Rain RemovalPoster457 citations
- Softmax Splatting for Video Frame InterpolationPoster457 citations
- Mnemonics Training: Multi-Class Incremental Learning Without ForgettingOral454 citations
- What Makes Training Multi-Modal Classification Networks Hard?Poster453 citations
- CycleISP: Real Image Restoration via Improved Data SynthesisOral450 citations
- Style Normalization and Restitution for Generalizable Person Re-IdentificationPoster448 citations
- Self2Self With Dropout: Learning Self-Supervised Denoising From Single ImagePoster447 citations
- Structure-Preserving Super Resolution With Gradient GuidancePoster446 citations
- In Defense of Grid Features for Visual Question AnsweringPoster444 citations
- Interactive Two-Stream Decoder for Accurate and Fast Saliency DetectionPoster444 citations
- Contextual Residual Aggregation for Ultra High-Resolution Image InpaintingOral443 citations
- Learning to Restore Low-Light Images via Decomposition-and-EnhancementPoster443 citations
- MetaIQA: Deep Meta-Learning for No-Reference Image Quality AssessmentPoster443 citations
- Towards Fairness in Visual Recognition: Effective Strategies for Bias MitigationPoster441 citations
- Google Landmarks Dataset v2 - A Large-Scale Benchmark for Instance-Level Recognition and RetrievalOral438 citations
- Learning to Dress 3D People in Generative ClothingPoster435 citations
- Cross-Modality Person Re-Identification With Shared-Specific Feature TransferPoster434 citations
- Forward and Backward Information Retention for Accurate Binary Neural NetworksPoster431 citations
- RMP-SNN: Residual Membrane Potential Neuron for Enabling Deeper High-Accuracy and Low-Latency Spiking Neural NetworkPoster430 citations
- Action Genome: Actions As Compositions of Spatio-Temporal Scene GraphsPoster426 citations
- Closed-Loop Matters: Dual Regression Networks for Single Image Super-ResolutionPoster425 citations
- Towards Accurate Scene Text Recognition With Semantic Reasoning NetworksPoster424 citations
- What's Hidden in a Randomly Weighted Neural Network?Poster424 citations
- GHUM & GHUML: Generative 3D Human Shape and Articulated Pose ModelsOral423 citations
- Watch Your Up-Convolution: CNN Based Generative Deep Neural Networks Are Failing to Reproduce Spectral DistributionsPoster422 citations
- A U-Net Based Discriminator for Generative Adversarial NetworksPoster421 citations
- UC-Net: Uncertainty Inspired RGB-D Saliency Detection via Conditional Variational AutoencodersOral420 citations
- Deep Snake for Real-Time Instance SegmentationOral415 citations
- Semantic Drift Compensation for Class-Incremental LearningPoster413 citations
- FineGym: A Hierarchical Video Dataset for Fine-Grained Action UnderstandingOral412 citations
- Hi-CMD: Hierarchical Cross-Modality Disentanglement for Visible-Infrared Person Re-IdentificationPoster412 citations
- Perceptual Quality Assessment of Smartphone PhotographyPoster412 citations
- Dynamic Refinement Network for Oriented and Densely Packed Object DetectionOral411 citations
- Dynamic Multiscale Graph Neural Networks for 3D Skeleton Based Human Motion PredictionOral410 citations
- Universal Source-Free Domain AdaptationPoster410 citations
- Single-View View Synthesis With Multiplane ImagesPoster408 citations
- Disentangled and Controllable Face Image Generation via 3D Imitative-Contrastive LearningOral404 citations
- Disentangling Physical Dynamics From Unknown Factors for Unsupervised Video PredictionPoster404 citations
- Fine-Grained Video-Text Retrieval With Hierarchical Graph ReasoningPoster402 citations
- Counterfactual Samples Synthesizing for Robust Visual Question AnsweringPoster401 citations
- Central Similarity Quantization for Efficient Image and Video RetrievalPoster400 citations
- From Patches to Pictures (PaQ-2-PiQ): Mapping the Perceptual Space of Picture QualityPoster397 citations
- MMTM: Multimodal Transfer Module for CNN FusionPoster397 citations
- Cost Volume Pyramid Based Depth Inference for Multi-View StereoOral395 citations
- Online Knowledge Distillation via Collaborative LearningOral395 citations
- Global Texture Enhancement for Fake Face Detection in the WildPoster394 citations
- Image Processing Using Multi-Code GAN PriorPoster394 citations
- Memory Enhanced Global-Local Aggregation for Video Object DetectionPoster392 citations
- Label Decoupling Framework for Salient Object DetectionPoster390 citations
- JL-DCF: Joint Learning and Densely-Cooperative Fusion Framework for RGB-D Salient Object DetectionPoster389 citations
- Object Relational Graph With Teacher-Recommended Learning for Video CaptioningPoster387 citations
- Understanding Human Hands in Contact at Internet ScaleOral386 citations
- Learning Depth-Guided Convolutions for Monocular 3D Object DetectionPoster384 citations
- AD-Cluster: Augmented Discriminative Clustering for Domain Adaptive Person Re-IdentificationPoster383 citations
- Deep Stereo Using Adaptive Thin Volume Representation With Uncertainty AwarenessOral383 citations
- FBNetV2: Differentiable Neural Architecture Search for Spatial and Channel DimensionsPoster383 citations
- Reference-Based Sketch Image Colorization Using Augmented-Self Reference and Dense Semantic CorrespondencePoster382 citations
- Scale-Space Flow for End-to-End Optimized Video CompressionPoster382 citations
- Unsupervised Domain Adaptation via Structurally Regularized Deep ClusteringOral381 citations
- ASLFeat: Learning Local Features of Accurate Shape and LocalizationPoster379 citations
- Regularizing Class-Wise Predictions via Self-Knowledge DistillationPoster379 citations
- ARCH: Animatable Reconstruction of Clothed HumansPoster378 citations
- Exploring Categorical Regularization for Domain Adaptive Object DetectionPoster378 citations
- Modeling the Background for Incremental Learning in Semantic SegmentationPoster378 citations
- View-GCN: View-Based Graph Convolutional Network for 3D Shape AnalysisPoster378 citations
- Adversarial Feature Hallucination Networks for Few-Shot LearningPoster375 citations
- REVERIE: Remote Embodied Visual Referring Expression in Real Indoor EnvironmentsOral374 citations
- Weakly-Supervised Semantic Segmentation via Sub-Category ExplorationPoster373 citations
- Hyperbolic Image EmbeddingsOral372 citations
- Hierarchical Clustering With Hard-Batch Triplet Loss for Person Re-IdentificationPoster368 citations
- Unsupervised Learning of Probably Symmetric Deformable 3D Objects From Images in the WildOral367 citations
- Squeeze-and-Attention Networks for Semantic SegmentationPoster365 citations
- Neural Blind Deconvolution Using Deep PriorsPoster363 citations
- D3S - A Discriminative Single Shot Segmentation TrackerPoster361 citations
- FaceScape: A Large-Scale High Quality 3D Face Dataset and Detailed Riggable 3D Face PredictionPoster361 citations
- Harmonizing Transferability and Discriminability for Adapting Object DetectorsPoster361 citations
- Meta-Transfer Learning for Zero-Shot Super-ResolutionPoster361 citations
- Learning Selective Self-Mutual Attention for RGB-D Saliency DetectionPoster359 citations
- Attention Scaling for Crowd CountingPoster358 citations
- Rethinking Class-Balanced Methods for Long-Tailed Visual Recognition From a Domain Adaptation PerspectiveOral355 citations
- Benchmarking Adversarial Robustness on Image ClassificationOral354 citations
- Spatio-Temporal Graph for Video Captioning With Knowledge DistillationPoster354 citations
- BSP-Net: Generating Compact Meshes via Binary Space PartitioningOral353 citations
- ManiGAN: Text-Guided Image ManipulationPoster353 citations
- Gradually Vanishing Bridge for Adversarial Domain AdaptationPoster352 citations
- Overcoming Classifier Imbalance for Long-Tail Object Detection With Balanced Group SoftmaxOral351 citations
- All in One Bad Weather Removal Using Architectural SearchPoster350 citations
- DIST: Rendering Deep Implicit Signed Distance Function With Differentiable Sphere TracingPoster350 citations
- 3D Photography Using Context-Aware Layered Depth InpaintingPoster349 citations
- Neural Topological SLAM for Visual NavigationPoster349 citations
- ImVoteNet: Boosting 3D Object Detection in Point Clouds With Image VotesPoster348 citations
- Multi-Task Collaborative Network for Joint Referring Expression Comprehension and SegmentationOral348 citations
- A Self-supervised Approach for Adversarial RobustnessOral346 citations
- Clean-Label Backdoor Attacks on Video Recognition ModelsPoster346 citations
- Unsupervised Person Re-Identification via Softened Similarity LearningPoster346 citations
- HybridPose: 6D Object Pose Estimation Under Hybrid RepresentationsPoster345 citations
- Spatially-Attentive Patch-Hierarchical Network for Adaptive Motion DeblurringPoster345 citations
- TailorNet: Predicting Clothing in 3D as a Function of Human Pose, Shape and Garment StyleOral344 citations
- TubeTK: Adopting Tubes to Track Multi-Object in a One-Step Training ModelOral344 citations
- Feature-Metric Registration: A Fast Semi-Supervised Approach for Robust Point Cloud Registration Without CorrespondencesPoster343 citations
- On Translation Invariance in CNNs: Convolutional Layers Can Exploit Absolute Spatial LocationPoster343 citations
- MonoPair: Monocular 3D Object Detection Using Pairwise Spatial RelationshipsPoster342 citations
- PPDM: Parallel Point Detection and Matching for Real-Time Human-Object Interaction DetectionPoster341 citations
- Gated Channel Transformation for Visual RecognitionPoster340 citations
- SEED: Semantics Enhanced Encoder-Decoder Framework for Scene Text RecognitionPoster340 citations
- Learning Texture Invariant Representation for Domain Adaptation of Semantic SegmentationPoster339 citations
- Visual Commonsense R-CNNPoster339 citations
- Towards Photo-Realistic Virtual Try-On by Adaptively Generating-Preserving Image ContentPoster337 citations
- Dense Regression Network for Video GroundingPoster336 citations
- Weakly-Supervised Salient Object Detection via Scribble AnnotationsPoster335 citations
- Hierarchical Conditional Relation Networks for Video Question AnsweringOral334 citations
- Context Prior for Scene SegmentationPoster333 citations
- Foreground-Aware Relation Network for Geospatial Object Segmentation in High Spatial Resolution Remote Sensing ImageryPoster333 citations
- Adversarial Latent AutoencodersPoster332 citations
- MAGSAC++, a Fast, Reliable and Accurate Robust EstimatorOral332 citations
- FastDVDnet: Towards Real-Time Deep Video Denoising Without Flow EstimationOral330 citations
- Single-Side Domain Generalization for Face Anti-SpoofingPoster330 citations
- Conditional Gaussian Distribution Learning for Open Set RecognitionPoster329 citations
- Data Uncertainty Learning in Face RecognitionPoster328 citations
- FSS-1000: A 1000-Class Dataset for Few-Shot SegmentationPoster326 citations
- Local-Global Video-Text Interactions for Temporal GroundingPoster325 citations
- Point Cloud Completion by Skip-Attention Network With Hierarchical FoldingPoster325 citations
- SpeedNet: Learning the Speediness in VideosOral322 citations
- GPS-Net: Graph Property Sensing Network for Scene Graph GenerationOral321 citations
- Improved Few-Shot Visual ClassificationPoster321 citations
- Single-Stage Semantic Segmentation From Image LabelsPoster321 citations
- Editing in Style: Uncovering the Local Semantics of GANsPoster320 citations
- Listen to Look: Action Recognition by Previewing AudioPoster320 citations
- Towards Learning a Generic Agent for Vision-and-Language Navigation via Pre-TrainingPoster320 citations
- Few-Shot Video Classification via Temporal AlignmentPoster319 citations
- High-Performance Long-Term Tracking With Meta-UpdaterOral319 citations
- Cascaded Refinement Network for Point Cloud CompletionPoster318 citations
- Self-Trained Deep Ordinal Regression for End-to-End Video Anomaly DetectionPoster318 citations
- Incremental Few-Shot Object DetectionPoster316 citations
- Grid-GCN for Fast and Scalable Point Cloud LearningPoster315 citations
- MSG-GAN: Multi-Scale Gradients for Generative Adversarial NetworksPoster315 citations
- Pose-Guided Visible Part Matching for Occluded Person ReIDPoster315 citations
- Wavelet Integrated CNNs for Noise-Robust Image ClassificationPoster315 citations
- Advancing High Fidelity Identity Swapping for Forgery DetectionOral314 citations
- Distilling Knowledge From Graph Convolutional NetworksPoster314 citations
- Mitigating Bias in Face Recognition Using Skewness-Aware Reinforcement LearningPoster314 citations
- Context-Aware Attention Network for Image-Text RetrievalPoster313 citations
- CARS: Continuous Evolution for Efficient Neural Architecture SearchPoster310 citations
- Controllable Person Image Synthesis With Attribute-Decomposed GANOral309 citations
- On the Uncertainty of Self-Supervised Monocular Depth EstimationPoster309 citations
- Resolution Adaptive Networks for Efficient InferencePoster308 citations
- Salience-Guided Cascaded Suppression Network for Person Re-IdentificationPoster307 citations
- Single-Image HDR Reconstruction by Learning to Reverse the Camera PipelinePoster307 citations
- Graph Structured Network for Image-Text MatchingPoster306 citations
- Cross-Batch Memory for Embedding LearningOral304 citations
- Predicting Semantic Map Representations From Images Using Pyramid Occupancy NetworksOral304 citations
- Superpixel Segmentation With Fully Convolutional NetworksPoster304 citations
- Cross-Domain Detection via Graph-Induced Prototype AlignmentOral302 citations
- Learning Filter Pruning Criteria for Deep Convolutional Neural Networks AccelerationPoster301 citations
- Old Is Gold: Redefining the Adversarially Learned One-Class Classifier Training ParadigmPoster301 citations
- Towards Visually Explaining Variational AutoencodersOral301 citations
- M2m: Imbalanced Classification via Major-to-Minor TranslationPoster300 citations
- RoboTHOR: An Open Simulation-to-Real Embodied AI PlatformPoster300 citations
- Fast Symmetric Diffeomorphic Image Registration with Convolutional Neural NetworksPoster299 citations
- Fine-Grained Generalized Zero-Shot Learning via Dense Attribute-Based AttentionPoster299 citations
- Learning Human-Object Interaction Detection Using Interaction PointsPoster297 citations
- Noisier2Noise: Learning to Denoise From Unpaired Noisy DataPoster297 citations
- AdaCoF: Adaptive Collaboration of Flows for Video Frame InterpolationPoster295 citations
- EPOS: Estimating 6D Pose of Objects With SymmetriesPoster295 citations
- Adversarial Robustness: From Self-Supervised Pre-Training to Fine-TuningPoster294 citations
- GAN Compression: Efficient Architectures for Interactive Conditional GANsPoster294 citations
- Inverse Rendering for Complex Indoor Scenes: Shape, Spatially-Varying Lighting and SVBRDF From a Single ImageOral294 citations
- TBT: Targeted Neural Network Attack With Bit TrojanPoster293 citations
- CvxNet: Learnable Convex DecompositionOral292 citations
- OccuSeg: Occupancy-Aware 3D Instance SegmentationPoster292 citations
- Self-Supervised Monocular Trained Depth Estimation Using Self-Attention and Discrete Disparity VolumePoster292 citations
- CascadePSP: Toward Class-Agnostic and Very High-Resolution Segmentation via Global and Local RefinementPoster289 citations
- DeepLPF: Deep Local Parametric Filters for Image EnhancementPoster289 citations
- Differential Treatment for Stuff and Things: A Simple Unsupervised Domain Adaptation Method for Semantic SegmentationPoster289 citations
- Multi-Modal Domain Adaptation for Fine-Grained Action RecognitionOral288 citations
- The Devil Is in the Details: Delving Into Unbiased Data Processing for Human Pose EstimationPoster288 citations
- Deep Representation Learning on Long-Tailed Data: A Learnable Embedding Augmentation PerspectivePoster287 citations
- Physically Realizable Adversarial Examples for LiDAR Object DetectionPoster287 citations
- Say As You Wish: Fine-Grained Control of Image Caption Generation With Abstract Scene GraphsOral287 citations
- Vision-Language Navigation With Self-Supervised Auxiliary Reasoning TasksOral287 citations
- AdderNet: Do We Really Need Multiplications in Deep Learning?Oral286 citations
- Group Sparsity: The Hinge Between Filter Pruning and Decomposition for Network CompressionPoster286 citations
- Prime Sample Attention in Object DetectionPoster286 citations
- DPGN: Distribution Propagation Graph Network for Few-Shot LearningPoster285 citations
- Normalized and Geometry-Aware Self-Attention Network for Image CaptioningPoster284 citations
- Adversarial Camouflage: Hiding Physical-World Attacks With Natural StylesPoster282 citations
- Instance-Aware Image ColorizationPoster282 citations
- A2dele: Adaptive and Attentive Depth Distiller for Efficient RGB-D Salient Object DetectionPoster281 citations
- Deep Relational Reasoning Graph Network for Arbitrary Shape Text DetectionOral281 citations
- NAS-FCOS: Fast Neural Architecture Search for Object DetectionPoster281 citations
- Fast-MVSNet: Sparse-to-Dense Multi-View Stereo With Learned Propagation and Gauss-Newton RefinementPoster280 citations
- Attention Mechanism Exploits Temporal Contexts: Real-Time 3D Human Pose ReconstructionOral279 citations
- RetinaTrack: Online Single Stage Joint Detection and TrackingPoster279 citations
- End-to-End Model-Free Reinforcement Learning for Urban Driving Using Implicit AffordancesPoster278 citations
- Total3DUnderstanding: Joint Layout, Object Pose and Mesh Reconstruction for Indoor Scenes From a Single ImageOral278 citations
- Convolution in the Cloud: Learning Deformable Kernels in 3D Graph Convolution Networks for Point Cloud AnalysisPoster277 citations
- Effectively Unbiased FID and Inception Score and Where to Find ThemPoster277 citations
- Universal Litmus Patterns: Revealing Backdoor Attacks in CNNsOral277 citations
- Attention Convolutional Binary Neural Tree for Fine-Grained Visual CategorizationPoster276 citations
- MaskFlownet: Asymmetric Feature Matching With Learnable Occlusion MaskOral276 citations
- 3DRegNet: A Deep Neural Network for 3D Point RegistrationPoster275 citations
- CRNet: Cross-Reference Networks for Few-Shot SegmentationPoster275 citations
- A Physics-Based Noise Formation Model for Extreme Low-Light Raw DenoisingOral274 citations
- How to Train Your Deep Multi-Object TrackerPoster274 citations
- ContourNet: Taking a Further Step Toward Accurate Arbitrary-Shaped Scene Text DetectionPoster273 citations
- VSGNet: Spatial Attention Network for Detecting Human Object Interactions Using Graph ConvolutionsPoster273 citations
- Augment Your Batch: Improving Generalization Through Instance RepetitionPoster271 citations
- Detection in Crowded Scenes: One Proposal, Multiple PredictionsOral271 citations
- Orthogonal Convolutional Neural NetworksPoster271 citations
- SDFDiff: Differentiable Rendering of Signed Distance Fields for 3D Shape OptimizationOral271 citations
- Conditional Channel Gated Networks for Task-Aware Continual LearningOral270 citations
- Cross-domain Object Detection through Coarse-to-Fine Feature AdaptationPoster270 citations
- Learning for Video Compression With Hierarchical Quality and Recurrent EnhancementPoster270 citations
- Video to Events: Recycling Video Datasets for Event CamerasPoster270 citations
- PREDICT & CLUSTER: Unsupervised Skeleton Based Action RecognitionPoster268 citations
- Bringing Old Photos Back to LifeOral267 citations
- F-BRS: Rethinking Backpropagating Refinement for Interactive SegmentationOral267 citations
- Multi-scale Domain-adversarial Multiple-instance CNN for Cancer Subtype Classification with Unannotated Histopathological ImagesOral267 citations
- SGAS: Sequential Greedy Architecture SearchPoster267 citations
- DeepCap: Monocular Human Performance Capture Using Weak SupervisionOral266 citations
- Select, Supplement and Focus for RGB-D Saliency DetectionPoster266 citations
- Spatial-Temporal Graph Convolutional Network for Video-Based Person Re-IdentificationPoster266 citations
- LiDARsim: Realistic LiDAR Simulation by Leveraging the Real WorldOral265 citations
- Actor-Transformers for Group Activity RecognitionPoster263 citations
- HOPE-Net: A Graph-Based Model for Hand-Object Pose EstimationPoster263 citations
- HVNet: Hybrid Voxel Network for LiDAR Based 3D Object DetectionPoster263 citations
- Plug-and-Play Algorithms for Large-Scale Snapshot Compressive ImagingOral263 citations
- End-to-End Pseudo-LiDAR for Image-Based 3D Object DetectionPoster262 citations
- GNN3DMOT: Graph Neural Network for 3D Multi-Object Tracking With 2D-3D Multi-Feature LearningPoster262 citations
- Learning 3D Semantic Scene Graphs From 3D Indoor ReconstructionsPoster262 citations
- Instance-Aware, Context-Focused, and Memory-Efficient Weakly Supervised Object DetectionPoster261 citations
- DoveNet: Deep Image Harmonization via Domain VerificationPoster260 citations
- Weakly Supervised Semantic Point Cloud Segmentation: Towards 10x Fewer LabelsPoster260 citations
- M-LVC: Multiple Frames Prediction for Learned Video CompressionPoster259 citations
- Mapillary Street-Level Sequences: A Dataset for Lifelong Place RecognitionOral259 citations
- Reusing Discriminators for Encoding: Towards Unsupervised Image-to-Image TranslationPoster259 citations
- SpineNet: Learning Scale-Permuted Backbone for Recognition and LocalizationPoster259 citations
- Transfer Learning From Synthetic to Real-Noise Denoising With Adaptive Instance NormalizationPoster259 citations
- Enhanced Transport Distance for Unsupervised Domain AdaptationPoster257 citations
- Monocular Real-Time Hand Shape and Motion Capture Using Multi-Modal DataPoster257 citations
- CIAGAN: Conditional Identity Anonymization Generative Adversarial NetworksPoster255 citations
- Online Deep Clustering for Unsupervised Representation LearningPoster255 citations
- Parsing-Based View-Aware Embedding Network for Vehicle Re-IdentificationPoster255 citations
- APQ: Joint Search for Network Architecture, Pruning and Quantization PolicyPoster253 citations
- 3D-MPA: Multi-Proposal Aggregation for 3D Semantic Instance SegmentationPoster251 citations
- Iterative Answer Prediction With Pointer-Augmented Multimodal Transformers for TextVQAOral251 citations
- When2com: Multi-Agent Perception via Communication Graph GroupingPoster251 citations
- DSGN: Deep Stereo Geometry Network for 3D Object DetectionPoster250 citations
- TPNet: Trajectory Proposal Network for Motion PredictionPoster250 citations
- Temporally Distributed Networks for Fast Video Semantic SegmentationPoster250 citations
- UCTGAN: Diverse Image Inpainting Based on Unsupervised Cross-Space TranslationPoster250 citations
- Deep Semantic Clustering by Partition Confidence MaximisationPoster248 citations
- Learning Integral Objects With Intra-Class Discriminator for Weakly-Supervised Semantic SegmentationPoster248 citations
- Single-Stage 6D Object Pose EstimationPoster247 citations
- Weakly-Supervised Mesh-Convolutional Hand Reconstruction in the WildOral247 citations
- UniPose: Unified Human Pose Estimation in Single Images and VideosPoster246 citations
- Boosting Few-Shot Learning With Adaptive Margin LossPoster245 citations
- Category-Level Articulated Object Pose EstimationOral245 citations
- Deep Spatial Gradient and Temporal Depth Learning for Face Anti-SpoofingOral245 citations
- Block-Wisely Supervised Neural Architecture Search With Knowledge DistillationPoster244 citations
- Label Distribution Learning on Auxiliary Label Space Graphs for Facial Expression RecognitionPoster244 citations
- Cars Can't Fly Up in the Sky: Improving Urban-Scene Segmentation via Height-Driven Attention NetworksPoster242 citations
- Background Matting: The World Is Your Green ScreenPoster241 citations
- Dual Super-Resolution Learning for Semantic SegmentationOral241 citations
- RL-CycleGAN: Reinforcement Learning Aware Simulation-to-RealOral241 citations
- A Real-Time Cross-Modality Correlation Filtering Method for Referring Expression ComprehensionPoster240 citations
- D2Det: Towards High Quality Object Detection and Instance SegmentationPoster240 citations
- Generative-Discriminative Feature Representations for Open-Set RecognitionPoster240 citations
- Graph Embedded Pose Clustering for Anomaly DetectionPoster238 citations
- Agriculture-Vision: A Large Aerial Image Database for Agricultural Pattern AnalysisPoster237 citations
- Evaluating Weakly Supervised Object Localization Methods RightPoster237 citations
- MSeg: A Composite Dataset for Multi-Domain Semantic SegmentationPoster237 citations
- Syn2Real Transfer Learning for Image Deraining Using Gaussian ProcessesOral236 citations
- Tracking by Instance Detection: A Meta-Learning ApproachOral235 citations
- Universal Physical Camouflage Attacks on Object DetectorsPoster235 citations
- Cross-Domain Face Presentation Attack Detection via Multi-Domain Disentangled Representation LearningPoster234 citations
- Deep Kinematics Analysis for Monocular 3D Human Pose EstimationPoster233 citations
- Distortion Agnostic Deep WatermarkingPoster233 citations
- SER-FIQ: Unsupervised Estimation of Face Image Quality Based on Stochastic Embedding RobustnessPoster232 citations
- Towards Efficient Model Compression via Learned Global RankingOral232 citations
- Deep Image Spatial Transformation for Person Image GenerationPoster231 citations
- Music Gesture for Visual Sound SeparationPoster231 citations
- PointAugment: An Auto-Augmentation Framework for Point Cloud ClassificationOral230 citations
- BiFuse: Monocular 360 Depth Estimation via Bi-Projection FusionPoster229 citations
- MLCVNet: Multi-Level Context VoteNet for 3D Object DetectionPoster229 citations
- MineGAN: Effective Knowledge Transfer From GANs to Target Domains With Few ImagesPoster229 citations
- GLU-Net: Global-Local Universal Network for Dense Flow and CorrespondencesOral228 citations
- MAST: A Memory-Augmented Self-Supervised TrackerPoster227 citations
- Satellite Image Time Series Classification With Pixel-Set Encoders and Temporal Self-AttentionOral227 citations
- Spatial Pyramid Based Graph Reasoning for Semantic SegmentationPoster227 citations
- Cascaded Deep Monocular 3D Human Pose Estimation With Evolutionary Training DataOral226 citations
- Instance Credibility Inference for Few-Shot LearningPoster226 citations
- SampleNet: Differentiable Point Cloud SamplingOral226 citations
- Distilling Image Dehazing With Heterogeneous Task ImitationPoster225 citations
- Referring Image Segmentation via Cross-Modal Progressive ComprehensionPoster225 citations
- DMCP: Differentiable Markov Channel Pruning for Neural NetworksOral224 citations
- xMUDA: Cross-Modal Unsupervised Domain Adaptation for 3D Semantic SegmentationPoster224 citations
- Epipolar TransformersPoster223 citations
- Rethinking Depthwise Separable Convolutions: How Intra-Kernel Correlations Lead to Improved MobileNetsPoster223 citations
- PnPNet: End-to-End Perception and Prediction With Tracking in the LoopPoster221 citations
- Syntax-Aware Action Targeting for Video CaptioningPoster221 citations
- CentripetalNet: Pursuing High-Quality Keypoint Pairs for Object DetectionPoster220 citations
- Deep Face Super-Resolution With Iterative Collaboration Between Attentive Recovery and Landmark EstimationPoster220 citations
- Learning Multiview 3D Point Cloud RegistrationPoster220 citations
- QEBA: Query-Efficient Boundary-Based Blackbox AttackPoster220 citations
- Video Super-Resolution With Temporal Group AttentionPoster220 citations
- Learning Dynamic Routing for Semantic SegmentationOral219 citations
- Recursive Social Behavior Graph for Trajectory PredictionPoster219 citations
- Zooming Slow-Mo: Fast and Accurate One-Stage Space-Time Video Super-ResolutionPoster219 citations
- Learning Canonical Shape Space for Category-Level 6D Object Pose and Size EstimationPoster218 citations
- PolyTransform: Deep Polygon Transformer for Instance SegmentationPoster218 citations
- Something-Else: Compositional Action Recognition With Spatial-Temporal Interaction NetworksPoster218 citations
- Towards Unified INT8 Training for Convolutional Neural NetworkPoster218 citations
- Detail-recovery Image Deraining via Context Aggregation NetworksPoster217 citations
- Leveraging Photometric Consistency Over Time for Sparsely Supervised Hand-Object ReconstructionPoster217 citations
- Context Aware Graph Convolution for Skeleton-Based Action RecognitionPoster216 citations
- Image Search With Text Feedback by Visiolinguistic Attention LearningPoster216 citations
- OctSqueeze: Octree-Structured Entropy Model for LiDAR CompressionOral216 citations
- Classifying, Segmenting, and Tracking Object Instances in Video with Mask PropagationOral215 citations
- Predicting Lymph Node Metastasis Using Histopathological Images Based on Multiple Instance Learning With Deep Graph ConvolutionPoster215 citations
- Towards Better Generalization: Joint Depth-Pose Learning Without PoseNetPoster215 citations
- Train in Germany, Test in the USA: Making 3D Object Detectors GeneralizePoster215 citations
- Structure-Guided Ranking Loss for Single Image Depth PredictionPoster214 citations
- Attention-Guided Hierarchical Structure Aggregation for Image MattingPoster213 citations
- Incremental Learning in Online ScenarioPoster213 citations
- Learning by Analogy: Reliable Supervision From Transformations for Unsupervised Optical Flow EstimationPoster213 citations
- Where Am I Looking At? Joint Location and Orientation Estimation by Cross-View MatchingPoster213 citations
- Deep Optics for Single-Shot High-Dynamic-Range ImagingOral210 citations
- Episode-Based Prototype Generating Network for Zero-Shot LearningPoster210 citations
- Video Playback Rate Perception for Self-Supervised Spatio-Temporal Representation LearningPoster210 citations
- When NAS Meets Robustness: In Search of Robust Architectures Against Adversarial AttacksPoster210 citations
- Coherent Reconstruction of Multiple Humans From a Single ImagePoster208 citations
- DaST: Data-Free Substitute Training for Adversarial AttacksOral208 citations
- Adaptive Dilated Network With Self-Correction Supervision for CountingPoster207 citations
- Gate-Shift Networks for Video Action RecognitionPoster207 citations
- Video Panoptic SegmentationOral207 citations
- Rethinking Data Augmentation for Image Super-resolution: A Comprehensive Analysis and a New StrategyPoster206 citations
- Stochastic Classifiers for Unsupervised Domain AdaptationPoster205 citations
- iTAML: An Incremental Task-Agnostic Meta-learning ApproachPoster205 citations
- MotionNet: Joint Perception and Motion Prediction for Autonomous Driving Based on Bird's Eye View MapsPoster204 citations
- Object-Occluded Human Shape and Pose Estimation From a Single Color ImageOral204 citations
- Deep Geometric Functional Maps: Robust Feature Learning for Shape CorrespondenceOral203 citations
- NMS by Representative Region: Towards Crowded Pedestrian Detection by Proposal PairingPoster202 citations
- Unpaired Image Super-Resolution Using Pseudo-SupervisionOral202 citations
- AvatarMe: Realistically Renderable 3D Facial Reconstruction "In-the-Wild"Poster201 citations
- Domain-Aware Visual Bias Eliminating for Generalized Zero-Shot LearningPoster201 citations
- GanHand: Predicting Human Grasp Affordances in Multi-Object ScenesOral201 citations
- Interactive Image Segmentation With First Click AttentionPoster201 citations
- Meta-Learning of Neural Architectures for Few-Shot LearningOral201 citations
- Dynamic Convolutions: Exploiting Spatial Sparsity for Faster InferencePoster200 citations
- The Garden of Forking Paths: Towards Multi-Future Trajectory PredictionPoster200 citations
- Bi-Directional Relationship Inferring Network for Referring Image SegmentationPoster199 citations
- P2B: Point-to-Box Network for 3D Object Tracking in Point CloudsOral199 citations
- DuDoRNet: Learning a Dual-Domain Recurrent Network for Fast MRI Reconstruction With Deep T1 PriorPoster197 citations
- Towards Universal Representation Learning for Deep Face RecognitionPoster197 citations
- ViewAL: Active Learning With Viewpoint Entropy for Semantic SegmentationPoster197 citations
- A Hierarchical Graph Network for 3D Object Detection on Point CloudsPoster196 citations
- ACNe: Attentive Context Normalization for Robust Permutation-Equivariant LearningPoster196 citations
- LUVLi Face Alignment: Estimating Landmarks' Location, Uncertainty, and Visibility LikelihoodPoster196 citations
- Weakly-Supervised Action Localization by Generative Attention ModelingPoster196 citations
- Spherical Space Domain Adaptation With Robust Pseudo-Label LossPoster195 citations
- SCATTER: Selective Context Attentional Scene Text RecognizerPoster194 citations
- Cascaded Deep Video Deblurring Using Temporal Sharpness PriorPoster193 citations
- Low-Rank Compression of Neural Nets: Learning the Rank of Each LayerPoster193 citations
- Learning Dynamic Relationships for 3D Human Motion PredictionPoster192 citations
- Learning Video Object Segmentation From Unlabeled VideosPoster192 citations
- Local Class-Specific and Global Image-Level Generative Adversarial Networks for Semantic-Guided Scene GenerationPoster192 citations
- Context-Aware Human Motion PredictionPoster191 citations
- A Multi-Task Mean Teacher for Semi-Supervised Shadow DetectionPoster190 citations
- PQ-NET: A Generative Part Seq2Seq Network for 3D ShapesPoster190 citations
- PaStaNet: Toward Human Activity Knowledge EnginePoster190 citations
- Learning Meta Face Recognition in Unseen DomainsOral189 citations
- Learning Multi-Granular Hypergraphs for Video-Based Person Re-IdentificationPoster189 citations
- GreedyNAS: Towards Fast One-Shot NAS With Greedy SupernetPoster188 citations
- Light Field Spatial Super-Resolution via Deep Combinatorial Geometry Embedding and Structural Consistency RegularizationPoster188 citations
- PhysGAN: Generating Physical-World-Resilient Adversarial Examples for Autonomous DrivingPoster188 citations
- FPConv: Learning Local Flattening for Point ConvolutionPoster187 citations
- Robust Learning Through Cross-Task ConsistencyOral187 citations
- Towards Causal VQA: Revealing and Reducing Spurious Correlations by Invariant and Covariant Semantic EditingPoster187 citations
- Single Image Reflection Removal Through Cascaded RefinementPoster185 citations
- DSNAS: Direct Neural Architecture Search Without Parameter RetrainingPoster184 citations
- Learning Event-Based Motion DeblurringPoster184 citations
- LiDAR-Based Online 3D Video Object Detection With Graph-Based Message Passing and Spatiotemporal Transformer AttentionPoster184 citations
- Making Better Mistakes: Leveraging Class Hierarchies With Deep NetworksPoster184 citations
- Towards Large Yet Imperceptible Adversarial Image Perturbations With Perceptual Color DistancePoster184 citations
- Boosting the Transferability of Adversarial Samples via AttentionPoster182 citations
- C2FNAS: Coarse-to-Fine Neural Architecture Search for 3D Medical Image SegmentationPoster182 citations
- Interpretable and Accurate Fine-grained Recognition via Region GroupingOral182 citations
- Just Go With the Flow: Self-Supervised Scene Flow EstimationOral182 citations
- Rethinking Zero-Shot Video Classification: End-to-End Training for Realistic ApplicationsPoster182 citations
- End-to-End Adversarial-Attention Network for Multi-Modal ClusteringPoster181 citations
- PSGAN: Pose and Expression Robust Spatial-Aware GAN for Customizable Makeup TransferOral181 citations
- Reliable Weighted Optimal Transport for Unsupervised Domain AdaptationPoster181 citations
- Few Sample Knowledge Distillation for Efficient Network CompressionPoster180 citations
- Towards Unsupervised Learning of Generative Models for 3D Controllable Image SynthesisPoster180 citations
- Unsupervised Multi-Modal Image Registration via Geometry Preserving Image-to-Image TranslationPoster180 citations
- Benchmarking the Robustness of Semantic Segmentation ModelsPoster179 citations
- More Grounded Image Captioning by Distilling Image-Text Matching ModelPoster179 citations
- ScrabbleGAN: Semi-Supervised Varying Length Handwritten Text GenerationPoster179 citations
- Detecting Adversarial Samples Using Influence Functions and Nearest NeighborsPoster178 citations
- Hyperbolic Visual Embedding Learning for Zero-Shot RecognitionPoster178 citations
- Improving Action Segmentation via Graph-Based Temporal ReasoningPoster178 citations
- Multi-Path Region Mining for Weakly Supervised 3D Semantic Segmentation on Point CloudsPoster178 citations
- EmotiCon: Context-Aware Multimodal Emotion Recognition Using Frege's PrinciplePoster177 citations
- Filter Response Normalization Layer: Eliminating Batch Dependence in the Training of Deep Neural NetworksOral177 citations
- Heterogeneous Knowledge Distillation Using Information Flow ModelingPoster177 citations
- Self-Supervised Scene De-OcclusionOral177 citations
- Fast Sparse ConvNetsPoster176 citations
- SG-NN: Sparse Generative Neural Networks for Self-Supervised Scene Completion of RGB-D ScansPoster176 citations
- Detailed 2D-3D Joint Representation for Human-Object InteractionPoster175 citations
- Video Modeling With Correlation NetworksPoster175 citations
- Distilling Effective Supervision From Severe Label NoisePoster174 citations
- What Can Be Transferred: Unsupervised Domain Adaptation for Endoscopic Lesions SegmentationPoster173 citations
- Adaptive Hierarchical Down-Sampling for Point Cloud ClassificationPoster172 citations
- Novel View Synthesis of Dynamic Scenes With Globally Coherent Depths From a Monocular CameraPoster172 citations
- Two Causal Principles for Improving Visual DialogPoster172 citations
- Generating 3D People in Scenes Without PeopleOral171 citations
- Uncertainty-Aware Score Distribution Learning for Action Quality AssessmentOral171 citations
- LatentFusion: End-to-End Differentiable Reconstruction and Rendering for Unseen Object Pose EstimationPoster170 citations
- Can Weight Sharing Outperform Random Architecture Search? An Investigation With TuNASPoster169 citations
- Deep Polarization Cues for Transparent Object SegmentationOral169 citations
- Joint Semantic Segmentation and Boundary Detection Using Iterative Pyramid ContextsPoster169 citations
- SESS: Self-Ensembling Semi-Supervised 3D Object DetectionOral169 citations
- Structure Boundary Preserving Segmentation for Medical Image With Ambiguous BoundaryPoster169 citations
- Generalized Zero-Shot Learning via Over-Complete DistributionPoster168 citations
- Learning Fast and Robust Target Models for Video Object SegmentationOral168 citations
- MiLeNAS: Efficient Neural Architecture Search via Mixed-Level ReformulationPoster168 citations
- Reverse Perspective Network for Perspective-Aware Object CountingPoster168 citations
- ClusterFit: Improving Generalization of Visual RepresentationsPoster167 citations
- Evolving Losses for Unsupervised Video Representation LearningOral167 citations
- Explaining Knowledge Distillation by Quantifying the KnowledgePoster166 citations
- Neural Cages for Detail-Preserving 3D DeformationsOral166 citations
- Neural Network Pruning With Residual-Connections and Limited-DataOral166 citations
- Understanding Adversarial Examples From the Mutual Influence of Images and PerturbationsPoster166 citations
- Deep Homography Estimation for Dynamic ScenesPoster165 citations
- Densely Connected Search Space for More Flexible Neural Architecture SearchPoster165 citations
- Don't Hit Me! Glass Detection in Real-World ScenesPoster165 citations
- FocalMix: Semi-Supervised Learning for 3D Medical Image DetectionPoster165 citations
- Context R-CNN: Long Term Temporal Context for Per-Camera Object DetectionPoster164 citations
- Correlation-Guided Attention for Corner Detection Based Visual TrackingPoster164 citations
- Transferring Cross-Domain Knowledge for Video Sign Language RecognitionOral164 citations
- Unified Dynamic Convolutional Network for Super-Resolution With Variational DegradationsPoster164 citations
- Auto-Encoding Twin-Bottleneck HashingPoster163 citations
- DOA-GAN: Dual-Order Attentive Generative Adversarial Network for Image Copy-Move Forgery Detection and LocalizationPoster163 citations
- Norm-Aware Embedding for Efficient Person SearchPoster163 citations
- Robust Object Detection Under Occlusion With Context-Aware CompositionalNetsPoster163 citations
- Seeing Around Street Corners: Non-Line-of-Sight Detection and Tracking In-the-Wild Using Doppler RadarPoster163 citations
- Through Fog High-Resolution Imaging Using Millimeter Wave RadarPoster163 citations
- Detecting Attended Visual Targets in VideoPoster161 citations
- Dynamic Graph Message Passing NetworksOral161 citations
- Sketchformer: Transformer-Based Representation for Sketched StructurePoster161 citations
- Global-Local Bidirectional Reasoning for Unsupervised Representation Learning of 3D Point CloudsPoster160 citations
- SDC-Depth: Semantic Divide-and-Conquer Network for Monocular Depth EstimationPoster160 citations
- State-Relabeling Adversarial Active LearningOral160 citations
- Counting Out Time: Class Agnostic Video Repetition Counting in the WildPoster159 citations
- TransMatch: A Transfer-Learning Scheme for Semi-Supervised Few-Shot LearningPoster159 citations
- AdaBits: Neural Network Quantization With Adaptive Bit-WidthsPoster158 citations
- Interactive Object Segmentation With Inside-Outside GuidanceOral158 citations
- ROAM: Recurrently Optimizing Tracking ModelPoster158 citations
- Counterfactual Vision and Language LearningOral157 citations
- Learning From Synthetic AnimalsOral157 citations
- Neural Head Reenactment with Latent Pose DescriptorsPoster157 citations
- Combining Detection and Tracking for Human Pose Estimation in VideosOral156 citations
- Efficient Adversarial Training With Transferable Adversarial ExamplesPoster156 citations
- Inter-Region Affinity Distillation for Road Marking SegmentationPoster156 citations
- Phase Consistent Ecological Domain AdaptationPoster156 citations
- Semantic Correspondence as an Optimal Transport ProblemPoster156 citations
- Towards Inheritable Models for Open-Set Domain AdaptationOral156 citations
- 3D Sketch-Aware Semantic Scene Completion via Semi-Supervised Structure PriorPoster155 citations
- A Local-to-Global Approach to Multi-Modal Movie Scene SegmentationPoster155 citations
- Anisotropic Convolutional Networks for 3D Semantic Scene CompletionPoster155 citations
- Learning to Cartoonize Using White-Box Cartoon RepresentationsPoster155 citations
- Deep White-Balance EditingOral154 citations
- Stylization-Based Architecture for Fast Deep Exemplar ColorizationPoster154 citations
- Towards Transferable Targeted AttackPoster154 citations
- MANTRA: Memory Augmented Networks for Multiple Trajectory PredictionPoster153 citations
- Rethinking Computer-Aided Tuberculosis DiagnosisOral153 citations
- A Transductive Approach for Video Object SegmentationPoster152 citations
- ColorFool: Semantic Adversarial ColorizationPoster152 citations
- Ego-Topo: Environment Affordances From Egocentric VideoOral152 citations
- Erasing Integrated Learning: A Simple Yet Effective Approach for Weakly Supervised Object LocalizationOral152 citations
- GeoDA: A Geometric Framework for Black-Box Adversarial AttacksPoster152 citations
- Hierarchical Scene Coordinate Classification and Regression for Visual LocalizationPoster152 citations
- Towards High-Fidelity 3D Face Reconstruction From In-the-Wild Images Using Graph Convolutional NetworksPoster152 citations
- Adversarial Vertex Mixup: Toward Better Adversarially Robust GeneralizationOral151 citations
- Creating Something From Nothing: Unsupervised Knowledge Distillation for Cross-Modal HashingPoster151 citations
- EcoNAS: Finding Proxies for Economical Neural Architecture SearchPoster151 citations
- Guided Variational Autoencoder for Disentanglement LearningPoster151 citations
- Rethinking Differentiable Search for Mixed-Precision Neural NetworksPoster151 citations
- SketchyCOCO: Image Generation From Freehand Scene SketchesOral151 citations
- Symmetry and Group in Attribute-Object CompositionsPoster151 citations
- What You See is What You Get: Exploiting Visibility for 3D Object DetectionOral151 citations
- How Useful Is Self-Supervised Pretraining for Visual Tasks?Poster150 citations
- Multi-Modal Graph Neural Network for Joint Reasoning on Vision and Scene TextPoster150 citations
- TITAN: Future Forecast Using Action PriorsOral150 citations
- The Edge of Depth: Explicit Constraints Between Segmentation and DepthPoster150 citations
- Weakly-Supervised 3D Human Pose Learning via Multi-View Images in the WildPoster150 citations
- Action Segmentation With Joint Self-Supervised Temporal Domain AdaptationPoster149 citations
- Cross-Modal Pattern-Propagation for RGB-T TrackingPoster149 citations
- State-Aware Tracker for Real-Time Video Object SegmentationPoster149 citations
- A Stochastic Conditioning Scheme for Diverse Human Motion PredictionPoster148 citations
- Rotate-and-Render: Unsupervised Photorealistic Face Rotation From Single-View ImagesPoster148 citations
- Scale-Equalizing Pyramid Convolution for Object DetectionPoster148 citations
- There and Back Again: Revisiting Backpropagation Saliency MethodsPoster148 citations
- Explainable Object-Induced Action Decision for Autonomous VehiclesPoster147 citations
- Lightweight Multi-View 3D Pose Estimation Through Camera-Disentangled RepresentationPoster147 citations
- Mask Encoding for Single Shot Instance SegmentationPoster147 citations
- Open Compound Domain AdaptationOral147 citations
- Uncertainty-Aware CNNs for Depth Completion: Uncertainty from Beginning to EndPoster147 citations
- Semantic Image Manipulation Using Scene GraphsPoster146 citations
- Disp R-CNN: Stereo 3D Object Detection via Shape Prior Guided Instance Disparity EstimationPoster145 citations
- RiFeGAN: Rich Feature Generation for Text-to-Image Synthesis From Prior KnowledgePoster145 citations
- End-to-End Learning Local Multi-View Descriptors for 3D Point CloudsPoster144 citations
- Supervised Raw Video Denoising With a Benchmark Dataset on Dynamic ScenesPoster142 citations
- Cascaded Human-Object Interaction RecognitionPoster141 citations
- Don't Judge an Object by Its Context: Learning to Overcome Contextual BiasOral141 citations
- A Unified Object Motion and Affinity Model for Online Multi-Object TrackingPoster139 citations
- Deep Distance Transform for Tubular Structure Segmentation in CT ScansOral139 citations
- Defending Against Model Stealing Attacks With Adaptive MisinformationPoster139 citations
- SegGCN: Efficient 3D Point Cloud Segmentation With Fuzzy Spherical KernelPoster139 citations
- TCTS: A Task-Consistent Two-Stage Framework for Person SearchPoster139 citations
- Learning Physics-Guided Face Relighting Under Directional LightOral138 citations
- Learning to Simulate Dynamic Environments With GameGANPoster138 citations
- Multi-Granularity Reference-Aided Attentive Feature Aggregation for Video-Based Person Re-IdentificationPoster138 citations
- Multimodal Categorization of Crisis Events in Social MediaPoster138 citations
- DNU: Deep Non-Local Unrolling for Computational Spectral ImagingPoster137 citations
- KeyPose: Multi-View 3D Labeling and Keypoint Estimation for Transparent ObjectsPoster137 citations
- An Efficient PointLSTM for Point Clouds Based Gesture RecognitionPoster136 citations
- Gait Recognition via Semi-supervised Disentangled Representation Learning to Identity and Covariate FeaturesPoster136 citations
- GrappaNet: Combining Parallel Imaging With Deep Learning for Multi-Coil MRI ReconstructionPoster136 citations
- Hierarchical Human Parsing With Typed Part-Relation ReasoningPoster136 citations
- Hit-Detector: Hierarchical Trinity Architecture Search for Object DetectionPoster136 citations
- Holistically-Attracted Wireframe ParsingPoster136 citations
- Joint Demosaicing and Denoising With Self GuidancePoster136 citations
- Learning to Transfer Texture From Clothing Images to 3D HumansPoster136 citations
- Predicting Goal-Directed Human Attention Using Inverse Reinforcement LearningOral136 citations
- S3VAE: Self-Supervised Sequential VAE for Representation Disentanglement and Data GenerationPoster136 citations
- Sketch Less for More: On-the-Fly Fine-Grained Sketch-Based Image RetrievalOral135 citations
- Collaborative Distillation for Ultra-Resolution Universal Style TransferPoster134 citations
- Exploring Spatial-Temporal Multi-Frequency Analysis for High-Fidelity and Temporal-Consistency Video PredictionPoster134 citations
- FReeNet: Multi-Identity Face ReenactmentPoster134 citations
- Where Does It Exist: Spatio-Temporal Video Grounding for Multi-Form SentencesPoster134 citations
- Deep Residual Flow for Out of Distribution DetectionPoster133 citations
- Few-Shot Open-Set Recognition Using Meta-LearningPoster133 citations
- Flow Contrastive Estimation of Energy-Based ModelsOral133 citations
- G2L-Net: Global to Local Network for Real-Time 6D Pose Estimation With Embedding Vector FeaturesPoster133 citations
- Self-Supervised Monocular Scene Flow EstimationOral133 citations
- Unsupervised Learning for Intrinsic Image Decomposition From a Single ImagePoster133 citations
- Cascade EF-GAN: Progressive Facial Expression Editing With Local FocusesOral132 citations
- Diverse Image Generation via Self-Conditioned GANsPoster132 citations
- Joint 3D Instance Segmentation and Object Detection for Autonomous DrivingPoster132 citations
- Learning Representations by Predicting Bags of Visual WordsPoster132 citations
- Polarized Reflection Removal With Perfect Alignment in the WildPoster132 citations
- Learning the Redundancy-Free Features for Generalized Zero-Shot Object RecognitionPoster131 citations
- Orderless Recurrent Models for Multi-Label ClassificationPoster131 citations
- Tangent Images for Mitigating Spherical DistortionPoster131 citations
- Three-Dimensional Reconstruction of Human InteractionsPoster131 citations
- DualSDF: Semantic Shape Manipulation Using a Two-Level RepresentationPoster130 citations
- Iteratively-Refined Interactive 3D Medical Image Segmentation With Multi-Agent Reinforcement LearningPoster130 citations
- LG-GAN: Label Guided Adversarial Network for Flexible Targeted Attack of Point Cloud Based Deep NetworksPoster130 citations
- Learning Individual Speaking Styles for Accurate Lip to Speech SynthesisPoster130 citations
- Learning Unsupervised Hierarchical Part Decomposition of 3D Objects From a Single RGB ImagePoster130 citations
- PhraseCut: Language-Based Image Segmentation in the WildPoster130 citations
- Unsupervised Adaptation Learning for Hyperspectral Imagery Super-ResolutionPoster130 citations
- Enhanced Blind Face Restoration With Multi-Exemplar Images and Adaptive Spatial Feature FusionOral129 citations
- GroupFace: Learning Latent Groups and Constructing Group-Based Representations for Face RecognitionPoster129 citations
- SpSequenceNet: Semantic Segmentation Network on 4D Point CloudsPoster129 citations
- Space-Time-Aware Multi-Resolution Video EnhancementPoster129 citations
- End-to-End Learnable Geometric Vision by Backpropagating PnP OptimizationPoster128 citations
- Total Deep Variation for Linear Inverse ProblemsOral128 citations
- Adaptive Graph Convolutional Network With Attention Graph Clustering for Co-Saliency DetectionPoster127 citations
- Diversified Arbitrary Style Transfer via Deep Feature PerturbationPoster127 citations
- Learning Rank-1 Diffractive Optics for Single-Shot High Dynamic Range ImagingOral127 citations
- Oops! Predicting Unintentional Action in VideoPoster127 citations
- 3DV: 3D Dynamic Voxel for Action Recognition in Depth VideoPoster126 citations
- Learning From Noisy Anchors for One-Stage Object DetectionPoster126 citations
- On the General Value of Evidence, and Bilingual Scene-Text Visual Question AnsweringPoster126 citations
- Unsupervised Representation Learning for Gaze EstimationPoster126 citations
- A Shared Multi-Attention Framework for Multi-Label Zero-Shot LearningOral125 citations
- Autolabeling 3D Objects With Differentiable Rendering of SDF Shape PriorsOral125 citations
- Discriminative Multi-Modality Speech RecognitionPoster125 citations
- Learning to Forget for Meta-LearningPoster125 citations
- Multiple Anchor Learning for Visual Object DetectionPoster125 citations
- SmallBigNet: Integrating Core and Contextual Views for Video ClassificationPoster125 citations
- SurfelGAN: Synthesizing Realistic Sensor Data for Autonomous DrivingOral125 citations
- 3D Human Mesh Regression With Dense CorrespondencePoster124 citations
- EventCap: Monocular 3D Capture of High-Speed Human Motions Using an Event CameraOral124 citations
- Learning Longterm Representations for Person Re-Identification Using Radio SignalsPoster124 citations
- Prior Guided GAN Based Semantic InpaintingPoster124 citations
- Transform and Tell: Entity-Aware News Image CaptioningPoster124 citations
- A Multigrid Method for Efficiently Training Video ModelsOral123 citations
- Attention-Aware Multi-View StereoPoster123 citations
- ClusterVO: Clustering Moving Instances and Estimating Visual Odometry for Self and SurroundingsPoster123 citations
- Compressed Volumetric Heatmaps for Multi-Person 3D Pose EstimationPoster123 citations
- EventSR: From Asynchronous Events to Image Reconstruction, Restoration, and Super-Resolution via End-to-End Adversarial LearningPoster123 citations
- Multi-View Neural Human RenderingPoster123 citations
- Collaborative Motion Prediction via Neural Motion Message PassingOral122 citations
- Image Demoireing with Learnable Bandpass FiltersPoster122 citations
- Learning Formation of Physically-Based Face AttributesPoster122 citations
- Multi-Path Learning for Object Pose Estimation Across DomainsPoster122 citations
- Efficient Dynamic Scene Deblurring Using Spatially Variant Deconvolution Network With Optical Flow Guided TrainingPoster121 citations
- Optimizing Rank-Based Metrics With Blackbox DifferentiationOral121 citations
- Unsupervised Domain Adaptation With Hierarchical Gradient SynchronizationPoster121 citations
- Compositional Convolutional Neural Networks: A Deep Architecture With Innate Robustness to Partial OcclusionPoster120 citations
- Graph-Guided Architecture Search for Real-Time Semantic SegmentationPoster120 citations
- Hypergraph Attention Networks for Multimodal LearningPoster120 citations
- Leveraging 2D Data to Learn Textured 3D Mesh GenerationOral120 citations
- The Knowledge Within: Methods for Data-Free Model CompressionPoster120 citations
- Instance Guided Proposal Network for Person SearchOral119 citations
- Lighthouse: Predicting Lighting Volumes for Spatially-Coherent IlluminationPoster119 citations
- MoreFusion: Multi-object Reasoning for 6D Pose Estimation from Volumetric FusionPoster119 citations
- Rethinking the Route Towards Weakly Supervised Object LocalizationPoster119 citations
- Semi-Supervised Semantic Image Segmentation With Self-Correcting NetworksPoster119 citations
- Warping Residual Based Image Stitching for Large ParallaxPoster119 citations
- OrigamiNet: Weakly-Supervised, Segmentation-Free, One-Step, Full Page Text Recognition by learning to unfoldPoster118 citations
- Attentive Weights Generation for Few Shot Learning via Information MaximizationPoster117 citations
- Cross-Domain Semantic Segmentation via Domain-Invariant Interactive Relation TransferPoster117 citations
- Future Video Synthesis With Object Motion PredictionPoster117 citations
- Image Based Virtual Try-On Network From Unpaired DataOral117 citations
- Progressive Relation Learning for Group Activity RecognitionPoster117 citations
- VecRoad: Point-Based Iterative Graph Exploration for Road Graphs ExtractionPoster117 citations
- Learn to Augment: Joint Data Augmentation and Network Optimization for Text RecognitionPoster116 citations
- Learning to Cluster Faces via Confidence and Connectivity EstimationPoster116 citations
- Associate-3Ddet: Perceptual-to-Conceptual Association for 3D Point Cloud Object DetectionPoster115 citations
- Cross-View Tracking for Multi-Human 3D Pose Estimation at Over 100 FPSPoster115 citations
- Robust Reference-Based Super-Resolution With Similarity-Aware Deformable ConvolutionPoster115 citations
- Semantically Multi-Modal Image SynthesisPoster115 citations
- Smooth Shells: Multi-Scale Shape Registration With Functional MapsOral115 citations
- AdversarialNAS: Adversarial Neural Architecture Search for GANsPoster114 citations
- High-Resolution Daytime Translation Without Domain LabelsOral114 citations
- Adaptive Fractional Dilated Convolution Network for Image Aesthetics AssessmentPoster113 citations
- Articulation-Aware Canonical Surface MappingPoster113 citations
- Boosting Semantic Human Matting With Coarse AnnotationsOral113 citations
- C-Flow: Conditional Generative Flow Models for Images and 3D Point CloudsPoster113 citations
- Synthetic Learning: Learn From Distributed Asynchronized Discriminator GAN Without Sharing Medical Image DataPoster113 citations
- Universal Weighting Metric Learning for Cross-Modal MatchingPoster113 citations
- You2Me: Inferring Body Pose in Egocentric Video via First and Second Person InteractionsOral113 citations
- A Novel Recurrent Encoder-Decoder Structure for Large-Scale Multi-View Stereo Reconstruction From an Open Aerial DatasetPoster112 citations
- FALCON: A Fourier Transform Based Approach for Fast and Secure Convolutional Neural Network PredictionsOral112 citations
- G3AN: Disentangling Appearance and Motion for Video GenerationPoster112 citations
- Learning Invariant Representation for Unsupervised Image RestorationPoster112 citations
- Learning to Segment the TailPoster112 citations
- A Context-Aware Loss Function for Action Spotting in Soccer VideosPoster111 citations
- Bi-Directional Interaction Network for Person SearchPoster111 citations
- Fashion Outfit Complementary Item RetrievalPoster111 citations
- HUMBI: A Large Multiview Dataset of Human Body ExpressionsPoster111 citations
- Learning Better Lossless Compression Using Lossy CompressionPoster111 citations
- Pattern-Structure Diffusion for Multi-Task LearningPoster111 citations
- COCAS: A Large-Scale Clothes Changing Person Dataset for Re-IdentificationPoster110 citations
- Joint Filtering of Intensity Images and Neuromorphic Events for High-Resolution Noise-Robust ImagingPoster110 citations
- Neuromorphic Camera Guided High Dynamic Range ImagingPoster110 citations
- PANDA: A Gigapixel-Level Human-Centric Video DatasetPoster110 citations
- Factorized Higher-Order CNNs With an Application to Spatio-Temporal Emotion EstimationPoster109 citations
- Graph-Structured Referring Expression Reasoning in the WildOral109 citations
- L2-GCN: Layer-Wise and Learned Efficient Training of Graph Convolutional NetworksPoster109 citations
- MTL-NAS: Task-Agnostic Neural Architecture Search Towards General-Purpose Multi-Task LearningPoster109 citations
- Memory Aggregation Networks for Efficient Interactive Video Object SegmentationPoster109 citations
- Normal Assisted Stereo Depth EstimationPoster109 citations
- Self-Supervised 3D Human Pose Estimation via Part Guided Novel Image SynthesisOral109 citations
- CenterMask: Single Shot Instance Segmentation With Point RepresentationPoster108 citations
- Defending and Harnessing the Bit-Flip Based Adversarial Weight AttackPoster108 citations
- DR Loss: Improving Object Detection by Distributional RankingPoster107 citations
- DualConvMesh-Net: Joint Geodesic and Euclidean Convolutions on 3D MeshesOral107 citations
- Solving Mixed-Modal Jigsaw Puzzle for Fine-Grained Sketch-Based Image RetrievalPoster107 citations
- Two-Shot Spatially-Varying BRDF and Shape EstimationPoster107 citations
- ARShadowGAN: Shadow Generative Adversarial Network for Augmented Reality in Single Light ScenesPoster106 citations
- DeFeat-Net: General Monocular Depth via Simultaneous Unsupervised Representation LearningPoster106 citations
- Don't Even Look Once: Synthesizing Features for Zero-Shot DetectionPoster106 citations
- Private-kNN: Practical Differential Privacy for Computer VisionPoster106 citations
- Transferable, Controllable, and Inconspicuous Adversarial Attacks on Person Re-identification With Deep Mis-RankingOral106 citations
- Breaking the Cycle - Colleagues Are All You NeedPoster105 citations
- Cooling-Shrinking Attack: Blinding the Tracker With Imperceptible NoisesPoster105 citations
- DeepFLASH: An Efficient Network for Learning-Based Medical Image RegistrationPoster105 citations
- 4D Association Graph for Realtime Multi-Person Motion Capture Using Multiple Video CamerasOral104 citations
- Active Speakers in ContextPoster104 citations
- Exploring Data Aggregation in Policy Learning for Vision-Based Urban Autonomous DrivingPoster104 citations
- IntrA: 3D Intracranial Aneurysm Dataset for Deep LearningOral104 citations
- Learning a Neural 3D Texture Space From 2D ExemplarsPoster104 citations
- Neural Point Cloud Rendering via Multi-Plane ProjectionPoster104 citations
- Weakly Supervised Fine-Grained Image Classification via Guassian Mixture Model Oriented Discriminative LearningOral104 citations
- Bi3D: Stereo Depth Estimation via Binary ClassificationsPoster103 citations
- Blurry Video Frame InterpolationOral103 citations
- Channel Attention Based Iterative Residual Learning for Depth Map Super-ResolutionPoster103 citations
- Efficient Derivative Computation for Cumulative B-Splines on Lie GroupsOral103 citations
- Hierarchical Pyramid Diverse Attention Networks for Face RecognitionPoster103 citations
- Overcoming Multi-Model Forgetting in One-Shot NAS With Diversity MaximizationPoster103 citations
- SAM: The Sensitivity of Attribution Methods to HyperparametersOral103 citations
- SCOUT: Self-Aware Discriminant Counterfactual ExplanationsPoster103 citations
- DeepDeform: Learning Non-Rigid RGB-D Reconstruction With Semi-Supervised DataPoster102 citations
- Enhancing Cross-Task Black-Box Transferability of Adversarial Examples With Dispersion ReductionPoster102 citations
- Learning Instance Occlusion for Panoptic SegmentationPoster102 citations
- Modality Shifting Attention Network for Multi-Modal Video Question AnsweringPoster102 citations
- Multi-Dimensional Pruning: A Unified Framework for Model CompressionOral102 citations
- MixNMatch: Multifactor Disentanglement and Encoding for Conditional Image GenerationPoster101 citations
- Retina-Like Visual Image Reconstruction via Spiking Neural ModelOral101 citations
- Towards Backward-Compatible Representation LearningOral101 citations
- Weakly-Supervised Domain Adaptation via GAN and Mesh Model for Estimating 3D Hand Poses Interacting ObjectsOral101 citations
- Discrete Model Compression With Resource Constraint for Deep Neural NetworksPoster100 citations
- From Depth What Can You See? Depth Completion via Auxiliary Image ReconstructionPoster100 citations
- Learning to Discriminate Information for Online Action DetectionPoster100 citations
- One-Shot Adversarial Attacks on Visual Tracking With Dual AttentionPoster100 citations
- Self-Supervised Learning of Interpretable Keypoints From Unlabelled VideosOral100 citations
- Taking a Deeper Look at Co-Salient Object DetectionPoster100 citations
- Attribution in Scale and SpacePoster99 citations
- KFNet: Learning Temporal Camera Relocalization Using Kalman FilteringOral99 citations
- Look-Into-Object: Self-Supervised Structure Modeling for Object RecognitionPoster99 citations
- Progressive Mirror DetectionPoster99 citations
- Robust Partial Matching for Person Search in the WildPoster99 citations
- A Disentangling Invertible Interpretation Network for Explaining Latent RepresentationsPoster98 citations
- Single Image Reflection Removal With Physically-Based Training ImagesOral98 citations
- Training Noise-Robust Deep Neural Networks via Meta-LearningPoster98 citations
- Unsupervised Instance Segmentation in Microscopy Images via Panoptic Domain Adaptation and Task Re-WeightingPoster98 citations
- Correspondence Networks With Adaptive Neighbourhood ConsensusPoster97 citations
- Deep 3D Capture: Geometry and Reflectance From Sparse Multi-View ImagesPoster97 citations
- Instance Shadow DetectionPoster97 citations
- Interactive Multi-Label CNN Learning With Partial LabelsPoster97 citations
- Reinforced Feature Points: Optimizing Feature Detection and Description for a High-Level TaskOral97 citations
- RoutedFusion: Learning Real-Time Depth Map FusionOral97 citations
- Search to Distill: Pearls Are Everywhere but Not the EyesOral97 citations
- Two-Stage Peer-Regularized Feature Recombination for Arbitrary Image Style TransferPoster97 citations
- Upgrading Optical Flow to 3D Scene Flow Through Optical ExpansionOral97 citations
- Correction Filter for Single Image Super-Resolution: Robustifying Off-the-Shelf Deep Super-ResolversOral96 citations
- FeatureFlow: Robust Video Interpolation via Structure-to-Texture GenerationPoster96 citations
- Inflated Episodic Memory With Region Self-Attention for Long-Tailed Visual RecognitionPoster96 citations
- LT-Net: Label Transfer by Learning Reversible Voxel-Wise Correspondence for One-Shot Medical Image SegmentationPoster96 citations
- Learning Multi-Object Tracking and Segmentation From Automatic AnnotationsPoster96 citations
- STAViS: Spatio-Temporal AudioVisual Saliency NetworkPoster96 citations
- Unity Style Transfer for Person Re-IdentificationPoster96 citations
- Composed Query Image Retrieval Using Locally Bounded FeaturesPoster95 citations
- CookGAN: Causality Based Text-to-Image SynthesisPoster95 citations
- Event Probability Mask (EPM) and Event Denoising Convolutional Neural Network (EDnCNN) for Neuromorphic CamerasPoster95 citations
- On Isometry Robustness of Deep 3D Point Cloud Models Under Adversarial AttacksPoster95 citations
- P-nets: Deep Polynomial Neural NetworksPoster95 citations
- SLV: Spatial Likelihood Voting for Weakly Supervised Object DetectionPoster95 citations
- Training Quantized Neural Networks With a Full-Precision Auxiliary ModuleOral95 citations
- 3FabRec: Fast Few-Shot Face Alignment by ReconstructionOral94 citations
- DUNIT: Detection-Based Unsupervised Image-to-Image TranslationPoster94 citations
- Decoupled Representation Learning for Skeleton-Based Gesture RecognitionPoster94 citations
- Exploring Category-Agnostic Clusters for Open-Set Domain AdaptationPoster94 citations
- Real-Time Panoptic Segmentation From Dense DetectionsOral94 citations
- Domain Balancing: Face Recognition on Long-Tailed DomainsPoster93 citations
- End-to-End Camera Calibration for Broadcast VideosPoster93 citations
- GAMIN: Generative Adversarial Multiple Imputation Network for Highly Missing DataPoster93 citations
- HandVoxNet: Deep Voxel-Based Network for 3D Hand Shape and Pose Estimation From a Single Depth MapPoster93 citations
- Towards Verifying Robustness of Neural Networks Against A Family of Semantic PerturbationsOral93 citations
- BANet: Bidirectional Aggregation Network With Occlusion Handling for Panoptic SegmentationOral92 citations
- Beyond Short-Term Snippet: Video Relation Detection With Spatio-Temporal Global ContextPoster92 citations
- Deep Fair Clustering for Visual LearningPoster92 citations
- Fashion Editing With Adversarial Parsing LearningPoster92 citations
- Knowledge As Priors: Cross-Modal Knowledge Generalization for Datasets Without Superior KnowledgePoster92 citations
- Telling Left From Right: Learning Spatial Correspondence of Sight and SoundOral92 citations
- Distilled Semantics for Comprehensive Scene Understanding from VideosPoster91 citations
- Learning Situational DrivingPoster91 citations
- STEFANN: Scene Text Editor Using Font Adaptive Neural NetworkPoster91 citations
- End-to-End Optimization of Scene LayoutOral90 citations
- Improving One-Shot NAS by Suppressing the Posterior FadingPoster90 citations
- Learn2Perturb: An End-to-End Feature Perturbation Learning to Improve Adversarial RobustnessPoster90 citations
- Optical Non-Line-of-Sight Physics-Based 3D Human Pose EstimationPoster90 citations
- Self-Supervised Deep Visual Odometry With Online AdaptationOral90 citations
- Stochastic Sparse Subspace ClusteringPoster90 citations
- BiDet: An Efficient Binarized Object DetectorPoster89 citations
- FGN: Fully Guided Network for Few-Shot Instance SegmentationPoster89 citations
- Hierarchical Graph Attention Network for Visual Relationship DetectionPoster89 citations
- KeypointNet: A Large-Scale 3D Keypoint Dataset Aggregated From Numerous Human AnnotationsPoster89 citations
- Memory-Efficient Hierarchical Neural Architecture Search for Image DenoisingPoster89 citations
- Real-World Person Re-Identification via Degradation Invariance LearningPoster89 citations
- SwapText: Image Based Texts Transfer in ScenesPoster89 citations
- Global-Local GCN: Large-Scale Label Noise Cleansing for Face RecognitionPoster88 citations
- Learning Video Stabilization Using Optical FlowPoster88 citations
- Learning When and Where to Zoom With Deep Reinforcement LearningOral88 citations
- Towards Robust Image Classification Using Sequential Attention ModelsPoster88 citations
- Unifying Training and Inference for Panoptic SegmentationPoster88 citations
- A Semi-Supervised Assessor of Neural ArchitecturesPoster87 citations
- Attention-Driven Cropping for Very High Resolution Facial Landmark DetectionPoster87 citations
- Organ at Risk Segmentation for Head and Neck Cancer Using Stratified Learning and Neural Architecture SearchPoster87 citations
- SCT: Set Constrained Temporal Transformer for Set Supervised Action SegmentationPoster87 citations
- Unpaired Portrait Drawing Generation via Asymmetric Cycle MappingPoster87 citations
- Basis Prediction Networks for Effective Burst Denoising With Large KernelsPoster86 citations
- Deep Adversarial Decomposition: A Unified Framework for Separating Superimposed ImagesPoster86 citations
- Geometric Structure Based and Regularized Depth Estimation From 360 Indoor ImageryPoster86 citations
- PointGMM: A Neural GMM Network for Point CloudsPoster86 citations
- Learning Visual Motion Segmentation Using Event SurfacesPoster85 citations
- Learning to Evaluate Perception Models Using Planner-Centric MetricsPoster85 citations
- PandaNet: Anchor-Based Single-Shot Multi-Person 3D Pose EstimationPoster85 citations
- SQuINTing at VQA Models: Introspecting VQA Models With Sub-QuestionsOral85 citations
- Smoothing Adversarial Domain Attack and P-Memory Reconsolidation for Cross-Domain Person Re-IdentificationPoster85 citations
- Through the Looking Glass: Neural 3D Reconstruction of Transparent ShapesOral85 citations
- Unsupervised Reinforcement Learning of Transferable Meta-Skills for Embodied NavigationPoster85 citations
- Single Image Optical Flow Estimation With an Event CameraPoster84 citations
- Your Local GAN: Designing Two Dimensional Local Attention Mechanisms for Generative ModelsPoster84 citations
- 4D Visualization of Dynamic Events From Unconstrained Multi-View VideosPoster83 citations
- Disentangled Image Generation Through Structured Noise InjectionOral83 citations
- Non-Line-of-Sight Surface Reconstruction Using the Directional Light-Cone TransformOral83 citations
- BidNet: Binocular Image Dehazing Without Explicit Disparity EstimationPoster82 citations
- Computing the Testing Error Without a Testing SetOral82 citations
- Correlating Edge, Pose With ParsingPoster82 citations
- Fast Template Matching and Update for Video Object Tracking and SegmentationPoster82 citations
- Intra- and Inter-Action Understanding via Temporal Action ParsingPoster82 citations
- Progressive Adversarial Networks for Fine-Grained Domain AdaptationPoster82 citations
- Self-Learning Video Rain Streak Removal: When Cyclic Consistency Meets Temporal CorrespondencePoster82 citations
- IDA-3D: Instance-Depth-Aware 3D Object Detection From Stereo Vision for Autonomous DrivingPoster81 citations
- Robust Superpixel-Guided Attentional Adversarial AttackPoster81 citations
- STINet: Spatio-Temporal-Interactive Network for Pedestrian Detection and Trajectory PredictionPoster81 citations
- BEDSR-Net: A Deep Shadow Removal Network From a Single Document ImagePoster80 citations
- Fusing Wearable IMUs With Multi-View Images for Human Pose Estimation: A Geometric ApproachPoster80 citations
- Hardware-in-the-Loop End-to-End Optimization of Camera Image Processing PipelinesOral80 citations
- Selective Transfer With Reinforced Transfer Network for Partial Domain AdaptationPoster80 citations
- Sketch-BERT: Learning Sketch Bidirectional Encoder Representation From Transformers by Self-Supervised Learning of Sketch GestaltPoster80 citations
- An End-to-End Edge Aggregation Network for Moving Object SegmentationPoster79 citations
- Bidirectional Graph Reasoning Network for Panoptic SegmentationPoster79 citations
- Bodies at Rest: 3D Human Pose and Shape Estimation From a Pressure Image Using Synthetic DataOral79 citations
- Focus on Defocus: Bridging the Synthetic to Real Domain Gap for Depth EstimationPoster79 citations
- Learning Multi-View Camera Relocalization With Graph Neural NetworksPoster79 citations
- Learning Temporal Co-Attention Models for Unsupervised Video Action LocalizationOral79 citations
- Multiview-Consistent Semi-Supervised Learning for 3D Human Pose EstimationPoster79 citations
- Video Instance Segmentation Tracking With a Modified VAE ArchitecturePoster79 citations
- Conv-MPN: Convolutional Message Passing Neural Network for Structured Outdoor Architecture ReconstructionPoster78 citations
- Deep Active Learning for Biased Datasets via Fisher Kernel Self-SupervisionPoster78 citations
- Geometry-Aware Satellite-to-Ground Image Synthesis for Urban AreasPoster78 citations
- Learning to Super Resolve Intensity Images From EventsOral78 citations
- Self-Supervised Domain-Aware Generative Network for Generalized Zero-Shot LearningPoster78 citations
- Single-Step Adversarial Training With Dropout SchedulingPoster78 citations
- Speech2Action: Cross-Modal Supervision for Action RecognitionPoster78 citations
- Uncertainty-Aware Mesh Decoder for High Fidelity 3D Face ReconstructionPoster78 citations
- Unsupervised Learning From Video With Deep Neural EmbeddingsPoster78 citations
- Learning to See Through ObstructionsPoster77 citations
- SP-NAS: Serial-to-Parallel Backbone Search for Object DetectionPoster77 citations
- Violin: A Large-Scale Dataset for Video-and-Language InferencePoster77 citations
- Automatic Neural Network Compression by Sparsity-Quantization Joint Learning: A Constrained Optimization-Based ApproachPoster76 citations
- Background Data Resampling for Outlier-Aware ClassificationPoster76 citations
- FroDO: From Detections to 3D ObjectsPoster76 citations
- Improving the Robustness of Capsule Networks to Image Affine TransformationsPoster76 citations
- Learning Interactions and Relationships Between Movie CharactersOral76 citations
- On Vocabulary Reliance in Scene Text RecognitionPoster76 citations
- Show, Edit and Tell: A Framework for Editing Image CaptionsPoster76 citations
- Cops-Ref: A New Dataset and Task on Compositional Referring Expression ComprehensionPoster75 citations
- Deep Facial Non-Rigid Multi-View StereoPoster75 citations
- Deep Non-Line-of-Sight ReconstructionPoster75 citations
- Fusion-Aware Point Convolution for Online Semantic 3D Scene SegmentationPoster75 citations
- Large-Scale Object Detection in the Wild From Imbalanced Multi-LabelsOral75 citations
- MUXConv: Information Multiplexing in Convolutional Neural NetworksPoster75 citations
- Self-Supervised Learning of Video-Induced Visual InvariancesPoster75 citations
- Assessing Image Quality Issues for Real-World ProblemsPoster74 citations
- Cross-Spectral Face Hallucination via Disentangling Independent FactorsPoster74 citations
- Neural Networks Are More Productive Teachers Than Human Raters: Active Mixup for Data-Efficient Knowledge Distillation From a Blackbox ModelOral74 citations
- CONSAC: Robust Multi-Model Fitting by Conditional Sample ConsensusPoster73 citations
- Fast Video Object Segmentation With Temporal Aggregation Network and Dynamic Template MatchingPoster73 citations
CVPR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.