CVPR 2019 Accepted Papers
The full list of 1,294 papers accepted at CVPR 2019 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 1,006Oral: 288
- A Style-Based Generator Architecture for Generative Adversarial NetworksOral14,282 citations
- ArcFace: Additive Angular Margin Loss for Deep Face RecognitionOral8,474 citations
- Dual Attention Network for Scene SegmentationPoster7,468 citations
- Generalized Intersection Over Union: A Metric and a Loss for Bounding Box RegressionPoster6,789 citations
- Deep High-Resolution Representation Learning for Human Pose EstimationPoster6,183 citations
- PointPillars: Fast Encoders for Object Detection From Point CloudsPoster4,630 citations
- DeepSDF: Learning Continuous Signed Distance Functions for Shape RepresentationOral4,353 citations
- MnasNet: Platform-Aware Neural Architecture Search for MobilePoster4,089 citations
- Semantic Image Synthesis With Spatially-Adaptive NormalizationOral3,706 citations
- Occupancy Networks: Learning 3D Reconstruction in Function SpaceOral3,382 citations
- Selective Kernel NetworksPoster3,288 citations
- Class-Balanced Loss Based on Effective Number of SamplesPoster3,212 citations
- PointRCNN: 3D Object Proposal Generation and Detection From Point CloudPoster3,208 citations
- AutoAugment: Learning Augmentation Strategies From DataOral3,054 citations
- Deformable ConvNets V2: More Deformable, Better ResultsPoster2,819 citations
- SiamRPN++: Evolution of Siamese Visual Tracking With Very Deep NetworksOral2,748 citations
- GQA: A New Dataset for Real-World Visual Reasoning and Compositional Question AnsweringOral2,286 citations
- 4D Spatio-Temporal ConvNets: Minkowski Convolutional Neural NetworksPoster2,282 citations
- PointConv: Deep Convolutional Networks on 3D Point CloudsPoster2,178 citations
- Two-Stream Adaptive Graph Convolutional Networks for Skeleton-Based Action RecognitionPoster2,123 citations
- NAS-FPN: Learning Scalable Feature Pyramid Architecture for Object DetectionPoster2,118 citations
- Expressive Body Capture: 3D Hands, Face, and Body From a Single ImageOral2,080 citations
- Second-Order Attention Network for Single Image Super-ResolutionOral2,042 citations
- Bag of Tricks for Image Classification with Convolutional Neural NetworksPoster2,019 citations
- Panoptic SegmentationPoster2,011 citations
- MVTec AD -- A Comprehensive Real-World Dataset for Unsupervised Anomaly DetectionPoster2,006 citations
- Libra R-CNN: Towards Balanced Learning for Object DetectionPoster1,921 citations
- Relational Knowledge DistillationPoster1,916 citations
- Learning Implicit Fields for Generative Shape ModelingPoster1,851 citations
- BASNet: Boundary-Aware Salient Object DetectionPoster1,782 citations
- Fast Online Object Tracking and Segmentation: A Unifying ApproachPoster1,768 citations
- LaSOT: A High-Quality Benchmark for Large-Scale Single Object TrackingPoster1,750 citations
- Argoverse: 3D Tracking and Forecasting With Rich MapsOral1,736 citations
- Hybrid Task Cascade for Instance SegmentationPoster1,727 citations
- ADVENT: Adversarial Entropy Minimization for Domain Adaptation in Semantic SegmentationOral1,726 citations
- Panoptic Feature Pyramid NetworksOral1,715 citations
- Do Better ImageNet Models Transfer Better?Oral1,706 citations
- FBNet: Hardware-Aware Efficient ConvNet Design via Differentiable Neural Architecture SearchOral1,699 citations
- Large Scale Incremental LearningPoster1,682 citations
- Meta-Learning With Differentiable Convex OptimizationOral1,664 citations
- ATOM: Accurate Tracking by Overlap MaximizationOral1,659 citations
- LVIS: A Dataset for Large Vocabulary Instance SegmentationPoster1,621 citations
- Meta-Transfer Learning for Few-Shot LearningPoster1,552 citations
- On the Continuity of Rotation Representations in Neural NetworksPoster1,552 citations
- Filter Pruning via Geometric Median for Deep Convolutional Neural Networks AccelerationOral1,523 citations
- Learning a Unified Classifier Incrementally via RebalancingPoster1,518 citations
- Noise2Void - Learning Denoising From Single Noisy ImagesPoster1,486 citations
- Improving Transferability of Adversarial Examples With Input DiversityPoster1,481 citations
- Large-Scale Long-Tailed Recognition in an Open WorldOral1,471 citations
- 3D Human Pose Estimation in Video With Temporal Convolutions and Semi-Supervised TrainingPoster1,464 citations
- Multi-Label Image Recognition With Graph Convolutional NetworksPoster1,418 citations
- End-To-End Multi-Task Learning With AttentionPoster1,416 citations
- Actional-Structural Graph Convolutional Networks for Skeleton-Based Action RecognitionPoster1,391 citations
- PVNet: Pixel-Wise Voting Network for 6DoF Pose EstimationOral1,355 citations
- Pseudo-LiDAR From Visual Depth Estimation: Bridging the Gap in 3D Object Detection for Autonomous DrivingPoster1,347 citations
- Mask Scoring R-CNNOral1,341 citations
- Towards VQA Models That Can ReadPoster1,328 citations
- Learning RoI Transformer for Oriented Object Detection in Aerial ImagesPoster1,326 citations
- Character Region Awareness for Text DetectionPoster1,294 citations
- DenseFusion: 6D Object Pose Estimation by Iterative Dense FusionPoster1,292 citations
- Auto-DeepLab: Hierarchical Neural Architecture Search for Semantic Image SegmentationOral1,290 citations
- HAQ: Hardware-Aware Automated Quantization With Mixed PrecisionOral1,273 citations
- Deeper and Wider Siamese Networks for Real-Time Visual TrackingOral1,266 citations
- Toward Convolutional Blind Denoising of Real PhotographsPoster1,266 citations
- Cascaded Partial Decoder for Fast and Accurate Salient Object DetectionPoster1,258 citations
- A Simple Pooling-Based Design for Real-Time Salient Object DetectionPoster1,257 citations
- Bottom-Up Object Detection by Grouping Extreme and Center PointsPoster1,255 citations
- SoPhie: An Attentive GAN for Predicting Paths Compliant to Social and Physical ConstraintsPoster1,245 citations
- Importance Estimation for Neural Network PruningPoster1,237 citations
- Relation-Shape Convolutional Neural Network for Point Cloud AnalysisOral1,206 citations
- OK-VQA: A Visual Question Answering Benchmark Requiring External KnowledgePoster1,199 citations
- Contrastive Adaptation Network for Unsupervised Domain AdaptationPoster1,190 citations
- Feature Selective Anchor-Free Module for Single-Shot Object DetectionPoster1,167 citations
- Feature Denoising for Improving Adversarial RobustnessPoster1,130 citations
- Deep Modular Co-Attention Networks for Visual Question AnsweringPoster1,110 citations
- Evading Defenses to Transferable Adversarial Examples by Translation-Invariant AttacksOral1,086 citations
- From Coarse to Fine: Robust Hierarchical Localization at Large ScalePoster1,086 citations
- Underexposed Photo Enhancement Using Deep Illumination EstimationOral1,084 citations
- Progressive Image Deraining Networks: A Better and Simpler BaselinePoster1,077 citations
- Domain Generalization by Solving Jigsaw PuzzlesOral1,075 citations
- Skeleton-Based Action Recognition With Directed Graph Neural NetworksPoster1,067 citations
- From Recognition to Cognition: Visual Commonsense ReasoningOral1,062 citations
- Feedback Network for Image Super-ResolutionPoster1,053 citations
- PointNetLK: Robust & Efficient Point Cloud Registration Using PointNetPoster1,046 citations
- An Attention Enhanced Graph Convolutional LSTM Network for Skeleton-Based Action RecognitionPoster1,042 citations
- Joint Discriminative and Generative Learning for Person Re-IdentificationOral1,005 citations
- Multi-Similarity Loss With General Pair Weighting for Deep Metric LearningPoster1,000 citations
- Video Action Transformer NetworkOral955 citations
- PointWeb: Enhancing Local Neighborhood Features for Point Cloud ProcessingPoster953 citations
- Revisiting Self-Supervised Visual Representation LearningPoster942 citations
- Auto-Encoding Scene Graphs for Image CaptioningOral939 citations
- Taking a Closer Look at Domain Shift: Category-Level Adversaries for Semantics Consistent Domain AdaptationOral933 citations
- Structured Knowledge Distillation for Semantic SegmentationOral929 citations
- Learning Loss for Active LearningOral924 citations
- GA-Net: Guided Aggregation Net for End-To-End Stereo MatchingOral915 citations
- MS-TCN: Multi-Stage Temporal Convolutional Network for Action SegmentationPoster910 citations
- D2-Net: A Trainable CNN for Joint Description and Detection of Local FeaturesPoster909 citations
- Label Propagation for Deep Semi-Supervised LearningPoster889 citations
- Pyramid Feature Attention Network for Saliency DetectionPoster873 citations
- Variational Information Distillation for Knowledge TransferPoster873 citations
- Multi-Task Multi-Sensor Fusion for 3D Object DetectionPoster870 citations
- Normalized Object Coordinate Space for Category-Level 6D Object Pose and Size EstimationOral870 citations
- Strong-Weak Distribution Alignment for Adaptive Object DetectionPoster853 citations
- PartNet: A Large-Scale Benchmark for Fine-Grained and Hierarchical Part-Level 3D Object UnderstandingPoster849 citations
- Graph Attention Convolution for Point Cloud Semantic SegmentationPoster846 citations
- Context-Aware Crowd CountingPoster838 citations
- Enhanced Pix2pix Dehazing NetworkPoster836 citations
- Generalized Zero- and Few-Shot Learning via Aligned Variational AutoencodersPoster834 citations
- DVC: An End-To-End Deep Video Compression FrameworkOral832 citations
- DFANet: Deep Feature Aggregation for Real-Time Semantic SegmentationPoster831 citations
- Shape Robust Text Detection With Progressive Scale Expansion NetworkPoster827 citations
- A General and Adaptive Robust Loss FunctionOral825 citations
- Searching for a Robust Neural Architecture in Four GPU HoursPoster812 citations
- Bidirectional Learning for Domain Adaptation of Semantic SegmentationPoster809 citations
- DM-GAN: Dynamic Memory Generative Adversarial Networks for Text-To-Image SynthesisPoster797 citations
- Region Proposal by Guided AnchoringPoster796 citations
- Invariance Matters: Exemplar Memory for Domain Adaptive Person Re-IdentificationPoster780 citations
- Group-Wise Correlation Stereo NetworkPoster776 citations
- Unsupervised Embedding Learning via Invariant and Spreading Instance FeaturePoster760 citations
- Mode Seeking Generative Adversarial Networks for Diverse Image SynthesisPoster756 citations
- CANet: Class-Agnostic Segmentation Networks With Iterative Refinement and Attentive Few-Shot LearningPoster747 citations
- Sliced Wasserstein Discrepancy for Unsupervised Domain AdaptationPoster743 citations
- Competitive Collaboration: Joint Unsupervised Learning of Depth, Camera Motion, Optical Flow and Motion SegmentationPoster742 citations
- MirrorGAN: Learning Text-To-Image Generation by RedescriptionPoster741 citations
- Weakly Supervised Learning of Instance Segmentation With Inter-Pixel RelationsOral736 citations
- DeepVoxels: Learning Persistent 3D Feature EmbeddingsOral725 citations
- Deep Stacked Hierarchical Multi-Patch Network for Image DeblurringPoster723 citations
- Why ReLU Networks Yield High-Confidence Predictions Far Away From the Training Data and How to Mitigate the ProblemOral717 citations
- Explainability Methods for Graph Convolutional Neural NetworksOral716 citations
- Knockoff Nets: Stealing Functionality of Black-Box ModelsPoster714 citations
- Learning From Synthetic Data for Crowd Counting in the WildPoster712 citations
- Towards Optimal Structured CNN Pruning via Generative Adversarial LearningPoster712 citations
- OCGAN: One-Class Novelty Detection Using GANs With Constrained Latent RepresentationsPoster708 citations
- Recurrent MVSNet for High-Resolution Multi-View Stereo Depth InferencePoster706 citations
- CrowdPose: Efficient Crowded Scenes Pose Estimation and a New BenchmarkOral699 citations
- MOTS: Multi-Object Tracking and SegmentationPoster699 citations
- Revisiting Local Descriptor Based Image-To-Class Measure for Few-Shot LearningPoster698 citations
- Spatial Attentive Single-Image Deraining With a High Quality Real Rain DatasetPoster698 citations
- Semantic Graph Convolutional Networks for 3D Human Pose RegressionPoster694 citations
- Learning Without MemorizingPoster693 citations
- Stereo R-CNN Based 3D Object Detection for Autonomous DrivingPoster692 citations
- Bounding Box Regression With Uncertainty for Accurate Object DetectionPoster674 citations
- Depth-Aware Video Frame InterpolationPoster672 citations
- Convolutional Mesh Regression for Single-Image Human Shape ReconstructionOral670 citations
- PifPaf: Composite Fields for Human Pose EstimationPoster670 citations
- Characterizing and Avoiding Negative TransferPoster661 citations
- Edge-Labeling Graph Neural Network for Few-Shot LearningOral653 citations
- Universal Domain AdaptationPoster651 citations
- Reinforced Cross-Modal Matching and Self-Supervised Imitation Learning for Vision-Language NavigationOral649 citations
- Unsupervised Event-Based Learning of Optical Flow, Depth, and EgomotionPoster648 citations
- F-VAEGAN-D2: A Feature Generating Framework for Any-Shot LearningPoster647 citations
- Blind Super-Resolution With Iterative Kernel CorrectionPoster646 citations
- ManTra-Net: Manipulation Tracing Network for Detection and Localization of Image Forgeries With Anomalous FeaturesPoster645 citations
- Attention Branch Network: Learning of Attention Mechanism for Visual ExplanationOral640 citations
- SpotTune: Transfer Learning Through Adaptive Fine-TuningPoster640 citations
- Pluralistic Image CompletionPoster637 citations
- SR-LSTM: State Refinement for LSTM Towards Pedestrian Trajectory PredictionPoster636 citations
- Learning Joint Reconstruction of Hands and Manipulated ObjectsPoster631 citations
- Learning 3D Human Dynamics From VideoPoster630 citations
- Long-Term Feature Banks for Detailed Video UnderstandingOral621 citations
- FlowNet3D: Learning Scene Flow in 3D Point CloudsPoster620 citations
- Latent Space Autoregression for Novelty DetectionPoster619 citations
- Learning to Compose Dynamic Tree Structures for Visual ContextsOral618 citations
- ABC: A Big CAD Model Dataset for Geometric Deep LearningPoster613 citations
- Learning Pyramid-Context Encoder Network for High-Quality Image InpaintingPoster609 citations
- Data Augmentation Using Learned Transformations for One-Shot Medical Image SegmentationOral608 citations
- Grid R-CNNPoster607 citations
- Task Agnostic Meta-Learning for Few-Shot LearningPoster603 citations
- Salient Object Detection With Pyramid Attention and Salient EdgesPoster602 citations
- DSFD: Dual Shot Face DetectorPoster600 citations
- ESPNetv2: A Light-Weight, Power Efficient, and General Purpose Convolutional Neural NetworkPoster600 citations
- Destruction and Construction Learning for Fine-Grained Image RecognitionPoster599 citations
- Learning Correspondence From the Cycle-Consistency of TimeOral599 citations
- See More, Know More: Unsupervised Video Object Segmentation With Co-Attention Siamese NetworksPoster598 citations
- Cross-Modal Self-Attention Network for Referring Image SegmentationPoster597 citations
- Graph-Based Global Reasoning NetworksPoster597 citations
- Sim-To-Real via Sim-To-Sim: Data-Efficient Robotic Grasping via Randomized-To-Canonical Adaptation NetworksPoster596 citations
- The Perfect Match: 3D Point Cloud Matching With Smoothed DensitiesPoster591 citations
- Attention-Based Dropout Layer for Weakly Supervised Object LocalizationOral590 citations
- Graph Convolutional Label Noise Cleaner: Train a Plug-And-Play Action Classifier for Anomaly DetectionPoster590 citations
- Attentive Feedback Network for Boundary-Aware Salient Object DetectionPoster580 citations
- Sea-Thru: A Method for Removing Water From Underwater ImagesPoster574 citations
- Domain-Specific Batch Normalization for Unsupervised Domain AdaptationPoster571 citations
- A Sufficient Condition for Convergences of Adam and RMSPropOral568 citations
- Meta-SR: A Magnification-Arbitrary Network for Super-ResolutionPoster568 citations
- Recurrent Back-Projection Network for Video Super-ResolutionPoster568 citations
- 3D-SIS: 3D Semantic Instance Segmentation of RGB-D ScansOral566 citations
- 3D Hand Shape and Pose Estimation From a Single RGB ImageOral565 citations
- Probabilistic End-To-End Noise Correction for Learning With Noisy LabelsPoster564 citations
- Self-Supervised Spatiotemporal Learning via Video Clip Order PredictionPoster563 citations
- ESIR: End-To-End Scene Text Recognition via Iterative Image RectificationPoster561 citations
- Shifting More Attention to Video Salient Object DetectionOral561 citations
- FickleNet: Weakly and Semi-Supervised Semantic Image Segmentation Using Stochastic InferencePoster557 citations
- Multi-Agent Tensor Fusion for Contextual Trajectory PredictionPoster554 citations
- Unprocessing Images for Learned Raw DenoisingOral553 citations
- TopNet: Structural Point Cloud DecoderPoster552 citations
- Bi-Directional Cascade Network for Perceptual Edge DetectionPoster551 citations
- UPSNet: A Unified Panoptic Segmentation NetworkOral548 citations
- Progressive Feature Alignment for Unsupervised Domain AdaptationPoster544 citations
- Looking for the Devil in the Details: Learning Trilinear Attention Sampling Network for Fine-Grained Image RecognitionPoster543 citations
- Siamese Cascaded Region Proposal Networks for Real-Time Visual TrackingPoster537 citations
- Classification-Reconstruction Learning for Open-Set RecognitionPoster531 citations
- High-Level Semantic Feature Detection: A New Perspective for Pedestrian DetectionPoster530 citations
- Global Second-Order Pooling Convolutional NetworksPoster529 citations
- Improving Semantic Segmentation via Video Propagation and Label RelaxationOral529 citations
- FEELVOS: Fast End-To-End Embedding Learning for Video Object SegmentationPoster528 citations
- Learning Not to Learn: Training Deep Neural Networks With Biased DataPoster526 citations
- Target-Aware Deep TrackingPoster523 citations
- Learning to Reduce Dual-Level Discrepancy for Infrared-Visible Person Re-IdentificationPoster522 citations
- Distilling Object Detectors With Fine-Grained Feature ImitationPoster521 citations
- What Do Single-View 3D Reconstruction Networks Learn?Poster521 citations
- Arbitrary Style Transfer With Style-Attentional NetworksPoster520 citations
- IP102: A Large-Scale Benchmark Dataset for Insect Pest RecognitionOral519 citations
- Modeling Point Clouds With Self-Attention and Gumbel Subset SamplingPoster519 citations
- Semi-Supervised Transfer Learning for Image Rain RemovalPoster517 citations
- DeepFashion2: A Versatile Benchmark for Detection, Pose Estimation, Segmentation and Re-Identification of Clothing ImagesPoster516 citations
- DeepView: View Synthesis With Learned Gradient DescentOral516 citations
- Efficient Decision-Based Black-Box Adversarial Attacks on Face RecognitionPoster516 citations
- End-To-End Interpretable Neural Motion PlannerOral514 citations
- Deep Supervised Cross-Modal RetrievalPoster512 citations
- CityFlow: A City-Scale Benchmark for Multi-Target Multi-Camera Vehicle Tracking and Re-IdentificationOral511 citations
- Peeking Into the Future: Predicting Future Person Activities and Locations in VideosPoster504 citations
- Pyramidal Person Re-IDentification via Multi-Loss Dynamic TrainingPoster502 citations
- Visual Tracking via Adaptive Spatially-Regularized Correlation FiltersOral498 citations
- Quantization NetworksPoster492 citations
- Hierarchical Cross-Modal Talking Face Generation With Dynamic Pixel-Wise LossPoster490 citations
- Unsupervised Deep TrackingPoster487 citations
- Unsupervised Person Re-Identification by Soft Multilabel LearningOral487 citations
- Memory in Memory: A Predictive Neural Network for Learning Higher-Order Non-Stationarity From Spatiotemporal DynamicsPoster483 citations
- In Defense of Pre-Trained ImageNet Architectures for Real-Time Semantic Segmentation of Road-Driving ImagesPoster481 citations
- Foreground-Aware Image InpaintingPoster480 citations
- Object-Centric Auto-Encoders and Dummy Anomalies for Abnormal Event Detection in VideoPoster478 citations
- Finding Task-Relevant Features for Few-Shot Learning by Category TraversalOral477 citations
- Deep Plug-And-Play Super-Resolution for Arbitrary Blur KernelsPoster476 citations
- Learning to Quantize Deep Networks by Optimizing Quantization Intervals With Task LossOral476 citations
- Knowledge-Embedded Routing Network for Scene Graph GenerationPoster470 citations
- Understanding the Limitations of CNN-Based Absolute Camera Pose RegressionPoster469 citations
- Interaction-And-Aggregation Network for Person Re-IdentificationPoster466 citations
- Task-Free Continual LearningPoster463 citations
- C2AE: Class Conditioned Auto-Encoder for Open-Set RecognitionOral462 citations
- Adaptive Pyramid Context Network for Semantic SegmentationPoster461 citations
- RepMet: Representative-Based Metric Learning for Classification and Few-Shot Object DetectionPoster461 citations
- Transferrable Prototypical Networks for Unsupervised Domain AdaptationOral461 citations
- Events-To-Video: Bringing Modern Computer Vision to Event CamerasPoster460 citations
- Perceive Where to Focus: Learning Visibility-Aware Part-Level Features for Partial Person Re-IdentificationPoster460 citations
- DeepLiDAR: Deep Surface Normal Guided Depth Prediction for Outdoor Scene From Sparse LiDAR Data and Single Color ImagePoster459 citations
- Variational Convolutional Neural Network PruningPoster455 citations
- 3D Point Capsule NetworksPoster454 citations
- Semi-Supervised Learning With Graph Learning-Convolutional NetworksPoster454 citations
- Contrast Prior and Fluid Pyramid Integration for RGBD Salient Object DetectionPoster451 citations
- Heavy Rain Image Restoration: Integrating Physics Model and Conditional Adversarial LearningPoster451 citations
- DLOW: Domain Flow for Adaptation and GeneralizationOral450 citations
- Dynamic Scene Deblurring With Parameter Selective Sharing and Nested Skip ConnectionsPoster443 citations
- Animating Arbitrary Objects via Deep Motion TransferOral442 citations
- Composing Text and Image for Image Retrieval - an Empirical OdysseyOral442 citations
- Domain-Symmetric Networks for Adversarial Domain AdaptationPoster442 citations
- Multi-Channel Attention Selection GAN With Cascaded Semantic Guidance for Cross-View Image TranslationOral441 citations
- LaserNet: An Efficient Probabilistic 3D Object Detector for Autonomous DrivingPoster440 citations
- Interpreting CNNs via Decision TreesPoster439 citations
- Gaussian Temporal Awareness Networks for Action LocalizationOral438 citations
- Spatial Fusion GAN for Image SynthesisPoster437 citations
- Adapting Object Detectors via Selective Cross-Domain AlignmentPoster436 citations
- Crowd Counting and Density Estimation by Trellis Encoder-Decoder NetworksPoster435 citations
- TOUCHDOWN: Natural Language Navigation and Spatial Reasoning in Visual Street EnvironmentsPoster433 citations
- SOSNet: Second Order Similarity Regularization for Local Descriptor LearningOral432 citations
- 3D Hand Shape and Pose From Images in the WildOral431 citations
- GS3D: An Efficient 3D Object Detection Framework for Autonomous DrivingPoster429 citations
- Image Super-Resolution by Neural Texture TransferPoster428 citations
- Multi-Adversarial Discriminative Deep Domain Generalization for Face Presentation Attack DetectionPoster428 citations
- STGAN: A Unified Selective Transfer Network for Arbitrary Image Attribute EditingPoster427 citations
- Capture, Learning, and Synthesis of 3D Speaking StylesPoster426 citations
- Progressive Pose Attention Transfer for Person Image GenerationOral424 citations
- AANet: Attribute Attention Network for Person Re-IdentificationsPoster420 citations
- Leveraging the Invariant Side of Generative Zero-Shot LearningPoster418 citations
- Depth-Attentional Features for Single-Image Rain RemovalPoster417 citations
- Learning to Learn From Noisy Labeled DataPoster416 citations
- Understanding the Disharmony Between Dropout and Batch Normalization by Variance ShiftPoster415 citations
- GANFIT: Generative Adversarial Network Fitting for High Fidelity 3D Face ReconstructionPoster414 citations
- SelFlow: Self-Supervised Learning of Optical FlowOral410 citations
- BAD SLAM: Bundle Adjusted Direct RGB-D SLAMOral409 citations
- Monocular Total Capture: Posing Face, Body, and Hands in the WildOral405 citations
- Learning Individual Styles of Conversational GesturePoster403 citations
- "Double-DIP": Unsupervised Image Decomposition via Coupled Deep-Image-PriorsOral401 citations
- Adaptive NMS: Refining Pedestrian Detection in a CrowdOral401 citations
- Segmentation-Driven 6D Object Pose EstimationPoster401 citations
- Rethinking Knowledge Graph Propagation for Zero-Shot LearningPoster399 citations
- Feature Transfer Learning for Face Recognition With Under-Represented DataPoster396 citations
- Decoupling Direction and Norm for Efficient Gradient-Based L2 Adversarial Attacks and DefensesOral392 citations
- Pattern-Affinitive Propagation Across Depth, Surface Normal and Semantic SegmentationPoster392 citations
- Strike (With) a Pose: Neural Networks Are Easily Fooled by Strange Poses of Familiar ObjectsPoster392 citations
- Large-Scale Weakly-Supervised Pre-Training for Video Action RecognitionPoster391 citations
- Robustness via Curvature Regularization, and Vice VersaPoster391 citations
- Learning Active Contour Models for Medical Image SegmentationPoster389 citations
- MAGSAC: Marginalizing Sample ConsensusPoster387 citations
- Object-Driven Text-To-Image Synthesis via Adversarial TrainingPoster386 citations
- Scene Graph Generation With External Knowledge and Image ReconstructionPoster386 citations
- Separate to Adapt: Open Set Domain Adaptation via Progressive SeparationPoster386 citations
- Exploring Object Relation in Mean Teacher for Cross-Domain DetectionPoster385 citations
- MUREL: Multimodal Relational Reasoning for Visual Question AnsweringPoster385 citations
- Diversify and Match: A Domain Adaptive Representation Learning Paradigm for Object DetectionPoster384 citations
- FSA-Net: Learning Fine-Grained Structure Aggregation for Head Pose Estimation From a Single ImagePoster384 citations
- Self-Supervised GANs via Auxiliary Rotation LossPoster384 citations
- Dynamic Fusion With Intra- and Inter-Modality Attention Flow for Visual Question AnsweringOral383 citations
- Learning to Remember: A Synaptic Plasticity Driven Framework for Continual LearningPoster383 citations
- Pixel-Adaptive Convolutional Neural NetworksPoster383 citations
- Transferable Interactiveness Knowledge for Human-Object Interaction DetectionPoster383 citations
- Exploiting Edge Features for Graph Neural NetworksPoster381 citations
- GSPN: Generative Shape Proposal Network for 3D Instance Segmentation in Point CloudPoster381 citations
- Generating 3D Adversarial Point CloudsPoster380 citations
- Learning to Reconstruct People in Clothing From a Single RGB CameraPoster380 citations
- Learning Regularity in Skeleton Trajectories for Anomaly Detection in VideosPoster379 citations
- CrDoCo: Pixel-Level Domain Transfer With Cross-Domain ConsistencyPoster378 citations
- Part-Regularized Near-Duplicate Vehicle Re-IdentificationPoster375 citations
- COIN: A Large-Scale Dataset for Comprehensive Instructional Video AnalysisPoster374 citations
- Uncertainty Guided Multi-Scale Residual Learning-Using a Cycle Spinning CNN for Single Image De-RainingPoster373 citations
- MAN: Moment Alignment Network for Natural Language Moment Retrieval via Iterative Graph AdjustmentPoster372 citations
- Knowledge Distillation via Instance Relationship GraphPoster371 citations
- Self-Supervised Learning of 3D Human Pose Using Multi-View GeometryPoster371 citations
- Parametric Noise Injection: Trainable Randomness to Improve Deep Neural Network Robustness Against Adversarial AttackPoster368 citations
- Single Image Deraining: A Comprehensive Benchmark AnalysisPoster368 citations
- ComDefend: An Efficient Image Compression Model to Defend Adversarial ExamplesPoster365 citations
- Iterative Residual Refinement for Joint Optical Flow and Occlusion EstimationPoster365 citations
- Pushing the Boundaries of View Extrapolation With Multiplane ImagesOral365 citations
- Learning to Regress 3D Face Shape and Expression From an Image Without 3D SupervisionPoster363 citations
- SIXray: A Large-Scale Security Inspection X-Ray Benchmark for Prohibited Item Discovery in Overlapping ImagesPoster359 citations
- RAVEN: A Dataset for Relational and Analogical Visual REasoNingPoster357 citations
- A-CNN: Annularly Convolutional Neural Networks on Point CloudsPoster356 citations
- Deep Spectral Clustering Using Dual Autoencoder NetworkPoster356 citations
- Fast Human Pose EstimationPoster356 citations
- Temporal Cycle-Consistency LearningPoster356 citations
- ADCrowdNet: An Attention-Injective Deformable Convolutional Network for Crowd UnderstandingPoster355 citations
- Graph Convolutional TrackingOral354 citations
- Learning to Transfer Examples for Partial Domain AdaptationPoster354 citations
- Attention-Guided Unified Network for Panoptic SegmentationPoster353 citations
- Densely Semantically Aligned Person Re-IdentificationPoster353 citations
- Patch-Based Progressive 3D Point Set UpsamplingPoster353 citations
- VERI-Wild: A Large Dataset and a New Method for Vehicle Re-Identification in the WildPoster352 citations
- Weakly Supervised Complementary Parts Models for Fine-Grained Image Classification From the Bottom UpPoster352 citations
- Attentive Region Embedding Network for Zero-Shot LearningPoster351 citations
- L3-Net: Towards Learning Based LiDAR Localization for Autonomous DrivingPoster351 citations
- Adaptive Transfer Network for Cross-Domain Person Re-IdentificationPoster350 citations
- Disentangling Adversarial Robustness and GeneralizationPoster350 citations
- REPAIR: Removing Representation Bias by Dataset ResamplingPoster350 citations
- NDDR-CNN: Layerwise Feature Fusing in Multi-Task CNNs by Neural Discriminative Dimensionality ReductionPoster347 citations
- TraPHic: Trajectory Prediction in Dense and Heterogeneous Traffic Using Weighted InteractionsPoster347 citations
- Deep Metric Learning to RankPoster343 citations
- Attention-Guided Network for Ghost-Free High Dynamic Range ImagingPoster342 citations
- Heterogeneous Memory Enhanced Multimodal Attention Model for Video Question AnsweringPoster342 citations
- ChamNet: Towards Efficient Network Design Through Platform-Aware Model AdaptationPoster341 citations
- ROI-10D: Monocular Lifting of 2D Detection to 6D Pose and Metric ShapePoster338 citations
- Rules of the Road: Predicting Driving Behavior With a Convolutional Model of Semantic InteractionsPoster338 citations
- Deep Flow-Guided Video InpaintingPoster337 citations
- Feature Distillation: DNN-Oriented JPEG Compression Against Adversarial ExamplesPoster337 citations
- Fast Interactive Object Annotation With Curve-GCNPoster336 citations
- MARS: Motion-Augmented RGB Stream for Action RecognitionPoster336 citations
- H+O: Unified Egocentric Recognition of 3D Hand-Object Poses and InteractionsOral335 citations
- Co-Occurrent Features in Semantic SegmentationPoster334 citations
- Learning Actor Relation Graphs for Group Activity RecognitionPoster333 citations
- Generating Classification Weights With GNN Denoising Autoencoders for Few-Shot LearningOral332 citations
- Style Transfer by Relaxed Optimal Transport and Self-SimilarityPoster331 citations
- Look More Than Once: An Accurate Detector for Text of Arbitrary ShapesPoster328 citations
- Monocular 3D Object Detection Leveraging Accurate Proposals and Shape ReconstructionPoster328 citations
- Polysemous Visual-Semantic Embedding for Cross-Modal RetrievalPoster328 citations
- Collaborative Learning of Semi-Supervised Segmentation and Classification for Medical ImagesPoster327 citations
- Learning Parallax Attention for Stereo Image Super-ResolutionPoster327 citations
- Real-Time Self-Adaptive Deep StereoOral326 citations
- Instance Segmentation by Jointly Optimizing Spatial Embeddings and Clustering BandwidthOral325 citations
- Ranked List Loss for Deep Metric LearningPoster325 citations
- Dual Encoding for Zero-Example Video RetrievalPoster324 citations
- Gait Recognition via Disentangled Representation LearningOral324 citations
- Hierarchical Deep Stereo Matching on High-Resolution ImagesPoster324 citations
- Re-Identification With Consistent Attentive Siamese NetworksPoster320 citations
- Learning From Noisy Labels by Regularized Estimation of Annotator ConfusionPoster318 citations
- Zoom to Learn, Learn to ZoomPoster318 citations
- All About Structure: Adapting Structural Information Across Domains for Boosting Semantic SegmentationPoster317 citations
- Associatively Segmenting Instances and Semantics in Point CloudsPoster316 citations
- Learning a Deep ConvNet for Multi-Label Classification With Partial LabelsPoster316 citations
- ContextDesc: Local Descriptor Augmentation With Cross-Modality ContextOral315 citations
- Learning Semantic Segmentation From Synthetic Data: A Geometrically Guided Input-Output Adaptation ApproachPoster314 citations
- Neural Illumination: Lighting Prediction for Indoor EnvironmentsOral313 citations
- AdaCos: Adaptively Scaling Cosine Logits for Effectively Learning Deep Face RepresentationsOral312 citations
- Bringing a Blurry Frame Alive at High Frame-Rate With an Event CameraOral312 citations
- DeepCaps: Going Deeper With Capsule NetworksOral312 citations
- Cross-Task Weakly Supervised Learning From Instructional VideosPoster311 citations
- Towards Rich Feature Discovery With Class Activation Maps Augmentation for Person Re-IdentificationPoster311 citations
- Dissecting Person Re-Identification From the Viewpoint of ViewpointPoster310 citations
- Lending Orientation to Neural Networks for Cross-View Geo-LocalizationPoster309 citations
- Visual Attention Consistency Under Image Transforms for Multi-Label Image ClassificationPoster307 citations
- Deep Tree Learning for Zero-Shot Face Anti-SpoofingOral305 citations
- Neighbourhood Watch: Referring Expression Comprehension via Language-Guided Graph Attention NetworksPoster305 citations
- Spatio-Temporal Dynamics and Semantic Attribute Enriched Visual Encoding for Video CaptioningPoster304 citations
- Image Deformation Meta-Networks for One-Shot LearningOral303 citations
- Large-Scale Interactive Object Segmentation With Human AnnotatorsPoster303 citations
- RepNet: Weakly Supervised Training of an Adversarial Reprojection Network for 3D Human Pose EstimationPoster303 citations
- Attention Based Glaucoma Detection: A Large-Scale Database and CNN ModelPoster302 citations
- Face Anti-Spoofing: Model Matters, so Does DataPoster302 citations
- Attentive Single-Tasking of Multiple TasksPoster301 citations
- Generalizable Person Re-Identification by Domain-Invariant Mapping NetworkPoster301 citations
- C-MIL: Continuation Multiple Instance Learning for Weakly Supervised Object DetectionOral299 citations
- ODE-Inspired Network Design for Single Image Super-ResolutionPoster299 citations
- Decoders Matter for Semantic Segmentation: Data-Dependent Decoding Enables Flexible Feature AggregationPoster297 citations
- Exploiting Temporal Context for 3D Human Pose Estimation in the WildPoster297 citations
- X2CT-GAN: Reconstructing CT From Biplanar X-Rays With Generative Adversarial NetworksPoster297 citations
- Dual Residual Networks Leveraging the Potential of Paired Operations for Image RestorationPoster295 citations
- Memory-Attended Recurrent Network for Video CaptioningPoster294 citations
- Scan2CAD: Learning CAD Model Alignment in RGB-D ScansOral294 citations
- Semantic Projection Network for Zero- and Few-Label Semantic SegmentationPoster294 citations
- Hierarchical Discrete Distribution Decomposition for Match Density EstimationPoster293 citations
- HoloPose: Holistic 3D Human Reconstruction In-The-WildOral292 citations
- Multi-Scale Geometric Consistency Guided Multi-View StereoPoster292 citations
- Unsupervised Image CaptioningPoster292 citations
- Iterative Alignment Network for Continuous Sign Language RecognitionPoster291 citations
- Knowledge Adaptation for Efficient Semantic SegmentationPoster291 citations
- Learning Linear Transformations for Fast Image and Video Style TransferPoster291 citations
- Multispectral and Hyperspectral Image Fusion by MS/HS Fusion NetPoster291 citations
- SPM-Tracker: Series-Parallel Matching for Real-Time Visual Object TrackingPoster290 citations
- A Mutual Learning Method for Salient Object Detection With Intertwined Multi-SupervisionPoster289 citations
- Graphical Contrastive Losses for Scene Graph ParsingPoster289 citations
- Geometry-Consistent Generative Adversarial Networks for One-Sided Unsupervised Domain MappingOral287 citations
- Towards Scene Understanding: Unsupervised Monocular Depth Estimation With Semantic-Aware RepresentationOral287 citations
- Timeception for Complex Action RecognitionOral286 citations
- RVOS: End-To-End Recurrent Network for Video Object SegmentationPoster285 citations
- ToothNet: Automatic Tooth Instance Segmentation and Identification From Cone Beam CT ImagesPoster284 citations
- Box-Driven Class-Wise Region Masking and Filling Rate Guided Loss for Weakly Supervised Semantic SegmentationPoster283 citations
- Deep Video InpaintingPoster283 citations
- Generative Dual Adversarial Network for Generalized Zero-Shot LearningPoster283 citations
- Few-Shot Learning via Saliency-Guided Hallucination of SamplesPoster280 citations
- Revisiting Perspective Information for Efficient Crowd CountingPoster280 citations
- StoryGAN: A Sequential Conditional GAN for Story VisualizationPoster280 citations
- Learning Monocular Depth Estimation Infusing Traditional Stereo KnowledgePoster278 citations
- Learning to Learn How to Learn: Self-Adaptive Visual Navigation Using Meta-LearningOral278 citations
- Learning Unsupervised Video Object Segmentation Through Visual AttentionPoster277 citations
- Learning the Depths of Moving People by Watching Frozen PeopleOral276 citations
- Pose2Seg: Detection Free Human Instance SegmentationPoster276 citations
- Efficient Parameter-Free Clustering Using First Neighbor RelationsOral275 citations
- PlaneRCNN: 3D Plane Detection and Reconstruction From a Single ImageOral275 citations
- Completeness Modeling and Context Separation for Weakly Supervised Temporal Action LocalizationPoster273 citations
- Explainable and Explicit Visual Reasoning Over Scene GraphsPoster272 citations
- VRSTC: Occlusion-Free Video Person Re-IdentificationPoster271 citations
- HPLFlowNet: Hierarchical Permutohedral Lattice FlowNet for Scene Flow Estimation on Large-Scale Point CloudsPoster270 citations
- LO-Net: Deep Real-Time Lidar OdometryPoster268 citations
- Patch-Based Discriminative Feature Learning for Unsupervised Person Re-IdentificationPoster268 citations
- Pushing the Envelope for RGB-Based Dense 3D Hand Pose Estimation via Neural RenderingPoster268 citations
- DuDoNet: Dual Domain Network for CT Metal Artifact ReductionPoster267 citations
- Blind Image Deblurring With Local Maximum Gradient PriorPoster266 citations
- Fast and Robust Multi-Person 3D Pose Estimation From Multiple ViewsPoster266 citations
- PCAN: 3D Attention Map Learning Using Contextual Information for Point Cloud Based RetrievalPoster266 citations
- AET vs. AED: Unsupervised Representation Learning by Auto-Encoding Transformations Rather Than DataOral265 citations
- Deep Multimodal Clustering for Unsupervised Audiovisual LearningPoster265 citations
- Interactive Image Segmentation via Backpropagating Refinement SchemePoster263 citations
- Practical Full Resolution Learned Lossless Image CompressionOral263 citations
- Generating Multiple Hypotheses for 3D Human Pose Estimation With Mixture Density NetworkPoster262 citations
- JSIS3D: Joint Semantic-Instance Segmentation of 3D Point Clouds With Multi-Task Pointwise Networks and Multi-Value Conditional Random FieldsOral262 citations
- Point in, Box Out: Beyond Counting Persons in CrowdsOral262 citations
- Self-Supervised Representation Learning by Rotation Feature DecouplingPoster262 citations
- Semantics Disentangling for Text-To-Image GenerationOral262 citations
- Soft Labels for Ordinal RegressionPoster262 citations
- 2.5D Visual SoundOral261 citations
- Deep Exemplar-Based Video ColorizationPoster261 citations
- Dense Classification and Implanting for Few-Shot LearningPoster260 citations
- An Iterative and Cooperative Top-Down and Bottom-Up Inference Network for Salient Object DetectionPoster259 citations
- Learning Shape-Aware Embedding for Scene Text DetectionPoster259 citations
- Self-Supervised Spatio-Temporal Representation Learning for Videos by Predicting Motion and Appearance StatisticsPoster259 citations
- AdaFrame: Adaptive Frame Selection for Fast Video RecognitionPoster258 citations
- Precise Detection in Densely Packed ScenesPoster257 citations
- Snapshot Distillation: Teacher-Student Optimization in One GenerationPoster255 citations
- Centripetal SGD for Pruning Very Deep Convolutional Networks With Complicated StructurePoster254 citations
- Image Generation From LayoutOral252 citations
- Multi-Granularity Generator for Temporal Action ProposalPoster252 citations
- Predicting Future Frames Using Retrospective Cycle GANPoster252 citations
- Residual Networks for Light Field Image Super-ResolutionOral252 citations
- Fully Quantized Network for Object DetectionPoster251 citations
- AE2-Nets: Autoencoder in Autoencoder NetworksOral249 citations
- SparseFool: A Few Pixels Make a Big DifferencePoster249 citations
- Unsupervised 3D Pose Estimation With Geometric Self-SupervisionPoster249 citations
- DrivingStereo: A Large-Scale Dataset for Stereo Matching in Autonomous Driving ScenariosPoster248 citations
- Seamless Scene SegmentationPoster247 citations
- MFAS: Multimodal Fusion Architecture SearchPoster246 citations
- Supervised Fitting of Geometric Primitives to 3D Point CloudsOral246 citations
- Towards Universal Object Detection by Domain AttentionPoster246 citations
- Grounded Video DescriptionOral243 citations
- RL-GAN-Net: A Reinforcement Learning Agent Controlled GAN Network for Real-Time Point Cloud Shape CompletionPoster243 citations
- A Poisson-Gaussian Denoising Dataset With Real Fluorescence Microscopy ImagesPoster242 citations
- Event-Based High Dynamic Range Image and Very High Frame Rate Video Generation Using Conditional Generative Adversarial NetworksPoster241 citations
- Linkage Based Face Clustering via Graph Convolution NetworkPoster241 citations
- Overcoming Limitations of Mixture Density Networks: A Sampling and Fitting Framework for Multimodal Future PredictionPoster241 citations
- Recurrent Neural Network for (Un-)Supervised Learning of Monocular Video Visual Odometry and DepthPoster241 citations
- Learning Context Graph for Person SearchOral240 citations
- Feature Space Perturbations Yield More Transferable Adversarial ExamplesPoster239 citations
- Deep Geometric Prior for Surface ReconstructionPoster238 citations
- Max-Sliced Wasserstein Distance and Its Use for GANsOral238 citations
- Scene Memory Transformer for Embodied Agents in Long-Horizon TasksPoster238 citations
- Weakly Supervised Video Moment Retrieval From Text QueriesPoster238 citations
- Improved Road Connectivity by Joint Learning of Orientation and SegmentationPoster237 citations
- A Generative Appearance Model for End-To-End Video Object SegmentationOral236 citations
- ContactDB: Analyzing and Predicting Grasp Contact via Thermal ImagingOral236 citations
- Learning Spatio-Temporal Representation With Local and Global DiffusionPoster236 citations
- Neural Rerendering in the WildOral234 citations
- Striking the Right Balance With UncertaintyOral234 citations
- Hardness-Aware Deep Metric LearningOral233 citations
- Density Map Regression Guided Detection Network for RGB-D Crowd Counting and LocalizationPoster231 citations
- HorizonNet: Learning Room Layout With 1D Representation and Pano Stretch Data AugmentationPoster231 citations
- Point Cloud Oversegmentation With Graph-Structured Deep Metric LearningPoster231 citations
- Show, Control and Tell: A Framework for Generating Controllable and Grounded CaptionsPoster231 citations
- Dense Intrinsic Appearance Flow for Human Pose TransferPoster230 citations
- Geometry-Aware Symmetric Domain Adaptation for Monocular Depth EstimationPoster229 citations
- Graphonomy: Universal Human Parsing via Graph Transfer LearningPoster228 citations
- Learning to SamplePoster228 citations
- Multi-Source Weak Supervision for Saliency DetectionPoster227 citations
- Audio Visual Scene-Aware DialogPoster226 citations
- Label Efficient Semi-Supervised Learning via Graph FilteringPoster226 citations
- ApolloCar3D: A Large 3D Car Instance Understanding Benchmark for Autonomous DrivingPoster224 citations
- Doodle to Search: Practical Zero-Shot Sketch-Based Image RetrievalOral224 citations
- Object-Aware Aggregation With Bidirectional Temporal Graph for Video CaptioningPoster224 citations
- Arbitrary Shape Scene Text Detection With Adaptive Text Region RepresentationOral222 citations
- Speech2Face: Learning the Face Behind a VoicePoster222 citations
- Barrage of Random Transforms for Adversarially Robust DefenseOral221 citations
- CollaGAN: Collaborative GAN for Missing Image Data ImputationOral221 citations
- SiCloPe: Silhouette-Based Clothed PeopleOral221 citations
- Unified Visual-Semantic Embeddings: Bridging Vision and Language With Structured Meaning RepresentationsOral221 citations
- Amodal Instance Segmentation With KINS DatasetPoster220 citations
- Hyperspectral Image Reconstruction Using a Deep Spatial-Spectral PriorPoster218 citations
- PoseFix: Model-Agnostic General Human Pose Refinement NetworkPoster218 citations
- ClusterNet: Deep Hierarchical Cluster Network With Rigorously Rotation-Invariant Representation for Point Cloud AnalysisPoster217 citations
- Recurrent Attentive Zooming for Joint Crowd Counting and Precise LocalizationPoster216 citations
- A Dataset and Benchmark for Large-Scale Multi-Modal Face Anti-SpoofingPoster215 citations
- A Theory of Fermat Paths for Non-Line-Of-Sight Shape ReconstructionOral215 citations
- AdaptiveFace: Adaptive Margin and Sampling for Face RecognitionPoster215 citations
- Attention-Aware Multi-Stroke Style TransferPoster215 citations
- Effective Aesthetics Prediction With Multi-Level Spatially Pooled FeaturesPoster215 citations
- Language-Driven Temporal Activity Localization: A Semantic Matching Reinforcement Learning ModelOral215 citations
- Semantic Correlation Promoted Shape-Variant Context for SegmentationOral215 citations
- A Relation-Augmented Fully Convolutional Network for Semantic Segmentation in Aerial ScenesPoster214 citations
- FastDraw: Addressing the Long Tail of Lane Detection by Adapting a Sequential Prediction NetworkPoster212 citations
- Improving Referring Expression Grounding With Cross-Modal Attention-Guided ErasingPoster212 citations
- Improving the Performance of Unimodal Dynamic Hand-Gesture Recognition With Multimodal TrainingPoster212 citations
- Inverse Cooking: Recipe Generation From Food ImagesPoster210 citations
- Leveraging Shape Completion for 3D Siamese TrackingPoster210 citations
- Partial Order Pruning: For Best Speed/Accuracy Trade-Off in Neural Architecture SearchPoster210 citations
- Representation Flow for Action RecognitionPoster209 citations
- Collaborative Global-Local Networks for Memory-Efficient Segmentation of Ultra-High Resolution ImagesOral208 citations
- LSTA: Long Short-Term Attention for Egocentric Action RecognitionPoster208 citations
- Cycle-Consistency for Robust Visual Question AnsweringOral207 citations
- Unsupervised Domain Adaptation Using Feature-Whitening and Consensus LossPoster207 citations
- Single Image Reflection Removal Exploiting Misaligned Training Data and Network EnhancementsPoster206 citations
- A Neural Temporal Model for Human Motion PredictionPoster205 citations
- The Regretful Agent: Heuristic-Aided Navigation Through Progress EstimationOral205 citations
- Automatic Adaptation of Object Detectors to New Domains Using Self-TrainingPoster204 citations
- Devil Is in the Edges: Learning Semantic Boundaries From Noisy AnnotationsOral204 citations
- Towards High-Fidelity Nonlinear 3D Face Morphable ModelPoster204 citations
- D3TW: Discriminative Differentiable Dynamic Time Warping for Weakly Supervised Action Alignment and SegmentationPoster201 citations
- Modeling Local Geometric Structure of 3D Point Clouds Using Geo-CNNPoster201 citations
- What and How Well You Performed? A Multitask Learning Approach to Action Quality AssessmentOral201 citations
- APDrawingGAN: Generating Artistic Portrait Drawings From Face Photos With Hierarchical GANsOral200 citations
- Camera Lens Super-ResolutionPoster200 citations
- Engaging Image Captioning via PersonalityPoster200 citations
- STEP: Spatio-Temporal Progressive Learning for Video Action DetectionOral200 citations
- A Variational Pan-Sharpening With Local Gradient ConstraintsPoster199 citations
- An End-To-End Network for Panoptic SegmentationPoster199 citations
- Attentive Relational Networks for Mapping Images to Scene GraphsPoster199 citations
- Self-Supervised Convolutional Subspace Clustering NetworkPoster199 citations
- Spherical Fractal Convolutional Neural Networks for Point Cloud RecognitionPoster197 citations
- Fast Neural Architecture Search of Compact Semantic Segmentation Models via Auxiliary CellsPoster196 citations
- Deep Fitting Degree Scoring Network for Monocular 3D Object DetectionPoster195 citations
- Fast and Flexible Indoor Scene Synthesis via Deep Convolutional Generative ModelsPoster195 citations
- Scalable Convolutional Neural Network for Image Compressed SensingPoster195 citations
- Tactical Rewind: Self-Correction via Backtracking in Vision-And-Language NavigationOral194 citations
- UnOS: Unified Unsupervised Optical-Flow and Stereo-Depth Estimation by Watching VideosPoster194 citations
- Embodied Question Answering in Photorealistic Environments With Point Cloud PerceptionOral193 citations
- Low-Rank Tensor Completion With a New Tensor Nuclear Norm Induced by Invertible Linear TransformsPoster193 citations
- Out-Of-Distribution Detection for Generalized Zero-Shot Action RecognitionPoster193 citations
- Selective Sensor Fusion for Neural Visual-Inertial OdometryPoster192 citations
- Structured Binary Neural Networks for Accurate Image Classification and Semantic SegmentationPoster192 citations
- Good News, Everyone! Context Driven Entity-Aware Captioning for News ImagesPoster191 citations
- Learning to Detect Human-Object Interactions With KnowledgePoster191 citations
- Multi-Person Pose Estimation With Enhanced Channel-Wise and Spatial InformationPoster189 citations
- Non-Local Meets Global: An Integrated Paradigm for Hyperspectral DenoisingOral189 citations
- Variational Autoencoders Pursue PCA Directions (by Accident)Poster189 citations
- Few-Shot Learning With Localization in Realistic SettingsOral188 citations
- ScratchDet: Training Single-Shot Object Detectors From ScratchOral188 citations
- Side Window FilteringOral188 citations
- Unsupervised Domain-Specific Deblurring via Disentangled RepresentationsPoster188 citations
- EV-Gait: Event-Based Robust Gait Recognition Using Dynamic Vision SensorsPoster186 citations
- Interpretable and Fine-Grained Visual Explanations for Convolutional Neural NetworksPoster186 citations
- Meta-Learning Convolutional Neural Architectures for Multi-Target Concrete Defect Classification With the COncrete DEfect BRidge IMage DatasetPoster186 citations
- Streamlined Dense Video CaptioningOral186 citations
- DistillHash: Unsupervised Deep Hashing by Distilling Data PairsPoster185 citations
- Attribute-Driven Feature Disentangling and Temporal Aggregation for Video Person Re-IdentificationPoster184 citations
- Regularizing Activation Distribution for Training Binarized Deep NetworksPoster184 citations
- Distraction-Aware Shadow DetectionPoster183 citations
- Few-Shot Adaptive Faster R-CNNPoster183 citations
- Iterative Normalization: Beyond Standardization Towards Efficient WhiteningPoster183 citations
- FOCNet: A Fractional Optimal Control Network for Image DenoisingPoster182 citations
- Gradient Matching Generative Networks for Zero-Shot LearningOral182 citations
- Octree Guided CNN With Spherical Kernels for 3D Point CloudsPoster182 citations
- Self-Calibrating Deep Photometric Stereo NetworksOral182 citations
- Image-To-Image Translation via Group-Wise Deep Whitening-And-Coloring TransformationOral181 citations
- Recurrent Neural Networks With Intra-Frame Iterations for Video DeblurringPoster181 citations
- Rethinking the Evaluation of Video SummariesPoster181 citations
- Accel: A Corrective Fusion Network for Efficient Semantic Segmentation on VideoOral180 citations
- Unsupervised Part-Based Disentangling of Object Shape and AppearanceOral180 citations
- A Late Fusion CNN for Digital MattingPoster179 citations
- Customizable Architecture Search for Semantic SegmentationPoster179 citations
- Discovering Fair Representations in the Data DomainPoster179 citations
- DuLa-Net: A Dual-Projection Network for Estimating Room Layouts From a Single RGB PanoramaPoster179 citations
- FML: Face Model Learning From VideosOral179 citations
- In the Wild Human Pose Estimation Using Explicit 2D Features and Intermediate 3D RepresentationsOral178 citations
- SCOPS: Self-Supervised Co-Part SegmentationPoster178 citations
- A Neural Network Based on SPD Manifold Learning for Skeleton-Based Hand Gesture RecognitionPoster177 citations
- Exploiting Kernel Sparsity and Entropy for Interpretable CNN CompressionPoster177 citations
- FineGAN: Unsupervised Hierarchical Disentanglement for Fine-Grained Object Generation and DiscoveryOral177 citations
- Deep Defocus Map Estimation Using Domain AdaptationPoster175 citations
- Photo Wake-Up: 3D Character Animation From a Single PhotoPoster175 citations
- A Bayesian Perspective on the Deep Image PriorPoster174 citations
- Adversarial Attacks Beyond the Image SpaceOral174 citations
- InverseRenderNet: Learning Single Image Inverse RenderingPoster174 citations
- PEPSI : Fast Image Inpainting With Parallel Decoding NetworkPoster174 citations
- Query-Guided End-To-End Person SearchPoster174 citations
- Unsupervised Learning of Dense Shape CorrespondenceOral174 citations
- CAM-Convs: Camera-Aware Multi-Scale Convolutions for Single-View DepthPoster173 citations
- Detailed Human Shape Estimation From a Single Image by Hierarchical Mesh DeformationOral173 citations
- Light Field Messaging With Deep Photographic SteganographyPoster173 citations
- Monocular Depth Estimation Using Relative Depth MapsPoster173 citations
- Neural Task Graphs: Generalizing to Unseen Tasks From a Single Video DemonstrationOral173 citations
- Representation Similarity Analysis for Efficient Task Taxonomy & Transfer LearningPoster173 citations
- Semantically Tied Paired Cycle Consistency for Zero-Shot Sketch-Based Image RetrievalPoster173 citations
- Towards Accurate One-Stage Object Detection With AP-LossPoster173 citations
- Binary Ensemble Neural Network: More Bits per Network or More Networks per Bit?Poster172 citations
- Fast, Diverse and Accurate Image Captioning Guided by Part-Of-SpeechOral172 citations
- Refine and Distill: Exploiting Cycle-Inconsistency and Knowledge Distillation for Unsupervised Monocular Depth EstimationPoster172 citations
- Video Summarization by Learning From Unpaired DataPoster172 citations
- Local Relationship Learning With Person-Specific Shape Regularization for Facial Action Unit DetectionPoster171 citations
- Neural RGB(r)D Sensing: Depth and Uncertainty From a Video CameraOral170 citations
- Fast Spatio-Temporal Residual Network for Video Super-ResolutionPoster169 citations
- GCAN: Graph Convolutional Adversarial Network for Unsupervised Domain AdaptationPoster169 citations
- Learning Cross-Modal Embeddings With Adversarial Networks for Cooking Recipes and Food ImagesPoster169 citations
- Learning to Generate Synthetic Data via CompositingPoster169 citations
- Unsupervised Moving Object Detection via Contextual Information SeparationPoster169 citations
- DMC-Net: Generating Discriminative Motion Cues for Fast Compressed Video Action RecognitionPoster168 citations
- Stochastic Class-Based Hard Example Mining for Deep Metric LearningPoster168 citations
- DeepLight: Learning Illumination for Unconstrained Mobile Mixed RealityPoster167 citations
- Fast Spatially-Varying Indoor Lighting EstimationOral167 citations
- Progressive Teacher-Student Learning for Early Action PredictionPoster166 citations
- Adaptive Weighting Multi-Field-Of-View CNN for Semantic Segmentation in PathologyPoster165 citations
- Wide-Area Crowd Counting via Ground-Plane Density Maps and Multi-View Fusion CNNsPoster165 citations
- Large-Scale Few-Shot Learning: Knowledge Transfer With Class HierarchyPoster164 citations
- Mask-Guided Portrait Editing With Conditional GANsPoster164 citations
- Natural and Realistic Single Image Super-Resolution With Explicit Natural Manifold DiscriminationPoster164 citations
- SFNet: Learning Object-Aware Semantic CorrespondenceOral164 citations
- Single Image Depth Estimation Trained via Depth From Defocus CuesPoster164 citations
- Focus Is All You Need: Loss Functions for Event-Based VisionPoster163 citations
- Robust Facial Landmark Detection via Occlusion-Adaptive Deep NetworksPoster163 citations
- Sequence-To-Sequence Domain Adaptation Network for Robust Text Image RecognitionPoster163 citations
- d-SNE: Domain Adaptation Using Stochastic Neighborhood EmbeddingOral163 citations
- Divide and Conquer the Embedding Space for Metric LearningPoster162 citations
- FilterReg: Robust and Efficient Probabilistic Point-Set Registration Using Gaussian Filter and Twist ParameterizationOral162 citations
- Leveraging Heterogeneous Auxiliary Tasks to Assist Crowd CountingPoster162 citations
- Learning to Cluster Faces on an Affinity GraphOral161 citations
- When Color Constancy Goes Wrong: Correcting Improperly White-Balanced ImagesPoster161 citations
- Learning Metrics From Teachers: Compact Networks for Image EmbeddingPoster160 citations
- Learning-Based Sampling for Natural Image MattingPoster160 citations
- Robust Histopathology Image Analysis: To Label or to Synthesize?Oral160 citations
- Dense Depth Posterior (DDP) From Single Image and Sparse RangePoster159 citations
- Less Is More: Learning Highlight Detection From Video DurationPoster159 citations
- Look Back and Predict Forward in Image CaptioningPoster159 citations
- R2GAN: Cross-Modal Recipe Retrieval With Generative Adversarial NetworkPoster159 citations
- Social-IQ: A Question Answering Benchmark for Artificial Social IntelligenceOral159 citations
- Coloring With Limited Data: Few-Shot Colorization via Memory Augmented NetworksPoster158 citations
- Learning Attraction Field Representation for Robust Line Segment DetectionPoster158 citations
- Deep Rigid Instance Scene FlowPoster157 citations
- Detect-To-Retrieve: Efficient Regional Aggregation for Image SearchPoster157 citations
- Parsing R-CNN for Instance-Level Human AnalysisPoster157 citations
- Towards Natural and Accurate Future Motion Prediction of Humans and AnimalsPoster157 citations
- Curls & Whey: Boosting Black-Box Adversarial AttacksOral156 citations
- Convolutional Relational Machine for Group Activity RecognitionPoster155 citations
- LaSO: Label-Set Operations Networks for Multi-Label Few-Shot LearningOral154 citations
- RENAS: Reinforced Evolutionary Neural Architecture SearchPoster154 citations
- Revealing Scenes by Inverting Structure From Motion ReconstructionsOral154 citations
- Efficient Online Multi-Person 2D Pose Tracking With Recurrent Spatio-Temporal Affinity FieldsOral153 citations
- Inverse Path Tracing for Joint Material and Lighting EstimationOral153 citations
- Triangulation Learning Network: From Monocular to Stereo 3D Object DetectionPoster153 citations
- 3DN: 3D Deformation NetworkPoster152 citations
- Kernel Transformer Networks for Compact Spherical ConvolutionPoster152 citations
- RegularFace: Deep Face Recognition via Exclusive RegularizationPoster152 citations
- Spatial-Aware Graph Relation Network for Large-Scale Object DetectionPoster151 citations
- Unequal-Training for Deep Face Recognition With Long-Tailed Noisy DataPoster151 citations
- Attribute-Aware Face Aging With Wavelet-Based Generative Adversarial NetworksPoster150 citations
- Connecting Touch and Vision via Cross-Modal PredictionPoster150 citations
- NM-Net: Mining Reliable Neighbors for Robust Feature CorrespondencesOral150 citations
- Networks for Joint Affine and Non-Parametric Image RegistrationPoster150 citations
- Sliced Wasserstein Generative ModelsPoster150 citations
- A Compact Embedding for Facial Expression SimilarityPoster148 citations
- Reducing Uncertainty in Undersampled MRI Reconstruction With Active AcquisitionPoster147 citations
- TAFE-Net: Task-Aware Feature Embeddings for Low Shot LearningPoster147 citations
- Object Counting and Instance Segmentation With Image-Level SupervisionPoster146 citations
- Single Image Reflection Removal Beyond LinearityPoster146 citations
- Acoustic Non-Line-Of-Sight ImagingOral145 citations
- DARNet: Deep Active Ray Network for Building SegmentationPoster145 citations
- Efficient Neural Network CompressionPoster145 citations
- CLEVR-Ref+: Diagnosing Visual Reasoning With Referring ExpressionsPoster144 citations
- HetConv: Heterogeneous Kernel-Based Convolutions for Deep CNNsPoster144 citations
- Learning Channel-Wise Interactions for Binary Convolutional Neural NetworksPoster144 citations
- MVF-Net: Multi-View 3D Face Morphable Model RegressionPoster144 citations
- Recursive Visual Attention in Visual DialogOral144 citations
- Structural Relational Reasoning of Point CloudsPoster144 citations
- UniformFace: Learning Deep Equidistributed Representation for Face RecognitionPoster144 citations
- Vision-Based Navigation With Language-Based Assistance via Imitation Learning With Indirect InterventionPoster144 citations
- 3D Local Features for Direct Pairwise RegistrationPoster143 citations
- Reasoning Visual Dialogs With Structural and Partial ObservationsOral143 citations
- TraVeLGAN: Image-To-Image Translation by Transformation Vector LearningPoster143 citations
- Cyclic Guidance for Weakly Supervised Joint Detection and SegmentationPoster142 citations
- Deep Sky Modeling for Single Image Outdoor Lighting EstimationOral142 citations
- Aggregation Cross-Entropy for Sequence RecognitionOral141 citations
- Detection Based Defense Against Adversarial Examples From the Steganalysis Point of ViewPoster141 citations
- Iterative Reorganization With Weak Spatial Constraints: Solving Arbitrary Jigsaw Puzzles for Unsupervised Representation LearningPoster141 citations
- TextureNet: Consistent Local Parametrizations for Learning From High-Resolution Signals on MeshesOral141 citations
- Unsupervised Person Image Generation With Semantic Parsing TransformationOral141 citations
- BridgeNet: A Continuity-Aware Probabilistic Network for Age EstimationPoster140 citations
- Deep Transfer Learning for Multiple Class Novelty DetectionPoster140 citations
- Disentangling Latent Hands for Image Synthesis and Pose EstimationPoster140 citations
- PointFlowNet: Learning Representations for Rigid Motion Estimation From Point CloudsPoster140 citations
- Rob-GAN: Generator, Discriminator, and Adversarial AttackerPoster140 citations
- Wide-Context Semantic Image ExtrapolationPoster140 citations
- Unsupervised Learning of Action Classes With Continuous Temporal EmbeddingPoster139 citations
- Weakly-Supervised Discovery of Geometry-Aware Representation for 3D Human Pose EstimationOral139 citations
- Adaptive Confidence Smoothing for Generalized Zero-Shot LearningPoster138 citations
- Context-Aware Visual Compatibility PredictionPoster138 citations
- MSCap: Multi-Style Image Captioning With Unpaired Stylized TextPoster138 citations
- Time-Conditioned Action Anticipation in One ShotPoster138 citations
- Multi-Level Context Ultra-Aggregation for Stereo MatchingPoster137 citations
- Shape2Motion: Joint Analysis of Motion Parts and Attributes From 3D ShapesOral137 citations
- The Pros and Cons: Rank-Aware Temporal Attention for Skill Determination in Long VideosPoster137 citations
- CapSal: Leveraging Captioning to Boost Semantics for Salient Object DetectionPoster136 citations
- Disentangled Representation Learning for 3D Face ShapePoster136 citations
- Coordinate-Based Texture Inpainting for Pose-Guided Human Image GenerationPoster135 citations
- Frame-Consistent Recurrent Video Deraining With Dual-Level FlowPoster135 citations
- TransGaGa: Geometry-Aware Unsupervised Image-To-Image TranslationPoster135 citations
- Efficient Featurized Image Pyramid Network for Single Shot DetectorPoster134 citations
- Compressing Convolutional Neural Networks via Factorized Convolutional FiltersPoster133 citations
- Cross-Modal Relationship Inference for Grounding Referring ExpressionsPoster133 citations
- Deep Incremental Hashing Network for Efficient Image RetrievalPoster133 citations
- Deep Metric Learning Beyond Binary SupervisionOral133 citations
- Fully Automatic Video Colorization With Self-Regularization and DiversityPoster133 citations
- Locating Objects Without Bounding BoxesOral133 citations
- EventNet: Asynchronous Recursive Event ProcessingPoster132 citations
- Factor Graph AttentionPoster132 citations
- VizWiz-Priv: A Dataset for Recognizing the Presence and Purpose of Private Visual Information in Images Taken by Blind PeoplePoster132 citations
- Collaborative Spatiotemporal Feature Learning for Video Action RecognitionPoster131 citations
- Grounding Human-To-Vehicle Advice for Self-Driving VehiclesPoster131 citations
- Distant Supervised Centroid Shift: A Simple and Efficient Approach to Visual Domain AdaptationPoster130 citations
- MeshAdv: Adversarial Meshes for Visual RecognitionOral130 citations
- Multi-Target Embodied Question AnsweringPoster130 citations
- SpherePHD: Applying CNNs on a Spherical PolyHeDron Representation of 360deg ImagesPoster130 citations
- Towards Instance-Level Image-To-Image TranslationPoster130 citations
- Attending to Discriminative Certainty for Domain AdaptationPoster129 citations
- Residual Regression With Semantic Prior for Crowd CountingPoster129 citations
- Self-Supervised Representation Learning From Videos for Facial Action Unit DetectionOral129 citations
- Textured Neural AvatarsOral129 citations
- Unsupervised Face Normalization With Extreme Pose and Expression in the WildPoster129 citations
- Distilled Person Re-Identification: Towards a More Scalable SystemPoster128 citations
- RF-Net: An End-To-End Image Matching Network Based on Receptive FieldPoster128 citations
- Video Generation From Single Semantic Label MapPoster128 citations
- Self-Supervised 3D Hand Pose Estimation Through Training by FittingOral127 citations
- Single-Image Piece-Wise Planar 3D Reconstruction via Associative EmbeddingPoster127 citations
- Video Relationship Reasoning Using Gated Spatio-Temporal Energy GraphPoster127 citations
- Balanced Self-Paced Learning for Generative Adversarial Clustering NetworkOral126 citations
- Blind Geometric Distortion Correction on Images Through Deep LearningPoster126 citations
- Describing Like Humans: On Diversity in Image CaptioningPoster126 citations
- Detecting Overfitting of Deep Generative Networks via Latent RecoveryPoster126 citations
- Diverse Generation for Multi-Agent Sports GamesOral126 citations
- Mixed Effects Neural Networks (MeNets) With Applications to Gaze EstimationPoster126 citations
- BeautyGlow: On-Demand Makeup Transfer Framework With Reversible Generative NetworkPoster125 citations
- Putting Humans in a Scene: Learning Affordance in 3D Indoor EnvironmentsPoster125 citations
- SimulCap : Single-View Human Performance Capture With Cloth SimulationPoster125 citations
- Generalized Zero-Shot Recognition Based on Visually Semantic EmbeddingPoster124 citations
- Large Scale High-Resolution Land Cover Mapping With Multi-Resolution DataPoster124 citations
- Large-Scale Distributed Second-Order Optimization Using Kronecker-Factored Approximate Curvature for Deep Convolutional Neural NetworksPoster124 citations
- Scan2Mesh: From Unstructured Range Scans to 3D MeshesPoster124 citations
- Speed Invariant Time Surface for Learning to Detect Corner Points With Event-Based CamerasPoster124 citations
- Towards Real Scene Super-Resolution With Raw ImagesPoster124 citations
- Beyond Tracking: Selecting Memory and Refining Poses for Deep Visual OdometryOral123 citations
- Spatiotemporal CNN for Video Object SegmentationPoster122 citations
- Structured Pruning of Neural Networks With Budget-Aware RegularizationPoster122 citations
- Adversarial Defense by Stratified Convolutional Sparse CodingPoster121 citations
- Mitigating Information Leakage in Image Representations: A Maximum Entropy ApproachOral121 citations
- PartNet: A Recursive Part Decomposition Network for Fine-Grained and Hierarchical Shape SegmentationPoster121 citations
- A Structured Model for Action DetectionPoster120 citations
- Blending-Target Domain Adaptation by Adversarial Meta-Adaptation NetworksOral120 citations
- Improving Few-Shot User-Specific Gaze Adaptation via Gaze Redirection SynthesisPoster120 citations
- MetaCleaner: Learning to Hallucinate Clean Representations for Noisy-Labeled Visual RecognitionPoster120 citations
- Art2Real: Unfolding the Reality of Artworks via Semantically-Aware Image-To-Image TranslationPoster119 citations
- DAVANet: Stereo Deblurring With View AggregationOral119 citations
- Decorrelated Adversarial Learning for Age-Invariant Face RecognitionPoster119 citations
- Depth Coefficients for Depth CompletionPoster119 citations
- LP-3DCNN: Unveiling Local Phase in 3D Convolutional Neural NetworksPoster119 citations
- Leveraging Crowdsourced GPS Data for Road Extraction From Aerial ImageryPoster119 citations
- StereoDRNet: Dilated Residual StereoNetPoster119 citations
- All You Need Is a Few Shifts: Designing Efficient Convolutional Neural Networks for Image ClassificationPoster118 citations
- Dance With Flow: Two-In-One Stream Action DetectionPoster118 citations
- Discovering Visual Patterns in Art Collections With Spatially-Consistent Feature LearningPoster118 citations
- Efficient Video Classification Using Fewer FramesOral118 citations
- Generalising Fine-Grained Sketch-Based Image RetrievalPoster118 citations
- Generalizing Eye Tracking With Bayesian Adversarial LearningPoster118 citations
- Re-Ranking via Metric Fusion for Object Retrieval and Person Re-IdentificationPoster118 citations
- Robustness of 3D Deep Learning in an Adversarial SettingPoster118 citations
- Reasoning-RCNN: Unifying Adaptive Global Reasoning Into Large-Scale Object DetectionOral117 citations
- 3D Guided Fine-Grained Face ManipulationPoster116 citations
- Information Maximizing Visual Question GenerationPoster116 citations
- Towards Social Artificial Intelligence: Nonverbal Social Signal Prediction in a Triadic InteractionOral116 citations
- Adversarial Inference for Multi-Sentence Video DescriptionOral115 citations
- Deep Single Image Camera Calibration With Radial DistortionPoster115 citations
- Explicit Bias Discovery in Visual Question Answering ModelsPoster115 citations
- Exploring Context and Visual Pattern of Relationship for Scene Graph GenerationPoster115 citations
- SDRSAC: Semidefinite-Based Randomized Approach for Robust Point Cloud Registration Without CorrespondencesOral114 citations
- You Look Twice: GaterNet for Dynamic Filter Selection in CNNsPoster114 citations
- Beyond Volumetric Albedo -- A Surface Optimization Framework for Non-Line-Of-Sight ImagingPoster113 citations
- Bilateral Cyclic Constraint and Adaptive Regularization for Unsupervised Monocular Depth PredictionPoster113 citations
- Facial Emotion Distribution Learning by Exploiting Low-Rank Label Correlations LocallyPoster113 citations
- Geometry-Aware Distillation for Indoor Semantic SegmentationPoster113 citations
- Metric Learning for Image RegistrationPoster113 citations
- SAIL-VOS: Semantic Amodal Instance Level Video Object Segmentation - A Synthetic Dataset and BaselinesPoster113 citations
- Attention-Based Adaptive Selection of Operations for Image Restoration in the Presence of Unknown Combined DistortionsPoster112 citations
- C3AE: Exploring the Limits of Compact Model for Age EstimationPoster112 citations
- Dense Relational Captioning: Triple-Stream Networks for Relationship-Based CaptioningPoster112 citations
- Dissimilarity Coefficient Based Weakly Supervised Object DetectionPoster112 citations
- PA3D: Pose-Action 3D Machine for Video RecognitionPoster112 citations
- TACNet: Transition-Aware Context Network for Spatio-Temporal Action DetectionPoster112 citations
- A Content Transformation Block for Image Style TransferPoster111 citations
- Nesti-Net: Normal Estimation for Unstructured 3D Point Clouds Using Convolutional Neural NetworksPoster111 citations
- Text2Scene: Generating Compositional Scenes From Textual DescriptionsOral111 citations
- Co-Saliency Detection via Mask-Guided Fully Convolutional Networks With Multi-Scale Label SmoothingPoster110 citations
- Modulating Image Restoration With Continual Levels via Adaptive Feature Modification LayersOral110 citations
- PPGNet: Learning Point-Pair Graph for Line Segment DetectionPoster110 citations
- Content-Aware Multi-Level Guidance for Interactive Instance SegmentationPoster109 citations
- Deep Network Interpolation for Continuous Imagery Effect TransitionPoster109 citations
- Signal-To-Noise Ratio: A Robust Distance Metric for Deep Metric LearningPoster109 citations
- Answer Them All! Toward Universal Visual Question Answering ModelsPoster108 citations
- Hyperspectral Image Super-Resolution With Optimized RGB GuidancePoster108 citations
- On Exploring Undetermined Relationships for Visual Relationship DetectionPoster108 citations
- S4Net: Single Stage Salient-Instance SegmentationPoster108 citations
- CrossInfoNet: Multi-Task Information Sharing Based Hand Pose EstimationPoster107 citations
- Sensitive-Sample Fingerprinting of Deep Neural NetworksPoster107 citations
- Object Tracking by Reconstruction With View-Specific Discriminative Correlation FiltersPoster106 citations
- Point-To-Pose Voting Based Hand Pose Estimation Using Residual Permutation Equivariant LayerPoster106 citations
- Toward Realistic Image Compositing With Adversarial LearningPoster105 citations
- Towards Robust Curve Text Detection With Conditional Spatial ExpansionPoster105 citations
- A Cross-Season Correspondence Dataset for Robust Semantic SegmentationPoster104 citations
- A Skeleton-Bridged Deep Learning Approach for Generating Meshes of Complex Topologies From Single RGB ImagesOral104 citations
- Combining 3D Morphable Models: A Large Scale Face-And-Head ModelOral104 citations
- Learning View Priors for Single-View 3D ReconstructionPoster104 citations
- Model-Blind Video Denoising via Frame-To-Frame TrainingPoster104 citations
- Quasi-Unsupervised Color ConstancyPoster104 citations
- Example-Guided Style-Consistent Image Synthesis From Semantic LabelingPoster102 citations
- Guided Stereo MatchingPoster102 citations
- Learning to Synthesize Motion BlurOral102 citations
- WarpGAN: Automatic Caricature GenerationOral102 citations
- Bridging Stereo Matching and Optical Flow via Spatiotemporal CorrespondencePoster101 citations
- Not Using the Car to See the Sidewalk -- Quantifying and Controlling the Effects of Context in Classification and SegmentationPoster101 citations
- Deeply-Supervised Knowledge SynergyPoster100 citations
- Learning Image and Video Compression Through Spatial-Temporal Energy CompactionPoster100 citations
- Learning to Calibrate Straight Lines for Fisheye Image RectificationPoster100 citations
- On Finding Gray PixelsPoster100 citations
- Relational Action ForecastingOral100 citations
- SeerNet: Predicting Convolutional Neural Network Feature-Map Sparsity Through Low-Bit QuantizationPoster100 citations
- Multi-Level Multimodal Common Semantic Space for Image-Phrase GroundingPoster99 citations
- Pedestrian Detection With Autoregressive Network PhasesPoster99 citations
- Privacy Preserving Image-Based LocalizationPoster99 citations
- Semantically Aligned Bias Reducing Zero Shot LearningPoster99 citations
- Face Parsing With RoI Tanh-WarpingPoster98 citations
- Object Instance Annotation With Deep Extreme Level Set EvolutionPoster98 citations
- Two Body Problem: Collaborative Visual Task CompletionOral98 citations
- IM-Net for High Resolution Video Frame InterpolationOral97 citations
- Interactive Full Image Segmentation by Considering All Regions JointlyPoster97 citations
- RGBD Based Dimensional Decomposition Residual Network for 3D Semantic Scene CompletionPoster97 citations
- ROI Pooled Correlation Filters for Visual TrackingPoster97 citations
- Steady-State Non-Line-Of-Sight ImagingOral97 citations
- Bringing Alive Blurred MomentsOral96 citations
- Complete the Look: Scene-Based Complementary Product RecommendationPoster96 citations
- Deep ChArUco: Dark ChArUco Marker Pose EstimationPoster96 citations
- Learning to Minify Photometric StereoPoster96 citations
- Multi-Person Articulated Tracking With Spatial and Temporal EmbeddingsPoster96 citations
- Progressive Attention Memory Network for Movie Story Question AnsweringPoster96 citations
- Does Learning Specific Features for Related Parts Help Human Pose Estimation?Poster95 citations
- Learning Instance Activation Maps for Weakly Supervised Instance SegmentationPoster95 citations
- PMS-Net: Robust Haze Removal Based on Patch Map for Single ImagesPoster95 citations
- SceneCode: Monocular Dense Semantic Reconstruction Using Learned Encoded Scene RepresentationsPoster95 citations
- AdaGraph: Unifying Predictive and Continuous Domain Adaptation Through GraphsOral94 citations
- Circulant Binary Convolutional Networks: Enhancing the Performance of 1-Bit DCNNs With Circulant Back PropagationPoster94 citations
- Fully Learnable Group Convolution for Acceleration of Deep Neural NetworksPoster94 citations
- Label-Noise Robust Generative Adversarial NetworksOral94 citations
- Noise-Aware Unsupervised Deep Lidar-Stereo FusionPoster94 citations
- Social Relation Recognition From Videos via Multi-Scale Spatial-Temporal ReasoningPoster94 citations
- Spot and Learn: A Maximum-Entropy Patch Sampler for Few-Shot Image ClassificationPoster94 citations
- Dense 3D Face Decoding Over 2500FPS: Joint Texture & Shape Convolutional Mesh DecodersPoster93 citations
- Depth From a Polarisation + RGB Stereo PairPoster93 citations
- Learning to Adapt for StereoPoster93 citations
- T-Net: Parametrizing Fully Convolutional Nets With a Single High-Order TensorPoster93 citations
- Action Recognition From Single Timestamp Supervision in Untrimmed VideosPoster92 citations
- Local Features and Visual Words Emerge in ActivationsPoster92 citations
- Occlusion-Net: 2D/3D Occluded Keypoint Localization Using Graph NetworksPoster92 citations
- Variational Prototyping-Encoder: One-Shot Learning With Prototypical ImagesPoster92 citations
- Context and Attribute Grounded Dense CaptioningPoster91 citations
- Event Cameras, Contrast Maximization and Reward Functions: An AnalysisPoster91 citations
- Photometric Mesh Optimization for Video-Aligned 3D Object ReconstructionPoster91 citations
- Simultaneously Optimizing Weight and Quantizer of Ternary Neural Network Using Truncated Gaussian ApproximationPoster91 citations
- Inverse Discriminative Networks for Handwritten Signature VerificationPoster90 citations
- On the Intrinsic Dimensionality of Image RepresentationsPoster90 citations
- SoDeep: A Sorting Deep Net to Learn Ranking Loss SurrogatesOral90 citations
- A Perceptual Prediction Framework for Self Supervised Event SegmentationPoster89 citations
- DeepMapping: Unsupervised Map Estimation From Multiple Point CloudsOral89 citations
- Not All Areas Are Equal: Transfer Learning for Semantic Segmentation via Hierarchical Region SelectionOral89 citations
- All-Weather Deep Outdoor Lighting EstimationPoster88 citations
- DeFusionNET: Defocus Blur Detection via Recurrently Fusing and Refining Multi-Scale Deep FeaturesPoster88 citations
- Multi-Step Prediction of Occupancy Grid Maps With Recurrent Neural NetworksPoster88 citations
- Noise-Tolerant Paradigm for Training Face Recognition CNNsPoster88 citations
- Pointing Novel Objects in Image CaptioningPoster88 citations
- Using Unknown Occluders to Recover Hidden ScenesPoster88 citations
- ELASTIC: Improving CNNs With Dynamic Scaling PoliciesOral87 citations
- A Simple Baseline for Audio-Visual Scene-Aware DialogPoster86 citations
- Convolutional Recurrent Network for Road Boundary ExtractionPoster86 citations
- Deep Surface Normal Estimation With Hierarchical RGB-D FusionPoster86 citations
- DeepCO3: Deep Instance Co-Segmentation by Co-Peak Search and Co-Saliency DetectionOral86 citations
- Estimating 3D Motion and Forces of Person-Object Interactions From Monocular VideoOral86 citations
- Learning for Single-Shot Confidence Calibration in Deep Neural Networks Through Stochastic InferencesPoster86 citations
- Temporal Transformer Networks: Joint Learning of Invariant and Discriminative Time WarpingPoster86 citations
- ZigZagNet: Fusing Top-Down and Bottom-Up Context for Object SegmentationPoster86 citations
- High Flux Passive Imaging With Single-Photon SensorsOral85 citations
- Learning Binary Code for Personalized Fashion RecommendationPoster85 citations
- Progressive Ensemble Networks for Zero-Shot RecognitionPoster85 citations
- Handwriting Recognition in Low-Resource Scripts Using Adversarial LearningPoster84 citations
- QATM: Quality-Aware Template Matching for Deep LearningPoster84 citations
- Reliable and Efficient Image Cropping: A Grid Anchor Based ApproachPoster84 citations
- Kervolutional Neural NetworksOral83 citations
- Learning Spatial Common Sense With Geometry-Aware Recurrent NetworksOral83 citations
- Unsupervised Deep Epipolar Flow for Stationary or Dynamic ScenesPoster83 citations
- Unsupervised Multi-Modal Neural Machine TranslationPoster83 citations
- Accelerating Convolutional Neural Networks via Activation Map CompressionPoster82 citations
- Image-Question-Answer Synergistic Network for Visual DialogPoster82 citations
- Ensemble Deep Manifold Similarity Learning Using Hard ProxiesPoster81 citations
- Homomorphic Latent Space Interpolation for Unpaired Image-To-Image TranslationOral81 citations
- LiFF: Light Field Features in Scale and DepthPoster81 citations
- Adaptively Connected Neural NetworksPoster80 citations
- End-To-End Supervised Product Quantization for Image Search and RetrievalPoster80 citations
- Learning Single-Image Depth From Videos Using Quality Assessment NetworksPoster80 citations
- Learning Video Representations From Correspondence ProposalsOral80 citations
- Phase-Only Image Based Kernel Estimation for Single Image Blind DeblurringPoster80 citations
- Fast Single Image Reflection Suppression via Convex OptimizationPoster79 citations
- Fast User-Guided Video Object Segmentation by Interaction-And-Propagation NetworksPoster79 citations
- Learning Multi-Class Segmentations From Single-Class DatasetsPoster78 citations
- OICSR: Out-In-Channel Sparsity Regularization for Compact Deep Neural NetworksPoster78 citations
- Spherical Regression: Learning Viewpoints, Surface Normals and 3D Rotations on N-SpheresPoster78 citations
- Trust Region Based Adversarial Attack on Neural NetworksPoster78 citations
- Which Way Are You Going? Imitative Decision Learning for Path Forecasting in Dynamic ScenesOral78 citations
- A Theoretically Sound Upper Bound on the Triplet Loss for Improving the Efficiency of Deep Distance Metric LearningPoster77 citations
- Divergence Triangle for Joint Training of Generator Model, Energy-Based Model, and Inferential ModelOral77 citations
- Face-Focused Cross-Stream Network for Deception Detection in VideosPoster77 citations
- Hybrid-Attention Based Decoupled Metric Learning for Zero-Shot Image RetrievalPoster77 citations
- Multi-Task Learning of Hierarchical Vision-Language RepresentationPoster77 citations
- Triply Supervised Decoder Networks for Joint Detection and SegmentationPoster77 citations
- Unsupervised Image Matching and Object Discovery as OptimizationPoster77 citations
- Dynamic Recursive Neural NetworkPoster76 citations
- Holistic and Comprehensive Annotation of Clinically Significant Findings on Diverse CT Images: Learning From Radiology Reports and Label OntologyOral76 citations
- RePr: Improved Training of Convolutional FiltersOral76 citations
- Reflection Removal Using a Dual-Pixel SensorPoster76 citations
- Self-Critical N-Step Training for Image CaptioningPoster76 citations
- Enhancing Diversity of Defocus Blur Detectors via Cross-Ensemble NetworkOral75 citations
- LAEO-Net: Revisiting People Looking at Each Other in VideosPoster75 citations
- On Stabilizing Generative Adversarial Training With NoisePoster75 citations
- Photon-Flooded Single-Photon 3D CamerasOral75 citations
- Privacy Protection in Street-View Panoramas Using Depth and Multi-View ImageryPoster75 citations
- Unifying Heterogeneous Classifiers With DistillationPoster75 citations
- Learning Joint Gait Representation via Quintuplet Loss MinimizationOral74 citations
- Semantic Alignment: Finding Semantically Consistent Ground-Truth for Facial Landmark DetectionPoster74 citations
- Atlas of Digital Pathology: A Generalized Hierarchical Histological Tissue Type-Annotated Database for Deep LearningPoster73 citations
- Robust Video Stabilization by Optimization in CNN Weight SpacePoster73 citations
- Defense Against Adversarial Images Using Web-Scale Nearest-Neighbor SearchOral72 citations
- Hierarchical Disentanglement of Discriminative Latent Features for Zero-Shot LearningPoster72 citations
- Marginalized Latent Semantic Encoder for Zero-Shot LearningPoster72 citations
- Object Discovery in Videos as Foreground Motion ClusteringPoster72 citations
- CRAVES: Controlling Robotic Arm With a Vision-Based Economic SystemPoster71 citations
- SSN: Learning Sparse Switchable Normalization via SparsestMaxPoster71 citations
- SketchGAN: Joint Sketch Completion and Recognition With Generative Adversarial NetworkPoster71 citations
- Student Becoming the Master: Knowledge Amalgamation for Joint Scene Parsing, Depth Estimation, and MorePoster71 citations
- A Variational Auto-Encoder Model for Stochastic Point ProcessesPoster70 citations
- Bayesian Hierarchical Dynamic Model for Human Action RecognitionPoster70 citations
- Hybrid Scene Compression for Visual LocalizationPoster70 citations
- Led3D: A Lightweight and Efficient Deep Approach to Recognizing Low-Quality 3D FacesPoster70 citations
- Non-Adversarial Image Synthesis With Generative Latent Nearest NeighborsPoster70 citations
- Reversible GANs for Memory-Efficient Image-To-Image TranslationPoster70 citations
- SIGNet: Semantic Instance Aided Unsupervised 3D Geometry PerceptionPoster70 citations
- Training Deep Learning Based Image Denoisers From Undersampled Measurements Without Ground Truth and Without Image PriorPoster70 citations
- Im2Pencil: Controllable Pencil Illustration From PhotographsPoster68 citations
- Learning to Extract Flawless Slow Motion From Blurry VideosPoster68 citations
- LiveSketch: Query Perturbations for Guided Sketch-Based Visual SearchPoster68 citations
- A Local Block Coordinate Descent Algorithm for the CSC ModelPoster67 citations
- Joint Face Detection and Facial Motion Retargeting for Multiple FacesPoster67 citations
- Learning Transformation SynchronizationPoster67 citations
- MHP-VOS: Multiple Hypotheses Propagation for Video Object SegmentationOral67 citations
- Tracking by Animation: Unsupervised Learning of Multi-Object Attentive TrackersPoster67 citations
- Disentangling Latent Space for VAE by Label Relevant/Irrelevant DimensionsPoster66 citations
CVPR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.