ICCV 2019 Accepted Papers
The full list of 1,075 papers accepted at ICCV 2019 (IEEE/CVF International Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 862Oral: 200
- Searching for MobileNetV3Oral10,859 citations
- FCOS: Fully Convolutional One-Stage Object DetectionPoster7,221 citations
- CutMix: Regularization Strategy to Train Strong Classifiers With Localizable FeaturesOral6,589 citations
- SlowFast Networks for Video RecognitionOral4,462 citations
- CenterNet: Keypoint Triplets for Object DetectionPoster4,174 citations
- CCNet: Criss-Cross Attention for Semantic SegmentationPoster3,729 citations
- KPConv: Flexible and Deformable Convolution for Point CloudsPoster3,401 citations
- YOLACT: Real-Time Instance SegmentationOral2,970 citations
- FaceForensics++: Learning to Detect Manipulated Facial ImagesPoster2,929 citations
- Digging Into Self-Supervised Monocular Depth EstimationPoster2,896 citations
- TSM: Temporal Shift Module for Efficient Video UnderstandingPoster2,510 citations
- SemanticKITTI: A Dataset for Semantic Scene Understanding of LiDAR SequencesOral2,413 citations
- Free-Form Image Inpainting With Gated ConvolutionOral2,386 citations
- Moment Matching for Multi-Source Domain AdaptationOral2,315 citations
- DeepGCNs: Can GCNs Go As Deep As CNNs?Oral1,943 citations
- Memorizing Normality to Detect Anomaly: Memory-Augmented Deep Autoencoder for Unsupervised Anomaly DetectionPoster1,892 citations
- Habitat: A Platform for Embodied AI ResearchOral1,687 citations
- Deep Hough Voting for 3D Object Detection in Point CloudsOral1,587 citations
- AMASS: Archive of Motion Capture As Surface ShapesPoster1,579 citations
- PANet: Few-Shot Image Semantic Segmentation With Prototype AlignmentOral1,571 citations
- VideoBERT: A Joint Model for Video and Language Representation LearningPoster1,568 citations
- Learning Discriminative Model Prediction for TrackingOral1,548 citations
- PIFu: Pixel-Aligned Implicit Function for High-Resolution Clothed Human DigitizationPoster1,539 citations
- Attention Augmented Convolutional NetworksPoster1,501 citations
- Rethinking ImageNet Pre-TrainingPoster1,470 citations
- HowTo100M: Learning a Text-Video Embedding by Watching Hundred Million Narrated Video ClipsPoster1,412 citations
- Image2StyleGAN: How to Embed Images Into the StyleGAN Latent Space?Oral1,379 citations
- Similarity-Preserving Knowledge DistillationOral1,344 citations
- Tracking Without Bells and WhistlesPoster1,321 citations
- EGNet: Edge Guidance Network for Salient Object DetectionPoster1,302 citations
- RepPoints: Point Set Representation for Object DetectionPoster1,297 citations
- Scale-Aware Trident Networks for Object DetectionOral1,247 citations
- DeblurGAN-v2: Deblurring (Orders-of-Magnitude) Faster and BetterPoster1,241 citations
- Learning to Reconstruct 3D Human Pose and Shape via Model-Fitting in the LoopPoster1,232 citations
- Symmetric Cross Entropy for Robust Learning With Noisy LabelsPoster1,222 citations
- Attention on Attention for Image CaptioningOral1,219 citations
- Deep Closest Point: Learning Representations for Point Cloud RegistrationPoster1,194 citations
- Omni-Scale Feature Learning for Person Re-IdentificationPoster1,193 citations
- Be Your Own Teacher: Improve the Performance of Convolutional Neural Networks via Self DistillationPoster1,137 citations
- S4L: Self-Supervised Semi-Supervised LearningOral1,125 citations
- Invariant Information Clustering for Unsupervised Image Classification and SegmentationPoster1,113 citations
- SinGAN: Learning a Generative Model From a Single Natural ImageOral1,110 citations
- GridDehazeNet: Attention-Based Multi-Scale Network for Image DehazingPoster1,096 citations
- SCRDet: Towards More Robust Detection for Small, Cluttered and Rotated ObjectsPoster1,074 citations
- Revisiting Point Cloud Classification: A New Benchmark Dataset and Classification Model on Real-World DataOral1,063 citations
- Confidence Regularized Self-TrainingOral1,037 citations
- Everybody Dance NowPoster1,014 citations
- Few-Shot Object Detection via Feature ReweightingPoster999 citations
- Few-Shot Unsupervised Image-to-Image TranslationPoster995 citations
- ACNet: Strengthening the Kernel Skeletons for Powerful CNN via Asymmetric Convolution BlocksPoster985 citations
- STD: Sparse-to-Dense 3D Object Detector for Point CloudPoster983 citations
- Video Object Segmentation Using Space-Time Memory NetworksOral935 citations
- CARAFE: Content-Aware ReAssembly of FEaturesOral916 citations
- Objects365: A Large-Scale, High-Quality Dataset for Object DetectionPoster910 citations
- On the Efficacy of Knowledge DistillationPoster894 citations
- Gated-SCNN: Gated Shape CNNs for Semantic SegmentationPoster862 citations
- Semi-Supervised Domain Adaptation via Minimax EntropyPoster848 citations
- Progressive Differentiable Architecture Search: Bridging the Depth Gap Between Search and EvaluationOral847 citations
- Asymmetric Non-Local Neural Networks for Semantic SegmentationPoster828 citations
- Fully Convolutional Geometric FeaturesPoster824 citations
- Learning Lightweight Lane Detection CNNs by Self Attention DistillationPoster824 citations
- Soft Rasterizer: A Differentiable Renderer for Image-Based 3D ReasoningOral820 citations
- Drop an Octave: Reducing Spatial Redundancy in Convolutional Neural Networks With Octave ConvolutionPoster811 citations
- Few-Shot Adversarial Learning of Realistic Neural Talking Head ModelsOral810 citations
- FSGAN: Subject Agnostic Face Swapping and ReenactmentPoster808 citations
- PointFlow: 3D Point Cloud Generation With Continuous Normalizing FlowsOral798 citations
- A Comprehensive Overhaul of Feature DistillationPoster791 citations
- BMN: Boundary-Matching Network for Temporal Action Proposal GenerationPoster791 citations
- Video Classification With Channel-Separated Convolutional NetworksPoster784 citations
- Expectation-Maximization Attention Networks for Semantic SegmentationOral783 citations
- Real Image Denoising With Feature AttentionOral774 citations
- Variational Adversarial Active LearningOral754 citations
- What Is Wrong With Scene Text Recognition Model Comparisons? Dataset and Model AnalysisOral729 citations
- 6-DOF GraspNet: Variational Grasp Generation for Object ManipulationPoster714 citations
- STGAT: Modeling Spatial-Temporal Interactions for Human Trajectory PredictionOral714 citations
- Exploring the Limitations of Behavior Cloning for Autonomous DrivingOral703 citations
- Data-Free Quantization Through Weight Equalization and Bias CorrectionOral702 citations
- Generative Adversarial Networks for Extreme Learned Image CompressionPoster698 citations
- Pose-Guided Feature Alignment for Occluded Person Re-IdentificationPoster696 citations
- Local Relation Networks for Image RecognitionPoster690 citations
- Correlation Congruence for Knowledge DistillationPoster688 citations
- Visual Semantic Reasoning for Image-Text MatchingOral682 citations
- An Empirical Study of Spatial Attention Mechanisms in Deep NetworksPoster679 citations
- Bayesian Loss for Crowd Count Estimation With Point SupervisionOral675 citations
- ABD-Net: Attentive but Diverse Person Re-IdentificationPoster672 citations
- VaTeX: A Large-Scale, High-Quality Multilingual Dataset for Video-and-Language ResearchOral669 citations
- Efficient and Accurate Arbitrary-Shaped Text Detection With Pixel Aggregation NetworkPoster666 citations
- Larger Norm More Transferable: An Adaptive Feature Norm Approach for Unsupervised Domain AdaptationOral656 citations
- Meta R-CNN: Towards General Solver for Instance-Level Low-Shot LearningPoster651 citations
- Mesh R-CNNPoster644 citations
- Graph Convolutional Networks for Temporal Action LocalizationPoster640 citations
- HAWQ: Hessian AWare Quantization of Neural Networks With Mixed-PrecisionPoster637 citations
- M3D-RPN: Monocular 3D Region Proposal Network for Object DetectionOral635 citations
- Video Instance SegmentationPoster635 citations
- Toward Real-World Single Image Super-Resolution: A New Benchmark and a New ModelOral633 citations
- Disentangling Monocular 3D Object DetectionPoster628 citations
- Gaussian YOLOv3: An Accurate and Fast Object Detector Using Localization Uncertainty for Autonomous DrivingPoster617 citations
- HoloGAN: Unsupervised Learning of 3D Representations From Natural ImagesPoster617 citations
- Self-Similarity Grouping: A Simple Unsupervised Cross Domain Adaptation Approach for Person Re-IdentificationOral606 citations
- Differentiable Soft Quantization: Bridging Full-Precision and Low-Bit Neural NetworksPoster591 citations
- Exploiting Spatial-Temporal Relationships for 3D Pose Estimation via Graph Convolutional NetworksPoster588 citations
- Pix2Pose: Pixel-Wise Coordinate Regression of Objects for 6D Pose EstimationOral581 citations
- Enforcing Geometric Constraints of Virtual Normal for Depth PredictionPoster577 citations
- Learning Trajectory Dependencies for Human Motion PredictionOral572 citations
- RGB-Infrared Cross-Modality Person Re-Identification via Joint Pixel and Feature AlignmentPoster568 citations
- DPOD: 6D Pose Object Detector and RefinerPoster567 citations
- Episodic Training for Domain GeneralizationOral565 citations
- STM: SpatioTemporal and Motion Encoding for Action RecognitionPoster556 citations
- MetaPruning: Meta Learning for Automatic Neural Network Channel PruningPoster555 citations
- Attributing Fake Images to GANs: Learning and Analyzing GAN FingerprintsPoster551 citations
- FreiHAND: A Dataset for Markerless Capture of Hand Pose and Shape From Single RGB ImagesPoster544 citations
- Balanced Datasets Are Not Enough: Estimating and Mitigating Gender Bias in Deep Image RepresentationsPoster542 citations
- Local Aggregation for Unsupervised Learning of Visual EmbeddingsOral542 citations
- PU-GAN: A Point Cloud Upsampling Adversarial NetworkPoster538 citations
- The Trajectron: Probabilistic Multi-Agent Trajectory Modeling With Dynamic Spatiotemporal GraphsPoster535 citations
- CDPN: Coordinates-Based Disentangled Pose Network for Real-Time RGB-Based 6-DoF Object Pose EstimationOral533 citations
- Understanding Deep Networks via Extremal Perturbations and Smooth MasksOral528 citations
- Anomaly Detection in Video Sequence With Appearance-Motion CorrespondencePoster526 citations
- Depth-Induced Multi-Scale Recurrent Attention Network for Saliency DetectionPoster526 citations
- Boosting Few-Shot Visual Learning With Self-SupervisionPoster511 citations
- Fast Point R-CNNPoster511 citations
- Learning With Average Precision: Training Image Retrieval With a Listwise LossPoster503 citations
- Stacked Cross Refinement Network for Edge-Aware Salient Object DetectionPoster502 citations
- Scaling and Benchmarking Self-Supervised Visual Representation LearningPoster500 citations
- Domain Randomization and Pyramid Consistency: Simulation-to-Real Generalization Without Accessing Target Domain DataPoster497 citations
- SoftTriple Loss: Deep Metric Learning Without Triplet SamplingPoster497 citations
- Coherent Semantic Attention for Image InpaintingPoster494 citations
- Learnable Triangulation of Human PoseOral494 citations
- Universally Slimmable Networks and Improved Training TechniquesPoster490 citations
- Mixed High-Order Attention Network for Person Re-IdentificationPoster487 citations
- Depth From Videos in the Wild: Unsupervised Monocular Depth Learning From Unknown CamerasPoster483 citations
- ShellNet: Efficient Point Cloud Convolutional Neural Networks Using Concentric Shells StatisticsOral481 citations
- Gaze360: Physically Unconstrained Gaze Estimation in the WildPoster475 citations
- Exploring Randomly Wired Neural Networks for Image RecognitionOral472 citations
- Pix2Vox: Context-Aware 3D Reconstruction From Single and Multi-View ImagesPoster471 citations
- PIE: A Large-Scale Dataset and Models for Pedestrian Intention Estimation and Trajectory PredictionOral469 citations
- TensorMask: A Foundation for Dense Object SegmentationPoster469 citations
- Learning Two-View Correspondences and Geometry Using Order-Aware NetworkPoster468 citations
- PRECOG: PREdiction Conditioned on Goals in Visual Multi-Agent SettingsPoster467 citations
- Multi-Garment Net: Learning to Dress 3D People From ImagesPoster464 citations
- Data-Free Learning of Student NetworksPoster463 citations
- Learning the Model Update for Siamese TrackersPoster461 citations
- Seeing What a GAN Cannot GenerateOral457 citations
- StructureFlow: Image Inpainting via Structure-Aware Appearance FlowPoster455 citations
- RankSRGAN: Generative Adversarial Networks With Ranker for Image Super-ResolutionOral454 citations
- Entangled Transformer for Image CaptioningPoster452 citations
- Relation-Aware Graph Attention Network for Visual Question AnsweringPoster451 citations
- Camera Distance-Aware Top-Down Approach for 3D Multi-Person Pose Estimation From a Single RGB ImagePoster449 citations
- Learning Aberrance Repressed Correlation Filters for Real-Time UAV TrackingPoster448 citations
- Feature Weighting and Boosting for Few-Shot SegmentationPoster446 citations
- IL2M: Class Incremental Learning With Dual MemoryPoster443 citations
- Point-Based Multi-View Stereo NetworkOral439 citations
- EPIC-Fusion: Audio-Visual Temporal Binding for Egocentric Action RecognitionPoster438 citations
- A Fast and Accurate One-Stage Approach to Visual GroundingOral437 citations
- Clustered Object Detection in Aerial ImagesPoster432 citations
- Photorealistic Style Transfer via Wavelet TransformsPoster426 citations
- Racial Faces in the Wild: Reducing Racial Bias by Information Maximization Adaptation NetworkPoster426 citations
- Learning Shape Templates With Structured Implicit FunctionsPoster425 citations
- Meta-Learning to Detect Rare ObjectsPoster424 citations
- DeepVCP: An End-to-End Deep Neural Network for Point Cloud RegistrationPoster420 citations
- nocaps: novel object captioning at scalePoster420 citations
- End-to-End Learning of Representations for Asynchronous Event-Based DataPoster418 citations
- Scene Text Visual Question AnsweringPoster417 citations
- HarDNet: A Low Memory Traffic NetworkPoster415 citations
- Multi-Adversarial Faster-RCNN for Unrestricted Object DetectionPoster414 citations
- 3D Scene Graph: A Structure for Unified Semantics, 3D Space, and CameraPoster413 citations
- Domain Adaptation for Structured Output via Discriminative Patch RepresentationsOral413 citations
- Miss Detection vs. False Alarm: Adversarial Learning for Small Object Segmentation in Infrared ImagesPoster412 citations
- DeepHuman: 3D Human Reconstruction From a Single ImageOral405 citations
- Probabilistic Face EmbeddingsPoster404 citations
- GradNet: Gradient-Guided Network for Visual Object TrackingOral400 citations
- Accurate Monocular 3D Object Detection via Color-Embedded 3D Reconstruction for Autonomous DrivingPoster396 citations
- CAMP: Cross-Modal Adaptive Message Passing for Text-Image RetrievalPoster395 citations
- Learning to Discover Novel Visual Categories via Deep Transfer ClusteringPoster395 citations
- Deep Self-Learning From Noisy LabelsPoster393 citations
- Pyramid Graph Networks With Connection Attentions for Region-Based One-Shot Semantic SegmentationPoster388 citations
- AutoGAN: Neural Architecture Search for Generative Adversarial NetworksPoster386 citations
- GANalyze: Toward Visual Definitions of Cognitive Image PropertiesPoster386 citations
- Task2Vec: Task Embedding for Meta-LearningPoster386 citations
- Learning Semantic-Specific Graph Representation for Multi-Label Image RecognitionPoster384 citations
- Domain Adaptation for Semantic Segmentation With Maximum Squares LossPoster382 citations
- SC-FEGAN: Face Editing Generative Adversarial Network With User's Sketch and ColorPoster382 citations
- Human-Aware Motion DeblurringPoster377 citations
- ThunderNet: Towards Real-Time Generic Object Detection on Mobile DevicesPoster377 citations
- NLNL: Negative Learning for Noisy LabelsPoster373 citations
- Tex2Shape: Detailed Full Human Body Geometry From a Single ImagePoster372 citations
- SRM: A Style-Based Recalibration Module for Convolutional Neural NetworksPoster371 citations
- Remote Heart Rate Measurement From Highly Compressed Facial Videos: An End-to-End Deep Learning Solution With Video EnhancementPoster370 citations
- 3D Point Cloud Generative Adversarial Network Based on Tree Structured Graph ConvolutionsPoster369 citations
- DensePoint: Learning Densely Contextual Representation for Efficient Point Cloud ProcessingPoster368 citations
- Texture Fields: Learning Texture Representations in Function SpaceOral368 citations
- Unsupervised Pre-Training of Image Features on Non-Curated DataOral368 citations
- Key.Net: Keypoint Detection by Handcrafted and Learned CNN FiltersPoster364 citations
- Neural-Guided RANSAC: Learning Where to Sample Model HypothesesPoster361 citations
- Resolving 3D Human Pose Ambiguities With 3D Scene ConstraintsPoster359 citations
- ACFNet: Attentional Class Feature Network for Semantic SegmentationPoster357 citations
- Human Uncertainty Makes Classification More RobustPoster357 citations
- Zero-Shot Video Object Segmentation via Attentive Graph Neural NetworksOral353 citations
- Context-Aware Emotion Recognition NetworksPoster352 citations
- Adaptive Wing Loss for Robust Face Alignment via Heatmap RegressionPoster350 citations
- GA-DAN: Geometry-Aware Domain Adaptation Network for Scene Text Detection and RecognitionPoster350 citations
- Recursive Cascaded Networks for Unsupervised Medical Image RegistrationPoster350 citations
- WoodScape: A Multi-Task, Multi-Camera Fisheye Dataset for Autonomous DrivingOral350 citations
- VV-Net: Voxel VAE Net With Group Convolutions for Point Cloud SegmentationPoster348 citations
- HACS: Human Action Clips and Segments Dataset for Recognition and Temporal LocalizationPoster347 citations
- Dynamic Multi-Scale Filters for Semantic SegmentationPoster345 citations
- LPD-Net: 3D Point Cloud Learning for Large-Scale Place Recognition and Environment AnalysisPoster345 citations
- DeepPruner: Learning Efficient Stereo Matching via Differentiable PatchMatchPoster342 citations
- Progressive Fusion Video Super-Resolution Network via Exploiting Non-Local Spatio-Temporal CorrelationsOral337 citations
- Deep Joint-Semantics Reconstructing Hashing for Large-Scale Unsupervised Cross-Modal RetrievalOral334 citations
- Liquid Warping GAN: A Unified Framework for Human Motion Imitation, Appearance Transfer and Novel View SynthesisPoster333 citations
- Self-Ensembling With GAN-Based Data Augmentation for Domain Adaptation in Semantic SegmentationPoster328 citations
- A Robust Learning Approach to Domain Adaptive Object DetectionPoster323 citations
- Single-Stage Multi-Person Pose MachinesPoster320 citations
- Bit-Flip Attack: Crushing Neural Network With Progressive Bit SearchPoster319 citations
- Dynamic Curriculum Learning for Imbalanced Data ClassificationPoster319 citations
- Image Inpainting With Learnable Bidirectional Attention MapsPoster319 citations
- Symmetric Graph Convolutional Autoencoder for Unsupervised Graph Representation LearningPoster319 citations
- O2U-Net: A Simple Noisy Label Detection Approach for Deep Neural NetworksPoster318 citations
- Batch DropBlock Network for Person Re-Identification and BeyondPoster317 citations
- Self-Supervised Learning With Geometric Constraints in Monocular Video: Connecting Flow, Depth, and CameraPoster317 citations
- Meta-Sim: Learning to Generate Synthetic DatasetsOral316 citations
- SSAP: Single-Shot Instance Segmentation With Affinity PyramidPoster316 citations
- Selective Sparse Sampling for Fine-Grained Image RecognitionPoster316 citations
- Auto-ReID: Searching for a Part-Aware ConvNet for Person Re-IdentificationPoster315 citations
- Sequence Level Semantics Aggregation for Video Object DetectionOral315 citations
- Dual Student: Breaking the Limits of the Teacher in Semi-Supervised LearningPoster314 citations
- Occupancy Flow: 4D Reconstruction by Learning Particle DynamicsPoster314 citations
- Spatial-Temporal Relation Networks for Multi-Object TrackingPoster313 citations
- XRAI: Better Attributions Through RegionsPoster312 citations
- Guided Curriculum Model Adaptation and Uncertainty-Aware Evaluation for Semantic Nighttime Image SegmentationPoster311 citations
- Learning to Assemble Neural Module Tree Networks for Visual GroundingOral311 citations
- Self-Supervised Monocular Depth HintsPoster311 citations
- Optimizing Network Structure for 3D Human Pose EstimationPoster307 citations
- Enhancing Adversarial Example Transferability With an Intermediate Level AttackPoster306 citations
- Cross View Fusion for 3D Human Pose EstimationPoster305 citations
- Crowd Counting With Deep Structured Scale Integration NetworkPoster305 citations
- Self-Training With Progressive Augmentation for Unsupervised Cross-Domain Person Re-IdentificationPoster305 citations
- Taking a HINT: Leveraging Explanations to Make Vision and Language Models More GroundedPoster305 citations
- Boundary-Aware Feature Propagation for Scene SegmentationPoster304 citations
- Implicit Surface Representations As Layers in Neural NetworksPoster304 citations
- Occlusion Robust Face Recognition Based on Mask Learning With Pairwise Differential Siamese NetworkPoster303 citations
- Cluster Alignment With a Teacher for Unsupervised Domain AdaptationPoster302 citations
- ClothFlow: A Flow-Based Model for Clothed Person GenerationPoster301 citations
- Learning Combinatorial Embedding Networks for Deep Graph MatchingOral301 citations
- Pixel2Mesh++: Multi-View 3D Mesh Generation via DeformationPoster301 citations
- Seeing Motion in the DarkOral299 citations
- The Sound of MotionsPoster298 citations
- FAMNet: Joint Learning of Feature, Affinity and Multi-Dimensional Assignment for Online Multiple Object TrackingOral293 citations
- Cross-X Learning for Fine-Grained Visual CategorizationPoster292 citations
- A Dual-Path Model With Adaptive Attention for Vehicle Re-IdentificationOral291 citations
- Variable Rate Deep Image Compression With a Conditional AutoencoderOral289 citations
- Learned Video CompressionPoster288 citations
- Global-Local Temporal Representations for Video Person Re-IdentificationPoster286 citations
- Overcoming Catastrophic Forgetting With Unlabeled Data in the WildPoster285 citations
- Joint Monocular 3D Vehicle Detection and TrackingPoster284 citations
- l-Net: Reconstruct Hyperspectral Images From a Snapshot MeasurementPoster283 citations
- Depth Completion From Sparse LiDAR Data With Depth-Normal ConstraintsPoster282 citations
- Relation Distillation Networks for Video Object DetectionPoster280 citations
- SCSampler: Sampling Salient Clips From Video for Efficient Action RecognitionOral280 citations
- Integral Object Mining via Online Attention AccumulationPoster279 citations
- Interpolated Convolutional Networks for 3D Point Cloud UnderstandingOral278 citations
- Diversity With Cooperation: Ensemble Methods for Few-Shot ClassificationPoster277 citations
- Pose-Aware Multi-Level Feature Network for Human Object Interaction DetectionOral276 citations
- Towards High-Resolution Salient Object DetectionPoster275 citations
- Better to Follow, Follow to Be Better: Towards Precise Supervision of Feature Super-Resolution for Small Object DetectionPoster274 citations
- RANet: Ranking Attention Network for Fast Video Object SegmentationPoster274 citations
- Video Compression With Rate-Distortion AutoencodersPoster274 citations
- PointCloud Saliency MapsOral272 citations
- Robust Multi-Modality Multi-Object TrackingPoster272 citations
- Constructing Self-Motivated Pyramid Curriculums for Cross-Domain Semantic Segmentation: A Non-Adversarial ApproachPoster271 citations
- Occlusion-Aware Networks for 3D Human Pose Estimation in VideoPoster271 citations
- Escaping Plato's Cave: 3D Shape From Adversarial RenderingPoster270 citations
- Few-Shot Image Recognition With Knowledge TransferPoster270 citations
- Free-Form Video Inpainting With 3D Gated Convolution and Temporal PatchGANPoster270 citations
- MeteorNet: Deep Learning on Dynamic 3D Point Cloud SequencesOral270 citations
- Adversarial Representation Learning for Text-to-Image MatchingPoster267 citations
- Mask-ShadowGAN: Learning to Remove Shadows From Unpaired DataPoster267 citations
- End-to-End Hand Mesh Recovery From a Monocular RGB ImagePoster265 citations
- DADA: Depth-Aware Domain Adaptation in Semantic SegmentationPoster263 citations
- Self-Training and Adversarial Background Regularization for Unsupervised Domain Adaptive One-Stage Object DetectionOral263 citations
- Significance-Aware Information Bottleneck for Domain Adaptive Semantic SegmentationPoster262 citations
- Generative Adversarial Minority OversamplingPoster260 citations
- Auto-FPN: Automatic Network Architecture Adaptation for Object Detection Beyond ClassificationPoster259 citations
- P-MVSNet: Learning Patch-Wise Matching Confidence Aggregation for Multi-View StereoPoster259 citations
- Sparse and Imperceivable Adversarial AttacksPoster259 citations
- Second-Order Non-Local Attention Networks for Person Re-IdentificationPoster255 citations
- TextDragon: An End-to-End Framework for Arbitrary Shaped Text SpottingPoster255 citations
- Dynamic Graph Attention for Referring Expression ComprehensionOral254 citations
- InstaBoost: Boosting Instance Segmentation via Probability Map Guided Copy-PastingPoster253 citations
- Vehicle Re-Identification With Viewpoint-Aware Metric LearningPoster253 citations
- Foreground-Aware Pyramid Reconstruction for Alignment-Free Occluded Person Re-IdentificationPoster252 citations
- Mask-Guided Attention Network for Occluded Pedestrian DetectionPoster252 citations
- Towards Multi-Pose Guided Virtual Try-On NetworkPoster252 citations
- Deep Optics for Monocular Depth Estimation and 3D Object DetectionPoster251 citations
- AMP: Adaptive Masked Proxies for Few-Shot SegmentationPoster250 citations
- Beyond Human Parts: Dual Part-Aligned Representations for Person Re-IdentificationPoster250 citations
- Indices Matter: Learning to Index for Deep Image MattingPoster250 citations
- Lifelong GAN: Continual Learning for Conditional Image GenerationPoster250 citations
- Cross-Dataset Person Re-Identification via Unsupervised Pose Disentanglement and AdaptationPoster248 citations
- Few-Shot Adaptive Gaze EstimationOral248 citations
- Hierarchy Parsing for Image CaptioningPoster248 citations
- Transductive Episodic-Wise Adaptive Metric for Few-Shot LearningPoster248 citations
- Multi-Level Bottom-Top and Top-Bottom Feature Fusion for Crowd CountingPoster247 citations
- Spatio-Temporal Filter Adaptive Network for Video DeblurringPoster247 citations
- Deep Mesh Reconstruction From Single RGB Images via Topology Modification NetworksPoster246 citations
- Deep Single-Image Portrait RelightingPoster246 citations
- Joint Learning of Saliency Detection and Weakly Supervised Semantic SegmentationPoster246 citations
- Motion Guided Attention for Video Salient Object DetectionPoster246 citations
- Hierarchical Point-Edge Interaction Network for Point Cloud Semantic SegmentationPoster245 citations
- Perspective-Guided Convolution Networks for Crowd CountingPoster245 citations
- Human Motion Prediction via Spatio-Temporal InpaintingPoster244 citations
- Drive&Act: A Multi-Modal Dataset for Fine-Grained Driver Behavior Recognition in Autonomous VehiclesPoster243 citations
- One-Shot Neural Architecture Search via Self-Evaluated Template NetworkPoster243 citations
- Temporal Attentive Alignment for Large-Scale Video Domain AdaptationOral243 citations
- USIP: Unsupervised Stable Interest Point Detection From 3D Point CloudsPoster243 citations
- DANet: Divergent Activation for Weakly Supervised Object LocalizationPoster242 citations
- Deep Comprehensive Correlation Mining for Image ClusteringPoster242 citations
- Joint Group Feature Selection and Discriminative Filter Learning for Robust Visual Object TrackingPoster242 citations
- Transferable Contrastive Network for Generalized Zero-Shot LearningPoster241 citations
- Weakly Aligned Cross-Modal Learning for Multispectral Pedestrian DetectionPoster241 citations
- Dual Attention Matching for Audio-Visual Event LocalizationOral240 citations
- Co-Separating Sounds of Visual ObjectsPoster239 citations
- Drop to Adapt: Learning Discriminative Features for Unsupervised Domain AdaptationPoster239 citations
- Image Generation From Small Datasets via Batch Statistics AdaptationPoster239 citations
- Unsupervised Multi-Task Feature Learning on Point CloudsPoster239 citations
- Prior-Aware Neural Network for Partially-Supervised Multi-Organ Segmentation238 citations
- Selectivity or Invariance: Boundary-Aware Salient Object DetectionPoster237 citations
- How Do Neural Networks See Depth in Single Images?Poster236 citations
- Shadow Removal via Shadow Image DecompositionPoster236 citations
- Structured Prediction Helps 3D Human Motion ModellingPoster236 citations
- Instance-Guided Context Rendering for Cross-Domain Person Re-IdentificationPoster233 citations
- Temporal Recurrent Networks for Online Action DetectionPoster233 citations
- Controllable Video Captioning With POS Sequence Guidance Based on Gated Fusion NetworkPoster232 citations
- Distillation-Based Training for Multi-Exit ArchitecturesOral232 citations
- What Would You Expect? Anticipating Egocentric Actions With Rolling-Unrolling LSTMs and Modality AttentionOral231 citations
- Learning Relationships for Multi-View 3D Object RecognitionPoster230 citations
- 'Skimming-Perusal' Tracking: A Framework for Real-Time and Robust Long-Term TrackingPoster229 citations
- Knowledge Distillation via Route Constrained OptimizationOral229 citations
- Deep Tensor ADMM-Net for Snapshot Compressive ImagingPoster228 citations
- Improved Conditional VRNNs for Video PredictionPoster228 citations
- Few-Shot Learning With Embedded Class Models and Shot-Free Meta TrainingPoster227 citations
- 3D-LaneNet: End-to-End 3D Multiple Lane DetectionPoster226 citations
- Specifying Object Attributes and Relations in Interactive Scene GenerationOral226 citations
- DenseRaC: Joint 3D Pose and Shape Estimation by Dense Render-and-CompareOral224 citations
- Incremental Learning Using Conditional Adversarial NetworksPoster224 citations
- Neural Inter-Frame Compression for Video CodingPoster224 citations
- Cross-Domain Adaptation for Animal Pose EstimationOral223 citations
- Convolutional Character NetworksPoster222 citations
- A2J: Anchor-to-Joint Regression Network for 3D Articulated Pose Estimation From a Single Depth ImagePoster221 citations
- Learning a Mixture of Granularity-Specific Experts for Fine-Grained CategorizationPoster221 citations
- Unsupervised Out-of-Distribution Detection by Maximum Classifier DiscrepancyPoster221 citations
- Task-Driven Modular Networks for Zero-Shot Compositional LearningPoster219 citations
- AdaptIS: Adaptive Instance Selection NetworkPoster217 citations
- Self-Guided Network for Fast Image DenoisingPoster217 citations
- Grouped Spatial-Temporal Aggregation for Efficient Action RecognitionPoster215 citations
- Person-in-WiFi: Fine-Grained Person Perception Using WiFiPoster215 citations
- From Open Set to Closed Set: Counting Objects by Spatial Divide-and-ConquerPoster214 citations
- Human Mesh Recovery From Monocular Images via a Skeleton-Disentangled RepresentationPoster214 citations
- Language-Conditioned Graph Networks for Relational ReasoningPoster214 citations
- Relational Attention Network for Crowd CountingPoster214 citations
- Scalable Verified Training for Provably Robust Image ClassificationPoster214 citations
- Progressive Reconstruction of Visual Structure for Image InpaintingPoster213 citations
- Detecting the Unexpected via Image ResynthesisPoster212 citations
- End-to-End Wireframe ParsingPoster212 citations
- Graph-Based Object Classification for Neuromorphic Vision SensingPoster210 citations
- Noise Flow: Noise Modeling With Conditional Normalizing FlowsOral209 citations
- TASED-Net: Temporally-Aggregating Spatial Encoder-Decoder Network for Video Saliency DetectionPoster209 citations
- Unpaired Image Captioning via Scene Graph AlignmentsPoster209 citations
- Extreme View SynthesisOral208 citations
- SSF-DAN: Separated Semantic Feature Based Domain Adaptation Network for Semantic SegmentationPoster208 citations
- Weakly-Supervised Action Localization With Background ModelingPoster208 citations
- 3C-Net: Category Count and Center Loss for Weakly-Supervised Action LocalizationPoster207 citations
- Adversarial Robustness vs. Model Compression, or Both?Poster207 citations
- CAMEL: A Weakly Supervised Learning Framework for Histopathology Image Segmentation207 citations
- Presence-Only Geographical Priors for Fine-Grained Image ClassificationPoster207 citations
- Topological Map Extraction From Overhead ImagesPoster206 citations
- PAMTRI: Pose-Aware Multi-Task Learning for Vehicle Re-Identification Using Highly Randomized Synthetic DataPoster205 citations
- Transferability and Hardness of Supervised Classification TasksOral205 citations
- Grounded Human-Object Interaction Hotspots From VideoPoster204 citations
- Toyota Smarthome: Real-World Activities of Daily LivingPoster204 citations
- Learning to Paint With Model-Based Deep Reinforcement LearningPoster203 citations
- VTNFP: An Image-Based Virtual Try-On Network With Body and Clothing Feature PreservationPoster203 citations
- DUP-Net: Denoiser and Upsampler Network for 3D Adversarial Point Clouds DefensePoster202 citations
- Counterfactual Critic Multi-Agent Training for Scene Graph GenerationOral200 citations
- Context-Aware Image Matting for Simultaneous Foreground and Alpha EstimationPoster199 citations
- Monocular 3D Human Pose Estimation by Generation and Ordinal RankingPoster198 citations
- Variational Few-Shot LearningPoster195 citations
- Neural 3D Morphable Models: Spiral Convolutional Networks for 3D Shape Representation Learning and GenerationPoster194 citations
- Content and Style Disentanglement for Artistic Style TransferPoster193 citations
- Switchable Whitening for Deep Representation LearningPoster193 citations
- 3D Instance Segmentation via Multi-Task Metric LearningOral192 citations
- Adaptive Density Map Generation for Crowd CountingPoster192 citations
- RelGAN: Multi-Domain Image-to-Image Translation via Relative AttributesPoster190 citations
- Adversarial Defense by Restricting the Hidden Space of Deep Neural NetworksPoster189 citations
- Learning Joint 2D-3D Representations for Depth CompletionPoster189 citations
- Event-Based Motion Segmentation by Motion CompensationPoster188 citations
- Robust Change CaptioningOral188 citations
- Self-Critical Attention Learning for Person Re-IdentificationPoster188 citations
- Symmetry-Constrained Rectification Network for Scene Text RecognitionPoster186 citations
- A Novel Unsupervised Camera-Aware Domain Adaptation Framework for Person Re-IdentificationPoster185 citations
- LayoutVAE: Stochastic Scene Layout Generation From a Label SetPoster185 citations
- Towards Adversarially Robust Object DetectionPoster185 citations
- WSOD2: Learning Bottom-Up and Top-Down Objectness Distillation for Weakly-Supervised Object DetectionPoster185 citations
- Bilinear Attention Networks for Person RetrievalPoster184 citations
- Fine-Grained Action Retrieval Through Multiple Parts-of-Speech EmbeddingsPoster184 citations
- Three-D Safari: Learning to Estimate Zebra Pose, Shape, and Texture From Images "In the Wild"Poster184 citations
- Collect and Select: Semantic Alignment Metric Learning for Few-Shot LearningPoster183 citations
- Copy-and-Paste Networks for Deep Video InpaintingPoster183 citations
- Sampling-Free Epistemic Uncertainty Estimation Using Approximated Variance PropagationOral183 citations
- Attribute Attention for Semantic Disambiguation in Zero-Shot LearningPoster181 citations
- Relation Parsing Neural Network for Human-Object Interaction DetectionPoster181 citations
- Deep Clustering by Gaussian Mixture Variational Autoencoders With Graph EmbeddingPoster180 citations
- Detecting Photoshopped Faces by Scripting PhotoshopPoster180 citations
- SROBB: Targeted Perceptual Loss for Single Image Super-ResolutionPoster180 citations
- Self-Supervised Difference Detection for Weakly-Supervised Semantic SegmentationPoster180 citations
- Zero-Shot Grounding of Objects From Natural Language QueriesOral180 citations
- Bridging the Domain Gap for Ground-to-Aerial Image MatchingPoster179 citations
- Kernel Modeling Super-Resolution on Real Low-Resolution ImagesPoster178 citations
- Spectral Feature Transformation for Person Re-IdentificationPoster178 citations
- Active Learning for Deep Detection Neural NetworksPoster176 citations
- Adaptive Context Network for Scene ParsingPoster176 citations
- No-Frills Human-Object Interaction Detection: Factorization, Layout Encodings, and Training TechniquesPoster176 citations
- On Network Design Spaces for Visual RecognitionPoster175 citations
- Total Denoising: Unsupervised Learning of 3D Point Cloud CleaningPoster175 citations
- ARGAN: Attentive Recurrent Generative Adversarial Network for Shadow Detection and RemovalPoster174 citations
- Live Face De-Identification in VideoOral174 citations
- Self-Supervised Moving Vehicle Tracking With Stereo SoundPoster174 citations
- Improved Techniques for Training Adaptive Deep NetworksPoster172 citations
- Improving Pedestrian Attribute Recognition With Weakly-Supervised Multi-Scale Attribute-Specific LocalizationPoster172 citations
- Convolutional Sequence Generation for Skeleton-Based Action SynthesisPoster171 citations
- LIP: Local Importance-Based PoolingPoster171 citations
- RIO: 3D Object Instance Re-Localization in Changing Indoor EnvironmentsOral171 citations
- COCO-GAN: Generation by Parts via Conditional CoordinatingOral170 citations
- Deep Residual Learning in the JPEG Transform DomainPoster170 citations
- Image Synthesis From Reconfigurable Layout and StylePoster170 citations
- Localization of Deep Inpainting Using High-Pass Fully Convolutional NetworkPoster170 citations
- Making the Invisible Visible: Action Recognition Through Walls and OcclusionsPoster170 citations
- Robust Person Re-Identification by Modelling Feature UncertaintyPoster169 citations
- Rethinking Zero-Shot Learning: A Conditional Visual Classification PerspectivePoster167 citations
- HistoSegNet: Semantic Segmentation of Histological Tissue Type in Whole Slide Images166 citations
- Interactive Sketch & Fill: Multiclass Sketch-to-Image TranslationPoster166 citations
- Multi-Agent Reinforcement Learning Based Frame Sampling for Effective Untrimmed Video RecognitionOral165 citations
- SegSort: Segmentation by Discriminative Sorting of SegmentsPoster165 citations
- Co-Segmentation Inspired Attention Networks for Video-Based Person Re-IdentificationPoster164 citations
- Detecting Unseen Visual Relations Using AnalogiesPoster164 citations
- HEMlets Pose: Learning Part-Centric Heatmap Triplets for Accurate 3D Human Pose EstimationPoster164 citations
- Neural Inverse Rendering of an Indoor Scene From a Single ImagePoster164 citations
- Disentangled Image MattingPoster163 citations
- Learn to Scale: Generating Multipolar Normalized Density Maps for Crowd CountingPoster163 citations
- Unsupervised Domain Adaptation via Regularized Conditional AlignmentOral163 citations
- Bilateral Adversarial Training: Towards Fast Training of More Robust Models Against Adversarial AttacksPoster162 citations
- Learning Spatial Awareness to Improve Crowd CountingOral162 citations
- Learning to See Moving Objects in the DarkPoster162 citations
- Multi-Angle Point Cloud-VAE: Unsupervised Feature Learning for 3D Point Clouds From Multiple Angles by Joint Self-Reconstruction and Half-to-Half PredictionPoster162 citations
- Re-ID Driven Localization Refinement for Person SearchPoster162 citations
- AutoFocus: Efficient Multi-Scale InferencePoster161 citations
- Deep Parametric Indoor Lighting EstimationPoster161 citations
- Unsupervised Deep Learning for Structured Shape MatchingOral161 citations
- GODS: Generalized One-Class Discriminative Subspaces for Anomaly DetectionPoster160 citations
- Learning Compositional Neural Information Fusion for Human ParsingPoster160 citations
- Deep Contextual Attention for Human-Object Interaction DetectionPoster159 citations
- Deep Floor Plan Recognition Using a Multi-Task Network With Room-Boundary-Guided AttentionPoster159 citations
- Towards Precise End-to-End Weakly Supervised Object Detection NetworkPoster159 citations
- CamNet: Coarse-to-Fine Retrieval for Camera Re-LocalizationPoster158 citations
- Embedded Block Residual Network: A Recursive Restoration Model for Single-Image Super-ResolutionPoster158 citations
- Reciprocal Multi-Layer Subspace Learning for Multi-View ClusteringPoster158 citations
- Guessing Smart: Biased Sampling for Efficient Black-Box Adversarial AttacksPoster157 citations
- ShapeMask: Learning to Segment Novel Objects by Refining Shape PriorsOral156 citations
- What Else Can Fool Deep Learning? Addressing Color Constancy Errors on Deep Neural Network PerformancePoster155 citations
- GarNet: A Two-Stream Network for Fast and Accurate 3D Cloth DrapingPoster154 citations
- Semi-Supervised Video Salient Object Detection Using Pseudo-LabelsPoster154 citations
- Deep Learning for Seeing Through Window With RaindropsPoster153 citations
- Deep Reinforcement Active Learning for Human-in-the-Loop Person Re-IdentificationOral153 citations
- 3DPeople: Modeling the Geometry of Dressed HumansPoster152 citations
- Efficient Learning on Point Clouds With Basis Point SetsPoster152 citations
- MonoLoco: Monocular 3D Pedestrian Localization and Uncertainty EstimationPoster152 citations
- Moulding Humans: Non-Parametric 3D Human Shape Estimation From Single ImagesPoster152 citations
- See-Through-Text Grouping for Referring Image SegmentationPoster152 citations
- Towards Unconstrained End-to-End Text SpottingOral152 citations
- BAE-NET: Branched Autoencoder for Shape Co-SegmentationPoster151 citations
- Ground-to-Aerial Image Geo-Localization With a Hard Exemplar Reweighting Triplet LossPoster151 citations
- Where Is My Mirror?Poster151 citations
- Generative Multi-View Human Action RecognitionOral150 citations
- Learning Compositional Representations for Few-Shot RecognitionPoster149 citations
- InGAN: Capturing and Retargeting the "DNA" of a Natural ImageOral148 citations
- Towards Bridging Semantic Gap to Improve Semantic SegmentationPoster148 citations
- Onion-Peel Networks for Deep Video CompletionPoster147 citations
- Physics-Based Rendering for Improving Robustness to RainPoster147 citations
- Semantic Stereo Matching With Pyramid Cost VolumesPoster147 citations
- Attentional Neural Fields for Crowd CountingPoster146 citations
- Bayesian Graph Convolution LSTM for Skeleton Based Action RecognitionPoster146 citations
- Deep Multi-Model Fusion for Single-Image DehazingPoster146 citations
- Ego-Pose Estimation and Forecasting As Real-Time PD ControlPoster145 citations
- Holistic++ Scene Understanding: Single-View 3D Holistic Scene Parsing and Human Pose Estimation With Human-Object Interaction and Physical CommonsensePoster145 citations
- Understanding Human Gaze Communication by Spatio-Temporal Graph ReasoningPoster145 citations
- Few-Shot Learning With Global Class RepresentationsPoster144 citations
- Tag2Pix: Line Art Colorization Using Text Tag With SECat and Changing LossPoster144 citations
- Towards Unsupervised Image Captioning With Shared Multimodal EmbeddingsPoster144 citations
- Unsupervised Person Re-Identification by Camera-Aware Similarity Consistency LearningPoster144 citations
- Learning Rich Features at High-Speed for Single-Shot Object DetectionPoster143 citations
- Anchor Diffusion for Unsupervised Video Object SegmentationPoster142 citations
- Co-Mining: Deep Face Recognition With Noisy LabelsOral142 citations
- Exploiting Temporal Consistency for Real-Time Video Depth EstimationPoster142 citations
- Learning Single Camera Depth Estimation Using Dual-PixelsOral142 citations
- SPGNet: Semantic Prediction Guidance for Scene ParsingPoster142 citations
- xR-EgoPose: Egocentric 3D Human Pose From an HMD CameraOral142 citations
- Learning Deep Priors for Image DehazingPoster140 citations
- Addressing Model Vulnerability to Distributional Shifts Over Image Transformation SetsPoster139 citations
- JPEG Artifacts Reduction via Deep Convolutional Sparse CodingPoster139 citations
- SBSGAN: Suppression of Inter-Domain Background Shift for Person Re-IdentificationPoster139 citations
- DynamoNet: Dynamic Action and Motion NetworkOral138 citations
- Explaining the Ambiguity of Object Detection and 6D Pose From Visual DataPoster138 citations
- A Learned Representation for Scalable Vector GraphicsPoster137 citations
- Action Assessment by Joint Relation GraphsOral137 citations
- C3DPO: Canonical 3D Pose Networks for Non-Rigid Structure From MotionOral137 citations
- Counting With Focus for FreePoster137 citations
- Object Guided External Memory Network for Video Object DetectionPoster137 citations
- Semantic-Aware Knowledge Preservation for Zero-Shot Sketch-Based Image RetrievalPoster137 citations
- Expert Sample Consensus Applied to Camera Re-LocalizationPoster136 citations
- PARN: Position-Aware Relation Networks for Few-Shot LearningPoster136 citations
- Reflective Decoding Network for Image CaptioningPoster136 citations
- Beyond Cartesian Representations for Local DescriptorsPoster135 citations
- Dynamic Points Agglomeration for Hierarchical Point Sets LearningPoster135 citations
- Explicit Shape Encoding for Real-Time Instance SegmentationPoster135 citations
- Recurrent U-Net for Resource-Constrained SegmentationPoster135 citations
- Single-Network Whole-Body Pose EstimationPoster135 citations
- Weakly Supervised Temporal Action Localization Through Contrast Based Evaluation NetworksPoster135 citations
- Multinomial Distribution Learning for Effective Neural Architecture SearchOral134 citations
- Universal Perturbation Attack Against Image RetrievalPoster134 citations
- Align, Attend and Locate: Chest X-Ray Diagnosis via Contrast Induced Attention Network With Limited Supervision133 citations
- DAGMapper: Learning to Map by Discovering Lane TopologyPoster133 citations
- Discriminative Feature Learning With Consistent Attention Regularization for Person Re-IdentificationPoster133 citations
- Distilling Knowledge From a Deep Pose Regressor NetworkPoster133 citations
- Semantic Adversarial Attacks: Parametric Transformations That Fool Deep ClassifiersPoster133 citations
- Universal Semi-Supervised Semantic SegmentationPoster133 citations
- Weakly Supervised Object Detection With Segmentation CollaborationPoster132 citations
- Deep Learning for Light Field Saliency DetectionPoster131 citations
- Deep Metric Learning With Tuplet Margin LossPoster131 citations
- Imitation Learning for Human Pose PredictionPoster131 citations
- Online Model Distillation for Efficient Video InferencePoster131 citations
- Photo-Realistic Facial Details Synthesis From Single ImageOral131 citations
- TexturePose: Supervising Human Mesh Estimation With Texture ConsistencyPoster131 citations
- Unsupervised Graph Association for Person Re-IdentificationPoster131 citations
- FDA: Feature Disruptive AttackPoster130 citations
- LADN: Local Adversarial Disentangling Network for Facial Makeup and De-MakeupPoster130 citations
- Controllable Artistic Text Style Transfer via Shape-Matching GANOral129 citations
- Deep Blind Hyperspectral Image FusionPoster129 citations
- Predicting 3D Human Dynamics From VideoPoster129 citations
- C-MIDN: Coupled Multiple Instance Detection Network With Segmentation Guidance for Weakly Supervised Object DetectionPoster128 citations
- Learning Feature-to-Feature Translator by Alternating Back-Propagation for Generative Zero-Shot LearningPoster127 citations
- Wasserstein GAN With Quadratic Transport CostPoster126 citations
- Deep SR-ITM: Joint Learning of Super-Resolution and Inverse Tone-Mapping for 4K UHD HDR ApplicationsOral125 citations
- FW-GAN: Flow-Navigated Warping GAN for Video Virtual Try-OnPoster125 citations
- MIC: Mining Interclass Characteristics for Improved Metric LearningPoster125 citations
- Stochastic Attraction-Repulsion Embedding for Large Scale Image LocalizationPoster125 citations
- Boundless: Generative Adversarial Networks for Image ExtensionPoster124 citations
- MMAct: A Large-Scale Dataset for Cross Modal Human Action UnderstandingPoster124 citations
- Pushing the Frontiers of Unconstrained Crowd Counting: New Dataset and Benchmark MethodPoster124 citations
- Guided Image-to-Image Translation With Bi-Directional Feature TransformationPoster123 citations
- NOTE-RCNN: NOise Tolerant Ensemble RCNN for Semi-Supervised Object DetectionPoster123 citations
- Saliency-Guided Attention Network for Image-Sentence MatchingPoster123 citations
- Through-Wall Human Mesh Recovery Using Radio SignalsPoster123 citations
- Bayesian Relational Memory for Semantic Visual NavigationPoster122 citations
- Deep Meta Learning for Real-Time Target-Aware Visual TrackingPoster122 citations
- Learning Filter Basis for Convolutional Neural Network CompressionPoster122 citations
- Modeling Inter and Intra-Class Relations in the Triplet Loss for Zero-Shot LearningPoster122 citations
- Hyperpixel Flow: Semantic Correspondence With Multi-Layer Neural FeaturesPoster121 citations
- DSConv: Efficient Convolution OperatorPoster120 citations
- Learning Fixed Points in Generative Adversarial Networks: From Image-to-Image Translation to Disease Detection and LocalizationPoster120 citations
- Weakly Supervised Energy-Based Learning for Action SegmentationOral120 citations
- ACE: Adapting to Changing Environments for Semantic SegmentationPoster119 citations
- Align2Ground: Weakly Supervised Phrase Grounding Guided by Image-Caption AlignmentPoster119 citations
- Canonical Surface Mapping via Geometric Cycle ConsistencyPoster119 citations
- Hallucinating IDT Descriptors and I3D Optical Flow Features for Action Recognition With CNNsPoster119 citations
- Leveraging Long-Range Temporal Relationships Between Proposals for Video Object DetectionPoster119 citations
- Universal Adversarial Perturbation via Prior Driven Uncertainty ApproximationOral119 citations
- Disentangling Propagation and Generation for Video PredictionPoster118 citations
- Employing Deep Part-Object Relationships for Salient Object DetectionPoster118 citations
- Fashion Retrieval via Graph Reasoning Networks on a Similarity PyramidOral118 citations
- Talking With Hands 16.2M: A Large-Scale Dataset of Synchronized Body-Finger Motion and Audio for Conversational Motion Analysis and SynthesisPoster118 citations
- Scene Graph Prediction With Limited LabelsPoster117 citations
- Semantics-Enhanced Adversarial Nets for Text-to-Image SynthesisPoster117 citations
- Adversarial Fine-Grained Composition Learning for Unseen Attribute-Object RecognitionPoster116 citations
- Predicting the Future: A Jointly Learnt Model for Action AnticipationPoster116 citations
- Attacking Optical FlowPoster115 citations
- Floor-SP: Inverse CAD for Floorplans by Sequential Room-Wise Shortest PathPoster115 citations
- Learning to Collocate Neural Modules for Image CaptioningPoster115 citations
- Many Task Learning With Task RoutingOral115 citations
- Watch, Listen and Tell: Multi-Modal Weakly Supervised Dense Event CaptioningPoster115 citations
- Fashion++: Minimal Edits for Outfit ImprovementPoster114 citations
- Very Long Natural Scenery Image Prediction by OutpaintingPoster114 citations
- Learning Similarity Conditions Without Explicit SupervisionPoster113 citations
- Progressive Sparse Local Attention for Video Object DetectionPoster113 citations
- Spatio-Temporal Fusion Based Convolutional Sequence Learning for Lip ReadingPoster113 citations
- Joint Syntax Representation Learning and Visual Cue Translation for Video CaptioningPoster112 citations
- Learning an Event Sequence Embedding for Dense Event-Based Deep StereoOral112 citations
- Equivariant Multi-View NetworksOral111 citations
- Fair Loss: Margin-Aware Reinforcement Learning for Deep Face RecognitionPoster111 citations
- Towards Interpretable Face RecognitionOral111 citations
- Adaptive Reconstruction Network for Weakly Supervised Referring Expression GroundingPoster110 citations
- Diverse Image Synthesis From Semantic Layouts via Conditional IMLEPoster110 citations
- Multimodal Style Transfer via Graph CutsPoster110 citations
- U-CAM: Visual Explanation Using Uncertainty Based Class Activation MapsPoster110 citations
- Co-Evolutionary Compression for Unpaired Image TranslationPoster109 citations
- Enriched Feature Guided Refinement Network for Object DetectionPoster109 citations
- Online Hyper-Parameter Learning for Auto-Augmentation StrategyPoster109 citations
- DeceptionNet: Network-Driven Domain RandomizationPoster108 citations
- Efficient Segmentation: Learning Downsampling Near Semantic BoundariesPoster108 citations
- MVSCRF: Learning Multi-View Stereo With Conditional Random FieldsPoster108 citations
- Vision-Infused Deep Audio InpaintingPoster108 citations
- DeCaFA: Deep Convolutional Cascade for Face Alignment in the WildPoster107 citations
- Dynamic Context Correspondence Network for Semantic AlignmentPoster107 citations
- End-to-End CAD Model Retrieval and 9DoF Alignment in 3D ScansPoster106 citations
- SceneGraphNet: Neural Message Passing for 3D Indoor Scene AugmentationPoster106 citations
- AGSS-VOS: Attention Guided Single-Shot Video Object SegmentationPoster105 citations
- Aligning Latent Spaces for 3D Hand Pose EstimationPoster105 citations
- SO-HandNet: Self-Organizing Network for 3D Hand Pose Estimation With Semi-Supervised LearningPoster105 citations
- Shape-Aware Human Pose and Shape Reconstruction Using Multi-View ImagesPoster105 citations
- Unsupervised Video Interpolation Using Cycle ConsistencyPoster105 citations
- Joint Acne Image Grading and Counting via Label Distribution Learning104 citations
- Neural Turtle Graphics for Modeling City Road LayoutsOral104 citations
- Stochastic Filter Groups for Multi-Task CNNs: Learning Specialist and Generalist Convolution KernelsOral104 citations
- Hierarchical Shot DetectorPoster103 citations
- Multi-View Stereo by Temporal Nonparametric FusionPoster103 citations
- Aggregation via Separation: Boosting Facial Landmark Detector With Semi-Supervised Style TranslationPoster102 citations
- Delving Into Robust Object Detection From Unmanned Aerial Vehicles: A Deep Nuisance Disentanglement ApproachPoster102 citations
- Spectral Regularization for Combating Mode Collapse in GANsPoster102 citations
- Transformable Bottleneck NetworksOral102 citations
- A Deep Cybersickness Predictor Based on Brain Signal Analysis for Virtual Reality ContentsPoster101 citations
- An Internal Learning Approach to Video InpaintingPoster101 citations
- EM-Fusion: Dynamic Object-Level SLAM With Probabilistic Data AssociationPoster101 citations
- Transferable Representation Learning in Vision-and-Language NavigationPoster101 citations
- Visualization of Convolutional Neural Networks for Monocular Depth EstimationPoster101 citations
- Mop Moire Patterns Using MopNetPoster100 citations
- Shapeglot: Learning Language for Shape DifferentiationPoster100 citations
- TAPA-MVS: Textureless-Aware PAtchMatch Multi-View StereoPoster100 citations
- ViSiL: Fine-Grained Spatio-Temporal Video Similarity LearningOral100 citations
- Adversarial Defense via Learning to Generate Diverse AttacksPoster99 citations
- Compositional Video PredictionPoster99 citations
- Learning Object-Specific Distance From a Monocular ImagePoster99 citations
- Orientation-Aware Semantic Segmentation on Icosahedron SpheresPoster99 citations
- SANet: Scene Agnostic Network for Camera LocalizationPoster99 citations
- Attribute Manipulation Generative Adversarial Networks for Fashion ImagesPoster98 citations
- DMM-Net: Differentiable Mask-Matching Network for Video Object SegmentationPoster98 citations
- Transductive Learning for Zero-Shot Object DetectionOral98 citations
- ClusterSLAM: A SLAM Backend for Simultaneous Rigid Body Clustering and Motion EstimationPoster97 citations
- Deep Meta Functionals for Shape RepresentationPoster97 citations
- Recover and Identify: A Generative Dual Model for Cross-Resolution Person Re-IdentificationPoster97 citations
- Recursive Visual Sound Separation Using Minus-Plus NetPoster97 citations
- Wavelet Domain Style Transfer for an Effective Perception-Distortion Tradeoff in Single Image Super-ResolutionOral97 citations
- Asymmetric Cross-Guided Attention Network for Actor and Action Video Segmentation From Natural Language QueryPoster96 citations
- AutoDispNet: Improving Disparity Estimation With AutoMLPoster95 citations
- Skeleton-Aware 3D Human Shape Reconstruction From Point CloudsPoster95 citations
- Temporal Structure Mining for Weakly Supervised Action DetectionPoster95 citations
- Fooling Network Interpretation in Image ClassificationPoster94 citations
- SpaceNet MVOI: A Multi-View Overhead Imagery DatasetPoster94 citations
- A Closed-Form Solution to Universal Style TransferPoster93 citations
- Accelerate CNN via Recursive Bayesian PruningPoster93 citations
- AM-LFS: AutoML for Loss Function SearchPoster92 citations
- DF2Net: A Dense-Fine-Finer Network for Detailed 3D Face ReconstructionPoster92 citations
- DewarpNet: Single-Image Document Unwarping With Stacked 3D and 2D Regression NetworksPoster92 citations
- Dynamic Kernel Distillation for Efficient Pose Estimation in VideosPoster92 citations
- GeoStyle: Discovering Fashion Trends and EventsPoster92 citations
- Compact Trilinear Interaction for Visual Question AnsweringPoster91 citations
- Computational Hyperspectral Imaging Based on Dimension-Discriminative Low-Rank Tensor RecoveryPoster91 citations
- Gated2Depth: Real-Time Dense Lidar From Gated ImagesOral91 citations
- Looking to Relations for Future Trajectory ForecastPoster91 citations
- Multi-Modality Latent Interaction Network for Visual Question AnsweringPoster91 citations
- Physical Adversarial Textures That Fool Visual Object TrackingPoster91 citations
- Teacher Supervises Students How to Learn From Partially Labeled Images for Facial Landmark DetectionPoster91 citations
- Tell, Draw, and Repeat: Generating and Modifying Images Based on Continual Linguistic InstructionPoster91 citations
- Action Recognition With Spatial-Temporal Discriminative Filter BanksPoster90 citations
- Fingerspelling Recognition in the Wild With Iterative Visual AttentionPoster90 citations
- Gaussian Affinity for Max-Margin Class Imbalanced LearningPoster90 citations
- Generative Modeling for Small-Data Object DetectionOral90 citations
- Guided Super-Resolution As Pixel-to-Pixel TransformationPoster90 citations
- Non-Local ConvLSTM for Video Compression Artifact ReductionPoster90 citations
- Optimizing the F-Measure for Threshold-Free Salient Object DetectionPoster90 citations
- SPLINE-Net: Sparse Photometric Stereo Through Lighting Interpolation and Normal Estimation NetworksPoster90 citations
- VrR-VG: Refocusing Visually-Relevant RelationshipsPoster90 citations
- CDTB: A Color and Depth Visual Object Tracking Dataset and BenchmarkPoster89 citations
- Semi-Supervised Learning by Augmented Distribution AlignmentOral89 citations
- Uncertainty-Aware Audiovisual Activity Recognition Using Deep Bayesian Variational InferenceOral89 citations
- Deep Graphical Feature Learning for the Feature Matching ProblemPoster88 citations
- ERL-Net: Entangled Representation Learning for Single Image De-RainingPoster88 citations
- Evaluating Robustness of Deep Image Super-Resolution Against Adversarial AttacksPoster88 citations
- Fine-Grained Segmentation Networks: Self-Supervised Segmentation for Improved Long-Term Visual LocalizationPoster88 citations
- SENSE: A Shared Encoder Network for Scene-Flow EstimationOral88 citations
- AttPool: Towards Hierarchical Feature Representation in Graph Convolutional Networks via Attention MechanismPoster87 citations
- Moving Indoor: Unsupervised Video Depth Learning in Challenging EnvironmentsPoster87 citations
- Progressive-X: Efficient, Anytime, Multi-Model Fitting AlgorithmPoster87 citations
- Convolutional Approximations to the General Non-Line-of-Sight Imaging OperatorOral86 citations
- GLAMpoints: Greedily Learned Accurate Match Points86 citations
- LAP-Net: Level-Aware Progressive Network for Image DehazingPoster86 citations
- Make a Face: Towards Arbitrary High Fidelity Face ManipulationPoster86 citations
- Targeted Mismatch Adversarial Attack: Query With a Flower to Retrieve the TowerPoster86 citations
- A Quaternion-Based Certifiably Optimal Solution to the Wahba Problem With OutliersOral85 citations
- Deep Meta Metric LearningPoster85 citations
- FiNet: Compatible and Diverse Fashion Image InpaintingOral85 citations
- Temporal Knowledge Propagation for Image-to-Video Person Re-IdentificationPoster85 citations
- CapsuleVOS: Semi-Supervised Video Object Segmentation Using Capsule RoutingPoster84 citations
- Fast and Practical Neural Architecture SearchPoster84 citations
- Metric Learning With HORDE: High-Order Regularizer for Deep EmbeddingsPoster84 citations
- Sequential Latent Spaces for Modeling the Intention During Diverse Image CaptioningPoster84 citations
- Unsupervised Learning of Landmarks by Descriptor Vector ExchangePoster84 citations
- Attract or Distract: Exploit the Margin of Open SetPoster83 citations
- Evolving Space-Time Neural Architectures for VideosPoster83 citations
- Hyperspectral Image Reconstruction Using Deep External and Internal LearningPoster83 citations
- Learning to Reconstruct 3D Manhattan Wireframes From a Single ImageOral83 citations
- Sequential Adversarial Learning for Self-Supervised Deep Visual OdometryPoster83 citations
- ACMM: Aligned Cross-Modal Memory for Few-Shot Image and Sentence MatchingPoster82 citations
- Asynchronous Single-Photon 3D ImagingOral82 citations
- On the Design of Black-Box Adversarial Examples by Leveraging Gradient-Free Optimization and Operator Splitting MethodPoster82 citations
- Scalable Place Recognition Under Appearance Change for Autonomous DrivingOral82 citations
- Creativity Inspired Zero-Shot LearningPoster81 citations
- Deep Non-Rigid Structure From MotionOral81 citations
- Dual Directed Capsule Network for Very Low Resolution Image RecognitionPoster81 citations
- Joint Demosaicking and Denoising by Fine-Tuning of Bursts of Raw ImagesPoster81 citations
- Making History Matter: History-Advantage Sequence Training for Visual DialogPoster81 citations
- Learning Robust Facial Landmark Detection via Hierarchical Structured EnsemblePoster80 citations
- Video Face Clustering With Unknown Number of ClustersPoster80 citations
- A Dataset of Multi-Illumination Images in the WildPoster79 citations
- Zero-Shot Anticipation for Instructional ActivitiesPoster79 citations
- A Graph-Based Framework to Bridge Movies and SynopsesOral78 citations
- Dynamic Anchor Feature Selection for Single-Shot Object DetectionPoster78 citations
- Fast Object Detection in Compressed VideoPoster78 citations
- Monocular Neural Image Based Rendering With Continuous View ControlPoster78 citations
- SplitNet: Sim2Sim and Task2Task Transfer for Embodied Visual NavigationPoster78 citations
- Vehicle Re-Identification in Aerial Imagery: Dataset and ApproachPoster78 citations
- Cascaded Context Pyramid for Full-Resolution 3D Semantic Scene CompletionOral77 citations
- Contextual Attention for Hand Detection in the WildPoster77 citations
- GAN-Based Projector for Faster Recovery With Convergence Guarantees in Linear Inverse ProblemsPoster77 citations
- Situational Fusion of Visual Representation for Visual NavigationPoster77 citations
- Unsupervised High-Resolution Depth Learning From Videos With Dual NetworksPoster77 citations
- DistInit: Learning Video Representations Without a Single Labeled VideoPoster75 citations
- Embodied Amodal Recognition: Learning to Move to Perceive ObjectsPoster75 citations
- Face-to-Parameter Translation for Game Character Auto-CreationPoster75 citations
- ForkNet: Multi-Branch Volumetric Semantic Completion From a Single Depth ImagePoster75 citations
- Group-Wise Deep Object Co-Segmentation With Co-Attention Recurrent Neural NetworkPoster75 citations
- Local Supports Global: Deep Camera Relocalization With Sequence EnhancementPoster75 citations
- SkyScapes Fine-Grained Semantic Understanding of Aerial ScenesPoster75 citations
- Analyzing the Variety Loss in the Context of Probabilistic Trajectory PredictionPoster74 citations
- Dynamic PET Image Reconstruction Using Nonnegative Matrix Factorization Incorporated With Deep Image PriorOral74 citations
- Not All Parts Are Created Equal: 3D Pose Estimation by Modeling Bi-Directional Dependencies of Body PartsOral74 citations
- AdvIT: Adversarial Frames Identifier Based on Temporal Consistency in VideosPoster73 citations
- Delving Deep Into Hybrid Annotations for 3D Human Recovery in the WildPoster73 citations
- Improving Adversarial Robustness via Guided Complement EntropyPoster73 citations
- Siamese Networks: The Tale of Two ManifoldsOral73 citations
- Attention-Based Autism Spectrum Disorder Screening With Privileged ModalityPoster72 citations
- View Confusion Feature Learning for Person Re-IdentificationPoster72 citations
- View N-Gram Network for 3D Object RetrievalPoster72 citations
- CFSNet: Toward a Controllable Feature Space for Image RestorationPoster71 citations
- Defending Against Universal Perturbations With Shared Adversarial TrainingPoster71 citations
- Customizing Student Networks From Heterogeneous Teachers via Adaptive Knowledge AmalgamationPoster70 citations
- Explaining Neural Networks Semantically and QuantitativelyOral70 citations
- Fast Video Object Segmentation via Dynamic Targeting NetworkPoster70 citations
- Multi-Class Part Parsing With Joint Boundary-Semantic AwarenessOral70 citations
- OmniMVS: End-to-End Learning for Omnidirectional Stereo MatchingPoster70 citations
- StartNet: Online Detection of Action Start in Untrimmed VideosPoster70 citations
- Why Does a Visual Question Have Different Answers?Poster70 citations
- 3D Face Modeling From Diverse Raw Scan DataOral69 citations
- Deep Supervised Hashing With Anchor GraphPoster69 citations
- 3D Scene Reconstruction With Multi-Layer Depth and Epipolar TransformersPoster68 citations
- G3raphGround: Graph-Based Language GroundingPoster68 citations
- UM-Adapt: Unsupervised Multi-Task Adaptation Using Adversarial Cross-Task DistillationOral68 citations
- VideoMem: Constructing, Analyzing, Predicting Short-Term and Long-Term Video MemorabilityPoster68 citations
- CIIDefence: Defeating Adversarial Attacks by Fusing Class-Specific Image Inpainting and Image DenoisingPoster67 citations
- Composite Shape Modeling via Latent Space FactorizationPoster67 citations
- Image Aesthetic Assessment Based on Pairwise Comparison A Unified Approach to Score Regression, Binary Classification, and PersonalizationPoster67 citations
- Label-PEnet: Sequential Label Propagation and Enhancement Networks for Weakly Supervised Instance SegmentationPoster67 citations
- Personalized Fashion DesignPoster67 citations
- TextPlace: Visual Place Recognition and Topological Localization Through Reading Scene TextsPoster67 citations
- Bayesian Optimized 1-Bit CNNsPoster66 citations
- Discriminative Feature Transformation for Occluded Pedestrian DetectionPoster66 citations
- On the Over-Smoothing Problem of CNN Based Disparity EstimationPoster66 citations
- SpatialSense: An Adversarially Crowdsourced Benchmark for Spatial Relation RecognitionPoster66 citations
- A Deep Step Pattern Representation for Multimodal Retinal Image RegistrationPoster65 citations
- Bridging the Gap Between Detection and Tracking: A Unified ApproachPoster65 citations
- Face De-Occlusion Using 3D Morphable Model and Generative Adversarial NetworkPoster65 citations
- Language-Agnostic Visual-Semantic EmbeddingsPoster65 citations
- Object-Aware Instance Labeling for Weakly Supervised Object DetectionOral65 citations
- Two-Stream Action Recognition-Oriented Video Super-ResolutionPoster65 citations
- CompoNet: Learning to Generate the Unseen by Part Synthesis and CompositionPoster64 citations
- From Strings to Things: Knowledge-Enabled VQA Model That Can Read and ReasonOral64 citations
- Mono-SF: Multi-View Geometry Meets Single-View Depth for Monocular Scene Flow Estimation of Dynamic Traffic ScenesPoster64 citations
- Unsupervised Microvascular Image Segmentation Using an Active Contours Mimicking Neural Network64 citations
- Zero-Shot Emotion Recognition via Affective Structural EmbeddingPoster64 citations
- A Geometry-Inspired Decision-Based AttackPoster63 citations
- Chinese Street View Text: Large-Scale Chinese Text Reading With Partially Supervised LearningPoster63 citations
- Deep Elastic Networks With Model Selection for Multi-Task LearningPoster63 citations
- Enhancing Low Light Videos by Exploring High Sensitivity Camera NoisePoster63 citations
- Fully Convolutional Pixel Adaptive Image DenoiserPoster63 citations
- Learning to Rank Proposals for Object DetectionPoster63 citations
- MONET: Multiview Semi-Supervised Keypoint Detection via Epipolar DivergencePoster63 citations
- Photo-Realistic Monocular Gaze Redirection Using Generative Adversarial NetworksPoster63 citations
- FACSIMILE: Fast and Accurate Scans From an Image in Less Than a SecondPoster62 citations
- Hilbert-Based Generative Defense for Adversarial ExamplesPoster62 citations
- Adversarial Learning With Margin-Based Triplet Embedding RegularizationPoster61 citations
- Cap2Det: Learning to Amplify Weak Caption Supervision for Object DetectionPoster61 citations
- SVD: A Large-Scale Short Video Dataset for Near-Duplicate Video RetrievalPoster61 citations
- Semantic-Transferable Weakly-Supervised Endoscopic Lesions Segmentation61 citations
- advPattern: Physical-World Attacks on Deep Person Re-Identification via Adversarially Transformable PatternsPoster61 citations
- A Delay Metric for Video Object Detection: What Average Precision Fails to TellPoster60 citations
- A Neural Network for Detailed Human Depth Estimation From a Single ImageOral60 citations
- Deep Multiple-Attribute-Perceived Network for Real-World Texture RecognitionPoster60 citations
- EvalNorm: Estimating Batch Normalization Statistics for EvaluationPoster60 citations
- Surface Networks via General CoversPoster60 citations
- Unsupervised Procedure Learning via Joint Dynamic SummarizationOral60 citations
- Anchor Loss: Modulating Loss Scale Based on Prediction DifficultyOral59 citations
- Bayesian Adaptive Superpixel SegmentationPoster59 citations
- Deep Head Pose Estimation Using Synthetic Images and Partial Adversarial Domain Adaption for Continuous Label SpacesPoster59 citations
- Geometric Disentanglement for Generative Latent Shape ModelsPoster59 citations
- Is This the Right Place? Geometric-Semantic Pose Verification for Indoor Visual LocalizationPoster59 citations
- On Boosting Single-Frame 3D Human Pose Estimation via Monocular VideosPoster59 citations
- Prior Guided Dropout for Robust Visual Localization in Dynamic EnvironmentsPoster59 citations
- Self-Supervised Representation Learning From Multi-Domain DataPoster59 citations
- Structured Modeling of Joint Deep Feature and Prediction Refinement for Salient Object DetectionPoster59 citations
- 3D-RelNet: Joint Object and Relational Network for 3D PredictionPoster58 citations
- Distill Knowledge From NRSfM for Weakly Supervised 3D Pose LearningPoster58 citations
- Hierarchical Self-Attention Network for Action Localization in VideosPoster58 citations
- Neighborhood Preserving Hashing for Scalable Video RetrievalPoster58 citations
- GLoSH: Global-Local Spherical Harmonics for Intrinsic Image DecompositionOral57 citations
- S2GAN: Share Aging Factors Across Ages and Share Aging Trends Among IndividualsOral57 citations
- Scoot: A Perceptual Metric for Facial SketchesPoster57 citations
- UprightNet: Geometry-Aware Camera Orientation Estimation From Single ImagesPoster57 citations
- A Differential Volumetric Approach to Multi-View Photometric StereoPoster56 citations
- Face Video Deblurring Using 3D Facial PriorsOral56 citations
- Human Attention in Image Captioning: Dataset and AnalysisPoster56 citations
- SILCO: Show a Few Images, Localize the Common ObjectPoster56 citations
- DUAL-GLOW: Conditional Flow-Based Generative Model for Modality Transfer55 citations
- Laplace Landmark LocalizationPoster55 citations
- Learning Temporal Action Proposals With Fewer LabelsPoster54 citations
- Multi-Stage Pathological Image Classification Using Semantic Segmentation54 citations
- Unsupervised Collaborative Learning of Keyframe Detection and Visual Odometry Towards Monocular Deep SLAMPoster54 citations
- Attentional Feature-Pair Relation Networks for Accurate Face RecognitionPoster53 citations
- Frame-to-Frame Aggregation of Active Regions in Web Videos for Weakly Supervised Semantic SegmentationPoster53 citations
- FrameNet: Learning Local Canonical Frames of 3D Surfaces From a Single RGB ImagePoster53 citations
- HBONet: Harmonious Bottleneck on Two Orthogonal DimensionsPoster53 citations
- MVP Matching: A Maximum-Value Perfect Matching for Mining Hard Samples, With Application to Person Re-IdentificationPoster53 citations
- Normalized Wasserstein for Mixture Distributions With Applications in Adversarial Learning and Domain AdaptationPoster53 citations
- Perceptual Deep Depth Super-ResolutionPoster53 citations
- Homography From Two Orientation- and Scale-Covariant FeaturesPoster52 citations
- Person Search by Text Attribute Query As Zero-Shot LearningPoster52 citations
- Conditional Coupled Generative Adversarial Networks for Zero-Shot Domain AdaptationPoster51 citations
- DSIC: Deep Stereo Image CompressionOral50 citations
- Dual Adversarial Inference for Text-to-Image SynthesisPoster50 citations
- Generating Diverse and Descriptive Image Captions Using Visual ParaphrasesPoster50 citations
- PLMP - Point-Line Minimal Problems in Complete Multi-View VisibilityOral50 citations
- Self-Supervised Deep Depth DenoisingPoster50 citations
- Self-Supervised Representation Learning via Neighborhood-Relational EncodingPoster50 citations
- Towards Photorealistic Reconstruction of Highly Multiplexed Lensless ImagesOral50 citations
- AVT: Unsupervised Learning of Transformation Equivariant Representations by Autoencoding Variational TransformationsPoster49 citations
- Continual Learning by Asymmetric Loss Approximation With Single-Side OverestimationPoster49 citations
- Differentiable Learning-to-Group Channels via Groupable Convolutional Neural NetworksPoster49 citations
- Few-Shot Generalization for Single-Image 3D Reconstruction via PriorsPoster48 citations
- Learning an Effective Equivariant 3D Descriptor Without SupervisionPoster48 citations
- Learning to Jointly Generate and Separate ReflectionsPoster48 citations
- A Camera That CNNs: Towards Embedded Neural Networks on Pixel Processor ArraysOral47 citations
- Maximum-Margin Hamming HashingPoster47 citations
- Memory-Based Neighbourhood Embedding for Visual RecognitionOral47 citations
- Phrase Localization Without Paired Training ExamplesOral47 citations
- SynDeMo: Synergistic Deep Feature Alignment for Joint Learning of Depth and Ego-MotionPoster47 citations
- Transferable Semi-Supervised 3D Object Detection From RGB-D DataPoster47 citations
- Budget-Aware Adapters for Multi-Domain LearningPoster46 citations
- Learning Motion in Feature Space: Locally-Consistent Deformable Convolution Networks for Fine-Grained Action DetectionOral46 citations
- Shape Reconstruction Using Differentiable Projections and Deep PriorsPoster46 citations
- Attention-Aware Polarity Sensitive Embedding for Affective Image RetrievalPoster45 citations
- M2FPA: A Multi-Yaw Multi-Pitch High-Quality Dataset and Benchmark for Facial Pose AnalysisPoster45 citations
- MultiSeg: Semantically Meaningful, Scale-Diverse Segmentations From Minimal User InputPoster45 citations
- Resource Constrained Neural Network Architecture Search: Will a Submodularity Assumption Help?Poster45 citations
- View Independent Generative Adversarial Network for Novel View SynthesisOral45 citations
- Visualizing the Invisible: Occluded Vehicle Segmentation and RecoveryPoster45 citations
- AFD-Net: Aggregated Feature Difference Learning for Cross-Spectral Image Patch MatchingOral44 citations
- Deep CG2Real: Synthetic-to-Real Translation via Image DisentanglementPoster44 citations
- Elaborate Monocular Point and Line SLAM With Robust InitializationPoster44 citations
- FAB: A Robust Facial Landmark Detection Framework for Motion-Blurred VideosPoster44 citations
- Variational Uncalibrated Photometric Stereo Under General LightingPoster44 citations
- Face Alignment With Kernel Density Deep Neural NetworkPoster43 citations
- Joint Embedding of 3D Scan and CAD ObjectsPoster43 citations
- Learning Local Descriptors With a CDF-Based Dynamic Soft MarginOral43 citations
- Markerless Outdoor Human Motion Capture Using Multiple Autonomous Micro Aerial VehiclesPoster43 citations
- RainFlow: Optical Flow Under Rain Streaks and Rain Veiling EffectPoster43 citations
- Reasoning About Human-Object Interactions Through Dual Attention NetworksPoster43 citations
- Revisiting Radial Distortion Absolute PosePoster43 citations
- A Weakly Supervised Fine Label Classifier Enhanced by Coarse SupervisionPoster42 citations
- Generative Adversarial Training for Weakly Supervised Cloud MattingPoster42 citations
- GraphX-Convolution for Point Cloud Deformation in 2D-to-3D ConversionPoster42 citations
- Algebraic Characterization of Essential Matrices and Their Averaging in Multiview SettingsPoster41 citations
- On the Global Optima of Kernelized Adversarial Representation LearningPoster41 citations
- Patchwork: A Patch-Wise Attention Network for Efficient Object Detection and Segmentation in Video StreamsPoster41 citations
- Sharpen Focus: Learning With Attention Separability and ConsistencyPoster41 citations
- Deep Appearance MapsPoster40 citations
- Dilated Convolutional Neural Networks for Sequential Manifold-Valued Data40 citations
- Geometry Normalization Networks for Accurate Scene Text DetectionPoster40 citations
- HiPPI: Higher-Order Projected Power Iterations for Scalable Multi-MatchingPoster40 citations
- Information Entropy Based Feature Pooling for Convolutional Neural NetworksPoster40 citations
- Joint Prediction for Kinematic Trajectories in Vehicle-Pedestrian-Mixed ScenesPoster40 citations
- Once a MAN: Towards Multi-Target Attack via Learning Multi-Target Adversarial Network OncePoster40 citations
- Spatiotemporal Feature Residual Propagation for Action PredictionPoster40 citations
- Unsupervised Robust Disentangling of Latent Characteristics for Image SynthesisPoster40 citations
- A Decoupled 3D Facial Shape Model by Adversarial TrainingOral39 citations
- Context-Aware Feature and Label Fusion for Facial Action Unit Intensity Estimation With Partially Labeled DataPoster39 citations
- Language Features Matter: Effective Language Representations for Vision-Language TasksPoster39 citations
- Learning Across Tasks and DomainsPoster39 citations
- Multi-View Image FusionPoster39 citations
- Privacy Preserving Image Queries for Camera LocalizationOral39 citations
- The LogBarrier Adversarial Attack: Making Effective Use of Decision Boundary InformationPoster39 citations
- Understanding Generalized Whitening and Coloring Transform for Universal Style TransferOral39 citations
- Cascaded Parallel Filtering for Memory-Efficient Image-Based LocalizationPoster38 citations
- Permutation-Invariant Feature Restructuring for Correlation-Aware Image Set-Based RecognitionPoster38 citations
- Towards Interpretable Object Detection by Unfolding Latent StructuresOral38 citations
- Approximated Bilinear Modules for Temporal ModelingPoster37 citations
- Attention Bridging Network for Knowledge TransferPoster37 citations
- Calibration Wizard: A Guidance System for Camera Calibration Based on Modelling Geometric and Corner UncertaintyOral37 citations
- Conservative Wasserstein Training for Pose EstimationPoster37 citations
- GSLAM: A General SLAM Framework and BenchmarkPoster37 citations
- Quasi-Globally Optimal and Efficient Vanishing Point Estimation in Manhattan WorldOral37 citations
- ViCo: Word Embeddings From Visual Co-OccurrencesPoster37 citations
- Bidirectional One-Shot Unsupervised Domain MappingPoster36 citations
- Large-Scale Tag-Based Font Retrieval With Generative Feature LearningPoster36 citations
- Spatial Correspondence With Generative Adversarial Network: Learning Depth From Monocular VideosPoster36 citations
- No Fear of the Dark: Image Retrieval Under Varying Illumination ConditionsPoster35 citations
- Simultaneous Multi-View Instance Detection With Learned Geometric Soft-ConstraintsPoster35 citations
- Teacher Guided Architecture SearchPoster35 citations
- Cross-View Policy Learning for Street NavigationPoster34 citations
- Detecting 11K Classes: Large Scale Object Detection Without Fine-Grained Bounding BoxesPoster34 citations
- ELF: Embedded Localisation of Features in Pre-Trained CNNPoster34 citations
- Learning With Unsure Data for Medical Image DiagnosisPoster34 citations
- SegEQA: Video Segmentation Based Visual Attention for Embodied Question AnsweringPoster34 citations
- Bayes-Factor-VAE: Hierarchical Bayesian Deep Auto-Encoder Models for Factor DisentanglementOral33 citations
- CompenNet++: End-to-End Full Projector CompensationPoster33 citations
- DiscoNet: Shapes Learning on Disconnected Manifolds for 3D EditingPoster33 citations
- Learning Perspective Undistortion of PortraitsOral33 citations
- Mixture-Kernel Graph Attention Network for Situation RecognitionPoster33 citations
- Object-Driven Multi-Layer Scene Decomposition From a Single ImagePoster33 citations
- Occlusion-Shared and Feature-Separated Network for Occlusion Relationship ReasoningPoster33 citations
- Probabilistic Deep Ordinal Regression Based on Gaussian ProcessesPoster33 citations
- Sampling Wisely: Deep Image Embedding by Top-K Precision OptimizationPoster33 citations
- Semi-Supervised Monocular 3D Face Reconstruction With End-to-End Shape-Preserved Domain TransferOral33 citations
- Non-Local Intrinsic Decomposition With Near-Infrared PriorsPoster32 citations
- Semi-Supervised Skin Detection by Network With Mutual GuidancePoster32 citations
- Unsupervised Neural Quantization for Compressed-Domain Similarity SearchOral32 citations
- Better and Faster: Exponential Loss for Image Patch MatchingPoster31 citations
- Dynamic-Net: Tuning the Objective Without Re-Training for Synthesis TasksPoster31 citations
- Global Feature Guided Local PoolingPoster31 citations
- Learning to Caption Images Through a Lifetime by Asking QuestionsPoster31 citations
- Adversarial Feedback LoopPoster30 citations
- An Alarm System for Segmentation Algorithm Based on Shape Model30 citations
- Block Annotation: Better Image Annotation With Sub-Image DecompositionPoster30 citations
- Convex Shape Prior for Multi-Object Segmentation Using a Single Level Set FunctionPoster30 citations
- Domain-Adaptive Single-View 3D ReconstructionOral30 citations
- Generating Easy-to-Understand Referring Expressions for Target IdentificationsPoster30 citations
- Learning Local RGB-to-CAD Correspondences for Object Pose EstimationPoster30 citations
- Point-to-Point Video GenerationPoster30 citations
- View-Consistent 4D Light Field Superpixel SegmentationOral30 citations
- A Bayesian Optimization Framework for Neural Network CompressionPoster29 citations
- Closed-Form Optimal Two-View Triangulation Based on Angular ErrorsPoster29 citations
- Deep End-to-End Alignment and Refinement for Time-of-Flight RGB-D ModulePoster29 citations
- Domain Intersection and Domain DifferencePoster29 citations
- Fast Image Restoration With Multi-Bin Trainable Linear UnitsPoster29 citations
- Is an Affine Constraint Needed for Affine Subspace Clustering?Poster29 citations
- Restoration of Non-Rigidly Distorted Underwater Images Using a Combination of Compressive Sensing and Local Polynomial Image RepresentationsOral29 citations
- Unpaired Image-to-Speech Synthesis With Multimodal Information BottleneckPoster29 citations
- Agile Depth Sensing Using Triangulation Light CurtainsOral28 citations
- Learning Meshes for Dense Visual SLAMPoster28 citations
- An Efficient Solution to the Homography-Based Relative Pose Problem With a Common Reference DirectionOral27 citations
- Controlling Neural Networks via Energy DissipationPoster27 citations
- Learning Implicit Generative Models by Matching Perceptual FeaturesOral27 citations
- Linearized Multi-Sampling for Differentiable Image TransformationOral27 citations
- POD: Practical Object Detection With Scale-Sensitive NetworkPoster27 citations
- Exploring Overall Contextual Information for Image Captioning in Human-Like Cognitive StylePoster26 citations
- Goal-Driven Sequential Data AbstractionPoster26 citations
- Polarimetric Relative Pose EstimationPoster26 citations
- PuppetGAN: Cross-Domain Image Manipulation by DemonstrationOral26 citations
- Scaling Object Detection by Transferring Classification WeightsOral26 citations
- AdaTransform: Adaptive Data TransformationOral25 citations
- Adaptative Inference Cost With Convolutional Neural Mixture ModelsPoster25 citations
- Consensus Maximization Tree Search RevisitedOral25 citations
- Accelerate Learning of Deep Hashing With Gradient AttentionPoster24 citations
- EMPNet: Neural Localisation and Mapping Using Embedded Memory PointsPoster24 citations
- Efficient and Robust Registration on the 3D Special Euclidean GroupPoster24 citations
- Program-Guided Image ManipulatorsPoster24 citations
- Proximal Mean-Field for Neural Network QuantizationPoster24 citations
- Adaptive Activation Thresholding: Dynamic Routing Type Behavior for Interpretability in Convolutional Neural NetworksPoster23 citations
- Enhancing 2D Representation via Adjacent Views for 3D Shape RetrievalPoster23 citations
- Gravity as a Reference for Estimating a Person's Height From VideoPoster23 citations
- Incremental Class Discovery for Semantic Segmentation With RGBD SensingPoster23 citations
- Rescan: Inductive Instance Segmentation for Indoor RGBD ScansPoster23 citations
- Small Steps and Giant Leaps: Minimal Newton Solvers for Deep LearningPoster23 citations
- Floorplan-Jigsaw: Jointly Estimating Scene Layout and Aligning Partial ScansPoster22 citations
- IMP: Instance Mask Projection for High Accuracy Semantic Segmentation of ThingsPoster22 citations
- Recognizing Part Attributes With Insufficient DataPoster22 citations
- Deep Depth From Aberration MapPoster21 citations
- Fast Computation of Content-Sensitive Superpixels and Supervoxels Using Q-DistancesPoster21 citations
- GP2C: Geometric Projection Parameter Consensus for Joint 3D Pose and Focal Length Estimation in the WildPoster21 citations
- Identity From Here, Pose From There: Self-Supervised Disentanglement and Generation of Objects Using Unlabeled VideosPoster21 citations
- Joint Learning of Semantic Alignment and Object Landmark DetectionPoster21 citations
- Joint Optimization for Cooperative Image CaptioningPoster21 citations
- Pro-Cam SSfM: Projector-Camera System for Structure and Spectral Reflectance From MotionPoster21 citations
ICCV accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.