CVPR 2018 Accepted Papers
The full list of 979 papers accepted at CVPR 2018 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 979
- Squeeze-and-Excitation NetworksPoster41,020 citations
- MobileNetV2: Inverted Residuals and Linear BottlenecksPoster29,310 citations
- The Unreasonable Effectiveness of Deep Features as a Perceptual MetricPoster14,258 citations
- Non-Local Neural NetworksPoster12,595 citations
- ShuffleNet: An Extremely Efficient Convolutional Neural Network for Mobile DevicesPoster10,272 citations
- Path Aggregation Network for Instance SegmentationPoster9,600 citations
- Learning Transferable Architectures for Scalable Image RecognitionPoster7,963 citations
- Cascade R-CNN: Delving Into High Quality Object DetectionPoster7,377 citations
- Bottom-Up and Top-Down Attention for Image Captioning and Visual Question AnsweringPoster5,866 citations
- Learning to Compare: Relation Network for Few-Shot LearningPoster5,544 citations
- High-Resolution Image Synthesis and Semantic Manipulation With Conditional GANsPoster5,478 citations
- Residual Dense Network for Image Super-ResolutionPoster5,376 citations
- VoxelNet: End-to-End Learning for Point Cloud Based 3D Object DetectionPoster5,114 citations
- StarGAN: Unified Generative Adversarial Networks for Multi-Domain Image-to-Image TranslationPoster5,010 citations
- Unsupervised Feature Learning via Non-Parametric Instance DiscriminationPoster4,718 citations
- Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only InferencePoster4,374 citations
- Multi-Task Learning Using Uncertainty to Weigh Losses for Scene Geometry and SemanticsPoster4,160 citations
- A Closer Look at Spatiotemporal Convolutions for Action RecognitionPoster4,089 citations
- Deep Image PriorPoster3,762 citations
- Boosting Adversarial Attacks With MomentumPoster3,515 citations
- CosFace: Large Margin Cosine Loss for Deep Face RecognitionPoster3,386 citations
- High Performance Visual Tracking With Siamese Region Proposal NetworkPoster3,306 citations
- DOTA: A Large-Scale Dataset for Object Detection in Aerial ImagesPoster3,187 citations
- Frustum PointNets for 3D Object Detection From RGB-D DataPoster3,121 citations
- Generative Image Inpainting With Contextual AttentionPoster3,105 citations
- PWC-Net: CNNs for Optical Flow Using Pyramid, Warping, and Cost VolumePoster3,033 citations
- Robust Physical-World Attacks on Deep Learning Visual ClassificationPoster2,927 citations
- Social GAN: Socially Acceptable Trajectories With Generative Adversarial NetworksPoster2,672 citations
- Maximum Classifier Discrepancy for Unsupervised Domain AdaptationPoster2,553 citations
- Can Spatiotemporal 3D CNNs Retrace the History of 2D CNNs and ImageNet?Poster2,543 citations
- AttnGAN: Fine-Grained Text to Image Generation With Attentional Generative Adversarial NetworksPoster2,322 citations
- Person Transfer GAN to Bridge Domain Gap for Person Re-IdentificationPoster2,297 citations
- End-to-End Recovery of Human Shape and PosePoster2,272 citations
- Deep Mutual LearningPoster2,262 citations
- Deep Ordinal Regression Network for Monocular Depth EstimationPoster2,236 citations
- Real-World Anomaly Detection in Surveillance VideosPoster2,202 citations
- Cascaded Pyramid Network for Multi-Person Pose EstimationPoster2,084 citations
- Pyramid Stereo Matching NetworkPoster2,043 citations
- DeblurGAN: Blind Motion Deblurring Using Conditional Adversarial NetworksPoster2,010 citations
- Learning to Adapt Structured Output Space for Semantic SegmentationPoster1,942 citations
- Single-Shot Refinement Neural Network for Object DetectionPoster1,940 citations
- 3D Semantic Segmentation With Submanifold Sparse Convolutional NetworksPoster1,932 citations
- CSRNet: Dilated Convolutional Neural Networks for Understanding the Highly Congested ScenesPoster1,873 citations
- DensePose: Dense Human Pose Estimation in the WildPoster1,827 citations
- Deep Back-Projection Networks for Super-ResolutionPoster1,823 citations
- Deep Layer AggregationPoster1,820 citations
- COCO-Stuff: Thing and Stuff Classes in ContextPoster1,810 citations
- Domain Adaptive Faster R-CNN for Object Detection in the WildPoster1,766 citations
- DenseASPP for Semantic Segmentation in Street ScenesPoster1,744 citations
- Harmonious Attention Network for Person Re-IdentificationPoster1,731 citations
- Context Encoding for Semantic SegmentationPoster1,702 citations
- Large-Scale Point Cloud Semantic Segmentation With Superpoint GraphsPoster1,671 citations
- Relation Networks for Object DetectionPoster1,660 citations
- PackNet: Adding Multiple Tasks to a Single Network by Iterative PruningPoster1,633 citations
- Vision-and-Language Navigation: Interpreting Visually-Grounded Navigation Instructions in Real EnvironmentsPoster1,622 citations
- Future Frame Prediction for Anomaly Detection – A New BaselinePoster1,611 citations
- Learning to See in the DarkPoster1,610 citations
- A Papier-Mâché Approach to Learning 3D Surface GenerationPoster1,593 citations
- Domain Generalization With Adversarial Feature LearningPoster1,574 citations
- Taskonomy: Disentangling Task Transfer LearningPoster1,541 citations
- Scale-Recurrent Network for Deep Image DeblurringPoster1,538 citations
- FoldingNet: Point Cloud Auto-Encoder via Deep Grid DeformationPoster1,525 citations
- PIXOR: Real-Time 3D Object Detection From Point CloudsPoster1,479 citations
- The INaturalist Species Classification and Detection DatasetPoster1,469 citations
- GeoNet: Unsupervised Learning of Dense Depth, Optical Flow and Camera PosePoster1,463 citations
- Dynamic Few-Shot Visual Learning Without ForgettingPoster1,450 citations
- MoCoGAN: Decomposing Motion and Content for Video GenerationPoster1,438 citations
- ISTA-Net: Interpretable Optimization-Inspired Deep Network for Image Compressive SensingPoster1,415 citations
- Densely Connected Pyramid Dehazing NetworkPoster1,359 citations
- MegaDepth: Learning Single-View Depth Prediction From Internet PhotosPoster1,322 citations
- AVA: A Video Dataset of Spatio-Temporally Localized Atomic Visual ActionsPoster1,319 citations
- Recovering Realistic Texture in Image Super-Resolution by Deep Spatial Feature TransformPoster1,313 citations
- Neural 3D Mesh RendererPoster1,277 citations
- Learning a Single Convolutional Super-Resolution Network for Multiple DegradationsPoster1,276 citations
- Feature Generating Networks for Zero-Shot LearningPoster1,248 citations
- Neural Motifs: Scene Graph Parsing With Global ContextPoster1,240 citations
- Image-Image Domain Adaptation With Preserved Self-Similarity and Domain-Dissimilarity for Person Re-IdentificationPoster1,224 citations
- SO-Net: Self-Organizing Network for Point Cloud AnalysisPoster1,202 citations
- The Lovász-Softmax Loss: A Tractable Surrogate for the Optimization of the Intersection-Over-Union Measure in Neural NetworksPoster1,202 citations
- Density-Aware Single Image De-Raining Using a Multi-Stream Dense NetworkPoster1,163 citations
- Defense Against Adversarial Attacks Using High-Level Representation Guided DenoiserPoster1,144 citations
- Real-Time Seamless Single Shot 6D Object Pose PredictionPoster1,120 citations
- NISP: Pruning Networks Using Neuron Importance Score PropagationPoster1,103 citations
- CondenseNet: An Efficient DenseNet Using Learned Group ConvolutionsPoster1,074 citations
- “Zero-Shot” Super-Resolution Using Deep Internal LearningPoster1,067 citations
- Interpretable Convolutional Neural NetworksPoster1,051 citations
- Fast and Accurate Single Image Super-Resolution via Information Distillation NetworkPoster1,049 citations
- PiCANet: Learning Pixel-Wise Contextual Attention for Saliency DetectionPoster1,035 citations
- Gated Fusion Network for Single Image DehazingPoster1,032 citations
- Learning Spatial-Temporal Regularized Correlation Filters for Visual TrackingPoster1,011 citations
- The Perception-Distortion TradeoffPoster1,007 citations
- Image Generation From Scene GraphsPoster1,000 citations
- An Analysis of Scale Invariance in Object Detection SNIPPoster994 citations
- Gibson Env: Real-World Perception for Embodied AgentsPoster988 citations
- Learning a Discriminative Feature Network for Semantic SegmentationPoster987 citations
- Learning Pixel-Level Semantic Affinity With Image-Level Supervision for Weakly Supervised Semantic SegmentationPoster983 citations
- A High-Quality Denoising Dataset for Smartphone CamerasPoster982 citations
- Super SloMo: High Quality Estimation of Multiple Intermediate Frames for Video InterpolationPoster981 citations
- VizWiz Grand Challenge: Answering Visual Questions From Blind PeoplePoster961 citations
- LiteFlowNet: A Lightweight Convolutional Neural Network for Optical Flow EstimationPoster959 citations
- MAttNet: Modular Attention Network for Referring Expression ComprehensionPoster958 citations
- Adversarially Learned One-Class Classifier for Novelty DetectionPoster931 citations
- Image to Image Translation for Domain AdaptationPoster919 citations
- Unsupervised Learning of Depth and Ego-Motion From Monocular Video Using 3D Geometric ConstraintsPoster919 citations
- Low-Shot Learning From Imaginary DataPoster915 citations
- SPLATNet: Sparse Lattice Networks for Point Cloud ProcessingPoster914 citations
- The Power of Ensembles for Active Learning in Image ClassificationPoster907 citations
- An Unsupervised Learning Model for Deformable Medical Image RegistrationPoster903 citations
- Joint Optimization Framework for Learning With Noisy LabelsPoster899 citations
- PointFusion: Deep Sensor Fusion for 3D Bounding Box EstimationPoster899 citations
- Attentive Generative Adversarial Network for Raindrop Removal From a Single ImagePoster851 citations
- Neural Sign Language TranslationPoster850 citations
- Rethinking the Faster R-CNN Architecture for Temporal Action LocalizationPoster846 citations
- A Twofold Siamese Network for Real-Time Object TrackingPoster843 citations
- Generate to Adapt: Aligning Domains Using Generative Adversarial NetworksPoster839 citations
- Fast and Furious: Real Time End-to-End 3D Detection, Tracking and Motion Forecasting With a Single Convolutional NetPoster834 citations
- Embodied Question AnsweringPoster814 citations
- Unsupervised Learning of Monocular Depth Estimation and Visual Odometry With Deep Feature ReconstructionPoster802 citations
- Learning Rich Features for Image Manipulation DetectionPoster797 citations
- Learning Deep Models for Face Anti-Spoofing: Binary or Auxiliary SupervisionPoster789 citations
- Learning to Estimate 3D Human Pose and Shape From a Single Color ImagePoster785 citations
- PU-Net: Point Cloud Upsampling NetworkPoster784 citations
- VITON: An Image-Based Virtual Try-On NetworkPoster783 citations
- Benchmarking 6DOF Outdoor Visual Localization in Changing ConditionsPoster780 citations
- Don't Just Assume; Look and Answer: Overcoming Priors for Visual Question AnsweringPoster772 citations
- PPFNet: Global Context Aware Local Features for Robust 3D Point MatchingPoster764 citations
- Detecting and Recognizing Human-Object InteractionsPoster757 citations
- Progressive Attention Guided Recurrent Network for Salient Object DetectionPoster756 citations
- Human Semantic Parsing for Person Re-IdentificationPoster753 citations
- Mask-Guided Contrastive Attention Model for Person Re-IdentificationPoster752 citations
- Zero-Shot Recognition via Semantic Embeddings and Knowledge GraphsPoster750 citations
- GVCNN: Group-View Convolutional Neural Networks for 3D Shape RecognitionPoster749 citations
- Learning Depth From Monocular Videos Using Direct MethodsPoster746 citations
- Pointwise Convolutional Neural NetworksPoster742 citations
- Camera Style Adaptation for Person Re-IdentificationPoster741 citations
- Through-Wall Human Pose Estimation Using Radio SignalsPoster731 citations
- Adversarial Complementary Learning for Weakly Supervised Object LocalizationPoster728 citations
- End-to-End Dense Video Captioning With Masked TransformerPoster728 citations
- Image Blind Denoising With Generative Adversarial Network Based Noise ModelingPoster728 citations
- Transferable Joint Attribute-Identity Deep Learning for Unsupervised Person Re-IdentificationPoster728 citations
- Tell Me Where to Look: Guided Attention Inference NetworkPoster719 citations
- Features for Multi-Target Multi-Camera Tracking and Re-IdentificationPoster709 citations
- Tangent Convolutions for Dense Prediction in 3DPoster704 citations
- PointNetVLAD: Deep Point Cloud Based Retrieval for Large-Scale Place RecognitionPoster702 citations
- Revisiting Dilated Convolution: A Simple Approach for Weakly- and Semi-Supervised Semantic SegmentationPoster700 citations
- Deep Video Super-Resolution Network Using Dynamic Upsampling Filters Without Explicit Motion CompensationPoster691 citations
- Weakly-Supervised Semantic Segmentation Network With Deep Seeded Region GrowingPoster691 citations
- Event-Based Vision Meets Deep Learning on Steering Prediction for Self-Driving CarsPoster686 citations
- Learning to Find Good CorrespondencesPoster685 citations
- Few-Shot Image Recognition by Predicting Parameters From ActivationsPoster680 citations
- 2D/3D Pose Estimation and Action Recognition Using Multitask Deep LearningPoster678 citations
- Cross-Domain Weakly-Supervised Object Detection Through Progressive Domain AdaptationPoster675 citations
- Frame-Recurrent Video Super-ResolutionPoster675 citations
- First-Person Hand Action Benchmark With RGB-D Videos and 3D Hand Pose AnnotationsPoster672 citations
- GANerated Hands for Real-Time 3D Hand Tracking From Monocular RGBPoster669 citations
- Repulsion Loss: Detecting Pedestrians in a CrowdPoster669 citations
- Learning Attentions: Residual Attentional Siamese Network for High Performance Online Visual TrackingPoster667 citations
- Low-Shot Learning With Imprinted WeightsPoster665 citations
- FOTS: Fast Oriented Text Spotting With a Unified NetworkPoster664 citations
- SGPN: Similarity Group Proposal Network for 3D Point Cloud Instance SegmentationPoster662 citations
- TieNet: Text-Image Embedding Network for Common Thorax Disease Classification and Reporting in Chest X-RaysPoster659 citations
- FSRNet: End-to-End Learning Face Super-Resolution With Facial PriorsPoster658 citations
- Large Scale Fine-Grained Categorization and Domain-Specific Transfer LearningPoster656 citations
- VITAL: VIsual Tracking via Adversarial LearningPoster654 citations
- Practical Block-Wise Neural Network Architecture GenerationPoster650 citations
- RotationNet: Joint Object Categorization and Pose Estimation Using Multiviews From Unsupervised ViewpointsPoster645 citations
- Collaborative and Adversarial Network for Unsupervised Domain AdaptationPoster636 citations
- Mining Point Cloud Local Structures by Kernel Correlation and Graph PoolingPoster635 citations
- Multi-Level Factorisation Net for Person Re-IdentificationPoster627 citations
- PoseTrack: A Benchmark for Human Pose Estimation and TrackingPoster621 citations
- BlockDrop: Dynamic Inference Paths in Residual NetworksPoster620 citations
- VirtualHome: Simulating Household Activities via ProgramsPoster620 citations
- Total Capture: A 3D Deformation Model for Tracking Faces, Hands, and BodiesPoster617 citations
- Conditional Probability Models for Deep Image CompressionPoster607 citations
- Inferring Semantic Layout for Hierarchical Text-to-Image SynthesisPoster606 citations
- SplineCNN: Fast Geometric Deep Learning With Continuous B-Spline KernelsPoster606 citations
- A Pose-Sensitive Embedding for Person Re-Identification With Expanded Cross Neighborhood Re-RankingPoster604 citations
- Deformable GANs for Pose-Based Human Image GenerationPoster604 citations
- Rotation-Sensitive Regression for Oriented Scene Text DetectionPoster602 citations
- Learning From Synthetic Data: Addressing Domain Shift for Semantic SegmentationPoster601 citations
- Neural Baby TalkPoster601 citations
- Deep Photo Enhancer: Unpaired Learning for Image Enhancement From Photographs With GANsPoster599 citations
- Look at Boundary: A Boundary-Aware Face Alignment AlgorithmPoster599 citations
- CleanNet: Transfer Learning for Scalable Image Classifier Training With Label NoisePoster598 citations
- PAD-Net: Multi-Tasks Guided Prediction-and-Distillation Network for Simultaneous Depth Estimation and Scene ParsingPoster596 citations
- DeepMVS: Learning Multi-View StereopsisPoster595 citations
- Pix3D: Dataset and Methods for Single-Image 3D Shape ModelingPoster590 citations
- InLoc: Indoor Visual Localization With Dense Matching and View SynthesisPoster582 citations
- A Bi-Directional Message Passing Model for Salient Object DetectionPoster579 citations
- Recurrent Slice Networks for 3D Segmentation of Point CloudsPoster573 citations
- Generalized Zero-Shot Learning via Synthesized ExamplesPoster570 citations
- Attention-Aware Compositional Network for Person Re-IdentificationPoster565 citations
- Deep Parametric Continuous Convolutional Neural NetworksPoster561 citations
- V2V-PoseNet: Voxel-to-Voxel Prediction Network for Accurate 3D Hand and Human Pose Estimation From a Single Depth MapPoster557 citations
- Partial Transfer Learning With Selective Adversarial NetworksPoster556 citations
- Video Based Reconstruction of 3D People ModelsPoster553 citations
- HATS: Histograms of Averaged Time Surfaces for Robust Event-Based Object ClassificationPoster550 citations
- Wing Loss for Robust Facial Landmark Localisation With Convolutional Neural NetworksPoster548 citations
- Deep Extreme Cut: From Extreme Points to Object SegmentationPoster545 citations
- Translating and Segmenting Multimodal Medical Volumes With Cycle- and Shape-Consistency Generative Adversarial NetworkPoster543 citations
- Revisiting Oxford and Paris: Large-Scale Image Retrieval BenchmarkingPoster542 citations
- Disentangled Person Image GenerationPoster541 citations
- Self-Supervised Adversarial Hashing Networks for Cross-Modal RetrievalPoster541 citations
- Facial Expression Recognition by De-Expression Residue LearningPoster540 citations
- Importance Weighted Adversarial Nets for Partial Domain AdaptationPoster539 citations
- Efficient Interactive Annotation of Segmentation Datasets With Polygon-RNN++Poster537 citations
- Stacked Conditional Generative Adversarial Networks for Jointly Learning Shadow Detection and Shadow RemovalPoster537 citations
- A Variational U-Net for Conditional Appearance and Shape GenerationPoster536 citations
- Data Distillation: Towards Omni-Supervised LearningPoster536 citations
- Multimodal Explanations: Justifying Decisions and Pointing to the EvidencePoster535 citations
- Deep Cocktail Network: Multi-Source Unsupervised Domain Adaptation With Category ShiftPoster528 citations
- CartoonGAN: Generative Adversarial Networks for Photo CartoonizationPoster527 citations
- Multi-Cue Correlation Filters for Robust Visual TrackingPoster520 citations
- ST-GAN: Spatial Transformer Generative Adversarial Networks for Image CompositingPoster516 citations
- Fast Video Object Segmentation by Reference-Guided Mask PropagationPoster512 citations
- Single Image Dehazing via Conditional Generative Adversarial NetworkPoster511 citations
- Deep Depth Completion of a Single RGB-D ImagePoster507 citations
- Detect Globally, Refine Locally: A Novel Approach to Saliency DetectionPoster507 citations
- Learning a Discriminative Filter Bank Within a CNN for Fine-Grained RecognitionPoster504 citations
- Ordinal Depth Supervision for 3D Human Pose EstimationPoster503 citations
- Dual Attention Matching Network for Context-Aware Feature Sequence Based Person Re-IdentificationPoster502 citations
- Deep Progressive Reinforcement Learning for Skeleton-Based Action RecognitionPoster500 citations
- Tips and Tricks for Visual Question Answering: Learnings From the 2017 ChallengePoster500 citations
- A Generative Adversarial Approach for Zero-Shot Learning From Noisy TextsPoster499 citations
- Context-Aware Synthesis for Video Frame InterpolationPoster499 citations
- IQA: Visual Question Answering in Interactive EnvironmentsPoster499 citations
- PointGrid: A Deep Network for 3D Shape UnderstandingPoster499 citations
- Geometry-Aware Learning of Maps for Camera LocalizationPoster498 citations
- MaskLab: Instance Segmentation by Refining Object Detection With Semantic and Direction FeaturesPoster497 citations
- Shift: A Zero FLOP, Zero Parameter Alternative to Spatial ConvolutionsPoster494 citations
- 3D Human Pose Estimation in the Wild by Adversarial LearningPoster493 citations
- Learning Convolutional Networks for Content-Weighted Image CompressionPoster490 citations
- Convolutional Image CaptioningPoster489 citations
- Direction-Aware Spatial Context Features for Shadow DetectionPoster484 citations
- Efficient Parametrization of Multi-Domain Deep Neural NetworksPoster483 citations
- Improved Lossy Image Compression With Priming and Spatially Adaptive Bit Rates for Recurrent NetworksPoster483 citations
- Functional Map of the WorldPoster482 citations
- Nonlinear 3D Face Morphable ModelPoster478 citations
- Robust Classification With Convolutional Prototype LearningPoster478 citations
- Look, Imagine and Match: Improving Textual-Visual Cross-Modal Retrieval With Generative ModelsPoster476 citations
- Generative Adversarial PerturbationsPoster470 citations
- Burst Denoising With Kernel Prediction NetworksPoster467 citations
- Dynamic Scene Deblurring Using Spatially Variant Recurrent Neural NetworksPoster466 citations
- Learning Steerable Filters for Rotation Equivariant CNNsPoster465 citations
- CodeSLAM — Learning a Compact, Optimisable Representation for Dense Visual SLAMPoster463 citations
- Scale-Transferrable Object DetectionPoster463 citations
- Triplet-Center Loss for Multi-View 3D Object RetrievalPoster461 citations
- Exploit the Unknown Gradually: One-Shot Video-Based Person Re-Identification by Stepwise LearningPoster456 citations
- Pose Transferrable Person Re-IdentificationPoster456 citations
- Learning Less Is More - 6D Camera Localization via 3D Surface RegressionPoster455 citations
- Occluded Pedestrian Detection Through Guided Attention in CNNsPoster455 citations
- Thoracic Disease Identification and Localization With Limited SupervisionPoster455 citations
- Context Contrasted Feature and Gated Multi-Scale Aggregation for Scene SegmentationPoster450 citations
- Appearance-and-Relation Networks for Video ClassificationPoster449 citations
- Efficient Video Object Segmentation via Network ModulationPoster449 citations
- Weakly Supervised Action Localization by Sparse Temporal Pooling NetworkPoster449 citations
- DecideNet: Counting Varying Density Crowds Through Attention Guided Detection and Density EstimationPoster448 citations
- Diversity Regularized Spatiotemporal Attention for Video-Based Person Re-IdentificationPoster443 citations
- 3D-RCNN: Instance-Level 3D Object Reconstruction via Render-and-ComparePoster439 citations
- DVQA: Understanding Data Visualizations via Question AnsweringPoster439 citations
- Graph-Cut RANSACPoster433 citations
- CLIP-Q: Deep Network Compression Learning by In-Parallel Pruning-QuantizationPoster432 citations
- MorphNet: Fast & Simple Resource-Constrained Structure Learning of Deep NetworksPoster432 citations
- Fully Convolutional Adaptation Networks for Semantic SegmentationPoster429 citations
- Multi-Agent Diverse Generative Adversarial NetworksPoster429 citations
- Attentional ShapeContextNet for Point Cloud RecognitionPoster428 citations
- Compressed Video Action RecognitionPoster428 citations
- GeoNet: Geometric Neural Network for Joint Depth and Surface Normal EstimationPoster428 citations
- Learning and Using the Arrow of TimePoster427 citations
- A Revised Underwater Image Formation ModelPoster422 citations
- Multi-Oriented Scene Text Detection via Corner Localization and Region SegmentationPoster420 citations
- Deflecting Adversarial Attacks With Pixel DeflectionPoster418 citations
- Multi-Level Fusion Based 3D Object Detection From Monocular ImagesPoster417 citations
- Multi-Content GAN for Few-Shot Font Style TransferPoster416 citations
- Reconstruction Network for Video CaptioningPoster416 citations
- Single Image Reflection Separation With Perceptual LossesPoster416 citations
- A Unifying Contrast Maximization Framework for Event Cameras, With Applications to Motion, Depth, and Optical Flow EstimationPoster415 citations
- Deep Cauchy Hashing for Hamming Space RetrievalPoster415 citations
- Crowd Counting via Adversarial Cross-Scale Consistency PursuitPoster414 citations
- Convolutional Sequence to Sequence Model for Human DynamicsPoster409 citations
- Learning Semantic Concepts and Order for Image and Sentence MatchingPoster409 citations
- MegDet: A Large Mini-Batch Object DetectorPoster408 citations
- Structured Attention Guided Convolutional Neural Fields for Monocular Depth EstimationPoster407 citations
- Style Aggregated Network for Facial Landmark DetectionPoster406 citations
- Toward Driving Scene Understanding: A Dataset for Learning Driver Behavior and Causal ReasoningPoster406 citations
- In-Place Activated BatchNorm for Memory-Optimized Training of DNNsPoster404 citations
- Photographic Text-to-Image Synthesis With a Hierarchically-Nested Adversarial NetworkPoster401 citations
- Normalized Cut Loss for Weakly-Supervised CNN SegmentationPoster399 citations
- Super-FAN: Integrated Facial Landmark Localization and Super-Resolution of Real-World Low Resolution Faces in Arbitrary Poses With GANsPoster399 citations
- Learning for Disparity Estimation Through Feature ConstancyPoster398 citations
- Learning to Localize Sound Source in Visual ScenesPoster397 citations
- Optical Flow Guided Feature: A Fast and Robust Motion Representation for Video Action RecognitionPoster396 citations
- FeaStNet: Feature-Steered Graph Convolutions for 3D Shape AnalysisPoster393 citations
- Memory Matching Networks for One-Shot Image RecognitionPoster392 citations
- Boosting Self-Supervised Learning via Knowledge TransferPoster391 citations
- RoadTracer: Automatic Extraction of Road Networks From Aerial ImagesPoster391 citations
- Iterative Learning With Open-Set Noisy LabelsPoster389 citations
- On the Robustness of Semantic Segmentation Models to Adversarial AttacksPoster386 citations
- Recognizing Human Actions as the Evolution of Pose Estimation MapsPoster386 citations
- PoTion: Pose MoTion Representation for Action RecognitionPoster381 citations
- Avatar-Net: Multi-Scale Zero-Shot Style Transfer by Feature DecorationPoster379 citations
- Deep Spatial Feature Reconstruction for Partial Person Re-Identification: Alignment-Free ApproachPoster379 citations
- Improved Fusion of Visual and Language Representations by Dense Symmetric Co-Attention for Visual Question AnsweringPoster379 citations
- Multi-View Harmonized Bilinear Network for 3D Object RecognitionPoster377 citations
- SfSNet: Learning Shape, Reflectance and Illuminance of Faces `in the Wild'Poster377 citations
- Multi-Label Zero-Shot Learning With Structured Knowledge GraphsPoster376 citations
- Occlusion Aware Unsupervised Learning of Optical FlowPoster376 citations
- Synthesizing Images of Humans in Unseen PosesPoster376 citations
- ScanComplete: Large-Scale Scene Completion and Semantic Segmentation for 3D ScansPoster375 citations
- Weakly-Supervised Semantic Segmentation by Iteratively Mining Common Object FeaturesPoster375 citations
- Conditional Generative Adversarial Network for Structured Domain AdaptationPoster374 citations
- Learning to Segment Every ThingPoster372 citations
- Unsupervised Training for 3D Morphable Model RegressionPoster372 citations
- DoubleFusion: Real-Time Capture of Human Performances With Inner Body Shapes From a Single Depth SensorPoster371 citations
- Zero-Shot Visual Recognition Using Semantics-Preserving Adversarial Embedding NetworksPoster370 citations
- Progressively Complementarity-Aware Fusion Network for RGB-D Salient Object DetectionPoster369 citations
- SketchyGAN: Towards Diverse and Realistic Sketch to Image SynthesisPoster369 citations
- ROAD: Reality Oriented Adaptation for Semantic Segmentation of Urban ScenesPoster365 citations
- End-to-End Flow Correlation Tracking With Spatial-Temporal AttentionPoster361 citations
- AON: Towards Arbitrarily-Oriented Text RecognitionPoster360 citations
- Towards Faster Training of Global Covariance Pooling Networks by Iterative Matrix Square Root NormalizationPoster360 citations
- CVM-Net: Cross-View Matching Network for Image-Based Ground-to-Aerial Geo-LocalizationPoster357 citations
- Cross-Modal Deep Variational Hand Pose EstimationPoster357 citations
- Weakly Supervised Instance Segmentation Using Class Peak ResponsePoster357 citations
- PieAPP: Perceptual Image-Error Assessment Through Pairwise PreferencePoster355 citations
- Universal Denoising Networks : A Novel CNN Architecture for Image DenoisingPoster354 citations
- TextureGAN: Controlling Deep Image Synthesis With Texture PatchesPoster353 citations
- PairedCycleGAN: Asymmetric Style Transfer for Applying and Removing MakeupPoster348 citations
- Monocular 3D Pose and Shape Estimation of Multiple People in Natural Scenes - The Importance of Multiple Scene ConstraintsPoster346 citations
- Unsupervised Domain Adaptation With Similarity LearningPoster346 citations
- Semantic Visual LocalizationPoster345 citations
- Deep Marching Cubes: Learning Explicit Surface RepresentationsPoster344 citations
- Gaze Prediction in Dynamic 360° Immersive VideosPoster344 citations
- Hand PointNet: 3D Hand Pose Estimation Using Point SetsPoster343 citations
- Leveraging Unlabeled Data for Crowd Counting by Learning to RankPoster342 citations
- Fast and Accurate Online Video Object Segmentation via Tracking PartsPoster337 citations
- Towards High Performance Video Object DetectionPoster337 citations
- Encoding Crowd Interaction With Deep Neural Network for Pedestrian Trajectory PredictionPoster336 citations
- Resource Aware Person Re-Identification Across Multiple ResolutionsPoster335 citations
- Real-Time Monocular Depth Estimation Using Synthetic Data With Domain Adaptation via Image Style TransferPoster334 citations
- Blazingly Fast Video Object Segmentation With Pixel-Wise Metric LearningPoster328 citations
- Revisiting Video Saliency: A Large-Scale Benchmark and a New ModelPoster328 citations
- Smooth Neighbors on Teacher Graphs for Semi-Supervised LearningPoster327 citations
- EPINET: A Fully-Convolutional Neural Network Using Epipolar Geometry for Depth From Light Field ImagesPoster325 citations
- Net2Vec: Quantifying and Explaining How Concepts Are Encoded by Filters in Deep Neural NetworksPoster323 citations
- Towards Open-Set Identity Preserving Face SynthesisPoster323 citations
- Crowd Counting With Deep Negative Correlation LearningPoster320 citations
- Video Captioning via Hierarchical Reinforcement LearningPoster320 citations
- Detect-and-Track: Efficient Pose Estimation in VideosPoster315 citations
- LayoutNet: Reconstructing the 3D Room Layout From a Single RGB ImagePoster312 citations
- Motion-Appearance Co-Memory Networks for Video Question AnsweringPoster310 citations
- Joint Pose and Expression Modeling for Facial Expression RecognitionPoster308 citations
- Learning Monocular 3D Human Pose Estimation From Multi-View ImagesPoster308 citations
- Self-Supervised Multi-Level Face Model Learning for Monocular Reconstruction at Over 250 HzPoster308 citations
- Attentive Fashion Grammar Network for Fashion Landmark Detection and Clothing Category ClassificationPoster307 citations
- Adversarially Occluded Samples for Person Re-IdentificationPoster305 citations
- Towards Effective Low-Bitwidth Convolutional Neural NetworksPoster304 citations
- Adversarial Feature Augmentation for Unsupervised Domain AdaptationPoster303 citations
- Beyond the Pixel-Wise Loss for Topology-Aware DelineationPoster301 citations
- Towards Pose Invariant Face Recognition in the WildPoster300 citations
- “Learning-Compression” Algorithms for Neural Net PruningPoster299 citations
- Structure Inference Net: Object Detection Using Scene-Level Context and Instance-Level RelationshipsPoster298 citations
- Deep Learning of Graph MatchingPoster297 citations
- MiCT: Mixed 3D/2D Convolutional Tube for Human Action RecognitionPoster295 citations
- Attention Clusters: Purely Attention Based Local Feature Integration for Video ClassificationPoster292 citations
- Fast End-to-End Trainable Guided FilterPoster291 citations
- From Source to Target and Back: Symmetric Bi-Directional Adaptive GANPoster291 citations
- Min-Entropy Latent Model for Weakly Supervised Object DetectionPoster291 citations
- Preserving Semantic Relations for Zero-Shot LearningPoster291 citations
- Deformable Shape Completion With Graph Convolutional AutoencodersPoster290 citations
- Mean-Variance Loss for Deep Age Estimation From a FacePoster290 citations
- Defense Against Universal Adversarial PerturbationsPoster289 citations
- Hallucinated-IQA: No-Reference Image Quality Assessment via Adversarial LearningPoster289 citations
- Long-Term On-Board Prediction of People in Traffic Scenes Under UncertaintyPoster288 citations
- Face Aging With Identity-Preserved Conditional Generative Adversarial NetworksPoster287 citations
- Multi-Frame Quality Enhancement for Compressed VideoPoster287 citations
- Recurrent Saliency Transformation Network: Incorporating Multi-Stage Visual Cues for Small Organ SegmentationPoster285 citations
- Jointly Optimize Data Augmentation and Network Training: Adversarial Data Augmentation in Human Pose EstimationPoster284 citations
- SBNet: Sparse Blocks Network for Fast InferencePoster282 citations
- Image Super-Resolution via Dual-State Recurrent NetworksPoster281 citations
- An End-to-End TextSpotter With Explicit Alignment and AttentionPoster280 citations
- Generative Modeling Using the Sliced Wasserstein DistancePoster280 citations
- Group Consistent Similarity Learning via Deep CRF for Person Re-IdentificationPoster280 citations
- Learning 3D Shape Completion From Laser Scan Data With Weak SupervisionPoster280 citations
- Semantic Video Segmentation by Gated Recurrent Flow PropagationPoster279 citations
- Deep Adversarial Metric LearningPoster277 citations
- Depth-Based 3D Hand Pose Estimation: From Current Achievements to Future GoalsPoster277 citations
- Referring Image Segmentation via Recurrent Refinement NetworksPoster275 citations
- Bidirectional Attentive Fusion With Context Gating for Dense Video CaptioningPoster272 citations
- Cross-Domain Self-Supervised Multi-Task Feature Learning Using Synthetic ImageryPoster272 citations
- Divide and Grow: Capturing Huge Diversity in Crowd Images With Incrementally Growing CNNPoster271 citations
- UV-GAN: Adversarial Facial UV Map Completion for Pose-Invariant Face RecognitionPoster271 citations
- Iterative Visual Reasoning Beyond ConvolutionsPoster270 citations
- Between-Class Learning for Image ClassificationPoster269 citations
- Seeing Voices and Hearing Faces: Cross-Modal Biometric MatchingPoster269 citations
- Interactive Image Segmentation With Latent DiversityPoster267 citations
- Natural and Effective Obfuscation by Head InpaintingPoster266 citations
- Decorrelated Batch NormalizationPoster265 citations
- End-to-End Learning of Motion Representation for Video UnderstandingPoster265 citations
- PlaneNet: Piece-Wise Planar Reconstruction From a Single RGB ImagePoster265 citations
- Context-Aware Deep Feature Compression for High-Speed Visual TrackingPoster263 citations
- Transparency by Design: Closing the Gap Between Performance and Interpretability in Visual ReasoningPoster262 citations
- Distort-and-Recover: Color Enhancement Using Deep Reinforcement LearningPoster261 citations
- Neural Kinematic Networks for Unsupervised Motion RetargettingPoster261 citations
- Single-Shot Object Detection With Enriched SemanticsPoster261 citations
- Visual to Sound: Generating Natural Sound for Videos in the WildPoster261 citations
- Ring Loss: Convex Feature Normalization for Face RecognitionPoster260 citations
- Video Person Re-Identification With Competitive Snippet-Similarity Aggregation and Co-Attentive Snippet EmbeddingPoster260 citations
- Single View Stereo MatchingPoster259 citations
- Grounding Referring Expressions in Images by Variational ContextPoster257 citations
- HSA-RNN: Hierarchical Structure-Adaptive RNN for Video SummarizationPoster257 citations
- Variational Autoencoders for Deforming 3D Mesh ModelsPoster257 citations
- CNN in MRF: Video Object Segmentation via Inference in a CNN-Based Higher-Order Spatio-Temporal MRFPoster256 citations
- Unsupervised Sparse Dirichlet-Net for Hyperspectral Image Super-ResolutionPoster256 citations
- Mobile Video Object Detection With Temporally-Aware Feature MapsPoster255 citations
- Transductive Unbiased Embedding for Zero-Shot LearningPoster254 citations
- Local Descriptors Optimized for Average PrecisionPoster253 citations
- Monocular Relative Depth Perception With Web Stereo Data SupervisionPoster253 citations
- Supervision-by-Registration: An Unsupervised Approach to Improve the Precision of Facial Landmark DetectorsPoster252 citations
- Finding Tiny Faces in the Wild With Generative Adversarial NetworkPoster251 citations
- Multi-Evidence Filtering and Fusion for Multi-Label Classification, Object Detection and Semantic Segmentation Based on Weakly Supervised LearningPoster251 citations
- Improving Object Localization With Fitness NMS and Bounded IoU LossPoster247 citations
- Temporal Deformable Residual Networks for Action Segmentation in VideosPoster247 citations
- Deep Semantic Face DeblurringPoster245 citations
- Learning Spatial-Aware Regressions for Visual TrackingPoster245 citations
- Separating Style and Content for Generalized Style TransferPoster245 citations
- Discriminability Objective for Training Descriptive CaptionsPoster244 citations
- Future Person Localization in First-Person VideosPoster242 citations
- Salient Object Detection Driven by Fixation PredictionPoster242 citations
- Deep Adversarial Subspace ClusteringPoster241 citations
- Visual Grounding via Accumulated AttentionPoster241 citations
- Cube Padding for Weakly-Supervised Saliency Prediction in 360° VideosPoster240 citations
- Lightweight Probabilistic Deep NetworksPoster237 citations
- Crafting a Toolchain for Image Restoration by Deep Reinforcement LearningPoster235 citations
- When Will You Do What? - Anticipating Temporal Occurrences of ActivitiesPoster235 citations
- Learning to Parse Wireframes in Images of Man-Made EnvironmentsPoster233 citations
- Multi-View Consistency as Supervisory Signal for Learning Shape and Pose PredictionPoster232 citations
- Unsupervised Discovery of Object Landmarks as Structural RepresentationsPoster232 citations
- Learning Dual Convolutional Neural Networks for Low-Level VisionPoster230 citations
- PhaseNet for Video Frame InterpolationPoster230 citations
- Pose-Guided Photorealistic Face RotationPoster228 citations
- Video Rain Streak Removal by Multiscale Convolutional Sparse CodingPoster228 citations
- Cross-View Image Synthesis Using Conditional GANsPoster227 citations
- Unsupervised Cross-Dataset Person Re-Identification by Transfer Learning of Spatial-Temporal PatternsPoster227 citations
- Jointly Localizing and Describing Events for Dense Video CaptioningPoster226 citations
- Weakly-Supervised Action Segmentation With Iterative Soft Boundary AssignmentPoster225 citations
- Erase or Fill? Deep Joint Recurrent Rain Removal and Reconstruction in VideosPoster224 citations
- Learning Face Age Progression: A Pyramid Architecture of GANsPoster224 citations
- WILDTRACK: A Multi-Camera HD Dataset for Dense Unscripted Pedestrian DetectionPoster222 citations
- Deep Unsupervised Saliency Detection: A Multiple Noisy Labeling PerspectivePoster219 citations
- SeGAN: Segmenting and Generating the InvisiblePoster219 citations
- AdaDepth: Unsupervised Content Congruent Adaptation for Depth EstimationPoster218 citations
- Extreme 3D Face Reconstruction: Seeing Through OcclusionsPoster218 citations
- Wide Compression: Tensor Ring NetsPoster217 citations
- Arbitrary Style Transfer With Deep Feature ReshufflePoster216 citations
- Duplex Generative Adversarial Network for Unsupervised Domain AdaptationPoster216 citations
- FaceID-GAN: Learning a Symmetry Three-Player GAN for Identity-Preserving Face SynthesisPoster216 citations
- LEGO: Learning Edge With Geometry All at Once by Watching VideosPoster215 citations
- NAG: Network for Adversary GenerationPoster213 citations
- Learning Deep Structured Active Contours End-to-EndPoster212 citations
- Deep Regression Forests for Age EstimationPoster211 citations
- Improving Landmark Localization With Semi-Supervised LearningPoster211 citations
- Low-Latency Video Semantic SegmentationPoster211 citations
- Unsupervised Person Image Synthesis in Arbitrary PosesPoster211 citations
- Glimpse Clouds: Human Activity Recognition From Unstructured Feature PointsPoster210 citations
- Rethinking Feature Distribution for Loss Functions in Image ClassificationPoster210 citations
- Dense 3D Regression for Hand Pose EstimationPoster209 citations
- Learning to Generate Time-Lapse Videos Using Multi-Stage Dynamic Generative Adversarial NetworksPoster209 citations
- Robust Video Content Alignment and Compensation for Rain Removal in a CNN FrameworkPoster209 citations
- Human-Centric Indoor Scene Synthesis Using Stochastic GrammarPoster207 citations
- Flow Guided Recurrent Neural Encoder for Video Salient Object DetectionPoster205 citations
- Recurrent Pixel Embedding for Instance GroupingPoster205 citations
- Actor and Observer: Joint Modeling of First and Third-Person VideosPoster204 citations
- End-to-End Weakly-Supervised Semantic AlignmentPoster204 citations
- Super-Resolving Very Low-Resolution Face Images With Supplementary AttributesPoster204 citations
- Deep Lesion Graphs in the Wild: Relationship Learning and Organization of Significant Radiology Image Findings in a Diverse Large-Scale Lesion DatabasePoster200 citations
- Eliminating Background-Bias for Robust Person Re-IdentificationPoster200 citations
- Visual Feature Attribution Using Wasserstein GANsPoster199 citations
- Correlation Tracking via Joint Discrimination and Reliability LearningPoster198 citations
- Hyperparameter Optimization for Tracking With Continuous Deep Q-LearningPoster198 citations
- Semi-Parametric Image SynthesisPoster198 citations
- Visual Question Generation as Dual Task of Visual Question AnsweringPoster198 citations
- Actor and Action Video Segmentation From a SentencePoster197 citations
- M3: Multimodal Memory Modelling for Video CaptioningPoster197 citations
- Discriminative Learning of Latent Features for Zero-Shot RecognitionPoster196 citations
- Learning Intrinsic Image Decomposition From Watching the WorldPoster196 citations
- Anatomical Priors in Convolutional Networks for Unsupervised Biomedical SegmentationPoster195 citations
- Learning a Discriminative Prior for Blind Image DeblurringPoster195 citations
- LSTM Pose MachinesPoster191 citations
- Learning to Evaluate Image CaptioningPoster191 citations
- Audio to Body DynamicsPoster189 citations
- Boosting Domain Adaptation by Discovering Latent DomainsPoster189 citations
- Exploring Disentangled Feature Representation Beyond Face IdentificationPoster188 citations
- Single-Image Depth Estimation Based on Fourier Domain AnalysisPoster188 citations
- Emotional Attention: A Study of Image Sentiment and Visual AttentionPoster187 citations
- Empirical Study of the Topology and Geometry of Deep NetworksPoster185 citations
- MapNet: An Allocentric Spatial Memory for Mapping EnvironmentsPoster185 citations
- Pose-Robust Face Recognition via Deep Residual Equivariant MappingPoster185 citations
- Very Large-Scale Global SfM by Distributed Motion AveragingPoster183 citations
- DA-GAN: Instance-Level Image Translation by Deep Attention Generative Adversarial NetworksPoster182 citations
- Learning From Millions of 3D Scans for Large-Scale 3D Face RecognitionPoster182 citations
- What Makes a Video a Video: Analyzing Temporal Information in Video Understanding Models and DatasetsPoster181 citations
- Dynamic-Structured Semantic Propagation NetworkPoster180 citations
- HydraNets: Specialized Dynamic Architectures for Efficient InferencePoster180 citations
- ICE-BA: Incremental, Consistent and Efficient Bundle Adjustment for Visual-Inertial SLAMPoster180 citations
- Zero-Shot Sketch-Image HashingPoster180 citations
- Gesture Recognition: Focus on the HandsPoster179 citations
- MovieGraphs: Towards Understanding Human-Centric Situations From VideosPoster179 citations
- Attend and Interact: Higher-Order Object Interactions for Video UnderstandingPoster178 citations
- Conditional Image-to-Image TranslationPoster178 citations
- Deep Group-Shuffling Random Walk for Person Re-IdentificationPoster178 citations
- Learning Descriptor Networks for 3D Shape Synthesis and AnalysisPoster176 citations
- Sliced Wasserstein Distance for Learning Gaussian Mixture ModelsPoster176 citations
- 3D Pose Estimation and 3D Model Retrieval for Objects in the WildPoster175 citations
- A Hybrid l1-l0 Layer Decomposition Model for Tone MappingPoster175 citations
- Dynamic Zoom-In Network for Fast Object Detection in Large ImagesPoster175 citations
- Geometric Robustness of Deep Networks: Analysis and ImprovementPoster175 citations
- Re-Weighted Adversarial Adaptation Network for Unsupervised Domain AdaptationPoster174 citations
- NeuralNetwork-Viterbi: A Framework for Weakly Supervised Video LearningPoster173 citations
- Learning Compact Recurrent Neural Networks With Block-Term Tensor DecompositionPoster171 citations
- Disentangling 3D Pose in a Dendritic CNN for Unconstrained 2D Face AlignmentPoster170 citations
- Who's Better? Who's Best? Pairwise Deep Ranking for Skill DeterminationPoster170 citations
- Detail-Preserving Pooling in Deep NetworksPoster169 citations
- SYQ: Learning Symmetric Quantization for Efficient Deep Neural NetworksPoster169 citations
- Art of Singular Vectors and Universal Adversarial PerturbationsPoster168 citations
- Deep Texture Manifold for Ground Terrain RecognitionPoster168 citations
- DocUNet: Document Image Unwarping via a Stacked U-NetPoster168 citations
- Creating Capsule Wardrobes From Fashion ImagesPoster167 citations
- Learning Attribute Representations With Localization for Flexible Fashion SearchPoster167 citations
- Person Re-Identification With Cascaded Pairwise ConvolutionsPoster167 citations
- Two-Step Quantization for Low-Bit Neural NetworksPoster167 citations
- End-to-End Deep Kronecker-Product Matching for Person Re-IdentificationPoster166 citations
- Feature Mapping for Learning Fast and Accurate 3D Pose Inference From Synthetic ImagesPoster166 citations
- Language-Based Image Editing With Recurrent Attentive ModelsPoster164 citations
- MoNet: Deep Motion Exploitation for Video Object SegmentationPoster164 citations
- Dynamic Video Segmentation NetworkPoster163 citations
- Matryoshka Networks: Predicting 3D Geometry via Nested Shape LayersPoster163 citations
- Dense Decoder Shortcut Connections for Single-Pass Semantic SegmentationPoster162 citations
- Edit Probability for Scene Text RecognitionPoster162 citations
- Enhancing the Spatial Resolution of Stereo Images Using a Parallax PriorPoster162 citations
- Weakly Supervised Coupled Networks for Visual Sentiment AnalysisPoster161 citations
- Convolutional Neural Networks With Alternately Updated CliquePoster160 citations
- Interleaved Structured Sparse Convolutional Neural NetworksPoster160 citations
- Seeing Small Faces From Robust Anchor's PerspectivePoster160 citations
- Eye In-Painting With Exemplar Generative Adversarial NetworksPoster159 citations
- LiDAR-Video Driving Dataset: Learning Driving Policies EffectivelyPoster158 citations
- Low-Shot Learning With Large-Scale DiffusionPoster158 citations
- Parallel Attention: A Unified Framework for Visual Object Discovery Through Dialogs and QueriesPoster158 citations
- A PID Controller Approach for Stochastic Optimization of Deep NetworksPoster157 citations
- Anticipating Traffic Accidents With Adaptive Loss and Large-Scale Incident DBPoster157 citations
- Factoring Shape, Pose, and Layout From the 2D Image of a 3D ScenePoster157 citations
- Lions and Tigers and Bears: Capturing Non-Rigid, 3D, Articulated Shape From ImagesPoster154 citations
- MX-LSTM: Mixing Tracklets and Vislets to Jointly Forecast Trajectories and Head PosesPoster153 citations
- From Lifestyle Vlogs to Everyday InteractionsPoster152 citations
- SINT++: Robust Visual Tracking via Adversarial Positive Instance GenerationPoster152 citations
- Learning Superpixels With Segmentation-Aware Affinity LossPoster151 citations
- Modeling Facial Geometry Using Compositional VAEsPoster151 citations
- Neural Style Transfer via Meta NetworksPoster151 citations
- W2F: A Weakly-Supervised to Fully-Supervised Framework for Object DetectionPoster150 citations
- Learning to Extract a Video Sequence From a Single Motion-Blurred ImagePoster149 citations
- Lose the Views: Limited Angle CT Reconstruction via Implicit Sinogram CompletionPoster149 citations
- Revisiting Salient Object Detection: Simultaneous Detection, Ranking, and Subitizing of Multiple Salient ObjectsPoster149 citations
- SketchMate: Deep Hashing for Million-Scale Human Sketch RetrievalPoster149 citations
- Are You Talking to Me? Reasoned Visual Dialog Generation Through Adversarial LearningPoster148 citations
- Im2Struct: Recovering 3D Shape Structure From a Single RGB ImagePoster148 citations
- Improvements to Context Based Self-Supervised LearningPoster148 citations
- Self-Supervised Feature Learning by Learning to Spot ArtifactsPoster148 citations
- ClusterNet: Detecting Small Objects in Large Scenes by Exploiting Spatio-Temporal InformationPoster147 citations
- On the Duality Between Retinex and Image DehazingPoster147 citations
- Weakly and Semi Supervised Human Body Part Parsing via Pose-Guided Knowledge TransferPoster147 citations
- Geometry Guided Convolutional Neural Networks for Self-Supervised Video Representation LearningPoster146 citations
- SemStyle: Learning to Generate Stylised Image Captions Using Unaligned TextPoster146 citations
- Mining on Manifolds: Metric Learning Without LabelsPoster145 citations
- Towards Universal Representation for Unseen Action RecognitionPoster145 citations
- Unsupervised Deep Generative Adversarial Hashing NetworkPoster144 citations
- A Perceptual Measure for Deep Single Image Camera CalibrationPoster143 citations
- A2-RL: Aesthetics Aware Reinforcement Learning for Image CroppingPoster142 citations
- Image Correction via Deep Reciprocating HDR TransformationPoster142 citations
- Optimizing Video Object Detection via a Scale-Time LatticePoster141 citations
- Pixels, Voxels, and Views: A Study of Shape Representations for Single View 3D Object Shape PredictionPoster141 citations
- Zigzag Learning for Weakly Supervised Object DetectionPoster141 citations
- Accurate and Diverse Sampling of Sequences Based on a “Best of Many” Sample ObjectivePoster140 citations
- Direct Shape Regression Networks for End-to-End Face AlignmentPoster140 citations
- Unsupervised Learning and Segmentation of Complex Activities From VideoPoster140 citations
- Learning Markov Clustering Networks for Scene Text DetectionPoster139 citations
- Learning to Sketch With Shortcut Cycle ConsistencyPoster139 citations
- 3D Human Sensing, Action and Emotion Recognition in Robot Assisted Therapy of Children With AutismPoster137 citations
- 4DFAB: A Large Scale 4D Database for Facial Expression Analysis and Biometric ApplicationsPoster137 citations
- Towards Human-Machine Cooperation: Self-Supervised Sample Mining for Object DetectionPoster136 citations
- CRRN: Multi-Scale Guided Concurrent Reflection Removal NetworkPoster135 citations
- LIME: Live Intrinsic Material EstimationPoster135 citations
- Clinical Skin Lesion Diagnosis Using Representations Inspired by Dermatologist CriteriaPoster134 citations
- Real-Time Rotation-Invariant Face Detection With Progressive Calibration NetworksPoster134 citations
- Sim2Real Viewpoint Invariant Visual Servoing by Recurrent ControlPoster134 citations
- Visual Question Answering With Memory-Augmented NetworksPoster134 citations
- Partially Shared Multi-Task Convolutional Neural Network With Local Constraint for Face Attribute LearningPoster133 citations
- Demo2Vec: Reasoning Object Affordances From Online VideosPoster132 citations
- Instance Embedding Transfer to Unsupervised Video Object SegmentationPoster132 citations
- Missing Slice Recovery for Tensors Using a Low-Rank Model in Embedded SpacePoster132 citations
- HashGAN: Deep Learning to Hash With Pair Conditional Wasserstein GANPoster131 citations
- Motion-Guided Cascaded Refinement Network for Video Object SegmentationPoster131 citations
- Recurrent Scene Parsing With Perspective Understanding in the LoopPoster131 citations
- Learning to Look Around: Intelligently Exploring Unseen Environments for Unknown TasksPoster130 citations
- Stereoscopic Neural Style TransferPoster130 citations
- Analysis of Hand Segmentation in the WildPoster129 citations
- Disentangling Features in 3D Face Shapes for Joint Face Reconstruction and RecognitionPoster129 citations
- Deep End-to-End Time-of-Flight ImagingPoster128 citations
- Detach and Adapt: Learning Cross-Domain Disentangled Deep RepresentationPoster127 citations
- Learning Structure and Strength of CNN Filters for Small Sample Size TrainingPoster127 citations
- R-FCN-3000 at 30fps: Decoupling Detection and ClassificationPoster127 citations
- Revisiting Deep Intrinsic Image DecompositionsPoster127 citations
- Soccer on Your TabletopPoster127 citations
- Feature Space Transfer for Data AugmentationPoster126 citations
- Finding Beans in Burgers: Deep Semantic-Visual Embedding With LocalizationPoster126 citations
- Learning to Act Properly: Predicting and Explaining Affordances From ImagesPoster125 citations
- Referring RelationshipsPoster125 citations
- Zero-Shot Kernel LearningPoster125 citations
- Interpret Neural Networks by Identifying Critical Data Routing PathsPoster122 citations
- Quantization of Fully Convolutional Networks for Accurate Biomedical Image SegmentationPoster122 citations
- Rotation Averaging and Strong DualityPoster121 citations
- Blind Predicting Similar Quality Map for Image Quality AssessmentPoster120 citations
- Controllable Video Generation With Sparse TrajectoriesPoster120 citations
- Regularizing RNNs for Caption Generation by Reconstructing the Past With the PresentPoster120 citations
- Deep Learning Under Privileged Information Using Heteroscedastic DropoutPoster119 citations
- SobolevFusion: 3D Reconstruction of Scenes Undergoing Free Non-Rigid MotionPoster119 citations
- Focal Visual-Text Attention for Visual Question AnsweringPoster118 citations
- High-Speed Tracking With Multi-Kernel Correlation FiltersPoster118 citations
- Human Pose Estimation With Parsing Induced LearnerPoster117 citations
- Learning Deep Sketch AbstractionPoster117 citations
- Im2Flow: Motion Hallucination From Static Images for Action RecognitionPoster116 citations
- Action Sets: Weakly Supervised Action Segmentation Without Ordering ConstraintsPoster115 citations
- Deeply Learned Filter Response Functions for Hyperspectral ReconstructionPoster115 citations
- Hashing as Tie-Aware Learning to RankPoster115 citations
- Left-Right Comparative Recurrent Model for Stereo MatchingPoster115 citations
- RayNet: Learning Volumetric 3D Reconstruction With Ray PotentialsPoster115 citations
- Finding "It": Weakly-Supervised Reference-Aware Visual Grounding in Instructional VideosPoster114 citations
- Learning Latent Super-Events to Detect Multiple Activities in VideosPoster114 citations
- People, Penguins and Petri Dishes: Adapting Object Counting Models to New Visual Domains and Object Types Without ForgettingPoster114 citations
- Efficient and Deep Person Re-Identification Using Multi-Level SimilarityPoster113 citations
- Knowledge Aided Consistency for Weakly Supervised Phrase GroundingPoster113 citations
- Robust Facial Landmark Detection via a Fully-Convolutional Local-Global Context NetworkPoster112 citations
- Connecting Pixels to Privacy and Utility: Automatic Redaction of Private Information in ImagesPoster111 citations
- Geometry-Aware Scene Text Detection With Instance Transformation NetworkPoster111 citations
- Good View Hunting: Learning Photo Composition From Dense View PairsPoster110 citations
- Improving Occlusion and Hard Negative Handling for Single-Stage Pedestrian DetectorsPoster110 citations
- Explicit Loss-Error-Aware Quantization for Low-Bit Deep Neural NetworksPoster109 citations
- Learning Time/Memory-Efficient Deep Architectures With Budgeted Super NetworksPoster108 citations
- Multi-Scale Weighted Nuclear Norm Image RestorationPoster108 citations
- On the Importance of Label Quality for Semantic SegmentationPoster108 citations
- Human Appearance TransferPoster106 citations
- Reinforcement Cutting-Agent Learning for Video Object SegmentationPoster105 citations
- Surface NetworksPoster105 citations
- Multi-Scale Location-Aware Kernel Representation for Object DetectionPoster103 citations
- Free Supervision From Video GamesPoster102 citations
- OLÉ: Orthogonal Low-Rank Embedding - A Plug and Play Geometric Loss for Deep LearningPoster102 citations
- Texture Mapping for 3D Reconstruction With RGB-D SensorPoster102 citations
- Augmented Skeleton Space Transfer for Depth-Based Hand Pose EstimationPoster101 citations
- Recognize Actions by Disentangling Components of DynamicsPoster101 citations
- TOM-Net: Learning Transparent Object Matting From a Single ImagePoster101 citations
- Two Can Play This Game: Visual Dialog With Discriminative Question Generation and AnsweringPoster101 citations
- CarFusion: Combining Point Tracking and Part Detection for Dynamic 3D Reconstruction of VehiclesPoster100 citations
- Learning to Detect Features in Texture ImagesPoster100 citations
- GroupCap: Group-Based Image Captioning With Structured Relevance and Diversity ConstraintsPoster99 citations
- Defocus Blur Detection via Multi-Stream Bottom-Top-Bottom Fully Convolutional NetworkPoster98 citations
- SGAN: An Alternative Training of Generative Adversarial NetworksPoster98 citations
- Differential Attention for Visual Question AnsweringPoster97 citations
- Global Versus Localized Generative Adversarial NetsPoster97 citations
- Inferring Shared Attention in Social Scene VideosPoster97 citations
- Learning by Asking QuestionsPoster97 citations
- Deep Spatio-Temporal Random Fields for Efficient Video SegmentationPoster96 citations
- Sparse, Smart Contours to Represent and Edit ImagesPoster96 citations
- Webly Supervised Learning Meets Zero-Shot Learning: A Hybrid Approach for Fine-Grained ClassificationPoster96 citations
- Weakly Supervised Learning of Single-Cell Feature EmbeddingsPoster95 citations
- Hierarchical Novelty Detection for Visual Object RecognitionPoster94 citations
- CNN Based Learning Using Reflection and Retinex Models for Intrinsic Image DecompositionPoster93 citations
- Disentangling Factors of Variation by Mixing ThemPoster93 citations
- Generative Adversarial Learning Towards Fast Weakly Supervised DetectionPoster93 citations
- Learning Generative ConvNets via Multi-Grid Modeling and SamplingPoster93 citations
- A Constrained Deep Neural Network for Ordinal RegressionPoster92 citations
- Deep Reinforcement Learning of Region Proposal Networks for Object DetectionPoster92 citations
- Fooling Vision and Language Models Despite Localization and Attention MechanismPoster92 citations
- Logo Synthesis and Manipulation With Clustered Generative Adversarial NetworksPoster92 citations
- Non-Blind Deblurring: Handling Kernel Uncertainty With CNNsPoster91 citations
- A Two-Step Disentanglement MethodPoster89 citations
- Revisiting Knowledge Transfer for Training Object Class DetectorsPoster89 citations
- Classification-Driven Dynamic Image EnhancementPoster88 citations
- Learning Visual Knowledge Memory Networks for Visual Question AnsweringPoster88 citations
- Bootstrapping the Performance of Webly Supervised Semantic SegmentationPoster87 citations
- Inferring Light Fields From ShadowsPoster87 citations
- SeedNet: Automatic Seed Generation With Deep Reinforcement Learning for Robust Interactive SegmentationPoster87 citations
- Self-Supervised Learning of Geometrically Stable Features Through Probabilistic IntrospectionPoster87 citations
- Who Let the Dogs Out? Modeling Dog Behavior From Visual DataPoster87 citations
- Multi-Shot Pedestrian Re-Identification via Sequential Decision MakingPoster86 citations
- Object Referring in Videos With Language and Human GazePoster86 citations
- Teaching Categories to Human Learners With Visual ExplanationsPoster86 citations
- A Memory Network Approach for Story-Based Temporal Summarization of 360° VideosPoster85 citations
- Optimizing Filter Size in Convolutional Neural Networks for Facial Action Unit RecognitionPoster84 citations
- A Network Architecture for Point Cloud Classification via Automatic Depth Images GenerationPoster82 citations
- Deep Density Clustering of Unconstrained FacesPoster82 citations
- Every Smile Is Unique: Landmark-Guided Diverse Smile GenerationPoster82 citations
- Video Representation Learning Using Discriminative PoolingPoster82 citations
- Where and Why Are They Looking? Jointly Inferring Human Attention and Intentions in Complex TasksPoster82 citations
- Structured Uncertainty Prediction NetworksPoster81 citations
- Decoupled NetworksPoster80 citations
- Geometry-Aware Deep Network for Single-Image Novel View SynthesisPoster80 citations
- Im2Pano3D: Extrapolating 360° Structure and Semantics Beyond the Field of ViewPoster80 citations
- A Certifiably Globally Optimal Solution to the Non-Minimal Relative Pose ProblemPoster79 citations
- Tracking Multiple Objects Outside the Line of Sight Using Speckle ImagingPoster78 citations
- Trust Your Model: Light Field Depth Estimation With Inline Occlusion HandlingPoster78 citations
- AMNet: Memorability Estimation With AttentionPoster77 citations
- Hierarchical Recurrent Attention Networks for Structured Online MapsPoster77 citations
- Multi-Task Adversarial Network for Disentangled Feature LearningPoster77 citations
- Real-World Repetition Estimation by Div, Grad and CurlPoster77 citations
- CBMV: A Coalesced Bidirectional Matching Volume for Disparity EstimationPoster76 citations
- Coding Kendall's Shape Trajectories for 3D Action RecognitionPoster76 citations
- Fine-Grained Video Captioning for Sports NarrativePoster76 citations
- Hybrid Camera Pose EstimationPoster76 citations
- InverseFaceNet: Deep Monocular Inverse Face RenderingPoster76 citations
- Mesoscopic Facial Geometry Inference Using Deep Neural NetworksPoster76 citations
- NestedNet: Learning Nested Sparse Structures in Deep Neural NetworksPoster76 citations
- Scalable and Effective Deep CCA via Soft DecorrelationPoster76 citations
- A Hierarchical Generative Model for Eye Image Synthesis and Eye Gaze EstimationPoster75 citations
- Geometry Aware Constrained Optimization Techniques for Deep LearningPoster75 citations
- Weakly Supervised Phrase Localization With Multi-Scale Anchored Transformer NetworkPoster75 citations
- Beyond Grobner Bases: Basis Selection for Minimal SolversPoster74 citations
- Deep Material-Aware Cross-Spectral Stereo MatchingPoster74 citations
- Dynamic Feature Learning for Partial Face RecognitionPoster74 citations
- Tensorize, Factorize and Regularize: Robust Visual Relationship LearningPoster74 citations
- Document Enhancement Using Visibility DetectionPoster73 citations
- A Low Power, High Throughput, Fully Event-Based Stereo SystemPoster72 citations
- Light Field Intrinsics With a Deep Encoder-Decoder NetworkPoster72 citations
- Multistage Adversarial Losses for Pose-Based Human Image SynthesisPoster72 citations
- End-to-End Learning of Keypoint Detector and Descriptor for Pose Invariant 3D MatchingPoster71 citations
- Learning Deep Descriptors With Scale-Aware Triplet NetworksPoster71 citations
- Learning Facial Action Units From Web Images With Scalable Weakly Supervised ClusteringPoster71 citations
- Learning Strict Identity Mappings in Deep Residual NetworksPoster71 citations
- Interpretable Video Captioning via Trajectory Structured LocalizationPoster70 citations
- Learning to Promote Saliency DetectorsPoster70 citations
- GAGAN: Geometry-Aware Generative Adversarial NetworksPoster69 citations
- SSNet: Scale Selection Network for Online 3D Action PredictionPoster68 citations
- Zoom and Learn: Generalizing Deep Stereo Matching to Novel DomainsPoster68 citations
- Automatic 3D Indoor Scene Modeling From Single PanoramaPoster67 citations
- Going From Image to Video Saliency: Augmenting Image Salience With Dynamic Attentional PushPoster67 citations
- Residual Parameter Transfer for Deep Domain AdaptationPoster67 citations
- Structure Preserving Video PredictionPoster67 citations
- Fast Spectral Ranking for Similarity SearchPoster66 citations
- Geometry-Aware Network for Non-Rigid Shape Prediction From a Single ViewPoster66 citations
- DeLS-3D: Deep Localization and Segmentation With a 3D Semantic MapPoster65 citations
- FFNet: Video Fast-Forwarding via Reinforcement LearningPoster65 citations
- Excitation Backprop for RNNsPoster64 citations
- One-Shot Action Localization by Learning Sequence Matching NetworkPoster64 citations
- Tagging Like Humans: Diverse and Distinct Image AnnotationPoster64 citations
- Two-Stream Convolutional Networks for Dynamic Texture SynthesisPoster64 citations
- Weakly-Supervised Deep Convolutional Neural Network Learning for Facial Action Unit Intensity EstimationPoster64 citations
- Aperture Supervision for Monocular Depth EstimationPoster63 citations
- Classifier Learning With Prior Probabilities for Facial Action Unit RecognitionPoster63 citations
- Weakly Supervised Facial Action Unit Recognition Through Adversarial TrainingPoster63 citations
- xUnit: Learning a Spatial Activation Function for Efficient Image RestorationPoster63 citations
- Deep Diffeomorphic Transformer NetworksPoster62 citations
- Density Adaptive Point Set RegistrationPoster62 citations
- Efficient Optimization for Rank-Based Loss FunctionsPoster62 citations
- Image Restoration by Estimating Frequency Distribution of Local PatchesPoster62 citations
- Polarimetric Dense Monocular SLAMPoster62 citations
- A Deeper Look at Power NormalizationsPoster61 citations
- Aligning Infinite-Dimensional Covariance Matrices in Reproducing Kernel Hilbert Spaces for Domain AdaptationPoster61 citations
- Cross-Dataset Adaptation for Visual Question AnsweringPoster61 citations
- Feature Super-Resolution: Make Machine See More ClearlyPoster61 citations
- CLEAR: Cumulative LEARning for One-Shot One-Class Image RecognitionPoster60 citations
- Deep Cross-Media Knowledge TransferPoster60 citations
- IVQA: Inverse Visual Question AnsweringPoster60 citations
- Multi-Image Semantic Matching by Mining Consistent FeaturesPoster60 citations
- The Best of Both Worlds: Combining CNNs and Geometric Constraints for Hierarchical Motion SegmentationPoster59 citations
- Wasserstein Introspective Neural NetworksPoster59 citations
- What Have We Learned From Deep Representations for Action Recognition?Poster59 citations
- An Efficient and Provable Approach for Mixture Proportion Estimation Using Linear Independence AssumptionPoster58 citations
- LAMV: Learning to Align and Match Videos With Kernelized Temporal LayersPoster58 citations
- Optimal Structured Light à La CartePoster58 citations
- Scalable Dense Non-Rigid Structure-From-Motion: A Grassmannian PerspectivePoster58 citations
- Towards Dense Object Tracking in a 2D Honeybee HivePoster58 citations
- Deep Hashing via Discrepancy MinimizationPoster57 citations
- Egocentric Activity Recognition on a BudgetPoster57 citations
- Facelet-Bank for Fast Portrait ManipulationPoster57 citations
- Kernelized Subspace Pooling for Deep Local DescriptorsPoster57 citations
- Learning Distributions of Shape Trajectories From Longitudinal Datasets: A Hierarchical Model on a Manifold of DiffeomorphismsPoster57 citations
- Learning to Understand Image BlurPoster57 citations
- End-to-End Convolutional Semantic EmbeddingsPoster55 citations
- Improving Color Reproduction Accuracy on CamerasPoster55 citations
- Efficient Large-Scale Approximate Nearest Neighbor Search on OpenCL FPGAPoster54 citations
- Five-Point Fundamental Matrix Estimation for Uncalibrated CamerasPoster54 citations
- Making Convolutional Networks Recurrent for Visual Sequence LearningPoster54 citations
- Probabilistic Plant Modeling via Multi-View Image-to-Image TranslationPoster54 citations
- A Robust Method for Strong Rolling Shutter Effects Correction Using Lines With Automatic Feature SelectionPoster53 citations
- Bilateral Ordinal Relevance Multi-Instance Regression for Facial Action Unit Intensity EstimationPoster53 citations
- DS*: Tighter Lifting-Free Convex Relaxations for Quadratic Matching ProblemsPoster53 citations
- DeepVoting: A Robust and Explainable Deep Network for Semantic Part Detection Under Partial OcclusionPoster53 citations
- LDMNet: Low Dimensional Manifold Regularized Neural NetworksPoster53 citations
- Pseudo Mask Augmented Object DetectionPoster53 citations
- Stacked Latent Attention for Multimodal ReasoningPoster53 citations
- Unifying Identification and Context Learning for Person RecognitionPoster53 citations
- View Extrapolation of Human Body From a Single ImagePoster53 citations
- Generating a Fusion Image: One's Identity and Another's ShapePoster52 citations
- Learning Intelligent Dialogs for Bounding Box AnnotationPoster52 citations
- Wrapped Gaussian Process Regression on Riemannian ManifoldsPoster52 citations
- Active Fixation Control to Predict Saccade SequencesPoster51 citations
- Non-Linear Temporal Subspace Representations for Activity RecognitionPoster51 citations
- Baseline Desensitizing in Translation AveragingPoster50 citations
- Link and Code: Fast Indexing With Graphs and Compact Regression CodesPoster50 citations
- Motion Segmentation by Exploiting Complementary Geometric ModelsPoster49 citations
- Planar Shape Detection at Structural ScalesPoster49 citations
- Alive Caricature From 2D to 3DPoster48 citations
- Fight Ill-Posedness With Ill-Posedness: Single-Shot Variational Depth Super-Resolution From ShadingPoster48 citations
- FlipDial: A Generative Model for Two-Way Visual DialoguePoster48 citations
- Unsupervised Textual Grounding: Linking Words to Image ConceptsPoster48 citations
- Matching Pixels Using Co-Occurrence StatisticsPoster47 citations
- Perturbative Neural NetworksPoster47 citations
- Radially-Distorted Conjugate TranslationsPoster47 citations
- Recurrent Residual Module for Fast Inference in VideosPoster46 citations
- Reward Learning From Narrated DemonstrationsPoster46 citations
- Occlusion-Aware Rolling Shutter Rectification of 3D ScenesPoster45 citations
- Bidirectional Retrieval Made SimplePoster44 citations
- Learning Answer Embeddings for Visual Question AnsweringPoster44 citations
- Intrinsic Image Transformation via Scale Space DecompositionPoster43 citations
- PoseFlow: A Deep Motion Representation for Understanding Human Behaviors in VideosPoster43 citations
- Uncalibrated Photometric Stereo Under Natural IlluminationPoster43 citations
- Jerk-Aware Video Acceleration MagnificationPoster42 citations
- MoNet: Moments Embedding NetworkPoster42 citations
- Structured Set Matching Networks for One-Shot Part LabelingPoster42 citations
- Towards a Mathematical Understanding of the Difficulty in Learning With Feedforward Neural NetworksPoster42 citations
- Visual Question Reasoning on General Dependency TreePoster42 citations
- Sparse Photometric 3D Face Reconstruction Guided by Morphable ModelsPoster41 citations
- Structure From Recurrent Motion: From Rigidity to RecurrencyPoster41 citations
- What Do Deep Networks Like to See?Poster41 citations
- Beyond Trade-Off: Accelerate FCN-Based Face Detector With Higher AccuracyPoster40 citations
- Modulated Convolutional NetworksPoster40 citations
- Separating Self-Expression and Visual Content in Hashtag SupervisionPoster40 citations
- Show Me a Story: Towards Coherent Neural Story IllustrationPoster40 citations
- Camera Pose Estimation With Unknown Principal PointPoster39 citations
- Geometric Multi-Model Fitting With a Convex Relaxation AlgorithmPoster39 citations
- Guide Me: Interacting With Deep NetworksPoster39 citations
- Reconstructing Thin Structures of Manifold Surfaces by Integrating Spatial CurvesPoster39 citations
- Depth-Aware Stereo Video RetargetingPoster38 citations
- DiverseNet: When One Right Answer Is Not EnoughPoster38 citations
- Dynamic Graph Generation Network: Generating Relational Knowledge From DiagramsPoster38 citations
- Egocentric Basketball Motion Planning From a Single First-Person ImagePoster38 citations
- Latent RANSACPoster38 citations
- GraphBit: Bitwise Interaction Mining via Deep Reinforcement LearningPoster37 citations
- KIPPI: KInetic Polygonal Partitioning of ImagesPoster37 citations
- Matching Adversarial NetworksPoster37 citations
- Memory Based Online Learning of Deep Representations From Video StreamsPoster37 citations
- Nonlocal Low-Rank Tensor Factor Analysis for Image RestorationPoster37 citations
- A Causal And-Or Graph Model for Visibility Fluent Reasoning in Tracking Interacting ObjectsPoster36 citations
- Analytic Expressions for Probabilistic Moments of PL-DNN With Gaussian InputPoster36 citations
- Deep Cost-Sensitive and Order-Preserving Feature Learning for Cross-Population Age EstimationPoster36 citations
- Mix and Match Networks: Encoder-Decoder Alignment for Zero-Pair Image TranslationPoster36 citations
- A Weighted Sparse Sampling and Smoothing Frame Transition Approach for Semantic Fast-Forward First-Person VideosPoster35 citations
- Beyond Holistic Object Recognition: Enriching Image Understanding With Part StatesPoster35 citations
- Feature Quantization for Defending Against Distortion of ImagesPoster35 citations
- Regularizing Deep Networks by Modeling and Predicting Label StructurePoster35 citations
- Generating Synthetic X-Ray Images of a Person From the Surface GeometryPoster34 citations
- Guided Proofreading of Automatic Segmentations for ConnectomicsPoster34 citations
- Learning From Noisy Web Data With Category-Level SupervisionPoster34 citations
- Textbook Question Answering Under Instructor Guidance With Memory NetworksPoster34 citations
- A Common Framework for Interactive Texture TransferPoster33 citations
- Shape From Shading Through Shape EvolutionPoster33 citations
- A Prior-Less Method for Multi-Face Tracking in Unconstrained VideosPoster32 citations
- Efficient Diverse Ensemble for Discriminative Co-TrackingPoster32 citations
- Depth and Transient Imaging With Compressive SPAD Array CamerasPoster31 citations
- Image Collection Pop-Up: 3D Reconstruction and Clustering of Rigid and Non-Rigid CategoriesPoster31 citations
- Learning Pose Specific Representations by Predicting Different ViewsPoster31 citations
- Pulling Actions out of Context: Explicit Separation for Effective CombinationPoster31 citations
- SurfConv: Bridging 3D and 2D Convolution for RGBD ImagesPoster31 citations
- 3D Object Detection With Latent Support SurfacesPoster30 citations
- Deep Sparse Coding for Invariant Multimodal Halle Berry NeuronsPoster30 citations
- Fusing Crowd Density Maps and Visual Object Trackers for People Tracking in Crowd ScenesPoster30 citations
- Learning Compressible 360° Video IsomersPoster29 citations
- Learning Globally Optimized Object Detector via Policy GradientPoster29 citations
- Alternating-Stereo VINS: Observability Analysis and Performance EvaluationPoster28 citations
- BPGrad: Towards Global Optimality in Deep Learning via Branch and PruningPoster28 citations
- Large-Scale Distance Metric Learning With UncertaintyPoster28 citations
- A Face-to-Face Neural Conversation ModelPoster27 citations
- Distributable Consistent Multi-Object MatchingPoster27 citations
- Feature Selective Networks for Object DetectionPoster27 citations
- Salience Guided Depth Calibration for Perceptually Optimized Compressive Light Field 3D DisplayPoster27 citations
- Sketch-a-Classifier: Sketch-Based Photo Classifier GenerationPoster27 citations
- Tags2Parts: Discovering Semantic Regions From Shape TagsPoster27 citations
- Coupled End-to-End Transfer Learning With Generalized Fisher InformationPoster26 citations
- Now You Shake Me: Towards Automatic 4D CinemaPoster26 citations
- OATM: Occlusion Aware Template Matching by Consensus Set MaximizationPoster26 citations
- Generative Adversarial Image Synthesis With Decision Tree Latent ControllerPoster25 citations
- Multiple Granularity Group Interaction PredictionPoster25 citations
- Photometric Stereo in Participating Media Considering Shape-Dependent Forward ScatterPoster25 citations
- Reflection Removal for Large-Scale 3D Point CloudsPoster25 citations
- Temporal Hallucinating for Action Recognition With Few Still ImagesPoster25 citations
- Inverse Composition Discriminative Optimization for Point Cloud RegistrationPoster24 citations
- Lean Multiclass CrowdsourcingPoster24 citations
- A Neural Multi-Sequence Alignment TeCHnique (NeuMATCH)Poster23 citations
- Label Denoising Adversarial Network (LDAN) for Inverse Lighting of FacesPoster23 citations
- Representing and Learning High Dimensional Data With the Optimal Transport Map From a Probabilistic ViewpointPoster23 citations
- Spline Error Weighting for Robust Visual-Inertial FusionPoster23 citations
- Exploiting Transitivity for Learning Person Re-Identification Models on a BudgetPoster22 citations
- Globally Optimal Inlier Set Maximization for Atlanta Frame EstimationPoster22 citations
- Easy Identification From Better Constraints: Multi-Shot Person Re-Identification From Reference ConstraintsPoster21 citations
- Learning Multi-Instance Enriched Image Representations via Non-Greedy Ratio Maximization of the l1-Norm DistancesPoster21 citations
- Manifold Learning in Quotient SpacesPoster21 citations
- Probabilistic Joint Face-Skull Modelling for Facial ReconstructionPoster21 citations
- Deformation Aware Image CompressionPoster19 citations
- Joint Cuts and Matching of Partitions in One GraphPoster19 citations
- Stochastic Downsampling for Cost-Adjustable Inference and Improved Regularization in Convolutional NetworksPoster19 citations
- 3D Registration of Curves and Surfaces Using Local Differential InformationPoster18 citations
- Adversarial Data Programming: Using GANs to Relax the Bottleneck of Curated Labeled DataPoster18 citations
- Discovering Point Lights With Intensity Distance FieldsPoster18 citations
- Fast Monte-Carlo Localization on Aerial Vehicles Using Approximate Continuous Belief RepresentationsPoster18 citations
- Indoor RGB-D Compass From a Single Line and PlanePoster18 citations
- pOSE: Pseudo Object Space Error for Initialization-Free Bundle AdjustmentPoster18 citations
- Boundary Flow: A Siamese Network That Predicts Boundary Motion Without Training on MotionPoster17 citations
- CNN Driven Sparse Multi-Level B-Spline Image RegistrationPoster17 citations
- Learning Compositional Visual Concepts With Mutual ConsistencyPoster17 citations
- Divide and Conquer for Full-Resolution Light Field DeblurringPoster16 citations
- Illuminant Spectra-Based Source Separation Using Flash PhotographyPoster16 citations
- Learning a Complete Image Indexing PipelinePoster16 citations
- Multi-Task Learning by Maximizing Statistical DependencePoster16 citations
- Robust Hough Transform Based 3D Reconstruction From Circular Light FieldsPoster16 citations
- A Minimalist Approach to Type-Agnostic Detection of Quadrics in Point CloudsPoster15 citations
- Analyzing Filters Toward Efficient ConvNetPoster15 citations
- ClcNet: Improving the Efficiency of Convolutional Neural Network Using Channel Local ConvolutionsPoster15 citations
- Dimensionality's Blessing: Clustering Images by Underlying DistributionPoster15 citations
- Disentangling Structure and Aesthetics for Style-Aware Image CompletionPoster15 citations
- Feedback-Prop: Convolutional Neural Network Inference Under Partial EvidencePoster15 citations
- Focus Manipulation Detection via Photometric Histogram AnalysisPoster15 citations
- Deep Face Detector Adaptation Without Negative Transfer or Catastrophic ForgettingPoster14 citations
- Spatially-Adaptive Filter Units for Deep Neural NetworksPoster14 citations
- 3D Semantic Trajectory Reconstruction From 3D Pixel ContinuumPoster13 citations
- Multimodal Visual Concept Learning With Weakly Supervised TechniquesPoster13 citations
- Multispectral Image Intrinsic Decomposition via Subspace ConstraintPoster13 citations
- Objects as Context for Detecting Their Semantic PartsPoster13 citations
- Statistical Tomography of Microscopic LifePoster13 citations
- Content-Sensitive Supervoxels via Uniform Tessellations on Video ManifoldsPoster12 citations
- Estimation of Camera Locations in Highly Corrupted Scenarios: All About That Base, No Shape TroublePoster12 citations
- SoS-RSC: A Sum-of-Squares Polynomial Approach to Robustifying Subspace Clustering AlgorithmsPoster12 citations
- A Fast Resection-Intersection Method for the Known Rotation ProblemPoster11 citations
- Dual Skipping NetworksPoster11 citations
- Modifying Non-Local Variations Across Multiple ViewsPoster11 citations
- Rolling Shutter and Radial Distortion Are Features for High Frame Rate Multi-Camera TrackingPoster11 citations
- Context Embedding NetworksPoster10 citations
- Customized Image Narrative Generation via Interactive Visual Question Generation and AnsweringPoster10 citations
- Discrete-Continuous ADMM for Transductive Inference in Higher-Order MRFsPoster10 citations
- Fast and Robust Estimation for Unit-Norm Constrained Linear Fitting ProblemsPoster10 citations
- Learned Shape-Tailored Descriptors for SegmentationPoster10 citations
- Analytical Modeling of Vanishing Points and Curves in Catadioptric CamerasPoster9 citations
- Augmenting Crowd-Sourced 3D Reconstructions Using Semantic DetectionsPoster9 citations
- Compare and Contrast: Learning Prominent Visual DifferencesPoster9 citations
- Learning Patch Reconstructability for Accelerating Multi-View StereoPoster9 citations
- Multi-Cell Detection and Classification Using a Generative Convolutional ModelPoster9 citations
- Consensus Maximization for Semantic Region CorrespondencesPoster8 citations
- Environment Upgrade Reinforcement Learning for Non-Differentiable Multi-Stage PipelinesPoster8 citations
- Local and Global Optimization Techniques in Graph-Based ClusteringPoster8 citations
- Time-Resolved Light Transport Decomposition for Thermal Photometric StereoPoster8 citations
- Trapping Light for Time of FlightPoster8 citations
- Unsupervised Correlation AnalysisPoster8 citations
- 4D Human Body Correspondences From Panoramic Depth MapsPoster7 citations
- Categorizing Concepts With Basic Level for Vision-to-LanguagePoster7 citations
- Inference in Higher Order MRF-MAP Problems With Small and Large CliquesPoster7 citations
- Robust Depth Estimation From Auto Bracketed ImagesPoster7 citations
- Self-Calibrating Polarising Radiometric CalibrationPoster7 citations
- Continuous Relaxation of MAP Inference: A Nonconvex PerspectivePoster5 citations
- Compassionately Conservative Balanced Cuts for Image SegmentationPoster4 citations
- On the Convergence of PatchMatch and Its VariantsPoster4 citations
- A Biresolution Spectral Framework for Product QuantizationPoster3 citations
- Efficient, Sparse Representation of Manifold Distance Matrices for Classical ScalingPoster3 citations
- Seeing Temporal Modulation of Lights From Standard CamerasPoster3 citations
- Stochastic Variational Inference With Gradient LinearizationPoster3 citations
- Curve Reconstruction via the Global Statistics of Natural CurvesPoster2 citations
- Efficient Subpixel Refinement With Symbolic Linear PredictorsPoster1 citations
- High-Order Tensor Regularization With Application to Attribute RankingPoster1 citations
- CSGNet: Neural Shape Parser for Constructive Solid GeometryPoster
- Independently Recurrent Neural Network (IndRNN): Building a Longer and Deeper RNNPoster
- Solving the Perspective-2-Point Problem for Flying-Camera Photo CompositionPoster
- Viewpoint-Aware Attentive Multi-View Inference for Vehicle Re-IdentificationPoster
- Viewpoint-Aware Video SummarizationPoster
CVPR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.