CVPR 2017 Accepted Papers
The full list of 783 papers accepted at CVPR 2017 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 568Spotlight: 144Oral: 71
- Densely Connected Convolutional NetworksOral54,232 citations
- Feature Pyramid Networks for Object DetectionPoster33,044 citations
- Image-To-Image Translation With Conditional Adversarial NetworksPoster27,229 citations
- YOLO9000: Better, Faster, StrongerOral25,398 citations
- Xception: Deep Learning With Depthwise Separable ConvolutionsPoster22,485 citations
- PointNet: Deep Learning on Point Sets for 3D Classification and SegmentationOral19,941 citations
- Pyramid Scene Parsing NetworkPoster17,601 citations
- Photo-Realistic Single Image Super-Resolution Using a Generative Adversarial NetworkOral14,895 citations
- Aggregated Residual Transformations for Deep Neural NetworksPoster14,783 citations
- Quo Vadis, Action Recognition? A New Model and the Kinetics DatasetPoster10,976 citations
- Realtime Multi-Person 2D Pose Estimation Using Part Affinity FieldsOral9,379 citations
- Adversarial Discriminative Domain AdaptationPoster6,156 citations
- ChestX-ray8: Hospital-Scale Chest X-Ray Database and Benchmarks on Weakly-Supervised Classification and Localization of Common Thorax DiseasesSpotlight5,353 citations
- ScanNet: Richly-Annotated 3D Reconstructions of Indoor ScenesSpotlight5,003 citations
- iCaRL: Incremental Classifier and Representation LearningSpotlight4,974 citations
- Residual Attention Network for Image ClassificationSpotlight4,712 citations
- Scene Parsing Through ADE20K DatasetPoster4,105 citations
- FlowNet 2.0: Evolution of Optical Flow Estimation With Deep NetworksPoster4,066 citations
- RefineNet: Multi-Path Refinement Networks for High-Resolution Semantic SegmentationPoster4,039 citations
- Multi-View 3D Object Detection Network for Autonomous DrivingSpotlight3,953 citations
- Unsupervised Monocular Depth Estimation With Left-Right ConsistencyOral3,871 citations
- Making the v in VQA Matter: Elevating the Role of Image Understanding in Visual Question AnsweringPoster3,740 citations
- SphereFace: Deep Hypersphere Embedding for Face RecognitionPoster3,736 citations
- Speed/Accuracy Trade-Offs for Modern Convolutional Object DetectorsSpotlight3,693 citations
- Universal Adversarial PerturbationsOral3,430 citations
- Unsupervised Learning of Depth and Ego-Motion From VideoOral3,364 citations
- Deep Laplacian Pyramid Networks for Fast and Accurate Super-ResolutionPoster3,356 citations
- ECO: Efficient Convolution Operators for TrackingPoster3,142 citations
- A Point Set Generation Network for 3D Object Reconstruction From a Single ImageOral2,836 citations
- CLEVR: A Diagnostic Dataset for Compositional Language and Elementary Visual ReasoningPoster2,819 citations
- Image Super-Resolution via Deep Recursive Residual NetworkPoster2,749 citations
- Deep Hashing Network for Unsupervised Domain AdaptationSpotlight2,742 citations
- Deep Multi-Scale Convolutional Neural Network for Dynamic Scene DeblurringSpotlight2,652 citations
- Self-Critical Sequence Training for Image CaptioningOral2,619 citations
- Learning Deep CNN Denoiser Prior for Image RestorationPoster2,471 citations
- Geometric Deep Learning on Graphs and Manifolds Using Mixture Model CNNsOral2,443 citations
- Learning From Simulated and Unsupervised Images Through Adversarial TrainingOral2,368 citations
- SCA-CNN: Spatial and Channel-Wise Attention in Convolutional Networks for Image CaptioningPoster2,297 citations
- Dilated Residual NetworksPoster2,214 citations
- EAST: An Efficient and Accurate Scene Text DetectorPoster2,207 citations
- Temporal Convolutional Networks for Action Segmentation and DetectionPoster2,196 citations
- Large Kernel Matters -- Improve Semantic Segmentation by Global Convolutional NetworkPoster2,037 citations
- Unsupervised Pixel-Level Domain Adaptation With Generative Adversarial NetworksOral2,021 citations
- Knowing When to Look: Adaptive Attention via a Visual Sentinel for Image CaptioningSpotlight2,002 citations
- OctNet: Learning Deep 3D Representations at High ResolutionsOral1,982 citations
- A Gift From Knowledge Distillation: Fast Optimization, Network Minimization and Transfer LearningPoster1,972 citations
- Reliable Crowdsourcing and Deep Locality-Preserving Learning for Expression Recognition in the WildPoster1,966 citations
- Network Dissection: Quantifying Interpretability of Deep Visual RepresentationsOral1,943 citations
- Re-Ranking Person Re-Identification With k-Reciprocal EncodingPoster1,916 citations
- Deeply Supervised Salient Object Detection With Short ConnectionsPoster1,892 citations
- End-To-End Representation Learning for Correlation Filter Based TrackingPoster1,892 citations
- Making Deep Neural Networks Robust to Label Noise: A Loss Correction ApproachOral1,853 citations
- Discriminative Correlation Filter With Channel and Spatial ReliabilityPoster1,672 citations
- Dynamic Edge-Conditioned Filters in Convolutional Neural Networks on GraphsSpotlight1,648 citations
- Look Closer to See Better: Recurrent Attention Convolutional Neural Network for Fine-Grained Image RecognitionOral1,640 citations
- Optical Flow Estimation Using a Spatial Pyramid NetworkPoster1,582 citations
- Hand Keypoint Detection in Single Images Using Multiview BootstrappingPoster1,579 citations
- Scene Graph Generation by Iterative Message PassingPoster1,568 citations
- Beyond Triplet Loss: A Deep Quadruplet Network for Person Re-IdentificationSpotlight1,545 citations
- Semantic Scene Completion From a Single Depth ImageOral1,504 citations
- Semantic Image Inpainting With Deep Generative ModelsPoster1,485 citations
- Age Progression/Regression by Conditional Adversarial AutoencoderSpotlight1,463 citations
- Learning to Detect Salient Objects With Image-Level SupervisionPoster1,450 citations
- Richer Convolutional Features for Edge DetectionPoster1,433 citations
- Fully Convolutional Instance-Aware Semantic SegmentationSpotlight1,418 citations
- Removing Rain From Single Images via a Deep Detail NetworkPoster1,377 citations
- Deep Joint Rain Detection and Removal From a Single ImagePoster1,366 citations
- 3D Bounding Box Estimation Using Deep Learning and GeometryPoster1,362 citations
- DESIRE: Distant Future Prediction in Dynamic Scenes With Interacting AgentsSpotlight1,300 citations
- 3DMatch: Learning Local Geometric Descriptors From RGB-D ReconstructionsOral1,287 citations
- Spatiotemporal Multiplier Networks for Video Action RecognitionPoster1,281 citations
- Visual DialogSpotlight1,254 citations
- On Human Motion Prediction Using Recurrent Neural NetworksPoster1,252 citations
- Learning From Synthetic HumansPoster1,234 citations
- Disentangled Representation Learning GAN for Pose-Invariant Face RecognitionOral1,217 citations
- Switching Convolutional Neural Network for Crowd CountingPoster1,200 citations
- Coarse-To-Fine Volumetric Prediction for Single-Image 3D Human PoseSpotlight1,177 citations
- One-Shot Video Object SegmentationPoster1,167 citations
- Towards Accurate Multi-Person Pose Estimation in the WildPoster1,144 citations
- CityPersons: A Diverse Dataset for Pedestrian DetectionSpotlight1,138 citations
- A Low Power, Fully Event-Based Gesture Recognition SystemPoster1,129 citations
- End-To-End Learning of Driving Models From Large-Scale Video DatasetsOral1,126 citations
- High-Resolution Image Inpainting Using Multi-Scale Neural Patch SynthesisPoster1,114 citations
- Full Resolution Image Compression With Recurrent Neural NetworksOral1,111 citations
- Designing Energy-Efficient Convolutional Neural Networks Using Energy-Aware PruningPoster1,106 citations
- Spindle Net: Person Re-Identification With Human Body Region Guided Feature Decomposition and FusionPoster1,102 citations
- Semantic Autoencoder for Zero-Shot LearningSpotlight1,099 citations
- Joint Detection and Identification Feature Learning for Person SearchSpotlight1,086 citations
- A New Representation of Skeleton Sequences for 3D Action RecognitionPoster1,080 citations
- Lip Reading Sentences in the WildOral1,063 citations
- Perceptual Generative Adversarial Networks for Small Object DetectionPoster1,052 citations
- Plug & Play Generative Networks: Conditional Iterative Generation of Images in Latent SpaceSpotlight1,035 citations
- Finding Tiny FacesPoster1,025 citations
- CNN-SLAM: Real-Time Dense Monocular SLAM With Learned Depth PredictionSpotlight1,024 citations
- Object Region Mining With Adversarial Erasing: A Simple Classification to Semantic Segmentation ApproachOral1,023 citations
- Zero-Shot Learning - the Good, the Bad and the UglyPoster1,015 citations
- Person Re-Identification in the WildSpotlight1,011 citations
- A Multi-View Stereo Benchmark With High-Resolution Images and Multi-Camera VideosPoster1,009 citations
- Improved Texture Networks: Maximizing Quality and Diversity in Feed-Forward Stylization and Texture SynthesisPoster1,004 citations
- HPatches: A Benchmark and Evaluation of Handcrafted and Learned Local DescriptorsPoster980 citations
- Simple Does It: Weakly Supervised Instance and Semantic SegmentationPoster971 citations
- Geometric Loss Functions for Camera Pose Regression With Deep LearningSpotlight970 citations
- Deep Cross-Modal HashingSpotlight929 citations
- Learning Non-Maximum SuppressionSpotlight926 citations
- Deep Pyramidal Residual NetworksPoster916 citations
- Multi-Context Attention for Human Pose EstimationPoster909 citations
- Semi-Supervised Deep Learning for Monocular Depth Map PredictionSpotlight897 citations
- Learning a Deep Embedding Model for Zero-Shot LearningPoster895 citations
- Deep Photo Style TransferPoster892 citations
- Deep Feature Flow for Video RecognitionPoster889 citations
- Real-Time Video Super-Resolution With Spatio-Temporal Networks and Motion CompensationPoster888 citations
- Dual Attention Networks for Multimodal Reasoning and MatchingSpotlight882 citations
- DeMoN: Depth and Motion Network for Learning Monocular StereoPoster880 citations
- Cognitive Mapping and Planning for Visual NavigationPoster876 citations
- Harmonic Networks: Deep Translation and Rotation EquivariancePoster867 citations
- Detecting Oriented Text in Natural Images by Linking SegmentsSpotlight864 citations
- Expert Gate: Lifelong Learning With a Network of ExpertsPoster862 citations
- GMS: Grid-based Motion Statistics for Fast, Ultra-Robust Feature CorrespondencePoster862 citations
- Ubernet: Training a Universal Convolutional Neural Network for Low-, Mid-, and High-Level Vision Using Diverse Datasets and Limited MemoryOral855 citations
- Split-Brain Autoencoders: Unsupervised Learning by Cross-Channel PredictionPoster843 citations
- Learning Deep Context-Aware Features Over Body and Latent Parts for Person Re-IdentificationPoster829 citations
- Global Context-Aware Attention LSTM Networks for 3D Action RecognitionPoster822 citations
- Generative Face CompletionPoster812 citations
- Shape Completion Using 3D-Encoder-Predictor CNNs and Shape SynthesisSpotlight804 citations
- A-Fast-RCNN: Hard Positive Generation via Adversary for Object DetectionPoster802 citations
- Large Margin Object Tracking With Circulant Feature MapsPoster801 citations
- Context-Aware Correlation Filter TrackingOral781 citations
- Mind the Class Weight Bias: Weighted Maximum Mean Discrepancy for Unsupervised Domain AdaptationPoster777 citations
- Learning Cross-Modal Embeddings for Cooking Recipes and Food ImagesPoster758 citations
- Stacked Generative Adversarial NetworksPoster751 citations
- Full-Resolution Residual Networks for Semantic Segmentation in Street ScenesOral741 citations
- 3D Human Pose Estimation = 2D Pose Estimation + MatchingPoster738 citations
- YouTube-BoundingBoxes: A Large High-Precision Human-Annotated Data Set for Object Detection in VideoPoster738 citations
- DSAC - Differentiable RANSAC for Camera LocalizationOral737 citations
- Non-Local Deep Features for Salient Object DetectionSpotlight736 citations
- Deep Watershed Transform for Instance SegmentationPoster730 citations
- Benchmarking Denoising Algorithms With Real PhotographsPoster714 citations
- Deep Video Deblurring for Hand-Held CamerasSpotlight711 citations
- CDC: Convolutional-De-Convolutional Networks for Precise Temporal Action Localization in Untrimmed VideosOral706 citations
- Unsupervised Video Summarization With Adversarial LSTM NetworksPoster704 citations
- Convolutional Neural Network Architecture for Geometric MatchingSpotlight703 citations
- Multiple People Tracking by Lifted Multicut and Person Re-IdentificationPoster703 citations
- L2-Net: Deep Learning of Discriminative Patch Descriptor in Euclidean SpacePoster698 citations
- Deep Image MattingOral685 citations
- Unite the People: Closing the Loop Between 3D and 2D Human RepresentationsPoster680 citations
- Joint Geometrical and Statistical Alignment for Visual Domain AdaptationPoster677 citations
- TGIF-QA: Toward Spatio-Temporal Reasoning in Visual Question AnsweringSpotlight676 citations
- Visual Translation Embedding Network for Visual Relation DetectionPoster676 citations
- Learning Video Object Segmentation From Static ImagesSpotlight651 citations
- Lifting From the Deep: Convolutional 3D Pose Estimation From a Single ImagePoster651 citations
- UntrimmedNets for Weakly Supervised Action Recognition and DetectionPoster651 citations
- Multi-View Supervision for Single-View Reconstruction via Differentiable Ray ConsistencyOral646 citations
- Scribbler: Controlling Deep Image Synthesis With Sketch and ColorPoster643 citations
- Learning Features by Watching Objects MovePoster640 citations
- Action-Decision Networks for Visual Tracking With Deep Reinforcement LearningSpotlight635 citations
- Deep Learning With Low Precision by Half-Wave Gaussian QuantizationSpotlight632 citations
- Latent Multi-View Subspace ClusteringSpotlight631 citations
- Detecting Visual Relationships With Deep Relational NetworksOral625 citations
- Colorization as a Proxy Task for Visual UnderstandingPoster622 citations
- Look Into Person: Self-Supervised Structure-Sensitive Learning and a New Benchmark for Human ParsingPoster621 citations
- Video Frame Interpolation via Adaptive ConvolutionSpotlight614 citations
- Regressing Robust and Discriminative 3D Morphable Models With a Very Deep Neural NetworkPoster612 citations
- ActionVLAD: Learning Spatio-Temporal Aggregation for Action ClassificationPoster607 citations
- Learning From Noisy Large-Scale Datasets With Minimal SupervisionSpotlight606 citations
- StyleBank: An Explicit Representation for Neural Image Style TransferPoster602 citations
- Controlling Perceptual Factors in Neural Style TransferPoster594 citations
- Superpixels and Polygons Using Simple Non-Iterative ClusteringPoster575 citations
- Deep MANTA: A Coarse-To-Fine Many-Task Network for Joint 2D and 3D Vehicle Analysis From Monocular ImagePoster564 citations
- Multiple Instance Detection Network With Online Instance Classifier RefinementPoster564 citations
- On Compressing Deep Models by Low Rank and Sparse DecompositionSpotlight562 citations
- Self-Supervised Video Representation Learning With Odd-One-Out NetworksPoster562 citations
- Multi-Scale Continuous CRFs as Sequential Deep Networks for Monocular Depth EstimationSpotlight561 citations
- Semantic Compositional Networks for Visual CaptioningSpotlight561 citations
- SyncSpecCNN: Synchronized Spectral CNN for 3D Shape SegmentationSpotlight560 citations
- Detecting Masked Faces in the Wild With LLE-CNNsPoster557 citations
- SST: Single-Stream Temporal Action ProposalsPoster544 citations
- RON: Reverse Connection With Objectness Prior Networks for Object DetectionPoster539 citations
- Person Search With Natural Language DescriptionPoster537 citations
- Graph-Structured Representations for Visual Question AnsweringSpotlight525 citations
- Deep Representation Learning for Human Motion Prediction and ClassificationPoster519 citations
- Fine-Tuning Convolutional Neural Networks for Biomedical Image Analysis: Actively and IncrementallyPoster516 citations
- Modeling Temporal Dynamics and Spatial Configurations of Actions Using Two-Stream Recurrent Neural NetworksPoster511 citations
- Fully-Adaptive Feature Sharing in Multi-Task Networks With Applications in Person Attribute ClassificationSpotlight509 citations
- From Motion Blur to Motion Flow: A Deep Learning Solution for Removing Heterogeneous Motion BlurPoster504 citations
- 3D Human Pose Estimation From a Single Image via Distance Matrix RegressionPoster499 citations
- Multi-Task Correlation Particle Filter for Robust Object TrackingPoster498 citations
- Neural Aggregation Network for Video Face RecognitionPoster495 citations
- 3D Menagerie: Modeling the 3D Shape and Pose of AnimalsSpotlight491 citations
- A Hierarchical Approach for Generating Descriptive Image ParagraphsSpotlight487 citations
- GuessWhat?! Visual Object Discovery Through Multi-Modal DialogueSpotlight482 citations
- FusionSeg: Learning to Combine Motion and Appearance for Fully Automatic Segmentation of Generic Objects in VideosPoster477 citations
- Learning Spatial Regularization With Image-Level Supervisions for Multi-Label Image ClassificationPoster476 citations
- 3D Shape Segmentation With Projective Convolutional NetworksOral469 citations
- Low-Rank Bilinear Pooling for Fine-Grained ClassificationPoster460 citations
- Modeling Relationships in Referential Expressions With Compositional Modular NetworksSpotlight454 citations
- The More You Know: Using Knowledge Graphs for Image ClassificationSpotlight451 citations
- Annotating Object Instances With a Polygon-RNNOral450 citations
- MDNet: A Semantically and Visually Interpretable Medical Image Diagnosis NetworkOral448 citations
- Dynamic FAUST: Registering Human Bodies in MotionOral445 citations
- End-To-End Instance Segmentation With Recurrent AttentionSpotlight434 citations
- Image Deblurring via Extreme Channels PriorPoster434 citations
- Mimicking Very Efficient Network for Object DetectionPoster434 citations
- Non-Local Color Image Denoising With Convolutional Neural NetworksPoster432 citations
- Spatially Adaptive Computation Time for Residual NetworksPoster431 citations
- Video Captioning With Transferred Semantic AttributesPoster427 citations
- Deep Reinforcement Learning-Based Image Captioning With Embedding RewardOral426 citations
- Recurrent Convolutional Neural Networks for Continuous Sign Language Recognition by Staged OptimizationPoster422 citations
- Deep Matching Prior Network: Toward Tighter Multi-Oriented Text DetectionSpotlight421 citations
- WILDCAT: Weakly Supervised Learning of Deep ConvNets for Image Classification, Pointwise Localization and SegmentationPoster419 citations
- Kernel Pooling for Convolutional Neural NetworksPoster405 citations
- Learning Shape Abstractions by Assembling Volumetric PrimitivesPoster402 citations
- CASENet: Deep Category-Aware Semantic Edge DetectionPoster400 citations
- Learning Detailed Face Reconstruction From a Single ImageOral400 citations
- LCR-Net: Localization-Classification-Regression for Human PoseSpotlight399 citations
- StyleNet: Generating Attractive Visual Captions With StylesPoster397 citations
- Quality Aware Network for Set to Set RecognitionPoster396 citations
- See the Forest for the Trees: Joint Spatial and Temporal Recurrent Neural Networks for Video-Based Person Re-IdentificationPoster395 citations
- More Is Less: A More Complicated Network With Less Inference ComplexityPoster390 citations
- Scalable Person Re-Identification on Supervised Smoothed ManifoldSpotlight390 citations
- Attentional Correlation Filter Network for Adaptive Visual TrackingPoster388 citations
- Deep Feature Interpolation for Image Content ChangesPoster386 citations
- Deep Roots: Improving CNN Efficiency With Hierarchical Filter GroupsPoster383 citations
- Comparative Evaluation of Hand-Crafted and Learned Local FeaturesPoster381 citations
- ArtTrack: Articulated Multi-Person Tracking in the WildOral379 citations
- DeLiGAN : Generative Adversarial Networks for Diverse and Limited DataPoster377 citations
- Accurate Single Stage Detector Using Recurrent Rolling ConvolutionPoster374 citations
- Deep Visual-Semantic Quantization for Efficient Image RetrievalPoster372 citations
- Weakly Supervised Cascaded Convolutional NetworksPoster370 citations
- DeshadowNet: A Multi-Context Embedding Deep Network for Shadow RemovalSpotlight367 citations
- Deep Metric Learning via Facility LocationSpotlight365 citations
- What Can Help Pedestrian Detection?Poster363 citations
- Are You Smarter Than a Sixth Grader? Textbook Question Answering for Multimodal Machine ComprehensionSpotlight360 citations
- WSISA: Making Survival Prediction From Whole Slide Histopathological ImagesPoster360 citations
- 3D Convolutional Neural Networks for Efficient and Robust Hand Pose Estimation From Single Depth ImagesPoster356 citations
- Not All Pixels Are Equal: Difficulty-Aware Semantic Segmentation via Deep Layer CascadeSpotlight353 citations
- Local Binary Convolutional Neural NetworksSpotlight351 citations
- Deep Learning on Lie Groups for Skeleton-Based Action RecognitionSpotlight350 citations
- Transformation-Grounded Image Generation Network for Novel 3D View SynthesisPoster346 citations
- Detailed, Accurate, Human Shape Estimation From Clothed 3D Scan SequencesSpotlight344 citations
- Diversified Texture Synthesis With Feed-Forward NetworksSpotlight341 citations
- Deep Image HarmonizationPoster340 citations
- Neural Face Editing With Intrinsic Image DisentanglingOral340 citations
- Instance-Level Salient Object SegmentationSpotlight339 citations
- Oriented Response NetworksPoster337 citations
- Re-Sign: Re-Aligned End-To-End Sequence Modelling With Deep Recurrent CNN-HMMsOral336 citations
- Weighted-Entropy-Based Quantization for Deep Neural NetworksPoster336 citations
- FC4: Fully Convolutional Color Constancy With Confidence-Weighted PoolingOral335 citations
- Deep TEN: Texture Encoding NetworkPoster331 citations
- Learning Motion Patterns in VideosPoster330 citations
- BigHand2.2M Benchmark: Hand Pose Dataset and State of the Art AnalysisPoster329 citations
- Physically-Based Rendering for Indoor Scene Understanding Using Convolutional Neural NetworksPoster329 citations
- PolyNet: A Pursuit of Structural Diversity in Very Deep NetworksPoster329 citations
- SGM-Nets: Semi-Global Matching With Neural NetworksPoster328 citations
- Using Ranking-CNN for Age EstimationPoster327 citations
- Hyperspectral Image Super-Resolution via Non-Local Sparse Tensor FactorizationPoster326 citations
- VidLoc: A Deep Spatio-Temporal Model for 6-DoF Video-Clip RelocalizationPoster325 citations
- Exclusivity-Consistency Regularized Multi-View Subspace ClusteringSpotlight324 citations
- InstanceCut: From Edges to Instances With MultiCutPoster324 citations
- Learning Residual Images for Face Attribute ManipulationSpotlight323 citations
- Learning to Extract Semantic Structure From Documents Using Multimodal Fully Convolutional Neural NetworksSpotlight320 citations
- Multi-Object Tracking With Quadruplet Convolutional Neural NetworksPoster320 citations
- Deep Learning Human Mind for Automated Visual ClassificationOral319 citations
- Deep Sketch Hashing: Fast Free-Hand Sketch-Based Image RetrievalSpotlight319 citations
- A Joint Speaker-Listener-Reinforcer Model for Referring ExpressionsSpotlight317 citations
- Deep Temporal Linear Encoding NetworksPoster317 citations
- Deep Learning of Human Visual Sensitivity in Image Quality Assessment FrameworkPoster315 citations
- Deep Variation-Structured Reinforcement Learning for Visual Relationship and Attribute DetectionSpotlight315 citations
- Learning Random-Walk Label Propagation for Weakly-Supervised Semantic SegmentationPoster315 citations
- ViP-CNN: Visual Phrase Guided Convolutional Neural NetworkPoster314 citations
- Spatiotemporal Pyramid Network for Video Action RecognitionPoster312 citations
- End-To-End 3D Face Reconstruction With Deep Neural NetworksPoster311 citations
- Pixelwise Instance Segmentation With a Dynamically Instantiated NetworkPoster311 citations
- A Deep Regression Architecture With Two-Stage Re-Initialization for High Performance Facial Landmark DetectionPoster308 citations
- Discovering Causal Signals in ImagesSpotlight302 citations
- PoseTrack: Joint Multi-Person Pose Estimation and TrackingPoster301 citations
- Video Propagation NetworksPoster298 citations
- 3D Point Cloud Registration for Localization Using a Deep Neural Network Auto-EncoderOral297 citations
- Borrowing Treasures From the Wealthy: Deep Transfer Learning Through Selective Joint Fine-TuningSpotlight297 citations
- From Red Wine to Red Tomato: Composition With ContextOral297 citations
- Social Scene Understanding: End-To-End Multi-Person Action Localization and Collective Activity RecognitionOral296 citations
- Event-Based Visual Inertial OdometryPoster294 citations
- Real-Time Neural Style Transfer for VideosPoster287 citations
- Gated Feedback Refinement Network for Dense Image LabelingPoster286 citations
- Improving Pairwise Ranking for Multi-Label Image ClassificationPoster282 citations
- Joint Multi-Person Pose Estimation and Semantic Part SegmentationPoster282 citations
- Predicting Ground-Level Scene Layout From Aerial ImageryPoster282 citations
- Accurate Optical Flow via Direct Cost Volume ProcessingPoster280 citations
- Instance-Aware Image and Sentence Matching With Selective Multimodal LSTMPoster279 citations
- Learned Contextual Feature Reweighting for Image Geo-LocalizationSpotlight276 citations
- Multi-Level Attention Networks for Visual Question AnsweringPoster275 citations
- Deep Network Flow for Multi-Object TrackingPoster273 citations
- Emotion Recognition in ContextPoster273 citations
- End-To-End Concept Word Detection for Video Captioning, Retrieval, and Question AnsweringSpotlight273 citations
- Locality-Sensitive Deconvolution Networks With Gated Fusion for RGB-D Indoor Semantic SegmentationPoster273 citations
- Deep Outdoor Illumination EstimationOral272 citations
- Weakly Supervised Action Learning With RNN Based Fine-To-Coarse ModelingOral264 citations
- Feedback NetworksPoster263 citations
- IM2CADSpotlight263 citations
- Learning Diverse Image ColorizationPoster262 citations
- Missing Modalities Imputation via Cascaded Residual AutoencoderPoster262 citations
- A-Lamp: Adaptive Layout-Aware Multi-Patch Deep Convolutional Neural Network for Photo Aesthetic AssessmentPoster260 citations
- Improved Stereo Matching With Constant Highway Networks and Reflective Confidence LearningPoster259 citations
- Are Large-Scale 3D Models Really Necessary for Accurate Visual Localization?Poster257 citations
- Learning Cross-Modal Deep Representations for Robust Pedestrian DetectionPoster257 citations
- Level Playing Field for Million Scale Face RecognitionSpotlight256 citations
- Synthesizing 3D Shapes via Modeling Multi-View Depth Maps and Silhouettes With Deep Generative NetworksPoster256 citations
- Cross-Modality Binary Code Learning via Fusion Similarity HashingPoster255 citations
- Object Detection in Videos With Tubelet Proposal NetworksPoster255 citations
- Light Field Reconstruction Using Deep Convolutional Network on EPIPoster254 citations
- Unsupervised Learning of Long-Term Motion Dynamics for VideosPoster254 citations
- Simultaneous Super-Resolution and Cross-Modality Synthesis of 3D Medical Images Using Weakly-Supervised Joint Convolutional Sparse CodingPoster251 citations
- Attention-Aware Face Hallucination via Deep Reinforcement LearningPoster249 citations
- Deep Self-Taught Learning for Weakly Supervised Object LocalizationSpotlight249 citations
- Harvesting Multiple Views for Marker-Less 3D Human Pose AnnotationsSpotlight248 citations
- Hierarchical Boundary-Aware Neural Encoder for Video CaptioningPoster248 citations
- Fast Fourier Color ConstancyPoster244 citations
- DenseReg: Fully Convolutional Dense Shape Regression In-The-WildPoster239 citations
- Deep Level Sets for Salient Object DetectionPoster238 citations
- Exploiting Saliency for Object Segmentation From Image Level LabelsPoster236 citations
- Fast Haze Removal for Nighttime Image Using Maximum Reflectance PriorPoster234 citations
- All You Need Is Beyond a Good Init: Exploring Better Solution for Training Extremely Deep Convolutional Neural Networks With Orthonormality and ModulationPoster233 citations
- Cross-View Image Matching for Geo-Localization in Urban EnvironmentsPoster233 citations
- Efficient Diffusion on Region Manifolds: Recovering Small Objects With Compact CNN RepresentationsPoster233 citations
- POSEidon: Face-From-Depth for Driver Pose EstimationSpotlight231 citations
- Quad-Networks: Unsupervised Learning to Rank for Interest Point DetectionPoster230 citations
- Attend to You: Personalized Image Captioning With Context Sequence Memory NetworksSpotlight228 citations
- CERN: Confidence-Energy Recurrent Network for Group Activity RecognitionPoster228 citations
- Captioning Images With Diverse ObjectsOral226 citations
- Joint Sequence Learning and Cross-Modality Convolution for 3D Biomedical SegmentationPoster226 citations
- Learning Non-Lambertian Object Intrinsics Across ShapeNet CategoriesPoster225 citations
- Active Convolution: Learning the Shape of Convolution for Image ClassificationPoster224 citations
- What Is the Space of Attenuation Coefficients in Underwater Computer Vision?Poster221 citations
- Designing Effective Inter-Pixel Information Flow for Natural Image MattingSpotlight220 citations
- Hyper-Laplacian Regularized Unidirectional Low-Rank Tensor Recovery for Multispectral Image DenoisingPoster220 citations
- Automatic Understanding of Image and Video AdvertisementsSpotlight219 citations
- Fine-Grained Image Classification via Combining Vision and LanguagePoster217 citations
- Multimodal Transfer: A Hierarchical Deep Convolutional Neural Network for Fast Artistic Style TransferPoster217 citations
- Dense Captioning With Joint Inference and Visual ContextPoster215 citations
- Forecasting Interactive Dynamics of Pedestrians With Fictitious PlayPoster215 citations
- Learning Fully Convolutional Networks for Iterative Non-Blind DeconvolutionPoster215 citations
- 3D Face Morphable Models "In-The-Wild"Spotlight213 citations
- Generating the Future With Adversarial TransformersPoster213 citations
- SurfNet: Generating 3D Shape Surfaces Using Deep Residual NetworksPoster213 citations
- Asynchronous Temporal Fields for Action RecognitionPoster212 citations
- Semantic Amodal SegmentationPoster212 citations
- KillingFusion: Non-Rigid 3D Reconstruction Without CorrespondencesSpotlight210 citations
- Linking Image and Text With 2-Way NetsPoster208 citations
- Action Unit Detection With Region Adaptation, Multi-Labeling Learning and Optimal Temporal FusingPoster207 citations
- Tracking by Natural Language SpecificationPoster206 citations
- Counting Everyday Objects in Everyday ScenesSpotlight205 citations
- Growing a Brain: Fine-Tuning by Increasing Model CapacityPoster203 citations
- AdaScan: Adaptive Scan Pooling in Deep Convolutional Neural Networks for Human Action Recognition in VideosPoster201 citations
- Conditional Similarity NetworksPoster199 citations
- Video Desnowing and Deraining Based on Matrix DecompositionPoster199 citations
- BranchOut: Regularization for Online Ensemble Tracking With Convolutional Neural NetworksPoster195 citations
- Detect, Replace, Refine: Deep Structured Prediction for Pixel Wise LabelingPoster195 citations
- A Novel Tensor-Based Video Rain Streaks Removal Approach via Utilizing Discriminatively Intrinsic PriorsPoster194 citations
- Deep Sequential Context Networks for Action PredictionPoster192 citations
- Point to Set Similarity Based Deep Feature Learning for Person Re-IdentificationPoster191 citations
- Understanding Traffic Density From Large-Scale Web Camera DataPoster191 citations
- Weakly Supervised Semantic Segmentation Using Web-Crawled VideosSpotlight191 citations
- Synthesizing Normalized Faces From Facial Identity FeaturesSpotlight190 citations
- Creativity: Generating Diverse Questions Using Variational AutoencodersSpotlight189 citations
- HSfM: Hybrid Structure-from-MotionSpotlight188 citations
- An Efficient Algebraic Solution to the Perspective-Three-Point ProblemPoster187 citations
- Comprehension-Guided Referring ExpressionsPoster187 citations
- Zero-Shot Recognition Using Dual Visual-Semantic Mapping PathsPoster187 citations
- Boundary-Aware Instance SegmentationPoster186 citations
- Primary Object Segmentation in Videos Based on Region Augmentation and ReductionPoster186 citations
- Zero-Shot Action Recognition With Error-Correcting Output CodesPoster186 citations
- Inverse Compositional Spatial Transformer NetworksOral185 citations
- Crossing Nets: Combining GANs and VAEs With a Shared Latent Space for Hand Pose EstimationSpotlight184 citations
- Deep Multitask Architecture for Integrated 2D and 3D Human SensingPoster183 citations
- Recurrent Modeling of Interaction Context for Collective Activity RecognitionPoster183 citations
- Incorporating Copying Mechanism in Image Captioning for Learning Novel ObjectsPoster181 citations
- Top-Down Visual Saliency Guided by CaptionsPoster181 citations
- From Zero-Shot Learning to Conventional Supervised Classification: Unseen Visual Data SynthesisPoster180 citations
- Procedural Generation of Videos to Train Deep Action Recognition NetworksPoster180 citations
- Hallucinating Very Low-Resolution Unaligned and Noisy Face Images by Transformative Discriminative AutoencodersSpotlight178 citations
- Improving Interpretability of Deep Neural Networks With Semantic InformationPoster178 citations
- Global Optimality in Neural Network TrainingOral177 citations
- FCSS: Fully Convolutional Self-Similarity for Dense Semantic CorrespondencePoster176 citations
- Scene Flow to Action Map: A New Representation for RGB-D Based Action Recognition With Convolutional Neural NetworksPoster176 citations
- Convolutional Random Walk Networks for Semantic Image SegmentationPoster175 citations
- Context-Aware Captions From Context-Agnostic SupervisionSpotlight174 citations
- Polarimetric Multi-View StereoPoster174 citations
- Temporal Action Localization by Structured Maximal SumsPoster174 citations
- Memory-Augmented Attribute Manipulation Networks for Interactive Fashion SearchPoster173 citations
- Neural Scene De-RenderingPoster173 citations
- End-To-End Training of Hybrid CNN-CRF Models for StereoPoster170 citations
- Noisy Softmax: Improving the Generalization Ability of DCNN via Postponing the Early Softmax SaturationPoster170 citations
- Not Afraid of the Dark: NIR-VIS Face Recognition via Cross-Spectral Hallucination and Low-Rank EmbeddingPoster169 citations
- Semantically Consistent Regularization for Zero-Shot RecognitionPoster167 citations
- Weakly Supervised Dense Video CaptioningPoster165 citations
- Loss Max-Pooling for Semantic Image SegmentationPoster164 citations
- Query-Focused Video Summarization: Dataset, Evaluation, and a Memory Network Based ApproachPoster164 citations
- Spatio-Temporal Naive-Bayes Nearest-Neighbor (ST-NBNN) for Skeleton-Based Action RecognitionPoster164 citations
- Domain Adaptation by Mixture of Alignments of Second- or Higher-Order Scatter TensorsPoster163 citations
- Dynamic Facial Analysis: From Bayesian Filtering to Recurrent Neural NetworkPoster163 citations
- Efficient Solvers for Minimal Problems by Syzygy-Based ReductionSpotlight163 citations
- Sports Field Localization via Deep Structured ModelsPoster163 citations
- Photorealistic Facial Texture Inference Using Deep Neural NetworksSpotlight162 citations
- Single Image Reflection SuppressionPoster162 citations
- Zero-Shot Classification With Discriminative Semantic Representation LearningPoster162 citations
- One-Shot Metric Learning for Person Re-IdentificationPoster160 citations
- Network Sketching: Exploiting Binary Structure in Deep CNNsPoster159 citations
- Thin-Slicing Network: A Deep Structured Model for Pose Estimation in VideosOral159 citations
- Consistent-Aware Deep Learning for Person Re-Identification in a Camera NetworkSpotlight158 citations
- Link the Head to the "Beak": Zero Shot Learning From Noisy Text Description at Part PrecisionPoster158 citations
- Matrix Tri-Factorization With Manifold Regularizations for Zero-Shot LearningPoster158 citations
- Learning Discriminative and Transformation Covariant Local Feature DetectorsPoster157 citations
- Training Object Class Detectors With Click SupervisionSpotlight157 citations
- Global Hypothesis Generation for 6D Object Pose EstimationSpotlight156 citations
- Deep Structured Learning for Facial Action Unit Intensity EstimationPoster155 citations
- Fine-Grained Recognition as HSnet Search for Informative Image PartsOral155 citations
- LCNN: Lookup-Based Convolutional Neural NetworkPoster155 citations
- STD2P: RGBD Semantic Segmentation Using Spatio-Temporal Data-Driven PoolingPoster155 citations
- AGA: Attribute-Guided AugmentationOral154 citations
- Learning by Association -- A Versatile Semi-Supervised Training Method for Neural NetworksPoster153 citations
- A Unified Approach of Multi-Scale Deep and Hand-Crafted Features for Defocus EstimationPoster152 citations
- Weakly-Supervised Visual Grounding of Phrases With Linguistic StructuresPoster152 citations
- CNN-Based Patch Matching for Optical Flow With Thresholded Hinge Embedding LossPoster149 citations
- Connecting Look and Feel: Associating the Visual and Tactile Properties of Physical MaterialsOral149 citations
- Learning an Invariant Hilbert Space for Domain AdaptationPoster149 citations
- Optical Flow in Mostly Rigid ScenesPoster148 citations
- CLKN: Cascaded Lucas-Kanade Networks for Image AlignmentPoster147 citations
- Product Manifold Filter: Non-Rigid Shape Correspondence via Kernel Density Estimation in the Product SpacePoster147 citations
- Scale-Aware Face DetectionPoster147 citations
- Skeleton Key: Image Captioning by Skeleton-Attribute DecompositionPoster147 citations
- Online Video Object Segmentation via Convolutional Trident NetworkPoster145 citations
- Recurrent 3D Pose Sequence MachinesOral145 citations
- Towards a Quality Metric for Dense Light FieldsPoster145 citations
- Forecasting Human Dynamics From Static ImagesPoster144 citations
- Relationship Proposal NetworksPoster144 citations
- Reconstructing Transient Images From Single-Photon SensorsSpotlight143 citations
- Self-Supervised Learning of Visual Features Through Embedding Images Into Text Topic SpacesPoster143 citations
- Template Matching With Deformable Diversity SimilaritySpotlight143 citations
- Deep Crisp BoundariesPoster142 citations
- Gaze Embeddings for Zero-Shot Image ClassificationSpotlight142 citations
- On-The-Fly Adaptation of Regression Forests for Online Camera RelocalisationOral141 citations
- Provable Self-Representation Based Outlier Detection in a Union of SubspacesSpotlight141 citations
- G2DeNet: Global Gaussian Distribution Embedding Network and Its Application to Visual RecognitionOral140 citations
- Spatially-Varying Blur Detection Based on Multiscale Fused and Sorted Transform Coefficients of Gradient MagnitudesPoster140 citations
- Low-Rank Embedded Ensemble Semantic Dictionary for Zero-Shot LearningPoster139 citations
- Position Tracking for Virtual Reality Using Commodity WiFiPoster139 citations
- Deep Multimodal Representation Learning From Temporal DataPoster138 citations
- Combining Bottom-Up, Top-Down, and Smoothness Cues for Weakly Supervised Image SegmentationPoster136 citations
- Semantic Regularisation for Recurrent Image AnnotationPoster136 citations
- A Domain Based Approach to Social Relation RecognitionPoster135 citations
- Enhancing Video Summarization via Vision-Language EmbeddingPoster135 citations
- The Amazing Mysteries of the Gutter: Drawing Inferences Between Panels in Comic Book NarrativesSpotlight132 citations
- Deep Future Gaze: Gaze Anticipation on Egocentric Videos Using Adversarial NetworksOral131 citations
- Joint Graph Decomposition & Node Labeling: Problem, Algorithms, ApplicationsPoster131 citations
- Video Acceleration MagnificationPoster129 citations
- Flexible Spatio-Temporal Networks for Video PredictionPoster127 citations
- Human Shape From Silhouettes Using Generative HKS Descriptors and Cross-Modal Neural NetworksSpotlight127 citations
- A Dataset and Exploration of Models for Understanding Video Data Through Fill-In-The-Blank Question-AnsweringPoster126 citations
- Generalized Semantic Preserving Hashing for N-Label Cross-Modal RetrievalPoster126 citations
- Hard Mixtures of Experts for Large Scale Weakly Supervised VisionPoster126 citations
- Learning Deep Binary Descriptor With Multi-QuantizationPoster124 citations
- Outlier-Robust Tensor PCAPoster122 citations
- Interpretable Structure-Evolving LSTMSpotlight121 citations
- Amodal Detection of 3D Objects: Inferring 3D Bounding Boxes From 2D Ones in RGB-Depth ImagesPoster120 citations
- Dynamic Attention-Controlled Cascaded Shape Regression Exploiting Training Data Augmentation and Fuzzy-Set Sample WeightingPoster120 citations
- SRN: Side-output Residual Network for Object Symmetry Detection in the WildOral120 citations
- Infinite Variational Autoencoder for Semi-Supervised LearningPoster119 citations
- Seeing Invisible Poses: Estimating 3D Body Pose From Egocentric VideoSpotlight117 citations
- Synthesizing Dynamic Patterns by Spatial-Temporal Generative ConvNetPoster117 citations
- Convex Global 3D Registration With Lagrangian DualityPoster116 citations
- DeepPermNet: Visual Permutation LearningPoster115 citations
- Generalized Rank Pooling for Activity RecognitionPoster114 citations
- Generative Attribute Controller With Conditional Filtered Generative Adversarial NetworksPoster114 citations
- Beyond Instance-Level Image Retrieval: Leveraging Captions to Learn a Global Visual Representation for Semantic RetrievalPoster113 citations
- Multi-Attention Network for One Shot LearningPoster112 citations
- Differential Angular Imaging for Material RecognitionPoster111 citations
- Improving Facial Attribute Prediction Using Semantic SegmentationPoster111 citations
- SCC: Semantic Context Cascade for Efficient Action DetectionPoster111 citations
- Simultaneous Facial Landmark Detection, Pose and Deformation Estimation Under Facial OcclusionPoster111 citations
- Deep Supervision With Shape Concepts for Occlusion-Aware 3D Object ParsingPoster110 citations
- Weakly Supervised Affordance DetectionPoster110 citations
- Awesome Typography: Statistics-Based Text Effects TransferPoster108 citations
- Learning Dynamic Guidance for Depth Image EnhancementPoster108 citations
- Video2Shop: Exact Matching Clothes in Videos to Online Shopping ImagesPoster108 citations
- The Geometry of First-Returning Photons for Non-Line-Of-Sight ImagingSpotlight107 citations
- What Is and What Is Not a Salient Object? Learning Salient Object Detector by Ensembling Linear Exemplar RegressorsSpotlight107 citations
- Improving Training of Deep Neural Networks via Singular Value BoundingPoster106 citations
- S3Pool: Pooling With Stochastic Spatial SamplingPoster106 citations
- One-To-Many Network for Visually Pleasing Compression Artifacts ReductionPoster105 citations
- The VQA-Machine: Learning How to Use Existing Vision Algorithms to Answer New QuestionsPoster105 citations
- Attend in Groups: A Weakly-Supervised Deep Learning Framework for Learning From Web DataPoster103 citations
- Collaborative Deep Reinforcement Learning for Joint Object SearchPoster103 citations
- Multigrid Neural ArchitecturesPoster103 citations
- Temporal Attention-Gated Model for Robust Sequence ClassificationPoster103 citations
- Learning and Refining of Privileged Information-Based RNNs for Action Recognition From Depth SequencesPoster102 citations
- Transition Forests: Learning Discriminative Temporal Transitions for Action Recognition and DetectionPoster102 citations
- Webly Supervised Semantic SegmentationPoster102 citations
- Binge Watching: Scaling Affordance Learning From SitcomsSpotlight101 citations
- Deep View MorphingPoster101 citations
- Bidirectional Multirate Reconstruction for Temporal Modeling in VideosSpotlight100 citations
- MCMLSD: A Dynamic Programming Approach to Line Segment DetectionPoster99 citations
- Robust Visual Tracking Using Oblique Random ForestsPoster99 citations
- Generalized Deep Image to Image RegressionSpotlight98 citations
- Superpixel-Based Tracking-By-Segmentation Using Markov ChainsPoster98 citations
- Temporal Residual Networks for Dynamic Scene RecognitionPoster98 citations
- Collaborative Summarization of Topic-Related VideosPoster97 citations
- Slow Flow: Exploiting High-Speed Cameras for Accurate and Diverse Optical Flow Reference DataOral97 citations
- Multi-Scale FCN With Cascaded Instance Aware Segmentation for Arbitrary Oriented Word Spotting in the WildPoster96 citations
- FASON: First and Second Order Information Fusion Network for Texture RecognitionPoster95 citations
- Fast Person Re-Identification via Cross-Camera Semantic Binary TransformationPoster94 citations
- Robust Interpolation of Correspondences for Large Displacement Optical FlowPoster94 citations
- Joint Intensity and Spatial Metric Learning for Robust Gait RecognitionPoster92 citations
- Deep Semantic Feature MatchingPoster91 citations
- Learning Barycentric Representations of 3D Shapes for Sketch-Based 3D Shape RetrievalPoster91 citations
- Reflection Removal Using Low-Rank Matrix CompletionPoster91 citations
- Supervising Neural Attention Models for Video Captioning by Human Gaze DataPoster91 citations
- Fast Video Classification via Adaptive Cascading of Deep ModelsSpotlight90 citations
- Agent-Centric Risk Assessment: Accident Anticipation and Risky Region LocalizationSpotlight89 citations
- Fine-Grained Recognition of Thousands of Object Categories With Single-Example TrainingPoster89 citations
- Fine-To-Coarse Global Registration of RGB-D ScansPoster89 citations
- Jointly Learning Energy Expenditures and Activities Using Egocentric Multimodal SignalsPoster88 citations
- MIML-FCN+: Multi-Instance Multi-Label Learning via Fully Convolutional Networks With Privileged InformationPoster87 citations
- On the Global Geometry of Sphere-Constrained Sparse Blind DeconvolutionOral87 citations
- Physics Inspired Optimization on Semantic Transfer Features: An Alternative Method for Room Layout EstimationPoster87 citations
- UltraStereo: Efficient Learning-Based Matching for Active Stereo SystemsSpotlight85 citations
- Unrolling the Shutter: CNN to Correct Motion DistortionsOral85 citations
- Task-Driven Dynamic Fusion: Reducing Ambiguity in Video DescriptionPoster84 citations
- Teaching Compositionality to CNNsPoster83 citations
- Deep Quantization: Encoding Convolutional Activations With Deep Generative ModelPoster82 citations
- A Non-Local Low-Rank Framework for Ultrasound Speckle ReductionPoster81 citations
- Reflectance Adaptive Filtering Improves Intrinsic Image EstimationPoster81 citations
- Order-Preserving Wasserstein Distance for Sequence MatchingPoster79 citations
- Semantic Segmentation via Structured Patch Prediction, Context CRF and Guidance CRFPoster79 citations
- Budget-Aware Deep Semantic Video SegmentationPoster78 citations
- Shading Annotations in the WildPoster78 citations
- Identifying First-Person Camera Wearers in Third-Person VideosPoster77 citations
- Generating Descriptions With Grounded and Co-Referenced PeoplePoster76 citations
- CATS: A Color and Thermal Stereo BenchmarkSpotlight75 citations
- Few-Shot Object Recognition From Machine-Labeled Web ImagesSpotlight74 citations
- Learning Adaptive Receptive Fields for Deep Image Parsing NetworkPoster74 citations
- NID-SLAM: Robust Monocular SLAM Using Normalised Information DistancePoster74 citations
- Using Locally Corresponding CAD Models for Dense 3D Reconstructions From a Single ImagePoster74 citations
- A Dataset for Benchmarking Image-Based LocalizationPoster73 citations
- A Non-Convex Variational Approach to Photometric Stereo Under Inaccurate LightingPoster73 citations
- Simultaneous Stereo Video Deblurring and Scene Flow EstimationPoster73 citations
- Surveillance Video Parsing With Single Frame SupervisionPoster73 citations
- On the Effectiveness of Visible WatermarksPoster72 citations
- 4D Light Field Superpixel and SegmentationPoster71 citations
- A Compact DNN: Approaching GoogLeNet-Level Accuracy of Classification and Domain AdaptationPoster71 citations
- A General Framework for Curve and Surface Comparison and Registration With Oriented VarifoldsPoster71 citations
- AnchorNet: A Weakly Supervised Network to Learn Geometry-Sensitive Features for Semantic MatchingPoster71 citations
- Co-Occurrence FilterPoster71 citations
- Spatio-Temporal Vector of Locally Max Pooled Features for Action Recognition in VideosPoster70 citations
- Accurate Depth and Normal Maps From Occlusion-Aware Focal Stack SymmetryPoster69 citations
- Deep Mixture of Linear Inverse Regressions Applied to Head-Pose EstimationPoster69 citations
- Light Field Blind Motion DeblurringOral69 citations
- Visual-Inertial-Semantic Scene Representation for 3D Object DetectionPoster69 citations
- A Reinforcement Learning Approach to the View Planning ProblemPoster68 citations
- A Study of Lagrangean Decompositions and Dual Ascent Solvers for Graph MatchingPoster68 citations
- Factorized Variational Autoencoders for Modeling Audience Reactions to MoviesPoster68 citations
- Interspecies Knowledge Transfer for Facial Keypoint DetectionPoster68 citations
- Multiple-Scattering Microphysics TomographyPoster68 citations
- Snapshot Hyperspectral Light Field ImagingPoster68 citations
- Subspace Clustering via Variance Regularized Ridge RegressionPoster68 citations
- Unsupervised Visual-Linguistic Reference Resolution in Instructional VideosPoster66 citations
- A Clever Elimination Strategy for Efficient Minimal SolversPoster65 citations
- Expecting the Unexpected: Training Detectors for Unusual Pedestrians With Adversarial ImpostersPoster65 citations
- InterpoNet, a Brain Inspired Neural Network for Optical Flow Dense InterpolationPoster65 citations
- DeepNav: Learning to Navigate Large CitiesPoster64 citations
- Predictive-Corrective Networks for Action DetectionPoster64 citations
- Straight to Shapes: Real-Time Detection of Encoded ShapesPoster63 citations
- Predicting Behaviors of Basketball Players From First Person VideosSpotlight62 citations
- Direct Photometric Alignment by Mesh DeformationPoster61 citations
- Discriminative Bimodal Networks for Visual Localization and Detection With Natural Language QueriesSpotlight61 citations
- Incremental Kernel Null Space Discriminant Analysis for Novelty DetectionPoster61 citations
- SPFTN: A Self-Paced Fine-Tuning Network for Segmenting Objects in Weakly Labelled VideosPoster61 citations
- Depth From Defocus in the WildPoster60 citations
- Joint Gap Detection and Inpainting of Line DrawingsPoster60 citations
- LSTM Self-Supervision for Detailed Behavior AnalysisPoster60 citations
- Online Summarization via Submodular and Convex OptimizationPoster60 citations
- PoseAgent: Budget-Constrained 6D Object Pose Estimation via Reinforcement LearningPoster60 citations
- Learning to Predict Stereo Reliability Enforcing Local Consistency of Confidence MapsPoster59 citations
- Discretely Coding Semantic Rank Orders for Supervised Image HashingPoster58 citations
- Face Normals "In-The-Wild" Using Fully Convolutional NetworksPoster58 citations
- Lean Crowdsourcing: Combining Humans and Machines in an Online SystemPoster58 citations
- Learning Object Interactions and Descriptions for Semantic Image SegmentationPoster58 citations
- A Wide-Field-Of-View Monocentric Light Field CameraPoster57 citations
- Adaptive Relaxed ADMM: Convergence Theory and Practical ImplementationPoster57 citations
- Computational Imaging on the Electric GridOral57 citations
- Object Co-Skeletonization With Co-SegmentationPoster57 citations
- Seeing What Is Not There: Learning Context to Determine Where Objects Are MissingSpotlight57 citations
- Simultaneous Visual Data Completion and Denoising Based on Tensor Rank and Total Variation Minimization and Its Primal-Dual Splitting AlgorithmPoster57 citations
- Bidirectional Beam Search: Forward-Backward Inference in Neural Sequence Models for Fill-In-The-Blank Image CaptioningPoster56 citations
- Knowledge Acquisition for Visual Question Answering via Iterative QueryingPoster55 citations
- Semantic Multi-View Stereo: Jointly Estimating Objects and VoxelsPoster55 citations
- Weakly Supervised Actor-Action Segmentation via Robust Multi-Task RankingPoster55 citations
- Exploiting 2D Floorplan for Building-Scale Panorama RGBD AlignmentPoster54 citations
- Fast Multi-Frame Stereo Scene Flow With Motion SegmentationPoster54 citations
- Fast-At: Fast Automatic Thumbnail Generation Using Deep Neural NetworksPoster54 citations
- Deep Co-Occurrence Feature Learning for Visual Object RecognitionPoster53 citations
- Efficient Global Point Cloud Alignment Using Bayesian Nonparametric MixturesSpotlight53 citations
- Semantically Coherent Co-Segmentation and Reconstruction of Dynamic ScenesPoster53 citations
- Semi-Calibrated Near Field Photometric StereoPoster53 citations
- A Minimal Solution for Two-View Focal-Length Estimation Using Two Affine CorrespondencesPoster52 citations
- Fixed-Point Factorized NetworksPoster52 citations
- Geodesic Distance DescriptorsPoster52 citations
- Spatial-Semantic Image Search by Visual Feature SynthesisSpotlight52 citations
- Commonly Uncommon: Semantic Sparsity in Situation RecognitionPoster51 citations
- Image Splicing Detection via Camera Response Function AnalysisPoster51 citations
- Noise-Blind Image DeblurringPoster51 citations
- Real-Time 3D Model Tracking in Color and Depth on a Single CPU CorePoster51 citations
- The World of Fast Moving ObjectsPoster51 citations
- AMVH: Asymmetric Multi-Valued HashingPoster50 citations
- Zero Shot Learning via Multi-Scale Manifold RegularizationPoster50 citations
- AMC: Attention guided Multi-modal Correlation Learning for Image SearchPoster49 citations
- Discriminative Covariance Oriented Representation Learning for Face Recognition With Image SetsPoster49 citations
- Exploiting Symmetry and/or Manhattan Properties for 3D Object Structure Estimation From Single and Multiple ImagesPoster49 citations
- Learning Deep Match Kernels for Image-Set ClassificationPoster49 citations
- Specular Highlight Removal in Facial ImagesPoster49 citations
- Unsupervised Vanishing Point Detection and Camera Calibration From a Single Manhattan Image With Radial DistortionPoster49 citations
- Alternating Direction Graph MatchingPoster48 citations
- Joint Registration and Representation Learning for Unconstrained Face IdentificationPoster48 citations
- Online Asymmetric Similarity Learning for Cross-Modal RetrievalPoster48 citations
- Stereo-Based 3D Reconstruction of Dynamic Fluid Surfaces by Global OptimizationPoster48 citations
- Unsupervised Adaptive Re-Identification in Open World Dynamic Camera NetworksSpotlight48 citations
- Noise Robust Depth From Focus Using a Ring Difference FilterSpotlight47 citations
- BRISKS: Binary Features for Spherical Images on a Geodesic GridPoster46 citations
- Hierarchical Multimodal Metric Learning for Multimodal ClassificationPoster46 citations
- Object-Aware Dense Semantic CorrespondencePoster46 citations
- Flight Dynamics-Based Recovery of a UAV Trajectory Using Ground CamerasOral45 citations
- Predicting Salient Face in Multiple-Face VideosPoster45 citations
- Variational Bayesian Multiple Instance Learning With Gaussian ProcessesPoster45 citations
- Deep Affordance-Grounded Sensorimotor Object RecognitionSpotlight44 citations
- Material Classification Using Frequency- and Depth-Dependent Time-Of-Flight DistortionPoster44 citations
- Saliency Revisited: Analysis of Mouse Movements Versus FixationsPoster44 citations
- On the Two-View Geometry of Unsynchronized CamerasPoster43 citations
- Revisiting the Variable Projection Method for Separable Nonlinear Least Squares ProblemsPoster43 citations
- Consensus Maximization With Linear Matrix Inequality ConstraintsPoster42 citations
- Discriminative Optimization: Theory and Applications to Point Cloud RegistrationPoster42 citations
- IRINA: Iris Recognition (Even) in Inaccurately Segmented DataPoster42 citations
- Polyhedral Conic Classifiers for Visual Object Detection and ClassificationPoster42 citations
- Toroidal Constraints for Two-Point Localization Under High Outlier RatiosPoster42 citations
- An Exact Penalty Method for Locally Convergent Maximum ConsensusPoster41 citations
- Asymmetric Feature Maps With Application to Sketch Based RetrievalPoster41 citations
- Learning Multifunctional Binary Codes for Both Category and Attribute Oriented Retrieval TasksPoster41 citations
- Self-Learning Scene-Specific Pedestrian Detectors Using a Progressive Latent ModelPoster41 citations
- A Message Passing Algorithm for the Minimum Cost Multicut ProblemPoster40 citations
- FastMask: Segment Multi-Scale Object Candidates in One ShotSpotlight40 citations
- Learning to Align Semantic Segmentation and 2.5D Maps for GeolocalizationPoster40 citations
- Pose-Aware Person RecognitionPoster40 citations
- Simultaneous Feature Aggregating and Hashing for Large-Scale Image SearchPoster40 citations
- Indoor Scene Parsing With Instance Segmentation, Semantic Labeling and Support Relationship InferencePoster39 citations
- Automatic Discovery, Association Estimation and Learning of Semantic Attributes for a Thousand CategoriesPoster38 citations
- Building a Regular Decision Boundary With Deep NetworksPoster38 citations
- Distinguishing the Indistinguishable: Exploring Structural Ambiguities via Geodesic ContextSpotlight38 citations
- A Graph Regularized Deep Neural Network for Unsupervised Image Representation LearningPoster37 citations
- DUST: Dual Union of Spatio-Temporal Subspaces for Monocular Multiple Object 3D ReconstructionPoster37 citations
- Deeply Aggregated Alternating Minimization for Image RestorationSpotlight37 citations
- Diverse Image AnnotationPoster37 citations
- Joint Discriminative Bayesian Dictionary and Classifier LearningPoster37 citations
- Scalable Surface Reconstruction From Point Clouds With Extreme Scale and Density DiversityPoster37 citations
- Unambiguous Text Localization and Retrieval for Cluttered ScenesSpotlight37 citations
- Analyzing Computer Vision Data - The Good, the Bad and the UglyPoster36 citations
- Anti-Glare: Tightly Constrained Optimization for Eyeglass Reflection RemovalPoster36 citations
- Can Walking and Measuring Along Chord Bunches Better Describe Leaf Shapes?Poster36 citations
- Learning to Learn From Noisy Web VideosPoster36 citations
- Modeling Sub-Event Dynamics in First-Person Action RecognitionPoster36 citations
- Multi-Task Clustering of Human Actions by Sharing InformationPoster36 citations
- Self-Calibration-Based Approach to Critical Motion Sequences of Rolling-Shutter Structure From MotionPoster36 citations
- Variational Autoencoded Regression: High Dimensional Regression of Visual Data on Complex ManifoldPoster36 citations
- A Dual Ascent Framework for Lagrangean Decomposition of Combinatorial ProblemsPoster35 citations
- Fried Binary Embedding for High-Dimensional Visual FeaturesPoster35 citations
- From Local to Global: Edge Profiles to Camera Motion in Blurred ImagesPoster35 citations
- Generating Holistic 3D Scene Abstractions for Text-Based Image RetrievalPoster35 citations
- Binary Coding for Partial Action Analysis With Limited Observation RatiosPoster34 citations
- Deep Unsupervised Similarity Learning Using Partially Ordered SetsPoster34 citations
- Grassmannian Manifold Optimization Assisted Sparse Spectral ClusteringPoster34 citations
- Low-Rank-Sparse Subspace Representation for Robust RegressionPoster34 citations
- Non-Uniform Subset Selection for Active Learning in Structured DataPoster34 citations
- Personalizing Gesture Recognition Using Hierarchical Bayesian Neural NetworksPoster34 citations
- Riemannian Nonlinear Mixed Effects Models: Analyzing Longitudinal Deformations in NeuroimagingPoster34 citations
- Adversarially Tuned Scene GenerationSpotlight33 citations
- An Empirical Evaluation of Visual Question Answering for Novel ObjectsPoster33 citations
- Correlational Gaussian Processes for Cross-Domain Visual RecognitionPoster32 citations
- Nonnegative Matrix Underapproximation for Robust Multiple Model FittingPoster32 citations
- Sequential Person Recognition in Photo Albums With a Recurrent NetworkPoster32 citations
- A New Rank Constraint on Multi-View Fundamental Matrices, and Its Application to Camera Location RecoverySpotlight31 citations
- Mining Object Parts From CNNs via Active Question-AnsweringPoster31 citations
- Multi-Way Multi-Level Kernel Modeling for Neuroimaging ClassificationPoster31 citations
- Revisiting Metric Learning for SPD Matrix Based Visual RepresentationPoster30 citations
- Soft-Margin Mixture of RegressionsPoster30 citations
- Attentional Push: A Deep Convolutional Network for Augmenting Image Salience With Shared Attention Modeling in Social ScenesSpotlight29 citations
- Deep 360 Pilot: Learning a Deep Agent for Piloting Through 360deg Sports VideosOral29 citations
- S2F: Slow-To-Fast Interpolator FlowPoster29 citations
- Temporal Action Co-Segmentation in 3D Motion Capture Data and VideosPoster29 citations
- Binary Constraint Preserving Graph MatchingPoster28 citations
- ER3: A Unified Framework for Event Retrieval, Recognition and RecountingPoster28 citations
- Fast Boosting Based Detection Using Scale Invariant Multimodal Multiresolution Filtered FeaturesPoster28 citations
- Fractal Dimension Invariant Filtering and Its CNN-Based ImplementationPoster27 citations
- Why You Should Forget Luminance Conversion and Do Something BetterPoster27 citations
- BIND: Binary Integrated Net Descriptors for Texture-Less Object RecognitionPoster26 citations
- Learning Detection With Diverse ProposalsPoster26 citations
- Discover and Learn New Objects From DocumentariesSpotlight25 citations
- Learning the Multilinear Structure of Visual DataPoster25 citations
- MuCaLe-Net: Multi Categorical-Level Networks to Generate More Discriminating FeaturesPoster25 citations
- One-Shot Hyperspectral Imaging Using Faced ReflectorsPoster25 citations
- Viraliency: Pooling Local ViralityPoster25 citations
- Improving RANSAC-Based Segmentation Through CNN EncapsulationPoster24 citations
- Learning Category-Specific 3D Shape Models From Weakly Labeled 2D ImagesPoster24 citations
- Probabilistic Temporal Subspace ClusteringSpotlight24 citations
- Unsupervised Part Learning for Visual RecognitionPoster24 citations
- Robust Joint and Individual Variance ExplainedPoster23 citations
- Simultaneous Geometric and Radiometric Calibration of a Projector-Camera PairPoster23 citations
- A Generative Model for Depth-Based Robust 3D Facial Pose TrackingPoster22 citations
- Minimum Delay Moving Object DetectionPoster22 citations
- Contour-Constrained Superpixels for Image and Video ProcessingPoster21 citations
- Efficient Linear Programming for Dense CRFsPoster21 citations
- Acquiring Axially-Symmetric Transparent Objects Using Single-View Transmission ImagingPoster20 citations
- Adaptive Class Preserving Representation for Image ClassificationPoster20 citations
- Intrinsic Grassmann Averages for Online Linear and Robust Subspace LearningPoster20 citations
- Wetness and Color From a Single Multispectral ImageOral20 citations
- A Combinatorial Solution to Non-Rigid 3D Shape-To-Image MatchingPoster19 citations
- Unified Embedding and Metric Learning for Zero-Exemplar Event DetectionPoster19 citations
- What's in a Question: Using Visual Questions as a Form of SupervisionSpotlight19 citations
- Efficient Multiple Instance Metric Learning Using Weakly Supervised DataPoster18 citations
- Spatio-Temporal Self-Organizing Map Deep Network for Dynamic Object Detection From VideosPoster18 citations
- Bayesian Supervised HashingSpotlight17 citations
- Elastic Shape-From-Template With Spatially Sparse Deforming ForcesSpotlight17 citations
- Episodic CAMN: Contextual Attention-Based Memory Networks With Iterative Feedback for Scene LabelingPoster17 citations
- Optical Flow Requires Multiple Strategies (but Only One Network)Poster17 citations
- Robust Energy Minimization for BRDF-Invariant Shape From Light FieldsPoster17 citations
- Dynamic Time-Of-FlightSpotlight16 citations
- HOPE: Hierarchical Object Prototype Encoding for Efficient Object Instance Search in VideosPoster16 citations
- Learning to Rank Retargeted ImagesPoster16 citations
- Video Segmentation via Multiple Granularity AnalysisPoster16 citations
- Group-Wise Point-Set Registration Based on Renyi's Second Order EntropySpotlight15 citations
- Making 360deg Video Watchable in 2D: Learning Videography for Click Free ViewingSpotlight15 citations
- Parametric T-Spline Face Morphable Model for Detailed Fitting in Shape SubspaceSpotlight14 citations
- Parsing Images of Overlapping Organisms With Deep Singling-Out NetworksPoster14 citations
- Surface Motion Capture Transfer With Gaussian Process RegressionPoster14 citations
- The Incremental Multiresolution Matrix Factorization AlgorithmPoster14 citations
- Efficient Optimization for Hierarchically-structured Interacting Segments (HINTS)Poster13 citations
- Kernel Square-Loss Exemplar Machines for Image RetrievalPoster13 citations
- Illuminant-Camera Communication to Observe Moving Objects Under Strong External Light by Spread Spectrum ModulationSpotlight12 citations
- Product Split TreesPoster12 citations
- Radiometric Calibration From Faces in ImagesPoster12 citations
- Compact Matrix Factorization With Dependent SubspacesOral11 citations
- Detangling People: Individuating Multiple Close People and Their Body Parts via Region AssemblyOral11 citations
- FFTLasso: Large-Scale LASSO in the Fourier DomainOral11 citations
- Hardware-Efficient Guided Image Filtering for Multi-Label ProblemPoster11 citations
- The Surfacing of Multiview 3D Drawings via Lofting and Occlusion ReasoningPoster11 citations
- Binarized Mode Seeking for Scalable Visual Pattern DiscoveryPoster10 citations
- Coarse-To-Fine Segmentation With Shape-Tailored Continuum Scale SpacesPoster10 citations
- Fast 3D Reconstruction of Faces With GlassesPoster10 citations
- General Models for Rational Cameras and the Case of Two-Slit ProjectionsPoster10 citations
- Model-Based Iterative Restoration for Binary Document Image Compression With Dictionary LearningPoster10 citations
- Template-Based Monocular 3D Recovery of Elastic Shapes Using Lagrangian MultipliersPoster10 citations
- The Impact of Typicality for Informative Representative SelectionPoster10 citations
- Unsupervised Semantic Scene Labeling for Streaming DataPoster10 citations
- Hidden Layers in Perceptual LearningSpotlight9 citations
- The Misty Three Point Algorithm for Relative PosePoster9 citations
- A Linear Extrinsic Calibration of Kaleidoscopic Imaging System From Single 3D PointPoster8 citations
- Additive Component AnalysisPoster8 citations
- Seeing Into Darkness: Scotopic Visual RecognitionPoster8 citations
- A Practical Method for Fully Automatic Intrinsic Camera Calibration Using Directionally Encoded LightSpotlight7 citations
- An Efficient Background Term for 3D Reconstruction and Tracking With Smooth Surface ModelsPoster7 citations
- Non-Contact Full Field Vibration Measurement Based on Phase-ShiftingPoster7 citations
- Online Graph Completion: Multivariate Signal Recovery in Computer VisionPoster7 citations
- Turning an Urban Scene Video Into a CinemagraphPoster7 citations
- Designing Illuminant Spectral Power Distributions for Surface ClassificationPoster6 citations
- Filter Flow Made Practical: Massively Parallel and Lock-FreePoster6 citations
- ROAM: A Rich Object Appearance Model With Application to RotoscopingPoster6 citations
- Radiometric Calibration for Internet Photo CollectionsSpotlight6 citations
- ShapeOdds: Variational Bayesian Learning of Generative Shape ModelsSpotlight6 citations
- Truncated Max-Of-Convex ModelsPoster6 citations
- Multi-Modal Mean-Fields via Cardinality-Based ClampingSpotlight5 citations
- Matting and Depth Recovery of Thin Structures Using a Focal StackPoster4 citations
- A Matrix Splitting Method for Composite Function MinimizationPoster3 citations
- DOPE: Distributed Optimization for Pairwise EnergiesPoster3 citations
- Newton-Type Methods for Inference in Higher-Order Markov Random FieldsPoster3 citations
- Generative Hierarchical Learning of Sparse FRAME ModelsPoster2 citations
- Adaptive and Move Making Auxiliary Cuts for Binary Pairwise EnergiesPoster1 citations
- Residual Expansion Algorithm: Fast and Effective Optimization for Nonconvex Least Squares ProblemsPoster1 citations
- Spatio-Temporal Alignment of Non-Overlapping Sequences From Independently Panning CamerasPoster1 citations
CVPR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.