CVPR 2016 Accepted Papers
The full list of 643 papers accepted at CVPR 2016 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 420Spotlight: 128Oral: 85
- Deep Residual Learning for Image RecognitionOral269,257 citations
- You Only Look Once: Unified, Real-Time Object DetectionOral61,920 citations
- Rethinking the Inception Architecture for Computer VisionPoster39,189 citations
- The Cityscapes Dataset for Semantic Urban Scene UnderstandingSpotlight15,494 citations
- Learning Deep Features for Discriminative LocalizationPoster13,283 citations
- Accurate Image Super-Resolution Using Very Deep Convolutional NetworksOral8,887 citations
- Real-Time Single Image and Video Super-Resolution Using an Efficient Sub-Pixel Convolutional Neural NetworkPoster8,215 citations
- Structure-From-Motion RevisitedPoster7,288 citations
- Image Style Transfer Using Convolutional Neural NetworksOral7,219 citations
- Context Encoders: Feature Learning by InpaintingPoster7,142 citations
- DeepFool: A Simple and Accurate Method to Fool Deep Neural NetworksPoster6,723 citations
- Social LSTM: Human Trajectory Prediction in Crowded SpacesSpotlight4,143 citations
- Convolutional Pose MachinesSpotlight3,968 citations
- NetVLAD: CNN Architecture for Weakly Supervised Place RecognitionOral3,700 citations
- Convolutional Two-Stream Network Fusion for Video Action RecognitionPoster3,662 citations
- NTU RGB+D: A Large Scale Dataset for 3D Human Activity AnalysisPoster3,655 citations
- Deeply-Recursive Convolutional Network for Image Super-ResolutionOral3,548 citations
- A Large Dataset to Train Convolutional Networks for Disparity, Optical Flow, and Scene Flow EstimationPoster3,436 citations
- Learning Multi-Domain Convolutional Neural Networks for Visual TrackingPoster3,331 citations
- Training Region-Based Object Detectors With Online Hard Example MiningOral3,146 citations
- The SYNTHIA Dataset: A Large Collection of Synthetic Images for Semantic Segmentation of Urban ScenesSpotlight2,880 citations
- Face2Face: Real-Time Face Capture and Reenactment of RGB VideosOral2,654 citations
- Single-Image Crowd Counting via Multi-Column Convolutional Neural NetworkPoster2,492 citations
- MSR-VTT: A Large Video Description Dataset for Bridging Video and LanguagePoster2,460 citations
- Stacked Attention Networks for Image Question AnsweringOral2,435 citations
- WIDER FACE: A Face Detection BenchmarkOral2,425 citations
- A Benchmark Dataset and Evaluation Methodology for Video Object SegmentationPoster2,422 citations
- DeepFashion: Powering Robust Clothes Recognition and Retrieval With Rich AnnotationsPoster2,303 citations
- Image Captioning With Semantic AttentionSpotlight2,268 citations
- 3D Semantic Parsing of Large-Scale Indoor SpacesOral2,242 citations
- Staple: Complementary Learners for Real-Time TrackingPoster2,208 citations
- Deep Metric Learning via Lifted Structured Feature EmbeddingSpotlight2,134 citations
- Volumetric and Multi-View CNNs for Object Classification on 3D DataSpotlight2,061 citations
- Towards Open Set Deep NetworksSpotlight1,979 citations
- Synthetic Data for Text Localisation in Natural ImagesSpotlight1,904 citations
- Non-Local Image DehazingSpotlight1,812 citations
- Instance-Aware Semantic Segmentation via Multi-Task Network CascadesOral1,791 citations
- Cross-Stitch Networks for Multi-Task LearningSpotlight1,784 citations
- Attention to Scale: Scale-Aware Semantic Image SegmentationPoster1,726 citations
- CNN-RNN: A Unified Framework for Multi-Label Image ClassificationOral1,717 citations
- Inside-Outside Net: Detecting Objects in Context With Skip Pooling and Recurrent Neural NetworksPoster1,678 citations
- Person Re-Identification by Multi-Channel Parts-Based CNN With Improved Triplet Loss FunctionPoster1,630 citations
- Learning Temporal Regularity in Video SequencesPoster1,598 citations
- Quantized Convolutional Neural Networks for Mobile DevicesPoster1,586 citations
- Generation and Comprehension of Unambiguous Object DescriptionsOral1,580 citations
- DenseCap: Fully Convolutional Localization Networks for Dense CaptioningOral1,539 citations
- Neural Module NetworksOral1,501 citations
- Structural-RNN: Deep Learning on Spatio-Temporal GraphsOral1,477 citations
- Virtual Worlds as Proxy for Multi-Object Tracking AnalysisPoster1,462 citations
- DeepCut: Joint Subset Partition and Labeling for Multi Person Pose EstimationSpotlight1,446 citations
- Face Alignment Across Large Poses: A 3D SolutionOral1,424 citations
- Siamese Instance Search for TrackingPoster1,421 citations
- Learning Deep Representation for Imbalanced ClassificationSpotlight1,349 citations
- ScribbleSup: Scribble-Supervised Convolutional Networks for Semantic SegmentationOral1,333 citations
- Fast Algorithms for Convolutional Neural NetworksSpotlight1,287 citations
- Eye Tracking for EveryonePoster1,274 citations
- Monocular 3D Object Detection for Autonomous DrivingPoster1,263 citations
- Efficient Piecewise Training of Deep Structured Models for Semantic SegmentationSpotlight1,221 citations
- Traffic-Sign Detection and Classification in the WildPoster1,212 citations
- Learning Deep Feature Representations With Domain Guided Dropout for Person Re-IdentificationPoster1,196 citations
- Temporal Action Localization in Untrimmed Videos via Multi-Stage CNNsPoster1,194 citations
- A Weighted Variational Model for Simultaneous Reflectance and Illumination EstimationPoster1,183 citations
- HyperNet: Towards Accurate Region Proposal Generation and Joint Object DetectionSpotlight1,150 citations
- The MegaFace Benchmark: 1 Million Faces for Recognition at ScalePoster1,109 citations
- Learning Deep Representations of Fine-Grained Visual DescriptionsSpotlight1,105 citations
- Compact Bilinear PoolingPoster1,102 citations
- Visual7W: Grounded Question Answering in ImagesPoster1,097 citations
- Deep Supervised Hashing for Fast Image RetrievalPoster1,096 citations
- Rain Streak Removal Using Layer PriorsPoster1,084 citations
- Joint Unsupervised Learning of Deep Representations and Image ClustersPoster1,078 citations
- Human Pose Estimation With Iterative Error FeedbackSpotlight1,074 citations
- Patch-Based Convolutional Neural Network for Whole Slide Tissue Image ClassificationSpotlight1,032 citations
- Weakly Supervised Deep Detection NetworksPoster1,001 citations
- DHSNet: Deep Hierarchical Saliency Network for Salient Object DetectionPoster986 citations
- Learning Deep Structure-Preserving Image-Text EmbeddingsPoster983 citations
- Blind Image Deblurring Using Dark Channel PriorOral968 citations
- Efficient Deep Learning for Stereo MatchingSpotlight966 citations
- Deep Contrast Learning for Salient Object DetectionPoster947 citations
- Synthesized Classifiers for Zero-Shot LearningOral947 citations
- Combining Markov Random Fields and Convolutional Neural Networks for Image SynthesisSpotlight942 citations
- Deep Relative Distance Learning: Tell the Difference Between Similar VehiclesPoster900 citations
- Hedged Deep TrackingPoster890 citations
- Latent Embeddings for Zero-Shot ClassificationSpotlight888 citations
- Deep Sliding Shapes for Amodal 3D Object Detection in RGB-D ImagesSpotlight887 citations
- MovieQA: Understanding Stories in Movies Through Question-AnsweringSpotlight875 citations
- ReconNet: Non-Iterative Reconstruction of Images From Compressively Sensed MeasurementsPoster854 citations
- Inverting Visual Representations With Convolutional NetworksPoster838 citations
- Improving the Robustness of Deep Neural Networks via Stability TrainingPoster823 citations
- Online Detection and Classification of Dynamic Hand Gestures With Recurrent 3D Convolutional Neural NetworkPoster822 citations
- Robust Scene Text Recognition With Automatic RectificationPoster820 citations
- Ordinal Regression With Multiple Output CNN for Age EstimationOral813 citations
- DCAN: Deep Contour-Aware Networks for Accurate Gland SegmentationPoster803 citations
- DeepStereo: Learning to Predict New Views From the World's ImagerySpotlight798 citations
- Learning a Discriminative Null Space for Person Re-IdentificationPoster791 citations
- End-To-End Learning of Action Detection From Frame Glimpses in VideosPoster763 citations
- Exploit All the Layers: Fast and Accurate CNN Object Detector With Scale Dependent Pooling and Cascaded Rejection ClassifiersPoster751 citations
- Recurrent Convolutional Network for Video-Based Person Re-IdentificationPoster746 citations
- Hierarchical Gaussian Descriptor for Person Re-IdentificationPoster744 citations
- Video Paragraph Captioning Using Hierarchical Recurrent Neural NetworksOral742 citations
- Multi-Oriented Text Detection With Fully Convolutional NetworksPoster740 citations
- Dynamic Image Networks for Action RecognitionOral727 citations
- Jointly Modeling Embedding and Translation to Bridge Video and LanguageOral716 citations
- EmotioNet: An Accurate, Real-Time Algorithm for the Automatic Annotation of a Million Facial Expressions in the WildSpotlight711 citations
- End-To-End People Detection in Crowded ScenesSpotlight684 citations
- Cross Modal Distillation for Supervision TransferPoster668 citations
- Natural Language Object RetrievalOral664 citations
- A Hierarchical Deep Temporal Model for Group Activity RecognitionPoster642 citations
- Recursive Recurrent Nets With Attention Modeling for OCR in the WildPoster638 citations
- Tensor Robust Principal Component Analysis: Exact Recovery of Corrupted Low-Rank Tensors via Convex OptimizationPoster627 citations
- Uncertainty-Driven 6D Pose Estimation of Objects and Scenes From a Single RGB ImagePoster627 citations
- Where to Look: Focus Regions for Visual Question AnsweringSpotlight610 citations
- A Multi-Stream Bi-Directional Recurrent Neural Network for Fine-Grained Action DetectionPoster606 citations
- How Far Are We From Solving Pedestrian Detection?Poster597 citations
- Part-Stacked CNN for Fine-Grained Visual CategorizationPoster589 citations
- Shallow and Deep Convolutional Networks for Saliency PredictionPoster587 citations
- Fast ConvNets Using Group-Wise Brain DamagePoster579 citations
- Deep Saliency With Encoded Low Level Distance Map and High Level FeaturesPoster570 citations
- Deep Interactive Object SelectionPoster563 citations
- What Value Do Explicit High Level Concepts Have in Vision to Language Problems?Poster561 citations
- Real-Time Action Recognition With Enhanced Motion Vector CNNsPoster546 citations
- Sparseness Meets Deepness: 3D Human Pose Estimation From Monocular VideoSpotlight545 citations
- Sketch Me That ShoeOral540 citations
- Anticipating Visual Representations From Unlabeled VideoSpotlight533 citations
- Seven Ways to Improve Example-Based Single Image Super ResolutionPoster526 citations
- A Comparative Study for Single Image Blind DeblurringSpotlight524 citations
- Multimodal Spontaneous Emotion Corpus for Human Behavior AnalysisPoster521 citations
- Joint Learning of Single-Image and Cross-Image Representations for Person Re-IdentificationPoster518 citations
- Adaptive Decontamination of the Training Set: A Unified Formulation for Discriminative Visual TrackingPoster515 citations
- Object Detection From Video Tubelets With Convolutional Neural NetworksSpotlight513 citations
- Hierarchical Recurrent Neural Encoder for Video Representation With Application to CaptioningPoster506 citations
- Learning Activity Progression in LSTMs for Activity Detection and Early DetectionPoster502 citations
- Learning to Read Chest X-Rays: Recurrent Neural Cascade Model for Automated Image AnnotationPoster490 citations
- Visually Indicated SoundsOral489 citations
- Object Contour Detection With a Fully Convolutional Encoder-Decoder NetworkSpotlight478 citations
- Ask Me Anything: Free-Form Visual Question Answering Based on Knowledge From External SourcesSpotlight475 citations
- Scalable Sparse Subspace Clustering by Orthogonal Matching PursuitOral459 citations
- Unsupervised Cross-Dataset Transfer Learning for Person Re-IdentificationPoster457 citations
- Video Segmentation via Object FlowSpotlight454 citations
- Learning Dense Correspondence via 3D-Guided Cycle ConsistencyOral453 citations
- Semantic Image Segmentation With Task-Specific Edge Detection Using CNNs and a Discriminatively Trained Domain TransformPoster451 citations
- Understanding Real World Indoor Scenes With Synthetic DataPoster448 citations
- Mnemonic Descent Method: A Recurrent Process Applied for End-To-End Face AlignmentPoster444 citations
- Yin and Yang: Balancing and Answering Binary Visual QuestionsPoster439 citations
- Image Question Answering Using Convolutional Neural Network With Dynamic Parameter PredictionOral435 citations
- Zero-Shot Learning via Joint Latent Similarity Embedding433 citations
- Learning Compact Binary Descriptors With Unsupervised Deep Neural NetworksPoster431 citations
- A 3D Morphable Model Learnt From 10,000 FacesSpotlight424 citations
- Deep Region and Multi-Label Learning for Facial Action Unit DetectionPoster414 citations
- Self-Adaptive Matrix Completion for Heart Rate Estimation From Face Videos Under Realistic ConditionsOral413 citations
- Large-Pose Face Alignment via CNN-Based Dense 3D Model FittingPoster410 citations
- FireCaffe: Near-Linear Acceleration of Deep Neural Network Training on Compute ClustersPoster404 citations
- Picking Deep Filter Responses for Fine-Grained Image RecognitionPoster401 citations
- Going Deeper into First-Person Activity RecognitionPoster400 citations
- Monocular Depth Estimation Using Neural Regression ForestSpotlight398 citations
- Similarity Learning With Spatial Constraints for Person Re-IdentificationPoster398 citations
- Learning Local Image Descriptors With Deep Siamese and Triplet Convolutional Networks by Minimising Global Loss FunctionsSpotlight394 citations
- SPDA-CNN: Unifying Semantic Part Detection and Abstraction for Fine-Grained RecognitionPoster382 citations
- Unsupervised Learning From Narrated Instruction VideosOral378 citations
- Simultaneous Optical Flow and Intensity Estimation From an Event CameraOral377 citations
- Robust 3D Hand Pose Estimation in Single Depth Images: From Single-View CNN to Multi-View CNNsPoster375 citations
- Deep Hand: How to Train a CNN on 1 Million Hand Images When Your Data Is Continuous and Weakly LabelledOral370 citations
- A Benchmark Dataset and Evaluation for Non-Lambertian and Uncalibrated Photometric StereoPoster358 citations
- Fast Temporal Activity Proposals for Efficient Detection of Human Actions in Untrimmed VideosPoster355 citations
- GIFT: A Real-Time and Scalable 3D Shape Search EnginePoster351 citations
- Actions ~ TransformationsPoster347 citations
- Deep Compositional Captioning: Describing Novel Object Categories Without Paired Training DataOral346 citations
- End-To-End Learning of Deformable Mixture of Parts and Deep Convolutional Neural Networks for Human Pose EstimationOral346 citations
- Highlight Detection With Pairwise Deep Ranking for First-Person Video SummarizationSpotlight345 citations
- Composition-Preserving Deep Photo Aesthetics AssessmentPoster340 citations
- Real-Time Salient Object Detection With a Minimum Spanning TreeSpotlight340 citations
- A Probabilistic Collaborative Representation Based Approach for Pattern ClassificationPoster337 citations
- STCT: Sequentially Training Convolutional Networks for Visual TrackingPoster330 citations
- Structured Feature Learning for Pose EstimationSpotlight330 citations
- TGIF: A New Dataset and Benchmark on Animated GIF DescriptionSpotlight330 citations
- TI-Pooling: Transformation-Invariant Pooling for Feature Learning in Convolutional Neural NetworksPoster328 citations
- A Key Volume Mining Deep Framework for Action RecognitionPoster321 citations
- Pose-Aware Face Recognition in the WildPoster321 citations
- Situation Recognition: Visual Semantic Role Labeling for Image UnderstandingOral321 citations
- Oracle Based Active Set Algorithm for Scalable Elastic Net Subspace ClusteringOral318 citations
- Marr Revisited: 2D-3D Alignment via Surface Normal Prediction317 citations
- DisturbLabel: Regularizing CNN on the Loss LayerPoster314 citations
- A Holistic Approach to Cross-Channel Image Noise Modeling and Its Application to Image DenoisingSpotlight310 citations
- Top-Push Video-Based Person Re-IdentificationPoster310 citations
- Pairwise Decomposition of Image Sequences for Active Multi-View RecognitionOral308 citations
- Structure Inference Machines: Recurrent Neural Networks for Analyzing Relations in Group Activity RecognitionPoster308 citations
- Object Tracking via Dual Linear Structured SVM and Explicit Feature MapPoster297 citations
- Recurrent Attentional Networks for Saliency DetectionPoster296 citations
- Active Image Segmentation PropagationPoster293 citations
- Fine-Grained Categorization and Dataset Bootstrapping Using Deep Metric Learning With Humans in the LoopPoster293 citations
- Instance-Level Segmentation for Autonomous Driving With Deep Densely Connected MRFsPoster292 citations
- Learning With Side Information Through Modality HallucinationSpotlight286 citations
- Efficient Indexing of Billion-Scale Datasets of Deep DescriptorsPoster285 citations
- Detecting Events and Key Actors in Multi-Person VideosOral284 citations
- Studying Very Low Resolution Recognition Using Deep NetworksPoster284 citations
- Joint Training of Cascaded CNN for Face DetectionPoster280 citations
- Multispectral Images Denoising by Intrinsic Tensor Sparsity RegularizationSpotlight280 citations
- Recovering 6D Object Pose and Predicting Next-Best-View in the CrowdPoster275 citations
- Direct Prediction of 3D Body Poses From Motion Compensated SequencesPoster273 citations
- Efficient Coarse-To-Fine PatchMatch for Large Displacement Optical FlowSpotlight273 citations
- Seeing Through the Human Reporting Bias: Visual Classifiers From Noisy Human-Centric LabelsPoster273 citations
- Summary Transfer: Exemplar-Based Subset Selection for Video SummarizationPoster271 citations
- Bilateral Space Video SegmentationPoster268 citations
- Contour Detection in Unstructured 3D Point CloudsOral267 citations
- G-CNN: An Iterative Grid Based Object DetectorSpotlight267 citations
- Temporal Action Detection Using a Statistical Language ModelSpotlight267 citations
- First Person Action Recognition Using Deep Learned DescriptorsPoster264 citations
- Analyzing Classifiers: Fisher Vectors and Deep Neural NetworksPoster262 citations
- A Dual-Source Approach for 3D Pose Estimation From a Single ImageSpotlight260 citations
- Semantic Segmentation With Boundary Neural FieldsPoster260 citations
- Embedding Label Structures for Fine-Grained Feature RepresentationPoster259 citations
- Rolling Rotations for Recognizing Human Actions From 3D Skeletal DataPoster259 citations
- Scene Recognition With CNNs: Objects, Scales and Dataset BiasPoster258 citations
- Feature Space Optimization for Semantic Video SegmentationOral257 citations
- Weakly Supervised Object Localization With Progressive Domain AdaptationPoster257 citations
- Factors in Finetuning Deep Model for Object Detection With Long-Tail DistributionSpotlight256 citations
- Learning Attributes Equals Multi-Source Domain GeneralizationSpotlight256 citations
- Beyond Local Search: Tracking Objects Everywhere With Instance-Specific ProposalsSpotlight255 citations
- Optical Flow With Semantic Segmentation and Localized LayersSpotlight251 citations
- D3: Deep Dual-Domain Based Fast Restoration of JPEG-Compressed ImagesPoster249 citations
- Local Background Enclosure for RGB-D Salient Object DetectionSpotlight246 citations
- Learning Cross-Domain Landmarks for Heterogeneous Domain AdaptationPoster244 citations
- Learning Sparse High Dimensional Filters: Image Filtering, Dense CRFs and Bilateral Neural NetworksPoster244 citations
- 3D Action Recognition From Novel ViewpointsOral243 citations
- BoxCars: 3D Boxes as CNN Input for Improved Fine-Grained Vehicle RecognitionPoster243 citations
- Dense Human Body Correspondences Using Convolutional NetworksOral242 citations
- Less Is More: Zero-Shot Learning From Online Textual Documents With Noise SuppressionPoster238 citations
- Dense Monocular Depth Estimation in Complex Dynamic ScenesPoster235 citations
- Temporal Action Localization With Pyramid of Score Distribution FeaturesSpotlight232 citations
- Recurrent Face AgingOral231 citations
- DeepHand: Robust Hand Pose Estimation by Completing a Matrix Imputed With Deep FeaturesPoster228 citations
- Adaptive 3D Face Reconstruction From Unconstrained Photo CollectionsPoster227 citations
- Full Flow: Optical Flow Estimation By Global Optimization Over Regular GridsOral227 citations
- CNN-N-Gram for Handwriting Word RecognitionOral226 citations
- Online Multi-Object Tracking via Structural Constraint Event AggregationPoster226 citations
- Sample-Specific SVM Learning for Person Re-IdentificationPoster226 citations
- Learning Transferrable Knowledge for Semantic Segmentation With Deep Convolutional Neural NetworkSpotlight221 citations
- Semantic Instance Annotation of Street Scenes by 3D to 2D Label TransferPoster220 citations
- Unconstrained Face Alignment via Cascaded Compositional LearningPoster217 citations
- WELDON: Weakly Supervised Learning of Deep Convolutional Neural NetworksPoster217 citations
- Semantic Object Parsing With Local-Global Long Short-Term MemorySpotlight215 citations
- Sliced Wasserstein Kernels for Probability DistributionsPoster215 citations
- Visual Tracking Using Attention-Modulated Disintegration and IntegrationPoster215 citations
- Multi-View Deep Network for Cross-View ClassificationPoster214 citations
- Exploit Bounding Box Annotations for Multi-Label Object RecognitionPoster210 citations
- Recurrent Attention Models for Depth-Based Person IdentificationPoster210 citations
- Latent Factor Guided Convolutional Neural Networks for Age-Invariant Face RecognitionPoster209 citations
- Structured Prediction of Unobserved Voxels From a Single Depth ImageOral206 citations
- Learning Aligned Cross-Modal Representations From Weakly Aligned DataPoster204 citations
- RIFD-CNN: Rotation-Invariant and Fisher Discriminative Convolutional Neural Networks for Object DetectionPoster204 citations
- Reinforcement Learning for Visual Object DetectionPoster203 citations
- Structural Correlation Filter for Robust Visual TrackingPoster202 citations
- Cataloging Public Objects Using Aerial and Street-Level Images - Urban Trees201 citations
- DAG-Recurrent Neural Networks For Scene LabelingPoster201 citations
- Gaussian Conditional Random Field Network for Semantic SegmentationSpotlight200 citations
- Regularizing Long Short Term Memory With 3D Human-Skeleton Sequences for Action RecognitionOral199 citations
- Recurrently Target-Attending TrackingPoster197 citations
- Fashion Style in 128 Floats: Joint Ranking and Classification Using Weak Data for Feature ExtractionPoster194 citations
- SketchNet: Sketch Classification With Web ImagesPoster192 citations
- Large-Scale Location Recognition and the Geometric Burstiness ProblemSpotlight191 citations
- DeLay: Robust Spatial Layout Estimation for Cluttered Indoor ScenesPoster189 citations
- Sparsifying Neural Network Connections for Face RecognitionPoster187 citations
- End-To-End Saliency Mapping via Probability Distribution PredictionSpotlight186 citations
- Iterative Instance SegmentationPoster185 citations
- Saliency Unified: A Deep Architecture for Simultaneous Eye Fixation Prediction and Salient Object SegmentationPoster185 citations
- WarpNet: Weakly Supervised Matching for Single-View ReconstructionPoster185 citations
- Multi-View People Tracking via Hierarchical Trajectory CompositionPoster184 citations
- Newtonian Scene Understanding: Unfolding the Dynamics of Objects in Static ImagesPoster183 citations
- Video2GIF: Automatic Generation of Animated GIFs From VideoPoster182 citations
- Visualizing and Understanding Deep Texture RepresentationsPoster182 citations
- HD Maps: Fine-Grained Road Segmentation by Parsing Ground and Aerial ImagesPoster181 citations
- Manifold SLIC: A Fast Method to Compute Content-Sensitive SuperpixelsPoster181 citations
- LocNet: Improving Localization Accuracy for Object DetectionOral180 citations
- Three-Dimensional Object Detection and Layout Prediction Using Clouds of Oriented GradientsOral180 citations
- We Don't Need No Bounding-Boxes: Training Object Class Detectors Using Only Human VerificationSpotlight179 citations
- Slow and Steady Feature Analysis: Higher Order Temporal Coherence in VideoSpotlight176 citations
- CRAFT Objects From Images173 citations
- Large Scale Semi-Supervised Object Detection Using Visual and Semantic Knowledge TransferPoster173 citations
- FANNG: Fast Approximate Nearest Neighbour GraphsSpotlight172 citations
- Discriminatively Embedded K-Means for Multi-View ClusteringSpotlight169 citations
- Semi-Supervised Vocabulary-Informed LearningOral169 citations
- Fine-Grained Image Classification by Exploring Bipartite-Graph LabelsPoster168 citations
- Answer-Type Prediction for Visual Question AnsweringPoster167 citations
- Learning Relaxed Deep Supervision for Better Edge DetectionPoster167 citations
- Mining Discriminative Triplets of Patches for Fine-Grained ClassificationPoster165 citations
- How Hard Can It Be? Estimating the Difficulty of Visual Search in an ImagePoster164 citations
- Proposal FlowPoster164 citations
- Comparative Deep Learning of Hybrid Representations for Image RecommendationsPoster162 citations
- Learning Structured Inference Neural Networks With Label RelationsPoster162 citations
- In Defense of Sparse Tracking: Circulant Sparse TrackerSpotlight161 citations
- Multi-Cue Zero-Shot Learning With Strong SupervisionSpotlight161 citations
- Recombinator Networks: Learning Coarse-To-Fine Feature AggregationSpotlight156 citations
- Canny Text Detector: Fast and Robust Scene Text Localization AlgorithmPoster155 citations
- Fits Like a Glove: Rapid and Reliable Hand Shape PersonalizationSpotlight154 citations
- Discriminative Hierarchical Rank Pooling for Activity RecognitionPoster153 citations
- Improving Person Re-Identification via Pose-Aware Multi-Shot MatchingPoster153 citations
- Convolutional Networks for Shape From Light FieldPoster151 citations
- Efficient Training of Very Deep Neural Networks for Supervised HashingPoster150 citations
- Split and Match: Example-Based Adaptive Patch Sampling for Unsupervised Style TransferPoster150 citations
- Automatic Image Cropping : A Computational Complexity StudyPoster147 citations
- Fast Training of Triplet-Based Deep Binary Embedding Networks146 citations
- Learning to Assign Orientations to Feature PointsOral145 citations
- Track and Segment: An Iterative Unsupervised Approach for Video Object ProposalsSpotlight145 citations
- Conditional Graphical Lasso for Multi-Label Image ClassificationPoster142 citations
- Structured Receptive Fields in CNNsPoster142 citations
- Egocentric Future LocalizationOral141 citations
- Detecting Vanishing Points Using Global Image Context in a Non-Manhattan WorldSpotlight138 citations
- Walk and Learn: Facial Attribute Representation Learning From Egocentric Video and Contextual DataOral137 citations
- Facial Expression Intensity Estimation Using Ordinal InformationPoster136 citations
- From Keyframes to Key Objects: Video Summarization by Representative Object Proposal SelectionPoster136 citations
- Robust Light Field Depth Estimation for Noisy Scene With OcclusionPoster136 citations
- You Lead, We Exceed: Labor-Free Video Concept Learning by Jointly Exploiting Web Videos and ImagesSpotlight136 citations
- Discriminative Multi-Modal Feature Fusion for RGBD Indoor Scene RecognitionPoster134 citations
- HyperDepth: Learning Depth From Structured Light Without MatchingOral134 citations
- Kernel Sparse Subspace Clustering on Symmetric Positive Definite ManifoldsPoster134 citations
- A Field Model for Repairing 3D ShapesSpotlight133 citations
- Bottom-Up and Top-Down Reasoning With Hierarchical Rectified GaussiansSpotlight133 citations
- Object Skeleton Extraction in Natural Images by Fusing Scale-Associated Deep Side OutputsPoster133 citations
- Temporal Multimodal Learning in Audiovisual Speech RecognitionPoster133 citations
- What Sparse Light Field Coding Reveals About Scene StructurePoster133 citations
- Fast Zero-Shot Image Tagging132 citations
- High-Quality Depth From Uncalibrated Small Motion ClipOral132 citations
- Personalizing Human Video Pose EstimationOral132 citations
- GOGMA: Globally-Optimal Gaussian Mixture AlignmentSpotlight130 citations
- Robust Kernel Estimation With Outliers Handling for Image DeblurringPoster130 citations
- Deep Reflectance MapsPoster129 citations
- Occlusion-Free Face Alignment: Deep Regression Networks Coupled With De-Corrupt AutoEncodersPoster128 citations
- Actionness Estimation Using Hybrid Fully Convolutional NetworksPoster127 citations
- Efficient Temporal Sequence Comparison and Classification Using Gram Matrix Embeddings on a Riemannian ManifoldPoster127 citations
- Joint Recovery of Dense Correspondence and Cosegmentation in Two ImagesPoster126 citations
- Recovering the Missing Link: Predicting Class-Attribute Associations for Unsupervised Zero-Shot Learning126 citations
- Unsupervised Learning of Discriminative Attributes and Visual RepresentationsPoster123 citations
- Soft-Segmentation Guided Object Motion DeblurringPoster122 citations
- Deep Exemplar 2D-3D Detection by Adapting From Real to Rendered Views121 citations
- Exploiting Spectral-Spatial Correlation for Coded Hyperspectral Image RestorationPoster121 citations
- Group MAD Competition - A New Methodology to Compare Objective Image Quality ModelsSpotlight120 citations
- Recognizing Emotions From Abstract Paintings Using Non-Linear Matrix CompletionPoster120 citations
- Visual Word2Vec (vis-w2v): Learning Visually Grounded Word Embeddings Using Abstract ScenesPoster120 citations
- Large-Scale Semantic 3D Reconstruction: An Adaptive Multi-Resolution Model for Multi-Class Volumetric LabelingOral119 citations
- Loss Functions for Top-k Error: Analysis and InsightsPoster118 citations
- PatchBatch: A Batch Augmented Loss for Optical FlowPoster118 citations
- Unconstrained Salient Object Detection via Proposal Subset OptimizationSpotlight118 citations
- Detection and Accurate Localization of Circular Fiducials Under Highly Challenging ConditionsPoster116 citations
- Efficiently Creating 3D Training Data for Fine Hand Pose EstimationSpotlight115 citations
- Unsupervised Learning of EdgesOral115 citations
- GraB: Visual Saliency via Novel Graph Model and Background PriorsPoster114 citations
- Deep Decision Network for Multi-Class Image ClassificationPoster113 citations
- Harnessing Object and Scene Semantics for Large-Scale Video UnderstandingSpotlight113 citations
- Inferring Forces and Learning Human Utilities From VideosOral113 citations
- VLAD3: Encoding Dynamics of Deep Features for Action RecognitionPoster111 citations
- Do It Yourself Hyperspectral Imaging With Everyday Digital CamerasSpotlight110 citations
- Multi-Scale Patch Aggregation (MPA) for Simultaneous Detection and SegmentationOral110 citations
- Adaptive Object Detection Using Adjacency and Zoom PredictionSpotlight108 citations
- What Players Do With the Ball: A Physically Constrained Interaction ModelingSpotlight108 citations
- Automated 3D Face Reconstruction From Multiple Images Using Quality MeasuresPoster107 citations
- Some Like It Hot - Visual Guidance for Preference PredictionSpotlight107 citations
- LOMo: Latent Ordinal Model for Facial Analysis in VideosSpotlight105 citations
- Mining 3D Key-Pose-Motifs for Action RecognitionPoster105 citations
- Slicing Convolutional Neural Network for Crowd Video UnderstandingSpotlight104 citations
- Constrained Joint Cascade Regression Framework for Simultaneous Facial Action Unit Recognition and Facial Landmark DetectionPoster103 citations
- Pedestrian Detection Inspired by Appearance Constancy and Shape SymmetryPoster103 citations
- Multiple Model Fitting as a Set Coverage ProblemPoster102 citations
- ASP Vision: Optically Computing the First Layer of Convolutional Neural Networks Using Angle Sensitive PixelsOral100 citations
- Object-Proposal Evaluation Protocol is 'Gameable'Spotlight100 citations
- From Noise Modeling to Blind Image DenoisingPoster98 citations
- Object Co-Segmentation via Graph Optimized-Flexible Manifold RankingPoster98 citations
- Recognizing Micro-Actions and Reactions From Paired Egocentric VideosPoster98 citations
- Progressively Parsing Interactional Objects for Fine Grained Action DetectionPoster95 citations
- Rolling Shutter Camera Relative Pose: Generalized Epipolar GeometryPoster94 citations
- Learning to Match Aerial Images With Deep Attentive ArchitecturesPoster93 citations
- Automatic Content-Aware Color and Tone StylizationSpotlight92 citations
- Temporally Coherent 4D Reconstruction of Complex Dynamic ScenesOral91 citations
- Blind Image Deconvolution by Automatic Gradient ActivationPoster90 citations
- Efficient 3D Room Shape Recovery From a Single PanoramaOral90 citations
- Predicting the Where and What of Actors and Actions Through Online Action LocalizationPoster90 citations
- iLab-20M: A Large-Scale Controlled Object Dataset to Investigate Deep LearningPoster90 citations
- A Consensus-Based Framework for Distributed Bundle AdjustmentPoster89 citations
- Efficient Large-Scale Approximate Nearest Neighbor Search on the GPUPoster89 citations
- A Text Detection System for Natural Scenes With Convolutional Feature Learning and Cascaded ClassificationPoster88 citations
- Hierarchically Gated Deep Networks for Semantic SegmentationOral87 citations
- Primary Object Segmentation in Videos via Alternate Convex Optimization of Foreground and Background DistributionsPoster87 citations
- 3D Part-Based Sparse Tracker With Automatic Synchronization and RegistrationPoster85 citations
- Modality and Component Aware Feature Fusion For RGB-D Scene Classification85 citations
- Accelerated Generative Models for 3D Point Cloud DataSpotlight84 citations
- Computational Imaging for VLBI Image ReconstructionOral84 citations
- Deep Gaussian Conditional Random Field Network: A Model-Based Deep Network for Discriminative DenoisingPoster84 citations
- Semantic Channels for Fast Pedestrian DetectionSpotlight84 citations
- Supervised Quantization for Similarity SearchPoster84 citations
- Automating Carotid Intima-Media Thickness Video Interpretation With Convolutional Neural NetworksPoster82 citations
- SVBRDF-Invariant Shape and Reflectance Estimation From Light-Field CamerasOral82 citations
- ProNet: Learning to Propose Object-Specific Boxes for Cascaded Neural NetworksPoster80 citations
- Track and Transfer: Watching Videos to Simulate Strong Human Supervision for Weakly-Supervised Object DetectionPoster80 citations
- Logistic Boosting Regression for Label Distribution LearningPoster79 citations
- ForgetMeNot: Memory-Aware Forensic Facial Sketch MatchingSpotlight77 citations
- Spatiotemporal Bundle Adjustment for Dynamic 3D ReconstructionPoster77 citations
- The Next Best Underwater ViewPoster77 citations
- A Hole Filling Approach Based on Background Reconstruction for View Synthesis in 3D VideoPoster76 citations
- Affinity CNN: Learning Pixel-Centric Pairwise Relations for Figure/Ground EmbeddingSpotlight76 citations
- A Deeper Look at Saliency: Feature Contrast, Semantics, and BeyondPoster75 citations
- RAID-G: Robust Estimation of Approximate Infinite Dimensional Gaussian With Application to Material RecognitionPoster75 citations
- Theory and Practice of Structure-From-Motion Using Affine CorrespondencesSpotlight75 citations
- Blockout: Dynamic Model Selection for Hierarchical Deep NetworksPoster74 citations
- Information Bottleneck Learning Using Privileged Information for Visual RecognitionPoster74 citations
- One-Shot Learning of Scene Locations via Feature Trajectory TransferSpotlight74 citations
- Copula Ordinal Regression for Joint Estimation of Facial Action Unit IntensityPoster72 citations
- Material Classification Using Raw Time-Of-Flight MeasurementsPoster72 citations
- Collaborative Quantization for Cross-Modal Similarity SearchPoster71 citations
- Efficient Intersection of Three Quadrics and Applications in Computer VisionPoster71 citations
- Fast Algorithms for Linear and Kernel SVM+Poster71 citations
- Longitudinal Face Modeling via Temporal Deep Restricted Boltzmann MachinesPoster71 citations
- 3D Reconstruction of Transparent Objects With Position-Normal ConsistencyPoster70 citations
- Efficient and Robust Color Consistency for Community Photo CollectionsPoster70 citations
- From Bows to Arrows: Rolling Shutter Rectification of Urban ScenesPoster70 citations
- Geometry-Informed Material RecognitionSpotlight69 citations
- Learning Online Smooth Predictors for Realtime Camera Planning Using Recurrent Decision TreesOral69 citations
- Robust Visual Place Recognition With Graph KernelsPoster69 citations
- We Are Humor Beings: Understanding and Predicting Visual HumorSpotlight69 citations
- Cascaded Interactional Targeting Network for Egocentric Video AnalysisPoster68 citations
- Recognizing Activities of Daily Living With a Wrist-Mounted CameraSpotlight68 citations
- Gradient-Domain Image Reconstruction Framework With Intensity-Range and Base-Structure ConstraintsPoster67 citations
- Pairwise Linear Regression Classification for Image Set RetrievalPoster67 citations
- A Hierarchical Pose-Based Approach to Complex Action Understanding Using Dictionaries of Actionlets and Motion PoseletsPoster66 citations
- Pairwise Matching Through Max-Weight Bipartite Belief PropagationPoster66 citations
- Reversible Recursive Instance-Level Object SegmentationPoster65 citations
- Semantic 3D Reconstruction With Continuous Regularization and Ray Potentials Using a Visibility Consistency ConstraintSpotlight65 citations
- PSyCo: Manifold Span Reduction for Super ResolutionPoster63 citations
- Learning Weight Uncertainty With Stochastic Gradient MCMC for Shape ClassificationSpotlight62 citations
- MDL-CW: A Multimodal Deep Learning Framework With Cross WeightsPoster62 citations
- Robust Optical Flow Estimation of Double-Layer Images Under Transparency or ReflectionPoster62 citations
- SemiContour: A Semi-Supervised Learning Approach for Contour DetectionPoster62 citations
- CP-mtML: Coupled Projection Multi-Task Metric Learning for Large Scale Face RetrievalPoster61 citations
- RAW Image Reconstruction Using a Self-Contained sRGB-JPEG Image With Only 64 KB OverheadSpotlight60 citations
- Recovering Transparent Shape From Time-Of-Flight DistortionPoster60 citations
- Stereo Matching With Color and Monochrome Cameras in Low-Light ConditionsPoster60 citations
- Laplacian Patch-Based Image SynthesisPoster59 citations
- DeepCAMP: Deep Convolutional Action & Attribute Mid-Level PatternsPoster58 citations
- Structure From Motion With ObjectsPoster58 citations
- Deep SimNetsPoster57 citations
- Event-Specific Image ImportancePoster57 citations
- Learning Action Maps of Large Environments via First-Person VisionPoster57 citations
- Multi-Label Ranking From Positive and Unlabeled DataPoster57 citations
- Weakly Supervised Object BoundariesSpotlight57 citations
- Sparse Coding for Classification via Discrimination EnsemblePoster56 citations
- Gravitational Approach for Point Set RegistrationPoster55 citations
- InterActive: Inter-Layer Activeness PropagationPoster55 citations
- Actor-Action Semantic Segmentation With Grouping Process ModelsSpotlight54 citations
- Online Collaborative Learning for Open-Vocabulary Visual ClassifiersPoster54 citations
- Prior-Less Compressible Structure From MotionPoster54 citations
- TenSR: Multi-Dimensional Tensor Sparse RepresentationPoster54 citations
- Deep Canonical Time WarpingPoster53 citations
- Dictionary Pair Classifier Driven Convolutional Neural Networks for Object DetectionPoster53 citations
- Solving Small-Piece Jigsaw Puzzles by Growing ConsensusPoster53 citations
- A Nonlinear Regression Technique for Manifold Valued Data With Applications to Medical Image AnalysisPoster52 citations
- From Dusk Till Dawn: Modeling in the DarkSpotlight52 citations
- Predicting Motivations of Actions by Leveraging TextPoster52 citations
- Unbiased Photometric Stereo for Colored Surfaces: A Variational ApproachPoster52 citations
- The Solution Path Algorithm for Identity-Aware Multi-Object TrackingSpotlight51 citations
- A Probabilistic Framework for Color-Based Point Set RegistrationPoster50 citations
- Beyond F-Formations: Determining Social Involvement in Free Standing Conversing Groups From Static ImagesPoster50 citations
- Consensus of Non-Rigid ReconstructionsOral50 citations
- Noisy Label Recovery for Shadow Detection in Unfamiliar DomainsPoster50 citations
- Rolling Shutter Absolute Pose Problem With Known Vertical DirectionPoster50 citations
- Sublabel-Accurate Relaxation of Nonconvex EnergiesOral50 citations
- Equiangular Kernel Dictionary Learning With Applications to Dynamic Texture AnalysisPoster49 citations
- Multilinear Hyperplane HashingPoster49 citations
- Progressive Prioritized Multi-View StereoPoster49 citations
- Semantic FilteringPoster49 citations
- Guaranteed Outlier Removal With Mixed Integer Linear ProgramsPoster48 citations
- Constrained Deep Transfer Feature Learning and Its ApplicationsPoster47 citations
- Instance-Level Video Segmentation From Object TracksPoster47 citations
- Image Deblurring Using Smartphone Inertial SensorsPoster46 citations
- Regularity-Driven Facade Matching Between Aerial and Street ViewsSpotlight46 citations
- Camera Calibration From Periodic Motion of a PedestrianPoster45 citations
- Do Computational Models Differ Systematically From Human Object Perception?Spotlight45 citations
- Exemplar-Driven Top-Down Saliency Detection via Deep AssociationSpotlight45 citations
- Macroscopic Interferometry: Rethinking Depth Estimation With Frequency-Domain Time-Of-FlightOral45 citations
- An Egocentric Look at Video Photographer IdentityPoster44 citations
- Visual Path Prediction in Complex Scenes With Crowded Moving ObjectsPoster44 citations
- Saliency Guided Dictionary Learning for Weakly-Supervised Image ParsingPoster43 citations
- Two Illuminant Estimation and User Correction PreferencePoster43 citations
- Ambiguity Helps: Classification With Disagreements in Crowdsourced AnnotationsPoster42 citations
- Patches, Planes and Probabilities: A Non-Local Prior for Volumetric 3D ReconstructionPoster42 citations
- Geospatial Correspondences for Multimodal RegistrationPoster41 citations
- Joint Probabilistic Matching Using m-Best SolutionsOral41 citations
- Scale-Aware Alignment of Hierarchical Image SegmentationPoster41 citations
- Sparse Coding for Third-Order Super-Symmetric Tensor Descriptors With Application to Texture RecognitionSpotlight41 citations
- Tensor Power Iteration for Multi-Graph MatchingPoster41 citations
- Using Self-Contradiction to Learn Confidence Measures in Stereo VisionPoster41 citations
- What If We Do Not Have Multiple Videos of the Same Action? -- Video Action Localization Using Web ImagesPoster41 citations
- Deep Structured Scene Parsing by Learning With Image DescriptionsOral40 citations
- Efficient Globally Optimal 2D-To-3D Deformable Shape MatchingPoster40 citations
- Improving Human Action Recognition by Non-Action ClassificationPoster40 citations
- Panoramic Stereo Videos With a Single CameraPoster40 citations
- Refining Architectures of Deep Convolutional Neural NetworksPoster40 citations
- Robust Tensor Factorization With Unknown NoisePoster40 citations
- Sparse to Dense 3D Reconstruction From Rolling Shutter ImagesPoster40 citations
- The Global Patch ColliderOral40 citations
- Volumetric 3D Tracking by DetectionSpotlight40 citations
- A Multi-Level Contextual Model For Person Recognition in Photo AlbumsPoster39 citations
- Backtracking ScSPM Image Classifier for Weakly Supervised Top-Down SaliencyPoster39 citations
- Gradual DropIn of Layers to Train Very Deep Neural NetworksPoster39 citations
- Discriminative Invariant Kernel Features: A Bells-and-Whistles-Free Approach to Unsupervised Face Recognition and Pose EstimationSpotlight38 citations
- Efficient Point Process Inference for Large-Scale Object DetectionPoster38 citations
- PPP: Joint Pointwise and Pairwise Image Label Prediction38 citations
- Sparse Coding and Dictionary Learning With Linear Dynamical SystemsOral38 citations
- They Are Not Equally Reliable: Semantic Event Search Using Differentiated Concept ClassifiersPoster38 citations
- A Continuous Occlusion Model for Road Scene UnderstandingPoster37 citations
- Groupwise Tracking of Crowded Similar-Appearance Targets From Low-Continuity Image SequencesSpotlight37 citations
- Region Ranking SVM for Image ClassificationPoster37 citations
- 3D Shape AttributesOral36 citations
- A Robust Multilinear Model Learning Framework for 3D FacesOral36 citations
- Multiview Image Completion With Space Structure PropagationPoster36 citations
- Removing Clouds and Recovering Ground Observations in Satellite Image Sequences via Temporally Contiguous Robust Matrix CompletionPoster36 citations
- Action Recognition in Video Using Sparse Coding and Relative FeaturesPoster35 citations
- Improved Hamming Distance Search Using Variable Length SubstringsPoster35 citations
- Interactive Segmentation on RGBD Images via Cue SelectionSpotlight35 citations
- When Naive Bayes Nearest Neighbors Meet Convolutional Neural NetworksPoster35 citations
- Camera Calibration From Dynamic Silhouettes Using Motion BarcodesPoster34 citations
- Context-Aware Gaussian Fields for Non-Rigid Point Set RegistrationPoster34 citations
- Inextensible Non-Rigid Shape-From-Motion by Second-Order Cone ProgrammingPoster34 citations
- Pull the Plug? Predicting If Computers or Humans Should Segment ImagesPoster34 citations
- Seeing Behind the Camera: Identifying the Authorship of a PhotographPoster34 citations
- The Multiverse Loss for Robust Transfer LearningSpotlight34 citations
- Highway Vehicle Counting in Compressed DomainPoster33 citations
- POD: Discovering Primary Objects in Videos Based on Evolutionary Refinement of Object Recurrence, Background, and Primary Object ModelsPoster33 citations
- Principled Parallel Mean-Field Inference for Discrete Random FieldsPoster33 citations
- Augmented Blendshapes for Real-Time Simultaneous 3D Head Modeling and Facial Motion CapturePoster32 citations
- Hedgehog Shape Priors for Multi-Object SegmentationSpotlight32 citations
- Just Look at the Image: Viewpoint-Specific Surface Normal Prediction for Improved Multi-View ReconstructionSpotlight32 citations
- Learned Binary Spectral Shape Descriptor for 3D Shape CorrespondencePoster32 citations
- Moral Lineage TracingPoster32 citations
- Occlusion Boundary Detection via Deep Exploration of ContextPoster32 citations
- A Direct Least-Squares Solution to the PnP Problem With Unknown Focal LengthPoster31 citations
- Convexity Shape Constraints for Image SegmentationPoster31 citations
- Coordinating Multiple Disparity Proposals for Stereo ComputationPoster31 citations
- Online Reconstruction of Indoor Scenes From RGB-D StreamsPoster31 citations
- Accumulated Stability Voting: A Robust Descriptor From Descriptors of Multiple ScalesPoster29 citations
- Aggregating Image and Text Quantized Correlated ComponentsPoster29 citations
- Automatic Fence Segmentation in Videos of Dynamic ScenesPoster29 citations
- Coherent Parametric Contours for Interactive Video Object SegmentationPoster29 citations
- Fast Detection of Curved Edges at Low SNRPoster29 citations
- Layered Scene Decomposition via the Occlusion-CRFSpotlight29 citations
- Parametric Object Motion From BlurPoster29 citations
- Real-Time Depth Refinement for Specular ObjectsPoster29 citations
- Closed-Form Training of Mahalanobis Distance for Supervised ClusteringOral28 citations
- Isometric Non-Rigid Shape-From-Motion in Linear TimeOral28 citations
- Needle-Match: Reliable Patch Matching Under High UncertaintyPoster28 citations
- Efficient Large-Scale Similarity Search Using Matrix FactorizationPoster27 citations
- Symmetry reCAPTCHAPoster27 citations
- BORDER: An Oriented Rectangles Approach to Texture-Less Object RecognitionPoster26 citations
- Globally Optimal Manhattan Frame Estimation in Real-TimePoster26 citations
- Scene Labeling Using Sparse Precision MatrixPoster26 citations
- Simultaneous Estimation of Near IR BRDF and Fine-Scale Surface GeometrySpotlight26 citations
- Multivariate Regression on the Grassmannian for Predicting Novel DomainsPoster25 citations
- Approximate Log-Hilbert-Schmidt Distances Between Covariance Operators for Image ClassificationPoster24 citations
- Depth From Semi-Calibrated Stereo and DefocusPoster24 citations
- Robust, Real-Time 3D Tracking of Multiple Objects With Similar AppearancesPoster24 citations
- MCMC Shape Sampling for Image Segmentation With Nonparametric Shape PriorsPoster23 citations
- Optimal Relative Pose With Unknown CorrespondencesPoster23 citations
- Progressive Feature Matching With Alternate Descriptor Selection and Correspondence EnrichmentPoster23 citations
- An Efficient Exact-PGA Algorithm for Constant Curvature ManifoldsSpotlight22 citations
- Force From Motion: Decoding Physical Sensation in a First Person VideoOral22 citations
- Functional Faces: Groupwise Dense Correspondence Using Functional MapsPoster22 citations
- Video-Story Composition via Plot AnalysisSpotlight22 citations
- Learning to Select Pre-Trained Deep Representations With Bayesian Evidence FrameworkOral21 citations
- Recognizing Car Fluents From VideoOral21 citations
- Shape Analysis With Hyperbolic Wasserstein DistancePoster21 citations
- A New Finsler Minimal Path Model With Curvature Penalization for Image Segmentation and Closed Contour DetectionPoster20 citations
- Min Norm Point Algorithm for Higher Order MRF-MAP InferenceSpotlight20 citations
- Sample and Filter: Nonparametric Scene Parsing via Efficient FilteringPoster20 citations
- Similarity Metric For Curved Shapes In Euclidean SpacePoster20 citations
- Trace Quotient Meets Sparsity: A Method for Learning Low Dimensional Image RepresentationsPoster20 citations
- Active Learning for Delineation of Curvilinear StructuresPoster19 citations
- Learning to Localize Little LandmarksPoster19 citations
- Linear Shape Deformation Models With Local Support Using Graph-Based Structured Matrix FactorisationSpotlight19 citations
- Metric Learning as Convex Combinations of Local Models With Generalization GuaranteesPoster19 citations
- Predicting When Saliency Maps Are Accurate and Eye Fixations ConsistentPoster19 citations
- Robust Multi-Body Feature Tracker: A Segmentation-Free ApproachSpotlight19 citations
- Learning to Co-Generate Object Proposals With a Deep Structured NetworkPoster18 citations
- Thin-Slicing for Pose: Learning to Understand Pose Without Explicit Pose EstimationSpotlight18 citations
- 6D Dynamic Camera Relocalization From Single Reference ImagePoster17 citations
- An Empirical Evaluation of Current Convolutional Architectures' Ability to Manage Nuisance Location and Scale VariabilityPoster17 citations
- Information-Driven Adaptive Structured-Light ScannersOral17 citations
- Kinematic Structure Correspondences via Hypergraph MatchingPoster17 citations
- Variable Aperture Light Field Photography: Overcoming the Diffraction-Limited Spatio-Angular Resolution TradeoffPoster17 citations
- Large Scale Hard Sample Mining With Monte Carlo Tree SearchPoster16 citations
- Amplitude Modulated Video Camera - Light Separation in Dynamic ScenesPoster15 citations
- Learning From the Mistakes of Others: Matching Errors in Cross-Dataset LearningSpotlight15 citations
- Piecewise-Planar 3D Approximation From Wide-Baseline StereoPoster15 citations
- ReD-SFA: Relation Discovery Based Slow Feature Analysis for Trajectory ClusteringPoster15 citations
- Subspace Clustering With Priors via Sparse Quadratically Constrained Quadratic ProgrammingPoster15 citations
- What's Wrong With That Object? Identifying Images of Unusual Objects by Modelling the Detection Score DistributionSpotlight15 citations
- Discovering the Physical Parts of an Articulated Object Class From Multiple VideosPoster14 citations
- Homography Estimation From the Common Self-Polar Triangle of Separate EllipsesPoster14 citations
- In the Shadows, Shape Priors Shine: Using Occlusion to Improve Multi-Region SegmentationPoster14 citations
- Determining Occlusions From Space and Time Image ReconstructionsPoster13 citations
- Heterogeneous Light FieldsPoster13 citations
- Kernel Approximation via Empirical Orthogonal Decomposition for Unsupervised Feature LearningPoster13 citations
- Shortlist Selection With Residual-Aware Distance Estimator for K-Nearest Neighbor SearchPoster13 citations
- Estimating Correspondences of Deformable Objects "In-The-Wild"Poster12 citations
- UAV Sensor Fusion With Latent-Dynamic Conditional Random Fields in Coronal Plane EstimationPoster12 citations
- Conformal Surface Alignment With Optimal Mobius SearchPoster11 citations
- Spatially Binned ROC: A Comprehensive Saliency MetricPoster11 citations
- Identifying Good Training Data for Self-Supervised Free Space EstimationPoster10 citations
- Learning Reconstruction-Based Remote Gaze EstimationPoster10 citations
- Learnt Quasi-Transitive Similarity for Retrieval From Large Collections of FacesPoster10 citations
- Reconstructing Shapes and Appearances of Thin Film Objects Using RGB ImagesPoster10 citations
- Relaxation-Based Preprocessing Techniques for Markov Random Field InferencePoster10 citations
- Single Image Camera Calibration With Lenticular Arrays for Augmented RealityPoster10 citations
- Constructing Canonical Regions for Fast and Effective View SelectionPoster9 citations
- Coupled Harmonic Bases for Longitudinal Characterization of Brain NetworksPoster9 citations
- Memory Efficient Max Flow for Multi-Label Submodular MRFsPoster9 citations
- On Benefits of Selection Diversity via Bilevel Exclusive SparsityPoster9 citations
- Random Features for Sparse Signal ClassificationSpotlight9 citations
- Trust No One: Low Rank Matrix Factorization Using Hierarchical RANSACPoster9 citations
- Uncalibrated Photometric Stereo by Stepwise Optimization Using Principal Components of Isotropic BRDFsPoster9 citations
- A Paradigm for Building Generalized Models of Human Image Perception Through Data FusionPoster8 citations
- CoMaL: Good Features to Match on Object BoundariesPoster8 citations
- Latent Variable Graphical Model Selection Using Harmonic Analysis: Applications to the Human Connectome Project (HCP)Spotlight8 citations
- Using Spatial Order to Boost the Elimination of Incorrect Feature MatchesPoster8 citations
- Consistency of Silhouettes and Their DualsPoster7 citations
- Estimating Sparse Signals With Smooth Support via Convex Programming and Block SparsityPoster7 citations
- Joint Multiview Segmentation and Localization of RGB-D Images Using Depth-Induced Silhouette ConsistencyPoster7 citations
- Online Learning With Bayesian Classification TreesSpotlight7 citations
- Rotational Crossed-Slit Light FieldPoster7 citations
- Joint Unsupervised Deformable Spatio-Temporal Alignment of SequencesPoster6 citations
- Simultaneous Clustering and Model Selection for Tensor AffinitiesSpotlight6 citations
- Solving Temporal PuzzlesPoster6 citations
- Structured Feature Similarity With Explicit Feature MapPoster6 citations
- Detecting Migrating Birds at NightPoster5 citations
- Detecting Repeating Objects Using Patch Correlation AnalysisPoster5 citations
- Globally Optimal Rigid Intensity Based Registration: A Fast Fourier Domain ApproachPoster5 citations
- Mixture of Bilateral-Projection Two-Dimensional Probabilistic Principal Component AnalysisPoster5 citations
- A Task-Oriented Approach for Cost-Sensitive RecognitionPoster4 citations
- Mirror Surface Reconstruction Under an Uncalibrated CameraPoster4 citations
- Motion From Structure (MfS): Searching for 3D Objects in Cluttered Point TrajectoriesSpotlight4 citations
- Multicamera Calibration From Visible and Mirrored EpipolesPoster4 citations
- Proximal Riemannian Pursuit for Large-Scale Trace-Norm MinimizationPoster4 citations
- Single Image Object Modeling Based on BRDF and R-Surfaces LearningPoster3 citations
- When VLAD Met HilbertPoster3 citations
- Incremental Object Discovery in Time-Varying Image CollectionsPoster1 citations
- Minimizing the Maximal RankPoster1 citations
- Temporal Epipolar RegionsPoster1 citations
- Structured Regression Gradient BoostingPoster
CVPR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.