ICCV 2017 Accepted Papers
The full list of 621 papers accepted at ICCV 2017 (IEEE/CVF International Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 520Spotlight: 56Oral: 45
- Mask R-CNNOral43,311 citations
- Focal Loss for Dense Object DetectionOral38,703 citations
- Unpaired Image-To-Image Translation Using Cycle-Consistent Adversarial NetworksSpotlight27,623 citations
- Grad-CAM: Visual Explanations From Deep Networks via Gradient-Based LocalizationPoster24,144 citations
- Deformable Convolutional NetworksOral7,573 citations
- Least Squares Generative Adversarial NetworksPoster6,527 citations
- Arbitrary Style Transfer in Real-Time With Adaptive Instance NormalizationOral5,672 citations
- StackGAN: Text to Photo-Realistic Image Synthesis With Stacked Generative Adversarial NetworksOral3,996 citations
- Revisiting Unreasonable Effectiveness of Data in Deep Learning EraSpotlight3,433 citations
- Learning Efficient Convolutional Networks Through Network SlimmingPoster3,354 citations
- Channel Pruning for Accelerating Very Deep Neural NetworksPoster3,345 citations
- DualGAN: Unsupervised Dual Learning for Image-To-Image TranslationPoster2,770 citations
- Soft-NMS -- Improving Object Detection With One Line of CodePoster2,622 citations
- Unlabeled Samples Generated by GAN Improve the Person Re-Identification Baseline in VitroSpotlight2,486 citations
- AOD-Net: All-In-One Dehazing NetworkPoster2,408 citations
- RMPE: Regional Multi-Person Pose EstimationPoster2,405 citations
- ThiNet: A Filter Level Pruning Method for Deep Neural Network CompressionPoster2,395 citations
- Learning Spatio-Temporal Representation With Pseudo-3D Residual NetworksPoster2,294 citations
- MemNet: A Persistent Memory Network for Image RestorationSpotlight2,081 citations
- Interpretable Explanations of Black Boxes by Meaningful PerturbationPoster2,028 citations
- How Far Are We From Solving the 2D & 3D Face Alignment Problem? (And a Dataset of 230,000 3D Facial Landmarks)Poster1,952 citations
- Structure-Measure: A New Way to Evaluate Foreground MapsSpotlight1,925 citations
- A Simple yet Effective Baseline for 3D Human Pose EstimationPoster1,880 citations
- The "Something Something" Video Database for Learning and Evaluating Visual Common SensePoster1,878 citations
- Deeper, Broader and Artier Domain GeneralizationPoster1,827 citations
- The Mapillary Vistas Dataset for Semantic Understanding of Street ScenesPoster1,677 citations
- End-To-End Learning of Geometry and Context for Deep Stereo RegressionSpotlight1,619 citations
- Image Super-Resolution Using Dense Skip ConnectionsPoster1,619 citations
- Dense-Captioning Events in VideosPoster1,605 citations
- Learning Background-Aware Correlation Filters for Visual TrackingPoster1,441 citations
- SSD-6D: Making RGB-Based 3D Detection and 6D Pose Estimation Great AgainOral1,284 citations
- Escape From Cells: Deep Kd-Networks for the Recognition of 3D Point Cloud ModelsSpotlight1,268 citations
- EnhanceNet: Single Image Super-Resolution Through Automated Texture SynthesisOral1,263 citations
- Adversarial Examples for Semantic Segmentation and Object DetectionPoster1,248 citations
- Genetic CNNPoster1,186 citations
- Sampling Matters in Deep Embedding LearningPoster1,169 citations
- Photographic Image Synthesis With Cascaded Refinement NetworksOral1,168 citations
- Learning Multi-Attention Convolutional Neural Network for Fine-Grained Image RecognitionOral1,166 citations
- Localizing Moments in Video With Natural LanguagePoster1,155 citations
- Look, Listen and LearnPoster1,154 citations
- Temporal Action Detection With Structured Segment NetworksPoster1,154 citations
- Unified Deep Supervised Domain Adaptation and GeneralizationPoster1,065 citations
- Learning Dynamic Siamese Network for Visual Object TrackingPoster1,046 citations
- BB8: A Scalable, Accurate, Robust to Partial Occlusion Method for Predicting the 3D Poses of Challenging Objects Without Using DepthPoster1,036 citations
- Amulet: Aggregating Multi-Level Convolutional Features for Salient Object DetectionPoster1,024 citations
- Large-Scale Image Retrieval With Attentive Deep Local FeaturesPoster1,017 citations
- Pose-Driven Deep Convolutional Model for Person Re-IdentificationPoster999 citations
- TALL: Temporal Activity Localization via Language QuerySpotlight984 citations
- Low-Shot Visual Recognition by Shrinking and Hallucinating FeaturesSpotlight982 citations
- A Revisit of Sparse Coding Based Anomaly Detection in Stacked RNN FrameworkPoster979 citations
- SVDNet for Pedestrian RetrievalSpotlight974 citations
- R-C3D: Region Convolutional 3D Network for Temporal Activity DetectionPoster960 citations
- Deeply-Learned Part-Aligned Representations for Person Re-IdentificationPoster951 citations
- Learning to Estimate 3D Hand Pose From Single RGB ImagesPoster939 citations
- Video Frame Synthesis Using Deep Voxel FlowOral937 citations
- Octree Generating Networks: Efficient Convolutional Architectures for High-Resolution 3D OutputsPoster925 citations
- RGB-Infrared Cross-Modality Person Re-IdentificationPoster896 citations
- S3FD: Single Shot Scale-Invariant Face DetectorPoster887 citations
- Multi-Modal Factorized Bilinear Pooling With Co-Attention Learning for Visual Question AnsweringPoster885 citations
- HashNet: Deep Learning to Hash by ContinuationPoster876 citations
- Hide-And-Seek: Forcing a Network to Be Meticulous for Weakly-Supervised Object and Action LocalizationPoster876 citations
- Video Frame Interpolation via Adaptive Separable ConvolutionPoster876 citations
- Flow-Guided Feature Aggregation for Video Object DetectionPoster867 citations
- Boosting Image Captioning With AttributesPoster865 citations
- Beyond Face Rotation: Global and Local Perception GAN for Photorealistic and Identity Preserving Frontal View SynthesisPoster849 citations
- Cut, Paste and Learn: Surprisingly Easy Synthesis for Instance DetectionPoster831 citations
- Multi-Task Self-Supervised Visual LearningPoster829 citations
- No Fuss Distance Metric Learning Using ProxiesPoster827 citations
- MUTAN: Multimodal Tucker Fusion for Visual Question AnsweringPoster824 citations
- DeepFuse: A Deep Unsupervised Approach for Exposure Fusion With Extreme Exposure Image PairsPoster823 citations
- DSOD: Learning Deeply Supervised Object Detectors From ScratchPoster820 citations
- Generating High-Quality Crowd Density Maps Using Contextual Pyramid CNNsPoster818 citations
- Towards Diverse and Natural Image Descriptions via a Conditional GANOral804 citations
- PanNet: A Deep Network Architecture for Pan-SharpeningPoster800 citations
- CVAE-GAN: Fine-Grained Image Generation Through Asymmetric TrainingPoster766 citations
- Detect to Track and Track to DetectSpotlight751 citations
- Temporal Generative Adversarial Nets With Singular Value ClippingPoster749 citations
- Towards 3D Human Pose Estimation in the Wild: A Weakly-Supervised ApproachPoster749 citations
- Open Set Domain AdaptationOral744 citations
- Learning to Reason: End-To-End Module Networks for Visual Question AnsweringSpotlight742 citations
- Tracking the Untrackable: Learning to Track Multiple Cues With Long-Term DependenciesPoster721 citations
- Learning From Noisy Labels With DistillationPoster718 citations
- Deep Clustering via Joint Convolutional Autoencoder Embedding and Relative Entropy MinimizationPoster713 citations
- DSLR-Quality Photos on Mobile Devices With Deep Convolutional NetworksPoster693 citations
- MoFA: Model-Based Deep Convolutional Face Autoencoder for Unsupervised Monocular ReconstructionOral688 citations
- Deep Adaptive Image ClusteringOral686 citations
- Incremental Learning of Object Detectors Without Catastrophic ForgettingPoster685 citations
- Unsupervised Representation Learning by Sorting SequencesPoster685 citations
- Deep Metric Learning With Angular LossPoster684 citations
- View Adaptive Recurrent Neural Networks for High Performance Human Action Recognition From Skeleton DataPoster683 citations
- Inferring and Executing Programs for Visual ReasoningOral677 citations
- HydraPlus-Net: Attentive Deep Features for Pedestrian AnalysisPoster674 citations
- Compositional Human Pose RegressionPoster660 citations
- Image-Based Localization Using LSTMs for Structured Feature CorrelationPoster658 citations
- CREST: Convolutional Residual Learning for Visual TrackingPoster652 citations
- Learning Feature Pyramids for Human Pose EstimationPoster645 citations
- Detail-Revealing Deep Video Super-ResolutionOral640 citations
- Scene Graph Generation From Objects, Phrases and Region CaptionsPoster633 citations
- Focusing Attention: Towards Accurate Text Recognition in Natural ImagesPoster626 citations
- SSH: Single Stage Headless Face DetectorPoster620 citations
- 3D Graph Neural Networks for RGBD Semantic SegmentationOral605 citations
- Curriculum Domain Adaptation for Semantic Segmentation of Urban ScenesPoster598 citations
- Playing for BenchmarksSpotlight594 citations
- RankIQA: Learning From Rankings for No-Reference Image Quality AssessmentPoster591 citations
- Semi Supervised Semantic Segmentation Using Generative Adversarial NetworkPoster589 citations
- DeepRoadMapper: Extracting Road Topology From Aerial ImagesPoster579 citations
- Large Pose 3D Face Reconstruction From a Single Image via Direct Volumetric CNN RegressionPoster579 citations
- Improved Image Captioning via Policy Gradient Optimization of SPIDErSpotlight577 citations
- Fast Face-Swap Using Convolutional Neural NetworksPoster573 citations
- Need for Speed: A Benchmark for Higher Frame Rate Object TrackingPoster570 citations
- TURN TAP: Temporal Unit Regression Network for Temporal Action ProposalsPoster567 citations
- VPGNet: Vanishing Point Guided Network for Lane and Road Marking Detection and RecognitionPoster556 citations
- SegFlow: Joint Learning for Video Object Segmentation and Optical FlowPoster554 citations
- Learning Uncertain Convolutional Features for Accurate Saliency DetectionPoster549 citations
- SafetyNet: Detecting and Rejecting Adversarial Examples RobustlyPoster549 citations
- Wavelet-SRNet: A Wavelet-Based CNN for Multi-Scale Face Super ResolutionPoster540 citations
- Drone-Based Object Counting by Spatially Regularized Regional Proposal NetworkPoster535 citations
- A Stagewise Refinement Model for Detecting Salient Objects in ImagesPoster521 citations
- Adversarial Examples Detection in Deep Networks With Convolutional Filter StatisticsPoster512 citations
- Range Loss for Deep Face Recognition With Long-Tailed Training DataPoster512 citations
- Ensemble Deep Learning for Skeleton-Based Action Recognition Using Temporal Sliding LSTM NetworksPoster506 citations
- SurfaceNet: An End-To-End 3D Neural Network for Multiview StereopsisPoster496 citations
- Learning Cooperative Visual Dialog Agents With Deep Reinforcement LearningOral493 citations
- Online Multi-Object Tracking Using CNN-Based Single Object Tracker With Spatial-Temporal Attention MechanismPoster486 citations
- Interpretable Learning for Self-Driving Cars by Visualizing Causal AttentionPoster478 citations
- Stereo DSO: Large-Scale Direct Sparse Visual Odometry With Stereo CamerasPoster473 citations
- Attention-Based Multimodal Fusion for Video DescriptionPoster469 citations
- Dual Motion GAN for Future-Flow Embedded Video PredictionPoster464 citations
- Deep Direct Regression for Multi-Oriented Scene Text DetectionPoster462 citations
- Adversarial PoseNet: A Structure-Aware Convolutional Network for Human Pose EstimationPoster461 citations
- Orientation Invariant Feature Embedding and Spatial Temporal Regularization for Vehicle Re-IdentificationPoster458 citations
- Tube Convolutional Neural Network (T-CNN) for Action Detection in VideosPoster456 citations
- Learning Proximal Operators: Using Denoising Networks for Regularizing Inverse Imaging ProblemsPoster443 citations
- Fast Image Processing With Fully-Convolutional NetworksPoster441 citations
- The Pose Knows: Video Forecasting by Generating Pose FuturesPoster439 citations
- Action Tubelet Detector for Spatio-Temporal Action LocalizationPoster437 citations
- Encoder Based Lifelong LearningPoster437 citations
- Representation Learning by Learning to CountOral430 citations
- Towards Large-Pose Face Frontalization in the WildPoster430 citations
- Colored Point Cloud Registration RevisitedPoster428 citations
- SubUNets: End-To-End Hand Shape and Continuous Sign Language RecognitionSpotlight420 citations
- Interleaved Group ConvolutionsPoster417 citations
- Jointly Attentive Spatial-Temporal Pooling Networks for Video-Based Person Re-IdentificationPoster411 citations
- No More Discrimination: Cross City Adaptation of Road Scene SegmentersPoster410 citations
- One Network to Solve Them All -- Solving Linear Inverse Problems Using Deep Projection ModelsOral410 citations
- Real-Time Hand Tracking Under Occlusion From an Egocentric RGB-D SensorPoster409 citations
- Smart Mining for Deep Metric LearningPoster409 citations
- AutoDIAL: Automatic DomaIn Alignment LayersPoster398 citations
- Unmasking the Abnormal Events in VideoPoster398 citations
- Cross-View Asymmetric Metric Learning for Unsupervised Person Re-IdentificationPoster397 citations
- Single Shot Text Detector With Regional AttentionSpotlight397 citations
- Visual Relationship Detection With Internal and External Linguistic Knowledge DistillationPoster397 citations
- Learning Video Object Segmentation With Visual MemoryOral395 citations
- Multi-Label Image Recognition by Recurrently Discovering Attentional RegionsPoster394 citations
- RDFNet: RGB-D Multi-Level Residual Feature Fusion for Indoor Semantic SegmentationPoster389 citations
- Learning Deep Neural Networks for Vehicle Re-ID With Visual-Spatio-Temporal Path ProposalsPoster384 citations
- Online Real-Time Multiple Spatiotemporal Action Localisation and PredictionPoster384 citations
- Universal Adversarial Perturbations Against Semantic Image SegmentationPoster380 citations
- A Generic Deep Architecture for Single Image Reflection Removal and Image SmoothingPoster379 citations
- Multi-Scale Deep Learning Architectures for Person Re-IdentificationPoster376 citations
- Understanding Low- and High-Level Contributions to Fixation PredictionPoster374 citations
- Joint Bi-Layer Optimization for Single-Image Rain Streak RemovalPoster373 citations
- High-Resolution Shape Completion Using Deep Neural Networks for Global Structure and Local Geometry InferenceSpotlight367 citations
- SceneNet RGB-D: Can 5M Synthetic Images Beat Generic ImageNet Pre-Training on Indoor Segmentation?Poster362 citations
- Hard-Aware Deeply Cascaded EmbeddingSpotlight360 citations
- Multi-Channel Weighted Nuclear Norm Minimization for Real Color Image DenoisingPoster359 citations
- Is Second-Order Information Helpful for Large-Scale Visual Recognition?Poster353 citations
- CoupleNet: Coupling Global Structure With Local Parts for Object DetectionPoster352 citations
- Parallel Tracking and Verifying: A Framework for Real-Time and High Accuracy Visual TrackingPoster352 citations
- Be Your Own Prada: Fashion Synthesis With Structural CoherencePoster346 citations
- Deep Functional Maps: Structured Prediction for Dense Shape CorrespondencePoster345 citations
- A Two Stream Siamese Convolutional Neural Network for Person Re-IdentificationPoster344 citations
- SGN: Sequential Grouping Networks for Instance SegmentationPoster344 citations
- Coherent Online Video Style TransferPoster338 citations
- Illuminating Pedestrians via Simultaneous Detection & SegmentationPoster331 citations
- Semantic Image Synthesis via Adversarial LearningPoster331 citations
- Extreme Clicking for Efficient Object AnnotationPoster330 citations
- Learning to Fuse 2D and 3D Image Cues for Monocular Body Pose EstimationPoster327 citations
- Pixel Recursive Super ResolutionPoster326 citations
- A Joint Intrinsic-Extrinsic Prior Model for RetinexPoster325 citations
- Rotation Equivariant Vector Field NetworksPoster323 citations
- PolyFit: Polygonal Surface Reconstruction From Point CloudsPoster322 citations
- Deep Spatial-Semantic Attention for Fine-Grained Sketch-Based Image RetrievalPoster318 citations
- Temporal Context Network for Activity Localization in VideosPoster318 citations
- Infinite Latent Feature Selection: A Probabilistic Latent Graph-Based Ranking ApproachPoster317 citations
- Identity-Aware Textual-Visual Matching With Latent Co-AttentionPoster315 citations
- Unrestricted Facial Geometry Reconstruction Using Image-To-Image TranslationPoster315 citations
- Associative Domain AdaptationPoster313 citations
- Raster-To-Vector: Revisiting Floorplan TransformationPoster313 citations
- Speaking the Same Language: Matching Machine to Human Captions by Adversarial TrainingPoster311 citations
- Automatic Spatially-Aware Fashion Concept DiscoveryPoster310 citations
- Deep TextSpotter: An End-To-End Trainable Scene Text Localization and Recognition FrameworkPoster309 citations
- An Analysis of Visual Question Answering AlgorithmsPoster297 citations
- Learning to Synthesize a 4D RGBD Light Field From a Single ImageSpotlight297 citations
- BIER - Boosting Independent Embeddings RobustlyOral296 citations
- Recurrent Multimodal Interaction for Referring Image SegmentationPoster296 citations
- Joint Detection and Recounting of Abnormal Events by Learning Deep Generic KnowledgePoster295 citations
- A Two-Streamed Network for Estimating Fine-Scaled Depth Maps From Single RGB ImagesPoster294 citations
- Robust Video Super-Resolution With Learned Temporal DynamicsPoster289 citations
- A Generative Model of People in ClothingSpotlight288 citations
- Exploiting Spatial Structure for Localizing Manipulated Image RegionsPoster288 citations
- Learning Policies for Adaptive Tracking With Deep Feature CascadesSpotlight282 citations
- Semantic Video CNNs Through Representation WarpingOral280 citations
- Binarized Convolutional Landmark Localizers for Human Pose Estimation and Face Alignment With Limited ResourcesOral279 citations
- Learning to Super-Resolve Blurry Face and Text ImagesPoster279 citations
- Predicting Deeper Into the Future of Semantic SegmentationPoster278 citations
- Chained Multi-Stream Networks Exploiting Pose, Motion, and Appearance for Action Classification and DetectionPoster277 citations
- FCN-rLSTM: Deep Spatio-Temporal Neural Networks for Vehicle Counting in City CamerasPoster272 citations
- Towards End-To-End Text Spotting With Convolutional Recurrent Neural NetworksSpotlight270 citations
- Areas of Attention for Image CaptioningPoster267 citations
- 3D-PRNN: Generating Shape Primitives With Recurrent Neural NetworksPoster265 citations
- Class Rectification Hard Mining for Imbalanced Deep LearningPoster265 citations
- BlitzNet: A Real-Time Deep Network for Scene UnderstandingPoster264 citations
- Recurrent Topic-Transition GAN for Visual Paragraph GenerationPoster264 citations
- Joint Convolutional Analysis and Synthesis Sparse Representation for Single Image Layer SeparationPoster258 citations
- Spatiotemporal Modeling for Crowd Counting in VideosPoster258 citations
- Deep Generative Adversarial Compression Artifact RemovalPoster257 citations
- Learning Compact Geometric FeaturesPoster252 citations
- Weakly-Supervised Learning of Visual RelationsOral250 citations
- WordSup: Exploiting Word Annotations for Character Based Text DetectionPoster250 citations
- Factorized Bilinear Models for Image RecognitionPoster248 citations
- Shadow Detection With Conditional Generative Adversarial NetworksOral245 citations
- Higher-Order Integration of Hierarchical Convolutional Activations for Fine-Grained Visual CategorizationPoster240 citations
- Long Short-Term Memory Kalman Filters: Recurrent Neural Estimators for Pose RegularizationPoster237 citations
- Learning in an Uncertain World: Representing Ambiguity Through Multiple HypothesesPoster235 citations
- Fashion Forward: Forecasting Visual Style in FashionPoster234 citations
- A Coarse-Fine Network for Keypoint LocalizationSpotlight232 citations
- Lattice Long Short-Term Memory for Human Action RecognitionPoster232 citations
- Phrase Localization and Visual Relationship Detection With Comprehensive Image-Language CuesPoster230 citations
- RPAN: An End-To-End Recurrent Pose-Attention Network for Action Recognition in VideosOral229 citations
- 2D-Driven 3D Object Detection in RGB-D ImagesPoster226 citations
- Attention-Aware Deep Reinforcement Learning for Video Face RecognitionPoster226 citations
- Efficient Low Rank Tensor Ring CompletionPoster226 citations
- Neural Person Search MachinesPoster226 citations
- Dynamic Label Graph Matching for Unsupervised Video Re-IdentificationPoster224 citations
- Pixel-Level Matching for Video Object Segmentation Using Convolutional Neural NetworksPoster219 citations
- Predicting Visual Exemplars of Unseen Classes for Zero-Shot LearningPoster219 citations
- Scale-Adaptive Convolutions for Scene ParsingPoster218 citations
- TorontoCity: Seeing the World With a Million EyesSpotlight217 citations
- Transitive Invariance for Self-Supervised Visual Representation LearningPoster216 citations
- RoomNet: End-To-End Room Layout EstimationPoster215 citations
- Scaling the Scattering Transform: Deep Hybrid NetworksPoster214 citations
- Shape Inpainting Using 3D Generative Adversarial Network and Recurrent Convolutional NetworksPoster214 citations
- Encouraging LSTMs to Anticipate Actions Very EarlyPoster212 citations
- Towards More Accurate Iris Recognition Using Deeply Learned Spatially Corresponding FeaturesSpotlight212 citations
- Benchmarking and Error Diagnosis in Multi-Instance Pose EstimationPoster211 citations
- Stepwise Metric Promotion for Unsupervised Video Person Re-IdentificationPoster210 citations
- Learning Robust Visual-Semantic EmbeddingsPoster209 citations
- Benchmarking Single-Image Reflection Removal AlgorithmsPoster208 citations
- Spatial Memory for Context Reasoning in Object DetectionPoster204 citations
- BodyFusion: Real-Time Capture of Human Motion and Surface Geometry Using a Single Depth CameraPoster200 citations
- Towards Context-Aware Interaction Recognition for Visual Relationship DetectionPoster199 citations
- Fine-Grained Recognition in the Wild: A Multi-Task Domain Adaptation ApproachPoster197 citations
- Online Video Deblurring via Dynamic Temporal Blending NetworkPoster197 citations
- Efficient Global 2D-3D Matching for Camera Localization in a Large-Scale 3D MapPoster195 citations
- Hierarchical Multimodal LSTM for Dense Visual-Semantic EmbeddingPoster195 citations
- Towards a Visual Privacy Advisor: Understanding and Predicting Privacy Risks in ImagesPoster194 citations
- Turning Corners Into Cameras: Principles and MethodsSpotlight194 citations
- BAM! The Behance Artistic Media Dataset for Recognition Beyond PhotographyPoster191 citations
- Bounding Boxes, Segmentations and Object Coordinates: How Important Is Recognition for 3D Scene Flow Estimation in Autonomous Driving Scenarios?Poster189 citations
- Reconstruction-Based Disentanglement for Pose-Invariant Face RecognitionPoster189 citations
- Coordinating Filters for Faster Deep Neural NetworksPoster188 citations
- Segmentation-Aware Convolutional Networks Using Local Attention MasksPoster188 citations
- Regional Interactive Image Segmentation NetworksPoster187 citations
- Learning Visual Attention to Identify People With Autism Spectrum DisorderPoster186 citations
- Supervision by Fusion: Towards Unsupervised Learning of Deep Salient Object DetectorPoster186 citations
- Learning a Recurrent Residual Fusion Network for Multimodal MatchingPoster184 citations
- Adversarial Image Perturbation for Privacy Protection -- A Game Theory PerspectivePoster183 citations
- Show, Adapt and Tell: Adversarial Training of Cross-Domain Image CaptionerPoster183 citations
- Two-Phase Learning for Weakly Supervised Object LocalizationPoster183 citations
- Attribute Recognition by Joint Recurrent Learning of Context and CorrelationPoster181 citations
- Learning Blind Motion DeblurringPoster181 citations
- Soft Proposal Networks for Weakly Supervised Object LocalizationPoster181 citations
- Unsupervised Learning of Object Landmarks by Factorized Spatial EmbeddingsOral181 citations
- Situation Recognition With Graph Neural NetworksPoster180 citations
- Blur-Invariant Deep Learning for Blind-DeblurringPoster179 citations
- An Empirical Study of Language CNN for Image CaptioningPoster178 citations
- Online Video Object Detection Using Association LSTMPoster178 citations
- Visual Semantic Planning Using Deep Successor RepresentationsPoster178 citations
- PPR-FCN: Weakly Supervised Visual Relation Detection via Parallel Pairwise R-FCNPoster177 citations
- Submodular Trajectory Optimization for Aerial 3D ScanningPoster177 citations
- Cascaded Feature Network for Semantic Segmentation of RGB-D ImagesPoster175 citations
- Monocular Free-Head 3D Gaze Tracking With Deep Learning and Geometry ConstraintsPoster175 citations
- Personalized Image AestheticsPoster175 citations
- Convolutional Dictionary Learning via Local ProcessingSpotlight174 citations
- SCNet: Learning Semantic CorrespondencePoster174 citations
- Semantic Jitter: Dense Supervision for Visual Comparisons via Synthetic ImagesPoster174 citations
- Transformed Low-Rank Model for Line Pattern Noise RemovalPoster174 citations
- Learning Spread-Out Local Feature DescriptorsSpotlight173 citations
- Unsupervised Learning of Stereo MatchingPoster172 citations
- VegFru: A Domain-Specific Dataset for Fine-Grained Visual CategorizationPoster172 citations
- Adversarial Inverse Graphics Networks: Learning 2D-To-3D Lifting and Image-To-Image Translation From Unpaired SupervisionPoster170 citations
- First-Person Activity Forecasting With Online Inverse Reinforcement LearningOral169 citations
- Learning Visual N-Grams From Web DataPoster167 citations
- Exploiting Multi-Grain Ranking Constraints for Precisely Searching Visually-Similar VehiclesPoster166 citations
- What Actions Are Needed for Understanding Human Actions in Videos?Poster165 citations
- 3DCNN-DQN-RNN: A Deep Reinforcement Learning Framework for Semantic Parsing of Large-Scale 3D Point CloudsPoster162 citations
- Should We Encode Rain Streaks in Video as Deterministic or Stochastic?Poster162 citations
- Revisiting IM2GPS in the Deep Learning EraPoster161 citations
- Monocular 3D Human Pose Estimation by Predicting Depth on JointsPoster158 citations
- Characterizing and Improving Stability in Neural Style TransferPoster157 citations
- Referring Expression Generation and Comprehension via AttributesPoster156 citations
- Video Scene Parsing With Predictive Feature LearningPoster156 citations
- DeNet: Scalable Real-Time Object Detection With Directed Sparse SamplingPoster154 citations
- Learned Multi-Patch SimilarityPoster152 citations
- Faster Than Real-Time Facial Alignment: A 3D Spatial Transformer Network Approach in Unconstrained PosesPoster149 citations
- A 3D Morphable Model of Craniofacial Shape and Texture VariationPoster148 citations
- GANs for Biological Image SynthesisSpotlight147 citations
- Unsupervised Domain Adaptation for Face Recognition in Unlabeled VideosPoster147 citations
- Real-Time Monocular Pose Estimation of 3D Objects Using Temporally Consistent Local Color HistogramsPoster145 citations
- VQS: Linking Segmentations to Questions and Answers for Supervised Attention in VQA and Question-Focused Semantic SegmentationPoster145 citations
- Reconfiguring the Imaging Pipeline for Computer VisionPoster143 citations
- Pose-Invariant Face Alignment With a Single CNNPoster142 citations
- Query-Guided Regression Network With Context Policy for Phrase GroundingSpotlight142 citations
- Learning Action Recognition Model From Depth and Skeleton VideosPoster141 citations
- Adaptive RNN Tree for Large-Scale Human Action RecognitionPoster140 citations
- Multi-Label Learning of Part Detectors for Heavily Occluded Pedestrian DetectionPoster140 citations
- Tracking as Online Decision-Making: Learning a Policy From Streaming Videos With Reinforcement LearningPoster140 citations
- Deep Cropping via Attention Box Prediction and Aesthetics AssessmentPoster138 citations
- Real Time Eye Gaze Tracking With 3D Deformable Eye-Face ModelPoster138 citations
- Nonparametric Variational Auto-Encoders for Hierarchical Representation LearningPoster137 citations
- Performance Guaranteed Network Acceleration via High-Order Residual QuantizationPoster137 citations
- Intrinsic3D: High-Quality 3D Reconstruction by Joint Appearance and Geometry Optimization With Spatially-Varying LightingPoster136 citations
- Generative Adversarial Networks Conditioned by Brain SignalsPoster134 citations
- Open Vocabulary Scene ParsingPoster133 citations
- SBGAR: Semantics Based Group Activity RecognitionPoster133 citations
- A Read-Write Memory Network for Movie Story UnderstandingPoster132 citations
- Structured Attentions for Visual Question AnsweringPoster132 citations
- Curriculum DropoutPoster130 citations
- Non-Uniform Blind Deblurring by ReblurringPoster129 citations
- Learning Discriminative Latent Attributes for Zero-Shot ClassificationPoster128 citations
- Deep Occlusion Reasoning for Multi-Camera Multi-Target DetectionPoster127 citations
- Learning to Push the Limits of Efficient FFT-Based Image DeconvolutionSpotlight127 citations
- Unsupervised Adaptation for Deep StereoPoster126 citations
- From RGB to Spectrum for Natural Scenes via Manifold-Based MappingPoster125 citations
- Weakly Supervised Summarization of Web VideosPoster124 citations
- ChromaTag: A Colored Marker and Fast Detection AlgorithmPoster123 citations
- Predicting Human Activities Using Stochastic GrammarPoster123 citations
- Temporal Non-Volume Preserving Approach to Facial Age-Progression and Age-Invariant Face RecognitionOral123 citations
- Egocentric Gesture Recognition Using Recurrent 3D Convolutional Neural Networks With Spatiotemporal Transformer ModulesSpotlight122 citations
- Learning High Dynamic Range From Outdoor PanoramasOral121 citations
- MarioQA: Answering Questions by Watching Gameplay VideosPoster121 citations
- Non-Linear Convolution Filters for CNN-Based LearningPoster121 citations
- Rethinking Reprojection: Closing the Loop for Pose-Aware Shape Reconstruction From a Single ImageSpotlight121 citations
- MIHash: Online Hashing With Mutual InformationPoster119 citations
- Video Deblurring via Semantic Segmentation and Pixel-Wise Non-Linear KernelPoster117 citations
- Realistic Dynamic Facial Textures From a Single Image Using GANsPoster116 citations
- Deep Dual Learning for Semantic Image SegmentationPoster115 citations
- Following Gaze in VideoPoster115 citations
- Neural EPI-Volume Networks for Shape From Light FieldSpotlight115 citations
- Single Image Action Recognition Using Semantic Body Part ActionsPoster115 citations
- Ensemble Diffusion for RetrievalOral114 citations
- Learning the Latent "Look": Unsupervised Discovery of a Style-Coherent Embedding From Fashion ImagesPoster114 citations
- Interpretable Transformations With Encoder-Decoder NetworksPoster113 citations
- Blind Image Deblurring With Outlier HandlingPoster112 citations
- MirrorFlow: Exploiting Symmetries in Joint Optical Flow and Occlusion EstimationPoster110 citations
- Distributed Very Large Scale Bundle Adjustment by Global Camera ConsensusOral109 citations
- Joint Prediction of Activity Labels and Starting Times in Untrimmed VideosPoster109 citations
- Recurrent Scale Approximation for Object Detection in CNNPoster109 citations
- Spatial-Aware Object Embeddings for Zero-Shot Localization and Classification of ActionsOral109 citations
- Temporal Dynamic Graph LSTM for Action-Driven Video Object DetectionPoster108 citations
- Am I a Baller? Basketball Performance Assessment From First-Person VideosPoster106 citations
- Dense and Low-Rank Gaussian CRFs Using Deep EmbeddingsPoster106 citations
- Joint Discovery of Object States and Manipulation ActionsPoster106 citations
- Weakly- and Self-Supervised Learning for Content-Aware Deep Image RetargetingSpotlight106 citations
- Detecting Faces Using Inside Cascaded Contextual CNNPoster105 citations
- Material Editing Using a Physically Based Rendering NetworkSpotlight105 citations
- DualNet: Learn Complementary Features for Image RecognitionPoster103 citations
- Self-Organized Text Detection With Minimal Post-Processing via Border LearningPoster103 citations
- WeText: Scene Text Detection Under Weak SupervisionPoster103 citations
- What Will Happen Next? Forecasting Player Moves in Sports VideosPoster103 citations
- SUBIC: A Supervised, Structured Binary Code for Image SearchSpotlight102 citations
- Attribute-Enhanced Face Recognition With Neural Tensor Fusion NetworksSpotlight100 citations
- Dual-Glance Model for Deciphering Social RelationshipsPoster100 citations
- On-Demand Learning for Deep Image RestorationPoster100 citations
- Non-Markovian Globally Consistent Multi-Object TrackingPoster99 citations
- Paying Attention to Descriptions Generated by Image Captioning ModelsPoster99 citations
- Efficient Online Local Metric Adaptation via Negative Samples for Person Re-IdentificationPoster98 citations
- Active Learning for Human Pose EstimationPoster96 citations
- Learning Bag-Of-Features Pooling for Deep Convolutional Neural NetworksPoster93 citations
- Quantitative Evaluation of Confidence Measures in a Machine Learning WorldSpotlight93 citations
- Learning-Based Cloth Material Recovery From VideoPoster92 citations
- Pose Guided RGBD Feature Learning for 3D Object Pose EstimationPoster91 citations
- When Unsupervised Domain Adaptation Meets Tensor RepresentationsPoster89 citations
- Centered Weight Normalization in Accelerating Training of Deep Neural NetworksPoster88 citations
- Weakly Supervised Object Localization Using Things and Stuff TransferPoster87 citations
- Learning 3D Object Categories by Looking Around ThemOral86 citations
- Privacy-Preserving Visual Learning Using Doubly Permuted Homomorphic EncryptionPoster86 citations
- Attentive Semantic Video Generation Using CaptionsPoster85 citations
- Learning Long-Term Dependencies for Action Recognition With a Biologically-Inspired Deep NetworkPoster85 citations
- Attributes2Classname: A Discriminative Model for Attribute-Based Unsupervised Zero-Shot LearningPoster84 citations
- PathTrack: Fast Trajectory Annotation With Path SupervisionPoster83 citations
- Robust Hand Pose Estimation During the Interaction With an Unknown ObjectPoster83 citations
- Rolling-Shutter-Aware Differential SfM and Image RectificationPoster83 citations
- Rotational Subgroup Voting and Pose Clustering for Robust 3D Object RecognitionPoster83 citations
- Unsupervised Action Discovery and Localization in VideosPoster83 citations
- DeepContext: Context-Encoding Neural Pathways for 3D Holistic Scene UnderstandingPoster82 citations
- Human Pose Estimation Using Global and Local NormalizationPoster82 citations
- Scale Recovery for Monocular Visual Odometry Using Depth Estimated With Deep Convolutional Neural FieldsPoster81 citations
- AMTnet: Action-Micro-Tube Regression by End-To-End Trainable Deep ArchitecturePoster80 citations
- Aesthetic Critiques Generation for PhotosPoster80 citations
- Domain-Adaptive Deep Network CompressionPoster80 citations
- Learning Dense Facial Correspondences in Unconstrained ImagesPoster80 citations
- Chained Cascade Network for Object DetectionPoster79 citations
- Deltille Grids for Geometric Camera CalibrationPoster79 citations
- Multi-View Dynamic Shape Refinement Using Local Temporal IntegrationPoster78 citations
- Joint Learning of Object and Action DetectorsPoster77 citations
- Sketching With Style: Visual Search With Sketches and Aesthetic ContextPoster77 citations
- TORNADO: A Spatio-Temporal Convolutional Regression Network for Video Action ProposalPoster77 citations
- Robust Object Tracking Based on Temporal and Spatial Deep NetworksPoster76 citations
- Visual Forecasting by Imitating Dynamics in Natural SequencesSpotlight76 citations
- DeepCoder: Semi-Parametric Variational Autoencoders for Automatic Facial Action CodingPoster75 citations
- Locally-Transferred Fisher Vectors for Texture ClassificationPoster75 citations
- Multi-Stage Multi-Recursive-Input Fully Convolutional Networks for Neuronal Boundary DetectionPoster75 citations
- Monocular Dense 3D Reconstruction of a Complex Dynamic Scene From Two Perspective FramesPoster74 citations
- Globally-Optimal Inlier Set Maximisation for Simultaneous Camera Pose and Feature CorrespondenceOral73 citations
- Practical and Efficient Multi-View MatchingSpotlight73 citations
- Reflectance Capture Using Univariate Sampling of BRDFsPoster73 citations
- See the Glass Half Full: Reasoning About Liquid Containers, Their Volume and ContentPoster73 citations
- Semantic Line Detection and Its ApplicationsPoster73 citations
- Anchored Regression Networks Applied to Age Estimation and Super ResolutionPoster72 citations
- Making Minimal Solvers for Absolute Pose Estimation Compact and RobustPoster72 citations
- Recurrent Color ConstancyPoster72 citations
- Decoder Network Over Lightweight Reconstructed Feature for Fast Semantic Style TransferPoster71 citations
- ProbFlow: Joint Optical Flow and Uncertainty EstimationPoster71 citations
- Spatio-Temporal Person Retrieval via Natural Language QueriesPoster71 citations
- Scene Parsing With Global Context EmbeddingPoster70 citations
- Look, Perceive and Segment: Finding the Salient Objects in Images via Two-Stream Fixation-Semantic CNNsPoster69 citations
- Delving Into Salient Object Subitizing and DetectionPoster68 citations
- Introspective Neural Networks for Generative ModelingPoster68 citations
- A Unified Model for Near and Remote SensingPoster67 citations
- Estimating Defocus Blur via Rank of Local PatchesPoster67 citations
- SORT: Second-Order Response Transform for Visual RecognitionPoster67 citations
- Deep Scene Image Classification With the MFAFVNetPoster66 citations
- Group Re-Identification via Unsupervised Transfer of Sparse Features EncodingPoster66 citations
- FoveaNet: Perspective-Aware Urban Scene ParsingOral65 citations
- Unsupervised Learning From Video to Detect Foreground Objects in Single ImagesPoster65 citations
- Fast Multi-Image Matching via Density-Based ClusteringPoster64 citations
- Recurrent 3D-2D Dual Learning for Large-Pose Facial Landmark DetectionPoster64 citations
- From Point Clouds to Mesh Using RegressionPoster63 citations
- Learning Discriminative Aggregation Network for Video-Based Face RecognitionSpotlight63 citations
- A Self-Balanced Min-Cut Algorithm for Image ClusteringPoster62 citations
- Recognition of Action Units in the Wild With Deep Nets and a New Global-Local LossPoster62 citations
- Deep Binaries: Encoding Semantic-Rich Cues for Efficient Textual-Visual Cross RetrievalPoster61 citations
- Directionally Convolutional Networks for 3D Shape SegmentationPoster61 citations
- Filter Selection for Hyperspectral EstimationPoster61 citations
- Joint Estimation of Camera Pose, Depth, Deblurring, and Super-Resolution From a Blurred Image SequencePoster61 citations
- Low-Dimensionality Calibration Through Local Anisotropic Scaling for Robust Hand Model PersonalizationPoster61 citations
- Semi-Global Weighted Least Squares in Image FilteringPoster61 citations
- Unsupervised Creation of Parameterized AvatarsOral61 citations
- Super-Trajectory for Video SegmentationPoster60 citations
- Recursive Spatial Transformer (ReST) for Alignment-Free Face RecognitionSpotlight59 citations
- Cross-Modal Deep Variational HashingPoster58 citations
- What Is Around the Camera?Poster58 citations
- A Lightweight Approach for On-The-Fly Reflectance EstimationOral57 citations
- Learning Gaze Transitions From Depth to Improve Video Saliency EstimationPoster57 citations
- End-To-End Face Detection and Cast Grouping in Movies Using Erdos-Renyi ClusteringSpotlight56 citations
- Increasing CNN Robustness to Occlusions by Reducing Filter SupportPoster56 citations
- Joint Adaptive Sparsity and Low-Rankness on the Fly: An Online Tensor Reconstruction Scheme for Video DenoisingPoster56 citations
- ScaleNet: Guiding Object Proposal Generation in Supermarkets and BeyondPoster56 citations
- Complex Event Detection by Identifying Reliable Shots From Untrimmed VideosPoster55 citations
- Depth and Image Restoration From Light Field in a Scattering MediumPoster55 citations
- Learned Watershed: End-To-End Learning of Seeded SegmentationPoster55 citations
- Learning From Video and Text via Large-Scale Discriminative ClusteringSpotlight54 citations
- Weakly Supervised Learning of Deep Metrics for Stereo ReconstructionPoster54 citations
- Active Decision Boundary Annotation With Deep Generative ModelsSpotlight53 citations
- DCTM: Discrete-Continuous Transformation Matching for Semantic FlowOral53 citations
- DeepSetNet: Predicting Sets With Deep Neural NetworksSpotlight53 citations
- Jointly Recognizing Object Fluents and Tasks in Egocentric VideosPoster53 citations
- Neural Ctrl-F: Segmentation-Free Query-By-String Word Spotting in Handwritten Manuscript CollectionsPoster53 citations
- Surface Normals in the WildPoster53 citations
- Generalized Orderless Pooling Performs Implicit Salient MatchingPoster52 citations
- PUnDA: Probabilistic Unsupervised Domain Adaptation for Knowledge Transfer Across Visual CategoriesPoster51 citations
- Rolling Shutter Correction in Manhattan WorldPoster51 citations
- A Novel Space-Time Representation on the Positive Semidefinite Cone for Facial Expression RecognitionPoster50 citations
- Consensus Convolutional Sparse CodingPoster50 citations
- Point Set Registration With Global-Local Correspondence and Transformation EstimationPoster50 citations
- DeepCD: Learning Deep Complementary Descriptors for Patch RepresentationsPoster49 citations
- Learning Hand Articulations by Hallucinating Heat DistributionPoster49 citations
- Temporal Tessellation: A Unified Approach for Video AnalysisSpotlight49 citations
- Polynomial Solvers for Saturated IdealsPoster48 citations
- Beyond Planar Symmetry: Modeling Human Perception of Reflection and Rotation Symmetries in the WildOral47 citations
- Bringing Background Into the Foreground: Making All Classes Equal in Weakly-Supervised Video Semantic SegmentationPoster47 citations
- Progressive Large Scale-Invariant Image Matching in Scale SpacePoster47 citations
- Understanding and Mapping Natural BeautyPoster47 citations
- Video Reflection Removal Through Spatio-Temporal OptimizationPoster46 citations
- FLaME: Fast Lightweight Mesh Estimation Using Variational Smoothing on Delaunay GraphsPoster45 citations
- Synergy Between Face Alignment and Tracking via Discriminative Global Consensus OptimizationSpotlight45 citations
- Depth Estimation Using Structured Light Flow -- Analysis of Projected Pattern Flow on an Object's SurfacePoster44 citations
- Generative Modeling of Audible Shapes for Object PerceptionPoster44 citations
- Probabilistic Structure From Motion With Objects (PSfMO)Poster44 citations
- Convergence Analysis of MAP Based Blur Kernel EstimationPoster43 citations
- Unsupervised Object Segmentation in Video by Efficient Selection of Highly Probable Positive FeaturesPoster43 citations
- AMAT: Medial Axis Transform for Natural ImagesPoster41 citations
- Deep Growing LearningPoster41 citations
- Mutual Enhancement for Detection of Multiple Logos in Sports VideosPoster40 citations
- A Spatiotemporal Oriented Energy Network for Dynamic Texture RecognitionSpotlight39 citations
- Face Sketch Matching via Coupled Deep Transform LearningPoster39 citations
- Self-Paced Kernel Estimation for Robust Blind Image DeblurringPoster39 citations
- Composite Focus Measure for High Quality Depth MapsPoster38 citations
- Learning Discriminative Data Fitting Functions for Blind Image DeblurringPoster38 citations
- Adaptive Feeding: Achieving Fast and Accurate Detections by Adaptively Combining Object DetectorsPoster37 citations
- Robust Pseudo Random Fields for Light-Field Stereo MatchingOral37 citations
- Semantically Informed Multiview Surface RefinementPoster37 citations
- Visual Transformation Aided Contrastive Learning for Video-Based Kinship VerificationPoster37 citations
- Deep Facial Action Unit Recognition From Partially Labeled DataPoster36 citations
- Higher-Order Minimum Cost Lifted Multicuts for Motion SegmentationPoster36 citations
- Linear Differential Constraints for Photo-Polarimetric Height EstimationSpotlight36 citations
- SHaPE: A Novel Graph Theoretic Algorithm for Making Consensus-Based Decisions in Person Re-Identification SystemsPoster36 citations
- Scene Categorization With Spectral FeaturesPoster36 citations
- Trespassing the Boundaries: Labeling Temporal Bounds for Object Interactions in Egocentric VideoPoster36 citations
- Zero-Order Reverse FilteringPoster36 citations
- Offline Handwritten Signature Modeling and Verification Based on Archetypal AnalysisPoster35 citations
- Recurrent Models for Situation RecognitionPoster35 citations
- Visual Odometry for Pixel Processor ArraysSpotlight35 citations
- Refractive Structure-From-Motion Through a Flat Refractive InterfacePoster34 citations
- Revisiting Cross-Channel Information Transfer for Chromatic Aberration CorrectionPoster34 citations
- Corner-Based Geometric Calibration of Multi-Focus Plenoptic CamerasPoster33 citations
- Deep Determinantal Point Process for Large-Scale Multi-Label ClassificationPoster33 citations
- Embedding 3D Geometric Features for Rigid Object Part SegmentationPoster33 citations
- High Order Tensor Formulation for Convolutional Sparse CodingPoster33 citations
- Unsupervised Learning of Important Objects From First-Person VideosPoster33 citations
- Anticipating Daily Intention Using On-Wrist Motion Triggered SensingSpotlight32 citations
- Self-Supervised Learning of Pose Embeddings From Spatiotemporal Relations in VideosPoster32 citations
- Learning to Disambiguate by Asking Discriminative QuestionsPoster31 citations
- Misalignment-Robust Joint Filter for Cross-Modal Image PairsPoster31 citations
- Low Compute and Fully Parallel Computer Vision With HashMatchPoster30 citations
- Primary Video Object Segmentation via Complementary CNNs and Neighborhood Reversible FlowPoster30 citations
- GPLAC: Generalizing Vision-Based Robotic Skills Using Weakly Labeled ImagesPoster29 citations
- Modelling the Scene Dependent Imaging in Cameras With a Deep Neural NetworkPoster29 citations
- A Microfacet-Based Reflectance Model for Photometric Stereo With Highly Specular SurfacesPoster28 citations
- A Multimodal Deep Regression Bayesian Network for Affective Video Content AnalysesPoster28 citations
- From Square Pieces to Brick Walls: The Next Challenge in Solving Jigsaw PuzzlesPoster28 citations
- Infant Footprint RecognitionPoster28 citations
- Joint Layout Estimation and Global Multi-View Registration for Indoor ReconstructionPoster28 citations
- Learning View-Invariant Features for Person Identification in Temporally Synchronized Videos Taken by Wearable CamerasPoster28 citations
- Makeup-Go: Blind Reversion of Portrait EditOral28 citations
- Moving Object Detection in Time-Lapse or Motion Trigger Image Sequences Using Low-Rank and Invariant Sparse DecompositionPoster28 citations
- Ray Space Features for Plenoptic Structure-From-MotionPoster27 citations
- Beyond Standard Benchmarks: Parameterizing Performance Evaluation in Visual Object TrackingPoster26 citations
- Non-Rigid Object Tracking via Deformable Patches Using Shape-Preserved KCF and Level SetsPoster26 citations
- Aligned Image-Word Representations Improve Inductive Transfer Across Vision-Language TasksPoster25 citations
- Sublabel-Accurate Discretization of Nonconvex Free-Discontinuity ProblemsPoster25 citations
- Taking the Scenic Route to 3D: Optimising Reconstruction From Moving CamerasPoster25 citations
- Dense Non-Rigid Structure-From-Motion and Shading With Unknown AlbedosPoster24 citations
- Non-Convex Rank/Sparsity Regularization and Local MinimaPoster24 citations
- A Multilayer-Based Framework for Online Background Subtraction With Freely Moving CamerasPoster23 citations
- Tensor RPCA by Bayesian CP Factorization With Complex NoisePoster23 citations
- Unsupervised Video Understanding by Reconciliation of Posture SimilaritiesPoster23 citations
- A Lightweight Single-Camera Polarization Compass With Covariance EstimationPoster22 citations
- CAD Priors for Accurate and Flexible Instance ReconstructionPoster22 citations
- Object-Level ProposalsPoster22 citations
- Practical Projective Structure From Motion (P2SfM)Oral22 citations
- Modeling Urban Scenes From PointcloudsPoster21 citations
- Monocular Video-Based Trailer Coupler Detection Using Multiplexer Convolutional Neural NetworkPoster21 citations
- "Maximizing Rigidity" Revisited: A Convex Programming Approach for Generic 3D Shape Reconstruction From Multiple Perspective ViewsPoster20 citations
- Click Here: Human-Localized Keypoints as Guidance for Viewpoint EstimationPoster20 citations
- Parameter-Free Lens Distortion Calibration of Central CamerasPoster20 citations
- Personalized Cinemagraphs Using Semantic Understanding and Collaborative LearningPoster19 citations
- Efficient Algorithms for Moral Lineage TracingPoster18 citations
- Efficient Global Illumination for Morphable ModelsPoster18 citations
- Focal Track: Depth and Accommodation With Oscillating Lens DeformationPoster18 citations
- Learning for Active 3D MappingOral18 citations
- Robust Kronecker-Decomposable Component Analysis for Low-Rank ModelingPoster18 citations
- Blob Reconstruction Using Unilateral Second Order Gaussian Kernels With Application to High-ISO Long-Exposure Image DenoisingPoster17 citations
- Compressive Quantization for Fast Object Instance Search in VideosPoster17 citations
- Detailed Surface Geometry and Albedo Recovery From RGB-D Video Under Natural IlluminationPoster17 citations
- Towards a Unified Compositional Model for Visual Pattern ModelingPoster17 citations
- Weakly Supervised Manifold Learning for Dense Semantic Object CorrespondencePoster17 citations
- Leveraging Weak Semantic Relevance for Complex Video Event ClassificationPoster16 citations
- Online Robust Image Alignment via Subspace Learning From Gradient OrientationsPoster16 citations
- Reasoning About Fine-Grained Attribute Phrases Using Reference GamesPoster16 citations
- Volumetric Flow Estimation for Incompressible Fluids Using the Stationary Stokes EquationsPoster16 citations
- CDTS: Collaborative Detection, Tracking, and Segmentation for Online Multiple Object Segmentation in VideosPoster15 citations
- High-Quality Correspondence and Segmentation Estimation for Dual-Lens Smart-Phone PortraitsPoster15 citations
- Local-To-Global Point Cloud Registration Using a Dictionary of Viewpoint DescriptorsPoster15 citations
- Video Fill in the Blank Using LR/RL LSTMs With Spatial-Temporal AttentionsPoster15 citations
- Transferring Objects: Joint Inference of Container and Human PosePoster14 citations
- Catadioptric HyperSpectral Light Field ImagingPoster13 citations
- Going Unconstrained With Rolling Shutter DeblurringPoster13 citations
- Saliency Pattern Detection by Ranking Structured TreesPoster13 citations
- Using Sparse Elimination for Solving Minimal Problems in Computer VisionSpotlight13 citations
- Deep Free-Form Deformation Network for Object-Mask RegistrationPoster12 citations
- Image2song: Song Retrieval via Bridging Image Content and Lyric WordsPoster12 citations
- Intrinsic 3D Dynamic Surface Tracking Based on Dynamic Ricci Flow and Teichmuller MapPoster12 citations
- Side Information in Robust Principal Component Analysis: Algorithms and ApplicationsPoster12 citations
- Temporal Superpixels Based on Proximity-Weighted Patch MatchingPoster12 citations
- Common Action Discovery and Localization in Unconstrained VideosPoster11 citations
- Multimodal Gaussian Process Latent Variable Models With HarmonizationPoster11 citations
- Surface Registration via FoliationPoster11 citations
- 3D Surface Detail Enhancement From a Single Normal MapPoster10 citations
- Constrained Convolutional Sparse Coding for Parametric Based Reconstruction of Line DrawingsPoster10 citations
- Flip-Invariant Motion RepresentationPoster10 citations
- Low-Rank Tensor Completion: A Pseudo-Bayesian Learning ApproachPoster10 citations
- Region-Based Correspondence Between 3D Shapes via Spatially Smooth BiclusteringPoster10 citations
- Editable Parametric Dense Foliage From 3D CapturePoster9 citations
- Simultaneous Detection and Removal of High Altitude Clouds From an ImagePoster9 citations
- A Geometric Framework for Statistical Analysis of Trajectories With Distinct Temporal SpansPoster8 citations
- Deep Globally Constrained MRFs for Human Pose EstimationPoster8 citations
- Summarization and Classification of Wearable Camera Streams by Learning the Distributions Over Deep Features of Out-Of-Sample Image SequencesPoster8 citations
- An Optimal Transportation Based Univariate Neuroimaging IndexPoster7 citations
- AnnArbor: Approximate Nearest Neighbors Using Arborescence CodingPoster6 citations
- Learning Discriminative ab-Divergences for Positive Definite MatricesPoster6 citations
- Predictor Combination at Test TimePoster6 citations
- Supplementary Meta-Learning: Towards a Dynamic Model for Deep Neural NetworksPoster6 citations
- Toward Perceptually-Consistent Stereo: A Scanline StudyPoster6 citations
- Sparse Exact PGA on Riemannian ManifoldsPoster5 citations
- Temporal Shape Super-Resolution by Intra-Frame Motion Encoding Using High-Fps Structured LightSpotlight5 citations
- Training Deep Networks to Be Spatially SensitivePoster5 citations
- Guided Perturbations: Self-Corrective Behavior in Convolutional Neural NetworksPoster4 citations
- Quasiconvex Plane Sweep for Triangulation With OutliersPoster4 citations
- Space-Time Localization and MappingPoster4 citations
- Unrolled Memory Inner-Products: An Abstract GPU Operator for Efficient Vision-Related ComputationsSpotlight4 citations
- Truncating Wide Networks Using Binary Tree ArchitecturesPoster3 citations
- Approximate Grassmannian Intersections: Subspace-Valued Subspace LearningPoster2 citations
- Camera Calibration by Global Constraints on the Motion of SilhouettesPoster2 citations
- Multi-View Non-Rigid Refinement and Normal Selection for High Quality 3D ReconstructionPoster2 citations
- A Discriminative View of MRF Pre-Processing AlgorithmsPoster1 citations
- Automatic Content-Aware Projection for 360deg VideosPoster1 citations
- Dynamics Enhanced Multi-Camera Motion Segmentation From Unsynchronized VideosPoster1 citations
- Optimal Transformation Estimation With Semantic CuesPoster1 citations
ICCV accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.