ECCV 2018 Accepted Papers
The full list of 776 papers accepted at ECCV 2018 (European Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 776
- CBAM: Convolutional Block Attention ModulePoster27,863 citations
- Encoder-Decoder with Atrous Separable Convolution for Semantic Image SegmentationPoster19,794 citations
- ShuffleNet V2: Practical Guidelines for Efficient CNN Architecture DesignPoster7,574 citations
- Image Super-Resolution Using Very Deep Residual Channel Attention NetworksPoster6,094 citations
- CornerNet: Detecting Objects as Paired KeypointsPoster5,272 citations
- Group NormalizationPoster4,921 citations
- Deep Clustering for Unsupervised Learning of Visual FeaturesPoster3,639 citations
- BiSeNet: Bilateral Segmentation Network for Real-time Semantic SegmentationPoster3,213 citations
- Multimodal Unsupervised Image-to-image TranslationPoster3,174 citations
- Beyond Part Models: Person Retrieval with Refined Part Pooling (and A Strong Convolutional Baseline)Poster3,028 citations
- Image Inpainting for Irregular Holes Using Partial ConvolutionsPoster2,727 citations
- Progressive Neural Architecture SearchPoster2,549 citations
- Simple Baselines for Human Pose Estimation and TrackingPoster2,531 citations
- Unified Perceptual Parsing for Scene UnderstandingPoster2,392 citations
- Memory Aware Synapses: Learning what (not) to forgetPoster2,053 citations
- Receptive Field Block Net for Accurate and Fast Object DetectionPoster2,042 citations
- ICNet for Real-Time Semantic Segmentation on High-Resolution ImagesPoster2,006 citations
- Diverse Image-to-Image Translation via Disentangled RepresentationsPoster1,994 citations
- Unsupervised Domain Adaptation for Semantic Segmentation via Class-Balanced Self-TrainingPoster1,784 citations
- AMC: AutoML for Model Compression and Acceleration on Mobile DevicesPoster1,783 citations
- Rethinking Spatiotemporal Feature Learning: Speed-Accuracy Trade-offs in Video ClassificationPoster1,765 citations
- Exploring the Limits of Weakly Supervised PretrainingPoster1,746 citations
- Distractor-aware Siamese Networks for Visual Object TrackingPoster1,726 citations
- Pixel2Mesh: Generating 3D Mesh Models from Single RGB ImagesPoster1,707 citations
- Fast, Accurate, and Lightweight Super-Resolution with Cascading Residual NetworkPoster1,650 citations
- MVSNet: Depth Inference for Unstructured Multi-view StereoPoster1,625 citations
- Stacked Cross Attention for Image-Text MatchingPoster1,536 citations
- End-to-End Incremental LearningPoster1,533 citations
- Riemannian Walk for Incremental Learning: Understanding Forgetting and IntransigencePoster1,482 citations
- Temporal Relational Reasoning in VideosPoster1,356 citations
- PSANet: Point-wise Spatial Attention Network for Scene ParsingPoster1,348 citations
- Scaling Egocentric Vision: The EPIC-KITCHENS DatasetPoster1,329 citations
- Recovering Accurate 3D Human Pose in The Wild Using IMUs and a Moving CameraPoster1,257 citations
- Acquisition of Localization Confidence for Accurate Object DetectionPoster1,191 citations
- TrackingNet: A Large-Scale Dataset and Benchmark for Object Tracking in the WildPoster1,191 citations
- Deep Continuous Fusion for Multi-Sensor 3D Object DetectionPoster1,168 citations
- ESPNet: Efficient Spatial Pyramid of Dilated Convolutions for Semantic SegmentationPoster1,130 citations
- Exploring Visual Relationship for Image CaptioningPoster1,123 citations
- Recognition in Terra IncognitaPoster1,117 citations
- HiDDeN: Hiding Data with Deep NetworksPoster1,092 citations
- Graph R-CNN for Scene Graph GenerationPoster1,072 citations
- Integral Human Pose RegressionPoster1,071 citations
- Recurrent Squeeze-and-Excitation Context Aggregation Net for Single Image DerainingPoster1,039 citations
- SpiderCNN: Deep Learning on Point Sets with Parameterized Convolutional FiltersPoster1,022 citations
- Multi-scale Residual Network for Image Super-ResolutionPoster1,011 citations
- Two at Once: Enhancing Learning and Generalization Capacities via IBN-NetPoster1,008 citations
- The Unmanned Aerial Vehicle Benchmark: Object Detection and TrackingPoster974 citations
- LQ-Nets: Learned Quantization for Highly Accurate and Compact Deep Neural NetworksPoster936 citations
- Composition Loss for Counting, Density Map Estimation and Localization in Dense CrowdsPoster932 citations
- Joint 3D Face Reconstruction and Dense Alignment with Position Map Regression NetworkPoster930 citations
- Videos as Space-Time Region GraphsPoster930 citations
- Audio-Visual Scene Analysis with Self-Supervised Multisensory FeaturesPoster915 citations
- Deep Domain Generalization via Conditional Invariant Adversarial NetworksPoster890 citations
- DeepIM: Deep Iterative Matching for 6D Pose EstimationPoster889 citations
- BSN: Boundary Sensitive Network for Temporal Action Proposal GenerationPoster866 citations
- SkipNet: Learning Dynamic Routing in Convolutional NetworksPoster837 citations
- Scale Aggregation Network for Accurate and Efficient Crowd CountingPoster835 citations
- Piggyback: Adapting a Single Network to Multiple Tasks by Learning to Mask WeightsPoster831 citations
- PersonLab: Person Pose Estimation and Instance Segmentation with a Bottom-Up, Part-Based, Geometric Embedding ModelPoster821 citations
- Mask TextSpotter: An End-to-End Trainable Neural Network for Spotting Text with Arbitrary ShapesPoster782 citations
- GANimation: Anatomically-aware Facial Animation from a Single ImagePoster773 citations
- Triplet Loss in Siamese Network for Object TrackingPoster768 citations
- Reverse Attention for Salient Object DetectionPoster767 citations
- Data-Driven Sparse Structure Selection for Deep Neural NetworksPoster757 citations
- NetAdapt: Platform-Aware Neural Network Adaptation for Mobile ApplicationsPoster746 citations
- Generating 3D Faces using Convolutional Mesh AutoencodersPoster736 citations
- Bi-Real Net: Enhancing the Performance of 1-bit CNNs with Improved Representational Capability and Advanced Training AlgorithmPoster713 citations
- Learning Category-Specific Mesh Reconstruction from Image CollectionsPoster710 citations
- TextSnake: A Flexible Representation for Detecting Text of Arbitrary ShapesPoster707 citations
- Implicit 3D Orientation Learning for 6D Object Detection from RGB ImagesPoster699 citations
- Learning Human-Object Interactions by Graph Parsing Neural NetworksPoster693 citations
- DeepPhys: Video-Based Physiological Measurement Using Convolutional Attention NetworksPoster686 citations
- Learning to Navigate for Fine-grained ClassificationPoster686 citations
- Open Set Domain Adaptation by BackpropagationPoster686 citations
- ECO: Efficient Convolutional Network for Online Video UnderstandingPoster680 citations
- Part-Aligned Bilinear Representations for Person Re-IdentificationPoster671 citations
- ExFuse: Enhancing Feature Fusion for Semantic SegmentationPoster665 citations
- Objects that SoundPoster656 citations
- The Sound of PixelsPoster638 citations
- Shift-Net: Image Inpainting via Deep Feature RearrangementPoster628 citations
- Learning SO(3) Equivariant Representations with Spherical CNNsPoster617 citations
- Deep Co-Training for Semi-Supervised Image RecognitionPoster612 citations
- Unveiling the Power of Deep TrackingPoster605 citations
- Learning Deep Representations with Probabilistic Knowledge TransferPoster597 citations
- YouTube-VOS: Sequence-to-Sequence Video Object SegmentationPoster594 citations
- Open Set Learning with Counterfactual ImagesPoster593 citations
- Pyramid Dilated Deeper ConvLSTM for Video Salient Object DetectionPoster593 citations
- A Systematic DNN Weight Pruning Framework using Alternating Direction Method of MultipliersPoster588 citations
- DF-Net: Unsupervised Joint Learning of Depth and Flow using Cross-Task ConsistencyPoster585 citations
- DeepJDOT: Deep Joint Distribution Optimal Transport for Unsupervised Domain AdaptationPoster579 citations
- Audio-Visual Event Localization in Unconstrained VideosPoster575 citations
- Partial Adversarial Domain AdaptationPoster573 citations
- Pose-Normalized Image Generation for Person Re-identificationPoster566 citations
- Generalizing A Person Retrieval Model Hetero- and HomogeneouslyPoster561 citations
- Towards Robust Neural Networks via Random Self-ensemblePoster560 citations
- SOD-MTGAN: Small Object Detection via Multi-Task Generative Adversarial NetworkPoster559 citations
- Fighting Fake News: Image Splice Detection via Learned Self-ConsistencyPoster550 citations
- Occlusion-aware R-CNN: Detecting Pedestrians in a CrowdPoster544 citations
- PyramidBox: A Context-assisted Single Shot Face DetectorPoster536 citations
- BOP: Benchmark for 6D Object Pose EstimationPoster532 citations
- BodyNet: Volumetric Inference of 3D Human Body ShapesPoster530 citations
- Women also Snowboard: Overcoming Bias in Captioning ModelsPoster526 citations
- How good is my GAN?Poster511 citations
- X2Face: A network for controlling face generation using images, audio, and pose codesPoster511 citations
- To learn image super-resolution, use a GAN to learn how to do image degradation firstPoster510 citations
- Deep Metric Learning with Hierarchical Triplet LossPoster509 citations
- Mancs: A Multi-task Attentional Network with Curriculum Sampling for Person Re-identificationPoster501 citations
- Multi-Attention Multi-Class Constraint for Fine-grained Image RecognitionPoster501 citations
- Toward Characteristic-Preserving Image-based Virtual Try-On NetworkPoster501 citations
- Tracking Emerges by Colorizing VideosPoster497 citations
- Exploiting temporal information for 3D human pose estimationPoster493 citations
- A Closed-form Solution to Photorealistic Image StylizationPoster492 citations
- Multi-modal Cycle-consistent Generalized Zero-Shot LearningPoster491 citations
- Convolutional Networks with Adaptive Inference GraphsPoster487 citations
- Deep Cross-Modal Projection Learning for Image-Text MatchingPoster485 citations
- Is Robustness the Cost of Accuracy? -- A Comprehensive Study on the Robustness of 18 Deep Image Classification ModelsPoster484 citations
- PPF-FoldNet: Unsupervised Learning of Rotation Invariant 3D Local DescriptorsPoster476 citations
- The Contextual Loss for Image Transformation with Non-Aligned DataPoster474 citations
- Dynamic Task Prioritization for Multitask LearningPoster470 citations
- StereoNet: Guided Hierarchical Refinement for Real-Time Edge-Aware Depth PredictionPoster461 citations
- Zero-Shot Object DetectionPoster457 citations
- Local Spectral Graph Convolution for Point Set Feature LearningPoster456 citations
- Online Multi-Object Tracking with Dual Matching Attention NetworksPoster455 citations
- SphereNet: Learning Spherical Representations for Detection and Classification in Omnidirectional ImagesPoster453 citations
- Learning Blind Video Temporal ConsistencyPoster452 citations
- 3DFeat-Net: Weakly Supervised Local 3D Features for Point Cloud RegistrationPoster439 citations
- Skeleton-Based Action Recognition with Spatial Reasoning and Temporal Stack LearningPoster439 citations
- Recycle-GAN: Unsupervised Video RetargetingPoster437 citations
- A Joint Sequence Fusion Model for Video Question Answering and RetrievalPoster435 citations
- Textual Explanations for Self-Driving VehiclesPoster431 citations
- RESOUND: Towards Action Recognition without Representation BiasPoster429 citations
- SegStereo: Exploiting Semantic Information for Disparity EstimationPoster429 citations
- Deep Virtual Stereo Odometry: Leveraging Deep Depth Prediction for Monocular Direct Sparse OdometryPoster427 citations
- Video Compression through Image InterpolationPoster424 citations
- RT-GENE: Real-Time Eye Gaze Estimation in Natural EnvironmentsPoster423 citations
- Instance-level Human Parsing via Part Grouping NetworkPoster421 citations
- License Plate Detection and Recognition in Unconstrained ScenariosPoster420 citations
- CurriculumNet: Weakly Supervised Learning from Large-Scale Web ImagesPoster418 citations
- Hierarchical Bilinear Pooling for Fine-Grained Visual RecognitionPoster417 citations
- 3DMV: Joint 3D-Multi-View Prediction for 3D Semantic Scene SegmentationPoster416 citations
- In the Eye of Beholder: Joint Learning of Gaze and Actions in First Person VideoPoster411 citations
- Towards End-to-End License Plate Detection and Recognition: A Large Dataset and BaselinePoster410 citations
- Learning Dynamic Memory Networks for Object TrackingPoster405 citations
- 3D-CODED: 3D Correspondences by Deep DeformationPoster400 citations
- Depth Estimation via Affinity Learned with Convolutional Spatial Propagation NetworkPoster399 citations
- W-TALC: Weakly-supervised Temporal Activity Localization and ClassificationPoster397 citations
- MultiPoseNet: Fast Multi-Person Pose Estimation using Pose Residual NetworkPoster394 citations
- Hand Pose Estimation via Latent 2.5D Heatmap RegressionPoster393 citations
- Transferring GANs: generating images from limited dataPoster393 citations
- Facial Expression Recognition with Inconsistently Annotated DatasetsPoster389 citations
- Interpretable Basis Decomposition for Visual ExplanationPoster383 citations
- On Regularized Losses for Weakly-supervised CNN SegmentationPoster383 citations
- Person Re-identification with Deep Similarity-Guided Graph Neural NetworkPoster383 citations
- Multi-Scale Structure-Aware Network for Human Pose EstimationPoster382 citations
- Salient Objects in Clutter: Bringing Salient Object Detection to the ForegroundPoster380 citations
- BusterNet: Detecting Copy-Move Image Forgery with Source/Target LocalizationPoster378 citations
- Factorizable Net: An Efficient Subgraph-based Framework for Scene Graph GenerationPoster365 citations
- Parallel Feature Pyramid Network for Object DetectionPoster365 citations
- Weakly-supervised 3D Hand Pose Estimation from Monocular RGB ImagesPoster365 citations
- 3D Recurrent Neural Networks with Context Fusion for Point Cloud Semantic SegmentationPoster362 citations
- Real-Time MDNetPoster361 citations
- Iterative Crowd CountingPoster358 citations
- VideoMatch: Matching based Video Object SegmentationPoster358 citations
- CIRL: Controllable Imitative Reinforcement Learning for Vision-based Self-drivingPoster357 citations
- Recurrent Fusion Network for Image captioningPoster354 citations
- Depth-aware CNN for RGB-D SegmentationPoster353 citations
- AugGAN: Cross Domain Adaptation with GAN-based Data AugmentationPoster350 citations
- Contextual-based Image Inpainting: Infer, Match, and TranslatePoster346 citations
- AutoLoc: Weakly-supervised Temporal Action Localization in Untrimmed VideosPoster343 citations
- Verisimilar Image Synthesis for Accurate Detection and Recognition of Texts in ScenesPoster341 citations
- EC-Net: an Edge-aware Point set Consolidation NetworkPoster340 citations
- Face De-Spoofing: Anti-Spoofing via Noise ModelingPoster340 citations
- Learning to Predict Crisp BoundariesPoster337 citations
- Proximal Dehaze-Net: A Prior Learning-Based Deep Network for Single Image DehazingPoster337 citations
- Contour Knowledge Transfer for Salient Object DetectionPoster336 citations
- Video Summarization Using Fully Convolutional Sequence NetworksPoster335 citations
- Multiresolution Tree Networks for 3D Point Cloud ProcessingPoster334 citations
- Deep High Dynamic Range Imaging with Large Foreground MotionsPoster330 citations
- Practical Black-box Attacks on Deep Neural Networks using Efficient Query MechanismsPoster325 citations
- Structured Siamese Network for Real-Time Visual TrackingPoster325 citations
- Superpixel Sampling NetworksPoster325 citations
- Learning to Separate Object Sounds by Watching Unlabeled VideoPoster324 citations
- Learning Efficient Single-stage Pedestrian Detectors by Asymptotic Localization FittingPoster319 citations
- Adversarial Geometry-Aware Human Motion PredictionPoster317 citations
- DCAN: Dual Channel-wise Alignment Networks for Unsupervised Scene AdaptationPoster317 citations
- Modeling Visual Context is Key to Augmenting Object Detection DatasetsPoster314 citations
- Unsupervised Geometry-Aware Representation for 3D Human Pose EstimationPoster313 citations
- Bidirectional Feature Pyramid Network with Recurrent Attention Residual Modules for Shadow DetectionPoster312 citations
- A Trilateral Weighted Sparse Coding Scheme for Real-World Image DenoisingPoster308 citations
- Deeply Learned Compositional Models for Human Pose EstimationPoster308 citations
- Lip Movements Generation at a GlancePoster307 citations
- Transferable Adversarial PerturbationsPoster307 citations
- Revisiting RCNN: On Awakening the Classification Power of Faster RCNNPoster306 citations
- Out-of-Distribution Detection Using an Ensemble of Self Supervised Leave-out ClassifiersPoster305 citations
- Transductive Semi-Supervised Deep Learning using Min-Max FeaturesPoster301 citations
- Learning Type-Aware Embeddings for Fashion CompatibilityPoster300 citations
- Unsupervised Person Re-identification by Deep Learning Tracklet AssociationPoster298 citations
- Self-produced Guidance for Weakly-supervised Object LocalizationPoster297 citations
- Domain Adaptation through Synthesis for Unsupervised Person Re-identificationPoster295 citations
- Making Deep Heatmaps Robust to Partial Occlusions for 3D Object Pose EstimationPoster295 citations
- Multi-object Tracking with Neural Gating Using Bilinear LSTMPoster295 citations
- R2P2: A ReparameteRized Pushforward Policy for Diverse, Precise Generative Path ForecastingPoster295 citations
- Object Detection in Video with Spatiotemporal Sampling NetworksPoster291 citations
- DeepTAM: Deep Tracking and MappingPoster285 citations
- Model Adaptation with Synthetic and Real Data for Semantic Dense Foggy Scene UnderstandingPoster285 citations
- Propagating LSTM: 3D Pose Estimation based on Joint InterdependencyPoster285 citations
- RIDI: Robust IMU Double IntegrationPoster285 citations
- A Style-Aware Content Loss for Real-time HD Style TransferPoster283 citations
- Compound Memory Networks for Few-shot Video ClassificationPoster282 citations
- Pairwise Confusion for Fine-Grained Visual ClassificationPoster282 citations
- Actor-centric Relation NetworkPoster280 citations
- OmniDepth: Dense Depth Estimation for Indoors Spherical PanoramasPoster280 citations
- Multi-Fiber Networks for Video RecognitionPoster278 citations
- Deep Regression Tracking with Shrinkage LossPoster277 citations
- Attention-based Ensemble for Deep Metric LearningPoster276 citations
- RelocNet: Continuous Metric Learning Relocalisation using Neural NetsPoster276 citations
- Deep Feature Pyramid Reconfiguration for Object DetectionPoster275 citations
- Repeatability Is Not Enough: Learning Affine Regions via DiscriminabilityPoster275 citations
- Deep Imbalanced Attribute Classification using Visual Attention AggregationPoster274 citations
- DPP-Net: Device-aware Progressive Search for Pareto-optimal Neural ArchitecturesPoster272 citations
- Less is More: Picking Informative Frames for Video CaptioningPoster272 citations
- Learning to Anonymize Faces for Privacy Preserving Action DetectionPoster271 citations
- CrossNet: An End-to-end Reference-based Super Resolution Network using Cross-scale WarpingPoster270 citations
- Uncertainty Estimates and Multi-Hypotheses Networks for Optical FlowPoster270 citations
- Deep Fundamental Matrix EstimationPoster269 citations
- Dense Pose TransferPoster269 citations
- Improving DNN Robustness to Adversarial Attacks using Jacobian RegularizationPoster269 citations
- Face Super-resolution Guided by Facial Component HeatmapsPoster267 citations
- Graininess-Aware Deep Feature Learning for Pedestrian DetectionPoster267 citations
- Learning 3D Human Pose from Structure and MotionPoster264 citations
- The Devil of Face Recognition is in the NoisePoster263 citations
- Joint Task-Recursive Learning for Semantic Segmentation and Depth EstimationPoster261 citations
- Look Before You Leap: Bridging Model-Free and Model-Based Reinforcement Learning for Planned-Ahead Vision-and-Language NavigationPoster259 citations
- Fully Motion-Aware Network for Video Object DetectionPoster258 citations
- Video Object Segmentation with Joint Re-identification and Attention-Aware Mask PropagationPoster257 citations
- Lifelong Learning via Progressive Distillation and RetrospectionPoster256 citations
- Look Deeper into Depth: Monocular Depth Estimation with Semantic Booster and Attention-Driven LossPoster256 citations
- Jointly Discovering Visual Objects and Spoken Words from Raw Sensory InputPoster254 citations
- Occlusions, Motion and Depth Boundaries with a Generic Network for Disparity, Optical Flow or Scene Flow EstimationPoster254 citations
- Wasserstein Divergence for GANsPoster254 citations
- Where are the blobs: Counting by Localization with Point SupervisionPoster254 citations
- Bi-box Regression for Pedestrian Detection and Occlusion EstimationPoster252 citations
- Attribute-Guided Face Generation Using Conditional CycleGANPoster250 citations
- Grounding Visual ExplanationsPoster250 citations
- Deforming Autoencoders: Unsupervised Disentangling of Shape and AppearancePoster249 citations
- Fully-Convolutional Point Networks for Large-Scale Point CloudsPoster247 citations
- ReenactGAN: Learning to Reenact Faces via Boundary TransferPoster247 citations
- Weakly Supervised Region Proposal Network and Object DetectionPoster247 citations
- Adaptive Affinity Fields for Semantic SegmentationPoster246 citations
- DetNet: Design Backbone for Object DetectionPoster246 citations
- Video Object Detection with an Aligned Spatial-Temporal MemoryPoster246 citations
- Learning with Biased Complementary LabelsPoster245 citations
- Person Search via A Mask-guided Two-stream CNN ModelPoster245 citations
- Explainable Neural Computation via Stack Neural Module NetworksPoster243 citations
- ELEGANT: Exchanging Latent Encodings with GAN for Transferring Multiple Face AttributesPoster240 citations
- Spatio-Temporal Channel Correlation Networks for Action ClassificationPoster239 citations
- DeepWrinkles: Accurate and Realistic Clothing ModelingPoster237 citations
- Learning Monocular Depth by Distilling Cross-domain Stereo NetworksPoster237 citations
- Deep Pictorial Gaze EstimationPoster234 citations
- Modality Distillation with Multiple Stream Networks for Action RecognitionPoster234 citations
- Learning Shape Priors for Single-View 3D Completion and ReconstructionPoster232 citations
- Unsupervised Learning of Multi-Frame Optical Flow with OcclusionsPoster232 citations
- SRFeat: Single Image Super-Resolution with Feature DiscriminationPoster231 citations
- Attention-GAN for Object Transfiguration in Wild ImagesPoster229 citations
- Attributes as Operators: Factorizing Unseen Attribute-Object CompositionsPoster227 citations
- Dynamic Multimodal Instance Segmentation Guided by Natural Language QueriesPoster227 citations
- Value-aware Quantization for Training and Inference of Neural NetworksPoster227 citations
- Learning to Detect and Track Visible and Occluded Body Joints in a Virtual WorldPoster226 citations
- T2Net: Synthetic-to-Realistic Translation for Solving Single-Image Depth Estimation TasksPoster225 citations
- ConvNets and ImageNet Beyond Accuracy: Understanding Mistakes and Uncovering BiasesPoster224 citations
- Visual Coreference Resolution in Visual Dialog using Neural Module NetworksPoster224 citations
- Deep Adaptive Attention for Joint Facial Action Unit Detection and Face AlignmentPoster223 citations
- DeepVS: A Deep Learning Based Video Saliency Prediction ApproachPoster223 citations
- Weakly- and Semi-Supervised Panoptic SegmentationPoster223 citations
- Distortion-Aware Convolutional Filters for Dense Prediction in Panoramic ImagesPoster221 citations
- A Zero-Shot Framework for Sketch based Image RetrievalPoster220 citations
- Learning-based Video Motion MagnificationPoster220 citations
- Quaternion Convolutional Neural NetworksPoster220 citations
- CTAP: Complementary Temporal Action Proposal GenerationPoster219 citations
- Meta-Tracker: Fast and Robust Online Adaptation for Visual Object TrackersPoster219 citations
- Point-to-Point Regression PointNet for 3D Hand Pose EstimationPoster219 citations
- WildDash - Creating Hazard-Aware BenchmarksPoster217 citations
- GeoDesc: Learning Local Descriptors by Integrating Geometry ConstraintsPoster216 citations
- Key-Word-Aware Network for Referring Expression Image SegmentationPoster214 citations
- End-to-End Learning of Driving Models with Surround-View Cameras and Route PlannersPoster213 citations
- Deep Model-Based 6D Pose Refinement in RGBPoster211 citations
- Multi-Scale Context Intertwining for Semantic SegmentationPoster211 citations
- A Unified Framework for Multi-View Multi-Class Object Pose EstimationPoster208 citations
- Object Level Visual Reasoning in VideosPoster207 citations
- Long-term Tracking in the Wild: a BenchmarkPoster206 citations
- Effective Use of Synthetic Data for Urban Scene Semantic SegmentationPoster205 citations
- Self-supervised Knowledge Distillation Using Singular Value DecompositionPoster205 citations
- Towards Privacy-Preserving Visual Recognition via Adversarial Training: A Pilot StudyPoster205 citations
- Spatio-temporal Transformer Network for Video RestorationPoster203 citations
- Seeing Deeply and Bidirectionally: A Deep Learning Approach for Single Image Reflection RemovalPoster201 citations
- Appearance-Based Gaze Estimation via Evaluation-Guided Asymmetric RegressionPoster196 citations
- Semi-Dense 3D Reconstruction with a Stereo Event CameraPoster196 citations
- ContextVP: Fully Context-Aware Video PredictionPoster194 citations
- Stereo Vision-based Semantic 3D Object and Ego-motion Tracking for Autonomous DrivingPoster194 citations
- Supervising the new with the old: learning SFM from SFMPoster191 citations
- TS2C: Tight Box Mining with Surrounding Segmentation Context for Weakly Supervised Object DetectionPoster190 citations
- Generative Adversarial Network with Spatial Attention for Face Attribute EditingPoster189 citations
- CGIntrinsics: Better Intrinsic Image Decomposition through Physically-Based RenderingPoster188 citations
- Deep Video Generation, Prediction and Completion of Human Action SequencesPoster186 citations
- PS-FCN: A Flexible Learning Framework for Photometric StereoPoster186 citations
- Person Search by Multi-Scale MatchingPoster186 citations
- Real-time 'Actor-Critic' TrackingPoster186 citations
- SDC-Net: Video prediction using spatially-displaced convolutionPoster185 citations
- Learning to Zoom: a Saliency-Based Sampling Layer for Neural NetworksPoster184 citations
- Materials for Masses: SVBRDF Acquisition with a Single Mobile Phone ImagePoster184 citations
- MT-VAE: Learning Motion Transformations to Generate Multimodal Human DynamicsPoster183 citations
- CNN-PS: CNN-based Photometric Stereo for General Non-Convex SurfacesPoster181 citations
- Asynchronous, Photometric Feature Tracking using Events and FramesPoster180 citations
- Hard-Aware Point-to-Set Deep Metric for Person Re-identificationPoster180 citations
- stagNet: An Attentive Semantic RNN for Group Activity RecognitionPoster180 citations
- Compositional Learning for Human Object InteractionPoster179 citations
- Layer-structured 3D Scene Inference via View SynthesisPoster179 citations
- Macro-Micro Adversarial Network for Human ParsingPoster179 citations
- Saliency Detection in 360° VideosPoster178 citations
- CAR-Net: Clairvoyant Attentive Recurrent NetworkPoster177 citations
- Learning Warped Guidance for Blind Face RestorationPoster177 citations
- Zoom-Net: Mining Deep Feature Interactions for Visual Relationship RecognitionPoster177 citations
- CubeNet: Equivariance to 3D Rotation and TranslationPoster176 citations
- Learnable PINs: Cross-Modal Embeddings for Person IdentityPoster176 citations
- Cross-Modal and Hierarchical Modeling of Video and TextPoster175 citations
- Image Generation from Sketch Constraint Using Contextual GANPoster174 citations
- Mutual Learning to Adapt for Joint Human Parsing and Pose EstimationPoster174 citations
- Fast Light Field Reconstruction With Deep Coarse-To-Fine Modeling of Spatial-Angular CluesPoster173 citations
- FloorNet: A Unified Framework for Floorplan Reconstruction from 3D ScansPoster173 citations
- Small-scale Pedestrian Detection Based on Topological Line Localization and Temporal Feature AggregationPoster172 citations
- Holistic 3D Scene Parsing and Reconstruction from a Single RGB ImagePoster171 citations
- Improving Deep Visual Representation for Person Re-identification by Global and Local Image-language AssociationPoster169 citations
- Pairwise Body-Part Attention for Recognizing Human-Object InteractionsPoster169 citations
- Predicting Gaze in Egocentric Video by Learning Task-dependent Attention TransitionPoster168 citations
- Multi-view to Novel view: Synthesizing novel views with Self-Learned ConfidencePoster166 citations
- Pose Guided Human Video GenerationPoster166 citations
- Quantized Densely Connected U-Nets for Efficient Landmark LocalizationPoster166 citations
- Semantic Match Consistency for Long-Term Visual LocalizationPoster166 citations
- Show, Tell and Discriminate: Image Captioning by Self-retrieval with Partially Labeled DataPoster166 citations
- A Modulation Module for Multi-task Learning with Applications in Image RetrievalPoster165 citations
- Orthogonal Deep Features Decomposition for Age-Invariant Face RecognitionPoster165 citations
- Deep Structure Inference Network for Facial Action Unit RecognitionPoster164 citations
- Cross-Modal Ranking with Soft Consistency and Noisy Labels for Robust RGB-T TrackingPoster163 citations
- Disentangling Factors of Variation with Cycle-Consistent Variational Auto-EncodersPoster163 citations
- FishEyeRecNet: A Multi-Context Collaborative Deep Network for Fisheye Image RectificationPoster163 citations
- Deep Adversarial Attention Alignment for Unsupervised Domain Adaptation: the Benefit of Target Expectation MaximizationPoster162 citations
- Learning Class Prototypes via Structure Alignment for Zero-Shot RecognitionPoster162 citations
- Retrospective Encoders for Video SummarizationPoster162 citations
- Super-Identity Convolutional Neural Network for Face HallucinationPoster162 citations
- VSO: Visual Semantic OdometryPoster162 citations
- Connecting Gaze, Scene, and Attention: Generalized Attention Estimation via Joint Modeling of Gaze and Scene SaliencyPoster161 citations
- Flow-Grounded Spatial-Temporal Video Prediction from Still ImagesPoster159 citations
- Motion Feature Network: Fixed Motion Filter for Action RecognitionPoster159 citations
- Localization Recall Precision (LRP): A New Performance Metric for Object DetectionPoster158 citations
- Attention-aware Deep Adversarial Hashing for Cross-Modal RetrievalPoster157 citations
- Folded Recurrent Neural Networks for Future Video PredictionPoster157 citations
- Hierarchical Relational Networks for Group Activity Recognition and RetrievalPoster157 citations
- Unsupervised Video Object Segmentation with Motion-based Bilateral NetworksPoster157 citations
- Few-Shot Human Motion Prediction via Meta-LearningPoster155 citations
- Graph Adaptive Knowledge Transfer for Unsupervised Domain AdaptationPoster154 citations
- Improving Generalization via Scalable Neighborhood Component AnalysisPoster154 citations
- Deep Burst DenoisingPoster153 citations
- GAL: Geometric Adversarial Loss for Single-View 3D-Object ReconstructionPoster153 citations
- Remote Photoplethysmography Correspondence Feature for 3D Mask Face Presentation Attack DetectionPoster153 citations
- Deep Video Quality Assessor: From Spatio-temporal Visual Sensitivity to A Convolutional Neural Aggregation NetworkPoster151 citations
- Burst Image Deblurring Using Permutation Invariant Convolutional Neural NetworksPoster150 citations
- Deep Bilevel LearningPoster150 citations
- Deep Recursive HDRI: Inverse Tone Mapping using Generative Adversarial NetworksPoster150 citations
- Deep Image Demosaicking using a Cascade of Convolutional Residual Denoising NetworksPoster149 citations
- Accurate Scene Text Detection through Border Semantics Awareness and BootstrappingPoster148 citations
- Monocular Depth Estimation with Affinity, Vertical Pooling, and Label EnhancementPoster148 citations
- Start, Follow, Read: End-to-End Full-Page Handwriting RecognitionPoster148 citations
- Stroke Controllable Fast Style Transfer with Adaptive Receptive FieldsPoster148 citations
- Context Refinement for Object DetectionPoster147 citations
- Recurrent Tubelet Proposal and Recognition Networks for Action DetectionPoster146 citations
- Deep Volumetric Video From Very Sparse Multi-View Performance CapturePoster144 citations
- Domain transfer through deep activation matchingPoster144 citations
- Move Forward and Tell: A Progressive Generator of Video DescriptionsPoster144 citations
- A Hybrid Model for Identity Obfuscation by Face ReplacementPoster143 citations
- A+D Net: Training a Shadow Detector with Adversarial Shadow AttenuationPoster142 citations
- Conditional Image-Text Embedding NetworksPoster141 citations
- Cross-Modal Hamming HashingPoster141 citations
- Quantization Mimic: Towards Very Tiny CNN for Object DetectionPoster141 citations
- Dist-GAN: An Improved GAN using Distance ConstraintsPoster140 citations
- Estimating Depth from RGB and Sparse SensingPoster140 citations
- Graph Distillation for Action Detection with Privileged ModalitiesPoster140 citations
- ActiveStereoNet: End-to-End Self-Supervised Learning for Active Stereo SystemsPoster139 citations
- End-to-end View Synthesis for Light Field Imaging with Pseudo 4DCNNPoster139 citations
- Improving Spatiotemporal Self-Supervision by Deep Reinforcement LearningPoster138 citations
- Saliency Benchmarking Made Easy: Separating Models, Maps and MetricsPoster138 citations
- VQA-E: Explaining, Elaborating, and Enhancing Your Answers for Visual QuestionsPoster138 citations
- Diagnosing Error in Temporal Action DetectorsPoster137 citations
- Lambda Twist: An Accurate Fast Robust Perspective Three Point (P3P) SolverPoster137 citations
- Deep Variational Metric LearningPoster136 citations
- On Offline Evaluation of Vision-based Driving ModelsPoster135 citations
- Penalizing Top Performers: Conservative Loss for Semantic Segmentation AdaptationPoster135 citations
- Coloring with Words: Guiding Image Colorization Through Text-based Palette GenerationPoster134 citations
- Efficient Uncertainty Estimation for Semantic Segmentation in VideosPoster134 citations
- Fine-Grained Visual Categorization using Meta-Learning Optimization with Sample Selection of Auxiliary DataPoster134 citations
- HGMR: Hierarchical Gaussian Mixtures for Adaptive 3D RegistrationPoster134 citations
- TBN: Convolutional Neural Network with Ternary Inputs and Binary WeightsPoster134 citations
- Correcting the Triplet Selection Bias for Triplet LossPoster132 citations
- Learning Visual Question Answering by Bootstrapping Hard AttentionPoster132 citations
- Neural Graph Matching Networks for Fewshot 3D Action RecognitionPoster132 citations
- RCAA: Relational Context-Aware Agents for Person SearchPoster129 citations
- Straight to the Facts: Learning Knowledge Base Retrieval for Factual Visual Question AnsweringPoster129 citations
- Efficient Semantic Scene Completion Network with Spatial Group ConvolutionPoster127 citations
- Recovering 3D Planes from a Single Image via Convolutional Neural NetworksPoster127 citations
- Robust Anchor Embedding for Unsupervised Video Person Re-Identification in the WildPoster127 citations
- Affinity Derivation and Graph Merge for Instance SegmentationPoster126 citations
- Deep Randomized Ensembles for Metric LearningPoster125 citations
- Unsupervised Video Object Segmentation using Motion Saliency-Guided Spatio-Temporal PropagationPoster125 citations
- A Deeply-initialized Coarse-to-fine Ensemble of Regression Trees for Face AlignmentPoster124 citations
- Learning to Segment via Cut-and-PastePoster124 citations
- Unsupervised Image-to-Image Translation with Stacked Cycle-Consistent Adversarial NetworksPoster124 citations
- ADVIO: An Authentic Dataset for Visual-Inertial OdometryPoster123 citations
- An Adversarial Approach to Hard Triplet GenerationPoster121 citations
- Characterizing Adversarial Examples Based on Spatial Consistency Information for Semantic SegmentationPoster121 citations
- Deep Boosting for Image DenoisingPoster121 citations
- Deep Directional Statistics: Pose Estimation with Uncertainty QuantificationPoster121 citations
- Grassmann Pooling as Compact Homogeneous Bilinear Pooling for Fine-Grained Visual ClassificationPoster121 citations
- Associating Inter-Image Salient Instances for Weakly Supervised Semantic SegmentationPoster120 citations
- Deep Kalman Filtering Network for Video Compression Artifact ReductionPoster120 citations
- Learning to Forecast and Refine Residual Motion for Image-to-Video GenerationPoster119 citations
- Deep Feature Factorization For Concept DiscoveryPoster118 citations
- Interaction-aware Spatio-temporal Pyramid Attention Networks for Action ClassificationPoster118 citations
- Collaborative Deep Reinforcement Learning for Multi-Object TrackingPoster116 citations
- Deep Bilinear Learning for RGB-D Action RecognitionPoster116 citations
- C-WSL: Count-guided Weakly Supervised LocalizationPoster115 citations
- ShapeStacks: Learning Vision-Based Physical Intuition for Generalised Object StackingPoster115 citations
- Clustering Convolutional Kernels to Compress Deep Neural NetworksPoster114 citations
- Predicting Future Instance Segmentation by Forecasting Convolutional FeaturesPoster114 citations
- Ask, Acquire, and Attack: Data-free UAP Generation using Class ImpressionsPoster113 citations
- Revisiting the Inverted Indices for Billion-Scale Approximate Nearest NeighborsPoster113 citations
- HybridFusion: Real-Time Performance Capture Using a Single Depth Sensor and Sparse IMUsPoster112 citations
- Learning Rigidity in Dynamic Scenes with a Moving Camera for 3D Motion Field EstimationPoster112 citations
- Semi-convolutional Operators for Instance SegmentationPoster110 citations
- Simultaneous Edge Alignment and LearningPoster109 citations
- Synthetically Supervised Feature Learning for Scene Text RecognitionPoster109 citations
- Double JPEG Detection in Mixed JPEG Quality Factors using Deep Convolutional Neural NetworkPoster108 citations
- Geolocation Estimation of Photos using a Hierarchical Model and Scene ClassificationPoster108 citations
- Task-Aware Image DownscalingPoster108 citations
- Action Search: Spotting Actions in Videos and Its Application to Temporal Action LocalizationPoster107 citations
- Generative Domain-Migration Hashing for Sketch-to-Image RetrievalPoster107 citations
- Zero-Shot Deep Domain AdaptationPoster107 citations
- Contemplating Visual Emotions: Understanding and Overcoming Dataset BiasPoster106 citations
- Adding Attentiveness to the Neurons in Recurrent Neural NetworksPoster105 citations
- Imagine This! Scripts to Compositions to VideosPoster104 citations
- MVTec D2S: Densely Segmented Supermarket DatasetPoster104 citations
- Self-Supervised Relative Depth Learning for Urban Scene UnderstandingPoster104 citations
- Weakly-supervised Video Summarization using Variational Encoder-Decoder and Web PriorPoster104 citations
- Coreset-Based Neural Network CompressionPoster103 citations
- Learning Region Features for Object DetectionPoster103 citations
- Unpaired Image Captioning by Language PivotingPoster103 citations
- Eliminating the Blind Spot: Adapting 3D Object Detection and Monocular Depth Estimation to 360° Panoramic ImageryPoster102 citations
- Pose Partition Networks for Multi-Person Pose EstimationPoster102 citations
- Realtime Time Synchronized Event-based StereoPoster102 citations
- StarMap for Category-Agnostic Keypoint and Viewpoint EstimationPoster102 citations
- Consensus-Driven Propagation in Massive Unlabeled Data for Face RecognitionPoster101 citations
- Constrained Optimization Based Low-Rank Approximation of Deep Neural NetworksPoster101 citations
- Learning to Solve Nonlinear Least Squares for Monocular StereoPoster100 citations
- Action Anticipation with RBF Kernelized Feature Mapping RNNPoster99 citations
- Product Quantization Network for Fast Image RetrievalPoster99 citations
- Scalable Exemplar-based Subspace Clustering on Class-Imbalanced DataPoster99 citations
- Linear RGB-D SLAM for Planar EnvironmentsPoster98 citations
- Multimodal Dual Attention Memory for Video Story Question AnsweringPoster97 citations
- Comparator NetworksPoster96 citations
- Improving Shape Deformation in Unsupervised Image-to-Image TranslationPoster96 citations
- The Mutex Watershed: Efficient, Parameter-Free Image PartitioningPoster96 citations
- Learning to Look around Objects for Top-View Representations of Outdoor ScenesPoster95 citations
- ``Factual'' or ``Emotional'': Stylized Image Captioning with Adaptive Learning and AttentionPoster95 citations
- Open-World Stereo Video Matching with Deep RNNPoster94 citations
- Temporal Modular Networks for Retrieving Complex Compositional Activities in VideosPoster94 citations
- Unsupervised Class-Specific DeblurringPoster94 citations
- Where Will They Go? Predicting Fine-Grained Adversarial Multi-Agent Motion using Conditional Variational AutoencodersPoster94 citations
- AGIL: Learning Attention from Human for Visuomotor TasksPoster93 citations
- CPlaNet: Enhancing Image Geolocalization by Combinatorial Partitioning of MapsPoster93 citations
- Question-Guided Hybrid Convolution for Visual Question AnsweringPoster93 citations
- Attentive Semantic Alignment with Offset-Aware Correlation KernelsPoster92 citations
- Deep Expander Networks: Efficient Deep Networks from Graph TheoryPoster92 citations
- Deep Shape MatchingPoster92 citations
- Dividing and Aggregating Network for Multi-view Action RecognitionPoster92 citations
- Constraint-Aware Deep Neural Network CompressionPoster91 citations
- Efficient Global Point Cloud Registration by Matching Rotation Invariant Features Through Translation SearchPoster91 citations
- Find and Focus: Retrieve and Localize Video Events with Natural Language QueriesPoster90 citations
- Modular Generative Adversarial NetworksPoster90 citations
- Unsupervised Hard Example Mining from Videos for Improved Object DetectionPoster90 citations
- DDRNet: Depth Map Denoising and Refinement for Consumer Depth Cameras Using Cascaded CNNsPoster89 citations
- Does Haze Removal Help CNN-based Image Classification?Poster89 citations
- SketchyScene: Richly-Annotated Scene SketchesPoster89 citations
- Online Detection of Action Start in Untrimmed, Streaming VideosPoster88 citations
- Probabilistic Video Generation using Holistic Attribute ControlPoster88 citations
- 3D Ego-Pose Estimation via Imitation LearningPoster87 citations
- Deep Regionlets for Object DetectionPoster87 citations
- Deformable Pose Traversal Convolution for 3D Action and Gesture RecognitionPoster87 citations
- HairNet: Single-View Hair Reconstruction using Convolutional Neural NetworksPoster86 citations
- Semi-Supervised Deep Learning with MemoryPoster86 citations
- Shuffle-Then-Assemble: Learning Object-Agnostic Visual Relationship FeaturesPoster86 citations
- Diverse and Coherent Paragraph Generation from ImagesPoster84 citations
- Deep Attention Neural Tensor Network for Visual Question AnsweringPoster83 citations
- Dynamic Conditional Networks for Few-Shot LearningPoster82 citations
- Extreme Network Compression via Filter Group ApproximationPoster82 citations
- Robust fitting in computer vision: easy or hard?Poster82 citations
- Video Re-localizationPoster82 citations
- Single Image Intrinsic Decomposition without a Single Intrinsic ImagePoster81 citations
- Separating Reflection and Transmission Images in the WildPoster80 citations
- Single Image Highlight Removal with a Sparse and Low-Rank Reflection ModelPoster80 citations
- Deep Reinforcement Learning with Iterative Shift for Visual TrackingPoster79 citations
- Person Search in Videos with One Portrait Through Visual and Temporal LinksPoster79 citations
- Sparsely Aggregated Convolutional NetworksPoster78 citations
- Discriminative Region Proposal Adversarial Networks for High-Quality Image-to-Image TranslationPoster77 citations
- MaskConnect: Connectivity Learning by Gradient DescentPoster77 citations
- Robust image stitching with multiple registrationsPoster77 citations
- Semi-supervised Adversarial Learning to Generate Photorealistic Face Images of New Identities from 3D Morphable ModelPoster77 citations
- Analyzing Clothing Layer Deformation Statistics of 3D Human MotionsPoster76 citations
- SAN: Learning Relationship between Convolutional Features for Multi-Scale Object DetectionPoster76 citations
- Semi-supervised FusedGAN for Conditional Image GenerationPoster76 citations
- Deep Autoencoder for Combined Human Pose Estimation and Body Model UpscalingPoster75 citations
- DeepKSPD: Learning Kernel-matrix-based SPD Representation for Fine-grained Image RecognitionPoster74 citations
- LAPRAN: A Scalable Laplacian Pyramid Reconstructive Adversarial Network for Flexible Compressive Sensing ReconstructionPoster74 citations
- Beyond local reasoning for stereo confidence estimation with deep learningPoster73 citations
- Real-to-Virtual Domain Unification for End-to-End Autonomous DrivingPoster73 citations
- Towards Human-Level License Plate RecognitionPoster73 citations
- Joint Learning of Intrinsic Images and Semantic SegmentationPoster72 citations
- Learning to Fuse Proposals from Multiple Scanline Optimizations in Semi-Global MatchingPoster72 citations
- Occlusion-aware Hand Pose Estimation Using Hierarchical Mixture Density NetworkPoster72 citations
- Learning to Capture Light Fields through a Coded Aperture CameraPoster71 citations
- Deep Cross-modality Adaptation via Semantics Preserving Adversarial Learning for Sketch-based 3D Shape RetrievalPoster70 citations
- Geometric Constrained Joint Lane Segmentation and Lane Boundary DetectionPoster70 citations
- Joint Camera Spectral Sensitivity Selection and Hyperspectral Image RecoveryPoster70 citations
- Decouple Learning for Parameterized Image OperatorsPoster69 citations
- PARN: Pyramidal Affine Regression Networks for Dense Semantic CorrespondencePoster69 citations
- Focus, Segment and Erase: An Efficient Network for Multi-Label Brain Tumor SegmentationPoster68 citations
- Human Motion Analysis with Deep Metric LearningPoster68 citations
- Unsupervised CNN-based Co-Saliency Detection with Graphical OptimizationPoster68 citations
- Video Object Segmentation by Learning Location-Sensitive EmbeddingsPoster68 citations
- Visual Tracking via Spatially Aligned Correlation Filters NetworkPoster68 citations
- Volumetric performance capture from minimal camera viewpointsPoster68 citations
- Learning Single-View 3D Reconstruction with Limited Pose SupervisionPoster67 citations
- Generative Semantic Manipulation with Mask-Contrasting GANPoster66 citations
- Neural Network EncapsulationPoster66 citations
- Part-Activated Deep Reinforcement Learning for Action PredictionPoster66 citations
- Tackling 3D ToF Artifacts Through Learning and the FLAT DatasetPoster66 citations
- ExplainGAN: Model Explanation via Decision Boundary Crossing TransformationsPoster65 citations
- Interactive Boundary Prediction for Object SelectionPoster65 citations
- Interpretable Intuitive Physics ModelPoster65 citations
- Joint Representation and Truncated Inference Learning for Correlation Filter based TrackingPoster64 citations
- Massively Parallel Video NetworksPoster64 citations
- ADVISE: Symbolism and External Knowledge for Decoding AdvertisementsPoster63 citations
- Boosted Attention: Leveraging Human Attention for Image CaptioningPoster63 citations
- Shape Reconstruction Using Volume Sweeping and Learned PhotoconsistencyPoster63 citations
- Learn-to-Score: Efficient 3D Scene Exploration by Predicting View UtilityPoster62 citations
- Question Type Guided Attention in Visual Question AnsweringPoster62 citations
- Single Shot Scene Text RetrievalPoster62 citations
- SwapNet: Garment Transfer in Single View ImagesPoster61 citations
- Adversarial Open-World Person Re-IdentificationPoster60 citations
- Face Recognition with Contrastive ConvolutionPoster60 citations
- Fine-grained Video Categorization with Redundancy Reduction AttentionPoster60 citations
- Improving Sequential Determinantal Point Processes for Supervised Video SummarizationPoster60 citations
- Egocentric Activity Prediction via Event Modulated AttentionPoster59 citations
- Robust Optical Flow in Rainy ScenesPoster59 citations
- Learning and Matching Multi-View Descriptors for Registration of Point CloudsPoster58 citations
- Pose Proposal NetworksPoster58 citations
- Statistically-motivated Second-order PoolingPoster58 citations
- Universal Sketch Perceptual GroupingPoster58 citations
- HybridNet: Classification and Reconstruction Cooperation for Semi-Supervised LearningPoster57 citations
- Normalized Blind DeconvolutionPoster57 citations
- Choose Your Neuron: Incorporating Domain Knowledge through Neuron-ImportancePoster56 citations
- Direct Sparse Odometry With Rolling ShutterPoster56 citations
- HBE: Hand Branch Ensemble Network for Real-time 3D Hand Pose EstimationPoster56 citations
- Hierarchical Metric Learning and Matching for 2D and 3D Geometric CorrespondencesPoster56 citations
- How Local is the Local Diversity? Reinforcing Sequential Determinantal Point Processes with Dynamic Ground Sets for Supervised Video SummarizationPoster56 citations
- Learning Priors for Semantic 3D ReconstructionPoster56 citations
- A Dataset and Architecture for Visual Reasoning with a Working MemoryPoster55 citations
- Deep Multi-Task Learning to Recognise Subtle Facial Expressions of Mental StatesPoster55 citations
- Highly-Economized Multi-View Binary Compression for Scalable Image ClusteringPoster55 citations
- Selfie Video StabilizationPoster55 citations
- Structural Consistency and Controllability for Diverse ColorizationPoster55 citations
- Attend and Rectify: a gated attention mechanism for fine-grained recoveryPoster54 citations
- DFT-based Transformation Invariant Pooling Layer for Visual ClassificationPoster54 citations
- Eigendecomposition-free Training of Deep Networks with Zero Eigenvalue-based LossesPoster54 citations
- Joint 3D tracking of a deformable object in interaction with a handPoster54 citations
- Multi-Class Model Fitting by Energy Minimization and Mode-SeekingPoster54 citations
- Museum Exhibit Identification Challenge for the Supervised Domain Adaptation and BeyondPoster54 citations
- Pairwise Relational Networks for Face RecognitionPoster54 citations
- Dependency-aware Attention Control for Unconstrained Face Recognition with Image SetsPoster53 citations
- Single Image Water Hazard Detection using FCN with Reflection Attention UnitsPoster53 citations
- End-to-End Joint Semantic Segmentation of Actors and Actions in VideoPoster52 citations
- Faces as Lighting Probes via Unsupervised Deep Highlight ExtractionPoster52 citations
- LSQ++: Lower running time and higher recall in multi-codebook quantizationPoster52 citations
- Reinforced Temporal Attention and Split-Rate Transfer for Depth-Based Person Re-IdentificationPoster52 citations
- Variational Wasserstein ClusteringPoster52 citations
- Zero-shot keyword spotting for visual speech recognition in-the-wildPoster52 citations
- Gray-box Adversarial TrainingPoster51 citations
- Multimodal image alignment through a multiscale chain of neural networks with application to remote sensingPoster51 citations
- Programmable Triangulation Light CurtainsPoster51 citations
- What do I Annotate Next? An Empirical Study of Active Learning for Action LocalizationPoster51 citations
- 3D Face Reconstruction from Light Field Images: A Model-free ApproachPoster50 citations
- Deep Texture and Structure Aware Filtering Network for Image SmoothingPoster50 citations
- Dynamic Filtering with Large Sampling Field for ConvNetsPoster50 citations
- PSDF Fusion: Probabilistic Signed Distance Function for On-the-fly 3D Data Fusion and Scene ReconstructionPoster50 citations
- A Dataset of Flash and Ambient Illumination Pairs from the CrowdPoster49 citations
- Efficient Dense Point Cloud Object Reconstruction using Deformation Vector FieldsPoster49 citations
- Learning 3D Keypoint Descriptors for Non-Rigid Shape MatchingPoster49 citations
- Switchable Temporal Propagation NetworkPoster49 citations
- Task-driven Webpage SaliencyPoster49 citations
- Visual Psychophysics for Making Face Recognition Algorithms More ExplainablePoster49 citations
- Deep Generative Models for Weakly-Supervised Multi-Label ClassificationPoster48 citations
- Conditional Prior Networks for Optical FlowPoster47 citations
- Goal-Oriented Visual Question Generation via Intermediate RewardsPoster47 citations
- Learning Data Terms for Non-blind DeblurringPoster47 citations
- Visual Question Answering as a Meta Learning TaskPoster47 citations
- Joint Person Segmentation and Identification in Synchronized First- and Third-person VideosPoster46 citations
- Extending Layered Models to 3D MotionPoster45 citations
- GridFace: Face Rectification via Learning Local Homography TransformationsPoster45 citations
- Linear Span Network for Object Skeleton DetectionPoster45 citations
- Monocular Depth Estimation Using Whole Strip Masking and Reliability-Based RefinementPoster45 citations
- Object-centered image stitchingPoster45 citations
- Bayesian Semantic Instance Segmentation in Open Set WorldPoster44 citations
- Relaxation-Free Deep Hashing via Policy GradientPoster44 citations
- Reconstruction-based Pairwise Depth Dataset for Depth Image Enhancement Using CNNPoster43 citations
- Simultaneous 3D Reconstruction for Water Surface and Underwater ScenePoster43 citations
- A Framework for Evaluating 6-DOF Object TrackersPoster42 citations
- Compressing the Input for CNNs with the First-Order Scattering TransformPoster42 citations
- DOCK: Detecting Objects by transferring Common-sense KnowledgePoster42 citations
- HandMap: Robust Hand Pose Estimation via Intermediate Dense Guidance Map SupervisionPoster42 citations
- Image Reassembly Combining Deep Learning and Shortest Path ProblemPoster42 citations
- Semi-Supervised Generative Adversarial Hashing for Image RetrievalPoster42 citations
- Summarizing First-Person Videos from Third Persons' Points of ViewPoster42 citations
- Joint optimization for compressive video sensing and reconstruction under hardware constraintsPoster41 citations
- PlaneMatch: Patch Coplanarity Prediction for Robust RGB-D ReconstructionPoster41 citations
- Unsupervised Domain Adaptation for 3D Keypoint Estimation via View ConsistencyPoster41 citations
- Evaluating Capability of Deep Neural Networks for Image Classification via Information PlanePoster40 citations
- Learning 3D Shapes as Multi-Layered Height-maps using 2D Convolutional NetworksPoster40 citations
- Towards Realistic PredictorsPoster40 citations
- Transductive Centroid Projection for Semi-supervised Large-scale RecognitionPoster40 citations
- A New Large Scale Dynamic Texture Dataset with Application to ConvNet UnderstandingPoster39 citations
- Coded Two-Bucket Cameras for Computer VisionPoster39 citations
- DYAN: A Dynamical Atoms-Based Network For Video PredictionPoster39 citations
- Joint & Progressive Learning from High-Dimensional Data for Multi-Label ClassificationPoster39 citations
- A-Contrario Horizon-First Vanishing Point Detection Using Second-Order Grouping LawsPoster38 citations
- Improved Structure from Motion Using Fiducial Marker MatchingPoster38 citations
- Learning to Reconstruct High-quality 3D Shapes with Cascaded Fully Convolutional NetworksPoster38 citations
- Real-Time Hair Rendering using Sequential Adversarial NetworksPoster38 citations
- Scenes-Objects-Actions: A Multi-Task, Multi-Label Video DatasetPoster38 citations
- DeepGUM: Learning Deep Robust Regression with a Gaussian-Uniform Mixture ModelPoster37 citations
- Large Scale Urban Scene Modeling from MVS MeshesPoster37 citations
- Second-order Democratic AggregationPoster37 citations
- Selective Zero-Shot Classification with Augmented AttributesPoster37 citations
- Efficient Relative Attribute Learning using Graph Neural NetworksPoster36 citations
- Super-Resolution and Sparse View CT ReconstructionPoster36 citations
- A Minimal Closed-Form Solution for Multi-Perspective Pose Estimation using Points and LinesPoster35 citations
- Deterministic Consensus Maximization with Biconvex ProgrammingPoster35 citations
- Dual-Agent Deep Reinforcement Learning for Deformable Face TrackingPoster35 citations
- Fictitious GAN: Training GANs with Historical ModelsPoster35 citations
- Learning Compression from Limited Unlabeled DataPoster35 citations
- Neural Procedural Reconstruction for Residential BuildingsPoster35 citations
- Revisiting Autofocus for Smartphone CamerasPoster35 citations
- Saliency Preservation in Low-Resolution Grayscale ImagesPoster35 citations
- Sidekick Policy Learning for Active Visual ExplorationPoster35 citations
- A Geometric Perspective on Structured Light CodingPoster34 citations
- A Segmentation-aware Deep Fusion Network for Compressed Sensing MRIPoster34 citations
- Deblurring Natural Image Using Super-Gaussian FieldsPoster34 citations
- Neural Stereoscopic Image Style TransferPoster34 citations
- Physical Primitive DecompositionPoster34 citations
- Polarimetric Three-View GeometryPoster34 citations
- Diverse feature visualizations reveal invariances in early layers of deep neural networksPoster33 citations
- Maximum Margin Metric Learning Over Discriminative Nullspace for Person Re-identificationPoster33 citations
- Joint Blind Motion Deblurring and Depth Estimation of Light FieldPoster32 citations
- PM-GANs: Discriminative Representation Learning for Action Recognition Using Partial-modalitiesPoster32 citations
- Rendering Portraitures from Monocular Camera and BeyondPoster32 citations
- Semantically Aware Urban 3D Reconstruction with Plane-Based RegularizationPoster32 citations
- Descending, lifting or smoothing: Secrets of robust cost optimizationPoster31 citations
- ISNN: Impact Sound Neural Network for Audio-Visual Object ClassificationPoster31 citations
- Learning Discriminative Video Representations Using Adversarial PerturbationsPoster31 citations
- Hashing with Binary Matrix PursuitPoster30 citations
- Image Manipulation with Perceptual DiscriminatorsPoster30 citations
- Exploiting Vector Fields for Geometric Rectification of Distorted Document ImagesPoster29 citations
- Generalized Loss-Sensitive Adversarial Learning with Manifold MarginsPoster29 citations
- ML-LocNet: Improving Object Localization with Multi-view Learning NetworkPoster29 citations
- Progressive Structure from MotionPoster29 citations
- Viewpoint Estimation---Insights & ModelPoster29 citations
- Broadcasting Convolutional Network for Visual Relational ReasoningPoster28 citations
- Specular-to-Diffuse Translation for Multi-View ReconstructionPoster28 citations
- End-to-End Deep Structured Models for Drawing CrosswalksPoster27 citations
- NAM: Non-Adversarial Unsupervised Domain MappingPoster27 citations
- SRDA: Generating Instance Segmentation Annotation via Scanning, Reasoning and Domain AdaptationPoster27 citations
- Visual-Inertial Object Detection and MappingPoster27 citations
- Affine Correspondences between Central Cameras for Rapid Relative Pose EstimationPoster26 citations
- ArticulatedFusion: Real-time Reconstruction of Motion, Geometry and Segmentation Using a Single Depth CameraPoster26 citations
- NNEval: Neural Network based Evaluation Metric for Image CaptioningPoster26 citations
- Modeling Varying Camera-IMU Time Offset in Optimization-Based Visual-Inertial OdometryPoster25 citations
- Visual Question Generation for Class Acquisition of Unknown ObjectsPoster25 citations
- Zero-Annotation Object Detection with Web Knowledge TransferPoster25 citations
- Deep Component Analysis via Alternating Direction Neural NetworksPoster24 citations
- Hierarchy of Alternating Specialists for Scene RecognitionPoster24 citations
- Integrating Egocentric Videos in Top-view Surveillance Videos: Joint Identification and Temporal AlignmentPoster24 citations
- Multiple-gaze geometry: Inferring novel 3D locations from gazes observed in monocular videoPoster24 citations
- Sequential Clique Optimization for Video Object SegmentationPoster24 citations
- Sub-GAN: An Unsupervised Generative Model via SubspacesPoster24 citations
- Using Object Information for Spotting TextPoster24 citations
- Snap Angle Prediction for 360° PanoramasPoster23 citations
- Training Binary Weight Networks via Semi-Binary DecompositionPoster23 citations
- Fast and Accurate Intrinsic Symmetry DetectionPoster22 citations
- Good Line Cutting: towards Accurate Pose Tracking of Line-assisted VO/VSLAMPoster22 citations
- Incremental Multi-graph Matching via Diversity and Randomness based Graph ClusteringPoster22 citations
- MPLP++: Fast, Parallel Dual Block-Coordinate Ascent for Dense Graphical ModelsPoster22 citations
- Perturbation Robust Representations of Topological Persistence DiagramsPoster22 citations
- SaaS: Speed as a Supervisor for Semi-supervised LearningPoster22 citations
- Visual Reasoning with Multi-hop Feature ModulationPoster22 citations
- Compositing-aware Image SearchPoster21 citations
- Concept Mask: Large-Scale Segmentation from Semantic ConceptsPoster21 citations
- Urban Zoning Using Higher-Order Markov Random Fields on Multi-View Imagery DataPoster21 citations
- X-ray Computed Tomography Through ScatterPoster21 citations
- Rethinking the Form of Latent States in Image CaptioningPoster20 citations
- ShapeCodes: Self-Supervised Feature Learning by Lifting Views to ViewgridsPoster20 citations
- Dense Semantic and Topological Correspondence of 3D Faces without LandmarksPoster19 citations
- Deep Factorised Inverse-SketchingPoster18 citations
- Efficient Sliding Window Computation for NN-Based Template MatchingPoster18 citations
- Escaping from Collapsing Modes in a Constrained SpacePoster18 citations
- A Dataset for Lane Instance Segmentation in Urban EnvironmentsPoster17 citations
- Combining 3D Model Contour Energy and Keypoints for Object TrackingPoster17 citations
- Multi-Scale Spatially-Asymmetric Recalibration for Image ClassificationPoster17 citations
- On the Solvability of Viewing GraphsPoster17 citations
- Stereo relative pose from line and point feature tripletsPoster17 citations
- U-PC: Unsupervised Planogram CompliancePoster17 citations
- Efficient 6-DoF Tracking of Handheld Objects from an Egocentric ViewpointPoster16 citations
- Joint Map and Symmetry SynchronizationPoster16 citations
- Quadtree Convolutional Neural NetworksPoster16 citations
- Scale-Awareness of Light Field Camera based Visual OdometryPoster16 citations
- Teaching Machines to Understand Baseball Games: Large-Scale Baseball Video Database for Multiple Video Understanding TasksPoster16 citations
- Unsupervised holistic image generation from key local patchesPoster16 citations
- 3D Vehicle Trajectory Reconstruction in Monocular Video Data Using Environment Structure ConstraintsPoster15 citations
- Fast and Accurate Camera Covariance Computation for Large 3D ReconstructionPoster15 citations
- Rolling Shutter Pose and Ego-motion Estimation using Shape-from-TemplatePoster15 citations
- Structure-from-Motion-Aware PatchMatch for Adaptive Optical Flow EstimationPoster15 citations
- Accelerating Dynamic Programs via Nested Benders Decomposition with Application to Multi-Person Pose EstimationPoster14 citations
- K-convexity shape priors for segmentationPoster14 citations
- Online Dictionary Learning for Approximate Archetypal AnalysisPoster14 citations
- Pivot Correlational Neural Network for Multimodal Video CategorizationPoster14 citations
- RefocusGAN: Scene Refocusing using a Single ImagePoster14 citations
- Seeing Tree Structure from VibrationPoster14 citations
- Understanding Degeneracies and Ambiguities in Attribute TransferPoster14 citations
- Learning to Dodge A Bullet: Concyclic View Morphing via Deep LearningPoster13 citations
- Stereo Computation for a Single Mixture ImagePoster13 citations
- 3D Scene Flow from 4D Light Field GradientsPoster12 citations
- Estimating the Success of Unsupervised Image to Image TranslationPoster12 citations
- Visual Text CorrectionPoster12 citations
- Learning to Blend PhotosPoster11 citations
- Self-Calibration of Cameras with Euclidean Image Plane in Case of Two Views and Known Relative Rotation AnglePoster11 citations
- Toward Scale-Invariance and Position-Sensitive Region Proposal NetworksPoster11 citations
- From Face Recognition to Models of Identity: A Bayesian Approach to Learning about Unknown Identities from Unsupervised DataPoster10 citations
- Adaptively Transforming Graph MatchingPoster9 citations
- Deep Discriminative Model for Video ClassificationPoster9 citations
- Lifting Layers: Analysis and ApplicationsPoster9 citations
- Liquid Pouring Monitoring via Rich Sensory InputsPoster9 citations
- View-graph Selection Framework for SfMPoster9 citations
- ForestHash: Semantic Hashing With Shallow Random Forests and Tiny Convolutional NetworksPoster8 citations
- Into the Twilight Zone: Depth Estimation using Joint Structure-Stereo OptimizationPoster8 citations
- Light Structure from Pin Motion: Simple and Accurate Point Light Calibration for Physics-based ModelingPoster8 citations
- Sampling Algebraic Varieties for Robust Camera AutocalibrationPoster8 citations
- Variable Ring Light Imaging: Capturing Transient Subsurface Scattering with An Ordinary CameraPoster8 citations
- Facial Dynamics Interpreter Network: What are the Important Relations between Local Dynamics for Facial Trait Estimation?Poster7 citations
- Incremental Non-Rigid Structure-from-Motion with Unknown Focal LengthPoster6 citations
- Inner Space Preserving Generative Pose MachinePoster6 citations
- Self-Calibrating Isometric Non-Rigid Structure-from-MotionPoster6 citations
- Diverse Conditional Image Generation by Stochastic Regression with Latent Drop-Out CodesPoster5 citations
- Interpolating Convolutional Neural Networks Using Batch NormalizationPoster5 citations
- Coded Illumination and Imaging for Fluorescence Based ClassificationPoster4 citations
- Local Orthogonal-Group TestingPoster4 citations
- Using LIP to Gloss Over Faces in Single-Stage Face Detection NetworksPoster4 citations
- MRF Optimization with Separable Convex Prior on Partially Ordered LabelsPoster3 citations
- Model-free Consensus Maximization for Non-Rigid ShapesPoster3 citations
- Understanding Perceptual and Conceptual Fluency at a Large ScalePoster3 citations
- Proxy Clouds for Live RGB-D Stream Processing and ConsolidationPoster2 citations
- Leveraging Motion Priors in Videos for Improving Human SegmentationPoster1 citations
ECCV accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.