ECCV 2020 Accepted Papers
The full list of 1,358 papers accepted at ECCV 2020 (European Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 1,358
- End-to-End Object Detection with TransformersPoster17,886 citations
- NeRF: Representing Scenes as Neural Radiance Fields for View SynthesisPoster12,384 citations
- RAFT: Recurrent All-Pairs Field Transforms for Optical FlowPoster3,178 citations
- Contrastive Multiview CodingPoster3,020 citations
- UNITER: UNiversal Image-TExt Representation LearningPoster2,528 citations
- Oscar: Object-Semantics Aligned Pre-training for Vision-Language TasksPoster2,351 citations
- Object-Contextual Representations for Semantic SegmentationPoster1,902 citations
- Contrastive Learning for Unpaired Image-to-Image TranslationPoster1,656 citations
- Tracking Objects as PointsPoster1,495 citations
- Big Transfer (BiT): General Visual Representation LearningPoster1,465 citations
- Towards Real-Time Multi-Object TrackingPoster1,349 citations
- Lift, Splat, Shoot: Encoding Images from Arbitrary Camera Rigs by Implicitly Unprojecting to 3DPoster1,294 citations
- Square Attack: a query-efficient black-box adversarial attack via random searchPoster1,243 citations
- Rethinking Few-shot Image Classification: A Good Embedding is All You Need?Poster1,182 citations
- Trajectron++: Dynamically-Feasible Trajectory Forecasting With Heterogeneous DataPoster1,175 citations
- Convolutional Occupancy NetworksPoster1,174 citations
- Single Path One-Shot Neural Architecture Search with Uniform SamplingPoster1,129 citations
- SOLO: Segmenting Objects by LocationsPoster950 citations
- Learning Enriched Features for Real Image Restoration and EnhancementPoster949 citations
- Axial-DeepLab: Stand-Alone Axial-Attention for Panoptic SegmentationPoster937 citations
- Ocean: Object-aware Anchor-free TrackingPoster937 citations
- Thinking in Frequency: Face Forgery Detection by Mining Frequency-aware CluesPoster912 citations
- PODNet: Pooled Outputs Distillation for Small-Tasks Incremental LearningPoster901 citations
- Single Image Super-Resolution via a Holistic Attention NetworkPoster878 citations
- Searching Efficient 3D Architectures with Sparse Point-Voxel ConvolutionPoster821 citations
- Conditional Convolutions for Instance SegmentationPoster799 citations
- Self-Challenging Improves Cross-Domain GeneralizationPoster785 citations
- Multi-modal Transformer for Video RetrievalPoster782 citations
- In-Domain GAN Inversion for Real Image EditingPoster774 citations
- PointContrast: Unsupervised Pre-training for 3D Point Cloud UnderstandingPoster757 citations
- Learning Data Augmentation Strategies for Object DetectionPoster752 citations
- Learning Lane Graph Representations for Motion ForecastingPoster732 citations
- GDumb: A Simple Approach that Questions Our Progress in Continual LearningPoster730 citations
- Reflection Backdoor: A Natural Backdoor Attack on Deep Neural NetworksPoster719 citations
- SCAN: Learning to Classify Images without LabelsPoster710 citations
- Dynamic R-CNN: Towards High Quality Object Detection via Dynamic TrainingPoster655 citations
- Spatio-Temporal Graph Transformer Networks for Pedestrian Trajectory PredictionPoster643 citations
- Arbitrary-Oriented Object Detection with Circular Smooth LabelPoster632 citations
- A Metric Learning Reality CheckPoster585 citations
- Ultra Fast Structure-aware Deep Lane DetectionPoster585 citations
- It is not the Journey but the Destination: Endpoint Conditioned Trajectory PredictionPoster580 citations
- 3D-CVF: Generating Joint Camera and LiDAR Features Using Cross-View Spatial Feature Fusion for 3D Object DetectionPoster573 citations
- Suppress and Balance: A Simple Gated Network for Salient Object DetectionPoster568 citations
- Learning to Generate Novel Domains for Domain GeneralizationPoster556 citations
- EPNet: Enhancing Point Features with Image Semantics for 3D Object DetectionPoster539 citations
- Deep Local Shapes: Learning Local SDF Priors for Detailed 3D ReconstructionPoster537 citations
- CosyPose: Consistent multi-view multi-object 6D pose estimationPoster532 citations
- SqueezeSegV3: Spatially-Adaptive Convolution for Efficient Point-Cloud SegmentationPoster531 citations
- Towards Fast, Accurate and Stable 3D Dense Face AlignmentPoster527 citations
- Probabilistic Anchor Assignment with IoU Prediction for Object DetectionPoster524 citations
- I2L-MeshNet: Image-to-Lixel Prediction Network for Accurate 3D Human Pose and Mesh Estimation from a Single RGB ImagePoster522 citations
- Dynamic Dual-Attentive Aggregation Learning for Visible-Infrared Person Re-IdentificationPoster517 citations
- Two-branch Recurrent Network for Isolating Deepfakes in VideosPoster513 citations
- Semantic Flow for Fast and Accurate Scene ParsingPoster501 citations
- V2VNet: Vehicle-to-Vehicle Communication for Joint Perception and PredictionPoster489 citations
- TextCaps: a Dataset for Image Captioning with Reading ComprehensionPoster473 citations
- Prototype Mixture Models for Few-shot Semantic SegmentationPoster469 citations
- Minimum Class Confusion for Versatile Domain AdaptationPoster468 citations
- Neural Point-Based GraphicsPoster468 citations
- SRFlow: Learning the Super-Resolution Space with Normalizing FlowPoster462 citations
- Unifying Deep Local and Global Features for Image SearchPoster459 citations
- Pose2Mesh: Graph Convolutional Network for 3D Human Pose and Mesh Recovery from a 2D Human PosePoster454 citations
- ReActNet: Towards Precise Binary Neural Network with Generalized Activation FunctionsPoster452 citations
- GRNet: Gridding Residual Network for Dense Point Cloud CompletionPoster447 citations
- Know Your Surroundings: Exploiting Scene Information for Object TrackingPoster447 citations
- Chained-Tracker: Chaining Paired Attentive Regression Results for End-to-End Joint Multiple-Object Detection and TrackingPoster444 citations
- Not only Look, but also Listen: Learning Multimodal Violence Detection under Weak SupervisionPoster444 citations
- GRAB: A Dataset of Whole-Body Human Grasping of ObjectsPoster441 citations
- Adversarial T-shirt! Evading Person Detectors in A Physical WorldPoster435 citations
- Neural Voice Puppetry: Audio-driven Facial ReenactmentPoster435 citations
- Real-World Blur Dataset for Learning and Benchmarking Deblurring AlgorithmsPoster435 citations
- Fine-Grained Visual Classification via Progressive Multi-Granularity Training of Jigsaw PatchesPoster434 citations
- Bi-directional Cross-Modality Feature Propagation with Separation-and-Aggregation Gate for RGB-D Semantic SegmentationPoster431 citations
- Multi-Scale Positive Sample Refinement for Few-Shot Object DetectionPoster426 citations
- Few-Shot Object Detection and Viewpoint Estimation for Objects in the WildPoster423 citations
- Negative Margin Matters: Understanding Margin in Few-shot ClassificationPoster417 citations
- BBS-Net: RGB-D Salient Object Detection with a Bifurcated Backbone Strategy NetworkPoster414 citations
- Exploiting Deep Generative Prior for Versatile Image Restoration and ManipulationPoster413 citations
- ScanRefer: 3D Object Localization in RGB-D Scans using Natural LanguagePoster413 citations
- Disentangled Non-local Neural NetworksPoster412 citations
- Non-Local Spatial Propagation Network for Depth CompletionPoster412 citations
- Part-aware Prototype Network for Few-shot Semantic SegmentationPoster412 citations
- A Broader Study of Cross-Domain Few-Shot LearningPoster409 citations
- Decoupling GCN with DropGraph Module for Skeleton-Based Action RecognitionPoster404 citations
- Identity-Guided Human Semantic Parsing for Person Re-IdentificationPoster404 citations
- Rethinking Image Inpainting via a Mutual Encoder-Decoder with Feature EqualizationsPoster403 citations
- What makes fake images detectable? Understanding properties that generalizePoster401 citations
- Self-Supervised Monocular Depth Estimation: Solving the Dynamic Object Problem by Semantic GuidancePoster394 citations
- REMIND Your Neural Network to Prevent Catastrophic ForgettingPoster392 citations
- Mining Cross-Image Semantics for Weakly Supervised Semantic SegmentationPoster390 citations
- Learning Joint Spatial-Temporal Transformations for Video InpaintingPoster384 citations
- RTM3D: Real-time Monocular 3D Detection from Object Keypoints for Autonomous DrivingPoster381 citations
- Instance Adaptive Self-Training for Unsupervised Domain AdaptationPoster380 citations
- History Repeats Itself: Human Motion Prediction via Motion AttentionPoster375 citations
- InterHand2.6M: A Dataset and Baseline for 3D Interacting Hand Pose Estimation from a Single RGB ImagePoster374 citations
- Classes Matter: A Fine-grained Adversarial Approach to Cross-domain Semantic SegmentationPoster369 citations
- MEAD: A Large-scale Audio-visual Dataset for Emotional Talking-face GenerationPoster368 citations
- Free View SynthesisPoster364 citations
- Knowledge Distillation Meets Self-SupervisionPoster362 citations
- House-GAN: Relational Generative Adversarial Networks for Graph-constrained House Layout GenerationPoster359 citations
- Learning From Multiple Experts: Self-paced Knowledge Distillation for Long-tailed ClassificationPoster359 citations
- BigNAS: Scaling Up Neural Architecture Search with Big Single-Stage ModelsPoster358 citations
- Prototype Rectification for Few-Shot LearningPoster358 citations
- Feature Pyramid TransformerPoster347 citations
- Whole-Body Human Pose Estimation in the WildPoster347 citations
- Atlas: End-to-End 3D Scene Reconstruction from Posed ImagesPoster345 citations
- ETH-XGaze: A Large Scale Dataset for Gaze Estimation under Extreme Head Pose and Gaze VariationPoster342 citations
- STAR: Sparse Trained Articulated Human Body RegressorPoster341 citations
- TVR: A Large-Scale Dataset for Video-Subtitle Moment RetrievalPoster340 citations
- Making an Invisibility Cloak: Real World Adversarial Attacks on Object DetectorsPoster339 citations
- ReferIt3D: Neural Listeners for Fine-Grained 3D Object Identification in Real-World ScenesPoster338 citations
- Improving Semantic Segmentation via Decoupled Body and Edge SupervisionPoster337 citations
- LatticeNet: Towards Lightweight Image Super-resolution with Lattice BlockPoster337 citations
- Rethinking Bottleneck Structure for Efficient Mobile Network DesignPoster336 citations
- Beyond the Nav-Graph: Vision-and-Language Navigation in Continuous EnvironmentsPoster331 citations
- Video Object Segmentation with Episodic Graph Memory NetworksPoster327 citations
- Feature Space Augmentation for Long-Tailed DataPoster325 citations
- Structured3D: A Large Photo-realistic Dataset for Structured 3D ModelingPoster325 citations
- Collaborative Video Object Segmentation by Foreground-Background IntegrationPoster324 citations
- Joint Disentangling and Adaptation for Cross-Domain Person Re-IdentificationPoster324 citations
- Learning Gradient Fields for Shape GenerationPoster320 citations
- SoundSpaces: Audio-Visual Navigation in 3D EnvironmentsPoster319 citations
- PIoU Loss: Towards Accurate Oriented Object Detection in Complex EnvironmentsPoster317 citations
- Learning to Optimize Domain Specific Normalization for Domain GeneralizationPoster316 citations
- Self-Supervised Learning of Audio-Visual Objects from VideoPoster313 citations
- MTI-Net: Multi-Scale Task Interaction Networks for Multi-Task LearningPoster312 citations
- Latent Embedding Feedback and Discriminative Features for Zero-Shot ClassificationPoster309 citations
- Distribution-Balanced Loss for Multi-Label Classification in Long-Tailed DatasetsPoster308 citations
- DLow: Diversifying Latent Flows for Diverse Human Motion PredictionPoster305 citations
- Guided Collaborative Training for Pixel-wise Semi-Supervised LearningPoster304 citations
- Sub-center ArcFace: Boosting Face Recognition by Large-scale Noisy Web FacesPoster304 citations
- Long-term Human Motion Prediction with Scene ContextPoster302 citations
- Memory-augmented Dense Predictive Coding for Video Representation LearningPoster300 citations
- Self-supervised Video Representation Learning by Pace PredictionPoster299 citations
- DeepGMR: Learning Latent Gaussian Mixture Models for RegistrationPoster298 citations
- Boundary-preserving Mask R-CNNPoster297 citations
- Attention Guided Anomaly Localization in ImagesPoster295 citations
- Component Divide-and-Conquer for Real-World Image Super-ResolutionPoster295 citations
- Self-supervision with Superpixels: Training Few-shot Medical Image Segmentation without AnnotationPoster295 citations
- Invertible Image RescalingPoster294 citations
- Feature-metric Loss for Self-supervised Learning of Depth and EgomotionPoster293 citations
- Clustering Driven Deep Autoencoder for Video Anomaly DetectionPoster290 citations
- Dual Adversarial Network: Toward Real-world Noise Removal and Noise GenerationPoster290 citations
- Improving One-stage Visual Grounding by Recursive Sub-query ConstructionPoster289 citations
- A Single Stream Network for Robust and Real-time RGB-D Salient Object DetectionPoster284 citations
- Image-based table recognition: data, model, and evaluationPoster284 citations
- Connecting Vision and Language with Localized NarrativesPoster283 citations
- Monocular Expressive Body Regression through Body-Driven AttentionPoster283 citations
- MovieNet: A Holistic Dataset for Movie UnderstandingPoster283 citations
- Hierarchical Dynamic Filtering Network for RGB-D Salient Object DetectionPoster277 citations
- Bridging Knowledge Graphs to Generate Scene GraphsPoster275 citations
- SPAN: Spatial Pyramid Attention Network for Image Manipulation LocalizationPoster275 citations
- Learning Delicate Local Representations for Multi-Person Pose EstimationPoster274 citations
- Adversarial Continual LearningPoster273 citations
- Faster AutoAugment: Learning Augmentation Strategies Using BackpropagationPoster272 citations
- Multi-Temporal Recurrent Neural Networks For Progressive Non-Uniform Single Image Deblurring With Incremental Temporal TrainingPoster272 citations
- Every Pixel Matters: Center-aware Feature Alignment for Domain Adaptive Object DetectorPoster270 citations
- TuiGAN: Learning Versatile Image-to-Image Translation with Two Unpaired ImagesPoster270 citations
- Video Super-Resolution with Recurrent Structure-Detail NetworkPoster270 citations
- DRG: Dual Relation Graph for Human-Object Interaction DetectionPoster268 citations
- Improving Multispectral Pedestrian Detection by Addressing Modality Imbalance ProblemsPoster267 citations
- Learning Open Set Network with Discriminative Reciprocal PointsPoster266 citations
- Pillar-based Object Detection for Autonomous DrivingPoster265 citations
- Dynamic ReLUPoster263 citations
- NASA Neural Articulated Shape ApproximationPoster263 citations
- Motion Guided 3D Pose Estimation from VideosPoster262 citations
- Defocus Deblurring Using Dual-Pixel DataPoster261 citations
- SegFix: Model-Agnostic Boundary Refinement for SegmentationPoster261 citations
- BMBC: Bilateral Motion Estimation with Bilateral Cost Volume for Video InterpolationPoster258 citations
- Improving Vision-and-Language Navigation with Image-Text Pairs from the WebPoster258 citations
- TIDE: A General Toolbox for Identifying Object Detection ErrorsPoster258 citations
- Side-Tuning: A Baseline for Network Adaptation via Additive Side NetworksPoster257 citations
- Attention-Driven Dynamic Graph Convolutional Network for Multi-Label Image RecognitionPoster255 citations
- Few-Shot Semantic Segmentation with Democratic Attention NetworksPoster254 citations
- Embedding Propagation: Smoother Manifold for Few-Shot ClassificationPoster252 citations
- Shape Prior Deformation for Categorical 6D Object Pose and Size EstimationPoster251 citations
- Learning to Balance Specificity and Invariance for In and Out of Domain GeneralizationPoster247 citations
- Gradient Centralization: A New Optimization Technique for Deep Neural NetworksPoster246 citations
- Neural Predictor for Neural Architecture SearchPoster246 citations
- Rethinking Pseudo-LiDAR RepresentationPoster245 citations
- A Simple Way to Make Neural Networks Robust Against Diverse Image CorruptionsPoster244 citations
- VoxelPose: Towards Multi-Camera 3D Human Pose Estimation in Wild EnvironmentPoster244 citations
- Mask TextSpotter v3: Segmentation Proposal Network for Robust Scene Text SpottingPoster243 citations
- SRNet: Improving Generalization in 3D Human Pose Estimation with a Split-and-Recombine ApproachPoster243 citations
- Deep Hough Transform for Semantic Line DetectionPoster242 citations
- End-to-End Low Cost Compressive Spectral Imaging with Spatial-Spectral Self-AttentionPoster242 citations
- Captioning Images Taken by People Who Are BlindPoster241 citations
- Highly Efficient Salient Object Detection with 100K ParametersPoster241 citations
- EagleEye: Fast Sub-net Evaluation for Efficient Neural Network PruningPoster240 citations
- Multiple Expert Brainstorming for Domain Adaptive Person Re-identificationPoster239 citations
- Learning from Extrinsic and Intrinsic Supervisions for Domain GeneralizationPoster238 citations
- SipMask: Spatial Information Preservation for Fast Image and Video Instance SegmentationPoster238 citations
- CelebA-Spoof: Large-Scale Face Anti-Spoofing Dataset with Rich AnnotationsPoster237 citations
- Consistency-based Semi-supervised Active Learning: Towards Minimizing Labeling CostPoster237 citations
- CurveLane-NAS: Unifying Lane-Sensitive Architecture Search and Adaptive Point BlendingPoster237 citations
- Kernelized Memory Network for Video Object SegmentationPoster237 citations
- Combining Implicit Function Learning and Parametric Models for 3D Human ReconstructionPoster236 citations
- Points2Surf Learning Implicit Surfaces from Point CloudsPoster236 citations
- Iterative Distance-Aware Similarity Matrix Convolution with Mutual-Supervised Point Elimination for Efficient Point Cloud RegistrationPoster235 citations
- Bottom-Up Temporal Action Localization with Mutual RegularizationPoster234 citations
- ContactPose: A Dataset of Grasps with Object Contact and Hand PosePoster234 citations
- Federated Visual Classification with Real-World Data DistributionPoster234 citations
- What Matters in Unsupervised Optical FlowPoster234 citations
- PointPWC-Net: Cost Volume on Point Clouds for (Self-)Supervised Scene Flow EstimationPoster233 citations
- H3DNet: 3D Object Detection Using Hybrid Geometric PrimitivesPoster232 citations
- PIPAL: a Large-Scale Image Quality Assessment Dataset for Perceptual Image RestorationPoster232 citations
- Forgetting Outside the Box: Scrubbing Deep Networks of Information Accessible from Input-Output ObservationsPoster231 citations
- Gait Lateral Network: Learning Discriminative and Compact Representations for Gait RecognitionPoster231 citations
- Simulating Content Consistent Vehicle Datasets with Attribute DescentPoster231 citations
- RobustScanner: Dynamically Enhancing Positional Clues for Robust Text RecognitionPoster230 citations
- Contextual Diversity for Active LearningPoster229 citations
- Perceive, Predict, and Plan: Safe Motion Planning Through Interpretable Semantic RepresentationsPoster229 citations
- Rethinking the Distribution Gap of Person Re-identification with Camera-based Batch NormalizationPoster228 citations
- Video-based Remote Physiological Measurement via Cross-verified Feature DisentanglingPoster228 citations
- The Devil is in Classification: A Simple Framework for Long-tail Instance SegmentationPoster227 citations
- Topology-Preserving Class-Incremental LearningPoster227 citations
- Unsupervised Domain Adaptation with Noise Resistible Mutual-Training for Person Re-identificationPoster227 citations
- Accurate RGB-D Salient Object Detection via Collaborative LearningPoster226 citations
- FLOT: Scene Flow on Point Clouds guided by Optimal TransportPoster226 citations
- Memory-Efficient Incremental Learning Through Feature AdaptationPoster226 citations
- Meta-rPPG: Remote Heart Rate Estimation Using a Transductive Meta-LearnerPoster226 citations
- Spatial-Angular Interaction for Light Field Image Super-ResolutionPoster225 citations
- Visual Compositional Learning for Human-Object Interaction DetectionPoster225 citations
- When Does Self-supervision Improve Few-shot Learning?Poster225 citations
- NSGANetV2: Evolutionary Multi-Objective Surrogate-Assisted Neural Architecture SearchPoster222 citations
- Naive-Student: Leveraging Semi-Supervised Learning in Video Sequences for Urban Scene SegmentationPoster222 citations
- REVISE: A Tool for Measuring and Mitigating Bias in Visual DatasetsPoster222 citations
- BSL-1K: Scaling up co-articulated sign language recognition using mouthing cuesPoster221 citations
- Blind Face Restoration via Deep Multi-scale Component DictionariesPoster220 citations
- URVOS: Unified Referring Video Object Segmentation Network with a Large-Scale BenchmarkPoster220 citations
- Few-shot Action Recognition with Permutation-invariant AttentionPoster219 citations
- High-Resolution Image Inpainting with Iterative Confidence Feedback and Guided UpsamplingPoster219 citations
- Hybrid Models for Open Set RecognitionPoster219 citations
- Talking-head Generation with Rhythmic Head MotionPoster219 citations
- ViTAA: Visual-Textual Attributes Alignment in Person Search by Natural LanguagePoster219 citations
- DADA: Differentiable Automatic Data AugmentationPoster218 citations
- Domain-invariant Stereo Matching NetworksPoster218 citations
- Spike-FlowNet: Event-based Optical Flow Estimation with Energy-Efficient Hybrid Neural NetworksPoster218 citations
- Unified Multisensory Perception: Weakly-Supervised Audio-Visual Video ParsingPoster218 citations
- A Closer Look at Local Aggregation Operators in Point Cloud AnalysisPoster217 citations
- SNE-RoadSeg: Incorporating Surface Normal Information into Semantic Segmentation for Accurate Freespace DetectionPoster217 citations
- Segmenting Transparent Objects in the WildPoster217 citations
- Smooth-AP: Smoothing the Path Towards Large-Scale Image RetrievalPoster217 citations
- Consensus-Aware Visual-Semantic Embedding for Image-Text MatchingPoster216 citations
- PointMixup: Augmentation for Point CloudsPoster216 citations
- A unifying mutual information view of metric learning: cross-entropy vs. pairwise lossesPoster215 citations
- Dual Mixup Regularized Learning for Adversarial Domain AdaptationPoster214 citations
- Soft Anchor-Point Object DetectionPoster214 citations
- TAO: A Large-Scale Benchmark for Tracking Any ObjectPoster214 citations
- Boundary Content Graph Neural Network for Temporal Action Proposal GenerationPoster213 citations
- Unified Image and Video Saliency ModelingPoster213 citations
- Deep FusionNet for Point Cloud Semantic SegmentationPoster212 citations
- Flow-edge Guided Video CompletionPoster212 citations
- Post-Training Piecewise Linear Quantization for Deep Neural NetworksPoster212 citations
- JSTASR: Joint Size and Transparency-Aware Snow Removal Algorithm Based on Modified Partial Convolution and Veiling Effect RemovalPoster211 citations
- Object as Hotspots: An Anchor-Free 3D Object Detection Approach via Firing of HotspotsPoster211 citations
- ProxyNCA++: Revisiting and Revitalizing Proxy Neighborhood Component AnalysisPoster211 citations
- Virtual Multi-view Fusion for 3D Semantic SegmentationPoster211 citations
- STEm-Seg: Spatio-temporal Embeddings for Instance Segmentation in VideosPoster210 citations
- Weakly Supervised Semantic Segmentation with Boundary ExplorationPoster210 citations
- XingGAN for Person Image GenerationPoster210 citations
- UnionDet: Union-Level Detector Towards Real-Time Human-Object Interaction DetectionPoster209 citations
- Cross-Modal Weighting Network for RGB-D Salient Object DetectionPoster208 citations
- Efficient Neighbourhood Consensus Networks via Submanifold Sparse ConvolutionsPoster208 citations
- Kinematic 3D Object Detection in Monocular VideoPoster208 citations
- Spatial-Adaptive Network for Single Image DenoisingPoster208 citations
- Content-Aware Unsupervised Deep Homography EstimationPoster207 citations
- Learning to Detect Open Classes for Universal Domain AdaptationPoster207 citations
- Reducing the Sim-to-Real Gap for Event CamerasPoster206 citations
- Deep Spiking Neural Network: Energy Efficiency Through Time based CodingPoster205 citations
- Prior-based Domain Adaptive Object Detection for Hazy and Rainy ConditionsPoster205 citations
- SemanticAdv: Generating Adversarial Examples via Attribute-conditioned Image EditingPoster203 citations
- Learning Feature Descriptors using Camera Pose SupervisionPoster201 citations
- Dense Hybrid Recurrent Multi-view Stereo Net with Dynamic Consistency CheckingPoster200 citations
- Fully Convolutional Networks for Continuous Sign Language RecognitionPoster200 citations
- Self-supervised Single-view 3D Reconstruction via Semantic ConsistencyPoster200 citations
- Hard negative examples are hard, but usefulPoster199 citations
- On the Effectiveness of Image Rotation for Open Set Domain AdaptationPoster199 citations
- Self-supervising Fine-grained Region Similarities for Large-scale Image LocalizationPoster199 citations
- Learning What to Learn for Video Object SegmentationPoster198 citations
- Learning Progressive Joint Propagation for Human Motion PredictionPoster197 citations
- Learning to Learn with Variational Information Bottleneck for Domain GeneralizationPoster196 citations
- Few-Shot Scene-Adaptive Anomaly DetectionPoster195 citations
- PiP: Planning-informed Trajectory Prediction for Autonomous DrivingPoster195 citations
- Region Graph Embedding Network for Zero-Shot LearningPoster195 citations
- CLAWS: Clustering Assisted Weakly Supervised Learning with Normalcy Suppression for Anomalous Event DetectionPoster194 citations
- Joint Visual and Temporal Consistency for Unsupervised Domain Adaptive Person Re-IdentificationPoster194 citations
- Side-Aware Boundary Localization for More Precise Object DetectionPoster194 citations
- Stable Low-rank Tensor Decomposition for Compression of Convolutional Neural NetworkPoster194 citations
- AR-Net: Adaptive Frame Resolution for Efficient Action RecognitionPoster193 citations
- Face Anti-Spoofing with Human Material PerceptionPoster193 citations
- Guiding Monocular Depth Estimation Using Depth-Attention VolumePoster193 citations
- Implicit Latent Variable Model for Scene-Consistent Motion ForecastingPoster193 citations
- BCNet: Learning Body and Cloth Shape from A Single ImagePoster191 citations
- Intra-class Feature Variation Distillation for Semantic SegmentationPoster191 citations
- Multiple Sound Sources Localization from Coarse to FinePoster191 citations
- Progressive Transformers for End-to-End Sign Language ProductionPoster191 citations
- Learning Visual Representations with Caption AnnotationsPoster190 citations
- SF-Net: Single-Frame Supervision for Temporal Action LocalizationPoster190 citations
- Unpaired Learning of Deep Image DenoisingPoster190 citations
- Content-Consistent Matching for Domain Adaptive Semantic SegmentationPoster188 citations
- Occupancy Anticipation for Efficient Exploration and NavigationPoster188 citations
- Event-based Asynchronous Sparse Convolutional NetworksPoster187 citations
- Linguistic Structure Guided Context Modeling for Referring Image SegmentationPoster187 citations
- StyleGAN2 Distillation for Feed-forward Image ManipulationPoster186 citations
- Temporal Aggregate Representations for Long-Range Video UnderstandingPoster186 citations
- MuCAN: Multi-Correspondence Aggregation Network for Video Super-ResolutionPoster185 citations
- Weakly Supervised 3D Hand Pose Estimation via Biomechanical ConstraintsPoster185 citations
- Fast Bi-layer Neural Synthesis of One-Shot Realistic Head AvatarsPoster184 citations
- The Devil is in the Details: Self-Supervised Attention for Vehicle Re-IdentificationPoster184 citations
- Appearance-Preserving 3D Convolution for Video-based Person Re-identificationPoster183 citations
- CLOTH3D: Clothed 3D HumansPoster182 citations
- Synthesize then Compare: Detecting Failures and Anomalies for Semantic SegmentationPoster182 citations
- Associative Alignment for Few-shot Image ClassificationPoster181 citations
- A Comprehensive Study of Weight Sharing in Graph Networks for 3D Human Pose EstimationPoster180 citations
- Challenge-Aware RGBT TrackingPoster180 citations
- Face Anti-Spoofing via Disentangled Representation LearningPoster180 citations
- Interpretable and Generalizable Person Re-Identification with Query-Adaptive Convolution and Temporal LiftingPoster180 citations
- Scene Text Image Super-resolution in the wildPoster180 citations
- Attract, Perturb, and Explore: Learning a Feature Alignment Network for Semi-supervised Domain AdaptationPoster179 citations
- Boundary-Aware Cascade Networks for Temporal Action SegmentationPoster179 citations
- Leveraging Seen and Unseen Semantic Relationships for Generative Zero-Shot LearningPoster178 citations
- Patch-wise Attack for Fooling Deep Neural NetworkPoster178 citations
- VPN: Learning Video-Pose Embedding for Activities of Daily LivingPoster178 citations
- Point-Set Anchors for Object Detection, Instance Segmentation and Pose EstimationPoster177 citations
- Selecting Relevant Features from a Multi-domain Representation for Few-shot ClassificationPoster177 citations
- Detail Preserved Point Cloud Completion via Separated Feature AggregationPoster176 citations
- Two-Stream Consensus Network for Weakly-Supervised Temporal Action LocalizationPoster176 citations
- BorderDet: Border Feature for Dense Object DetectionPoster175 citations
- Efficient Spatio-Temporal Recurrent Neural Network for Video DeblurringPoster175 citations
- JSENet: Joint Semantic Segmentation and Edge Detection Network for 3D Point CloudsPoster175 citations
- Contextual-Relation Consistent Domain Adaptation for Semantic SegmentationPoster174 citations
- MotionSqueeze: Neural Motion Feature Learning for Video UnderstandingPoster174 citations
- Practical Detection of Trojan Neural Networks: Data-Limited and Data-Free CasesPoster173 citations
- Efficient Semantic Video Segmentation with Per-frame InferencePoster172 citations
- Generative Low-bitwidth Data Free QuantizationPoster172 citations
- ParSeNet: A Parametric Surface Fitting Network for 3D Point CloudsPoster172 citations
- An Ensemble of Epoch-wise Empirical Bayes for Few-shot LearningPoster171 citations
- Progressively Guided Alternate Refinement Network for RGB-D Salient Object DetectionPoster171 citations
- Self6D: Self-Supervised Monocular 6D Object Pose EstimationPoster171 citations
- On Disentangling Spoof Trace for Generic Face Anti-SpoofingPoster170 citations
- Bias-based Universal Adversarial Patch Attack for Automatic Check-outPoster169 citations
- Foley Music: Learning to Generate Music from VideosPoster168 citations
- RGB-D Salient Object Detection with Cross-Modality Modulation and SelectionPoster168 citations
- Shape and Viewpoint without KeypointsPoster168 citations
- A Balanced and Uncertainty-aware Approach for Partial Domain AdaptationPoster166 citations
- Self-Supervised Monocular 3D Face Reconstruction by Occlusion-Aware Multi-view Geometry ConsistencyPoster166 citations
- Differentiable Hierarchical Graph Grouping for Multi-Person Pose EstimationPoster165 citations
- Asynchronous Interaction Aggregation for Action DetectionPoster164 citations
- Deep Fashion3D: A Dataset and Benchmark for 3D Garment Reconstruction from Single ImagesPoster163 citations
- Behind the Scene: Revealing the Secrets of Pre-trained Vision-and-Language ModelsPoster162 citations
- FeatMatch: Feature-Based Augmentation for Semi-Supervised LearningPoster162 citations
- Learning Object Relation Graph and Tentative Policy for Visual NavigationPoster162 citations
- Learning with Privileged Information for Efficient Image Super-ResolutionPoster162 citations
- Contrastive Learning for Weakly Supervised Phrase GroundingPoster161 citations
- Domain Adaptive Object Detection via Asymmetric Tri-way Faster-RCNNPoster161 citations
- Comprehensive Image Captioning via Scene Graph DecompositionPoster160 citations
- Content Adaptive and Error Propagation Aware Deep Video CompressionPoster160 citations
- Cross-Attention in Coupled Unmixing Nets for Unsupervised Hyperspectral Super-ResolutionPoster160 citations
- Funnel Activation for Visual RecognitionPoster160 citations
- Perceiving 3D Human-Object Spatial Arrangements from a Single Image in the WildPoster160 citations
- Weakly Supervised 3D Human Pose and Shape Reconstruction with Normalizing FlowsPoster160 citations
- Rewriting a Deep Generative ModelPoster159 citations
- Unpaired Image-to-Image Translation using Adversarial Consistency LossPoster159 citations
- Multi-Task Curriculum Framework for Open-Set Semi-Supervised LearningPoster158 citations
- DHP: Differentiable Meta Pruning via HyperNetworksPoster157 citations
- Encoding Structure-Texture Relation with P-Net for Anomaly Detection in Retinal ImagesPoster157 citations
- Physics-based Feature Dehazing NetworksPoster157 citations
- Unsupervised Domain Adaptation in the Dissimilarity Space for Person Re-identificationPoster156 citations
- Jointly De-biasing Face Recognition and Demographic Attribute EstimationPoster155 citations
- PUGeo-Net: A Geometry-centric Network for 3D Point Cloud UpsamplingPoster155 citations
- TSIT: A Simple and Versatile Framework for Image-to-Image TranslationPoster155 citations
- Guidance and Evaluation: Semantic-Aware Image Inpainting for Mixed ScenesPoster154 citations
- Learning Event-Driven Video Deblurring and InterpolationPoster154 citations
- AdvPC: Transferable Adversarial Perturbations on 3D Point CloudsPoster153 citations
- Detecting Human-Object Interactions with Action Co-occurrence PriorsPoster153 citations
- Neural Design Network: Graphic Layout Generation with ConstraintsPoster152 citations
- A Consistently Fast and Globally Optimal Solution to the Perspective-n-Point ProblemPoster151 citations
- Adaptive Mixture Regression Network with Local Counting Map for Crowd CountingPoster151 citations
- Curriculum Manager for Source Selection in Multi-Source Domain AdaptationPoster151 citations
- Learning to Combine: Knowledge Aggregation for Multi-Source Domain AdaptationPoster151 citations
- Deep Shape from PolarizationPoster150 citations
- Forecasting Human-Object Interaction: Joint Prediction of Motor Attention and Actions in First Person VideoPoster150 citations
- Temporal Complementary Learning for Video Person Re-IdentificationPoster150 citations
- SOLAR: Second-Order Loss and Attention for Image RetrievalPoster149 citations
- Weakly-Supervised Action Localization with Expectation-Maximization Multi-Instance LearningPoster149 citations
- Diverse and Admissible Trajectory Prediction through Multimodal Context UnderstandingPoster148 citations
- Towards Streaming PerceptionPoster148 citations
- Improving Deep Video Compression by Resolution-adaptive Flow CodingPoster147 citations
- Lifespan Age Transformation SynthesisPoster146 citations
- Large-scale Pretraining for Visual Dialog: A Simple State-of-the-Art BaselinePoster145 citations
- Learning What Makes a Difference from Counterfactual Examples and Gradient SupervisionPoster145 citations
- RadarNet: Exploiting Radar for Robust Perception of Dynamic ObjectsPoster145 citations
- The Hessian Penalty: A Weak Prior for Unsupervised DisentanglementPoster145 citations
- YOLO in the Dark - Domain Adaptation Method for Merging Multiple Models -Poster145 citations
- Corner Proposal Network for Anchor-free, Two-stage Object DetectionPoster144 citations
- Hand-Transformer: Non-Autoregressive Structured Modeling for 3D Hand Pose EstimationPoster144 citations
- Pyramid Multi-view Stereo Net with Self-adaptive View AggregationPoster144 citations
- Stochastic Fine-grained Labeling of Multi-state Sign Glosses for Continuous Sign Language RecognitionPoster144 citations
- Category Level Object Pose Estimation via Neural Analysis-by-SynthesisPoster143 citations
- SSN: Shape Signature Networks for Multi-class Object Detection from Point CloudsPoster143 citations
- Collaborative Training between Region Proposal Localization and Classification for Domain Adaptive Object DetectionPoster142 citations
- Invertible Zero-Shot Recognition FlowsPoster142 citations
- Actions as Moving PointsPoster141 citations
- VisualCOMET: Reasoning about the Dynamic Context of a Still ImagePoster141 citations
- Cascade Graph Neural Networks for RGB-D Salient Object DetectionPoster140 citations
- Event Enhanced High-Quality Image RecoveryPoster140 citations
- Imbalanced Continual Learning with Partitioning Reservoir SamplingPoster140 citations
- Conditional Sequential Modulation for Efficient Global Image RetouchingPoster139 citations
- DSA: More Efficient Budgeted Pruning via Differentiable Sparsity AllocationPoster139 citations
- A Differentiable Recurrent Surface for Asynchronous Event-Based DataPoster138 citations
- Multiview Detection with Feature Perspective TransformationPoster138 citations
- Guided Saliency Feature Learning for Person Re-identification in Crowded ScenesPoster137 citations
- Spatial Attention Pyramid Network for Unsupervised Domain AdaptationPoster137 citations
- An LSTM Approach to Temporal 3D Object Detection in LiDAR Point CloudsPoster136 citations
- Asymmetric Two-Stream Architecture for Accurate RGB-D Saliency DetectionPoster136 citations
- Fast Video Object Segmentation using the Global Context ModulePoster136 citations
- From Shadow Segmentation to Shadow RemovalPoster136 citations
- Gradient-Induced Co-Saliency DetectionPoster136 citations
- MatryODShka: Real-time 6DoF Video View Synthesis using Multi-Sphere ImagesPoster136 citations
- Large Scale Holistic Video UnderstandingPoster135 citations
- Rethinking Class Activation Mapping for Weakly Supervised Object LocalizationPoster135 citations
- Discrete Point Flow Networks for Efficient Point Cloud GenerationPoster134 citations
- Fashionpedia: Ontology, Segmentation, and an Attribute Localization DatasetPoster134 citations
- Deep Reflectance Volumes: Relightable Reconstructions from Multi-View Photometric ImagesPoster133 citations
- More Classifiers, Less Forgetting: A Generic Multi-classifier Paradigm for Incremental LearningPoster133 citations
- Object-and-Action Aware Model for Visual Language NavigationPoster133 citations
- SIZER: A Dataset and Model for Parsing 3D Clothing and Learning Size Sensitive 3D ClothingPoster133 citations
- Gen-LaneNet: A Generalized and Scalable Approach for 3D Lane DetectionPoster132 citations
- SMAP: Single-Shot Multi-Person Absolute 3D Pose EstimationPoster132 citations
- Style Transfer for Co-Speech Gesture Animation: A Multi-Speaker Conditional-Mixture ApproachPoster132 citations
- Two-phase Pseudo Label Densification for Self-training based Domain AdaptationPoster132 citations
- Box2Seg: Attention Weighted Loss and Discriminative Feature Learning for Weakly Supervised SegmentationPoster131 citations
- Deep Graph Matching via Blackbox Differentiation of Combinatorial SolversPoster131 citations
- Feature Normalized Knowledge Distillation for Image ClassificationPoster131 citations
- Do Not Mask What You Do Not Need to Mask: a Parser-Free Virtual Try-OnPoster129 citations
- PatchAttack: A Black-box Texture-based Attack with Reinforcement LearningPoster129 citations
- Weakly Supervised 3D Object Detection from Lidar Point CloudPoster129 citations
- Hierarchical Kinematic Human Mesh RecoveryPoster128 citations
- Model-Agnostic Boundary-Adversarial Sampling for Test-Time Generalization in Few-Shot learningPoster128 citations
- Who Left the Dogs Out? 3D Animal Reconstruction with Expectation Maximization in the LoopPoster128 citations
- DeepSFM: Structure From Motion Via Deep Bundle AdjustmentPoster127 citations
- Generalizing Person Re-Identification by Camera-Aware Invariance Learning and Cross-Domain MixupPoster127 citations
- Generative Sparse Detection Networks for 3D Single-shot Object DetectionPoster127 citations
- WeightNet: Revisiting the Design Space of Weight NetworksPoster127 citations
- Inter-Image Communication for Weakly Supervised LocalizationPoster126 citations
- Wavelet-Based Dual-Branch Network for Image DemoiréingPoster126 citations
- Semi-Supervised Segmentation based on Error-Correcting SupervisionPoster125 citations
- Curriculum DeepSDFPoster124 citations
- Info3D: Representation Learning on 3D Objects using Mutual Information Maximization and Contrastive LearningPoster123 citations
- Learning Modality Interaction for Temporal Sentence Localization and Event Captioning in VideosPoster123 citations
- Shuffle and Attend: Video Domain AdaptationPoster123 citations
- ForkGAN: Seeing into the Rainy NightPoster122 citations
- Omni-sourced Webly-supervised Learning for Video RecognitionPoster122 citations
- Table Structure Recognition using Top-Down and Bottom-Up CuesPoster122 citations
- Amplifying Key Cues for Human-Object-Interaction DetectionPoster121 citations
- GANwriting: Content-Conditioned Generation of Styled Handwritten Word ImagesPoster121 citations
- Learning Canonical Representations for Scene Graph to Image GenerationPoster121 citations
- Learning and Aggregating Deep Local Descriptors for Instance-level RecognitionPoster121 citations
- NAS-Count: Counting-by-Density with Neural Architecture SearchPoster121 citations
- Spatially Adaptive Inference with Stochastic Feature Sampling and InterpolationPoster121 citations
- Structured Landmark Detection via Topology-Adapting Deep Graph LearningPoster121 citations
- DH3D: Deep Hierarchical 3D Descriptors for Robust Large-Scale 6DoF RelocalizationPoster120 citations
- Adversarial Robustness on In- and Out-Distribution Improves ExplainabilityPoster119 citations
- Contact and Human Dynamics from Monocular VideoPoster119 citations
- HardGAN: A Haze-Aware Representation Distillation GAN for Single Image DehazingPoster119 citations
- Practical Deep Raw Image Denoising on Mobile DevicesPoster119 citations
- Procedure Planning in Instructional VideosPoster119 citations
- Quantization Guided JPEG Artifact CorrectionPoster119 citations
- Speech-driven Facial Animation using Cascaded GANs for Learning of Motion and TexturePoster119 citations
- The Mapillary Traffic Sign Dataset for Detection and Classification on a Global ScalePoster119 citations
- Adversarial Background-Aware Loss for Weakly-supervised Temporal Activity LocalizationPoster118 citations
- COCO-FUNIT: Few-Shot Unsupervised Image Translation with a Content Conditioned Style EncoderPoster118 citations
- DSDNet: Deep Structured self-Driving NetworkPoster118 citations
- Graph-PCNN: Two Stage Human Pose Estimation with Graph Pose RefinementPoster117 citations
- CycAs: Self-supervised Cycle Association for Learning Re-identifiable DescriptionsPoster116 citations
- Deep Credible Metric Learning for Unsupervised Domain Adaptation Person Re-identificationPoster116 citations
- PatchNets: Patch-Based Generalizable Deep Implicit 3D Shape RepresentationsPoster116 citations
- Aligning and Projecting Images to Class-conditional Generative NetworksPoster115 citations
- Orientation-aware Vehicle Re-identification with Semantics-guided Part Attention NetworkPoster115 citations
- Towards Recognizing Unseen Categories in Unseen DomainsPoster115 citations
- World-Consistent Video-to-Video SynthesisPoster115 citations
- CONFIG: Controllable Neural Face Image GenerationPoster114 citations
- Contextual Heterogeneous Graph Network for Human-Object Interaction DetectionPoster114 citations
- Dual Refinement Underwater Object Detection NetworkPoster114 citations
- Fairness by Learning Orthogonal Disentangled RepresentationsPoster114 citations
- Inherent Adversarial Robustness of Deep Spiking Neural Networks: Effects of Discrete Input Encoding and Non-Linear ActivationsPoster114 citations
- RANSAC-Flow: Generic Two-stage Image AlignmentPoster114 citations
- Grounded Situation RecognitionPoster113 citations
- Label-Driven Reconstruction for Domain Adaptation in Semantic SegmentationPoster113 citations
- Mining Inter-Video Proposal Relations for Video Object DetectionPoster113 citations
- PROFIT: A Novel Training Method for sub-4-bit MobileNet ModelsPoster113 citations
- Social Adaptive Module for Weakly-supervised Group Activity RecognitionPoster113 citations
- A Generic Graph-based Neural Architecture Encoding Scheme for Predictor-based NASPoster112 citations
- Quaternion Equivariant Capsule Networks for 3D Point CloudsPoster112 citations
- SPARK: Spatial-aware Online Incremental Attack Against Visual TrackingPoster112 citations
- Learning Feature Embeddings for Discriminant Model based TrackingPoster111 citations
- Multimodal Shape Completion via Conditional Generative Adversarial NetworksPoster110 citations
- PG-Net: Pixel to Global Matching Network for Visual TrackingPoster110 citations
- Autoregressive Unsupervised Image SegmentationPoster109 citations
- Counterfactual Vision-and-Language Navigation via Adversarial Path SamplerPoster109 citations
- Meta-Sim2: Unsupervised Learning of Scene Structure for Synthetic Data GenerationPoster109 citations
- Sat2Graph: Road Graph Extraction through Graph-Tensor EncodingPoster109 citations
- Targeted Attack for Deep Hashing based RetrievalPoster109 citations
- CLNet: A Compact Latent Network for Fast Adjusting Siamese TrackersPoster108 citations
- LiteFlowNet3: Resolving Correspondence Ambiguity for More Accurate Optical Flow EstimationPoster108 citations
- Weakly-Supervised Crowd Counting Learns from Sorting rather than LocationsPoster108 citations
- A Boundary Based Out-of-Distribution Classifier for Generalized Zero-Shot LearningPoster107 citations
- Efficient Adversarial Attacks for Visual Object TrackingPoster107 citations
- Human Body Model Fitting by Learned Gradient DescentPoster107 citations
- Learning Disentangled Representations via Mutual Information EstimationPoster107 citations
- Monocular Real-Time Volumetric Performance CapturePoster107 citations
- PlugNet: Degradation Aware Scene Text Recognition Supervised by a Pluggable Super-Resolution UnitPoster107 citations
- VisualEchoes: Spatial Image Representation Learning through EcholocationPoster107 citations
- RobustFusion: Human Volumetric Capture with Data-driven Visual Cues using a RGBD CameraPoster106 citations
- Spatially Aware Multimodal Transformers for TextVQAPoster106 citations
- A Large-scale Annotated Mechanical Components Benchmark for Classification and Retrieval Tasks with Deep Neural NetworksPoster105 citations
- Class-wise Dynamic Graph Convolution for Semantic SegmentationPoster105 citations
- GIQA: Generated Image Quality AssessmentPoster104 citations
- Guided Deep Decoder: Unsupervised Image Pair FusionPoster104 citations
- Learning Graph-Convolutional Representations for Point Cloud DenoisingPoster104 citations
- Reparameterizing Convolutions for Incremental Multi-Task Learning without Task InterferencePoster104 citations
- Sparse Adversarial Attack via Perturbation FactorizationPoster104 citations
- Segment as Points for Efficient Online Multi-Object Tracking and SegmentationPoster103 citations
- Sep-Stereo: Visually Guided Stereophonic Audio Generation by Associating Source SeparationPoster103 citations
- Towards End-to-end Video-based Eye-TrackingPoster103 citations
- Towards causal benchmarking of bias in face analysis algorithmsPoster103 citations
- VQA-LOL: Visual Question Answering under the Lens of LogicPoster103 citations
- Adapting Object Detectors with Conditional Domain NormalizationPoster102 citations
- Few-shot Compositional Font Generation with Dual MemoryPoster102 citations
- Peeking into occluded joints: A novel framework for crowd pose estimationPoster102 citations
- PAMS: Quantized Super-Resolution via Parameterized Max ScalePoster101 citations
- Are Labels Necessary for Neural Architecture Search?Poster100 citations
- BIRNAT: Bidirectional Recurrent Neural Networks with Adversarial Training for Video Snapshot Compressive ImagingPoster100 citations
- Context-Aware RCNN: A Baseline for Action Detection in VideosPoster100 citations
- DeepFit: 3D Surface Fitting via Neural Network Weighted Least SquaresPoster99 citations
- GATCluster: Self-Supervised Gaussian-Attention Network for Image ClusteringPoster99 citations
- Semantic Curiosity for Active Visual LearningPoster99 citations
- VLANet: Video-Language Alignment Network for Weakly-Supervised Video Moment RetrievalPoster99 citations
- DDGCN: A Dynamic Directed Graph Convolutional Network for Action RecognitionPoster98 citations
- Fast Adaptation to Super-Resolution Networks via Meta-LearningPoster98 citations
- Multitask Learning Strengthens Adversarial RobustnessPoster98 citations
- SimAug: Learning Robust Representations from Simulation for Trajectory PredictionPoster98 citations
- VCNet: A Robust Approach to Blind Image InpaintingPoster98 citations
- Deep Hough-Transform Line PriorsPoster97 citations
- Geometry Constrained Weakly Supervised Object LocalizationPoster97 citations
- View-Invariant Probabilistic Embedding for Human PosePoster97 citations
- Weighing Counts: Sequential Crowd Counting by Reinforcement LearningPoster97 citations
- Domain Adaptive Semantic Segmentation Using Weak LabelsPoster96 citations
- Joint Learning of Social Groups, Individuals Action and Sub-group Activities in VideosPoster96 citations
- Online Meta-Learning for Multi-Source and Semi-Supervised Domain AdaptationPoster96 citations
- P²Net: Patch-match and Plane-regularization for Unsupervised Indoor Depth EstimationPoster96 citations
- Semi-Supervised Crowd Counting via Self-Training on Surrogate TasksPoster96 citations
- Human Interaction Learning on 3D Skeleton Point Clouds for Video Violence RecognitionPoster95 citations
- Mask2CAD: 3D Shape Prediction by Learning to Segment and RetrievePoster95 citations
- MimicDet: Bridging the Gap Between One-Stage and Two-Stage Object DetectionPoster95 citations
- Probabilistic Future Prediction for Video Scene UnderstandingPoster95 citations
- Differentiable Joint Pruning and Quantization for Hardware EfficiencyPoster94 citations
- Improving 3D Object Detection through Progressive Population Based AugmentationPoster94 citations
- Label Propagation with Augmented Anchors: A Simple Semi-Supervised Learning baseline for Unsupervised Domain AdaptationPoster94 citations
- Learning latent representations across multiple data domains using Lifelong VAEGANPoster94 citations
- Reducing Language Biases in Visual Question Answering with Visually-Grounded Question EncoderPoster94 citations
- Robust Re-Identification by Multiple Views Knowledge DistillationPoster94 citations
- TAFSSL: Task-Adaptive Feature Sub-Space Learning for few-shot classificationPoster94 citations
- Fashion Captioning: Towards Generating Accurate Descriptions with Semantic RewardsPoster93 citations
- MutualNet: Adaptive ConvNet via Mutual Learning from Network Width and ResolutionPoster93 citations
- Backpropagated Gradient Representations for Anomaly DetectionPoster92 citations
- Shonan Rotation Averaging: Global Optimality by Surfing SO(p)(n)Poster92 citations
- SoftPoolNet: Shape Descriptor for Point Cloud Completion and ClassificationPoster92 citations
- Improving Object Detection with Selective Self-Supervised Self-TrainingPoster91 citations
- Improving the Transferability of Adversarial Examples with Resized-Diverse-Inputs, Diversity-Ensemble and Region FittingPoster91 citations
- Learning Monocular Visual Odometry via Self-Supervised Long-Term ModelingPoster91 citations
- Neural Re-Rendering of Humans from a Single ImagePoster91 citations
- Spatiotemporal Attacks for Embodied AgentsPoster91 citations
- Temporal Coherence or Temporal Motion: Which is More Critical for Video-based Person Re-identification?Poster91 citations
- Binarized Neural Network for Single Image Super ResolutionPoster90 citations
- Global Distance-distributions Separation for Unsupervised Person Re-identificationPoster90 citations
- Learning Visual Commonsense for Robust Scene Graph GenerationPoster90 citations
- Learning from Scale-Invariant Examples for Domain Adaptation in Semantic SegmentationPoster90 citations
- AtlantaNet: Inferring the 3D Indoor Layout from a Single 360(∘) Image beyond the Manhattan World AssumptionPoster89 citations
- CPGAN: Content-Parsing Generative Adversarial Networks for Text-to-Image SynthesisPoster89 citations
- Character Region Attention For Text SpottingPoster89 citations
- Edge-aware Graph Representation Learning and Reasoning for Face ParsingPoster89 citations
- Learning Joint Visual Semantic Matching Embeddings for Language-guided RetrievalPoster89 citations
- Learning to Count in the Crowd from Limited Labeled DataPoster88 citations
- Online Invariance Selection for Local Feature DescriptorsPoster88 citations
- Tensor Low-Rank Reconstruction for Semantic SegmentationPoster88 citations
- Explainable Face RecognitionPoster87 citations
- HTML: A Parametric Hand Texture Model for 3D Hand Reconstruction and PersonalizationPoster87 citations
- LIMP: Learning Latent Shape Representations with Metric Preservation PriorsPoster87 citations
- MINI-Net: Multiple Instance Ranking Network for Video Highlight DetectionPoster87 citations
- SESAME: Semantic Editing of Scenes by Adding, Manipulating or Erasing ObjectsPoster87 citations
- Semi-supervised Semantic Segmentation via Strong-weak Dual-branch NetworkPoster87 citations
- BATS: Binary ArchitecTure SearchPoster86 citations
- A Unified Framework for Shot Type Classification Based on Subject Centric LensPoster85 citations
- Active Visual Information Gathering for Vision-Language NavigationPoster85 citations
- Face Super-Resolution Guided by 3D Facial PriorsPoster85 citations
- OnlineAugment: Online Data Augmentation with Less Domain KnowledgePoster85 citations
- Learning Where to Focus for Efficient Video Object DetectionPoster84 citations
- Learning to Compose Hypercolumns for Visual CorrespondencePoster84 citations
- Progressive Point Cloud Deconvolution Generation NetworkPoster84 citations
- RubiksNet: Learnable 3D-Shift for Efficient Video Action RecognitionPoster84 citations
- Adversarial Self-Supervised Learning for Semi-Supervised 3D Action RecognitionPoster83 citations
- Angle-based Search Space Shrinking for Neural Architecture SearchPoster83 citations
- Boosting Decision-based Black-box Adversarial Attacks with Random Sign FlipPoster83 citations
- Deep Plastic Surgery: Robust and Controllable Image Editing with Human-Drawn SketchesPoster83 citations
- Online Continual Learning under Extreme Memory ConstraintsPoster83 citations
- Crowdsampling the Plenoptic FunctionPoster82 citations
- Global and Local Enhancement Networks for Paired and Unpaired Image EnhancementPoster82 citations
- Polysemy Deciphering Network for Human-Object Interaction DetectionPoster82 citations
- Synthesizing Coupled 3D Face Modalities by Trunk-Branch Generative Adversarial NetworksPoster82 citations
- Unsupervised Shape and Pose Disentanglement for 3D MeshesPoster82 citations
- Context-Gated ConvolutionPoster81 citations
- Object Detection with a Unified Label Space from Multiple DatasetsPoster81 citations
- Pseudo RGB-D for Self-Improving Monocular SLAM and Depth PredictionPoster81 citations
- Splitting vs. Merging: Mining Object Regions with Discrepancy and Intersection Loss for Weakly Supervised Semantic SegmentationPoster81 citations
- Towards Generalization Across Depth for Monocular 3D Object DetectionPoster81 citations
- CoReNet: Coherent 3D Scene Reconstruction from a Single RGB ImagePoster80 citations
- Empowering Relational Network by Self-Attention Augmented Conditional Random Fields for Group Activity RecognitionPoster80 citations
- GAN Slimming: All-in-One GAN Compression by A Unified Optimization FrameworkPoster80 citations
- High-Fidelity Synthesis with Disentangled RepresentationPoster80 citations
- Learning Stereo from Single ImagesPoster80 citations
- Adaptive Offline Quintuplet Loss for Image-Text MatchingPoster79 citations
- Adversarial Semantic Data Augmentation for Human Pose EstimationPoster79 citations
- All at Once: Temporally Adaptive Multi-Frame Interpolation with Advanced Motion ModelingPoster79 citations
- Deep Vectorization of Technical DrawingsPoster79 citations
- DiVA: Diverse Visual Feature Aggregation for Deep Metric LearningPoster79 citations
- Energy-Based Models for Deep Probabilistic RegressionPoster79 citations
- Toward Unsupervised, Multi-Object Discovery in Large-Scale Image CollectionsPoster79 citations
- Adaptive Variance Based Label Distribution Learning For Facial Age EstimationPoster78 citations
- Handcrafted Outlier Detection RevisitedPoster78 citations
- Improving Face Recognition from Hard Samples via Distribution Distillation LossPoster78 citations
- Learning Object Placement by Inpainting for Compositional Data AugmentationPoster78 citations
- Off-Policy Reinforcement Learning for Efficient and Effective GAN Architecture SearchPoster78 citations
- Task-Aware Quantization Network for JPEG Image CompressionPoster78 citations
- UFO²: A Unified Framework towards Omni-supervised Object DetectionPoster78 citations
- Weakly Supervised Instance Segmentation by Learning Annotation Consistent InstancesPoster78 citations
- Detecting Natural Disasters, Damage, and Incidents in the WildPoster77 citations
- InfoFocus: 3D Object Detection for Autonomous Driving with Dynamic Information ModelingPoster77 citations
- Learning 3D Part Assembly from a Single ImagePoster77 citations
- One-Pixel Signature: Characterizing CNN Models for Backdoor DetectionPoster77 citations
- Unsupervised 3D Human Pose Representation with Viewpoint and Pose DisentanglementPoster77 citations
- Circumventing Outliers of AutoAugment with Knowledge DistillationPoster76 citations
- DeepHandMesh: A Weakly-supervised Deep Encoder-Decoder Framework for High-fidelity Hand Mesh ModelingPoster76 citations
- Global-and-Local Relative Position Embedding for Unsupervised Video SummarizationPoster75 citations
- HMOR: Hierarchical Multi-Person Ordinal Relations for Monocular Multi-Person 3D Pose EstimationPoster75 citations
- Multi-view Action Recognition using Cross-view Video PredictionPoster75 citations
- NAS-DIP: Learning Deep Image Prior with Neural Architecture SearchPoster75 citations
- SODA: Story Oriented Dense Video Captioning Evaluation FrameworkPoster75 citations
- TENet: Triple Excitation Network for Video Salient Object DetectionPoster75 citations
- Towards Practical and Efficient High-Resolution HDR Deghosting with CNNPoster75 citations
- EfficientFCN: Holistically-guided Decoding for Semantic SegmentationPoster74 citations
- Employing Multi-Estimations for Weakly-Supervised Semantic SegmentationPoster74 citations
- Matching Guided DistillationPoster74 citations
- Occlusion-Aware Depth Estimation with Adaptive Normal ConstraintsPoster74 citations
- Personalized Face Modeling for Improved Face Reconstruction and Motion RetargetingPoster74 citations
- Progressive Refinement Network for Occluded Pedestrian DetectionPoster74 citations
- The Group Loss for Deep Metric LearningPoster74 citations
- Adaptive Task Sampling for Meta-LearningPoster73 citations
- Conditional Entropy Coding for Efficient Video CompressionPoster73 citations
- Faster Person Re-IdentificationPoster73 citations
- HARD-Net: Hardness-AwaRe Discrimination Network for 3D Early Activity PredictionPoster73 citations
- Photon-Efficient 3D Imaging with A Non-Local Neural NetworkPoster73 citations
- SceneCAD: Predicting Object Alignments and Layouts in RGB-D ScansPoster73 citations
- Search What You Want: Barrier Panelty NAS for Mixed Precision QuantizationPoster73 citations
- Solving the Blind Perspective-n-Point Problem End-To-End With Robust Differentiable Geometric OptimizationPoster73 citations
- HoughNet: Integrating near and long-range evidence for bottom-up object detectionPoster72 citations
- Learning Discriminative Feature with CRF for Unsupervised Video Object SegmentationPoster72 citations
- Length-Controllable Image CaptioningPoster72 citations
- Robust Tracking against Adversarial AttacksPoster72 citations
- Simultaneous Detection and Tracking with Motion Modelling for Multiple Object TrackingPoster72 citations
- Task-conditioned Domain Adaptation for Pedestrian Detection in Thermal ImageryPoster72 citations
- A Cordial Sync: Going Beyond Marginal Policies for Multi-Agent Embodied TasksPoster71 citations
- FHDe²Net: Full High Definition Demoireing NetworkPoster71 citations
- Learning Semantic Neural Tree for Human ParsingPoster71 citations
- Multimodal Memorability: Modeling Effects of Semantics and Decay on Video MemorabilityPoster71 citations
- Regional Homogeneity: Towards Learning Transferable Universal Adversarial Perturbations Against DefensesPoster71 citations
- Renovating Parsing R-CNN for Accurate Multiple Human ParsingPoster71 citations
- Solving Long-tailed Recognition with Deep Realistic Taxonomic ClassifierPoster71 citations
- AutoSTR: Efficient Backbone Search for Scene Text RecognitionPoster70 citations
- Deformable Style TransferPoster70 citations
- Dynamic and Static Context-aware LSTM for Multi-agent Motion PredictionPoster70 citations
- End-to-End Trainable Deep Active Contour Models for Automated Image Segmentation: Delineating Buildings in Aerial ImageryPoster70 citations
- HMQ: Hardware Friendly Mixed Precision Quantization Block for CNNsPoster70 citations
- Inclusive GAN: Improving Data and Minority Coverage in Generative ModelsPoster70 citations
- Seeing the Un-Scene: Learning Amodal Semantic Maps for Room NavigationPoster70 citations
- CLIFFNet for Monocular Depth Estimation with Hierarchical Embedding LossPoster69 citations
- Class-Incremental Domain AdaptationPoster69 citations
- Environment-agnostic Multitask Learning for Natural Language Grounded NavigationPoster69 citations
- Exclusivity-Consistency Regularized Knowledge Distillation for Face RecognitionPoster69 citations
- Knowledge Transfer via Dense Cross-Layer Mutual-DistillationPoster69 citations
- On Modulating the Gradient for Meta-LearningPoster69 citations
- SumGraph: Video Summarization via Recursive Graph ModelingPoster69 citations
- 3D-Rotation-Equivariant Quaternion Neural NetworksPoster68 citations
- JGR-P2O: Joint Graph Reasoning based Pixel-to-Offset Prediction Network for 3D Hand Pose Estimation from a Single Depth ImagePoster68 citations
- Meshing Point Clouds with Predicted Intrinsic-Extrinsic Ratio GuidancePoster68 citations
- Optical Flow Distillation: Towards Efficient and Stable Video Style TransferPoster68 citations
- OS2D: One-Stage One-Shot Object Detection by Matching Anchor FeaturesPoster67 citations
- Online Ensemble Model Compression using Knowledge DistillationPoster67 citations
- Segmentations-Leak: Membership Inference Attacks and Defenses in Semantic Image SegmentationPoster67 citations
- SeqHAND: RGB-Sequence-Based 3D Hand Pose and Shape EstimationPoster67 citations
- TP-LSD: Tri-Points Based Line Segment DetectorPoster67 citations
- Multi-person 3D Pose Estimation in Crowded Scenes Based on Multi-View GeometryPoster66 citations
- Neural Dense Non-Rigid Structure from Motion with Latent Space ConstraintsPoster66 citations
- Password-conditioned Anonymization and Deanonymization with Face Identity TransformersPoster66 citations
- Active Crowd Counting with Limited SupervisionPoster65 citations
- An Attention-driven Two-stage Clustering Method for Unsupervised Person Re-IdentificationPoster65 citations
- Continuous Adaptation for Interactive Object Segmentation by Learning from CorrectionsPoster65 citations
- DOPE: Distillation Of Part Experts for whole-body 3D pose estimation in the wildPoster65 citations
- Distance-Normalized Unified Representation for Monocular 3D Object DetectionPoster65 citations
- Joint Bilateral Learning for Real-time Universal Photorealistic Style TransferPoster65 citations
- Learning Predictive Models from Observation and InteractionPoster65 citations
- Learning Trailer Moments in Full-Length Movies with Co-Contrastive AttentionPoster65 citations
- NeuRoRA: Neural Robust Rotation AveragingPoster65 citations
- Rethinking Image Deraining via Rain Streaks and VaporsPoster65 citations
- Single-Shot Neural Relighting and SVBRDF EstimationPoster65 citations
- Unsupervised Sketch to Photo SynthesisPoster65 citations
- Weakly-supervised 3D Shape Completion in the WildPoster65 citations
- 3D Human Shape and Pose from a Single Low-Resolution Image with Self-Supervised LearningPoster64 citations
- Improving Query Efficiency of Black-box Adversarial AttackPoster64 citations
- Learning to See in the Dark with EventsPoster64 citations
- PhraseClick: Toward Achieving Flexible Interactive Segmentation by Phrase and ClickPoster64 citations
- RD-GAN: Few/Zero-Shot Chinese Character Style Transfer via Radical Decomposition and RenderingPoster64 citations
- Semantic Equivalent Adversarial Data Augmentation for Visual Question AnsweringPoster64 citations
- Training Interpretable Convolutional Neural Networks by Differentiating Class-specific FiltersPoster64 citations
- BézierSketch: A generative model for scalable vector sketchesPoster63 citations
- Directional Temporal Modeling for Action RecognitionPoster63 citations
- Dynamic Group Convolution for Accelerating Convolutional Neural NetworksPoster63 citations
- Early Exit Or Not: Resource-Efficient Blind Quality Enhancement for Compressed ImagesPoster63 citations
- GSNet: Joint Vehicle Pose and Shape Reconstruction with Geometrical and Scene-aware SupervisionPoster63 citations
- In-Home Daily-Life Captioning Using Radio SignalsPoster63 citations
- Journey Towards Tiny Perceptual Super-ResolutionPoster63 citations
- PointTriNet: Learned Triangulation of 3D Point SetsPoster63 citations
- TopoGAN: A Topology-Aware Generative Adversarial NetworkPoster63 citations
- What is Learned in Deep Uncalibrated Photometric Stereo?Poster63 citations
- 3D Bird Reconstruction: a Dataset, Model, and Shape Recovery from a Single ViewPoster62 citations
- Dense RepPoints: Representing Visual Objects with Dense Point SetsPoster62 citations
- LEMMA: A Multi-view Dataset for LEarning Multi-agent Multi-task ActivitiesPoster62 citations
- Local Correlation Consistency for Knowledge DistillationPoster62 citations
- Momentum Batch Normalization for Deep Learning with Small Batch SizePoster62 citations
- Self-supervised Outdoor Scene RelightingPoster62 citations
- Take an Emotion Walk: Perceiving Emotions from Gaits Using Hierarchical Attention Pooling and Affective MappingPoster62 citations
- Unsupervised Monocular Depth Estimation for Night-time Images using Adversarial Domain Feature AdaptationPoster62 citations
- Adaptive Object Detection with Dual Multi-Label PredictionPoster61 citations
- BroadFace: Looking at Tens of Thousands of People at Once for Face RecognitionPoster61 citations
- PieNet: Personalized Image Enhancement NetworkPoster61 citations
- Boosting Weakly Supervised Object Detection with Progressive Knowledge TransferPoster60 citations
- Learning Noise-Aware Encoder-Decoder from Noisy Labels by Alternating Back-Propagation for Saliency DetectionPoster60 citations
- Sketching Image Gist: Human-Mimetic Hierarchical Scene Graph GenerationPoster60 citations
- URIE: Universal Image Enhancement for Visual Recognition in the WildPoster60 citations
- Weakly Supervised Learning with Side Information for Noisy Labeled ImagesPoster60 citations
- APRICOT: A Dataset of Physical Adversarial Attacks on Object DetectionPoster59 citations
- Do Not Disturb Me: Person Re-identification Under the Interference of Other PedestriansPoster59 citations
- Enabling Deep Residual Networks for Weakly Supervised Object DetectionPoster59 citations
- GAN-based Garment Generation Using Sewing Pattern ImagesPoster59 citations
- Interactive Multi-Dimension Modulation with Dynamic Controllable Residual Learning for Image RestorationPoster59 citations
- Malleable 2.5D Convolution: Learning Receptive Fields along the Depth-axis for RGB-D Scene ParsingPoster59 citations
- Mind the Discriminability: Asymmetric Adversarial Domain AdaptationPoster59 citations
- Self-supervised Keypoint Correspondences for Multi-Person Pose Estimation and Tracking in VideosPoster59 citations
- An Asymmetric Modeling for Action AssessmentPoster58 citations
- DELTAS: Depth Estimation by Learning Triangulation And densification of Sparse pointsPoster58 citations
- Hierarchical Visual-Textual Graph for Temporal Activity Localization via LanguagePoster58 citations
- Measuring Generalisation to Unseen Viewpoints, Articulations, Shapes and Objects for 3D Hand Pose Estimation under Hand-Object InteractionPoster58 citations
- Monocular 3D Object Detection via Feature Domain AdaptationPoster58 citations
- Multi-Loss Rebalancing Algorithm for Monocular Depth EstimationPoster58 citations
- Nighttime Defogging Using High-Low Frequency Decomposition and Grayscale-Color NetworksPoster58 citations
- Yet Another Intermediate-Level AttackPoster58 citations
- Channel selection using Gumbel SoftmaxPoster57 citations
- Collaborative Learning of Gesture Recognition and 3D Hand Pose Estimation with Multi-Order Feature AnalysisPoster57 citations
- DA4AD: End-to-End Deep Attention-based Visual Localization for Autonomous DrivingPoster57 citations
- End-to-end Interpretable Learning of Non-blind Image DeblurringPoster57 citations
- Improving Optical Flow on a Pyramid LevelPoster57 citations
- Label-Efficient Learning on Point Clouds using Approximate Convex DecompositionsPoster57 citations
- Learning to Exploit Multiple Vision Modalities by Using Grafted NetworksPoster57 citations
- Multi-level Wavelet-based Generative Adversarial Network for Perceptual Quality Enhancement of Compressed VideoPoster57 citations
- Surface Normal Estimation of Tilted Images via Spatial RectifierPoster57 citations
- TF-NAS: Rethinking Three Search Freedoms of Latency-Constrained Differentiable Neural Architecture SearchPoster57 citations
- 3D Human Shape Reconstruction from a Polarization ImagePoster56 citations
- AttentionNAS: Spatiotemporal Attention Cell Search for Video ClassificationPoster56 citations
- CSCL: Critical Semantic-Consistent Learning for Unsupervised Domain AdaptationPoster56 citations
- Cyclic Functional Mapping: Self-supervised Correspondence between Non-isometric Deformable ShapesPoster56 citations
- Deep Image Clustering with Category-Style RepresentationPoster56 citations
- Learning Memory Augmented Cascading Network for Compressed Sensing of ImagesPoster56 citations
- Learning Multi-layer Latent Variable Model via Variational Optimization of Short Run MCMC for Approximate InferencePoster56 citations
- SG-VAE: Scene Grammar Variational Autoencoder to generate new indoor scenesPoster56 citations
- Accurate Polarimetric BRDF for Real Polarization Scene RenderingPoster55 citations
- Domain-Specific Mappings for Generative Adversarial Style TransferPoster55 citations
- Learning Disentangled Feature Representation for Hybrid-distorted Image RestorationPoster55 citations
- RetrieveGAN: Image Synthesis via Differentiable Patch RetrievalPoster55 citations
- Semantic Object Prediction and Spatial Sound Super-Resolution with Binaural SoundsPoster55 citations
- Beyond Monocular Deraining: Stereo Image Deraining via Semantic UnderstandingPoster54 citations
- Differentiable Feature Aggregation Search for Knowledge DistillationPoster54 citations
- Dynamic Low-light Imaging with Quanta Image SensorsPoster54 citations
- Efficient Attention Mechanism for Visual Dialog that can Handle All the Interactions between Multiple InputsPoster54 citations
- Estimating People Flows to Better Count Them in Crowded ScenesPoster54 citations
- Finding It at Another Side: A Viewpoint-Adapted Matching Encoder for Change CaptioningPoster54 citations
- Graph-Based Social Relation ReasoningPoster54 citations
- Learning Architectures for Binary NetworksPoster54 citations
- Monocular Differentiable Rendering for Self-Supervised 3D Object DetectionPoster54 citations
- Motion Capture from Internet VideosPoster54 citations
- Reversing the cycle: self-supervised deep stereo through enhanced monocular distillationPoster54 citations
- Short-Term and Long-Term Context Aggregation Network for Video InpaintingPoster54 citations
- Soft Expert Reward Learning for Vision-and-Language NavigationPoster54 citations
- Adversarial Ranking Attack and DefensePoster53 citations
- Character-Preserving Coherent Story VisualizationPoster53 citations
- Fully Trainable and Interpretable Non-Local Sparse Models for Image RestorationPoster53 citations
- GMNet: Graph Matching Network for Large Scale Part Semantic Segmentation in the WildPoster53 citations
- Joint 3D Layout and Depth Prediction from a Single Indoor Panorama ImagePoster53 citations
- Learning to Generate Grounded Visual Captions without Localization SupervisionPoster53 citations
- TexMesh: Reconstructing Detailed Human Texture and Geometry from RGB-D VideoPoster53 citations
- Visual Question Answering on Image SetsPoster53 citations
- Visual Relation Grounding in VideosPoster53 citations
- Accelerating CNN Training by Pruning Activation GradientsPoster52 citations
- Compare and Reweight: Distinctive Image Captioning Using Similar Images SetsPoster52 citations
- Connecting the Dots: Detecting Adversarial Perturbations Using Context InconsistencyPoster52 citations
- ExchNet: A Unified Hashing Network for Large-Scale Fine-Grained Image RetrievalPoster52 citations
- Learning Camera-Aware Noise ModelsPoster52 citations
- Low Light Video Enhancement using Synthetic Data Produced with an Intermediate Domain MappingPoster52 citations
- Attentive Prototype Few-shot Learning with Capsule Network-based EmbeddingPoster51 citations
- CenterNet Heatmap Propagation for Real-time Video Object DetectionPoster51 citations
- DEMEA: Deep Mesh Autoencoders for Non-Rigidly Deforming ObjectsPoster51 citations
- DVI: Depth Guided Video Inpainting for Autonomous DrivingPoster51 citations
- Design and Interpretation of Universal Adversarial Patches in Face DetectionPoster51 citations
- Full-Body Awareness from Partial ObservationsPoster51 citations
- NormalGAN: Learning Detailed 3D Human from a Single RGB-D ImagePoster51 citations
- Polarimetric Multi-View Inverse RenderingPoster51 citations
- Prime-Aware Adaptive DistillationPoster51 citations
- Representative Graph Neural NetworkPoster51 citations
- TRADI: Tracking Deep Neural network Weight DistributionsPoster51 citations
- DPDist: Comparing Point Clouds Using Deep Point Cloud DistancePoster50 citations
- DTVNet: Dynamic Time-lapse Video Generation via Single Still ImagePoster50 citations
- Deep Learning-based Pupil Center Detection for Fast and Accurate Eye Tracking SystemPoster50 citations
- End-to-end Dynamic Matching Network for Multi-view Multi-person 3d Pose EstimationPoster50 citations
- Explaining Image Classifiers using Statistical Fault LocalizationPoster50 citations
- Learning and Memorizing Representative Prototypes for 3D Point Cloud Semantic and Instance SegmentationPoster50 citations
- Occlusion-Aware Siamese Network for Human Pose EstimationPoster50 citations
- Open-Edit: Open-Domain Image Manipulation with Open-Vocabulary InstructionsPoster50 citations
- Reconstructing NBA PlayersPoster50 citations
- Stochastic Frequency Masking to Improve Super-Resolution and Denoising NetworksPoster50 citations
- A Closer Look at Generalisation in RAVENPoster49 citations
- DataMix: Efficient Privacy-Preserving Edge-Cloud InferencePoster49 citations
- Deformation-Aware 3D Model Embedding and RetrievalPoster49 citations
- Learning to Plan with Uncertain Topological MapsPoster49 citations
- Multi-View Optimization of Local Feature GeometryPoster49 citations
- PT2PC: Learning to Generate 3D Point Cloud Shapes from Part Tree ConditionsPoster49 citations
- Stereo Event-based Particle Tracking Velocimetry for 3D Fluid Flow ReconstructionPoster49 citations
- Supervised Edge Attention Network for Accurate Image Instance SegmentationPoster49 citations
- Appearance Consensus Driven Self-Supervised Human Mesh RecoveryPoster48 citations
- Efficient Non-Line-of-Sight Imaging from Transient SinogramsPoster48 citations
- Modeling 3D Shapes by Reinforcement LearningPoster48 citations
- OneGAN: Simultaneous Unsupervised Learning of Conditional Image Generation, Foreground Segmentation, and Fine-Grained ClusteringPoster48 citations
- PatchPerPix for Instance SegmentationPoster48 citations
- Privacy Preserving Structure-from-MotionPoster48 citations
- Enhanced Sparse Model for Blind DeblurringPoster47 citations
- HDNet: Human Depth Estimation for Multi-Person Camera-Space LocalizationPoster47 citations
- MetaDistiller: Network Self-Boosting via Meta-Learned Top-Down DistillationPoster47 citations
- Piggyback GAN: Efficient Lifelong Learning for Image Conditioned GenerationPoster47 citations
- Traffic Accident Benchmark for Causality RecognitionPoster47 citations
- A Flexible Recurrent Residual Pyramid Network for Video Frame InterpolationPoster46 citations
- Attention-Based Query Expansion LearningPoster46 citations
- Attentive NormalizationPoster46 citations
- Beyond Controlled Environments: 3D Camera Re-Localization in Changing Indoor ScenesPoster46 citations
- Deep Decomposition Learning for Inverse Imaging ProblemsPoster46 citations
- Feature Representation Matters: End-to-End Learning for Reference-based Image Super-resolutionPoster46 citations
- Fully Embedding Fast Convolutional Networks on Pixel Processor ArraysPoster46 citations
- Key Frame Proposal Network for Efficient Pose Estimation in VideosPoster46 citations
- S2DNAS: Transforming Static CNN Model for Dynamic Inference via Neural Architecture SearchPoster46 citations
- Single View Metrology in the WildPoster46 citations
- Sparse-to-Dense Depth Completion Revisited: Sampling Strategy and Graph ConstructionPoster46 citations
- Deep Multi Depth Panoramas for View SynthesisPoster45 citations
- Extending and Analyzing Self-Supervised Learning Across DomainsPoster45 citations
- Learning to Factorize and Relight a CityPoster45 citations
- One-Shot Unsupervised Cross-Domain DetectionPoster45 citations
- Practical Poisoning Attacks on Neural NetworksPoster45 citations
- SceneSketcher: Fine-Grained Image Retrieval with Scene SketchesPoster45 citations
- Self-Supervised Multi-Task Procedure Learning from Instructional VideosPoster45 citations
- Toward Fine-grained Facial Expression ManipulationPoster45 citations
- Unsupervised Learning of Category-Specific Symmetric 3D Keypoints from Point SetsPoster45 citations
- Zero-Shot Image Super-Resolution with Depth Guided Internal Degradation LearningPoster45 citations
- AiR: Attention with Reasoning CapabilityPoster44 citations
- Controlling Style and Semantics in Weakly-Supervised Image GenerationPoster44 citations
- Deep Positional and Relational Feature Learning for Rotation-Invariant Point Cloud AnalysisPoster44 citations
- GINet: Graph Interaction Network for Scene ParsingPoster44 citations
- PSConv: Squeezing Feature Pyramid into One Compact Poly-Scale Convolutional LayerPoster44 citations
- Preserving Semantic Neighborhoods for Robust Cross-modal RetrievalPoster44 citations
- Representation Learning on Visual-Symbolic Graphs for Video UnderstandingPoster44 citations
- Rotation-robust Intersection over Union for 3D Object DetectionPoster44 citations
- Structure-Aware Human-Action GenerationPoster44 citations
- Unsupervised Learning of Optical Flow with Deep Feature SimilarityPoster44 citations
- Anatomy-Aware Siamese Network: Exploiting Semantic Asymmetry for Accurate Pelvic Fracture Detection in X-ray ImagesPoster43 citations
- Anti-Bandit Neural Architecture Search for Model DefensePoster43 citations
- Deep Image Compression using Decoder Side InformationPoster43 citations
- Domain2Vec: Domain Embedding for Unsupervised Domain AdaptationPoster43 citations
- Large-Scale Few-Shot Learning via Multi-Modal Knowledge DiscoveryPoster43 citations
- Learning Flow-based Feature Warping for Face Frontalization with Illumination Inconsistent SupervisionPoster43 citations
- Multi-Source Open-Set Deep Adversarial Domain AdaptationPoster43 citations
- Neural Batch Sampling with Reinforcement Learning for Semi-Supervised Anomaly DetectionPoster43 citations
- NoiseRank: Unsupervised Label Noise Reduction with Dependence ModelsPoster43 citations
- S2DNet: Learning Image Features for Accurate Sparse-to-Dense MatchingPoster43 citations
- Unsupervised Video Object Segmentation with Joint Hotspot TrackingPoster43 citations
- Video Object Detection via Object-level Temporal AggregationPoster43 citations
- Adaptive Computationally Efficient Network for Monocular 3D Hand Pose EstimationPoster42 citations
- Adaptive Video Highlight Detection by Learning from User HistoryPoster42 citations
- Image Classification in the Dark using Quanta Image SensorsPoster42 citations
- Meta-Learning with Network PruningPoster42 citations
- Pix2Surf: Learning Parametric 3D Surface Models of Objects from ImagesPoster42 citations
- SEN: A Novel Feature Normalization Dissimilarity Measure for Prototypical Few-Shot Learning NetworksPoster42 citations
- You Are Here: Geolocation by Embedding Maps and ImagesPoster42 citations
- Adaptive Text Recognition through Visual MatchingPoster41 citations
- AutoSimulate: (Quickly) Learning Synthetic Data GenerationPoster41 citations
- Knowledge-Based Video Question Answering with Unsupervised Scene DescriptionsPoster41 citations
- Mapillary Planet-Scale Depth DatasetPoster41 citations
- Motion-Excited Sampler: Video Adversarial Attack with Sparked PriorPoster41 citations
- PointAR: Efficient Lighting Estimation for Mobile Augmented RealityPoster41 citations
- Sound2Sight: Generating Visual Dynamics from Sound and ContextPoster41 citations
- Stochastic Bundle Adjustment for Efficient and Scalable 3D ReconstructionPoster41 citations
- Structure-Aware Generation Network for Recipe Generation from ImagesPoster41 citations
- Vectorizing World Buildings: Planar Graph Reconstruction by Primitive Detection and Relationship InferencePoster41 citations
- A Competence-aware Curriculum for Visual Concepts Learning via Question AnsweringPoster40 citations
- Dual Adversarial Network for Deep Active LearningPoster40 citations
- Expressive Telepresence via Modular Codec AvatarsPoster40 citations
- Full-Time Monocular Road Detection Using Zero-Distribution Prior of Angle of PolarizationPoster40 citations
- Interactive Video Object Segmentation Using Global and Local Transfer ModulesPoster40 citations
- Making Affine Correspondences Work in Camera Geometry ComputationPoster40 citations
- Mitigating Embedding and Class Assignment Mismatch in Unsupervised Image ClassificationPoster40 citations
- Open-set Adversarial DefensePoster40 citations
- Suppressing Mislabeled Data via Grouping and Self-AttentionPoster40 citations
- Symbiotic Adversarial Learning for Attribute-based Person SearchPoster40 citations
- Towards Unique and Informative Captioning of ImagesPoster40 citations
- 3D Scene Reconstruction from a Single ViewportPoster39 citations
- Beyond 3DMM Space: Towards Fine-grained 3D Face ReconstructionPoster39 citations
- Count- and Similarity-aware R-CNN for Pedestrian DetectionPoster39 citations
- Coupling Explicit and Implicit Surface Representations for Generative 3D ModelingPoster39 citations
- Du²Net: Learning Depth Estimation from Dual-Cameras and Dual-PixelsPoster39 citations
- FairALM: Augmented Lagrangian Method for Training Fair Models with Little RegretPoster39 citations
- Indirect Local Attacks for Context-aware Semantic Segmentation NetworksPoster39 citations
- Microscopy Image Restoration with Deep Wiener-Kolmogorov FiltersPoster39 citations
- Semantic Relation Preserving Knowledge Distillation for Image-to-Image TranslationPoster39 citations
- CAFE-GAN: Arbitrary Face Attribute Editing with Complementary Attention FeaturePoster38 citations
- Defocus Blur Detection via Depth DistillationPoster38 citations
- Impact of base dataset design on few-shot image classificationPoster38 citations
- Multi-Agent Embodied Question Answering in Interactive EnvironmentsPoster38 citations
- Proposal-based Video CompletionPoster38 citations
- Sketch-Guided Object Localization in Natural ImagesPoster38 citations
- Temporal Distinct Representation Learning for Action RecognitionPoster38 citations
- A Generalization of Otsu’s Method and Minimum Error ThresholdingPoster37 citations
- AutoMix: Mixup Networks for Sample Interpolation via Cooperative Barycenter LearningPoster37 citations
- Discriminative Partial Domain Adversarial NetworkPoster37 citations
- Duality Diagram Similarity: a generic framework for initialization selection in task transfer learningPoster37 citations
- Learning to Predict Context-adaptive Convolution for Semantic SegmentationPoster37 citations
- Learning to Scale Multilingual Representations for Vision-Language TasksPoster37 citations
- Propagating Over Phrase Relations for One-Stage Visual GroundingPoster37 citations
- Semantic View SynthesisPoster37 citations
- Uncertainty-Aware Weakly Supervised Action Detection from Untrimmed VideosPoster37 citations
- Adversarial Generative Grammars for Human Activity PredictionPoster36 citations
- Co-Heterogeneous and Adaptive Segmentation from Multi-Source and Multi-Phase CT Imaging Data: A Study on Pathological Liver and Lesion SegmentationPoster36 citations
- Invertible Neural BRDF for Object Inverse RenderingPoster36 citations
- Learning Attentive and Hierarchical Representations for 3D Shape RecognitionPoster36 citations
- Learning Object Permanence from VideoPoster36 citations
- LevelSet R-CNN: A Deep Variational Method for Instance SegmentationPoster36 citations
- ProxyBNN: Learning Binarized Neural Networks via Proxy MatricesPoster36 citations
- Can You Read Me Now? Content Aware Rectification using Angle SupervisionPoster35 citations
- Commonality-Parsing Network across Shape and Appearance for Partially Supervised Instance SegmentationPoster35 citations
- Cross-Task Transfer for Geotagged Audiovisual Aerial Scene RecognitionPoster35 citations
- Deep Complementary Joint Model for Complex Scene Registration and Few-shot Segmentation on Medical ImagesPoster35 citations
- Deep near-light photometric stereo for spatially varying reflectancesPoster35 citations
- Disambiguating Monocular Depth Estimation with a Single TransientPoster35 citations
- Hierarchical Context Embedding for Region-based Object DetectionPoster35 citations
- Hierarchical Style-based Networks for Motion SynthesisPoster35 citations
- Improving Monocular Depth Estimation by Leveraging Structural Awareness and Complementary DatasetsPoster35 citations
- Manifold Projection for Adversarial Defense on Face RecognitionPoster35 citations
- Online Multi-modal Person Search in VideosPoster35 citations
- SeqXY2SeqZ: Structure Learning for 3D Shapes by Sequentially Predicting 1D Occupancy Segments From 2D CoordinatesPoster35 citations
- Sequential Deformation for Accurate Scene Text DetectionPoster35 citations
- Spiral Generative Network for Image ExtrapolationPoster35 citations
- TRRNet: Tiered Relation Reasoning for Compositional Visual Question AnsweringPoster35 citations
- Entropy Minimisation Framework for Event-based Vision Model EstimationPoster34 citations
- GeoLayout: Geometry Driven Room Layout Estimation Based on Depth Maps of PlanesPoster34 citations
- Learning Disentangled Representations with Latent Variation PredictabilityPoster34 citations
- Learning Pairwise Inter-Plane Relations for Piecewise Planar ReconstructionPoster34 citations
- Learning with Noisy Class Labels for Instance SegmentationPoster34 citations
- Privacy Preserving Visual SLAMPoster34 citations
- Reflection Separation via Multi-bounce Polarization State TracingPoster34 citations
- SMART: Simultaneous Multi-Agent Recurrent Trajectory PredictionPoster34 citations
- Self-Supervised CycleGAN for Object-Preserving Image-to-Image Domain AdaptationPoster34 citations
- SimPose: Effectively Learning DensePose and Surface Normals of People from Simulated DataPoster34 citations
- TANet: Towards Fully Automatic Tooth ArrangementPoster34 citations
- Towards Content-Independent Multi-Reference Super-Resolution: Adaptive Pattern Matching and Feature AggregationPoster34 citations
- Weight Excitation: Built-in Attention Mechanisms in Convolutional Neural NetworksPoster34 citations
- Disentangling Multiple Features in Video Sequences using Gaussian Processes in Variational AutoencodersPoster33 citations
- Explanation-based Weakly-supervised Learning of Visual Relations with Graph NetworksPoster33 citations
- Generating Handwriting via Decoupled Style DescriptorsPoster33 citations
- GeoGraph: Graph-based multi-view object detection with geometric cues end-to-endPoster33 citations
- Learning Structural Similarity of User Interface Layouts using Graph NetworksPoster33 citations
- Null-sampling for Interpretable and Fair RepresentationsPoster33 citations
- OID: Outlier Identifying and Discarding in Blind Image DeblurringPoster33 citations
- Regression of Instance Boundary by Aggregated CNN and GCNPoster33 citations
- Resolution Switchable Networks for Runtime Efficient Image RecognitionPoster33 citations
- AE-OT-GAN: Training GANs from data specific latent distributionPoster32 citations
- CAD-Deform: Deformable Fitting of CAD Models to 3D ScansPoster32 citations
ECCV accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.