CVPR 2022 Accepted Papers
The full list of 2,043 papers accepted at CVPR 2022 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 1,704Oral: 339
- Smooth Maximum Unit: Smooth Activation Function for Deep Networks Using Smoothing Maximum TechniquePoster61 citations
- StyleT2I: Toward Compositional and High-Fidelity Text-to-Image SynthesisPoster61 citations
- 3D Photo Stylization: Learning To Generate Stylized Novel Views From a Single ImageOral60 citations
- A Stitch in Time Saves Nine: A Train-Time Regularizing Loss for Improved Neural Network CalibrationOral60 citations
- AnyFace: Free-Style Text-To-Face Synthesis and ManipulationOral60 citations
- Colar: Effective and Efficient Online Action Detection by Consulting ExemplarsPoster60 citations
- DESTR: Object Detection With Split TransformerPoster60 citations
- Dancing Under the Stars: Video Denoising in StarlightOral60 citations
- Detector-Free Weakly Supervised Group Activity RecognitionPoster60 citations
- Exposure Normalization and Compensation for Multiple-Exposure CorrectionPoster60 citations
- Few-Shot Backdoor Defense Using Shapley EstimationOral60 citations
- ISDNet: Integrating Shallow and Deep Networks for Efficient Ultra-High Resolution SegmentationPoster60 citations
- Learning Deep Implicit Functions for 3D Shapes With Dynamic Code CloudsPoster60 citations
- Look Back and Forth: Video Super-Resolution With Explicit Temporal Difference ModelingPoster60 citations
- Meta Convolutional Neural Networks for Single Domain GeneralizationPoster60 citations
- PoseTrack21: A Dataset for Person Search, Multi-Object Tracking and Multi-Person Pose TrackingPoster60 citations
- Sketch3T: Test-Time Training for Zero-Shot SBIRPoster60 citations
- Sound-Guided Semantic Image ManipulationPoster60 citations
- Time3D: End-to-End Joint Monocular 3D Object Detection and Tracking for Autonomous DrivingPoster60 citations
- When To Prune? A Policy Towards Early Structural PruningPoster60 citations
- CaDeX: Learning Canonical Deformation Coordinate Space for Dynamic Surface Representation via Neural HomeomorphismPoster59 citations
- Dual Temperature Helps Contrastive Learning Without Many Negative Samples: Towards Understanding and Simplifying MoCoPoster59 citations
- FLAG: Flow-Based 3D Avatar Generation From Sparse ObservationsPoster59 citations
- Fine-Tuning Image Transformers Using Learnable MemoryPoster59 citations
- GraftNet: Towards Domain Generalized Stereo Matching With a Broad-Spectrum and Task-Oriented FeaturePoster59 citations
- Homography Loss for Monocular 3D Object DetectionPoster59 citations
- IFOR: Iterative Flow Minimization for Robotic Object RearrangementPoster59 citations
- Look Outside the Room: Synthesizing a Consistent Long-Term 3D Scene Video From a Single ImagePoster59 citations
- MVS2D: Efficient Multi-View Stereo via Attention-Driven 2D ConvolutionsPoster59 citations
- Styleformer: Transformer Based Generative Adversarial Networks With Style VectorPoster59 citations
- Sylph: A Hypernetwork Framework for Incremental Few-Shot Object DetectionPoster59 citations
- Unsupervised Hierarchical Semantic Segmentation With Multiview Cosegmentation and Clustering TransformersOral59 citations
- ADAPT: Vision-Language Navigation With Modality-Aligned Action PromptsPoster58 citations
- Continuous Scene Representations for Embodied AIPoster58 citations
- DAD-3DHeads: A Large-Scale Dense, Accurate and Diverse Dataset for 3D Head Alignment From a Single ImagePoster58 citations
- DeeCap: Dynamic Early Exiting for Efficient Image CaptioningPoster58 citations
- Dist-PU: Positive-Unlabeled Learning From a Label Distribution PerspectivePoster58 citations
- SEEG: Semantic Energized Co-Speech Gesture GenerationPoster58 citations
- SWEM: Towards Real-Time Video Object Segmentation With Sequential Weighted Expectation-MaximizationPoster58 citations
- SphereSR: 360deg Image Super-Resolution With Arbitrary Projection via Continuous Spherical Image RepresentationOral58 citations
- Unsupervised Learning of Debiased Representations With Pseudo-AttributesPoster58 citations
- XMP-Font: Self-Supervised Cross-Modality Pre-Training for Few-Shot Font GenerationPoster58 citations
- XYDeblur: Divide and Conquer for Single Image DeblurringPoster58 citations
- Background Activation Suppression for Weakly Supervised Object LocalizationPoster57 citations
- COAP: Compositional Articulated Occupancy of PeoplePoster57 citations
- Dynamic MLP for Fine-Grained Image Classification by Leveraging Geographical and Temporal InformationOral57 citations
- ElePose: Unsupervised 3D Human Pose Estimation by Predicting Camera Elevation and Learning Normalizing Flows on 2D PosesPoster57 citations
- General Incremental Learning With Domain-Aware Categorical RepresentationsPoster57 citations
- Learning To Refactor Action and Co-Occurrence Features for Temporal Action LocalizationPoster57 citations
- Modeling Image Composition for Complex Scene GenerationPoster57 citations
- Multi-View Mesh Reconstruction With Neural Deferred ShadingPoster57 citations
- Non-Isotropy Regularization for Proxy-Based Deep Metric LearningPoster57 citations
- PoseTriplet: Co-Evolving 3D Human Pose Estimation, Imitation, and Hallucination Under Self-SupervisionOral57 citations
- ROCA: Robust CAD Model Retrieval and Alignment From a Single ImagePoster57 citations
- Shapley-NAS: Discovering Operation Contribution for Neural Architecture SearchPoster57 citations
- Show Me What and Tell Me How: Video Synthesis via Multimodal ConditioningPoster57 citations
- UTC: A Unified Transformer With Inter-Task Contrastive Learning for Visual DialogPoster57 citations
- Unifying Panoptic Segmentation for Autonomous DrivingPoster57 citations
- Unsupervised Image-to-Image Translation With Generative PriorPoster57 citations
- Bridging the Gap Between Classification and Localization for Weakly Supervised Object LocalizationPoster56 citations
- Cross-Modal Representation Learning for Zero-Shot Action RecognitionPoster56 citations
- Dual-Generator Face ReenactmentPoster56 citations
- Energy-Based Latent Aligner for Incremental LearningPoster56 citations
- Leveraging Self-Supervision for Cross-Domain Crowd CountingOral56 citations
- MLSLT: Towards Multilingual Sign Language TranslationPoster56 citations
- Neural Volumetric Object SelectionPoster56 citations
- OSSO: Obtaining Skeletal Shape From OutsidePoster56 citations
- ST-MFNet: A Spatio-Temporal Multi-Flow Network for Frame InterpolationPoster56 citations
- Single-Stage Is Enough: Multi-Person Absolute 3D Pose EstimationPoster56 citations
- A Unified Query-Based Paradigm for Point Cloud UnderstandingPoster55 citations
- Cross-Modal Clinical Graph Transformer for Ophthalmic Report GenerationPoster55 citations
- Disentangling Visual and Written Concepts in CLIPOral55 citations
- Eigenlanes: Data-Driven Lane Descriptors for Structurally Diverse LanesPoster55 citations
- GateHUB: Gated History Unit With Background Suppression for Online Action DetectionPoster55 citations
- Group R-CNN for Weakly Semi-Supervised Object Detection With PointsPoster55 citations
- Multi-Label Classification With Partial Annotations Using Class-Aware Selective LossPoster55 citations
- Multi-View Consistent Generative Adversarial Networks for 3D-Aware Image SynthesisPoster55 citations
- Proactive Image Manipulation DetectionPoster55 citations
- RCL: Recurrent Continuous Localization for Temporal Action DetectionOral55 citations
- Safe-Student for Safe Deep Semi-Supervised Learning With Unseen-Class Unlabeled DataPoster55 citations
- Vox2Cortex: Fast Explicit Reconstruction of Cortical Surfaces From 3D MRI Scans With Geometric Deep Neural NetworksPoster55 citations
- CDGNet: Class Distribution Guided Network for Human ParsingPoster54 citations
- Critical Regularizations for Neural Surface Reconstruction in the WildPoster54 citations
- Geometric Anchor Correspondence Mining With Uncertainty Modeling for Universal Domain AdaptationOral54 citations
- Human Hands As Probes for Interactive Object UnderstandingPoster54 citations
- Is Mapping Necessary for Realistic PointGoal Navigation?Poster54 citations
- Iterative Corresponding Geometry: Fusing Region and Depth for Highly Efficient 3D Tracking of Textureless ObjectsPoster54 citations
- Joint Video Summarization and Moment Localization by Cross-Task Sample TransferOral54 citations
- Learning Bayesian Sparse Networks With Full Experience Replay for Continual LearningPoster54 citations
- Locality-Aware Inter- and Intra-Video Reconstruction for Self-Supervised Correspondence LearningPoster54 citations
- Meta-Attention for ViT-Backed Continual LearningPoster54 citations
- Neural Point Light FieldsPoster54 citations
- Neural Reflectance for Shape Recovery With Shadow HandlingOral54 citations
- Open-World Instance Segmentation: Exploiting Pseudo Ground Truth From Learned Pairwise AffinityPoster54 citations
- PhoCaL: A Multi-Modal Dataset for Category-Level Object Pose Estimation With Photometrically Challenging ObjectsPoster54 citations
- Robust Region Feature Synthesizer for Zero-Shot Object DetectionPoster54 citations
- Unsupervised Homography Estimation With Coplanarity-Aware GANPoster54 citations
- Aug-NeRF: Training Stronger Neural Radiance Fields With Triple-Level Physically-Grounded AugmentationsPoster53 citations
- Bridged Transformer for Vision and Point Cloud 3D Object DetectionPoster53 citations
- Clipped Hyperbolic Classifiers Are Super-Hyperbolic ClassifiersPoster53 citations
- Contrastive Learning for Unsupervised Video Highlight DetectionPoster53 citations
- DIP: Deep Inverse Patchmatch for High-Resolution Optical FlowPoster53 citations
- Distillation Using Oracle Queries for Transformer-Based Human-Object Interaction DetectionPoster53 citations
- Frame-Wise Action Representations for Long Videos via Sequence Contrastive LearningPoster53 citations
- High Quality Segmentation for Ultra High-Resolution ImagesPoster53 citations
- Ithaca365: Dataset and Driving Perception Under Repeated and Challenging Weather ConditionsPoster53 citations
- Learning Semantic Associations for Mirror DetectionPoster53 citations
- Learning a Structured Latent Space for Unsupervised Point Cloud CompletionOral53 citations
- Optical Flow Estimation for Spiking CameraPoster53 citations
- Robust and Accurate Superquadric Recovery: A Probabilistic ApproachOral53 citations
- SCS-Co: Self-Consistent Style Contrastive Learning for Image HarmonizationPoster53 citations
- Semiconductor Defect Detection by Hybrid Classical-Quantum Deep LearningPoster53 citations
- The Auto Arborist Dataset: A Large-Scale Benchmark for Multiview Urban Forest Monitoring Under Domain ShiftPoster53 citations
- The Wanderings of Odysseus in 3D ScenesPoster53 citations
- Topology Preserving Local Road Network Estimation From Single Onboard Camera ImagePoster53 citations
- Uni6D: A Unified CNN Framework Without Projection Breakdown for 6D Pose EstimationOral53 citations
- Audio-Adaptive Activity Recognition Across Video DomainsPoster52 citations
- BARC: Learning To Regress 3D Dog Shape From Images by Exploiting Breed InformationPoster52 citations
- ContrastMask: Contrastive Learning To Segment Every ThingPoster52 citations
- Deep Orientation-Aware Functional Maps: Tackling Symmetry Issues in Shape MatchingPoster52 citations
- Differentiable Dynamics for Articulated 3D Human Motion ReconstructionPoster52 citations
- Discovering Objects That Can MovePoster52 citations
- Dual-Key Multimodal Backdoors for Visual Question AnsweringPoster52 citations
- Dual-Path Image Inpainting With Auxiliary GAN InversionPoster52 citations
- Efficient Video Instance Segmentation via Tracklet Query and ProposalPoster52 citations
- Face Relighting With Geometrically Consistent ShadowsPoster52 citations
- How Well Do Sparse ImageNet Models Transfer?Poster52 citations
- P3IV: Probabilistic Procedure Planning From Instructional Videos With Weak SupervisionOral52 citations
- RU-Net: Regularized Unrolling Network for Scene Graph GenerationPoster52 citations
- SketchEdit: Mask-Free Local Image Manipulation With Partial SketchesPoster52 citations
- Topologically-Aware Deformation Fields for Single-View 3D ReconstructionPoster52 citations
- Towards Noiseless Object Contours for Weakly Supervised Semantic SegmentationPoster52 citations
- A Brand New Dance Partner: Music-Conditioned Pluralistic Dancing Controlled by Multiple Dance GenresPoster51 citations
- AdaptPose: Cross-Dataset Adaptation for 3D Human Pose Estimation by Learnable Motion GenerationPoster51 citations
- AutoMine: An Unmanned Mine DatasetPoster51 citations
- Bringing Old Films Back to LifePoster51 citations
- Deep Anomaly Discovery From Unlabeled Videos via Normality Advantage and Self-Paced RefinementPoster51 citations
- Disentangled3D: Learning a 3D Generative Model With Disentangled Geometry and Appearance From Monocular ImagesPoster51 citations
- Divide and Conquer: Compositional Experts for Generalized Novel Class DiscoveryPoster51 citations
- Exploring Set Similarity for Dense Self-Supervised Representation LearningPoster51 citations
- H2FA R-CNN: Holistic and Hierarchical Feature Alignment for Cross-Domain Weakly Supervised Object DetectionPoster51 citations
- Investigating Top-k White-Box and Transferable Black-Box AttackPoster51 citations
- Learning To Detect Mobile Objects From LiDAR Scans Without LabelsPoster51 citations
- Optimizing Video Prediction via Video Frame InterpolationPoster51 citations
- Partial Class Activation Attention for Semantic SegmentationPoster51 citations
- Stereo Depth From Events Cameras: Concentrate and Focus on the FuturePoster51 citations
- Structure-Aware Motion Transfer With Deformable Anchor ModelPoster51 citations
- Symmetry and Uncertainty-Aware Object SLAM for 6DoF Object Pose EstimationPoster51 citations
- Watch It Move: Unsupervised Discovery of 3D Joints for Re-Posing of Articulated ObjectsPoster51 citations
- Deformable Video TransformerPoster50 citations
- Distribution-Aware Single-Stage Models for Multi-Person 3D Pose EstimationPoster50 citations
- Exploiting Temporal Relations on Radar Perception for Autonomous DrivingPoster50 citations
- MUM: Mix Image Tiles and UnMix Feature Tiles for Semi-Supervised Object DetectionPoster50 citations
- Neural Shape Mating: Self-Supervised Object Assembly With Adversarial Shape PriorsPoster50 citations
- NeuralHOFusion: Neural Volumetric Rendering Under Human-Object InteractionsPoster50 citations
- Not All Labels Are Equal: Rationalizing the Labeling Costs for Training Object DetectionPoster50 citations
- Ranking Distance Calibration for Cross-Domain Few-Shot LearningPoster50 citations
- Task-Adaptive Negative Envision for Few-Shot Open-Set RecognitionPoster50 citations
- Automated Progressive Learning for Efficient Training of Vision TransformersPoster49 citations
- Boosting Black-Box Attack With Partially Transferred Conditional Adversarial DistributionPoster49 citations
- Bring Evanescent Representations to Life in Lifelong Class Incremental LearningPoster49 citations
- Cross-Modal Transferable Adversarial Attacks From Images to VideosPoster49 citations
- DeepFake Disrupter: The Detector of DeepFake Is My FriendPoster49 citations
- Global Convergence of MAML and Theory-Inspired Neural Architecture Search for Few-Shot LearningPoster49 citations
- Interact Before Align: Leveraging Cross-Modal Knowledge for Domain Adaptive Action RecognitionPoster49 citations
- MDAN: Multi-Level Dependent Attention Network for Visual Emotion AnalysisPoster49 citations
- Mr.BiQ: Post-Training Non-Uniform Quantization Based on Minimizing the Reconstruction ErrorPoster49 citations
- PlaneMVS: 3D Plane Reconstruction From Multi-View StereoPoster49 citations
- Predict, Prevent, and Evaluate: Disentangled Text-Driven Image Manipulation Empowered by Pre-Trained Vision-Language ModelPoster49 citations
- STCrowd: A Multimodal Dataset for Pedestrian Perception in Crowded ScenesPoster49 citations
- Spatially-Adaptive Multilayer Selection for GAN Inversion and EditingPoster49 citations
- Towards Accurate Facial Landmark Detection via Cascaded TransformersPoster49 citations
- Unsupervised Domain Generalization by Learning a Bridge Across DomainsOral49 citations
- A Simple Data Mixing Prior for Improving Self-Supervised LearningPoster48 citations
- Amodal Panoptic SegmentationPoster48 citations
- Beyond Semantic to Instance Segmentation: Weakly-Supervised Instance Segmentation via Semantic Knowledge Transfer and Self-RefinementPoster48 citations
- Blind Face Restoration via Integrating Face Shape and Generative PriorsPoster48 citations
- BokehMe: When Neural Rendering Meets Classical RenderingOral48 citations
- DLFormer: Discrete Latent Transformer for Video InpaintingPoster48 citations
- Dynamic Scene Graph Generation via Anticipatory Pre-TrainingPoster48 citations
- Efficient Classification of Very Large Images With Tiny ObjectsPoster48 citations
- End-to-End Trajectory Distribution Prediction Based on Occupancy Grid MapsPoster48 citations
- Group Contextualization for Video RecognitionPoster48 citations
- Inertia-Guided Flow Completion and Style Fusion for Video InpaintingPoster48 citations
- Knowledge Distillation As Efficient Pre-Training: Faster Convergence, Higher Data-Efficiency, and Better TransferabilityPoster48 citations
- Learning Local-Global Contextual Adaptation for Multi-Person Pose EstimationPoster48 citations
- Memory-Augmented Non-Local Attention for Video Super-ResolutionPoster48 citations
- Multi-Label Iterated Learning for Image Classification With Label AmbiguityPoster48 citations
- Multi-Objective Diverse Human Motion Prediction With Knowledge DistillationOral48 citations
- Synthetic Generation of Face Videos With Plethysmograph PhysiologyPoster48 citations
- The Principle of Diversity: Training Stronger Vision Transformers Calls for Reducing All Levels of RedundancyPoster48 citations
- Trajectory Optimization for Physics-Based Reconstruction of 3D Human Pose From Monocular VideoPoster48 citations
- TubeFormer-DeepLab: Video Mask TransformerPoster48 citations
- CAD: Co-Adapting Discriminative Features for Improved Few-Shot ClassificationPoster47 citations
- Dynamic 3D Gaze From Afar: Deep Gaze Estimation From Temporal Eye-Head-Body CoordinationPoster47 citations
- Evaluation-Oriented Knowledge Distillation for Deep Face RecognitionOral47 citations
- Fast and Unsupervised Action Boundary Detection for Action SegmentationPoster47 citations
- Give Me Your Attention: Dot-Product Attention Considered Harmful for Adversarial Patch RobustnessPoster47 citations
- Learning Graph Regularisation for Guided Super-ResolutionPoster47 citations
- Learning Where To Learn in Cross-View Self-Supervised LearningPoster47 citations
- Modality-Agnostic Learning for Radar-Lidar Fusion in Vehicle DetectionPoster47 citations
- OpenTAL: Towards Open Set Temporal Action LocalizationOral47 citations
- Quantization-Aware Deep Optics for Diffractive Snapshot Hyperspectral ImagingPoster47 citations
- Reinforced Structured State-Evolution for Vision-Language NavigationPoster47 citations
- Rotationally Equivariant 3D Object DetectionPoster47 citations
- Task2Sim: Towards Effective Pre-Training and Transfer From Synthetic DataPoster47 citations
- Unleashing Potential of Unsupervised Pre-Training With Intra-Identity Regularization for Person Re-IdentificationPoster47 citations
- Active Learning for Open-Set AnnotationPoster46 citations
- Category-Aware Transformer Network for Better Human-Object Interaction DetectionPoster46 citations
- Collaborative Learning for Hand and Object Reconstruction With Attention-Guided Graph ConvolutionPoster46 citations
- Contextual Debiasing for Visual Recognition With Causal MechanismsPoster46 citations
- Decoupling and Recoupling Spatiotemporal Representation for RGB-D-Based Motion RecognitionPoster46 citations
- Distinguishing Unseen From Seen for Generalized Zero-Shot LearningPoster46 citations
- IRISformer: Dense Vision Transformers for Single-Image Inverse Rendering in Indoor ScenesOral46 citations
- ITSA: An Information-Theoretic Approach to Automatic Shortcut Avoidance and Domain Generalization in Stereo Matching NetworksPoster46 citations
- Imposing Consistency for Optical Flow EstimationPoster46 citations
- It's All in the Teacher: Zero-Shot Quantization Brought Closer to the TeacherOral46 citations
- JRDB-Act: A Large-Scale Dataset for Spatio-Temporal Action, Social Group and Activity DetectionPoster46 citations
- NightLab: A Dual-Level Architecture With Hardness Detection for Segmentation at NightPoster46 citations
- Point Cloud Pre-Training With Natural 3D StructuresPoster46 citations
- SimVQA: Exploring Simulated Environments for Visual Question AnsweringPoster46 citations
- Smooth-Swap: A Simple Enhancement for Face-Swapping With SmoothnessOral46 citations
- Surpassing the Human Accuracy: Detecting Gallbladder Cancer From USG Images With Curriculum LearningPoster46 citations
- Uncertainty-Guided Probabilistic Transformer for Complex Action RecognitionPoster46 citations
- vCLIMB: A Novel Video Class Incremental Learning BenchmarkOral46 citations
- ATPFL: Automatic Trajectory Prediction Model Design Under Federated Learning FrameworkPoster45 citations
- Audio-Visual Speech Codecs: Rethinking Audio-Visual Speech Enhancement by Re-SynthesisOral45 citations
- CREAM: Weakly Supervised Object Localization via Class RE-Activation MappingPoster45 citations
- Causal Transportability for Visual RecognitionPoster45 citations
- Controllable Animation of Fluid Elements in Still ImagesPoster45 citations
- Domain-Agnostic Prior for Transfer Semantic SegmentationPoster45 citations
- Egocentric Deep Multi-Channel Audio-Visual Active Speaker LocalizationPoster45 citations
- End-to-End Semi-Supervised Learning for Video Action DetectionPoster45 citations
- Equivariant Point Cloud Analysis via Learning Orientations for Message PassingOral45 citations
- Expanding Large Pre-Trained Unimodal Models With Multimodal Information Injection for Image-Text Multimodal ClassificationPoster45 citations
- Fire Together Wire Together: A Dynamic Pruning Approach With Self-Supervised Mask PredictionPoster45 citations
- Instance-Aware Dynamic Neural Network QuantizationPoster45 citations
- Learning Pixel Trajectories With Multiscale Contrastive Random WalksPoster45 citations
- Learning To Find Good Models in RANSACPoster45 citations
- Learning To Solve Hard Minimal ProblemsOral45 citations
- Non-Parametric Depth Distribution Modelling Based Depth Inference for Multi-View StereoPoster45 citations
- Topology-Preserving Shape Reconstruction and Registration via Neural Diffeomorphic FlowPoster45 citations
- Uncertainty-Aware Adaptation for Self-Supervised 3D Human Pose EstimationPoster45 citations
- Uncertainty-Aware Deep Multi-View Photometric StereoPoster45 citations
- Weakly Supervised Rotation-Invariant Aerial Object Detection NetworkPoster45 citations
- A Re-Balancing Strategy for Class-Imbalanced Classification Based on Instance DifficultyPoster44 citations
- Adversarial Parametric Pose PriorOral44 citations
- BNV-Fusion: Dense 3D Reconstruction Using Bi-Level Neural Volume FusionPoster44 citations
- Continual Object Detection via Prototypical Task Correlation Guided Gating MechanismPoster44 citations
- Federated Learning With Position-Aware NeuronsPoster44 citations
- Global Tracking via Ensemble of Local TrackersPoster44 citations
- Integrating Language Guidance Into Vision-Based Deep Metric LearningOral44 citations
- It Is Okay To Not Be Okay: Overcoming Emotional Bias in Affective Image Captioning by Contrastive Data CollectionPoster44 citations
- LMGP: Lifted Multicut Meets Geometry Projections for Multi-Camera Multi-Object TrackingPoster44 citations
- M5Product: Self-Harmonized Contrastive Learning for E-Commercial Multi-Modal PretrainingPoster44 citations
- Multi-Source Uncertainty Mining for Deep Unsupervised Saliency DetectionPoster44 citations
- NICGSlowDown: Evaluating the Efficiency Robustness of Neural Image Caption Generation ModelsPoster44 citations
- Pre-Train, Self-Train, Distill: A Simple Recipe for Supersizing 3D ReconstructionPoster44 citations
- RGB-Depth Fusion GAN for Indoor Depth CompletionPoster44 citations
- Replacing Labeled Real-Image Datasets With Auto-Generated ContoursPoster44 citations
- Spatial-Temporal Space Hand-in-Hand: Spatial-Temporal Video Super-Resolution via Cycle-Projected Mutual LearningPoster44 citations
- Towards Better Understanding Attribution MethodsPoster44 citations
- TransforMatcher: Match-to-Match Attention for Semantic CorrespondencePoster44 citations
- Weakly Supervised Object Localization As Domain AdaptionPoster44 citations
- AutoLoss-Zero: Searching Loss Functions From Scratch for Generic TasksPoster43 citations
- BoxeR: Box-Attention for 2D and 3D TransformersPoster43 citations
- Decoupled Multi-Task Learning With Cyclical Self-Regulation for Face ParsingPoster43 citations
- Dynamic Sparse R-CNNPoster43 citations
- EMScore: Evaluating Video Captioning via Coarse-Grained and Fine-Grained Embedding MatchingPoster43 citations
- Full-Range Virtual Try-On With Recurrent Tri-Level TransformPoster43 citations
- Global Context With Discrete Diffusion in Vector Quantised Modelling for Image GenerationPoster43 citations
- Instance Segmentation With Mask-Supervised Polygonal Boundary TransformersPoster43 citations
- It's Time for Artistic Correspondence in Music and VideoPoster43 citations
- LSVC: A Learning-Based Stereo Video Compression FrameworkPoster43 citations
- Learned Queries for Efficient Local AttentionOral43 citations
- Meta Agent Teaming Active Learning for Pose EstimationOral43 citations
- NODEO: A Neural Ordinary Differential Equation Based Optimization Framework for Deformable Image RegistrationPoster43 citations
- Scalable Penalized Regression for Noise Detection in Learning With Noisy LabelsPoster43 citations
- Self-Supervised Equivariant Learning for Oriented Keypoint DetectionPoster43 citations
- UDA-COPE: Unsupervised Domain Adaptation for Category-Level Object Pose EstimationPoster43 citations
- CNN Filter DB: An Empirical Investigation of Trained Convolutional FiltersOral42 citations
- Classification-Then-Grounding: Reformulating Video Scene Graphs As Temporal Bipartite GraphsPoster42 citations
- ConDor: Self-Supervised Canonicalization of 3D Pose for Partial ShapesPoster42 citations
- Contextual Similarity Distillation for Asymmetric Image RetrievalPoster42 citations
- DyRep: Bootstrapping Training With Dynamic Re-ParameterizationPoster42 citations
- HEAT: Holistic Edge Attention Transformer for Structured ReconstructionPoster42 citations
- HLRTF: Hierarchical Low-Rank Tensor Factorization for Inverse Problems in Multi-Dimensional ImagingPoster42 citations
- Hypergraph-Induced Semantic Tuplet Loss for Deep Metric LearningPoster42 citations
- Learning Distinctive Margin Toward Active Domain AdaptationOral42 citations
- Learning Multiple Dense Prediction Tasks From Partially Annotated DataOral42 citations
- Lifelong Unsupervised Domain Adaptive Person Re-Identification With Coordinated Anti-Forgetting and AdaptationPoster42 citations
- On Generalizing Beyond Domains in Cross-Domain Continual LearningPoster42 citations
- PIE-Net: Photometric Invariant Edge Guided Network for Intrinsic Image DecompositionPoster42 citations
- VISOLO: Grid-Based Space-Time Aggregation for Efficient Online Video Instance SegmentationOral42 citations
- Beyond Fixation: Dynamic Window Visual TransformerPoster41 citations
- Bongard-HOI: Benchmarking Few-Shot Visual Reasoning for Human-Object InteractionsOral41 citations
- CPPF: Towards Robust Category-Level 9D Pose Estimation in the WildPoster41 citations
- Deep 3D-to-2D Watermarking: Embedding Messages in 3D Meshes and Extracting Them From 2D RenderingsPoster41 citations
- Does Robustness on ImageNet Transfer to Downstream Tasks?Poster41 citations
- Geometric Structure Preserving Warp for Natural Image StitchingPoster41 citations
- HyperSegNAS: Bridging One-Shot Neural Architecture Search With 3D Medical Image Segmentation Using HyperNetPoster41 citations
- IntentVizor: Towards Generic Query Guided Interactive Video SummarizationPoster41 citations
- Learning Program Representations for Food Images and Cooking RecipesOral41 citations
- Neural Collaborative Graph Machines for Table Structure RecognitionPoster41 citations
- Pyramid Architecture for Multi-Scale Processing in Point Cloud SegmentationPoster41 citations
- Sign Language Video Retrieval With Free-Form Textual QueriesPoster41 citations
- UniVIP: A Unified Framework for Self-Supervised Visual Pre-TrainingPoster41 citations
- Unsupervised Vision-and-Language Pre-Training via Retrieval-Based Multi-Granular AlignmentOral41 citations
- Weakly-Supervised Action Transition Learning for Stochastic Human Motion PredictionOral41 citations
- 3DAC: Learning Attribute Compression for Point CloudsPoster40 citations
- APRIL: Finding the Achilles' Heel on Privacy for Vision TransformersPoster40 citations
- Bi-Level Alignment for Cross-Domain Crowd CountingPoster40 citations
- DiffPoseNet: Direct Differentiable Camera Pose EstimationPoster40 citations
- Efficient Multi-View Stereo by Iterative Dynamic Cost VolumePoster40 citations
- Episodic Memory Question AnsweringOral40 citations
- Exploiting Rigidity Constraints for LiDAR Scene Flow EstimationPoster40 citations
- Few-Shot Keypoint Detection With Uncertainty Learning for Unseen SpeciesPoster40 citations
- Forecasting From LiDAR via Future Object DetectionPoster40 citations
- GazeOnce: Real-Time Multi-Person Gaze EstimationPoster40 citations
- High-Fidelity Human Avatars From a Single RGB CameraPoster40 citations
- Interactron: Embodied Adaptive Object DetectionPoster40 citations
- LC-FDNet: Learned Lossless Image Compression With Frequency Decomposition NetworkPoster40 citations
- Learning To Detect Scene Landmarks for Camera LocalizationOral40 citations
- Leverage Your Local and Global Representations: A New Self-Supervised Learning StrategyPoster40 citations
- Localized Adversarial Domain GeneralizationPoster40 citations
- Neural MoCon: Neural Motion Control for Physically Plausible Human Motion CapturePoster40 citations
- Node Representation Learning in Graph via Node-to-Neighbourhood Mutual Information MaximizationPoster40 citations
- Noisy Boundaries: Lemon or Lemonade for Semi-Supervised Instance Segmentation?Poster40 citations
- OcclusionFusion: Occlusion-Aware Motion Estimation for Real-Time Dynamic 3D ReconstructionPoster40 citations
- Open-Set Text Recognition via Character-Context DecouplingPoster40 citations
- Unsupervised Visual Representation Learning by Online Constrained K-MeansPoster40 citations
- An Efficient Training Approach for Very Large Scale Face RecognitionPoster39 citations
- Cycle-Consistent Counterfactuals by Latent TransformationsPoster39 citations
- DGECN: A Depth-Guided Edge Convolutional Network for End-to-End 6D Pose EstimationPoster39 citations
- Exploring Endogenous Shift for Cross-Domain Detection: A Large-Scale Benchmark and Perturbation Suppression NetworkPoster39 citations
- Human Trajectory Prediction With Momentary ObservationPoster39 citations
- Improving GAN Equilibrium by Raising Spatial AwarenessPoster39 citations
- Long-Tail Recognition via Compositional Knowledge TransferPoster39 citations
- Motron: Multimodal Probabilistic Human Motion ForecastingPoster39 citations
- Neural Compression-Based Feature Learning for Video RestorationPoster39 citations
- Neural Template: Topology-Aware Reconstruction and Disentangled Generation of 3D MeshesPoster39 citations
- Remember the Difference: Cross-Domain Few-Shot Semantic Segmentation via Meta-Memory TransferPoster39 citations
- Rethinking Bayesian Deep Learning Methods for Semi-Supervised Volumetric Medical Image SegmentationPoster39 citations
- Scale-Equivalent Distillation for Semi-Supervised Object DetectionPoster39 citations
- Self-Supervised Neural Articulated Shape and Appearance ModelsPoster39 citations
- Towards Bidirectional Arbitrary Image Rescaling: Joint Optimization and Cycle IdempotencePoster39 citations
- Towards Robust Adaptive Object Detection Under Noisy AnnotationsPoster39 citations
- Weakly Supervised Segmentation on Outdoor 4D Point Clouds With Temporal Matching and Spatial Graph PropagationPoster39 citations
- A Style-Aware Discriminator for Controllable Image TranslationPoster38 citations
- AUV-Net: Learning Aligned UV Maps for Texture Transfer and SynthesisPoster38 citations
- Bi-Directional Object-Context Prioritization Learning for Saliency RankingPoster38 citations
- Boosting Robustness of Image Matting With Context Assembling and Strong Data AugmentationPoster38 citations
- Brain-Inspired Multilayer Perceptron With Spiking NeuronsPoster38 citations
- DC-SSL: Addressing Mismatched Class Distribution in Semi-Supervised LearningPoster38 citations
- DPICT: Deep Progressive Image Compression Using Trit-PlanesOral38 citations
- Generalizable Human Pose TriangulationOral38 citations
- JIFF: Jointly-Aligned Implicit Face Function for High Quality Single View Clothed Human ReconstructionOral38 citations
- Knowledge-Driven Self-Supervised Representation Learning for Facial Action Unit RecognitionPoster38 citations
- LGT-Net: Indoor Panoramic Room Layout Estimation With Geometry-Aware Transformer NetworkPoster38 citations
- Learning To Imagine: Diversify Memory for Incremental Learning Using Unlabeled DataPoster38 citations
- NeuralHDHair: Automatic High-Fidelity Hair Modeling From a Single Image Using Implicit Neural RepresentationsPoster38 citations
- Not All Relations Are Equal: Mining Informative Labels for Scene Graph GenerationPoster38 citations
- Physically Disentangled Intra- and Inter-Domain Adaptation for Varicolored Haze RemovalPoster38 citations
- Polarity Sampling: Quality and Diversity Control of Pre-Trained Generative Networks via Singular ValuesOral38 citations
- Probabilistic Warp Consistency for Weakly-Supervised Semantic CorrespondencesPoster38 citations
- TVConv: Efficient Translation Variant Convolution for Layout-Aware Visual ProcessingPoster38 citations
- Transferability Metrics for Selecting Source Model EnsemblesOral38 citations
- VALHALLA: Visual Hallucination for Machine TranslationPoster38 citations
- A Hybrid Quantum-Classical Algorithm for Robust FittingPoster37 citations
- DArch: Dental Arch Prior-Assisted 3D Tooth Instance Segmentation With Weak AnnotationsPoster37 citations
- Defensive Patches for Robust Recognition in the Physical WorldPoster37 citations
- Deformation and Correspondence Aware Unsupervised Synthetic-to-Real Scene Flow Estimation for Point CloudsPoster37 citations
- Estimating Egocentric 3D Human Pose in the Wild With External Weak SupervisionPoster37 citations
- FlexIT: Towards Flexible Semantic Image TranslationPoster37 citations
- LIFT: Learning 4D LiDAR Image Fusion Transformer for 3D Object DetectionPoster37 citations
- Learning Invisible Markers for Hidden Codes in Offline-to-Online PhotographyPoster37 citations
- Mutual Quantization for Cross-Modal Search With Noisy LabelsPoster37 citations
- SLIC: Self-Supervised Learning With Iterative Clustering for Human Action VideosOral37 citations
- SceneSqueezer: Learning To Compress Scene for Camera RelocalizationOral37 citations
- Semantic Segmentation by Early Region ProxyPoster37 citations
- SimAN: Exploring Self-Supervised Representation Learning of Scene Text via Similarity-Aware NormalizationPoster37 citations
- TimeReplayer: Unlocking the Potential of Event Cameras for Video InterpolationPoster37 citations
- Vision-Language Pre-Training for Boosting Scene Text DetectorsPoster37 citations
- 3PSDF: Three-Pole Signed Distance Function for Learning Surfaces With Arbitrary TopologiesPoster36 citations
- Amodal Segmentation Through Out-of-Task and Out-of-Distribution Generalization With a Bayesian ModelPoster36 citations
- Attribute Group Editing for Reliable Few-Shot Image GenerationPoster36 citations
- Back to Reality: Weakly-Supervised 3D Object Detection With Shape-Guided Label EnhancementPoster36 citations
- Boosting 3D Object Detection by Simulating Multimodality on Point CloudsOral36 citations
- Calibrating Deep Neural Networks by Pairwise ConstraintsOral36 citations
- Cloning Outfits From Real-World Images to 3D Characters for Generalizable Person Re-IdentificationPoster36 citations
- Diverse Plausible 360-Degree Image Outpainting for Efficient 3DCG Background CreationPoster36 citations
- Doodle It Yourself: Class Incremental Learning by Drawing a Few SketchesPoster36 citations
- ESCNet: Gaze Target Detection With the Understanding of 3D ScenesPoster36 citations
- HSC4D: Human-Centered 4D Scene Capture in Large-Scale Indoor-Outdoor Space Using Wearable IMUs and LiDARPoster36 citations
- Improving Adversarially Robust Few-Shot Image Classification With Generalizable RepresentationsPoster36 citations
- Look for the Change: Learning Object States and State-Modifying Actions From Untrimmed Web VideosPoster36 citations
- MogFace: Towards a Deeper Appreciation on Face DetectionPoster36 citations
- Novel Class Discovery in Semantic SegmentationPoster36 citations
- Pixel Screening Based Intermediate Correction for Blind DeblurringPoster36 citations
- Registering Explicit to Implicit: Towards High-Fidelity Garment Mesh Reconstruction From Single ImagesPoster36 citations
- Self-Supervised Keypoint Discovery in Behavioral VideosPoster36 citations
- UBoCo: Unsupervised Boundary Contrastive Learning for Generic Event Boundary DetectionPoster36 citations
- AutoLoss-GMS: Searching Generalized Margin-Based Softmax Loss Function for Person Re-IdentificationPoster35 citations
- Controllable Dynamic Multi-Task ArchitecturesOral35 citations
- Day-to-Night Image Synthesis for Training Nighttime Neural ISPsOral35 citations
- Geometry-Aware Guided Loss for Deep Crack RecognitionPoster35 citations
- ImplicitAtlas: Learning Deformable Shape Templates in Medical ImagingPoster35 citations
- Improving Segmentation of the Inferior Alveolar Nerve Through Deep Label PropagationPoster35 citations
- On the Road to Online Adaptation for Semantic Image SegmentationPoster35 citations
- Proper Reuse of Image Classification Features Improves Object DetectionOral35 citations
- Ray Priors Through Reprojection: Improving Neural Radiance Fields for Novel View ExtrapolationPoster35 citations
- Recurrent Glimpse-Based Decoder for Detection With TransformerOral35 citations
- Semantic-Shape Adaptive Feature Modulation for Semantic Image SynthesisPoster35 citations
- Semi-Supervised Video Paragraph Grounding With Contrastive EncoderPoster35 citations
- V2C: Visual Voice CloningPoster35 citations
- Adiabatic Quantum Computing for Multi Object TrackingPoster34 citations
- DeltaCNN: End-to-End CNN Inference of Sparse Frame Differences in VideosPoster34 citations
- Dynamic Dual-Output Diffusion ModelsPoster34 citations
- ES6D: A Computation Efficient and Symmetry-Aware 6D Pose Regression FrameworkPoster34 citations
- Enhancing Adversarial Robustness for Deep Metric LearningPoster34 citations
- EvUnroll: Neuromorphic Events Based Rolling Shutter Image CorrectionPoster34 citations
- Finding Good Configurations of Planar Primitives in Unorganized Point CloudsPoster34 citations
- Forecasting Characteristic 3D Poses of Human ActionsPoster34 citations
- HyperDet3D: Learning a Scene-Conditioned 3D Object DetectorOral34 citations
- MetaPose: Fast 3D Pose From Multiple Views Without 3D SupervisionPoster34 citations
- Multi-Grained Spatio-Temporal Features Perceived Network for Event-Based Lip-ReadingPoster34 citations
- Multi-Robot Active Mapping via Neural Bipartite Graph MatchingPoster34 citations
- Neural Mesh SimplificationPoster34 citations
- RCP: Recurrent Closest Point for Point CloudOral34 citations
- RayMVSNet: Learning Ray-Based 1D Implicit Fields for Accurate Multi-View StereoPoster34 citations
- Reading To Listen at the Cocktail Party: Multi-Modal Speech SeparationPoster34 citations
- Reference-Based Video Super-Resolution Using Multi-Camera Video TripletsPoster34 citations
- Revisiting Document Image Dewarping by Grid RegularizationPoster34 citations
- SharpContour: A Contour-Based Boundary Refinement Approach for Efficient and Accurate Instance SegmentationPoster34 citations
- SimT: Handling Open-Set Noise for Domain Adaptive Semantic SegmentationPoster34 citations
- Task Decoupled Framework for Reference-Based Super-ResolutionPoster34 citations
- What Matters for Meta-Learning Vision Regression Tasks?Poster34 citations
- iFS-RCNN: An Incremental Few-Shot Instance SegmenterPoster34 citations
- Aesthetic Text Logo Synthesis via Content-Aware Layout InferringPoster33 citations
- Alleviating Semantics Distortion in Unsupervised Low-Level Image-to-Image Translation via Structure Consistency ConstraintPoster33 citations
- Augmented Geometric Distillation for Data-Free Incremental Person ReIDPoster33 citations
- DeepFace-EMD: Re-Ranking Using Patch-Wise Earth Mover's Distance Improves Out-of-Distribution Face IdentificationPoster33 citations
- Differentiable Stereopsis: Meshes From Multiple Views Using Differentiable RenderingPoster33 citations
- Exploring Effective Data for Surrogate Training Towards Black-Box AttackPoster33 citations
- Incorporating Semi-Supervised and Positive-Unlabeled Learning for Boosting Full Reference Image Quality AssessmentPoster33 citations
- L-Verse: Bidirectional Generation Between Image and TextOral33 citations
- LAR-SR: A Local Autoregressive Model for Image Super-ResolutionPoster33 citations
- OCSampler: Compressing Videos to One Clip With Single-Step SamplingPoster33 citations
- Object Localization Under Single Coarse Point SupervisionPoster33 citations
- One Step at a Time: Long-Horizon Vision-and-Language Navigation With MilestonesPoster33 citations
- PartGlot: Learning Shape Part Segmentation From Language Reference GamesOral33 citations
- Retrieval-Based Spatially Adaptive Normalization for Semantic Image SynthesisPoster33 citations
- SASIC: Stereo Image Compression With Latent Shifts and Stereo AttentionPoster33 citations
- Style-ERD: Responsive and Coherent Online Motion Style TransferPoster33 citations
- Universal Photometric Stereo Network Using Global Lighting ContextsPoster33 citations
- CO-SNE: Dimensionality Reduction and Visualization for Hyperbolic DataPoster32 citations
- De-Rendering 3D Objects in the WildPoster32 citations
- DiLiGenT102: A Photometric Stereo Benchmark Dataset With Controlled Shape and Material VariationPoster32 citations
- Discrete Time Convolution for Fast Event-Based StereoPoster32 citations
- Dressing in the Wild by Watching Dance VideosPoster32 citations
- E-CIR: Event-Enhanced Continuous Intensity RecoveryPoster32 citations
- Enhancing Face Recognition With Self-Supervised 3D ReconstructionPoster32 citations
- Exploring Geometric Consistency for Monocular 3D Object DetectionPoster32 citations
- Fourier Document Restoration for Robust Document Dewarping and RecognitionPoster32 citations
- How Much More Data Do I Need? Estimating Requirements for Downstream TasksPoster32 citations
- Learning To Align Sequential Actions in the WildPoster32 citations
- Neural Emotion Director: Speech-Preserving Semantic Control of Facial Expressions in "In-the-Wild" VideosOral32 citations
- Projective Manifold Gradient Layer for Deep Rotation RegressionPoster32 citations
- SIOD: Single Instance Annotated per Category per Image for Object DetectionPoster32 citations
- Semantic-Aligned Fusion Transformer for One-Shot Object DetectionPoster32 citations
- Sparse to Dense Dynamic 3D Facial Expression GenerationPoster32 citations
- Balanced and Hierarchical Relation Learning for One-Shot Object DetectionPoster31 citations
- Camera-Conditioned Stable Feature Generation for Isolated Camera Supervised Person Re-IDentificationPoster31 citations
- Collaborative Transformers for Grounded Situation RecognitionPoster31 citations
- Consistency Learning via Decoding Path Augmentation for Transformers in Human Object Interaction DetectionPoster31 citations
- Contour-Hugging Heatmaps for Landmark DetectionPoster31 citations
- Cross-Architecture Self-Supervised Video Representation LearningPoster31 citations
- Enabling Equivariance for Arbitrary Lie GroupsOral31 citations
- HARA: A Hierarchical Approach for Robust Rotation AveragingPoster31 citations
- Interpretable Part-Whole Hierarchies and Conceptual-Semantic Relationships in Neural NetworksOral31 citations
- Interspace Pruning: Using Adaptive Filter Representations To Improve Training of Sparse CNNsPoster31 citations
- Learning 3D Object Shape and Layout Without 3D SupervisionPoster31 citations
- Learning To Learn and Remember Super Long Multi-Domain Task SequenceOral31 citations
- Likert Scoring With Grade Decoupling for Long-Term Action AssessmentPoster31 citations
- Neural Inertial LocalizationPoster31 citations
- PhotoScene: Photorealistic Material and Lighting Transfer for Indoor ScenesPoster31 citations
- REX: Reasoning-Aware and Grounded ExplanationPoster31 citations
- Rep-Net: Efficient On-Device Learning via Feature ReprogrammingPoster31 citations
- Target-Relevant Knowledge Preservation for Multi-Source Domain Adaptive Object DetectionOral31 citations
- UKPGAN: A General Self-Supervised Keypoint DetectorPoster31 citations
- Virtual Elastic ObjectsPoster31 citations
- Align Representations With Base: A New Approach to Self-Supervised LearningPoster30 citations
- ClothFormer: Taming Video Virtual Try-On in All ModuleOral30 citations
- Context-Aware Video Reconstruction for Rolling Shutter CamerasPoster30 citations
- Do Explanations Explain? Model Knows BestPoster30 citations
- Ev-TTA: Test-Time Adaptation for Event-Based Object RecognitionPoster30 citations
- GenDR: A Generalized Differentiable RendererPoster30 citations
- HODOR: High-Level Object Descriptors for Object Re-Segmentation in Video Learned From Static ImagesOral30 citations
- Input-Level Inductive Biases for 3D ReconstructionPoster30 citations
- Interactive Multi-Class Tiny-Object DetectionPoster30 citations
- Learning Pixel-Level Distinctions for Video Highlight DetectionPoster30 citations
- Low-Resource Adaptation for Personalized Co-Speech Gesture GenerationPoster30 citations
- NeurMiPs: Neural Mixture of Planar Experts for View SynthesisPoster30 citations
- On Guiding Visual Attention With Language SpecificationPoster30 citations
- PlanarRecon: Real-Time 3D Plane Detection and Reconstruction From Posed Monocular VideosPoster30 citations
- Proto2Proto: Can You Recognize the Car, the Way I Do?Poster30 citations
- Real-Time Hyperspectral Imaging in Hardware via Trained Metasurface EncodersPoster30 citations
- Revisiting Learnable Affines for Batch Norm in Few-Shot Transfer LearningPoster30 citations
- Revisiting Temporal Alignment for Video RestorationPoster30 citations
- SPAMs: Structured Implicit Parametric ModelsPoster30 citations
- Slot-VPS: Object-Centric Representation Learning for Video Panoptic SegmentationPoster30 citations
- SplitNets: Designing Neural Architectures for Efficient Distributed Computing on Head-Mounted SystemsPoster30 citations
- TransRank: Self-Supervised Video Representation Learning via Ranking-Based Transformation RecognitionOral30 citations
- Zero-Query Transfer Attacks on Context-Aware Object DetectorsPoster30 citations
- ADAS: A Direct Adaptation Strategy for Multi-Target Domain Adaptive Semantic SegmentationPoster29 citations
- BNUDC: A Two-Branched Deep Neural Network for Restoring Images From Under-Display CamerasPoster29 citations
- Deep Hybrid Models for Out-of-Distribution DetectionPoster29 citations
- Estimating Fine-Grained Noise Model via Contrastive LearningPoster29 citations
- GANSeg: Learning To Segment by Unsupervised Hierarchical Image GenerationPoster29 citations
- Hierarchical Self-Supervised Representation Learning for Movie UnderstandingPoster29 citations
- Human Instance Matting via Mutual Guidance and Multi-Instance RefinementOral29 citations
- Interactive Disentanglement: Learning Concepts by Interacting With Their Prototype RepresentationsPoster29 citations
- Learning of Global Objective for Network Flow in Multi-Object TrackingPoster29 citations
- Maintaining Reasoning Consistency in Compositional Visual Question AnsweringPoster29 citations
- No Pain, Big Gain: Classify Dynamic Point Cloud Sequences With Static Models by Fitting Feature-Level Space-Time SurfacesPoster29 citations
- Open Challenges in Deep Stereo: The Booster DatasetPoster29 citations
- PanopticDepth: A Unified Framework for Depth-Aware Panoptic SegmentationPoster29 citations
- Partially Does It: Towards Scene-Level FG-SBIR With Partial InputPoster29 citations
- Quarantine: Sparsity Can Uncover the Trojan Attack Trigger for FreePoster29 citations
- TWIST: Two-Way Inter-Label Self-Training for Semi-Supervised 3D Instance SegmentationPoster29 citations
- Undoing the Damage of Label Shift for Cross-Domain Semantic SegmentationPoster29 citations
- Unimodal-Concentrated Loss: Fully Adaptive Label Distribution Learning for Ordinal RegressionPoster29 citations
- Versatile Multi-Modal Pre-Training for Human-Centric PerceptionOral29 citations
- A Hybrid Egocentric Activity Anticipation Framework via Memory-Augmented Recurrent and One-Shot Representation ForecastingPoster28 citations
- A Probabilistic Graphical Model Based on Neural-Symbolic Reasoning for Visual Relationship DetectionPoster28 citations
- C2AM Loss: Chasing a Better Decision Boundary for Long-Tail Object DetectionPoster28 citations
- Contextualized Spatio-Temporal Contrastive Learning With Self-SupervisionPoster28 citations
- Continual Learning for Visual Search With Backward Consistent Feature EmbeddingPoster28 citations
- DPGEN: Differentially Private Generative Energy-Guided Network for Natural Image SynthesisOral28 citations
- DR.VIC: Decomposition and Reasoning for Video Individual CountingPoster28 citations
- Deep Stereo Image Compression via Bi-Directional CodingPoster28 citations
- Deep Vanishing Point Detection: Geometric Priors Make Dataset Variations VanishPoster28 citations
- Delving Into the Estimation Shift of Batch Normalization in a NetworkPoster28 citations
- Global Sensing and Measurements Reuse for Image Compressed SensingPoster28 citations
- Learnable Irrelevant Modality Dropout for Multimodal Action Recognition on Modality-Specific Annotated VideosPoster28 citations
- Learning Optimal K-Space Acquisition and Reconstruction Using Physics-Informed Neural NetworksPoster28 citations
- Learning Part Segmentation Through Unsupervised Domain Adaptation From Synthetic VehiclesOral28 citations
- Modeling Motion With Multi-Modal Features for Text-Based Video SegmentationPoster28 citations
- SS3D: Sparsely-Supervised 3D Object Detection From Point CloudPoster28 citations
- The Devil Is in the Pose: Ambiguity-Free 3D Rotation-Invariant Learning via Pose-Aware ConvolutionPoster28 citations
- A Study on the Distribution of Social Biases in Self-Supervised Learning Visual ModelsPoster27 citations
- Alignment-Uniformity Aware Representation Learning for Zero-Shot Video ClassificationPoster27 citations
- CADTransformer: Panoptic Symbol Spotting Transformer for CAD DrawingsOral27 citations
- Deterministic Point Cloud Registration via Novel Transformation DecompositionPoster27 citations
- Directional Self-Supervised Learning for Heavy Image AugmentationsPoster27 citations
- Dual-Shutter Optical Vibration SensingOral27 citations
- Gravitationally Lensed Black Hole Emission TomographyPoster27 citations
- Learning Adaptive Warping for Real-World Rolling Shutter CorrectionPoster27 citations
- Motion-Adjustable Neural Implicit Video RepresentationOral27 citations
- Multi-Scale Memory-Based Video DeblurringPoster27 citations
- NinjaDesc: Content-Concealing Visual Descriptors via Adversarial LearningPoster27 citations
- Noise Is Also Useful: Negative Correlation-Steered Latent Contrastive LearningPoster27 citations
- Object-Relation Reasoning Graph for Action RecognitionPoster27 citations
- Relieving Long-Tailed Instance Segmentation via Pairwise Class BalancePoster27 citations
- Robust Structured Declarative Classifiers for 3D Point Clouds: Defending Adversarial Attacks With Implicit GradientsPoster27 citations
- Self-Taught Metric Learning Without LabelsPoster27 citations
- Sparse and Complete Latent Organization for Geospatial Semantic SegmentationPoster27 citations
- The Two Dimensions of Worst-Case Training and Their Integrated Effect for Out-of-Domain GeneralizationPoster27 citations
- Video Demoireing With Relation-Based Temporal ConsistencyPoster27 citations
- Virtual Correspondence: Humans as a Cue for Extreme-View GeometryPoster27 citations
- Whose Track Is It Anyway? Improving Robustness to Tracking Errors With Affinity-Based Trajectory PredictionPoster27 citations
- iPLAN: Interactive and Procedural Layout PlanningPoster27 citations
- A Unified Framework for Implicit Sinkhorn DifferentiationPoster26 citations
- Accelerating Video Object Segmentation With Compressed VideoPoster26 citations
- H4D: Human 4D Modeling by Learning Neural Compositional RepresentationPoster26 citations
- How Do You Do It? Fine-Grained Action Understanding With Pseudo-AdverbsPoster26 citations
- Instance-Wise Occlusion and Depth Orders in Natural ScenesPoster26 citations
- Interactive Image Synthesis With Panoptic Layout GenerationPoster26 citations
- Learning Based Multi-Modality Image and Video CompressionPoster26 citations
- Learning To Learn Across Diverse Data Biases in Deep Face RecognitionPoster26 citations
- Leveraging Adversarial Examples To Quantify Membership Information LeakagePoster26 citations
- Maximum Spatial Perturbation Consistency for Unpaired Image-to-Image TranslationPoster26 citations
- Modeling sRGB Camera Noise With Normalizing FlowsPoster26 citations
- Multi-Modal Dynamic Graph Transformer for Visual GroundingPoster26 citations
- Noise2NoiseFlow: Realistic Camera Noise Modeling Without Clean ImagesPoster26 citations
- Online Learning of Reusable Abstract Models for Object Goal NavigationPoster26 citations
- Parametric Scattering NetworksOral26 citations
- PhyIR: Physics-Based Inverse Rendering for Panoramic Indoor ImagesPoster26 citations
- WarpingGAN: Warping Multiple Uniform Priors for Adversarial 3D Point Cloud GenerationPoster26 citations
- Weakly-Supervised Online Action Segmentation in Multi-View Instructional VideosPoster26 citations
- Which Images To Label for Few-Shot Medical Landmark Detection?Poster26 citations
- Whose Hands Are These? Hand Detection and Hand-Body Association in the WildPoster26 citations
- A Versatile Multi-View Framework for LiDAR-Based 3D Object Detection With Guidance From Panoptic SegmentationPoster25 citations
- Aladdin: Joint Atlas Building and Diffeomorphic Registration Learning With Pairwise AlignmentPoster25 citations
- Arbitrary-Scale Image SynthesisPoster25 citations
- Arch-Graph: Acyclic Architecture Relation Predictor for Task-Transferable Neural Architecture SearchPoster25 citations
- Attentive Fine-Grained Structured Sparsity for Image RestorationPoster25 citations
- Beyond Supervised vs. Unsupervised: Representative Benchmarking and Analysis of Image Representation LearningPoster25 citations
- Can You Spot the Chameleon? Adversarially Camouflaging Images From Co-Salient Object DetectionPoster25 citations
- Consistent Explanations by Contrastive LearningPoster25 citations
- DeepCurrents: Learning Implicit Representations of Shapes With BoundariesPoster25 citations
- Degree-of-Linear-Polarization-Based Color ConstancyPoster25 citations
- Dreaming To Prune Image Deraining NetworksPoster25 citations
- Feature Statistics Mixing Regularization for Generative Adversarial NetworksPoster25 citations
- Focal Length and Object Pose Estimation via Render and ComparePoster25 citations
- GrainSpace: A Large-Scale Dataset for Fine-Grained and Domain-Adaptive Recognition of Cereal GrainsPoster25 citations
- HINT: Hierarchical Neuron Concept ExplainerPoster25 citations
- Hyperspherical Consistency RegularizationPoster25 citations
- Incremental Cross-View Mutual Distillation for Self-Supervised Medical CT SynthesisPoster25 citations
- Learning From Pixel-Level Noisy Label: A New Perspective for Light Field Saliency DetectionPoster25 citations
- Learning To Anticipate Future With Dynamic Context RemovalPoster25 citations
- OccAM's Laser: Occlusion-Based Attribution Maps for 3D Object Detectors on LiDAR DataPoster25 citations
- PILC: Practical Image Lossless Compression With an End-to-End GPU Oriented Neural FrameworkPoster25 citations
- Rethinking Deep Face RestorationPoster25 citations
- SVIP: Sequence VerIfication for Procedures in VideosPoster25 citations
- Self-Supervised Dense Consistency Regularization for Image-to-Image TranslationPoster25 citations
- SelfD: Self-Learning Large-Scale Driving Policies From the WebPoster25 citations
- Set-Supervised Action Learning in Procedural Task Videos via Pairwise Order ConsistencyPoster25 citations
- Stable Long-Term Recurrent Video Super-ResolutionPoster25 citations
- Video-Text Representation Learning via Differentiable Weak Temporal AlignmentPoster25 citations
- BaLeNAS: Differentiable Architecture Search via the Bayesian Learning RulePoster24 citations
- Bending Graphs: Hierarchical Shape Matching Using Gated Optimal TransportPoster24 citations
- Compressive Single-Photon 3D CamerasPoster24 citations
- Eigencontours: Novel Contour Descriptors Based on Low-Rank ApproximationOral24 citations
- Graph-Context Attention Networks for Size-Varied Deep Graph MatchingPoster24 citations
- ISNAS-DIP: Image-Specific Neural Architecture Search for Deep Image PriorPoster24 citations
- LARGE: Latent-Based Regression Through GAN SemanticsPoster24 citations
- Learning sRGB-to-Raw-RGB De-Rendering With Content-Aware MetadataPoster24 citations
- M3L: Language-Based Video Editing via Multi-Modal Multi-Level TransformersPoster24 citations
- Manifold Learning Benefits GANsPoster24 citations
- Mining Multi-View Information: A Strong Self-Supervised Framework for Depth-Based 3D Hand Pose and Mesh EstimationPoster24 citations
- Modeling 3D Layout for Group Re-IdentificationPoster24 citations
- Neural Prior for Trajectory EstimationPoster24 citations
- OSKDet: Orientation-Sensitive Keypoint Localization for Rotated Object DetectionPoster24 citations
- Pushing the Performance Limit of Scene Text Recognizer Without Human AnnotationPoster24 citations
- Representing 3D Shapes With Probabilistic Directed Distance FieldsPoster24 citations
- Salvage of Supervision in Weakly Supervised Object DetectionPoster24 citations
- Text2Pos: Text-to-Point-Cloud Cross-Modal LocalizationPoster24 citations
- Towards Low-Cost and Efficient Malaria DetectionPoster24 citations
- Two Coupled Rejection Metrics Can Tell Adversarial Examples ApartPoster24 citations
- Understanding 3D Object Articulation in Internet VideosPoster24 citations
- WALT: Watch and Learn 2D Amodal Representation From Time-Lapse ImageryPoster24 citations
- f-SfT: Shape-From-Template With a Physics-Based Deformation ModelPoster24 citations
- CrossLoc: Scalable Aerial Localization Assisted by Multimodal Synthetic DataPoster23 citations
- Deep Saliency Prior for Reducing Visual DistractionPoster23 citations
- DiSparse: Disentangled Sparsification for Multitask Model CompressionPoster23 citations
- ELSR: Efficient Line Segment Reconstruction With Planes and Points GuidancePoster23 citations
- Efficient Large-Scale Localization by Global Instance RecognitionPoster23 citations
- Explore Spatio-Temporal Aggregation for Insubstantial Object Detection: Benchmark Dataset and BaselinePoster23 citations
- Fast Algorithm for Low-Rank Tensor Completion in Delay-Embedded SpacePoster23 citations
- Forward Compatible Training for Large-Scale Embedding Retrieval SystemsPoster23 citations
- FvOR: Robust Joint Shape and Pose Optimization for Few-View Object ReconstructionPoster23 citations
- Hierarchical Nearest Neighbor Graph Embedding for Efficient Dimensionality ReductionPoster23 citations
- IDEA-Net: Dynamic 3D Point Cloud Interpolation via Deep Embedding AlignmentPoster23 citations
- LD-ConGR: A Large RGB-D Video Dataset for Long-Distance Continuous Gesture RecognitionPoster23 citations
- Leveraging Equivariant Features for Absolute Pose RegressionPoster23 citations
- MotionAug: Augmentation With Physical Correction for Human Motion PredictionPoster23 citations
- PCA-Based Knowledge Distillation Towards Lightweight and Content-Style Balanced Photorealistic Style Transfer ModelsPoster23 citations
- Physical Simulation Layer for Accurate 3D ModelingOral23 citations
- RIDDLE: Lidar Data Compression With Range Image Deep Delta EncodingPoster23 citations
- Semi-Supervised Few-Shot Learning via Multi-Factor ClusteringPoster23 citations
- Sparse Object-Level Supervision for Instance Segmentation With Pixel EmbeddingsPoster23 citations
- Spatial Commonsense Graph for Object Localisation in Partial ScenesPoster23 citations
- Towards Understanding Adversarial Robustness of Optical Flow NetworksPoster23 citations
- Which Model To Transfer? Finding the Needle in the Growing HaystackPoster23 citations
- A Deeper Dive Into What Deep Spatiotemporal Networks Encode: Quantifying Static vs. Dynamic InformationPoster22 citations
- A Proposal-Based Paradigm for Self-Supervised Sound Source Localization in VideosPoster22 citations
- A Scalable Combinatorial Solver for Elastic Geometrically Consistent 3D Shape MatchingPoster22 citations
- An Iterative Quantum Approach for Transformation Estimation From Point SetsPoster22 citations
- Bandits for Structure Perturbation-Based Black-Box Attacks To Graph Neural Networks With Theoretical GuaranteesOral22 citations
- BodyMap: Learning Full-Body Dense Correspondence MapPoster22 citations
- CVNet: Contour Vibration Network for Building ExtractionPoster22 citations
- Comparing Correspondences: Video Prediction With Correspondence-Wise LossesPoster22 citations
- CoordGAN: Self-Supervised Dense Correspondences Emerge From GANsPoster22 citations
- DST: Dynamic Substitute Training for Data-Free Black-Box AttackPoster22 citations
- Deep Depth From Focus With Differential Focus VolumePoster22 citations
- GreedyNASv2: Greedier Search With a Greedy Path FilterPoster22 citations
- HP-Capsule: Unsupervised Face Part Discovery by Hierarchical Parsing Capsule NetworkPoster22 citations
- INS-Conv: Incremental Sparse Convolution for Online 3D SegmentationOral22 citations
- PLAD: Learning To Infer Shape Programs With Pseudo-Labels and Approximate DistributionsPoster22 citations
- RIO: Rotation-Equivariance Supervised Learning of Robust Inertial OdometryPoster22 citations
- Stochastic Backpropagation: A Memory Efficient Strategy for Training Video ModelsOral22 citations
- Style-Structure Disentangled Features and Normalizing Flows for Diverse Icon ColorizationPoster22 citations
- Why Discard if You Can Recycle?: A Recycling Max Pooling Module for 3D Point Cloud AnalysisPoster22 citations
- Artistic Style Discovery With Independent ComponentsPoster21 citations
- Attributable Visual Similarity LearningPoster21 citations
- Bootstrapping ViTs: Towards Liberating Vision Transformers From Pre-TrainingPoster21 citations
- Demystifying the Neural Tangent Kernel From a Practical Perspective: Can It Be Trusted for Neural Architecture Search Without Training?Poster21 citations
- DisARM: Displacement Aware Relation Module for 3D DetectionPoster21 citations
- Dual Adversarial Adaptation for Cross-Device Real-World Image Super-ResolutionOral21 citations
- Explaining Deep Convolutional Neural Networks via Latent Visual-Semantic Filter AttentionOral21 citations
- Few-Shot Head Swapping in the WildOral21 citations
- GanOrCon: Are Generative Models Useful for Few-Shot Segmentation?Poster21 citations
- Gradient-SDF: A Semi-Implicit Surface Representation for 3D ReconstructionPoster21 citations
- LASER: LAtent SpacE Rendering for 2D Visual LocalizationOral21 citations
- More Than Words: In-the-Wild Visually-Driven Prosody for Text-to-SpeechPoster21 citations
- NOC-REK: Novel Object Captioning With Retrieved Vocabulary From External KnowledgePoster21 citations
- Noise Distribution Adaptive Self-Supervised Image Denoising Using Tweedie Distribution and Score MatchingPoster21 citations
- Query and Attention Augmentation for Knowledge-Based Explainable ReasoningPoster21 citations
- RIM-Net: Recursive Implicit Fields for Unsupervised Learning of Hierarchical Shape StructuresPoster21 citations
- RelTransformer: A Transformer-Based Long-Tail Visual Relationship RecognitionPoster21 citations
- Semi-Supervised Learning of Semantic Correspondence With Pseudo-LabelsPoster21 citations
- Semi-Supervised Object Detection via Multi-Instance Alignment With Global Class PrototypesPoster21 citations
- Speech Driven Tongue AnimationPoster21 citations
- Temporal Context Matters: Enhancing Single Image Prediction With Disease Progression RepresentationsOral21 citations
- Total Variation Optimization Layers for Computer VisionPoster21 citations
- Transformer Based Line Segment Classifier With Image Context for Real-Time Vanishing Point Detection in Manhattan WorldPoster21 citations
- Unpaired Cartoon Image Synthesis via Gated Cycle MappingPoster21 citations
- Video Shadow Detection via Spatio-Temporal Interpolation Consistency TrainingPoster21 citations
- 3D Shape Variational Autoencoder Latent Disentanglement via Mini-Batch Feature Swapping for Bodies and FacesOral20 citations
- A Conservative Approach for Unbiased Learning on Unknown BiasesPoster20 citations
- ART-Point: Improving Rotation Robustness of Point Cloud Classifiers via Adversarial RotationPoster20 citations
- AdaSTE: An Adaptive Straight-Through Estimator To Train Binary Neural NetworksPoster20 citations
- BTS: A Bi-Lingual Benchmark for Text Segmentation in the WildOral20 citations
- Contrastive Conditional Neural ProcessesPoster20 citations
- Cross-Modal Perceptionist: Can Face Geometry Be Gleaned From Voices?Poster20 citations
- Dimension Embeddings for Monocular 3D Object DetectionPoster20 citations
- End-to-End Compressed Video Representation Learning for Generic Event Boundary DetectionPoster20 citations
- Finding Fallen Objects via Asynchronous Audio-Visual IntegrationPoster20 citations
- FisherMatch: Semi-Supervised Rotation Regression via Entropy-Based FilteringOral20 citations
- Frame Averaging for Equivariant Shape Space LearningPoster20 citations
- Gated2Gated: Self-Supervised Depth Estimation From Gated ImagesOral20 citations
- HODEC: Towards Efficient High-Order DEcomposed Convolutional Neural NetworksPoster20 citations
- HVH: Learning a Hybrid Neural Volumetric Representation for Dynamic Hair Performance CapturePoster20 citations
- Knowledge Mining With Scene Text for Fine-Grained RecognitionPoster20 citations
- Learning From Untrimmed Videos: Self-Supervised Video Representation Learning With Hierarchical ConsistencyPoster20 citations
- MLP-3D: A MLP-Like 3D Architecture With Grouped Time MixingPoster20 citations
- Multi-Instance Point Cloud Registration by Efficient Correspondence ClusteringPoster20 citations
- Nested Hyperbolic Spaces for Dimensionality Reduction and Hyperbolic NN DesignPoster20 citations
- NomMer: Nominate Synergistic Context in Vision Transformer for Visual RecognitionPoster20 citations
- Playable Environments: Video Manipulation in Space and TimePoster20 citations
- Privacy-Preserving Online AutoML for Domain-Specific Face DetectionPoster20 citations
- Progressive Attention on Multi-Level Dense Difference Maps for Generic Event Boundary DetectionPoster20 citations
- Scene Consistency Representation Learning for Video Scene SegmentationPoster20 citations
- SemAffiNet: Semantic-Affine Transformation for Point Cloud SegmentationPoster20 citations
- A Simple Episodic Linear Probe Improves Visual Recognition in the WildPoster19 citations
- ARCS: Accurate Rotation and Correspondence SearchOral19 citations
- Appearance and Structure Aware Robust Deep Visual Graph Matching: Attack, Defense and BeyondPoster19 citations
- Audio-Driven Neural Gesture Reenactment With Video Motion GraphsPoster19 citations
- BE-STI: Spatial-Temporal Integrated Network for Class-Agnostic Motion Prediction With Bidirectional EnhancementPoster19 citations
- Context-Aware Sequence Alignment Using 4D Skeletal AugmentationOral19 citations
- CroMo: Cross-Modal Learning for Monocular Depth EstimationPoster19 citations
- Geometric and Textural Augmentation for Domain Gap ReductionPoster19 citations
- Industrial Style Transfer With Large-Scale Geometric Warping and Content PreservationPoster19 citations
- ManiTrans: Entity-Level Text-Guided Image Manipulation via Token-Wise Semantic Alignment and GenerationOral19 citations
- Measuring Compositional Consistency for Video Question AnsweringPoster19 citations
- Neural Architecture Search With Representation Mutual InformationPoster19 citations
- Optimal Correction Cost for Object Detection EvaluationPoster19 citations
- Performance-Aware Mutual Knowledge Distillation for Improving Neural Architecture SearchPoster19 citations
- Portrait Eyeglasses and Shadow Removal by Leveraging 3D Synthetic DataPoster19 citations
- Pushing the Envelope of Gradient Boosting Forests via Globally-Optimized Oblique TreesPoster19 citations
- Scene Graph Expansion for Semantics-Guided Image OutpaintingPoster19 citations
- SpaceEdit: Learning a Unified Editing Space for Open-Domain Image Color EditingPoster19 citations
- Stereoscopic Universal Perturbations Across Different Architectures and DatasetsPoster19 citations
- Super-Fibonacci Spirals: Fast, Low-Discrepancy Sampling of SO(3)Oral19 citations
- Texture-Based Error Analysis for Image Super-ResolutionPoster19 citations
- Towards Driving-Oriented Metric for Lane Detection ModelsPoster19 citations
- VRDFormer: End-to-End Video Visual Relation Detection With TransformersOral19 citations
- 3D Moments From Near-Duplicate PhotosPoster18 citations
- A Large-Scale Comprehensive Dataset and Copy-Overlap Aware Evaluation Protocol for Segment-Level Video Copy DetectionPoster18 citations
- Autofocus for Event CamerasOral18 citations
- Brain-Supervised Image EditingPoster18 citations
- Channel Balancing for Accurate Quantization of Winograd ConvolutionsPoster18 citations
- Deep Image-Based Illumination HarmonizationPoster18 citations
- Depth Estimation by Combining Binocular Stereo and Monocular Structured-LightPoster18 citations
- Does Text Attract Attention on E-Commerce Images: A Novel Saliency Prediction Dataset and MethodPoster18 citations
- GAT-CADNet: Graph Attention Network for Panoptic Symbol Spotting in CAD DrawingsPoster18 citations
- Masking Adversarial Damage: Finding Adversarial Saliency for Robust and Sparse NetworkPoster18 citations
- Occlusion-Robust Face Alignment Using a Viewpoint-Invariant Hierarchical Network ArchitectureOral18 citations
- On the Instability of Relative Pose Estimation and RANSAC's RolePoster18 citations
- Point2Seq: Detecting 3D Objects As SequencesPoster18 citations
- Reflection and Rotation Symmetry Detection via Equivariant LearningPoster18 citations
- SkinningNet: Two-Stream Graph Convolutional Neural Network for Skinning Prediction of Synthetic CharactersPoster18 citations
- SphericGAN: Semi-Supervised Hyper-Spherical Generative Adversarial Networks for Fine-Grained Image SynthesisPoster18 citations
- Understanding and Increasing Efficiency of Frank-Wolfe Adversarial TrainingPoster18 citations
- BCOT: A Markerless High-Precision 3D Object Tracking BenchmarkPoster17 citations
- Co-Domain Symmetry for Complex-Valued Deep LearningPoster17 citations
- Coherent Point Drift Revisited for Non-Rigid Shape Matching and RegistrationPoster17 citations
- Contrastive Learning for Space-Time Correspondence via Self-Cycle ConsistencyPoster17 citations
- Data-Free Network Compression via Parametric Non-Uniform Mixed Precision QuantizationPoster17 citations
- Egocentric Prediction of Action Target in 3DPoster17 citations
- FLOAT: Factorized Learning of Object Attributes for Improved Multi-Object Multi-Part Scene ParsingPoster17 citations
- Fast Light-Weight Near-Field Photometric StereoPoster17 citations
- GASP, a Generalized Framework for Agglomerative Clustering of Signed Graphs and Its Application to Instance SegmentationPoster17 citations
- GPU-Based Homotopy Continuation for Minimal Problems in Computer VisionPoster17 citations
- HairMapper: Removing Hair From Portraits Using GANsPoster17 citations
- Learning Motion-Dependent Appearance for High-Fidelity Rendering of Dynamic Humans From a Single CameraPoster17 citations
- Learning Video Representations of Human Motion From Synthetic DataPoster17 citations
- Neural Convolutional SurfacesPoster17 citations
- PSMNet: Position-Aware Stereo Merging Network for Room Layout EstimationPoster17 citations
- Pooling Revisited: Your Receptive Field Is SuboptimalPoster17 citations
- RAGO: Recurrent Graph Optimizer for Multiple Rotation AveragingPoster17 citations
- Revisiting Near/Remote Sensing With Geospatial AttentionPoster17 citations
- Robust Outlier Detection by De-Biasing VAE LikelihoodsPoster17 citations
- SOMSI: Spherical Novel View Synthesis With Soft Occlusion Multi-Sphere ImagesPoster17 citations
- Self-Supervised Super-Resolution for Multi-Exposure Push-Frame SatellitesPoster17 citations
- Simulated Adversarial Testing of Face Recognition ModelsPoster17 citations
- Stereo Magnification With Multi-Layer ImagesPoster17 citations
- Temporal Complementarity-Guided Reinforcement Learning for Image-to-Video Person Re-IdentificationPoster17 citations
- Text-to-Image Synthesis Based on Object-Guided Joint-Decoding TransformerPoster17 citations
- The Implicit Values of a Good Hand Shake: Handheld Multi-Frame Neural Depth RefinementOral17 citations
- Towards Discovering the Effectiveness of Moderately Confident Samples for Semi-Supervised LearningPoster17 citations
- ZZ-Net: A Universal Rotation Equivariant Architecture for 2D Point CloudsOral17 citations
- Commonality in Natural Images Rescues GANs: Pretraining GANs With Generic and Privacy-Free Synthetic DataPoster16 citations
- Confidence Propagation Cluster: Unleash Full Potential of Object DetectorsPoster16 citations
- Dual Task Learning by Leveraging Both Dense Correspondence and Mis-Correspondence for Robust Change Detection With Imperfect MatchesOral16 citations
- ETHSeg: An Amodel Instance Segmentation Network and a Real-World Dataset for X-Ray Waste InspectionPoster16 citations
- Generative Flows With Invertible AttentionsPoster16 citations
- Glass: Geometric Latent Augmentation for Shape SpacesPoster16 citations
- GlideNet: Global, Local and Intrinsic Based Dense Embedding NETwork for Multi-Category Attributes PredictionPoster16 citations
- Multi-Modal Extreme ClassificationPoster16 citations
- PUMP: Pyramidal and Uniqueness Matching Priors for Unsupervised Learning of Local DescriptorsPoster16 citations
- Panoptic, Instance and Semantic Relations: A Relational Context Encoder To Enhance Panoptic SegmentationPoster16 citations
- Rethinking Image Cropping: Exploring Diverse Compositions From Global ViewsPoster16 citations
- Self-Supervised Correlation Mining Network for Person Image GenerationPoster16 citations
- Self-Supervised Deep Image Restoration via Adaptive Stochastic Gradient Langevin DynamicsPoster16 citations
- Semi-Supervised Video Semantic Segmentation With Inter-Frame Feature ReconstructionPoster16 citations
- Semi-Weakly-Supervised Learning of Complex Actions From Instructional Task VideosPoster16 citations
- Slimmable Domain AdaptationPoster16 citations
- Training Object Detectors From Scratch: An Empirical Study in the Era of Vision TransformerPoster16 citations
- UnweaveNet: Unweaving Activity StoriesPoster16 citations
- Volumetric Bundle Adjustment for Online Photorealistic Scene CapturePoster16 citations
- What Do Navigation Agents Learn About Their Environment?Poster16 citations
- Wnet: Audio-Guided Video Object Segmentation via Wavelet-Based Cross-Modal Denoising NetworksPoster16 citations
- Adversarial Eigen Attack on Black-Box ModelsPoster15 citations
- AutoGPart: Intermediate Supervision Search for Generalizable 3D Part SegmentationPoster15 citations
- BoosterNet: Improving Domain Generalization of Deep Neural Nets Using Culpability-Ranked FeaturesPoster15 citations
- Canonical Voting: Towards Robust Oriented Bounding Box Detection in 3D ScenesPoster15 citations
- Chitransformer: Towards Reliable Stereo From CuesPoster15 citations
- Depth-Guided Sparse Structure-From-Motion for Movies and TV ShowsPoster15 citations
- EyePAD++: A Distillation-Based Approach for Joint Eye Authentication and Presentation Attack Detection Using Periocular ImagesPoster15 citations
- Failure Modes of Domain Generalization AlgorithmsOral15 citations
- Faithful Extreme Rescaling via Generative Prior Reciprocated Invertible RepresentationsOral15 citations
- How Good Is Aesthetic Ability of a Fashion Model?Poster15 citations
- It's About Time: Analog Clock Reading in the WildPoster15 citations
- MPC: Multi-View Probabilistic ClusteringPoster15 citations
- Modular Action Concept Grounding in Semantic Video PredictionPoster15 citations
- Neural Face Identification in a 2D Wireframe Projection of a Manifold ObjectPoster15 citations
- Neural Global Shutter: Learn To Restore Video From a Rolling Shutter Camera With Global Reset FeaturePoster15 citations
- Revealing Occlusions With 4D Neural FieldsOral15 citations
- SIMBAR: Single Image-Based Scene Relighting for Effective Data Augmentation for Automated Driving Vision TasksPoster15 citations
- Single-Photon Structured LightPoster15 citations
- SmartAdapt: Multi-Branch Object Detection Framework for Videos on MobilesPoster15 citations
- Stability-Driven Contact Reconstruction From Monocular Color ImagesPoster15 citations
- Synthetic Aperture Imaging With Events and FramesPoster15 citations
- 3DeformRS: Certifying Spatial Deformations on Point CloudsPoster14 citations
- A Differentiable Two-Stage Alignment Scheme for Burst Image Reconstruction With Large ShiftPoster14 citations
- ABPN: Adaptive Blend Pyramid Network for Real-Time Local Retouching of Ultra High-Resolution PhotoPoster14 citations
- AR-NeRF: Unsupervised Learning of Depth and Defocus Effects From Natural Images With Aperture Rendering Neural Radiance FieldsPoster14 citations
- Adaptive Hierarchical Representation Learning for Long-Tailed Object DetectionPoster14 citations
- Consistency Driven Sequential Transformers Attention Model for Partially Observable ScenesPoster14 citations
- Contrastive Dual Gating: Learning Sparse Features With Contrastive LearningPoster14 citations
- Local-Adaptive Face Recognition via Graph-Based Meta-Clustering and Regularized AdaptationPoster14 citations
- Non-Iterative Recovery From Nonlinear Observations Using Generative ModelsPoster14 citations
- Paramixer: Parameterizing Mixing Links in Sparse Factors Works Better Than Dot-Product Self-AttentionPoster14 citations
- RADU: Ray-Aligned Depth Update Convolutions for ToF Data DenoisingPoster14 citations
- Rethinking Controllable Variational AutoencodersPoster14 citations
- Robust Egocentric Photo-Realistic Facial Expression Transfer for Virtual RealityPoster14 citations
- Sequential Voting With Relational Box Fields for Active Object DetectionPoster14 citations
- Towards Multimodal Depth Estimation From Light FieldsPoster14 citations
- Acquiring a Dynamic Light Field Through a Single-Shot Coded ImagePoster13 citations
- All-Photon Polarimetric Time-of-Flight ImagingPoster13 citations
- Automatic Color Image Stitching Using Quaternion Rank-1 AlignmentPoster13 citations
- Compressing Models With Few Samples: Mimicking Then ReplacingPoster13 citations
- Connecting the Complementary-View Videos: Joint Camera Identification and Subject AssociationPoster13 citations
- Exploring and Evaluating Image Restoration Potential in Dynamic ScenesPoster13 citations
- Forward Propagation, Backward Regression, and Pose Association for Hand Tracking in the WildPoster13 citations
- Improving Robustness Against Stealthy Weight Bit-Flip Attacks by Output Code MatchingOral13 citations
- KeyTr: Keypoint Transporter for 3D Reconstruction of Deformable Objects in VideosOral13 citations
- Learning To Learn by Jointly Optimizing Neural Architecture and WeightsPoster13 citations
- Multidimensional Belief Quantification for Label-Efficient Meta-LearningPoster13 citations
- RAMA: A Rapid Multicut Algorithm on GPUOral13 citations
- Shape From Thermal Radiation: Passive Ranging Using Multi-Spectral LWIR MeasurementsPoster13 citations
- Spatial-Temporal Parallel Transformer for Arm-Hand Dynamic EstimationPoster13 citations
- Speed Up Object Detection on Gigapixel-Level Images With Patch ArrangementPoster13 citations
- Unseen Classes at a Later Time? No ProblemPoster13 citations
- Unsupervised Vision-Language Parsing: Seamlessly Bridging Visual Scene Graphs With Language Structures via Dependency RelationshipsPoster13 citations
- A Variational Bayesian Method for Similarity Learning in Non-Rigid Image RegistrationPoster12 citations
- Adaptive Gating for Single-Photon 3D ImagingOral12 citations
- Automatic Relation-Aware Graph Network ProliferationOral12 citations
- Complex Video Action Reasoning via Learnable Markov Logic NetworkPoster12 citations
- Escaping Data Scarcity for High-Resolution Heterogeneous Face HallucinationOral12 citations
- GIQE: Generic Image Quality Enhancement via Nth Order Iterative DegradationPoster12 citations
- Generating 3D Bio-Printable Patches Using Wound Segmentation and Reconstruction To Treat Diabetic Foot UlcersPoster12 citations
- GridShift: A Faster Mode-Seeking Algorithm for Image Segmentation and Object TrackingOral12 citations
- Holocurtains: Programming Light Curtains via Binary HolographyPoster12 citations
- Id-Free Person Similarity LearningPoster12 citations
- Learning Soft Estimator of Keypoint Scale and Orientation With Probabilistic Covariant LossPoster12 citations
- Location-Free Human Pose EstimationPoster12 citations
- Long-Term Video Frame Interpolation via Feature PropagationPoster12 citations
- SMPL-A: Modeling Person-Specific Deformable AnatomyPoster12 citations
- Segment-Fusion: Hierarchical Context Fusion for Robust 3D Semantic SegmentationPoster12 citations
- The DEVIL Is in the Details: A Diagnostic Evaluation Benchmark for Video InpaintingPoster12 citations
- The Flag Median and FlagIRLSPoster12 citations
- The Neurally-Guided Shape Parser: Grammar-Based Labeling of 3D Shape Regions With Approximate InferencePoster12 citations
- 3MASSIV: Multilingual, Multimodal and Multi-Aspect Dataset of Social Media Short VideosPoster11 citations
- Automatic Synthesis of Diverse Weak Supervision Sources for Behavior AnalysisPoster11 citations
- Bilateral Video Magnification FilterPoster11 citations
- BodyGAN: General-Purpose Controllable Neural Human Body GenerationPoster11 citations
- Camera Pose Estimation Using Implicit Distortion ModelsPoster11 citations
- DATA: Domain-Aware and Task-Aware Self-Supervised LearningPoster11 citations
- Efficient Maximal Coding Rate Reduction by Variational FormsPoster11 citations
- Fast, Accurate and Memory-Efficient Partial Permutation SynchronizationPoster11 citations
- Generating Diverse 3D Reconstructions From a Single Occluded Face ImagePoster11 citations
- Learning Canonical F-Correlation Projection for Compact Multiview RepresentationPoster11 citations
- Privacy Preserving Partial LocalizationPoster11 citations
- Propagation Regularizer for Semi-Supervised Learning With Extremely Scarce Labeled SamplesPoster11 citations
- RGB-Multispectral Matching: Dataset, Learning Methodology, EvaluationPoster11 citations
- Revisiting AP Loss for Dense Object Detection: Adaptive Ranking Pair SelectionPoster11 citations
- Semantic-Aware Auto-Encoders for Self-Supervised Representation LearningPoster11 citations
- Split Hierarchical Variational CompressionPoster11 citations
- The Probabilistic Normal Epipolar Constraint for Frame-to-Frame Rotation Optimization Under Uncertain Feature PositionsPoster11 citations
- Upright-Net: Learning Upright Orientation for 3D Point CloudPoster11 citations
- Clean Implicit 3D Structure From Noisy 2D STEM ImagesPoster10 citations
- CodedVTR: Codebook-Based Sparse Voxel Transformer With Geometric GuidancePoster10 citations
- Computing Wasserstein-p Distance Between Images With Linear CostPoster10 citations
- Condensing CNNs With Partial Differential EquationsPoster10 citations
- Continual Predictive Learning From VideosOral10 citations
- Degradation-Agnostic Correspondence From Resolution-Asymmetric StereoPoster10 citations
- FastDOG: Fast Discrete Optimization on GPUPoster10 citations
- Few-Shot Incremental Learning for Label-to-Image TranslationPoster10 citations
- Globetrotter: Connecting Languages by Connecting ImagesOral10 citations
- Learning To Memorize Feature Hallucination for One-Shot Image GenerationPoster10 citations
- Motion-From-Blur: 3D Shape and Motion Estimation of Motion-Blurred Objects in VideosPoster10 citations
- OSSGAN: Open-Set Semi-Supervised Image GenerationPoster10 citations
- R(Det)2: Randomized Decision Routing for Object DetectionPoster10 citations
- ScaleNet: A Shallow Architecture for Scale EstimationPoster10 citations
- Visual Vibration Tomography: Estimating Interior Material Properties From Monocular VideoOral10 citations
- Weakly-Supervised Generation and Grounding of Visual Descriptions With Conditional Generative ModelsPoster10 citations
- A Sampling-Based Approach for Efficient Clustering in Large DatasetsPoster9 citations
- Contextual Outpainting With Object-Level Contrastive LearningPoster9 citations
- Egocentric Scene Understanding via Multimodal Spatial RectifierOral9 citations
- Exemplar-Based Pattern Synthesis With Implicit Periodic Field NetworkPoster9 citations
- Learning Structured Gaussians To Approximate Deep EnsemblesPoster9 citations
- Medial Spectral Coordinates for 3D Shape AnalysisOral9 citations
- Multi-Dimensional, Nuanced and Subjective - Measuring the Perception of Facial ExpressionsPoster9 citations
- One-Bit Active Query With Contrastive PairsPoster9 citations
- Optimizing Elimination Templates by Greedy Parameter SearchPoster9 citations
- Polymorphic-GAN: Generating Aligned Samples Across Multiple Domains With Learned Morph MapsOral9 citations
- PoseKernelLifter: Metric Lifting of 3D Human Pose Using SoundPoster9 citations
- SmartPortraits: Depth Powered Handheld Smartphone Dataset of Human Portraits for State Estimation, Reconstruction and SynthesisPoster9 citations
- Towards Real-World Navigation With Deep Differentiable PlannersPoster9 citations
- UNIST: Unpaired Neural Implicit Shape Translation NetworkPoster9 citations
- "The Pedestrian Next to the Lamppost" Adaptive Object Graphs for Better Instantaneous MappingPoster8 citations
- ActiveZero: Mixed Domain Learning for Active Stereovision With Zero AnnotationPoster8 citations
- Bounded Adversarial Attack on Deep Content FeaturesPoster8 citations
- Deep Hyperspectral-Depth Reconstruction Using Single Color-Dot ProjectionPoster8 citations
- Distribution Consistent Neural Architecture SearchOral8 citations
- FoggyStereo: Stereo Matching With Fog Volume RepresentationPoster8 citations
- Global-Aware Registration of Less-Overlap RGB-D ScansPoster8 citations
- Harmony: A Generic Unsupervised Approach for Disentangling Semantic Content From Parameterized TransformationsPoster8 citations
- Identifying Ambiguous Similarity Conditions via Semantic MatchingPoster8 citations
- Image Based Reconstruction of Liquids From 2D Surface DetectionsPoster8 citations
- Lite-MDETR: A Lightweight Multi-Modal DetectorPoster8 citations
- Local Attention Pyramid for Scene Image GenerationPoster8 citations
- MNSRNet: Multimodal Transformer Network for 3D Surface Super-ResolutionPoster8 citations
- Physically-Guided Disentangled Implicit Rendering for 3D Face ModelingPoster8 citations
- Programmatic Concept Learning for Human Motion Description and SynthesisPoster8 citations
- Self-Supervised Image Representation Learning With Geometric Set ConsistencyPoster8 citations
- Sound and Visual Representation Learning With Multiple Pretraining TasksPoster8 citations
- Tencent-MVSE: A Large-Scale Benchmark Dataset for Multi-Modal Video Similarity EvaluationPoster8 citations
- Weakly Supervised High-Fidelity Clothing Model GenerationPoster8 citations
- 3D Human Tongue Reconstruction From Single "In-the-Wild" ImagesOral7 citations
- AlignQ: Alignment Quantization With ADMM-Based Correlation PreservationPoster7 citations
- AziNorm: Exploiting the Radial Symmetry of Point Cloud for Azimuth-Normalized 3D PerceptionPoster7 citations
- Bi-Level Doubly Variational Learning for Energy-Based Latent Variable ModelsPoster7 citations
- Convolutions for Spatial Interaction ModelingPoster7 citations
- Dynamic Kernel Selection for Improved Generalization and Memory Efficiency in Meta-LearningPoster7 citations
- Generalizing Interactive Backpropagating Refinement for Dense Prediction NetworksPoster7 citations
- Image Animation With Perturbed MasksPoster7 citations
- Optimal LED Spectral Multiplexing for NIR2RGB TranslationPoster7 citations
- Practical Learned Lossless JPEG Recompression With Multi-Level Cross-Channel Entropy Model in the DCT DomainPoster7 citations
- Scanline Homographies for Rolling-Shutter Plane Absolute PosePoster7 citations
- SeeThroughNet: Resurrection of Auxiliary Loss by Preserving Class Probability InformationPoster7 citations
- Single-Stage 3D Geometry-Preserving Depth Estimation Model Training on Dataset Mixtures With Uncalibrated Stereo DataPoster7 citations
- Structure-Aware Flow Generation for Human Body ReshapingPoster7 citations
- TemporalUV: Capturing Loose Clothing With Temporally Coherent UV CoordinatesPoster7 citations
- Training Quantised Neural Networks With STE Variants: The Additive Noise Annealing AlgorithmPoster7 citations
- Unsupervised Representation Learning for Binary Networks by Joint Classifier LearningPoster7 citations
- VisualHow: Multimodal Problem SolvingPoster7 citations
- Weakly Paired Associative Learning for Sound and Image Representations via Bimodal Associative MemoryPoster7 citations
- 360-Attack: Distortion-Aware Perturbations From Perspective-ViewsPoster6 citations
- ADeLA: Automatic Dense Labeling With Attention for Viewpoint Shift in Semantic SegmentationOral6 citations
- AirObject: A Temporally Evolving Graph Embedding for Object IdentificationPoster6 citations
- Do Learned Representations Respect Causal Relationships?Poster6 citations
- Exploiting Explainable Metrics for Augmented SGDPoster6 citations
- Finding Badly Drawn BunniesPoster6 citations
- Fixing Malfunctional Objects With Learned Physical Simulation and Functional PredictionPoster6 citations
- Layered Depth Refinement With Mask GuidancePoster6 citations
- Progressive Minimal Path Method With Embedded CNNPoster6 citations
- UniCoRN: A Unified Conditional Image Repainting NetworkPoster6 citations
- 3D Scene Painting via Semantic Image SynthesisPoster5 citations
- AME: Attention and Memory Enhancement in Hyper-Parameter OptimizationPoster5 citations
- APES: Articulated Part Extraction From Sprite SheetsPoster5 citations
- Boosting View Synthesis With Residual TransferPoster5 citations
- Cannot See the Forest for the Trees: Aggregating Multiple Viewpoints To Better Classify Objects in VideosPoster5 citations
- DO-GAN: A Double Oracle Framework for Generative Adversarial NetworksPoster5 citations
- Deep Decomposition for Stochastic Normal-Abnormal TransportOral5 citations
- Equivariance Allows Handling Multiple Nuisance Variables When Analyzing Pooled Neuroimaging DatasetsPoster5 citations
- Estimating Structural Disparities for Face ModelsPoster5 citations
CVPR accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.