← All conferences

CVPR 2023 Accepted Papers

The full list of 2,307 papers accepted at CVPR 2023 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Poster: 2,085Highlight: 222
  1. Bias Mimicking: A Simple Sampling Approach for Bias MitigationPoster38 citations
  2. Boost Vision Transformer With GPU-Friendly Sparsity and QuantizationPoster38 citations
  3. Class-Conditional Sharpness-Aware Minimization for Deep Long-Tailed RecognitionPoster38 citations
  4. Discovering the Real Association: Multimodal Causal Reasoning in Video Question AnsweringPoster38 citations
  5. Elastic Aggregation for Federated OptimizationPoster38 citations
  6. Enhancing the Self-Universality for Transferable Targeted AttacksPoster38 citations
  7. Handwritten Text Generation From Visual ArchetypesPoster38 citations
  8. HumanGen: Generating Human Radiance Fields With Explicit PriorsPoster38 citations
  9. Layout-Based Causal Inference for Object NavigationPoster38 citations
  10. Learning To Fuse Monocular and Multi-View Cues for Multi-Frame Depth Estimation in Dynamic ScenesPoster38 citations
  11. M6Doc: A Large-Scale Multi-Format, Multi-Type, Multi-Layout, Multi-Language, Multi-Annotation Category Dataset for Modern Document Layout AnalysisPoster38 citations
  12. MV-JAR: Masked Voxel Jigsaw and Reconstruction for LiDAR-Based Self-Supervised Pre-TrainingPoster38 citations
  13. Multi-Mode Online Knowledge Distillation for Self-Supervised Visual Representation LearningPoster38 citations
  14. PLIKS: A Pseudo-Linear Inverse Kinematic Solver for 3D Human Body EstimationHighlight38 citations
  15. PMatch: Paired Masked Image Modeling for Dense Geometric MatchingPoster38 citations
  16. Prompt-Guided Zero-Shot Anomaly Action Recognition Using Pretrained Deep Skeleton FeaturesPoster38 citations
  17. RA-CLIP: Retrieval Augmented Contrastive Language-Image Pre-TrainingPoster38 citations
  18. Rethinking Feature-Based Knowledge Distillation for Face RecognitionPoster38 citations
  19. SelfME: Self-Supervised Motion Learning for Micro-Expression RecognitionPoster38 citations
  20. Top-Down Visual Attention From Analysis by SynthesisHighlight38 citations
  21. Trainable Projected Gradient Method for Robust Fine-TuningPoster38 citations
  22. Understanding Masked Autoencoders via Hierarchical Latent Variable ModelsHighlight38 citations
  23. VQACL: A Novel Visual Question Answering Continual Learning SettingPoster38 citations
  24. Video Dehazing via a Multi-Range Temporal Alignment Network With Physical PriorPoster38 citations
  25. A Strong Baseline for Generalized Few-Shot Semantic SegmentationPoster37 citations
  26. Camouflaged Instance Segmentation via Explicit De-CamouflagingHighlight37 citations
  27. Collecting Cross-Modal Presence-Absence Evidence for Weakly-Supervised Audio-Visual Event PerceptionPoster37 citations
  28. Deep Graph-Based Spatial Consistency for Robust Non-Rigid Point Cloud RegistrationPoster37 citations
  29. DynamicStereo: Consistent Dynamic Depth From Stereo VideosPoster37 citations
  30. Dynamically Instance-Guided Adaptation: A Backward-Free Approach for Test-Time Domain Adaptive Semantic SegmentationPoster37 citations
  31. Exploring Structured Semantic Prior for Multi Label Recognition With Incomplete LabelsPoster37 citations
  32. GradICON: Approximate Diffeomorphisms via Gradient Inverse ConsistencyPoster37 citations
  33. Improving Vision-and-Language Navigation by Generating Future-View Image SemanticsPoster37 citations
  34. IterativePFN: True Iterative Point Cloud FilteringPoster37 citations
  35. LOGO: A Long-Form Video Dataset for Group Action Quality AssessmentPoster37 citations
  36. Learning Multi-Modal Class-Specific Tokens for Weakly Supervised Dense Object LocalizationPoster37 citations
  37. Learning To Retain While Acquiring: Combating Distribution-Shift in Adversarial Data-Free Knowledge DistillationPoster37 citations
  38. Localized Semantic Feature Mixers for Efficient Pedestrian Detection in Autonomous DrivingPoster37 citations
  39. MobileVOS: Real-Time Video Object Segmentation Contrastive Learning Meets Knowledge DistillationPoster37 citations
  40. Multispectral Video Semantic Segmentation: A Benchmark Dataset and BaselinePoster37 citations
  41. NeFII: Inverse Rendering for Reflectance Decomposition With Near-Field Indirect IlluminationPoster37 citations
  42. Physical-World Optical Adversarial Attacks on 3D Face RecognitionPoster37 citations
  43. RIFormer: Keep Your Vision Backbone Effective but Removing Token MixerPoster37 citations
  44. STMixer: A One-Stage Sparse Action DetectorPoster37 citations
  45. Sample-Level Multi-View Graph ClusteringPoster37 citations
  46. SliceMatch: Geometry-Guided Aggregation for Cross-View Pose EstimationPoster37 citations
  47. TeSLA: Test-Time Self-Learning With Automatic Adversarial AugmentationPoster37 citations
  48. Uncovering the Missing Pattern: Unified Framework Towards Trajectory Imputation and PredictionPoster37 citations
  49. Adversarial Counterfactual Visual ExplanationsPoster36 citations
  50. Balanced Energy Regularization Loss for Out-of-Distribution DetectionPoster36 citations
  51. Bi-Level Meta-Learning for Few-Shot Domain GeneralizationPoster36 citations
  52. Black-Box Sparse Adversarial Attack via Multi-Objective OptimisationPoster36 citations
  53. Both Style and Distortion Matter: Dual-Path Unsupervised Domain Adaptation for Panoramic Semantic SegmentationPoster36 citations
  54. Bringing Inputs to Shared Domains for 3D Interacting Hands Recovery in the WildPoster36 citations
  55. DexArt: Benchmarking Generalizable Dexterous Manipulation With Articulated ObjectsPoster36 citations
  56. DiGA: Distil To Generalize and Then Adapt for Domain Adaptive Semantic SegmentationPoster36 citations
  57. DistilPose: Tokenized Pose Regression With Heatmap DistillationPoster36 citations
  58. DoNet: Deep De-Overlapping Network for Cytology Instance SegmentationPoster36 citations
  59. DrapeNet: Garment Generation and Self-Supervised DrapingPoster36 citations
  60. High-Fidelity and Freely Controllable Talking Head Video GenerationPoster36 citations
  61. JRDB-Pose: A Large-Scale Dataset for Multi-Person Pose Estimation and TrackingPoster36 citations
  62. LipFormer: High-Fidelity and Generalizable Talking Face Generation With a Pre-Learned Facial CodebookPoster36 citations
  63. Neural Fourier Filter BankPoster36 citations
  64. Novel-View Acoustic SynthesisPoster36 citations
  65. RGBD2: Generative Scene Synthesis via Incremental View Inpainting Using RGBD Diffusion ModelsPoster36 citations
  66. Robust Generalization Against Photon-Limited Corruptions via Worst-Case Sharpness MinimizationPoster36 citations
  67. SCADE: NeRFs from Space Carving With Ambiguity-Aware Depth EstimatesPoster36 citations
  68. Self-Guided Diffusion ModelsPoster36 citations
  69. Semi-Supervised Learning Made Simple With Self-Supervised ClusteringPoster36 citations
  70. Temporal Consistent 3D LiDAR Representation Learning for Semantic Perception in Autonomous DrivingPoster36 citations
  71. Unpaired Image-to-Image Translation With Shortest Path RegularizationPoster36 citations
  72. ALTO: Alternating Latent Topologies for Implicit 3D ReconstructionPoster35 citations
  73. BiCro: Noisy Correspondence Rectification for Multi-Modality Data via Bi-Directional Cross-Modal Similarity ConsistencyPoster35 citations
  74. Class Balanced Adaptive Pseudo Labeling for Federated Semi-Supervised LearningPoster35 citations
  75. CutMIB: Boosting Light Field Super-Resolution via Multi-View Image BlendingPoster35 citations
  76. EditableNeRF: Editing Topologically Varying Neural Radiance Fields by Key PointsPoster35 citations
  77. FJMP: Factorized Joint Multi-Agent Motion Prediction Over Learned Directed Acyclic Interaction GraphsPoster35 citations
  78. FitMe: Deep Photorealistic 3D Morphable Model AvatarsPoster35 citations
  79. GM-NeRF: Learning Generalizable Model-Based Neural Radiance Fields From Multi-View ImagesPoster35 citations
  80. H2ONet: Hand-Occlusion-and-Orientation-Aware Network for Real-Time 3D Hand Mesh ReconstructionPoster35 citations
  81. I2-SDF: Intrinsic Indoor Scene Reconstruction and Editing via Raytracing in Neural SDFsPoster35 citations
  82. Iterative Proposal Refinement for Weakly-Supervised Video GroundingPoster35 citations
  83. Learning Event Guided High Dynamic Range Video ReconstructionPoster35 citations
  84. NIRVANA: Neural Implicit Representations of Videos With Adaptive Networks and Autoregressive Patch-Wise ModelingPoster35 citations
  85. Neural Koopman Pooling: Control-Inspired Temporal Dynamics Encoding for Skeleton-Based Action RecognitionPoster35 citations
  86. PDPP:Projected Diffusion for Procedure Planning in Instructional VideosHighlight35 citations
  87. PSVT: End-to-End Multi-Person 3D Pose and Shape Estimation With Progressive Video TransformersPoster35 citations
  88. RankMix: Data Augmentation for Weakly Supervised Learning of Classifying Whole Slide Images With Diverse Sizes and Imbalanced CategoriesPoster35 citations
  89. ResFormer: Scaling ViTs With Multi-Resolution TrainingPoster35 citations
  90. Self-Supervised Image-to-Point Distillation via Semantically Tolerant Contrastive LossPoster35 citations
  91. Shape, Pose, and Appearance From a Single Image via Bootstrapped Radiance Field InversionPoster35 citations
  92. Towards Effective Visual Representations for Partial-Label LearningPoster35 citations
  93. Video Test-Time Adaptation for Action RecognitionPoster35 citations
  94. X3KD: Knowledge Distillation Across Modalities, Tasks and Stages for Multi-Camera 3D Object DetectionPoster35 citations
  95. Bi-LRFusion: Bi-Directional LiDAR-Radar Fusion for 3D Dynamic Object DetectionPoster34 citations
  96. BiFormer: Learning Bilateral Motion Estimation via Bilateral Transformer for 4K Video Frame InterpolationPoster34 citations
  97. CIGAR: Cross-Modality Graph Reasoning for Domain Adaptive Object DetectionPoster34 citations
  98. Detecting Human-Object Contact in ImagesPoster34 citations
  99. Diffusion Video Autoencoders: Toward Temporally Consistent Face Video Editing via Disentangled Video EncodingPoster34 citations
  100. Dual-Bridging With Adversarial Noise Generation for Domain Adaptive rPPG EstimationPoster34 citations
  101. FEND: A Future Enhanced Distribution-Aware Contrastive Learning Framework for Long-Tail Trajectory PredictionPoster34 citations
  102. HAAV: Hierarchical Aggregation of Augmented Views for Image CaptioningPoster34 citations
  103. Incrementer: Transformer for Class-Incremental Semantic Segmentation With Knowledge Distillation Focusing on Old ClassHighlight34 citations
  104. Indiscernible Object Counting in Underwater ScenesPoster34 citations
  105. Learning Procedure-Aware Video Representation From Instructional Videos and Their NarrationsPoster34 citations
  106. Making Vision Transformers Efficient From a Token Sparsification ViewPoster34 citations
  107. Meta Compositional Referring Expression SegmentationPoster34 citations
  108. MetaCLUE: Towards Comprehensive Visual Metaphors ResearchPoster34 citations
  109. Nighttime Smartphone Reflective Flare Removal Using Optical Center Symmetry PriorHighlight34 citations
  110. Orthogonal Annotation Benefits Barely-Supervised Medical Image SegmentationPoster34 citations
  111. Referring Image MattingPoster34 citations
  112. Robust Unsupervised StyleGAN Image RestorationPoster34 citations
  113. Single Domain Generalization for LiDAR Semantic SegmentationPoster34 citations
  114. Sliced Optimal Partial TransportPoster34 citations
  115. Stitchable Neural NetworksHighlight34 citations
  116. The Differentiable Lens: Compound Lens Search Over Glass Surfaces and Materials for Object DetectionPoster34 citations
  117. Transformer Scale Gate for Semantic SegmentationPoster34 citations
  118. Unsupervised Inference of Signed Distance Functions From Single Sparse Point Clouds Without Learning PriorsPoster34 citations
  119. Zero-Shot Generative Model Adaptation via Image-Specific Prompt LearningPoster34 citations
  120. itKD: Interchange Transfer-Based Knowledge Distillation for 3D Object DetectionPoster34 citations
  121. A Large-Scale Robustness Analysis of Video Action Recognition ModelsPoster33 citations
  122. CLIP2Protect: Protecting Facial Privacy Using Text-Guided Makeup via Adversarial Latent SearchPoster33 citations
  123. Coaching a Teachable StudentHighlight33 citations
  124. Discriminative Co-Saliency and Background Mining Transformer for Co-Salient Object DetectionPoster33 citations
  125. Event-Based Video Frame Interpolation With Cross-Modal Asymmetric Bidirectional Motion FieldsHighlight33 citations
  126. Feature Separation and Recalibration for Adversarial RobustnessHighlight33 citations
  127. GeneCIS: A Benchmark for General Conditional Image SimilarityHighlight33 citations
  128. Generalized Deep 3D Shape Prior via Part-Discretized Diffusion ProcessPoster33 citations
  129. NeRFLix: High-Quality Neural View Synthesis by Learning a Degradation-Driven Inter-Viewpoint MiXerPoster33 citations
  130. Noisy Correspondence Learning With Meta Similarity CorrectionPoster33 citations
  131. Regularizing Second-Order Influences for Continual LearningPoster33 citations
  132. Robust Multiview Point Cloud Registration With Reliable Pose Graph Initialization and History ReweightingPoster33 citations
  133. Self-Supervised Implicit Glyph Attention for Text RecognitionPoster33 citations
  134. Stare at What You See: Masked Image Modeling Without ReconstructionPoster33 citations
  135. Structured Sparsity Learning for Efficient Video Super-ResolutionPoster33 citations
  136. TAPS3D: Text-Guided 3D Textured Shape Generation From Pseudo SupervisionPoster33 citations
  137. Text-Visual Prompting for Efficient 2D Temporal Video GroundingPoster33 citations
  138. Towards Better Stability and Adaptability: Improve Online Self-Training for Model Adaptation in Semantic SegmentationHighlight33 citations
  139. Towards Modality-Agnostic Person Re-Identification With Descriptive QueryPoster33 citations
  140. Ultra-High Resolution Segmentation With Ultra-Rich Context: A Novel BenchmarkPoster33 citations
  141. Unsupervised Sampling Promoting for Stochastic Human Trajectory PredictionPoster33 citations
  142. ConQueR: Query Contrast Voxel-DETR for 3D Object DetectionHighlight32 citations
  143. EfficientSCI: Densely Connected Network With Space-Time Factorization for Large-Scale Video Snapshot Compressive ImagingPoster32 citations
  144. HRDFuse: Monocular 360deg Depth Estimation by Collaboratively Learning Holistic-With-Regional Depth DistributionsPoster32 citations
  145. Hierarchical Supervision and Shuffle Data Augmentation for 3D Semi-Supervised Object DetectionPoster32 citations
  146. High-Fidelity 3D Face Generation From Natural Language DescriptionsPoster32 citations
  147. Jedi: Entropy-Based Localization and Removal of Adversarial PatchesPoster32 citations
  148. Learning To Detect and Segment for Open Vocabulary Object DetectionPoster32 citations
  149. Multilateral Semantic Relations Modeling for Image Text RetrievalPoster32 citations
  150. Physically Realizable Natural-Looking Clothing Textures Evade Person Detectors via 3D ModelingPoster32 citations
  151. RUST: Latent Neural Scene Representations From Unposed ImageryHighlight32 citations
  152. Re2TAL: Rewiring Pretrained Video Backbones for Reversible Temporal Action LocalizationPoster32 citations
  153. SceneTrilogy: On Human Scene-Sketch and Its Complementarity With Photo and TextPoster32 citations
  154. SeSDF: Self-Evolved Signed Distance Field for Implicit 3D Clothed Human ReconstructionPoster32 citations
  155. SplineCam: Exact Visualization and Characterization of Deep Network Geometry and Decision BoundariesHighlight32 citations
  156. The Devil Is in the Points: Weakly Semi-Supervised Instance Segmentation via Point-Guided Mask RepresentationPoster32 citations
  157. Towards Trustable Skin Cancer Diagnosis via Rewriting Model's DecisionPoster32 citations
  158. Two-Way Multi-Label LossHighlight32 citations
  159. A New Path: Scaling Vision-and-Language Navigation With Synthetic Instructions and Imitation LearningPoster31 citations
  160. Are Deep Neural Networks SMARTer Than Second Graders?Poster31 citations
  161. Category Query Learning for Human-Object Interaction ClassificationPoster31 citations
  162. Defining and Quantifying the Emergence of Sparse Concepts in DNNsPoster31 citations
  163. DynaMask: Dynamic Mask Selection for Instance SegmentationPoster31 citations
  164. FLAG3D: A 3D Fitness Activity Dataset With Language InstructionPoster31 citations
  165. Graph Transformer GANs for Graph-Constrained House GenerationPoster31 citations
  166. HARP: Personalized Hand Reconstruction From a Monocular RGB VideoPoster31 citations
  167. HaLP: Hallucinating Latent Positives for Skeleton-Based Self-Supervised Learning of ActionsPoster31 citations
  168. Hierarchical Neural Memory Network for Low Latency Event ProcessingPoster31 citations
  169. Integrally Pre-Trained Transformer Pyramid NetworksPoster31 citations
  170. Joint HDR Denoising and Fusion: A Real-World Mobile HDR Image DatasetPoster31 citations
  171. OT-Filter: An Optimal Transport Filter for Learning With Noisy LabelsPoster31 citations
  172. Progressive Neighbor Consistency Mining for Correspondence PruningPoster31 citations
  173. Ref-NPR: Reference-Based Non-Photorealistic Radiance Fields for Controllable Scene StylizationPoster31 citations
  174. Revisiting Self-Similarity: Structural Embedding for Image RetrievalPoster31 citations
  175. TBP-Former: Learning Temporal Bird's-Eye-View Pyramid for Joint Perception and Prediction in Vision-Centric Autonomous DrivingPoster31 citations
  176. The ObjectFolder Benchmark: Multisensory Learning With Neural and Real ObjectsPoster31 citations
  177. Towards Robust Tampered Text Detection in Document Image: New Dataset and New SolutionPoster31 citations
  178. Weakly Supervised Temporal Sentence Grounding With Uncertainty-Guided Self-TrainingPoster31 citations
  179. ActMAD: Activation Matching To Align Distributions for Test-Time-TrainingPoster30 citations
  180. AeDet: Azimuth-Invariant Multi-View 3D Object DetectionPoster30 citations
  181. Affordance Grounding From Demonstration Video To Target ImagePoster30 citations
  182. BEV@DC: Bird's-Eye View Assisted Training for Depth CompletionPoster30 citations
  183. Backdoor Cleansing With Unlabeled DataPoster30 citations
  184. BiasAdv: Bias-Adversarial Augmentation for Model DebiasingPoster30 citations
  185. Boosting Weakly-Supervised Temporal Action Localization With Text InformationPoster30 citations
  186. CIMI4D: A Large Multimodal Climbing Motion Dataset Under Human-Scene InteractionsPoster30 citations
  187. CUDA: Convolution-Based Unlearnable DatasetsPoster30 citations
  188. Confidence-Aware Personalized Federated Learning via Variational Expectation MaximizationPoster30 citations
  189. Context-Aware Pretraining for Efficient Blind Image DecompositionPoster30 citations
  190. Decoupling-and-Aggregating for Image Exposure CorrectionPoster30 citations
  191. Dense-Localizing Audio-Visual Events in Untrimmed Videos: A Large-Scale Benchmark and BaselinePoster30 citations
  192. DynaFed: Tackling Client Data Heterogeneity With Global DynamicsPoster30 citations
  193. Exploring and Exploiting Uncertainty for Incomplete Multi-View ClassificationPoster30 citations
  194. Fine-Grained Audible Video DescriptionPoster30 citations
  195. Fuzzy Positive Learning for Semi-Supervised Semantic SegmentationPoster30 citations
  196. Generalizable Implicit Neural Representations via Instance Pattern ComposersHighlight30 citations
  197. Hi-LASSIE: High-Fidelity Articulated Shape and Skeleton Discovery From Sparse Image EnsemblePoster30 citations
  198. IS-GGT: Iterative Scene Graph Generation With Generative TransformersPoster30 citations
  199. Implicit Occupancy Flow Fields for Perception and Prediction in Self-DrivingHighlight30 citations
  200. Improving Visual Grounding by Encouraging Consistent Gradient-Based ExplanationsPoster30 citations
  201. LVQAC: Lattice Vector Quantization Coupled With Spatially Adaptive Companding for Efficient Learned Image CompressionPoster30 citations
  202. Language-Guided Music Recommendation for Video via Prompt AnalogiesHighlight30 citations
  203. Learning Generative Structure Prior for Blind Text Image Super-ResolutionPoster30 citations
  204. Learning To Dub Movies via Hierarchical Prosody ModelsPoster30 citations
  205. Learning To Generate Image Embeddings With User-Level Differential PrivacyPoster30 citations
  206. Local Implicit Ray Function for Generalizable Radiance Field RepresentationPoster30 citations
  207. MMG-Ego4D: Multimodal Generalization in Egocentric Action RecognitionPoster30 citations
  208. Meta-Learning With a Geometry-Adaptive PreconditionerPoster30 citations
  209. NeRFInvertor: High Fidelity NeRF-GAN Inversion for Single-Shot Real Image AnimationPoster30 citations
  210. Neumann Network With Recursive Kernels for Single Image Defocus DeblurringPoster30 citations
  211. On Calibrating Semantic Segmentation Models: Analyses and an AlgorithmPoster30 citations
  212. Persistent Nature: A Generative Model of Unbounded 3D WorldsPoster30 citations
  213. Physics-Driven Diffusion Models for Impact Sound Synthesis From VideosPoster30 citations
  214. Q-DETR: An Efficient Low-Bit Quantized Detection TransformerHighlight30 citations
  215. Recognizability Embedding Enhancement for Very Low-Resolution Face Recognition and Quality EstimationPoster30 citations
  216. Recognizing Rigid Patterns of Unlabeled Point Clouds by Complete and Continuous Isometry Invariants With No False Negatives and No False PositivesPoster30 citations
  217. Starting From Non-Parametric Networks for 3D Point Cloud AnalysisPoster30 citations
  218. StyLess: Boosting the Transferability of Adversarial ExamplesPoster30 citations
  219. Towards Unified Scene Text Spotting Based on Sequence GenerationPoster30 citations
  220. Annealing-Based Label-Transfer Learning for Open World Object DetectionPoster29 citations
  221. BITE: Beyond Priors for Improved Three-D Dog Pose EstimationPoster29 citations
  222. Deformable Mesh Transformer for 3D Human Mesh RecoveryPoster29 citations
  223. Delving StyleGAN Inversion for Image Editing: A Foundation Latent Space ViewpointPoster29 citations
  224. Distilling Vision-Language Pre-Training To Collaborate With Weakly-Supervised Temporal Action LocalizationPoster29 citations
  225. DualRefine: Self-Supervised Depth and Pose Estimation Through Iterative Epipolar Sampling and Refinement Toward EquilibriumPoster29 citations
  226. DyLiN: Making Light Field Networks DynamicPoster29 citations
  227. Generating Aligned Pseudo-Supervision From Non-Aligned Data for Image Restoration in Under-Display CameraPoster29 citations
  228. HandNeRF: Neural Radiance Fields for Animatable Interacting HandsPoster29 citations
  229. Hubs and Hyperspheres: Reducing Hubness and Improving Transductive Few-Shot Learning With Hyperspherical EmbeddingsPoster29 citations
  230. KD-DLGAN: Data Limited Image Generation via Knowledge DistillationPoster29 citations
  231. LSTFE-Net:Long Short-Term Feature Enhancement Network for Video Small Object DetectionPoster29 citations
  232. Learning Distortion Invariant Representation for Image Restoration From a Causality PerspectivePoster29 citations
  233. Learning and Aggregating Lane Graphs for Urban Automated DrivingPoster29 citations
  234. Local 3D Editing via 3D Distillation of CLIP KnowledgePoster29 citations
  235. Masked Representation Learning for Domain Generalized Stereo MatchingPoster29 citations
  236. Modality-Agnostic Debiasing for Single Domain GeneralizationPoster29 citations
  237. MonoATT: Online Monocular 3D Object Detection With Adaptive Token TransformerPoster29 citations
  238. NLOST: Non-Line-of-Sight Imaging With TransformerPoster29 citations
  239. NUWA-LIP: Language-Guided Image Inpainting With Defect-Free VQGANPoster29 citations
  240. Neuro-Modulated Hebbian Learning for Fully Test-Time AdaptationPoster29 citations
  241. OmniAvatar: Geometry-Guided Controllable 3D Head SynthesisPoster29 citations
  242. ProtoCon: Pseudo-Label Refinement via Online Clustering and Prototypical Consistency for Efficient Semi-Supervised LearningHighlight29 citations
  243. Reliability in Semantic Segmentation: Are We on the Right Track?Poster29 citations
  244. Rethinking Gradient Projection Continual Learning: Stability / Plasticity Feature Space DecouplingPoster29 citations
  245. SCOTCH and SODA: A Transformer Video Shadow Detection FrameworkPoster29 citations
  246. Semantic-Promoted Debiasing and Background Disambiguation for Zero-Shot Instance SegmentationPoster29 citations
  247. StepFormer: Self-Supervised Step Discovery and Localization in Instructional VideosPoster29 citations
  248. SunStage: Portrait Reconstruction and Relighting Using the Sun as a Light StagePoster29 citations
  249. Token Turing MachinesPoster29 citations
  250. Towards Fast Adaptation of Pretrained Contrastive Models for Multi-Channel Video-Language RetrievalPoster29 citations
  251. Two-Stream Networks for Weakly-Supervised Temporal Action Localization With Semantic-Aware MechanismsPoster29 citations
  252. Why Is the Winner the Best?Poster29 citations
  253. 3D-POP - An Automated Annotation Approach to Facilitate Markerless 2D-3D Tracking of Freely Moving Birds With Marker-Based Motion CapturePoster28 citations
  254. A-La-Carte Prompt Tuning (APT): Combining Distinct Data via Composable PromptingPoster28 citations
  255. BEV-SAN: Accurate BEV 3D Object Detection via Slice Attention NetworksPoster28 citations
  256. Blind Video Deflickering by Neural Filtering With a Flawed AtlasPoster28 citations
  257. CloSET: Modeling Clothed Humans on Continuous Surface With Explicit Template DecompositionPoster28 citations
  258. ConStruct-VL: Data-Free Continual Structured VL Concepts LearningPoster28 citations
  259. Dealing With Cross-Task Class Discrimination in Online Continual LearningPoster28 citations
  260. Devil Is in the Queries: Advancing Mask Transformers for Real-World Medical Image Segmentation and Out-of-Distribution LocalizationHighlight28 citations
  261. DivClust: Controlling Diversity in Deep ClusteringPoster28 citations
  262. FrustumFormer: Adaptive Instance-Aware Resampling for Multi-View 3D DetectionPoster28 citations
  263. Hard Sample Matters a Lot in Zero-Shot QuantizationPoster28 citations
  264. Human Pose Estimation in Extremely Low-Light ConditionsPoster28 citations
  265. L-CoIns: Language-Based Colorization With Instance AwarenessPoster28 citations
  266. Learning Dynamic Style Kernels for Artistic Style TransferPoster28 citations
  267. Learning Emotion Representations From Verbal and Nonverbal CommunicationPoster28 citations
  268. Learning Neural Duplex Radiance Fields for Real-Time View SynthesisPoster28 citations
  269. Learning Rotation-Equivariant Features for Visual CorrespondencePoster28 citations
  270. MaLP: Manipulation Localization Using a Proactive SchemePoster28 citations
  271. MaskSketch: Unpaired Structure-Guided Masked Image GenerationHighlight28 citations
  272. NIPQ: Noise Proxy-Based Integrated Pseudo-QuantizationPoster28 citations
  273. NerVE: Neural Volumetric Edges for Parametric Curve Extraction From Point CloudPoster28 citations
  274. Non-Contrastive Learning Meets Language-Image Pre-TrainingPoster28 citations
  275. Not All Image Regions Matter: Masked Vector Quantization for Autoregressive Image GenerationPoster28 citations
  276. PaCa-ViT: Learning Patch-to-Cluster Attention in Vision TransformersPoster28 citations
  277. Polynomial Implicit Neural Representations for Large Diverse DatasetsHighlight28 citations
  278. Pruning Parameterization With Bi-Level Optimization for Efficient Semantic Segmentation on the EdgePoster28 citations
  279. Realistic Saliency Guided Image EnhancementPoster28 citations
  280. Self-Supervised Learning for Multimodal Non-Rigid 3D Shape MatchingHighlight28 citations
  281. Shape-Constraint Recurrent Flow for 6D Object Pose EstimationPoster28 citations
  282. TimeBalance: Temporally-Invariant and Temporally-Distinctive Video Representations for Semi-Supervised Action RecognitionPoster28 citations
  283. Toward RAW Object Detection: A New Benchmark and a New ModelPoster28 citations
  284. Unknown Sniffer for Object Detection: Don't Turn a Blind Eye to Unknown ObjectsPoster28 citations
  285. Weakly Supervised Posture Mining for Fine-Grained ClassificationPoster28 citations
  286. 3D Cinemagraphy From a Single ImagePoster27 citations
  287. 3D Highlighter: Localizing Regions on 3D Shapes via Text DescriptionsHighlight27 citations
  288. Bi-Directional Distribution Alignment for Transductive Zero-Shot LearningPoster27 citations
  289. Bootstrap Your Own Prior: Towards Distribution-Agnostic Novel Class DiscoveryPoster27 citations
  290. Catch Missing Details: Image Reconstruction With Frequency Augmented Variational AutoencoderPoster27 citations
  291. Divide and Adapt: Active Domain Adaptation via Customized LearningHighlight27 citations
  292. E2PN: Efficient SE(3)-Equivariant Point NetworkPoster27 citations
  293. Event-Based Shape From PolarizationPoster27 citations
  294. Ham2Pose: Animating Sign Language Notation Into Pose SequencesPoster27 citations
  295. High-Fidelity Facial Avatar Reconstruction From Monocular Video With Generative PriorsPoster27 citations
  296. Improving Image Recognition by Retrieving From Web-Scale Image-Text DataPoster27 citations
  297. Learning Analytical Posterior Probability for Human Mesh RecoveryPoster27 citations
  298. MELTR: Meta Loss Transformer for Learning To Fine-Tune Video Foundation ModelsPoster27 citations
  299. Mask-Free Video Instance SegmentationPoster27 citations
  300. MethaneMapper: Spectral Absorption Aware Hyperspectral Transformer for Methane DetectionHighlight27 citations
  301. Object Pop-Up: Can We Infer 3D Objects and Their Poses From Human Interactions Alone?Poster27 citations
  302. Object-Goal Visual Navigation via Effective Exploration of Relations Among Historical Navigation StatesPoster27 citations
  303. One-to-Few Label Assignment for End-to-End Dense DetectionPoster27 citations
  304. PEFAT: Boosting Semi-Supervised Medical Image Classification via Pseudo-Loss Estimation and Feature Adversarial TrainingHighlight27 citations
  305. ProD: Prompting-To-Disentangle Domain Knowledge for Cross-Domain Few-Shot Image ClassificationPoster27 citations
  306. Proximal Splitting Adversarial Attack for Semantic SegmentationPoster27 citations
  307. Reliable and Interpretable Personalized Federated LearningPoster27 citations
  308. Semi-Supervised Parametric Real-World Image HarmonizationPoster27 citations
  309. Shortcomings of Top-Down Randomization-Based Sanity Checks for Evaluations of Deep Neural Network ExplanationsPoster27 citations
  310. Source-Free Adaptive Gaze Estimation by Uncertainty ReductionPoster27 citations
  311. SynthVSR: Scaling Up Visual Speech Recognition With Synthetic SupervisionPoster27 citations
  312. Transfer Knowledge From Head to Tail: Uncertainty Calibration Under Long-Tailed DistributionPoster27 citations
  313. Unified Mask Embedding and Correspondence Learning for Self-Supervised Video SegmentationPoster27 citations
  314. Unlearnable Clusters: Towards Label-Agnostic Unlearnable ExamplesPoster27 citations
  315. Vision Transformers Are Good Mask Auto-LabelersPoster27 citations
  316. Visual Atoms: Pre-Training Vision Transformers With Sinusoidal WavesPoster27 citations
  317. Where We Are and What We're Looking At: Query Based Worldwide Image Geo-Localization Using Hierarchies and ScenesPoster27 citations
  318. A New Benchmark: On the Utility of Synthetic Data With Blender for Bare Supervised Learning and Downstream Domain AdaptationPoster26 citations
  319. Balanced Spherical Grid for Egocentric View SynthesisPoster26 citations
  320. CoMFormer: Continual Learning in Semantic and Panoptic SegmentationPoster26 citations
  321. Connecting Vision and Language With Video Localized NarrativesHighlight26 citations
  322. Content-Aware Token Sharing for Efficient Semantic Segmentation With Vision TransformersPoster26 citations
  323. DINER: Depth-Aware Image-Based NEural Radiance FieldsPoster26 citations
  324. Detection Hub: Unifying Object Detection Datasets via Query Adaptation on Language EmbeddingPoster26 citations
  325. Domain Generalized Stereo Matching via Hierarchical Visual TransformationPoster26 citations
  326. Exploiting Unlabelled Photos for Stronger Fine-Grained SBIRPoster26 citations
  327. Exploring Motion Ambiguity and Alignment for High-Quality Video Frame InterpolationPoster26 citations
  328. FeatureBooster: Boosting Feature Descriptors With a Lightweight Neural NetworkPoster26 citations
  329. Focused and Collaborative Feedback Integration for Interactive Image SegmentationPoster26 citations
  330. Geometry and Uncertainty-Aware 3D Point Cloud Class-Incremental Semantic SegmentationPoster26 citations
  331. HairStep: Transfer Synthetic to Real Using Strand and Depth Maps for Single-View 3D Hair ModelingHighlight26 citations
  332. ImageNet-E: Benchmarking Neural Network Robustness via Attribute EditingPoster26 citations
  333. Latency Matters: Real-Time Action Forecasting TransformerHighlight26 citations
  334. Learning 3D Scene Priors With 2D SupervisionPoster26 citations
  335. MammalNet: A Large-Scale Video Benchmark for Mammal Recognition and Behavior UnderstandingPoster26 citations
  336. Meta-Tuning Loss Functions and Data Augmentation for Few-Shot Object DetectionPoster26 citations
  337. Modeling Video As Stochastic Processes for Fine-Grained Video Representation LearningHighlight26 citations
  338. Open-Category Human-Object Interaction Pre-Training via Language Modeling FrameworkPoster26 citations
  339. Probabilistic Debiasing of Scene GraphsPoster26 citations
  340. RONO: Robust Discriminative Learning With Noisy Labels for 2D-3D Cross-Modal RetrievalPoster26 citations
  341. Robust Model-Based Face Reconstruction Through Weakly-Supervised Outlier SegmentationPoster26 citations
  342. SIM: Semantic-Aware Instance Mask Generation for Box-Supervised Instance SegmentationPoster26 citations
  343. Single Image Depth Prediction Made Better: A Multivariate Gaussian TakePoster26 citations
  344. Spatio-Temporal Pixel-Level Contrastive Learning-Based Source-Free Domain Adaptation for Video Semantic SegmentationPoster26 citations
  345. Trajectory-Aware Body Interaction Transformer for Multi-Person Pose ForecastingPoster26 citations
  346. VNE: An Effective Method for Improving Deep Representation by Manipulating Eigenvalue DistributionPoster26 citations
  347. Viewpoint Equivariance for Multi-View 3D Object DetectionPoster26 citations
  348. Weakly Supervised Video Emotion Detection and Prediction via Cross-Modal Temporal Erasing NetworkPoster26 citations
  349. A Probabilistic Attention Model With Occlusion-Aware Texture Regression for 3D Hand Reconstruction From a Single RGB ImagePoster25 citations
  350. Adversarially Robust Neural Architecture Search for Graph Neural NetworksPoster25 citations
  351. BAEFormer: Bi-Directional and Early Interaction Transformers for Bird's Eye View Semantic SegmentationPoster25 citations
  352. Biomechanics-Guided Facial Action Unit Detection Through Force ModelingPoster25 citations
  353. Complete-to-Partial 4D Distillation for Self-Supervised Point Cloud Sequence Representation LearningPoster25 citations
  354. Compression-Aware Video Super-ResolutionPoster25 citations
  355. DeepVecFont-v2: Exploiting Transformers To Synthesize Vector Fonts With Higher QualityPoster25 citations
  356. DegAE: A New Pretraining Paradigm for Low-Level VisionHighlight25 citations
  357. Distribution Shift Inversion for Out-of-Distribution PredictionPoster25 citations
  358. DualRel: Semi-Supervised Mitochondria Segmentation From a Prototype PerspectivePoster25 citations
  359. Exploring Incompatible Knowledge Transfer in Few-Shot Image GenerationPoster25 citations
  360. Glocal Energy-Based Learning for Few-Shot Open-Set RecognitionPoster25 citations
  361. Harmonious Feature Learning for Interactive Hand-Object Pose EstimationPoster25 citations
  362. Incremental 3D Semantic Scene Graph Prediction From RGB SequencesPoster25 citations
  363. Masked Jigsaw Puzzle: A Versatile Position Embedding for Vision TransformersPoster25 citations
  364. NeurOCS: Neural NOCS Supervision for Monocular 3D Object LocalizationPoster25 citations
  365. Neural Vector Fields: Implicit Representation by Explicit LearningPoster25 citations
  366. RMLVQA: A Margin Loss Approach for Visual Question Answering With Language BiasesPoster25 citations
  367. Re-Thinking Federated Active Learning Based on Inter-Class DiversityPoster25 citations
  368. Recurrent Homography Estimation Using Homography-Guided Image Warping and Focus TransformerPoster25 citations
  369. SemiCVT: Semi-Supervised Convolutional Vision Transformer for Semantic SegmentationPoster25 citations
  370. Sketch2Saliency: Learning To Detect Salient Objects From Human DrawingsPoster25 citations
  371. SteerNeRF: Accelerating NeRF Rendering via Smooth Viewpoint TrajectoryPoster25 citations
  372. Towards Benchmarking and Assessing Visual Naturalness of Physical World Adversarial AttacksPoster25 citations
  373. Towards Domain Generalization for Multi-View 3D Object Detection in Bird-Eye-ViewPoster25 citations
  374. Towards High-Quality and Efficient Video Super-Resolution via Spatial-Temporal Data OverfittingHighlight25 citations
  375. Transformer-Based Learned OptimizationPoster25 citations
  376. Turning Strengths Into Weaknesses: A Certified Robustness Inspired Attack Framework Against Graph Neural NetworksPoster25 citations
  377. Unsupervised Volumetric AnimationPoster25 citations
  378. Weakly Supervised Segmentation With Point Annotations for Histopathology Images via Contrast-Based Variational ModelPoster25 citations
  379. ZBS: Zero-Shot Background Subtraction via Instance-Level Background Modeling and Foreground SelectionPoster25 citations
  380. Zero-Shot Text-to-Parameter Translation for Game Character Auto-CreationPoster25 citations
  381. iQuery: Instruments As Queries for Audio-Visual Sound SeparationPoster25 citations
  382. ARKitTrack: A New Diverse Dataset for Tracking Using Mobile RGB-D DataPoster24 citations
  383. Bridging the Gap Between Model Explanations in Partially Annotated Multi-Label ClassificationPoster24 citations
  384. Co-Salient Object Detection With Uncertainty-Aware Group Exchange-MaskingPoster24 citations
  385. ContraNeRF: Generalizable Neural Radiance Fields for Synthetic-to-Real Novel View Synthesis via Contrastive LearningPoster24 citations
  386. DART: Diversify-Aggregate-Repeat Training Improves Generalization of Neural NetworksPoster24 citations
  387. Data-Free Sketch-Based Image RetrievalPoster24 citations
  388. Delving Into Shape-Aware Zero-Shot Semantic SegmentationPoster24 citations
  389. Dual Alignment Unsupervised Domain Adaptation for Video-Text RetrievalPoster24 citations
  390. FCC: Feature Clusters Compression for Long-Tailed Visual RecognitionPoster24 citations
  391. Hierarchical Semantic Correspondence Networks for Video Paragraph GroundingPoster24 citations
  392. In-Hand 3D Object Scanning From an RGB SequencePoster24 citations
  393. Markerless Camera-to-Robot Pose Estimation via Self-Supervised Sim-to-Real TransferPoster24 citations
  394. Multi-Space Neural Radiance FieldsPoster24 citations
  395. Mutual Information-Based Temporal Difference Learning for Human Pose Estimation in VideoPoster24 citations
  396. NEF: Neural Edge Fields for 3D Parametric Curve Reconstruction From Multi-View ImagesPoster24 citations
  397. Novel Class Discovery for 3D Point Cloud Semantic SegmentationPoster24 citations
  398. OPE-SR: Orthogonal Position Encoding for Designing a Parameter-Free Upsampling Module in Arbitrary-Scale Image Super-ResolutionPoster24 citations
  399. Physics-Guided ISO-Dependent Sensor Noise Modeling for Extreme Low-Light PhotographyPoster24 citations
  400. REC-MV: REconstructing 3D Dynamic Cloth From Monocular VideosPoster24 citations
  401. Spectral Bayesian Uncertainty for Image Super-ResolutionPoster24 citations
  402. StructVPR: Distill Structural Knowledge With Weighting Samples for Visual Place RecognitionPoster24 citations
  403. Visual-Tactile Sensing for In-Hand Object ReconstructionPoster24 citations
  404. iCLIP: Bridging Image Classification and Contrastive Language-Image Pre-Training for Visual RecognitionPoster24 citations
  405. Adaptive Plasticity Improvement for Continual LearningPoster23 citations
  406. Architectural Backdoors in Neural NetworksPoster23 citations
  407. AutoLabel: CLIP-Based Framework for Open-Set Video Domain AdaptationPoster23 citations
  408. Boosting Low-Data Instance Segmentation by Unsupervised Pre-Training With Saliency PromptPoster23 citations
  409. Box-Level Active DetectionHighlight23 citations
  410. Decompose More and Aggregate Better: Two Closer Looks at Frequency Representation Learning for Human Motion PredictionPoster23 citations
  411. Detection of Out-of-Distribution Samples Using Binary Neuron Activation PatternsPoster23 citations
  412. Dynamic Focus-Aware Positional Queries for Semantic SegmentationPoster23 citations
  413. Dynamic Generative Targeted Attacks With Pattern InjectionPoster23 citations
  414. Efficient On-Device Training via Gradient FilteringPoster23 citations
  415. Egocentric Auditory Attention Localization in ConversationsPoster23 citations
  416. Exact-NeRF: An Exploration of a Precise Volumetric Parameterization for Neural Radiance FieldsPoster23 citations
  417. FaceLit: Neural 3D Relightable FacesPoster23 citations
  418. IDGI: A Framework To Eliminate Explanation Noise From Integrated GradientsPoster23 citations
  419. Im2Hands: Learning Attentive Implicit Representation of Interacting Two-Hand ShapesPoster23 citations
  420. Improving Robustness of Vision Transformers by Reducing Sensitivity To Patch CorruptionsPoster23 citations
  421. LEMaRT: Label-Efficient Masked Region Transform for Image HarmonizationPoster23 citations
  422. Learning Expressive Prompting With Residuals for Vision TransformersPoster23 citations
  423. Leverage Interactive Affinity for Affordance LearningPoster23 citations
  424. MHPL: Minimum Happy Points Learning for Active Source Free Domain AdaptationPoster23 citations
  425. MSF: Motion-Guided Sequential Fusion for Efficient 3D Object Detection From Point Cloud SequencesPoster23 citations
  426. Masked and Adaptive Transformer for Exemplar Based Image TranslationPoster23 citations
  427. Modeling the Distributional Uncertainty for Salient Object Detection ModelsPoster23 citations
  428. Object Discovery From Motion-Guided TokensPoster23 citations
  429. Occlusion-Free Scene Recovery via Neural Radiance FieldsPoster23 citations
  430. PersonNeRF: Personalized Reconstruction From Photo CollectionsPoster23 citations
  431. Probabilistic Prompt Learning for Dense PredictionPoster23 citations
  432. Rate Gradient Approximation Attack Threats Deep Spiking Neural NetworksPoster23 citations
  433. SMPConv: Self-Moving Point Representations for Continuous ConvolutionPoster23 citations
  434. ScaleDet: A Scalable Multi-Dataset Object DetectorPoster23 citations
  435. Self-Supervised Representation Learning for CADPoster23 citations
  436. SmartAssign: Learning a Smart Knowledge Assignment Strategy for Deraining and DesnowingPoster23 citations
  437. Sparse Multi-Modal Graph Transformer With Shared-Context Processing for Representation Learning of Giga-Pixel ImagesPoster23 citations
  438. Spatiotemporal Self-Supervised Learning for Point Clouds in the WildPoster23 citations
  439. System-Status-Aware Adaptive Network for Online Streaming Video UnderstandingPoster23 citations
  440. TempSAL - Uncovering Temporal Information for Deep Saliency PredictionPoster23 citations
  441. The Dark Side of Dynamic Routing Neural Networks: Towards Efficiency Backdoor InjectionPoster23 citations
  442. Toward Accurate Post-Training Quantization for Image Super ResolutionPoster23 citations
  443. Trade-Off Between Robustness and Accuracy of Vision TransformersPoster23 citations
  444. Uncertainty-Aware Optimal Transport for Semantically Coherent Out-of-Distribution DetectionPoster23 citations
  445. Understanding and Improving Features Learned in Deep Functional MapsHighlight23 citations
  446. Visual Recognition-Driven Image Restoration for Multiple Degradation With Intrinsic Semantics RecoveryPoster23 citations
  447. WeatherStream: Light Transport Automation of Single Image DeweatheringPoster23 citations
  448. ACL-SPC: Adaptive Closed-Loop System for Self-Supervised Point Cloud CompletionPoster22 citations
  449. ASPnet: Action Segmentation With Shared-Private Representation of Multiple Data SourcesPoster22 citations
  450. Adaptive Graph Convolutional Subspace ClusteringPoster22 citations
  451. Binary Latent DiffusionPoster22 citations
  452. Class Adaptive Network CalibrationPoster22 citations
  453. Cross-Domain Image Captioning With Discriminative FinetuningPoster22 citations
  454. Decomposed Cross-Modal Distillation for RGB-Based Temporal Action DetectionPoster22 citations
  455. Deep Random Projector: Accelerated Deep Image PriorPoster22 citations
  456. EFEM: Equivariant Neural Field Expectation Maximization for 3D Object Segmentation Without Scene SupervisionPoster22 citations
  457. FashionSAP: Symbols and Attributes Prompt for Fine-Grained Fashion Vision-Language Pre-TrainingPoster22 citations
  458. HDR Imaging With Spatially Varying Signal-to-Noise RatiosPoster22 citations
  459. High Fidelity 3D Hand Shape Reconstruction via Scalable Graph Frequency DecompositionPoster22 citations
  460. Improving Weakly Supervised Temporal Action Localization by Bridging Train-Test Gap in Pseudo LabelsPoster22 citations
  461. Introducing Competition To Boost the Transferability of Targeted Adversarial Examples Through Clean Feature MixupPoster22 citations
  462. Iterative Vision-and-Language NavigationPoster22 citations
  463. LiDAR2Map: In Defense of LiDAR-Based Semantic Map Construction Using Online Camera DistillationPoster22 citations
  464. MED-VT: Multiscale Encoder-Decoder Video Transformer With Application To Object SegmentationPoster22 citations
  465. MarS3D: A Plug-and-Play Motion-Aware Model for Semantic Segmentation on Multi-Scan 3D Point CloudsPoster22 citations
  466. Masked Images Are Counterfactual Samples for Robust Fine-TuningPoster22 citations
  467. Matching Is Not Enough: A Two-Stage Framework for Category-Agnostic Pose EstimationHighlight22 citations
  468. Multiscale Tensor Decomposition and Rendering Equation Encoding for View SynthesisPoster22 citations
  469. NVTC: Nonlinear Vector Transform CodingPoster22 citations
  470. NeuDA: Neural Deformable Anchor for High-Fidelity Implicit Surface ReconstructionPoster22 citations
  471. NeuMap: Neural Coordinate Mapping by Auto-Transdecoder for Camera LocalizationPoster22 citations
  472. On the Convergence of IRLS and Its Variants in Outlier-Robust EstimationHighlight22 citations
  473. Open-Set Fine-Grained Retrieval via Prompting Vision-Language EvaluatorPoster22 citations
  474. PixHt-Lab: Pixel Height Based Light Effect Generation for Image CompositingHighlight22 citations
  475. Privacy-Preserving Adversarial Facial FeaturesPoster22 citations
  476. Progressive Open Space Expansion for Open-Set Model AttributionPoster22 citations
  477. Rawgment: Noise-Accounted RAW Augmentation Enables Recognition in a Wide Variety of EnvironmentsPoster22 citations
  478. Rebalancing Batch Normalization for Exemplar-Based Class-Incremental LearningPoster22 citations
  479. Rigidity-Aware Detection for 6D Object Pose EstimationPoster22 citations
  480. Robust Single Image Reflection Removal Against Adversarial AttacksPoster22 citations
  481. ShapeClipper: Scalable 3D Shape Learning From Single-View Images via Geometric and CLIP-Based ConsistencyPoster22 citations
  482. The Best Defense Is a Good Offense: Adversarial Augmentation Against Adversarial AttacksPoster22 citations
  483. Towards a Smaller Student: Capacity Dynamic Distillation for Efficient Image RetrievalPoster22 citations
  484. Video Compression With Entropy-Constrained Neural RepresentationsPoster22 citations
  485. Weakly Supervised Monocular 3D Object Detection Using Multi-View Projection and Direction ConsistencyPoster22 citations
  486. A New Dataset Based on Images Taken by Blind People for Testing the Robustness of Image Classification Models Trained for ImageNet CategoriesPoster21 citations
  487. Bias-Eliminating Augmentation Learning for Debiased Federated LearningPoster21 citations
  488. Bit-Shrinking: Limiting Instantaneous Sharpness for Improving Post-Training QuantizationPoster21 citations
  489. Boosting Detection in Crowd Analysis via Underutilized Output FeaturesPoster21 citations
  490. CASP-Net: Rethinking Video Saliency Prediction From an Audio-Visual Consistency Perceptual PerspectivePoster21 citations
  491. CP3: Channel Pruning Plug-In for Point-Based NetworksPoster21 citations
  492. Cascade Evidential Learning for Open-World Weakly-Supervised Temporal Action LocalizationPoster21 citations
  493. Continuous Pseudo-Label Rectified Domain Adaptive Semantic Segmentation With Implicit Neural RepresentationsPoster21 citations
  494. Deep Fair Clustering via Maximizing and Minimizing Mutual Information: Theory, Algorithm and MetricPoster21 citations
  495. Defending Against Patch-Based Backdoor Attacks on Self-Supervised LearningPoster21 citations
  496. Fast Contextual Scene Graph Generation With Unbiased Context AugmentationPoster21 citations
  497. FlexNeRF: Photorealistic Free-Viewpoint Rendering of Moving Humans From Sparse ViewsPoster21 citations
  498. GINA-3D: Learning To Generate Implicit Neural Assets in the WildPoster21 citations
  499. HelixSurf: A Robust and Efficient Neural Implicit Surface Learning of Indoor Scenes With Iterative Intertwined RegularizationPoster21 citations
  500. Instant Multi-View Head Capture Through Learnable RegistrationPoster21 citations
  501. Instant-NVR: Instant Neural Volumetric Rendering for Human-Object Interactions From Monocular RGBD StreamPoster21 citations
  502. Learnable Skeleton-Aware 3D Point Cloud SamplingPoster21 citations
  503. Learning 3D-Aware Image Synthesis With Unknown Pose DistributionPoster21 citations
  504. Learning Situation Hyper-Graphs for Video Question AnsweringPoster21 citations
  505. Learning To Detect Mirrors From Videos via Dual CorrespondencesPoster21 citations
  506. Motion Information Propagation for Neural Video CompressionPoster21 citations
  507. Multi-View Inverse Rendering for Large-Scale Real-World Indoor ScenesPoster21 citations
  508. NeuralPCI: Spatio-Temporal Neural Field for 3D Point Cloud Multi-Frame Non-Linear InterpolationPoster21 citations
  509. ORCa: Glossy Objects As Radiance-Field CamerasPoster21 citations
  510. PAniC-3D: Stylized Single-View 3D Reconstruction From Portraits of Anime CharactersPoster21 citations
  511. Poly-PC: A Polyhedral Network for Multiple Point Cloud Tasks at OncePoster21 citations
  512. Q: How To Specialize Large Vision-Language Models to Data-Scarce VQA Tasks? A: Self-Train on Unlabeled Images!Poster21 citations
  513. ReVISE: Self-Supervised Speech Resynthesis With Visual Input for Universal and Generalized Speech RegenerationPoster21 citations
  514. Relightable Neural Human Assets From Multi-View Gradient IlluminationsPoster21 citations
  515. SHS-Net: Learning Signed Hyper Surfaces for Oriented Normal Estimation of Point CloudsPoster21 citations
  516. Seasoning Model Soups for Robustness to Adversarial and Natural Distribution ShiftsPoster21 citations
  517. Soft Augmentation for Image ClassificationPoster21 citations
  518. TWINS: A Fine-Tuning Framework for Improved Transferability of Adversarial Robustness and GeneralizationPoster21 citations
  519. Two-Shot Video Object SegmentationPoster21 citations
  520. UMat: Uncertainty-Aware Single Image High Resolution Material CapturePoster21 citations
  521. Use Your Head: Improving Long-Tail Video RecognitionPoster21 citations
  522. Visual Exemplar Driven Task-Prompting for Unified Perception in Autonomous DrivingPoster21 citations
  523. Visual Localization Using Imperfect 3D Models From the InternetPoster21 citations
  524. Weakly-Supervised Domain Adaptive Semantic Segmentation With Prototypical Contrastive LearningPoster21 citations
  525. Where Is My Spot? Few-Shot Image Generation via Latent Subspace OptimizationPoster21 citations
  526. You Need Multiple Exiting: Dynamic Early Exiting for Accelerating Unified Vision Language ModelPoster21 citations
  527. 3D-Aware Face SwappingPoster20 citations
  528. A Unified Spatial-Angular Structured Light for Single-View Acquisition of Shape and ReflectancePoster20 citations
  529. Adaptive Channel Sparsity for Federated Learning Under System HeterogeneityPoster20 citations
  530. AsyFOD: An Asymmetric Adaptation Paradigm for Few-Shot Domain Adaptive Object DetectionPoster20 citations
  531. Bridging Precision and Confidence: A Train-Time Loss for Calibrating Object DetectionPoster20 citations
  532. Class Prototypes Based Contrastive Learning for Classifying Multi-Label and Fine-Grained Educational VideosPoster20 citations
  533. Cloud-Device Collaborative Adaptation to Continual Changing Environments in the Real-WorldPoster20 citations
  534. Difficulty-Based Sampling for Debiased Contrastive Representation LearningPoster20 citations
  535. DualVector: Unsupervised Vector Font Synthesis With Dual-Part RepresentationPoster20 citations
  536. Evolved Part Masking for Self-Supervised LearningPoster20 citations
  537. Federated Learning With Data-Agnostic Distribution FusionPoster20 citations
  538. Fusing Pre-Trained Language Models With Multimodal Prompts Through Reinforcement LearningPoster20 citations
  539. GANHead: Towards Generative Animatable Neural Head AvatarsPoster20 citations
  540. HIER: Metric Learning Beyond Class Labels via Hierarchical RegularizationPoster20 citations
  541. Hierarchical B-Frame Video Coding Using Two-Layer CANF Without Motion CodingHighlight20 citations
  542. HuManiFlow: Ancestor-Conditioned Normalising Flows on SO(3) Manifolds for Human Pose and Shape Distribution EstimationPoster20 citations
  543. Human Guided Ground-Truth Generation for Realistic Image Super-ResolutionPoster20 citations
  544. HypLiLoc: Towards Effective LiDAR Pose Regression With Hyperbolic FusionPoster20 citations
  545. IFSeg: Image-Free Semantic Segmentation via Vision-Language ModelPoster20 citations
  546. Improving Commonsense in Vision-Language Models via Knowledge Graph RiddlesHighlight20 citations
  547. Improving Selective Visual Question Answering by Learning From Your PeersPoster20 citations
  548. Learning Personalized High Quality Volumetric Head Avatars From Monocular RGB VideosPoster20 citations
  549. Level-S$^2$fM: Structure From Motion on Neural Level Set of Implicit SurfacesPoster20 citations
  550. MOSO: Decomposing MOtion, Scene and Object for Video PredictionPoster20 citations
  551. Masked Auto-Encoders Meet Generative Adversarial Networks and BeyondPoster20 citations
  552. Master: Meta Style Transformer for Controllable Zero-Shot and Few-Shot Artistic Style TransferPoster20 citations
  553. Meta-Explore: Exploratory Hierarchical Vision-and-Language Navigation Using Scene Object Spectrum GroundingPoster20 citations
  554. No One Left Behind: Improving the Worst Categories in Long-Tailed LearningPoster20 citations
  555. One-Shot Model for Mixed-Precision QuantizationPoster20 citations
  556. Open-Set Likelihood Maximization for Few-Shot LearningPoster20 citations
  557. Parametric Implicit Face Representation for Audio-Driven Facial ReenactmentPoster20 citations
  558. Partial Network CloningPoster20 citations
  559. Point2Pix: Photo-Realistic Point Cloud Rendering via Neural Radiance FieldsPoster20 citations
  560. Pointersect: Neural Rendering With Cloud-Ray IntersectionPoster20 citations
  561. Raw Image Reconstruction With Learned Compact MetadataPoster20 citations
  562. Re-GAN: Data-Efficient GANs Training via Architectural ReconfigurationPoster20 citations
  563. RefCLIP: A Universal Teacher for Weakly Supervised Referring Expression ComprehensionPoster20 citations
  564. Revisiting the P3P ProblemPoster20 citations
  565. STMT: A Spatial-Temporal Mesh Transformer for MoCap-Based Action RecognitionPoster20 citations
  566. SViTT: Temporal Learning of Sparse Video-Text TransformersPoster20 citations
  567. ShadowNeuS: Neural SDF Reconstruction by Shadow Ray SupervisionPoster20 citations
  568. Towards Open-World Segmentation of PartsPoster20 citations
  569. Where Is My Wallet? Modeling Object Proposal Sets for Egocentric Visual Query LocalizationPoster20 citations
  570. Zero-Shot Model DiagnosisPoster20 citations
  571. 3D-Aware Facial Landmark Detection via Multi-View Consistent Training on Synthetic DataPoster19 citations
  572. Advancing Visual Grounding With Scene Knowledge: Benchmark and MethodPoster19 citations
  573. Context-Based Trit-Plane Coding for Progressive Image CompressionPoster19 citations
  574. Crossing the Gap: Domain Generalization for Image CaptioningPoster19 citations
  575. DIFu: Depth-Guided Implicit Function for Clothed Human ReconstructionPoster19 citations
  576. Decoupling Learning and Remembering: A Bilevel Memory Framework With Knowledge Projection for Task-Incremental LearningPoster19 citations
  577. Demystifying Causal Features on Adversarial Examples and Causal Inoculation for Robust Network by Adversarial Instrumental Variable RegressionPoster19 citations
  578. Discrete Point-Wise Attack Is Not Enough: Generalized Manifold Adversarial Attack for Face RecognitionPoster19 citations
  579. Ensemble-Based Blackbox Attacks on Dense PredictionPoster19 citations
  580. From Node Interaction To Hop Interaction: New Effective and Scalable Graph Learning ParadigmPoster19 citations
  581. GazeNeRF: 3D-Aware Gaze Redirection With Neural Radiance FieldsPoster19 citations
  582. HGNet: Learning Hierarchical Geometry From Points, Edges, and SurfacesPoster19 citations
  583. How Can Objects Help Action Recognition?Poster19 citations
  584. How To Prevent the Poor Performance Clients for Personalized Federated Learning?Poster19 citations
  585. IPCC-TP: Utilizing Incremental Pearson Correlation Coefficient for Joint Multi-Agent Trajectory PredictionPoster19 citations
  586. Language-Guided Audio-Visual Source Separation via Trimodal ConsistencyPoster19 citations
  587. Learning Visibility Field for Detailed 3D Human Reconstruction and RelightingPoster19 citations
  588. Leveraging Inter-Rater Agreement for Classification in the Presence of Noisy LabelsPoster19 citations
  589. Listening Human Behavior: 3D Human Pose Estimation With Acoustic SignalsPoster19 citations
  590. Looking Through the Glass: Neural Surface Reconstruction Against High Specular ReflectionsPoster19 citations
  591. MarginMatch: Improving Semi-Supervised Learning with Pseudo-MarginsHighlight19 citations
  592. Mask-Free OVIS: Open-Vocabulary Instance Segmentation Without Manual Mask AnnotationsPoster19 citations
  593. MeMaHand: Exploiting Mesh-Mano Interaction for Single Image Two-Hand ReconstructionPoster19 citations
  594. Mitigating Task Interference in Multi-Task Learning via Explicit Task Routing With Non-Learnable PrimitivesPoster19 citations
  595. MixPHM: Redundancy-Aware Parameter-Efficient Tuning for Low-Resource Visual Question AnsweringPoster19 citations
  596. Model Barrier: A Compact Un-Transferable Isolation Domain for Model Intellectual Property ProtectionPoster19 citations
  597. Model-Agnostic Gender Debiased Image CaptioningPoster19 citations
  598. Movies2Scenes: Using Movie Metadata To Learn Scene RepresentationPoster19 citations
  599. Multiclass Confidence and Localization Calibration for Object DetectionPoster19 citations
  600. NoisyTwins: Class-Consistent and Diverse Image Generation Through StyleGANsPoster19 citations
  601. OmniCity: Omnipotent City Understanding With Multi-Level and Multi-View ImagesPoster19 citations
  602. Optimal Proposal Learning for Deployable End-to-End Pedestrian DetectionPoster19 citations
  603. Out-of-Distributed Semantic Pruning for Robust Semi-Supervised LearningPoster19 citations
  604. PanoSwin: A Pano-Style Swin Transformer for Panorama UnderstandingPoster19 citations
  605. Pose-Disentangled Contrastive Learning for Self-Supervised Facial RepresentationPoster19 citations
  606. Probability-Based Global Cross-Modal Upsampling for PansharpeningPoster19 citations
  607. Quantum-Inspired Spectral-Spatial Pyramid Network for Hyperspectral Image ClassificationPoster19 citations
  608. Real-Time Controllable Denoising for Image and VideoPoster19 citations
  609. SMAE: Few-Shot Learning for HDR Deghosting With Saturation-Aware Masked AutoencodersPoster19 citations
  610. Self-Correctable and Adaptable Inference for Generalizable Human Pose EstimationPoster19 citations
  611. Semantic Scene Completion With Cleaner SelfPoster19 citations
  612. ShapeTalk: A Language Dataset and Framework for 3D Shape Edits and DeformationsPoster19 citations
  613. Solving Oscillation Problem in Post-Training Quantization Through a Theoretical PerspectivePoster19 citations
  614. Sparsifiner: Learning Sparse Instance-Dependent Attention for Efficient Vision TransformersPoster19 citations
  615. Task Difficulty Aware Parameter Allocation & Regularization for Lifelong LearningPoster19 citations
  616. TriVol: Point Cloud Rendering via Triple VolumesPoster19 citations
  617. Unite and Conquer: Plug & Play Multi-Modal Synthesis Using Diffusion ModelsPoster19 citations
  618. Unsupervised Domain Adaption With Pixel-Level Discriminator for Image-Aware Layout GenerationPoster19 citations
  619. VIVE3D: Viewpoint-Independent Video Editing Using 3D-Aware GANsPoster19 citations
  620. WildLight: In-the-Wild Inverse Rendering With a FlashlightPoster19 citations
  621. Affection: Learning Affective Explanations for Real-World Visual DataPoster18 citations
  622. An Erudite Fine-Grained Visual Classification ModelPoster18 citations
  623. Are We Ready for Vision-Centric Driving Streaming Perception? The ASAP BenchmarkPoster18 citations
  624. AutoRecon: Automated 3D Object Discovery and ReconstructionHighlight18 citations
  625. Collaborative Static and Dynamic Vision-Language Streams for Spatio-Temporal Video GroundingPoster18 citations
  626. Consistent Direct Time-of-Flight Video Depth Super-ResolutionPoster18 citations
  627. DeGPR: Deep Guided Posterior Regularization for Multi-Class Cell Detection and CountingPoster18 citations
  628. Deep Arbitrary-Scale Image Super-Resolution via Scale-Equivariance PursuitPoster18 citations
  629. DeepMapping2: Self-Supervised Large-Scale LiDAR Map OptimizationPoster18 citations
  630. DyNCA: Real-Time Dynamic Texture Synthesis Using Neural Cellular AutomataPoster18 citations
  631. FAC: 3D Representation Learning via Foreground Aware Feature ContrastPoster18 citations
  632. Fantastic Breaks: A Dataset of Paired 3D Scans of Real-World Broken Objects and Their Complete CounterpartsPoster18 citations
  633. Few-Shot Learning With Visual Distribution Calibration and Cross-Modal Distribution AlignmentPoster18 citations
  634. Image Quality-Aware Diagnosis via Meta-Knowledge Co-EmbeddingPoster18 citations
  635. Knowledge Distillation for 6D Pose Estimation by Aligning Distributions of Local PredictionsPoster18 citations
  636. Learning To Name Classes for Vision and Language ModelsPoster18 citations
  637. Lift3D: Synthesize 3D Training Data by Lifting 2D GAN to 3D Generative Radiance FieldPoster18 citations
  638. MMVC: Learned Multi-Mode Video Compression With Block-Based Prediction Mode Selection and Density-Adaptive Entropy CodingPoster18 citations
  639. Multi-View Stereo Representation Revist: Region-Aware MVSNetPoster18 citations
  640. Normalizing Flow Based Feature Synthesis for Outlier-Aware Object DetectionHighlight18 citations
  641. Open-Set Semantic Segmentation for Point Clouds via Adversarial Prototype FrameworkPoster18 citations
  642. PanelNet: Understanding 360 Indoor Environment via Panel RepresentationPoster18 citations
  643. Phone2Proc: Bringing Robust Robots Into Our Chaotic WorldPoster18 citations
  644. PointCMP: Contrastive Mask Prediction for Self-Supervised Learning on Point Cloud VideosPoster18 citations
  645. PoseExaminer: Automated Testing of Out-of-Distribution Robustness in Human Pose and Shape EstimationPoster18 citations
  646. Progressive Spatio-Temporal Alignment for Efficient Event-Based Motion EstimationPoster18 citations
  647. SAP-DETR: Bridging the Gap Between Salient Points and Queries-Based Transformer Detector for Fast Model ConvergencyPoster18 citations
  648. Semi-Supervised Video Inpainting With Cycle Consistency ConstraintsPoster18 citations
  649. Shepherding Slots to Objects: Towards Stable and Robust Object-Centric LearningPoster18 citations
  650. Streaming Video ModelPoster18 citations
  651. SuperDisco: Super-Class Discovery Improves Visual Recognition for the Long-TailPoster18 citations
  652. Symmetric Shape-Preserving Autoencoder for Unsupervised Real Scene Point Cloud CompletionPoster18 citations
  653. The Dialog Must Go On: Improving Visual Dialog via Generative Self-TrainingPoster18 citations
  654. The Resource Problem of Using Linear Layer Leakage Attack in Federated LearningPoster18 citations
  655. TopNet: Transformer-Based Object Placement Network for Image CompositingPoster18 citations
  656. Training Debiased Subnetworks With Contrastive Weight PruningPoster18 citations
  657. Transformer-Based Unified Recognition of Two Hands Manipulating ObjectsPoster18 citations
  658. Uncertainty-Aware Unsupervised Image Deblurring With Deep Residual PriorPoster18 citations
  659. VDN-NeRF: Resolving Shape-Radiance Ambiguity via View-Dependence NormalizationPoster18 citations
  660. Visual Recognition by RequestPoster18 citations
  661. 3D Human Keypoints Estimation From Point Clouds in the Wild Without Human LabelsPoster17 citations
  662. A Rotation-Translation-Decoupled Solution for Robust and Efficient Visual-Inertial InitializationPoster17 citations
  663. ANetQA: A Large-Scale Benchmark for Fine-Grained Compositional Reasoning Over Untrimmed VideosPoster17 citations
  664. AnyFlow: Arbitrary Scale Optical Flow With Implicit Neural RepresentationHighlight17 citations
  665. Bilateral Memory Consolidation for Continual LearningPoster17 citations
  666. CLOTH4D: A Dataset for Clothed Human ReconstructionPoster17 citations
  667. Common Pets in 3D: Dynamic New-View Synthesis of Real-Life Deformable CategoriesHighlight17 citations
  668. CrOC: Cross-View Online Clustering for Dense Visual Representation LearningPoster17 citations
  669. DETR With Additional Global Aggregation for Cross-Domain Weakly Supervised Object DetectionPoster17 citations
  670. Deep Factorized Metric LearningPoster17 citations
  671. Distilling Focal Knowledge From Imperfect Expert for 3D Object DetectionPoster17 citations
  672. Diverse 3D Hand Gesture Prediction From Body Dynamics by Bilateral Hand DisentanglementPoster17 citations
  673. Domain Expansion of Image GeneratorsPoster17 citations
  674. EC2: Emergent Communication for Embodied ControlPoster17 citations
  675. EXCALIBUR: Encouraging and Evaluating Embodied ExplorationPoster17 citations
  676. Efficient Mask Correction for Click-Based Interactive Image SegmentationPoster17 citations
  677. Equivalent Transformation and Dual Stream Network Construction for Mobile Image Super-ResolutionPoster17 citations
  678. Event-Based Blurry Frame Interpolation Under Blind ExposurePoster17 citations
  679. Event-Guided Person Re-Identification via Sparse-Dense Complementary LearningPoster17 citations
  680. Feature Aggregated Queries for Transformer-Based Video Object DetectorsPoster17 citations
  681. GIVL: Improving Geographical Inclusivity of Vision-Language Models With Pre-Training MethodsPoster17 citations
  682. GLeaD: Improving GANs With a Generator-Leading TaskPoster17 citations
  683. Generalist: Decoupling Natural and Robust GeneralizationHighlight17 citations
  684. Handy: Towards a High Fidelity 3D Hand Shape and Appearance ModelPoster17 citations
  685. Hierarchical Discriminative Learning Improves Visual Representations of Biomedical MicroscopyHighlight17 citations
  686. High-Res Facial Appearance Capture From Polarized Smartphone ImagesPoster17 citations
  687. Implicit 3D Human Mesh Recovery Using Consistency With Pose and Shape From Unseen-ViewPoster17 citations
  688. Improving Generalization of Meta-Learning With Inverted Regularization at Inner-LevelPoster17 citations
  689. Knowledge Combination To Learn Rotated Detection Without Rotated AnnotationPoster17 citations
  690. MOT: Masked Optimal Transport for Partial Domain AdaptationPoster17 citations
  691. NeuFace: Realistic 3D Neural Face Rendering From Multi-View ImagesPoster17 citations
  692. Non-Line-of-Sight Imaging With Signal Superresolution NetworkPoster17 citations
  693. Octree Guided Unoriented Surface ReconstructionPoster17 citations
  694. Promoting Semantic Connectivity: Dual Nearest Neighbors Contrastive Learning for Unsupervised Domain GeneralizationPoster17 citations
  695. Recurrence Without Recurrence: Stable Video Landmark Detection With Deep Equilibrium ModelsPoster17 citations
  696. RefTeacher: A Strong Baseline for Semi-Supervised Referring Expression ComprehensionPoster17 citations
  697. RelightableHands: Efficient Neural Relighting of Articulated Hand ModelsPoster17 citations
  698. Rethinking Few-Shot Medical Segmentation: A Vector Quantization ViewPoster17 citations
  699. Rethinking the Approximation Error in 3D Surface Fitting for Point Cloud Normal EstimationPoster17 citations
  700. Revisiting Rotation Averaging: Uncertainties and Robust LossesPoster17 citations
  701. Robot Structure Prior Guided Temporal Attention for Camera-to-Robot Pose Estimation From Image SequencePoster17 citations
  702. SE-ORNet: Self-Ensembling Orientation-Aware Network for Unsupervised Point Cloud Shape CorrespondencePoster17 citations
  703. ScarceNet: Animal Pose Estimation With Scarce AnnotationsPoster17 citations
  704. SegLoc: Learning Segmentation-Based Representations for Privacy-Preserving Visual LocalizationPoster17 citations
  705. Semantic Human Parsing via Scalable Semantic Transfer Over Multiple Label DomainsPoster17 citations
  706. Stimulus Verification Is a Universal and Effective Sampler in Multi-Modal Human Trajectory PredictionPoster17 citations
  707. Therbligs in Action: Video Understanding Through Motion PrimitivesPoster17 citations
  708. Towards Practical Plug-and-Play Diffusion ModelsPoster17 citations
  709. Tracking Through Containers and Occluders in the WildPoster17 citations
  710. Trap Attention: Monocular Depth Estimation With Manual TrapsPoster17 citations
  711. Unbalanced Optimal Transport: A Unified Framework for Object DetectionPoster17 citations
  712. Unsupervised 3D Point Cloud Representation Learning by Triangle Constrained Contrast for Autonomous DrivingPoster17 citations
  713. Unsupervised Continual Semantic Adaptation Through Neural RenderingPoster17 citations
  714. Visual Dependency Transformers: Dependency Tree Emerges From Reversed AttentionPoster17 citations
  715. Weakly Supervised Video Representation Learning With Unaligned Text for Sequential VideosPoster17 citations
  716. An Actor-Centric Causality Graph for Asynchronous Temporal Inference in Group ActivityPoster16 citations
  717. Asymmetric Feature Fusion for Image RetrievalPoster16 citations
  718. Blowing in the Wind: CycleNet for Human Cinemagraphs From Still ImagesPoster16 citations
  719. Breaching FedMD: Image Recovery via Paired-Logits Inversion AttackPoster16 citations
  720. Complete 3D Human Reconstruction From a Single Incomplete ImagePoster16 citations
  721. CoralStyleCLIP: Co-Optimized Region and Layer Selection for Image EditingPoster16 citations
  722. Correlational Image Modeling for Self-Supervised Visual Pre-TrainingPoster16 citations
  723. DANI-Net: Uncalibrated Photometric Stereo by Differentiable Shadow Handling, Anisotropic Reflectance Modeling, and Neural Inverse RenderingPoster16 citations
  724. Differentiable Architecture Search With Random FeaturesPoster16 citations
  725. DisCo-CLIP: A Distributed Contrastive Loss for Memory Efficient CLIP TrainingHighlight16 citations
  726. Disentangling Orthogonal Planes for Indoor Panoramic Room Layout Estimation With Cross-Scale Distortion AwarenessPoster16 citations
  727. Document Image Shadow Removal Guided by Color-Aware BackgroundPoster16 citations
  728. Effective Ambiguity Attack Against Passport-Based DNN Intellectual Property Protection Schemes Through Fully Connected Layer SubstitutionPoster16 citations
  729. Efficient Semantic Segmentation by Altering Resolutions for Compressed VideosPoster16 citations
  730. Egocentric Video Task TranslationHighlight16 citations
  731. Enhanced Multimodal Representation Learning With Cross-Modal KDPoster16 citations
  732. Genie: Show Me the Data for QuantizationPoster16 citations
  733. Gradient-Based Uncertainty Attribution for Explainable Bayesian Deep LearningPoster16 citations
  734. Hybrid Active Learning via Deep Clustering for Video Action DetectionPoster16 citations
  735. IMP: Iterative Matching and Pose Estimation With Adaptive PoolingPoster16 citations
  736. Indescribable Multi-Modal Spatial EvaluatorPoster16 citations
  737. Instant Domain Augmentation for LiDAR Semantic SegmentationPoster16 citations
  738. Is BERT Blind? Exploring the Effect of Vision-and-Language Pretraining on Visual Language UnderstandingPoster16 citations
  739. Learning a Practical SDR-to-HDRTV Up-Conversion Using New Dataset and Degradation ModelsPoster16 citations
  740. Logical Consistency and Greater Descriptive Power for Facial Hair Attribute LearningPoster16 citations
  741. Long-Term Visual Localization With Mobile SensorsPoster16 citations
  742. MAESTER: Masked Autoencoder Guided Segmentation at Pixel Resolution for Accurate, Self-Supervised Subcellular Structure RecognitionHighlight16 citations
  743. MEGANE: Morphable Eyeglass and Avatar NetworkPoster16 citations
  744. Mask3D: Pre-Training 2D Vision Transformers by Learning Masked 3D PriorsPoster16 citations
  745. NIFF: Alleviating Forgetting in Generalized Few-Shot Object Detection via Neural Instance Feature ForgingPoster16 citations
  746. NeuWigs: A Neural Dynamic Model for Volumetric Hair Capture and AnimationPoster16 citations
  747. Neural Congealing: Aligning Images to a Joint Semantic AtlasPoster16 citations
  748. Neuralizer: General Neuroimage Analysis Without Re-TrainingPoster16 citations
  749. On the Pitfall of Mixup for Uncertainty CalibrationPoster16 citations
  750. On-the-Fly Category DiscoveryPoster16 citations
  751. SGLoc: Scene Geometry Encoding for Outdoor LiDAR LocalizationPoster16 citations
  752. Self-Supervised Blind Motion Deblurring With Deep Expectation MaximizationPoster16 citations
  753. SinGRAF: Learning a 3D Generative Radiance Field for a Single ScenePoster16 citations
  754. TINC: Tree-Structured Implicit Neural CompressionPoster16 citations
  755. Towards Flexible Multi-Modal Document ModelsHighlight16 citations
  756. Towards Unbiased Volume Rendering of Neural Implicit Surfaces With Geometry PriorsPoster16 citations
  757. Transforming Radiance Field With Lipschitz Network for Photorealistic 3D Scene StylizationHighlight16 citations
  758. VectorFloorSeg: Two-Stream Graph Attention Network for Vectorized Roughcast Floorplan SegmentationHighlight16 citations
  759. Zero-Shot Dual-Lens Super-ResolutionPoster16 citations
  760. AVFormer: Injecting Vision Into Frozen Speech Models for Zero-Shot AV-ASRPoster15 citations
  761. Accidental Light ProbesPoster15 citations
  762. Adversarially Masking Synthetic To Mimic Real: Adaptive Noise Injection for Point Cloud Segmentation AdaptationPoster15 citations
  763. BKinD-3D: Self-Supervised 3D Keypoint Discovery From Multi-View VideosPoster15 citations
  764. Bootstrapping Objectness From Videos by Relaxed Common Fate and Visual GroupingPoster15 citations
  765. CCuantuMM: Cycle-Consistent Quantum-Hybrid Matching of Multiple ShapesPoster15 citations
  766. Complexity-Guided Slimmable Decoder for Efficient Deep Video CompressionPoster15 citations
  767. Cross-Domain 3D Hand Pose Estimation With Dual ModalitiesPoster15 citations
  768. DSFNet: Dual Space Fusion Network for Occlusion-Robust 3D Dense Face AlignmentPoster15 citations
  769. DeCo: Decomposition and Reconstruction for Compositional Temporal Grounding via Coarse-To-Fine Contrastive RankingPoster15 citations
  770. Delving Into Discrete Normalizing Flows on SO(3) Manifold for Probabilistic Rotation ModelingPoster15 citations
  771. EXIF As Language: Learning Cross-Modal Associations Between Images and Camera MetadataHighlight15 citations
  772. Foundation Model Drives Weakly Incremental Learning for Semantic SegmentationPoster15 citations
  773. Frame Interpolation Transformer and Uncertainty GuidancePoster15 citations
  774. Fully Self-Supervised Depth Estimation From Defocus CluePoster15 citations
  775. GarmentTracking: Category-Level Garment Pose TrackingPoster15 citations
  776. GeoNet: Benchmarking Unsupervised Adaptation Across GeographiesPoster15 citations
  777. Guided Recommendation for Model Fine-TuningPoster15 citations
  778. Hybrid Neural Rendering for Large-Scale Scenes With Motion BlurPoster15 citations
  779. JAWS: Just a Wild Shot for Cinematic Transfer in Neural Radiance FieldsPoster15 citations
  780. LANIT: Language-Driven Image-to-Image Translation for Unlabeled DataPoster15 citations
  781. Learning Partial Correlation Based Deep Visual Representation for Image ClassificationPoster15 citations
  782. Learning a Depth Covariance FunctionPoster15 citations
  783. Mask-Guided Matting in the WildPoster15 citations
  784. MaskCon: Masked Contrastive Learning for Coarse-Labelled DatasetPoster15 citations
  785. MetaMix: Towards Corruption-Robust Continual Learning With Temporally Self-Adaptive Data TransformationPoster15 citations
  786. MetaViewer: Towards a Unified Multi-View RepresentationPoster15 citations
  787. MoDAR: Using Motion Forecasting for 3D Object Detection in Point Cloud SequencesPoster15 citations
  788. Modeling Entities As Semantic Points for Visual Information Extraction in the WildPoster15 citations
  789. Modernizing Old Photos Using Multiple References via Photorealistic Style TransferPoster15 citations
  790. Neural Intrinsic Embedding for Non-Rigid Point Cloud MatchingPoster15 citations
  791. Neural Rate Estimator and Unsupervised Learning for Efficient Distributed Image Analytics in Split-DNN ModelsPoster15 citations
  792. Normal-Guided Garment UV Prediction for Human Re-TexturingHighlight15 citations
  793. OSAN: A One-Stage Alignment Network To Unify Multimodal Alignment and Unsupervised Domain AdaptationPoster15 citations
  794. Prefix Conditioning Unifies Language and Label SupervisionPoster15 citations
  795. Preserving Linear Separability in Continual Learning by Backward Feature ProjectionPoster15 citations
  796. ProTeGe: Untrimmed Pretraining for Video Temporal Grounding by Video Temporal GroundingPoster15 citations
  797. Probabilistic Knowledge Distillation of Face EnsemblesPoster15 citations
  798. Progressive Backdoor Erasing via Connecting Backdoor and Adversarial AttacksPoster15 citations
  799. Reconstructing Signing Avatars From Video Using Linguistic PriorsPoster15 citations
  800. Rethinking Image Super Resolution From Long-Tailed Distribution Learning PerspectivePoster15 citations
  801. Robust and Scalable Gaussian Process Regression and Its ApplicationsPoster15 citations
  802. Text2Scene: Text-Driven Indoor Scene Stylization With Part-Aware DetailsHighlight15 citations
  803. Topology-Guided Multi-Class Cell Context Generation for Digital PathologyPoster15 citations
  804. Towards Building Self-Aware Object Detectors via Reliable Uncertainty Quantification and CalibrationPoster15 citations
  805. Unsupervised Cumulative Domain Adaptation for Foggy Scene Optical FlowPoster15 citations
  806. 3D Spatial Multimodal Knowledge Accumulation for Scene Graph Prediction in Point CloudPoster14 citations
  807. Adversarial Robustness via Random Projection FiltersPoster14 citations
  808. An Image Quality Assessment Dataset for PortraitsPoster14 citations
  809. Architecture, Dataset and Model-Scale Agnostic Data-Free Meta-LearningPoster14 citations
  810. Are Data-Driven Explanations Robust Against Out-of-Distribution Data?Poster14 citations
  811. AutoFocusFormer: Image Segmentation off the GridPoster14 citations
  812. Azimuth Super-Resolution for FMCW Radar in Autonomous DrivingPoster14 citations
  813. Bias in Pruned Vision Models: In-Depth Analysis and CountermeasuresPoster14 citations
  814. Binarizing Sparse Convolutional Networks for Efficient Point Cloud AnalysisPoster14 citations
  815. Continuous Intermediate Token Learning With Implicit Motion Manifold for Keyframe Based Motion InterpolationPoster14 citations
  816. Coreset Sampling From Open-Set for Fine-Grained Self-Supervised LearningPoster14 citations
  817. Cross-Guided Optimization of Radiance Fields With Multi-View Image Super-Resolution for High-Resolution Novel View SynthesisPoster14 citations
  818. DAA: A Delta Age AdaIN Operation for Age Estimation via Binary Code TransformerPoster14 citations
  819. DKT: Diverse Knowledge Transfer Transformer for Class Incremental LearningPoster14 citations
  820. DeFeeNet: Consecutive 3D Human Motion Prediction With Deviation FeedbackPoster14 citations
  821. Discriminator-Cooperated Feature Map Distillation for GAN CompressionPoster14 citations
  822. Flexible-Cm GAN: Towards Precise 3D Dose Prediction in RadiotherapyPoster14 citations
  823. Gated Multi-Resolution Transfer Network for Burst Restoration and EnhancementPoster14 citations
  824. How You Feelin'? Learning Emotions and Mental States in Movie ScenesPoster14 citations
  825. Humans As Light Bulbs: 3D Human Reconstruction From Thermal ReflectionPoster14 citations
  826. Inverting the Imaging Process by Learning an Implicit Camera ModelPoster14 citations
  827. Joint Appearance and Motion Learning for Efficient Rolling Shutter CorrectionPoster14 citations
  828. Joint Video Multi-Frame Interpolation and Deblurring Under Unknown Exposure TimePoster14 citations
  829. Large-Scale Training Data Search for Object Re-IdentificationPoster14 citations
  830. Learning From Unique Perspectives: User-Aware Saliency ModelingPoster14 citations
  831. Learning Human Mesh Recovery in 3D ScenesPoster14 citations
  832. LightPainter: Interactive Portrait Relighting With Freehand ScribblePoster14 citations
  833. MDL-NAS: A Joint Multi-Domain Learning Framework for Vision TransformerPoster14 citations
  834. Marching-Primitives: Shape Abstraction From Signed Distance FunctionHighlight14 citations
  835. Masked Autoencoding Does Not Help Natural Language Supervision at ScalePoster14 citations
  836. MobileBrick: Building LEGO for 3D Reconstruction on Mobile DevicesPoster14 citations
  837. Neural Lens ModelingPoster14 citations
  838. Object Detection With Self-Supervised Scene AdaptationPoster14 citations
  839. PA&DA: Jointly Sampling Path and Data for Consistent NASPoster14 citations
  840. POEM: Reconstructing Hand in a Point Embedded Multi-View StereoPoster14 citations
  841. Parts2Words: Learning Joint Embedding of Point Clouds and Texts by Bidirectional Matching Between Parts and WordsPoster14 citations
  842. PointClustering: Unsupervised Point Cloud Pre-Training Using Transformation Invariance in ClusteringHighlight14 citations
  843. Principles of Forgetting in Domain-Incremental Semantic Segmentation in Adverse Weather ConditionsPoster14 citations
  844. RGB No More: Minimally-Decoded JPEG Vision TransformersPoster14 citations
  845. Recovering 3D Hand Mesh Sequence From a Single Blurry Image: A New Dataset and Temporal UnfoldingPoster14 citations
  846. Regularization of Polynomial Networks for Image RecognitionPoster14 citations
  847. Relational Space-Time Query in Long-Form VideosHighlight14 citations
  848. SCoDA: Domain Adaptive Shape Completion for Real ScansPoster14 citations
  849. STDLens: Model Hijacking-Resilient Federated Learning for Object DetectionPoster14 citations
  850. Seeing Through the Glass: Neural 3D Reconstruction of Object Inside a Transparent ContainerPoster14 citations
  851. TOPLight: Lightweight Neural Networks With Task-Oriented Pretraining for Visible-Infrared RecognitionPoster14 citations
  852. Target-Referenced Reactive Grasping for Dynamic ObjectsPoster14 citations
  853. The Wisdom of Crowds: Temporal Progressive Attention for Early Action PredictionPoster14 citations
  854. Towards Bridging the Performance Gaps of Joint Energy-Based ModelsPoster14 citations
  855. Tracking Multiple Deformable Objects in Egocentric VideosPoster14 citations
  856. ViLEM: Visual-Language Error Modeling for Image-Text RetrievalPoster14 citations
  857. VisFusion: Visibility-Aware Online 3D Scene Reconstruction From VideosPoster14 citations
  858. (ML)$^2$P-Encoder: On Exploration of Channel-Class Correlation for Multi-Label Zero-Shot LearningPoster13 citations
  859. 3D Video Object Detection With Learnable Object-Centric Global OptimizationPoster13 citations
  860. Abstract Visual Reasoning: An Algebraic Approach for Solving Raven's Progressive MatricesPoster13 citations
  861. Accelerating Vision-Language Pretraining With Free Language ModelingPoster13 citations
  862. AdaptiveMix: Improving GAN Training via Feature Space ShrinkagePoster13 citations
  863. Building Rearticulable Models for Arbitrary 3D Objects From 4D Point CloudsPoster13 citations
  864. Conjugate Product Graphs for Globally Optimal 2D-3D Shape MatchingPoster13 citations
  865. Crowd3D: Towards Hundreds of People Reconstruction From a Single ImagePoster13 citations
  866. Curricular Object Manipulation in LiDAR-Based Object DetectionPoster13 citations
  867. DC2: Dual-Camera Defocus Control by Learning To RefocusPoster13 citations
  868. DartBlur: Privacy Preservation With Detection Artifact SuppressionPoster13 citations
  869. Deep Learning of Partial Graph Matching via Differentiable Top-KPoster13 citations
  870. Deep Stereo Video InpaintingPoster13 citations
  871. Distilling Neural Fields for Real-Time Articulated Shape ReconstructionPoster13 citations
  872. Enhancing Deformable Local Features by Jointly Learning To Detect and Describe KeypointsPoster13 citations
  873. Few-Shot Geometry-Aware Keypoint LocalizationPoster13 citations
  874. Frequency-Modulated Point Cloud Rendering With Easy EditingHighlight13 citations
  875. HOTNAS: Hierarchical Optimal Transport for Neural Architecture SearchPoster13 citations
  876. Integral Neural NetworksPoster13 citations
  877. JacobiNeRF: NeRF Shaping With Mutual Information GradientsPoster13 citations
  878. LP-DIF: Learning Local Pattern-Specific Deep Implicit Function for 3D Objects and ScenesPoster13 citations
  879. Learning Anchor Transformations for 3D Garment AnimationPoster13 citations
  880. Learning Instance-Level Representation for Large-Scale Multi-Modal Pretraining in E-CommercePoster13 citations
  881. MAGVLT: Masked Generative Vision-and-Language TransformerPoster13 citations
  882. Meta-Personalizing Vision-Language Models To Find Named Instances in VideoPoster13 citations
  883. NeRFVS: Neural Radiance Fields for Free View Synthesis via Geometry ScaffoldsPoster13 citations
  884. OmniVidar: Omnidirectional Depth Estimation From Multi-Fisheye ImagesPoster13 citations
  885. On the Importance of Accurate Geometry Data for Dense 3D Vision TasksPoster13 citations
  886. PlenVDB: Memory Efficient VDB-Based Radiance Fields for Fast Training and RenderingPoster13 citations
  887. Policy Adaptation From Foundation Model FeedbackPoster13 citations
  888. Post-Processing Temporal Action DetectionPoster13 citations
  889. Quantum Multi-Model FittingHighlight13 citations
  890. Seeing What You Miss: Vision-Language Pre-Training With Semantic Completion LearningPoster13 citations
  891. Self-Supervised Pre-Training With Masked Shape Prediction for 3D Scene UnderstandingPoster13 citations
  892. Simulated Annealing in Early Layers Leads to Better GeneralizationPoster13 citations
  893. Source-Free Video Domain Adaptation With Spatial-Temporal-Historical Consistency LearningPoster13 citations
  894. Test Time Adaptation With Regularized Loss for Weakly Supervised Salient Object DetectionPoster13 citations
  895. Unsupervised 3D Shape Reconstruction by Part Retrieval and AssemblyPoster13 citations
  896. ViewNet: A Novel Projection-Based Backbone With View Pooling for Few-Shot Point Cloud ClassificationPoster13 citations
  897. Visual DNA: Representing and Comparing Images Using Distributions of Neuron ActivationsPoster13 citations
  898. "Seeing" Electric Network Frequency From EventsPoster12 citations
  899. A Bag-of-Prototypes Representation for Dataset-Level ApplicationsPoster12 citations
  900. A Large-Scale Homography BenchmarkPoster12 citations
  901. ABLE-NeRF: Attention-Based Rendering With Learnable Embeddings for Neural Radiance FieldPoster12 citations
  902. Alias-Free Convnets: Fractional Shift Invariance via Polynomial ActivationsPoster12 citations
  903. AttentionShift: Iteratively Estimated Part-Based Attention Map for Pointly Supervised Instance SegmentationPoster12 citations
  904. Boundary-Aware Backward-Compatible Representation via Adversarial Learning in Image RetrievalPoster12 citations
  905. Co-Training 2L Submodels for Visual RecognitionPoster12 citations
  906. Compositor: Bottom-Up Clustering and Compositing for Robust Part and Object SegmentationPoster12 citations
  907. Continuous Landmark Detection With 3D QueriesPoster12 citations
  908. Controllable Light Diffusion for PortraitsPoster12 citations
  909. Critical Learning Periods for Multisensory Integration in Deep NetworksHighlight12 citations
  910. FlowGrad: Controlling the Output of Generative ODEs With GradientsPoster12 citations
  911. GANmouflage: 3D Object Nondetection With Texture FieldsPoster12 citations
  912. Image Cropping With Spatial-Aware Feature and Rank ConsistencyPoster12 citations
  913. Implicit Neural Head Synthesis via Controllable Local Deformation FieldsPoster12 citations
  914. Improving Generalization With Domain Convex GamePoster12 citations
  915. K3DN: Disparity-Aware Kernel Estimation for Dual-Pixel Defocus DeblurringPoster12 citations
  916. Label Information Bottleneck for Label EnhancementPoster12 citations
  917. Learning Accurate 3D Shape Based on Stereo Polarimetric ImagingPoster12 citations
  918. Learning Adaptive Dense Event Stereo From the Image DomainPoster12 citations
  919. Learning Attribute and Class-Specific Representation Duet for Fine-Grained Fashion AnalysisPoster12 citations
  920. Learning Detailed Radiance Manifolds for High-Fidelity and 3D-Consistent Portrait Synthesis From Monocular ImagePoster12 citations
  921. Learning To Segment Every Referring Object Point by PointPoster12 citations
  922. Learning a Deep Color Difference Metric for Photographic ImagesPoster12 citations
  923. Logical Implications for Visual Question Answering ConsistencyPoster12 citations
  924. MDQE: Mining Discriminative Query Embeddings To Segment Occluded Instances on Challenging VideosPoster12 citations
  925. MM-3DScene: 3D Scene Understanding by Customizing Masked Modeling With Informative-Preserved Reconstruction and Self-Distilled ConsistencyPoster12 citations
  926. Multi-Sensor Large-Scale Dataset for Multi-View 3D ReconstructionPoster12 citations
  927. Plateau-Reduced Differentiable Path TracingPoster12 citations
  928. Progressive Transformation Learning for Leveraging Virtual Images in TrainingHighlight12 citations
  929. RIAV-MVS: Recurrent-Indexing an Asymmetric Volume for Multi-View StereoPoster12 citations
  930. Real-Time Multi-Person Eyeblink Detection in the Wild for Untrimmed VideoPoster12 citations
  931. SIEDOB: Semantic Image Editing by Disentangling Object and BackgroundHighlight12 citations
  932. SMOC-Net: Leveraging Camera Pose for Self-Supervised Monocular Object Pose EstimationHighlight12 citations
  933. Search-Map-Search: A Frame Selection Paradigm for Action RecognitionPoster12 citations
  934. Siamese DETRPoster12 citations
  935. Simultaneously Short- and Long-Term Temporal Modeling for Semi-Supervised Video Semantic SegmentationPoster12 citations
  936. StyleIPSB: Identity-Preserving Semantic Basis of StyleGAN for High Fidelity Face SwappingPoster12 citations
  937. Toward Stable, Interpretable, and Lightweight Hyperspectral Super-ResolutionPoster12 citations
  938. Weakly-Supervised Single-View Image RelightingPoster12 citations
  939. AShapeFormer: Semantics-Guided Object-Level Active Shape Encoding for 3D Object Detection via TransformersPoster11 citations
  940. Adapting Shortcut With Normalizing Flow: An Efficient Tuning Framework for Visual RecognitionPoster11 citations
  941. B-Spline Texture Coefficients Estimator for Screen Content Image Super-ResolutionHighlight11 citations
  942. Bi-Directional Feature Fusion Generative Adversarial Network for Ultra-High Resolution Pathological Image Virtual Re-StainingPoster11 citations
  943. Bitstream-Corrupted JPEG Images Are Restorable: Two-Stage Compensation and Alignment Framework for Image RestorationPoster11 citations
  944. Boosting Verified Training for Robust Image Classifications via AbstractionPoster11 citations
  945. CABM: Content-Aware Bit Mapping for Single Image Super-Resolution Network With Large InputPoster11 citations
  946. CUF: Continuous Upsampling FiltersPoster11 citations
  947. CaPriDe Learning: Confidential and Private Decentralized Learning Based on Encryption-Friendly Distillation LossPoster11 citations
  948. Clothed Human Performance Capture With a Double-Layer Neural Radiance FieldsPoster11 citations
  949. Command-Driven Articulated Object Understanding and ManipulationPoster11 citations
  950. Context-Aware Relative Object Queries To Unify Video Instance and Panoptic SegmentationPoster11 citations
  951. Deep Polarization Reconstruction With PDAVIS EventsPoster11 citations
  952. Discriminating Known From Unknown Objects via Structure-Enhanced Recurrent Variational AutoEncoderPoster11 citations
  953. DistractFlow: Improving Optical Flow Estimation via Realistic Distractions and Pseudo-LabelingPoster11 citations
  954. EMT-NAS:Transferring Architectural Knowledge Between Tasks From Different DatasetsPoster11 citations
  955. End-to-End Video Matting With Trimap PropagationPoster11 citations
  956. Exploring Data Geometry for Continual LearningPoster11 citations
  957. Few-Shot Non-Line-of-Sight Imaging With Signal-Surface Collaborative RegularizationPoster11 citations
  958. Few-Shot Semantic Image Synthesis With Class Affinity TransferPoster11 citations
  959. Frame Flexible NetworkPoster11 citations
  960. GraVoS: Voxel Selection for 3D Point-Cloud DetectionPoster11 citations
  961. Grounding Counterfactual Explanation of Image Classifiers to Textual Concept SpacePoster11 citations
  962. Heterogeneous Continual LearningHighlight11 citations
  963. Hyperspherical Embedding for Point Cloud CompletionPoster11 citations
  964. Learning Correspondence Uncertainty via Differentiable Nonlinear Least SquaresPoster11 citations
  965. Learning Joint Latent Space EBM Prior Model for Multi-Layer GeneratorPoster11 citations
  966. Learning Steerable Function for Efficient Image ResamplingPoster11 citations
  967. Learning Transformation-Predictive Representations for Detection and Description of Local FeaturesPoster11 citations
  968. LightedDepth: Video Depth Estimation in Light of Limited Inference View AnglesPoster11 citations
  969. Modular Memorability: Tiered Representations for Video Memorability PredictionPoster11 citations
  970. Multi-Object Manipulation via Object-Centric Neural Scattering FunctionsPoster11 citations
  971. Multiplicative Fourier Level of DetailHighlight11 citations
  972. Network Expansion for Practical Training AccelerationPoster11 citations
  973. Neural Texture Synthesis With Guided CorrespondencePoster11 citations
  974. Neural Transformation Fields for Arbitrary-Styled Font GenerationPoster11 citations
  975. NewsNet: A Novel Dataset for Hierarchical Temporal SegmentationPoster11 citations
  976. PointCert: Point Cloud Classification With Deterministic Certified Robustness GuaranteesPoster11 citations
  977. Regularize Implicit Neural Representation by ItselfHighlight11 citations
  978. Seeing a Rose in Five Thousand WaysPoster11 citations
  979. Self-Supervised Super-Plane for Neural 3D ReconstructionPoster11 citations
  980. Semi-Weakly Supervised Object Kinematic Motion PredictionPoster11 citations
  981. Shakes on a Plane: Unsupervised Depth Estimation From Unstabilized PhotographyPoster11 citations
  982. Similarity Maps for Self-Training Weakly-Supervised Phrase GroundingPoster11 citations
  983. Similarity Metric Learning for RGB-Infrared Group Re-IdentificationPoster11 citations
  984. Single Image Backdoor Inversion via Robust Smoothed ClassifiersPoster11 citations
  985. SketchXAI: A First Look at Explainability for Human SketchesPoster11 citations
  986. TMO: Textured Mesh Acquisition of Objects With a Mobile Device by Using Differentiable RenderingPoster11 citations
  987. Tree Instance Segmentation With Temporal Contour GraphPoster11 citations
  988. Ultrahigh Resolution Image/Video Matting With Spatio-Temporal SparsityPoster11 citations
  989. Weakly Supervised Class-Agnostic Motion Prediction for Autonomous DrivingPoster11 citations
  990. Zero-Shot Pose Transfer for Unrigged Stylized 3D CharactersPoster11 citations
  991. A Meta-Learning Approach to Predicting Performance and Data RequirementsPoster10 citations
  992. Adaptive Global Decay Process for Event CamerasPoster10 citations
  993. Automatic High Resolution Wire Segmentation and RemovalPoster10 citations
  994. Beyond mAP: Towards Better Evaluation of Instance SegmentationHighlight10 citations
  995. CNVid-3.5M: Build, Filter, and Pre-Train the Large-Scale Public Chinese Video-Text DatasetPoster10 citations
  996. D2Former: Jointly Learning Hierarchical Detectors and Contextual Descriptors via Agent-Based TransformersHighlight10 citations
  997. DejaVu: Conditional Regenerative Learning To Enhance Dense PredictionPoster10 citations
  998. Equiangular Basis VectorsPoster10 citations
  999. EvShutter: Transforming Events for Unconstrained Rolling Shutter CorrectionPoster10 citations
  1000. Four-View Geometry With Unknown Radial DistortionPoster10 citations

Looking for submission deadlines instead? See the conference deadline calendar.