← All conferences

ICCV 2023 Accepted Papers

The full list of 2,156 papers accepted at ICCV 2023 (IEEE/CVF International Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Poster: 2,005Oral: 145
  1. LiDAR-Camera Panoptic Segmentation via Geometry-Consistent and Semantic-Aware AlignmentPoster21 citations
  2. MRM: Masked Relation Modeling for Medical Image Pre-Training with GeneticsPoster21 citations
  3. PhaseMP: Robust 3D Pose Estimation via Phase-conditioned Human Motion PriorPoster21 citations
  4. Point-TTA: Test-Time Adaptation for Point Cloud Registration Using Multitask Meta-Auxiliary LearningPoster21 citations
  5. Privacy-Preserving Face Recognition Using Random Frequency ComponentsPoster21 citations
  6. R-Pred: Two-Stage Motion Prediction Via Tube-Query Attention-Based Trajectory RefinementPoster21 citations
  7. Re-ReND: Real-Time Rendering of NeRFs across DevicesPoster21 citations
  8. ReNeRF: Relightable Neural Radiance Fields with Nearfield LightingPoster21 citations
  9. SCANet: Scene Complexity Aware Network for Weakly-Supervised Video Moment RetrievalPoster21 citations
  10. ScatterNeRF: Seeing Through Fog with Physically-Based Inverse Neural RenderingPoster21 citations
  11. Scenimefy: Learning to Craft Anime Scene via Semi-Supervised Image-to-Image TranslationPoster21 citations
  12. Search for or Navigate to? Dual Adaptive Thinking for Object NavigationPoster21 citations
  13. SegPrompt: Boosting Open-World Segmentation via Category-Level Prompt LearningPoster21 citations
  14. Semi-supervised Semantics-guided Adversarial Training for Robust Trajectory PredictionPoster21 citations
  15. Skill Transformer: A Monolithic Policy for Mobile ManipulationPoster21 citations
  16. Time Does Tell: Self-Supervised Time-Tuning of Dense Image RepresentationsPoster21 citations
  17. Unified Data-Free Compression: Pruning and Quantization without Fine-TuningPoster21 citations
  18. Video Adverse-Weather-Component Suppression Network via Weather Messenger and Adversarial BackpropagationPoster21 citations
  19. Vision Relation Transformer for Unbiased Scene Graph GenerationPoster21 citations
  20. Audio-Enhanced Text-to-Video Retrieval using Text-Conditioned Feature AlignmentOral20 citations
  21. Beyond Skin Tone: A Multidimensional Measure of Apparent Skin ColorPoster20 citations
  22. End-to-end 3D Tracking with Decoupled QueriesPoster20 citations
  23. Enhancing Modality-Agnostic Representations via Meta-Learning for Brain Tumor SegmentationPoster20 citations
  24. Event-Guided Procedure Planning from Instructional Videos with Text SupervisionPoster20 citations
  25. Generalized Lightness Adaptation with Channel Selective NormalizationPoster20 citations
  26. How to Boost Face Recognition with StyleGAN?Poster20 citations
  27. Hybrid Spectral Denoising Transformer with Guided AttentionPoster20 citations
  28. LFS-GAN: Lifelong Few-Shot Image GenerationPoster20 citations
  29. Learning Depth Estimation for Transparent and Mirror SurfacesPoster20 citations
  30. Learning Symmetry-Aware Geometry Correspondences for 6D Object Pose EstimationPoster20 citations
  31. Learning Unified Decompositional and Compositional NeRF for Editable Novel View SynthesisPoster20 citations
  32. Learning to Ground Instructional Articles in Videos through NarrationsPoster20 citations
  33. LexLIP: Lexicon-Bottlenecked Language-Image Pre-Training for Large-Scale Image-Text Sparse RetrievalPoster20 citations
  34. MAS: Towards Resource-Efficient Federated Multiple-Task LearningPoster20 citations
  35. MATE: Masked Autoencoders are Online 3D Test-Time LearnersPoster20 citations
  36. Multi-Frequency Representation Enhancement with Privilege Information for Video Super-ResolutionPoster20 citations
  37. Multi-Modal Continual Test-Time Adaptation for 3D Semantic SegmentationPoster20 citations
  38. Novel Scenes & Classes: Towards Adaptive Open-set Object DetectionOral20 citations
  39. PolicyCleanse: Backdoor Detection and Mitigation for Competitive Reinforcement LearningPoster20 citations
  40. Representation Uncertainty in Self-Supervised Learning as Variational InferencePoster20 citations
  41. Self-Evolved Dynamic Expansion Model for Task-Free Continual LearningPoster20 citations
  42. Self-supervised Image Denoising with Downsampled Invariance Loss and Conditional Blind-Spot NetworkPoster20 citations
  43. SimFIR: A Simple Framework for Fisheye Image Rectification with Self-supervised Representation LearningPoster20 citations
  44. Social Diffusion: Long-term Multiple Human Motion AnticipationPoster20 citations
  45. Total-Recon: Deformable Scene Reconstruction for Embodied View SynthesisPoster20 citations
  46. Adaptive Template Transformer for Mitochondria Segmentation in Electron Microscopy ImagesPoster19 citations
  47. Adversarial Bayesian Augmentation for Single-Source Domain GeneralizationPoster19 citations
  48. Black-Box Unsupervised Domain Adaptation with Bi-Directional Atkinson-Shiffrin MemoryPoster19 citations
  49. Boosting Novel Category Discovery Over Domains with Soft Contrastive Learning and All in One ClassifierOral19 citations
  50. Bootstrap Motion Forecasting With Self-Consistent ConstraintsPoster19 citations
  51. Boundary-Aware Divide and Conquer: A Diffusion-Based Solution for Unsupervised Shadow RemovalPoster19 citations
  52. DETR Does Not Need Multi-Scale or Locality DesignPoster19 citations
  53. DiffV2S: Diffusion-Based Video-to-Speech Synthesis with Vision-Guided Speaker EmbeddingPoster19 citations
  54. Distilling Coarse-to-Fine Semantic Matching Knowledge for Weakly Supervised 3D Visual GroundingPoster19 citations
  55. Doppelgangers: Learning to Disambiguate Images of Similar StructuresOral19 citations
  56. Dual Learning with Dynamic Knowledge Distillation for Partially Relevant Video RetrievalPoster19 citations
  57. Estimator Meets Equilibrium Perspective: A Rectified Straight Through Estimator for Binary Neural Networks TrainingPoster19 citations
  58. Exploring the Benefits of Visual Prompting in Differential PrivacyPoster19 citations
  59. Few Shot Font Generation Via Transferring Similarity Guided Global Style and Quantization Local StylePoster19 citations
  60. Generating Dynamic Kernels via Transformers for Lane DetectionPoster19 citations
  61. Hierarchical Point-based Active Learning for Semi-supervised Point Cloud Semantic SegmentationPoster19 citations
  62. HopFIR: Hop-wise GraphFormer with Intragroup Joint Refinement for 3D Human Pose EstimationPoster19 citations
  63. Improving CLIP Fine-tuning PerformancePoster19 citations
  64. JOTR: 3D Joint Contrastive Learning with Transformers for Occluded Human Mesh RecoveryPoster19 citations
  65. KECOR: Kernel Coding Rate Maximization for Active 3D Object DetectionPoster19 citations
  66. Learning Optical Flow from Event Camera with Rendered DatasetPoster19 citations
  67. LiveHand: Real-time and Photorealistic Neural Hand RenderingPoster19 citations
  68. MEFLUT: Unsupervised 1D Lookup Tables for Multi-exposure Image FusionPoster19 citations
  69. MixReorg: Cross-Modal Mixed Patch Reorganization is a Good Mask Learner for Open-World Semantic SegmentationPoster19 citations
  70. Multi-Label Self-Supervised Learning with Scene ImagesPoster19 citations
  71. Multi-Object Navigation with Dynamically Learned Neural Implicit RepresentationsPoster19 citations
  72. Neural Interactive Keypoint DetectionPoster19 citations
  73. Non-Coaxial Event-Guided Motion Deblurring with Spatial AlignmentPoster19 citations
  74. One-bit Flip is All You Need: When Bit-flip Attack Meets Model TrainingPoster19 citations
  75. PIDRo: Parallel Isomeric Attention with Dynamic Routing for Text-Video RetrievalPoster19 citations
  76. Pluralistic Aging Diffusion AutoencoderPoster19 citations
  77. RenderIH: A Large-Scale Synthetic Dataset for 3D Interacting Hand Pose EstimationPoster19 citations
  78. Rethinking the Role of Pre-Trained Networks in Source-Free Domain AdaptationPoster19 citations
  79. Revisiting Foreground and Background Separation in Weakly-supervised Temporal Action Localization: A Clustering-based ApproachPoster19 citations
  80. SILT: Shadow-Aware Iterative Label Tuning for Learning to Detect Shadows from Noisy LabelsPoster19 citations
  81. Scratch Each Other's Back: Incomplete Multi-Modal Brain Tumor Segmentation via Category Aware Group Self-Support LearningPoster19 citations
  82. Semantics Meets Temporal Correspondence: Self-supervised Object-centric Learning in VideosPoster19 citations
  83. Sparse Instance Conditioned Multimodal Trajectory PredictionPoster19 citations
  84. StyleInV: A Temporal Style Modulated Inversion Network for Unconditional Video GenerationPoster19 citations
  85. SupFusion: Supervised LiDAR-Camera Fusion for 3D Object DetectionPoster19 citations
  86. TCOVIS: Temporally Consistent Online Video Instance SegmentationPoster19 citations
  87. The Devil is in the Upsampling: Architectural Decisions Made Simpler for Denoising with Deep Image PriorPoster19 citations
  88. The Euclidean Space is Evil: Hyperbolic Attribute Editing for Few-shot Image GenerationPoster19 citations
  89. Uncertainty-aware State Space Transformer for Egocentric 3D Hand Trajectory ForecastingPoster19 citations
  90. VL-PET: Vision-and-Language Parameter-Efficient Tuning via Granularity ControlPoster19 citations
  91. VLN-PETL: Parameter-Efficient Transfer Learning for Vision-and-Language NavigationPoster19 citations
  92. Weakly-Supervised Action Segmentation and Unseen Error Detection in Anomalous Instructional VideosPoster19 citations
  93. Why Is Prompt Tuning for Vision-Language Models Robust to Noisy Labels?Poster19 citations
  94. zPROBE: Zero Peek Robustness Checks for Federated LearningPoster19 citations
  95. 2D3D-MATR: 2D-3D Matching Transformer for Detection-Free Registration Between Images and Point CloudsPoster18 citations
  96. 4D Panoptic Segmentation as Invariant and Equivariant Field PredictionPoster18 citations
  97. Active Self-Supervised Learning: A Few Low-Cost Relationships Are All You NeedPoster18 citations
  98. Agglomerative Transformer for Human-Object Interaction DetectionPoster18 citations
  99. CHAMPAGNE: Learning Real-world Conversation from Large-Scale Web VideosPoster18 citations
  100. Chop & Learn: Recognizing and Generating Object-State CompositionsPoster18 citations
  101. Communication-Efficient Vertical Federated Learning with Limited Overlapping SamplesPoster18 citations
  102. DDG-Net: Discriminability-Driven Graph Network for Weakly-supervised Temporal Action LocalizationPoster18 citations
  103. DQS3D: Densely-matched Quantization-aware Semi-supervised 3D DetectionPoster18 citations
  104. Domain Generalization via Balancing Training Difficulty and Model CapabilityPoster18 citations
  105. Explicit Motion Disentangling for Efficient Optical Flow EstimationPoster18 citations
  106. FDViT: Improve the Hierarchical Architecture of Vision TransformerPoster18 citations
  107. Human Part-wise 3D Motion Context Learning for Sign Language RecognitionPoster18 citations
  108. ICE-NeRF: Interactive Color Editing of NeRFs via Decomposition-Aware Weight OptimizationPoster18 citations
  109. Knowledge Restore and Transfer for Multi-Label Class-Incremental LearningPoster18 citations
  110. LIMITR: Leveraging Local Information for Medical Image-Text RepresentationPoster18 citations
  111. Label-Efficient Online Continual Object Detection in Streaming VideoPoster18 citations
  112. Learning Rain Location Prior for Nighttime DerainingPoster18 citations
  113. Lip Reading for Low-resource Languages by Learning and Combining General Speech Knowledge and Language-specific KnowledgePoster18 citations
  114. LoTE-Animal: A Long Time-span Dataset for Endangered Animal Behavior UnderstandingPoster18 citations
  115. Locally Stylized Neural Radiance FieldsPoster18 citations
  116. Manipulate by Seeing: Creating Manipulation Controllers from Pre-Trained RepresentationsOral18 citations
  117. Masked Spatio-Temporal Structure Prediction for Self-supervised Learning on Point Cloud VideosPoster18 citations
  118. Minimum Latency Deep Online Video StabilizationPoster18 citations
  119. Mitigating and Evaluating Static Bias of Action Representations in the Background and the ForegroundOral18 citations
  120. Rendering Humans from Object-Occluded Monocular VideosPoster18 citations
  121. S-VolSDF: Sparse Multi-View Stereo Regularization of Neural Implicit SurfacesPoster18 citations
  122. SOAR: Scene-debiasing Open-set Action RecognitionPoster18 citations
  123. Scanning Only Once: An End-to-end Framework for Fast Temporal Grounding in Long VideosPoster18 citations
  124. Seal-3D: Interactive Pixel-Level Editing for Neural Radiance FieldsPoster18 citations
  125. Sound Source Localization is All about Cross-Modal AlignmentPoster18 citations
  126. Space Engage: Collaborative Space Supervision for Contrastive-Based Semi-Supervised Semantic SegmentationPoster18 citations
  127. Spatial Self-Distillation for Object Detection with Inaccurate Bounding BoxesPoster18 citations
  128. Structural Alignment for Network Pruning through Partial RegularizationPoster18 citations
  129. Synchronize Feature Extracting and Matching: A Single Branch Framework for 3D Object TrackingPoster18 citations
  130. Towards High-Fidelity Text-Guided 3D Face Generation and Manipulation Using only ImagesPoster18 citations
  131. Towards Robust and Smooth 3D Multi-Person Pose Estimation from Monocular Videos in the WildPoster18 citations
  132. Towards Semi-supervised Learning with Non-random Missing LabelsPoster18 citations
  133. Towards Zero Domain Gap: A Comprehensive Study of Realistic LiDAR Simulation for Autonomy TestingPoster18 citations
  134. Uncertainty-guided Learning for Improving Image Manipulation DetectionPoster18 citations
  135. Unified Visual Relationship Detection with Vision and Language ModelsPoster18 citations
  136. When to Learn What: Model-Adaptive Data Augmentation CurriculumPoster18 citations
  137. Ada3D : Exploiting the Spatial Redundancy with Adaptive Inference for Efficient 3D Object DetectionPoster17 citations
  138. Automatic Network Pruning via Hilbert-Schmidt Independence Criterion Lasso under Information Bottleneck PrinciplePoster17 citations
  139. BEV-DG: Cross-Modal Learning under Bird's-Eye View for Domain Generalization of 3D Semantic SegmentationPoster17 citations
  140. Bidirectional Alignment for Domain Adaptive Detection with TransformersPoster17 citations
  141. C2ST: Cross-Modal Contextualized Sequence Transduction for Continuous Sign Language RecognitionPoster17 citations
  142. CLNeRF: Continual Learning Meets NeRFPoster17 citations
  143. ConSlide: Asynchronous Hierarchical Interaction Transformer with Breakup-Reorganize Rehearsal for Continual Whole Slide Image AnalysisPoster17 citations
  144. Constraining Depth Map Geometry for Multi-View Stereo: A Dual-Depth Approach with Saddle-shaped Depth CellsPoster17 citations
  145. Cumulative Spatial Knowledge Distillation for Vision TransformersPoster17 citations
  146. DARTH: Holistic Test-time Adaptation for Multiple Object TrackingPoster17 citations
  147. Deep Geometrized Cartoon Line InbetweeningPoster17 citations
  148. DiffCloth: Diffusion Based Garment Synthesis and Manipulation via Structural Cross-modal Semantic AlignmentPoster17 citations
  149. Distilled Reverse Attention Network for Open-world Compositional Zero-Shot LearningPoster17 citations
  150. Distilling DETR with Visual-Linguistic Knowledge for Open-Vocabulary Object DetectionPoster17 citations
  151. Distribution Shift Matters for Knowledge Distillation with Webly Collected ImagesPoster17 citations
  152. ETran: Energy-Based Transferability EstimationPoster17 citations
  153. Event-based Temporally Dense Optical Flow Estimation with Sequential LearningPoster17 citations
  154. FrozenRecon: Pose-free 3D Scene Reconstruction with Frozen Depth ModelsPoster17 citations
  155. GlobalMapper: Arbitrary-Shaped Urban Layout GenerationPoster17 citations
  156. GraphEcho: Graph-Driven Unsupervised Domain Adaptation for Echocardiogram Video SegmentationOral17 citations
  157. Hard No-Box Adversarial Attack on Skeleton-Based Human Action Recognition with Skeleton-Motion-Informed GradientPoster17 citations
  158. ImbSAM: A Closer Look at Sharpness-Aware Minimization in Class-Imbalanced RecognitionPoster17 citations
  159. Integrating Boxes and Masks: A Multi-Object Framework for Unified Visual Tracking and SegmentationPoster17 citations
  160. Is Imitation All You Need? Generalized Decision-Making with Dual-Phase TrainingPoster17 citations
  161. Label-Guided Knowledge Distillation for Continual Semantic Segmentation on 2D Images and 3D Point CloudsPoster17 citations
  162. Learning in Imperfect Environment: Multi-Label Classification with Long-Tailed Distribution and Partial LabelsPoster17 citations
  163. Long-Range Grouping Transformer for Multi-View 3D ReconstructionPoster17 citations
  164. M2T: Masking Transformers Twice for Faster DecodingPoster17 citations
  165. MAMo: Leveraging Memory and Attention for Monocular Video Depth EstimationPoster17 citations
  166. MRN: Multiplexed Routing Network for Incremental Multilingual Text RecognitionPoster17 citations
  167. MVPSNet: Fast Generalizable Multi-view Photometric StereoPoster17 citations
  168. Masked Autoencoders are Efficient Class Incremental LearnersPoster17 citations
  169. MemorySeg: Online LiDAR Semantic Segmentation with a Latent MemoryPoster17 citations
  170. MoTIF: Learning Motion Trajectories with Local Implicit Neural Functions for Continuous Space-Time Video Super-ResolutionPoster17 citations
  171. Multi-Scale Bidirectional Recurrent Network with Hybrid Correlation for Point Cloud Based Scene Flow EstimationPoster17 citations
  172. Multi-label Affordance Mapping from Egocentric VisionPoster17 citations
  173. Probabilistic Modeling of Inter- and Intra-observer Variability in Medical Image SegmentationPoster17 citations
  174. Proxy Anchor-based Unsupervised Learning for Continuous Generalized Category DiscoveryPoster17 citations
  175. Query6DoF: Learning Sparse Queries as Implicit Shape Prior for Category-Level 6DoF Pose EstimationPoster17 citations
  176. RefEgo: Referring Expression Comprehension Dataset from First-Person Perception of Ego4DPoster17 citations
  177. Sat2Density: Faithful Density Learning from Satellite-Ground Image PairsPoster17 citations
  178. Similarity Min-Max: Zero-Shot Day-Night Domain AdaptationOral17 citations
  179. Single Image Defocus Deblurring via Implicit Neural Inverse KernelsPoster17 citations
  180. Speech2Lip: High-fidelity Speech to Lip Generation by Learning from a Short VideoPoster17 citations
  181. Tangent Model Composition for Ensembling and Continual Fine-tuningPoster17 citations
  182. Tem-Adapter: Adapting Image-Text Pretraining for Video Question AnswerPoster17 citations
  183. The Making and Breaking of CamouflagePoster17 citations
  184. TiDAL: Learning Training Dynamics for Active LearningPoster17 citations
  185. Towards Authentic Face Restoration with Iterative Diffusion Models and BeyondPoster17 citations
  186. Towards Understanding the Generalization of Deepfake Detectors from a Game-Theoretical ViewPoster17 citations
  187. Towards Universal Image Embeddings: A Large-Scale Dataset and Challenge for Generic Image RepresentationsPoster17 citations
  188. Unsupervised Domain Adaptation for Training Event-Based Networks Using Contrastive Learning and Uncorrelated ConditioningPoster17 citations
  189. UrbanGIRAFFE: Representing Urban Scenes as Compositional Generative Neural Feature FieldsPoster17 citations
  190. Video OWL-ViT: Temporally-consistent Open-world Localization in VideoPoster17 citations
  191. Weakly Supervised Referring Image Segmentation with Intra-Chunk and Inter-Chunk ConsistencyPoster17 citations
  192. XiNet: Efficient Neural Networks for tinyMLPoster17 citations
  193. 2D-3D Interlaced Transformer for Point Cloud Segmentation with Scene-Level SupervisionPoster16 citations
  194. 3D Implicit Transporter for Temporally Consistent Keypoint DiscoveryOral16 citations
  195. Beating Backdoor Attack at Its Own GamePoster16 citations
  196. Breaking The Limits of Text-conditioned 3D Motion Synthesis with Elaborative DescriptionsPoster16 citations
  197. CFCG: Semi-Supervised Semantic Segmentation via Cross-Fusion and Contour Guidance SupervisionPoster16 citations
  198. CL-MVSNet: Unsupervised Multi-View Stereo with Dual-Level Contrastive LearningPoster16 citations
  199. ClothesNet: An Information-Rich 3D Garment Model Repository with Simulated Clothes EnvironmentPoster16 citations
  200. ClusT3: Information Invariant Test-Time TrainingPoster16 citations
  201. Contrastive Model Adaptation for Cross-Condition Robustness in Semantic SegmentationPoster16 citations
  202. DIFFGUARD: Semantic Mismatch-Guided Out-of-Distribution Detection Using Pre-Trained Diffusion ModelsPoster16 citations
  203. Deep Feature Deblurring Diffusion for Detecting Out-of-Distribution ObjectsPoster16 citations
  204. Differentiable Transportation PruningPoster16 citations
  205. Efficient Converted Spiking Neural Network for 3D and 2D ClassificationPoster16 citations
  206. FaceCLIPNeRF: Text-driven 3D Face Manipulation using Deformable Neural Radiance FieldsPoster16 citations
  207. GeoMIM: Towards Better 3D Knowledge Transfer via Masked Image Modeling for Multi-view 3D UnderstandingPoster16 citations
  208. Guiding Image Captioning Models Toward More Specific CaptionsPoster16 citations
  209. HaMuCo: Hand Pose Estimation via Multiview Collaborative Self-Supervised LearningPoster16 citations
  210. Hierarchical Prior Mining for Non-local Multi-View StereoPoster16 citations
  211. Image-Free Classifier Injection for Zero-Shot ClassificationPoster16 citations
  212. Iterative Denoiser and Noise Estimator for Self-Supervised Image DenoisingPoster16 citations
  213. Learn TAROT with MENTOR: A Meta-Learned Self-Supervised Approach for Trajectory PredictionPoster16 citations
  214. MDCS: More Diverse Experts with Consistency Self-distillation for Long-tailed RecognitionPoster16 citations
  215. MagicFusion: Boosting Text-to-Image Generation Performance by Fusing Diffusion ModelsPoster16 citations
  216. Mimic3D: Thriving 3D-Aware GANs via 3D-to-2D ImitationPoster16 citations
  217. Motion-Guided Masking for Spatiotemporal Representation LearningPoster16 citations
  218. Novel-View Synthesis and Pose Estimation for Hand-Object Interaction from Sparse ViewsPoster16 citations
  219. Object-Centric Multiple Object TrackingPoster16 citations
  220. Optimizing the Placement of Roadside LiDARs for Autonomous DrivingPoster16 citations
  221. Order-preserving Consistency Regularization for Domain Adaptation and GeneralizationPoster16 citations
  222. PDiscoNet: Semantically consistent part discovery for fine-grained recognitionPoster16 citations
  223. Physics-Augmented Autoencoder for 3D Skeleton-Based Gait RecognitionPoster16 citations
  224. RecRecNet: Rectangling Rectified Wide-Angle Images by Thin-Plate Spline Model and DoF-based Curriculum LearningPoster16 citations
  225. Reconstructing Groups of People with Hypergraph Relational ReasoningPoster16 citations
  226. Rethinking Data Distillation: Do Not Overlook CalibrationPoster16 citations
  227. SMAUG: Sparse Masked Autoencoder for Efficient Video-Language Pre-TrainingPoster16 citations
  228. Seeing Beyond the Patch: Scale-Adaptive Semantic Segmentation of High-resolution Remote Sensing Imagery based on Reinforcement LearningPoster16 citations
  229. Towards Attack-tolerant Federated Learning via Critical Parameter AnalysisPoster16 citations
  230. Towards Effective Instance Discrimination Contrastive Loss for Unsupervised Domain AdaptationPoster16 citations
  231. Towards General Low-Light Raw Noise Synthesis and ModelingPoster16 citations
  232. Towards Real-World Burst Image Super-Resolution: Benchmark and MethodPoster16 citations
  233. TrackFlow: Multi-Object tracking with Normalizing FlowsPoster16 citations
  234. Uncertainty-aware Unsupervised Multi-Object TrackingPoster16 citations
  235. Understanding the Feature Norm for Out-of-Distribution DetectionPoster16 citations
  236. Unified Out-Of-Distribution Detection: A Model-Specific PerspectivePoster16 citations
  237. Variational Causal Inference Network for Explanatory Visual Question AnsweringPoster16 citations
  238. WaveNeRF: Wavelet-based Generalizable Neural Radiance FieldsPoster16 citations
  239. A Skeletonization Algorithm for Gradient-Based OptimizationPoster15 citations
  240. A step towards understanding why classification helps regression15 citations
  241. Adaptive Illumination Mapping for Shadow Detection in Raw ImagesPoster15 citations
  242. Affine-Consistent Transformer for Multi-Class Cell Nuclei DetectionPoster15 citations
  243. Alignment Before Aggregation: Trajectory Memory Retrieval Network for Video Object SegmentationPoster15 citations
  244. Alleviating Catastrophic Forgetting of Incremental Object Detection via Within-Class and Between-Class Knowledge DistillationPoster15 citations
  245. Attention Discriminant Sampling for Point CloudsPoster15 citations
  246. Attention Where It Matters: Rethinking Visual Document Understanding with Selective Region ConcentrationPoster15 citations
  247. Benchmarking Algorithmic Bias in Face Recognition: An Experimental Approach Using Synthetic Faces and Human EvaluationPoster15 citations
  248. CHORD: Category-level Hand-held Object Reconstruction via Shape DeformationPoster15 citations
  249. CHORUS : Learning Canonicalized 3D Human-Object Spatial Relations from Unbounded Synthesized ImagesOral15 citations
  250. CLR: Channel-wise Lightweight Reprogramming for Continual LearningPoster15 citations
  251. CaPhy: Capturing Physical Properties for Animatable Human AvatarsPoster15 citations
  252. Category-aware Allocation Transformer for Weakly Supervised Object LocalizationPoster15 citations
  253. Class Prior-Free Positive-Unlabeled Learning with Taylor Variational Loss for Hyperspectral Remote Sensing ImageryPoster15 citations
  254. Clusterformer: Cluster-based Transformer for 3D Object Detection in Point CloudsPoster15 citations
  255. Confidence-based Visual Dispersal for Few-shot Unsupervised Domain AdaptationPoster15 citations
  256. CrossMatch: Source-Free Domain Adaptive Semantic Segmentation via Cross-Modal Consistency TrainingPoster15 citations
  257. D3G: Exploring Gaussian Prior for Temporal Sentence Grounding with Glance AnnotationPoster15 citations
  258. DG-Recon: Depth-Guided Neural 3D Scene ReconstructionPoster15 citations
  259. DPS-Net: Deep Polarimetric Stereo Depth EstimationPoster15 citations
  260. Deep Active Contours for Real-time 6-DoF Object TrackingPoster15 citations
  261. Delving into Motion-Aware Matching for Monocular 3D Object TrackingPoster15 citations
  262. Domain-Specificity Inducing Transformers for Source-Free Domain AdaptationPoster15 citations
  263. Exploiting Proximity-Aware Tasks for Embodied Social NavigationPoster15 citations
  264. Exploring Group Video Captioning with Efficient Relational ApproximationPoster15 citations
  265. Few-shot Continual Infomax LearningPoster15 citations
  266. GPA-3D: Geometry-aware Prototype Alignment for Unsupervised Domain Adaptive 3D Object Detection from Point CloudsPoster15 citations
  267. Harvard Glaucoma Detection and Progression: A Multimodal Multitask Dataset and Generalization-Reinforced Semi-Supervised LearningPoster15 citations
  268. Isomer: Isomerous Transformer for Zero-shot Video Object SegmentationPoster15 citations
  269. Joint Demosaicing and Deghosting of Time-Varying Exposures for Single-Shot HDR ImagingPoster15 citations
  270. Late Stopping: Avoiding Confidently Learning from Mislabeled ExamplesPoster15 citations
  271. Learning Image-Adaptive Codebooks for Class-Agnostic Image RestorationPoster15 citations
  272. Learning from Semantic Alignment between Unpaired Multiviews for Egocentric Video RecognitionPoster15 citations
  273. MV-DeepSDF: Implicit Modeling with Multi-Sweep Point Clouds for 3D Vehicle Reconstruction in Autonomous DrivingPoster15 citations
  274. Measuring Asymmetric Gradient Discrepancy in Parallel Continual LearningPoster15 citations
  275. Muscles in ActionPoster15 citations
  276. NSF: Neural Surface Fields for Human Modeling from Monocular DepthPoster15 citations
  277. Noise2Info: Noisy Image to Information of Noise for Self-Supervised Image Denoising15 citations
  278. PanFlowNet: A Flow-Based Deep Network for Pan-SharpeningPoster15 citations
  279. Probabilistic Triangulation for Uncalibrated Multi-View 3D Human Pose EstimationPoster15 citations
  280. REAP: A Large-Scale Realistic Adversarial Patch BenchmarkPoster15 citations
  281. Retro-FPN: Retrospective Feature Pyramid Network for Point Cloud Semantic SegmentationPoster15 citations
  282. SMMix: Self-Motivated Image Mixing for Vision TransformersPoster15 citations
  283. SSB: Simple but Strong Baseline for Boosting Performance of Open-Set Semi-Supervised LearningPoster15 citations
  284. Score Priors Guided Deep Variational Inference for Unsupervised Real-World Single Image DenoisingPoster15 citations
  285. Semantic Attention Flow Fields for Monocular Dynamic Scene DecompositionPoster15 citations
  286. Sequential Texts Driven Cohesive Motions Synthesis with Natural TransitionsPoster15 citations
  287. Task-aware Adaptive Learning for Cross-domain Few-shot LearningPoster15 citations
  288. Taxonomy Adaptive Cross-Domain Adaptation in Medical Imaging via Optimization Trajectory DistillationPoster15 citations
  289. Towards Models that Can See and ReadPoster15 citations
  290. Towards Viewpoint Robustness in Bird's Eye View SegmentationPoster15 citations
  291. TrajectoryFormer: 3D Object Tracking Transformer with Predictive Trajectory HypothesesPoster15 citations
  292. Two-in-One Depth: Bridging the Gap Between Monocular and Binocular Self-Supervised Depth EstimationPoster15 citations
  293. Under-Display Camera Image Restoration with Scattering EffectPoster15 citations
  294. UnitedHuman: Harnessing Multi-Source Data for High-Resolution Human GenerationPoster15 citations
  295. Visual Traffic Knowledge Graph Generation from Scene ImagesPoster15 citations
  296. VoroMesh: Learning Watertight Surface Meshes with Voronoi DiagramsPoster15 citations
  297. Walking Your LiDOG: A Journey Through Multiple Domains for LiDAR Semantic SegmentationPoster15 citations
  298. What can Discriminator do? Towards Box-free Ownership Verification of Generative Adversarial NetworksPoster15 citations
  299. Window-Based Early-Exit Cascades for Uncertainty Estimation: When Deep Ensembles are More Efficient than Single ModelsPoster15 citations
  300. A Large-scale Study of Spatiotemporal Representation Learning with a New Benchmark on Action RecognitionPoster14 citations
  301. Achievement-Based Training Progress Balancing for Multi-Task LearningPoster14 citations
  302. Affective Image Filter: Reflecting Emotions from Text to ImagesPoster14 citations
  303. Agile Modeling: From Concept to Classifier in MinutesPoster14 citations
  304. Anomaly Detection using Score-based Perturbation ResiliencePoster14 citations
  305. Boosting Whole Slide Image Classification from the Perspectives of Distribution, Correlation and MagnificationPoster14 citations
  306. CDFSL-V: Cross-Domain Few-Shot Learning for VideosPoster14 citations
  307. CSDA: Learning Category-Scale Joint Feature for Domain Adaptive Object DetectionPoster14 citations
  308. CheckerPose: Progressive Dense Keypoint Localization for Object Pose Estimation with Graph Neural NetworkPoster14 citations
  309. Computation and Data Efficient Backdoor AttacksPoster14 citations
  310. Contactless Pulse Estimation Leveraging Pseudo Labels and Self-SupervisionPoster14 citations
  311. DReg-NeRF: Deep Registration for Neural Radiance FieldsPoster14 citations
  312. Dec-Adapter: Exploring Efficient Decoder-Side Adapter for Bridging Screen Content and Natural Image CompressionPoster14 citations
  313. DeformToon3D: Deformable Neural Radiance Fields for 3D ToonificationPoster14 citations
  314. Divide&Classify: Fine-Grained Classification for City-Wide Visual Geo-LocalizationPoster14 citations
  315. Dynamic Hyperbolic Attention Network for Fine Hand-object ReconstructionPoster14 citations
  316. EDAPS: Enhanced Domain-Adaptive Panoptic SegmentationPoster14 citations
  317. Factorized Inverse Path Tracing for Efficient and Accurate Material-Lighting EstimationOral14 citations
  318. FemtoDet: An Object Detection Baseline for Energy Versus Performance TradeoffsPoster14 citations
  319. Generalizing Neural Human Fitting to Unseen Poses With Articulated SE(3) EquivarianceOral14 citations
  320. Geometrized Transformer for Self-Supervised Homography EstimationPoster14 citations
  321. Global Balanced Experts for Federated Long-Tailed LearningPoster14 citations
  322. HMD-NeMo: Online 3D Avatar Motion Generation From Sparse ObservationsPoster14 citations
  323. Holistic Label Correction for Noisy Multi-Label ClassificationPoster14 citations
  324. Homeomorphism Alignment for Unsupervised Domain AdaptationPoster14 citations
  325. Inducing Neural Collapse to a Fixed Hierarchy-Aware Frame for Reducing Mistake SeverityPoster14 citations
  326. LAC - Latent Action Composition for Skeleton-based Action SegmentationPoster14 citations
  327. LAW-Diffusion: Complex Scene Generation by Diffusion with LayoutsPoster14 citations
  328. MapPrior: Bird's-Eye View Map Layout Estimation with Generative ModelsPoster14 citations
  329. Monocular 3D Object Detection with Bounding Box Denoising in 3D by PerceiverPoster14 citations
  330. MosaiQ: Quantum Generative Adversarial Networks for Image Generation on NISQ ComputersPoster14 citations
  331. Multi-Event Video-Text RetrievalPoster14 citations
  332. NAPA-VQ: Neighborhood-Aware Prototype Augmentation with Vector Quantization for Continual LearningPoster14 citations
  333. On the Effectiveness of Spectral Discriminators for Perceptual Quality ImprovementPoster14 citations
  334. Open-Vocabulary Object Detection With an Open CorpusPoster14 citations
  335. PADDLES: Phase-Amplitude Spectrum Disentangled Early Stopping for Learning with Noisy LabelsPoster14 citations
  336. PODIA-3D: Domain Adaptation of 3D Generative Model Across Large Domain Gap Using Pose-Preserved Text-to-Image DiffusionPoster14 citations
  337. Phasic Content Fusing Diffusion Model with Directional Distribution Consistency for Few-Shot Model AdaptionPoster14 citations
  338. RSFNet: A White-Box Image Retouching Approach using Region-Specific Color FiltersPoster14 citations
  339. RankMatch: Fostering Confidence and Consistency in Learning with Noisy LabelsPoster14 citations
  340. RankMixup: Ranking-Based Mixup Training for Network CalibrationPoster14 citations
  341. Reinforced Disentanglement for Face Swapping without Skip ConnectionPoster14 citations
  342. SGAligner: 3D Scene Alignment with Scene GraphsPoster14 citations
  343. SPANet: Frequency-balancing Token Mixer using Spectral Pooling Aggregation ModulationPoster14 citations
  344. Scene Graph Contrastive Learning for Embodied NavigationPoster14 citations
  345. Self-similarity Driven Scale-invariant Learning for Weakly Supervised Person SearchPoster14 citations
  346. Semi-Supervised Semantic Segmentation under Label Noise via Diverse Learning GroupsPoster14 citations
  347. Studying How to Efficiently and Effectively Guide Models with ExplanationsPoster14 citations
  348. StylerDALLE: Language-Guided Style Transfer Using a Vector-Quantized Tokenizer of a Large-Scale Generative ModelPoster14 citations
  349. The Perils of Learning From Unlabeled Data: Backdoor Attacks on Semi-supervised LearningPoster14 citations
  350. Towards High-Quality Specular Highlight Removal by Leveraging Large-Scale Synthetic DataPoster14 citations
  351. Tracking by Natural Language Specification with Long Short-term Context DecouplingPoster14 citations
  352. UMIFormer: Mining the Correlations between Similar Tokens for Multi-View 3D ReconstructionPoster14 citations
  353. Understanding 3D Object Interaction from a Single ImagePoster14 citations
  354. Uni-3D: A Universal Model for Panoptic 3D Scene ReconstructionPoster14 citations
  355. Unsupervised Compositional Concepts Discovery with Text-to-Image Generative ModelsPoster14 citations
  356. Unsupervised Manifold Linearizing and ClusteringPoster14 citations
  357. Video State-Changing Object SegmentationPoster14 citations
  358. What Can Simple Arithmetic Operations Do for Temporal Modeling?Poster14 citations
  359. 3D VR Sketch Guided 3D Shape Prototyping and ExplorationPoster13 citations
  360. 3DHumanGAN: 3D-Aware Human Image Generation with 3D Pose MappingPoster13 citations
  361. Beyond the Pixel: a Photometrically Calibrated HDR Dataset for Luminance and Color PredictionOral13 citations
  362. Coarse-to-Fine: Learning Compact Discriminative Representation for Single-Stage Image RetrievalPoster13 citations
  363. DPM-OT: A New Diffusion Probabilistic Model Based on Optimal TransportPoster13 citations
  364. Deep Optics for Video Snapshot Compressive ImagingPoster13 citations
  365. Do DALL-E and Flamingo Understand Each Other?Poster13 citations
  366. Downscaled Representation Matters: Improving Image Rescaling with Collaborative Downscaled ImagesPoster13 citations
  367. Dynamic PlenOctree for Adaptive Sampling Refinement in Explicit NeRFPoster13 citations
  368. EPiC: Ensemble of Partial Point Clouds for Robust ClassificationPoster13 citations
  369. EQ-Net: Elastic Quantization Neural NetworksPoster13 citations
  370. EgoPCA: A New Framework for Egocentric Hand-Object Interaction UnderstandingPoster13 citations
  371. Environment-Invariant Curriculum Relation Learning for Fine-Grained Scene Graph GenerationPoster13 citations
  372. Eventful Transformers: Leveraging Temporal Redundancy in Vision TransformersPoster13 citations
  373. Fast Adversarial Training with Smooth ConvergencePoster13 citations
  374. Few-Shot Video Classification via Representation Fusion and Promotion LearningPoster13 citations
  375. Generative Gradient Inversion via Over-Parameterized Networks in Federated LearningPoster13 citations
  376. GlowGAN: Unsupervised Learning of HDR Images from LDR Images in the WildPoster13 citations
  377. Gradient-based Sampling for Class Imbalanced Semi-supervised Object DetectionPoster13 citations
  378. HollowNeRF: Pruning Hashgrid-Based NeRFs with Trainable Collision MitigationPoster13 citations
  379. HybridAugment++: Unified Frequency Spectra Perturbations for Model RobustnessPoster13 citations
  380. INSTA-BNN: Binary Neural Network with INSTAnce-aware ThresholdPoster13 citations
  381. Improving Adversarial Robustness of Masked Autoencoders via Test-time Frequency-domain PromptingPoster13 citations
  382. Improving Unsupervised Visual Program Inference with Code Rewriting FamiliesOral13 citations
  383. Invariant Training 2D-3D Joint Hard Samples for Few-Shot Point Cloud RecognitionPoster13 citations
  384. Joint Metrics Matter: A Better Standard for Trajectory ForecastingPoster13 citations
  385. Joint-Relation Transformer for Multi-Person Motion PredictionPoster13 citations
  386. LPFF: A Portrait Dataset for Face Generators Across Large PosesPoster13 citations
  387. Learning a Room with the Occ-SDF Hybrid: Signed Distance Function Mingled with Occupancy Aids Scene RepresentationPoster13 citations
  388. Locating Noise is Halfway Denoising for Semi-Supervised SegmentationPoster13 citations
  389. NLOS-NeuS: Non-line-of-sight Neural Implicit SurfacePoster13 citations
  390. PGFed: Personalize Each Client's Global Objective for Federated LearningOral13 citations
  391. ProtoFL: Unsupervised Federated Learning via Prototypical DistillationPoster13 citations
  392. Prototypical Kernel Learning and Open-set Foreground Perception for Generalized Few-shot Semantic SegmentationPoster13 citations
  393. RICO: Regularizing the Unobservable for Indoor Compositional ReconstructionPoster13 citations
  394. SegRCDB: Semantic Segmentation via Formula-Driven Supervised LearningPoster13 citations
  395. Semantically Structured Image Compression via Irregular Group-Based DecouplingPoster13 citations
  396. SimMatchV2: Semi-Supervised Learning with Graph ConsistencyPoster13 citations
  397. SparseDet: Improving Sparsely Annotated Object Detection with Pseudo-positive MiningPoster13 citations
  398. Spatial-Aware Token for Weakly Supervised Object LocalizationPoster13 citations
  399. Steered Diffusion: A Generalized Framework for Plug-and-Play Conditional Image SynthesisPoster13 citations
  400. Strip-MLP: Efficient Token Interaction for Vision MLPPoster13 citations
  401. StyleLipSync: Style-based Personalized Lip-sync Video GenerationPoster13 citations
  402. To Adapt or Not to Adapt? Real-Time Adaptation for Semantic SegmentationPoster13 citations
  403. ToonTalker: Cross-Domain Face ReenactmentPoster13 citations
  404. Towards Multi-Layered 3D Garments AnimationPoster13 citations
  405. Tubelet-Contrastive Self-Supervision for Video-Efficient GeneralizationPoster13 citations
  406. Two Birds, One Stone: A Unified Framework for Joint Learning of Image and Video Style TransfersPoster13 citations
  407. ViLTA: Enhancing Vision-Language Pre-training through Textual AugmentationPoster13 citations
  408. Weakly-Supervised Text-Driven Contrastive Learning for Facial Behavior UnderstandingPoster13 citations
  409. 3D-aware Blending with Generative NeRFsPoster12 citations
  410. A Benchmark for Chinese-English Scene Text Image Super-ResolutionPoster12 citations
  411. A Parse-Then-Place Approach for Generating Graphic Layouts from Textual DescriptionsPoster12 citations
  412. Adaptive Superpixel for Active Learning in Semantic SegmentationPoster12 citations
  413. All4One: Symbiotic Neighbour Contrastive Learning via Self-Attention and Redundancy ReductionPoster12 citations
  414. AssetField: Assets Mining and Reconfiguration in Ground Feature Plane RepresentationPoster12 citations
  415. Audio-Visual Deception Detection: DOLOS Dataset and Parameter-Efficient Crossmodal LearningPoster12 citations
  416. CLIP-Cluster: CLIP-Guided Attribute Hallucination for Face ClusteringPoster12 citations
  417. CancerUniT: Towards a Single Unified Model for Effective Detection, Segmentation, and Diagnosis of Eight Major Cancers Using a Large Collection of CT ScansPoster12 citations
  418. Center-Based Decoupled Point-cloud Registration for 6D Object Pose EstimationPoster12 citations
  419. Class-incremental Continual Learning for Instance Segmentation with Image-level Weak SupervisionPoster12 citations
  420. Communication-efficient Federated Learning with Single-Step Synthetic Features Compressor for Faster ConvergencePoster12 citations
  421. Confidence-aware Pseudo-label Learning for Weakly Supervised Visual GroundingPoster12 citations
  422. Cyclic-Bootstrap Labeling for Weakly Supervised Object DetectionPoster12 citations
  423. DEDRIFT: Robust Similarity Search under Content DriftPoster12 citations
  424. Deep Image Harmonization with Globally Guided Feature Transformation and Relation DistillationPoster12 citations
  425. DiLiGenT-Pi: Photometric Stereo for Planar Surfaces with Rich Details - Benchmark Dataset and BeyondPoster12 citations
  426. DynaMITe: Dynamic Query Bootstrapping for Multi-object Interactive Segmentation TransformerPoster12 citations
  427. FBLNet: FeedBack Loop Network for Driver Attention PredictionPoster12 citations
  428. Fast Full-frame Video Stabilization with Iterative OptimizationPoster12 citations
  429. Focus on Your Target: A Dual Teacher-Student Framework for Domain-Adaptive Semantic SegmentationPoster12 citations
  430. FreeCOS: Self-Supervised Learning from Fractals and Unlabeled Images for Curvilinear Object SegmentationPoster12 citations
  431. Hiding Visual Information via Obfuscating Adversarial PerturbationsPoster12 citations
  432. Keep It SimPool: Who Said Supervised Transformers Suffer from Attention Deficit?Poster12 citations
  433. LAN-HDR: Luminance-based Alignment Network for High Dynamic Range Video ReconstructionPoster12 citations
  434. LEA2: A Lightweight Ensemble Adversarial Attack via Non-overlapping Vulnerable Frequency RegionsPoster12 citations
  435. Learning by Sorting: Self-supervised Learning with Group Ordering ConstraintsPoster12 citations
  436. Learning to Distill Global Representation for Sparse-View CTPoster12 citations
  437. Learning to Generate Semantic Layouts for Higher Text-Image Correspondence in Text-to-Image SynthesisPoster12 citations
  438. Learning to Identify Critical States for Reinforcement Learning from VideosPoster12 citations
  439. Luminance-aware Color Transform for Multiple Exposure CorrectionPoster12 citations
  440. MOST: Multiple Object Localization with Self-Supervised Transformers for Object DiscoveryOral12 citations
  441. NCHO: Unsupervised Learning for Neural 3D Composition of Humans and ObjectsPoster12 citations
  442. NEMTO: Neural Environment Matting for Novel View and Relighting Synthesis of Transparent ObjectsPoster12 citations
  443. NeRF-MS: Neural Radiance Fields with Multi-SequencePoster12 citations
  444. NeRFrac: Neural Radiance Fields through Refractive SurfacePoster12 citations
  445. NeTO:Neural Reconstruction of Transparent Objects with Self-Occlusion Aware Refraction-TracingPoster12 citations
  446. Neural Implicit Surface EvolutionPoster12 citations
  447. Neural Reconstruction of Relightable Human Model from Monocular VideoPoster12 citations
  448. Not All Steps are Created Equal: Selective Diffusion Distillation for Image ManipulationPoster12 citations
  449. One-Shot Recognition of Any Material Anywhere Using Contrastive Learning with Physics-Based RenderingPoster12 citations
  450. PRANC: Pseudo RAndom Networks for Compacting Deep ModelsPoster12 citations
  451. Point Contrastive Prediction with Semantic Clustering for Self-Supervised Learning on Point Cloud VideosPoster12 citations
  452. ProtoTransfer: Cross-Modal Prototype Transfer for Point Cloud SegmentationPoster12 citations
  453. Pseudo Flow Consistency for Self-Supervised 6D Object Pose EstimationPoster12 citations
  454. ROME: Robustifying Memory-Efficient NAS via Topology Disentanglement and Gradient AccumulationPoster12 citations
  455. RPG-Palm: Realistic Pseudo-data Generation for Palmprint RecognitionPoster12 citations
  456. Regularized Mask Tuning: Uncovering Hidden Knowledge in Pre-Trained Vision-Language ModelsPoster12 citations
  457. Rethinking Point Cloud Registration as Masking and ReconstructionPoster12 citations
  458. Rethinking Safe Semi-supervised Learning: Transferring the Open-set Problem to A Close-set OnePoster12 citations
  459. SC3K: Self-supervised and Coherent 3D Keypoints Estimation from Rotated, Noisy, and Decimated Point Cloud DataPoster12 citations
  460. Segment Every Reference Object in Spatial and Temporal SpacesPoster12 citations
  461. Self-Organizing Pathway Expansion for Non-Exemplar Class-Incremental LearningPoster12 citations
  462. ShapeScaffolder: Structure-Aware 3D Shape Generation from TextPoster12 citations
  463. SimNP: Learning Self-Similarity Priors Between Neural PointsPoster12 citations
  464. Simulating Fluids in Real-World Still ImagesOral12 citations
  465. Skip-Plan: Procedure Planning in Instructional Videos via Condensed Action Space LearningPoster12 citations
  466. SoDaCam: Software-defined Cameras via Single-Photon ImagingOral12 citations
  467. StageInteractor: Query-based Object Detector with Cross-stage InteractionPoster12 citations
  468. TIJO: Trigger Inversion with Joint Optimization for Defending Multimodal Backdoored ModelsOral12 citations
  469. TextPSG: Panoptic Scene Graph Generation from Textual DescriptionsPoster12 citations
  470. Towards Deeply Unified Depth-aware Panoptic Segmentation with Bi-directional Guidance LearningOral12 citations
  471. Towards Realistic Evaluation of Industrial Continual Learning Scenarios with an Emphasis on Energy Consumption and Computational FootprintPoster12 citations
  472. Understanding Hessian Alignment for Domain GeneralizationPoster12 citations
  473. VAPCNet: Viewpoint-Aware 3D Point Cloud CompletionPoster12 citations
  474. Vision Transformer Adapters for Generalizable Multitask LearningPoster12 citations
  475. Why do networks have inhibitory/negative connections?Poster12 citations
  476. Zero-guidance Segmentation Using Zero Segment LabelsPoster12 citations
  477. A 5-Point Minimal Solver for Event Camera Relative Motion EstimationOral11 citations
  478. AGG-Net: Attention Guided Gated-Convolutional Network for Depth Image CompletionPoster11 citations
  479. Active Stereo Without Pattern ProjectorPoster11 citations
  480. Body Knowledge and Uncertainty Modeling for Monocular 3D Human Body ReconstructionPoster11 citations
  481. Boosting Semantic Segmentation from the Perspective of Explicit Class EmbeddingsPoster11 citations
  482. Building Bridge Across the Time: Disruption and Restoration of Murals In the WildPoster11 citations
  483. CLIPTrans: Transferring Visual Knowledge with Pre-trained Models for Multimodal Machine TranslationPoster11 citations
  484. Clutter Detection and Removal in 3D Scenes with View-Consistent InpaintingPoster11 citations
  485. Collecting The Puzzle Pieces: Disentangled Self-Driven Human Pose Transfer by Permuting TexturesPoster11 citations
  486. DELFlow: Dense Efficient Learning of Scene Flow for Large-Scale Point CloudsPoster11 citations
  487. Deep Incubation: Training Large Models by Divide-and-ConqueringPoster11 citations
  488. Deformable Model-Driven Neural Rendering for High-Fidelity 3D Reconstruction of Human Heads Under Low-View SettingsPoster11 citations
  489. Disentangle then Parse: Night-time Semantic Segmentation with Illumination DisentanglementPoster11 citations
  490. E2E-LOAD: End-to-End Long-form Online Action DetectionPoster11 citations
  491. E3Sym: Leveraging E(3) Invariance for Unsupervised 3D Planar Reflective Symmetry DetectionPoster11 citations
  492. Enhancing Sample Utilization through Sample Adaptive Augmentation in Semi-Supervised LearningOral11 citations
  493. Few-Shot Dataset Distillation via Translative Pre-TrainingPoster11 citations
  494. GePSAn: Generative Procedure Step Anticipation in Cooking VideosPoster11 citations
  495. ImGeoNet: Image-induced Geometry-aware Voxel Representation for Multi-view 3D Object DetectionPoster11 citations
  496. Improving Transformer-based Image Matching by Cascaded Capturing Spatially Informative KeypointsPoster11 citations
  497. Invariant Feature Regularization for Fair Face RecognitionPoster11 citations
  498. LDP-Feat: Image Features with Local Differential PrivacyPoster11 citations
  499. Lecture Presentations Multimodal Dataset: Towards Understanding Multimodality in Educational VideosPoster11 citations
  500. Mitigating Adversarial Vulnerability through Causal Parameter Estimation by Adversarial Double Machine LearningPoster11 citations
  501. Movement Enhancement toward Multi-Scale Video Feature Representation for Temporal Action DetectionPoster11 citations
  502. Multi-Task Learning with Knowledge Distillation for Dense PredictionPoster11 citations
  503. Multi-grained Temporal Prototype Learning for Few-shot Video Object SegmentationPoster11 citations
  504. Multiple Planar Object TrackingPoster11 citations
  505. Multiscale Representation for Real-Time Anti-Aliasing Neural RenderingPoster11 citations
  506. NaviNeRF: NeRF-based 3D Representation Disentanglement by Latent Semantic NavigationPoster11 citations
  507. OFVL-MS: Once for Visual Localization across Multiple Indoor ScenesPoster11 citations
  508. Ordinal Label Distribution LearningPoster11 citations
  509. OxfordTVG-HIC: Can Machine Make Humorous Captions from Images?Poster11 citations
  510. PC-Adapter: Topology-Aware Adapter for Efficient Domain Adaption on Point Clouds with Rectified Pseudo-labelPoster11 citations
  511. PVT++: A Simple End-to-End Latency-Aware Visual Tracking FrameworkPoster11 citations
  512. Parallel Attention Interaction Network for Few-Shot Skeleton-Based Action RecognitionPoster11 citations
  513. Pose-Free Neural Radiance Fields via Implicit Pose RegularizationPoster11 citations
  514. QD-BEV : Quantization-aware View-guided Distillation for Multi-view 3D Object DetectionPoster11 citations
  515. Randomized Quantization: A Generic Augmentation for Data Agnostic Self-supervised LearningPoster11 citations
  516. Reinforce Data, Multiply Impact: Improved Model Accuracy and Robustness with Dataset ReinforcementPoster11 citations
  517. SSDA: Secure Source-Free Domain AdaptationPoster11 citations
  518. STEPs: Self-Supervised Key Step Extraction and Localization from Unlabeled Procedural VideosPoster11 citations
  519. Self-Supervised Burst Super-ResolutionPoster11 citations
  520. Sound Localization from Motion: Jointly Learning Sound Direction and Camera RotationPoster11 citations
  521. Space-time Prompting for Video Class-incremental LearningOral11 citations
  522. Supervised Homography Learning with Realistic Dataset GenerationPoster11 citations
  523. TRM-UAP: Enhancing the Transferability of Data-Free Universal Adversarial Perturbation via Truncated Ratio MaximizationPoster11 citations
  524. The Unreasonable Effectiveness of Large Language-Vision Models for Source-Free Video Domain AdaptationPoster11 citations
  525. Towards Inadequately Pre-trained Models in Transfer LearningPoster11 citations
  526. Towards Robust Model Watermark via Reducing Parametric VulnerabilityPoster11 citations
  527. Towards Viewpoint-Invariant Visual Recognition via Adversarial TrainingPoster11 citations
  528. TrajPAC: Towards Robustness Verification of Pedestrian Trajectory Prediction ModelsPoster11 citations
  529. Transparent Shape from a Single View Polarization ImagePoster11 citations
  530. UHDNeRF: Ultra-High-Definition Neural Radiance FieldsPoster11 citations
  531. Unsupervised Video Deraining with An Event CameraPoster11 citations
  532. Unsupervised Video Object Segmentation with Online Adversarial Self-TuningPoster11 citations
  533. Video Action Recognition with Attentive Semantic UnitsPoster11 citations
  534. When Do Curricula Work in Federated Learning?Poster11 citations
  535. iDAG: Invariant DAG Searching for Domain GeneralizationPoster11 citations
  536. 360VOT: A New Benchmark Dataset for Omnidirectional Visual Object TrackingPoster10 citations
  537. 3D Distillation: Improving Self-Supervised Monocular Depth Estimation on Reflective SurfacesPoster10 citations
  538. 3D Human Mesh Recovery with Sequentially Global Rotation EstimationPoster10 citations
  539. A Multidimensional Analysis of Social Biases in Vision TransformersPoster10 citations
  540. AdVerb: Visually Guided Audio DereverberationPoster10 citations
  541. Advancing Example Exploitation Can Alleviate Critical Challenges in Adversarial TrainingOral10 citations
  542. Automatic Animation of Hair Blowing in Still Portrait PhotosPoster10 citations
  543. BoMD: Bag of Multi-label Descriptors for Noisy Chest X-ray ClassificationPoster10 citations
  544. Boosting Single Image Super-Resolution via Partial Channel ShiftingPoster10 citations
  545. C2F2NeUS: Cascade Cost Frustum Fusion for High Fidelity and Generalizable Neural Surface ReconstructionPoster10 citations
  546. Chasing Clouds: Differentiable Volumetric Rasterisation of Point Clouds as a Highly Efficient and Accurate Loss for Large-Scale Deformable 3D RegistrationOral10 citations
  547. Coordinate Quantized Neural Implicit Representations for Multi-view ReconstructionPoster10 citations
  548. Cross-modal Scalable Hyperbolic Hierarchical ClusteringPoster10 citations
  549. DDIT: Semantic Scene Completion via Deformable Deep Implicit TemplatesPoster10 citations
  550. DOT: A Distillation-Oriented TrainerPoster10 citations
  551. Discriminative Class Tokens for Text-to-Image Diffusion ModelsPoster10 citations
  552. EGC: Image Generation and Classification via a Diffusion Energy-Based ModelPoster10 citations
  553. EP2P-Loc: End-to-End 3D Point to 2D Pixel Localization for Large-Scale Visual LocalizationPoster10 citations
  554. Editable Image Geometric Abstraction via Neural Primitive AssemblyPoster10 citations
  555. Enhancing Non-line-of-sight Imaging via Learnable Inverse Kernel and Attention MechanismsPoster10 citations
  556. Environment Agnostic Representation for Visual Reinforcement LearningPoster10 citations
  557. Exploring Transformers for Open-world Instance SegmentationPoster10 citations
  558. F&F Attack: Adversarial Attack against Multiple Object Trackers by Inducing False Negatives and False PositivesPoster10 citations
  559. FULLER: Unified Multi-modality Multi-task 3D Perception via Multi-level Gradient CalibrationPoster10 citations
  560. Federated Learning Over Images: Vertical Decompositions and Pre-Trained Backbones Are Difficult to BeatPoster10 citations
  561. Foreground and Text-lines Aware Document Image RectificationPoster10 citations
  562. INT2: Interactive Trajectory Prediction at IntersectionsPoster10 citations
  563. Innovating Real Fisheye Image Correction with Dual Diffusion ArchitecturePoster10 citations
  564. Iterative Superquadric Recomposition of 3D Objects from Multiple ViewsPoster10 citations
  565. Knowledge-Spreader: Learning Semi-Supervised Facial Action Dynamics by Consistifying Knowledge GranularityPoster10 citations
  566. LaPE: Layer-adaptive Position Embedding for Vision Transformers with Independent Layer NormalizationPoster10 citations
  567. Large-Scale Land Cover Mapping with Fine-Grained Classes via Class-Aware Semi-Supervised Semantic SegmentationPoster10 citations
  568. Learned Image Reasoning Prior Penetrates Deep Unfolding Network for Panchromatic and Multi-spectral Image FusionPoster10 citations
  569. Learning Continuous Exposure Value Representations for Single-Image HDR ReconstructionPoster10 citations
  570. Learning Neural Eigenfunctions for Unsupervised Semantic SegmentationPoster10 citations
  571. Learning from Noisy Data for Semi-Supervised 3D Object DetectionPoster10 citations
  572. Learning from Noisy Pseudo Labels for Semi-Supervised Temporal Action LocalizationPoster10 citations
  573. Local or Global: Selective Knowledge Assimilation for Federated Learning with Limited LabelsPoster10 citations
  574. Long-range Multimodal Pretraining for Movie UnderstandingPoster10 citations
  575. MAGI: Multi-Annotated Explanation-Guided LearningPoster10 citations
  576. MUVA: A New Large-Scale Benchmark for Multi-View Amodal Instance Segmentation in the Shopping ScenarioPoster10 citations
  577. Masked Autoencoders Are Stronger Knowledge DistillersPoster10 citations
  578. Most Important Person-Guided Dual-Branch Cross-Patch Attention for Group Affect RecognitionPoster10 citations
  579. Multi-granularity Interaction Simulation for Unsupervised Interactive SegmentationPoster10 citations
  580. Neural Fields for Structured LightingPoster10 citations
  581. Neural Radiance Field with LiDAR mapsPoster10 citations
  582. P1AC: Revisiting Absolute Pose From a Single Affine CorrespondenceOral10 citations
  583. PARTNER: Level up the Polar Representation for LiDAR 3D Object DetectionPoster10 citations
  584. Parametric Depth Based Feature Representation Learning for Object Detection and Segmentation in Bird's-Eye ViewPoster10 citations
  585. Partition Speeds Up Learning Implicit Neural Representations Based on Exponential-Increase HypothesisPoster10 citations
  586. PointDC: Unsupervised Semantic Segmentation of 3D Point Clouds via Cross-Modal Distillation and Super-Voxel ClusteringPoster10 citations
  587. Pre-training Vision Transformers with Very Limited Synthesized ImagesPoster10 citations
  588. Re:PolyWorld - A Graph Neural Network for Polygonal Scene ParsingPoster10 citations
  589. Recursive Video Lane DetectionPoster10 citations
  590. Representation Disparity-aware Distillation for 3D Object DetectionPoster10 citations
  591. Robust One-Shot Face Video Re-enactment using Hybrid Latent Spaces of StyleGAN2Poster10 citations
  592. SIGMA: Scale-Invariant Global Sparse Shape MatchingPoster10 citations
  593. SVQNet: Sparse Voxel-Adjacent Query Network for 4D Spatio-Temporal LiDAR Semantic SegmentationPoster10 citations
  594. Sample-wise Label Confidence Incorporation for Learning with Noisy LabelsPoster10 citations
  595. Segmenting Known Objects and Unseen Unknowns without Prior KnowledgePoster10 citations
  596. SeiT: Storage-Efficient Vision Training with Tokens Using 1% of Pixel StoragePoster10 citations
  597. Sentence Attention Blocks for Answer GroundingPoster10 citations
  598. Spacetime Surface Regularization for Neural Dynamic Scene ReconstructionPoster10 citations
  599. Speech4Mesh: Speech-Assisted Monocular 3D Facial Reconstruction for Speech-Driven 3D Facial AnimationPoster10 citations
  600. TextManiA: Enriching Visual Feature by Text-driven Manifold AugmentationPoster10 citations
  601. Towards Building More Robust Models with Frequency BiasPoster10 citations
  602. Unilaterally Aggregated Contrastive Learning with Hierarchical Augmentation for Anomaly DetectionPoster10 citations
  603. VLSlice: Interactive Vision-and-Language Slice DiscoveryPoster10 citations
  604. ViLLA: Fine-Grained Vision-Language Representation Learning from Real-World DataPoster10 citations
  605. BaRe-ESA: A Riemannian Framework for Unregistered Human Body ShapesPoster9 citations
  606. Be Everywhere - Hear Everything (BEE): Audio Scene Reconstruction by Sparse Audio-Visual SamplesPoster9 citations
  607. Beyond Object Recognition: A New Benchmark towards Object Concept LearningPoster9 citations
  608. Boosting Positive Segments for Weakly-Supervised Audio-Visual Video ParsingPoster9 citations
  609. CAME: Contrastive Automated Model EvaluationPoster9 citations
  610. CIRI: Curricular Inactivation for Residue-aware One-shot Video InpaintingPoster9 citations
  611. CVSformer: Cross-View Synthesis Transformer for Semantic Scene CompletionPoster9 citations
  612. Canonical Factors for Hybrid Neural FieldsPoster9 citations
  613. Collaborative Tracking Learning for Frame-Rate-Insensitive Multi-Object TrackingPoster9 citations
  614. Controllable Visual-Tactile SynthesisPoster9 citations
  615. Counterfactual-based Saliency Map: Towards Visual Contrastive Explanations for Neural NetworksPoster9 citations
  616. DPF-Net: Combining Explicit Shape Priors in Deformable Primitive Field for Unsupervised Structural Reconstruction of 3D ObjectsPoster9 citations
  617. Data-Free Class-Incremental Hand Gesture RecognitionPoster9 citations
  618. ENTL: Embodied Navigation Trajectory LearnerPoster9 citations
  619. EgoTV: Egocentric Task Verification from Natural Language Task DescriptionsPoster9 citations
  620. Emotional Listener Portrait: Neural Listener Head Generation with EmotionPoster9 citations
  621. Energy-based Self-Training and Normalization for Unsupervised Domain AdaptationPoster9 citations
  622. Exploring Model Transferability through the Lens of Potential EnergyPoster9 citations
  623. FashionNTM: Multi-turn Fashion Image Retrieval via Cascaded MemoryPoster9 citations
  624. Fcaformer: Forward Cross Attention in Hybrid Vision TransformerPoster9 citations
  625. Fine-grained Visible Watermark RemovalPoster9 citations
  626. Foreground-Background Separation through Concept Distillation from Generative Image Foundation ModelsPoster9 citations
  627. Generalized Few-Shot Point Cloud Segmentation via Geometric WordsPoster9 citations
  628. Improving Online Lane Graph Extraction by Object-Lane ClusteringPoster9 citations
  629. Informative Data Mining for One-Shot Cross-Domain Semantic SegmentationPoster9 citations
  630. Inverse Problem Regularization with Hierarchical Variational AutoencodersPoster9 citations
  631. Learning Global-aware Kernel for Image HarmonizationPoster9 citations
  632. Learning Spatial-context-aware Global Visual Feature Representation for Instance Image RetrievalPoster9 citations
  633. LiDAR-UDA: Self-ensembling Through Time for Unsupervised LiDAR Domain AdaptationOral9 citations
  634. Lip2Vec: Efficient and Robust Visual Speech Recognition via Latent-to-Latent Visual to Audio Representation MappingPoster9 citations
  635. MHCN: A Hyperbolic Neural Network Model for Multi-view Hierarchical ClusteringPoster9 citations
  636. Meta-ZSDETR: Zero-shot DETR with Meta-learningPoster9 citations
  637. MixSynthFormer: A Transformer Encoder-like Structure with Mixed Synthetic Self-attention for Efficient Human Pose EstimationPoster9 citations
  638. MolGrapher: Graph-based Visual Recognition of Chemical StructuresPoster9 citations
  639. Multi-Object Discovery by Low-Dimensional Object MotionPoster9 citations
  640. Multi-View Active Fine-Grained Visual RecognitionPoster9 citations
  641. Multi-view Self-supervised Disentanglement for General Image DenoisingPoster9 citations
  642. Narrator: Towards Natural Control of Human-Scene Interaction Generation via Relationship ReasoningPoster9 citations
  643. OmniLabel: A Challenging Benchmark for Language-Based Object DetectionOral9 citations
  644. OmniZoomer: Learning to Move and Zoom in on Sphere at High-ResolutionPoster9 citations
  645. On the Robustness of Normalizing Flows for Inverse Problems in ImagingPoster9 citations
  646. Pairwise Similarity Learning is SimPLEPoster9 citations
  647. Pixel-Aligned Recurrent Queries for Multi-View 3D Object DetectionPoster9 citations
  648. PlaneRecTR: Unified Query Learning for 3D Plane Recovery from a Single ViewPoster9 citations
  649. Pyramid Dual Domain Injection Network for Pan-sharpeningPoster9 citations
  650. Reconciling Object-Level and Global-Level Objectives for Long-Tail DetectionPoster9 citations
  651. Root Pose Decomposition Towards Generic Non-rigid 3D Reconstruction with Monocular VideosPoster9 citations
  652. S-TREK: Sequential Translation and Rotation Equivariant Keypoints for Local Feature ExtractionPoster9 citations
  653. Scene Matters: Model-based Deep Video CompressionPoster9 citations
  654. Self-Ordering Point CloudsOral9 citations
  655. Self-Supervised Object Detection from Egocentric VideosPoster9 citations
  656. Self-supervised Learning of Implicit Shape Representation with Dense Correspondence for Deformable ObjectsPoster9 citations
  657. Self-supervised Pre-training for Mirror DetectionPoster9 citations
  658. Semi-Supervised Learning via Weight-Aware Distillation under Class Distribution MismatchPoster9 citations
  659. ShiftNAS: Improving One-shot NAS via Probability ShiftPoster9 citations
  660. Story Visualization by Online Text Augmentation with Context MemoryPoster9 citations
  661. StyleDomain: Efficient and Lightweight Parameterizations of StyleGAN for One-shot and Few-shot Domain AdaptationPoster9 citations
  662. Template Inversion Attack against Face Recognition Systems using 3D Face ReconstructionPoster9 citations
  663. Troubleshooting Ethnic Quality Bias with Curriculum Domain Adaptation for Face Image Quality AssessmentPoster9 citations
  664. UniKD: Universal Knowledge Distillation for Mimicking Homogeneous or Heterogeneous Object DetectorsPoster9 citations
  665. Unsupervised Domain Adaptive Detection with Network Stability AnalysisPoster9 citations
  666. Unsupervised Prompt Tuning for Text-Driven Object DetectionPoster9 citations
  667. VeRi3D: Generative Vertex-based Radiance Fields for 3D Controllable Human Image SynthesisPoster9 citations
  668. Zero-Shot Point Cloud Segmentation by Semantic-Visual Aware SynthesisPoster9 citations
  669. ASAG: Building Strong One-Decoder-Layer Sparse Detectors via Adaptive Sparse Anchor GenerationPoster8 citations
  670. Activate and Reject: Towards Safe Domain Generalization under Category ShiftPoster8 citations
  671. Adaptive Calibrator Ensemble: Navigating Test Set Difficulty in Out-of-Distribution ScenariosPoster8 citations
  672. Adaptive Positional Encoding for Bundle-Adjusting Neural Radiance FieldsPoster8 citations
  673. Anchor-Intermediate Detector: Decoupling and Coupling Bounding Boxes for Accurate Object DetectionPoster8 citations
  674. BANSAC: A Dynamic BAyesian Network for Adaptive SAmple ConsensusPoster8 citations
  675. Borrowing Knowledge From Pre-trained Language Model: A New Data-efficient Visual Learning ParadigmPoster8 citations
  676. Box-based Refinement for Weakly Supervised and Unsupervised Localization TasksPoster8 citations
  677. Conditional 360-degree Image Synthesis for Immersive Indoor Scene DecorationPoster8 citations
  678. Curvature-Aware Training for Coordinate NetworksPoster8 citations
  679. DRAW: Defending Camera-shooted RAW Against Image ManipulationPoster8 citations
  680. Dark Side Augmentation: Generating Diverse Night Examples for Metric LearningPoster8 citations
  681. DeFormer: Integrating Transformers with Deformable Models for 3D Shape Abstraction from a Single ImagePoster8 citations
  682. Deep Homography Mixture for Single Image Rolling Shutter CorrectionPoster8 citations
  683. Deep Image Harmonization with Learnable AugmentationPoster8 citations
  684. Deep Multitask Learning with Progressive Parameter SharingOral8 citations
  685. Diffuse3D: Wide-Angle 3D Photography via Bilateral DiffusionPoster8 citations
  686. Efficient Transformer-based 3D Object Detection with Dynamic Token HaltingPoster8 citations
  687. Efficient Unified Demosaicing for Bayer and Non-Bayer Patterned Image SensorsPoster8 citations
  688. Exemplar-Free Continual Transformer with ConvolutionsPoster8 citations
  689. FSAR: Federated Skeleton-based Action Recognition with Adaptive Topology Structure and Knowledge DistillationPoster8 citations
  690. FedPD: Federated Open Set Recognition with Parameter DisentanglementPoster8 citations
  691. Few-Shot Physically-Aware Articulated Mesh Generation via Hierarchical DeformationPoster8 citations
  692. Frequency-aware GAN for Adversarial Manipulation GenerationPoster8 citations
  693. Fully Attentional Networks with Self-emerging Token LabelingPoster8 citations
  694. Generating Realistic Images from In-the-wild SoundsPoster8 citations
  695. Grounded Image Text Matching with Mismatched Relation ReasoningPoster8 citations
  696. HandR2N2: Iterative 3D Hand Pose Estimation Using a Residual Recurrent Neural NetworkPoster8 citations
  697. Householder Projector for Unsupervised Latent Semantics DiscoveryPoster8 citations
  698. Landscape Learning for Neural Network InversionPoster8 citations
  699. Learning Cross-Representation Affinity Consistency for Sparsely Supervised Biomedical Instance SegmentationPoster8 citations
  700. Learning Hierarchical Features with Joint Latent Space Energy-Based PriorPoster8 citations
  701. Learning Image Harmonization in the Linear Color SpacePoster8 citations
  702. Learning Robust Representations with Information Bottleneck and Memory Network for RGB-D-based Gesture RecognitionPoster8 citations
  703. Learning with Diversity: Self-Expanded Equalization for Better Generalized Deep Metric LearningPoster8 citations
  704. LightDepth: Single-View Depth Self-Supervision from Illumination DeclinePoster8 citations
  705. Linear-Covariance Loss for End-to-End Learning of 6D Pose EstimationPoster8 citations
  706. MULLER: Multilayer Laplacian Resizer for VisionPoster8 citations
  707. MapFormer: Boosting Change Detection by Using Pre-change InformationPoster8 citations
  708. Meta OOD Learning For Continuously Adaptive OOD DetectionPoster8 citations
  709. Minimal Solutions to Generalized Three-View Relative Pose ProblemOral8 citations
  710. Misalign, Contrast then Distill: Rethinking Misalignments in Language-Image Pre-trainingPoster8 citations
  711. MixBag: Bag-Level Data Augmentation for Learning from Label ProportionsPoster8 citations
  712. Multi-view Spectral Polarization Propagation for Video Glass SegmentationPoster8 citations
  713. OPERA: Omni-Supervised Representation Learning with Hierarchical SupervisionsPoster8 citations
  714. Omnidirectional Information Gathering for Knowledge Transfer-Based Audio-Visual NavigationPoster8 citations
  715. Ord2Seq: Regarding Ordinal Regression as Label Sequence PredictionPoster8 citations
  716. OrthoPlanes: A Novel Representation for Better 3D-Awareness of GANsPoster8 citations
  717. ParCNetV2: Oversized Kernel with Enhanced AttentionPoster8 citations
  718. Predict to Detect: Prediction-guided 3D Object Detection using Sequential ImagesPoster8 citations
  719. RIGID: Recurrent GAN Inversion and Editing of Real Face VideosPoster8 citations
  720. Sample-adaptive Augmentation for Point Cloud Recognition Against Real-world CorruptionsPoster8 citations
  721. SemARFlow: Injecting Semantics into Unsupervised Optical Flow Estimation for Autonomous DrivingPoster8 citations
  722. Simple Baselines for Interactive Video Retrieval with Questions and AnswersPoster8 citations
  723. Sparse Point Guided 3D Lane DetectionPoster8 citations
  724. Surface Extraction from Neural Unsigned Distance FieldsPoster8 citations
  725. Text-Driven Generative Domain Adaptation with Spectral Consistency RegularizationPoster8 citations
  726. Towards Better Robustness against Common Corruptions for Unsupervised Domain AdaptationPoster8 citations
  727. Towards Nonlinear-Motion-Aware and Occlusion-Robust Rolling Shutter CorrectionPoster8 citations
  728. Tracking without Label: Unsupervised Multiple Object Tracking via Contrastive Similarity LearningPoster8 citations
  729. Translating Images to Road Network: A Non-Autoregressive Sequence-to-Sequence ApproachOral8 citations
  730. Tuning Pre-trained Model via Moment ProbingPoster8 citations
  731. Unsupervised Feature Representation Learning for Domain-generalized Cross-domain Image RetrievalPoster8 citations
  732. VQA Therapy: Exploring Answer Differences by Visually Grounding AnswersPoster8 citations
  733. WALDO: Future Video Synthesis Using Object Layer Decomposition and Parametric Flow PredictionPoster8 citations
  734. 3D Motion Magnification: Visualizing Subtle Motions from Time-Varying Radiance FieldsPoster7 citations
  735. A Fast Unified System for 3D Object Detection and TrackingPoster7 citations
  736. A Retrospect to Multi-prompt Learning across Vision and LanguagePoster7 citations
  737. Adaptive Image Anonymization in the Context of Image Classification with Neural NetworksPoster7 citations
  738. Adaptive Nonlinear Latent Transformation for Conditional Face EditingPoster7 citations
  739. Adversarial Finetuning with Latent Representation Constraint to Mitigate Accuracy-Robustness TradeoffPoster7 citations
  740. Augmenting and Aligning Snippets for Few-Shot Video Domain AdaptationPoster7 citations
  741. BUS: Efficient and Effective Vision-Language Pre-Training with Bottom-Up Patch Summarization.Poster7 citations
  742. BallGAN: 3D-aware Image Synthesis with a Spherical BackgroundPoster7 citations
  743. BiFF: Bi-level Future Fusion with Polyline-based Coordinate for Interactive Trajectory PredictionPoster7 citations
  744. Building Vision Transformers with Hierarchy Aware Feature AggregationPoster7 citations
  745. CAD-Estate: Large-scale CAD Model Annotation in RGB VideosPoster7 citations
  746. CO-Net: Learning Multiple Point Cloud Tasks at Once with A Cohesive NetworkPoster7 citations
  747. COOP: Decoupling and Coupling of Whole-Body Grasping Pose GenerationPoster7 citations
  748. Chordal Averaging on Flag Manifolds and Its ApplicationsOral7 citations
  749. Compatibility of Fundamental Matrices for Complete Viewing GraphsPoster7 citations
  750. Convex Decomposition of Indoor ScenesPoster7 citations
  751. Convolutional Networks with Oriented 1D KernelsPoster7 citations
  752. Creative Birds: Self-Supervised Single-View 3D Style TransferPoster7 citations
  753. CrossLoc3D: Aerial-Ground Cross-Source 3D Place RecognitionPoster7 citations
  754. DR-Tune: Improving Fine-tuning of Pretrained Visual Models by Distribution Regularization with Semantic CalibrationPoster7 citations
  755. DandelionNet: Domain Composition with Instance Adaptive Classification for Domain GeneralizationPoster7 citations
  756. Data-free Knowledge Distillation for Fine-grained Visual CategorizationPoster7 citations
  757. Deep Equilibrium Object DetectionPoster7 citations
  758. Dense 2D-3D Indoor Prediction with Sound via Aligned Cross-Modal DistillationPoster7 citations
  759. Exploring Positional Characteristics of Dual-Pixel Data for Camera AutofocusPoster7 citations
  760. Fast and Accurate Transferability Measurement by Evaluating Intra-class Feature VariancePoster7 citations
  761. Few-Shot Common Action Localization via Cross-Attentional Fusion of Context and Temporal DynamicsPoster7 citations
  762. General Planar Motion from a Pair of 3D CorrespondencesOral7 citations
  763. Gram-based Attentive Neural Ordinary Differential Equations Network for Video Nystagmography ClassificationPoster7 citations
  764. Growing a Brain with Sparsity-Inducing Generation for Continual LearningPoster7 citations
  765. HairNeRF: Geometry-Aware Image Synthesis for Hairstyle TransferPoster7 citations
  766. Handwritten and Printed Text Segmentation: A Signature Case StudyPoster7 citations
  767. Hashing Neural Video Decomposition with Multiplicative Residuals in Space-TimePoster7 citations
  768. Human-Inspired Facial Sketch Synthesis with Dynamic AdaptationPoster7 citations
  769. IHNet: Iterative Hierarchical Network Guided by High-Resolution Estimated Information for Scene Flow EstimationPoster7 citations
  770. Identity-Consistent Aggregation for Video Object DetectionPoster7 citations
  771. Improved Visual Fine-tuning with Natural Language SupervisionOral7 citations
  772. Interactive Class-Agnostic Object CountingPoster7 citations
  773. Learning Adaptive Neighborhoods for Graph Neural NetworksPoster7 citations
  774. Learning Fine-Grained Features for Pixel-Wise Video CorrespondencesPoster7 citations
  775. Learning Point Cloud Completion without Complete Point Clouds: A Pose-Aware ApproachPoster7 citations
  776. Leveraging Intrinsic Properties for Non-Rigid Garment AlignmentPoster7 citations
  777. Local Context-Aware Active Domain AdaptationPoster7 citations
  778. MHEntropy: Entropy Meets Multiple Hypotheses for Pose and Shape RecoveryPoster7 citations
  779. MetaF2N: Blind Image Super-Resolution by Learning Efficient Model Adaptation from FacesPoster7 citations
  780. OCHID-Fi: Occlusion-Robust Hand Pose Estimation in 3D via RF-VisionPoster7 citations
  781. OmnimatteRF: Robust Omnimatte with 3D Background ModelingPoster7 citations
  782. Open-vocabulary Video Question Answering: A New Benchmark for Evaluating the Generalizability of Video Question Answering ModelsPoster7 citations
  783. PARF: Primitive-Aware Radiance Fusion for Indoor Scene Novel View SynthesisPoster7 citations
  784. Passive Ultra-Wideband Single-Photon ImagingOral7 citations
  785. Plausible Uncertainties for Human Pose RegressionPoster7 citations
  786. Replay: Multi-modal Multi-view Acted Videos for Casual HolographyPoster7 citations
  787. Revisit PCA-based Technique for Out-of-Distribution DetectionPoster7 citations
  788. SUMMIT: Source-Free Adaptation of Uni-Modal Models to Multi-Modal TargetsPoster7 citations
  789. Semantics-Consistent Feature Search for Self-Supervised Visual Representation LearningPoster7 citations
  790. Shift from Texture-bias to Shape-bias: Edge Deformation-based Augmentation for Robust Object RecognitionPoster7 citations
  791. Single Depth-image 3D Reflection Symmetry and Shape PredictionPoster7 citations
  792. Test-time Personalizable Forecasting of 3D Human PosesPoster7 citations
  793. Theoretical and Numerical Analysis of 3D Reconstruction Using Point and Line IncidencesPoster7 citations
  794. Towards Universal LiDAR-Based 3D Object Detection by Multi-Domain Knowledge TransferPoster7 citations
  795. Unaligned 2D to 3D Translation with Conditional Vector-Quantized Code Diffusion using TransformersPoster7 citations
  796. Unfolding Framework with Prior of Convolution-Transformer Mixture and Uncertainty Estimation for Video Snapshot Compressive ImagingPoster7 citations
  797. Unsupervised Open-Vocabulary Object Localization in VideosPoster7 citations
  798. Video Task Decathlon: Unifying Image and Video Tasks in Autonomous DrivingPoster7 citations
  799. WDiscOOD: Out-of-Distribution Detection via Whitened Linear Discriminant AnalysisPoster7 citations
  800. WaveIPT: Joint Attention and Flow Alignment in the Wavelet domain for Pose TransferPoster7 citations
  801. Weakly-supervised 3D Pose Transfer with KeypointsPoster7 citations
  802. 3D Instance Segmentation via Enhanced Spatial and Semantic SupervisionPoster6 citations
  803. A Complete Recipe for Diffusion Generative ModelsOral6 citations
  804. A2Q: Accumulator-Aware Quantization with Guaranteed Overflow AvoidancePoster6 citations
  805. ASM: Adaptive Skinning Model for High-Quality 3D Face ModelingPoster6 citations
  806. Audio-Visual Glance Network for Efficient Video RecognitionPoster6 citations
  807. BT^2: Backward-compatible Training with Basis TransformationPoster6 citations
  808. Both Diverse and Realism Matter: Physical Attribute and Style Alignment for Rainy Image GenerationPoster6 citations
  809. Breaking Temporal Consistency: Generating Video Universal Adversarial Perturbations Using Image ModelsPoster6 citations
  810. Building a Winning Team: Selecting Source Model Ensembles using a Submodular Transferability Estimation ApproachPoster6 citations
  811. CO-PILOT: Dynamic Top-Down Point Cloud with Conditional Neighborhood Aggregation for Multi-Gigapixel Histopathology Image RepresentationPoster6 citations
  812. Causal-DFQ: Causality Guided Data-Free Network QuantizationPoster6 citations
  813. ClothPose: A Real-world Benchmark for Visual Analysis of Garment Pose via An Indirect Recording SolutionOral6 citations
  814. Consistent Depth Prediction for Transparent Object Reconstruction from RGB-D CameraPoster6 citations
  815. Continual Learning for Personalized Co-speech Gesture GenerationPoster6 citations
  816. Continual Zero-Shot Learning through Semantically Guided Generative Random WalksPoster6 citations
  817. Contrastive Continuity on Augmentation Stability Rehearsal for Continual Self-Supervised LearningPoster6 citations
  818. DarSwin: Distortion Aware Radial Swin TransformerPoster6 citations
  819. Democratising 2D Sketch to 3D Shape Retrieval Through PivotingPoster6 citations
  820. Efficient Controllable Multi-Task ArchitecturesPoster6 citations
  821. Efficient Discovery and Effective Evaluation of Visual Perceptual Similarity: A Benchmark and BeyondPoster6 citations
  822. Extensible and Efficient Proxy for Neural Architecture SearchPoster6 citations
  823. Foreground Object Search by Distilling Composite Image FeaturePoster6 citations
  824. Geometry-guided Feature Learning and Fusion for Indoor Scene ReconstructionPoster6 citations
  825. HSE: Hybrid Species Embedding for Deep Metric LearningPoster6 citations
  826. Heterogeneous Diversity Driven Active Learning for Multi-Object TrackingPoster6 citations
  827. HiVLP: Hierarchical Interactive Video-Language Pre-TrainingPoster6 citations
  828. Hierarchical Contrastive Learning for Pattern-Generalizable Image Corruption Detection6 citations
  829. ICD-Face: Intra-class Compactness Distillation for Face RecognitionPoster6 citations
  830. Improving Representation Learning for Histopathologic Images with Cluster ConstraintsPoster6 citations
  831. Interaction-aware Joint Attention Estimation Using People AttributesPoster6 citations
  832. Knowledge Proxy Intervention for Deconfounded Video Question AnsweringPoster6 citations
  833. LeaF: Learning Frames for 4D Point Cloud Sequence UnderstandingPoster6 citations
  834. Learning Trajectory-Word Alignments for Video-Language TasksPoster6 citations
  835. Lossy and Lossless (L2) Post-training Model Size CompressionPoster6 citations
  836. MPI-Flow: Learning Realistic Optical Flow with Multiplane ImagesPoster6 citations
  837. MixCycle: Mixup Assisted Semi-Supervised 3D Single Object Tracking with Cycle ConsistencyPoster6 citations
  838. Multi-body Depth and Camera Pose Estimation from Multiple ViewsPoster6 citations
  839. Neural Deformable Models for 3D Bi-Ventricular Heart Shape Reconstruction and Modeling from 2D Sparse Cardiac Magnetic Resonance ImagingPoster6 citations
  840. Online Continual Learning on Hierarchical Label ExpansionPoster6 citations
  841. PHRIT: Parametric Hand Representation with Implicit TemplatePoster6 citations
  842. Personalized Image Generation for Color Vision Deficiency PopulationPoster6 citations
  843. Physically-Plausible Illumination Distribution EstimationPoster6 citations
  844. PourIt!: Weakly-Supervised Liquid Perception from a Single Image for Visual Closed-Loop Robotic PouringPoster6 citations
  845. Preserving Modality Structure Improves Multi-Modal LearningPoster6 citations
  846. Preserving Tumor Volumes for Unsupervised Medical Image RegistrationPoster6 citations
  847. RLSAC: Reinforcement Learning Enhanced Sample Consensus for End-to-End Robust EstimationPoster6 citations
  848. Ray Conditioning: Trading Photo-consistency for Photo-realism in Multi-view Image GenerationPoster6 citations
  849. ReactioNet: Learning High-Order Facial Behavior from Universal Stimulus-Reaction by Dyadic Relation ReasoningPoster6 citations
  850. Rethinking Video Frame Interpolation from Shutter Mode Induced DegradationPoster6 citations
  851. Revisiting Vision Transformer from the View of Path EnsembleOral6 citations
  852. Robust Geometry-Preserving Depth Estimation Using Differentiable RenderingPoster6 citations
  853. SSF: Accelerating Training of Spiking Neural Networks with Stabilized Spiking FlowPoster6 citations
  854. Semantic-Aware Dynamic Parameter for Video Inpainting TransformerPoster6 citations
  855. Semantify: Simplifying the Control of 3D Morphable Models Using CLIPPoster6 citations
  856. Single Image Deblurring with Row-dependent Blur MagnitudePoster6 citations
  857. SlaBins: Fisheye Depth Estimation using Slanted Bins on Road EnvironmentsPoster6 citations
  858. Task-Oriented Multi-Modal Mutual Leaning for Vision-Language ModelsPoster6 citations
  859. Tiled Multiplane Images for Practical 3D PhotographyPoster6 citations
  860. Token-Label Alignment for Vision TransformersPoster6 citations
  861. Towards Fairness-aware Adversarial Network PruningPoster6 citations
  862. Unleashing the Power of Gradient Signal-to-Noise Ratio for Zero-Shot NASPoster6 citations
  863. Unsupervised Self-Driving Attention Prediction via Uncertainty Mining and Knowledge EmbeddingPoster6 citations
  864. VertexSerum: Poisoning Graph Neural Networks for Link InferencePoster6 citations
  865. Video Action Segmentation via Contextually Refined Temporal KeypointsPoster6 citations
  866. Video Object Segmentation-aware Video Frame InterpolationPoster6 citations
  867. Viewing Graph Solvability in PracticeOral6 citations
  868. Workie-Talkie: Accelerating Federated Learning by Overlapping Computing and Communications via Contrastive RegularizationPoster6 citations
  869. Yes, we CANN: Constrained Approximate Nearest Neighbors for Local Feature-Based Visual LocalizationPoster6 citations
  870. iVS-Net: Learning Human View Synthesis from Internet VideosPoster6 citations
  871. 3D-Aware Generative Model for Improved Side-View Image SynthesisPoster5 citations
  872. 4D Myocardium Reconstruction with Decoupled Motion and Shape ModelPoster5 citations
  873. Algebraically Rigorous Quaternion Framework for the Neural Network Pose Estimation ProblemPoster5 citations
  874. Atmospheric Transmission and Thermal Inertia Induced Blind Road Segmentation with a Large-Scale Dataset TBRSDPoster5 citations
  875. Backpropagation Path Search On Adversarial TransferabilityPoster5 citations
  876. Benchmarking and Analyzing Robust Point Cloud Recognition: Bag of Tricks for Defending Adversarial ExamplesPoster5 citations
  877. Better May Not Be Fairer: A Study on Subgroup Discrepancy in Image ClassificationPoster5 citations
  878. BlindHarmony: "Blind" Harmonization for MR Images via Flow ModelPoster5 citations
  879. Boosting Long-tailed Object Detection via Step-wise Learning on Smooth-tail DataPoster5 citations
  880. COMPASS: High-Efficiency Deep Image Compression with Arbitrary-scale Spatial ScalabilityPoster5 citations
  881. Conceptual and Hierarchical Latent Space Decomposition for Face EditingPoster5 citations
  882. Coordinate Transformer: Achieving Single-stage Multi-person Mesh Recovery from VideosPoster5 citations
  883. DMNet: Delaunay Meshing Network for 3D Shape RepresentationPoster5 citations
  884. DeePoint: Visual Pointing Recognition and Direction EstimationPoster5 citations
  885. Domain Generalization Guided by Gradient Signal to Noise Ratio of ParametersPoster5 citations
  886. Efficient Deep Space Filling CurvePoster5 citations
  887. Efficiently Robustify Pre-Trained ModelsPoster5 citations
  888. Enhancing Adversarial Robustness in Low-Label Regime via Adaptively Weighted Regularization and Knowledge DistillationPoster5 citations
  889. Essential Matrix Estimation using Convex Relaxations in Orthogonal SpacePoster5 citations
  890. Exploring the Sim2Real Gap Using Digital TwinsPoster5 citations
  891. FCCNs: Fully Complex-valued Convolutional Networks using Complex-valued Color Model and Loss FunctionPoster5 citations
  892. Flexible Visual Recognition by Evidential Modeling of Confusion and IgnorancePoster5 citations
  893. GeT: Generative Target Structure Debiasing for Domain AdaptationPoster5 citations
  894. Generalized Sum Pooling for Metric LearningPoster5 citations
  895. Gramian Attention Heads are Strong yet Efficient Vision LearnersPoster5 citations
  896. GrowCLIP: Data-Aware Automatic Model Growing for Large-scale Contrastive Language-Image Pre-TrainingPoster5 citations
  897. Homography Guided Temporal Fusion for Road Line and Marking SegmentationPoster5 citations
  898. Iterative Soft Shrinkage Learning for Efficient Image Super-ResolutionPoster5 citations
  899. Joint Implicit Neural Representation for High-fidelity and Compact Vector FontsPoster5 citations
  900. Learning Data-Driven Vector-Quantized Degradation Model for Animation Video Super-ResolutionPoster5 citations
  901. Learning to Learn: How to Continuously Teach Humans and MachinesPoster5 citations
  902. MIMO-NeRF: Fast Neural Rendering with Multi-input Multi-output Neural Radiance FieldsPoster5 citations
  903. Mining bias-target Alignment from Voronoi CellsPoster5 citations
  904. ModelGiF: Gradient Fields for Model Functional DistancePoster5 citations
  905. MoreauGrad: Sparse and Robust Interpretation of Neural Networks via Moreau EnvelopePoster5 citations
  906. MotionDeltaCNN: Sparse CNN Inference of Frame Differences in Moving Camera Videos with Spherical Buffers and Padded ConvolutionsPoster5 citations
  907. Multi-task View Synthesis with Neural Radiance FieldsPoster5 citations
  908. Multimodal High-order Relation Transformer for Scene Boundary DetectionPoster5 citations
  909. Neglected Free Lunch - Learning Image Classifiers Using Annotation ByproductsPoster5 citations
  910. Not Every Side Is Equal: Localization Uncertainty Estimation for Semi-Supervised 3D Object DetectionPoster5 citations
  911. ORC: Network Group-based Knowledge Distillation using Online Role ChangePoster5 citations
  912. Objects Do Not Disappear: Video Object Detection by Single-Frame Object Location AnticipationPoster5 citations
  913. Open Set Video HOI detection from Action-Centric Chain-of-Look PromptingPoster5 citations
  914. Ordered Atomic Activity for Fine-grained Interactive Traffic Scenario UnderstandingPoster5 citations
  915. PIRNet: Privacy-Preserving Image Restoration Network via Wavelet LiftingPoster5 citations
  916. Pixel-Wise Contrastive DistillationPoster5 citations
  917. PlanarTrack: A Large-scale Challenging Benchmark for Planar Object TrackingPoster5 citations
  918. PlankAssembly: Robust 3D Reconstruction from Three Orthographic Views with Learnt Shape ProgramsPoster5 citations
  919. Probabilistic Precision and Recall Towards Reliable Evaluation of Generative ModelsPoster5 citations
  920. Prototypical Mixing and Retrieval-Based Refinement for Label Noise-Resistant Image RetrievalPoster5 citations
  921. RCA-NOC: Relative Contrastive Alignment for Novel Object CaptioningPoster5 citations
  922. Recovering a Molecule's 3D Dynamics from Liquid-phase Electron Microscopy MoviesPoster5 citations
  923. RecursiveDet: End-to-End Region-Based Recursive Object DetectionPoster5 citations
  924. Regularized Primitive Graph Learning for Unified Vector MappingPoster5 citations
  925. SEFD: Learning to Distill Complex Pose and OcclusionPoster5 citations
  926. SEMPART: Self-supervised Multi-resolution Partitioning of Image SemanticsPoster5 citations
  927. SFHarmony: Source Free Domain Adaptation for Distributed Neuroimaging AnalysisPoster5 citations
  928. SIDGAN: High-Resolution Dubbed Video Generation via Shift-Invariant LearningPoster5 citations
  929. SINC: Self-Supervised In-Context Learning for Vision-Language TasksPoster5 citations
  930. SYENet: A Simple Yet Effective Network for Multiple Low-Level Vision Tasks with Real-Time Performance on Mobile DevicePoster5 citations
  931. Self-supervised Learning to Bring Dual Reversed Rolling Shutter Images AlivePoster5 citations
  932. Shape Anchor Guided Holistic Indoor Scene UnderstandingPoster5 citations
  933. SpaceEvo: Hardware-Friendly Search Space Design for Efficient INT8 InferencePoster5 citations
  934. SparseMAE: Sparse Training Meets Masked AutoencodersPoster5 citations
  935. Spatio-temporal Prompting Network for Robust Video Feature ExtractionPoster5 citations
  936. Text-Conditioned Sampling Framework for Text-to-Image Generation with Masked Generative ModelsPoster5 citations
  937. The Victim and The Beneficiary: Exploiting a Poisoned Model to Train a Clean Model on Poisoned DataOral5 citations
  938. Time-to-Contact Map by Joint Estimation of Up-to-Scale Inverse Depth and Global Motion using a Single Event CameraPoster5 citations
  939. Tracing the Origin of Adversarial Attack for Forensic Investigation and DeterrencePoster5 citations
  940. VADER: Video Alignment Differencing and RetrievalPoster5 citations
  941. VL-Match: Enhancing Vision-Language Pretraining with Token-Level and Instance-Level MatchingPoster5 citations
  942. View Consistent Purification for Accurate Cross-View LocalizationPoster5 citations
  943. You Never Get a Second Chance To Make a Good First Impression: Seeding Active Learning for 3D Semantic SegmentationPoster5 citations
  944. 3D Neural Embedding Likelihood: Probabilistic Inverse Graphics for Robust 6D Pose EstimationPoster4 citations
  945. Aperture Diffraction for Compact Snapshot Spectral ImagingPoster4 citations
  946. Beyond the Limitation of Monocular 3D Detector via Knowledge DistillationPoster4 citations
  947. Chaotic World: A Large and Challenging Benchmark for Human Behavior Understanding in Chaotic EventsPoster4 citations
  948. Cloth2Body: Generating 3D Human Body Mesh from 2D ClothingPoster4 citations
  949. Complementary Domain Adaptation and Generalization for Unsupervised Continual Domain Shift LearningPoster4 citations
  950. Cross-modal Latent Space Alignment for Image to Avatar TranslationPoster4 citations
  951. Cross-view Semantic Alignment for Livestreaming Product RecognitionPoster4 citations
  952. DCPB: Deformable Convolution Based on the Poincare Ball for Top-view Fisheye CamerasPoster4 citations
  953. DISeR: Designing Imaging Systems with Reinforcement LearningPoster4 citations
  954. DeLiRa: Self-Supervised Depth, Light, and Radiance FieldsPoster4 citations
  955. DetermiNet: A Large-Scale Diagnostic Dataset for Complex Visually-Grounded Referencing using DeterminersPoster4 citations
  956. Distributed Bundle Adjustment with Block-Based Sparse Matrix Compression for Super Large Scale DatasetsPoster4 citations
  957. Domain Adaptive Few-Shot Open-Set LearningPoster4 citations
  958. Efficient LiDAR Point Cloud Oversegmentation NetworkPoster4 citations
  959. Exploring Temporal Concurrency for Video-Language Representation LearningPoster4 citations
  960. Fan-Beam Binarization Difference Projection (FB-BDP): A Novel Local Object Descriptor for Fine-Grained Leaf Image RetrievalPoster4 citations
  961. GACE: Geometry Aware Confidence Enhancement for Black-Box 3D Object Detectors on LiDAR-DataPoster4 citations
  962. GaPro: Box-Supervised 3D Point Cloud Instance Segmentation Using Gaussian Processes as Pseudo LabelersPoster4 citations
  963. Generalizable Neural Fields as Partially Observed Neural ProcessesPoster4 citations
  964. Guiding Local Feature Matching with Surface CurvaturePoster4 citations
  965. HDG-ODE: A Hierarchical Continuous-Time Model for Human Pose ForecastingPoster4 citations
  966. IIEU: Rethinking Neural Feature Activation from Decision-MakingPoster4 citations
  967. Improved Knowledge Transfer for Semi-Supervised Domain Adaptation via Trico Training StrategyPoster4 citations
  968. In-Style: Bridging Text and Uncurated Videos with Style Transfer for Text-Video RetrievalPoster4 citations
  969. LIST: Learning Implicitly from Spatial Transformers for Single-View 3D ReconstructionPoster4 citations
  970. Learned Compressive Representations for Single-Photon 3D ImagingPoster4 citations
  971. LivePose: Online 3D Reconstruction from Monocular Video with Dynamic Camera PosesOral4 citations
  972. MEGA: Multimodal Alignment Aggregation and Distillation For Cinematic Video SegmentationPoster4 citations
  973. MST-compression: Compressing and Accelerating Binary Neural Networks with Minimum Spanning TreePoster4 citations
  974. Markov Game Video Augmentation for Action SegmentationPoster4 citations
  975. Model Calibration in Dense Classification with Adaptive Label PerturbationPoster4 citations
  976. Moment Detection in Long Tutorial VideosPoster4 citations
  977. NeSS-ST: Detecting Good and Stable Keypoints with a Neural Stability Score and the Shi-Tomasi detectorPoster4 citations
  978. Occ^2Net: Robust Image Matching Based on 3D Occupancy Estimation for Occluded RegionsPoster4 citations
  979. Order-Prompted Tag Sequence Generation for Video TaggingPoster4 citations
  980. Out-of-Distribution Detection for Monocular Depth EstimationPoster4 citations
  981. Out-of-Domain GAN Inversion via Invertibility Decomposition for Photo-Realistic Human Face ManipulationPoster4 citations
  982. Overcoming Forgetting Catastrophe in Quantization-Aware TrainingPoster4 citations
  983. Panoramas from PhotonsPoster4 citations
  984. Preparing the Future for Continual Semantic SegmentationOral4 citations
  985. Privacy Preserving Localization via Coordinate PermutationsPoster4 citations
  986. Prototype-based Dataset ComparisonPoster4 citations
  987. RED-PSM: Regularization by Denoising of Partially Separable Models for Dynamic ImagingPoster4 citations
  988. RFD-ECNet: Extreme Underwater Image Compression with Reference to Feature DictionaryPoster4 citations
  989. Rapid Network Adaptation: Learning to Adapt Neural Networks Using Test-Time FeedbackPoster4 citations
  990. ResQ: Residual Quantization for Video PerceptionPoster4 citations
  991. Rethinking Amodal Video Segmentation from Learning Supervised Signals with Object-centric RepresentationPoster4 citations
  992. SOCS: Semantically-Aware Object Coordinate Space for Category-Level 6D Object Pose Estimation under Large Shape VariationsPoster4 citations
  993. Segmentation of Tubular Structures Using Iterative Training with Tailored SamplesPoster4 citations
  994. Semantic-Aware Implicit Template Learning via Part Deformation ConsistencyPoster4 citations
  995. Simple and Effective Out-of-Distribution Detection via Cosine-based Softmax LossPoster4 citations
  996. Smoothness Similarity Regularization for Few-Shot GAN AdaptationPoster4 citations
  997. Spatio-Temporal Crop Aggregation for Video Representation LearningPoster4 citations
  998. Spectral Graphormer: Spectral Graph-Based Transformer for Egocentric Two-Hand Reconstruction using Multi-View Color ImagesPoster4 citations
  999. Stabilizing Visual Reinforcement Learning via Asymmetric Interactive CooperationPoster4 citations
  1000. Strata-NeRF : Neural Radiance Fields for Stratified ScenesPoster4 citations

Looking for submission deadlines instead? See the conference deadline calendar.