← All conferences

CVPR 2024 Accepted Papers

The full list of 2,640 papers accepted at CVPR 2024 (IEEE/CVF Conference on Computer Vision and Pattern Recognition). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Poster: 2,323Highlight: 317
  1. Reg-PTQ: Regression-specialized Post-training Quantization for Fully Quantized Object DetectorPoster5 citations
  2. Revisiting Counterfactual Problems in Referring Expression ComprehensionPoster5 citations
  3. Robust Distillation via Untargeted and Targeted Intermediate Adversarial SamplesPoster5 citations
  4. Robust Overfitting Does Matter: Test-Time Adversarial Purification With FGSMPoster5 citations
  5. SCULPT: Shape-Conditioned Unpaired Learning of Pose-dependent Clothed and Textured Human MeshesPoster5 citations
  6. SG-PGM: Partial Graph Matching Network with Semantic Geometric Fusion for 3D Scene Graph Alignment and Its Downstream TasksPoster5 citations
  7. SURE: SUrvey REcipes for building reliable and robust deep networksPoster5 citations
  8. SVDinsTN: A Tensor Network Paradigm for Efficient Structure Search from Regularized Modeling PerspectiveHighlight5 citations
  9. ScoreHypo: Probabilistic Human Mesh Estimation with Hypothesis ScoringPoster5 citations
  10. Segment Any Event Streams via Weighted Adaptation of Pivotal TokensPoster5 citations
  11. Semantics-aware Motion Retargeting with Vision-Language ModelsPoster5 citations
  12. Sharingan: A Transformer Architecture for Multi-Person Gaze FollowingPoster5 citations
  13. Stable Neighbor Denoising for Source-free Domain Adaptive SegmentationPoster5 citations
  14. Step Differences in Instructional VideoPoster5 citations
  15. Strong Transferable Adversarial Attacks via Ensembled Asymptotically Normal Distribution LearningHighlight5 citations
  16. Summarize the Past to Predict the Future: Natural Language Descriptions of Context Boost Multimodal Object Interaction AnticipationPoster5 citations
  17. Task-Adaptive Saliency Guidance for Exemplar-free Class Incremental LearningPoster5 citations
  18. TexVocab: Texture Vocabulary-conditioned Human AvatarsPoster5 citations
  19. TextNeRF: A Novel Scene-Text Image Synthesis Method based on Neural Radiance FieldsPoster5 citations
  20. The Unreasonable Effectiveness of Pre-Trained Features for Camera Pose RefinementHighlight5 citations
  21. Total-Decom: Decomposed 3D Scene Reconstruction with Minimal InteractionHighlight5 citations
  22. Towards Fairness-Aware Adversarial LearningPoster5 citations
  23. Tri-Modal Motion Retrieval by Learning a Joint Embedding SpaceHighlight5 citations
  24. TurboSL: Dense Accurate and Fast 3D by Neural Inverse Structured LightPoster5 citations
  25. USE: Universal Segment Embeddings for Open-Vocabulary Image SegmentationPoster5 citations
  26. Uncertainty-Aware Source-Free Adaptive Image Super-Resolution with Wavelet Augmentation TransformerPoster5 citations
  27. Unexplored Faces of Robustness and Out-of-Distribution: Covariate Shifts in Environment and Sensor DomainsPoster5 citations
  28. Ungeneralizable ExamplesPoster5 citations
  29. Unleashing Network Potentials for Semantic Scene CompletionPoster5 citations
  30. VA3: Virtually Assured Amplification Attack on Probabilistic Copyright Protection for Text-to-Image Generative ModelsHighlight5 citations
  31. Vanishing-Point-Guided Video Semantic Segmentation of Driving ScenesHighlight5 citations
  32. Video Recognition in Portrait ModePoster5 citations
  33. View From Above: Orthogonal-View aware Cross-view LocalizationPoster5 citations
  34. ViewFusion: Towards Multi-View Consistency via Interpolated DenoisingPoster5 citations
  35. Visual Layout Composer: Image-Vector Dual Diffusion Model for Design Layout GenerationPoster5 citations
  36. Weak-to-Strong 3D Object Detection with X-Ray DistillationPoster5 citations
  37. When Visual Grounding Meets Gigapixel-level Large-scale Scenes: Benchmark and ApproachPoster5 citations
  38. YolOOD: Utilizing Object Detection Concepts for Multi-Label Out-of-Distribution DetectionPoster5 citations
  39. 2S-UDF: A Novel Two-stage UDF Learning Method for Robust Non-watertight Model Reconstruction from Multi-view ImagesPoster4 citations
  40. A&B BNN: Add&Bit-Operation-Only Hardware-Friendly Binary Neural NetworkPoster4 citations
  41. ACT-Diffusion: Efficient Adversarial Consistency Training for One-step Diffusion ModelsPoster4 citations
  42. Active Domain Adaptation with False Negative Prediction for Object DetectionHighlight4 citations
  43. Active Open-Vocabulary Recognition: Let Intelligent Moving Mitigate CLIP LimitationsPoster4 citations
  44. Align and Aggregate: Compositional Reasoning with Video Alignment and Answer Aggregation for Video Question-AnsweringPoster4 citations
  45. Anatomically Constrained Implicit Face ModelsPoster4 citations
  46. Artist-Friendly Relightable and Animatable Neural HeadsPoster4 citations
  47. Atom-Level Optical Chemical Structure Recognition with Limited SupervisionPoster4 citations
  48. BerfScene: Bev-conditioned Equivariant Radiance Fields for Infinite 3D Scene GenerationPoster4 citations
  49. Boosting Adversarial Training via Fisher-Rao Norm-based RegularizationPoster4 citations
  50. Building a Strong Pre-Training Baseline for Universal 3D Large-Scale PerceptionPoster4 citations
  51. CAMEL: CAusal Motion Enhancement Tailored for Lifting Text-driven Video EditingPoster4 citations
  52. CN-RMA: Combined Network with Ray Marching Aggregation for 3D Indoor Object Detection from Multi-view ImagesPoster4 citations
  53. CPR-Coach: Recognizing Composite Error Actions based on Single-class TrainingPoster4 citations
  54. CaKDP: Category-aware Knowledge Distillation and Pruning Framework for Lightweight 3D Object DetectionPoster4 citations
  55. Content-Style Decoupling for Unsupervised Makeup Transfer without Generating Pseudo Ground TruthPoster4 citations
  56. Cross Initialization for Face Personalization of Text-to-Image ModelsPoster4 citations
  57. CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head GenerationPoster4 citations
  58. DMR: Decomposed Multi-Modality Representations for Frames and Events Fusion in Visual Reinforcement LearningPoster4 citations
  59. DUDF: Differentiable Unsigned Distance Fields with Hyperbolic ScalingPoster4 citations
  60. DYSON: Dynamic Feature Space Self-Organization for Online Task-Free Class Incremental LearningPoster4 citations
  61. Deep Imbalanced Regression via Hierarchical Classification AdjustmentPoster4 citations
  62. Density-Guided Semi-Supervised 3D Semantic Segmentation with Dual-Space Hardness SamplingPoster4 citations
  63. Design2Cloth: 3D Cloth Generation from 2D MasksPoster4 citations
  64. Device-Wise Federated Network PruningPoster4 citations
  65. DiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language ModelPoster4 citations
  66. Discriminability-Driven Channel Selection for Out-of-Distribution DetectionPoster4 citations
  67. Discriminative Pattern Calibration Mechanism for Source-Free Domain AdaptationPoster4 citations
  68. Distilling ODE Solvers of Diffusion Models into Smaller StepsPoster4 citations
  69. Don't Look into the Dark: Latent Codes for Pluralistic Image InpaintingPoster4 citations
  70. Dr2Net: Dynamic Reversible Dual-Residual Networks for Memory-Efficient FinetuningPoster4 citations
  71. Dual-Consistency Model Inversion for Non-Exemplar Class Incremental LearningPoster4 citations
  72. Dual-Scale Transformer for Large-Scale Single-Pixel ImagingPoster4 citations
  73. EFHQ: Multi-purpose ExtremePose-Face-HQ datasetPoster4 citations
  74. ESCAPE: Encoding Super-keypoints for Category-Agnostic Pose EstimationPoster4 citations
  75. EarthLoc: Astronaut Photography Localization by Indexing Earth from SpacePoster4 citations
  76. Edge-Aware 3D Instance Segmentation Network with Intelligent Semantic PriorPoster4 citations
  77. Edit One for All: Interactive Batch Image EditingPoster4 citations
  78. Efficient Stitchable Task AdaptationPoster4 citations
  79. Efficient and Effective Weakly-Supervised Action Segmentation via Action-Transition-Aware Boundary AlignmentPoster4 citations
  80. Ensemble Diversity Facilitates Adversarial TransferabilityPoster4 citations
  81. Entangled View-Epipolar Information Aggregation for Generalizable Neural Radiance FieldsPoster4 citations
  82. Entity-NeRF: Detecting and Removing Moving Entities in Urban ScenesPoster4 citations
  83. Exact Fusion via Feature Distribution Matching for Few-shot Image GenerationPoster4 citations
  84. Exploring Pose-Aware Human-Object Interaction via Hybrid LearningPoster4 citations
  85. FAR: Flexible Accurate and Robust 6DoF Relative Camera Pose EstimationHighlight4 citations
  86. FaceChain-SuDe: Building Derived Class to Inherit Category Attributes for One-shot Subject-Driven GenerationPoster4 citations
  87. Fixed Point Diffusion ModelsPoster4 citations
  88. Fully Geometric Panoramic LocalizationPoster4 citations
  89. GOV-NeSF: Generalizable Open-Vocabulary Neural Semantic FieldsPoster4 citations
  90. Gear-NeRF: Free-Viewpoint Rendering and Tracking with Motion-aware Spatio-Temporal SamplingHighlight4 citations
  91. Generalizable Novel-View Synthesis using a Stereo CameraPoster4 citations
  92. Generalized Event CamerasPoster4 citations
  93. Generate Like Experts: Multi-Stage Font Generation by Incorporating Font Transfer Process into Diffusion ModelsPoster4 citations
  94. GeoReF: Geometric Alignment Across Shape Variation for Category-level Object Pose RefinementPoster4 citations
  95. HDQMF: Holographic Feature Decomposition Using Quantum AlgorithmsPoster4 citations
  96. HandDiff: 3D Hand Pose Estimation with Diffusion on Image-Point CloudHighlight4 citations
  97. Hearing Anything AnywherePoster4 citations
  98. HumanNeRF-SE: A Simple yet Effective Approach to Animate HumanNeRF with Diverse PosesPoster4 citations
  99. Hybrid Proposal Refiner: Revisiting DETR Series from the Faster R-CNN PerspectivePoster4 citations
  100. Improving Physics-Augmented Continuum Neural Radiance Field-Based Geometry-Agnostic System Identification with Lagrangian Particle OptimizationPoster4 citations
  101. In Search of a Data Transformation That Accelerates Neural Field TrainingPoster4 citations
  102. Instance Tracking in 3D Scenes from Egocentric VideosPoster4 citations
  103. Integrating Efficient Optimal Transport and Functional Maps For Unsupervised Shape Correspondence LearningPoster4 citations
  104. JointSQ: Joint Sparsification-Quantization for Distributed LearningPoster4 citations
  105. LASA: Instance Reconstruction from Real Scans using A Large-scale Aligned Shape Annotation DatasetPoster4 citations
  106. LUWA Dataset: Learning Lithic Use-Wear Analysis on Microscopic ImagesHighlight4 citations
  107. Language-conditioned Detection TransformerPoster4 citations
  108. Leak and Learn: An Attacker's Cookbook to Train Using Leaked Data from Federated LearningPoster4 citations
  109. Learning Adaptive Spatial Coherent Correlations for Speech-Preserving Facial Expression ManipulationHighlight4 citations
  110. Learning Degradation-unaware Representation with Prior-based Latent Transformations for Blind Face RestorationPoster4 citations
  111. Learning Discriminative Dynamics with Label Corruption for Noisy Label DetectionPoster4 citations
  112. Learning from Synthetic Human Group ActivitiesPoster4 citations
  113. Learning with Structural Labels for Learning with Noisy LabelsPoster4 citations
  114. Learning with Unreliability: Fast Few-shot Voxel Radiance Fields with Relative Geometric ConsistencyPoster4 citations
  115. Looking Similar Sounding Different: Leveraging Counterfactual Cross-Modal Pairs for Audiovisual Representation LearningPoster4 citations
  116. Low-Rank Knowledge Decomposition for Medical Foundation ModelsPoster4 citations
  117. MAFA: Managing False Negatives for Vision-Language Pre-trainingPoster4 citations
  118. MAGICK: A Large-scale Captioned Dataset from Matting Generated Images using Chroma KeyingPoster4 citations
  119. MAP: MAsk-Pruning for Source-Free Model Intellectual Property ProtectionPoster4 citations
  120. MMSum: A Dataset for Multimodal Summarization and Thumbnail Generation of VideosHighlight4 citations
  121. MaskINT: Video Editing via Interpolative Non-autoregressive Masked TransformersPoster4 citations
  122. MaskPLAN: Masked Generative Layout Planning from Partial InputPoster4 citations
  123. Masked AutoDecoder is Effective Multi-Task Vision GeneralistPoster4 citations
  124. Memory-Scalable and Simplified Functional Map LearningPoster4 citations
  125. Meta-Point Learning and Refining for Category-Agnostic Pose EstimationPoster4 citations
  126. Motion Diversification NetworksPoster4 citations
  127. Multi-agent Collaborative Perception via Motion-aware Robust Communication NetworkPoster4 citations
  128. Multiview Aerial Visual RECognition (MAVREC): Can Multi-view Improve Aerial Visual Perception?Poster4 citations
  129. Navigating Beyond Dropout: An Intriguing Solution towards Generalizable Image Super ResolutionPoster4 citations
  130. NeLF-Pro: Neural Light Field Probes for Multi-Scale Novel View SynthesisPoster4 citations
  131. Neural Visibility Field for Uncertainty-Driven Active MappingPoster4 citations
  132. OVFoodSeg: Elevating Open-Vocabulary Food Image Segmentation via Image-Informed Textual RepresentationPoster4 citations
  133. OVMR: Open-Vocabulary Recognition with Multi-Modal ReferencesPoster4 citations
  134. OmniLocalRF: Omnidirectional Local Radiance Fields from Dynamic VideosPoster4 citations
  135. OmniSDF: Scene Reconstruction using Omnidirectional Signed Distance Functions and Adaptive BinoctreesPoster4 citations
  136. On the Robustness of Language Guidance for Low-Level Vision Tasks: Findings from Depth EstimationPoster4 citations
  137. Open Vocabulary Semantic Scene Sketch UnderstandingPoster4 citations
  138. OpticalDR: A Deep Optical Imaging Model for Privacy-Protective Depression RecognitionPoster4 citations
  139. PEGASUS: Personalized Generative 3D Avatars with Composable AttributesPoster4 citations
  140. PanoPose: Self-supervised Relative Pose Estimation for Panoramic ImagesHighlight4 citations
  141. PeerAiD: Improving Adversarial Distillation from a Specialized Peer TutorPoster4 citations
  142. Perceptual Assessment and Optimization of HDR Image RenderingPoster4 citations
  143. Physics-Aware Hand-Object Interaction DenoisingPoster4 citations
  144. Relational Matching for Weakly Semi-Supervised Oriented Object DetectionPoster4 citations
  145. Resolution Limit of Single-Photon LiDARPoster4 citations
  146. Restoration by Generation with Constrained PriorsHighlight4 citations
  147. Robust Depth Enhancement via Polarization Prompt Fusion TuningPoster4 citations
  148. S-DyRF: Reference-Based Stylized Radiance Fields for Dynamic ScenesPoster4 citations
  149. SDPose: Tokenized Pose Estimation via Circulation-Guide Self-DistillationPoster4 citations
  150. SHiNe: Semantic Hierarchy Nexus for Open-vocabulary Object DetectionHighlight4 citations
  151. SPU-PMD: Self-Supervised Point Cloud Upsampling via Progressive Mesh DeformationPoster4 citations
  152. Selective Interpretable and Motion Consistent Privacy Attribute Obfuscation for Action RecognitionPoster4 citations
  153. Self-supervised Debiasing Using Low Rank RegularizationPoster4 citations
  154. Siamese Learning with Joint Alignment and Regression for Weakly-Supervised Video Paragraph GroundingPoster4 citations
  155. Single View Refractive Index Tomography with Neural FieldsPoster4 citations
  156. Solving Masked Jigsaw Puzzles with Diffusion Vision TransformersPoster4 citations
  157. Stratified Avatar Generation from Sparse ObservationsPoster4 citations
  158. StreamingFlow: Streaming Occupancy Forecasting with Asynchronous Multi-modal Data Streams via Neural Ordinary Differential EquationHighlight4 citations
  159. Super-Resolution Reconstruction from Bayer-Pattern Spike StreamsPoster4 citations
  160. SurroundSDF: Implicit 3D Scene Understanding Based on Signed Distance FieldHighlight4 citations
  161. SynFog: A Photo-realistic Synthetic Fog Dataset based on End-to-end Imaging Simulation for Advancing Real-World Defogging in Autonomous DrivingPoster4 citations
  162. Task-Conditioned Adaptation of Visual Features in Multi-Task Policy LearningPoster4 citations
  163. Text2QR: Harmonizing Aesthetic Customization and Scanning Robustness for Text-Guided QR Code GenerationPoster4 citations
  164. The Mirrored Influence Hypothesis: Efficient Data Influence Estimation by Harnessing Forward PassesPoster4 citations
  165. Total Selfie: Generating Full-Body SelfiesHighlight4 citations
  166. Towards CLIP-driven Language-free 3D Visual Grounding via 2D-3D Relational Enhancement and ConsistencyPoster4 citations
  167. Towards Generalizing to Unseen Domains with Few LabelsPoster4 citations
  168. Towards More Accurate Diffusion Model Acceleration with A Timestep TunerPoster4 citations
  169. Tumor Micro-environment Interactions Guided Graph Learning for Survival Analysis of Human Cancers from Whole-slide Pathological ImagesPoster4 citations
  170. UFORecon: Generalizable Sparse-View Surface Reconstruction from Arbitrary and Unfavorable SetsPoster4 citations
  171. UltrAvatar: A Realistic Animatable 3D Avatar Diffusion Model with Authenticity Guided TexturesPoster4 citations
  172. UnSAMFlow: Unsupervised Optical Flow Guided by Segment Anything ModelPoster4 citations
  173. Uncertainty-Guided Never-Ending Learning to DrivePoster4 citations
  174. Unlocking the Potential of Pre-trained Vision Transformers for Few-Shot Semantic Segmentation through Relationship DescriptorsPoster4 citations
  175. Unsegment Anything by Simulating DeformationPoster4 citations
  176. Unsupervised Deep Unrolling Networks for Phase UnwrappingPoster4 citations
  177. Unsupervised Feature Learning with Emergent Data-Driven PrototypicalityPoster4 citations
  178. Unsupervised Template-assisted Point Cloud Shape Correspondence NetworkPoster4 citations
  179. Unveiling the Unknown: Unleashing the Power of Unknown to Known in Open-Set Source-Free Domain AdaptationPoster4 citations
  180. VSRD: Instance-Aware Volumetric Silhouette Rendering for Weakly Supervised 3D Object DetectionPoster4 citations
  181. Validating Privacy-Preserving Face Recognition under a Minimum AssumptionPoster4 citations
  182. VidLA: Video-Language Alignment at ScalePoster4 citations
  183. Visual Objectification in Films: Towards a New AI Task for Video InterpretationHighlight4 citations
  184. What Sketch Explainability Really Means for Downstream Tasks?Poster4 citations
  185. Zero-Painter: Training-Free Layout Control for Text-to-Image SynthesisPoster4 citations
  186. 3D Feature Tracking via Event CameraPoster3 citations
  187. 3D-Aware Face Editing via Warping-Guided Latent Direction LearningPoster3 citations
  188. A Backpack Full of Skills: Egocentric Video Understanding with Diverse Task PerspectivesPoster3 citations
  189. A Theory of Joint Light and Heat Transport for Lambertian ScenesPoster3 citations
  190. A Versatile Framework for Continual Test-Time Domain Adaptation: Balancing Discriminability and GeneralizabilityPoster3 citations
  191. AHIVE: Anatomy-aware Hierarchical Vision Encoding for Interactive Radiology Report RetrievalPoster3 citations
  192. Activity-Biometrics: Person Identification from Daily ActivitiesPoster3 citations
  193. Adversarial Text to Continuous Image GenerationPoster3 citations
  194. Adversarially Robust Few-shot Learning via Parameter Co-distillation of Similarity and Class Concept LearnersPoster3 citations
  195. An Asymmetric Augmented Self-Supervised Learning Method for Unsupervised Fine-Grained Image HashingPoster3 citations
  196. An Interactive Navigation Method with Effect-oriented AffordancePoster3 citations
  197. Anomaly Score: Evaluating Generative Models and Individual Generated Images based on Complexity and VulnerabilityPoster3 citations
  198. BANF: Band-Limited Neural Fields for Levels of Detail ReconstructionPoster3 citations
  199. BEHAVIOR Vision Suite: Customizable Dataset Generation via SimulationHighlight3 citations
  200. BOTH2Hands: Inferring 3D Hands from Both Text Prompts and Body DynamicsPoster3 citations
  201. BSNet: Box-Supervised Simulation-assisted Mean Teacher for 3D Instance SegmentationPoster3 citations
  202. Bayesian Exploration of Pre-trained Models for Low-shot Image ClassificationPoster3 citations
  203. Beyond Image Super-Resolution for Image Recognition with Task-Driven Perceptual LossPoster3 citations
  204. Bezier Everywhere All at Once: Learning Drivable Lanes as Bezier GraphsPoster3 citations
  205. Boosting Order-Preserving and Transferability for Neural Architecture Search: a Joint Architecture Refined Search and Fine-tuning ApproachPoster3 citations
  206. Bootstrapping Autonomous Driving Radars with Self-Supervised LearningPoster3 citations
  207. BrainWash: A Poisoning Attack to Forget in Continual LearningPoster3 citations
  208. Building Optimal Neural Architectures using Interpretable KnowledgePoster3 citations
  209. CAM Back Again: Large Kernel CNNs from a Weakly Supervised Object Localization PerspectivePoster3 citations
  210. CNC-Net: Self-Supervised Learning for CNC Machining OperationsPoster3 citations
  211. CausalPC: Improving the Robustness of Point Cloud Classification by Causal Effect IdentificationPoster3 citations
  212. Circuit Design and Efficient Simulation of Quantum Inner Product and Empirical Studies of Its Effect on Near-Term Hybrid Quantum-Classic Machine LearningPoster3 citations
  213. DIEM: Decomposition-Integration Enhancing Multimodal InsightsPoster3 citations
  214. DIOD: Self-Distillation Meets Object DiscoveryPoster3 citations
  215. Data-Free Quantization via Pseudo-label FilteringPoster3 citations
  216. DeCoTR: Enhancing Depth Completion with 2D and 3D AttentionsPoster3 citations
  217. DeMatch: Deep Decomposition of Motion Field for Two-View Correspondence LearningPoster3 citations
  218. Deep Single Image Camera Calibration by Heatmap Regression to Recover Fisheye Images Under Manhattan World AssumptionPoster3 citations
  219. Deep-TROJ: An Inference Stage Trojan Insertion Algorithm through Efficient Weight Replacement AttackPoster3 citations
  220. DiG-IN: Diffusion Guidance for Investigating Networks - Uncovering Classifier Differences Neuron Visualisations and Visual Counterfactual ExplanationsPoster3 citations
  221. DiaLoc: An Iterative Approach to Embodied Dialog LocalizationPoster3 citations
  222. Differentiable Display Photometric StereoPoster3 citations
  223. Diffusion Reflectance Map: Single-Image Stochastic Inverse Rendering of Illumination and ReflectanceHighlight3 citations
  224. DiffusionRegPose: Enhancing Multi-Person Pose Estimation using a Diffusion-Based End-to-End Regression ApproachPoster3 citations
  225. Discriminative Sample-Guided and Parameter-Efficient Feature Space Adaptation for Cross-Domain Few-Shot LearningPoster3 citations
  226. Distilled Datamodel with Reverse Gradient MatchingPoster3 citations
  227. Domain-Specific Block Selection and Paired-View Pseudo-Labeling for Online Test-Time AdaptationPoster3 citations
  228. Don't Drop Your Samples! Coherence-Aware Training Benefits Conditional DiffusionHighlight3 citations
  229. DreamSalon: A Staged Diffusion Framework for Preserving Identity-Context in Editable Face GenerationPoster3 citations
  230. Dual Pose-invariant Embeddings: Learning Category and Object-specific Discriminative Representations for Recognition and RetrievalPoster3 citations
  231. Enhancing Quality of Compressed Images by Mitigating Enhancement Bias Towards Compression DomainPoster3 citations
  232. Enhancing the Power of OOD Detection via Sample-Aware Model SelectionPoster3 citations
  233. ExMap: Leveraging Explainability Heatmaps for Unsupervised Group Robustness to Spurious CorrelationsPoster3 citations
  234. ExtraNeRF: Visibility-Aware View Extrapolation of Neural Radiance Fields with Diffusion ModelsPoster3 citations
  235. FADES: Fair Disentanglement with Sensitive RelevancePoster3 citations
  236. Fusing Personal and Environmental Cues for Identification and Segmentation of First-Person Camera Wearers in Third-Person ViewsPoster3 citations
  237. FutureHuman3D: Forecasting Complex Long-Term 3D Human Behavior from Video ObservationsPoster3 citations
  238. Generating Illustrated InstructionsPoster3 citations
  239. GigaTraj: Predicting Long-term Trajectories of Hundreds of Pedestrians in Gigapixel Complex ScenesPoster3 citations
  240. HIT: Estimating Internal Human Implicit Tissues from the Body SurfacePoster3 citations
  241. HOIST-Former: Hand-held Objects Identification Segmentation and Tracking in the WildPoster3 citations
  242. HUNTER: Unsupervised Human-centric 3D Detection via Transferring Knowledge from Synthetic Instances to Real ScenesPoster3 citations
  243. HyperSDFusion: Bridging Hierarchical Structures in Language and Geometry for Enhanced 3D Text2Shape GenerationPoster3 citations
  244. Improving Distant 3D Object Detection Using 2D Box SupervisionPoster3 citations
  245. Improving Generalization via Meta-Learning on Hard SamplesPoster3 citations
  246. Improving Generalized Zero-Shot Learning by Exploring the Diverse Semantics from External Class NamesPoster3 citations
  247. In-N-Out: Faithful 3D GAN Inversion with Volumetric Decomposition for Face EditingPoster3 citations
  248. Incorporating Geo-Diverse Knowledge into Prompting for Increased Geographical Robustness in Object RecognitionPoster3 citations
  249. Incremental Nuclei Segmentation from Histopathological Images via Future-class Awareness and Compatibility-inspired DistillationPoster3 citations
  250. Infrared Adversarial Car StickersPoster3 citations
  251. Insights from the Use of Previously Unseen Neural Architecture Search DatasetsPoster3 citations
  252. KITRO: Refining Human Mesh by 2D Clues and Kinematic-tree RotationPoster3 citations
  253. Kernel Adaptive Convolution for Scene Text Detection via Distance Map PredictionPoster3 citations
  254. L-MAGIC: Language Model Assisted Generation of Images with CoherencePoster3 citations
  255. L2B: Learning to Bootstrap Robust Models for Combating Label NoisePoster3 citations
  256. LLaMA-Excitor: General Instruction Tuning via Indirect Feature InteractionPoster3 citations
  257. Language Model Guided Interpretable Video Action ReasoningPoster3 citations
  258. Language-aware Visual Semantic Distillation for Video Question AnsweringPoster3 citations
  259. Learned Scanpaths Aid Blind Panoramic Video Quality AssessmentPoster3 citations
  260. Learning Coupled Dictionaries from Unpaired Data for Image Super-ResolutionPoster3 citations
  261. Learning from One Continuous Video StreamPoster3 citations
  262. Learning to Navigate Efficiently and Precisely in Real EnvironmentsPoster3 citations
  263. Locally Adaptive Neural 3D Morphable ModelsPoster3 citations
  264. Looking 3D: Anomaly Detection with 2D-3D AlignmentPoster3 citations
  265. Low-Latency Neural Stereo StreamingPoster3 citations
  266. MFP: Making Full Use of Probability Maps for Interactive Image SegmentationPoster3 citations
  267. MICap: A Unified Model for Identity-Aware Movie DescriptionsPoster3 citations
  268. MMCert: Provable Defense against Adversarial Attacks to Multi-modal ModelsPoster3 citations
  269. MMVP: A Multimodal MoCap Dataset with Vision and Pressure SensorsPoster3 citations
  270. Mind Artist: Creating Artistic Snapshots with Human ThoughtPoster3 citations
  271. Minimal Perspective AutocalibrationPoster3 citations
  272. Monocular Identity-Conditioned Facial Reflectance ReconstructionPoster3 citations
  273. Multiplane Prior Guided Few-Shot Aerial Scene RenderingPoster3 citations
  274. NICE: Neurogenesis Inspired Contextual Encoding for Replay-free Class Incremental LearningPoster3 citations
  275. NeRFDeformer: NeRF Transformation from a Single View via 3D Scene FlowsPoster3 citations
  276. Not All Classes Stand on Same Embeddings: Calibrating a Semantic Distance with Metric TensorPoster3 citations
  277. Novel View Synthesis with View-Dependent Effects from a Single ImagePoster3 citations
  278. OCAI: Improving Optical Flow Estimation by Occlusion and Consistency Aware InterpolationPoster3 citations
  279. Omni-Q: Omni-Directional Scene Understanding for Unsupervised Visual GroundingPoster3 citations
  280. One More Step: A Versatile Plug-and-Play Module for Rectifying Diffusion Schedule Flaws and Enhancing Low-Frequency ControlsPoster3 citations
  281. POCE: Primal Policy Optimization with Conservative Estimation for Multi-constraint Offline Reinforcement LearningPoster3 citations
  282. PanoRecon: Real-Time Panoptic 3D Reconstruction from Monocular VideoPoster3 citations
  283. Patch2Self2: Self-supervised Denoising on Coresets via Matrix SketchingPoster3 citations
  284. PeVL: Pose-Enhanced Vision-Language Model for Fine-Grained Human Action RecognitionPoster3 citations
  285. PoseIRM: Enhance 3D Human Pose Estimation on Unseen Camera Settings via Invariant Risk MinimizationPoster3 citations
  286. PostureHMR: Posture Transformation for 3D Human Mesh RecoveryPoster3 citations
  287. RAM-Avatar: Real-time Photo-Realistic Avatar from Monocular Videos with Full-body ControlPoster3 citations
  288. Random Entangled Tokens for Adversarially Robust Vision TransformerPoster3 citations
  289. Real-World Mobile Image Denoising Dataset with Efficient BaselinesPoster3 citations
  290. SIRA: Scalable Inter-frame Relation and Association for Radar PerceptionPoster3 citations
  291. SPIDeRS: Structured Polarization for Invisible Depth and Reflectance SensingPoster3 citations
  292. Seeing the Unseen: Visual Common Sense for Semantic PlacementPoster3 citations
  293. Seeing the World through Your EyesPoster3 citations
  294. Self-Supervised Class-Agnostic Motion Prediction with Spatial and Temporal Consistency RegularizationsPoster3 citations
  295. Semantic Human Mesh Reconstruction with TexturesPoster3 citations
  296. Semantic Shield: Defending Vision-Language Models Against Backdooring and Poisoning via Fine-grained Knowledge AlignmentPoster3 citations
  297. ShapeMatcher: Self-Supervised Joint Shape Canonicalization Segmentation Retrieval and DeformationPoster3 citations
  298. ShapeWalk: Compositional Shape Editing Through Language-Guided ChainsPoster3 citations
  299. SlowFormer: Adversarial Attack on Compute and Energy Consumption of Efficient Vision TransformersPoster3 citations
  300. Small Steps and Level Sets: Fitting Neural Surface Models with Point GuidancePoster3 citations
  301. Soften to Defend: Towards Adversarial Robustness via Self-Guided Label RefinementPoster3 citations
  302. Spectral and Polarization Vision: Spectro-polarimetric Real-world DatasetHighlight3 citations
  303. Specularity Factorization for Low-Light EnhancementPoster3 citations
  304. Spin-UP: Spin Light for Natural Light Uncalibrated Photometric StereoPoster3 citations
  305. Synergistic Global-space Camera and Human Reconstruction from VideosPoster3 citations
  306. Teeth-SEG: An Efficient Instance Segmentation Framework for Orthodontic Treatment based on Multi-Scale Aggregation and Anthropic Prior KnowledgePoster3 citations
  307. Text-Conditioned Generative Model of 3D Strand-based Human HairstylesPoster3 citations
  308. TiNO-Edit: Timestep and Noise Optimization for Robust Diffusion-Based Image EditingPoster3 citations
  309. Time-Efficient Light-Field Acquisition Using Coded Aperture and EventsPoster3 citations
  310. Towards Automated Movie Trailer GenerationPoster3 citations
  311. Towards HDR and HFR Video from Rolling-Mixed-Bit SpikingsPoster3 citations
  312. Towards a Perceptual Evaluation Framework for Lighting EstimationPoster3 citations
  313. Unifying Automatic and Interactive Matting with Pretrained ViTsPoster3 citations
  314. Universal Robustness via Median Randomized Smoothing for Real-World Super-ResolutionPoster3 citations
  315. Unmixing Before Fusion: A Generalized Paradigm for Multi-Source-based Hyperspectral Image SynthesisPoster3 citations
  316. Unsupervised Gaze Representation Learning from Multi-view Face ImagesPoster3 citations
  317. VINECS: Video-based Neural Character SkinningPoster3 citations
  318. VS: Reconstructing Clothed 3D Human from Single Image via Vertex ShiftPoster3 citations
  319. WildlifeMapper: Aerial Image Analysis for Multi-Species Detection and IdentificationPoster3 citations
  320. Your Student is Better Than Expected: Adaptive Teacher-Student Collaboration for Text-Conditional Diffusion ModelsPoster3 citations
  321. Zero-Shot Structure-Preserving Diffusion Model for High Dynamic Range Tone MappingHighlight3 citations
  322. 3D Face Tracking from 2D Video through Iterative Dense UV to Image FlowPoster2 citations
  323. 3DFIRES: Few Image 3D REconstruction for Scenes with Hidden SurfacesPoster2 citations
  324. 3DToonify: Creating Your High-Fidelity 3D Stylized Avatar Easily from 2D Portrait ImagesPoster2 citations
  325. A Category Agnostic Model for Visual RearrangmentPoster2 citations
  326. A Subspace-Constrained Tyler's Estimator and its Applications to Structure from MotionPoster2 citations
  327. A Unified Framework for Human-centric Point Cloud Video UnderstandingPoster2 citations
  328. A-Teacher: Asymmetric Network for 3D Semi-Supervised Object DetectionPoster2 citations
  329. A2XP: Towards Private Domain GeneralizationPoster2 citations
  330. ADFactory: An Effective Framework for Generalizing Optical Flow with NeRFPoster2 citations
  331. AETTA: Label-Free Accuracy Estimation for Test-Time AdaptationPoster2 citations
  332. AUEditNet: Dual-Branch Facial Action Unit Intensity Manipulation with Implicit DisentanglementPoster2 citations
  333. Absolute Pose from One or Two Scaled and Oriented FeaturesHighlight2 citations
  334. Accurate Training Data for Occupancy Map Prediction in Automated Driving Using Evidence TheoryPoster2 citations
  335. ActiveDC: Distribution Calibration for Active FinetuningPoster2 citations
  336. Adversarial Distillation Based on Slack Matching and Attribution Region AlignmentPoster2 citations
  337. Aerial Lifting: Neural Urban Semantic and Building Instance Lifting from Aerial ImageryPoster2 citations
  338. Attack To Defend: Exploiting Adversarial Attacks for Detecting Poisoned ModelsPoster2 citations
  339. Benchmarking Segmentation Models with Mask-Preserved Attribute EditingPoster2 citations
  340. Benchmarking the Robustness of Temporal Action Detection Models Against Temporal CorruptionsPoster2 citations
  341. BiTT: Bi-directional Texture Reconstruction of Interacting Two Hands from a Single ImagePoster2 citations
  342. Boosting Self-Supervision for Single-View Scene Completion via Knowledge DistillationPoster2 citations
  343. Bridging the Gap Between End-to-End and Two-Step Text SpottingPoster2 citations
  344. C3Net: Compound Conditioned ControlNet for Multimodal Content GenerationPoster2 citations
  345. CAPE: CAM as a Probabilistic Ensemble for Enhanced DNN InterpretationPoster2 citations
  346. CMA: A Chromaticity Map Adapter for Robust Detection of Screen-Recapture Document ImagesPoster2 citations
  347. Close Imitation of Expert Retouching for Black-and-White PhotographyPoster2 citations
  348. CodedEvents: Optimal Point-Spread-Function Engineering for 3D-Tracking with Event CamerasPoster2 citations
  349. Compositional Video Understanding with Spatiotemporal Structure-based TransformersPoster2 citations
  350. ConCon-Chi: Concept-Context Chimera Benchmark for Personalized Vision-Language TasksPoster2 citations
  351. Cross-spectral Gated-RGB Stereo Depth EstimationHighlight2 citations
  352. CurveCloudNet: Processing Point Clouds with 1D StructurePoster2 citations
  353. CycleINR: Cycle Implicit Neural Representation for Arbitrary-Scale Volumetric Super-Resolution of Medical DataPoster2 citations
  354. DPMesh: Exploiting Diffusion Prior for Occluded Human Mesh RecoveryPoster2 citations
  355. Density-guided Translator Boosts Synthetic-to-Real Unsupervised Domain Adaptive Segmentation of 3D Point CloudsPoster2 citations
  356. Differentiable Point-based Inverse RenderingPoster2 citations
  357. Dispersed Structured Light for Hyperspectral 3D ImagingPoster2 citations
  358. Domain Separation Graph Neural Networks for Saliency Object RankingPoster2 citations
  359. Dr.Hair: Reconstructing Scalp-Connected Hair Strands without Pre-Training via Differentiable Rendering of Line SegmentsHighlight2 citations
  360. EFormer: Enhanced Transformer towards Semantic-Contour Features of Foreground for Portraits MattingPoster2 citations
  361. ES3: Evolving Self-Supervised Learning of Robust Audio-Visual Speech RepresentationsPoster2 citations
  362. EVS-assisted Joint Deblurring Rolling-Shutter Correction and Video Frame Interpolation through Sensor Inverse ModelingPoster2 citations
  363. Efficient Multitask Dense Predictor via BinarizationPoster2 citations
  364. Efficient Privacy-Preserving Visual Localization Using 3D Ray CloudsPoster2 citations
  365. FaceLift: Semi-supervised 3D Facial Landmark LocalizationPoster2 citations
  366. Fine-Grained Bipartite Concept Factorization for ClusteringPoster2 citations
  367. Flexible Biometrics Recognition: Bridging the Multimodality Gap through Attention Alignment and Prompt TuningPoster2 citations
  368. Flexible Depth Completion for Sparse and Varying Point DensitiesPoster2 citations
  369. Flow-Guided Online Stereo Rectification for Wide Baseline StereoPoster2 citations
  370. FreeMan: Towards Benchmarking 3D Human Pose Estimation under Real-World ConditionsPoster2 citations
  371. From Activation to Initialization: Scaling Insights for Optimizing Neural FieldsHighlight2 citations
  372. From Variance to Veracity: Unbundling and Mitigating Gradient Variance in Differentiable Bundle Adjustment LayersPoster2 citations
  373. Fully Convolutional Slice-to-Volume Reconstruction for Single-Stack MRIPoster2 citations
  374. G-FARS: Gradient-Field-based Auto-Regressive Sampling for 3D Part GroupingPoster2 citations
  375. Generating Non-Stationary Textures using Self-RectificationPoster2 citations
  376. Harnessing Meta-Learning for Improving Full-Frame Video StabilizationPoster2 citations
  377. Hierarchical Histogram Threshold Segmentation - Auto-terminating High-detail OversegmentationPoster2 citations
  378. Hierarchical Intra-modal Correlation Learning for Label-free 3D Semantic SegmentationPoster2 citations
  379. How to Make Cross Encoder a Good Teacher for Efficient Image-Text Retrieval?Poster2 citations
  380. Human Motion Prediction Under Unexpected PerturbationHighlight2 citations
  381. IBD-SLAM: Learning Image-Based Depth Fusion for Generalizable SLAMPoster2 citations
  382. ICON: Incremental CONfidence for Joint Pose and Radiance Field OptimizationPoster2 citations
  383. Implicit Motion FunctionPoster2 citations
  384. Improving Subject-Driven Image Synthesis with Subject-Agnostic GuidancePoster2 citations
  385. Improving Visual Recognition with Hyperbolical Visual Hierarchy MappingPoster2 citations
  386. In-distribution Public Data Synthesis with Diffusion Models for Differentially Private Image ClassificationPoster2 citations
  387. Infer from What You Have Seen Before: Temporally-dependent Classifier for Semi-supervised Video SegmentationPoster2 citations
  388. Instance-aware Contrastive Learning for Occluded Human Mesh ReconstructionPoster2 citations
  389. Intensity-Robust Autofocus for Spike CameraPoster2 citations
  390. Interpretable Measures of Conceptual Similarity by Complexity-Constrained Descriptive Auto-EncodingPoster2 citations
  391. Intriguing Properties of Diffusion Models: An Empirical Study of the Natural Attack Capability in Text-to-Image Generative ModelsPoster2 citations
  392. JRDB-PanoTrack: An Open-world Panoptic Segmentation and Tracking Robotic Dataset in Crowded Human EnvironmentsPoster2 citations
  393. KP-RED: Exploiting Semantic Keypoints for Joint 3D Shape Retrieval and DeformationPoster2 citations
  394. LayoutFormer: Hierarchical Text Detection Towards Scene Text UnderstandingPoster2 citations
  395. LeGO: Leveraging a Surface Deformation Network for Animatable Stylized Face Generation with One ExampleHighlight2 citations
  396. Learning Group Activity Features Through Person Attribute PredictionPoster2 citations
  397. Learning SO(3)-Invariant Semantic Correspondence via Local Shape TransformPoster2 citations
  398. Learning to Produce Semi-dense Correspondences for Visual LocalizationPoster2 citations
  399. Learning to Select Views for Efficient Multi-View UnderstandingPoster2 citations
  400. Leveraging Frame Affinity for sRGB-to-RAW Video De-renderingPoster2 citations
  401. LidaRF: Delving into Lidar for Neural Radiance Field on Street ScenesHighlight2 citations
  402. MVCPS-NeuS: Multi-view Constrained Photometric Stereo for Neural Surface ReconstructionPoster2 citations
  403. MarkovGen: Structured Prediction for Efficient Text-to-Image GenerationPoster2 citations
  404. Masked Spatial Propagation Network for Sparsity-Adaptive Depth RefinementPoster2 citations
  405. MeshPose: Unifying DensePose and 3D Body Mesh ReconstructionPoster2 citations
  406. MirageRoom: 3D Scene Segmentation with 2D Pre-trained Models by Mirage ProjectionHighlight2 citations
  407. MoML: Online Meta Adaptation for 3D Human Motion PredictionPoster2 citations
  408. MorpheuS: Neural Dynamic 360deg Surface Reconstruction from Monocular RGB-D VideoPoster2 citations
  409. Motion Blur Decomposition with Cross-shutter GuidancePoster2 citations
  410. Multi-Session SLAM with Differentiable Wide-Baseline Pose OptimizationPoster2 citations
  411. Multi-View Attentive Contextualization for Multi-View 3D Object DetectionPoster2 citations
  412. NB-GTR: Narrow-Band Guided Turbulence RemovalPoster2 citations
  413. NC-SDF: Enhancing Indoor Scene Reconstruction Using Neural SDFs with View-Dependent Normal CompensationPoster2 citations
  414. Neural Exposure Fusion for High-Dynamic Range Object DetectionPoster2 citations
  415. Neural Super-Resolution for Real-time Rendering with Radiance DemodulationPoster2 citations
  416. Noisy One-point Homographies are Surprisingly GoodPoster2 citations
  417. Non-autoregressive Sequence-to-Sequence Vision-Language ModelsPoster2 citations
  418. Normalizing Flows on the Product Space of SO(3) Manifolds for Probabilistic Human Pose ModelingPoster2 citations
  419. Observation-Guided Diffusion Probabilistic ModelsPoster2 citations
  420. PAPR in Motion: Seamless Point-level 3D Scene InterpolationHighlight2 citations
  421. PNeRV: Enhancing Spatial Consistency via Pyramidal Neural Representation for VideosPoster2 citations
  422. Passive Snapshot Coded Aperture Dual-Pixel RGB-D ImagingPoster2 citations
  423. Positive-Unlabeled Learning by Latent Group-Aware Meta DisambiguationPoster2 citations
  424. Pre-training Vision Models with Mandelbulb VariationsPoster2 citations
  425. Prompt Augmentation for Self-supervised Text-guided Image ManipulationPoster2 citations
  426. Quantifying Uncertainty in Motion Prediction with Variational Bayesian MixturePoster2 citations
  427. READ: Retrieval-Enhanced Asymmetric Diffusion for Motion PlanningPoster2 citations
  428. Ranking Distillation for Open-Ended Video Question Answering with Insufficient LabelsPoster2 citations
  429. Real-Time Neural BRDF with Spherically Distributed PrimitivesPoster2 citations
  430. Reconstruction-free Cascaded Adaptive Compressive SensingPoster2 citations
  431. Regularized Parameter Uncertainty for Improving Generalization in Reinforcement LearningPoster2 citations
  432. Rethinking Human Motion Prediction with Symplectic IntegralPoster2 citations
  433. Rolling Shutter Correction with Intermediate Distortion Flow EstimationPoster2 citations
  434. SCINeRF: Neural Radiance Fields from a Snapshot Compressive ImageHighlight2 citations
  435. SaCo Loss: Sample-wise Affinity Consistency for Vision-Language Pre-trainingPoster2 citations
  436. SeNM-VAE: Semi-Supervised Noise Modeling with Hierarchical Variational AutoencoderPoster2 citations
  437. Self-Calibrating Vicinal Risk Minimisation for Model CalibrationPoster2 citations
  438. SleepVST: Sleep Staging from Near-Infrared Video Signals using Pre-Trained TransformersHighlight2 citations
  439. Spatial-Aware Regression for Keypoint LocalizationHighlight2 citations
  440. Spike-guided Motion Deblurring with Unknown Modal Spatiotemporal AlignmentPoster2 citations
  441. Stationary Representations: Optimally Approximating Compatibility and Implications for Improved Model ReplacementsHighlight2 citations
  442. Steganographic Passport: An Owner and User Verifiable Credential for Deep Model IP Protection Without RetrainingPoster2 citations
  443. Structured Gradient-based Interpretations via Norm-Regularized Adversarial TrainingPoster2 citations
  444. StyleCineGAN: Landscape Cinemagraph Generation using a Pre-trained StyleGANPoster2 citations
  445. TULIP: Multi-camera 3D Precision Assessment of Parkinson's DiseasePoster2 citations
  446. Task-aligned Part-aware Panoptic Segmentation through Joint Object-Part RepresentationsPoster2 citations
  447. The More You See in 2D the More You Perceive in 3DHighlight2 citations
  448. ToonerGAN: Reinforcing GANs for Obfuscating Automated Facial IndexingPoster2 citations
  449. Towards Accurate and Robust Architectures via Neural Architecture SearchPoster2 citations
  450. Towards Better Vision-Inspired Vision-Language ModelsPoster2 citations
  451. Towards Robust Learning to Optimize with Theoretical GuaranteesPoster2 citations
  452. Traffic Scene Parsing through the TSP6K DatasetPoster2 citations
  453. Transferable and Principled Efficiency for Open-Vocabulary SegmentationPoster2 citations
  454. Tune-An-Ellipse: CLIP Has Potential to Find What You WantHighlight2 citations
  455. Tuning Stable Rank Shrinkage: Aiming at the Overlooked Structural Risk in Fine-tuningPoster2 citations
  456. Uncertainty Visualization via Low-Dimensional Posterior ProjectionsPoster2 citations
  457. Unsupervised Learning of Category-Level 3D Pose from Object-Centric VideosPoster2 citations
  458. Versatile Navigation Under Partial Observability via Value-guided Diffusion PolicyPoster2 citations
  459. WALT3D: Generating Realistic Training Data from Time-Lapse Imagery for Reconstructing Dynamic Objects Under OcclusionPoster2 citations
  460. WaveMo: Learning Wavefront Modulations to See Through ScatteringPoster2 citations
  461. Weakly Supervised Video Individual CountingPoster2 citations
  462. WinSyn: : A High Resolution Testbed for Synthetic DataPoster2 citations
  463. X-MIC: Cross-Modal Instance Conditioning for Egocentric Action GeneralizationPoster2 citations
  464. XFibrosis: Explicit Vessel-Fiber Modeling for Fibrosis Staging from Liver Pathology ImagesPoster2 citations
  465. XScale-NVS: Cross-Scale Novel View Synthesis with Hash Featurized ManifoldPoster2 citations
  466. Your Transferability Barrier is Fragile: Free-Lunch for Transferring the Non-Transferable LearningHighlight2 citations
  467. AdaShift: Learning Discriminative Self-Gated Neural Feature Activation With an Adaptive Shift FactorPoster1 citations
  468. Adaptive Random Feature Regularization on Fine-tuning Deep Neural NetworksPoster1 citations
  469. AirPlanes: Accurate Plane Estimation via 3D-Consistent EmbeddingsPoster1 citations
  470. All Rivers Run to the Sea: Private Learning with Asymmetric FlowsPoster1 citations
  471. Animating General Image with Large Visual Motion ModelPoster1 citations
  472. AnyScene: Customized Image Synthesis with Composited ForegroundPoster1 citations
  473. Bayesian Differentiable Physics for Cloth DigitalizationPoster1 citations
  474. Behind the Veil: Enhanced Indoor 3D Scene Reconstruction with Occluded Surfaces CompletionPoster1 citations
  475. Benchmarking Audio Visual Segmentation for Long-Untrimmed VideosPoster1 citations
  476. Brush2Prompt: Contextual Prompt Generator for Object InpaintingPoster1 citations
  477. CLIPtone: Unsupervised Learning for Text-based Image Tone AdjustmentPoster1 citations
  478. Capturing Closely Interacted Two-Person Motions with Reaction PriorsPoster1 citations
  479. CoDe: An Explicit Content Decoupling Framework for Image RestorationPoster1 citations
  480. Combining Frame and GOP Embeddings for Neural Video RepresentationPoster1 citations
  481. Continual Learning for Motion Prediction Model via Meta-Representation Learning and Optimal Memory Buffer Retention StrategyPoster1 citations
  482. CosalPure: Learning Concept from Group Images for Robust Co-Saliency DetectionPoster1 citations
  483. Coupled Laplacian Eigenmaps for Locally-Aware 3D Rigid Point Cloud MatchingPoster1 citations
  484. DIMAT: Decentralized Iterative Merging-And-Training for Deep Learning ModelsPoster1 citations
  485. DITTO: Dual and Integrated Latent Topologies for Implicit 3D ReconstructionPoster1 citations
  486. Deep Generative Model based Rate-Distortion for Image Downscaling AssessmentPoster1 citations
  487. Degrees of Freedom Matter: Inferring Dynamics from Point TrajectoriesPoster1 citations
  488. Density-Adaptive Model Based on Motif Matrix for Multi-Agent Trajectory PredictionPoster1 citations
  489. DiffPerformer: Iterative Learning of Consistent Latent Guidance for Diffusion-based Human Video GenerationPoster1 citations
  490. Differentiable Micro-Mesh ConstructionPoster1 citations
  491. Differentiable Neural Surface Refinement for Modeling Transparent ObjectsPoster1 citations
  492. Discontinuity-preserving Normal Integration with Auxiliary EdgesPoster1 citations
  493. ESR-NeRF: Emissive Source Reconstruction Using LDR Multi-view ImagesPoster1 citations
  494. Efficient Detection of Long Consistent Cycles and its Application to Distributed SynchronizationPoster1 citations
  495. Efficient Solution of Point-Line Absolute PoseHighlight1 citations
  496. Enhancing 3D Fidelity of Text-to-3D using Cross-View CorrespondencesPoster1 citations
  497. Explaining the Implicit Neural Canvas: Connecting Pixels to Neurons by Tracing their ContributionsPoster1 citations
  498. FISBe: A Real-World Benchmark Dataset for Instance Segmentation of Long-Range Thin Filamentous StructuresPoster1 citations
  499. FlowerFormer: Empowering Neural Architecture Encoding using a Flow-aware Graph TransformerPoster1 citations
  500. Fooling Polarization-Based Vision using Locally Controllable Polarizing ProjectionPoster1 citations
  501. From Correspondences to Pose: Non-minimal Certifiably Optimal Relative Pose without DisambiguationHighlight1 citations
  502. G-NeRF: Geometry-enhanced Novel View Synthesis from Single-View ImagesPoster1 citations
  503. GLiDR: Topologically Regularized Graph Generative Network for Sparse LiDAR Point CloudsPoster1 citations
  504. Generalizable Face Landmarking Guided by Conditional Face WarpingPoster1 citations
  505. Generating Handwritten Mathematical Expressions From Symbol Graphs: An End-to-End PipelinePoster1 citations
  506. HardMo: A Large-Scale Hardcase Dataset for Motion CapturePoster1 citations
  507. IDGuard: Robust General Identity-centric POI Proactive Defense Against Face Editing AbusePoster1 citations
  508. IPoD: Implicit Field Learning with Point Diffusion for Generalizable 3D Object Reconstruction from Single RGB-D ImagesHighlight1 citations
  509. IReNe: Instant Recoloring of Neural Radiance FieldsPoster1 citations
  510. Identifying Important Group of Pixels using InteractionsPoster1 citations
  511. Ink Dot-Oriented Differentiable Optimization for Neural Image HalftoningPoster1 citations
  512. Instantaneous Perception of Moving Objects in 3DPoster1 citations
  513. JDEC: JPEG Decoding via Enhanced Continuous Cosine CoefficientsPoster1 citations
  514. JoAPR: Cleaning the Lens of Prompt Learning for Vision-Language ModelsPoster1 citations
  515. Joint-Task Regularization for Partially Labeled Multi-Task LearningPoster1 citations
  516. LAENeRF: Local Appearance Editing for Neural Radiance FieldsPoster1 citations
  517. LPSNet: End-to-End Human Pose and Shape Estimation with Lensless ImagingPoster1 citations
  518. Label-Efficient Group Robustness via Out-of-Distribution Concept CurationPoster1 citations
  519. Learning Large-Factor EM Image Super-Resolution with Generative PriorsPoster1 citations
  520. Learning by Correction: Efficient Tuning Task for Zero-Shot Generative Vision-Language ReasoningPoster1 citations
  521. Learning to Count without AnnotationsPoster1 citations
  522. Learning to Rank Patches for Unbiased Image Redundancy ReductionPoster1 citations
  523. LightOctree: Lightweight 3D Spatially-Coherent Indoor Lighting EstimationPoster1 citations
  524. MPOD123: One Image to 3D Content Generation Using Mask-enhanced Progressive Outline-to-Detail OptimizationPoster1 citations
  525. MTMMC: A Large-Scale Real-World Multi-Modal Camera Tracking BenchmarkPoster1 citations
  526. Mean-Shift Feature TransformerPoster1 citations
  527. Molecular Data Programming: Towards Molecule Pseudo-labeling with Systematic Weak SupervisionPoster1 citations
  528. Mudslide: A Universal Nuclear Instance Segmentation MethodHighlight1 citations
  529. Named Entity Driven Zero-Shot Image ManipulationPoster1 citations
  530. Neighbor Relations Matter in Video Scene DetectionPoster1 citations
  531. Neural Fields as Distributions: Signal Processing Beyond Euclidean SpacePoster1 citations
  532. NightCC: Nighttime Color Constancy via Adaptive Channel MaskingPoster1 citations
  533. Non-Rigid Structure-from-Motion: Temporally-Smooth Procrustean Alignment and Spatially-Variant Deformation ModelingPoster1 citations
  534. PaReNeRF: Toward Fast Large-scale Dynamic NeRF with Patch-based ReferencePoster1 citations
  535. PairDETR : Joint Detection and Association of Human Bodies and FacesPoster1 citations
  536. Pick-or-Mix: Dynamic Channel Sampling for ConvNetsPoster1 citations
  537. PikeLPN: Mitigating Overlooked Inefficiencies of Low-Precision Neural NetworksPoster1 citations
  538. PolarRec: Improving Radio Interferometric Data Reconstruction Using Polar CoordinatesPoster1 citations
  539. Polarization Wavefront Lidar: Learning Large Scene Reconstruction from Polarized WavefrontsPoster1 citations
  540. Pose-Guided Self-Training with Two-Stage Clustering for Unsupervised Landmark DiscoveryHighlight1 citations
  541. Pose-Transformed Equivariant Network for 3D Point Trajectory PredictionPoster1 citations
  542. Practical Measurements of Translucent Materials with Inter-Pixel Translucency PriorPoster1 citations
  543. Previously on ... From Recaps to Story SummarizationPoster1 citations
  544. Probabilistic Sampling of Balanced K-Means using Adiabatic Quantum ComputingPoster1 citations
  545. Projecting Trackable Thermal Patterns for Dynamic Computer VisionPoster1 citations
  546. Prompt3D: Random Prompt Assisted Weakly-Supervised 3D Object DetectionPoster1 citations
  547. Revisiting Global Translation Estimation with Feature TracksPoster1 citations
  548. Robust Self-calibration of Focal Lengths from the Fundamental MatrixPoster1 citations
  549. SCE-MAE: Selective Correspondence Enhancement with Masked Autoencoder for Self-Supervised Landmark EstimationPoster1 citations
  550. SNED: Superposition Network Architecture Search for Efficient Video Diffusion ModelPoster1 citations
  551. SVDTree: Semantic Voxel Diffusion for Single Image Tree ReconstructionPoster1 citations
  552. Seg2Reg: Differentiable 2D Segmentation to 1D Regression Rendering for 360 Room Layout ReconstructionPoster1 citations
  553. Self-Supervised Dual ContouringHighlight1 citations
  554. Self-Supervised Representation Learning from Arbitrary ScenariosPoster1 citations
  555. Sheared Backpropagation for Fine-tuning Foundation ModelsPoster1 citations
  556. Snapshot Lidar: Fourier Embedding of Amplitude and Phase for Single-Image Depth ReconstructionPoster1 citations
  557. StrokeFaceNeRF: Stroke-based Facial Appearance Editing in Neural Radiance FieldPoster1 citations
  558. Taming the Tail in Class-Conditional GANs: Knowledge Sharing via Unconditional Training at Lower ResolutionsPoster1 citations
  559. TexOct: Generating Textures of 3D Models with Octree-based DiffusionPoster1 citations
  560. Text Grouping Adapter: Adapting Pre-trained Text Detector for Layout AnalysisPoster1 citations
  561. Towards High-fidelity Artistic Image Vectorization via Texture-Encapsulated Shape ParameterizationPoster1 citations
  562. Towards Robust 3D Pose Transfer with Adversarial LearningPoster1 citations
  563. Transferable Structural Sparse Adversarial Attack Via Exact Group Sparsity TrainingPoster1 citations
  564. Unbiased Estimator for Distorted Conics in Camera CalibrationHighlight1 citations
  565. Unsupervised Salient Instance DetectionPoster1 citations
  566. VRetouchEr: Learning Cross-frame Feature Interdependence with Imperfection Flow for Face Retouching in VideosPoster1 citations
  567. Weakly-Supervised Audio-Visual Video Parsing with Prototype-based Pseudo-LabelingPoster1 citations
  568. A Bayesian Approach to OOD Robustness in Image ClassificationPoster
  569. Aligning Logits Generatively for Principled Black-Box Knowledge DistillationPoster
  570. Alpha Invariance: On Inverse Scaling Between Distance and Volume Density in Neural Radiance FieldsPoster
  571. Beyond Seen Primitive Concepts and Attribute-Object Compositional LearningPoster
  572. Bootstrapping SparseFormers from Vision Foundation ModelsPoster
  573. CLOAF: CoLlisiOn-Aware Human FlowPoster
  574. CORE-MPI: Consistency Object Removal with Embedding MultiPlane ImagePoster
  575. CURSOR: Scalable Mixed-Order Hypergraph Matching with CUR DecompositionPoster
  576. Coherence As Texture - Passive Textureless 3D Reconstruction by Self-interferenceHighlight
  577. Construct to Associate: Cooperative Context Learning for Domain Adaptive Point Cloud SegmentationPoster
  578. Deep Video Inverse Tone Mapping Based on Temporal CluesPoster
  579. DiVAS: Video and Audio Synchronization with Dynamic Frame RatesPoster
  580. Efficient Model Stealing Defense with Noise Transition MatrixPoster
  581. Efficient Scene Recovery Using Luminous Flux PriorPoster
  582. Enhancing Intrinsic Features for Debiasing via Investigating Class-Discerning Common Attributes in Bias-Contrastive PairPoster
  583. Estimating Extreme 3D Image Rotations using Cascaded AttentionPoster
  584. EvDiG: Event-guided Direct and Global Components SeparationPoster
  585. Evaluating Transferability in Retrieval Tasks: An Approach Using MMD and Kernel MethodsPoster
  586. FC-GNN: Recovering Reliable and Accurate Correspondences from InterferencesPoster
  587. FaceCom: Towards High-fidelity 3D Facial Shape Completion via Optimization and Inpainting GuidancePoster
  588. Fitting Flats to FlatsPoster
  589. FocSAM: Delving Deeply into Focused Objects in Segmenting AnythingPoster
  590. G-HOP: Generative Hand-Object Prior for Interaction Reconstruction and Grasp SynthesisPoster
  591. GLOW: Global Layout Aware Attacks on Object DetectionPoster
  592. Gated Fields: Learning Scene Reconstruction from Gated VideosPoster
  593. Generative Quanta Color ImagingPoster
  594. HashPoint: Accelerated Point Searching and Sampling for Neural RenderingHighlight
  595. Hyper-MD: Mesh Denoising with Customized Parameters Aware of Noise Intensity and Geometric CharacteristicsPoster
  596. Improving Unsupervised Hierarchical Representation with Reinforcement LearningPoster
  597. In-Context MattingHighlight
  598. L4D-Track: Language-to-4D Modeling Towards 6-DoF Tracking and Shape Reconstruction in 3D Point Cloud StreamPoster
  599. LEAD: Exploring Logit Space Evolution for Model SelectionPoster
  600. Learning for Transductive Threshold Calibration in Open-World RecognitionPoster
  601. Learning to Remove Wrinkled Transparent Film with Polarized PriorPoster
  602. Leveraging Camera Triplets for Efficient and Accurate Structure-from-MotionPoster
  603. MSU-4S - The Michigan State University Four Seasons DatasetPoster
  604. Mask4Align: Aligned Entity Prompting with Color Masks for Multi-Entity Localization ProblemsPoster
  605. MaxQ: Multi-Axis Query for N:M Sparsity NetworkPoster
  606. MoSAR: Monocular Semi-Supervised Model for Avatar Reconstruction using Differentiable ShadingPoster
  607. Model Adaptation for Time Constrained Embodied ControlPoster
  608. Neural 3D Strokes: Creating Stylized 3D Scenes with Vectorized 3D StrokesPoster
  609. Neural Modes: Self-supervised Learning of Nonlinear Modal SubspacesPoster
  610. Object Dynamics Modeling with Hierarchical Point Cloud-based RepresentationsPoster
  611. Outdoor Scene Extrapolation with Hierarchical Generative Cellular AutomataHighlight
  612. Person in Place: Generating Associative Skeleton-Guidance Maps for Human-Object Interaction Image EditingPoster
  613. Pixel-level Semantic Correspondence through Layout-aware Representation Learning and Multi-scale Matching IntegrationPoster
  614. Point-VOS: Pointing Up Video Object SegmentationPoster
  615. PolarMatte: Fully Computational Ground-Truth-Quality Alpha Matte Extraction for Images and Video using Polarized Screen MattingPoster
  616. PredToken: Predicting Unknown Tokens and Beyond with Coarse-to-Fine Iterative DecodingPoster
  617. QUADify: Extracting Meshes with Pixel-level Details and Materials from ImagesHighlight
  618. Real-time Acquisition and Reconstruction of Dynamic Volumes with Neural Structured IlluminationPoster
  619. RepAn: Enhanced Annealing through Re-parameterizationPoster
  620. SRTube: Video-Language Pre-Training with Action-Centric Video Tube Features and Semantic Role LabelingPoster
  621. Selective Nonlinearities Removal from Digital SignalsPoster
  622. Semantic Line Combination DetectorPoster
  623. Semantic-Aware Multi-Label Adversarial AttacksPoster
  624. Structured Model Probing: Empowering Efficient Transfer Learning by Structured RegularizationPoster
  625. SuperPrimitive: Scene Reconstruction at a Primitive LevelPoster
  626. SynSP: Synergy of Smoothness and Precision in Pose Sequences RefinementPoster
  627. Task-Driven Wavelets using Constrained Empirical Risk MinimizationPoster
  628. Task2Box: Box Embeddings for Modeling Asymmetric Task RelationshipsHighlight
  629. Text-conditional Attribute Alignment across Latent Spaces for 3D Controllable Face Image SynthesisPoster
  630. ToNNO: Tomographic Reconstruction of a Neural Network's Output for Weakly Supervised Segmentation of 3D Medical ImagesPoster
  631. Towards Co-Evaluation of Cameras HDR and Algorithms for Industrial-Grade 6DoF Pose EstimationPoster
  632. Towards General Robustness Verification of MaxPool-based Convolutional Neural Networks via Tightening Linear ApproximationPoster
  633. TutteNet: Injective 3D Deformations by Composition of 2D Mesh DeformationsHighlight
  634. Universal Semi-Supervised Domain Adaptation by Mitigating Common-Class BiasPoster
  635. Unsupervised 3D Structure Inference from Category-Specific Image CollectionsPoster
  636. VMINer: Versatile Multi-view Inverse Rendering with Near- and Far-field Light SourcesHighlight
  637. Video Harmonization with Triplet Spatio-Temporal Variation PatternsPoster
  638. Viewpoint-Aware Visual Grounding in 3D ScenesPoster
  639. Your Image is My Video: Reshaping the Receptive Field via Image-To-Video Differentiable AutoAugmentation and FusionPoster
  640. iToF-flow-based High Frame Rate Depth ImagingPoster

Looking for submission deadlines instead? See the conference deadline calendar.