← All conferences

ECCV 2024 Accepted Papers

The full list of 2,385 papers accepted at ECCV 2024 (European Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.

Poster: 2,185Oral: 200
  1. Flash Cache: Reducing Bias in Radiance Cache Based Inverse RenderingOral5 citations
  2. Flying with Photons: Rendering Novel Views of Propagating LightOral5 citations
  3. Fully Authentic Visual Question Answering Dataset from Online CommunitiesPoster5 citations
  4. FutureDepth: Learning to Predict the Future Improves Video Depth EstimationPoster5 citations
  5. GRIDS: Grouped Multiple-Degradation Restoration with Image Degradation SimilarityPoster5 citations
  6. GarmentAligner: Text-to-Garment Generation via Retrieval-augmented Multi-level CorrectionsPoster5 citations
  7. GeometrySticker: Enabling Ownership Claim of Recolorized Neural Radiance FieldsPoster5 citations
  8. HGL: Hierarchical Geometry Learning for Test-time Adaptation in 3D Point Cloud SegmentationOral5 citations
  9. HPFF: Hierarchical Locally Supervised Learning with Patch Feature FusionPoster5 citations
  10. HiDiffusion: Unlocking Higher-Resolution Creativity and Efficiency in Pretrained Diffusion ModelsPoster5 citations
  11. High-Fidelity 3D Textured Shapes Generation by Sparse Encoding and Adversarial DecodingPoster5 citations
  12. Idea2Img: Iterative Self-Refinement with GPT-4V for Automatic Image Design and GenerationPoster5 citations
  13. Implicit Filtering for Learning Neural Signed Distance Functions from 3D Point CloudsPoster5 citations
  14. Improving Knowledge Distillation via Regularizing Feature Direction and NormOral5 citations
  15. Instant 3D Human Avatar Generation using Image Diffusion ModelsPoster5 citations
  16. Is Retain Set All You Need in Machine Unlearning? Restoring Performance of Unlearned Models with Out-Of-Distribution ImagesPoster5 citations
  17. JointDreamer: Ensuring Geometry Consistency and Text Congruence in Text-to-3D Generation via Joint Score DistillationPoster5 citations
  18. LG-Gaze: Learning Geometry-aware Continuous Prompts for Language-Guided Gaze EstimationPoster5 citations
  19. LLM as Dataset Analyst: Subpopulation Structure Discovery with Large Language ModelPoster5 citations
  20. Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual PersistencePoster5 citations
  21. Learning Semantic Latent Directions for Accurate and Controllable Human Motion PredictionPoster5 citations
  22. Learning Video Context as Interleaved Multimodal SequencesPoster5 citations
  23. Leveraging Near-Field Lighting for Monocular Depth Estimation from Endoscopy VideosPoster5 citations
  24. Leveraging Thermal Modality to Enhance Reconstruction in Low-Light ConditionsPoster5 citations
  25. Leveraging temporal contextualization for video action recognitionPoster5 citations
  26. LiFT: A Surprisingly Simple Lightweight Feature Transform for Dense ViT DescriptorsPoster5 citations
  27. Localization and Expansion: A Decoupled Framework for Point Cloud Few-shot Semantic SegmentationPoster5 citations
  28. Look Around and Learn: Self-Training Object Detection by ExplorationPoster5 citations
  29. MMVR: Millimeter-wave Multi-View Radar Dataset and Benchmark for Indoor PerceptionPoster5 citations
  30. MTA-CLIP: Language-Guided Semantic Segmentation with Mask-Text AlignmentPoster5 citations
  31. MasterWeaver: Taming Editability and Face Identity for Personalized Text-to-Image GenerationPoster5 citations
  32. Merging and Splitting Diffusion Paths for Semantically Coherent PanoramasPoster5 citations
  33. MeshSegmenter: Zero-Shot Mesh Segmentation via Texture SynthesisPoster5 citations
  34. Momentum Auxiliary Network for Supervised Local LearningOral5 citations
  35. Motion and Structure from Event-based Normal FlowPoster5 citations
  36. Multi-Label Cluster Discrimination for Visual Representation LearningPoster5 citations
  37. NOVUM: Neural Object Volumes for Robust Object ClassificationPoster5 citations
  38. Norface: Improving Facial Expression Analysis by Identity NormalizationPoster5 citations
  39. OTSeg: Multi-prompt Sinkhorn Attention for Zero-Shot Semantic SegmentationPoster5 citations
  40. Osmosis: RGBD Diffusion Prior for Underwater Image RestorationPoster5 citations
  41. PQ-SAM: Post-training Quantization for Segment Anything ModelPoster5 citations
  42. PanGu-Draw: Advancing Resource-Efficient Text-to-Image Synthesis with Time-Decoupled Training and Reusable Coop-DiffusionPoster5 citations
  43. PiTe: Pixel-Temporal Alignment for Large Video-Language ModelOral5 citations
  44. PosterLlama: Bridging Design Ability of Langauge Model to Content-Aware Layout GenerationPoster5 citations
  45. PredBench: Benchmarking Spatio-Temporal Prediction across Diverse DisciplinesPoster5 citations
  46. Projecting Points to Axes: Oriented Object Detection via Point-Axis RepresentationOral5 citations
  47. REVISION: Rendering Tools Enable Spatial Fidelity in Vision-Language ModelsPoster5 citations
  48. RGNet: A Unified Clip Retrieval and Grounding Network for Long VideosPoster5 citations
  49. RT-Pose: A 4D Radar-Tensor based 3D Human Pose Estimation and Localization BenchmarkPoster5 citations
  50. Raising the Ceiling: Conflict-Free Local Feature Matching with Dynamic View SwitchingPoster5 citations
  51. RealViformer: Investigating Attention for Real-World Video Super-ResolutionPoster5 citations
  52. Reinforcement Learning Meets Visual OdometryPoster5 citations
  53. Rethinking Data Augmentation for Robust LiDAR Semantic Segmentation in Adverse WeatherOral5 citations
  54. Revisit Anything: Visual Place Recognition via Image Segment RetrievalPoster5 citations
  55. Revisiting Adaptive Cellular Recognition Under Domain Shifts: A Contextual Correspondence ViewOral5 citations
  56. RoomTex: Texturing Compositional Indoor Scenes via Iterative InpaintingPoster5 citations
  57. Safeguard Text-to-Image Diffusion Models with Human Feedback InversionPoster5 citations
  58. Self-Guided Generation of Minority Samples Using Diffusion ModelsPoster5 citations
  59. Siamese Vision Transformers are Scalable Audio-visual LearnersPoster5 citations
  60. Simplifying Source-Free Domain Adaptation for Object Detection: Effective Self-Training Strategies and Performance InsightsPoster5 citations
  61. Sparse Beats Dense: Rethinking Supervision in Radar-Camera Depth CompletionPoster5 citations
  62. StyleTokenizer: Defining Image Style by a Single Instance for Controlling Diffusion ModelsPoster5 citations
  63. SuperGaussian: Repurposing Video Models for 3D Super ResolutionPoster5 citations
  64. Sur^2f: A Hybrid Representation for High-Quality and Efficient Surface Reconstruction from Multi-view ImagesPoster5 citations
  65. Surface Reconstruction for 3D Gaussian Splatting via Local Structural HintsPoster5 citations
  66. T-MAE: Temporal Masked Autoencoders for Point Cloud Representation LearningPoster5 citations
  67. Temporal Event Stereo via Joint Learning with Stereoscopic FlowPoster5 citations
  68. Text-to-Sticker: Style Tailoring Latent Diffusion Models for Human ExpressionPoster5 citations
  69. The Hard Positive Truth about Vision-Language CompositionalityPoster5 citations
  70. Token Compensator: Altering Inference Cost of Vision Transformer without Re-TuningPoster5 citations
  71. Towards Multi-modal Transformers in Federated LearningPoster5 citations
  72. Towards Scene Graph AnticipationOral5 citations
  73. Training A Small Emotional Vision Language Model for Visual Art ComprehensionPoster5 citations
  74. Unlocking Textual and Visual Wisdom: Open-Vocabulary 3D Object Detection Enhanced by Comprehensive Guidance from Text and ImagePoster5 citations
  75. VQA-Diff: Exploiting VQA and Diffusion for Zero-Shot Image-to-3D Vehicle Asset Generation in Autonomous DrivingPoster5 citations
  76. Weakly Supervised 3D Object Detection via Multi-Level Visual GuidancePoster5 citations
  77. Which Model Generated This Image? A Model-Agnostic Approach for Origin AttributionPoster5 citations
  78. WorldPose: A World Cup Dataset for Global 3D Human Pose EstimationPoster5 citations
  79. iHuman: Instant Animatable Digital Humans From Monocular VideosPoster5 citations
  80. "BlinkVision: A Benchmark for Optical Flow, Scene Flow and Point Tracking Estimation using RGB Frames and Events"Poster4 citations
  81. "On Calibration of Object Detectors: Pitfalls, Evaluation and Baselines"Oral4 citations
  82. "ProCreate, Don't Reproduce! Propulsive Energy Diffusion for Creative Generation"Poster4 citations
  83. 3D Small Object Detection with Dynamic Spatial PruningPoster4 citations
  84. 3D-GOI: 3D GAN Omni-Inversion for Multifaceted and Multi-object EditingPoster4 citations
  85. 3iGS: Factorised Tensorial Illumination for 3D Gaussian SplattingPoster4 citations
  86. 4D Contrastive Superflows are Dense 3D Representation LearnersPoster4 citations
  87. A Geometric Distortion Immunized Deep Watermarking Framework with Robustness GeneralizabilityOral4 citations
  88. A New Dataset and Framework for Real-World Blurred Images Super-ResolutionPoster4 citations
  89. A Simple Baseline for Spoken Language to Sign Language Translation with 3D AvatarsOral4 citations
  90. ABC Easy as 123: A Blind Counter for Exemplar-Free Multi-Class Class-agnostic CountingOral4 citations
  91. ActionVOS: Actions as Prompts for Video Object SegmentationOral4 citations
  92. AdaDiffSR: Adaptive Region-aware Dynamic acceleration Diffusion Model for Real-World Image Super-ResolutionPoster4 citations
  93. AdaGlimpse: Active Visual Exploration with Arbitrary Glimpse Position and ScalePoster4 citations
  94. Adaptive High-Frequency Transformer for Diverse Wildlife Re-IdentificationPoster4 citations
  95. Adaptive Human Trajectory Prediction via Latent CorridorsPoster4 citations
  96. AddBiomechanics Dataset: Capturing the Physics of Human Motion at ScalePoster4 citations
  97. Affective Visual Dialog: A Large-Scale Benchmark for Emotional Reasoning Based on Visually Grounded ConversationsPoster4 citations
  98. Affine steerers for structured keypoint descriptionPoster4 citations
  99. AlignDiff: Aligning Diffusion Models for General Few-Shot SegmentationOral4 citations
  100. AlignZeg: Mitigating Objective Misalignment for Zero-shot Semantic SegmentationPoster4 citations
  101. Any Target Can be Offense: Adversarial Example Generation via Generalized Latent InfectionPoster4 citations
  102. Auto-DAS: Automated Proxy Discovery for Training-free Distillation-aware Architecture SearchPoster4 citations
  103. BKDSNN: Enhancing the Performance of Learning-based Spiking Neural Networks Training with Blurred Knowledge DistillationPoster4 citations
  104. Background Adaptation with Residual Modeling for Exemplar-Free Class-Incremental Semantic SegmentationPoster4 citations
  105. Bi-directional Contextual Attention for 3D Dense CaptioningOral4 citations
  106. Bidirectional Stereo Image Compression with Cross-Dimensional Entropy ModelPoster4 citations
  107. CMD: A Cross Mechanism Domain Adaptation Dataset for 3D Object DetectionPoster4 citations
  108. COIN: Control-Inpainting Diffusion Prior for Human and Camera Motion EstimationPoster4 citations
  109. Camera-LiDAR Cross-modality Gait RecognitionPoster4 citations
  110. CardiacNet: Learning to Reconstruct Abnormalities for Cardiac Disease Assessment from Echocardiogram VideosOral4 citations
  111. Chat-Edit-3D: Interactive 3D Scene Editing via Text PromptsPoster4 citations
  112. Click Prompt Learning with Optimal Transport for Interactive SegmentationPoster4 citations
  113. Concept Arithmetics for Circumventing Concept Inhibition in Diffusion ModelsOral4 citations
  114. Conceptual Codebook Learning for Vision-Language ModelsPoster4 citations
  115. Cross-Domain Learning for Video Anomaly Detection with Limited SupervisionPoster4 citations
  116. Cross-Domain Semantic Segmentation on Inconsistent Taxonomy using VLMsPoster4 citations
  117. DATENeRF: Depth-Aware Text-based Editing of NeRFsPoster4 citations
  118. DGD: Dynamic 3D Gaussians DistillationPoster4 citations
  119. DPA-Net: Structured 3D Abstraction from Sparse Views via Differentiable Primitive AssemblyPoster4 citations
  120. DailyDVS-200: A Comprehensive Benchmark Dataset for Event-Based Action RecognitionPoster4 citations
  121. Depth-Aware Blind Image Decomposition for Real-World Adverse Weather RecoveryPoster4 citations
  122. DiffuMatting: Synthesizing Arbitrary Objects with Matting-level AnnotationPoster4 citations
  123. Diffusion-Guided Weakly Supervised Semantic SegmentationPoster4 citations
  124. DiscoMatch: Fast Discrete Optimisation for Geometrically Consistent 3D Shape MatchingPoster4 citations
  125. Dissecting Dissonance: Benchmarking Large Multimodal Models Against Self-Contradictory InstructionsPoster4 citations
  126. Domain Generalization of 3D Object Detection by Density-ResamplingPoster4 citations
  127. Domain-Adaptive 2D Human Pose Estimation via Dual Teachers in Extremely Low-Light ConditionsPoster4 citations
  128. DoughNet: A Visual Predictive Model for Topological Manipulation of Deformable ObjectsPoster4 citations
  129. Dual-Rain: Video Rain Removal using Assertive and Gentle TeachersPoster4 citations
  130. Dual-stage Hyperspectral Image Classification Model with Spectral SupertokenPoster4 citations
  131. DualBEV: Unifying Dual View Transformation with Probabilistic CorrespondencesPoster4 citations
  132. EAFormer: Scene Text Segmentation with Edge-Aware TransformersPoster4 citations
  133. Efficient Few-Shot Action Recognition via Multi-Level Post-ReasoningPoster4 citations
  134. EgoBody3M: Egocentric Body Tracking on a VR Headset using a Diverse DatasetPoster4 citations
  135. EgoPet: Egomotion and Interaction Data from an Animal's PerspectivePoster4 citations
  136. Eliminating Warping Shakes for Unsupervised Online Video StitchingPoster4 citations
  137. Eta Inversion: Designing an Optimal Eta Function for Diffusion-based Real Image EditingPoster4 citations
  138. Event Trojan: Asynchronous Event-based Backdoor AttacksPoster4 citations
  139. Event-Aided Time-To-Collision Estimation for Autonomous DrivingPoster4 citations
  140. Event-Based Motion MagnificationPoster4 citations
  141. Event-based Mosaicing Bundle AdjustmentPoster4 citations
  142. Exploring Reliable Matching with Phase Enhancement for Night-time Semantic SegmentationPoster4 citations
  143. FALIP: Visual Prompt as Foveal Attention Boosts CLIP Zero-Shot PerformancePoster4 citations
  144. Few-Shot Anomaly-Driven Generation for Anomaly Classification and SegmentationPoster4 citations
  145. Finding a needle in a haystack: A Black-Box Approach to Invisible Watermark DetectionPoster4 citations
  146. FipTR: A Simple yet Effective Transformer Framework for Future Instance Prediction in Autonomous DrivingPoster4 citations
  147. FontStudio: Shape-Adaptive Diffusion Model for Coherent and Consistent Font Effect GenerationPoster4 citations
  148. FrePolad: Frequency-Rectified Point Latent Diffusion for Point Cloud GenerationPoster4 citations
  149. GTPT: Group-based Token Pruning Transformer for Efficient Human Pose EstimationPoster4 citations
  150. GazeXplain: Learning to Predict Natural Language Explanations of Visual ScanpathsOral4 citations
  151. Global Counterfactual DirectionsPoster4 citations
  152. HARIVO: Harnessing Text-to-Image Models for Video GenerationPoster4 citations
  153. HPE-Li: WiFi-enabled Lightweight Dual Selective Kernel Convolution for Human Pose EstimationPoster4 citations
  154. How to Train the Teacher Model for Effective Knowledge DistillationPoster4 citations
  155. HumanRefiner: Benchmarking Abnormal Human Generation and Refining with Coarse-to-fine Pose-Reversible GuidancePoster4 citations
  156. INTRA: Interaction Relationship-aware Weakly Supervised Affordance GroundingPoster4 citations
  157. Improving Adversarial Transferability via Model AlignmentPoster4 citations
  158. Improving Hyperbolic Representations via Gromov-Wasserstein RegularizationPoster4 citations
  159. Improving Text-guided Object Inpainting with Semantic Pre-inpaintingPoster4 citations
  160. Interleaving One-Class and Weakly-Supervised Models with Adaptive Thresholding for Unsupervised Video Anomaly DetectionPoster4 citations
  161. ItTakesTwo: Leveraging Peer Representations for Semi-supervised LiDAR Semantic SegmentationPoster4 citations
  162. Just a Hint: Point-Supervised Camouflaged Object DetectionPoster4 citations
  163. KMTalk: Speech-Driven 3D Facial Animation with Key Motion EmbeddingPoster4 citations
  164. L-DiffER: Single Image Reflection Removal with Language-based Diffusion ModelPoster4 citations
  165. LMT-GP: Combined Latent Mean-Teacher and Gaussian Process for Semi-supervised Low-light Image EnhancementPoster4 citations
  166. LabelDistill: Label-guided Cross-modal Knowledge Distillation for Camera-based 3D Object DetectionPoster4 citations
  167. LayerDiff: Exploring Text-guided Multi-layered Composable Image Synthesis via Layer-Collaborative Diffusion ModelPoster4 citations
  168. LayeredFlow: A Real-World Benchmark for Non-Lambertian Multi-Layer Optical FlowPoster4 citations
  169. Learning Camouflaged Object Detection from Noisy Pseudo LabelPoster4 citations
  170. Learning Neural Volumetric Pose Features for Camera LocalizationPoster4 citations
  171. Learning Unified Reference Representation for Unsupervised Multi-class Anomaly DetectionPoster4 citations
  172. Learning the Unlearned: Mitigating Feature Suppression in Contrastive LearningPoster4 citations
  173. Learning to Detect Multi-class Anomalies with Just One Normal Image PromptPoster4 citations
  174. Learning to Generate Conditional Tri-plane for 3D-aware Expression Controllable Portrait AnimationPoster4 citations
  175. Long-term Temporal Context Gathering for Neural Video CompressionPoster4 citations
  176. MAP-ADAPT: Real-Time Quality-Adaptive Semantic 3D MapsPoster4 citations
  177. MICDrop: Masking Image and Depth Features via Complementary Dropout for Domain-Adaptive Semantic SegmentationPoster4 citations
  178. MVDD: Multi-View Depth Diffusion ModelsPoster4 citations
  179. MagicEraser: Erasing Any Objects via Semantics-Aware ControlPoster4 citations
  180. Mesh2NeRF: Direct Mesh Supervision for Neural Radiance Field Representation and GenerationPoster4 citations
  181. MeshVPR: Citywide Visual Place Recognition Using 3D MeshesPoster4 citations
  182. NePhi: Neural Deformation Fields for Approximately Diffeomorphic Medical Image RegistrationPoster4 citations
  183. Noise-assisted Prompt Learning for Image Forgery Detection and LocalizationPoster4 citations
  184. Omni6D: Large-Vocabulary 3D Object Dataset for Category-Level 6D Object Pose EstimationPoster4 citations
  185. Open-Vocabulary 3D Semantic Segmentation with Text-to-Image Diffusion ModelsPoster4 citations
  186. PISR: Polarimetric Neural Implicit Surface Reconstruction for Textureless and Specular ObjectsPoster4 citations
  187. PLOT: Text-based Person Search with Part Slot Attention for Corresponding Part DiscoveryPoster4 citations
  188. Pairwise Distance Distillation for Unsupervised Real-World Image Super-ResolutionPoster4 citations
  189. PanoFree: Tuning-Free Holistic Multi-view Image Generation with Cross-view Self-GuidancePoster4 citations
  190. Parameter-Efficient and Memory-Efficient Tuning for Vision Transformer: A Disentangled ApproachPoster4 citations
  191. PetFace: A Large-Scale Dataset and Benchmark for Animal IdentificationOral4 citations
  192. Physical-Based Event Camera SimulatorPoster4 citations
  193. Placing Objects in Context via Inpainting for Out-of-distribution SegmentationPoster4 citations
  194. Platypus: A Generalized Specialist Model for Reading Text in Various FormsPoster4 citations
  195. PointRegGPT: Boosting 3D Point Cloud Registration using Generative Point-Cloud Pairs for TrainingPoster4 citations
  196. Pre-trained Visual Dynamics Representations for Efficient Policy LearningPoster4 citations
  197. Preventing Catastrophic Forgetting through Memory Networks in Continuous DetectionPoster4 citations
  198. Quality Assured: Rethinking Annotation Strategies in Imaging AIPoster4 citations
  199. RCS-Prompt: Learning Prompt to Rearrange Class Space for Prompt-based Continual LearningPoster4 citations
  200. Rate-Distortion-Cognition Controllable Versatile Neural Image CompressionPoster4 citations
  201. Rawformer: Unpaired Raw-to-Raw Translation for Learnable Camera ISPsPoster4 citations
  202. ReSyncer: Rewiring Style-based Generator for Unified Audio-Visually Synced Facial PerformerOral4 citations
  203. Rectify the Regression Bias in Long-Tailed Object DetectionPoster4 citations
  204. Relightable Neural Actor with Intrinsic Decomposition and Pose ControlPoster4 citations
  205. Rethinking Deep Unrolled Model for Accelerated MRI ReconstructionOral4 citations
  206. Revisit Event Generation Model: Self-Supervised Learning of Event-to-Video Reconstruction with Implicit Neural RepresentationsPoster4 citations
  207. RoGUENeRF: A Robust Geometry-Consistent Universal Enhancer for NeRFPoster4 citations
  208. Robust Incremental Structure-from-Motion with Hybrid FeaturesPoster4 citations
  209. Robust Multimodal Learning via Representation DecouplingPoster4 citations
  210. S-JEPA: A Joint Embedding Predictive Architecture for Skeletal Action RecognitionPoster4 citations
  211. SAFARI: Adaptive Sequence Transformer for Weakly Supervised Referring Expression SegmentationPoster4 citations
  212. SAIR: Learning Semantic-aware Implicit RepresentationPoster4 citations
  213. SLIM: Spuriousness Mitigation with Minimal Human AnnotationsPoster4 citations
  214. SNeRV: Spectra-preserving Neural Representation for VideoPoster4 citations
  215. SPARO: Selective Attention for Robust and Compositional Transformer Encodings for VisionPoster4 citations
  216. SPIRE: Semantic Prompt-Driven Image RestorationPoster4 citations
  217. STAMP: Outlier-Aware Test-Time Adaptation with Stable Memory ReplayPoster4 citations
  218. Scene-Graph ViT: End-to-End Open-Vocabulary Visual Relationship DetectionPoster4 citations
  219. SelEx: Self-Expertise in Fine-Grained Generalized Category DiscoveryPoster4 citations
  220. Self-Cooperation Knowledge Distillation for Novel Class DiscoveryPoster4 citations
  221. Self-Supervised Audio-Visual Soundscape StylizationPoster4 citations
  222. Self-Supervised Video Desmoking for Laparoscopic SurgeryOral4 citations
  223. Semantically Guided Representation Learning For Action AnticipationPoster4 citations
  224. Situated Instruction FollowingPoster4 citations
  225. Spherical World-Locking for Audio-Visual Localization in Egocentric VideosPoster4 citations
  226. Style-Extracting Diffusion Models for Semi-Supervised Histopathology SegmentationPoster4 citations
  227. Subspace Prototype Guidance for Mitigating Class Imbalance in Point Cloud Semantic SegmentationPoster4 citations
  228. Switch Diffusion Transformer: Synergizing Denoising Tasks with Sparse Mixture-of-ExpertsPoster4 citations
  229. TIP: Tabular-Image Pre-training for Multimodal Classification with Incomplete DataPoster4 citations
  230. TP2O: Creative Text Pair-to-Object Generation using Balance Swap-SamplingPoster4 citations
  231. Taming CLIP for Fine-grained and Structured Visual Understanding of Museum ExhibitsPoster4 citations
  232. Text-Anchored Score Composition: Tackling Condition Misalignment in Text-to-Image Diffusion ModelsPoster4 citations
  233. Text-Guided Video Masked AutoencoderPoster4 citations
  234. Text2Place: Affordance-aware Text Guided Human PlacementPoster4 citations
  235. The Devil is in the Statistics: Mitigating and Exploiting Statistics Difference for Generalizable Semi-supervised Medical Image SegmentationPoster4 citations
  236. The Fabrication of Reality and Fantasy: Scene Generation with LLM-Assisted Prompt InterpretationPoster4 citations
  237. The Lottery Ticket Hypothesis in Denoising: Towards Semantic-Driven InitializationPoster4 citations
  238. The Sky's the Limit: Relightable Outdoor Scenes via a Sky-pixel Constrained Illumination Prior and Outside-In VisibilityPoster4 citations
  239. Thermal3D-GS: Physics-induced 3D Gaussians for Thermal Infrared Novel-view SynthesisPoster4 citations
  240. TimeCraft: Navigate Weakly-Supervised Temporal Grounded Video Question Answering via Bi-directional ReasoningPoster4 citations
  241. Timestep-Aware Correction for Quantized Diffusion ModelsPoster4 citations
  242. Tiny Models are the Computational Saver for Large ModelsPoster4 citations
  243. Towards Reliable Advertising Image Generation Using Human FeedbackPoster4 citations
  244. Towards Unified Representation of Invariant-Specific Features in Missing Modality Face Anti-SpoofingPoster4 citations
  245. Tree-D Fusion: Simulation-Ready Tree Dataset from Single Images with Diffusion PriorsPoster4 citations
  246. UDA-Bench: Revisiting Common Assumptions in Unsupervised Domain Adaptation Using a Standardized FrameworkPoster4 citations
  247. Unsupervised Dense Prediction using Differentiable Normalized CutsPoster4 citations
  248. VLAD-BuFF: Burst-aware Fast Feature Aggregation for Visual Place RecognitionPoster4 citations
  249. Video Question Answering with Procedural ProgramsPoster4 citations
  250. WBP: Training-time Backdoor Attacks through Hardware-based Weight Bit PoisoningPoster4 citations
  251. WRIM-Net: Wide-Ranging Information Mining Network for Visible-Infrared Person Re-IdentificationPoster4 citations
  252. Walker: Self-supervised Multiple Object Tracking by Walking on Temporal Object Appearance GraphsPoster4 citations
  253. Weakly-supervised Camera Localization by Ground-to-satellite Image RegistrationPoster4 citations
  254. Zero-Shot Image Feature Consensus with Deep Functional MapsPoster4 citations
  255. "Category-level Object Detection, Pose Estimation and Reconstruction from Stereo Images"Poster3 citations
  256. "FARSE-CNN: Fully Asynchronous, Recurrent and Sparse Event-Based CNN"Poster3 citations
  257. "Hyperion – A fast, versatile symbolic Gaussian Belief Propagation framework for Continuous-Time SLAM"Poster3 citations
  258. "SLAck: Semantic, Location, and Appearance Aware Open-Vocabulary Tracking"Poster3 citations
  259. "Segment, Lift and Fit: Automatic 3D Shape Labeling from 2D Prompts"Poster3 citations
  260. "UniINR: Event-guided Unified Rolling Shutter Correction, Deblurring, and Interpolation"Poster3 citations
  261. "X-InstructBLIP: A Framework for Aligning Image, 3D, Audio, Video to LLMs and its Emergent Cross-modal Reasoning"Poster3 citations
  262. 3D Open-Vocabulary Panoptic Segmentation with 2D-3D Vision-Language DistillationPoster3 citations
  263. A Multimodal Benchmark Dataset and Model for Crop Disease DiagnosisPoster3 citations
  264. A Semantic Space is Worth 256 Language Descriptions: Make Stronger Segmentation Models with Descriptive PropertiesPoster3 citations
  265. Active Coarse-to-Fine Segmentation of Moveable Parts from Real ImagesPoster3 citations
  266. AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive ComputationPoster3 citations
  267. Adaptive Multi-modal Fusion of Spatially Variant Kernel Refinement with Diffusion Model for Blind Image Super-ResolutionPoster3 citations
  268. Anytime Continual Learning for Open Vocabulary ClassificationOral3 citations
  269. Appearance-based Refinement for Object-Centric Motion SegmentationPoster3 citations
  270. Arbitrary-Scale Video Super-Resolution with Structural and Textural PriorsPoster3 citations
  271. AttentionHand: Text-driven Controllable Hand Image Generation for 3D Hand Reconstruction in the WildOral3 citations
  272. Augmented Neural Fine-tuning for Efficient Backdoor PurificationPoster3 citations
  273. Avatar Fingerprinting for Authorized Use of Synthetic Talking-Head VideosPoster3 citations
  274. BI-MDRG: Bridging Image History in Multimodal Dialogue Response GenerationPoster3 citations
  275. Benchmarking Spurious Bias in Few-Shot Image ClassifiersPoster3 citations
  276. BeyondScene: Higher-Resolution Human-Centric Scene Generation With Pretrained DiffusionPoster3 citations
  277. Bidirectional Uncertainty-Based Active Learning for Open-Set AnnotationPoster3 citations
  278. Boost Your NeRF: A Model-Agnostic Mixture of Experts Framework for High Quality and Efficient RenderingPoster3 citations
  279. Boosting 3D Single Object Tracking with 2D Matching Distillation and 3D Pre-trainingPoster3 citations
  280. BurstM: Deep Burst Multi-scale SR using Fourier Space with Optical FlowPoster3 citations
  281. CLOSER: Towards Better Representation Learning for Few-Shot Class-Incremental LearningPoster3 citations
  282. COD: Learning Conditional Invariant Representation for Domain Adaptation RegressionOral3 citations
  283. COMO: Compact Mapping and OdometryOral3 citations
  284. COMPOSE: Comprehensive Portrait Shadow EditingPoster3 citations
  285. Camera Calibration using a Collimator SystemOral3 citations
  286. Can OOD Object Detectors Learn from Foundation Models?Poster3 citations
  287. Canonical Shape Projection is All You Need for 3D Few-shot Class Incremental LearningPoster3 citations
  288. CarFormer: Self-Driving with Learned Object-Centric RepresentationsPoster3 citations
  289. Chameleon: A Data-Efficient Generalist for Dense Visual Prediction in the WildOral3 citations
  290. Chronologically Accurate Retrieval for Temporal Grounding of Motion-Language ModelsPoster3 citations
  291. ClusteringSDF: Self-Organized Neural Implicit Surfaces for 3D DecompositionPoster3 citations
  292. CoLA: Conditional Dropout and Language-driven Robust Dual-modal Salient Object DetectionPoster3 citations
  293. CoMusion: Towards Consistent Stochastic Human Motion Prediction via Motion DiffusionPoster3 citations
  294. ColorMNet: A Memory-based Deep Spatial-Temporal Feature Propagation Network for Video ColorizationPoster3 citations
  295. ConceptExpress: Harnessing Diffusion Models for Single-image Unsupervised Concept ExtractionOral3 citations
  296. Concise Plane Arrangements for Low-Poly Surface and Volume ModellingPoster3 citations
  297. Confidence Self-Calibration for Multi-Label Class-Incremental LearningPoster3 citations
  298. Content-Aware Radiance Fields: Aligning Model Complexity with Scene Intricacy Through Learned Bitwidth QuantizationPoster3 citations
  299. Continual Learning for Remote Physiological Measurement: Minimize Forgetting and Simplify InferencePoster3 citations
  300. Continuity Preserving Online CenterLine Graph LearningPoster3 citations
  301. ControlNet-XS: Rethinking the Control of Text-to-Image Diffusion Models as Feedback-Control SystemsOral3 citations
  302. Controlling the World by Sleight of HandOral3 citations
  303. CountFormer: Multi-View Crowd Counting TransformerPoster3 citations
  304. DECIDER: Leveraging Foundation Model Priors for Improved Model Failure Detection and ExplanationPoster3 citations
  305. DECap: Towards Generalized Explicit Caption Editing via Diffusion MechanismPoster3 citations
  306. DHR: Dual Features-Driven Hierarchical Rebalancing in Inter- and Intra-Class Regions for Weakly-Supervised Semantic SegmentationPoster3 citations
  307. Dataset GrowthPoster3 citations
  308. Decomposition Betters Tracking Everything EverywherePoster3 citations
  309. Deep Online Probability Aggregation ClusteringPoster3 citations
  310. Dense Hand-Object(HO) GraspNet with Full Grasping Taxonomy and DynamicsPoster3 citations
  311. Depth on Demand: Streaming Dense Depth from a Low Frame Rate Active SensorPoster3 citations
  312. Diff-Reg: Diffusion Model in Doubly Stochastic Matrix Space for Registration ProblemPoster3 citations
  313. DiffuX2CT: Diffusion Learning to Reconstruct CT Images from Biplanar X-RaysPoster3 citations
  314. Diffusion Model is a Good Pose Estimator from 3D RF-VisionPoster3 citations
  315. Diffusion Models are Geometry Critics: Single Image 3D Editing Using Pre-Trained Diffusion PriorsPoster3 citations
  316. Diffusion Models as Data Mining ToolsPoster3 citations
  317. Diffusion-Based Image-to-Image Translation by Noise Correction via Prompt InterpolationPoster3 citations
  318. Distribution Alignment for Fully Test-Time Adaptation with Dynamic Online Data StreamsPoster3 citations
  319. Diverse Text-to-3D Synthesis with Augmented Text EmbeddingPoster3 citations
  320. Domain-adaptive Video Deblurring via Test-time BlurringPoster3 citations
  321. DreamDiffusion: High-Quality EEG-to-Image Generation with Temporal Masked Signal Modeling and CLIP AlignmentPoster3 citations
  322. Dual-Camera Smooth Zoom on Mobile PhonesPoster3 citations
  323. DualDn: Dual-domain Denoising via Differentiable ISPPoster3 citations
  324. Dynamic Guidance Adversarial Distillation with Enhanced Teacher KnowledgePoster3 citations
  325. Dynamic Neural Radiance Field From Defocused Monocular VideoPoster3 citations
  326. Dynamic Retraining-Updating Mean Teacher for Source-Free Object DetectionPoster3 citations
  327. DynoSurf: Neural Deformation-based Temporally Consistent Dynamic Surface ReconstructionPoster3 citations
  328. E.T. the Exceptional Trajectory: Text-to-camera-trajectory generation with character awarenessPoster3 citations
  329. EA-VTR: Event-Aware Video-Text RetrievalPoster3 citations
  330. Effective Lymph Nodes Detection in CT Scans Using Location Debiased Query Selection and Contrastive Query Representation in TransformerPoster3 citations
  331. Efficient and Versatile Robust Fine-Tuning of Zero-shot ModelsPoster3 citations
  332. Embedding-Free Transformer with Inference Spatial Reduction for Efficient Semantic SegmentationPoster3 citations
  333. Encapsulating Knowledge in One PromptPoster3 citations
  334. Equi-GSPR: Equivariant SE(3) Graph Network Model for Sparse Point Cloud RegistrationOral3 citations
  335. Exploring Phrase-Level Grounding with Text-to-Image Diffusion ModelPoster3 citations
  336. FYI: Flip Your Images for Dataset DistillationPoster3 citations
  337. FedTSA: A Cluster-based Two-Stage Aggregation Method for Model-heterogeneous Federated LearningPoster3 citations
  338. Few-Shot Image Generation by Conditional Relaxing Diffusion InversionPoster3 citations
  339. Few-shot Defect Image Generation based on Consistency ModelingPoster3 citations
  340. Flash-Splat: 3D Reflection Removal with Flash Cues and Gaussian SplatsPoster3 citations
  341. Free Lunch for Gait Recognition: A Novel Relation DescriptorPoster3 citations
  342. FreeDiff: Progressive Frequency Truncation for Image Editing with Diffusion ModelsPoster3 citations
  343. Fundamental Matrix Estimation Using Relative DepthsPoster3 citations
  344. GKGNet: Group K-Nearest Neighbor based Graph Convolutional Network for Multi-Label Image RecognitionPoster3 citations
  345. Gated Temporal Diffusion for Stochastic Long-term Dense AnticipationPoster3 citations
  346. Generalizable Facial Expression RecognitionPoster3 citations
  347. Generating Physically Realistic and Directable Human Motions from Multi-Modal InputsPoster3 citations
  348. GroCo: Ground Constraint for Metric Self-Supervised Monocular DepthPoster3 citations
  349. HAT: History-Augmented Anchor Transformer for Online Temporal Action LocalizationPoster3 citations
  350. HIMO: A New Benchmark for Full-Body Human Interacting with Multiple ObjectsPoster3 citations
  351. HSR: Holistic 3D Human-Scene Reconstruction from Monocular VideosPoster3 citations
  352. HandDAGT: A Denoising Adaptive Graph Transformer for 3D Hand Pose EstimationPoster3 citations
  353. Heterogeneous Graph Learning for Scene Graph Prediction in 3D Point CloudsPoster3 citations
  354. High-Fidelity and Transferable NeRF Editing by Frequency DecompositionPoster3 citations
  355. High-Quality Mesh Blendshape Generation from Face Videos via Neural Inverse RenderingPoster3 citations
  356. IG Captioner: Information Gain Captioners are Strong Zero-shot ClassifiersPoster3 citations
  357. IVTP: Instruction-guided Visual Token Pruning for Large Vision-Language ModelsPoster3 citations
  358. Improving Geo-diversity of Generated Images with Contextualized Vendi Score GuidancePoster3 citations
  359. Improving Neural Surface Reconstruction with Feature Priors from Multi-View ImagesPoster3 citations
  360. InfoNorm: Mutual Information Shaping of Normals for Sparse-View ReconstructionPoster3 citations
  361. Instruction Tuning-free Visual Token Complement for Multimodal LLMsPoster3 citations
  362. Intrinsic Single-Image HDR ReconstructionPoster3 citations
  363. Invertible Neural Warp for NeRFPoster3 citations
  364. KFD-NeRF: Rethinking Dynamic NeRF with Kalman FilterPoster3 citations
  365. KeypointDETR: An End-to-End 3D Keypoint DetectorOral3 citations
  366. Kinetic Typography Diffusion ModelPoster3 citations
  367. Labeled Data Selection for Category DiscoveryPoster3 citations
  368. Layer-Wise Relevance Propagation with Conservation Property for ResNetPoster3 citations
  369. Learn to Preserve and Diversify: Parameter-Efficient Group with Orthogonal Regularization for Domain GeneralizationPoster3 citations
  370. Learning Cross-hand Policies of High-DOF Reaching and GraspingPoster3 citations
  371. Learning Diffusion Models for Multi-View Anomaly DetectionPoster3 citations
  372. Learning Local Pattern Modularization for Point Cloud Reconstruction from Unseen ClassesPoster3 citations
  373. Learning Scalable Model Soup on a Single GPU: An Efficient Subspace Training StrategyPoster3 citations
  374. Learning by Aligning 2D Skeleton Sequences and Multi-Modality FusionPoster3 citations
  375. Learning to Complement and to Defer to Multiple UsersPoster3 citations
  376. Learning to Obstruct Few-Shot Image Classification over Restricted ClassesPoster3 citations
  377. LiDAR-based All-weather 3D Object Detection via Prompting and Distilling 4D RadarPoster3 citations
  378. Linearly Controllable GAN: Unsupervised Feature Categorization and Decomposition for Image Generation and ManipulationPoster3 citations
  379. Local Action-Guided Motion Diffusion Model for Text-to-Motion GenerationPoster3 citations
  380. M^2Depth: Self-supervised Two-Frame Multi-camera Metric Depth EstimationOral3 citations
  381. MagicMirror: Fast and High-Quality Avatar Generation with Constrained Search SpacePoster3 citations
  382. Make Your ViT-based Multi-view 3D Detectors Faster via Token CompressionPoster3 citations
  383. Markov Knowledge Distillation: Make Nasty Teachers trained by Self-undermining Knowledge Distillation Fully DistillablePoster3 citations
  384. MarvelOVD: Marrying Object Recognition and Vision-Language Models for Robust Open-Vocabulary Object DetectionPoster3 citations
  385. MemBN: Robust Test-Time Adaptation via Batch Norm with Statistics MemoryPoster3 citations
  386. Memory-Efficient Fine-Tuning for Quantized Diffusion ModelPoster3 citations
  387. Minimalist Vision with Freeform PixelsOral3 citations
  388. Mitigating Perspective Distortion-induced Shape Ambiguity in Image CropsPoster3 citations
  389. MoEAD: A Parameter-efficient Model for Multi-class Anomaly DetectionPoster3 citations
  390. Modeling and Driving Human Body Soundfields through Acoustic PrimitivesPoster3 citations
  391. Modelling Competitive Behaviors in Autonomous Driving Under Generative World ModelPoster3 citations
  392. MonoTTA: Fully Test-Time Adaptation for Monocular 3D Object DetectionPoster3 citations
  393. Motion-Oriented Compositional Neural Radiance Fields for Monocular Dynamic Human ModelingPoster3 citations
  394. Multiscale Sliced Wasserstein Distances as Perceptual Color Difference MeasuresPoster3 citations
  395. Möbius Transform for Mitigating Perspective Distortions in Representation LearningPoster3 citations
  396. Neural Volumetric World Models for Autonomous DrivingPoster3 citations
  397. Object-Aware Query Perturbation for Cross-Modal Image-Text RetrievalPoster3 citations
  398. Occluded Gait Recognition with Mixture of Experts: An Action Detection PerspectivePoster3 citations
  399. Open Vocabulary 3D Scene Understanding via Geometry Guided Self-DistillationPoster3 citations
  400. Open-Set Biometrics: Beyond Good Closed-Set ModelsPoster3 citations
  401. OpenKD: Opening Prompt Diversity for Zero- and Few-shot Keypoint DetectionPoster3 citations
  402. Operational Open-Set Recognition and PostMax RefinementPoster3 citations
  403. Optimizing Illuminant Estimation in Dual-Exposure HDR ImagingPoster3 citations
  404. Overcome Modal Bias in Multi-modal Federated Learning via Balanced Modality SelectionPoster3 citations
  405. Overcoming Distribution Mismatch in Quantizing Image Super-Resolution NetworksPoster3 citations
  406. PARIS3D: Reasoning-based 3D Part Segmentation Using Large Multimodal ModelPoster3 citations
  407. PCF-Lift: Panoptic Lifting by Probabilistic Contrastive FusionPoster3 citations
  408. PEA-Diffusion: Parameter-Efficient Adapter with Knowledge Distillation in non-English Text-to-Image GenerationPoster3 citations
  409. PRET: Planning with Directed Fidelity Trajectory for Vision and Language NavigationPoster3 citations
  410. Parameterized Quasi-Physical Simulators for Dexterous Manipulations TransferPoster3 citations
  411. PartCraft: Crafting Creative Objects by PartsPoster3 citations
  412. PartGLEE: A Foundation Model for Recognizing and Parsing Any ObjectsPoster3 citations
  413. PartImageNet++ Dataset: Scaling up Part-based Models for Robust RecognitionPoster3 citations
  414. PartSTAD: 2D-to-3D Part Segmentation Task AdaptationPoster3 citations
  415. Ponymation: Learning Articulated 3D Animal Motions from Unlabeled Online VideosPoster3 citations
  416. Pose-Aware Self-Supervised Learning with Viewpoint Trajectory RegularizationOral3 citations
  417. Power Variable Projection for Initialization-Free Large-Scale Bundle AdjustmentPoster3 citations
  418. Powerful and Flexible: Personalized Text-to-Image Generation via Reinforcement LearningPoster3 citations
  419. Preventing Catastrophic Overfitting in Fast Adversarial Training: A Bi-level Optimization PerspectivePoster3 citations
  420. ProMerge: Prompt and Merge for Unsupervised Instance SegmentationPoster3 citations
  421. Progressive Classifier and Feature Extractor Adaptation for Unsupervised Domain Adaptation on Point CloudsPoster3 citations
  422. Prompt-Based Test-Time Real Image Dehazing: A Novel PipelinePoster3 citations
  423. Pseudo-RIS: Distinctive Pseudo-supervision Generation for Referring Image SegmentationPoster3 citations
  424. Pseudo-keypoint RKHS Learning for Self-supervised 6DoF Pose EstimationPoster3 citations
  425. Q&A Prompts: Discovering Rich Visual Clues through Mining Question-Answer Prompts for VQA requiring Diverse World KnowledgePoster3 citations
  426. RISurConv: Rotation Invariant Surface Attention-Augmented Convolutions for 3D Point Cloud Classification and SegmentationOral3 citations
  427. R^2-Bench: Benchmarking the Robustness of Referring Perception Models under PerturbationsPoster3 citations
  428. Rasterized Edge Gradients: Handling Discontinuities DifferentiallyOral3 citations
  429. ReCON: Training-Free Acceleration for Text-to-Image Synthesis with Retrieval of Concept Prompt TrajectoriesPoster3 citations
  430. Real Appearance Modeling for More General Deepfake DetectionPoster3 citations
  431. Responsible Visual EditingPoster3 citations
  432. Rethinking and Improving Visual Prompt Selection for In-Context Learning Segmentation FrameworkPoster3 citations
  433. RoScenes: A Large-scale Multi-view 3D Dataset for Roadside PerceptionPoster3 citations
  434. Robust Zero-Shot Crowd Counting and Localization with Adaptive Resolution SAMPoster3 citations
  435. SA-DVAE: Improving Zero-Shot Skeleton-Based Action Recognition by Disentangled Variational AutoencodersPoster3 citations
  436. SCOD: From Heuristics to TheoryPoster3 citations
  437. SCP-Diff: Spatial-Categorical Joint Prior for Diffusion Based Semantic Image SynthesisPoster3 citations
  438. SHIC: Shape-Image Correspondences with no Keypoint SupervisionPoster3 citations
  439. STSP: Spatial-Temporal Subspace Projection for Video Class-incremental LearningPoster3 citations
  440. S^3D-NeRF: Single-Shot Speech-Driven Neural Radiance Field for High Fidelity Talking Head SynthesisPoster3 citations
  441. Self-supervised co-salient object detection via feature correspondences at multiple scalesPoster3 citations
  442. SelfGeo: Self-supervised and Geodesic-consistent Estimation of Keypoints on Deformable ShapesPoster3 citations
  443. SemanticHuman-HD: High Resolution Semantic disentangled 3D Human GenerationPoster3 citations
  444. Semi-supervised Segmentation of Histopathology Images with Noise-Aware Topological ConsistencyPoster3 citations
  445. Semicalibrated Relative Pose from an Affine Correspondence and MonodepthPoster3 citations
  446. Similarity of Neural Architectures using Adversarial Attack TransferabilityPoster3 citations
  447. Skeleton-based Group Activity Recognition via Spatial-Temporal Panoramic GraphPoster3 citations
  448. SlotLifter: Slot-guided Feature Lifting for Learning Object-Centric Radiance FieldsPoster3 citations
  449. Strike a Balance in Continual Panoptic SegmentationPoster3 citations
  450. StyleCity: Large-Scale 3D Urban Scenes StylizationPoster3 citations
  451. TPA3D: Triplane Attention for Fast Text-to-3D GenerationPoster3 citations
  452. Take A Step Back: Rethinking the Two Stages in Visual ReasoningPoster3 citations
  453. Test-Time Stain Adaptation with Diffusion Models for Histopathology Image ClassificationPoster3 citations
  454. Text Motion Translator: A Bi-Directional Model for Enhanced 3D Human Motion Generation from Open-Vocabulary DescriptionsPoster3 citations
  455. Textual Query-Driven Mask Transformer for Domain Generalized SegmentationPoster3 citations
  456. Three Things We Need to Know About Transferring Stable Diffusion to Visual Dense Prediciton TasksPoster3 citations
  457. Towards Image Ambient Lighting NormalizationPoster3 citations
  458. Towards Physical World Backdoor Attacks against Skeleton Action RecognitionPoster3 citations
  459. Towards Real-World Adverse Weather Image Restoration: Enhancing Clearness and Semantics with Vision-Language ModelsPoster3 citations
  460. Towards Robust Event-based Networks for Nighttime via Unpaired Day-to-Night Event TranslationPoster3 citations
  461. Towards Stable 3D Object DetectionPoster3 citations
  462. U-COPE: Taking a Further Step to Universal 9D Category-level Object Pose EstimationPoster3 citations
  463. UCIP: A Universal Framework for Compressed Image Super-Resolution using Dynamic PromptPoster3 citations
  464. UMERegRobust – Universal Manifold Embedding Compatible Features for Robust Point Cloud RegistrationPoster3 citations
  465. Un-EVIMO: Unsupervised Event-based Independent Motion SegmentationPoster3 citations
  466. Understanding and Mitigating Human-Labelling Errors in Supervised Contrastive LearningPoster3 citations
  467. UniCal: Unified Neural Sensor CalibrationPoster3 citations
  468. UniTalker: Scaling up Audio-Driven 3D Facial Animation through A Unified ModelPoster3 citations
  469. Unlocking Attributes' Contribution to Successful Camouflage: A Combined Textual and Visual Analysis StrategyPoster3 citations
  470. Unmasking Bias in Diffusion Model TrainingPoster3 citations
  471. Unsupervised Moving Object Segmentation with Atmospheric TurbulencePoster3 citations
  472. VCD-Texture: Variance Alignment based 3D-2D Co-Denoising for Text-Guided TexturingPoster3 citations
  473. Viewpoint textual inversion: discovering scene representations and 3D view control in 2D diffusion modelsPoster3 citations
  474. Visual Grounding for Object-Level Generalization in Reinforcement LearningPoster3 citations
  475. WAVE: Warping DDIM Inversion Features for Zero-shot Text-to-Video EditingPoster3 citations
  476. WPS-SAM: Towards Weakly-Supervised Part Segmentation with Foundation ModelsOral3 citations
  477. Weakly Supervised Co-training with Swapping Assignments for Semantic SegmentationPoster3 citations
  478. WebRPG: Automatic Web Rendering Parameters Generation for Visual PresentationPoster3 citations
  479. iNeMo: Incremental Neural Mesh Models for Robust Class-Incremental LearningPoster3 citations
  480. nuCraft: Crafting High Resolution 3D Semantic Occupancy for Unified 3D Scene UnderstandingPoster3 citations
  481. "DECOLLAGE: 3D Detailization by Controllable, Localized, and Learned Geometry Enhancement"Poster2 citations
  482. "Not Just Change the Labels, Learn the Features: Watermarking Deep Neural Networks with Multi-View Data"Poster2 citations
  483. "Propose, Assess, Search: Harnessing LLMs for Goal-Oriented Planning in Instructional Videos"Oral2 citations
  484. "SPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models"Poster2 citations
  485. 2S-ODIS: Two-Stage Omni-Directional Image Synthesis by Geometric Distortion CorrectionPoster2 citations
  486. 3D Hand Sequence Recovery from Real Blurry Images and Event StreamPoster2 citations
  487. 3D Reconstruction of Objects in Hands without Real World 3D SupervisionPoster2 citations
  488. 3D Weakly Supervised Semantic Segmentation with 2D Vision-Language GuidancePoster2 citations
  489. 3R-INN: How to be climate friendly while consuming/delivering videos?Poster2 citations
  490. 3x2: 3D Object Part Segmentation by 2D Semantic CorrespondencesPoster2 citations
  491. A Cephalometric Landmark Regression Method based on Dual-encoder for High-resolution X-ray ImagePoster2 citations
  492. A Direct Approach to Viewing Graph SolvabilityOral2 citations
  493. A Simple Low-bit Quantization Framework for Video Snapshot Compressive ImagingOral2 citations
  494. AFreeCA: Annotation-Free Counting for AllPoster2 citations
  495. Accelerating Image Super-Resolution Networks with Pixel-Level ClassificationPoster2 citations
  496. AdaIFL: Adaptive Image Forgery Localization via a Dynamic and Importance-aware Transformer NetworkPoster2 citations
  497. Adapt without Forgetting: Distill Proximity from Dual Teachers in Vision-Language ModelsPoster2 citations
  498. Adapt2Reward: Adapting Video-Language Models to Generalizable Robotic Rewards via Failure PromptsPoster2 citations
  499. Adaptive Parametric ActivationOral2 citations
  500. AddMe: Zero-shot Group-photo Synthesis by Inserting People into ScenesPoster2 citations
  501. AdversariaLeak: External Information Leakage Attack Using Adversarial Samples on Face Recognition SystemsPoster2 citations
  502. Adversarially Robust Distillation by Reducing the Student-Teacher Variance GapPoster2 citations
  503. AnimateMe: 4D Facial Expressions via Diffusion ModelsPoster2 citations
  504. Approaching Outside: Scaling Unsupervised 3D Object Detection from 2D ScenePoster2 citations
  505. Are Synthetic Data Useful for Egocentric Hand-Object Interaction Detection?Poster2 citations
  506. ArtVLM: Attribute Recognition Through Vision-Based Prefix Language ModelingPoster2 citations
  507. Assessing Sample Quality via the Latent Space of Generative ModelsPoster2 citations
  508. AugDETR: Improving Multi-scale Learning for Detection TransformerPoster2 citations
  509. AvatarPose: Avatar-guided 3D Pose Estimation of Close Human Interaction from Sparse Multi-view VideosPoster2 citations
  510. Better Regression Makes Better Test-time Adaptive 3D Object DetectionPoster2 citations
  511. Bi-TTA: Bidirectional Test-Time Adapter for Remote Physiological MeasurementPoster2 citations
  512. Boosting Gaze Object Prediction via Pixel-level Supervision from Vision Foundation ModelPoster2 citations
  513. Brain Netflix: Scaling Data to Reconstruct Videos from Brain SignalsPoster2 citations
  514. Bucketed Ranking-based Losses for Efficient Training of Object DetectorsPoster2 citations
  515. CARFF: Conditional Auto-encoded Radiance Field for 3D Scene ForecastingPoster2 citations
  516. CC-SAM: Enhancing SAM with Cross-feature Attention and Context for Ultrasound Image SegmentationPoster2 citations
  517. CONDA: Condensed Deep Association Learning for Co-Salient Object Detection.Poster2 citations
  518. CPM: Class-conditional Prompting Machine for Audio-visual SegmentationPoster2 citations
  519. Camera Height Doesn't Change: Unsupervised Training for Metric Monocular Road-Scene Depth EstimationPoster2 citations
  520. CamoTeacher: Dual-Rotation Consistency Learning for Semi-Supervised Camouflaged Object DetectionPoster2 citations
  521. CatchBackdoor: Backdoor Detection via Critical Trojan Neural Path FuzzingPoster2 citations
  522. CipherDM: Secure Three-Party Inference for Diffusion Model SamplingPoster2 citations
  523. CityGuessr: City-Level Video Geo-Localization on a Global ScalePoster2 citations
  524. Clean & Compact: Efficient Data-Free Backdoor Defense with Model CompactnessPoster2 citations
  525. CoLeaF: A Contrastive-Collaborative Learning Framework for Weakly Supervised Audio-Visual Video ParsingPoster2 citations
  526. CoPT: Unsupervised Domain Adaptive Segmentation using Domain-Agnostic Text EmbeddingsPoster2 citations
  527. Collaborative Control for Geometry-Conditioned PBR Image GenerationPoster2 citations
  528. ColorMAE: Exploring data-independent masking strategies in Masked AutoEncodersPoster2 citations
  529. Compensation Sampling for Improved Convergence in Diffusion ModelsPoster2 citations
  530. Compositional Substitutivity of Visual Reasoning for Visual Question AnsweringPoster2 citations
  531. Comprehensive Attribution: Inherently Explainable Vision Model with Feature DetectorPoster2 citations
  532. Contrastive Learning with Synthetic PositivesPoster2 citations
  533. Contribution-based Low-Rank Adaptation with Pre-training Model for Real Image RestorationPoster2 citations
  534. CroMo-Mixup: Augmenting Cross-Model Representations for Continual Self-Supervised LearningPoster2 citations
  535. Customized Generation Reimagined: Fidelity and Editability HarmonizedPoster2 citations
  536. D-SCo: Dual-Stream Conditional Diffusion for Monocular Hand-Held Object ReconstructionPoster2 citations
  537. DCDM: Diffusion-Conditioned-Diffusion Model for Scene Text Image Super-ResolutionPoster2 citations
  538. DEVIAS: Learning Disentangled Video Representations of Action and SceneOral2 citations
  539. DISCO: Embodied Navigation and Interaction via Differentiable Scene Semantics and Dual-level ControlPoster2 citations
  540. DNI: Dilutional Noise Initialization for Diffusion Video EditingPoster2 citations
  541. Data Augmentation via Latent Diffusion for Saliency PredictionPoster2 citations
  542. De-confounded Gaze EstimationPoster2 citations
  543. Decomposed Vector-Quantized Variational Autoencoder for Human Grasp GenerationPoster2 citations
  544. Dependency-aware Differentiable Neural Architecture SearchPoster2 citations
  545. Differentiable Product Quantization for Memory Efficient Camera RelocalizationPoster2 citations
  546. Diffusion Model for Robust Multi-Sensor Fusion in 3D Object Detection and BEV SegmentationPoster2 citations
  547. Diffusion Prior-Based Amortized Variational Inference for Noisy Inverse ProblemsOral2 citations
  548. Diffusion for Out-of-Distribution Detection on Road Scenes and BeyondPoster2 citations
  549. Discovering Novel Actions from Open World Egocentric Videos with Object-Grounded Visual Commonsense ReasoningPoster2 citations
  550. Divide and Fuse: Body Part Mesh Recovery from Partially Visible Human ImagesPoster2 citations
  551. Do Generalised Classifiers really work on Human Drawn Sketches?Poster2 citations
  552. DomainFusion: Generalizing To Unseen Domains with Latent Diffusion ModelsPoster2 citations
  553. DreamDrone: Text-to-Image Diffusion Models are Zero-shot Perpetual View GeneratorsPoster2 citations
  554. DreamView: Injecting View-specific Text Guidance into Text-to-3D GenerationPoster2 citations
  555. EBDM: Exemplar-guided Image Translation with Brownian-bridge Diffusion ModelsPoster2 citations
  556. EINet: Point Cloud Completion via Extrapolation and InterpolationPoster2 citations
  557. Early Preparation Pays Off: New Classifier Pre-tuning for Class Incremental Semantic SegmentationPoster2 citations
  558. Efficient Bias Mitigation Without Privileged InformationOral2 citations
  559. Efficient Learning of Event-based Dense Representation using Hierarchical Memories with Adaptive UpdatePoster2 citations
  560. Elegantly Written: Disentangling Writer and Character Styles for Enhancing Online Chinese HandwritingPoster2 citations
  561. Elevating All Zero-Shot Sketch-Based Image Retrieval Through Multimodal Prompt LearningPoster2 citations
  562. Enhanced Motion Forecasting with Visual Relation ReasoningPoster2 citations
  563. Enhanced Sparsification via Stimulative TrainingPoster2 citations
  564. Enhancing Plausibility Evaluation for Generated Designs with Denoising AutoencoderPoster2 citations
  565. Enhancing Tampered Text Detection through Frequency Feature Fusion and DecompositionPoster2 citations
  566. Enriching Information and Preserving Semantic Consistency in Expanding Curvilinear Object Segmentation DatasetsPoster2 citations
  567. EntAugment: Entropy-Driven Adaptive Data Augmentation Framework for Image ClassificationPoster2 citations
  568. EraseDraw : Learning to Insert Objects by Erasing Them from ImagesPoster2 citations
  569. Event-based Head Pose Estimation: Benchmark and MethodPoster2 citations
  570. Exploring Vulnerabilities in Spiking Neural Networks: Direct Adversarial Attacks on Raw Event DataPoster2 citations
  571. FREST: Feature RESToration for Semantic Segmentation under Multiple Adverse ConditionsPoster2 citations
  572. FastCAD: Real-Time CAD Retrieval and Alignment from Scans and VideosPoster2 citations
  573. FastPCI: Motion-Structure Guided Fast Point Cloud Frame InterpolationPoster2 citations
  574. FedVAD: Enhancing Federated Video Anomaly Detection with GPT-Driven Semantic DistillationPoster2 citations
  575. Finding Meaning in Points: Weakly Supervised Semantic Segmentation for Event CamerasPoster2 citations
  576. Flowed Time of Flight Radiance FieldsPoster2 citations
  577. From Fake to Real: Pretraining on Balanced Synthetic Images to Prevent Spurious Correlations in Image RecognitionOral2 citations
  578. G2fR: Frequency Regularization in Grid-based Feature Encoding Neural Radiance FieldsPoster2 citations
  579. GAMMA-FACE: GAussian Mixture Models Amend Diffusion Models for Bias Mitigation in Face ImagesPoster2 citations
  580. GRACE: Graph-Based Contextual Debiasing for Fair Visual Question AnsweringPoster2 citations
  581. GenQ: Quantization in Low Data Regimes with Generative Synthetic DataPoster2 citations
  582. GenRC: Generative 3D Room Completion from Sparse Image CollectionsPoster2 citations
  583. Generalized Coverage for More Robust Low-Budget Active LearningPoster2 citations
  584. Geometry Fidelity for Spherical ImagesPoster2 citations
  585. Global-Local Collaborative Inference with LLM for Lidar-Based Open-Vocabulary DetectionPoster2 citations
  586. Gradient-Aware for Class-Imbalanced Semi-supervised Medical Image SegmentationPoster2 citations
  587. H-V2X: A Large Scale Highway Dataset for BEV PerceptionOral2 citations
  588. HVCLIP: High-dimensional Vector in CLIP for Unsupervised Domain AdaptationPoster2 citations
  589. HandDGP: Camera-Space Hand Mesh Prediction with Differentiable Global PositioningPoster2 citations
  590. HiEI: A Universal Framework for Generating High-quality Emerging Images from Natural ImagesPoster2 citations
  591. HyTAS: A Hyperspectral Image Transformer Architecture Search Benchmark and AnalysisPoster2 citations
  592. HybridBooth: Hybrid Prompt Inversion for Efficient Subject-Driven GenerationPoster2 citations
  593. I2-SLAM: Inverting Imaging Process for Robust Photorealistic Dense SLAMPoster2 citations
  594. IFTR: An Instance-Level Fusion Transformer for Visual Collaborative PerceptionPoster2 citations
  595. Image Manipulation Detection With Implicit Neural Representation and Limited SupervisionPoster2 citations
  596. Implicit Neural Models to Extract Heart Rate from VideoPoster2 citations
  597. Improving Vision and Language Concepts Understanding with Multimodal Counterfactual SamplesPoster2 citations
  598. Introducing Routing Functions to Vision-Language Parameter-Efficient Fine-Tuning with Low-Rank BottlenecksPoster2 citations
  599. LNL+K: Enhancing Learning with Noisy Labels Through Noise Source Knowledge IntegrationPoster2 citations
  600. LaMI-DETR: Open-Vocabulary Detection with Language Model InstructionPoster2 citations
  601. Latent-INR: A Flexible Framework for Implicit Representations of Videos with Discriminative SemanticsPoster2 citations
  602. Layout-Corrector: Alleviating Layout Sticking Phenomenon in Discrete Diffusion ModelPoster2 citations
  603. Learned Neural Physics Simulation for Articulated 3D Human Pose ReconstructionPoster2 citations
  604. Learning Anomalies with Normality Prior for Unsupervised Video Anomaly DetectionPoster2 citations
  605. Learning Differentially Private Diffusion Models via Stochastic Adversarial DistillationPoster2 citations
  606. Learning Multimodal Latent Generative Models with Energy-Based PriorOral2 citations
  607. Learning Pseudo 3D Guidance for View-consistent Texturing with 2D DiffusionPoster2 citations
  608. Learning Representation for Multitask Learning through Self-Supervised Auxiliary LearningPoster2 citations
  609. Learning Trimodal Relation for Audio-Visual Question Answering with Missing ModalityPoster2 citations
  610. Learning from the Web: Language Drives Weakly-Supervised Incremental Learning for Semantic SegmentationPoster2 citations
  611. Learning to Enhance Aperture Phasor Field for Non-Line-of-Sight ImagingPoster2 citations
  612. Learning to Localize Actions in Instructional Videos with LLM-Based Multi-Pathway Text-Video AlignmentPoster2 citations
  613. Learning to Make Keypoints Sub-Pixel AccuratePoster2 citations
  614. Learning with Unmasked Tokens Drives Stronger Vision LearnersPoster2 citations
  615. LiDAR-Event Stereo Fusion with HallucinationsPoster2 citations
  616. Light-in-Flight for a World-in-MotionPoster2 citations
  617. LineFit: A Geometric Approach for Fitting Line Segments in ImagesPoster2 citations
  618. LiveHPS++: Robust and Coherent Motion Capture in Dynamic Free EnvironmentOral2 citations
  619. LogoSticker: Inserting Logos into Diffusion Models for Customized GenerationPoster2 citations
  620. Long-Tail Temporal Action Segmentation with Group-wise Temporal Logit AdjustmentPoster2 citations
  621. Long-range Turbulence Mitigation: A Large-scale Dataset and A Coarse-to-fine FrameworkPoster2 citations
  622. Look Hear: Gaze Prediction for Speech-directed Human AttentionPoster2 citations
  623. ML-SemReg: Boosting Point Cloud Registration with Multi-level Semantic ConsistencyPoster2 citations
  624. MO-EMT-NAS: Multi-Objective Continuous Transfer of Architectural Knowledge Between Tasks from Different DatasetsPoster2 citations
  625. Made to Order: Discovering monotonic temporal changes via self-supervised video orderingOral2 citations
  626. Mahalanobis Distance-based Multi-view Optimal Transport for Multi-view Crowd LocalizationPoster2 citations
  627. Mask as Supervision: Leveraging Unified Mask Information for Unsupervised 3D Pose EstimationPoster2 citations
  628. MedRAT: Unpaired Medical Report Generation via Auxiliary TasksPoster2 citations
  629. MeshFeat: Multi-Resolution Features for Neural Fields on MeshesPoster2 citations
  630. Mitigating Background Shift in Class-Incremental Semantic SegmentationPoster2 citations
  631. MonoWAD: Weather-Adaptive Diffusion Model for Robust Monocular 3D Object DetectionPoster2 citations
  632. Multi-Modal Video Dialog State Tracking in the WildPoster2 citations
  633. Multi-Sentence Grounding for Long-term Instructional VideoPoster2 citations
  634. NAMER: Non-Autoregressive Modeling for Handwritten Mathematical Expression RecognitionPoster2 citations
  635. NL2Contact: Natural Language Guided 3D Hand-Object Contact Modeling with Diffusion ModelOral2 citations
  636. Navigating Text-to-Image Generative Bias across Indic LanguagesPoster2 citations
  637. Neural MetamorphosisPoster2 citations
  638. Nickel and Diming Your GAN: A Dual-Method Approach to Enhancing GAN Efficiency via Knowledge DistillationPoster2 citations
  639. Non-transferable PruningPoster2 citations
  640. OMR: Occlusion-Aware Memory-Based Refinement for Video Lane DetectionPoster2 citations
  641. OP-Align: Object-level and Part-level Alignment for Self-supervised Category-level Articulated Object Pose EstimationOral2 citations
  642. Occlusion-Aware Seamless SegmentationPoster2 citations
  643. Omniview-Tuning: Boosting Viewpoint Invariance of Vision-Language Pre-training ModelsOral2 citations
  644. On Learning Discriminative Features from Synthesized Data for Self-Supervised Fine-Grained Visual RecognitionPoster2 citations
  645. On Pretraining Data Diversity for Self-Supervised LearningPoster2 citations
  646. On the Approximation Risk of Few-Shot Class-Incremental LearningPoster2 citations
  647. On the Vulnerability of Skip Connections to Model Inversion AttacksPoster2 citations
  648. OneTrack: Demystifying the Conflict Between Detection and Tracking in End-to-End 3D TrackersPoster2 citations
  649. Open Vocabulary Multi-Label Video ClassificationPoster2 citations
  650. Open-World Dynamic Prompt and Continual Visual Representation LearningPoster2 citations
  651. Optimization-based Uncertainty Attribution Via Learning Informative PerturbationsPoster2 citations
  652. PMT: Progressive Mean Teacher via Exploring Temporal Consistency for Semi-Supervised Medical Image SegmentationPoster2 citations
  653. POA: Pre-training Once for Models of All SizesPoster2 citations
  654. PaPr: Training-Free One-Step Patch Pruning with Lightweight ConvNets for Faster InferencePoster2 citations
  655. PapMOT: Exploring Adversarial Patch Attack against Multiple Object TrackingPoster2 citations
  656. Personalized Privacy Protection Mask Against Unauthorized Facial RecognitionPoster2 citations
  657. Pick-a-back: Selective Device-to-Device Knowledge Transfer in Federated Continual LearningPoster2 citations
  658. Plain-Det: A Plain Multi-Dataset Object DetectorPoster2 citations
  659. Plug and Play: A Representation Enhanced Domain Adapter for Collaborative PerceptionPoster2 citations
  660. PolyRoom: Room-aware Transformer for Floorplan ReconstructionPoster2 citations
  661. PreLAR: World Model Pre-training with Learnable Action RepresentationPoster2 citations
  662. Prediction Exposes Your Face: Black-box Model Inversion via Prediction AlignmentPoster2 citations
  663. Quantization-Friendly Winograd Transformations for Convolutional Neural NetworksPoster2 citations
  664. QueryCDR: Query-based Controllable Distortion Rectification Network for Fisheye ImagesPoster2 citations
  665. RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image EnhancementPoster2 citations
  666. Ray-Distance Volume Rendering for Neural Scene ReconstructionPoster2 citations
  667. ReALFRED: An Embodied Instruction Following Benchmark in Photo-Realistic EnvironmentsPoster2 citations
  668. RePOSE: 3D Human Pose Estimation via Spatio-Temporal Depth Relational ConsistencyPoster2 citations
  669. Region-Aware Sequence-to-Sequence Learning for Hyperspectral DenoisingPoster2 citations
  670. Regulating Model Reliance on Non-Robust Features by Smoothing Input Marginal DensityPoster2 citations
  671. RepVF: A Unified Vector Fields Representation for Multi-task 3D PerceptionPoster2 citations
  672. Retargeting Visual Data with Deformation FieldsPoster2 citations
  673. Rethinking Image Super Resolution from Training Data PerspectivesPoster2 citations
  674. Rethinking Image-to-Video Adaptation: An Object-centric PerspectivePoster2 citations
  675. Rethinking LiDAR Domain Generalization: Single Source as Multiple Density DomainsPoster2 citations
  676. Rethinking Video-Text Understanding: Retrieval from Counterfactually Augmented DataPoster2 citations
  677. SAFT: Towards Out-of-Distribution Generalization in Fine-TuningPoster2 citations
  678. SCAPE: A Simple and Strong Category-Agnostic Pose EstimatorPoster2 citations
  679. SCOMatch: Alleviating Overtrusting in Open-set Semi-supervised LearningPoster2 citations
  680. SENC: Handling Self-collision in Neural Cloth SimulationPoster2 citations
  681. SG-NeRF: Neural Surface Reconstruction with Scene Graph OptimizationPoster2 citations
  682. SIGMA: Sinkhorn-Guided Masked Video ModelingPoster2 citations
  683. SINDER: Repairing the Singular Defects of DINOv2Oral2 citations
  684. SMILe: Leveraging Submodular Mutual Information For Robust Few-Shot Object DetectionPoster2 citations
  685. SPIN: Hierarchical Segmentation with Subpart Granularity in Natural ImagesPoster2 citations
  686. SPVLoc: Semantic Panoramic Viewport Matching for 6D Camera Localization in Unseen EnvironmentsOral2 citations
  687. SUP-NeRF: A Streamlined Unification of Pose Estimation and NeRF for Monocular 3D Object ReconstructionPoster2 citations
  688. Scaling Backwards: Minimal Synthetic Pre-training?Poster2 citations
  689. Seeing Faces in Things: A Model and Dataset for PareidoliaPoster2 citations
  690. Self-Supervised Any-Point Tracking by Contrastive Random WalksPoster2 citations
  691. Self-Training Room Layout via Geometry-aware Ray-castingPoster2 citations
  692. SelfSwapper: Self-Supervised Face Swapping via Shape Agnostic Masked AutoEncoderPoster2 citations
  693. SemReg: Semantics Constrained Point Cloud RegistrationPoster2 citations
  694. Semantic Diversity-aware Prototype-based Learning for Unbiased Scene Graph GenerationPoster2 citations
  695. Shape-guided Configuration-aware Learning for Endoscopic-image-based Pose Estimation of Flexible Robotic InstrumentsPoster2 citations
  696. ShoeModel: Learning to Wear on the User-specified Shoes via Diffusion ModelPoster2 citations
  697. SignGen: End-to-End Sign Language Video Generation with Latent DiffusionPoster2 citations
  698. SimPB: A Single Model for 2D and 3D Object Detection from Multiple CamerasPoster2 citations
  699. Six-Point Method for Multi-Camera Systems with Reduced Solution SpaceOral2 citations
  700. SkyMask: Attack-agnostic Robust Federated Learning with Fine-grained Learnable MasksPoster2 citations
  701. SkyScenes: A Synthetic Dataset for Aerial Scene UnderstandingPoster2 citations
  702. Source-Free Domain-Invariant Performance PredictionPoster2 citations
  703. Sparse Refinement for Efficient High-Resolution Semantic SegmentationPoster2 citations
  704. Spatial-Temporal Multi-level Association for Video Object SegmentationPoster2 citations
  705. Spatially-Variant Degradation Model for Dataset-free Super-resolutionPoster2 citations
  706. Spike-Temporal Latent Representation for Energy-Efficient Event-to-Video ReconstructionPoster2 citations
  707. Statewide Visual Geolocalization in the WildPoster2 citations
  708. Structured-NeRF: Hierarchical Scene Graph with Neural RepresentationPoster2 citations
  709. SuperFedNAS: Cost-Efficient Federated Neural Architecture Search for On-Device InferencePoster2 citations
  710. Superpixel-informed Implicit Neural Representation for Multi-Dimensional DataPoster2 citations
  711. Synchronization of Projective TransformationsPoster2 citations
  712. TCLC-GS: Tightly Coupled LiDAR-Camera Gaussian Splatting for Autonomous DrivingPoster2 citations
  713. TTD: Text-Tag Self-Distillation Enhancing Image-Text Alignment in CLIP to Alleviate Single Tag BiasPoster2 citations
  714. TTT-MIM: Test-Time Training with Masked Image Modeling for Denoising Distribution ShiftsPoster2 citations
  715. Taming Lookup Tables for Efficient Image RetouchingPoster2 citations
  716. Task-Driven Uncertainty Quantification in Inverse Problems via Conformal PredictionPoster2 citations
  717. Temporal Residual Guided Diffusion Framework for Event-Driven Video ReconstructionOral2 citations
  718. Temporal Residual Jacobians for Rig-free Motion TransferPoster2 citations
  719. Tendency-driven Mutual Exclusivity for Weakly Supervised Incremental Semantic SegmentationPoster2 citations
  720. Test-time Model Adaptation for Image Reconstruction Using Self-supervised Adaptive LayersPoster2 citations
  721. This Probably Looks Exactly Like That: An Invertible Prototypical NetworkPoster2 citations
  722. Topo4D: Topology-Preserving Gaussian Splatting for High-Fidelity 4D Head CapturePoster2 citations
  723. Toward Tiny and High-quality Facial Makeup with Data Amplify LearningPoster2 citations
  724. Towards Adaptive Pseudo-label Learning for Semi-Supervised Temporal Action LocalizationPoster2 citations
  725. Towards More Practical Group Activity Detection: A New Benchmark and ModelPoster2 citations
  726. Towards Open-World Object-based Anomaly Detection via Self-Supervised Outlier SynthesisPoster2 citations
  727. Trajectory-aligned Space-time Tokens for Few-shot Action RecognitionPoster2 citations
  728. TriNeRFLet: A Wavelet Based Triplane NeRF RepresentationPoster2 citations
  729. Two-Stage Video Shadow Detection via Temporal-Spatial AdaptionPoster2 citations
  730. UL-VIO: Ultra-lightweight Visual-Inertial Odometry with Noise Robust Test-time AdaptationPoster2 citations
  731. UNIKD: UNcertainty-Filtered Incremental Knowledge Distillation for Neural Implicit RepresentationPoster2 citations
  732. UniFS: Universal Few-shot Instance Perception with Point RepresentationsPoster2 citations
  733. Unsupervised Exposure CorrectionPoster2 citations
  734. VSViG: Real-time Video-based Seizure Detection via Skeleton-based Spatiotemporal ViGPoster2 citations
  735. VisFocus: Prompt-Guided Vision Encoders for OCR-Free Dense Document UnderstandingPoster2 citations
  736. Vision-Language Dual-Pattern Matching for Out-of-Distribution DetectionPoster2 citations
  737. Vista3D: unravel the 3d darkside of a single imagePoster2 citations
  738. WaSt-3D: Wasserstein-2 Distance for Scene-to-Scene Stylization on 3D GaussiansPoster2 citations
  739. Weakly-Supervised Spatio-Temporal Video Grounding with Variational Cross-Modal AlignmentPoster2 citations
  740. Weighting Pseudo-Labels via High-Activation Feature Index Similarity and Object Detection for Semi-Supervised SegmentationPoster2 citations
  741. X-Former: Unifying Contrastive and Reconstruction Learning for MLLMsPoster2 citations
  742. Zero-Shot Adaptation for Approximate Posterior Sampling of Diffusion Models in Inverse ProblemsPoster2 citations
  743. Zero-shot Text-guided Infinite Image Synthesis with LLM guidancePoster2 citations
  744. denoiSplit: a method for joint microscopy image splitting and unsupervised denoisingPoster2 citations
  745. "Plan, Posture and Go: Towards Open-vocabulary Text-to-Motion Generation"Poster1 citations
  746. "PoseEmbroider: Towards a 3D, Visual, Semantic-aware Human Pose Representation"Poster1 citations
  747. "SIMBA: Split Inference - Mechanisms, Benchmarks and Attacks"Poster1 citations
  748. "Smoothness, Synthesis, and Sampling: Re-thinking Unsupervised Multi-View Stereo with DIV Loss"Oral1 citations
  749. "Towards Dual Transparent Liquid Level Estimation in Biomedical Lab: Dataset, Methods and Practice"Poster1 citations
  750. 6DoF Head Pose Estimation through Explicit Bidirectional Interaction with Face GeometryPoster1 citations
  751. A Diffusion Model for Simulation Ready Coronary Anatomy with Morpho-skeletal ControlPoster1 citations
  752. A Fair Ranking and New Model for Panoptic Scene Graph GenerationOral1 citations
  753. A Riemannian Approach for Spatiotemporal Analysis and Generation of 4D Tree-shaped StructuresOral1 citations
  754. A high-quality robust diffusion framework for corrupted datasetPoster1 citations
  755. AD3: Introducing a score for Anomaly Detection Dataset Difficulty assessment using VIADUCT datasetPoster1 citations
  756. ADMap: Anti-disturbance Framework for Vectorized HD Map ConstructionPoster1 citations
  757. ADen: Adaptive Density Representations for Sparse-view Camera Pose EstimationOral1 citations
  758. AEDNet: Adaptive Embedding and Multiview-Aware Disentanglement for Point Cloud CompletionPoster1 citations
  759. Adapting to Shifting Correlations with Unlabeled Data CalibrationPoster1 citations
  760. Adaptive Annealing for Robust AveragingPoster1 citations
  761. Adaptive Correspondence Scoring for Unsupervised Medical Image RegistrationOral1 citations
  762. Adaptive Multi-task Learning for Few-shot Object DetectionPoster1 citations
  763. Adaptive Selection of Sampling-Reconstruction in Fourier Compressed SensingPoster1 citations
  764. Adversarial Robustification via Text-to-Image Diffusion ModelsOral1 citations
  765. Agglomerative Token ClusteringPoster1 citations
  766. Alignist: CAD-Informed Orientation Distribution Estimation by Fusing Shape and CorrespondencesPoster1 citations
  767. An accurate detection is not all you need to combat label noise in web-noisy datasetsPoster1 citations
  768. Analysis-by-Synthesis Transformer for Single-View 3D ReconstructionPoster1 citations
  769. Attention Decomposition for Cross-Domain Semantic SegmentationPoster1 citations
  770. Audio-driven Talking Face Generation with Stabilized Synchronization LossPoster1 citations
  771. BAFFLE: A Baseline of Backpropagation-Free Federated LearningPoster1 citations
  772. Bayesian Evidential Deep Learning for Online Action DetectionPoster1 citations
  773. Benchmarking the Robustness of Cross-view Geo-localization ModelsPoster1 citations
  774. Beyond Viewpoint: Robust 3D Object Recognition under Arbitrary Views through Joint Multi-Part RepresentationPoster1 citations
  775. BugNIST - a Large Volumetric Dataset for Detection under Domain ShiftPoster1 citations
  776. CIC-BART-SSA: : Controllable Image Captioning with Structured Semantic AugmentationPoster1 citations
  777. Catastrophic Overfitting: A Potential Blessing in DisguisePoster1 citations
  778. Chains of Diffusion ModelsPoster1 citations
  779. CliffPhys: Camera-based Respiratory Measurement using Clifford Neural NetworksPoster1 citations
  780. Co-speech Gesture Video Generation with 3D Human MeshesPoster1 citations
  781. Coarse-to-Fine Implicit Representation Learning for 3D Hand-Object Reconstruction from a Single RGB-D ImagePoster1 citations
  782. ComFusion: Enhancing Personalized Generation by Instance-Scene Compositing and FusionPoster1 citations
  783. Commonly Interesting ImagesPoster1 citations
  784. Context-Aware Action Recognition: Introducing a Comprehensive Dataset for Behavior ContrastPoster1 citations
  785. Controllable Contextualized Image Captioning: Directing the Visual Narrative through User-Defined HighlightsPoster1 citations
  786. Correspondence-Free SE(3) Point Cloud Registration in RKHS via Unsupervised Equivariant LearningPoster1 citations
  787. CriSp: Leveraging Tread Depth Maps for Enhanced Crime-Scene Shoeprint MatchingPoster1 citations
  788. Cross-Input Certified Training for Universal PerturbationsPoster1 citations
  789. Cs2K: Class-specific and Class-shared Knowledge Guidance for Incremental Semantic SegmentationPoster1 citations
  790. Curved Diffusion: A Generative Model With Optical Geometry ControlPoster1 citations
  791. Cut out the Middleman: Revisiting Pose-based Gait RecognitionPoster1 citations
  792. D4-VTON: Dynamic Semantics Disentangling for Differential Diffusion based Virtual Try-OnPoster1 citations
  793. DC-Solver: Improving Predictor-Corrector Diffusion Sampler via Dynamic CompensationPoster1 citations
  794. DEPICT: Diffusion-Enabled Permutation Importance for Image Classification TasksPoster1 citations
  795. DSMix: Distortion-Induced Saliency Map Based Pre-training for No-Reference Image Quality AssessmentPoster1 citations
  796. Data Collection-free Masked Video ModelingPoster1 citations
  797. Data Poisoning Quantization Backdoor AttackPoster1 citations
  798. Data-to-Model Distillation: Data-Efficient Learning FrameworkPoster1 citations
  799. DatasetNeRF: Efficient 3D-aware Data Factory with Generative Radiance FieldsPoster1 citations
  800. De-Confusing Pseudo-Labels in Source-Free Domain AdaptationPoster1 citations
  801. Deep Nets with Subsampling Layers Unwittingly Discard Useful Activations at Test-TimePoster1 citations
  802. Deep Polarization Cues for Single-shot Shape and Subsurface Scattering EstimationPoster1 citations
  803. Delving Deep into Engagement Prediction of Short VideosPoster1 citations
  804. Delving into Adversarial Robustness on Document Tampering LocalizationPoster1 citations
  805. Depth-guided NeRF Training via Earth Mover’s DistancePoster1 citations
  806. DiffCD: A Symmetric Differentiable Chamfer Distance for Neural Implicit Surface FittingPoster1 citations
  807. Diffusion Models as Optimizers for Efficient Planning in Offline RLPoster1 citations
  808. Disentangled Generation and Aggregation for Robust Radiance FieldsPoster1 citations
  809. Disentangling Masked Autoencoders for Unsupervised Domain GeneralizationPoster1 citations
  810. Distribution-Aware Robust Learning from Long-Tailed Data with Noisy LabelsPoster1 citations
  811. Distributionally Robust Loss for Long-Tailed Multi-Label Image ClassificationPoster1 citations
  812. DoubleTake: Geometry Guided Depth EstimationPoster1 citations
  813. Dropout Mixture Low-Rank Adaptation for Visual Parameters-Efficient Fine-TuningPoster1 citations
  814. Dual-Path Adversarial Lifting for Domain Shift Correction in Online Test-time AdaptationPoster1 citations
  815. Dyn-Adapter: Towards Disentangled Representation for Efficient Visual RecognitionPoster1 citations
  816. Early Anticipation of Driving ManeuversPoster1 citations
  817. Easing 3D Pattern Reasoning with Side-view Features for Semantic Scene CompletionPoster1 citations
  818. EcoMatcher: Efficient Clustering Oriented Matcher for Detector-free Image MatchingPoster1 citations
  819. Edge-Guided Fusion and Motion Augmentation for Event-Image StereoPoster1 citations
  820. Efficient Cascaded Multiscale Adaptive Network for Image RestorationPoster1 citations
  821. Efficient Depth-Guided Urban View SynthesisPoster1 citations
  822. Efficient NeRF Optimization - Not All Samples Remain Equally HardPoster1 citations
  823. Enhancing Tracking Robustness with Auxiliary Adversarial Defense NetworksPoster1 citations
  824. Equivariant Spatio-Temporal Self-Supervision for LiDAR Object DetectionPoster1 citations
  825. Evaluating the Adversarial Robustness of Semantic Segmentation: Trying Harder Pays OffPoster1 citations
  826. Ex2Eg-MAE: A Framework for Adaptation of Exocentric Video Masked Autoencoders for Egocentric Social Role UnderstandingPoster1 citations
  827. Exploiting Dual-Correlation for Multi-frame Time-of-Flight DenoisingPoster1 citations
  828. Exploring Active Learning in Meta-Learning: Enhancing Context Set LabelingPoster1 citations
  829. FAFA: Frequency-Aware Flow-Aided Self-Supervision for Underwater Object Pose EstimationPoster1 citations
  830. Fast Encoding and Decoding for Implicit Video RepresentationPoster1 citations
  831. Fast Point Cloud Geometry Compression with Context-based Residual Coding and INR-based RefinementPoster1 citations
  832. Fast Registration of Photorealistic Avatars for VR Facial AnimationPoster1 citations
  833. Fast Sprite Decomposition from Animated GraphicsPoster1 citations
  834. Feature Diversification and Adaptation for Federated Domain GeneralizationPoster1 citations
  835. Federated Learning with Local Openset Noisy LabelsPoster1 citations
  836. Flexible Distribution Alignment: Towards Long-tailed Semi-supervised Learning with Proper CalibrationPoster1 citations
  837. Flow-Assisted Motion Learning Network for Weakly-Supervised Group Activity RecognitionPoster1 citations
  838. Forget More to Learn More: Domain-specific Feature Unlearning for Semi-supervised and Unsupervised Domain AdaptationPoster1 citations
  839. Formula-Supervised Visual-Geometric Pre-trainingPoster1 citations
  840. FreeCompose: Generic Zero-Shot Image Composition with Diffusion PriorPoster1 citations
  841. FreeMotion: MoCap-Free Human Motion Synthesis with Multimodal Large Language ModelsPoster1 citations
  842. From Pixels to Objects: A Hierarchical Approach for Part and Object Segmentation Using Local and Global AggregationPoster1 citations
  843. Frontier-enhanced Topological Memory with Improved Exploration Awareness for Embodied Visual NavigationPoster1 citations
  844. Frugal 3D Point Cloud Model Training via Progressive Near Point Filtering and Fused AggregationPoster1 citations
  845. Functional Transform-Based Low-Rank Tensor Factorization for Multi-Dimensional Data RecoveryPoster1 citations
  846. GAReT: Cross-view Video Geolocalization with Adapters and Auto-Regressive TransformersPoster1 citations
  847. GMM-IKRS: Gaussian Mixture Models for Interpretable Keypoint Refinement and ScoringPoster1 citations
  848. GMT: Enhancing Generalizable Neural Rendering via Geometry-Driven Multi-Reference Texture TransferPoster1 citations
  849. General Geometry-aware Weakly Supervised 3D Object DetectionPoster1 citations
  850. Generating 3D House Wireframes with SemanticsPoster1 citations
  851. Gravity-aligned Rotation Averaging with Circular RegressionPoster1 citations
  852. Grid-Attention: Enhancing Computational Efficiency of Large Vision Models without Fine-TuningPoster1 citations
  853. GroundUp: Rapid Sketch-Based 3D City MassingPoster1 citations
  854. Handling The Non-Smooth Challenge in Tensor SVD: A Multi-Objective Tensor Recovery FrameworkPoster1 citations
  855. Head360: Learning a Parametric 3D Full-Head for Free-View Synthesis in 360°Poster1 citations
  856. Hetecooper: Feature Collaboration Graph for Heterogeneous Collaborative PerceptionPoster1 citations
  857. HiFi-Score: Fine-grained Image Description Evaluation with Hierarchical Parsing GraphsPoster1 citations
  858. Hierarchical Unsupervised Relation Distillation for Source Free Domain AdaptationPoster1 citations
  859. High-Precision Self-Supervised Monocular Depth Estimation with Rich-Resource PriorPoster1 citations
  860. HoloADMM: High-Quality Holographic Complex Field RecoveryPoster1 citations
  861. Holodepth: Programmable Depth-Varying Projection via Computer-Generated HolographyPoster1 citations
  862. Human Motion Forecasting in Dynamic Domain Shifts: A Homeostatic Continual Test-time Adaptation FrameworkPoster1 citations
  863. HyperSpaceX: Radial and Angular Exploration of HyperSpherical DimensionsPoster1 citations
  864. Hypernetworks for Generalizable BRDF RepresentationPoster1 citations
  865. IGNORE: Information Gap-based False Negative Loss Rejection for Single Positive Multi-Label LearningPoster1 citations
  866. Idempotent Unsupervised Representation Learning for Skeleton-Based Action RecognitionPoster1 citations
  867. Identity-Consistent Diffusion Network for Grading Knee Osteoarthritis Progression in Radiographic ImagingPoster1 citations
  868. Image-Feature Weak-to-Strong Consistency: An Enhanced Paradigm for Semi-Supervised LearningPoster1 citations
  869. Image-adaptive 3D Lookup Tables for Real-time Image Enhancement with Bilateral GridsPoster1 citations
  870. Image-to-Lidar Relational Distillation for Autonomous Driving DataPoster1 citations
  871. Imaging with Confidence: Uncertainty Quantification for High-dimensional Undersampled MR ImagesPoster1 citations
  872. Improving Domain Generalization in Self-Supervised Monocular Depth Estimation via Stabilized Adversarial TrainingPoster1 citations
  873. Improving Intervention Efficacy via Concept Realignment in Concept Bottleneck ModelsPoster1 citations
  874. Improving Unsupervised Domain Adaptation: A Pseudo-Candidate Set ApproachPoster1 citations
  875. Improving image synthesis with diffusion-negative samplingPoster1 citations
  876. Instant Uncertainty Calibration of NeRFs Using a Meta-CalibratorPoster1 citations
  877. Integrating Markov Blanket Discovery into Causal Representation Learning for Domain GeneralizationPoster1 citations
  878. Integration of Global and Local Representations for Fine-grained Cross-modal AlignmentPoster1 citations
  879. Is user feedback always informative? Retrieval Latent Defending for Semi-Supervised Domain Adaptation without Source DataPoster1 citations
  880. JDT3D: Addressing the Gaps in LiDAR-Based Tracking-by-AttentionPoster1 citations
  881. LLMCO4MR: LLMs-aided Neural Combinatorial Optimization for Ancient Manuscript Restoration from Fragments with Case Studies on DunhuangPoster1 citations
  882. Label-free Neural Semantic Image SynthesisPoster1 citations
  883. Lagrangian Hashing for Compressed Neural Field RepresentationsPoster1 citations
  884. Language-Assisted Skeleton Action Understanding for Skeleton-Based Temporal Action SegmentationPoster1 citations
  885. Layered Rendering Diffusion Model for Controllable Zero-Shot Image SynthesisPoster1 citations
  886. Learn to Memorize and to Forget: A Continual Learning Perspective of Dynamic SLAMPoster1 citations
  887. Learned HDR Image Compression for Perceptually Optimal Storage and DisplayPoster1 citations
  888. Learning 3D-aware GANs from Unposed Images with Template Feature FieldOral1 citations
  889. Learning Chain of Counterfactual Thought for Bias-Robust Vision-Language ReasoningPoster1 citations
  890. Learning High-resolution Vector Representation from Multi-Camera Images for 3D Object DetectionPoster1 citations
  891. Learning Where to Look: Self-supervised Viewpoint Selection for Active Localization using Geometrical InformationPoster1 citations
  892. Learning to Distinguish Samples for Generalized Category DiscoveryPoster1 citations
  893. Learning to Drive via Asymmetric Self-PlayPoster1 citations
  894. LetsMap: Unsupervised Representation Learning for Label-Efficient Semantic BEV MappingPoster1 citations
  895. Leveraging Imperfect Restoration for Data Availability AttackPoster1 citations
  896. Local Occupancy-Enhanced Object Grasping with Multiple Triplanar ProjectionPoster1 citations
  897. Local and Global Flatness for Federated Domain GeneralizationPoster1 citations
  898. Lost in Translation: Latent Concept Misalignment in Text-to-Image Diffusion ModelsPoster1 citations
  899. Lost in Translation: Modern Neural Networks Still Struggle With Small Realistic Image TransformationsPoster1 citations
  900. MAD-DR: Map Compression for Visual Localization with Matchness Aware Descriptor Dimension ReductionPoster1 citations
  901. MARs: Multi-view Attention Regularizations for Patch-based Feature Recognition of Space TerrainPoster1 citations
  902. MERLiN: Single-Shot Material Estimation and Relighting for Photometric StereoPoster1 citations
  903. MIGS: Multi-Identity Gaussian Splatting via Tensor DecompositionOral1 citations
  904. MLPHand: Real Time Multi-View 3D Hand Reconstruction via MLP ModelingPoster1 citations
  905. MONTAGE: Monitoring Training for Attribution of Generative Diffusion ModelsPoster1 citations
  906. MacDiff: Unified Skeleton Modeling with Masked Conditional DiffusionPoster1 citations
  907. Make a Strong Teacher with Label Assistance: A Novel Knowledge Distillation Approach for Semantic SegmentationPoster1 citations
  908. Masked Motion Prediction with Semantic Contrast for Point Cloud Sequence LearningPoster1 citations
  909. MaxMI: A Maximal Mutual Information Criterion for Manipulation Concept DiscoveryOral1 citations
  910. Modality Translation for Object Detection Adaptation without forgetting prior knowledgePoster1 citations
  911. Multi-Person Pose Forecasting with Individual Interaction Perceptron and Prior LearningPoster1 citations
  912. Multi-RoI Human Mesh Recovery with Camera Consistency and Contrastive LossesPoster1 citations
  913. Multi-Task Domain Adaptation for Language Grounding with 3D ObjectsPoster1 citations
  914. MutDet: Mutually Optimizing Pre-training for Remote Sensing Object DetectionPoster1 citations
  915. Mutual Learning for Acoustic Matching and Dereverberation via Visual Scene-driven DiffusionPoster1 citations
  916. NVS-Adapter: Plug-and-Play Novel View Synthesis from a Single ImagePoster1 citations
  917. Neural Surface Detection for Unsigned Distance FieldsPoster1 citations
  918. Non-Line-of-Sight Estimation of Fast Human Motion with Slow Scanning ImagersPoster1 citations
  919. Norma: A Noise Robust Memory-Augmented Framework for Whole Slide Image ClassificationPoster1 citations
  920. OAPT: Offset-Aware Partition Transformer for Double JPEG Artifacts RemovalPoster1 citations
  921. OAT: Object-Level Attention Transformer for Gaze Scanpath PredictionPoster1 citations
  922. Object-Oriented Anchoring and Modal Alignment in Multimodal LearningPoster1 citations
  923. Occlusion Handling in 3D Human Pose Estimation with Perturbed Positional EncodingPoster1 citations
  924. Online Video Quality Enhancement with Spatial-Temporal Look-up TablesPoster1 citations
  925. Optimizing Factorized Encoder Models: Time and Memory Reduction for Scalable and Efficient Action RecognitionPoster1 citations
  926. Out-of-Bounding-Box Triggers: A Stealthy Approach to Cheat Object DetectorsPoster1 citations
  927. OvSW: Overcoming Silent Weights for Accurate Binary Neural NetworksPoster1 citations
  928. PDT Uav Target Detection Dataset for Pests and Diseases TreePoster1 citations
  929. PDiscoFormer: Relaxing Part Discovery Constraints with Vision TransformersOral1 citations
  930. PFGS: High Fidelity Point Cloud Rendering via Feature SplattingPoster1 citations
  931. PFedEdit: Personalized Federated Learning via Automated Model EditingPoster1 citations
  932. POET: Prompt Offset Tuning for Continual Human Action AdaptationOral1 citations
  933. PairingNet: A Learning-based Pair-searching and -matching Network for Image FragmentsPoster1 citations
  934. Parameterization-driven Neural Surface Reconstruction for Object-oriented Editing in Neural RenderingPoster1 citations
  935. Part2Object: Hierarchical Unsupervised 3D Instance SegmentationPoster1 citations
  936. Pathformer3D: A 3D Scanpath Transformer for 360° ImagesPoster1 citations
  937. Perceptual Evaluation of Audio-Visual Synchrony Grounded in Viewers’ Opinion ScoresPoster1 citations
  938. Personalized Video Relighting With an At-Home Light StagePoster1 citations
  939. Physics-Based Interaction with 3D Objects via Video GenerationOral1 citations
  940. Physics-Free Spectrally Multiplexed Photometric Stereo under Unknown Spectral CompositionOral1 citations
  941. Physics-informed Knowledge Transfer for Underwater Monocular Depth EstimationPoster1 citations
  942. Plug-and-Play Learned Proximal Trajectory for 3D Sparse-View X-Ray Computed TomographyPoster1 citations
  943. Pose Guided Fine-Grained Sign Language Video GenerationPoster1 citations
  944. PoseAugment: Generative Human Pose Data Augmentation with Physical Plausibility for IMU-based Motion CapturePoster1 citations
  945. PoseCrafter: One-Shot Personalized Video Synthesis Following Flexible Pose ControlPoster1 citations
  946. Pro2SAM: Mask Prompt to SAM with Grid Points for Weakly Supervised Object LocalizationPoster1 citations
  947. ProDepth: Boosting Self-Supervised Multi-Frame Monocular Depth with Probabilistic FusionPoster1 citations
  948. ProSub: Probabilistic Open-Set Semi-Supervised Learning with Subspace-Based Out-of-Distribution DetectionPoster1 citations
  949. Probabilistic Weather Forecasting with Deterministic Guidance-based Diffusion ModelPoster1 citations
  950. Quanta Video RestorationPoster1 citations
  951. R3DS: Reality-linked 3D Scenes for Panoramic Scene UnderstandingPoster1 citations
  952. RAP: Retrieval-Augmented Planner for Adaptive Procedure Planning in Instructional VideosPoster1 citations
  953. REDIR: Refocus-free Event-based De-occlusion Image ReconstructionPoster1 citations
  954. RPBG: Towards Robust Neural Point-based Graphics in the WildOral1 citations
  955. RS-NeRF: Neural Radiance Fields from Rolling Shutter ImagesPoster1 citations
  956. RSL-BA: Rolling Shutter Line Bundle AdjustmentPoster1 citations
  957. RaFE: Generative Radiance Fields RestorationOral1 citations
  958. Random Walk on Pixel Manifolds for Anomaly Segmentation of Complex Driving ScenesPoster1 citations
  959. ReGround: Improving Textual and Spatial Grounding at No CostPoster1 citations
  960. Real-data-driven 2000 FPS Color Video from Mosaicked Chromatic SpikesPoster1 citations
  961. Rebalancing Using Estimated Class Distribution for Imbalanced Semi-Supervised Learning under Class Distribution MismatchPoster1 citations
  962. RecurrentBEV: A Long-term Temporal Fusion Framework for Multi-view 3D DetectionPoster1 citations
  963. Region-centric Image-Language Pretraining for Open-Vocabulary DetectionPoster1 citations
  964. Reinforcement Learning via Auxillary Task DistillationPoster1 citations
  965. Rejection Sampling IMLE: Designing Priors for Better Few-Shot Image SynthesisPoster1 citations
  966. Removing Distributional Discrepancies in Captions Improves Image-Text AlignmentPoster1 citations
  967. Reprojection Errors as Prompts for Efficient Scene Coordinate RegressionPoster1 citations
  968. Resilience of Entropy Model in Distributed Neural NetworksPoster1 citations
  969. Rethinking Unsupervised Outlier Detection via Multiple ThresholdingPoster1 citations
  970. Revisiting Calibration of Wide-Angle Radially Symmetric CamerasPoster1 citations
  971. Revisiting Domain-Adaptive Object Detection in Adverse Weather by the Generation and Composition of High-Quality Pseudo-LabelsPoster1 citations
  972. Risk-Aware Self-Consistent Imitation Learning for Trajectory Planning in Autonomous DrivingPoster1 citations
  973. RoDUS: Robust Decomposition of Static and Dynamic Elements in Urban ScenesPoster1 citations
  974. Robust Nearest Neighbors for Source-Free Domain Adaptation under Class Distribution ShiftPoster1 citations
  975. Robustness Tokens: Towards Adversarial Robustness of TransformersPoster1 citations
  976. RoofDiffusion: Constructing Roofs from Severely Corrupted Point Data via DiffusionPoster1 citations
  977. SEDiff: Structure Extraction for Domain Adaptive Depth Estimation via Denoising Diffusion ModelsPoster1 citations
  978. SOS: Segment Object System for Open-World Instance Segmentation With Object PriorsPoster1 citations
  979. SPAMming Labels: Efficient Annotations for the Trackers of TomorrowPoster1 citations
  980. SRPose: Two-view Relative Pose Estimation with Sparse KeypointsPoster1 citations
  981. Scalable Group Choreography via Variational Phase Manifold LearningPoster1 citations
  982. Scene-Conditional 3D Object Stylization and CompositionPoster1 citations
  983. Scene-aware Human Motion Forecasting via Mutual Distance PredictionPoster1 citations
  984. Self-Supervised Underwater Caustics Removal and Descattering via Deep Monocular SLAMPoster1 citations
  985. SemTrack: A Large-scale Dataset for Semantic Tracking in the WildPoster1 citations
  986. Semi-Supervised Video Desnowing Network via Temporal Decoupling Experts and Distribution-Driven Contrastive RegularizationPoster1 citations
  987. Sequential Representation Learning via Static-Dynamic Conditional DisentanglementPoster1 citations
  988. Shape from Heat ConductionOral1 citations
  989. Shedding More Light on Robust Classifiers under the lens of Energy-based ModelsPoster1 citations
  990. Shifted Autoencoders for Point Annotation Restoration in Object CountingPoster1 citations
  991. Simple Unsupervised Knowledge Distillation With Space SimilarityPoster1 citations
  992. Single-Mask Inpainting for Voxel-based Neural Radiance FieldsPoster1 citations
  993. Snuffy: Efficient Whole Slide Image ClassifierPoster1 citations
  994. SpaceJAM: a Lightweight and Regularization-free Method for Fast Joint Alignment of ImagesPoster1 citations
  995. SparseSSP: 3D Subcellular Structure Prediction from Sparse-View Transmitted Light ImagesOral1 citations
  996. SpecFormer: Guarding Vision Transformer Robustness via Maximum Singular Value PenalizationPoster1 citations
  997. Stable Video PortraitsPoster1 citations
  998. Stitched ViTs are Flexible Vision BackbonesPoster1 citations
  999. Straightforward Layer-wise Pruning for More Efficient Visual AdaptationPoster1 citations
  1000. Surf-D: Generating High-Quality Surfaces of Arbitrary Topologies Using Diffusion ModelsPoster1 citations

ECCV accepted papers in other years

Looking for submission deadlines instead? See the conference deadline calendar.