ICCV 2023 Accepted Papers
The full list of 2,156 papers accepted at ICCV 2023 (IEEE/CVF International Conference on Computer Vision). Click any title for details, similar papers, and links to the original source. You can also search these papers by meaning, not just keywords.
Poster: 2,005Oral: 145
- Structure-Aware Surface Reconstruction via Primitive AssemblyPoster4 citations
- Tangent Sampson Error: Fast Approximate Two-view Reprojection Error for Central Camera ModelsPoster4 citations
- Toward Multi-Granularity Decision-Making: Explicit Visual Reasoning with Hierarchical KnowledgePoster4 citations
- Towards Content-based Pixel Retrieval in Revisited Oxford and ParisPoster4 citations
- Tracking by 3D Model Estimation of Unknown Objects in VideosPoster4 citations
- UGC: Unified GAN Compression for Efficient Image-to-Image TranslationPoster4 citations
- Unsupervised Accuracy Estimation of Deep Visual Models using Domain-Adaptive Adversarial Perturbation without Source SamplesPoster4 citations
- Unsupervised Learning of Object-Centric Embeddings for Cell Instance Segmentation in Microscopy ImagesPoster4 citations
- Unsupervised Object Localization with Representer Point SelectionPoster4 citations
- Vanishing Point Estimation in Uncalibrated Images with Prior Gravity DirectionPoster4 citations
- Wasserstein Expansible Variational Autoencoder for Discriminative and Generative Continual LearningPoster4 citations
- Weakly-Supervised Action Localization by Hierarchically-Structured Latent Attention ModelingPoster4 citations
- Who Are You Referring To? Coreference Resolution In Image NarrationsPoster4 citations
- 3D Semantic Subspace Traverser: Empowering 3D Generative Model with Shape Editing CapabilityPoster3 citations
- A Game of Bundle Adjustment - Learning Efficient ConvergencePoster3 citations
- A Theory of Topological Derivatives for Inverse Rendering of GeometryPoster3 citations
- Adaptive Reordering Sampler with Neurally Guided MAGSACPoster3 citations
- Benchmarking Low-Shot Robustness to Natural Distribution ShiftsPoster3 citations
- COPILOT: Human-Environment Collision Prediction and Localization from Egocentric VideosPoster3 citations
- Candidate-aware Selective Disambiguation Based On Normalized Entropy for Instance-dependent Partial-label LearningPoster3 citations
- Concept-wise Fine-tuning Matters in Preventing Negative TransferPoster3 citations
- Cross-Domain Product Representation Learning for Rich-Content E-CommercePoster3 citations
- DG3D: Generating High Quality 3D Textured Shapes by Learning to Discriminate Multi-Modal Diffusion-RenderingsPoster3 citations
- Deep Video Demoireing via Compact Invertible Dyadic DecompositionPoster3 citations
- DenseShift: Towards Accurate and Efficient Low-Bit Power-of-Two QuantizationPoster3 citations
- DiffDis: Empowering Generative Diffusion Model with Cross-Modal Discrimination CapabilityPoster3 citations
- Distilling from Similar Tasks for Transfer Learning on a BudgetPoster3 citations
- EMR-MSF: Self-Supervised Recurrent Monocular Scene Flow Exploiting Ego-Motion RigidityOral3 citations
- Efficient Computation Sharing for Multi-Task Visual Scene UnderstandingPoster3 citations
- Eulerian Single-Photon VisionPoster3 citations
- Face Clustering via Graph Convolutional Networks with Confidence EdgesPoster3 citations
- FerKD: Surgical Label Adaptation for Efficient DistillationPoster3 citations
- Fingerprinting Deep Image Restoration ModelsPoster3 citations
- GAIT: Generating Aesthetic Indoor Tours with Deep Reinforcement LearningPoster3 citations
- Generative Multiplane Neural Radiance for 3D-Aware Image GenerationPoster3 citations
- Get the Best of Both Worlds: Improving Accuracy and Transferability by Grassmann Class RepresentationPoster3 citations
- Global Perception Based Autoregressive Neural ProcessesPoster3 citations
- Graphics2RAW: Mapping Computer Graphics Images to Sensor RAW ImagesPoster3 citations
- Hierarchical Visual Categories Modeling: A Joint Representation Learning and Density Estimation Framework for Out-of-Distribution DetectionPoster3 citations
- Holistic Geometric Feature Learning for Structured ReconstructionPoster3 citations
- Human from Blur: Human Pose Tracking from Blurry ImagesPoster3 citations
- LDL: Line Distance Functions for Panoramic LocalizationPoster3 citations
- Learning Cross-Modal Affinity for Referring Video Object Segmentation Targeting Limited SamplesPoster3 citations
- Learning Long-Range Information with Dual-Scale Transformers for Indoor Scene CompletionPoster3 citations
- Learning Shape Primitives via Implicit Convexity RegularizationPoster3 citations
- MAAL: Multimodality-Aware Autoencoder-Based Affordance Learning for 3D Articulated ObjectsPoster3 citations
- NIR-assisted Video Enhancement via Unpaired 24-hour DataPoster3 citations
- Name Your Colour For the Task: Artificially Discover Colour Naming via Colour Quantisation TransformerOral3 citations
- Neural Collage Transfer: Artistic Reconstruction via Material ManipulationPoster3 citations
- Nonrigid Object Contact Estimation With Regional Unwrapping TransformerPoster3 citations
- On the Audio-visual Synchronization for Lip-to-Speech SynthesisPoster3 citations
- PATMAT: Person Aware Tuning of Mask-Aware Transformer for Face InpaintingPoster3 citations
- Partition-And-Debias: Agnostic Biases Mitigation via a Mixture of Biases-Specific ExpertsPoster3 citations
- Quality Diversity for Visual Pre-TrainingPoster3 citations
- Reducing Training Time in Cross-Silo Federated Learning Using Multigraph TopologyPoster3 citations
- SAGA: Spectral Adversarial Geometric Attack on 3D Meshes3 citations
- SAMPLING: Scene-adaptive Hierarchical Multiplane Images Representation for Novel View Synthesis from a Single ImagePoster3 citations
- SQAD: Automatic Smartphone Camera Quality Assessment and BenchmarkingPoster3 citations
- Saliency Regularization for Self-Training with Partial AnnotationsPoster3 citations
- Scene-Aware Feature MatchingPoster3 citations
- Semantic Information in Contrastive LearningPoster3 citations
- Shape Analysis of Euclidean Curves under Frenet-Serret FrameworkOral3 citations
- TiDy-PSFs: Computational Imaging with Time-Averaged Dynamic Point-Spread-FunctionsPoster3 citations
- Toward Unsupervised Realistic Visual Question AnsweringPoster3 citations
- Towards Fair and Comprehensive Comparisons for Image-Based 3D Object DetectionPoster3 citations
- Towards Improved Input Masking for Convolutional Neural NetworksPoster3 citations
- U-RED: Unsupervised 3D Shape Retrieval and Deformation for Partial Point CloudsPoster3 citations
- UpCycling: Semi-supervised 3D Object Detection without Sharing Raw-level Unlabeled ScenesPoster3 citations
- X-VoE: Measuring eXplanatory Violation of Expectation in Physical EventsOral3 citations
- s-Adaptive Decoupled Prototype for Few-Shot Object DetectionPoster3 citations
- uSplit: Image Decomposition for Fluorescence MicroscopyPoster3 citations
- A Dynamic Dual-Processing Object Detection Framework Inspired by the Brain's Recognition MechanismPoster2 citations
- A Unified Framework for Robustness on Diverse Sampling ErrorsPoster2 citations
- Adaptive Similarity Bootstrapping for Self-Distillation Based Representation LearningPoster2 citations
- AutoSynth: Learning to Generate 3D Training Data for Object Point Cloud RegistrationPoster2 citations
- Batch-based Model Registration for Fast 3D Sherd ReconstructionPoster2 citations
- Bayesian Optimization Meets Self-DistillationPoster2 citations
- Beyond Image Borders: Learning Feature Extrapolation for Unbounded Image CompositionPoster2 citations
- Calibrating Panoramic Depth Estimation for Practical Localization and MappingPoster2 citations
- Collaborative Propagation on Multiple Instance Graphs for 3D Instance Segmentation with Single-point SupervisionPoster2 citations
- Contrastive Learning Relies More on Spatial Inductive Bias Than Supervised Learning: An Empirical StudyPoster2 citations
- Designing Phase Masks for Under-Display CamerasPoster2 citations
- Detecting Objects with Context-Likelihood Graphs and Graph RefinementPoster2 citations
- Disposable Transfer Learning for Selective Source Task UnlearningPoster2 citations
- Domain Specified Optimization for Deployment AuthorizationPoster2 citations
- Dynamic Mesh Recovery from Partial Point Cloud SequencePoster2 citations
- Efficient Neural Supersampling on a Novel Gaming DatasetPoster2 citations
- Enhancing Privacy Preservation in Federated Learning via Learning Rate PerturbationPoster2 citations
- Examining Autoexposure for Challenging ScenesPoster2 citations
- Explore and Tell: Embodied Visual Captioning in 3D EnvironmentsPoster2 citations
- Improving Diversity in Zero-Shot GAN Adaptation with Semantic VariationsPoster2 citations
- Instance and Category Supervision are Alternate Learners for Continual LearningPoster2 citations
- Inverse Compositional Learning for Weakly-supervised Relation GroundingPoster2 citations
- Learning Human-Human Interactions in Images from Weak Textual SupervisionPoster2 citations
- Learning Neural Implicit Surfaces with Object-Aware Radiance FieldsPoster2 citations
- Lens Parameter Estimation for Realistic Depth of Field ModelingPoster2 citations
- MAPConNet: Self-supervised 3D Pose Transfer with Mesh and Point Contrastive LearningPoster2 citations
- Mastering Spatial Graph Prediction of Road NetworksPoster2 citations
- Neural Characteristic Function Learning for Conditional Image GenerationPoster2 citations
- Persistent-Transient Duality: A Multi-Mechanism Approach for Modeling Human-Object InteractionPoster2 citations
- ReGen: A good Generative Zero-Shot Video Classifier Should be RewardedPoster2 citations
- ReLeaPS : Reinforcement Learning-based Illumination Planning for Generalized Photometric StereoPoster2 citations
- SCOB: Universal Text Understanding via Character-wise Supervised Contrastive Learning with Online Text Rendering for Bridging Domain GapPoster2 citations
- Shortcut-V2V: Compression Framework for Video-to-Video Translation Based on Temporal Redundancy ReductionPoster2 citations
- Surface Normal Clustering for Implicit Representation of Manhattan ScenesPoster2 citations
- SurfsUP: Learning Fluid Simulation for Novel SurfacesPoster2 citations
- Task Agnostic Restoration of Natural Video DynamicsPoster2 citations
- Towards Saner Deep Image RegistrationPoster2 citations
- TripLe: Revisiting Pretrained Model Reuse and Progressive Learning for Efficient Vision Transformer Scaling and SearchingPoster2 citations
- Variational Degeneration to Structural Refinement: A Unified Framework for Superimposed Image DecompositionPoster2 citations
- VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEsPoster2 citations
- A Simple Recipe to Meta-Learn Forward and Backward TransferPoster1 citations
- Beyond Single Path Integrated Gradients for Reliable Input Attribution via Randomized Path SamplingPoster1 citations
- Computational 3D Imaging with Position SensorsOral1 citations
- Corrupting Neuron Explanations of Deep Visual FeaturesPoster1 citations
- Efficient View Synthesis with Neural Radiance Distribution FieldPoster1 citations
- Enhanced Meta Label Correction for Coping with Label CorruptionPoster1 citations
- Explaining Adversarial Robustness of Neural Networks from Clustering Effect PerspectivePoster1 citations
- Fast Globally Optimal Surface Normal Estimation from an Affine CorrespondencePoster1 citations
- HAL3D: Hierarchical Active Learning for Fine-Grained 3D Part LabelingPoster1 citations
- How to Choose your Best Allies for a Transferable Attack?Poster1 citations
- Improving Equivariance in State-of-the-Art Supervised Depth and Normal PredictorsPoster1 citations
- Indoor Depth Recovery Based on Deep Unfolding with Non-Local PriorPoster1 citations
- Leaping Into Memories: Space-Time Deep Feature SynthesisPoster1 citations
- Learning Versatile 3D Shape Generation with Improved Auto-regressive ModelsPoster1 citations
- Learning to Transform for Generalizable Instance-wise InvariancePoster1 citations
- LoCUS: Learning Multiscale 3D-consistent Features from Posed ImagesPoster1 citations
- Minimal Solutions to Uncalibrated Two-view Geometry with Known EpipolesPoster1 citations
- Personalized Semantics Excitation for Federated Image ClassificationPoster1 citations
- RealGraph: A Multiview Dataset for 4D Real-world Context Graph GenerationPoster1 citations
- Robust Frame-to-Frame Camera Rotation Estimation in Crowded ScenesPoster1 citations
- SHIFT3D: Synthesizing Hard Inputs For Tricking 3D DetectorsPoster1 citations
- Semi-supervised Speech-driven 3D Facial Animation via Cross-modal EncodingPoster1 citations
- Simoun: Synergizing Interactive Motion-appearance Understanding for Vision-based Reinforcement Learning1 citations
- SpinCam: High-Speed Imaging via a Rotating Point-Spread FunctionPoster1 citations
- Stable and Causal Inference for Discriminative Self-supervised Deep Visual RepresentationsPoster1 citations
- Tree-Structured Shading DecompositionPoster1 citations
- UMFuse: Unified Multi View Fusion for Human Editing ApplicationsPoster1 citations
- Unpaired Multi-domain Attribute Translation of 3D Facial Shapes with a Square and Symmetric Geometric MapPoster1 citations
- Unsupervised Facial Performance Editing via Vector-Quantized StyleGAN RepresentationsPoster1 citations
- V-FUSE: Volumetric Depth Map Fusion with Long-Range ConstraintsPoster1 citations
- ViM: Vision Middleware for Unified Downstream TransferringPoster1 citations
- Weakly Supervised Learning of Semantic Correspondence through Cascaded Online Correspondence RefinementPoster1 citations
- 3DMiner: Discovering Shapes from Large-Scale Unannotated Image DatasetsPoster
- Adaptive Spiral Layers for Efficient 3D Representation Learning on MeshesPoster
- Bring Clipart to LifePoster
- CORE: Co-planarity Regularized Monocular Geometry Estimation with Weak SupervisionPoster
- Conditional Cross Attention Network for Multi-Space Embedding without Entanglement in Only a SINGLE NetworkPoster
- Dual Meta-Learning with Longitudinally Consistent Regularization for One-Shot Brain Tissue Segmentation Across the Human LifespanPoster
- Feature Proliferation -- the "Cancer" in StyleGAN and its TreatmentsPoster
- Geometric Viewpoint Learning with Hyper-Rays and Harmonics EncodingPoster
- LoLep: Single-View View Synthesis with Locally-Learned Planes and Self-Attention Occlusion InferencePoster
- Multi-Directional Subspace Editing in Style-SpacePoster
- Rapid Adaptation in Online Continual Learning: Are We Evaluating It Right?Poster
- SLAN: Self-Locator Aided Network for Vision-Language UnderstandingPoster
- Tiny Updater: Towards Efficient Neural Network-Driven Software UpdatingPoster
ICCV accepted papers in other years
Looking for submission deadlines instead? See the conference deadline calendar.