2025
ARKit LabelMaker: A New Scale for Indoor 3D Scene Understanding
CVPR 2025poster
Neural network performance scales with both model size and data volume, as shown in both language and image processing. This requires scaling-friendly architectures and large datasets. While transformers have been adapted for 3D vision, a `GPT-moment' remains elusive due to limited training data. We…