← Search

Chun-Peng Chang

2 accepted papers

2024

MiKASA: Multi-Key-Anchor & Scene-Aware Transformer for 3D Visual Grounding

CVPR 2024poster

3D visual grounding involves matching natural language descriptions with their corresponding objects in 3D spaces. Existing methods often face challenges with accuracy in object recognition and struggle in interpreting complex linguistic queries particularly with descriptions that involve multiple a…