2024
IVTP: Instruction-guided Visual Token Pruning for Large Vision-Language Models
ECCV 2024poster
"Inspired by the remarkable achievements of Large Language Models (LLMs), Large Vision-Language Models (LVLMs) have likewise experienced significant advancements. However, the increased computational cost and token budget occupancy associated with lengthy visual tokens pose significant challenge to…