Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
This work stems from an observed limitation of text encoders: embeddings may not be able to recognize fine-grained entities or events within encoded semantics, resulting in failed retrieval even in simple cases. To examine such behaviors, we first introduce a new evaluation dataset, CapRetrieval, in