On the retrieval cost/accuracy spectrum, how do bi-encoder, ColBERT, and cross-encoder compare per query-document pair?
- All three cost the same; only accuracy differs
- Bi-encoder: dot product; ColBERT: MaxSim; cross-encoder: full forward pass
- Cross-encoder is cheapest; bi-encoder is most expensive
- ColBERT runs a forward pass per pair, like a cross-encoder
Why
A bi-encoder compares two pooled vectors (one dot product), ColBERT does token-level MaxSim over precomputed vectors (moderate), and a cross-encoder runs a joint forward pass per pair (most expensive, most accurate). The other options invert or flatten this ordering.