2026
Bias Similarity Measurement: A Black-Box Audit of Fairness Across LLMs
ICLR 2026poster
Large Language Models (LLMs) reproduce social biases, yet prevailing evaluations score models in isolation, obscuring how biases persist across families and releases. We introduce Bias Similarity Measurement (BSM), which treats fairness as a relational property between models, unifying scalar, distr…