London3 facial-recognition models showed persistent demographic disparities.
Aggregate accuracy hid gaps between race-gender subgroups.
Researchers tested ResNet50, MobileNetV3 and DeiT on FairFace and UTKFace, with statistical significance testing.
The authors offer a reproducible framework for auditing representation quality and fairness.
Sources: Nature