This data set helps researchers spot harmful stereotypes in large language models (MIT Technology Review)