ModelRefs / Bias Detection — AI Glossary

Bias Detection — AI Glossary

Measuring systematic disparities in model outputs across demographic groups (gender, race, religion, nationality) to identify fairness violations.

Overview

Bias detection evaluates: representation bias (do certain groups appear as protagonists/antagonists?), stereotype propagation, sentiment differential (do names from different groups trigger different sentiments?), and performance gaps on benchmarks by group. Tools: Fairlearn, AI Fairness 360, CrowS-Pairs benchmark, WinoBias.

Reference details

Topicsafety
Last reviewed2026-06-24

Continue your research

Use these connected ModelRefs sections to compare alternatives, inspect implementation paths, and review the evidence and governance boundaries relevant to Bias Detection — AI Glossary.

Frequently asked questions

What is Bias Detection?

Measuring systematic disparities in model outputs across demographic groups (gender, race, religion, nationality) to identify fairness violations.

What concepts are related to Bias Detection?

Closely related concepts include fairness, toxicity detection, alignment.