DATDAT-003 — Data Bias and Fairness Oversights
Social Bias Embedded in LLM Training Data Produces Discriminatory Outputs
4/5Sector: OtherGeography: GlobalStage: OperateIngested: —
Executive Summary
Large language models trained on biased datasets systematically reproduce social prejudices in their generated content. Organisations deploying such systems face regulatory exposure and reputational harm if outputs perpetuate discrimination against protected groups.
Domain
Data Management
Blindspots in data quality, privacy, bias, lineage, lifecycle, and third-party data dependencies.
Source
MIT AI Risk Repository — Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems (Cui2024) ↗https://airisk.mit.edu/
Could this happen in your organisation?
A Velinor AI Audit maps your active AI portfolio against the 50+ blindspots and benchmarks against documented sector failures like this one. A board-ready foresight document in 5 weeks.