代理變數造成間接歧視
Indirect Discrimination Through Proxy Variables
驗證與確效
風險描述
當組織刻意將受保護屬性排除於模型輸入之外,認為已確保公平時;系統因事後分析發現模型透過居住地等變數重建了相同的區分效果,實際結果與直接使用該屬性無異,除引發相關利害關係人權益損害外,亦將造成企業合規與營運商譽代價。
框架對照
EU AI ActArt.10
NIST AI 600-1Harmful Bias and Homogenization
NIST AI RMFMEASURE 2.11
ISO/IEC TR 24027
MAESTRO
ISO/IEC 5338驗證與確效
MIT AI Risk RepositoryDomain 1
具體風險處置與實施指引
執行代理變數分析,檢測非敏感特徵與受保護屬性的相關結構; 以因果公平性測試驗證結果層面的等效歧視,不以輸入排除為足; 對確認的代理變數施以中和處理並持續監測結果公平性