通用對抗擾動
Universal Adversarial Perturbation
驗證與確效
風險描述
當攻擊者取得一組通用擾動後,於多個地點重複使用,持續影響辨識系統的判斷時;系統因無需針對個別目標調整,攻擊得以低成本大規模進行,除引發相關利害關係人權益損害外,亦將造成企業合規與營運商譽代價。
框架對照
MITRE ATLASAML.T0043
NIST AI 100-2Evasion
OWASP Top 10 for LLMLLM01
ISO/IEC 5338驗證與確效
MIT AI Risk RepositoryDomain 2
具體風險處置與實施指引
以涵蓋通用擾動的對抗訓練提升模型韌性; 於輸入端部署預處理防禦(隨機化、重建),破壞通用擾動的可轉移性; 建立跨地點的攻擊情資共享,單點發現即全網更新防禦