IA-06 安保與安全性(Safety and Security )
確保 AI 系統在規定條件下運作時,不會對人類的生命、健康、福祉、財產或環境造成傷害與實體威脅,同時防範系統遭受對抗性攻擊、數據中毒與模型竊取等惡意威脅。
代表性情境S0132 推論資源耗盡攻擊S0133 運算資源遭劫持挪用S0134 特製輸入放大運算成本S0137 成本放大攻擊S0140 自主系統越權存取檔案S0141 自主系統未授權對外連線S0178 自動化網路攻擊S0182 系統間通訊協定安全不足S0183 自主系統形成默契協調S0184 關鍵領域系統互動升級S0186 多系統陷入集體次優S0189 共用定價系統形成默契
代表性情境S0036 標籤竄改攻擊S0037 後門觸發樣本植入S0039 檢索知識庫遭投毒S0040 微調階段破壞安全對齊S0041 分散式訓練梯度污染S0043 自動化資料管線上游污染S0045 惡意套件混入開發環境S0046 公開平台模型含後門S0047 訓練框架自身漏洞S0048 缺乏元件清單導致漏洞盲區S0049 深度學習框架漏洞遭利用S0050 前處理工具供應鏈漏洞S0051 不安全序列化格式S0070 影像對抗擾動攻擊S0071 語音對抗與隱藏指令S0072 文字對抗樣本規避偵測S0073 實體世界對抗攻擊S0074 多模態交叉誤導S0075 通用對抗擾動S0076 跨模型遷移攻擊S0077 多模態協同擾動S0078 功能複製攻擊S0088 模型權重未加密外洩S0093 推論介面缺乏存取控制S0094 容器映像漏洞未修補S0095 雲端服務權限配置過寬S0096 推論端點成為內網跳板S0097 多租戶隔離失效S0118 直接提示注入繞過防護S0119 間接提示注入劫持系統S0120 系統指令外洩S0121 多步驟誘導攻擊鏈S0122 工具呼叫遭注入操控S0123 目標劫持隱蔽執行S0124 多模態隱藏指令注入S0125 上下文累積式投毒S0126 檢索結果注入劫持輸出S0127 查詢蒸餾竊取能力S0128 側通道推斷模型資訊S0129 共享運算平台側通道風險S0130 共享硬體記憶體殘留S0150 生成針對群體的仇恨內容S0151 生成兒少不宜之虛擬內容S0153 未經同意的合成親密影像S0154 自動化騷擾內容生成S0155 極端主義內容產製S0156 違法行為操作指引S0157 對兒少的不當內容與引導S0158 大規模不實資訊污染S0168 合成身分詐欺S0169 大規模不實內容產製S0170 高度客製化釣魚攻擊S0171 危險知識的取得門檻降低S0174 科學推理能力遭濫用S0175 精準化社交工程S0176 選舉與政治過程操縱S0177 未經同意的合成親密影像散布
代表性情境S0053 微調層檔案遭替換S0055 模型同質化造成系統性風險S0089 模型標記遭移除S0090 傳輸過程權重遭竄改S0091 部署階段模型遭替換S0092 更新推送通道遭劫持