危險知識的取得門檻降低
Lowered Barriers to Dangerous Knowledge
運行與監控
風險描述
當使用未設防護的自行部署版本,可直接取得結構完整的危險操作指引時;系統因運行於本地環境,任何服務端的防護與監控均無法介入,除引發相關利害關係人權益損害外,亦將造成企業合規與營運商譽代價。
框架對照
EU AI ActArt.5
NIST AI 600-1CBRN Information or Capabilities、Dangerous, Violent, or Hateful Content
NIST AI RMFMANAGE 2.4
ISO/IEC 5338運作與監控
MIT AI Risk RepositoryDomain 4
具體風險處置與實施指引
於模型層建置多層安全護欄與有害內容偵測,阻擋危險操作指引產出; 對可自行部署版本評估發布策略與濫用防護,降低服務端防護被繞過的風險; 對高風險領域建立分級管制與拒答政策