S0154RS6-T20-S0154-Z · 完整風險編碼

自動化騷擾內容生成

Automated Generation of Harassment Content

運行與監控
風險描述

當攻擊者依目標的公開資訊生成數百則各異的騷擾訊息,分散於多個平台發布時;系統因每則內容都不同,平台的重複內容偵測完全失效,受害者須逐則檢舉,除引發相關利害關係人權益損害外,亦將造成企業合規與營運商譽代價。

框架對照

EU AI ActArt.5、Art.50
NIST AI 600-1Dangerous, Violent, or Hateful Content
NIST AI RMFMANAGE 2.4
ISO/IEC 5338運作與監控
MIT AI Risk RepositoryDomain 4

具體風險處置與實施指引

部署自動化騷擾偵測,以行為模式(大量、跨平台、指向同一目標)而非內容重複度辨識; 建立平台協作機制共享攻擊者訊號; 對確認的騷擾來源快速處置並保全紀錄