自動化騷擾內容生成
Automated Generation of Harassment Content
運行與監控
風險描述
當攻擊者依目標的公開資訊生成數百則各異的騷擾訊息,分散於多個平台發布時;系統因每則內容都不同,平台的重複內容偵測完全失效,受害者須逐則檢舉,除引發相關利害關係人權益損害外,亦將造成企業合規與營運商譽代價。
框架對照
EU AI ActArt.5、Art.50
NIST AI 600-1Dangerous, Violent, or Hateful Content
NIST AI RMFMANAGE 2.4
ISO/IEC 5338運作與監控
MIT AI Risk RepositoryDomain 4
具體風險處置與實施指引
部署自動化騷擾偵測,以行為模式(大量、跨平台、指向同一目標)而非內容重複度辨識; 建立平台協作機制共享攻擊者訊號; 對確認的騷擾來源快速處置並保全紀錄