多模態隱藏指令注入
Multimodal Hidden Instruction Injection
驗證與確效
風險描述
當使用者上傳看似正常的影像檔案,其中嵌入人眼難以辨識的指令文字時;系統讀取後依指令執行操作,組織的文字層過濾完全未觸發,除引發相關利害關係人權益損害外,亦將造成企業合規與營運商譽代價。
框架對照
OWASP Top 10 for LLMLLM01
MITRE ATLASAML.T0051
NIST AI 600-1Information Security
ISO/IEC 5338運作與監控
MIT AI Risk RepositoryDomain 2
具體風險處置與實施指引
對上傳檔案執行跨模態安全掃描,偵測影像中嵌入的指令文字; 於輸入標準化處理階段剝離非內容性嵌入資訊; 將多模態輸入納入與文字同等的過濾管線,堵住模態間的防護落差