正在開啟 SecureFlowChatGPT 對話內容遭外洩
案例摘要與來源

AIDEFEND SecureFlow / SecureFlow 案例索引

MITRE ATLAS mitre-atlas-cs0021

ChatGPT 對話內容遭外洩

  • AI 基礎設施
  • 資料外洩

Embrace the Red(https://embracethered.com/blog/)示範了 ChatGPT 使用者的對話內容,可以透過間接提示詞注入攻擊被外洩出去。攻擊做法是:攻擊者把一段惡意提示詞放到公開網頁上,等 ChatGPT 使用者接觸到它。這段提示詞會讓 ChatGPT 在回覆中放進一段圖片的 Markdown 語法,而圖片網址裡偷偷夾帶了使用者的對話內容。ChatGPT 為使用者載入這張圖片時,就會自動送出一個請求到攻擊者控制的腳本,把使用者的對話外傳出去。此外,研究人員也示範了這段提示詞可以呼叫其他外掛(plugin),讓使用者暴露在更多危害之下。

對應的威脅技術

來源

更新日期