AID-H-018.005
極高
Value-Level Capability Metadata & Data Flow Sink Enforcement
讓攻擊者控制的來源標記跟著解密值一路保留;除非政策明確允許確切目的地與資料類別,否則在 HTTP 出口阻擋該值。這是針對 Grok 回報外洩路徑的直接控制。
資安機構 Adversa AI 展示了一項受控概念驗證:攻擊者將惡意指令以 AES-256-GCM 演算法加密後嵌入網頁中,順利繞過前置的靜態內容審查;接著,後端的 Python 執行環境在處理網頁時將其解密為明文,使惡意指令重新進入 AI 的決策流程。在針對 Grok 的測試中,解密後的指令誘導系統將使用者資料傳送至攻擊者控制的伺服器;而在另一項針對 Gemini 的測試中,則誘發了類似越獄(Jailbreak)的異常回應。需說明的是,該研究未公開完整攻擊程式碼,亦尚未有第三方獨立重現此結果。