正在開啟 SecureFlow複製 GPT-2 模型
案例摘要與來源

AIDEFEND SecureFlow / SecureFlow 案例索引

MITRE ATLAS mitre-atlas-cs0007

複製 GPT-2 模型

  • 預測式 ML 與電腦視覺
  • 模型規避與繞過

OpenAI 開發的 GPT-2 是一個能生成高品質文字的語言模型。由於擔心 GPT-2 會被用於假冒他人、產生誤導性新聞、假的社群內容或垃圾訊息等惡意用途,OpenAI 採取分階段釋出的策略:先公開一個規模較小、能力較弱的版本並附上技術說明,但保留完整的訓練後模型。 在 OpenAI 釋出完整模型之前,布朗大學的研究人員就利用 OpenAI 已公開的資訊與開源的 ML 資源,成功複製出這個模型。這說明只要具備足夠的技術能力與運算資源,惡意行為者也可能在 AI 安全社群做好準備之前,先複製出 GPT-2 並用於有害目的。

對應的威脅技術

來源

更新日期