MITRE ATLAS
mitre-atlas-cs0019
PoisonGPT:把植入假事實的模型混進 Hugging Face
- AI 供應鏈
- 模型投毒與完整性破壞
Mithril Security 的研究人員示範了如何對一個開源的預訓練大型語言模型(LLM)投毒,讓它回答一項錯誤的事實。接著他們把這個遭投毒的模型上傳回 HuggingFace,也就是目前最大的公開模型中心,藉此凸顯 LLM 供應鏈的脆弱之處。使用者原本可能下載到這個遭投毒的模型,接收並散播被汙染的資料與錯誤資訊,造成各種潛在危害。