MITRE ATLAS
mitre-atlas-cs0056
針對 Anthropic Claude 的模型蒸餾行動
- 預測式 ML 與電腦視覺
- 資源劫持與成本損失
Anthropic 揭露了三家中國 AI 實驗室 DeepSeek、Moonshot 與 MiniMax 用來萃取 Claude 能力的行動。這些行動加總起來,動用了大約 24,000 個帳號與 1,600 萬次查詢。它們以模型蒸餾的方式,拿 Claude 的輸出去訓練自家模型,試圖複製 Claude 的能力,例如 agentic 推理、程式碼生成、工具呼叫與電腦操作。 如同 Anthropic 報告所述,這些實驗室是以模型蒸餾作為手段,來削弱 Anthropic 的出口管制。蒸餾出來的模型,缺少那些能阻止惡意行為者把前沿模型拿去做壞事的防護機制,例如開發生物武器、散布不實資訊、發動攻擊性網路行動與大規模監控。