Term

蒸留攻撃

別名: Distillation Attacks, モデル抽出攻撃

Overview

最終更新: 2026年7月9日

蒸留攻撃(Distillation Attacks)は、モデル抽出攻撃(MEA)の一種で、高度なAIモデル(教師モデル)に対して体系的なプロンプトを送信し、その応答を収集することで、より安価な「生徒モデル」に教師モデルの思考プロセスや推論能力を学習させる手法。ハッキングによるデータ流出を伴わず、正規のAPI利用を装って実行されるため検知が困難。数千億円規模の開発費を投じたAIモデルの知的財産を、わずかなコストで抽出・複製する脅威として警戒されている。

Mentioned Articles

2 件