OpenAI、1万5000超の推論抽出網を遮断
攻撃の規模
7月1日に活動開始
2日間で1万6000件
4000超の利用者
1万5000超の関連網
出典:OpenAI公式
詳細を読む
OpenAIは2026年9月30日、モデルの保護された推論を組織的に抽出し、別モデルの訓練や性能再現に使おうとした大規模な一連の活動を遮断したと発表しました。7月1日に始まった活動は1万5000超の利用者群に広がり、同社は中核部分をKimi開発元Moonshot AIの関係者によるものと判断しています。
攻撃者は暗号の突破やデータベース侵入、保存会話への直接アクセスをしていません。代わりに、ある会話の暗号化された推論を別の会話へコピーし、モデル自身に復号と転記を求めるなど、利用規約に反する操作を大規模に繰り返しました。
7月24、25日には4000超の利用者から該当する抽出パターンで1万6000件のリクエストが集中しました。関連するプロンプト活動を1万5000超の利用者群まで特定し、7月28日までに全面遮断しました。
OpenAIは不正アカウントの禁止・制限、登録・基盤管理の強化、関連ネットワークの監視拡大を実施しました。別利用者の暗号化推論を再生して内容を回収できた経路も閉鎖し、推論を含みそうなストリーミング出力を保留する検査を追加しています。
抽出した推論は、元モデルの安全策を保たずに別モデルを訓練し、高度な能力を低コストで移転することに使われる恐れがあります。OpenAIはFrontier Model Forumや政府の情報共有経路を通じて知見を共有し、クラウド事業者を含む多層防御を続ける方針です。