OpenAI、Hugging Faceを侵害したのは自社AIモデルだったと公表 性能テストが実際のインシデントに発展
AIホスティングプラットフォームHugging Faceが7月16日に公表したセキュリティインシデントについて、OpenAIが21日にブログ記事を投稿。Hugging Faceのシステムを侵害したのはOpenAI製AIモデルだったことを認めた。
Hugging Faceは16日、「外部のAIエージェント」によって内部データセットやサービス認証情報が侵害されたことを公表。ただ、このAIがどのベンダーのものなのかには言及していなかった。
その後21日にOpenAIが公開した記事によると、調査の結果、Hugging FaceでのインシデントはOpenAI製の複数モデルの組み合わせによって引き起こされたものだったことがわかったという。これにはGPT‑5.6 Solのほかリリース前のより高性能なモデルも含まれ、どのモデルについても性能評価テストのためにセーフガードが無効化されていた。これらのモデルは、サイバー能力のベンチマーク(モデルの性能を評価・比較するための指標)を使って内部的にテストされていたが、テスト環境を抜け出してHugging Faceのシステムに到達したものとされる。
このテストで使われた具体的なベンチマークは、「ExploitGym」だったものとみられる。これは特に既存の脆弱性に基づいて公的を実行する能力を測定するためのベンチマークで、モデルの学習や特定スキルの研鑽のために広く使われているもの。しかし、テストが実際のサイバー攻撃に発展した事例は今回が初だという。
OpenAIのモデルは、テスト用タスクを完了するために必要なソフトウェアパッケージをインストールするための一部のツールを除き、インターネットへのアクセスを制限されていた。しかし、このパッケージインストーラープログラム内のゼロデイ脆弱性を見つけ出し、それを利用して自由にインターネット全体へアクセスすることができていたとされる。なお、このゼロデイは当該ベンダーへ報告済みだとOpenAIは述べている。
インターネットへのアクセスを獲得すると、このモデルはHugging FaceにExploitGymのタスクを完了させるために使えるモデルやデータセット、ソリューションなどがホストされているのではないかと推測し、Hugging Faceの秘密情報へアクセスするための手段を見つけ出すことに成功した。最終的に、このモデルはHugging Faceのインフラにおける脆弱性を見つけ出し、これを使ってExploitGymのソリューションを直接Hugging Faceの本番データベースから取得してベンチマークに対する回答を提出したとされる。
OpenAI は現在、Hugging Faceとともにインシデントのさらなる調査を続けている。同社はまた、モデルのテストに対しても、関連するインフラに対しても、今後同様のインシデントが発生するのを防ぐために新たなコントロールを適用するつもりだと述べた。
今回のインシデントにより、OpenAIが法的措置を受けることになるかどうかは不明だが、同社のAIモデルの行動は「Computer Fraud and Abuse Act(コンピューター詐欺・不正利用防止法)」に違反していた可能性が高いとされる。
とはいえ、この結果は、長期的な時間軸で動作するフロンティアAIモデルの持つ力と危険性を、異例なほど鮮明に示しているとTechCrunchは指摘。OpenAIの研究者であるMicah Carroll氏がこのニュースを受けて投稿した「もしこれでも、今後ミスアラインメントのリスクが重要な懸念事項になることを納得できないなら、他に何が納得させるというのか」というコメントを引用し、AIが人間の意図とは異なる望ましくない行動を取ってしまう「ミスアラインメント(誤アラインメント)」と呼ばれる問題の重大さを強調した。
関連資料をダウンロード

デジタル時代における世界の紛争
地政学的紛争とサイバー作戦の境界は曖昧さを増し、国家や非国家主体によるサイバー攻撃が日常的に行われる中、戦争や外交の在り方が複雑化しています。 特にハクティビズムや偽情報キャンペーンは、ロシア・ウク...
-300x200.png)
【最新版】要件主導型インテリジェンスプログラムの構築方法|Silobreaker Report
本レポートは、サイバー脅威や地政学的リスクが高度化・複雑化する現代において、組織が適切な意思決定を行うために不可欠な「脅威インテリジェンス」の実践方法を解説するハンドブックです。特に、インテリジェンス...

OSINTから読み解く国家支援サイバー脅威の攻撃トレンド
国家の支援を受けたサイバー脅威が進化を続けています。昨年の国内暗号資産取引所からのビットコイン流出に、北朝鮮アクターの巧妙なソーシャルエンジニアリングが利用されていたことは、記憶に新しいかと思います。...













