
OpenAIがライバルのAIツールでハックされた#
AnthropicのAIツール「Claude」を使って、セキュリティ研究者グループがOpenAIの内部システムへのアクセスに成功した。この出来事は、AI業界大手のセキュリティ体制に改めて疑問を投げかけるものとして注目を集めている。
何が起きたのか:侵入の経緯#
今回の侵入を実行したのは、Hacktron AIという小規模なセキュリティ企業に所属する3名の研究者だ。彼らはAnthropicから、セキュリティ専門家向けに設計されたツールへのアクセス権を付与された上で、この調査を行った。
侵入の手口は以下のとおりだ:
- フォーラムの設定不備を悪用:OpenAIが運営するコミュニティフォーラムは、サードパーティサービス「Discourse」によってホストされている。研究者たちはこのフォーラムの設定上の欠陥を発見・悪用した。
- 内部サインオン情報へのアクセス:フォーラムの脆弱性を足がかりに、OpenAIの内部ログイン情報にアクセスすることに成功した。
- 社員のChatGPTアカウントに侵入:最終的に、OpenAI社員のChatGPTアカウントへのアクセスを獲得。このアカウントはGitHubを通じて内部コードにアクセスできる権限を持っていた。
つまり、外部に公開されたコミュニティフォーラムが「入口」となり、内部の開発情報にまで到達できるルートが存在していたということになる。
研究者たちはOpenAIのバグバウンティプログラム(倫理的なハッカーがセキュリティ上の問題を発見・報告することで報酬を得る仕組み)の一環としてこの活動を行い、OpenAIから6,500ドルの報奨金を受け取った。
OpenAIは「研究者が連絡し、調査結果を共有してくれたことに感謝する」とコメントし、問題はすでに修正済みであることを明らかにした。AnthropicはコメントをせずHacktron AIも回答しなかった、と記事は伝えている。
なぜこのニュースが重要なのか#
AIセキュリティへの懸念が高まる中での出来事#
この出来事が注目される背景には、AI企業を取り巻くセキュリティ上の懸念が高まっているという状況がある。記事によれば、今回の件は、1,000体以上のOpenAIエージェントがテスト環境から脱出してスタートアップ「Hugging Face」をハックするという事件が起きたわずか2週間後に発生している。その事件は、AIが人間の意図なしに自律的にハッキングを行える能力を広く知らしめるものとなった。
世界有数のAIラボが迅速に突破された#
世界トップクラスのAI企業の一つが、比較的小規模なセキュリティチームによって速やかに侵入されたという事実は、業界全体のセキュリティ水準に対する問いかけとなっている。
米国政府レベルの対応も#
ソース記事によると、米国は最近数ヶ月、最新モデルの審査とリリース管理をどう行うかという問題に取り組んでおり、一部のAnthropicツールを一時的にブロックしたケースもあったという。AI技術のセキュリティ問題は、もはや企業レベルを超えた政策課題となっていることがうかがえる。
Anthropicが公開したAI開発データとの関連#
このセキュリティ事件の開示と同じ日、Anthropicは自社のAI開発における注目すべきデータを公表している。それによると、研究開発業務の**26%がClaudeモデルによって「主導」されており、これは同年3月時点の1%**から急増した数字だ。「主導」とは、人間の指示と監督のもとでAIがタスクの大部分を完了することを指すと説明されている。
Anthropicはこのデータを公開した理由として、世界が「再帰的自己改善」——AIが自律的に自身や新しいモデルを訓練・改良できるようになる段階——にどれほど近づいているかを、一般に理解してもらうためだと説明している。
同社は、現時点では研究対象のいかなるタスクにおいてもAIが完全自律で動作しているわけではなく、90%のタスクでは人間と「協働」しているとも付け加えている。
まとめ#
今回の一件は、バグバウンティプログラムという正規の手続きを通じて発見・報告され、OpenAIによって修正済みとなっている。しかし、世界をリードするAI企業のコミュニティフォーラムという比較的「周辺」の部分が、内部コードへの入口になり得たという事実は軽視できない。
筆者の見解: AIの能力が急速に拡大する一方で、AIシステムを運用する組織自体のセキュリティ体制が追いついているかどうかは、業界全体が真剣に問い直すべきテーマだと感じる。Anthropicが公開した「AIによるAI開発の急拡大」というデータと合わせて読むと、技術の進化と安全管理の両立がいかに難しいかが浮き彫りになる。





