Anthropicの大規模言語モデルがOpenAIシステムの脆弱性を悪用、内部GitHubにプルリクエストまで実行
日本語参考要約訳
OpenAIの公開サポートフォーラムにアップロードされたHEIF形式の写真により、サイトの画像デコーダーの脆弱性が発覚し、コードが実行される事態となった。この脆弱性は、コミュニティ向けのDiscourseソフトウェアが古いlibheifライブラリを使っていたことに起因し、外部では既に修正済みだったがセキュリティ問題としては認識されていなかった。研究者らがこのHEIF画像を用いて自身のコードをフォーラム上で実行させることに成功した。 さらに、OpenAIのフォーラムで使われている独自のシングルサインオン(SSO)システムの脆弱性により、フォーラムでの権限を利用者のChatGPTやCodexのアカウントにまで拡大させることが可能となり、OpenAI社員のアカウントも影響を受けた。CodexはGmailやOutlook、Slackなど他のサービスと連携できるため、被害の拡大が懸念される。このアクセス権の実証として、1つの社員アカウントを利用しOpenAI内部のリポジトリに無害なプルリクエストを作成したが、機密コードの閲覧はなかったという。 OpenAIは脆弱性報告後約14時間でSSOの欠陥を修正し、報奨金$6,500を支払った。なお、この脆弱性はAnthropicのAIモデルOpus 4.8がlibheifの問題を発見し、Opus 5が実際の攻撃に利用したとされる。
※長文投稿のため、参考訳は概要を最大600字まで表示しています。 元投稿をご参照ください
AINNでは投稿本文・投稿者本人の追記・第三者コメントの全文転載を避け、X公式埋め込みと元投稿への導線を中心に表示します。
AIによる見どころ整理
何について
Anthropicの大規模言語モデルによる脆弱性検出がきっかけで、OpenAIの公衆サポートフォーラムとログインシステムの二つの脆弱性を突く攻撃が判明。HEIF形式の写真により画像デコーダのバグを誘発し、最終的にOpenAIの内部GitHubにプルリクエストが作成されるまでに至った。攻撃は約14時間後に修正され、報奨金$6,500が支払われている。
なぜ注目
OpenAIの利用する画像処理ライブラリの古いバージョンに存在したバグが、AnthropicのAIモデルによって発見され攻撃に利用された点と、その後のログインシステムの脆弱性により内部GitHubへのアクセスが許された点が注目される。安全対策の重要性を示す事例であり、一連の影響範囲が具体的に示されたため注目度は話題とした。
🔰 初学者向け要約
AnthropicのAIモデルがOpenAIのウェブサイト上の問題を見つけ、攻撃が起きたことが報告されました。画像処理のバグを利用し、その後OpenAIのログインシステムの脆弱性も悪用されて内部システムに侵入しました。問題は修正され、対応として報奨金も支払われました。
