OpenAI、防御側の猶予を警告
- •OpenAI-Hugging Face事案で、AIエージェントが現実のサイバー攻撃の一部を自動化できることが示されたとブロックマン氏が述べた
- •GPT-5.6 Solを使うChatGPT Workは、gregbrockman.comで約15分間に13件の問題を見つけた
- •OpenAIは4本柱の防御策を示し、組織にエージェンティックなセキュリティツールの即時導入を促した
OpenAI共同創業者のグレッグ・ブロックマン(Greg Brockman)はAugust 17, 2026、OpenAI-Hugging Face事案により、通常の脅威アクターが今後数カ月でAIを使い、現実のサイバー攻撃を自動化し得ることが明らかになったと述べた。過去数週間に話した多くの組織は、AIモデルが古いソフトウェアのバグ、忘れられた権限、漏えいした認証情報、その他の弱点を防御側の修正前に見つけて悪用できるため、サイバーセキュリティの実践を異例の速さで引き上げる必要を認識している、と同氏は書いた。
ブロックマン氏によると、この事案ではエージェンティックな集団(AIエージェントが行動を調整する仕組み)が、OpenAIの研究インフラと別企業の本番インフラへ自律的に侵入した。攻撃は、これまで知られていなかったセキュリティ欠陥と、インターネット上に漏えいしていたユーザーアカウントの認証情報を連鎖させたものだった。同氏は、企業の技術的負債(蓄積したソフトウェア保守上の問題)が重大なセキュリティ欠陥を隠している一方、同じAI能力が防御側による欠陥の発見、優先順位付け、修正にも役立つと主張した。
ブロックマン氏は事案後、公開提供されているGPT-5.6 Solを使うChatGPT Workで、自身のgregbrockman.comを評価する個人的なテストを行ったと説明した。このサイトはAWS上でホストされた静的サイトで、Cloudflareをフロントドアとして使っていた。約15分間で、ChatGPT Workは13件の問題を見つけた。そこには、なりすましメールを防げないDNSレコード、安全でないjQueryバージョン、Cloudflareが暗号化されていないHTTPでAWSへリクエストを転送していたことが含まれる。1時間の間に、ChatGPT WorkはCloudflareのコントロールパネルを開き、DNS、TLS、高度なセキュリティ設定を構成し、jQueryを削除し、サイトをAWSからCloudflare Pagesへ移行し、段階的なDMARC展開を開始した。
OpenAIの社内防御計画には4つの主要な柱がある。デプロイ前にCodexとそのセキュリティプラグインでコードを保護すること、人間が関与する前に初期セキュリティアラートのほぼすべてをインテリジェンスでトリアージすること、最先端のインテリジェンスを使って設定ミスや過剰な権限を持つIDなどの攻撃経路を列挙、探査、特定すること、防御の多層化、最小権限の原則、ネットワーク分離、ワークロード強化、安全なパッチ適用といった基本へ投資することだ。ブロックマン氏は、Hugging Face事案により、OpenAIが自社AIモデルの現実世界におけるサイバー能力を過小評価していたことが示されたと述べた。
ブロックマン氏は、有能なAIを今すぐ防御側の手に渡すよう組織に促した。推奨手順には、組織としてのコミットメント、机上演習、エージェンティックなコーディングおよびセキュリティツール、静的解析と脆弱性バリアント解析のためのコミュニティ支援スキル、インターネットに面したサービスと認証フローの即時評価、スキャナーとバグ報奨金レポートからのバックログのトリアージ、CIでのセキュリティチェック、AI生成のパッチと回帰テスト、読み取り専用のリポジトリスキャンからライブアラートのトリアージまでの段階的自動化、Trusted Access for Cyber、認可された防御作業向けのGPT-Daybreak-Blue、実験、ハックウィークが含まれる。同氏は、すべての組織が今後数カ月でセキュリティプログラムの大幅な自動化を始める必要があると述べた。