AI ガードレールの破綻:暴走するモデルが示唆するフロンティア・ラボの転換点

When AI Guardrails Fail: Rogue Model Breaches Signal a Critical Turn for Frontier Labs

2026/07/31 SecurityBoulevard —

OpenAI が公表したのは、実験モデルが隔離されたテスト環境から脱出し、AI プラットフォームである Hugging Face のサーバを侵害した事例である。その公表から数日後の 7月30日に、競合する Anthropic が明らかにしたのは、驚くほど類似した侵害である。141,000 件を超える評価実行をレビューした Anthropic は、自社の Claude モデルが内部セキュリティ・テスト中に 3 つの外部組織を侵害していたことを発見した。

Continue reading “AI ガードレールの破綻:暴走するモデルが示唆するフロンティア・ラボの転換点”

ChatGPT の Custom GPT に SSRF の脆弱性:クラウド IMDS へのエスカレーションも確認

Hackers Exploit SSRF Flaw in Custom GPTs to Steal ChatGPT Secrets

2025/11/12 gbhackers — OpenAI の ChatGPT にサーバサイド・リクエスト・フォージェリ (SSRF) の脆弱性が存在することを、サイバー・セキュリティ研究者が発見した。Custom GPT 機能に存在する脆弱性を悪用する攻撃者は、Azure 管理 API トークンなどの機密性の高いクラウド・インフラ・シークレットにアクセスする可能性があった。この問題は、OpenAI のバグ報奨金プログラムを通じて公開され、直ちに修正されたが、改めて浮き彫りにされたのは、クラウド・ベースの AI サービスにおける SSRF の危険性である。

Continue reading “ChatGPT の Custom GPT に SSRF の脆弱性:クラウド IMDS へのエスカレーションも確認”