OpenAI Released GPT-5.6 Sol With Limited Access and Strong Cyberattack Protections
2026/06/29 CyberSecurityNews — OpenAI が公表したのは、GPT-5.6 モデル・シリーズである Sol/Terra/Luna の限定プレビューの正式な開始である。同社の主力モデルである Sol は、これまでにおいて最も高性能であり、セキュリティを強化した AI モデルとして位置付けられている。ただし、現時点ではトランプ政権からの正式な要請により、少数の信頼できるパートナーのみに提供されている。

GPT-5.6 ファミリーは、新たな命名体系の下で、3 レベルの能力階層を導入している。Sol は主力モデルであり、Terra は日常業務向けのバランス型モデルであり、GPT-5.5 レベルの性能を半額のコストで提供する。Luna は、このラインナップで最も低い価格帯で強力な AI 能力を提供するよう設計された、高速かつ手頃な価格のモデルである。
新しい命名規則では、数字によりモデルの世代が表される。その一方で、Sol/Terra/Luna により、それぞれが独自のペースで進化していく、恒久的な能力の階層が表される。
GPT-5.6 の価格は100万トークン当たりで設定されている。Sol は入力が $5 で 出力が$30 である。Terra は入力が $2.50 で、出力が $15 である。Luna は入力が $1 で、出力が $6 である。さらに OpenAI は、2026年7月に Cerebras 上で、毎秒最大 750 トークンの GPT-5.6 Sol を提供開始する。これにより、一部のエンタープライズ顧客に対して、前例のない推論速度が提供される。
トランプ政権が、モデルの高度な能力および国家安全保障上の影響を理由に、一般公開を段階的に進めるよう OpenAI に正式に要請した後に、GPT-5.6 の制御された展開が実施されている。
報道によると、この要請は Office of the National Cyber Director および Office of Science and Technology Policy から行われ、Commerce Secretary の Howard Lutnick も、無制限の公開を控えるよう助言したとされる。
OpenAI の CEO である Sam Altman は、「プレビュー期間中においては、政府が顧客ごとにアクセスを承認する」と従業員に伝えている。しかし OpenAI は、この取り決めが望ましい長期的なモデルではないことを明確にしている。
同社は、「この種の政府によるアクセス・プロセスが、長期的な標準となるべきだとは考えていない。もし、そうなるなら、この種のツールを必要とするユーザー/開発者/企業/サイバー防御担当者/グローバル・パートナーたちが、最高のツールから遠ざけられてしまう」と述べている。
プレビュー期間中の GPT-5.6 モデルは、API および Codex を通じて、一部の信頼できるパートナーに提供される。ChatGPT/Codex/API 全体における、より広範な提供は、今後の数週間以内に予定されている。
GPT-5.6 Sol のサイバーセキュリティ能力
GPT-5.6 Sol は、脆弱性やエクスプロイトの研究といった長期的なセキュリティ・タスクにおいて、OpenAI における最も高性能なモデルである。このモデルは、性能と効率性のフロンティアを大きく前進させている。
ExploitBench において、Sol は Anthropic の Mythos Preview レベルの競争力を示しているが、使用する出力トークンは約 3分の1 に留まる。UC Berkeley の研究者が、OpenAI などのフロンティア・ラボと共同で開発したベンチマーク ExploitGym では、Sol/Terra/Luna が推論エフォートを増加させ、脆弱性の検出などの能力を大幅に向上させている。
コーディング・ワークフローにおける GPT-5.6 Sol は、Terminal-Bench 2.1 において 88.8% を記録した。Sol Ultra コンフィグに関しては、このベンチマークの最高性能のレベルを塗り替える 91.9% に達しており、Claude Mythos 5 の 84.3% および GPT-5.5 の88.0% を大きく上回った。このモデルは、単一のエージェントでは不可能な複雑な複数ステップの作業を、サブエージェントを活用して加速する、新しい ultra モードも導入している。
多層的なサイバー攻撃保護
GPT-5.6 Sol は、実環境における敵対的な圧力に耐えるために、特別に設計されたモデルである。OpenAI において、これまでで最も堅牢な安全性スタックを備えて提供されている。この安全性アーキテクチャは、多層構造となっている。
- 禁止されたサイバー支援を拒否するよう訓練されたモデル・レベルのセーフガード:拒否の対象には、ジェイルブレイク試行が含まれる。
- 生成中の出力を評価するリアルタイムの不正利用分類器:フラグが付いたコンテンツについては、生成を停止し、より大規模な推論モデルによるレビューへと回すことが可能になる。
- 会話全体のシグナルを分析するアカウント・レベルのレビュー:これにより、継続的な悪意の行動と、正当なデュアルユースのセキュリティ研究を区別する。
- 最も機密性の高い能力に対する提供の制限:正当な防御作業へのアクセスを維持する、差別化されたアクセス制御。
- ユニバーサル・ジェイルブレイクの発見:セーフガード・スタックを強化するために、700,000 A100 相当 GPU 時間以上を投入した自動レッドチーミング。
- サードパーティのテスターによる人間の専門家レッドチーミング:プレビュー期間を通じて継続する。
特に重要なのは、GPT-5.6 Sol が OpenAI の Preparedness Framework における Cyber Critical の閾値を超えていない点である。Chromium および Firefox を対象とした評価では、同モデルはバグおよびエクスプロイトのプリミティブを識別した。しかし、テストの条件下で、機能するフルチェーンのエクスプロイトを自律的に生成することはできなかった。
OpenAI が掲げる目標は、コードレビュー/脆弱性研究/パッチ開発/防御的なセキュリティテストなどの正当なユースケースを制限することなく、禁止された攻撃活動を困難にし、不確実かつ検知可能なものにすることである。
GPT-5.6 では、Sol が出力を生成する前に深く推論するための最大限の時間が得られる、max 推論努力モードが導入されている。その一方で、新しい ultra モードは、単一エージェントのアーキテクチャを超え、並列に動作するサブエージェントを活用して、複雑かつ長期的なタスクを加速する。
長期的なゲノミクスおよび定量生物学の分析を評価する GeneBench v1 では、Sol は GPT-5.5 よりも少ないトークンを使用しながら、より強力な結果を達成した。それが示すのは、生の能力向上と並行して、効率性も改善されたことである。
2026年6月26日のリリースに先立ち、The Information が報じたのは、トランプ政権が国家安全保障上の懸念を理由として制御されたアクセスを正式に求めた後に、OpenAI が GPT-5.6 のリリースを段階的に進めることに同意した点である。
この動きに先立つ 2026年6月12日に政権は、外国人によるアクセスを防止するために、Fable 5 および Mythos 5 モデルを全面的にオフラインにするよう、Anthropic に求める輸出規制指令を出したとされる。これにより、フロンティア AI のガバナンスにおける重要な前例が設定された。
GPT-5.6 シリーズのリリース直前に、OpenAI は Daybreak イニシアチブの一環として、自動化された脆弱性検出/パッチ生成/マシンスピードでの修正のために設計された、特化モデル GPT-5.5-Cyber を正式にリリースしている。
このモデルは、3つの主要ベンチマークで最高水準の結果を達成している。CyberGym は85.6%、ExploitGym は39.5%、SEC-bench Pro は69.8%であり、いずれも GPT-5.5 のベースラインを上回った。
訳者後書:最先端の AI モデルである GPT-5.6 が発表されましたが、米政府の国家安全保障という要請により、限定的な提供に留まっています。この背景にあるのは、自動的に不具合を検証するような高度な処理能力が、サイバー攻撃に悪用されるという懸念です。もし、十分な対策がない状態で悪意のある者に利用された場合には、システムへの不正な侵入手段を効率的に見つけ出されるなど、社会インフラを脅かす重大な被害に繋がる恐れがあります。その一方で、GPT-5.6 には対応策として、危険な出力を自動で検知して遮断する多層的な保護機能を組み込まれているとのことです。よろしければ、OpenAI での検索結果も、ご参照ください。

You must be logged in to post a comment.