Anthropic Fable 5 をジェイルブレイク:安全性分類器の突破とシステム・プロンプトの大量流出

Anthropic’s Claude Fable 5 Jailbroken to Generate Stack Exploits

2026/06/11 CyberSecurityNews — 2026年6月9日に Anthropic が公開したのは、これまでに同社が開発した中で最も高性能な AI であり、新たな Mythos クラスに属する、初の一般提供モデル Claude Fable 5 である。このモデルは、ソフトウェア・エンジニアリング/ナレッジワーク/ビジョン分野などのベンチマークで優れた性能を示している。しかし、研究組織である Pliny the Liberator が、マルチエージェント分解/Unicode のトリック/ナラティブ・フレーミングを用いて Claude Fable 5 の安全性分類器を突破し、その過程で約 120,000 文字に及ぶシステム・プロンプトを流出させた。

Continue reading “Anthropic Fable 5 をジェイルブレイク:安全性分類器の突破とシステム・プロンプトの大量流出”

Anthropic が Claude Fable 5 を提供開始:Mythos モデル+強力なガードレール

Anthropic rolls out Claude Fable 5, but it’s available for a limited time

2026/06/09 BleepingComputer — Anthropic が開始したのは、Fable と呼ばれる新しいモデルのロールアウトである。このモデルは、同社の最強 AI モデル・クラスである、Mythos と同じ基盤モデルに基づいている。周知のとおり、Anthropic が開発した Mythos と呼ばれるモデルは、世界中の企業にセキュリティ・リスクをもたらす最先端モデルである。その当時の Anthropic は、脅威アクターによる公開/非公開ソフトウェアへの攻撃を支援し得るほど、Mythos は強力であると指摘していた。

Continue reading “Anthropic が Claude Fable 5 を提供開始:Mythos モデル+強力なガードレール”