Top AI Model に対する汎用型のジェイルブレイク:GPT-5.6/Claude/Opus 5/Fable なども対象

Researcher Claims Working Jailbreak on Top AI Models Including GPT-5.6, Claude Opus 5, and Fable

2026/07/25 CyberSecurityNews — GPT-5.6 Sol/Claude Opus 5/Fable といった主要な LLM に対して機能する、汎用型のジェイルブレイクを開発したと、著名な AI レッドチーム研究者が主張している。X 上の公開投稿で Pliny the Liberator は、「この手法は、すべてのモデルで、また、自身がテストしたすべてのカテゴリにわたり有効だった」と説明している。同氏は、この手法の仕組みを踏まえると、完全なパッチを適用することは極めて困難であり、あるいは不可能でさえあるかもしれないと指摘している。

Continue reading “Top AI Model に対する汎用型のジェイルブレイク:GPT-5.6/Claude/Opus 5/Fable なども対象”

Anthropic Fable 論争が問う知能統制の限界:国家が防御サイドを弱体化させる?

Trying to Control AI is Like Holding Sand

2026/06/17 SecurityBoulevard — ほぼ 1 週間にわたる Anthropic の Fable モデルをめぐる議論は、1 つの AI 企業と米国政府との対立として捉えられてきた。しかし、この議論は、その枠組みに当てはまらず、はるかに大きなものへと拡大している。つまり、知能そのものの本質をめぐって、サイバーセキュリティ分野で最も尊敬される専門家たちと、政策立案者との間で繰り広げられる、公的な意見の対立になってしまっている。

Continue reading “Anthropic Fable 論争が問う知能統制の限界:国家が防御サイドを弱体化させる?”

米国政府指令により Fable 5/Mythos 5 が全世界で停止:国家安全保障と AI 規制問題

US Gov asks Anthropic to ban ‘foreign national’ access to Fable, Mythos

2026/06/13 BleepingComputer — Anthropic が提供する、最も高性能な 2 つの AI モデルである Fable 5 および Mythos 5 だが、全世界の全ユーザーからのアクセスが停止された。これは、米国政府から Anthropic に対して発出された、外国籍者によるアクセスを遮断するよう命じる輸出管理指令を受けての措置である。

Continue reading “米国政府指令により Fable 5/Mythos 5 が全世界で停止:国家安全保障と AI 規制問題”