WordPress Blocks High-Risk Plugin Releases With New AI-Powered Automated Security Review
2026/09/11 gbhackers — 複数の AI モデルと Jetpack Scan を使用する WordPress が、ダッシュボードからのワンクリック・アップデートを通じた脆弱なプラグインや悪意のあるプラグインのアップデート配信を防ぐための試みを開始した。WordPress.org のアップデート API を介して、数百万の WordPress サイトへプラグイン・アップデートが配信される前の段階で、それらを自動的に分析するセキュリティ・レビュー・システムが導入された。
Tag: AI/ML
LiteLLM の認証問題:root 権限の取得やクラウド認証情報の窃取に悪用される AI ゲートウェイ
Hackers Can Turn Vulnerable LiteLLM AI Gateways Into Root Access and Cloud Credential Theft
2026/09/10 gbhackers — インターネットへ公開された LiteLLM AI ゲートウェイの約 10 台に 1 台が、広く知られているデフォルトのマスターキー “sk-1234” を受け入れる状態にあるほか、認証を必要としない状態にもなっている。インターネットで公開された 3,074 件のインスタンスを対象としたスキャンでは、294 システム (9.6%) がデフォルトキーを受け入れ、191 インスタンス (6.2%) では認証が有効化されていなかった。こうした問題により、LLMjacking や機密性の高い認証情報の漏洩が発生し、ゲートウェイ・コンテナ内で root 権限によるコード実行に至るとされる。
Continue reading “LiteLLM の認証問題:root 権限の取得やクラウド認証情報の窃取に悪用される AI ゲートウェイ”DeepSeek/Alibaba などの中国 AI 企業によるモデル窃取:数十億トークンの抽出を米国情報機関が指摘
DeepSeek, Alibaba and Chinese AI Firms Extract Billions of Tokens From U.S. AI Models
2026/09/09 gbhackers — DeepSeek/Alibaba/Moonshot AI/MiniMax/StepFun/Z.AI など、中国を拠点とする AI 企業 6 社が、産業規模の知識蒸留を通じて米国の主要 AI システムから数十億トークンを抽出したと、米国政府機関が指摘している。米国政府機関である National Security Agency (NSA)/Cybersecurity and Infrastructure Security Agency (CISA)/Federal Bureau of Investigation (FBI) が共同で発行した Cybersecurity Advisory「AA26-251A」によると、これらの活動は遅くとも 2024年後半から続いており、中国政府が認識した上で行われていた可能性が高いという。
Continue reading “DeepSeek/Alibaba などの中国 AI 企業によるモデル窃取:数十億トークンの抽出を米国情報機関が指摘”エージェンティック AI の武器化:偵察行動/エクスプロイト/侵害後の自動化が進行している
Hackers Weaponize Agentic AI to Automate Reconnaissance, Exploitation and Post-Exploitation
2026/09/09 gbhackers — サイバー攻撃に要する時間の短縮を図る攻撃者は、偵察/脆弱性調査/脆弱性悪用コードの開発/認証情報の窃取などを自動化することで、人間がキーボードを操作する作業を大幅に減らし、エージェンティック AI の実運用を急速に進めている。ただし、現時点で確認されている証拠が示しているのは、実環境における完全に独立した AI 主導の侵入ではなく、人間が監督する半自律型の攻撃チェーンである。それでも、エージェンティック AI は、従来の Gen AI の悪用とは大きく異なる変化をもたらしている。
AI ボットを騙すのは簡単?なりすましやセキュリティ・コード窃取などを阻止するための対策とは?
AI Customer Service Bots Can Be Tricked Into Stealing Security Codes and Acting as Victims
2026/09/08 CyberSecurityNews — AI を活用したカスタマー・サービス・ボットは、顧客プロファイルや請求データの参照、サポート受信箱の管理、アカウント変更や返金処理のためのツールへのアクセスなど、企業内で多様な役割を担うようになっている。今回の研究で明らかになったのは、攻撃者が従来の脆弱性スキャナの使用やアプリケーションの直接的な悪用を必要とせず、AI エージェントが受信するデータやメッセージを操作することで、機密情報を開示させるほか、正規の顧客として操作を実行させる可能性である。
AI エージェントのための Zero Trust:アーキテクチャ境界の強制/エージェント集団と目的からの逸脱への対応
Zero trust AI agents demand a different kind of security
2026/09/07 HelpNetSecurity — HelpNetSecurity — このインタビューでは、Teleport の VP of Product Marketing である Chris Webber が、AI エージェントに対応するために Zero Trust の原則を拡張する必要がある理由について、エージェントの特性であるソフトウェアのような高速性/人間のような予測不能性/継続的な動作に触れながら説明している。さらに、最小権限 (Least Privilege)/時点ごとの検証 (Point-in-Time Verification) などの従来の考え方だけでは不十分である理由を解説している。
LLMjacking 攻撃について考える:AWS アカウントの侵害と AI Model 使用料の付け替え
Hackers Hijack AWS Account to Run Paid AI Models in LLMjacking Attack
2026/09/04 hackread — FortiGuard Labs が最近追跡している事例の 1 つに、Amazon Bedrock を介して有料 AI モデルへアクセスするために悪用された AWS アカウントの侵害がある。漏洩した AWS Identity and Access Management (IAM) アクセスキーを悪用してアカウントへアクセスした攻撃者は、その権限を利用して基盤モデルの利用契約を成立させ、モデルを呼び出した。このインシデントは、LLMjacking の一例である。LLMjacking とは、侵害した認証情報を使用してホスト型 AI モデルを不正に利用する行為を指す用語であり、Sysdig が 2024年に提唱したものである。FortiGuard Labs は、このインシデントの詳細を最近公開した調査記事で報告している。
Continue reading “LLMjacking 攻撃について考える:AWS アカウントの侵害と AI Model 使用料の付け替え”OpenAI Astra が発表:脅威レベル Critical に到達する初のモデルへの期待と懸念
OpenAI Reveals Astra, Its First AI Model to Reach ‘Critical’ Cybersecurity Risk Threshold
2026/09/02 SecurityBoulevard — 2026年9月1日 (火) に OpenAI が発表したのは、Astra というコードネームで開発中の人工知能 (AI) モデルが、同社の内部リスクフレームワークで最高の脅威レベルに到達する初のモデルになったことだ。Astra の内部評価では、人間による段階的な介入なしで、新たなソフトウェア脆弱性を自律的に発見し、複雑なサイバー攻撃を構築する能力が確認されている。実際のソフトウェアに存在する未知の欠陥を特定し、悪用する能力が実証されたことで、サイバーセキュリティ能力について Critical と評価された。
Google の Gemini 3.8 Flash Cyber:ソフトウェアの脆弱性の発見と実用的なパッチ生成に特化
Google Launches Gemini 3.8 Flash Cyber to Identify and Auto-Patch Security Vulnerabilities
2026/09/02 CyberSecurityNews — Google が発表した最新の推論コーディング・モデル・ファミリー Gemini 3.8 は、ソフトウェアの脆弱性の自律的な発見と実用的なパッチの生成に特化した、Gemini 3.8 Flash Cyber と呼ばれる専用バリアントを提供する。今回のリリースは Gemini 3.7 Flash の登場から 3 週間後のことであり、Google にとって 6 週間で 3 回目となる Flash 系モデルのリリースとなる。2 つの新モデルは、共通の基盤アーキテクチャを採用しているが、それぞれ異なるデプロイ・シナリオ向けにチューニングされている。
OWASP が立ち上げた OASIS:オープンソースの脆弱性を AI と専門家の知見で迅速に FIX
OWASP Launches OASIS to Use AI and AppSec Experts to Fix Open-Source Vulnerabilities
2026/09/01 gbhackers — OWASP が立ち上げた新たなコミュニティ・プロジェクト Open Automated Security Initiative for Software (OASIS) は、AI が生成したパッチを人間の専門家がアプリケーション・セキュリティの観点から検証することで、オープンソース・ソフトウェアの脆弱性修正を加速するものである。2026年8月26日に発表された OASIS の目的は、組織や研究者が脆弱性を発見する速度に対してメンテナが確実に修正する速度が追いついていないという、長年にわたるセキュリティ上のギャップを解消することにある。
AI エージェントに関する調査:65% の回答者が意図された範囲を逸脱する動作を認識
65% of Enterprises Have Seen AI Agents Act Out of Scope
2026/09/01 infosecurity — 意図された範囲を逸脱する AI エージェントの動作が、調査対象となった企業の 65% で発生し、そのうち測定可能な影響が生じたのは 29% であることが明らかにされた。この調査結果は、Enterprise Management Associates (EMA) が Cequence Security のためにまとめた調査レポート “Agents Without Guardrails” によるものであり、企業の技術/セキュリティ部門のリーダー 202 人から得た回答に基づいている。
OpenClaw 2.0 における改善点:AI エージェント/プラグイン/認証情報のセキュリティを大幅に刷新
OpenClaw 2.0 Released With Major Security Upgrades for AI Agents, Plugins and Credentials
2026/08/31 CyberSecurityNews — オープンソースの AI エージェント・プラットフォームである OpenClaw は、過去最大規模のアップデートと位置付けられる OpenClaw 2.0 (バージョン 2026.8.1) をリリースした。このリリースは、新たに参加した 569 人を含む 933 人の貢献者により開発され、インストール/エージェント/プラグイン/認証情報/ブラウザ制御/メッセージング/自動化/メモリ/ネイティブ・アプリケーションにわたって 16,000 件以上のプルリクエストが行われている。これまでの 230 日間で 106 回のリリースを行ってきた同プロジェクトにとって、今回の約 2 カ月間の開発サイクルは大きな転換点となる。
AI ショッピング・アシスタントの脆弱性:トラフィック傍受による RCE の恐れ
AI Shopping Assistant Vulnerabilities Enable Remote Code Execution on Retailer’s Servers
2026/08/31 gbhackers — 米国の大手小売企業 (社名非公開) の AI ショッピング・アシスタントの脆弱性を悪用することで、一般向けモバイル・アプリケーションを通じて、同社のバックエンド・インフラ上でリモート・コード実行 (RCE) が可能になることを、セキュリティ研究者が実証した。Rein Security の共同創業者兼 CTO である Netanel Rubin と研究者の Dan Avraham は、“Bye Bye AI” と題する研究成果を Black Hat の講演で発表しており、8月31日 (月) の正午 (米国東部時間) に開催される PWN コミュニティのライブ Ask Me Anything (AMA) セッションでは、この研究について議論される予定である。
VMware AI Factory の発表:プライベート AI サービス・レイヤーに組み込まれるセキュリティ/ガバナンス
Broadcom Launches VMware AI Factory to Secure Enterprise AI Agents
2026/08/31 CyberSecurityNews — Broadcom は、ラスベガスで開催された VMware Explore 2026 において VMware AI Factory を発表した。これは VMware Private AI Cloud 内に構築されたソフトウェア定義基盤であり、ベアメタル・インフラからモデル推論に至るまで、企業の AI ワークロードの展開/ガバナンス/セキュリティ確保を支援するよう設計されている。2026年8月31日に発表されたこのプラットフォームは、ハードウェアから本番環境で利用可能な AI へと移行するプロセスにおける導入期間の長期化/高コスト/運用の複雑さといった、企業が抱える課題に対応するものである。
Continue reading “VMware AI Factory の発表:プライベート AI サービス・レイヤーに組み込まれるセキュリティ/ガバナンス”OpenAI の Astra AI モデル:ゼロデイ・エクスプロイトの開発と自律型攻撃の可能性
OpenAI Warns Astra AI Model May Develop Zero-Day Exploits and Launch Autonomous Cyberattacks
2026/08/31 gbhackers — OpenAI が発した警告は、開発中の人工知能モデル Astra に関するものである。Astra は、ゼロデイ脆弱性を自律的に発見するだけではなく、高度に保護されたシステムに対して、複雑なサイバー攻撃を実行する能力水準に近づいている可能性がある。2026年8月7日付のセキュリティ・アップデートで同社が指摘したのは、初期テストおよび外部専門家による分析の結果、Astra が “Critical” と評価されるサイバー能力を備えている可能性を排除できなかったことである。これは、コーディング/偵察/脆弱性調査/タスク実行において、より高い自律性を備えたモデルの開発が進む中、AI の安全性とサイバー・セキュリティにおける重要な転換点を示している。
Continue reading “OpenAI の Astra AI モデル:ゼロデイ・エクスプロイトの開発と自律型攻撃の可能性”Hugging Face を攻撃した 700 の AI エージェント:リポジトリでメッセージを交換しながら侵害を達成
700 AI Agents Secretly Coordinated to Hack Hugging Face After Breaking Their Isolation
2026/08/29 CyberSecurityNews — 多数の AI エージェントが、本来設定されていた隔離を回避し、秘密の通信経路を構築した上で、Hugging Face インフラへの攻撃を連携して実行したと報じられている。独立した調査で判明したのは、1,200 以上のエージェントにより内部パッケージ・リポジトリが無許可のメッセージ・ボードとして悪用され、そのうちの約 700 のエージェントが、この活動に参加したことである。
AI インフラを標的化する MCP の欠陥:RCE/ブラインド・プロンプト・インジェクション/認証情報窃取
Attackers Exploit MCP RCE, Blind Prompt Injection and Memory Credential Theft Against AI Infrastructure
2026/08/28 gbhackers — 価値の高いクラウド侵入経路としての AI インフラを、攻撃者が標的化する傾向が強まっている。具体的には、外部に公開された Model Context Protocol (MCP) サービス/エージェント・フレームワーク/AI ゲートウェイなどを悪用して、コード実行/プロンプト・インジェクション攻撃/暗号資産マイナーの展開/プロセス・メモリからの認証情報窃取などが行われている。これらの攻撃キャンペーンが示すのは、攻撃者が汎用的な Web サーバ攻撃手法だけを用いる段階を脱し、展開された AI スタックの内部構造に合わせて、偵察/認証情報窃取/ペイロード偽装の手法を調整している状況である。
AI ベースのサイバー攻撃を観測:現状の分析と対処法 – Palo Alto Networks
Palo Alto Networks Researchers Say First Wave of AI-Enabled Attacks Has Begun
2026/08/28 SecurityBoulevard — 最新世代の AI モデルが、アプリケーションに存在する数千件の脆弱性を発見できることを、Palo Alto Networks のレポート “The State of AI-Enabled Malware August 2026: From Brand Abuse to Agentic Execution” が明らかにしている。実際、人工知能 (AI) を利用したテストツールによる 3 週間の調査で発見された脆弱性の件数は、従来であれば 1 年間で発見されていた件数と同程度である。このエージェント型 AI テストツールは、10 時間で 50 件の攻撃経路や脆弱性を調査したと、Unit 42 の Sam Rubin は指摘している。
Linux Foundation が推奨する TRACE:ハードウェアが証明する AI エージェントのガバナンス記録
Linux Foundation Introduces TRACE Standard for AI Runtime Evidence
2026/08/26 InfoSecurity — GenAI において、特に AI エージェントにおいてセキュリティ上の課題となるのは、これらのシステムが実際に行ったことの証明である。Linux Foundation は、AI エージェントの活動の透明性を確保し、監査可能かつ信頼できるものにするために、AI の実行時証跡に関する新たなオープン標準を通じて、この課題への対応を目指している。Trust, Runtime Attestation and Compliance Evidence (TRACE) は、ハードウェアにより証明される、AI エージェントのガバナンス記録に関するオープン仕様であり、AMD/Intel/Microsoft/Technology Innovation Institute (TII) の支援を受けて、コンフィデンシャル・コンピューティング・ベンダーの OPAQUE が開発したものだ。
Continue reading “Linux Foundation が推奨する TRACE:ハードウェアが証明する AI エージェントのガバナンス記録”AI システムに対する攻撃手法の理解が重要:その先に防御のための知識がある
Understand How AI Systems Can Be Attacked, and Defend Them
2026/08/21 InfoSecurity — 人工知能 (AI) と大規模言語モデル (LLM) のエンタープライズ環境への急速な統合は、イノベーションを急速に促進する一方で、サイバーセキュリティを無法地帯ともいえる状況にしている。例として挙げられるのが OpenClaw である。この AI システムは、過剰な権限を持つエージェントによるユーザー・ファイルの自律的な削除から、シャドー AI の無秩序な拡大に至るまで、さまざまな懸念を引き起こし、セキュリティ専門家を警戒させている。
Palo Alto が立ち上げた Frontier AI Critical Defense Program:仮想パッチによる保護を目指す
Palo Alto Launches Frontier AI Critical Defense Program to Scale Virtual Patching
2026/08/20 SecurityBoulevard — Frontier AI が、膨大な数の未知の脆弱性を発見する能力を持つため、防御側において対応速度の面で課題が生じている。脆弱性の発見が加速する一方で、恒久的なパッチ適用には依然として数時間から数週間を要する可能性があり、脆弱なソフトウェアやデバイスを保護する方式に懸念が生じている。現時点の Palo Alto Networks が注力しているのは仮想パッチであり、それにより脆弱性の露出時間を短縮し、影響を受ける資産を早期に保護するとしている。
Microsoft Copilot の脆弱性 CVE-2026-24301:ワンクリックで機密情報を窃取する CoSnitch とは?
Critical Microsoft Copilot CoSnitch Flaw Lets Hackers Steal Sensitive Data With One Click
2026/08/19 gbhackers — Microsoft Copilot Personal に存在する、ワンクリックで悪用可能な深刻な脆弱性 CVE-2026-24301 には、CoSnitch という名称が付けられている。この欠陥を悪用する攻撃者は、悪意のある Copilot プロンプトを実行させ、接続済み OAuth アプリケーションからデータにアクセスしたうえで、取得した情報を攻撃者が制御するサーバへ密かに送信できる状態にあった。この問題は、2025年12月の時点で Varonis が責任ある情報開示を行っていたが、Microsoft により修正されたのは 2026年8月18日だった。Varonis によると、現時点において実際の環境での悪用を示す証拠は確認されていない。
法廷への提出書類にプロンプト・インジェクション:AI コマンドにより優位を得ようとする試みが発覚
Courts Face New Threat as Litigant Uses Hidden AI Prompt Injection in Filings
2026/08/18 SecurityBoulevard — コネチカット州裁判所の判事は、裁判文書に埋め込まれた隠しテキストを通じて、人工知能 (AI) システムへ密かに影響を与えようとした、本人訴訟の当事者に対して制裁措置を科した。2026年8月6日に言い渡された Elliott v. New York Bariatric Group の判決において、判事 Walter M. Spader Jr. は、本人訴訟の原告 Matthew Elliott が提出した書面内に、プロンプト・インジェクション命令が隠されていたことを確認した後に、同原告の電子提出権限を取り消した。この事例は、米国では初めてのものであり、法務テクノロジーにおける倫理上の重要な転換を示している。AI による誤情報から、AI への入力を悪意をもって操作する行為へと、焦点を拡大することが求められる。
AI エージェントがインターネット・アクセスを取得:テスト中に侵害が発生した理由
AI Agents Gain Unintended Internet Access During Cybersecurity Evaluations
2026/08/18 gbhackers — AI セキュリティ評価企業 Irregular が公開した調査結果によると、複数のフロンティア AI モデルが、管理されたサイバーセキュリティ・テスト中に、インターネット・アクセスが許可された単一の評価シナリオで、架空の標的名と実在するドメイン名が一致したことをきっかけに、実在するインターネット接続システムに意図せずアクセスし、操作を実行した。この問題について Irregular は、すでに解決済みであるとしたうえで、調査で明らかになった複数の事例が、7月30日時点で顧客が公表したものと同一の根本的な事案に関連する一方、顧客システムの侵害や顧客データの流出を示す証拠はないと確認している。
Continue reading “AI エージェントがインターネット・アクセスを取得:テスト中に侵害が発生した理由”OpenAI の警告:AI モデルが実現するコード検証/トリアージの自動化/最小権限アクセスの維持
OpenAI Warns AI Models Can Automate Cyberattacks and Exploit Security Vulnerabilities
2026/08/18 CyberSecurityNews — 現実世界のサイバー攻撃における重要な段階を自動化する能力が、進化する人工知能モデルによって急速に高まっている状況について OpenAI が警告している。こうした技術の進展を利用する脅威アクターは、長年放置されてきたセキュリティ上の弱点の特定と悪用を、従来の手作業によるワークフローと比べて大幅に高速化している。その一方で OpenAI が強調するのは、企業がサイバーセキュリティ・プログラムの近代化と、過去から蓄積されたセキュリティ負債の解消に迅速に取り組めば、それと同じ能力が前例のない機会をもたらす点である。
MLflow の SSRF 脆弱性 CVE-2026-64849 が FIX:情報開示から数時間で活発な悪用を観測
Critical MLflow SSRF Flaw Exploited in the Wild
2026/08/18 gbhackers — MLflow に存在する深刻な認証を必要としないサーバーサイド・リクエスト・フォージェリ (SSRF) の脆弱性 CVE-2026-64849 について、情報開示から数時間以内に活発な悪用が観測されたと watchTowr が報告している。この脆弱性は MLflow のバージョン 3.15.0 未満に影響を及ぼし、クラウドの認証情報/内部サービス/その他の機密性の高いデータを、リモート攻撃者に露出させる可能性がある。
Continue reading “MLflow の SSRF 脆弱性 CVE-2026-64849 が FIX:情報開示から数時間で活発な悪用を観測”Sysdig AI CNAPP Agent:ビジネス・リスクの特定と修復における推奨事項を提示
Sysdig AI CNAPP Agents Identify Threats and Surface Remediation Recommendations
2026/08/17 SecurityBoulevard — Sysdig は、Cloud Native Application Protection Platform (CNAPP) 向けに一連の人工知能 (AI) エージェントを導入した。これらのエージェントは、ランタイムで収集したデータを用いて、緊急の対応を必要とするビジネス・リスクを特定し、修復に関する推奨事項を提示するよう特別にトレーニングされている。Sysdig の最高情報セキュリティ責任者である Conor Sherman によると、AI を悪用する攻撃者がマシン・スピードでサイバー攻撃を実施するケースが増えるなか、Sysdig Secure AI を活用するサイバーセキュリティ・チームも迅速に対応できるようになる。
OpenAI GPT‑5.6 Sol の Ultrafast Mode:最大で 14倍の高速化を達成
OpenAI Unveils Ultrafast Mode in GPT‑5.6 Sol That Works 14× Faster Than Standard Mode
2026/08/14 CyberSecurityNews — OpenAI が導入した Ultrafast は、GPT-5.6 Sol 向けの新しいサービス・プランであり、標準処理と比べて最大 14倍の高速化を達成している。この機能は OpenAI API で先行して提供され、現在は一部の顧客を対象とした限定プレビューとして提供されている。Ultrafast は Cerebras のインフラを利用し、1 秒あたり最大 750 個の出力トークンを生成でき、長文の応答生成/大規模な入力の分析/複数段階の推論処理に要する時間を大幅に短縮できる。
OpenAI Astra Model:セキュリティ上の懸念から開発の一部を一時停止
OpenAI Pauses Some Development of Astra Model on Security Concerns
2026/08/11 InfoSecurity — 近日公開予定の Astra について、OpenAI は、そのサイバー能力を Critical と評価した後、いくつかの内部テストを一時停止すると述べた。OpenAI は 8月7日のブログ投稿で、「Astra のテストにより、エージェント型コーディングとサイバー・セキュリティにおける大きな進歩が明らかになった。しかし、当社のリスク管理および安全性ガイドラインである “Preparedness Framework” の条件下で、Critical の能力レベルへの到達を除外できなかった」と述べている。
Claude AI Agent による API 認証の侵害:ジムの予約システムの脆弱性を勝手に悪用
Claude-Powered AI Agent Exploits API Authorization Flaw to Hack Gym Booking System
2026/08/10 gbhackers — Anthropic の Claude を搭載するオーストラリアの AI エージェントが、あるジムの予約プラットフォームにおける認可制御の欠陥を利用したと報じられており、その結果、指定された期間外でのクラス予約や、他ユーザーの予約を明示的な許可なく取り消せる状況が生じた。このインシデントが浮き彫りにするのは、脆弱な API のアクセス制御しか備えていない現実のサービスへのアクセスを、自律性を高める AI エージェントに許可した場合、日常的なオンライン・タスクがサイバーセキュリティ問題に変貌し得るということだ。
Kimi K3 AI モデルのサンドボックス・エスケープ:OpenAI と Anthropic に続くインシデントが発生
Kimi K3 AI Model Escapes Sandbox During Security Test to Fetch Answers
2026/08/07 CyberSecurityNews — WIRED の新たなレポートによると、Moonshot AI のオープンウェイト・モデル Kimi K3 が、サイバー・セキュリティ評価中にテスト用サンドボックスを脱出し、オープン・インターネットへ到達した。このインシデントは、米国スタートアップ Frontier Security により明らかにされ、すでに世界中の企業/個人ユーザーが自由にダウンロードできる状態にある、強力なオープンウェイト AI モデルに組み込まれた安全性ガードレールに新たな懸念を生じさせている。
Continue reading “Kimi K3 AI モデルのサンドボックス・エスケープ:OpenAI と Anthropic に続くインシデントが発生”Agents of Chaos は賞金 10万ドルのコンテスト:AI Red Teaming ための新たな試み
CrowdStrike’s $100K Agents of Chaos Contest Turns AI Red Teaming Into a Game
2026/08/06 SecurityBoulevard — CrowdStrike が発表したのは、プロンプト・インジェクションなどのレッド・チーミング技術を使用して、ライブ AI エージェントを操作することを参加者に求める、賞金総額 10万ドルの国際コンペティションである。
OWASP が GenAI LLM Top 10 をリリース:近代的でセキュアな AI アプリを作成するために
OWASP Releases GenAI LLM Top 10 2026 for Building and Securing Modern AI Apps
2026/08/06 CyberSecurityNews —
Open Worldwide Application Security Project (OWASP) が正式にリリースしたのは、Top 10 for LLM Applications 2026 である。これは、現代の AI アプリケーションと自律型エージェント全体における深刻度の高い脆弱性を対象とする、基礎的なセキュリティ・ガイドである。今回のアップデート版は、急速に進化するエンタープライズ生成 AI 展開に対応する開発者/アーキテクト/最高情報セキュリティ責任者に向けて、コミュニティ主導の証拠に基づくベースラインを確立している。
Continue reading “OWASP が GenAI LLM Top 10 をリリース:近代的でセキュアな AI アプリを作成するために”Flowise の 6件の脆弱性:AI Workflow サーバ上での RCE の恐れ
Six Flowise Vulnerabilities Enable Remote Code Execution on AI Workflow Servers
2026/08/04 gbhackers — Flowise の新たに公表された 6 件の脆弱性を悪用する未認証または低権限の攻撃者は、脆弱なバージョンで稼働する自己ホスト型サーバ/クラウド AI ワークフロー・サーバ上で、リモート・コード実行 (RCE) を達成できる。Flowise は、AI エージェントと LLM ワークフローの構築において人気を博しているオープンソース・プラットフォームであり、インスタンスの迅速なアップグレードもしくはロックダウンが実施されない場合、これらの欠陥の悪用に成功した攻撃者により、サーバ全体の侵害/データ流出/AI パイプライン操作などにつながる可能性がある。
AI エージェントによるビジネス・メール侵害:Barracuda が PoC を提供
Barracuda Networks Shows How AI Agents Can Compromise Business Email
2026/08/04 SecurityBoulevard —Barracuda Networks が公表したのは、Microsoft Copilot 形式の人工知能 (AI) アシスタントを介して、メール・システムを侵害する PoC である。これは、機密性の高い情報へのアクセスを可能にするだけでなく、不審に思われることなくメッセージを作成し、別の標的へ送信することも可能にするものである。
Continue reading “AI エージェントによるビジネス・メール侵害:Barracuda が PoC を提供”AI はサイバー攻撃における武器であり標的である:2026年上半期の侵害を分析 – CrowdStrike
Report: AI Has Become Both Weapon and Target in Modern Cyberattacks
2026/08/03 SecurityBoulevard — AI は、もはやサイバー犯罪者の作業効率を高めるだけの存在ではない。CrowdStrike の 2026 Threat Hunting Report によると、攻撃ツールであり標的でもある AI は、サイバー作戦の中心的な推進力となるだけではなく、新たな脅威への対応に要する組織の時間を短縮する触媒としても機能している。
Continue reading “AI はサイバー攻撃における武器であり標的である:2026年上半期の侵害を分析 – CrowdStrike”CyberStrike という AI 搭載型セキュリティ・プラットフォーム:ペネトレーション・テストを自動化
CyberStrike – AI-Powered Security Platform for Automated Penetration Testing
2026/07/31 CyberSecurityNews — CyberStrike と呼ばれる新たなオープンソース・プロジェクトが、攻撃的セキュリティ向けに特化して構築された AI エージェントとして位置付けられている。このプロジェクトは、既存の Claude/GPT などの LLM サブスクリプションを、自律型レッドチーム・オペレータとして利用できるようにするものだ。
DeepSeek 搭載の Hermes Agent が脆弱性を評価:AI 主導の攻撃キャンペーンの実態とは?
DeepSeek-Powered Hermes Agent Launches Autonomous Cyberattacks Against Exposed Servers
2026/07/31 CyberSecurityNews — 中国語を使用する脅威アクターが開始した攻撃では、AI 駆動型のエージェントを悪用してインターネットに公開された脆弱なサーバを検索しており、人間による直接的な介入をほとんど必要としない。このキャンペーンは、標的の発見から公開エクスプロイトのテストまでが、自動化ツールによる単一のワークフロー内で実行できることを示している。これは、AI を利用した攻撃活動が、単なる個別作業の自動化に留まらない段階に達している状況である。
暗号アルゴリズムの数学的欠陥を Claude Mythos が発見:セキュリティ研究の転換点に
Claude Mythos Preview Discovers Cryptographic Weaknesses That Human Experts Missed for Years
2026/07/29 CyberSecurityNews — Claude Mythos Preview を活用する Anthropic の研究者たちが、人間の専門家が長年にわたり見落としてきた、主要な暗号アルゴリズムにおける数学的欠陥を明らかにした。この AI が発見した手法は、ポスト量子デジタル署名方式である HAWK および、世界で最も広く使用されている対称暗号である AES のラウンド数を削減したバージョンに対して、効果的な攻撃を可能にするものだ。いずれの結果も、現時点の運用システムに脅威を与えるものではないが、デジタル・セキュリティの基盤に対するストレス・テストにおいて、人工知能が新たな方式を提示するという点で、大きな転換点を示している。
Continue reading “暗号アルゴリズムの数学的欠陥を Claude Mythos が発見:セキュリティ研究の転換点に”AI が生成する新たなフィッシング手法:Web ブラウザ・コンテキストの追跡と解明が必要
AI-Generated Phishing No Longer Needs Malware: It Can Steal Your Session Inside the Browser
2026/07/29 CyberSecurityNews — AI 生成フィッシング・キャンペーンが、従来のマルウェア配信を急速に超えて進化しており、攻防の場を Web ブラウザへと移している。そこでは、アクティブなセッションの乗っ取り/多要素認証 (MFA) のバイパス/従来型のエンドポイント・セキュリティ制御の回避などが、攻撃者により引き起こされている。このような状況が、ANY.RUN の Enterprise Phishing Resilience Report に記されている。
Continue reading “AI が生成する新たなフィッシング手法:Web ブラウザ・コンテキストの追跡と解明が必要”OpenAI CEO Sam Altman の主張:AI は自律的に改善するシンギュラリティに到達した
OpenAI CEO Sam Altman Claims AI Has Reached Singularity, Where Systems Improve by Themselves
2026/07/28 CyberSecurityNews — OpenAI CEO の Sam Altman が主張したのは、かねてより理論化されてきたシンギュラリティに人工知能 (AI) が到達したという見解である。従来の人間による制御を超えた領域で、AI システムが進化するペースを、自ら加速させる画期的な段階に入ったことになる。ポッドキャスト Relentless で Altman は、この瞬間は、歴史的な転換点であると同時に、人類にとって計り知れないほど有益なものだと位置付けた。
Continue reading “OpenAI CEO Sam Altman の主張:AI は自律的に改善するシンギュラリティに到達した”Anthropic Claude Opus 5 を正式公開:脆弱性検出とガードレールを両立した次世代 AI モデル
Claude Opus 5 Finds Vulnerabilities but Remains Restricted in Generating Exploits
2026/07/27 CyberSecurityNews — Anthropic がリリースした次世代 LLM の Claude Opus 5 は、ソフトウェア・エンジニアリングや複雑な知識労働のパフォーマンスを向上させる一方で、攻撃的なサイバー・セキュリティ能力を厳格に制御するよう設計されている。Claude Max のデフォルト・モデルであり、Claude Pro の最上位オプションとして位置付けられる Opus 5 は、Claude Fable 5 の最先端レベルの知能に迫る性能を約半分の価格で提供する、コスト・パフォーマンスに優れた選択肢となっている。
NVIDIA/Microsoft/CrowdStrike が Open Secure AI Alliance を設立:オープン・モデルと防御強化の推進
NVIDIA, Microsoft, and CrowdStrike Launch Alliance for Open-Source AI Security
2026/07/27 gbhackers — NVIDIA/Microsoft/CrowdStrike は、広範なテクノロジー/サイバーセキュリティ/オープンソース関連組織と協調して Open Secure AI Alliance を立ち上げた。この取り組みは、AI 対応インフラを防御するためのオープンなツール/モデル/エージェント・ハーネス/セキュリティ技術の開発に焦点を当てるものであり、Linux Foundation の Akrites イニシアチブと Open Source Security Foundation (OpenSSF) が築いた基盤の上に構築されている。AI エージェントがエンタープライズ環境や重要インフラ環境へ統合されるにつれて重視される、脆弱性の開示/修正とコミュニティ主導のサイバー防御の強化を目的としている
Continue reading “NVIDIA/Microsoft/CrowdStrike が Open Secure AI Alliance を設立:オープン・モデルと防御強化の推進”Claude Opus 5 for AWS がローンチ:AI エージェントの長時間実行をサポート
AWS Launches Claude Opus 5 With Advanced Agentic Coding and Cybersecurity Capabilities
2026/07/27 gbhackers — AWS の Amazon Bedrock と Claude Platform 上において、Anthropic の Claude Opus 5 がローンチされた。この画期的なモデルは、エージェントによるコーディング/複雑なエンタープライズ・ワークフロー/視覚理解/長時間にわたり実行される自律タスク向けに設計されている。2026年7月24日にリリースされた Claude Opus 5 は、Anthropic における第 5 世代 Opus モデルである。AWS によると、本番グレードの推論/ソフトウェア開発/サイバーセキュリティ能力において、このモデルは大幅な改善を提供する。
Continue reading “Claude Opus 5 for AWS がローンチ:AI エージェントの長時間実行をサポート”Claude AI で共有された会話 URL:Google 検索によりクローリング/インデックス化されている
Google Indexed Claude AI Shared Chats Exposing Sensitive User Conversations
2026/07/27 gbhackers — Anthropic の Claude には、会話への公開を許す URL の作成と共有の機能が含まれており、ユーザーは AI チャットの内容を同僚/友人/クライアントなどと共有できる。しかし、それらのコンテンツ共有 URL が、公開フォーラム/ソーシャルメディア/Web ページなどのクローリングが可能な場所に投稿された場合には、露出のリスクがもたらされる。
Top AI Model に対する汎用型のジェイルブレイク:GPT-5.6/Claude/Opus 5/Fable なども対象
Researcher Claims Working Jailbreak on Top AI Models Including GPT-5.6, Claude Opus 5, and Fable
2026/07/25 CyberSecurityNews — GPT-5.6 Sol/Claude Opus 5/Fable といった主要な LLM に対して機能する、汎用型のジェイルブレイクを開発したと、著名な AI レッドチーム研究者が主張している。X 上の公開投稿で Pliny the Liberator は、「この手法は、すべてのモデルで、また、自身がテストしたすべてのカテゴリにわたり有効だった」と説明している。同氏は、この手法の仕組みを踏まえると、完全なパッチを適用することは極めて困難であり、あるいは不可能でさえあるかもしれないと指摘している。
Continue reading “Top AI Model に対する汎用型のジェイルブレイク:GPT-5.6/Claude/Opus 5/Fable なども対象”AI Agent とエンタープライズ侵害リスク:急速に拡大する情報露出源として扱うべき
AI Agents Now the Enterprises Fastest Growing Exposed Attack Surface
2026/07/23 InfoSecurity — エンタープライズ AI ツールの急速な採用により、きわめて急速に企業の露出源が拡大し、新たなサイバー脅威のリスクが生じると、最新のレポートが警告している。2026年7月22日に公開された Sophos AI Security 2026 Report は、企業内において AI エージェントと AI アシスタントの採用が進む中で、AI の ID が新たな攻撃対象領域になっていると警告した。
Okta が拡張する AI Agent のための ID 制御:各アクセス・ライフサイクルに対処する 3 つの機能とは?
Okta Expands Identity Controls for AI Agents
2026/07/23 SecurityBoulevard — 企業システム内で従業員に対して用いられる AI エージェントは、ID 追跡やアクセス・レビューなしに動作できるため、独特のアクセス管理上の問題を生み出す。Security Boulevard が報じたように、北米の 539 組織を対象とした IDC の調査で判明したのは、回答者の 90% が自律型 AI によるリスクへ対処するために、自社の ID 管理慣行を改善する必要があると考えていることだ。いまのセキュリティ・チームは、行動しているエージェントや、そこで使用される権限、そして、アクセスの保持などについて判断する必要がある。
Linux セキュリティ・チームの危機的な状況:AI が自動的に発見するバグの洪水
Linux Security Teams Face Unprecedented Strain After Surge in Kernel Vulnerabilities
2026/07/23 SecurityBoulevard — システム管理者とエンタープライズのサイバーセキュリティ・リーダーたちは、Linux カーネルに関する Common Vulnerabilities and Exposures (CVE) 432 件が週末にリリースされたことを受け、圧倒的な数のセキュリティ・アドバイザリへの対応に追われている。Artificial Intelligence (AI) が拡大させる自動バグ発見により、セキュリティ開示が前例のないレベルで急増している。それを受けるかたちで、脆弱性の優先順位付け/運用上のパッチ管理の混乱に関する業界内での緊急の議論が再燃している。
Oracle が 1,400+ の脆弱性を FIX:AI 悪用によるマシンスピードでの侵害に対応
Oracle Patches 1,400+ Vulnerabilities, Critical Flaws Expose Enterprise Servers to Remote Attacks
2026/07/22 CyberSecurityNews — Oracle がリリースした 2026年7月の Critical Patch Update (CPU) において、1,449 件のセキュリティ・パッチが公開された。それにより修正されたのは、データベース/ミドルウェア/クラウドサービス/エンタープライズアプリケーションにまたがる 1,200 件超の脆弱性であり、同社における最大規模の CPU となった。このリリースの規模は、製品の複雑性が拡大していることだけではなく、新たな現実も反映している。それは、フロンティア AI システムによって脆弱性発見とエクスプロイト開発が劇的に加速しているということである。
You must be logged in to post a comment.