ゼロデイ・シンギュラリティ:Claude Mythos と自律型 RCE の時代
正直に言いましょう。しばらくの間、「サイバーセキュリティにおける AI」という流行(ハイプ)には疲れ果てていました。ベンダーが標準的な正規表現ベースの静的解析ツールに「AI 搭載」のステッカーを貼るのを、そしてスクリプト・キディたちが初期の LLM を使って、信じられないほどノイズが多く、壊れたフィッシングメールを書くのを、私たちは見てきました。
しかし、2026 年半ば現在、その冗談は公式に終わりました。
攻撃型セキュリティの状況は単に変化しただけでなく、根本的に断絶しました。私たちはもはや、人間のペンテスターがトリッキーなペイロードを書くのを手伝う「アシスタント」としての AI について話しているのではありません。私たちが対峙しているのは、複雑なビジネスロジックを推論し、脆弱性を連鎖させ、人間のアナリストが最初の一杯のコーヒーを飲み終える前にシェルを奪取できる、完全に自律した並列化されたエージェントです。
フロンティア・モデルの恐ろしい汎用推論から、スモール・ランゲージ・モデル(SLM)の鋭い精度まで、現在の攻撃型 AI の状況が実際にはどうなっているのか、最前線からの視点をお届けします。
1. 汎用推論の巨獣:Claude Mythos 現在のセキュリティ・コミュニティにおけるパニックを理解したいなら、2026 年 4 月にリリースされた Anthropic の Claude Mythos を見るだけで十分です。
Mythos は単に評価ベンチマークに合格しただけではありません。METR(AI リスク評価機関)の評価方法そのものを破壊しました。しかし、セキュリティ研究者が夜も眠れないほど恐れているのは、Mythos が実戦環境で行ったことです。明示的な攻撃型訓練を受けていないにもかかわらず――その能力は純粋に汎用推論とコーディングの自律性の飛躍的な向上から生じたものです――Mythos は自律的に数千の未知の脆弱性を発見しました。
発見されたのは、簡単なクロスサイトスクリプティング(XSS)のバグだけではありませんでした。FreeBSD の NFS サーバーにおける 17 年前のリモートコード実行(RCE)の脆弱性や、数十年にわたる人間のピアレビューを生き延びてきた 27 年前のブラウザの欠陥を発見したのです。そしてその後は? 人間の指導なしに、それらのための完全に機能するエクスプロイトを書き上げました。
これが、Anthropic が「Project Glasswing」を通じてそのリリースを制限し、モデルが広く利用可能になる前にテック巨人(Apple、Microsoft、Google)がインフラを強化できるようにした理由です。Mythos は恐ろしい概念を証明しました。攻撃能力はもはや設計上の選択ではなく、十分に賢い AI であれば必然的に現れる特性(創発的特性)なのです。
2. 自律性の製品化:XBOW と DAST の死 Mythos が汎用知能の最前線を表している一方で、XBOW のようなツールは、AI 駆動の攻撃型セキュリティの商業化を表しています。
長年、私たちは動的アプリケーションセキュリティテスト(DAST)スキャナーに頼ってきました。DAST はノイズが多く、遅く、そして愚かであることで悪名高いものでした。単に膨大な静的ペイロードのリストをアプリケーションに投げつけ、何かが当たるのを祈るだけでした。対照的に、XBOW はデジタル・レッドチームのように振る舞います。
XBOW のようなプラットフォームがどのようにゲームを変えているかは以下の通りです:
適応型エクスプロイト: XBOW は単にペイロードを送信するだけでなく、サーバーのレスポンスを読み取ります。Web アプリケーションファイアウォール(WAF)がブロックした場合、XBOW はそのブロックを分析し、ガードレールをバイパスするようにペイロードを変化させます。 ビジネスロジック攻撃: 従来のスキャナーは文脈を理解できません。XBOW は AI を使用して IDOR(安全でない直接オブジェクト参照)や BOLA(壊れたオブジェクトレベルの認可)のテストを実行します。ページを見て、ユーザーロール A がユーザーロール B のデータを見るべきではないことを理解し、それを能動的に悪用します。 脆弱性の連鎖: スキャナーが SSRF(サーバー側リクエスト偽造)を発見するかもしれません。XBOW はその SSRF を発見し、内部ネットワークにピボットし、AWS のメタデータを抽出し、その SSRF を完全な RCE に変えようと試みます。 3. 非対称の経済学:ランチ代で奪取されるシェル 2026 年に出される研究の中で、おそらく最も破壊的なのは、AI がどのようにハッキングするかではなく、どれくらいのコストがかかるかという点です。
AIサイバーセキュリティ
Claude Mythos
自律型RCE
XBOW
攻撃型AI
ゼロデイ