GPT-6 Astraは何を測って『Critical』に達したのか

2026年9月2日、OpenAIは新モデル「GPT-6 Astra」と、その安全性を評価したレポート『Path to Astra』を同時に公開した。自社で設けた評価枠組み「Preparedness Framework」におけるサイバーセキュリティ部門で、最高レベルのリスクを示す「Critical(深刻)」の閾値に到達したことが判明した。

なぜそこまで危険視されたのか。決定打となったのは、ソフトウェアの脆弱性を自動で検出して実証攻撃を行うテスト「ExploitBench」における数字だ。前世代モデル「GPT-5.6 Sol」の成功率が78.5%だったのに対し、Astraは100%という驚異的な数値を叩き出した。

これを受け、OpenAIのCEO Sam Altman(サム・アルトマン) は要人会合の場で、Astraの能力が「誰もが冷静にならざるを得ない域に達した」と語った。同社は開発環境を隔離ネットワーク上のサンドボックスに制限し、検証速度を意図的に落とすという異例の判断を下している。スピード勝負を繰り広げてきた大手が、自らブレーキを踏んだ瞬間だった。

GPT-6 Astraの能力は、誰もが冷静にならざるを得ない(sobering)域に達した。
Sam Altman(OpenAI CEO)|2026年9月 G20会合にて

100%という数字を割り引く、OpenAIの安全ブランド戦略

ただし、この「危険すぎるから減速する」というストーリーをそのまま鵜呑みにするのは危険だ。これまで競合に先行するためにリリース速度を最重視してきた同社が、なぜ今になって足踏みをアピールするのか。その裏には、計算されたブランド戦略が透けて見える。

攻撃能力で100%を記録したということは、裏を返せば「世界で最も強力なサイバー攻撃ツールを保持している」ことに他ならない。OpenAIの狙いは、「うちのモデルは極めて危険だが、自社の高度なガードレールで安全に管理している」と市場に印象づけることだ。

これにより、高度な技術を安全に使える存在として位置づけ、法人向けAPIやプレミアムプランの価格維持・引き上げを正当化する下地が整う。トークン消費による収入を軸とする同社にとって、「安全の担保」そのものが大きな商材になりつつあるのだ。

100% ExploitBench成功率 前世代78.5%から急上昇
Critical 自社基準リスクレベル 最高危険度の閾値を突破
ゼロ円 推定攻撃外注費 AI普及による攻撃の限界費用

攻撃能力が商品化される世界で、狙われるのは中小の放置サーバ

OpenAIが安全性を管理したとしても、技術の原理が確立された以上、同様の攻撃能力を持つモデルがオープンソースや裏市場へ波及するのは時間の問題だ。読者である中小企業の経営者が注目すべきは、AI自体の危険度ではなく「攻撃側のコストが事実上ゼロになる」という構造変化である。

これまで、企業のネットワークに侵入して脆弱性を突く作業には、高度なスキルを持つ人手と時間が必要だった。そのため、ターゲットは資金力のある大企業が中心だった。しかし、脆弱性検証の成功率が100%に達するAIが普及すれば、攻撃者はボットネットにAIを組み込み、インターネット上の全IPアドレスに対して全自動で無差別に攻撃を試行できるようになる。

ターゲットの選別すら自動化される世界で最も標的になりやすいのは、月数万円のIT予算しかなく、専門の管理者が不在の中小企業だ。「うちのような小さな会社に価値あるデータはない」という認識は通用しない。脆弱性が1つでもあるサーバは、即座に踏み台や身代金要求の餌食となる。

明日できる棚卸し、高額製品より先にやる一手

攻撃側の技術が飛躍したからといって、焦って数百万のセキュリティソフトウェアを購入する必要はない。攻撃AIが最初に突いてくるのは、高度なゼロデイ攻撃(未知の脆弱性)ではなく、すでに修正プログラムが出ているのに放置されている「既知の穴」だからだ。

防御側が今すぐやるべきは、新製品の導入ではなく「当たり前の手当て」である。社内のWebサーバ、拠点間をつなぐ古いVPN機器、事務所のWi-Fiルーターなど、外部に接している機器の管理状態を洗い出すことが先決だ。

AI時代の防衛戦略とは、AIと戦うことではない。攻撃AIの自動探索プログラムに「ここは管理が行き届いていて隙がない」と判定させ、最初の数秒で素通りさせる体制を作ることにある。

出典 / SOURCES

※本記事は公開情報をもとに AI が自動で編集・要約し、出典を明記しています。正確性は各出典をご確認ください。

30分で課題を整理する