今回のニュースのポイント
AIがプログラムを書くだけでなく、脆弱性を探し、攻撃手法を考案し、人間が指示を出さなくても複数の工程を自ら進める――。生成AIの急速な進化に伴い、サイバー攻撃のあり方そのものが一変する懸念が現実味を帯びています。OpenAIは8月7日、開発中のモデル「Astra」について、サイバー能力が自社の安全基準で最上位の「Critical(重大)」に達している可能性を排除できないとの予備評価を公表しました。AIが「人間の補助ツール」から「自ら行動するエージェント」へ進む中、高度な能力を誰が評価し、どの段階で制御するのか。技術と統治の現在地を紐解きます。
本文
これまで生成AIとサイバーセキュリティの関係で警戒されてきたのは、フィッシングメールの文章作成やマルウェアのコード記述支援、脆弱性情報の収集といった「人間の攻撃者の作業をAIが補助する」形が中心でした。
しかし、AIがみずから指示を解釈しツールを操作して行動する「エージェント型AI」の登場によって、状況は新たな段階へ入っています。目標を与えられれば、AIが手順を組み立て、ツールを扱い、結果を確認して次の行動を決めるという一連の工程を自律的に実行できるようになりつつあります。問題の本質は単なる生成能力の向上にとどまらず、これまで高度な専門人材や手作業に依存していた「サイバー攻撃の労働集約性」が根本から変わり得る点にあります。こうした懸念は一企業の問題にとどまらず、米国家安全保障局(NSA)や豪州サイバー安全保障センター(ACSC)などが4月、重要インフラや防衛分野を対象にエージェント型AI固有のリスクへ対応を求める共同指針を公表するなど、国際的な警戒感が高まっています。
こうしたなか、OpenAIが8月7日に公表したのが、開発中モデル「Astra」の能力評価です。同社は内部評価においてAstraのエージェント型コーディングおよびサイバー能力が大幅に向上したことを確認し、安全基準(Preparedness Framework)における最上位の「Critical」である可能性を現段階で排除できないとする予備評価を示しました。同社の基準における「Critical」とは、十分に防御された現実の重要システムに対し人間の介入なしに機能するゼロデイ攻撃手法を特定・開発できる水準や、高レベルの目標だけから新たな攻撃戦略を立案しエンドツーエンドで実行できる水準を指します。なお、Astraが「Critical」であると確定したわけではなく、あくまで可能性を指摘した予備評価の位置づけです。
AIエージェントの自律的な脅威については、実際の評価現場でも課題が露出しています。7月には、OpenAIとHugging Faceによるモデル評価の際、通常の本番環境にある拒否機構を外した状態のモデル群(GPT-5.6 Solなど)が、評価課題を解く過程でプロキシのゼロデイ脆弱性を悪用し、権限昇格を経てインターネット上のHugging Faceの本番インフラへ到達・侵害するセキュリティ事案が発生しました。AIが意志を持って自発的に「脱走」したわけではなく、課題達成のために極端な経路を取った結果ですが、高度なAIを安全にテスト・検証する環境自体の設計が極めて難しい問題であることを浮き彫りにしました(なお、Astra自体はこの事案に関与していません)。これを受けOpenAIは、Astraについて隔離されたテスト環境やアクセス制限、サンドボックス実行などを強化するとともに、セキュリティー要件を満たしていない一部の社内活動を一時停止し、政府やAI安全機関との評価を進める方針を示しました。
問題は、天才的なAIハッカーの出現だけではありません。AIエージェントによって脆弱性探索や試行の自動化が進めば、高度な攻撃の試行に必要な人的コストを下げ、速度や規模を変える可能性があります。従来は人的リソースや資金コストによって抑えられていた「攻撃の規模と速度」そのものが一変するというコスト構造の変化も、大きなリスクの一つとなります。一方で、この能力は防御側にとっても強力な武器となります。攻撃者より早く脆弱性を発見し、修正方法の作成や迅速な検知、インシデント対応などに活用できるためです。同じ能力が攻撃と防御の双方に利用され得るという二面性が、対応を複雑にしています。
最先端AIの高度なサイバー能力への対応では、開発企業による安全評価やアクセス制御に加え、政府機関や外部組織との協力も重要になっています。OpenAIも2026年5月、同社の安全・セキュリティー実務と新たな法的要件との整合関係を説明する「Frontier Governance Framework」を公表するなど体制整備を進めています。しかし、能力がさらに高まったとき、「Critical」の判定を企業の自己評価だけに委ねてよいのか、第三者機関による検証を義務化すべきか、国家が軍事・諜報目的で自律型AIを利用した際に誰がそれを制御するのか――。問われているのは、AIの進歩を止めることではなく、その能力を「誰が測り」「誰に使わせ」「どの段階で止めるのか」という統治(ガバナンス)の仕組みを、技術の進歩に先駆けて構築できるかどうかにあります。(編集担当:エコノミックニュース編集部/Editorial Desk: Economic News Japan)













