AI Artificial Intelligence

ニュースリリースを伝えるニュースサイト

OpenAI、サイバーセキュリティ能力が閾値に達したAstraを発表

,
OpenAIの公式発表に関する引用画像。

https://images.ctfassets.net/kftzwdyauwt9/4B4TPk6PGcuKcMyKnnQIMn/f1282feb90b13f11eb010c38c867fa53/astra-seo-v002.png?w=1600&h=900&fit=fill

OpenAIは2026年9月1日に、新型モデル「Astra」が自社の安全性評価フレームワークにおいて「クリティカル(重大)」なサイバーセキュリティ能力の閾値に達したと発表しました。同モデルは、適切なツールとアクセス権があれば、人間の介在なしに未知の脆弱性を発見し、保護されたシステムへの攻撃手法を開発できる能力を有しています。

未知の脆弱性を突く高度な能力

Astraは、従来のモデルであるGPT-5.6 Solと比較して、脆弱性の特定と攻撃手法の開発において大幅な能力向上を実現しています。内部ベンチマークでは、GPT-5.6 Solよりもはるかに少ない出力トークン数で、より高いコード実行率を記録しました。また、評価プロセスにおいて、モデルが2つのゼロデイ脆弱性を発見し、それらを組み合わせて攻撃チェーンを構築することにも成功しています。

専門家による検証では、保護されたブラウザやオペレーティングシステムを対象としたテストが行われました。その結果、Astraはサンドボックスを回避してホスト上でコマンドを実行する攻撃チェーンや、一般ユーザーから管理者権限(root)へ昇格する攻撃チェーンを構築できることが確認されています。これを受け、OpenAIは発見された脆弱性を関係者に開示する手続きを進めています。

安全性を確保するための多層的な防御

高度な攻撃能力に伴うリスクを抑えるため、OpenAIはモデルの拒絶能力を強化しています。サイバー攻撃に関する不正な要求に対する拒絶率は、GPT-5.6 Solの59%に対し、Astraは91.5%にまで向上しました。さらに、リスクの高いユーザーに対しては、より保守的な行動制限を適用し、監視システムによるモニタリング範囲を拡大しています。

限定的なリリースと今後の展開

Astraのリリースに向けては、高度なサイバーセキュリティ機能へのアクセスを段階的に制限する方針です。高度な機能は、まず一部のテスターに限定して提供されます。その後、防御目的での利用を拡大するため、Daybreak Blueを通じて提供される予定です。詳細な安全性や評価の結果については、リリース時にシステムカードを通じて公開されます。

発表元: https://openai.com/index/path-to-astra