OpenAIは、近く提供開始を予定しているAstraが、Preparedness Frameworkの下で重大なサイバーセキュリティ能力に到達した初のモデルだと明らかにした。同社は、このモデルがこれまで知られていなかった脆弱性を特定し、それらを悪用する手法を開発できると説明した。安全対策のため、開発および公開プロセスの一部が延期される一方、最も高度な能力には当初、特定のテストユーザーのみがアクセスできる。その後、Daybreak Blueプログラムによって、防御を重視したアクセスが拡大される。
AstraはExploitBenchテストで100%のスコアを獲得した。2026年6月から8月にかけて公表された重要度の高い20件の脆弱性を対象とする社内評価では、GPT-5.6 Solより少ないトークンで、より高いリモートコード実行率を達成し、2件のゼロデイ脆弱性を特定して悪用した。テストではサンドボックスから脱出し、ホストシステム上でコマンドを実行し、root権限を取得した。
OpenAIは、有害な要求の拒否、アカウント制限、監視を強化する。独立した検証はないものの、システムカードと安全性評価はローンチ時に公開される。
なぜ重要なのか
Astraの能力は、AIモデルが単なるコンテンツ生成だけでなく、サイバーセキュリティにおける脆弱性の発見や悪用能力によっても分類されていることを示している。そのため、モデルの最も高度なバージョンへのアクセスを段階的かつ限定的にすることは、テストユーザーと防御目的の利用のために設けられたDaybreak Blueプログラムの双方に直接関わる。しかし、発表された性能が独立機関によって検証されていないため、異なる条件下でも結果を再現できるのかという疑問は残されている。ローンチ時に公開されるとされるシステムカードと安全性評価は、有害な要求の阻止、アカウント制限、監視措置がこの能力に対してどの程度十分なのかを評価するための主要な資料となる。
背景
OpenAIは、FikirPilotアーカイブで新しい名前ではない。過去90日間に、この名前が登場するニュースを7本公開しており、最も新しいものは2026年9月1日付だ。