
OpenAI、Astraの高度なサイバー機能を小規模アルファグループに限定
Astraは、OpenAIのPreparedness Frameworkにおいて、サイバーセキュリティの「Critical」の閾値を初めて超えたモデルである。ExploitBenchの20件の深刻な脆弱性テストでGPT-5.6 Solを上回り、自ら発見した2件のゼロデイ脆弱性を連鎖させた。完全なサイバーアクセスは、米国政府や重要インフラの防衛担当者を含む小規模なアルファグループに先行提供され、その後Daybreak Blueプログラムを通じて対象を拡大する。自律的なエクスプロイト発見は、もはや研究室のデモではなく、アクセス制限付きの商用製品となった。不適切なサイバーリクエストに対するAstraの拒否率は91.5%と、Solの59%を上回ったものの、依然として8.5%の要求には応じてしまっている。
出典: fortune.com ↗
Astraは、OpenAIがリリースを計画している最初のモデルだ。同社のPreparedness Framework(モデルが提示するリスクに応じて、同社が講じる安全対策を規定する社内ポリシー)のもとで「critical cybersecurity capability threshold」を満たすものだ。
OpenAI
なぜ重要か
- → 自律AIによる脆弱性発見が、ラボのデモから実際の政府展開を伴う利用制限のある商用製品へと移行した。
- → 有害な要求に対する8.5%の順守率が根本的なトレードオフを明らかにする。すなわち、安全性の拒否が正当な防御を妨げるというものだ。
防御か、支配か