2026年9月1日 22:00
OpenAIのAstra、サイバー能力が最高水準に
Path to Astra: critical capabilities and frontier safeguards
3行まとめ
- •AstraがサイバーCritical水準達成
- •Preparedness Frameworkで初認定
- •公開前に安全対策を強化へ
詳細
背景
OpenAIは「Preparedness Framework」と呼ばれるリスク管理方針のもとで、サイバーセキュリティや生物兵器など複数の分野についてAIモデルの潜在的な危険性を段階的に評価している。同フレームワークは能力レベルを複数段階に分類し、最上位の「Critical(重大)」水準に達したモデルには公開前に追加の安全対策を課すことを定めている。
内容
OpenAIは新モデル「Astra」について、このPreparedness Frameworkのサイバーセキュリティ分野で「Critical」水準の基準を満たした初のモデルであると発表した。これを受けて同社は、モデルの公開にあたり従来より強化した安全対策(セーフガード)を導入する。対策の具体的な内容や、Astraの提供時期・用途についての詳細は本発表では示されていない。
今後の影響
AIモデルのサイバー攻撃関連能力が公式に「重大」水準と認定された初の事例となる。OpenAIは今後、Preparedness Frameworkに基づき安全対策を強化した上でモデルを提供する方針を示した。
なぜ重要か
サイバー攻撃能力が『重大』水準に達した初のOpenAIモデル。公開前に安全対策を強化する。
元記事を読む — OpenAI Blog