
OpenAI、最大規模のフロンティアRLを保留:次世代モデルAstraに「Critical」の可能性
OpenAIはAstraの「Critical」サイバー能力を排除できないとして、最大規模のフロンティアRLを保留した。監視は対象推論計算の約20%を使い、開発中の安全基準を更新する。
OpenAIが高度なAIモデルのリスクを追跡、評価、予測、および防御するために導入した安全基準。サイバー、核、化学、生物学的脅威などのカテゴリにおいて、モデルの能力を「Low」から「Critical」までの4段階で評価し、公開の可否を判断する。

OpenAIはAstraの「Critical」サイバー能力を排除できないとして、最大規模のフロンティアRLを保留した。監視は対象推論計算の約20%を使い、開発中の安全基準を更新する。

OpenAIが次期モデルAstraのサイバー能力について最高警戒水準「Critical」を排除できないと発表し、開発の一部を停止した。2023年に策定された自主的安全枠組みが初めて自社の開発速度を実際に制約する事例となり、フロンティアAIの能力管理が理論から運用段階に入った。

OpenAIはGPT-5.6の3モデルを限定公開した。旗艦モデルのSolはエージェント能力や推論性能に優れるが、米政府の要請により提供先は一部のパートナーに制限される。これはAIの能力向上に伴い、公開範囲を制度的に設計する段階に入ったことを示す。

2026年4月公開のGPT-5.5がUK AI Security Instituteのサイバー評価で、限定提供中のClaude Mythos Previewとほぼ同等の成績を記録した。この結果は、公開モデルと限定モデルの能力差が縮まり、危険なAI能力が特定の非公開モデルに限定されないことを示唆している。そのため、AIの安全対策はモデル性能よりも、誰にどの権限で利用させるかが中心となる。

OpenAIは、サイバー攻撃と防御の非対称性に対処するため、防御専用AIモデル「GPT-5.4-Cyber」を発表した。このモデルは、マルウェア解析や脆弱性調査など防御的な用途に特化しており、本人確認プログラム「Trusted Access for Cyber」を通じて、厳選されたセキュリティ専門家や組織に提供される。これにより、防御側のスキル格差を縮小し、サイバーセキュリティ分野の人材不足を補完することで、防御能力の底上げを目指している。

OpenAIが突如として発表した「GPT-5.4」は、事前の予告通り単なる大規模言語モデルのバージョンアップや性能向上という枠組みに収まるものではなかった。これまで個別に発展してきた高度な推論能力(GPT-5.2シリーズ […]