OpenAIは、近く市場投入を予定しているAstraという大規模言語モデルを発表した。同社は、このモデルが重要なサイバーセキュリティ基準を満たす初のLLMであり、最先端のセキュリティ機能へのアクセスは制限されると述べた。

Astraは、OpenAIエンジニアが開発したテストでExploitBench上で満点を取得し、2つのゼロデイ脆弱性を発見・利用した。この結果は、モデルが人間の介入なしにシステム内の未知のセキュリティ脆弱性を検出し、悪用できることを示すが、独立した検証はまだ行われていない。

モデルが広範に使用される前に、OpenAIは限定されたテストグループで試験を行い、高リスクアカウントの応答を制限する新たなセキュリティ手法を導入する予定だ。政府との協力の可能性やこれらの対策の有効性は依然として不透明である。