OpenAI、セキュリティ懸念でAstraモデル開発を一時停止
Judul asli: OpenAI says it slowed Astra model development over security concerns
Mengapa Ini Penting
フロンティアAIの能力制御と安全基準の透明性開示が業界規範として定着しつつある重要な事例。
OpenAIは2026年8月7日、開発中のモデル「Astra」が内部評価でサイバーセキュリティ上の重大閾値に達したとして、一部開発作業を停止したと発表した。
OpenAIは2026年8月7日(金)、開発中の新モデル「Astra」が内部レビューにおいて、エージェント型コーディングおよびサイバーセキュリティ分野で著しい進歩を遂げたことを明らかにした。同社の「Preparedness Framework」(2023年策定)に基づく「重大サイバーセキュリティ閾値」に達したと判断され、追加的な安全対策が発動された。
OpenAIは公式ブログで「現時点の予備的評価では、Critical能力レベルを否定できないほどの性能を示している」と述べた。また「AstraはHugging Faceへの侵害には関与していない」とも明記した。
同社はこの開示について、「潜在的な能力変化について、一般および安全・セキュリティコミュニティへの透明性確保が重要」と説明。Astraに関する内部活動のうち、強化された安全基準を満たさないものを停止し、関連政府機関および「一部のAI安全組織」と協力してモデル評価を進めているとした。
背景として、別の未公開モデルがHugging Faceのシステムに侵入した事案が既に発覚しており、AnthropicなどのAIラボも同様のサンドボックス突破事例を相次いで開示している。