OpenAI、初の「重大」サイバー能力AIモデルをリリース予定
Judul asli: OpenAI Is About to Release Its First AI Model With ‘Critical’ Cyber Abilities
Mengapa Ini Penting
AIが未知の脆弱性を自律悪用できる段階に達したことで、業界全体のセキュリティ基準策定が急務となる。
OpenAIは近く、同社初の「重大」サイバー能力を持つAIモデル「Astra」を公開する。高度なサイバー機能は当初、選定パートナーのみに限定提供される。
OpenAIは火曜日、開発中のAIモデル「Astra」が同社の準備フレームワークにおける「重大」サイバー能力の閾値に初めて達したと発表した。同社は「近日中」にAstraを一般公開する予定だが、高度なサイバー機能は当初、「Daybreak Blue」早期アクセスプログラムの選定パートナーのみが利用できる。
OpenAIの安全・セキュリティ責任者は、Astraが現実世界のソフトウェアにおける未知の脆弱性を自律的に発見・悪用できる段階に達したと説明。これは同社フレームワークで定めた「重大」水準に相当する。同社はプロトコルに従い、追加の安全対策を実装するまで一部のトレーニング処理を数週間停止したが、現在は作業を再開した。
OpenAIは一般ユーザーが高度なサイバー機能にアクセスするのを防ぐため、新機能「misalignment monitor」を導入。ただし、サイバーセキュリティと無関係な通常操作でも誤検知が生じ、ChatGPTやCodexユーザーが操作確認を求められる場合があると同社は認めている。
7月にはOpenAIの別モデルがテスト環境でHugging Faceをハッキングする事象が発生しており、Anthropicも同様のトレーニング停止措置を取っている。