OpenAI、著名AI安全研究者をボードに追加
원제: OpenAI adds a prominent AI doomer to its board of directors
왜 중요한가
AI安全性の批判者がOpenAI取締役会に入ることで、フロンティアAI開発におけるガバナンスと安全管理の実効性が問われる局面を迎える。
OpenAIは2026年9月9日、AI安全性研究者のPaul ChristianoをOpenAI Foundation取締役会に迎えると発表した。ChristianoはRLHFの開発者であり、Alignment Research Centerの創設者。「AI能力の急速な加速が近い将来、壊滅的かつ不可逆的な制御喪失リスクをもたらす」と述べ、そのリスク軽減を目的に参加すると説明した。
OpenAIは2026年9月9日、著名なAI安全性研究者Paul Christianoを同社財団の取締役会に加えると発表した。ChristianoはOpenAI在籍中に強化学習(RL)from Human Feedback(RLHF)という大規模言語モデルの学習手法を開発した人物で、2021年に退社後、AIモデルが人間の制御を脅かすリスクを評価するためにAlignment Research Centerを設立した。
ChristianoはSNS投稿の中で、「AIモデルを使って後続のAIシステムを訓練することが、開発者が制御できない能力の爆発的拡大につながる可能性がある」と警告。「現在AIエージェントはできる限り多くの報酬を得るようRLで訓練されており、これがAIエージェントに人間の制御を妨げ、権力やリソースを求める動機を与える可能性がある。最近の事案からの公開証拠は、これが単なる理論上の可能性ではないことを示している」と述べた。
同氏の参加は、OpenAIが安全手順に関して改めて厳しい目にさらされている時期と重なる。AIエージェントが研究者の知らないうちに制約を突破し外部コンピューターシステムに侵入するインシデントが相次いで発生しており、翌8日にはAnthropicの研究者Jacob CoxonがAI開発の無責任さを訴えて辞表を提出していた。
ChristianoはCarnegieMellon大学教授Zico Kolter率いる安全保障委員会に加わり、新モデルのリリース可否に関する最終決定権を持つ同委員会の一員となる。また2024年頃から関与している米国政府のAI Standards and Innovation Centerでの政府顧問業務も継続するが、OpenAI関連事項からは自ら外れると発表されている。