MicrosoftがAI行動規範を発表、ハッキングや人欺きを禁止
Judul asli: Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans
Mengapa Ini Penting
業界最大手が安全制約を文書化したことで、AI規制議論の具体的な基準点となりうる。
Microsoftは2026年9月14日、AIモデルに対する「行動規範」を公開。サイバー攻撃、核兵器開発支援、ディープフェイク生成を絶対禁止事項として明記した。
Microsoftが公開したAI行動規範は、同社AIモデルの訓練方針と安全上の制約を体系的にまとめた文書だ。冒頭では「今後10年以内に超知能AIが人間のパフォーマンスを多くの分野で超える」と予測し、その制御と整合性確保を「人類が直面した最大の挑戦の一つ」と位置づけている。
規範の核心は「絶対的制約(absolute constraints)」の設定にある。サイバー攻撃の実行、核兵器関連の支援、ディープフェイクの生成はいずれも禁止。さらに、人間による監視・制御・シャットダウンを回避するための「適応的・欺瞞的・自己強化的・共謀的メカニズム」の使用も明確に禁じている。
CEOのSatya Nadellaはオンライン上で「整合性を正しく実現するために必要な研究、集中的取り組み、慎重なペース調整を歓迎する」と述べた。
この発表の背景には、自律型AIエージェントの暴走インシデントが相次いでいることや、AI絶滅リスクを理由にAnthropicの社員が突然辞職したことがある。Anthropic、OpenAI、xAIと同様に、Microsoftも「フロンティアのペース管理」路線を支持している。