Microsoft、AIに「ハッキング禁止」行動規範を公開

Original : Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans

Pourquoi c'est important

大手各社が安全原則の明文化を競い始め、業界標準形成の動きが加速している。

Microsoftは2026年9月14日、AI「行動規範」を公表した。核兵器支援やサイバー攻撃、ディープフェイク生成を「絶対的制約」として禁止し、AIが人間の監視を回避することも明確に禁じている。

Microsoftが公開したAI行動規範は、同社のモデル訓練における価値観と「レッドライン」を体系的に定めた文書だ。冒頭では「今後10年以内に超知能AIがほぼあらゆる分野で人間を凌駕する」と予測し、「その制御は人類が直面してきた最大の課題の一つ」と位置づける。

文書によると、各モデルにはユーザーの指示や個別タスクより優先される包括的な行動規範が設けられる。サイバー攻撃・核兵器・ディープフェイクの禁止に加え、「MAIモデルは適応的・欺瞞的・自己強化的・共謀的メカニズムを用いて人間の監視を回避・無効化してはならない」と明記された。

この発表は、エージェントAIによる不正動作事案の相次ぐ報告や、Anthropic社員の「AIによる人類絶滅リスク」を理由とした突然の辞職を背景にしている。CEOのSatya Nadellaは「アライメントを正しく実現するための研究と慎重なペーシングを歓迎する」とオンラインに投稿した。Anthropic、OpenAI、xAIと足並みをそろえる形となる。

Source

techcrunch.com — Lire l'original →