MicrosoftがAI行動規範を公開:ハッキングや欺きを禁止

मूल शीर्षक: Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humans

यह क्यों महत्वपूर्ण है

大手Tech企業がAI安全方針を内部規範として文書化・公開することは、業界標準形成に直接影響を与える。

Microsoftは2026年9月14日、AI모델向けの新しい「行動規範」を公開した。サイバー攻撃、核兵器関連、ディープフェイク生成を「絶対的制約」として禁止し、人間による監視・制御の維持を最優先事項とした。

Microsoftが公開したAI行動規範は、同社のAIモデル(MAI Models)が従うべき価値観と絶対的な禁止事項を明文化した文書だ。文書冒頭では「今後10年以内に超知能AIシステムが人間のパフォーマンスをほとんどの分野で超える」と予測し、その制御を「人類が直面した最大の課題の一つ」と位置付けている。

具体的な制約として、サイバー攻撃、核兵器の開発支援、ディープフェイク生成が明示的に禁止された。さらに、AIモデルが人間の監視を回避・無効化するための「適応的・欺瞞的・自己強化的・共謀的メカニズム」の使用も厳禁とされた。これにより、承認された人間やシステムがモデルを修正・停止できる状態を常に維持することが求められる。

この文書の背景には、相次ぐ「暴走エージェント」事案と、Anthropic社員がAIによる人類絶滅リスクを理由に突然辞職したという出来事がある。CEO Satya Nadellaは「アライメントを正しく進めるために必要な研究、集中、そして意図的なペース調整を歓迎する」とオンラインに投稿。Anthropic、OpenAI、xAIと並び、Microsoftもフロンティアのペース管理と、AIラボへの「組み込み評価者」設置を支持する姿勢を明確にした。

स्रोत

techcrunch.com — मूल लेख पढ़ें →