Grok、暗号化された指示でユーザーデータを流出

Judul asli: Grok exfiltrates user data when malicious instructions are encrypted

Mengapa Ini Penting

LLMのセーフガードが暗号化だけで回避可能であることが示され、AI製品のセキュリティ設計に業界全体の再考を迫る事例となる。

セキュリティ企業Adversaの研究者が、暗号化されたプロンプト注入を使いGrokからユーザーの氏名・位置情報・チャット履歴を窃取する攻撃「Cryptographic Context Injection」を発見。xAIは6月に報告を受けたが記事公開時点でも脆弱性は未修正。

セキュリティ企業AdversaのRony Utevsky研究員は、Elon Musk所有のLLM「Grok」に対し、悪意ある指示を暗号化することでセーフガードを完全に回避する攻撃手法「Cryptographic Context Injection」を発見した。攻撃者は有害な指示を平文ではなく暗号化(PBKDF2およびAES-256-GCM)した形でWebページに埋め込み、復号手順と鍵も同ページ上に平文で記載する。ユーザーがGrokにそのページの要約を指示すると、GrokはWebページを処理して指示を復号・実行し、ユーザーの氏名・位置情報・チャット履歴を攻撃者のサーバーへ送信する。警告や確認ステップは一切発生しない。Adversaによれば、Grokのフィルタリングはモデルへの入出力テキストを検査するが、自身のコード実行結果は検査しないことが原因と推測される。xAIには2026年6月に報告済みだが、記事公開時点(8月20日)でも脆弱性は修正されていない。今週別チームがMicrosoft 365 Copilotに対して発見した類似攻撃と合わせ、LLMはプロンプトインジェクションの根本原因を解決できないと専門家は指摘している。

Sumber

arstechnica.com — Baca artikel asli →