xAI, Grok 4.6を正式リリース

원제: Grok 4.6

왜 중요한가

エージェント型AIの長時間タスク処理能力がGPT-5.6 Sol水準に達し、コーディング・知識作業分野での競争が激化していることを示す。

xAIは2026年8月12日、新AIモデル「Grok 4.6」を正式公開した。長時間エージェント処理とビジュアル・インタラクティブ作業を強化し、Artificial Analysis Intelligence Indexでスコア61を記録、GPT-5.6 Solと同水準を達成。CursorおよびGrok Buildで即日利用可能。

xAIは2026年8月12日、「Grok 4.6」を正式リリースした。Grok 4.5を基盤に、長時間にわたるエージェント型タスク処理と、インタラクティブ・ビジュアル制作への対応を重点強化したモデルとなる。

ベンチマーク性能では、9つの評価指標を統合したArtificial Analysis Intelligence Indexで61点を記録し、GPT-5.6 Sol(同61点)と同水準、Grok 4.5(56点)を上回った。GDPVal-AA、DeepSWE 1.1、CursorBench 3.2、FrontierCode 1.1の各エージェント型コーディング・知識作業ベンチマークでもフロンティア水準を達成している。

トレーニング面では、Grok 4.5と比較してより長い追加トレーニングを実施。推論・高度技術概念向けのモデル生成データ、高品質なエンジニアリングデータ、改良済みオプティマイザとトレーニングレシピを採用した。SFT(教師あり微調整)段階ではGrok 4.5を用いてトラジェクトリを再生成し、モデルベースの検証で問題のあるデータを除去。RLトレーニングではカーネル最適化、Web開発、コンピュータ支援設計などドメイン固有の環境を含む幅広いエージェント型タスクを対象とした。

Grok 4.6はビジュアル・インタラクティブプロジェクトにおいて、初回生成の品質がGrok 4.5より向上しており、製品アイデアから動作する最初のバージョンを一度で生成できるとxAIは説明している。長いタスクシーケンスでは自己テストと検証も確認されたという。

安全性については、これまでで最も広範な事前デプロイテストを実施。脆弱性パッチ適用やエンジニアリング設計サイクルの加速など正当なユースケースでの有用性と安全性を両立させるよう調整されたとしている。

現在CursorおよびGrok Build上で利用可能で、リリース後1週間は利用枠が通常の2倍に設定されている。

출처

x.ai — 원문 읽기 →