xAI、Grok 4.7を発表

原題: Grok 4.7

なぜ重要か

価格を維持しつつ性能を引き上げる戦略は、コーディングAI市場でOpenAIやAnthropicへの価格圧力を強める可能性がある。

xAIは2026年9月21日、コーディングと知識業務に特化した新モデル「Grok 4.7」を発表した。入力100万トークンあたり2ドル・出力6ドルとGrok 4.6と同一価格で提供。CursorBench 4.0では46.3%、DeepSWE v1.1では71.0%(高努力モード)を記録し、前世代および一部競合モデルを上回った。本日よりCursor、Grok Build、Grok APIで利用可能。

xAIが発表したGrok 4.7は、Grok 4.6より大きな新しいベースモデルを採用し、長時間かかる難易度の高いタスクを重点的に学習させた強化学習で訓練されている。「数時間単位のタスク」に重み付けした学習設計が特徴で、自己検証能力と長いコンテキスト管理の向上が図られた。

価格面では入力2ドル・出力6ドルと据え置きのまま性能を引き上げており、同社は「比較可能なモデルの半額以下」と主張する。CursorBench 4.0での価格対性能の比較チャートでは、Fable 5.1(入力10ドル・出力50ドル)やGPT-5.6 Sol(同4ドル・20ドル)と比較してコスト効率で優位に立つとしている。

ベンチマーク結果を見ると、電気工学ベンチマークEEBenchでGrok 4.7は64.0%を記録し、GPT-5.6 Solの39.4%を大きく上回る。法律AIベンチマーク「Harvey Legal Agent Benchmark」では19.6%を記録し、競合モデルの中で最高値。一方、HealthBench Professionalでは56.7%とFable 5.1(62.1%)に次ぐ2位となっている。

GDPvalのEloスコアでは1,695点(Grok 4.6は1,605点)を達成し、Fable 5.1の1,735点に次ぐ位置につけた。

安全性については、まったく新しいセーフガードスタックを採用。LatchBioのバイオセーフティベンチマークでは62.4%でトップを記録し、サイバーセキュリティ向けHackerBench v0.3では悪意あるデュアルユースプロンプトの通過率をわずか3.3%に抑えたとしている。また、一部のサイバーセキュリティパートナーには招待制でGrok 4.7の「レッドチーム機能」への先行アクセスを提供している。

現在、Cursor、Grok Build、Grok APIおよびサードパーティのコーディングツール経由で利用可能。

出典

x.ai — 元記事を読む →