Cerebras、GPT-5.6 Sol超高速推論を実現
원제: Accelerating GPT-5.6 Sol Ultrafast
왜 중요한가
フロンティアモデルの推論速度と品質のトレードオフを解消する試みであり、エンタープライズAIエージェント活用の新たな基準となりうる。
CerebrasとOpenAIは2026年8月13日、OpenAI APIで提供する新サービス層「Ultrafast Mode」を発表した。CerebrasのハードウェアがGPT-5.6 Solを駆動し、最大毎秒750トークンの出力速度を実現。品質を損なわずに高速推論を提供するとしており、当初は一部顧客に限定提供し、段階的に拡大予定。
CerebrasとOpenAIは、OpenAI APIに「Ultrafast Mode」を導入すると発表した。CerebrasのシリコンがGPT-5.6 Solを最大毎秒750トークンで動作させ、品質を維持したまま大幅な速度向上を実現する。
Cerebrasが公開したベンチマーク結果によると、GPT-5.6 Sol Ultrafastは「Humanity's Last Exam(HLE)」の2,500問を11時間11分で処理した。同じタスクにおいてClaude Fable 5は78時間27分(3日以上)を要しており、Ultrafastは約7倍の速度で同等の精度を達成したとしている。ベンチマークはCerebrasが2026年7月10日および7月13〜15日に実施。
Artificial Analysisの報告と比較した出力速度では、GPT-5.6 Sol UltrafastはFable 5の11倍、Opus 4.8(Fastモード)の5倍の速度を示したとしている。
経済的価値ある知識労働タスクのベンチマーク「GDP-Val」では、通常版と比べてエンドツーエンドで5.6倍の速度向上を記録し、品質低下はなかったとCerebrasは説明する。
OpenAI製品担当のRohan Varma氏は「GPT-5.6 Sol Ultrafastにより、ユーザーの思考・コーディング・コラボレーションのペースに追いつくAIが実現する」とコメント。法律文書作成、金融モデリング、エンジニアリングレポート、サイバーセキュリティ対応など時間的制約が厳しい業務への適用が想定される。Ultrafastは現在、一部の選定顧客のみに提供されており、順次アクセスを拡大する予定。