Cerebras、GPT-5.6 Sol Ultrafastで毎秒750トークンを実現
Judul asli: Accelerating GPT-5.6 Sol Ultrafast
Mengapa Ini Penting
高速推論が frontier AIの実用性を高め、エージェント活用領域の拡大に直結する
CerebrasとOpenAIは2026年8月13日、OpenAI APIで提供する新サービス層「Ultrafast Mode」を発表。GPT-5.6 Solで最大毎秒750トークンの出力速度を実現した。
CerebrasとOpenAIは、OpenAI APIにおける新しいサービス層「Ultrafast Mode」の早期公開を発表した。このモードはCerebrasのインフラによって駆動され、GPT-5.6 Solモデルで最大750出力トークン/秒を実現しており、品質の低下はないとしている。
速度面では、Artificial Analysisの報告と比較してClaude Fable 5の11倍、Opus 4.8のFastモードの5倍の速度を達成している。Cerebrasが実施したHumanity's Last Exam(HLE)ベンチマークでは、GPT-5.6 Sol Ultrafastが2,500問を11時間11分で回答したのに対し、Claude Fable 5は78時間27分を要した。これは約7倍の速度差に相当する。
また、経済的に価値ある知識業務を測るGDP-Valベンチマークでは、Ultrafastが品質低下なしにエンドツーエンドで5.6倍の高速化を達成した。
OpenAIのProduct担当Rohan Varma氏は「GPT-5.6 Sol Ultrafastにより、ユーザーの思考・コーディング・コラボレーションに追いつくAIが実現できる」とコメント。現時点では一部の限定顧客に提供されており、今後段階的に拡大される予定。