
Cerebras と OpenAI、GPT-5.6 Sol の超高速モード「Ultrafast」を発表
CerebrasとOpenAIが OpenAI API上で動作する新サービス「Ultrafast Mode」を発表。GPT-5.6 Sol Ultrafastは最大750トークン/秒の出力速度を実現し、既存モデルより大幅に高速化する。
CerebrasとOpenAIは、OpenAI APIに統合される新しいサービス階層「Ultrafast Mode」の早期展開を発表した。このモードはCerebrasのテクノロジーによって実現され、初期段階では限定されたグループの顧客に提供され、アクセスは段階的に拡大する予定である。
性能とベンチマーク
GPT-5.6 Sol on Ultrafast modeは最大750 output tokens per secondの出力速度を実現する。Artificial Analysisが報じた比較データによると、GPT-5.6 Sol Ultrafastは Fable 5比で11x高速、Opus 4.8 on Fast mode比で5x高速である。
Humanity's Last Examベンチマーク(博士号取得者のみが回答可能とされる2,500問で構成)では、GPT-5.6 Sol Ultrafastは全問を11 hours and 11 minutesで解答したのに対し、Claude Fable 5は78 hours and 27 minutesを要した。GDP-Valベンチマーク(経済的価値を持つ知識業務タスク向け)では、Ultrafastは品質低下なしに5.6x のエンドツーエンド高速化を実現した。
技術基盤と活用例
Cebrebasの Wafer-Scale Engine アーキテクチャは、ウェハー規模チップ上に44 GB のSRAMを搭載している。GPT-5.6 Solは法務文書、財務モデル、エンジニアリング報告書向けで OpenAIの最高性能モデルとされている。
ユーザーからの反応
OpenAI の Product 責任者 Rohan Varmaは「GPT-5.6 Sol Ultrafastにより、Cebrebasは皆さんの思考、コード作成、協業のペースに追従するAIを実現しました。Ultrafast推論によってワークフローとアプリケーションがどう変革されるか、楽しみにしています」と述べた。
OpenAI研究員の Jeffrey Wangは「以前は数分間待たなければならなかったタスクが、今はコンテキストスイッチする機会も持たないうちに完了してしまいます。生産性が大幅に向上しました」とコメントした。
筆者の見立て
- GPT-5.6 Sol Ultrafastは速度と知能のトレードオフを解決する手段と解釈している
- モデル機能が進化するにつれ、高速推論の活用範囲が拡大する可能性を示唆している
- より高速な知能は個人と組織の業務可能性を変える可能性がある
- Ultrafastは最先端AIを活用する組織にとって継続的な優位性をもたらすと論じている
- Ultrafastはエージェントとの新しい作業モード全体を実現する可能性を示唆している
- この技術アプローチが今後の最先端モデルにおいても継続的な速度優位をもたらす可能性があると予想している
この記事は元記事の事実のみに基づいて自動生成されました。
出典
Cerebras 「Accelerating GPT-5.6 Sol Ultrafast with OpenAI」 https://www.cerebras.ai/blog/accelerating-gpt-5-6-sol-ultrafast-with-openai (Artificial Analysis、Humanity's Last Exam、GDP-Val の報道による)