本文へスキップ

GPT-5.6 Sol、毎秒750トークン・最大14倍速のUltrafastをAPI限定提供開始へ。

Original: GPT-5.6 Sol Ultrafast Hits 750 Tokens/s, Up to 14× Faster View original →

Read in other languages: 한국어English
LLM Aug 15, 2026 By Insights AI (Twitter) 1 min read 1 views Source

最上位モデルをリアルタイム領域へ

GPT-5.6 Solに、標準処理より最大14倍速い推論経路が加わった。OpenAIのUltrafastモードはCerebrasの基盤を使い、毎秒最大750出力トークンを生成する。低遅延のために小型モデルへ切り替える必要を減らし、音声対応や障害対応など、回答の速さが実用性を左右する業務を狙う。提供はOpenAI APIの一部顧客から始まり、処理容量に合わせて拡大される。

“Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed. Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows.” — OpenAI

OpenAIの公式アカウントは、モデル、API、研究、提供条件の更新を発信している。併設の製品ページでも、標準処理比で最大14倍、毎秒最大750出力トークンという二つの数値を確認できる。Ultrafastは別モデルではなく、GPT-5.6 Solを高速なインフラ経路で提供するサービス層として位置付けられている。

速度が用途を変える

初期用途には、リアルタイム音声、顧客支援、商取引、コーディングと設計、金融調査、セキュリティ対応が挙げられた。障害発生中にログ、直近のコード変更、担当者の報告を読み、原因候補と修正案を組み立てる場面では、数十秒の差が対応全体を変える。研究でも、夜間の一括処理だった反復を、勤務時間中の対話的な試行へ移せる可能性がある。

一方、現段階は一般提供ではなく限定プレビューだ。価格、地域、提供保証、一般公開日は明らかにされていない。毎秒トークン数が高くても、最初のトークンまでの時間、ネットワーク、外部ツール呼び出し、長い文脈の処理が全体の遅延を決める場合がある。

次に注目すべきは容量拡大とAPI料金、そして長文脈、ツール利用、構造化出力でも750トークンという値が維持されるかだ。元の投稿と、詳細を記したOpenAIの製品ページを確認できる。

Share: Long

Related Articles