OpenAIは2026年8月13日、大規模言語モデル「GPT-5.6 Sol」を通常のStandard処理と比べて最大14倍の速度で動かす新しいサービス階層「Ultrafast」をAPI向けにプレビュー公開したと発表しました。半導体企業Cerebrasの専用チップを活用することで、出力速度は最大で1秒あたり750トークンに達するといい、モデル自体の知能はStandard版のGPT-5.6 Solと同一のまま、応答速度だけを大幅に引き上げた形になります。
Ultrafastはまず一部の顧客に限定提供される形でOpenAI APIから展開が始まり、今後キャパシティの拡大にあわせて対象顧客を広げていく計画です。OpenAIは想定用途として、音声対話やカスタマーサポート、コマース、開発者向けエージェント、金融リサーチ、セキュリティ対応など、応答の遅延がそのまま体験の質を左右するリアルタイム・準本番用途を挙げています。
GPT-5.6 Solは同社が8月上旬にプレビュー公開したばかりの次世代モデルで、料金は入力100万トークンあたり5ドル・出力30ドルに設定されています。Ultrafastはこのモデルに「速度」という新たな選択肢を加える位置づけで、フロンティアモデルの知能を保ったまま、音声アシスタントのように低遅延が欠かせない場面での実用性を高める狙いがあるとみられます。
出典: OpenAI(公式ブログ)



