GPT‑5.6 Sol Ultrafast、最大毎秒750出力トークンの限定プレビュー

OpenAIはCerebras上でGPT‑5.6 SolをStandardより最大14倍高速化するAPIサービス層を一部顧客向けに公開しました。

フロンティアモデルをリアルタイム用途へ

OpenAIは8月13日、Cerebras基盤でGPT‑5.6 Solを動かすUltrafast API層を限定公開しました。Standard処理比で最大14倍、毎秒最大750出力トークンを報告し、障害対応、音声支援、金融分析、商取引、反復研究を例示しています。

数値の境界

いずれも供給側が報告する最大値で、全プロンプトの総遅延を保証しません。最初のトークン、入力長、ツール呼び出し、通信、同時利用、出力長が体感を左右します。価格と供給容量も未公開です。

現在は選定顧客の限定APIプレビューです。導入判断では同一作業で総完了時間、成功率、費用、再試行率をStandardと比較する必要があります。

公式情報