フロンティアモデルをリアルタイム用途へ
OpenAIは8月13日、Cerebras基盤でGPT‑5.6 Solを動かすUltrafast API層を限定公開しました。Standard処理比で最大14倍、毎秒最大750出力トークンを報告し、障害対応、音声支援、金融分析、商取引、反復研究を例示しています。
数値の境界
いずれも供給側が報告する最大値で、全プロンプトの総遅延を保証しません。最初のトークン、入力長、ツール呼び出し、通信、同時利用、出力長が体感を左右します。価格と供給容量も未公開です。
現在は選定顧客の限定APIプレビューです。導入判断では同一作業で総完了時間、成功率、費用、再試行率をStandardと比較する必要があります。