OpenAIは、より高速なモデル応答を特徴とする「Ultrafast」という新しいモードを発表しました。同社によると、このモードではGPT 5.6 Solが標準処理速度の14倍で動作し、最大で毎秒750トークンの出力が可能で、現在は限定された顧客に対してプレビュー版として提供されています。
この更新は、企業がリアルタイムのAI処理を必要としていることに焦点を当てています。OpenAIは、過去にはよりリアルタイムに近い応答を得るためには、通常、より小さなモデルに切り替えるか、特定のタスクに最適化されたシステムを選択する必要がありました。Ultrafastは、小さなモデルに単純に依存することなく、単位時間あたりに完了できる有効な作業量を向上させることを目指しています。
出力速度の向上
OpenAIによると、Ultrafastの主な特徴は生成までの待機時間を大幅に短縮することです。
- 最大出力速度は毎秒750トークンです
- 処理速度は標準モードの約14倍です
- 現在のバージョンはプレビュー段階です
TechCrunchは、Anthropicなどの競合他社も以前から高速モードを導入していたと指摘している。たとえばClaudeの製品も高速モードを提供しているが、OpenAIが今回発表した速度指標はそれよりも高い。
企業のワークフロー向け
OpenAIはUltrafastの適用シーンを複数の企業タスクに向け、主にイベント対応、カスタマーサービスおよびサポート、金融市場分析、eコマースなどに重点を置いています。これらのシーンではレイテンシーに敏感であり、モデルの応答時間が人間の協力効率や自動化プロセスのパフォーマンスに直接影響します。
製品の位置づけから見ると、Ultrafastは単独の新しいモデルではなく、GPT 5.6 Solを基にした高速実行方式です。企業顧客にとって、これは強力なモデルの機能を維持しつつ、AIをリアルタイムのビジネスプロセスにより直接的に組み込むことを意味します。
Cerebrasによってサポートされています
OpenAIは、Ultrafastが同社とチップ企業Cerebrasの協力によって実現されていることを示しています。最初のプレビュー資格は現在、限定された顧客のみに提供されており、今後、計算能力の拡大に伴いアクセス範囲を段階的に拡大する予定です。
これは、大規模モデルの競争がパラメータや機能の比較から、応答速度、デプロイ効率、および基盤となる計算リソースの協調へと拡大していることを示しています。企業市場を対象としたAI製品にとって、速度はモデルの品質と並ぶ重要な指標となっています。
