
0
会員(無料)になると、いいね!でマイページに保存できます。
共有する
米オープンAI は8月13日(現地時間)、AIモデル「GPT-5.6 Sol」を高速処理する新サービス「Ultrafast」の限定プレビューを開始したと発表した。Standard処理と比べて最大14倍高速で動作するという。米セレブラスの推論基盤を採用し、最大750出力トークン/秒の生成速度を実現するとしている。

GPT-5.6 Solの処理速度比較
(出典:セレブラス)
オープンAIは、これまでリアルタイムに近い応答速度を得るには、より小型あるいは用途を限定したモデルを選ぶ必要がある場合が多かったと説明する。Ultrafastでは、同社が最上位に位置付けるGPT-5.6 Solの知能を維持しながら、処理速度を大幅に引き上げる狙いだ。オープンAIは、速度のために知能を犠牲にする必要がなくなれば、AIを時間的制約の厳しい業務にも広げられるとしている。
想定用途には、システム障害発生時のインシデント対応、金融リサーチ、不審な活動の検知、音声による顧客対応、ECでの商品案内や在庫確認などを挙げた。研究業務では、従来一晩かけて処理して翌朝に結果を確認していたような作業を、勤務時間中に何度も試行できる可能性があるという。
オープンAI社内でもUltrafastを試験している。インシデント対応では、ログやトレース、直近のコード変更などを素早く読み込み、原因の特定や修正案の検証を支援。研究業務では、情報源の検索やデータ照会、情報の整理・要約を高速化し、分析結果を受けて次の試行に移るまでの時間を縮めているという。最終的な判断やシステムへの変更は引き続きエンジニアが担うとしている。
今回採用したセレブラスとの協業も特徴となる。Ultrafastは、低遅延推論をオープンAIのプラットフォームに取り込む両社の提携をさらに進める取り組みと位置付ける。最大750出力トークン/秒という速度を生かし、リアルタイム性が重要な業務への高性能モデルの投入を狙う。
オープンAIは7月30日、GPT-5.6 SolにStandard処理より最大2.5倍高速な「Fast」モードも導入していた。FastはStandardの2倍の料金でモデルの知能を変えずに高速化する仕組みとして報じられている。今回のUltrafastは、そこからさらに処理速度を引き上げた新たなサービス階層となる。
GPT-5.6シリーズ は、最上位のSol、性能とコストのバランスを重視するTerra、高速・低価格のLunaの3階層で構成される。Solは、複雑な推論やエージェント型の長時間タスクを想定したフラッグシップモデルで、オープンAIは7月に一般提供を始めている。
Ultrafastは現時点で、一部の顧客だけが利用できる限定プレビューとなる。オープンAIは容量の拡大に合わせてアクセス対象を広げる方針だ。料金については今回の発表では明らかにしていない。
AI・生成AIのおすすめコンテンツ
Googleで見つけやすく

評価する
いいね!でぜひ著者を応援してください
会員(無料)になると、いいね!でマイページに保存できます。
関連タグ