ホーム / ニュース / OpenAI、GPT-6 Astraの高速版「Ultrafast」をAPIで一般提供 標準の最大8倍速、料金は6倍

OpenAI、GPT-6 Astraの高速版「Ultrafast」をAPIで一般提供 標準の最大8倍速、料金は6倍

OpenAIは10月1日(米国時間)、フラッグシップモデルGPT-6 Astraを高速な提供枠で動かすUltrafastモードを、OpenAI APIのすべての利用者に開放した。同日、NVIDIAがGPT-6 Astra Ultrafastの推論基盤に関する解説を公開し、Ultrafastが同社のBlackwell GPU上で動いていることを明らかにした。トークンの生成速度は、Astraの通常モードと比べて最大8倍になる。

APIでは、モデルに「gpt-6-astra」を指定したうえで「service_tier」に「ultrafast」を渡すだけで切り替わる。HTTPでも呼び出せるが、OpenAIはツール呼び出しを短い間隔で繰り返すエージェント用途ではWebSocketの常時接続を強く推奨している。接続のたびに生じる通信のオーバーヘッドが、せっかくの高速化を目減りさせるためだ。初期の利用上限は、利用ティア1〜3で毎分50万トークン、ティア4で100万トークン、ティア5で500万トークン。これを超える枠はOpenAIの営業担当を通じて申請する。

料金は100万トークンあたり入力60ドル(約9,000円)、出力300ドル(約45,000円)で、通常の入力10ドル・出力50ドルのちょうど6倍にあたる。長文脈の料金は入力120ドル・出力450ドル。Astraには9月の公開時から、標準の2倍の料金で最大2倍速く処理するFast modeがあった(入力20ドル・出力100ドル)。Fastは「2倍払って最大2倍速」、Ultrafastは「6倍払って最大8倍速」という関係になり、同じ量の出力を得る費用は増えるものの、速度あたりの割増はUltrafastのほうが小さい。NVIDIAの説明では、OpenAIは自社モデルを使ってBlackwell向けの推論ソフトウェアを最適化したという。

前身にあたる取り組みとの違いもある。OpenAIは8月、GPT-5.6 Solを最大14倍速で動かすUltrafastを招待制の限定プレビューとして発表していた。このときの推論基盤はCerebras製のチップで、料金も一般提供の時期も示されていなかった。今回のAstra版は動かすハードウェアがNVIDIAのGPUに替わり、料金表を公開したうえで全API利用者に広げた点が大きく異なる。なお、GPT-5.6 SolのUltrafastは現在もプレビュー扱いのままだ。ChatGPT側では、9月29日に始まった月額500ドル(約75,000円)のPro 500でAstraのUltrafastが使えるようになっており、NVIDIAによればChatGPT WorkとCodexでも対象ユーザーに提供されている。

日本の企業が使う際に注意したいのは、処理を行う地域の制限だ。Ultrafastが対応するのは米国のデータレジデンシーとグローバル処理だけで、EUを含む米国以外の地域処理エンドポイントでは使えない。データを国内や特定地域で処理する設定を前提に契約している場合、Ultrafastを使うにはその条件を外す必要がある。

タグ付け処理あり: