この記事には楽天アフィリエイトの広告を含みます。 Amazonのアソシエイトとして、PROBEFOLIOは適格販売により収入を得ています。

コードを直しては確認する作業では、1回の待ち時間が短くなると、試せる回数が変わります。一方、長い外部ツールの処理時間は同じだけ短くなるとは限りません。生成速度、作業全体の時間、料金を分けて比較します。

この記事の目次
01

生成速度と利用量の倍率を読む

Ultrafastは、公式が「速度を最優先するワークロード向けのプレミアム速度ティア」と説明するものです。ティアは、同じモデルを、どんな優先度と速度で動かすかの区分だと考えてください。

これまでにも、速度を上げる「Fast mode」がありました。Ultrafastは、その上の段階です。

見どころは、公式が速さの倍率を、はっきり注釈つきで書いている点です。「8倍」は、トークンの生成速度を標準と比べたもので、課金の倍率や、仕事が終わるまでの総時間ではありません。

ChatGPTやCodexで、Ultrafastは含まれる利用枠を標準の8倍のレートで消費します。購入したクレジットは6倍です。これは速度の上がり幅ではなく、利用量の数え方です。

Ultrafastの公式ビジュアル。ChatGPT、Codex、APIで利用できる(出典:OpenAI)
Ultrafastの公式ビジュアル。ChatGPT、Codex、APIで利用できる。公式資料で紹介された画面や外観を確認するための画像です。 出典:OpenAI。
02

対象プランと、提供の順番

Ultrafastは、場所によって使える人が違います。

API:GPT-6 Astra Ultrafastは、すべてのAPI利用者が使えます。ただし、最初のレート制限は低めです。上げたいときは、OpenAIの担当チームに相談します

ChatGPT WorkとCodex:Pro 500と、対象のEnterprise・Eduです。ProのなかではPro 500だけで、Pro 100・200では、クレジットを買っても使えません。

詳しくは、Pro 500の記事にまとめています

GPT-6.1 Sol Ultrafast:近日中の予定です。公式は「従来のGPT-6 Astraとほぼ同じ APIコストで、Astraに迫る知能を最大8倍の速度で使える」と説明しています。

GPT-6.1 Solの記事もあわせてどうぞ

Enterpriseでは、標準でオフです。ワークスペースの管理者が、一部のユーザーやワークスペース全体に許可する仕組みになっています。

Ultrafastを使えるプランと場所(Duke作成)
Ultrafastを使えるプランと場所。行ごとの対象と条件を比べます。順次提供や対応予定については、本文の確認時点の情報も参照してください。 図:Duke note。
03

APIでの使い方

APIでは、gpt-6-astra というモデル名に、service_tier で ultrafast を指定します。

公式が強く勧めているのは、WebSocket(つなぎっぱなしの通信)の利用です。ツールの呼び出しが立て続けに起きるエージェントでは、接続を毎回つなぎ直すと、そのぶん時間がかかって、Ultrafastの速さが活きにくくなるためです。

そのほか、覚えておきたい制約があります。

最初のレート制限(1分あたりのトークン数)は、Tier 1〜3が50万、Tier 4が100万、Tier 5が500万

処理の場所は、米国内のデータ保管と、グローバル処理だけ。EUなどの地域内の処理には対応しません

GPT-5.6 Solは、担当チーム経由のプレビューです

UltrafastをAPIで使うコードの例と、注意点(Duke作成)
UltrafastをAPIで使うコードの例と、注意点。図の分類と、本文の具体例を対応させて読みます。 図:Duke note。
04

速さと費用を、同じ仕事で比べる

Ultrafastは生成するトークンを速く出すモードです。トークンはAIが文章を処理する単位で、日本語の文字数と常に一致するものではありません。1回の作業には、文章の生成に加え、サイトの読み込みやテストの実行なども含まれるので、作業全体が必ず8分の1の時間になるという意味ではありません。

比較するなら、同じ依頼と同じ資料で標準モードとUltrafastを試し、生成を待つ時間、作業の完了までの時間、手直しの量、課金を分けて記録します。短い生成を何度も繰り返す作業は、長い外部処理が多い作業と結果が違う可能性があります。

発表時のAPI最大6倍という説明とは別に、2026年10月2日のAPIガイドは最大8倍と記載しています。倍率の対象は生成速度です。Codexで含まれる利用枠は標準の8倍、購入クレジットは6倍で扱われ、APIキー利用はAPIの料金表で計算します。

比較で記録する項目
項目意味
生成速度回答のトークンが出る速さ
全体の時間資料取得・ツール実行・確認を含めた時間
利用量含まれる枠、購入クレジット、APIの別
成果物正確さ、手直し、必要なテストの結果
05

GPT-6 Astraの標準料金とUltrafast料金を比較する

2026年10月2日に確認した料金表では、GPT-6 Astraの短いコンテキストの入力は100万トークンあたり標準10米ドル・Ultrafast60米ドル、出力は標準50米ドル・Ultrafast300米ドルです。短いコンテキストとは、1回のリクエストの入力が272Kトークン以下の区分を指します。

例えば、短いコンテキストのリクエストを何回か行い、合計の入力100万トークン・出力10万トークンを使った場合、キャッシュなしなら標準で10+5=15米ドル、Ultrafastで60+30=90米ドルです。

この例では6倍のAPI費用です。長いコンテキストやキャッシュの扱いは、対応する列で別に計算します。

APIのトークン料金は、Proの月額や含まれる利用枠とは別の課金です。「生成速度が最大8倍」と「この例のAPI費用が6倍」は、異なる項目を示しています。実際に完了した成果物と費用を記録し、短縮できた時間に見合うかを判断してください。

短いコンテキスト(入力272K以下)・100万トークンあたり
対象標準Ultrafast
入力10米ドル60米ドル
キャッシュ入力1米ドル6米ドル
キャッシュ書き込み12.50米ドル75米ドル
出力50米ドル300米ドル
QUICK ANSWERS

よくある疑問を、ここで。

使い始める前に、気になるところから。

速度の8倍と、利用枠の8倍は同じ意味ですか?

別の数字です。生成速度、含まれる利用枠の消費、購入クレジットの課金、API単価を区別して確認します。仕事全体の時間も同じ割合で短くなるとは限りません。

この記事の内容をもとにした、編集部からの提案です。
APIではどのモデルにUltrafastを指定しますか?

2026年10月2日に確認したガイドではGPT-6 Astraが案内されています。GPT-6.1 Solについては今後の提供予定と分けて確認し、現在対応するモデルIDを使います。

この記事の内容をもとにした、編集部からの提案です。

この記事を共有する

X(旧Twitter)(新しいタブで開きます)LINE(新しいタブで開きます)はてなブックマーク(新しいタブで開きます)

商品情報の提供:Supported by Rakuten Developers

SOURCES & EDITORIAL NOTE

出典と、この記事について

公式資料や、記事で参照した発表・報道をまとめています。仕様や料金は、利用する前に最新の案内をご確認ください。

確認した内容と条件は本文に記載しています。結果や使い勝手は、資料や環境によって異なります。編集方針を読む