この記事には楽天アフィリエイトの広告を含みます。 Amazonのアソシエイトとして、PROBEFOLIOは適格販売により収入を得ています。
コードを直しては確認する作業では、1回の待ち時間が短くなると、試せる回数が変わります。一方、長い外部ツールの処理時間は同じだけ短くなるとは限りません。生成速度、作業全体の時間、料金を分けて比較します。
この記事の目次
生成速度と利用量の倍率を読む
Ultrafastは、公式が「速度を最優先するワークロード向けのプレミアム速度ティア」と説明するものです。ティアは、同じモデルを、どんな優先度と速度で動かすかの区分だと考えてください。
これまでにも、速度を上げる「Fast mode」がありました。Ultrafastは、その上の段階です。
見どころは、公式が速さの倍率を、はっきり注釈つきで書いている点です。「8倍」は、トークンの生成速度を標準と比べたもので、課金の倍率や、仕事が終わるまでの総時間ではありません。
ChatGPTやCodexで、Ultrafastは含まれる利用枠を標準の8倍のレートで消費します。購入したクレジットは6倍です。これは速度の上がり幅ではなく、利用量の数え方です。

対象プランと、提供の順番
Ultrafastは、場所によって使える人が違います。
API:GPT-6 Astra Ultrafastは、すべてのAPI利用者が使えます。ただし、最初のレート制限は低めです。上げたいときは、OpenAIの担当チームに相談します
ChatGPT WorkとCodex:Pro 500と、対象のEnterprise・Eduです。ProのなかではPro 500だけで、Pro 100・200では、クレジットを買っても使えません。
詳しくは、Pro 500の記事にまとめています
GPT-6.1 Sol Ultrafast:近日中の予定です。公式は「従来のGPT-6 Astraとほぼ同じ APIコストで、Astraに迫る知能を最大8倍の速度で使える」と説明しています。
GPT-6.1 Solの記事もあわせてどうぞ
Enterpriseでは、標準でオフです。ワークスペースの管理者が、一部のユーザーやワークスペース全体に許可する仕組みになっています。

APIでの使い方
APIでは、gpt-6-astra というモデル名に、service_tier で ultrafast を指定します。
公式が強く勧めているのは、WebSocket(つなぎっぱなしの通信)の利用です。ツールの呼び出しが立て続けに起きるエージェントでは、接続を毎回つなぎ直すと、そのぶん時間がかかって、Ultrafastの速さが活きにくくなるためです。
そのほか、覚えておきたい制約があります。
最初のレート制限(1分あたりのトークン数)は、Tier 1〜3が50万、Tier 4が100万、Tier 5が500万
処理の場所は、米国内のデータ保管と、グローバル処理だけ。EUなどの地域内の処理には対応しません
GPT-5.6 Solは、担当チーム経由のプレビューです

速さと費用を、同じ仕事で比べる
Ultrafastは生成するトークンを速く出すモードです。トークンはAIが文章を処理する単位で、日本語の文字数と常に一致するものではありません。1回の作業には、文章の生成に加え、サイトの読み込みやテストの実行なども含まれるので、作業全体が必ず8分の1の時間になるという意味ではありません。
比較するなら、同じ依頼と同じ資料で標準モードとUltrafastを試し、生成を待つ時間、作業の完了までの時間、手直しの量、課金を分けて記録します。短い生成を何度も繰り返す作業は、長い外部処理が多い作業と結果が違う可能性があります。
発表時のAPI最大6倍という説明とは別に、2026年10月2日のAPIガイドは最大8倍と記載しています。倍率の対象は生成速度です。Codexで含まれる利用枠は標準の8倍、購入クレジットは6倍で扱われ、APIキー利用はAPIの料金表で計算します。
| 項目 | 意味 |
|---|---|
| 生成速度 | 回答のトークンが出る速さ |
| 全体の時間 | 資料取得・ツール実行・確認を含めた時間 |
| 利用量 | 含まれる枠、購入クレジット、APIの別 |
| 成果物 | 正確さ、手直し、必要なテストの結果 |
GPT-6 Astraの標準料金とUltrafast料金を比較する
2026年10月2日に確認した料金表では、GPT-6 Astraの短いコンテキストの入力は100万トークンあたり標準10米ドル・Ultrafast60米ドル、出力は標準50米ドル・Ultrafast300米ドルです。短いコンテキストとは、1回のリクエストの入力が272Kトークン以下の区分を指します。
例えば、短いコンテキストのリクエストを何回か行い、合計の入力100万トークン・出力10万トークンを使った場合、キャッシュなしなら標準で10+5=15米ドル、Ultrafastで60+30=90米ドルです。
この例では6倍のAPI費用です。長いコンテキストやキャッシュの扱いは、対応する列で別に計算します。
APIのトークン料金は、Proの月額や含まれる利用枠とは別の課金です。「生成速度が最大8倍」と「この例のAPI費用が6倍」は、異なる項目を示しています。実際に完了した成果物と費用を記録し、短縮できた時間に見合うかを判断してください。
| 対象 | 標準 | Ultrafast |
|---|---|---|
| 入力 | 10米ドル | 60米ドル |
| キャッシュ入力 | 1米ドル | 6米ドル |
| キャッシュ書き込み | 12.50米ドル | 75米ドル |
| 出力 | 50米ドル | 300米ドル |
よくある疑問を、ここで。
使い始める前に、気になるところから。
速度の8倍と、利用枠の8倍は同じ意味ですか?
別の数字です。生成速度、含まれる利用枠の消費、購入クレジットの課金、API単価を区別して確認します。仕事全体の時間も同じ割合で短くなるとは限りません。
APIではどのモデルにUltrafastを指定しますか?
2026年10月2日に確認したガイドではGPT-6 Astraが案内されています。GPT-6.1 Solについては今後の提供予定と分けて確認し、現在対応するモデルIDを使います。
この記事を共有する
商品情報の提供:Supported by Rakuten Developers
出典と、この記事について
公式資料や、記事で参照した発表・報道をまとめています。仕様や料金は、利用する前に最新の案内をご確認ください。
- OpenAI公式:Ultrafastの速度と課金(新しいタブで開きます)
- OpenAI「DevDay 2026 の振り返り」(新しいタブで開きます)
- OpenAI公式:速度設定と利用量(新しいタブで開きます)
- OpenAI公式:API料金表(新しいタブで開きます)
- help.openai.com: 9793128-about-chatgpt-pro-tiers(新しいタブで開きます)
- Dukeの元のニュース解説(新しいタブで開きます)
確認した内容と条件は本文に記載しています。結果や使い勝手は、資料や環境によって異なります。編集方針を読む


ぜひコメントください