この記事には楽天アフィリエイトの広告を含みます。 Amazonのアソシエイトとして、PROBEFOLIOは適格販売により収入を得ています。
GPT-6 SolのAPI料金は、100万トークンあたり入力2ドル・出力10ドルです。キャッシュから読み込んだ入力は0.20ドルで、通常の入力の9割引きになります。前の世代GPT-5.6 Solの割引価格(入力4ドル・出力20ドル)から半額です。
この記事では、2026年9月23日にOpenAIの公式料金ページ・モデル情報・発表を確認し、料金表、「半額」の意味、キャッシュ、長い入力の割増、割引と割増の設定、3つの計算例の順に整理します。計算は公式の定価で行い、為替や税は含みません。
トークンはAIが文章を処理する単位です。APIの料金は、AIに渡す文章(入力)と返ってくる文章(出力)のトークン数で決まります。
この記事の目次
結論:入力2ドル・出力10ドル、キャッシュ入力は0.20ドル
GPT-6 Solの料金は、この節の最後の表のとおりです。出力の単価は入力の5倍なので、長い回答を大量に作る仕事ほど費用が増えます。
為替を1ドル=150円と仮定すると、入力100万トークンで約300円、出力100万トークンで約1,500円です。実際の請求は為替・税・支払い方法で変わります。
| 項目 | 料金 |
|---|---|
| 入力 | 2ドル |
| キャッシュから読み込んだ入力 | 0.20ドル(9割引き) |
| キャッシュへの書き込み | 2.50ドル(入力の1.25倍) |
| 出力 | 10ドル |
| 1回の入力が27万2,000トークン超 | 入力4ドル・出力15ドル(リクエスト全体) |
| Batch・Flex | 半額(入力1ドル・出力5ドル) |
料金表:Sol・Luna・Astraを比べる
GPT-6シリーズの3モデルを並べると、SolはAstraの5分の1、LunaはSolの20分の1の単価です。
長い入力(27万2,000トークン超)の料金は、3モデルとも入力とキャッシュが2倍、出力が1.5倍になります。
出力100万トークンの料金(標準・短い入力)
- GPT-6 Astra
最上位モデル
- GPT-6 Sol
主力モデル
- GPT-6 Luna
最も安いモデル
Solの出力はAstraの5分の1、Lunaの出力はSolの20分の1です。Lunaは棒がほとんど見えないほど安いモデルです。
| モデル | 入力 | キャッシュ入力 | 出力 | 長い入力(入力/出力) |
|---|---|---|---|---|
| GPT-6 Astra | 10 | 1 | 50 | 20 / 75 |
| GPT-6 Sol | 2 | 0.20 | 10 | 4 / 15 |
| GPT-6 Luna | 0.10 | 0.01 | 0.50 | 0.20 / 0.75 |
「半額」はGPT-5.6 Solの割引価格との比較
公式発表の「50%安い」は、GPT-5.6 Solの割引価格(入力4ドル・出力20ドル)との比較です。GPT-6 Lunaは、GPT-5.6 Luna(入力0.20ドル・出力1.20ドル)から入力が半分、出力は約58%下がりました。
OpenAIの料金ページには、GPT-5.6 Solの割引価格は少なくとも2026年11月21日まで続くと書かれています。GPT-5.6 Solを使い続けている場合も、同じ作業ならGPT-6 Solのほうが単価は半分です。
OpenAIは値下げの理由を、キャッシュと推論(AIが答えを出す処理)を効率化して低い費用で動かせるようになった分を、利用者へ還元するためと説明しています。
キャッシュ9割引きの仕組みと、効かせるコツ
キャッシュとは、一度読み込んだ文章を覚えておき、次に同じ部分を使うときに読み直しを省く仕組みです。長い指示書や資料を毎回渡すAIエージェントほど、効果が大きくなります。
GPT-6では、キャッシュが当たる割合が標準で高くなりました。キャッシュから読み込んだ入力は通常の入力の10%(Solなら0.20ドル)です。一方、キャッシュへの書き込みは通常の入力の1.25倍(Solなら2.50ドル)かかります。
キャッシュは、文章の先頭から同じ部分に当たります。毎回変わる内容(日付や質問)は後ろに置き、変わらない指示書や資料を先頭に置くと当たりやすくなります。
開発者向けの改善も発表されました。キャッシュの状況を見られるダッシュボードと、キャッシュが効かなかった理由を調べる診断ツールが用意され、会話の途中で考える量やツールの有無を変えてもキャッシュが保たれるようになっています。キャッシュする範囲の終わりを自分で指定することもできます。GitHubは、こうした改善で新たに処理し直す入力の割合が50%以上減ったと報告しています。
- 毎回同じ指示書・資料は、依頼文の先頭に置く
- 日付や質問など毎回変わる部分は、後ろに置く
- 途中で考える量を変えるときは、先頭の文章を書き換えない方法(configuration_update)を使う
- ダッシュボードでキャッシュに当たった割合を確認する
27万2,000トークンを超えると、リクエスト全体が割高になる
1回の入力が27万2,000トークンを超えると、そのリクエスト全体で、入力とキャッシュの単価が2倍、出力が1.5倍になります。超えた分だけではなく、リクエスト全体に適用される点に注意してください。
たとえば、入力30万トークン・出力1万トークンのリクエストは、入力1.20ドル+出力0.15ドルで1.35ドルです。入力を27万トークンに収めれば、入力0.54ドル+出力0.10ドルで0.64ドルになり、半分以下で済みます。
長い資料は、必要な部分だけに絞るか、章ごとに分けて渡すと割増を避けられます。ただし、分けると全体を見渡した判断が難しくなるので、仕事の内容に合わせて選んでください。
| 入力の長さ | 費用 | ポイント |
|---|---|---|
| 27万トークン | 0.64ドル | 標準料金 |
| 30万トークン | 1.35ドル | 全体に割増(入力2倍・出力1.5倍) |
| 50万トークン(出力5,000) | 2.075ドル | 同じ条件のClaude Opus 5.5(2.10ドル)とほぼ同じ |
Batch・Flex・Fast mode・地域の指定で変わる料金
結果をすぐに受け取らなくてよい処理は、BatchかFlexを使うと標準料金の半額になります。反対に、速さを優先するFast mode(以前のPriority processing)は2倍です。
データを特定の地域で処理する指定(データレジデンシー)をすると、対象のモデルでは10%上乗せになります。EUのデータレジデンシーは、標準処理でのみ使えます。
| 処理方法 | 入力 | 出力 | 向いている使い方 |
|---|---|---|---|
| 標準 | 2ドル | 10ドル | 普段の利用 |
| Batch・Flex | 1ドル | 5ドル | すぐに結果が要らない大量処理 |
| Fast mode | 4ドル | 20ドル | 応答の速さを優先したい場面 |
| 地域の指定 | 2.2ドル | 11ドル | データの処理地域を決めたい場合 |
計算例:3つの使い方でSol・Luna・Astraを比べる
3つの使い方で、1か月または1回の作業の費用を計算しました(2026年9月23日の定価、標準処理)。
例1:チャットボット。1日1,000回、1回あたり入力1,500・出力500トークンを30日続けると、Solは月240ドル、Lunaは月12ドル、Astraは月1,200ドルです。
例2:同じ資料を使いながら30回やり取りする。10万トークンの資料を最初にキャッシュへ書き込み、残り29回は読み込み、毎回の新しい入力5,000・出力2,000トークンで、Solは1.73ドルです。キャッシュを使わずに毎回10万5,000トークンを入力すると6.90ドルになり、約4分の1で済みます。
例3:入力100万・出力10万トークンの作業(1回の入力は27万2,000トークン以下に分けた場合)。Solは3ドル、Lunaは0.15ドル、Astraは15ドルです。
| 使い方 | GPT-6 Sol | GPT-6 Luna | GPT-6 Astra |
|---|---|---|---|
| 例1:チャットボット1か月(3万回) | 240 | 12 | 1,200 |
| 例2:資料10万をキャッシュして30回 | 1.73 | 0.09 | 8.65 |
| 例3:入力100万・出力10万 | 3.00 | 0.15 | 15.00 |
ChatGPTのプランで使う場合は、API料金とは別
ChatGPTのWorkやCodexでGPT-6 Solを使う場合、トークンごとの請求ではなく、プランに含まれる利用枠から消費されます。WorkはCodexと同じ利用枠の仕組みで、枠を使い切った後はクレジットを追加できるプランもあります。
CodexにChatGPTのアカウントでサインインすると、プランの利用枠と支払いが使われます。自分のAPIキーでサインインした場合は、この記事のAPI料金で課金されます。
2026年9月23日にChatGPT Web版のWorkでモデル一覧を開くと、考える量を上げたときに「利用枠の消費が早くなります」と表示されていました。利用枠が足りなくなったときの見直しは、GPT-6の利用枠が足りない?で解説しています。
使いすぎを防ぐ確認
APIの費用は、使い始めてから気づくことが多いものです。最初に上限と通知を決めておくと、想定外の請求を防げます。使用量と請求の確認方法はChatGPT APIの料金を確認する方法で、トークンを節約する設定はGPT-6 Astraのトークン節約で解説しています。
- API管理画面で、月の利用額の上限と通知を設定する
- 同じ作業を数回試し、入力・出力・キャッシュのトークン数を記録する
- 1回の入力が27万2,000トークンを超えていないか確かめる
- 急がない処理はBatchかFlexに回す
- 単純な作業は、Lunaや考える量「none」で足りるか試す
よくある疑問を、ここで。
使い始める前に、気になるところから。
GPT-6 SolのAPI料金はいくらですか?
100万トークンあたり入力2ドル・出力10ドルです。キャッシュから読み込んだ入力は0.20ドル、キャッシュへの書き込みは2.50ドルです(2026年9月23日確認)。
「半額」は何と比べて半額なのですか?
GPT-5.6 Solの割引価格(入力4ドル・出力20ドル)と比べて半額です。GPT-5.6 Solの割引価格は、少なくとも2026年11月21日まで続くと案内されています。
長い資料を読ませると料金は上がりますか?
1回の入力が27万2,000トークンを超えると、そのリクエスト全体で入力とキャッシュが2倍、出力が1.5倍になります。超えた部分だけではない点に注意してください。
ChatGPT Plusで使う場合もAPI料金がかかりますか?
かかりません。ChatGPTのWorkやCodexでは、プランの利用枠から消費されます。CodexでAPIキーを使ってサインインした場合は、API料金で課金されます。
この記事を共有する
商品情報の提供:Supported by Rakuten Developers
出典と、この記事について
公式資料や、記事で参照した発表・報道をまとめています。仕様や料金は、利用する前に最新の案内をご確認ください。
- OpenAI API:GPT-6 Sol(新しいタブで開きます)
- OpenAI API:GPT-6 Luna(新しいタブで開きます)
- OpenAI API:Pricing(新しいタブで開きます)
- OpenAI:Introducing GPT-6 Sol and Luna(2026年9月22日)(新しいタブで開きます)
- OpenAI API:Model guidance(GPT-6)(新しいタブで開きます)
- OpenAI Help Center:ChatGPT Work and Codex(新しいタブで開きます)
- Claude Platform Docs:Pricing(新しいタブで開きます)
- 画面の出典:ChatGPT Web版(2026年9月23日に確認)(新しいタブで開きます)
確認した内容と条件は本文に記載しています。結果や使い勝手は、資料や環境によって異なります。編集方針を読む



ぜひコメントください