トレンド調べる更新 2026-09-04
GPT-6 Astraの値札は入力$10・出力$50。272Kを超えると全体が割増になる
OpenAIが米国時間2026年9月3日に最上位モデル「GPT-6 Astra」を公開しました。報道の見出しはベンチマークの数字ですが、請求に効くのは値札のほうです。API単価は100万トークンあたり入力$10・出力$50で、これは当サイトが料金データとして持っているGPT-5.6 solの2.5倍にあたります。さらに公式モデルページには、入力が272,000トークンを超えるとリクエスト全体が割増になると書かれています。この記事では公式ページの原文で確認できた単価と条件だけを並べ、いまのモデルから乗せ替えると月額がどう動くかを整理します。
この記事が役に立つ人
- GPT-5.6 solをAPIで使っていて、上位モデルへの乗せ替えを検討している人。単価が2.5倍になるので、影響額を先に出す必要があります
- 長いコンテキストを投げる実装をしている人(RAG、長いコードベース、大きなドキュメント)。割増の境目に一番近い位置にいます
- 経営やクライアントにAIコストの見通しを出す立場の人
当てはまらない人
- ChatGPTの定額プランだけで使っている人。この記事はAPIのトークン課金の話です
- いまのモデルで精度が足りている人。上位モデルに替える理由がなければ単価は関係しません
- OpenAI以外のモデルだけを使っている人
- 今日すぐ使いたい人。後述のとおり、2026年9月4日時点では一般提供が始まっていません
単価は入力$10・出力$50。掲載中で最も高い出力単価に並んだ
まず値札を正確に押さえます。ベンチマークの話は他所にいくらでもあるので、ここでは金額だけを見ます。
| 項目(100万トークンあたり) | GPT-5.6 sol | GPT-6 Astra |
|---|---|---|
| 入力 | $4 | $10(2.5倍) |
| 出力 | $20 | $50(2.5倍) |
| キャッシュ読み取り | $0.4 | $1 |
| キャッシュ書き込み | 料金データに項目なし | $12.5 |
出力$50という水準は、当サイトが掲載しているモデルのなかで最も高い出力単価(Claude Fable 5の$50)と同じです。「最上位モデルの相場」がこの価格帯にそろったと読むのが素直なところです。
出力単価の安い順 — 料金データから自動更新(1ドル154.25円で換算)
参考までに、当サイトの料金データで出力単価の安い順に並べたもの(GPT-6 Astraはデータ反映前)
| モデル | 提供元 | 入力 | 出力 |
|---|---|---|---|
| GPT-5.6 luna | OpenAI (GPT) | 31円 | 185円 |
| GPT-5.4 nano | OpenAI (GPT) | 31円 | 193円 |
| GPT-5.4 mini | OpenAI (GPT) | 116円 | 694円 |
| Claude Haiku 4.5 | Anthropic (Claude) | 154円 | 771円 |
| Gemini 3.6 Flash | Google (Gemini) | 231円 | 1,157円 |
| Gemini 3.5 Flash | Google (Gemini) | 231円 | 1,388円 |
単位は100万トークンあたり。日本語は英語より多くトークンを消費するため、同じ文章量でも請求は上振れします。
キャッシュ読み取りは入力の10分の1で、当サイト掲載中の他モデル(いずれも10分の1)と同じ相場です。先日のClaude Fable 5.1のように、キャッシュ読み取りだけを大きく引き下げる形にはなっていません。
入力が272,000トークンを超えると、リクエスト全体が割増になる
ここが見落とされやすい部分です。公式モデルページには、単価表のすぐ下に条件が書かれています。
Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request.
— OpenAI公式モデルページ(GPT-6 Astra)の原文
読みどころは末尾の「for the full request」です。超えた分だけが割増になるのではなく、そのリクエスト全体に割増が適用されると書かれています。272,000トークンを1つでも超えれば、そのリクエストの入力は$20、出力は$75の扱いになる、という意味です。
同じページには、コンテキストウィンドウが1,050,000トークン、最大出力が128,000トークンとも書かれています。つまり「105万トークン入る」という売り文句の範囲のうち、272,000トークンから先は別料金です。長いコンテキストを前提に設計すると、単価表の$10を見て立てた見積もりから外れます。
| 月のワークロード | GPT-5.6 sol | GPT-6 Astra(標準) | GPT-6 Astra(全リクエストが272K超) |
|---|---|---|---|
| 入力5,000万トークン・出力500万トークン | 46,275円 | 115,688円 | 212,094円 |
同じ仕事をGPT-5.6 solからGPT-6 Astraに移すと、この置き方では月69,413円増えます。全リクエストが割増の条件に入ると、そこからさらに月96,406円乗ります。単価が2.5倍だから請求も2.5倍、で終わらないのはこの条件があるためです。
自分のワークロードで入力の長さとリクエスト数を入れると、モデル別の月額が出ます。まず、いま使っているモデルでいくらかかっているかを確定させてください。乗せ替えの判断はその差分を見てからです。
自分のワークロードで月額を計算するLLM API料金計算機・入力3つ・無料
安くする手段も同じページに書いてある
割増の条件だけを書くのは公平でないので、下げる側の記載も並べます。いずれも公式モデルページの原文にあるものです。
- BatchとFlexは標準の50%。原文は「Batch and Flex are priced at 50% of Standard rates.」です。即時の応答が要らない処理(夜間のバッチ、まとめて回す評価)をこちらに寄せると、上の例では月57,844円になります
- Fast modeは標準の2倍。原文は「Fast mode is priced at 2x the applicable rates.」です。同じ例で月231,375円になります。速度を買う機能なので、使うなら対象を絞る前提になります
- キャッシュ書き込みは入力の1.25倍。原文は「Cache writes are billed at 1.25x the uncached input token rate.」です。キャッシュは読むときに安くなる代わりに、書くときに割増がかかります。使い回さない文脈をキャッシュすると逆効果です
- `reasoning.effort` に `low` から `max` までの5段階がある。原文は「`reasoning.effort` supports `low`, `medium`, `high`, `xhigh`, and `max`.」です。思考にかかるトークンは出力側で課金されるため、ここの設定は請求に直接効きます
上の金額は、記事中の同じワークロード(入力・出力とも同量)をそのまま各条件に置き換えたものです。実際にはBatchに寄せられる処理とそうでない処理が混在するので、内訳を分けて計算する必要があります。
2026年9月4日時点では、まだ誰でも使えるわけではない
単価が分かっても、いますぐ切り替えられるとは限りません。提供状況についても公式ページに記載があります。
GPT-6 Astra is rolling out today for enterprises in our Trusted Access Program, with access through API and our Plus, Pro, Business and Enterprise plans coming in the coming days.
— OpenAI公式モデルページ(GPT-6 Astra)の原文
先行して使えるのは審査を通った組織で、APIと各プランへの展開は「数日以内」とされています。予算の組み替えを先にやっても、動かせるのはもう少し先という順序になります。
国内報道では、AWS(Amazon Bedrock)経由でも利用可能になるとされています。ただし提供チャネルごとの単価や課金条件までは公式モデルページに書かれていないため、Bedrock側の金額は別途そちらの公式ページで確認する必要があります。この記事では確認できていないので、金額は書きません。
最適セレクトの管理人の判断(料金以外は意見です)
私の考えでは、この発表で最初にやるべきは乗せ替えではなく、いまの請求の内訳を長さで分けることです。Astraの単価はGPT-5.6 solの2.5倍ですが、本当に効くのは272,000トークンの境目のほうで、ここを跨ぐリクエストが何割あるかで請求の伸び方が変わります。ここは意見ですが、「最上位モデルに全部載せ替える」は、ほとんどの実装で費用対効果が合わないと思います。難しい仕事だけをAstraに振り、残りは今のモデルに置いたままにする。そのうえで、即時性の要らない処理をBatchに逃がす。この順番で十分に効きます。ベンチマークの数字は乗り換えの理由になりますが、それは「その精度が要る仕事があるか」の話であって、全リクエストの話ではありません。
まとめ
- 米国時間2026年9月3日、OpenAIが最上位モデル「GPT-6 Astra」を公開した。API単価は入力$10・出力$50(100万トークンあたり)
- GPT-5.6 solと比べると入力・出力とも2.5倍。出力単価は当サイト掲載中で最も高い水準(Claude Fable 5)に並んだ
- 入力が272,000トークンを超えるリクエストは、入力とキャッシュが2倍・出力が1.5倍。超えた分だけでなくリクエスト全体に適用される
- キャッシュ読み取りは入力の10分の1で、他モデルと同じ相場。キャッシュ書き込みは入力の1.25倍
- Batch・Flexは標準の50%、Fast modeは2倍
- 2026年9月4日時点では審査を通った組織への先行提供のみで、APIと各プランは「数日以内」とされている
入力の長さ・出力の長さ・リクエスト数を入れると、モデル別の月額と内訳が出ます。272,000トークンを跨ぐリクエストがあるかどうかを、入力の長さのところで確かめてください。
モデル別の月額と内訳を計算するLLM API料金計算機・入力3つ・無料
出典
- OpenAI「GPT-6 Astra Model」(API公式モデルページ)確認 2026-09-04
- OpenAI「Pricing」(API公式料金ページ)確認 2026-09-04
- PC Watch「AGI能力テストで99.9%、ChatGPTの新モデル「GPT-6 Astra」登場」(2026年9月4日)確認 2026-09-04