新しいモデルが出たときに最初に届くのは、性能の話よりお金の話です。ご相談でも「結局いくらかかるんですか」と聞かれます。
GPT-6 Astraの料金は、単価そのものより「どこで上がるか」を知っているかで、月末の請求が変わります。速い設定にするだけで倍になる仕組みが入っているためです。
この記事はOpenAIの公式資料だけを見て、2026年9月6日時点の内容で整理しています。価格は変わるものなので、契約の前にはご自身でも確認してください。
先にまとめ
ChatGPTの画面から使うなら、FreeとGoでは出てきません。Plus以上で開きます。APIで使う場合は100万トークンあたり入力10ドル・出力50ドルです。
上がる条件は3つ、下げる条件は2つあります。同じ作業をいちばん軽いモデルに回した場合と比べると、後半の試算では40倍以上の開きが出ました(2026年9月6日時点)。
使えるかどうかは、契約しているプランで決まる
最初に見るのはここです。ChatGPTの料金ページにあるプラン比較表では、FreeとGoはGPT-6 Astraが「なし」と書かれています。無料のまま試すことはできません。
Plusでは使えます。Proは「拡大」と書かれていて、利用量が5倍または20倍、Pro向けの推論も同じAstraで動くという説明です。BusinessとEnterpriseは別枠の契約になります。
つまり、社内の何人が触るかによって、月額の合計はプランの人数分で決まります。ここまでは分かりやすい話です。
現場では、全員を同じプランに上げる必要はないと見ています。判断の重い仕事を持っている人だけ上のプランにして、他は下のままにする形でも回ります。
誰が上のプランを持つのかを決めずに人数分だけ契約すると、使われないまま毎月払い続けることになります。ここは最初に決めておくところだとお伝えしています。
分かりにくくなるのは、APIを使うときです。こちらは月額ではなく、送った文字と返ってきた文字の量で請求されます。ChatGPTの契約とは別勘定になります。
ご相談の場面では、この2つが混ざったまま話が進むことが多いです。担当していて、最初に切り分けるようにしているのはここだとお伝えしています。
マメ
うちはPlusを3人分だけ払っています。APIの単価まで見る意味はありますか。
ホク
画面から人が使っているうちは関係ありません。見る意味が出るのは、自社の仕組みに組み込んで、人が見ていない時間にも動かすときです。
マメ
たとえば、うちの5人だとどんな作業が当てはまりますか。
ホク
問い合わせの一次返信の下書き、日報の要約、見積書の読み取りのように、月の件数が読める作業です。件数と単価が分かれば、月額を先に計算できます。
APIの単価は、短い文脈で入力10ドル・出力50ドル
単位はトークンです。日本語ではおおむね1文字が1トークン前後になると見ておくと、量の見当がつきます。表の数字はすべて100万トークンあたりの金額です。
同じモデルでも、使い方を変えると単価が変わります。公式の料金表から、実際に選ぶことになる行だけを並べました。
見方は単純で、送った分が入力、返ってきた分が出力です。長い資料を読ませる作業は入力が膨らみ、長い文章を書かせる作業は出力が膨らみます。
自社の見当をつけるときは、1件あたりの入力と出力をざっくり置いて、月の件数を掛けるだけで足ります。細かい精度より、桁を間違えないことのほうが大事です。
| 使い方 | 入力 | 出力 | 読み直し(キャッシュ) |
|---|---|---|---|
| そのまま使う | 10.00ドル | 50.00ドル | 1.00ドル |
| 速い設定にする | 20.00ドル | 100.00ドル | 2.00ドル |
| まとめて後で受け取る | 5.00ドル | 25.00ドル | 0.50ドル |
| 272,000トークンを超える | 20.00ドル | 75.00ドル | 2.00ドル |
扱える分量は105万トークンまで、1回の返答は最大12万8千トークンまでと書かれています。学習に使われた知識は2026年4月30日までです。それより後の出来事は、こちらから資料を渡す必要があります。
請求が上がる条件と、下げる条件
上がる条件は3つあります。1つめは速い設定です。返答を優先して受け取る代わりに、入力も出力もそのまま倍額になります。
2つめは長い資料です。入力が272,000トークンを超えると、その請求全体が上の割増側へ切り替わります。日本語だと、本の3分の1から半分ほどの分量が目安です。
超えた分だけが高くなるのではなく、その回の請求がまとめて上がる形です。資料を全部まとめて渡す使い方をしていると、ここに当たりやすくなります。
この長い資料の扱いは他社との差が出るところで、Claude Fable 5.1と比べた記事で詳しく書いています。ここでは触れるだけにします。
3つめは、読み直し用にいったん覚えさせるときの費用です。100万トークンあたり12.50ドルで、そのまま入力するより高くつきます。
下げる条件は2つです。1つは、いま覚えさせた資料をもう一度参照するときで、1.00ドルまで下がります。同じ社内規程を何度も読ませる使い方ほど効きます。
もう1つは、すぐ返答が要らない作業をまとめて投げる方法です。半額になります。夜のあいだに回しておく処理と相性がよいと見ています。
どの条件に当てはまるかは、業務の形で変わります。件数が少なくても1件が長い会社もあれば、短い依頼が一日中続く会社もあるためです(うちはどれに当てはまる?)。
自社の金額を、5分で見当づける
単価表だけ見ていても、自社がいくらになるかは出てきません。必要なのは3つの数字だけです。月の件数、1件で渡す文字数、1件で返させる文字数。この3つで桁は掴めます。
たとえば問い合わせの一次返信を下書きさせる場合を考えます。受け取ったメールが800字、参照させる社内資料が2,000字、返させる文章が600字とします。1件で入力2,800、出力600トークンほどです。
月200件なら、入力は56万トークン、出力は12万トークンになります。単価を掛けると、Astraでおよそ11.6ドル。この作業がひととおり回る金額としては、思ったより小さいはずです。
この程度の金額なら、先に止めるほどの話ではありません。逆に、同じ作業を1日500件流す会社なら桁が2つ上がります。件数を先に置く理由はここにあります。
実際にやってみると、前提はたいていずれます。渡す資料が思ったより長かった、返答が途中で切れて2回投げていた、といった形です。1週間流して測り直すほうが早いです。
当社でも、見積りの段階では粗い数字で置いて、動かしてから直しています。最初から精密に出そうとすると、そこで手が止まってしまうためです。
同じ作業を、全部Astraに渡さない
料金の話でいちばん効くのは、単価の交渉ではなく振り分けだと捉えています。同じ会社の中に、4つの価格帯のモデルが並んでいるためです。
下の表は、同じ作業を月400件流したと仮定した試算です。1件あたり入力3,000トークン・出力1,500トークンと置いています。実際の請求ではなく、前提を置いた計算だとご理解ください。
| モデル | 入力の単価 | 出力の単価 | 月400件の試算 |
|---|---|---|---|
| GPT-6 Astra | 10.00ドル | 50.00ドル | 42.00ドル |
| GPT-5.6 Sol | 4.00ドル | 20.00ドル | 16.80ドル |
| GPT-5.6 Terra | 2.00ドル | 12.00ドル | 9.60ドル |
| GPT-5.6 Luna | 0.20ドル | 1.20ドル | 0.96ドル |
いちばん上といちばん下で、43倍ほどの開きになります。件数が増えるほど、この差はそのまま月額に乗ります。
実際に見ていると、金額そのものより「どの作業をどこに置くか」を決めていない状態のほうが後で響きます。全部を上のモデルに通す設定のまま、件数だけが増えていく形になりやすいためです。
ただし安いほうに寄せればよい、という話でもありません。判断を間違えたときにやり直す手間は、人の時間で払うことになるためです。
実際に、下書きの品質が足りずに毎回書き直しているなら、安いモデルで浮いた金額はすぐ人件費で消えます。金額だけで決めない理由はここにあります。
逆に、人が最後に必ず目を通す前提の作業なら、上のモデルを使う理由は薄くなります。件数の多い作業ほど、この見直しが効いてきます。
i-Style では、難しい判断が要る工程だけを上のモデルに回し、それ以外は軽いモデルで足りると考えています。社内の利用そのものは月額の枠で回していて、従量課金は使っていません。
マメ
判断が要る工程って、どうやって見分けるんですか。
ホク
間違えたときに、誰かが謝ることになる工程です。見積りの金額、契約の条件、お客様への謝罪文。ここは上のモデルに回します。
マメ
逆に、軽いモデルで足りるのはどのあたりですか。
ホク
下書き、分類、要約のように、人が最後に目を通す前提の作業です。やり直しても謝る相手がいない工程、と言い換えてもいいと思います。
いま決めておくと、後で困らないこと
1つめは、画面から人が使うのか、仕組みに組み込むのかを先に決めることです。前者なら月額のプラン、後者なら従量課金で、見るべき数字がまったく変わります。
この2つは同時に進めても構いませんが、請求書は別々に届きます。どちらがいくらなのかを分けて見られる状態にしておくと、後から判断しやすくなります。
2つめは、速い設定を既定にしないことです。倍額になる設定なので、待てる作業では選ばない。ここは最初に決めておくと迷いません。
待てる作業かどうかは、人がその場で結果を見ているかどうかで分かれます。夜間にまとめて流す処理なら、速さを買う理由はほとんどありません。
3つめは、上限に当たったときの動きです。ChatGPT側では利用枠の考え方が公開直後に変わっていて、その経緯は利用枠とリセットの記事にまとめています。
何に使われているのかを先に知りたい場面では、海外の使われ方をまとめた記事もあわせてご覧ください。金額の判断は、使い道が決まってからのほうが早いです。
料金表は今後も動きます。当社でも新しい発表が出るたびに数字を見直していて、この記事も確認日を入れているのはそのためです。
発表直後の価格は、数日で条件が変わることが多いです。契約を決める前には、必ず公式の料金表をもう一度開いてから判断してください。
参考にしたソース
単価は OpenAI の API 料金表(developers.openai.com)、扱える分量と知識の期限はモデルの資料(gpt-6-astra)から取りました。
プランごとに使えるかどうかは、ChatGPT の料金ページ(openai.com/chatgpt/pricing)の比較表を見ています。いずれも2026年9月6日に確認しました。
i-Styleに相談する
単価表を見ても、自社だといくらになるかは作業の件数が分からないと出ません。i-Styleでは、いまある作業を書き出して、どこを上のモデルに任せるかを分けるところから一緒に整理しています。作業1つからで構いません。
お問い合わせページへ arrow_forwardそこまでではない、という段階なら、botに聞いて論点を整理するところからでも間に合います。