半年前に受け取った見積書を開いてみてください。AI機能を組み込んだシステムなら、「AI利用料(月額概算)」という行があるはずです。その金額を、いまの単価で計算し直すと数分の1になっている可能性があります。
嬉しい話に見えますが、実務上の含意は別です。ランニング費用の前提が半年で動くということは、稟議を通した根拠も、投資回収の計算も、同じ速さで古くなるということだからです。
2026年7月30日に何が変わったか
OpenAI は GPT-5.6 ファミリーの価格を改定しました。中位モデルの Terra が20%、小型モデルの Luna が80%の値下げです(OpenAI drops GPT-5.6 Luna and Terra API prices by up to 80% — InfoWorld)。
| モデル | 改定前(100万トークンあたり) | 改定後 |
|---|---|---|
| GPT-5.6 Luna | 入力 $1 / 出力 $6 | 入力 $0.20 / 出力 $1.20 |
| GPT-5.6 Terra | 入力 $2.50 / 出力 $15 | 入力 $2 / 出力 $12 |
あわせて、上位モデル Sol に「高速モード」が追加されました。こちらは通常価格の2倍(入力 $10 / 出力 $60)で、モデルの賢さは変わらないまま処理速度が最大2.5倍になるという位置づけです(Advancing the price-performance frontier with GPT-5.6 — OpenAI)。
小型モデルが5分の1になった一方、速さには追加でお金を払う仕組みが用意された。値段が一律に下がったのではなく、選択肢の軸が増えたと読むのが正確です。
「安くなったから安心」で終わらせない
発注側がここで確認すべきことは3つあります。どれも見積書の読み方に直結します。
1つ目は、出力側の単価です。 表を見ると、どのモデルも出力の単価が入力の6倍前後に設定されています。この構造は値下げ後も変わっていません。つまり、長い文章を生成させる機能ほど費用が効くということです。社内文書の要約(入力が長く出力が短い)と、提案書の下書き生成(入力は短く出力が長い)では、同じ「AI機能」でも費用の出方が逆になります。見積書に「AI利用料」と一行でまとめられている場合、どちらの想定かを聞いてください。
2つ目は、どのモデルを前提にした金額かです。 同じ機能でも、Luna で組むか Sol で組むかで単価は数十倍変わります。見積書にモデル名が書かれていなければ、その金額は検証できません。
3つ目は、値下げが自社に反映されるかです。 受託開発の契約では、AI利用料を「実費+管理費」で精算する形と、月額固定に含める形があります。後者の場合、単価が下がっても請求額は下がりません。 良し悪しの話ではなく、契約時にどちらか決めておくべき話です。CI費用が保守費に転嫁されていた例と構造は同じで、保守費の値上げ理由が「CI費用の高騰」だったで扱った確認の仕方がそのまま使えます。

安いモデルに寄せると、かえって増えることがある
「Luna が5分の1になったなら、全部 Luna にすればいい」という判断は、しばしば裏目に出ます。
理由は再実行です。求める品質に届かないと、人間が指示を書き直して再度実行することになります。1回あたりの単価が5分の1でも、3回やり直せば実質は3倍です。加えて、確認と手戻りにかかる人の時間は単価表に載りません。
判断の順序としては、こうなります。
- その処理に求める正確さの水準を先に決める。 誤りが混じっても人が直せる作業か、そのまま外部に出る作業か
- 人が直せる作業なら小型モデルを試す。 要約、分類、下書きの叩き台はここに入ることが多い
- 外部に出るもの、判断に使うものは上位モデルを前提に見積もる
- 決めたあと、実際の再実行率を測る。 想定より高ければモデル選択が間違っている
4番まで回してはじめて、単価表の数字と実際の費用が結びつきます。モデルの世代が変わったときの採用判断の観点はGPT-5.5公開 — 受託案件で採用判断するときの4つの観点に整理しており、考え方はそのまま使えます。
高速モードにお金を払う価値があるかは、業務側で決まる
Sol の高速モードは、賢さではなく速さに対して2倍を払う仕組みです。技術的な判断に見えますが、実際は業務要件の話です。
利用者が画面の前で待っている処理なら、速さは体験そのものです。問い合わせフォームの自動応答や、営業が商談中に叩く検索は、遅ければ使われなくなります。
一方、夜間にまとめて処理するバッチや、後で結果を見に来るタイプの機能では、速さに追加費用を払う理由がありません。同じシステムの中でも、機能ごとに答えが違います。 「速いほうがいいですか」と聞かれて反射的に頷くと、待つ必要のない処理まで2倍の単価で回ることになります。
見積もりを開く前に、1つだけ数える
やることは1つです。直近3か月で、AI機能が実際にどれだけ使われたかを確認してください。
呼び出し回数と、おおよその入力・出力の量。委託先に運用を任せている場合でも、この数字は必ず出せます。出せないと言われたら、それ自体が確認すべき点です。
実測が手元にあれば、単価改定のニュースが自社にいくら効くのかを、その場で計算できます。逆にこれが無いと、値下げのたびに「安くなったらしい」で終わり、契約も見積もりも動きません。動くのは、数字を持っている側だけです。
AI機能を含むシステムの費用構造を整理したい、既存の契約が単価改定を反映できる形になっているか確認したい——そうしたご相談は、グリームハブの開発・AI・自動化のご相談で承っています。要件によって最適な構成は変わるため、個別にお見積りします。お問い合わせからご相談ください。
Sources
- Advancing the price-performance frontier with GPT-5.6 — OpenAI
- How GPT-5.6 fuses frontier intelligence with frontier efficiency — OpenAI
- OpenAI drops GPT-5.6 Luna and Terra API prices by up to 80% — InfoWorld
- OpenAI Cuts GPT-5.6 Luna API Prices by 80%, Terra 20% — eWeek
- OpenAI、GPT-5.6 Luna、Terraの利用料金を引き下げ — gihyo.jp