Grandream

Grandream

公開: 8 min read

OpenAI、GPT-5.6 Luna/Terraを値下げ+Sol「Fastモード」開始|旧Priorityから何が変わったか

OpenAI、GPT-5.6 Luna/Terraを値下げ+Sol「Fastモード」開始|旧Priorityから何が変わったか

OpenAIが2026年7月30日、GPT-5.6ファミリーのAPI価格を改定しました。下位2階層(Luna・Terra)を値下げし、同時に従来の「Priority処理(priority processing)」を 「Fastモード」 へ改称・条件変更しています。

発表の要点はシンプルです。

  • Luna を80%値下げ($1/$6 → $0.20/$1.20
  • Terra を20%値下げ($2.50/$15 → $2/$12
  • Sol の標準価格は据え置き($5/$30)
  • Fastモードは標準処理の 最大2.5倍の速度を、標準価格の2倍 で提供。知能(モデルの賢さ)は変わらない

GPT-5.6の一般提供開始は2026年7月9日でしたから、ファミリーが商用に出てわずか3週間での価格改定ということになります。

この記事では、値下げの中身に加えて、「Fastモードの倍率が、旧Priority処理から実質的に逆転している」 点と、同じ「Fastモード」という名前でCodex(サブスク)側とAPI側で数字がまったく違う という混同しやすいポイントを整理します。

1. 値下げの中身:Lunaが一気に5分の1へ

まず価格改定の全体像です(いずれも100万トークンあたり・標準処理・短コンテキスト時)。

階層

改定前 入力 / 出力

改定後 入力 / 出力

変化

GPT-5.6 Sol(フラッグシップ)

$5 / $30

$5 / $30

据え置き

GPT-5.6 Terra(バランス型)

$2.50 / $15

$2 / $12

▲20%

GPT-5.6 Luna(高速・低コスト型)

$1 / $6

$0.20 / $1.20

▲80%

インパクトが大きいのはLunaです。入力・出力とも一律で5分の1になり、大量処理帯の単価が桁の感覚ごと変わりました。OpenAI自身も、Lunaについて「1年前にフロンティア級とされたモデルに匹敵する性能を、1タスクあたり支払い1ドルにつき約6セント相当のコストで、かつ約9倍の速度で提供できる」という趣旨の説明をしています。

Terraの20%値下げは地味に見えますが、日常業務を量でこなす中位帯の単価が下がる意味は小さくありません。一方でフラッグシップのSolは据え置きで、「上位の値段は動かさず、下位の価格性能比を一気に引き上げる」 という構図です。

なお、この原資についてOpenAIは推論基盤側の効率改善を挙げています。GPUカーネルの書き直しによるコスト約20%削減、投機的デコーディング(speculative decoding)まわりの最適化によるトークン生成効率の約15%改善などで、これらの最適化作業自体にGPT-5.6 Sol を使ったとしています。値下げが「採算度外視の消耗戦」ではなく、効率改善の還元という建て付けになっている点は押さえておいてよいでしょう。

2. Fastモード:Priority処理の改称と、倍率の刷新

今回の発表でもうひとつの柱が Fastモード です。これは新機能というより、従来からAPIにあった「Priority処理」の名称と条件を刷新したもの です。

何が変わったか

項目

旧:Priority処理

新:Fastモード

名称

priority processing

Fast mode(2026年7月30日に改称)

APIパラメータ

service_tier: "priority"

service_tier: "fast""priority" も引き続き有効

速度

「標準より速く、より一貫している」(数値の公称なし)

標準処理の最大2.5倍

価格(GPT-5.6)

標準の2倍

知能

変化なし

変化なし

重要なのは 後方互換が保たれている ことです。すでに priority を指定しているリクエストは、コードを書き換えなくてもそのままFastモードへ振り分けられます。既存のインテグレーションを更新する必要はありません。

Fastモードの実額

Fastモードは全階層に適用され、いずれも標準の2倍です。

階層

標準 入力 / 出力

Fast 入力 / 出力

GPT-5.6 Sol

$5 / $30

$10 / $60

GPT-5.6 Terra

$2 / $12

$4 / $24

GPT-5.6 Luna

$0.20 / $1.20

$0.40 / $2.40

(参考)GPT-5.5

$5 / $30

$12.50 / $75

この表の最終行が、今回いちばん見落とされやすいポイントです。

3. 見落としやすい論点:価格倍率が2.5倍→2倍に下がっている

前世代のGPT-5.5では、Priority処理は 標準の2.5倍($12.50/$75 に対し標準 $5/$30)でした。それがGPT-5.6では 2倍 になっています。

つまり 速度優先オプションのプレミアムが、世代をまたいで2.5倍→2倍へ、実質20%引き下げられた わけです。しかも速度側は「最大2.5倍」という数値がはじめて明示されました。旧Priority処理は「標準より速く、ピーク時でも一貫した速度でトークンを生成する」という定性的な説明と、p50レイテンシのSLAで語られる仕組みで、倍率という形の数字は前面に出ていませんでした。

支払倍率と速度倍率の関係を並べると、性格の変化がはっきりします。

支払倍率

速度倍率

「速度1倍あたり」の支払

旧:GPT-5.5 Priority

2.5倍

非公称

評価不能

新:GPT-5.6 Fast

2倍

最大2.5倍

0.8倍

ここで注意したいのは、LLM APIはトークン課金であり、時間課金ではない という点です。速く終わっても支払うトークン数は変わりません。したがってFastモードの2倍は、純粋に 「待ち時間を金で買う」プレミアム です。「速くなったぶん安く済む」わけではありません。

そのうえで、公称値どおり最大2.5倍速が出る条件なら、支払2倍に対して時間は2.5分の1 になります。「時間あたりのコスト効率」で見れば、旧Priority処理より明確に割の良い設計へ寄せられた、という読み方ができます。

4. 「1.5倍速で2.5倍消費」の正体:Codex側のFastモードは別物

ここで、多くの人が引っかかるであろう点を整理します。

「Fastモードは 1.5倍の速度で、2.5倍のトークン(クレジット)消費 だったのでは?」という記憶を持っている方は、記憶違いではありません。ただし それはAPIの話ではなく、Codex(ChatGPTサブスクリプション枠)側のFastモード の数字です。

Codex CLI・IDE拡張・ChatGPTデスクトップアプリでChatGPTアカウントにサインインして使うFastモードの条件は、現在も次のとおりです。

速度

クレジット消費

GPT-5.6(Codex)

1.5倍

標準の2.5倍

GPT-5.5(Codex)

1.5倍

標準の2.5倍

GPT-5.4(Codex)

1.5倍

標準の2倍

CLIでは /fast on/fast off/fast status で切り替え・確認ができます。

そして今回のAPI側の改称は、まさにこの Codexの /fast と名前を揃えるため に行われたものです。名前は揃いましたが、中身の倍率はまったく別 である点に注意が必要です。

支払倍率

速度倍率

速度1倍あたりの支払

API Fastモード(GPT-5.6)

2倍

最大2.5倍

約0.8倍

Codex Fastモード(GPT-5.6)

クレジット2.5倍

1.5倍

約1.67倍

同じ「Fastモード」でありながら、速度単価で見ると 2倍以上の開き があります。名称統一によって「Codexで試したFastの感覚」をそのままAPIの見積もりに持ち込むと、コスト試算も速度期待も外れます。逆もまた然りです。

さらにもう一段ややこしいのは、CodexをAPIキーで使う場合はクレジット倍率が適用されず、APIのトークン価格で課金される 点です。同じCodexというツールを使っていても、認証方式(ChatGPTサブスク認証 か APIキー)によって、適用される倍率の体系がまるごと入れ替わります。社内で使い方が混在している組織では、ここが請求の説明を難しくする要因になります。

5. 実務で効いてくる、値付けのねじれ

改定後の価格表を素直に眺めると、階層とモードをまたいだ「逆転」がいくつか生まれています。

① Terra の Fast が、Sol の標準より安い

Terra Fast は $4/$24。Sol 標準の $5/$30 を下回ります。「もう一段賢いモデルに上げる」よりも「一段下のモデルを速く回す」ほうが安い、という選択肢が成立します。品質要件がTerraで足りている工程なら、Solへ上げる前にTerra+Fastを検討する価値があります。

② Luna の Fast が、値下げ前の Luna 標準より安い

Luna Fast は $0.40/$2.40。7月29日まで標準価格だった $1/$6 と比べて 約60%安い 計算です。7月上旬にLunaで大量処理を組み始めた現場は、7月30日以降、Fastへ切り替えてなお旧標準価格より大幅に安く 回せることになります。バッチ処理のレイテンシ改善を「追加コストなし」どころか「値下げ込みでプラス」に持ち込める、珍しいタイミングです。

③ 他の割引と併用できる

BatchおよびFlex処理は標準比50%割引、キャッシュ済み入力の読み取りも大幅割引が継続します。長コンテキスト帯は入力2倍・出力1.5倍の単価が適用されます。Fastモードは「速度を買う」レイヤーなので、まずはキャッシュ設計とBatch活用でトークン単価を下げ、そのうえで レイテンシがユーザー体験に直結する経路だけ Fastを当てる、という順序が費用対効果を出しやすいでしょう。

6. 導入時の注意点

実際に切り替える前に、押さえておきたい点を3つ挙げます。

「最大」2.5倍であって、保証値ではない。 公称は "up to 2.5×" です。実際の改善幅は負荷状況・リクエスト内容・出力長で変動します。切り替え前後で、自社のワークロードのp50・p95レイテンシを実測してから本採用を判断してください。支払いは確実に2倍になる一方、速度改善は変動する、という非対称性があります。

知能は変わらない。 OpenAIは明示的に「知能に変更はない」としています。品質が足りない問題をFastモードで解決することはできません。品質はモデル階層(Sol/Terra/Luna)と推論設定で、速度はFastモードで、という切り分けを崩さないことです。

課金体系の混在に注意。 前述のとおり、API・Codexサブスク・CodexのAPIキー利用で倍率体系が異なります。チームで利用形態が混ざっている場合は、「どの経路のFastの話をしているのか」を必ず明示してから見積もりを共有してください。

7. まとめ

  • OpenAIは2026年7月30日、GPT-5.6 Lunaを80%・Terraを20%値下げ。Solの標準価格は据え置き。
  • APIの Priority処理は「Fastモード」へ改称service_tier"fast""priority" どちらも有効で、既存コードの変更は不要
  • Fastモードは 標準の最大2.5倍の速度を、標準価格の2倍 で提供。知能は変わらない
  • 前世代GPT-5.5のPriority処理は 2.5倍価格 だったため、速度優先オプションのプレミアムは実質引き下げ られている。
  • 一方、Codex(サブスク枠)のFastモードは1.5倍速・クレジット2.5倍消費 のままで、名前は同じでも倍率は別物。混同するとコスト試算を外す。
  • 価格改定の結果、Terra Fast < Sol 標準Luna Fast < 改定前のLuna標準 という逆転が生まれている。

自社のワークロードにどう当てるかは、「速いモデルを選ぶ」ではなく 「品質は階層で、速度はモードで」買い分ける 視点で整理すると、コストと体験のバランスを取りやすくなります。まずはレイテンシがユーザーの離脱に直結している経路を特定し、そこだけをFastで実測比較するところから始めるのが現実的です。


出典(OpenAI公式)

CSエージェントで顧客対応を自動化しませんか?

デモ・無料相談・資料請求を承っています。

デモをみる無料相談する資料請求する

関連記事

Grandream

Grandream

株式会社グランドリーム

AI・システム開発のプロフェッショナルチームです。AIエージェント・業務自動化・Webシステム開発などを手がけています。

システム開発のご相談はお気軽に

アイデア段階の壁打ちから歓迎。エンジニアが直接ヒアリングします。

無料で相談する

どのサービスが合うか30秒で診断する →