2026年7月30日、OpenAI が GPT-5.6 の API 価格を改定しました。Luna は80%オフ、Terra は20%オフ。最上位の Sol は据え置きです。Luna は出力が 1Mトークンあたり $6.00 から $1.20 へ、つまり5分の1になりました。
この記事では、値下げの中身を確認したうえで、Luna・Terra・DeepSeek V4 Flash・Gemini 3.6 Flash・GLM-5.2 の5モデルに同じ課題を投げて、実際どれがいちばんコスパがいいのかを見ます。あわせて、報道では触れられていない「Terra を選ぶ理由が薄い」という点を、Artificial Analysis が公開しているグラフの実物から確かめます。
2026年7月30日付の OpenAI の発表です。適用は発表当日から。値下げされたのは Luna と Terra の2つで、Sol は変更ありません。
| モデル | 入力(1Mトークン) | 出力(1Mトークン) | 下げ幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 → $0.20 | $6.00 → $1.20 | 80% |
| GPT-5.6 Terra | $2.50 → $2.00 | $15.00 → $12.00 | 20% |
| GPT-5.6 Sol | $5.00 | $30.00 | 据え置き |
今回の改定は API の価格表だけの話ではありません。ChatGPT Work と Codex でも、Terra と Luna の消費クレジットが減りました。サブスクの月額とクォータ自体は変わっていないので、同じ料金のまま使える量が実質的に増えたことになります。Free と Go のユーザーは Terra まで、Plus 以上は Terra と Luna の両方を選べます。
GPT-5.6 Sol 向けに Fast mode が追加されました。標準の最大2.5倍速で、価格は2倍。知能そのものは変わりません。従来の Priority Processing を置き換えるもので、Codex の /fast と対応します。
OpenAI の説明は「モデル・推論基盤・エージェント基盤の各層を効率化した分を顧客に還元した」というものです。面白いのはその中身で、GPT-5.6 Sol 自身が本番用のカーネルを書き換えていると明記されています。
つまり、AIが自分自身を安くしている構造です。この循環が続く限り、値下げは今回1回で終わらないと考えたほうがいいでしょう。「高いモデルを前提にした設計」は、いま見直しておく価値があります。
価格だけ見ても判断できないので、第三者の計測を見ます。Artificial Analysis の Intelligence Index v4.1 です。9種類の評価(GDPval-AA v2・Terminal-Bench v2.1・SciCode・Humanity's Last Exam・GPQA Diamond ほか)の合成スコアです。
| モデル | Intelligence Index | 出力 $/1M |
|---|---|---|
| Claude Fable 5 | 60 | — |
| GPT-5.6 Sol | 59 | $30.00 |
| GPT-5.6 Terra | 55 | $12.00 |
| GPT-5.6 Luna | 51 | $1.20 |
| GLM-5.2 | 51 | $4.40 |
| DeepSeek V4 Flash | 50 | $0.28 |
| Gemini 3.6 Flash | 50 | $7.50 |
| Claude Haiku 4.5 | 30 | $5.00 |
Luna・GLM-5.2・DeepSeek V4 Flash・Gemini 3.6 Flash の4つが50前後の同じ帯に固まっています。つまりこの4つは「頭の良さはだいたい同じ」で、あとは値段と速度で選ぶ、という話になります。そして出力価格は $0.28 から $7.50 まで、26倍以上の開きがあります。
ここが今回いちばん伝えたいところです。Terra は Luna より上位で、Intelligence Index も 55 対 51 で上です。ただ、値段に見合った差なのかを見ると話が変わります。
GDPval-AA v2 は「実際の仕事のタスク」での性能を Elo で示すものです。人間のベースラインが1,000。
| モデル | GDPval-AA v2 Elo | 出力 $/1M |
|---|---|---|
| GPT-5.6 Terra | 1593 | $12.00 |
| GPT-5.6 Luna | 1592 | $1.20 |
1593 対 1592。差は1ポイントです。それでいて出力価格は10倍違います。
もう1枚、決定的なグラフがあります。横軸が1タスクあたりのコスト、縦軸が知能で、Artificial Analysis 自身が「最も魅力的な領域」を緑で塗っています。
Terra を選ぶ意味があるのは、Luna の上限である知能51では届かない、52〜55の帯が必要なときだけです。それ以外の用途では、同じ仕事に10倍払うことになります。
ベンチマークの数字だけでは分からないので、実際に走らせます。対象は GPT-5.6 Luna / GPT-5.6 Terra / DeepSeek V4 Flash / Gemini 3.6 Flash / GLM-5.2 の5つ。Claude Haiku 4.5 は今回は回さず、数字の比較としてだけ置いています。
課題は、短時間で差が出るものを3つ選びました。以下がそのまま投げるプロンプトです。
Generate an SVG of a horse riding an astronaut, where the astronaut is riding a pelican, and the pelican is riding a bicycle.
Write a Python program that shows 20 balls bouncing inside a spinning heptagon. All balls have the same radius and are numbered 1 to 20. All balls drop from the heptagon center at the start. Physics: gravity, friction, wall bounce, and ball-to-ball collision. The heptagon rotates 360 degrees per 5 seconds. Balls must never leave the heptagon; bounce height must be below the heptagon's radius but above the ball radius. Balls must visibly spin (the number shows the rotation). Only tkinter, math, numpy, dataclasses, typing, sys are allowed. No pygame, no physics engine. Single file.
Create a single HTML file that renders an animated solar system on <canvas>. Requirements: the Sun plus all 8 planets with roughly correct relative orbital periods and inclination, each planet leaves a fading orbital trail, planet labels always face the camera, a FPS counter and an in-simulation Earth-day counter in the top-left, all heavy computation must run in a WebWorker, and it must hold 60fps. No external libraries.
GPT-5.6 は3ティアとも 1.05M トークンのコンテキストを持ちます(入力最大 922K・出力最大 128K)。ただし272Kトークンを超えるリクエストは、入力が2倍・出力が1.5倍になります。しかもリクエスト全体に適用されます。「1Mコンテキストだから長文を投げ放題」と考えて設計すると、表の $0.20 では収まりません。
Luna は推論モデルです。出力そのものは毎秒177.8トークンと速いのですが、拡張思考を挟むぶん最初のトークンが返るまでの待ちが長い。安い=軽快、ではありません。対話UIの前面に置くよりも、バックグラウンド処理やバッチに回すほうが向いています。
OpenRouter では現在 Luna が $0.10 / $0.60、Terra が $1.00 / $6.00 と表示されますが、これは50%割引のプロモーションです。定価は $0.20 / $1.20 と $2.00 / $12.00 なので、採算の計算は定価で行ってください。
| こういうとき | 選ぶモデル | 理由 |
|---|---|---|
| 単価が全て・人が目で確認する作業 | DeepSeek V4 Flash | 出力 $0.28 で知能50。単価の最安はまだここ |
| Codex や ChatGPT のサブスク枠で完結させたい | GPT-5.6 Luna | 消費クレジットが減った今がタイミング。知能51で出力 $1.20 |
| 速度優先・マルチモーダル | Gemini 3.6 Flash | 毎秒216.9トークン。ただし出力は Luna の6.25倍 |
| 知能52〜55が必要 | GPT-5.6 Terra | Luna の上限51では届かない帯。ここだけが Terra の役割 |
| 失敗できない一発勝負 | Sol などの上位 | ここは値下げされていない。ただし弱い設定で使うなら Luna のほうが賢い |
Luna の値下げは本物です。同じ知能帯のなかで、いちばん扱いやすい価格になりました。ただし単価だけを見れば DeepSeek V4 Flash がまだ安く、Terra は Luna で届かない知能が要らないなら選ぶ理由がありません。
そして、安いモデルに任せるのは「人間が目で確認できる工程」まで。仕組みそのものを組ませる用途には、この価格帯はまだ早いと考えています。