Codexで一番強いのはSol。だったら、ずっとSolを使えばよくない?」

GPT-5.6が登場してから、私もほとんど反射的にSolを選んでいました。せっかく使うなら一番賢いモデルを使いたいし、LunaやTerraを選んで失敗するくらいなら、最初からSolに任せた方が安心だと思っていたからです。

ところが、2026年7月30日にOpenAIが価格改定を発表。Lunaは80%、Terraは20%の値下げとなり、モデルの選び方がかなり変わりました。公式ベンチマークを見ても、日常的なコーディングでは3モデルの差が価格差ほど大きくありません。

" 結論から言うと、Solは「常に使う標準モデル」ではなく、「難しい場面で投入する切り札」として使う方が、今のCodexではかなり合理的です。
IMPORTANT

この記事のグラフについて: OpenAIはモデル別の公式ベンチマークを公開していますが、Low・Medium・High・XHigh・Maxごとの細かな性能値や消費トークンは公開していません。そのため、effort別グラフは公式価格と公式ベンチマークの傾向をもとにした「比較用の試算」です。公式の実測ランキングではありません。


2026年7月30日、GPT-5.6が価格改定されました

OpenAIは2026年7月30日、GPT-5.6 LunaとTerraの値下げを発表しました。Lunaは80%値下げ、Terraは20%値下げ。Solの価格は据え置きです。APIだけでなく、CodexとChatGPT WorkでもLuna・Terraの利用が以前より少ないクレジット消費になると案内されています。

Scroll
MODEL 改定前・入力 改定後・入力 改定前・出力 改定後・出力 値下げ率
Luna $1.00 $0.20 $6.00 $1.20 80%OFF
Terra $2.50 $2.00 $15.00 $12.00 20%OFF
Sol $5.00 $5.00 $30.00 $30.00 変更なし
スクロールして全体を表示

※すべて100万トークンあたりのAPI価格。キャッシュ入力やFast modeなどは別料金です。価格は2026年7月31日時点。

$0.044

Luna

入力10万+出力2万

$0.440

Terra

入力10万+出力2万

$1.100

Sol

入力10万+出力2万

同じトークン量なら、料金比はほぼLuna:Terra:Sol=1:10:25です。Solを1回使う予算で、理論上はLunaを約25回使える計算になります。もちろん実際のCodexでは、タスクごとに読み込むコード量や推論量が違うため、この通りの回数になるわけではありません。それでも、モデル選択の重さがかなり違うことは分かります。


でも結局、LunaやTerraって使わなくない?Solでよくない?

これはかなり自然な疑問です。SolはGPT-5.6ファミリーの最上位であり、難しいコーディング、長い調査、設計、科学、サイバーセキュリティなどで最も高い能力を持ちます。失敗が許されない仕事なら、最初からSolを選ぶ安心感もあります。

ただし、Codexで毎回やる作業が、すべて最難関というわけではありません。文字の変更、ボタン追加、既存パターンに沿った画面実装、テスト作成、定型的なリファクタリングなどは、問題が整理されていればLunaやTerraでも十分に処理できます。

公式ベンチマークを見ると、コーディングでは意外と近い

Scroll
OpenAI公式評価 Luna Terra Sol
Artificial Analysis Intelligence Index 51.2 55.0 58.9
Coding Agent Index 74.6 77.4 80.0
SWE-Bench Pro 62.7% 63.4% 64.6%
スクロールして全体を表示

特にCoding Agent Indexでは、Lunaが74.6、Terraが77.4、Solが80.0。Solが最強なのは間違いありませんが、価格が25倍だから性能も25倍というわけではありません。普通の実装でLunaやTerraが候補になる理由は、ここにあります。

THE KEY IDEA

Solを使わないのではなく、Solを使う場所を選ぶ。簡単な工程までSolで埋め尽くさず、不確実性が高い場面だけ最上位モデルに任せるのがコスパの良い使い方です。


Luna・Terra・Solの違いをざっくり整理

LUNA

速くて、とにかく安い

指示が明確な作業、定型処理、軽い修正、テスト追加、文章やデータの整形などに向きます。

  • 小さなUI修正
  • 既存コードに沿った実装
  • テスト・コメント・整形
TERRA

日常開発のバランス型

実装力と料金のバランスがよく、Codexの標準モデルとして最も使いやすい立ち位置です。

  • 普通の機能追加
  • Flutter・Python・Unity
  • 中規模リファクタリング
SOL

難問を突破する最上位

曖昧な要件、原因不明の不具合、設計判断、広い影響範囲を伴う作業で強みが出ます。

  • アーキテクチャ設計
  • 原因不明の難しいバグ
  • 重要なレビュー・検証

ざっくり言えば、Lunaは作業員、Terraは頼れる実装担当、Solは設計者兼トラブルシューターです。もちろん実際には重なる部分もありますが、この役割分担で考えると選びやすくなります。


用途別比較:Codexではどのモデルを選ぶべき?

Scroll
用途 おすすめ 理由
誤字、CSS、文言、軽いUI修正Luna Low〜High答えがほぼ決まっており、深い探索が不要
既存機能に沿った小規模実装Luna High安価でも、明確な仕様なら十分に実装しやすい
一般的な機能追加Terra High性能・速度・利用枠のバランスが良い
複数ファイルの改修、リファクタリングTerra High〜XHigh影響範囲を考えつつ、Solより安く進めやすい
設計方針、技術選定、仕様の整理Sol Medium〜High曖昧さを整理し、全体最適を考える仕事
何度直しても再発するバグSol High〜XHigh仮説を複数立て、検証し直す価値が大きい
重要な最終レビューSol XHigh〜Maxコストより見落としを減らすことを優先
スクロールして全体を表示

迷ったときの基準

「手順が見えている仕事」はLunaかTerra。「何を直せばよいか分からない仕事」はSol。この基準だけでも、無駄なSol使用をかなり減らせます。


effortって結局何?モデルの頭が良くなるの?

Codexのモデル選択には、Low、Medium、High、XHigh、Maxといったeffort(推論努力)があります。APIではnoneも利用できますが、この記事ではCodexで使い分ける主要な段階に絞ります。

effortを上げても、LunaがSolに変身するわけではありません。モデルが持つ知識や基本能力は同じです。変わるのは、答えを出す前に、どこまで探索・比較・検証・修正に時間を使うかです。

LOW
まず動く答えを早く出す。 誤字修正や単純な変更など、考え直す価値が小さい作業向け。
問題 → 最初の案 → 提出
MEDIUM
速度と品質の標準設定。 OpenAIもバランスの良い開始地点として案内しています。
問題 → 少し比較 → 提出
HIGH
自分の案をレビューしてから出す感覚。 影響範囲やテストまで考えてほしい実装向け。
複数案 → 比較 → 修正 → 提出
XHIGH
さらに探索し、検証を重ねる。 難しいバグや複数の制約がある作業で効果が出やすい設定。
仮説A/B/C → 検証 → 再検討
MAX
品質最優先の最終手段。 XHighより長く考え、代替案の探索、チェック、修正に多くの計算を使います。
探索 → 検証 → 再設計 → 最終確認

effortを上げると起きやすい変化

良くなる可能性があるもの

  • 複数案の比較
  • 見落としや矛盾の発見
  • テスト・検証・自己修正
  • 長い手順を最後まで進める安定性

増えやすいもの

  • 応答までの時間
  • 推論・出力トークン
  • Codexの利用枠・クレジット消費
  • 簡単な作業での待ち時間

つまり、effortは「高いほど正義」ではありません。答えがほぼ一つに決まっている作業でMaxを使っても、結果はあまり変わらず、時間と利用枠だけ多く消費する可能性があります。逆に、原因が分からないバグや設計のように、考え直す価値が大きい仕事ではHigh以上の効果が出やすくなります。


effort別・コスパ別グラフで見るおすすめ設定

ここまでの内容を、性能とコストの散布図にまとめました。縦軸は性能イメージ、横軸は入力10万トークン+出力2万トークンのAPI料金を基準にした推定コストです。点はつながず、各モデル・effortを独立した選択肢として配置しています。

※モデル単位の価格は公式値。effort別の性能・消費倍率は非公開のため、グラフ内の点は比較用の試算です。実際の消費はコードベース、入力、出力、ツール実行によって変動します。

注目は「Terra XHigh」と「Sol Medium」

グラフ上で面白いのが、Terra XHighとSol Mediumの位置です。試算では、Terra XHighの方が安いまま、Sol Mediumに近い品質を狙える可能性があります。

WHY?

Terraの単価は、同じトークン量ならSolの40%です。

つまりTerra XHighがSol Mediumより多く考えたとしても、使用トークンが2.5倍未満なら、計算上はまだTerraの方が安くなります。もちろん「Terra XHighが必ずSol Mediumより賢い」という意味ではありません。難問への安定性や設計判断では、Solの基本能力が効く場面があります。

この比較から分かるのは、モデルとeffortを別々に考える必要があるということです。「上位モデルを低effortで使う」だけでなく、「一段下のモデルに多めに考えさせる」という選択肢もあります。日常開発では、この中間地点がかなりおいしいです。

BEST VALUE

Luna High

仕様が明確な小さな実装を大量にこなす。

DAILY DRIVER

Terra High

普通の開発で最も無難な標準設定。

HARD MODE

Sol High

曖昧さや難しい判断を突破する。


5時間の利用枠でうまくやっていく使い方

Codexの画面に表示される「5時間」の枠は、5時間ずっと作業できるという意味ではありません。OpenAIの公式説明でも、消費量はタスクの規模と複雑さ、選んだモデル、実行場所、長いセッションや大きなコードベースなどによって変わるとされています。

そのため、利用枠を長持ちさせるには、プロンプトを一文字でも短くすることより、高価な推論をどこに使うかを決める方が重要です。

SMART CODEX ROUTE

STEP 1

Terra Highで開始

通常の実装・修正を進める

STEP 2

Terra XHighへ

難しければ同モデルで深く考える

STEP 3

Sol Highへ昇格

原因や設計そのものが難しい場合

FINAL

Sol Max

重要案件・最後の切り札

利用枠を無駄にしにくい7つのルール

  1. 01標準をSolではなくTerra Highにする。
    普通の実装なら、まずTerraで十分かを試します。
  2. 02明確な単純作業はLunaへ落とす。
    文言、CSS、テスト、既存パターンの複製などはLuna Highが強力です。
  3. 03設計だけSol、実装はLuna・Terraに分ける。
    OpenAIも、Solで不確実性を解消して計画を作り、Lunaで明確な変更やテストを実行するワークフローを例示しています。
  4. 04いきなりXHigh・Maxにしない。
    まずHighで試し、失敗理由が「考察不足」だと判断できるときだけ上げます。
  5. 05タスクを一つの目的に絞る。
    「全部直して」より、対象画面・不具合・完了条件を明確にした方が無駄な探索を減らせます。
  6. 06長くなりすぎたセッションを整理する。
    必要な前提と現在の課題を短くまとめ、新しいタスクとして切り出すと、不要な文脈の再読を減らしやすくなります。
  7. 07急ぎでないならFast modeを常用しない。
    Fast modeは速度を上げる代わりに、対応モデルではクレジット消費率も高くなります。

大切なのは「弱いモデルから順番に試す」ことではありません。

タスクの難易度を見て、最初から適切な場所に置くことです。明らかに難しい設計をLuna Lowへ投げ、何度も失敗させるのも利用枠の無駄です。簡単な作業にSol Maxを使うのと同じくらい、モデルを下げすぎることにも注意が必要です。


結局、私ならこの設定で使います

今回、価格とベンチマーク、effortの仕組みをまとめて考えた結果、私ならCodexの標準設定をTerra Highにします。そこから、作業内容に応じて上下へ動かす形です。

LIGHT

Luna High

軽いUI、HTML、CSS、テスト、明確な小修正。

DEFAULT

Terra High

Flutter、Python、Unityを含む一般的な機能追加。

DEEP

Terra XHigh

普通より難しいが、Solへ上げるほどか迷う作業。

CRITICAL

Sol High / Max

設計、難解なバグ、重要レビュー。Maxは最後だけ。

特に価格改定後は、Lunaを「性能の低い節約モデル」と見るのはもったいないです。公式のCoding Agent Indexで74.6を出しながら、API単価はSolの25分の1。仕様を明確に渡せる人ほど、Lunaの価値は大きくなります。

そしてTerraは、今回の値下げでさらに使いやすくなりました。Sol Mediumを毎回使う前に、Terra HighやXHighで足りないかを考える。これだけで、Codexの5時間枠をかなり現実的に運用しやすくなるはずです。

SUMMARY

「最強モデルを固定」ではなく、仕事の難しさに合わせて推論予算を配るのが正解です。

  • Lunaは80%値下げ。明確な作業では圧倒的なコスパ
  • Terraは日常開発の標準候補。迷ったらHighから
  • effortはモデル変更ではなく、探索・検証・修正に使う量
  • Terra XHighはSol Mediumに対する有力なコスパ候補
  • Solは設計・難問・最終レビューに集中させる

GPT-5.6では、単純に「どのモデルが一番強いか」だけを見るより、「この作業には、どこまでの知能と考える時間が必要か」を判断する方が大切になりました。価格改定で選択肢が増えた今こそ、Sol一択から卒業して、自分の開発に合った組み合わせを見つけてみてください。

OFFICIAL SOURCES

情報確認日:2026年7月31日。価格、提供モデル、利用上限は今後変更される可能性があります。

>>RELATED ISSUES