最新動向

OpenAI、GPT-5.6の廉価2モデルを最大80%値下げ

OpenAI、GPT-5.6の廉価2モデルを最大80%値下げ

この記事の要点

OpenAIは7月30日、GPT-5.6のLunaを80%、Terraを20%値下げした。高速処理のFast modeも追加。エージェント運用のトークン費用が下がり、常時稼働の自動化を組みやすくなる。

結論

OpenAIは7月30日、GPT-5.6シリーズの廉価な2モデルを値下げした。最も安いLunaは入力・出力ともに約8割下がり、中位のTerraも約2割下がった。最上位のSolには高速処理の「Fast mode」が加わった。トークン単価が下がると、AIエージェントを常時動かす自動化のコストが読みやすくなる。大量の問い合わせ処理や下書き生成を回している現場ほど、月額の請求が目に見えて軽くなる。

何が変わったのか

Yahoo Financeの報道によると、値下げは7月30日付で適用された。Lunaは入力100万トークンが1ドルから20セントへ、出力100万トークンが6ドルから1.20ドルへ下がった。中位のTerraは入力が2.50ドルから2ドルへ、出力が15ドルから12ドルへ下がった。最上位のSolの料金は据え置かれている。

Solには「Fast mode」が新設された。高優先度の業務処理を標準より最大2.5倍速くこなす設定で、Unite.AIの記事によればAPI上でこれまでのPriority Processingを置き換える。開発ツールのCodexの「/fast」とも足並みをそろえる。

値下げの背景には推論コストの改善がある。OpenAIは、Sol自身が本番のコードを書き換えてモデル提供コストを2割削ったと説明している。この点は同社の主張であり、詳細な検証データは公開されていない。実際の効果は自社の利用量で確かめてほしい。

現場の実務にどう効くか

料金が下がって効くのは、少量の対話より、大量に回す処理である。問い合わせの一次対応、議事録の要約、商品説明文の生成のように件数が積み上がる用途では、単価の8割減がそのまま請求額に響く。これまで費用対効果が合わずに見送っていた常時稼働のエージェントを、Lunaで組み直す余地が出てくる。

使い分けの基本は変わらない。難しい判断や長い推論はSol、日常の量産はTerraかLunaに振る。判断の材料はトークン単価と速度、そして出力の当たり外れである。料金の考え方は生成AI導入の費用対効果の考え方とトークンとは?文字数制限と料金の関係を合わせて読むと整理しやすい。競合の値下げも続いており、Gemini 3.6 Flashの費用圧縮と並べて比べると、用途ごとの最安が見えてくる。

まずは請求額の大きい処理を1つ選び、LunaかTerraに切り替えて1週間の費用と品質を測る。そこで基準が合えば、同種の処理へ横展開する。

FAQ

Q. Solも値下げされたのか。 いいえ。今回の値下げはLunaとTerraが対象で、最上位のSolの料金は据え置きです。Solには高速処理のFast modeが加わりました。

Q. なぜ値下げできたのか。 OpenAIは推論効率の改善を理由に挙げ、Sol自身が提供コストを2割削ったと説明しています。これは同社の説明で、独立した検証データは示されていません。最新の情報は公式で確認してください。

出典

よくある質問

GPT-5.6 Lunaはいくらになったのか

入力100万トークンあたり20セント、出力100万トークンあたり1.20ドルです。従来は1ドルと6ドルで、それぞれ8割の引き下げになります。最新の料金は公式で確認してください。

Fast modeとは何か

最上位のGPT-5.6 Solを標準より最大2.5倍速く処理する高速オプションです。API上でこれまでのPriority Processingを置き換えます。