OpenAIが、大規模言語モデルの新世代「GPT-5.6」の提供を始めました。用途や予算に合わせて選べるSol・Terra・Lunaという3つのモデルで構成され、企業の業務、コーディング、科学研究といった場面での効率を高めることを狙います。ChatGPTやCodex、APIから利用でき、事務作業を助ける新ツールも同時に投入されました。本記事では、3階層の違いと性能、価格の要点を整理します。

用途と予算で選ぶ3階層

GPT-5.6は、役割を分けた3つのモデルを束ねた構成です。最上位のSolは最も高い性能を担う旗艦モデル、Terraは日常的な業務をバランスよくこなす中位モデル、Lunaは大量の処理を低コストで回すための軽量モデルという位置づけになります。名称のSol・Terra・Lunaはそれぞれ太陽・地球・月を指すラテン語で、数字(5.6)が世代を、名称が性能の階層を表す形に整理されました。

利用者は、精度を優先したいのか、コストを抑えたいのか、あるいはその中間を取りたいのかに応じて、3つのモデルから選び分けられます。難しい判断が絡む作業にはSol、幅広い日常業務にはTerra、問い合わせ対応のように件数が多い処理にはLunaといった使い分けが想定されています。

コーディング効率と競合との比較

今回OpenAIが特に強調しているのが、コーディング用途での効率です。サム・アルトマンCEOによると、旗艦モデルのSolはコーディングにおいて、従来モデルよりトークン効率が54パーセント高いといいます。同じ作業をより少ないトークンで処理できれば、応答が速くなるだけでなく、実際にかかる費用も抑えやすくなります。

性能面では、AIの実力を評価する第三者指標「Artificial Analysis Coding Agent Index」を引き合いに、SolがAnthropicの最上位モデルFable 5を2.8ポイント上回る80点を記録したと説明しています。中位のTerraはFable 5をわずかに上回り、軽量のLunaもOpus 4.8を上回るとしています。いずれも、より少ないトークンで、より低い費用でこの水準に達したというのがOpenAIの主張です。

もっとも、これらはOpenAI自身が示した比較です。競合各社が相次いで新モデルを投入し、法人顧客の獲得を巡る競争が激しさを増すなかでの発表でもあり、実際の使い勝手は独立した評価や現場での検証を待って見極めたいところです。

あわせてOpenAIは、GPT-5.6を「これまでで最もサイバーセキュリティに強いモデル」と位置づけています。脅威の想定やコードの点検、修正パッチの作成、攻撃を模した防御側の検証(ブルーチーム)といった、守りを固めるための作業を支援できるとしています。

事務作業を支援する新ツール「ChatGPT Work」

モデル群の刷新に合わせて、企業チーム向けの新ツール「ChatGPT Work」も投入されました。文書やスプレッドシート、プレゼン資料の下書きといった日々の事務作業を手伝うもので、デスクトップ、ウェブ、モバイルのいずれからも使えます。

生成AIを個人の調べ物や文章作成に使う段階から、チーム単位の実務に組み込む段階へと、用途を広げていく狙いがうかがえます。

提供範囲と価格

GPT-5.6は、ChatGPT、コーディング支援のCodex、そしてOpenAI APIを通じて利用できます。開発者はAPI経由で3階層を呼び分け、扱うタスクの重さに応じてモデルを切り替えられます。

APIの料金は100万トークンあたりで設定され、階層ごとに大きく差がつきます。旗艦のSolは入力5ドル(約810円)、出力30ドル(約4,860円)。中位のTerraは入力2.50ドル(約400円)、出力15ドル(約2,430円)。軽量のLunaは入力1ドル(約160円)、出力6ドル(約970円)です。用途に対して過剰な性能を避け、階層を選ぶことでコストを最適化しやすい構成といえます。

※1ドル=162円換算(2026年7月11日時点)

まとめ

GPT-5.6は、旗艦のSol、中位のTerra、軽量のLunaという3階層で、性能とコストのバランスを利用者が選べるようにした新モデル群です。コーディングでのトークン効率の向上や、競合を上回るとする性能主張、事務作業を助ける「ChatGPT Work」の投入など、企業での実務利用を強く意識した内容になっています。示された性能はOpenAI自身の比較に基づくため、実際の実力は今後の独立した評価で確かめていくことになりそうです。