GPT-6 Sol|「半額」の中身と、その分母

[最終更新]

Googleで優先するソースとして追加するボタン

同じ日、AnthropicはOpus 5.5を、OpenAIはGPT-6 Solを出しました。どちらも「安さ」を掲げていますが、中身は違います。独立評価によれば、Solの総合的な賢さは前世代と同水準で、下がったのは1件あたりの費用でした。「GPT-6」という名前の下で、実際に動いたのは何だったのでしょうか。


OpenAIは2026年9月22日、GPT-6 SolとGPT-6 Lunaを公開した。GPT-6 Astraと同様の手法で訓練した、より速く安価なモデルと位置づける。API価格は100万トークンあたりSolが入力2ドル・出力10ドル、Lunaが0.10ドル・0.50ドルである。GPT-5.6の価格と比べ、Solは入出力とも50%、Lunaは入力が50%、出力が約58%下がった。

AutomationBenchではSol(xhigh)が33.2%を記録し、1タスクの費用は0.27ドルとした。社内の事実性評価では、Solの誤りは前世代の約半分になった。ChatGPT WorkとCodexで有料プラン向けに提供を始め、APIでも利用できる。

From: 文献リンクIntroducing GPT-6 Sol and Luna

【編集部解説】

「GPT-6」の名で出た、半額のモデル

AnthropicがClaude Opus 5.5を公開した同じ日(既報)、OpenAIもGPT-6 SolとGPT-6 Lunaを出しました。最上位のGPT-6 Astraと同様の手法で訓練した、より速く安いモデルという位置づけです。

OpenAI自身、この2つを「コスト効率のフロンティアを押し進める」モデルと説明しています。OpenAIは、Solの事実性の誤りが前世代の約半分になったことや、コーディング評価での改善も挙げています。一方、独立評価の総合指数は、Sol、Lunaとも前世代と同水準でした。性能面の進歩を認めたうえで、今回最も目を引く変化は価格だと私は見ています。

独立計測:指数は横ばい、費用は半分

評価機関のArtificial Analysisは、SolとLunaの総合指数と、コーディングの指数が、どちらもGPT-5.6と同水準にとどまったと評価しています。伸びた評価もあれば、下がった評価もあるという内訳です。

一方で、1タスクあたりの費用は大きく下がりました。Sol(max設定)は1.06ドルで、GPT-5.6 Solの1.99ドルから約50%減です。Luna(max設定)は0.07ドルで、前世代の0.18ドルから約60%減でした。1タスクに使う出力トークンは、Solが約2.9万から約3.1万、Lunaも約4.1万から約5.1万に増えており、Artificial Analysisは、費用が下がった主な理由を単価の引き下げとしています。

コーディングの指数では、Solが2ポイント上がり、Lunaは2ポイント下がりました。同じ世代の中でも、進み方は一様ではありません。

OpenAIの図が示す、左へ動いた曲線

OpenAIの発表ページには、前世代のGPT-5.6 Solも同じ図に載っています。性能と1タスクの費用を結んだ曲線を読むと、変化の形がよく見えます。

長時間のソフトウェア開発を測るDeepSWEでは、新しいSolの最高点が68.8%(1タスク2.74ドル)、旧Solの最高点が72.7%(6.46ドル)です。画面操作を測るOSWorld 2.0(オフライン版)でも、新Solが64.4%(3.25ドル)、旧Solが66.2%(7.71ドル)でした。両評価とも、新Solは旧Solの最高点に届かないものの、最高設定にかかる費用は半分未満です。

多くの設定では、新Solがより低い費用で高い点に届いており、曲線は全体として安い側へ移っています。ただし、すべての設定で新Solが上回るわけではありません。DeepSWEでは、旧Solのhigh設定が69.4%(2.66ドル)で、ほぼ同じ費用の新Solの最高設定をわずかに上回る点もあります。

「50%値下げ」の分母

50%という数字は、GPT-5.6 Solの現在の価格(入力4ドル・出力20ドル)と比べたものです。OpenAIはこの価格をプロモーション価格と呼び、料金ページで「少なくとも2026年11月21日まで」提供するとしています。

GPT-5.6 Solが6月に発表されたときの価格は、入力5ドル・出力30ドルでした。これと比べると、新しいSolは入力で60%、出力で約67%安くなっています。Lunaは発表時の入力1ドル・出力6ドルから、7月30日に80%引き下げられました。今回はさらに、入力が0.20ドルから0.10ドルへ半分に、出力が1.20ドルから0.50ドルへ約58%下がっています。OpenAIはLunaの値下げも「50%」と表示していますが、出力の下げ幅は計算上それより大きくなります。

11月22日以降の旧Solの価格や、プロモーションの終了日は示されていません。旧Solとの比較で見積もる場合は、この日付を前提条件として置いておく必要があります。

比較相手と、同じ日のOpus 5.5

OpenAIの比較でClaude側に並んでいるのは、Opus 5とFable 5、Fable 5.1です。Opus 5.5は含まれておらず、その理由は示されていません。両社の告知投稿の時刻差は約101分でした。OpenAIは、Fable 5.1の費用にはOpus 5へのフォールバック分(タスクの約40%)が含まれていないと自ら注記し、比較の条件を明かしています。

同じ日の2つを単価で並べると、Solは入力2ドル・出力10ドル、Opus 5.5は4ドル・20ドルで、ちょうど2倍の差です。キャッシュ読み込みはどちらも0.20ドルで並びました。ただし、既報のとおりOpus 5.5はArtificial Analysisの総合指数で首位に立っており、2つは位置づけの異なるモデルです。単価の差がそのまま1件の仕事の費用の差になるわけではありません。

キャッシュの改善

価格と並んで、OpenAIはプロンプトキャッシュの改善を打ち出しました。推論の深さやツールの有無を会話の途中で変えても、それまでの文脈をキャッシュとして再利用できるようになります。キャッシュの効き具合を確かめるダッシュボードと診断ツールも用意されました。

GitHubは、ここ数か月の改善で、OpenAIのモデルへの数十億件のリクエスト全体で、新たに処理し直す必要のあるプロンプトトークンの割合が50%以上減ったと報告しています。文脈を繰り返し使うエージェントでは、単価に加えてキャッシュの再利用率も費用を左右します。

日本の現場にとっての意味

SolとLunaは、APIでは当日から、ChatGPT WorkとCodexではPlus、Pro、Business、Enterprise、Eduの各プランで順次使えるようになりました。ChatGPTの通常の対話画面(Chat)では、まだ選べません。

API料金は、処理方式と文脈の長さで変わります。入力が27万2000トークンを超えると、リクエスト全体に長文脈料金が適用され、入力とキャッシュは通常の2倍、出力は1.5倍になります。急がない処理に使うBatchとFlexは、それぞれStandardの半額です。一方、EUのデータ所在地指定はStandard処理に限られ、対象の地域処理には10%の上乗せがあります。自社の使い方がどの条件に当たるかで、実際の単価は変わります。

これから開くもの

OpenAIの命名では、数字が世代を、SolやLunaが能力の階層を表します。今回は、Astraで培った同じ世代の手法を、異なる費用と用途へ広げる構図です。最高の性能はAstraが担い、SolとLunaはその成果を日々の仕事の価格帯へ運ぶ役割を負っています。

OpenAIは今回の値下げを、高度なAIをより多くの日常の仕事で実用的にするためのものだと説明しています。同じ日の2つの発表からは、性能に加えて、1件の仕事を終える費用をめぐる競争の強まりが見えてきます。使う側にとっては、選択肢と交渉の材料が増えた1日でした。

【関連記事】

Claude Opus 5.5|「40%安い」はどの設定で成り立つか
同じ日に公開されたClaude Opus 5.5の記事。「40%安い」がeffortの設定次第で変わることを、独立計測から読み解いている。

【解説】GPT-6 Astra|見出しの数字より17個の注釈を読む
SolとLunaの上位にあたるGPT-6 Astraの解説記事。旧Solの価格がプロモーション価格である点にもいち早く触れている。

OpenAI GPT-5.6(Sol・Terra・Luna)命名騒動の真相—米政府の限定公開とソブリンAIという宿題
前世代GPT-5.6の発表時の記事。Sol、Terra、Lunaの位置づけと、発表時の料金を一次情報に基づいて整理している。

GPT-Live-1がAPIで提供開始、音声層は1分0.05ドル
音声モデルGPT-Live-1のAPI提供を扱った記事。背後で推論を担うモデルとして、7月30日に値下げされた旧Lunaにも触れている。

Grok 4.7のスコアは先月と比較できない 公式が明記した理由
評価指標の版が変わると、過去のスコアと単純に比べられなくなる問題を扱った記事。独立評価の総合指数を読むときの参考になる。

【編集部後記】

Artificial Analysisの評価には、もう1つ気になる数字があります。分からない問題に答えを控えず誤答する割合(ハルシネーション率)が、Sol(max設定)では92%から60%へ下がりました。

ただし同社によれば、これは答えを控える回数が増えたためです。回答した問題は99%から83%に減り、正答率は59%から54%へ下がっています。

誤りを減らす方法は、正しく答えることだけではありません。答えないことも、その1つです。どちらで減ったのかを見分ける目が、使う側にも求められます。


【用語解説】

GPT-6 Astra
OpenAIが2026年9月3日に公開した同社の最上位モデル。SolとLunaは、Astraと同様の手法で訓練された。

プロモーション価格
期間を限って提供される割引価格。GPT-5.6 Solの入力4ドル・出力20ドルがこれにあたり、OpenAIは少なくとも2026年11月21日まで提供するとしている。

1タスクあたりの費用
1つの課題を終えるまでにかかった費用。トークン単価に、使ったトークンの量を掛け合わせて決まる。

DeepSWE
長時間にわたるソフトウェア開発の課題を、AIエージェントに解かせて測るベンチマーク。

OSWorld 2.0
画面操作を伴う日常や業務の長い作業を、AIがどこまで遂行できるかを測るベンチマーク。

AutomationBench
Zapierが提供するベンチマーク。複数のアプリにまたがる業務フローを、AIが最後まで完了できるかを測る。

プロンプトキャッシュ
一度処理した入力を保存し、次のリクエストで再利用する仕組み。再利用分は通常の入力より安く課金される。

フォールバック
安全装置が作業を止めたときに、別のモデルが代わりに処理を引き継ぐ仕組み。

Batch/Flex
急がない処理を割安に実行するOpenAI APIの処理方式。どちらも通常の処理の半額で使える。

【参考リンク】

GPT-6 Sol(OpenAI APIモデルページ)(外部)
GPT-6 Solの仕様ページ。文脈長、推論の設定、長文脈やBatch、Flexの料金条件を、開発者向けに1ページにまとめている。

Pricing(OpenAI API)(外部)
OpenAI APIの公式料金表。GPT-6各モデルの単価と処理方式ごとの料金、旧Solのプロモーション価格の提供期限を確認できる。

GPT-6 Sol and Luna push the cost efficiency frontier(Artificial Analysis)(外部)
独立系評価機関によるSolとLunaの分析記事。1タスクの費用と出力トークン、評価ごとの伸びと後退を前世代と比べて示す。

Previewing GPT-5.6 Sol(OpenAI)(外部)
GPT-5.6シリーズの発表記事。旧Solの発表時の価格と、数字とSol・Terra・Lunaによる命名の考え方を確認できる。

DeepSWE(Datacurve)(外部)
長時間のソフトウェア開発課題でAIエージェントを評価する、Datacurveのベンチマーク公式サイト。課題の設計と結果を公開する。

OSWorld 2.0(外部)
画面操作を伴う日常や業務の長い作業で、AIエージェントを評価するベンチマークの公式サイト。評価の範囲と版の情報を掲載する。

【参考記事】

OpenAI launches GPT-6 Sol and Luna, boasting lower cost and fewer mistakes(外部)
GPT-6 SolとLunaの公開を報じる記事。価格の半減、事実性の改善の主張、同じ日のOpus 5.5公開との近さを伝える。

OpenAI releases GPT-6 Sol and Luna models, slashing API costs 50% or more(外部)
SolとLunaの価格を、Opus 5.5やFable 5.1、Geminiのトークン単価と並べて位置づけを整理した記事。

OpenAI Goes After AI Costs With GPT-6 Sol and Luna, Slashing Prices by 50%(外部)
SolとLunaの旧価格からの変化を具体的な数値で示し、Anthropicのキャッシュ値下げと並べて両社の競争を読んだ記事。

Googleで優先するソースとして追加するボタン
投稿者アバター
山本 達也 代表社員
合同会社デジタルの窓口 代表。ウェブ解析士。生成AI・サイバーセキュリティ・ 宇宙開発領域を中心に執筆。

おすすめ記事