2026年9月22日(米国時間)、OpenAIが「GPT-6 Sol」と「GPT-6 Luna」の2モデルを公開しました。今月初めに出た最上位モデルGPT-6 Astraの下に並ぶ、中位と下位のモデルです。看板は性能よりも値段で、API料金は前世代のGPT-5.6 SolとLunaに比べてどちらも半額以下になりました。
先に立場を書いておくと、このブログは記事の下調べにAnthropicのClaudeを、画像の生成にChatGPTを使っています。OpenAIとAnthropicは競合関係にあるので、両社の発表を扱うときはその前提で読んでもらえればと思います。

SolとLunaの役割分担
GPT-6の世代は、Astra、Sol、Lunaの3段構成になりました。Astraが「一番賢いが一番高い」モデルで、Solは日常の仕事向けの中位モデル、Lunaは速さと量を優先した軽量モデルという分け方です。OpenAIの説明では、Solはコードを書く・レビューする・データを分析するといった、開発者や知識労働者が繰り返しやる込み入った作業向け。Lunaは文書の要約や情報の抜き出し、短い質問への回答のように、ゴールがはっきりしていて件数が多い作業向けとされています。
訓練にはAstraと同じ手法を使ったとのことで、Astraで伸ばした専門業務・事実の正確さ・コーディング・パソコン操作・整合性の改善を、安いモデルにも持ち込んだという位置づけです。前世代からの伸びは、OpenAIの自社評価では全項目で確認されていますが、飛び抜けて大きいというほどではなく、着実な更新という印象です。
料金は半額、しかも恒久価格
API料金は100万トークンあたり、GPT-6 Solが入力2ドル・出力10ドル(GPT-5.6 Solは4ドル・20ドル)、GPT-6 Lunaが入力0.10ドル・出力0.50ドル(GPT-5.6 Lunaは0.20ドル・1.20ドル)です。Solはきっかり半額、Lunaは出力側が6割近い値下げになりました。
注目したいのは、GPT-5.6の価格が「プロモーション価格」だったのに対し、今回の価格は割引ではなく通常価格だとOpenAIの広報が説明している点です。値下げの原資は推論とキャッシュの効率化で、その分をそのまま利用者に返した、という説明になっています。
キャッシュ(一度送った長い前置きを使い回す仕組み)も改良され、GPT-6ではキャッシュに当たる割合が上がり、キャッシュ読み取りは9割引きになりました。会話が長くなるエージェント用途では、ここが効いてきます。GitHubは、この数か月の改善で新規に処理が必要なトークンの割合が半分以下になったとコメントしています。
比較相手が、発表当日に入れ替わった
今回の発表文で目を引くのは、性能の比較相手としてAnthropicのClaude Opus 5が繰り返し出てくることです。業務ワークフローのベンチマークAutomationBenchでは、GPT-6 Solが最大設定のOpus 5を上回り、しかもタスクあたりの費用はOpus 5の9%だった。ソフトウェア開発のDeepSWEでは、SolはClaude Fable 5の最高スコアに1.1ポイント差まで迫って費用は約8割安。パソコン操作のOSWorld 2.0では、SolとOpus 5がほぼ同点で、費用はやはり約8割安。つまり「Claudeと同じことを、ずっと安くできる」というのが発表文の骨格です。
ところが、同じ9月22日にAnthropicがClaude Opus 5.5を出しました。OpenAIが比較対象に選んだOpus 5は、発表からほんの数時間で一つ前のモデルになったわけです。たとえばAutomationBenchで、GPT-6 Solは33.2%、Opus 5は26.9%でしたが、Opus 5.5はZapierの計測で40.0%を出しています。Opus 5.5はトークン単価もOpus 5より2割下がり、同じ仕事に使うトークン数も減ったとされるので、費用比も発表時の「9%」からは動くはずです。
とはいえ、単価で見ればGPT-6 SolはOpus 5.5の半分です。両社とも「うちのほうが1タスクあたりの費用が安い」と主張していて、どちらが本当に安いかは、単価ではなく「その仕事にトークンを何個使うか」で決まります。ここは第三者の計測を待たないと、はっきりしたことは言えません。

間違いが半分に、ただし条件つき
値段以外で気になったのは、事実の正確さに関する数字です。OpenAIは、実際の会話の中でユーザーが「間違っている」と印をつけたやり取りを集めた社内評価で、GPT-6 Solの間違いが前世代の約半分になったとしています。Lunaも大きく改善し、高い推論設定ではGPT-5.6 Solと同程度の正確さを、その100分の1ほどの費用で出せるとのことです。
ただし、この評価に使っているのは「モデルが間違えた会話」を意図的に集めたものなので、ふだんの使い方での間違いの頻度そのものではありません。OpenAI自身もそう注記しています。
文章の書き方もAstraに合わせて調整され、専門用語や奇妙な言い回し、価値の低い細部が減り、回答は少し短くなるとされています。発表文にはWebサイトの改修を頼んだ例が載っていて、前世代は「やりました、公開しました」と勢いよく報告するのに対し、GPT-6 Solは「何を確認して、何が不要だったか」を淡々と書いています。派手さはないものの、こういう変化のほうが日々の作業では効くように思います。
安全面では、掲示板に仕込まれた不正な指示に従ってしまう割合が、Solでは前世代の51.9%から11.3%に下がったと報告されています。まだゼロではないので、外部のWebやファイルを読ませるエージェント用途では注意が必要です。
使えるところと、まだ使えないところ
SolとLunaは、ChatGPT WorkとCodexで、Plus・Pro・Business・Enterprise・Eduの各プランから同日に使えるようになりました。無料プランとGoプランのユーザーは、デスクトップアプリでLunaを使えます。一方で、ふつうのチャット画面にはまだ入っておらず、そちらは後日とされています。APIのモデル名は「gpt-6-sol」と「gpt-6-luna」です。混雑を避けるため段階的に配信されるので、表示されない場合は時間を置くとよさそうです。
個人的には、最上位モデルの性能競争より、こうした中位・下位モデルの値下げ合戦のほうが、ふだん使いには影響が大きいと感じています。同じ日に両社がぶつけてきたのは偶然ではないでしょうし、この価格帯での競争はしばらく続きそうです。
出典:Introducing GPT-6 Sol and Luna(OpenAI)、OpenAI releases GPT-6 Sol and Luna models, slashing API costs 50% or more(VentureBeat)、OpenAI releases GPT-6 Sol and Luna — and cuts token prices in half(The New Stack)、Introducing Claude Opus 5.5(Anthropic)


コメント