ニュース

「GPT-6 Sol」「GPT-6 Luna」が登場 ~賢くなったのにAPI価格は「GPT-5.6」の半額以下

「GPT-6 Astra」の成果を受け継いだ普段使い向けモデル

OpenAI、「GPT-6 Sol」と「GPT-6 Luna」を発表

 米OpenAIは9月22日(現地時間)、大規模言語モデル「GPT-6 Sol」と「GPT-6 Luna」を発表した。今月初めに発表された「GPT-6 Astra」と同様の手法で訓練することで、「Astra」譲りの能力をより高速、より手ごろな価格で利用できる。これで「GPT-6」シリーズに「Astra」「Sol」「Luna」の3モデルがそろった格好だ。

 「GPT-6 Sol」「GPT-6 Luna」の魅力は、なんと言ってもその価格だ。キャッシュと推論の効率化により提供コストを下げられたとのことで、APIの価格は「GPT-5.6」のプロモーション価格から50%以上引き下げられた。100万トークンあたりの価格は以下の通り(入力が27万2,000トークン以下の場合の標準処理料金)。

  • GPT-6 Sol:入力2米ドル、出力10米ドル(「GPT-5.6 Sol」は入力4米ドル、出力20米ドル)
  • GPT-6 Luna:入力0.10米ドル、出力0.50米ドル(「GPT-5.6 Luna」は入力0.20米ドル、出力1.20米ドル)

 性能面でも先代の「GPT-5.6」シリーズを上回っており、コストあたりの知能は高い。各種ベンチマークでも、Anthropic社の競合モデルと同等のスコアを出しつつ、より低いコストでおさまるとしている。

「AutomationBench」のスコアとタスクあたりのコスト(OpenAIの発表資料より引用、以下同)

 つまり、妥協のない結果を求めるならば、総合的にもっとも優れたモデルである「GPT-6 Astra」を用いるべきだが、普段使いであれば「GPT-6 Sol」「GPT-6 Luna」が適している。

 そのほかにも、より事実に基づいた回答を行うように改善。回答のスタイルも「GPT-6 Astra」の改良が引き継がれており、専門用語や冗長な説明が減り、全体としてやや短くなっているとのこと。アラインメント(AIの振る舞いを人間の意図や価値観に沿わせる取り組み)についても「GPT-6 Astra」で導入された取り組みを引き継いでおり、社内評価では「GPT-5.6」の各モデルよりも改善されているという。

コーディング時の“ごまかし”の割合を測る社内評価の結果。意図的に難しい状況を用いたテストで、通常利用時の発生率を示すものではない

 開発者向けにはプロンプトキャッシュの改善が図られ、既定でキャッシュのヒット率が高まっているほか、推論の努力度やツールの有効・無効を切り替えてもキャッシュが無駄にならないようになり、キャッシュするプレフィックスの終わりを明示的に指定することも可能。キャッシュの状況を確認する「Prompt Caching Dashboard」や診断ツールも提供される。これらを活用すれば、入力トークンの再処理を減らし、応答の高速化やAPI利用料金の削減につなげられる。

 「GPT-6 Sol」「GPT-6 Luna」は同日より、「ChatGPT Work」と「Codex」でPlus/Pro/Business/Enterprise/Eduの各ユーザーに提供される。FreeとGoのユーザーも、デスクトップアプリで「GPT-6 Luna」を利用可能。ただし「Chat」ではまだ使えない。APIでは「gpt-6-sol」「gpt-6-luna」として利用できる。