ニュース

「GPT-6.1 Sol」が登場 ~「GPT-6 Astra」に迫る知能を5分の1の料金で

「Astra Ultrafast」も提供開始、月額500米ドルの新「Pro」ティアも

OpenAI、「GPT-6.1 Sol」を発表

 米OpenAIは9月29日(現地時間、以下同)、開発者向けイベント「DevDay 2026」で、大規模言語モデル「GPT-6.1 Sol」を発表した。9月22日に発表された「GPT-6 Sol」の後継バージョンで、最上位モデル「GPT-6 Astra」に迫る知能を、「Astra」の5分の1という標準の入力・出力トークン料金で利用できる。

 「GPT-6.1 Sol」はエージェント型のコーディングで高い性能を発揮するほか、コンピューター操作(Computer Use)や専門業務にも優れる。同社によると、現時点で性能に対するコスト効率がもっとも高いモデルだという。

  • コーディング性能:ソフトウェア開発ベンチマーク「DeepSWE」で、「GPT-6 Astra」に近い性能を達成。「GPT-6 Sol」を上回るスコアを、より少ない推論コストで実現
  • 専門業務の処理能力:金融、医療、法務などの複雑なPDFを扱う「GDP.pdf」評価で高性能。複数ステップの業務自動化を評価する「AutomationBench」でも改善
  • コンピューター操作能力:OS操作ベンチマーク「OSWorld」で「GPT-6 Sol」を上回る結果。「Astra」との差も大幅に縮小
  • 科学研究用途:データ分析、シミュレーション、定理証明などを評価する「Terminal-Bench Science」で大幅な性能向上。コスト効率にすぐれる
  • 事実性の改善:「GPT-6 Sol」より事実誤認率が低下。「GPT-6 Astra」に近い水準まで改善
「DeepSWE」のスコアとタスクあたりのコスト
コンピューター操作の安全性を測る評価。値が低いほどよい

 ただし、総合的な能力では引き続き「GPT-6 Astra」が最高のフロンティアモデルであるとしている。

 そのほかにも、安全性の面ではアラインメント評価で「GPT-6 Sol」から大幅に改善。ツールに障害があった場合にユーザーへ伝えず、推測で回答する割合が「GPT-6 Sol」より減り、「Astra」に近い水準にまで抑えられているという。同社の評価では、自身の限界を伝える透明性や、ユーザーの意図・安全上の制約を尊重する信頼性が向上しているとのこと。

 「GPT-6.1 Sol」は同日より、有料ユーザーの「ChatGPT Work」と「Codex」へ展開される(「Chat」ではまだ使えない)。APIでは「gpt-6.1-sol」として利用でき、コンテキスト長が27万2,000トークン未満の場合、100万トークンあたりの標準料金は入力2米ドル、キャッシュ済み入力0.10米ドル、出力10米ドル。キャッシュ済み入力は標準の入力料金から95%引きにあたり、同じコンテキストを繰り返し使うエージェントの処理を安く回せる。

 あわせて、高速なトークン生成を特徴とする「GPT-6 Astra Ultrafast」の提供も開始された。APIに加え、月額500米ドルの「Pro」ティアのユーザーは「ChatGPT Work」「Codex」でも利用できる。「Ultrafast」のトークン生成速度は「Codex」で最大8倍(毎秒300トークン)、APIで最大6倍。「GPT-6.1 Sol Ultrafast」は近日提供予定で、「Codex」では通常版の最大8倍のトークン生成速度になるという。