ニュース

SpaceXAI、「Grok 4.7」を発表 ~先代から速度・価格維持で「GPT-5.6」「Fable 5.1」に伍する性能

「Cursor」「Grok Build」で即日利用可能

SpaceXAI、「Grok 4.7」を発表

 米SpaceXAIは9月21日(現地時間)、「Grok 4.7」を発表した。コーディングとナレッジワーク向けの最上位モデルで、先月リリースした「Grok 4.6」を凌ぐ品質とパフォーマンスを実現しているにもかかわらず、価格と速度は据え置きだ。

 「Grok 4.7」では、「Grok 4.6」よりも大きな新しいベースモデルを採用。完了までに数時間を要するような難易度の高いタスクでも、長時間推論できるよう強化された。その結果、自己検証能力や長文コンテキスト処理能力が向上。「Grok Bot」の実行環境を理解するよう学習されており、一般的なナレッジワークや会話性能も改善されているという。

 同社が公表した各種ベンチマークの結果にも、こうした改善が表れている。たとえば、長時間のコーディングタスクを重視した「CursorBench 4.0」では「GPT-5.6 Sol」を上回り、性能とコストのバランスでも最先端の水準にあるという。電気工学の「EEBench」や法務の「Harvey Legal Agent Benchmark」では比較対象のなかでもっとも高いスコアを記録した。文書やプレゼンテーションの作成も得意で、弁護士や看護師、金融アナリストといった専門職の作業を課題とする「GDPval」ではEloスコア1,695を記録し、「Fable 5.1」(1,735)に次ぐ値となっている。

「Grok 4.7」と他モデルの料金・ベンチマーク比較(SpaceXAI公表)
「CursorBench 4.0」のスコアと1タスクあたりの平均コストの比較(SpaceXAI公表)

 そのほかにも、安全対策を一新。脱獄プロンプト(jailbreak)への耐性が向上したほか、サイバーセキュリティや生物学分野の危険な依頼を以前よりも適切に拒絶するようになった。一方で、正当なセキュリティ業務はほとんど妨げないとのこと。一部のサイバーセキュリティパートナーには、防御研究向けに「Grok 4.7」のレッドチーム機能を招待制で提供している。

 「Grok 4.7」は同日より、「Cursor」(同社が買収)と「Grok Build」で利用可能。「Grok API」のほか、サードパーティ製のコーディングハーネスやモデルルーター、クラウドプラットフォーム経由でも使える。

 価格は入力100万トークンあたり2米ドル、出力100万トークンあたり6米ドルから。出力速度が2倍の高速版は、価格も2倍となる。「GPT-5.6 Sol」(入力4米ドル、出力20米ドル)や「Fable 5.1」(同10米ドル、50米ドル)と比べると割安で、同社は「同等のモデルの半額で、2倍高速」とアピールしている。