本文へスキップ
MameTechNews
AI

SpaceXAI、Grok 4.7を公開 長時間コーディング向けでCursorとAPIに投入

## POINTS

  • CursorとGrok Build、APIですぐ試せる。消費者向け画面は後追いなので、まず開発経路で評価する。
  • 100万トークンあたり入力2ドル・出力6ドルは4.6と同額。高速版は速度も価格も2倍になる。
  • 長時間タスクの自己検証を売りにしている。自社リポジトリでの成功率とトークン消費を比較してから切り替えたい。

SpaceXAI(xAI)はGrok 4.7を公開した。コーディングとナレッジワーク向けの最上位モデルと位置づけ、4.6より大きい基盤モデルと長時間タスク寄りの強化学習で、自己検証と長いコンテキストの管理を強化したとしている。価格は入力2ドル、出力6ドル(100万トークンあたり)で4.6と同額。出力が2倍速い高速版は価格も2倍。Cursor、Grok Build、Grok API、第三者のコーディングハーネスやモデルルーターから利用でき、消費者向け画面への展開は後日としている。

公式比較ではCursorBench 4.0が46.3%(4.6は40.4%)、Terminal-Bench 4.0が37.6%(4.6は20.3%)。安全面では新しいセーフガードを載せ、HackerBench v0.3で危険な二重用途プロンプトの通過を3.3%とした。

エンジニアにとっては、既存の4.6枠を置き換えるか、Astraや他社モデルと使い分けるかの判断材料になる。価格は据え置きなので、長時間エージェントの成功率とトークン効率を自前のワークロードで測るのが先決だ。