ニュース

「Grok 4.7」登場、長時間タスクも安定処理 価格はSolの半分以下

SpaceXAIは21日(米国時間)、最新のAIモデルとなる「Grok 4.7」を公開した。コーディングやナレッジワーク向けで、同社における最高モデルとなり、同等のモデルと比較し、「処理速度は2倍、価格は半額」とアピールしている。CursorとGrok Buildで利用可能となるほか、Grok APIや各社のコーディングハーネス、モデルルーター、クラウドプラットフォームでも展開する。

Grok 4.7は、コーディングやナレッジワークにおいて高い性能を示し、難易度の高いタスクにおいても長時間処理を継続。自身の作業をより慎重にチェックするほか、安全対策も強化した。

Grok 4.6との比較では、より大規模な新しいベースモデルを採用。長時間かかるコーディングタスクを評価する「CursorBench 4.0」において、Grok 4.7はコストパフォーマンスの点で優れた結果を出している。Grok 4.7は、自身の作業の検証や、より長いコンテキストの管理に優れているほか、Grok Botハーネスをネイティブに理解するように訓練され、会話タスクや一般的な知識作業の処理能力も向上した。

ベンチマークにおいては、Grok 4.7がOpenAIのGPT-5.6 Sol(Max)、AnthropicのFable 5.1(Max)を超える項目も多く、CursorBench 4.0は46.3%で、GPT-5.6 Solの41.7%を越え、Fable 5.1の51.8%に迫る。DeepSWE v1.1は71%で、Fable 5.1の70%を越え、GPT-5.6 Solの72.7%に迫る。EEBenchは64%でGPT-5.6 Sol(39.4%)、Fable 5.1(56.4%)を大きく上回る。

また、弁護士、金融アナリストなどの専門家が担当するタスクの遂行力も向上した。加えて、コスト競争力の高さがGrok 4.7の特徴で、API料金は100万トークン当たり入力2ドル、出力が6ドルから。出力速度が2倍で、価格も2倍となる高速版も提供する。

コスト競争力に強み

安全対策も強化し、サイバーセキュリティや生物学的研究のようなデュアルユース(有益な目的にも有害な目的にも使用できるが、その境界が曖昧な利用)の分野において、無害なタスクに対する有用性と危険なタスクに対する安全な拒否の両面でトップの性能を示したという。そのため、高いサイバー防御能力と、正当な利用における低い拒否率とのバランスを実現できたという。