SpaceXAI、Grok 4.6を発表:性能が基準を満たし、GPT-5.6 Sol Maxと並ぶ世界第3位に

Elon Musk 旗下の人工知能会社 SpaceX AI は、最近新世代の先端モデル Grok 4.6 を発表しました。このモデルは、長時間稼働するインテリジェントエージェント、プログラミング、知識作業のシナリオに特化しており、これらの作業負荷の運用コストを削減するために、より競争力のある価格戦略を採用しています。第三者評価機関 Artificial Analysis のインテリジェンス指数において、Grok 4.6 は 61 点を獲得し、オープンソースモデル Kimi K3 を上回り、OpenAIGPT-5.6 Sol Max と同点で、前世代の Grok 4.5 から 5 点の向上を見せました。

現在、ランキングの上位2位はそれぞれ Anthropic の Claude Opus 5 と Claude Fable 5 が占めており、Grok 4.6 は GPT-5.6 Sol Max と並んで世界第3位です。

プログラミングおよびインテリジェントエージェントの能力は、Grok 4.6 のアップグレードの重点です。DeepSWE v1.1 ベンチマークテストでは、得点が 54% から 65.9% に跳ね上がりました;APEX-Agents インテリジェントエージェントベンチマークは 47.1% から 57.5% に上昇し、10.4 パーセントポイントの向上を見せ、GPT-5.6 Sol Max の 56.7% をわずかに上回りました;Terminal-Bench v3.0 の得点も 15.7% から 26% に向上しました。しかし、後者の2つのテストでは、Claude Fable 5 Max が依然としてリードを保っており、Grok 4.6 は顕著な進歩を遂げたものの、競合他社に対する全面的な優位性はまだ実現していないことを示しています。

Grok 4.6 は価格と性能で競争力を示す

価格面では、Grok 4.6 の API の開始価格は、毎百万入力トークンあたり ¥320(US$2) 、毎百万出力トークンあたり ¥950(US$6) であり、先端モデルの中価格帯に位置しています。この価格は、GPT-5.6 Sol の標準モードの半分以下です。このモデルは 50 万トークンのコンテキストウィンドウをサポートしており、プロンプトが 20 万トークン未満の場合は上記の価格で請求され、20 万トークンに達すると料金が引き上げられます。SpaceX AI の紹介によれば、Grok 4.6 は本日より Grok Build にて稼働を開始し、同時に買収した AI プログラミング会社 Cursor にも登場し、パートナーには OpenRouter、

Vercel や Cloudflare などが含まれています。

トレーニングの面では、SpaceX AI は、Grok 4.5 に比べて Grok 4.6 がより長い時間のトレーニングを行い、汎用プログラミング、知識作業、コア最適化、ウェブ開発、コンピュータ支援設計などのインテリジェントエージェント環境に対して強化学習を強化したと述べています。テストでは、Grok 4.6 が長いシーケンスタスクでより強い自己テストおよび検証能力を示しました。コスト効率の観点から、Artificial Analysis のデータによると、Grok 4.6 は AA-Briefcase 作業負荷を完了するのに平均約 53 回のインタラクションと 5 億入力トークンしか必要とせず、Claude Opus 5 Max は約 103 回と 20

億トークンを必要とし、前者の効率的な優位性は非常に明確です。

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle