最近、各大人工知能企業が新しいモデルを相次いで発表しています。SpaceX傘下のxAIはGrok 4.6を発表し、DeepSeekはV4 Pro 0813を、GoogleはGemini 3.7 Flashを、OpenAIは毎秒750トークンを処理できる「UltraFast」モードを披露しました。Grokの評価機関Artificial Analysis(AA)の分析レポートによると、Grok 4.6の総合知能指数は61点に達し、GPT-5.6 Solと並んで第三位となり、前世代から23点も上昇しました。
さらに、その価格は変わらず(毎百万トークンの入力が¥320(US$2)、出力が¥950(US$6))で、同じスコアのGPT-5.6 Solよりも遥かに低いです。
知能体のタスクにおいて、Grok 4.6のパフォーマンスも非常に優れています。GDPval-AA v2のスコアは62%でClaude Opus 5に次ぎ、τ 3 -Banking金融テストではAlibabaのQiuWen Max 3.8と並んで第一位となり、単価を超える構造的コスト優位性を持つと見なされています。AA知能指数に関しては、DeepSeek V4 Pro 0813のAA知能指数は53点で、評価中に第七位にランクインしています。
その単一タスクコストはわずか6セントで、全104モデル中で第二位に位置し、同価格帯で最もコストパフォーマンスに優れた選択肢です。しかし、同社はAPI料金を引き上げることを発表し、ピーク時のキャッシュヒット入力料金が約12倍に急増する見込みです。業界では、この動きが「低コスト実用型AI」の市場ポジショニングを揺るがす可能性があると指摘されています。
Grok 4.6は知能体タスクで優れたパフォーマンスを発揮
Googleが発表したGemini 3.7 FlashのAA知能指数は56点です。その最大の特徴は出力速度で、毎秒340トークンを処理でき、GPT 5.6 Teraよりも約3倍速いです。さらに、前世代の価格の半分となっています。OpenAIはGPT 5.6 Solモデルに「UltraFast」モードを追加し、Cerebrasとの協力により毎秒750トークンの出力速度を実現し、標準処理よりも最大14倍の向上を達成し、「知能を損なうことなく高速計算を実現」と主張しています。
今回のモデル競争では、Anthropicは依然として沈黙を保っています。Fable 5.1が開発を完了したとの噂がありますが、Anthropicの今年の4〜8週間の発表リズムに従えば、8月下旬から9月初旬にかけて新製品が登場する可能性があります。

