7月16日から20日まで、国産大モデル分野は一連の集中リリースラッシュを迎えました。月の暗面 Kimi K3、DeepSeek V4 フルバージョン、そして通義千問 Qwen 3.8 が4日間で相次いで登場し、3社は異なる製品戦略で市場に参入しました。これは国産大モデルの競争次元が、単一指標から総合能力と価格体系の多次元的な競争へと変化していることを示しています。
まず、Kimi K3は7月16日に正式に発表され、コアパラメータは2.8兆パラメータ規模と100万Tokenのコンテキストウィンドウです。プログラミング能力評価では、K3はProgram Benchで77.8点を獲得し、GPT-5.6 Solの77.6点を上回りました。また、Frontier SWEでは81.2点を獲得し、GPT-5.6 Solの71.3点を大きくリードしています。この2つの重要指標で逆転を達成しました。Terminal Benchの得点は88.3点で、GPT-5.6 Solとの差はわずか0.5点です。
月の暗面は、K3は全体としてFable 5およびGPT-5.6 Solにはまだ劣るものの、プログラミング単項目では海外のクローズドソースモデルの水準に達したと述べています。
Kimi K3とDeepSeek V4の競争戦略が明確に分化
現在、DeepSeek V4はグレーディングテスト段階にあり、公式には正式な発表がされていません。既知の情報には、FlashとProの2つのバージョンが含まれ、SWE-benchの自己測定成績はOpus 4.6 Maxに対して0.2パーセントポイントの差があります。APIの価格設定には初めてピークと谷の課金メカニズムが導入されました:Pro版の百万出力Tokenは通常¥140(US$0.87)、ピーク時は¥280(US$1.74)です。この価格はFable 5の¥8,100(US$50)と比較して、1桁の差があります。
両社の路線の分化は非常に明確です。Kimi K3はプログラミングランキングで海外のクローズドソースモデルと直接対抗し、能力の上限をコアセールスポイントとしています。一方、DeepSeek V4はOpusレベルの能力を7分の1の価格に圧縮し、コスト優位性で市場を開拓しています。前者は能力の天井を競争し、後者は能力の下限の価格の閾値を競争しています。
このような分化は、国産大モデルの競争ロジックが根本的に変化していることを意味します。性能が近づき、価格が抑制される中で、ユーザーがモデルを選択する基準はもはや単一のスコアや単一の価格に限定されず、能力、コスト、イテレーション効率など複数の次元でのバランスを取る必要があります。

