Google、プログラミングとAI能力を強化したGemini 3.7 Flash大規模言語モデルを発表

Google は 8 月 14 日に Gemini 3.7 Flash 大規模言語モデルを正式に発表しました。前の世代の Gemini 3.6 Flash のリリースからわずか三週間後のことです。 Google はこの新しいモデルを、現在の Flash シリーズの中で最も強力な「主力」モデルとして位置づけ、特にプログラミングと AI エージェントのシナリオに最適化しています。 Google が発表したデータによると、Gemini 3.7 Flash はプログラミング能力において前の世代よりも明らかに向上しています。FrontierCode 1.1 Main テストでは、このモデルのスコアは 43.6% に達し、Gemini 3.6 Flash は 34.4% でした;DeepSWE v1.1 テストでは、スコアが 49% から 65.3% に向上しました。

ウェブ開発は Gemini 3.7 Flash のもう一つの主要な最適化方向です。 Google は、新しいモデルがより少ないプロンプトで機能的に強化されたページレイアウトと完全な機能を持つアプリケーションを生成できると述べており、参照デザインの再現性も改善されています。スクリーンショット、画像、または完全なデザインシステム形式の参照素材に関しても、モデルはより良く従うことができます。Arena.ai の WebDev Arena 評価では、このモデルの Elo スコアは 1588 点に達し、前の世代は 1538 点でした。

Gemini 3.7 Flash の知識集約型タスクにおけるパフォーマンスの顕著な向上

プログラミングとウェブ開発に加えて、 Google は Gemini 3.7 Flash の位置づけを知識集約型タスクの分野に拡大し、金融、法律、生物科学などの分野をカバーしています。GDP.pdf ベンチマークテストでは、このモデルのスコアは 34% で、前の世代は 22% でした;実際のビジネスワークフローのパフォーマンスを測定する AutomationBench テストでは、スコアが 17% から 30.4% に向上しました。AI エージェント体験において、 Google は Gemini 3.7 Flash が障害に直面した際の適応能力、ユーザーの意図を明確にする能力、指示に従う能力、複数ステップのタスク計画能力、外部ツールの使用能力が最適化されていることを強調しています。

Google は、これらの改善がソフトウェアエージェントを構築する際の開発者の手動介入と繰り返しの試行回数を減少させ、開発効率を向上させると考えています。価格戦略において、Gemini 3.7 Flash の価格は 2026 年末まで、百万入力トークンあたり ¥120(US$0.75) 、百万出力トークンあたり ¥600(US$3.75) です。 Google は、この価格が Gemini 3.6 Flash の元の価格の半分であると述べています。2027 年 1 月 1 日から、価格は百万入力トークンあたり ¥240(US$1.50) 、百万出力トークンあたり ¥1,190(US$7.50) に引き上げられます。

この段階的な価格設定は、初期により多くの開発者を引き付けるだけでなく、Google に後続の利益空間を確保することも可能にします。アプリケーション統合に関して、Gemini 3.7 Flash は Gemini Spark に接続されており、これは Google の 24 時間個人 AI エージェントサービスです。本日より、Spark は新しいモデルを使用して知識型作業タスクを処理します。これには、ドキュメントの統合、メールの草案作成、ステータス文書の更新などが含まれます。Spark サービスは Google AI Pro および Ultra サブスクリプションユーザー向けで、160 以上の国をカバーしています。

開発者コミュニティに対して、新しいモデルは Google Antigravity、Gemini API、Google AI Studio、Android Studio などのチャネルを通じて入手可能です;企業顧客は Gemini Enterprise Agent Platform および Gemini Enterprise アプリケーションを通じて使用できます;個人ユーザーは Gemini アプリ内で Spark 機能を通じて呼び出すことができ、Pro または Ultra サブスクリプション資格が必要です。

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle