Anthropic は Claude Opus 5 を発表しました。これは、深い思慮と積極性を備えた新しいモデルで、価格は Claude Fable 5 の半分でありながら、その最前線の知能レベルに近づいています。
Claude Opus 5 の性能表現
公式資料によると、Claude Opus 5 はコーディングおよび知識作業の評価において、Frontier-Bench や GDPval-AA の新しい業界標準となっており、ネットワークセキュリティのタスクでは Mythos 5 に遅れをとっています。公式は次のように述べています。
「Opus 5 は日常使用においてより効率的に設計され、Claude Max の新しいデフォルトモデルおよび Claude Pro の最強モデルとなっています。」
Anthropic
。
性能とコスト効果の向上
Claude Opus 5 は性能が大幅に向上し、前作 Opus 4.8 と同じコストを維持しています。公式は次のように指摘しています。
「Opus 5 は Frontier-Bench v0.1 で他のすべてのモデルを超え、各タスクのコストにおいて Opus 4.8 のパフォーマンスを 2 倍以上向上させています。」
Anthropic
。さらに、CursorBench 3.2 の最大努力設定では、Opus 5 のパフォーマンスは Fable 5 の最高得点に近づいていますが、各タスクのコストはその半分に過ぎません。
強化された検証能力と安全性
検証作業および反復において、Claude Opus 5 は優れた性能を示しています。公式は次のように述べています。
「Opus 5 は複数の評価および初期テストにおいて、その積極性と徹底性を示しました。」
Anthropic
。例えば、Frontier-Bench のあるタスクでは、Opus 5 は図面を直接見ることなく、自らコンピュータビジョンパイプラインを作成し、機械部品を成功裏に再構築しました。
安全性とリスク管理
安全性に関して、Opus 5 の設計はリスクおよび二重用途の能力を回避することを目的としています。公式は次のように強調しています。
「Opus 5 は生物研究および攻撃的ネットワークセキュリティにおいて、依然として Mythos 5 に遅れをとっています。」
Anthropic
。それにもかかわらず、Opus 5 はネットワークセキュリティの脆弱性を発見する能力が大幅に改善されており、脆弱性を見つけることができますが、それを利用する能力は Mythos 5 に及びません。
Claude Opus 5 はすべてのプラットフォームで利用可能で、価格は 100 万入力トークンあたり ¥820(US$5)、100 万出力トークンあたり ¥4,100(US$25)です。開発者は Claude API を通じて使用を開始できます。
資料出典:Anthropic 公式発表

