AnthropicがClaude Opus 5を発表:半額のコストでエリート級のパフォーマンスを実現

Anthropicは、プレミアムなClaude Fable 5に匹敵する性能を大幅に低い価格帯で提供することで、ハイエンドLLM市場に破壊的変化をもたらすことを目的とした新しいフラッグシップモデル、Claude Opus 5を正式にリリースしました。この戦略的な動きは、GPT-5.6 Solのような競合他社からの価格圧力を無効化すると同時に、開発者に対してコーディングや複雑な知識作業のためのより効率的なツールを提供することを目指しています。

価格と性能の境界線を打破

Claude Opus 5の最も際立った特徴は、その攻撃的な価格体系です。最上位モデルのClaude Fable 5が入力トークン100万件あたり10ドル、出力トークン100万件あたり50ドルであるのに対し、Opus 5はこれらの料金を半減させ、入力100万件あたり5ドル、出力100万件あたり25ドルに設定しています。

レイテンシ(遅延)の要件に対応するため、Anthropicは処理速度を2.5倍に向上させる「Fast Mode」も導入しましたが、これにはトークン価格が2倍になるというコストが伴います。この段階的な価格設定は、100万トークンという巨大なコンテキストウィンドウと相まって、Opus 5をClaude Maxの新しいデフォルトモデル、およびClaude Proユーザーにとって最も有能な選択肢として位置づけています。

コーディングと推論におけるベンチマークの圧倒的優位性

Opus 5は単なる低価格な代替案ではありません。特定の領域において圧倒的なパフォーマンスを発揮するパワーハウスです。Frontier-Bench v0.1を用いたエージェンティックなターミナルコーディングにおいて、Opus 5は43.3%のスコアを達成し、Fable 5 (33.7%) と GPT-5.6 Sol (34.4%) の両方を大幅に上回りました。また、知識作業においても優位性を示し、GDPval-AA v2ベンチマークでEloスコア1,861を記録して首位に立ちました。

おそらく最も驚くべき統計は、未知の問題解決能力を測定するARC-AGI-3ベンチマークから得られたものです。Opus 5は30.2%のスコアを記録し、GPT-5.6 Solが達成した7.8%の約4倍に達しました。これは、モデルの学習データパターンから外れたタスクを処理する能力において、飛躍的な進歩を遂げたことを示唆しています。

インテリジェントな「effort(エフォート)」のスケーリングと効率性

Anthropicは、low(低)、medium(中)、high(高)、xhigh(超高)、max(最大)の5つの設定を切り替えられる、洗練された「effort」システムを導入しました。これにより、トークン消費量と推論の深さの間で、きめ細かなトレードオフが可能になります。

Anthropicは、コストを最適化するために一般的なタスクには「low」または「medium」設定を推奨していますが、複雑なエージェンティック・コーディングには「xhigh」を使用することをアドバイスしています。興味深いことに、同社は「max」設定では収穫逓減が見られると指摘しています。Frontier-Bench v0.1とArtificial Analysis Coding Agent Indexの両方において、Opus 5はコストが高いにもかかわらず、最大エフォート設定では実際にはわずかなパフォーマンスの低下が見られました。これは、「xhigh」設定が現在の効率におけるスイートスポットである可能性を示唆しています。

安全性と自律性の向上

ユーザーからのフィードバックに直接応える形で、AnthropicはOpus 5のセーフティ・クラシファイア(安全分類器)を微調整しました。このモデルのサイバーフィルターの作動頻度は、Fable 5と比較して約85%減少しており、正当な研究までも過剰にブロックしてしまうという以前の批判に対処しています。エクスプロイト(脆弱性攻撃)の生成やバイナリベースのスキャンは引き続き防止されますが、ソースコードの脆弱性研究に対しては、はるかに寛容になっています。

さらに、Opus 5は強化された自己修正能力を示しています。実世界のテストにおいて、このモデルは幾何学形状を解釈するためのコンピュータビジョン・パイプラインを自ら記述することで、FreeCAD内で3Dモデルの構築に成功しました。これは、他のすべての競合モデルが立ち往生したタスクです。

主なポイント

  • 劇的なコスト削減: Opus 5は、Claude Fable 5のトークンコストの50%で、フラッグシップ級のパフォーマンスを提供します。
  • 推論におけるブレイクスルー: 未知の問題解決に関するARC-AGI-3ベンチマークにおいて、このモデルは競合他社に対して4倍という圧倒的なリードを示しました。
  • 最適化された開発者ワークフロー: 改善されたセーフティ・クラシファイアと専用の「effort」設定により、Opus 5はエージェンティックなコーディングや研究において、よりスムーズな体験を提供します。