Claude Opus 5登場:Fable並みの性能を半額で、しかも高速

[PR]記事内のアフィリエイトリンクから収入を得る場合があります
  • URLをコピーしました!

Anthropicが最新モデルClaude Opus 5を正式リリースしました(公式ブログ)。

Claude Opus 5は、同社の最上位モデルであるClaude Fable 5に迫る性能を持ちながら、半分の価格で提供されています。競争が激化する大規模モデル市場で、コストと性能の両面を大きく押し上げるアップデートとなっています。

Opus 5は従来のOpus 4.8の後継として提供され、Claude Maxの標準モデル、Claude Proの最強モデルとして利用可能になります。

目次

ベンチマークで示された圧倒的な性能

Opus 5は複数の標準ベンチマークで、Fable 5やGPT-5.6 Solを上回る結果を示しています。

主なポイントは以下の通り:

  • Frontier-Bench v0.1
    Opus 4.8の2倍以上のスコアを達成し、最先端モデルとして新記録を更新。

  • CursorBench 3.2
    最大努力モードではFable 5のピークに0.5%差まで迫り、価格は半額。

  • ARC-AGI 3
    未知問題の解決能力を測るテストで、次点モデルの3倍のスコア。

  • Zapier AutomationBench
    自動化タスクの成功率が、同価格帯のモデルより1.5倍

  • OSWorld 2.0
    Fable 5を上回る性能を、わずか1/3のコストで達成。

Opus 5は、高性能ならが低価格で利用できるのが特徴です。

  • 入力: $5/100万トークン
  • 出力: $25/100万トークン
  • Fastモード: 標準の2.5倍高速、価格は2倍

長時間タスクへの強さと弱点

Anthropicは、Opus 5が長時間の作業において自己検証能力が向上し、表面的な修正ではなく根本原因の特定が得意になったと説明しています。

開発者向けの細かな改善としては、会話中に利用ツールの設定を変更しても、プロンプトキャッシュが無効化されない仕様が導入された点も注目です。エージェント系ワークフローを扱う開発者にとって、実用性が高いアップデートといえます。

一方で、攻撃的サイバーセキュリティや一部の生物学研究タスクではMythos 5に劣るという弱点も明記されています。

まとめ: 高性能モデルの常識を塗り替えるアップデート

Claude Opus 5の登場は、単なる後継モデルへの置き換えではなく、「Fable級の性能を半額で」というAIモデル市場に大きなインパクトを与える内容となっています。

コーディング、エージェント運用、研究用途など、幅広い領域で高性能モデルを使うコストを大きく引き下げる存在として注目されそうです。

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!
目次