
AnthropicがClaude Opus 5を発表、Fable 5に迫る性能を半額で提供
公開日:
Anthropicは2026年7月24日、新しい大規模言語モデル「Claude Opus 5」を発表しました。このモデルは、最上位モデル「Claude Fable 5」に迫る性能を持ちながら、価格は半分に抑えられています。コーディングや知識処理の評価で新たな最高水準を達成し、日常的な利用に適した効率性を備えています。すでに全プラットフォームで利用可能で、Claude Maxのデフォルトモデル、Claude Proの最強モデルとして提供されます。
ポイント
- 1コーディング評価「Frontier-Bench」で全モデル中最高スコアを達成
- 2Claude Fable 5に迫る性能を半額で提供し、コスト効率が大幅に向上
- 3科学分野や自律的な検証能力が強化され、研究・開発用途での信頼性が向上
性能とコスト効率
Claude Opus 5は、前世代のOpus 4.8と同じ価格でありながら、性能が大幅に向上しています。ソフトウェア工学の評価「Frontier-Bench v0.1」では、他のすべてのモデルを上回り、Opus 4.8の2倍以上のスコアを記録しました。「CursorBench 3.2」では、最大努力時にFable 5のピークスコアと0.5%差に迫り、コストあたりの性能では全モデルを凌駕しています。知識処理や問題解決の評価でも優れており、「ARC-AGI 3」では次点モデルの3倍のスコアを獲得しました。また、科学分野では有機化学やタンパク質関連のタスクでOpus 4.8を大きく上回る成果を示しています。
自律性と徹底性
Opus 5は自らの作業を検証し、成功するまで注意深く反復する能力が強化されています。例えば、機械部品の図面から3Dモデルを再構築するタスクでは、モデル自身がコンピュータビジョンのパイプラインを構築して課題を解決しました。また、オープンソースのパッケージマネージャーのバグ修正では、表面的な症状ではなく根本原因を特定し、コミュニティのパッチが見落としたエッジケースを修正しています。金融機関のエンジニアが市場データフィードを1セッションで構築した事例も報告されており、テストハーネスを自ら作成してコードの正確性を検証するなど、高い自律性を示しています。
安全性とアライメント
AnthropicはOpus 5を最も安全性の高いモデルと位置づけています。自動化された行動監査では、Opus 4.8やSonnet 5、Fable 5と比較して、Claudeの憲章への準拠度が高く、欺瞞的行動の発生率が最も低い結果となりました。サイバーセキュリティ分野では、脆弱性の発見能力はMythos 5に迫るものの、エクスプロイトの開発能力では大きく後れを取っています。また、生物学分野では、長期的な自律研究タスクにおいて依然として重要な制限があるとされていますが、一般利用可能なモデルとしては最も高性能です。
利用方法と価格
Claude Opus 5は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドルで提供され、全プラットフォームですぐに利用できます。高速モードも用意されており、デフォルトの約2.5倍の速度で動作します。高速モードは基本価格の2倍で利用可能です。また、会話の途中でツールを変更できる機能や、安全性分類器によってブロックされたリクエストを自動的に別のモデルにルーティングする機能がベータ版として同時にリリースされました。
Q&A
Q. Claude Opus 5とは何ですか?
A. Anthropicが2026年7月24日に発表した新しい大規模言語モデルで、最上位モデルに迫る性能を半額で提供し、コーディングや知識処理で高い評価を得ています。
Q. Opus 5は以前のモデルと比べて何が向上しましたか?
A. 同じ価格で性能が大幅に向上し、特にコーディングや科学分野のタスクでスコアが改善され、自律的な検証能力も強化されています。
Q. Opus 5の安全性はどのように確保されていますか?
A. 自動監査で最も高いアライメントスコアを達成し、サイバーセキュリティや生物学分野でのリスクを抑制するための分類器や制限が組み込まれています。

O!Productニュース編集部からのコメント
Opus 5、Fable 5に0.5%差まで迫りつつ半額はかなりコスパいいですね。コーディングや科学系タスクをよく使うチームなら、まずこちらで十分かもです。
引用元:Anthropic
この記事の著者
O!Productニュース編集部








