Anthropic、モデル Claude Opus 5 を発表──ARC-AGI-3 スコアを 3 倍に向上し半額で提供
Anthropic がコードネーム Honeycomb と呼ばれた Claude Opus 5 を公開し、上位モデル Fable 5 に迫る推論能力を前モデルと同額の $5/$25 で実現した。
リリース: 2026-07-24 · 読了 3 分記事の要約
1. 核心(What)
- Anthropic はコードネーム Honeycomb として開発されていた Claude Opus 5 を公開した。
- 本モデルはコーディングおよびナレッジワークの評価において、新たな State-of-the-Art を記録した。
- 価格設定は従来モデルの Opus 4.8 と同等であり、競合の最上位モデルと比較して高いコストパフォーマンスを持つ。
2. 影響(Why)
- 高価格帯モデルからの置き換え: 月間数万ドルの API コストを計上する国内の対話型 AI 開発企業や SaaS ベンダーは、Fable 5 級の性能を $5/$25 で利用できる Opus 5 へ段階的に移行することで、推論コストを直接半分に圧縮できる。
- 高度な推論タスクの実装現実解: ARC-AGI-3 での圧倒的なスコア向上により、複雑なアルゴリズム生成や複数ステップの検証を伴う開発支援エージェントの構築において、従来モデルでは許容できなかったレイテンシとコストの制約がクリアになる。
3. 根拠・詳細(How)
- 価格とコストパフォーマンスの構造: 入力 $5、出力 $25(各 100 万トークンあたり)の価格体系を維持しながら、Mythos クラスに近い推論性能を発揮するよう最適化された。
- ベンチマーク検証結果: コードネーム Honeycomb として追跡されていたアーキテクチャ改良により、ARC-AGI-3 で他社製モデルの 3 倍に達するスコアを実証した。
4. 展望・課題(Next)
- API の即日提供と適用範囲の拡大: 本日から API 経由での利用が可能になっており、既存の Opus 4.8 からの置き換え検証が順次進む見通し。