🧠Research🔥🔥

Anthropic、Claude Opus 5 を検証──複数ファイルのリファクタリング効率と価格体系を公開

Claude Opus 5 を 1 週間検証し、複数ファイルにまたがるリファクタリングで Opus 4.8 比 2 倍以上の性能とセッション完走率の向上を確認した。
リリース: 2026-08-09 · 読了 3

記事の要約

1. 核心(What)

  • Anthropic は 2026 年 7 月 24 日に Claude Opus 5 をリリースし、Frontier-Bench v0.1 で Opus 4.8 比 2 倍以上の性能を達成した。
  • 価格は Opus 4.8 と同等で、Fable 5 の半額、Sonnet 5 の入力 1.7 倍に設定されている。
  • Adaptive thinking がデフォルトで有効化され、明示的な thinking フィールド指定が不要になった。
  • Claude Code の Fastモードでは標準の約 2.5 倍の出力速度を実現する。

2. 影響(Why)

  • マルチファイル作業の持続力向上: 5ファイル以上にまたがる変更でもコンテキストの欠損や手戻りが起きず、Sonnet 5 で 3 往復かかっていたリファクタリングを 1 セッションで完走できる。
  • 自己検証指示の最適化による工数削減: モデル自体に自己検証機能が標準装備されているため、プロンプトに「確認してください」等の指示を入れるとかえって過剰検証ループが発生し、トークンを無駄に消費する。

3. 根拠・詳細(How)

  • ベンチマークとコスト構造: Frontier-Bench v0.1 で Opus 4.8 比 2 倍以上の性能、CursorBench 3.2 で Fable 5 とほぼ同等のスコアを記録しつつ、価格は Opus 4.8 と同等水準を維持。
  • Adaptive thinking の仕様変更: thinking モードの自動有効化に伴い、Opus 4.8 時代の max_tokens 設定では不足するケースがあり、拡張や thinking: disabled と xhigh/max の同時指定制限(400エラー)への対応が必要。

4. 展望・課題(Next)

  • サブエージェント深度 3 の検証: 次回の記事では Claude Code のサブエージェント深度が 1 から 3 に変わったことによる機能拡張と体験談がまとめられる予定。