Anthropic / Claude / Claude Code のロゴ

Anthropic / Claude / Claude Code / 公式ブログ / 2026/07/24 / 重要

Claude Opus 5が長時間エージェントと知識業務を強化

AImodeldeveloper

公式ブログ原文

AnthropicがClaude Opus 5を提供開始しました。長時間のコーディングエージェント、知識業務、コンピューター操作、科学分析でOpus 4.8を上回り、同じトークン単価を維持したモデルです。

要点

  • API モデルIDはclaude-opus-5
  • 料金は入力100万トークン当たり5ドル、出力25ドルでOpus 4.8と同額
  • Claude Maxの既定、Claude Proで利用できる最上位モデルになる
  • 思考量設定により品質、トークン消費、遅延の折り合いを付ける

今回のブログ記事で語られていること

Claude Opus 5は、Anthropicが日常的に使えるOpusとして位置付ける第5世代モデルです。同社はClaude Fable 5に近い知能を半分の価格帯で提供すると説明し、コーディングと知識業務の評価で新しい最高水準に達したとしています。ただしサイバーセキュリティタスクではMythos 5より下だとも明記しています。価格はOpus 4.8から変わらず、APIではclaude-opus-5を指定します。

主な変化は、難しいタスクを一度答えて終えるのではなく、自分の作業を検証し、失敗の根本原因を探し、成功するまで方針を変えられる点です。公式例では、図面を直接見られない条件でピクセルから形状を取り出すコンピュータービジョンパイプラインを自作し、3D CAD モデルを再構築しました。別の例ではOSS パッケージマネージャーの不具合について表面的な症状ではなく根本原因と未対応のエッジケースを修正し、市場データ配信ではライブ映像がない状況でテスト環境まで作っています。長時間エージェント、デバッグ、財務分析、文書作成、コンピューター操作の利用者報告も紹介されています。

ベンチマークは利用判断の参考になりますが、そのまま自社タスクの成功率を保証しません。Anthropicは思考量設定ごとの性能と費用を比較しており、高い能力のモデルでも低い思考量ならタスク全体のコストを抑えられる場合があると示しています。科学分野では有機化学やタンパク質関連評価の改善、視覚出力では対話型な風洞や細胞図解も例示しました。保護策はOpus 4.8に近く、一部の狭いサイバータスクには強いガードレールを置いています。

そのため導入評価では、最高得点だけでなく、長時間処理の完了率、途中復旧の回数、成果物を人が直す時間まで測る必要があります。

今回のブログ記事が関係する人

Claude API、Claude Code、知識業務エージェントを運用する開発者とモデル選定担当に関係します。移行前に、自社評価、トークン使用量、遅延、ツール成功率、代替、サイバータスクの制限を測る必要があります。

結局、今回のブログ記事をどう読むべきか

Opus 5の価値は最高得点だけでなく、長いタスクで検証と修正を続ける安定性です。Opus 4.8を使うワークフローは同じ料金で候補にできますが、Fable 5や軽量モデルを含むタスク単位の比較が必要です。