LLM Frontline
ニュース・動向

AnthropicのClaude Opus 5を業務目線で読む|同価格のまま「毎日使う既定モデル」へ

イツキ編集長 / ニュース・動向担当
・ 約12分で読めます
AnthropicのClaude Opus 5を業務目線で読む|同価格のまま「毎日使う既定モデル」へ

Anthropicは2026年7月24日、Claude Opus 5を公開しました。世代交代の発表ですが、業務目線でいちばん効くのは性能の見出しよりも「料金を前世代Opus 4.8と同額に据え置いたまま、Claude Maxの新しい既定モデルに置いた」という一点です。最上位のFable 5を切り札として難所に投入する使い分けは前回整理しましたが、今回のOpus 5は毎日の作業を回す既定の座を狙った更新です。この記事では公式とシステムカード、報道で確認できた範囲を事実ベースで押さえ、どこでOpus 5を常用し、どこで上位のFable 5や専門特化のMythos 5へ委譲するかを、数値はすべてベンダー公表値である前提で切り分けます。

何が公開されたのか

まず事実を淡々と押さえます。Anthropicは2026年7月24日にClaude Opus 5を公開し、同日付のシステムカードも公開しています。APIのモデル指定子はclaude-opus-5で、Claude Platform(API)から利用できます。加えて、Claude Maxでは新しい既定モデルに、Claude Proでは最も強いモデルに据えられたと案内されています。

強化点としてAnthropicが前面に出しているのは、賢さの絶対値というより「エージェント的な丁寧さ」です。公式は、Opus 5が自分の作業を検証し、成功するまで粘り強く反復する挙動が従来より強くなったと説明しています。手順の多い作業を任せたときに、途中の取りこぼしや誤りを自分で見つけて直しにいく方向の改善で、これは1回の賢さより「最後までやり切れるか」が効くエージェント用途に直結します。

あわせて読みたい

AnthropicのClaude Opus 4.8を業務目線で読む|何が変わり、何は変わらないか

「同価格のまま既定へ」という更新点

今回の肝は価格です。Opus 5の料金は入力100万トークンあたり5ドル、出力100万トークンあたり25ドルで、前世代Opus 4.8とまったく同額に据え置かれました。つまり単価を上げずに世代を進め、そのモデルをMaxの既定に置いた、という構図です。値上げを伴わない世代更新は、すでにOpus 4.8で運用を組んでいる現場にとって、コスト試算を作り直さずにそのまま乗り換えを検討できる意味を持ちます。

上位との距離も詰まったとされます。最上位のFable 5は入力10ドル/出力50ドル(いずれも100万トークンあたり)で、Opus 5はその約半分の価格です。にもかかわらずAnthropicは、Opus 5がFable 5の知能に迫ると説明しています。具体例として、コーディング系のCursorBench 3.2ではFable 5のピークスコアと0.5%以内の差でありながら、タスクあたりのコストは半分だと整理しています。数字どおりに受け取れるなら、これまでFable 5でしか届かなかった一部の難所が、Opus 5の価格帯でも現実的な選択肢に入りうる、という更新です。

メモ

「Fable 5に迫る」「コストは半分」はいずれもAnthropicが選んだベンチと条件での説明で、あなたの実タスクでの差を保証するものではありません。近づいたのはあくまで一部の指標上の話で、後述のとおり専門特化の領域では依然として上位・特化モデルに譲る場面があります。まずは自社の代表タスクで、Opus 5とFable 5の出力を並べて差分が実在するか確かめてから、どちらを常用に置くか決めるのが堅実です。

速度の選択肢としてFastモードも用意されています。公式によると、既定の約2.5倍の速度で動く一方、価格は2倍です。応答の速さが体験や処理量に効く用途では、単価が上がっても総処理時間で見合う場合があります。ここも「速い=常に得」ではなく、遅延と単価のどちらが自分たちのボトルネックかで選ぶ判断です。

注意

ここに挙げた単価・速度・比較はすべて本記事時点でAnthropicが公表した値です。料金体系やモデルの位置づけは改定され得ますし、実コストは想定トークン量・キャッシュ・Fastモードの有無で大きく動きます。導入前・見積り前には必ず公式の料金ページと最新のモデル一覧で現行値を確認し、自社の想定トークン量で試算してください。「単価が据え置き」でも「総コストが同じ」とは限りません。

あわせて読みたい

LLMのコスト管理|トークン課金の考え方と削減の定石

Anthropic公表のベンチをどう読むか

Opus 5には多くのベンチ結果が添えられていますが、いずれもAnthropicが選んだ指標である点を割り引いて読むのが前提です。そのうえで、公表されている先行項目を用途の当たりをつける参考として並べます。

  • ソフトウェア開発を測るFrontier-Bench v0.1では、Anthropicは全モデルを上回るとしています。
  • 抽象推論のARC-AGI 3では、次点の約3倍のスコアと説明されています。
  • 業務自動化を測るZapier AutomationBenchでは、合格率が次点の約1.5倍とされています。
  • コンピュータ操作のOSWorld 2.0では、同一コスト帯で他を上回るとしています。
  • 知識労働を測るGDPval-AAでも最高水準と説明されています。

これらは「何が得意そうか」の見取り図としては有用です。抽象推論・業務自動化・コンピュータ操作・知識労働といった、まさにエージェント的な作業に寄った項目で先行がうたわれており、前述の「自分の作業を検証し反復する」強化点と方向がそろっています。

注意

ここで挙げた「約3倍」「約1.5倍」などの倍率は、いずれもAnthropicが公表したベンチマーク値で、特定のデータセット・時点での結果です。自社の実タスクの精度をそのまま保証しません。倍率は相対比較であり、対象や測定条件が変われば振れます。数字は候補を絞る入り口にとどめ、採否は自分たちのデータで検証してから判断してください。

どこで使い、どこでFable 5・Mythos 5へ委譲するか

使い分けの軸は「常用か、難所か、専門特化か」です。Anthropicのモデル階層は、最上位にFable 5、専門特化系のMythos 5、その下にOpus、さらにSonnetという並びで整理できます。Opus 5は、この中で毎日の作業を回す既定の位置に置かれたモデルです。

既定モデルが値上げなしで賢くなるのは、試算を作り直さずに乗り換えを検討できるのでありがたいです。うちは工程ごとにモデルを割り当てているので、常用の底上げと、難所だけ上位へ回す線引きは分けて考えています。
社内でAIエージェント基盤のコストを見ている運用担当者

Opus 5を常用に置くのが向くのは、コーディングや調査、資料作成、コンピュータ操作を含む定型のエージェント作業など、量があり毎日回す工程です。同価格でエージェント的な丁寧さが上がったぶん、これまでOpus 4.8で回していた作業はそのまま底上げを見込めます。

一方で、上位や特化へ委譲すべき場面も明確です。数日にわたる長時間・非同期の最難関タスクや、Opus 5とFable 5を並べて明確な差が出た工程は、コストを払ってでも最上位のFable 5に投入する価値があります。逆にサイバーセキュリティ課題や自律的な生物研究のような専門領域では、Anthropic自身がOpus 5はMythos 5に及ばないと認めています。これらの領域は、賢さの一般値ではなく特化の有無で結果が変わるため、素直に特化系へ委ねるのが現実的です。工程ごとに「常用はOpus 5、最難関はFable 5、専門特化はMythos 5」と割り当てる設計にすると、品質とコストを両立しやすくなります。

あわせて読みたい

AnthropicのClaude Fable 5を業務目線で読む|最上位モデルの立ち位置と、輸出規制からの再展開

小さく試す進め方

  1. 1

    Opus 4.8で回している工程をそのまま置き換える

    まず既存でOpus 4.8を使っている代表工程を1つ選び、Opus 5に差し替えて動かします。料金が同額なのでコスト前提を変えずに比較でき、エージェント的な丁寧さの底上げが実タスクに出るかを見やすいです。
  2. 2

    やり切れたかと手数の両方を記録する

    出力品質だけでなく、途中の取りこぼしを自分で直せたか、完了までの反復回数やムダなループが減ったかを記録します。エージェント用途では「最後まで到達したか」がOpus 5の強化点を測る核です。
  3. 3

    難所だけFable 5と並べて差分を確かめる

    自社で一番難しい代表タスクに絞り、Opus 5とFable 5の出力を並べます。明確な差が出た工程だけをFable 5へ委譲し、差が小さければOpus 5の常用のままにします。
  4. 4

    専門特化はMythos 5へ回す線引きをする

    サイバーや生物研究のような特化領域は、Opus 5で押し切らずMythos 5など特化系へ回す境界を先に決めます。Fastモードは、遅延がボトルネックの工程に限って単価2倍と引き換えに検討します。

本記事の公開日・モデル指定子・料金・Fastモード・ベンチ項目・Mythos 5との比較は、Anthropicの公式発表とシステムカード、公式のモデル一覧、およびtech-ishの報道で確認できた範囲に基づきます。ベンチマーク値・速度・価格・倍率はいずれもベンダー公表値で、実タスクの精度を保証するものではありません。料金・数値は改定や時点・構成で変わりうるため、導入前に各公式ページで最新値を確認してください。

よくある質問

Claude Opus 5はいつ公開され、どう指定しますか
Anthropicの公式発表によると、2026年7月24日に公開され、同日付のシステムカードも出ています。APIのモデル指定子はclaude-opus-5です。Claude Maxの新しい既定モデル、Claude Proで最も強いモデルという位置づけで、Claude Platform経由で利用できます。
料金はOpus 4.8から上がったのですか
上がっていません。公式によると入力100万トークンあたり5ドル、出力25ドルで、前世代Opus 4.8と同額です。加えて既定の約2.5倍速で動くFastモードが価格2倍で用意されています。いずれもベンダー公表値で、実装前に公式の最新料金を確認してください。
最上位のFable 5と比べてどうですか
Anthropicは、Opus 5がFable 5(入力10ドル/出力50ドル)の約半分の価格でその知能に迫ると説明しています。CursorBench 3.2ではFable 5のピークスコアと0.5%以内の差でタスクあたりコストは半分、との整理です。ただしこれは同社が選んだ指標での説明で、自社タスクでの差は並べて検証する前提です。
どんな場面ならFable 5やMythos 5へ委譲すべきですか
数日にわたる長時間・非同期の最難関タスクや、Opus 5と並べて明確な差が出た工程は最上位のFable 5に投入する価値があります。サイバーセキュリティや自律的な生物研究のような専門特化領域は、Anthropic自身がOpus 5はMythos 5に及ばないとしており、特化系へ委ねるのが現実的です。
公表されているベンチはそのまま信じてよいですか
参考にとどめてください。Frontier-Bench v0.1やARC-AGI 3(次点の約3倍)、Zapier AutomationBench(合格率が次点の約1.5倍)などで先行するとされますが、いずれもAnthropicが選んだ指標・条件での値です。倍率は相対比較で振れます。候補を絞る入り口として使い、採否は自社データで検証してください。

まとめ

Claude Opus 5を業務で見るときの確認事項

  • 2026年7月24日公開、モデル指定子claude-opus-5、Claude Maxの既定・Claude Proで最強という位置づけを押さえた
  • 料金は入力5ドル/出力25ドル(100万トークンあたり)でOpus 4.8と同額、という据え置きを、変動前提のベンダー公表値として確認した
  • 自分の作業を検証し反復するエージェント的な丁寧さの強化を、実タスクで『最後までやり切れたか』の観点で測る計画を立てた
  • Fable 5とは代表タスクを並べて差分を確かめ、明確な差が出た工程だけ委譲する線引きを持った
  • サイバーや生物研究などの専門特化はMythos 5へ回し、Fastモードは遅延がボトルネックの工程に限って単価2倍で検討する、と整理した

Claude Opus 5は、賢さの見出しよりも「同価格のまま既定を底上げする」という運用面の更新として読むと実務にはまります。単価をOpus 4.8に据え置いたままエージェント的な丁寧さを強化し、一部の指標では最上位Fable 5に迫るとされる一方、専門特化ではMythos 5に譲る。だからこそ、常用はOpus 5、最難関はFable 5、専門特化はMythos 5と工程ごとに割り当てる設計が生きます。公表値はあくまで比較の入り口です。まずはOpus 4.8で回している工程をそのまま置き換え、やり切れたかと手数を数字で突き合わせてから広げる。この冷静な使い分けが、同価格の世代更新を宣伝の期待値ではなく実コストに見合う形で取り込む近道だと考えます。

あわせて読みたい

AnthropicのClaude Sonnet 5を業務目線で読む|Opusに迫る性能と低価格の使いどころ

あわせて読みたい

主要LLMの選び方|用途別の考え方と「使い分け」の基準

出典・参考

この記事をシェア

関連する記事

ニュース・動向

AnthropicのClaude Opus 4.8を業務目線で読む|何が変わり、何は変わらないか

Anthropicが2026年5月28日に公開したClaude Opus 4.8を、業務利用の観点から冷静に整理します。Opus 4.7からの改良点、据え置きの料金と2.5倍速のfast mode、Super-Agentやツール呼び出しの主張、Claude Codeのdynamic workflowsを、ベンダー公表値・変動前提として読み解き、小さく検証して広げる手順まで具体的に示します。

ニュース・動向

AnthropicのClaude Fable 5を業務目線で読む|最上位モデルの立ち位置と、輸出規制からの再展開

AnthropicのClaude 5世代の最上位モデル、Claude Fable 5を業務利用の観点から冷静に整理します。既定100万トークンのコンテキストや1リクエスト最大12.8万出力トークン、入力10ドル/出力50ドル(100万トークンあたり)といった公式・報道で確認できた仕様、長時間・非同期の複雑なタスク向けという位置づけ、そして輸出規制による一時停止から分類器を強化しての再展開という経緯を、変動前提で読み解きます。最上位を使う場面とOpus 4.8などへ委譲する場面の切り分けまで具体的に示します。

ニュース・動向

AnthropicのClaude Sonnet 5を業務目線で読む|Opusに迫る性能と低価格の使いどころ

Anthropicが2026年6月30日に公開したClaude Sonnet 5を、業務利用の観点から冷静に整理します。Opus 4.8に迫るとされる性能、8月31日までの導入価格と標準価格、Free/Proのデフォルト化、agenticな用途での主力化のしどころを、ベンダー公表値・変動前提で読み解き、コスト最適化の手順まで具体的に示します。