Claude Opus 5を使ってみた。Fable 5級の性能を「普段の仕事」にできるモデル
AnthropicがClaudeの新モデル「Opus 5」を発表しました。日本時間では2026年7月25日に利用可能になったモデルです。
公式の説明では、最上位のFable 5に近い性能を、Opus 4.8と同じ料金で使えるモデルとされています。ただ、ベンチマークの数字だけでは普段の仕事で使えるかは分かりません。そこでこの記事では、公式発表の要点と、実際にサイト制作を任せてみたときの印象を分けて整理します。
Opus 5は「Fable 5の廉価版」と考えるより、普段使いの主役候補
Opus 5のAPI料金は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドルです。これは前モデルのOpus 4.8と同じ料金で、Fable 5の10ドル/50ドルと比べると半額です。
Anthropicは、コーディングやナレッジワークの評価でOpus 5が新しい最先端になったと説明しています。CursorBenchでは、最大の思考量を設定したときにFable 5のピークに近いスコアを、半分のタスク料金で出したという結果も公開されています。
ただし、これはあくまでAnthropicが公開した評価です。すべての仕事でFable 5を上回るという意味ではありません。Fable 5は長時間の自律タスクなど、最も難しい仕事向けのモデルとして残ります。
現時点での見方としては、Opus 5は「Fable 5より安い下位モデル」というより、十分に考えてほしい仕事を日常的に任せるための主役候補、と考えるのが近そうです。
公式情報から分かるOpus 5の特徴
- Claude APIのモデルIDは
claude-opus-5 - 入力5ドル、出力25ドルというOpus 4.8と同じ料金
- 1Mトークンのコンテキストウィンドウと最大128kトークンの出力
- 思考量をlow、medium、high、xhigh、maxから選べる
- Claude Maxでは標準モデル、Claude Proでは最上位モデルとして利用できる
- Fastモードでは通常の約2.5倍の速度で動作するが、料金は通常の2倍
思考量を調整できるため、簡単な文章作成では軽く、設計やデバッグでは深く考えさせるという使い分けができます。モデルを変えずに、仕事の重さに合わせて計算量を変えられるのは実用的です。
一方で、Opus 5ではWeb Fetchが使えない、Priority Tierに対応しないなど、Opus 4.8から移行する際に確認したい差分もあります。APIで利用する場合は、料金だけでなくツールの対応状況も確認が必要です。
実際に使って感じた「行間を読む」力
ここからは、僕がOpus 5を使ってみた感想です。
まず感じたのは、短い指示から意図をくみ取るのがうまいことです。指示の文字面だけを実行するのではなく、「この人は最終的に何をしたいのか」を推測して、必要な確認や提案を返してくれます。
単純に思考が深いだけでなく、こちらへの配慮が細かい。途中で迷いそうなポイントを先に説明したり、作業を進める前に選択肢を並べたりするため、会話のテンポが人間に近く感じられました。
もちろん、毎回正しいわけではありません。大事な変更では確認が必要です。ただ、間違えたときに自分の判断や前提を説明し、修正案まで出すところは、これまでのOpus系モデルから大きく進歩した印象があります。
サイト制作を任せて分かった、慎重な進め方
ちょうど作りたいサイトがあったため、最初の構築をOpus 5にまとめて任せてみました。半日ほどで公開直前の状態まで進み、細かな修正を指示しながら作業を続けられました。
驚いたのは、いきなりコードを書き始めなかったことです。必要な機能と利用者の動きを整理したうえで、先にワイヤーフレームを作り、「この機能ならこの配置が自然だと思います」と提案してきました。
Fable 5やGPT-5.6 SOLでも、最終的には良いものを作れます。ただ、こちらが細かく進め方を指定しない場合は、かなり積極的に先へ進む印象があります。Opus 5は、作る前に確認し、途中で検証し、必要なら自分で修正する流れが自然でした。
この性格なら、仕様を一行ずつ固めてから実装する仕様駆動開発にも、アイデアを話しながら形にするバイブコーディングにも対応できます。特に、完成形がまだ曖昧なサイトやツールでは、Opus 5の提案力が役に立ちそうです。
Fable 5、GPT-5.6 SOLとどう使い分けるか
僕の感覚では、Fable 5は「難しい仕事を最後まで走り切らせる」モデル、GPT-5.6 SOLは「複数の作業を進めながら成果物まで持っていく」モデルです。Opus 5はその間に入り、考えながら相談できる設計担当のような立ち位置に見えます。
たとえば、次のような使い分けが考えられます。
- 要件が曖昧で、相談しながら方向を決めたい:Opus 5
- 決まった仕様をもとに、長い作業を完遂させたい:Fable 5やGPT-5.6 SOL
- 実装前に抜け漏れやリスクを洗い出したい:Opus 5
- 大量のファイルを変更し、テストまで一気に進めたい:作業環境に合うエージェントモデル
ただし、モデルの得意分野は使うツールや指示の出し方でも変わります。Opus 5だけで完結させるより、Claudeで設計を詰め、Codexなどで実装する分業も現実的です。
最初に試すなら、正解が一つではない仕事
Opus 5を試すなら、短い質問への回答よりも、何度か判断が必要になる仕事を任せるのがおすすめです。サイトの構成案、既存コードの改善、長い資料の整理、複数の案を比較した企画などが向いています。
最初から「全部いい感じにやって」と丸投げするのではなく、目的と制約だけを伝え、どんな計画を立てるかを見る。そのうえで、任せる範囲と確認するポイントを決めると、Opus 5の良さが分かりやすくなります。
まとめ:Fable 5級の性能を、仕事の定番モデルにできるか
Claude Opus 5は、公式ベンチマークでFable 5に近い性能を示しながら、Opus 4.8と同じ料金で使えるモデルとして登場しました。
実際に触ってみると、性能の高さだけでなく、確認・提案・検証を挟みながら進める姿勢が印象に残ります。Fable 5を毎回使うほどではないけれど、軽いモデルでは不安な仕事を任せたい。そんな場面の標準モデルになり得ると感じました。
まだ初日の感想なので、長期間の利用でどこまで安定するかはこれから確認します。まずは自分の仕事の中から、考える時間が長く、途中の判断が多いタスクを一つ選んで試すのがよさそうです。