DEV Community

Cover image for クロードオプス5 vs フェイブル5: 半額の価値はある?
Akira
Akira

Posted on • Originally published at apidog.com

クロードオプス5 vs フェイブル5: 半額の価値はある?

Anthropicは2026年7月24日にClaude Opus 5をリリースしました。多くのチームが最初に確認すべき点は同じです。Opus 5がFable 5に近い性能を半額で提供するなら、どのワークロードでFable 5を使い続けるべきでしょうか。

今すぐApidogを試す

価格差は明確です。Opus 5は100万入力トークンあたり5ドル、100万出力トークンあたり25ドルです。Fable 5は入力10ドル、出力50ドルで、両方ともちょうど2倍です。Anthropicの発表では、Opus 5はCursorBench 3.2でFable 5のピークから0.5%以内に入り、OSWorld 2.0ではFable 5を3分の1のコストで上回るとされています。

自分のワークロードで比較する場合は、Apidogから同じプロンプトを両方のモデルIDに送信し、応答内容、レイテンシ、トークン使用量を並べて確認してください。

2つのモデルをひと目で比較

Claude Opus 5 Claude Fable 5
APIモデルID claude-opus-5 claude-fable-5
入力価格 $5 / MTok $10 / MTok
出力価格 $25 / MTok $50 / MTok
コンテキストウィンドウ 100万トークン(デフォルトおよび最大) 100万トークン
最大出力 128k(ベータヘッダー付きバッチで300k) 128k
知識カットオフ 2026年5月 2026年1月
ポジショニング Anthropicが推奨するデフォルト 最も高性能な広くリリースされたモデル
思考 適応型、デフォルトでオン、努力レベルで制御可能 常時オン
リリース日 2026年7月24日 2026年6月上旬

判断時には、特に次の2項目を確認してください。

  • 知識カットオフ: Opus 5は2026年5月、Fable 5は2026年1月です。2026年初頭以降に変化したライブラリ、フレームワーク、APIを扱う場合、Opus 5のほうが新しい情報を持っています。
  • モデルの位置付け: AnthropicはOpus 5を推奨デフォルトとしている一方、Fable 5を最も高性能な広くリリースされたモデルとして位置付けています。標準的な本番ワークロードではOpus 5、失敗コストが極めて高いタスクではFable 5を評価対象に残す、という使い分けができます。

Claude Opus 5とFable 5の比較

新モデルの仕様はClaude Opus 5解説、Fable 5の詳細はClaude Fable 5とは何かを参照してください。

Anthropicの実際の主張

Anthropicがリリース時に示した、Opus 5に関する比較上の主張は次のとおりです。

ベンチマーク AnthropicのOpus 5に対する主張
CursorBench 3.2 Fable 5のピークから0.5%以内、半額で
OSWorld 2.0(コンピューター利用) Fable 5を3分の1のコストで上回る
Frontier-Bench v0.1 他のすべてのモデルを上回る。Opus 4.8のスコアを2倍以上にする
ARC-AGI 3 次点のモデルの約3倍
Zapier AutomationBench 合格率が次点のモデルの約1.5倍
有機化学 Opus 4.8より+10.2ポイント
タンパク質分析 Opus 4.8より+7.7ポイント

ただし、重要な前提があります。これらはすべてベンダーが実施した評価です。 Anthropicが評価設定、努力レベル、実行条件を選択しています。2026年7月25日時点で、独立した再現結果はありません。

そのため、「Fable 5の0.5%以内」という数値は、特定のハーネスと構成における結果として扱う必要があります。自分のプロンプト、ツール、コンテキスト長、出力制約では、差が大きくなることも小さくなることもあります。

OSWorldの主張は、Opus 5がFable 5に近づくだけでなく、上回るとされている点で注目に値します。コンピューター利用タスクでは、単純な推論能力だけでなく、継続性、ツール操作、失敗からの回復が重要になるためです。一方、CursorBenchの「ピークから0.5%以内」という表現は、ピーク性能自体はFable 5が維持していることを示します。

各ベンチマークの測定対象と限界は、Opus 5ベンチマークの詳細分析を参照してください。Fable 5のリリース時ベンチマークはFable 5ベンチマークの投稿にあります。

Opus 5を選ぶべき理由

1. トークン単価が一貫して半額

Fable 5で月額3,000ドルかかるトークン量なら、Opus 5では同じトークン量で月額1,500ドルです。入力・出力ともに単価が半分のため、利用量が大きいほど差額は積み上がります。

2. バッチ・キャッシュ・努力レベルでさらに削減できる

Opus 5では、基本の単価差に加えてコスト最適化の選択肢があります。

  • バッチAPI料金: 入力$2.50 / 出力$12.50
  • キャッシュヒットとリフレッシュ: 100万トークンあたり$0.50
  • プロンプトキャッシュ最小値: 512トークン
  • tool_choiceautoまたはnoneの場合のツール利用システムプロンプトオーバーヘッド: 286トークン

キャッシュ最小値が512トークンに下がったため、短いシステムプロンプトもキャッシュ対象にしやすくなります。料金の詳細はOpus 5料金内訳、一般的な削減方法はClaude API請求額の削減を参照してください。

3. タスクに応じて努力レベルを調整できる

Opus 5ではoutput_config.effortを使用できます。デフォルトはhighです。

{
  "model": "claude-opus-5",
  "max_tokens": 8192,
  "output_config": {
    "effort": "high"
  },
  "messages": [
    {
      "role": "user",
      "content": "Refactor this handler and explain the tradeoffs."
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

実装では、ワークロード別に努力レベルを分けてください。

  • low: 分類、抽出、低リスクの定型処理
  • medium: 通常のコードレビュー、要約、変換
  • high: 複数ステップの実装、複雑な分析
  • xhigh: 難しいエージェントコーディングや高難度推論

重要なのは、Fable 5との比較を単純なモデル名の比較で終わらせないことです。「Fable 5の品質に近いOpus 5の努力レベルはどれか」を、自分の評価セットで測定してください。エフォートパラメータガイドでは、旧設定をそのまま引き継がずに実行すべき比較方法を説明しています。

4. より新しい知識カットオフ

Opus 5は2026年5月までの情報を持ち、Fable 5より4か月新しい知識カットオフです。急速に更新されるSDK、パッケージ、フレームワークを扱う場合は、モデル選定の実用上の差になります。

5. デフォルトモデルとしての採用範囲が広い

Opus 5はMaxサブスクライバーの新しいデフォルトであり、Proユーザーが利用できる最高性能のモデルです。Claude API、claude.ai、Claude Code、Claude Cowork、Amazon Bedrock、AWS上のClaude Platform、Google Cloud、Microsoft Foundry、GitHub Copilotで提供されています。

Anthropicのモデル概要でも、使用モデルに迷った場合はOpus 5から始めることが推奨されています。

Fable 5を選ぶべき理由

1. 最高性能モデルという位置付けは維持されている

AnthropicはOpus 5を推奨デフォルトとしていますが、最も高性能な広くリリースされたモデルという位置付けはFable 5のままです。

一度の失敗が高額な損失につながるタスクでは、トークン単価より性能上限を優先する合理性があります。たとえば、月額のAPI差額よりも、1回の失敗実行のコストが大きいケースです。位置付けの詳細はリリース発表を確認してください。

2. 常時オンの思考により設定上の失敗モードを減らせる

Fable 5はすべてのリクエストで思考が有効です。対してOpus 5では思考を無効化できますが、Anthropicのプロンプトガイドでは、思考無効時に以下のような問題が起こり得るとされています。

  • ツール呼び出しが実行されず、プレーンテキストとして出力される
  • 出力されたツール呼び出しテキストが、エージェントループの後続ターンに混入する
  • 内部XMLタグが可視出力に現れる

Anthropicは、思考を無効化する代わりに、思考を有効にしたまま努力レベルを下げてコストを制御する方法を推奨しています。

3. Opus 5への移行には設定変更が必要

Opus 5では、設定上の注意点があります。

  • thinking: {"type": "disabled"}xhighまたはmaxの努力レベルを同時に指定すると、リクエストごとに400エラーになる
  • thinkingフィールドを省略した場合、思考はデフォルトで実行される
  • 思考を考慮していないmax_tokens設定では、出力が切り捨てられる可能性がある
  • サブエージェントへの委譲や長いデフォルト応答により、制約がなければコストが増加する可能性がある

既存ワークロードを移す場合は、評価、プロンプト、トークン予算、コストモデルを見直してください。破壊的変更はOpus 4.8からOpus 5への移行ガイドで確認できます。

4. 小規模ワークロードでは移行コストが節約額を上回る

トークン単価が半額でも、移行コストはゼロではありません。たとえば、2人のエンジニアが1週間かけて評価・実装・監視をやり直す必要があり、利用量が小さい場合、移行による節約は正当化できないことがあります。

FableティアとOpusティアの一般的な違いはFable 5とOpus 4.8の比較、コスト構造はFable 5の料金設定を参照してください。

実際の利用で価格差がどうなるか

エージェントコーディングの1タスクで、入力20万トークン、出力2万トークンを使うケースを考えます。大規模リポジトリのコンテキストや長いツール呼び出し履歴がある場合に相当します。

Opus 5 Fable 5
入力(200k) $1.00 $2.00
出力(20k) $0.50 $1.00
タスクあたり $1.50 $3.00
月間500タスク $750 $1,500
月間5,000タスク $7,500 $15,000

月間500タスクなら差額は750ドルです。Fable 5が月に1回でも高コストな失敗を防げるなら、価格差を許容できる可能性があります。

一方、月間5,000タスクなら差額は月額7,500ドル、年間9万ドルです。この規模では、Fable 5を使い続けるなら、自分のワークロードで品質上の優位性を示す必要があります。

また、Opus 5の高速モードは出力速度が2.5倍で、ファーストパーティAPIのみの研究プレビューとして提供され、価格は入力10ドル・出力50ドルです。これはFable 5の基本料金と同じです。性能よりレイテンシが制約であれば、遅いFable 5ではなく高速なOpus 5を選ぶ余地があります。

なお、inference_geo: "us"はOpus 5のすべてのトークンカテゴリに1.1倍の乗数を加えるため、実際の料金は10%変動します。

ワークロード別決定フレームワーク

あなたのワークロード 選択 理由
エージェントコーディング、大量 Opus 5 AnthropicはCursorBenchでFable 5の0.5%以内、半額と報告。高ボリュームでは価格差が大きい
コンピューター利用とブラウザ自動化 Opus 5 AnthropicがOpus 5がFable 5を上回ると主張している直接比較
2026年1月以降のライブラリに触れる作業 Opus 5 2026年5月のカットオフ対2026年1月
コストに敏感な本番トラフィック Opus 5 半額、バッチ、512トークンキャッシュ最小、low/medium努力レベル
一回限りの高リスクな推論実行 Fable 5 依然としてAnthropicの最も高性能な広くリリースされたモデル
中途での失敗が高価になる長期間の自律セッション Fable 5 常時オンの思考、思考無効化によるアーティファクトなし、移行面が少ない
Fable 5で既に安定しており、低ボリューム Fable 5 移行コストが節約額を上回る可能性がある
サイバーセキュリティ攻撃または自律型生物学研究 どちらでもない これらの能力軸では両方ともMythos 5に劣る

要点は明確です。

Opus 5はスループット経済性で優れ、Fable 5はテールリスクで優れます。

大量に実行し、たまに弱い結果が出ても許容できるなら、Opus 5で請求額を半減させる効果は大きくなります。実行回数が少なく、1回の失敗が高価なら、価格差を最適化対象にするべきではありません。

自身のワークロードで比較を実行する

ベンダーベンチマークは、他社のタスクでの結果です。選定に使うべき数値は、自分の評価セットで取得してください。

両モデルは同じMessagesエンドポイントを使用するため、基本的にはモデル文字列を変えるだけで比較できます。

curl https://api.anthropic.com/v1/messages \
  --header "x-api-key: $ANTHROPIC_API_KEY" \
  --header "anthropic-version: 2023-06-01" \
  --header "content-type: application/json" \
  --data '{
    "model": "claude-opus-5",
    "max_tokens": 8192,
    "output_config": {"effort": "high"},
    "messages": [
      {"role": "user", "content": "Refactor this handler and explain the tradeoffs."}
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

claude-opus-5claude-fable-5に置き換えれば、同じリクエストをFable 5へ送信できます。

Apidogで比較環境を作る場合は、次の手順で実施します。

  1. APIキーを環境変数として保存し、リクエストボディに直接書き込まないようにします。
  2. モデルIDを環境変数化し、Opus 5用とFable 5用の環境を作成します。
  3. リクエストをコレクションとして保存し、両環境で同じシナリオを実行します。
  4. 各応答のusageフィールドを記録します。
  5. 入力、出力、キャッシュ読み取りトークンを比較します。
  6. エージェントを比較する場合は、SSEストリームとツール呼び出しペイロードを確認します。
  7. Opus 5ではlowmediumhighxhighの各努力レベルで繰り返します。
  8. 正答率だけでなく、レイテンシ、ツール実行成功率、再試行率、タスク完了率、トークン単価を集計します。

特にステップ6は重要です。ツール呼び出しが実行されたのか、モデルがツール呼び出しを単なるテキストとして返したのかは、最終レスポンスだけではなくイベントストリームで確認してください。

設定を始める場合は、Apidogをダウンロードするか、Opus 5 APIガイドのリクエスト手順を参照してください。公式料金はAnthropicの料金ページで確認できます。

正直な上限

この比較に含まれる2モデルは、どちらもAnthropicスタックの絶対的な上限ではありません。

Fable 5は最も高性能な広くリリースされたモデルとして位置付けられ、Opus 5は推奨デフォルトです。さらに、特定の能力軸ではMythos 5が上位にあります。Anthropicによれば、Opus 5は以下の分野でMythos 5に劣ります。

  • サイバーセキュリティ攻撃
  • 自律型生物学研究

Mythos 5は一般公開モデルではなく、限定プログラムと並行してFable 5とリリースされた分類器フリーの兄弟モデルです。そのため、ほとんどのチームにとって実用的な選択肢ではありません。資格要件はFable 5 vs Mythos 5の比較を参照してください。

Opus 5を正確に表現するなら、フロンティアクラスの性能を半額で提供するが、明確な性能上限は残っているモデルです。「最高のモデルが半額になった」と断定するのは、Anthropic自身がFable 5に性能上の冠を残している点を見落としています。

よくある質問

Claude Opus 5はFable 5より優れていますか?

Anthropic自身のベンチマークでは、Opus 5はOSWorld 2.0のコンピューター利用タスクでFable 5を上回り、CursorBench 3.2ではFable 5のピークの0.5%以内に位置しています。ただし、これらはベンダー実施の評価であり、2026年7月25日時点で独立再現はされていません。AnthropicはFable 5を最も高性能な広くリリースされたモデルと位置付けています。

Opus 5はFable 5よりどれくらい安いですか?

入力・出力ともに正確に半額です。

  • Opus 5: 入力$5 / MTok、出力$25 / MTok
  • Fable 5: 入力$10 / MTok、出力$50 / MTok

Opus 5のバッチAPIでは、入力$2.50 / MTok、出力$12.50 / MTokです。

どちらのモデルがより新しい知識カットオフを持っていますか?

Opus 5です。Opus 5のカットオフは2026年5月、Fable 5は2026年1月で、4か月の差があります。

Fable 5のワークロードをOpus 5に移行すべきですか?

まず月間タスク数を見てください。月間数百件以下の難しいタスクでは、節約額が移行作業に見合わないことがあります。月間数千件を超える場合は、Opus 5での評価結果が品質要件を満たすなら、移行価値が高くなります。

それぞれのモデルIDは何ですか?

  • Opus 5: claude-opus-5
  • Fable 5: claude-fable-5

どちらも日付サフィックスはありません。Amazon Bedrockでは、Opus 5はanthropic.claude-opus-5です。

Opus 5がサポートしていてFable 5がサポートしていないものはありますか?

Opus 5は以下を提供します。

  • 再調整されたoutput_config.effort
  • 会話途中のシステムメッセージ
  • 入力$10 / 出力$50の高速モード
  • 512トークンからの短いプロンプトキャッシュ

一方、Priority TierはOpus 5ではサポートされていません。Opus 4.8はこれを保持しています。

簡潔な回答

ほとんどのチームでは、Opus 5の半額という価格は有力な選択理由になります。重要なのは単発の性能比較よりもボリュームです。Anthropicの数値では、Opus 5はエージェントコーディングでFable 5に十分近く、コンピューター利用では優位とされ、月間数千タスク規模では2倍の価格差が予算に大きく影響します。

さらに、2026年5月という新しい知識カットオフと、努力レベルによる調整機能があります。標準的なデフォルトとしては、Opus 5から評価を始めるのが実用的です。

Fable 5を使い続けるべきなのは、タスクがモデル性能の限界に近い場合、1回の失敗コストが高い場合、または利用量が少なく移行コストを回収できない場合です。

最終判断では、ベンダーベンチマークではなく、自分の評価セットを基準にしてください。

Top comments (0)