Claude Fable 5.1の料金ガイド:キャッシュで最大45%削減する方法
Claude Fable 5.1の料金は、入力トークン100万あたり10ドル、出力トークン100万あたり50ドルで、Fable 5から変更ありません。変更点はプロンプトキャッシュの読み取り料金です。Fable 5の1ドルから0.25ドル(Opus 5の半額)に値下げされ、Anthropicによると通常のワークロードで約25%、エージェント中心のワークロードで最大約45%安くなります。
このガイドでは、公式料金ページの料金、25%および45%の削減率を再現する計算、タスク別のコスト例、料金を左右する要素をまとめます。モデルの概要は、Claude Fable 5.1とは何かをご覧ください。
Claude Fable 5.1の料金表
| 料金 | Claude Fable 5.1 |
|---|---|
| 基本入力 | トークン100万あたり$10 |
| 出力 | トークン100万あたり$50 |
| 5分キャッシュ書き込み | トークン100万あたり$12.50(入力の1.25倍) |
| 1時間キャッシュ書き込み | トークン100万あたり$20(入力の2倍) |
| キャッシュ読み取り(ヒットまたは更新) | トークン100万あたり$0.25(入力の0.025倍) |
| バッチAPI入力 | トークン100万あたり$5 |
| バッチAPI出力 | トークン100万あたり$25 |
| 長文コンテキストプレミアム | なし。1Mのフルウィンドウも標準料金 |
inference_geo: "us" |
すべてのトークンカテゴリで1.1倍 |
| 高速モード | 利用不可(Opus 5およびOpus 4.8のみ) |
| プライオリティティア | サポート対象外 |
| ウェブ検索 | 検索1,000回あたり$10、プラストークン料金 |
Claude Mythos 5.1も同じ料金です。バッチ割引とキャッシュ乗数を適用すると、バッチ処理されたキャッシュ読み取りは100万トークンあたり$0.125になります。
キャッシュ読み取り料金の比較
| モデル | 基本入力 | キャッシュ読み取り | 入力に対する割合 |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $0.25 | 2.5% |
| Claude Fable 5 | $10 | $1.00 | 10% |
| Claude Opus 5 | $5 | $0.50 | 10% |
| Claude Opus 4.8 | $5 | $0.50 | 10% |
| Claude Sonnet 5 | $2 | $0.20 | 10% |
| Claude Haiku 4.5 | $1 | $0.10 | 10% |
他のClaudeモデルでは、キャッシュヒットは基本入力料金の10%です。Fable 5.1では2.5%に下がっています。
Fable 5.1のキャッシュされていない入力はOpus 5の2倍ですが、キャッシュヒットはOpus 5より安価です。入力の大部分がキャッシュ済みプレフィックスになるワークロードでは、Fable 5.1の実効入力レートがOpus 5を下回る可能性があります。
Sonnet 5については、Opus 5とSonnet 5の比較で指摘されていた9月の値上げがキャンセルされました。料金は$2と$10に据え置かれます。
25%と45%の削減率を再現する
Anthropicはワークロードの詳細な内訳を公開していません。以下は示唆されているキャッシュヒット率を使った再構築であり、Anthropicの正確な計算式ではありません。
1リクエストあたりのトークンを次のように定義します。
- キャッシュされていない入力:
U - キャッシュされた入力:
C - 出力:
O
100万トークン単位の料金は次のとおりです。
- Fable 5:
10U + 1.0C + 50O - Fable 5.1:
10U + 0.25C + 50O
節約額は 0.75C、節約率は次の式になります。
0.75C / (10U + C + 50O)
典型的なチャット
1リクエストあたり、キャッシュ済み入力20,000トークン、キャッシュされていない入力2,000トークン、出力1,500トークンとします。
Fable 5:
10(0.002) + 1.0(0.02) + 50(0.0015)
= $0.02 + $0.02 + $0.075
= $0.115
Fable 5.1:
$0.02 + $0.005 + $0.075
= $0.100
節約率は13%です。
25%に到達するには、出力に対してキャッシュ済み入力がさらに大きくなる必要があります。例えば、出力1,500トークンに対してキャッシュ済み入力が60,000トークンなら、料金は$0.155から$0.110となり、29%削減できます。
エージェントループ
次のエージェントを考えます。
- キャッシュ済みプレフィックス:150,000トークン
- ツール呼び出し:40ターン
- 1ターンあたりの追加入力:1,000トークン
- 1ターンあたりの出力:800トークン
1ターンあたりの料金は次のとおりです。
Fable 5:
10(0.001) + 1.0(0.15) + 50(0.0008)
= $0.01 + $0.15 + $0.04
= $0.20
Fable 5.1:
$0.01 + $0.0375 + $0.04
= $0.0875
1回限りのキャッシュ書き込みを除けば、節約率は56%です。40ターンでは、Fable 5が$8.00、Fable 5.1が$3.50になります。
実際のエージェントではキャッシュ書き込みやキャッシュされていないターンも発生するため、Anthropicが示す「最大45%」という見積もりはこの範囲に収まります。
重要なのは、節約額が「出力に対するキャッシュ済み入力の比率」に比例することです。
- 短いプロンプトから長い出力を生成するワークロード:効果は小さい
- エージェント、大規模で安定したRAGコンテキスト、複数ターンのサポートボット:効果が大きい
タスク別コストの例
以下の3例では、Fable 5.1を標準料金で利用し、5分間のキャッシュ書き込みを1回行うものとします。
1. 単一のコードレビュー
- 入力:30,000トークン(差分+システムプロンプト)
- 出力:4,000トークン
- キャッシュ:なし
入力: $0.30
出力: $0.20
合計: $0.50
同じレビューをOpus 5で実行すると$0.25です。キャッシュを使わない場合、Fable 5.1は単純に2倍の料金になります。
2. 25ターンのサポート会話
12,000トークンの安定したシステムプロンプトを1回キャッシュし、その後25ターンで次のトークンを追加します。
- キャッシュ書き込み:$0.15
- 1ターンあたりのキャッシュされていない入力:300トークン
- 1ターンあたりの出力:250トークン
- プレフィックス:キャッシュから読み取り
キャッシュされていない入力:
25 × 300 = 7,500トークン = $0.075
キャッシュ読み取り:
25 × 12,000 = 300,000トークン = $0.075
出力:
25 × 250 = 6,250トークン = $0.3125
合計:
約 $0.61
Fable 5ではキャッシュ読み取りだけで$0.30となり、合計は約$0.84です。
3. 2時間のエージェントビルド
次の条件で、120回のツール呼び出しを行うエージェントを考えます。
- プレフィックス:20,000から200,000トークンへ増加
- 平均キャッシュ済みプレフィックス:110,000トークン
- 1ターンあたりのキャッシュされていない入力:1,500トークン
- 1ターンあたりの出力:1,200トークン
- プレフィックスの増加に伴うキャッシュ更新:約6回
キャッシュ読み取り:
120 × 110,000 = 13.2Mトークン = $3.30
キャッシュされていない入力:
120 × 1,500 = 180,000トークン = $1.80
出力:
120 × 1,200 = 144,000トークン = $7.20
キャッシュ書き込み:
約660,000トークン × $12.50/1M = $8.25
合計:
約 $20.55
Fable 5ではキャッシュ読み取りが$3.30ではなく$13.20となり、合計は約$30.45です。出力が最大のコスト項目である実行でも、約33%削減できます。
この例では、キャッシュ書き込みが2番目に大きなコストです。Fable 5.1では読み取りが安い分、キャッシュミスが相対的に高くなります。システムプロンプトの再構築、過去ターンの編集、ツール配列の変更など、キャッシュをリセットする操作には注意してください。
料金を左右する要素
Effort(労力)
output_config.effortは出力トークン数に最も影響します。出力料金は100万トークンあたり$50です。
Anthropicはまずhighから始めるよう案内しています。一方で、mediumは低コストでFable 5に近い品質になり、lowはタスク単価でOpusやSonnetと競合することが多いとしています。自分の評価データで設定を比較してください。
メッセージごとのeffortベータ機能を使えば、定型ターンではlow、難しいターンでは高い設定に切り替えられます。キャッシュをリセットする必要はありません。
キャッシュを温かく保つ
プロンプトキャッシングが割引の中心です。
読み取りが$0.25、5分キャッシュの書き込みが$12.50の場合、5分TTLの損益分岐点は1ヒットです。5分から60分のアイドル期間では、5分TTLでmax_tokens: 0のキープアライブを送るほうが、1時間TTLの2倍の書き込み料金を支払うより通常は安くなります。
次の運用も有効です。
- セッション中に
systemやtoolsを再構築しない - 変更には会話途中のシステムメッセージを使う
- ターンごとのリマインダーにはターンスコープのメッセージを使う
- 思考ブロックを維持してキャッシュも維持する
待てる処理はバッチにする
Batch APIでは、すべての料金が半額になります。Fable 5.1は次の料金です。
- 入力:$5 / 100万トークン
- 出力:$25 / 100万トークン
評価、バックフィル、夜間のドキュメント処理に適しています。
fallbacksはバッチでは拒否されるため、拒否された項目は手動で再送信してください。
ルートごとにモデルを選ぶ
Anthropicのドキュメントでは、まずOpus 5を使い、高いeffort設定でも不十分な場合にFable 5.1へ移行する方法が推奨されています。
Opus 5で評価をクリアできるルートにFable 5.1を使うと、品質上のメリットがないまま2倍の料金を支払うことになります。ワークロード別の判断は、Fable 5.1とOpus 5の比較で詳しく解説しています。
ツールのオーバーヘッドを測定する
ツールを使うリクエストには、ツール使用向けのシステムプロンプトが自動的に含まれます。
AnthropicはOpus 5について286トークンと公開していますが、Fable 5.1の数値は未公開です。トークンカウントエンドポイントで実測してください。
- ブラウザツールセット:約6,600トークン
- コンピュータツールセット:約4,500トークン
これらは初回送信後、すべてキャッシュされます。
拒否は無料、再試行は有料
出力生成前に分類器が拒否したリクエストは課金されません。
サーバーサイドのフォールバックでは、再試行先モデルの料金が課金されます。Anthropicのフォールバッククレジットは、切り替え時のキャッシュコストを返金します。
拒否を独立したメトリクスとして記録し、Fable 5.1の支出のうちどれだけがOpus 5で処理されているかを把握しましょう。
Claude APIの請求額を削減する一般的なテクニックも、キャッシュ読み取り料金が有利になる点を除けばFable 5.1にそのまま適用できます。
Fable 5.1で利用できない機能
- 高速モード:Opus 5とOpus 4.8専用。Fable 5.1の出力を高速化する有料オプションはありません
- プライオリティティア:Fable 5.1とMythos 5.1では非対応。Fable 5では引き続き利用可能
- データ保持ゼロ(ZDR):Anthropicが明示的に許可しない限り利用不可
プライオリティティアに依存するエンタープライズのキャパシティ計画では、Fable 5に留まるかOpus 5へ移行する必要があります。
ZDR組織では、すべてのリクエストが400エラーになります。
Apidogで実際のコストを確認する
リクエストコストを確認する最も信頼できる方法は、レスポンスのusageオブジェクトを使うことです。テストコレクションなら、これをすばやく自動化できます。
Apidogで次の手順を実行します。
- プロダクションのシステムプロンプトを
cache_control付きのリクエストとして保存する - リクエストを2回送信する
- 1回目に
usage.cache_creation_input_tokensを検証する - 2回目に
usage.cache_read_input_tokensを検証する - 各フィールドに料金レートを掛け、リクエスト単位のコストをログに記録するポストレスポンススクリプトを追加する
- プロンプトやツール定義を変更するたびにコレクションを実行する
これにより、請求額に反映される前にキャッシュを壊す変更を検出できます。
Apidogをダウンロードして始めましょう。正確なリクエスト例はAPIウォークスルーで確認できます。
ClaudeアプリでのFable 5.1の料金
APIではトークン単位で課金されます。Claudeアプリでは、Fable 5.1の利用量がプランごとに測定されます。
- Maxプラン:週間利用制限の最大50%まで、追加料金なしでFableモデルを利用可能。その後は利用クレジットで継続
- Proおよび標準チームシート:最初のメッセージから利用クレジットで測定
- エンタープライズ標準シート:プラン制限を超える利用には利用クレジットの有効化が必要
- 利用ベースのエンタープライズ:標準APIレートで課金
- セーフガードによる別モデルへのルーティング:Fableの料金では課金されない
詳しくは、無料および最安値のパスガイドをご覧ください。
よくある質問
Claude Fable 5.1は100万トークンあたりいくらですか?
入力は$10、出力は$50で、Fable 5から変更ありません。
- キャッシュ読み取り:$0.25
- 5分キャッシュ書き込み:$12.50
- 1時間キャッシュ書き込み:$20
- バッチAPI入力:$5
- バッチAPI出力:$25
いずれも100万トークンあたりの料金です。
Claude Fable 5.1はFable 5より安いですか?
トークン単価は安くありません。ただし、プロンプトキャッシングを使うワークロードでは安くなります。
キャッシュ読み取りが100万トークンあたり$1から$0.25に下がったため、Anthropicの見積もりでは通常のワークロードで25%、エージェント中心のワークロードで最大45%削減できます。出力が多いワークロードでは差は小さくなります。
Claude Fable 5.1はOpus 5より安いですか?
キャッシュされていない場合は安くありません。料金はちょうど2倍です。
キャッシュヒットでは逆転します。
- Fable 5.1:$0.25 / 100万トークン
- Opus 5:$0.50 / 100万トークン
一方、出力はFable 5.1が$50、Opus 5が$25です。出力が多いルートではOpus 5が有利です。
Fable 5.1に高速モードやプライオリティティアはありますか?
どちらもありません。高速モードはOpus 5とOpus 4.8専用です。プライオリティティアはFable 5では利用できますが、Fable 5.1ではサポートされていません。
Fable 5.1に長文コンテキストプレミアムはありますか?
ありません。1Mトークンのフルウィンドウも標準料金で課金され、キャッシュとバッチの割引が適用されます。
BedrockまたはGoogle Cloudではいくらですか?
AWSやGoogle Cloudなどのプラットフォームは独自の料金を設定しており、地域エンドポイントには10%のプレミアムが追加されます。
AWSおよびMicrosoft Foundry上のClaude Platformは、Claude Consumption Unitsを通じて標準APIレートで課金されます。各プラットフォームでの設定は、クラウド可用性ガイドで確認できます。

Top comments (0)