Claude Fable 5.1 가격과 API 비용 최적화 가이드
Claude Fable 5.1은 Fable 5와 동일하게 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러입니다. 가장 큰 변화는 프롬프트 캐시 읽기 비용으로, Fable 5의 1달러에서 0.25달러로 인하됐습니다. 이는 Opus 5 캐시 읽기 비용의 절반입니다. Anthropic은 일반적인 워크로드에서 약 25%, 고도로 에이전트화된 워크로드에서 최대 약 45%의 비용 절감을 예상합니다.
이 가이드에서는 공식 가격 페이지를 기준으로 전체 요금을 정리하고, 캐시 적중률을 적용해 25% 및 45% 절감 주장을 재현합니다. 또한 실제 작업별 비용 예시와 비용을 줄이는 방법을 소개합니다.
모델 개요가 필요하다면 Claude Fable 5.1이란 무엇인가를 먼저 확인하세요.
Claude Fable 5.1 가격표
| 요금 항목 | Claude Fable 5.1 |
|---|---|
| 기본 입력 | 100만 토큰당 10달러 |
| 출력 | 100만 토큰당 50달러 |
| 5분 캐시 쓰기 | 100만 토큰당 12.50달러 |
| 1시간 캐시 쓰기 | 100만 토큰당 20달러 |
| 캐시 읽기(적중 또는 새로고침) | 100만 토큰당 0.25달러 |
| 배치 API 입력 | 100만 토큰당 5달러 |
| 배치 API 출력 | 100만 토큰당 25달러 |
| 긴 컨텍스트 프리미엄 | 없음. 전체 1M 윈도우에 표준 요금 적용 |
inference_geo: "us" |
모든 토큰 카테고리에 1.1배 |
| 고속 모드 | 지원하지 않음. Opus 5 및 Opus 4.8만 지원 |
| 우선순위 티어 | 지원하지 않음 |
| 웹 검색 | 검색 1,000회당 10달러 + 토큰 비용 |
Claude Mythos 5.1도 동일한 요금이 적용됩니다. 배치 할인과 캐시 승수는 중첩되므로, 배치 요청의 캐시 읽기 비용은 100만 토큰당 0.125달러입니다.
캐시 읽기 가격 비교
| 모델 | 기본 입력 | 캐시 읽기 | 입력 대비 비율 |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $0.25 | 2.5% |
| Claude Fable 5 | $10 | $1.00 | 10% |
| Claude Opus 5 | $5 | $0.50 | 10% |
| Claude Opus 4.8 | $5 | $0.50 | 10% |
| Claude Sonnet 5 | $2 | $0.20 | 10% |
| Claude Haiku 4.5 | $1 | $0.10 | 10% |
다른 Claude 모델의 캐시 적중 비용은 기본 입력 비용의 10%입니다. Fable 5.1은 2.5%만 청구합니다.
따라서 캐시되지 않은 입력은 Fable 5.1이 Opus 5보다 두 배 비싸지만, 캐시 적중 비용은 더 저렴합니다. 안정적인 접두사를 반복해서 사용하는 에이전트, RAG, 다중 턴 지원 봇에서는 Fable 5.1의 유효 입력 비용이 Opus 5보다 낮아질 수 있습니다.
Sonnet 5의 가격 인상과 관련해서는 Opus 5와 Sonnet 5 비교를 참고하세요. 9월 가격 인상안은 취소됐으며, Sonnet 5는 입력 2달러와 출력 10달러를 유지합니다.
25% 및 45% 할인 주장 재현
Anthropic은 예상 절감률을 산출한 정확한 워크로드 조합을 공개하지 않았습니다. 다음 계산은 그들이 암시한 캐시 적중률을 이해하기 위한 재구성입니다.
요청에 다음 토큰이 있다고 가정합니다.
-
U: 캐시되지 않은 입력 토큰 -
C: 캐시된 입력 토큰 -
O: 출력 토큰
토큰을 백만 단위로 환산하면 비용은 다음과 같습니다.
- Fable 5:
10U + 1.0C + 50O - Fable 5.1:
10U + 0.25C + 50O - 절약액:
0.75C - 절약률:
0.75C / (10U + C + 50O)
일반적인 채팅 워크로드
요청당 다음과 같이 가정합니다.
- 캐시된 토큰: 20,000개
- 캐시되지 않은 입력 토큰: 2,000개
- 출력 토큰: 1,500개
Fable 5 비용:
10(0.002) + 1.0(0.02) + 50(0.0015)
= $0.02 + $0.02 + $0.075 = $0.115
Fable 5.1 비용:
$0.02 + $0.005 + $0.075 = $0.100
절감률은 약 13%입니다. Anthropic이 제시한 25% 절감을 달성하려면 출력에 비해 캐시된 토큰 비율이 더 높아야 합니다.
예를 들어 캐시된 토큰이 60,000개라면 비용은 다음과 같습니다.
- Fable 5: $0.155
- Fable 5.1: $0.110
- 절감률: 약 29%
에이전트 루프
다음과 같은 에이전트를 가정합니다.
- 40번의 도구 호출마다 150,000개의 캐시된 접두사 재사용
- 턴마다 캐시되지 않은 입력 토큰 1,000개
- 턴마다 출력 토큰 800개
Fable 5의 턴당 비용:
10(0.001) + 1.0(0.15) + 50(0.0008)
= $0.01 + $0.15 + $0.04 = $0.20
Fable 5.1의 턴당 비용:
$0.01 + $0.0375 + $0.04 = $0.0875
캐시 쓰기 비용을 제외하면 턴당 절감률은 56%입니다. 40턴 기준 비용은 다음과 같습니다.
- Fable 5: $8.00
- Fable 5.1: $3.50
실제 에이전트 워크로드에 캐시 쓰기와 캐시되지 않은 턴을 포함하면 Anthropic이 제시한 최대 45% 절감 범위에 들어갑니다.
핵심 규칙은 간단합니다. 캐시된 입력이 출력에 비해 많을수록 절감률이 높아집니다.
- 출력 중심 워크로드: 변화가 작음
- 접두사 중심 워크로드: 절감 효과가 큼
- 대표적인 예: 에이전트, 대규모 RAG 컨텍스트, 다중 턴 지원 봇
작업별 비용 예시
다음 예시는 모두 Fable 5.1 표준 요금을 사용하며, 5분 캐시 쓰기 비용은 최초 한 번만 계산합니다.
1. 단일 코드 검토
- 입력: 30,000토큰
- 출력: 4,000토큰
- 캐시: 없음
계산:
- 입력:
30,000 / 1,000,000 × $10 = $0.30 - 출력:
4,000 / 1,000,000 × $50 = $0.20
총액은 $0.50입니다.
동일한 검토를 Opus 5로 실행하면 $0.25입니다. 캐시를 사용하지 않으면 Fable 5.1이 단순히 두 배 비쌉니다.
2. 25턴 지원 대화
다음과 같이 가정합니다.
- 안정적인 시스템 프롬프트: 12,000토큰
- 캐시 쓰기: 1회
- 대화 턴: 25회
- 턴마다 캐시되지 않은 입력: 300토큰
- 턴마다 출력: 250토큰
비용:
- 캐시 쓰기:
$0.15 - 캐시되지 않은 입력:
25 × 300 = 7,500토큰 = $0.075 - 캐시 읽기:
25 × 12,000 = 300,000토큰 = $0.075 - 출력:
25 × 250 = 6,250토큰 = $0.3125
총액은 약 $0.61입니다.
Fable 5에서는 캐시 읽기 비용만 $0.30이므로 총액이 약 $0.84입니다.
3. 두 시간 에이전트 빌드
다음과 같은 실행을 가정합니다.
- 도구 호출 턴: 120회
- 접두사: 20,000토큰에서 200,000토큰으로 증가
- 평균 캐시된 접두사: 110,000토큰
- 턴마다 캐시되지 않은 입력: 1,500토큰
- 턴마다 출력: 1,200토큰
- 캐시 새로고침: 약 6회
비용:
- 캐시 읽기:
120 × 110,000 = 13,200,000토큰 = $3.30 - 캐시되지 않은 입력:
180,000토큰 = $1.80 - 출력:
144,000토큰 = $7.20 - 캐시 쓰기: 약
660,000토큰 × $12.50/M = $8.25
총액은 약 $20.55입니다.
Fable 5에서는 캐시 읽기 비용이 $3.30이 아니라 $13.20이므로 총액은 약 $30.45입니다. 출력 비용이 여전히 가장 큰 항목인 실행에서도 약 33%를 절감할 수 있습니다.
이 예시에서는 캐시 쓰기 비용이 두 번째로 큽니다. 캐시 읽기가 저렴해진 대신, 캐시 미스는 캐시 적중보다 40배 비쌉니다. 따라서 세션 중간에 다음 요소를 변경하면 비용이 크게 증가할 수 있습니다.
- 시스템 프롬프트 재구축
- 이전 턴 편집
- 도구 배열 변경
- 캐시 접두사 재설정
요금을 줄이는 방법
effort를 조정하세요
output_config.effort는 출력 토큰 비용에 직접 영향을 줍니다. Fable 5.1의 출력 비용은 100만 토큰당 50달러이므로, 출력 길이를 관리하는 것이 중요합니다.
Anthropic의 권장 방향은 다음과 같습니다.
-
high: Fable 5.1의 기본 시작점 -
medium: Fable 5 수준의 품질을 더 낮은 비용으로 제공 -
low: 작업별 비용에서 Opus 및 Sonnet과 경쟁 가능
자체 평가로 각 단계의 품질과 비용을 비교하세요. 메시지별 effort 베타 기능을 사용하면 캐시를 재설정하지 않고 일반 턴은 low, 어려운 턴은 높은 effort로 실행할 수 있습니다.
캐시를 유지하세요
프롬프트 캐싱은 Fable 5.1의 핵심 비용 절감 수단입니다.
읽기 비용이 0.25달러이고 5분 캐시 쓰기가 12.50달러일 때, 5분 TTL의 손익분기점은 캐시 적중 1회입니다. 5분에서 60분 사이의 유휴 시간에는 다음 방식이 일반적으로 더 저렴합니다.
- 5분 TTL 사용
-
max_tokens: 0으로 캐시 유지 요청 전송 - 1시간 TTL의 두 배 쓰기 비용 회피
사고 블록을 보존하는 전용 추가 규칙도 캐시를 유지합니다. 세션 중간에 system 또는 tools를 재구축하지 말고, 변경에는 대화 중간 시스템 메시지를 사용하세요. 턴별 알림은 턴 범위 메시지로 처리하는 것이 좋습니다.
지연 가능한 작업은 배치로 처리하세요
배치 API는 입력과 출력 비용을 절반으로 줄입니다.
Fable 5.1 배치 요금:
- 입력: 100만 토큰당 $5
- 출력: 100만 토큰당 $25
이는 Opus 5의 동기식 가격과 동일합니다. 평가, 백필, 야간 문서 처리처럼 즉시 응답이 필요하지 않은 작업에 적합합니다.
배치에서는 fallbacks가 거부되므로 거부된 항목은 수동으로 다시 제출해야 합니다.
경로별 모델 티어를 선택하세요
Anthropic 문서는 Opus 5에서 시작한 뒤, 높은 effort의 Opus 5로도 충분하지 않은 경로에 Fable 5.1을 사용하도록 권고합니다.
Opus 5가 평가를 통과하는 경로에서 Fable 5.1을 사용하면 품질 이득 없이 두 배의 비용을 지불할 수 있습니다. 워크로드별 비교는 Fable 5.1과 Opus 5 비교를 참고하세요.
도구 오버헤드를 측정하세요
도구가 포함된 요청에는 숨겨진 도구 사용 시스템 프롬프트가 추가됩니다.
- Opus 5 도구 오버헤드: 약 286토큰
- 브라우저 도구 세트: 요청당 약 6,600토큰
- 컴퓨터 도구 세트: 요청당 약 4,500토큰
이 토큰은 첫 전송 이후 캐시됩니다. Fable 5.1의 정확한 도구 토큰 수는 아직 공개되지 않았으므로 토큰 계산 엔드포인트로 직접 측정하세요.
거절과 재시도를 구분하세요
출력이 생성되기 전 분류기에서 거절된 요청에는 요금이 부과되지 않습니다. 반면 서버 측 폴백은 재시도된 폴백 모델의 요금을 청구합니다. Anthropic의 폴백 크레딧은 모델 전환으로 발생한 캐시 비용을 환불합니다.
Fable 5.1 사용량 중 얼마가 Opus 5에서 처리되는지 확인하려면 거절을 별도 지표로 기록하세요.
Claude API 청구서 절감 가이드의 일반적인 최적화 방법도 대부분 적용됩니다. Fable 5.1에서는 특히 캐시 읽기 계산 방식이 달라졌습니다.
Fable 5.1에서 지원하지 않는 기능
- 고속 모드: Opus 5와 Opus 4.8만 지원합니다.
- 우선순위 티어: Fable 5.1과 Mythos 5.1에서는 지원하지 않습니다. 해당 기능이 필요한 기업은 Fable 5를 유지하거나 Opus 5로 전환해야 합니다.
- 제로 데이터 보존(ZDR): Anthropic의 명시적인 승인이 없는 경우 지원되지 않습니다. ZDR 조직은 모든 요청에서 400 오류를 받습니다.
Fable 5.1에서 더 빠른 출력을 위해 추가 비용을 지불하는 옵션도 없습니다.
Apidog에서 실제 지출 확인하기
실제 요청 비용을 확인하는 가장 신뢰할 수 있는 데이터는 응답의 usage 객체입니다. 테스트 컬렉션을 사용하면 이를 빠르게 검증할 수 있습니다.
- Apidog에 프로덕션 시스템 프롬프트를 저장합니다.
- 프롬프트에
cache_control을 설정합니다. - 동일한 요청을 두 번 전송합니다.
- 첫 번째 응답에서
usage.cache_creation_input_tokens를 검증합니다. - 두 번째 응답에서
usage.cache_read_input_tokens를 검증합니다. - 응답 후 스크립트에서 각 필드에 해당 요금을 곱해 요청별 비용을 기록합니다.
프롬프트나 도구 정의를 변경할 때마다 컬렉션을 실행하면, 변경 사항이 청구서에 반영되기 전에 캐시 무효화를 발견할 수 있습니다.
Apidog 다운로드에서 도구를 설치하고, API 둘러보기에서 정확한 요청 형식을 확인하세요.
Claude 앱에서의 Fable 5.1 가격
API는 토큰당 과금되지만, Claude 앱의 Fable 5.1은 플랜에 따라 사용량이 측정됩니다.
- Max 플랜: 주간 사용량 한도의 최대 50%까지 Fable 모델을 추가 비용 없이 포함합니다. 이후에는 사용 크레딧으로 계속 사용할 수 있습니다.
- Pro 및 표준 Team 계정: 첫 메시지부터 사용 크레딧으로 측정됩니다.
- Enterprise 표준 계정: 플랜 한도를 초과하려면 사용 크레딧을 활성화해야 합니다.
- 사용량 기반 Enterprise: 표준 API 요금으로 청구됩니다.
- 안전장치에 따른 모델 전환: 다른 모델로 리디렉션된 요청은 Fable 가격으로 청구되지 않습니다.
자세한 내용은 무료 및 최저 비용 경로 가이드를 참고하세요.
자주 묻는 질문
Claude Fable 5.1은 100만 토큰당 얼마인가요?
입력은 100만 토큰당 10달러, 출력은 50달러입니다. 캐시 읽기는 0.25달러, 캐시 쓰기는 5분 TTL 기준 12.50달러, 1시간 TTL 기준 20달러입니다. 배치 API는 입력 5달러, 출력 25달러입니다.
Claude Fable 5.1이 Fable 5보다 저렴한가요?
토큰 단가는 동일하므로 항상 저렴한 것은 아닙니다. 하지만 프롬프트 캐싱을 사용하는 경우 캐시 읽기 비용이 1달러에서 0.25달러로 줄어들어 더 저렴합니다.
Anthropic은 일반적인 워크로드에서 25%, 에이전트 워크로드에서 최대 45%의 절감을 예상합니다. 출력 중심 워크로드에서는 차이가 작습니다.
Claude Fable 5.1이 Opus 5보다 저렴한가요?
캐시되지 않은 입력에서는 아닙니다. Fable 5.1이 정확히 두 배 비쌉니다.
캐시 읽기에서는 Fable 5.1이 더 저렴합니다.
- Fable 5.1: 100만 토큰당 $0.25
- Opus 5: 100만 토큰당 $0.50
다만 출력 비용은 Fable 5.1이 50달러, Opus 5가 25달러이므로 출력 중심 경로에서는 Opus 5가 더 유리할 수 있습니다.
Claude Fable 5.1에 고속 모드 또는 우선순위 티어가 있나요?
둘 다 없습니다. 고속 모드는 Opus 5와 Opus 4.8만 지원합니다. 우선순위 티어는 Fable 5에서는 지원되지만 Fable 5.1에서는 지원되지 않습니다.
Claude Fable 5.1에 긴 컨텍스트 프리미엄이 있나요?
없습니다. 전체 1M 토큰 윈도우에 표준 요금이 적용되며, 캐시 및 배치 할인도 적용됩니다.
Bedrock 또는 Google Cloud에서 Claude Fable 5.1은 얼마인가요?
각 플랫폼이 자체 가격을 설정하며, 지역 엔드포인트에는 10% 프리미엄이 추가됩니다. AWS의 Claude Platform과 Microsoft Foundry는 Claude Consumption Units를 통해 표준 API 요금으로 청구합니다.
각 배포 방식은 클라우드 가용성 가이드에서 확인할 수 있습니다.

Top comments (0)