DEV Community

Cover image for Claude Fable 5.1 대 Opus 5: 두 배 가격, 과연 그만한 가치가 있을까?
Rihpig
Rihpig

Posted on Originally published at apidog.com

Claude Fable 5.1 대 Opus 5: 두 배 가격, 과연 그만한 가치가 있을까?

Claude Fable 5.1 vs Opus 5: 어떤 모델을 선택해야 할까?

Claude Fable 5.1의 가격은 백만 토큰당 입력 10달러, 출력 50달러이며, Claude Opus 5는 입력 5달러, 출력 25달러입니다. Anthropic은 고강도 평가에서 Opus 5가 충분한 성능을 내지 못할 때만 Fable 5.1로 전환하라고 권장합니다. 이 글에서는 두 모델의 벤치마크, 프롬프트와 노력 수준에 따른 성능 차이, 캐시 사용 시 실제 비용을 비교합니다.

지금 Apidog를 사용해 보세요

출처는 Anthropic의 출시 게시물, Fable 5.1 모델 페이지, 가격 페이지입니다. 각 모델의 상세 내용은 Claude Fable 5.1이란 무엇인가Claude Opus 5란 무엇인가를 참고하세요.

나란히 비교

항목 Claude Fable 5.1 Claude Opus 5
모델 ID claude-fable-5-1 claude-opus-5
출시일 2026년 9월 1일 2026년 7월 24일
포지셔닝 까다로운 추론 및 장기 에이전트 작업 복잡한 에이전트 코딩 및 엔터프라이즈 작업; 권장 기본값
입력 / 출력 $10 / $50 $5 / $25
캐시 읽기 $0.25 $0.50
캐시 쓰기 (5분 / 1시간) $12.50 / $20 $6.25 / $10
배치 $5 / $25 $2.50 / $12.50
고속 모드 아니요 예 ($10 / $50)
우선순위 티어 아니요 아니요
컨텍스트 / 최대 출력 1M / 128K 1M / 128K (베타 배치에서 300K)
지식 업데이트 시점 2026년 6월 2026년 5월
비교 지연 시간 더 느림 보통
사고 과정 항상 켜짐; disabled 시 400 반환 기본적으로 켜짐; high 이하에서 disabled 허용
강제 tool_choice 400 허용됨
안전 분류기 사이버, 생체, 프론티어 LLM, 추론 추출, 일반 유해성 사이버 전용
제로 데이터 보존 승인되지 않은 경우 사용 불가 사용 가능
메시지당 노력 (베타)
기록 편집 확인 아니요

벤치마크 결과

모든 수치는 Anthropic이 직접 실행했으며, 아직 독립적인 재현은 없습니다.

벤치마크 Fable 5.1 Opus 5 격차
Terminal-Bench-Science 0.1 52.6% 29.0% +23.6
AutomationBench 31.4% 26.9% +4.5
인류 최후의 시험 (도구 없음) 60.9% 56.6% +4.3
Terminal-Bench 4.0 55.8% 52.3% +3.5
CursorBench 3.2.0 73.4% 70.0% +3.4
OSWorld 2.0 (부분) 77.9% 75.4% +2.5
OSWorld 2.0 (엄격) 41.7% 39.6% +2.1
인류 최후의 시험 (도구 포함) 65.0% 63.6% +1.4
GDPval-AA v2 1853 1824 +29 Elo

두 가지 흐름이 보입니다.

  • Terminal-Bench-Science에서는 Fable 5.1이 52.6% 대 29.0%로 크게 앞섭니다. 터미널에서 장시간 실험을 수행하는 도구 중심의 연구 벤치마크입니다.
  • 나머지 벤치마크의 차이는 1~5점입니다. AutomationBench의 5점 차이는 의미 있지만, 도구를 사용한 인류 최후의 시험의 1.4점과 GDPval의 29 Elo는 모델 선택보다 프롬프트와 노력 설정의 영향이 클 수 있는 범위입니다.

Opus 5는 7월 Terminal-Bench 4.0에서 52.3%로 출시되어 Fable 5의 42.0%를 앞섰습니다. Fable 5.1은 55.8%로 다시 선두를 차지했지만, 차이는 13.8점이 아닌 3.5점입니다. 에이전트 코딩에서 Fable 계열의 이점은 실제로 존재하지만 6월보다 좁아졌습니다. 초기 비교는 Opus 5 대 Fable 5 비교에서 확인할 수 있습니다.

가격은 단순히 2배가 아니다

캐시를 사용하지 않으면 Fable 5.1은 입력과 출력 모두 Opus 5의 정확히 2배입니다. 하지만 캐시 읽기 비용은 Fable 5.1이 $0.25, Opus 5가 $0.50로 Fable 5.1이 절반입니다. 따라서 실제 비용은 입력 중 캐시된 접두사의 비율에 따라 달라집니다.

캐시된 접두사가 긴 에이전트 턴

다음 조건을 가정합니다.

  • 캐시된 입력 토큰: 150,000개
  • 캐시되지 않은 입력 토큰: 1,000개
  • 출력 토큰: 800개

Opus 5

5(0.001) + 0.5(0.15) + 25(0.0008)
= 0.005달러 + 0.075달러 + 0.02달러
= 0.10달러
Enter fullscreen mode Exit fullscreen mode

Fable 5.1

10(0.001) + 0.25(0.15) + 50(0.0008)
= 0.01달러 + 0.0375달러 + 0.04달러
= 0.0875달러
Enter fullscreen mode Exit fullscreen mode

이 경우 Fable 5.1이 더 저렴합니다.

캐시를 사용하지 않는 코드 검토

이번에는 캐시되지 않은 입력 토큰 30,000개와 출력 토큰 4,000개를 가정합니다.

  • Opus 5: $0.15 + $0.10 = $0.25
  • Fable 5.1: $0.30 + $0.20 = $0.50

정확히 2배 차이입니다.

손익분기점

Fable 5.1의 턴당 비용은 다음 조건에서 Opus 5보다 낮아집니다.

캐시된 입력 토큰 수가 캐시되지 않은 입력 토큰의 약 20배와 출력 토큰의 5배를 초과할 때

접두사가 긴 에이전트 루프에서는 이 조건이 자주 충족될 수 있습니다. 반대로 출력 토큰이 많으면 손익분기점에 도달하기 어렵습니다. Fable 5.1의 캐시 쓰기 비용도 Opus 5의 2배이므로, 캐시를 자주 재설정하는 세션에서는 비용 이점이 사라질 수 있습니다.

전체 가격표는 Fable 5.1 가격 분석Opus 5 가격 분석을 참고하세요.

Opus 5가 우위인 경우

  • 사고 기능을 끌 수 있는 작업

    Opus 5는 high 이하에서 thinking: {"type": "disabled"}를 허용합니다. Fable 5.1은 항상 사고 기능을 사용해야 합니다. 분류, 추출, 단답형 작업에서는 사고 기능을 끈 Opus 5가 더 저렴하고 빠릅니다.

  • 응답 속도가 중요한 경우

    Opus 5는 $10/$50의 고속 모드에서 최대 2.5배 빠른 출력 속도를 제공합니다. Fable 5.1에는 대응 기능이 없습니다.

  • 일반적인 지연 시간이 중요한 경우

    Anthropic은 Opus 5의 지연 시간을 “보통”, Fable 5.1을 “더 느림”으로 분류합니다. 고난도 작업에서 Fable 5.1의 고강도 단일 턴은 수 분이 걸릴 수 있습니다.

  • 제로 데이터 보존(ZDR)이 필요한 경우

    Opus 5는 ZDR에서 사용할 수 있습니다. Fable 5.1은 Covered Model이므로 Anthropic의 명시적 승인이 없으면 400 오류를 반환합니다.

  • 거부 가능성을 줄여야 하는 경우

    Opus 5는 사이버 보안 전용 분류기를 사용합니다. Fable 5.1은 사이버, 생체, 프론티어 LLM 개발, 추론 추출, 일반 유해성 분류기를 모두 사용합니다. 양성 생명과학 또는 ML 작업이 Fable 5.1에서 거부될 경우 Opus 5를 대안으로 사용할 수 있습니다.

  • 강제 도구 호출이 필요한 경우

    Opus 5는 tool_choiceanytool을 허용합니다. Fable 5.1은 400 오류를 반환하므로, 강제 호출에 의존하는 통합이라면 Opus 5가 적합합니다.

  • 이전 기록을 편집하는 하네스

    Opus 5는 이전 턴을 편집해도 동작합니다. Fable 5.1은 기록 편집 시 이후 사고 블록을 무효화합니다. 클라이언트 측 압축이나 턴별 알림을 사용하는 하네스는 Fable 5.1로 전환하기 전에 점검해야 합니다.

Fable 5.1이 우위인 경우

  • 장기 연구 및 터미널 에이전트

    Terminal-Bench-Science에서 52.6% 대 29.0%를 기록했습니다. 실험 실행, 다단계 웹 연구, 수 시간 동안 실행되는 에이전트 작업에 적합합니다.

  • 비즈니스 워크플로 자동화

    AutomationBench에서 31.4% 대 26.9%로 앞섰습니다. 애플리케이션 전반의 엔드투엔드 작업을 자동화할 때 의미 있는 차이입니다.

  • 캐시 접두사가 긴 에이전트 루프

    캐시 읽기 비용이 $0.25이므로 접두사가 지배적인 루프에서는 턴당 비용이 Opus 5보다 낮을 수 있습니다.

  • 최신 지식이 필요한 작업

    지식 업데이트 시점은 Fable 5.1이 2026년 6월, Opus 5가 2026년 5월입니다.

  • 밀도 높은 문서의 시각적 이해

    Anthropic은 PDF의 차트, 문서, 표를 읽는 기능이 개선되었으며 특히 자르기와 확대·축소 도구 사용 시 효과가 크다고 설명합니다. Opus 5와의 공개 시각 벤치마크 비교는 없으므로 직접 평가해야 합니다.

  • Opus 5의 xhigh가 실패하는 작업

    Anthropic의 권장 규칙은 명확합니다. xhigh 노력 수준의 Opus 5가 평가에서 실패하면, 먼저 high 노력 수준의 Fable 5.1을 시도하세요.

노력 수준에 따라 결과가 달라진다

두 모델 모두 다섯 가지 노력 수준을 제공합니다. Anthropic은 Fable 5.1의 low 노력 수준에 대해 다음과 같이 설명합니다.

작업당 비용 측면에서 Claude Opus 및 Claude Sonnet 모델과 경쟁력이 있으며 더 높은 점수를 얻는다.

따라서 high Opus 5와 high Fable 5.1만 비교하는 것은 충분하지 않습니다. 일상적인 작업에서는 다음 조합도 테스트해야 합니다.

  • Opus 5: high
  • Fable 5.1: low 또는 medium

Fable 5.1의 낮은 노력 수준에서는 출력 토큰 수가 줄어들어 토큰당 2배 가격을 일부 상쇄할 수 있습니다.

반대로 Fable 5.1이 Fable 5보다 얻는 이점은 xhighmax에서 가장 큽니다. 이 노력 수준은 Opus 5의 기능 한계가 가장 많은 시간을 소모하는 영역이기도 합니다. 출시 표만 보고 결론을 내리지 말고, 두 모델의 노력 수준을 동일한 조건 또는 실제 운영 조건으로 맞춰 평가하세요. 다섯 가지 수준의 설명은 Opus 5 노력 가이드에서 확인할 수 있으며, Fable 5.1에도 같은 개념이 적용됩니다.

실전 의사결정 프레임워크

  1. high 노력 수준의 Opus 5로 시작합니다.

    Anthropic의 기본 권장 사항이며 가격이 절반이고, 분류기 제약이 적으며, ZDR을 사용할 수 있습니다.

  2. 실패하는 작업만 Opus 5의 xhigh로 높입니다.

    모델을 전환하는 것보다 비용 효율적일 수 있습니다.

  3. 그래도 실패하면 해당 작업만 Fable 5.1의 high로 이동합니다.

    전체 시스템을 전환하지 말고 실패한 경로에만 적용합니다.

  4. 이동한 작업의 캐시 프로필을 확인합니다.

    접두사가 긴 루프라면 Fable 5.1이 턴당 더 저렴할 수 있습니다.

  5. 전환 전에 하네스를 감사하세요.

    강제 tool_choice와 기록 편집은 Fable 5.1에서 동작하지 않습니다. 자세한 체크리스트는 마이그레이션 가이드를 참고하세요.

Apidog에서 직접 비교하기

프로덕션 프롬프트와 model을 환경 변수로 사용하는 컬렉션을 만드세요. 다음 순서로 실행하면 됩니다.

  1. claude-opus-5high 노력 수준으로 실행
  2. 같은 모델을 xhigh로 실행
  3. claude-fable-5-1high로 실행
  4. 같은 모델을 low로 실행
  5. 반복 실행 시 응답, usage.output_tokens, usage.cache_read_input_tokens 기록
  6. 응답 후 스크립트에서 각 모델의 요율을 곱해 노력 수준별 작업당 비용 계산

Apidog는 모든 실행 기록을 보존하므로, 다음 모델이 출시된 후에도 동일한 조건으로 비교할 수 있습니다. 시작하려면 Apidog 다운로드를 사용하세요.

자주 묻는 질문

Claude Fable 5.1이 Opus 5보다 나은가요?

Anthropic이 게시한 모든 벤치마크에서 Fable 5.1이 1.4~23.6점 앞섰습니다. 가장 큰 차이는 Terminal-Bench-Science에서 나타났고, 대부분의 다른 벤치마크에서는 5점 미만이었습니다. 단, 모든 결과는 공급업체가 직접 실행한 수치입니다.

Fable 5.1이 Opus 5 가격의 두 배만큼 가치가 있나요?

장기 연구, 터미널 에이전트, 비즈니스 자동화, 캐시 접두사가 긴 에이전트 루프에서는 그럴 수 있습니다. 출력이 많거나 지연 시간에 민감하거나 분류 작업이라면 그렇지 않을 가능성이 높습니다. Anthropic의 규칙은 고강도 노력 수준의 Opus 5가 평가에서 실패할 때만 상위 모델로 전환하는 것입니다.

Fable 5.1과 Opus 5 중 어느 것이 더 빠른가요?

Opus 5입니다. Anthropic은 Opus 5를 “보통” 지연 시간, Fable 5.1을 “더 느림”으로 분류합니다. Opus 5에는 최대 2.5배 빠른 고속 모드도 있지만 Fable 5.1에는 없습니다.

Opus 5가 Fable 5.1과 같은 안전 분류기를 사용하나요?

아닙니다. Opus 5는 사이버 전용 분류기를 사용하고, Fable 5.1은 생체, 프론티어 LLM, 추론 추출, 일반 유해성 분류기를 추가로 사용합니다. Fable 5.1이 거부하는 작업에서는 Opus 5가 대안이 될 수 있습니다.

Fable 5.1을 Opus 5처럼 제로 데이터 보존으로 사용할 수 있나요?

아닙니다. Fable 5.1은 30일 보존이 필요한 Covered Model이며, Opus 5는 ZDR에서 사용할 수 있습니다.

두 모델 사이에서 대화를 전환할 수 있나요?

상위 모델로의 전환은 가능합니다. Fable 5.1은 Opus 5의 사고 블록을 읽습니다. 하위 모델로 전환하면 API가 Opus 5가 해당 내용을 보기 전에 Fable 5.1의 사고 블록을 과금 없이 삭제하고, Opus 5가 턴을 다시 계획합니다.

Top comments (0)