DEV Community

Cover image for 클로드 하이쿠 5.5 이란?
Rihpig
Rihpig

Posted on Originally published at apidog.com

클로드 하이쿠 5.5 이란?

Claude Haiku 5.5는 Anthropic의 현재 모델 중 가장 작고 빠른 모델로, 2026년 10월 7일 claude-haiku-5-5 API ID로 출시되었습니다. 이 모델은 10만 토큰 이하 프롬프트에서 입력 토큰 100만 개당 $0.10, 출력 토큰 100만 개당 $0.50이 들며, 10만 토큰을 초과하면 $0.50/$2.50 요금이 적용됩니다. Anthropic은 출시 게시물에서 Haiku 4.5보다 평균 운영 비용이 약 75% 낮고, 현재까지 가장 빠른 모델이라고 설명했습니다. Haiku 계열 최초로 노력 수준 설정을 지원하며 100만 토큰 컨텍스트 창을 제공합니다.

지금 Apidog을 사용해 보세요

이 글에서는 Haiku 5.5의 사양, 이중 가격 정책, Haiku 4.5 마이그레이션 변경 사항, 벤치마크, 지원 플랫폼, 실제 전환 절차를 정리합니다. 비용 계산이 필요하면 Haiku 5.5 가격 분석을 참고하세요. API 요청은 Apidog에서 가져와 실행하고, API 키는 환경 변수로 저장하며, 응답의 토큰 사용량을 함께 비교할 수 있습니다.

Claude Haiku 5.5 사양 요약

사양 Claude Haiku 5.5
출시일 2026년 10월 7일
모델 ID — Claude API, Google Cloud, Microsoft Foundry, AWS의 Claude Platform claude-haiku-5-5 (고정 ID, 날짜 접미사 없음)
모델 ID — Amazon Bedrock anthropic.claude-haiku-5-5
컨텍스트 창 100만 토큰 (Haiku 4.5: 20만 토큰)
최대 출력 128K (Haiku 4.5: 64K), 배치 API에서 output-300k-2026-03-24 베타 헤더 사용 시 300K
사고 방식 적응형만 가능
노력 수준 low, medium(기본), high, xhigh, max
지식 마감일 2026년 6월
MTok당 가격 — 10만 토큰 이하 프롬프트 입력 $0.10, 출력 $0.50
MTok당 가격 — 10만 토큰 초과 프롬프트 입력 $0.50, 출력 $2.50
단종 예정일 2027년 10월 7일 이전 아님

Claude 라인업에서 Haiku 5.5의 위치

모델 MTok당 입력 / 출력 기본 노력 지연 시간
Claude Fable 5.1 $10 / $50 높음 느림
Claude Opus 5.5 $4 / $20 중간 보통
Claude Sonnet 5.5 $2 / $10 높음 빠름
Claude Haiku 5.5 10만 토큰 이하 프롬프트에서 $0.10 / $0.50 중간 가장 빠름

네 모델 모두 100만 토큰 컨텍스트 창, 128K 최대 출력, 2026년 6월 지식 마감일을 공유합니다. Anthropic은 Haiku 5.5를 다음과 같은 대량·지연 시간 민감 작업에 적합한 모델로 제시합니다.

  • 분류 및 라우팅
  • 데이터 추출
  • 문서 요약
  • 실시간 지원
  • 브라우저 사용
  • Opus 5.5 또는 Sonnet 5.5의 하위 에이전트 작업

속도 비교 시에는 조건을 확인하세요. Anthropic의 “가장 빠름”은 각 모델의 표준 속도 기준이며, Fast 모드에서는 Opus보다 느립니다. 초당 토큰 수는 공개되지 않았습니다.

Claude Haiku 5.5 가격

가격은 입력 프롬프트 길이에 따라 달라집니다. 입력이 100,000 토큰을 초과하면 더 높은 요율이 적용됩니다.

Claude Haiku 5.5 가격

출처: Claude API 가격

“약 75% 저렴”은 평균치입니다.

  • 10만 토큰 이하 프롬프트: Haiku 4.5보다 90% 저렴
  • 10만 토큰 초과 프롬프트: Haiku 4.5보다 50% 저렴
  • Haiku 4.5 요청의 90%는 10만 토큰 임계값 미만
  • 새 토크나이저가 동일 텍스트에서 약 30% 더 많은 토큰을 생성하는 점이 이미 반영됨

미국 전용 추론인 inference_geo는 모든 토큰 범주에서 1.1배의 비용이 듭니다. 캐싱 가능한 최소 프롬프트 길이는 Haiku 4.5의 4,096토큰에서 512토큰으로 줄었습니다.

10만 토큰 미만에서는 GPT-6 Luna와 정가가 같습니다.

  • 입력: $0.10 / MTok
  • 출력: $0.50 / MTok
  • 캐시 읽기: $0.01 / MTok
  • 캐시 쓰기: $0.125 / MTok

다만 할증 임계값은 다릅니다. Luna는 입력 토큰이 27만 2천을 초과할 때부터 할증이 시작됩니다. 자세한 비교는 Haiku 5.5 대 GPT-6 Luna와 가격 가이드를 참고하세요.

Haiku 4.5에서 변경된 사항

Haiku 5.5로 전환하면 컨텍스트 창은 5배, 최대 출력은 2배로 늘어나며 노력 수준을 제어할 수 있습니다. 그러나 마이그레이션 가이드에 따르면 Haiku 4.5용 요청 형식을 그대로 사용하면 400 오류가 발생할 수 있습니다.

400 오류를 유발하는 변경 사항

  1. 수동 사고 예산 제거

다음 형식은 실패합니다.

   {
     "thinking": {
       "type": "enabled",
       "budget_tokens": 4096
     }
   }
Enter fullscreen mode Exit fullscreen mode

대신 적응형 사고와 노력 수준을 사용하세요.

   {
     "thinking": {
       "type": "adaptive"
     },
     "output_config": {
       "effort": "medium"
     }
   }
Enter fullscreen mode Exit fullscreen mode
  1. 샘플링 매개변수 제거

temperature, top_p, top_k를 요청에서 제거하세요.

  • 기본값이 아닌 temperature 또는 top_p는 실패합니다.
  • 모든 top_k 값은 실패합니다.
  • temperature와 top_p를 동시에 보내도 실패합니다.
  1. 어시스턴트 사전 채우기 불가

사고 기능을 비활성화하더라도 assistant 메시지 프리필은 거부됩니다.

  1. 기존 컴퓨터 사용 도구 교체

Claude API 및 Google Cloud에서는 다음 도구를 사용하세요.

   computer_toolset_20260801
Enter fullscreen mode Exit fullscreen mode

다음 도구는 실패합니다.

   computer_20250124
Enter fullscreen mode Exit fullscreen mode
  1. 대화 기록 수정 금지

반환된 사고 블록 이전의 system, tools, 이전 메시지를 수정하면 실패할 수 있습니다. 대화 기록은 추가 전용으로 유지하세요.

오류는 없지만 결과에 영향을 주는 변경 사항

  • 사고 표시: 기본 응답의 사고 블록은 서명만 있고 비어 있을 수 있습니다. 요약된 사고 내용을 받으려면 "display": "summarized"를 설정하세요.
  • 토큰 수: 동일한 텍스트도 약 30% 더 많은 토큰을 사용할 수 있습니다. max_tokens에는 사고 토큰도 포함됩니다.
  • 강제 도구 사용: tool_choice에 any 또는 특정 도구를 지정할 수 있지만, 응답에는 사고 블록이 포함되지 않습니다.
  • 거부 처리: 안전 분류기가 서버 측 폴백 없이 stop_reason: "refusal"을 반환할 수 있습니다.
  • 우선순위 계층: Haiku 5.5에서는 지원되지 않습니다.

API에서 high 이하의 노력 수준에서는 사고 기능을 비활성화할 수 있습니다. 반면 xhigh와 max에서 사고 기능을 끄면 400 오류가 발생합니다.

Haiku 4.5는 아직 단종되지 않았으며 활성 모델로 나열됩니다. 요청 JSON의 전후 차이는 Haiku 5.5 대 Haiku 4.5 가이드에서 확인할 수 있습니다.

Claude Haiku 5.5 벤치마크

Haiku 5.5 점수는 최대 노력 수준에서 측정되었으며, 대부분 5회 시도의 평균입니다.

  • Artificial Analysis: GDPval-AA, AA-Briefcase
  • Cognition: FrontierCode
  • Anthropic: Chartography(Surge AI 벤치마크)

Claude Haiku 5.5 벤치마크

수치를 비교할 때 노력 수준이 동일한지 확인해야 합니다. 예를 들어 FrontierCode는 Haiku를 max 노력으로, Sonnet 5.5를 xhigh 노력으로 비교했습니다. 이 조건에서 Sonnet은 46.2%, Haiku는 46.4%를 기록했습니다.

추가로 확인할 사항은 다음과 같습니다.

  • Anthropic은 OpenAI API를 통해 Luna의 OSWorld 점수를 실행했습니다.
  • Luna의 Terminal-Bench 점수는 공개 리더보드(Codex CLI)에서 가져왔습니다.
  • 기본 medium 노력 수준에서 Haiku 5.5는 GDPval-AA 1277점, AA-Briefcase 1372점을 기록했습니다.
  • 2026년 10월 8일 기준 독립 리더보드에는 Haiku 5.5 결과가 없었습니다.
  • Cursor는 자체 CursorBench에서 max 노력 기준 48.4%를 보고했습니다.

Anthropic은 복잡한 에이전트 코딩 작업에서는 Sonnet 5.5와 Opus 5.5가 더 적합하다고 설명합니다. 노력 수준별 점수와 비용은 벤치마크 심층 분석에서 확인하세요.

Claude Haiku 5.5 사용처

플랫폼 접근 방식 참고 사항
Claude API claude-haiku-5-5 토큰당 지불
Amazon Bedrock anthropic.claude-haiku-5-5 AWS Marketplace를 통해 청구
Google Cloud, Microsoft Foundry, AWS의 Claude Platform claude-haiku-5-5 Claude API와 동일한 ID
Claude.ai — 웹, iOS, Android 모델 선택기 무료, Pro, Max, Team, Enterprise 사용자가 선택 가능
Claude Code /model claude-haiku-5-5 v2.1.293 이상, 유료 플랜
Vercel AI Gateway anthropic/claude-haiku-5.5 $0.10 / $0.50부터
Cursor claude-haiku-5-5 다른 모델 풀

2026년 10월 8일 기준으로 OpenRouter에는 없으며 GitHub Copilot용으로도 발표되지 않았습니다.

Claude.ai 무료 플랜에서의 채팅 접근은 API 키와 다릅니다. API는 신규 사용자에게 제공되는 소량의 테스트 크레딧을 초과하면 사용량 기준으로 비용이 청구됩니다.

Max와 Team 플랜에는 월별 API 크레딧이 통합됩니다.

  • Max 5x: $100
  • Max 20x: $200
  • Team: 최대 $500

이 크레딧은 Claude Code에는 적용되지 않습니다. 무료 사용 가능 범위는 무료 접근 가이드에서 확인하세요.

Claude Code에서 haiku 별칭은 Anthropic API에서만 Haiku 5.5를 의미합니다. 다른 환경에서는 여전히 Haiku 4.5를 가리킬 수 있으므로 모델 ID를 명시하는 편이 안전합니다. 하위 에이전트 설정은 Claude Code의 Haiku 5.5를 참고하세요.

Haiku 5.5로 전환해야 하는 사람

다음 기준으로 전환 대상을 결정하세요.

  • Haiku 4.5를 실행 중인 경우: 주요 호환성 변경 사항 다섯 가지를 수정한 뒤 전환하세요. 두 모델의 점수가 함께 공개된 모든 출시 테이블 행에서 Haiku 5.5가 Haiku 4.5를 앞서며, 정가도 더 낮습니다.
  • 간단하고 반복적인 작업에 Sonnet 또는 Opus를 쓰는 경우: 분류, 추출, 요약, 하위 에이전트 작업부터 Haiku 5.5를 테스트하세요. 복잡한 에이전트 코딩에는 더 큰 모델을 유지하세요.
  • 프롬프트가 자주 10만 토큰을 초과하는 경우: 전환 전 두 요금제를 계산하세요. 임계값을 넘으면 입력 토큰당 비용이 5배로 증가합니다.
  • 보안 작업을 하는 경우: Haiku 5.5의 사이버 보호 기능은 여전히 침투 테스트를 차단합니다.

Anthropic의 출시 게시물에서 Asana는 작업 완료 지연 시간이 30% 이상 감소했다고 보고했고, Box는 Haiku 4.5보다 11점 높은 점수를 약 절반의 지연 시간으로 얻었다고 밝혔습니다. 이는 고객 주장이지 독립적인 테스트 결과는 아닙니다.

시스템 카드에는 Anthropic의 자동 감사에서 다른 모델보다 과도하게 거부했다는 내용도 있으므로, 실제 서비스 프롬프트로 거부율을 측정하세요.

첫 번째 Haiku 5.5 요청 보내기

다음 요청은 지원 티켓을 billing, bug, feature request로 분류합니다.

curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 4000,
    "thinking": {"type": "adaptive", "display": "summarized"},
    "output_config": {"effort": "low"},
    "messages": [
      {
        "role": "user",
        "content": "Classify this support ticket as billing, bug, or feature request: The export button returns a 500 error."
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

구현할 때 다음 사항을 확인하세요.

  1. temperature, top_p, top_k를 보내지 않습니다.
  2. assistant 메시지 사전 채우기를 사용하지 않습니다.
  3. 응답은 사고 블록으로 시작할 수 있으므로 콘텐츠를 문자열 하나로 가정하지 말고 type별 블록으로 처리합니다.
  4. stop_reason이 refusal 또는 max_tokens인지 검사합니다.
  5. low와 medium 요청을 각각 실행해 출력 품질과 usage를 비교합니다.

Apidog에서는 위 curl 명령을 새 요청으로 가져온 뒤 ANTHROPIC_API_KEY 환경 변수에 키를 저장할 수 있습니다. 테스트 스크립트 또는 응답 검증에 다음 조건을 추가하세요.

stop_reason != "refusal"
stop_reason != "max_tokens"
Enter fullscreen mode Exit fullscreen mode

캐싱, 배치, 스트리밍은 Haiku 5.5 API 가이드를 참고하세요. API 키 설정이 필요하면 Anthropic API 키 가이드를 확인하세요.

자주 묻는 질문

Claude Haiku 5.5는 언제 출시되었습니까?

2026년 10월 7일이며, Sonnet 5.5 출시 9일 후입니다.

Claude Haiku 5.5는 무료입니까?

Claude.ai 채팅 앱에서는 무료 사용자가 선택할 수 있습니다. API는 신규 사용자를 위한 소량의 테스트 크레딧을 제외하면 유료입니다. 모든 무료 경로를 참고하세요.

Claude Haiku 5.5의 컨텍스트 창은 얼마입니까?

Messages API에서 100만 토큰이며 최대 출력은 128K입니다.

Haiku 4.5는 단종됩니까?

아직 아닙니다. 여전히 활성 상태로 나열되어 있으며, 2026년 10월 15일 이전에는 단종되지 않습니다.

다음 단계

오늘 운영 중인 작업 하나를 선택하세요. 예를 들면 티켓 분류, 문서 요약, 구조화된 정보 추출이 적합합니다.

  1. 현재 프롬프트를 claude-haiku-5-5으로 실행합니다.
  2. low 노력 수준으로 첫 결과를 기록합니다.
  3. 동일 요청을 medium으로 복제합니다.
  4. 출력 품질, 지연 시간, usage를 현재 모델과 비교합니다.
  5. 프롬프트가 10만 토큰을 넘는다면 고비용 구간도 별도로 측정합니다.

요청, 환경 변수, 어설션을 하나의 프로젝트에서 관리하려면 Apidog을 다운로드하고, 가격 가이드로 토큰 사용량을 월별 비용으로 환산하세요.

Top comments (0)