Claude Haiku 5.5는 Anthropic이 2026년 10월 7일 공개한 작은 모델로, 대량으로 반복하는 일을 빠르고 싸게 처리하도록 만들어졌습니다. API 가격은 10만 토큰 이하 요청 기준 입력 100만 토큰당 0.1달러로 Haiku 4.5보다 90% 낮아졌는데요. 이 글에서는 공식 발표와 문서를 바탕으로 Haiku 5.5의 가격과 특징, Sonnet 5.5와 나눠 쓰는 기준을 정리했습니다.
지난번 Sonnet 5.5와 Opus 5.5 비교 글을 쓸 때만 해도 Haiku 5.5는 「몇 주 안에 합류 예정」이었는데요. 그 Haiku 5.5가 10월 7일 나오면서 Claude 5.5 제품군이 Opus, Sonnet, Haiku까지 모두 갖춰졌습니다. "가장 싼 모델이면 성능이 많이 떨어지는 거 아닐까?" 하는 생각이 먼저 드실 텐데요. 이번 글에서는 Claude Haiku 5.5가 어떤 모델인지, 얼마인지, 어떤 일에 맡기면 좋은지 차례로 정리해 보겠습니다.
1. Claude Haiku 5.5는 어떤 모델일까요?
Anthropic 발표는 Haiku 5.5를 지금까지 내놓은 작은 모델 중 가장 싸고, 가장 빠르고, 가장 뛰어난 모델이라고 소개했습니다. 대량으로, 비용을 아껴야 하는 작업을 위해 설계했다고 밝혔고, 요약이나 분류처럼 빠르게 반복하는 일을 안정적으로 처리한다고 설명했는데요. 지금까지 나온 Anthropic 모델 중 가장 빠른 모델이라(Opus 모델의 빠른 모드는 제외), 실시간 고객 상담이나 브라우저 조작처럼 속도가 중요한 일에 특히 잘 맞는다고 합니다.
Haiku 5.5 문서를 보면 Haiku 4.5에서 달라진 점은 크게 세 가지입니다.
- 노력(effort) 수준 조절: Haiku 계열 모델 중 처음으로 노력 수준을 고를 수 있습니다. 노력을 낮추면 빠르고 싸게, 높이면 더 꼼꼼하게 답하는 식이죠.
- 더 긴 입력과 출력: 한 번에 읽을 수 있는 분량(컨텍스트 윈도우)이 20만 토큰에서 100만 토큰으로, 최대 출력이 6만 4천 토큰에서 12만 8천 토큰으로 늘었습니다.
- 사고(thinking) 기본 켜짐: 모델이 문제에 따라 얼마나 생각할지 스스로 정하는 적응형 사고가 기본으로 켜져 있습니다.
Claude 앱에서도 쓸 수 있는데요. Anthropic은 claude.ai와 iOS·안드로이드 앱에서 쓰는 Haiku 5.5 시스템 프롬프트를 공개했고, 모델·노력 설정 도움말에도 노력 수준을 고를 수 있는 모델로 Haiku 5.5가 올라 있습니다. 다만 Claude 앱에서는 Haiku 5.5의 사고 기능을 끌 수 없고, 요금제별로 어디까지 쓸 수 있는지는 공식 문서에서 찾지 못했습니다.
2. Claude Haiku 5.5 가격은 얼마일까요?
Haiku 5.5는 요청 길이에 따라 가격이 두 단계로 나뉩니다. 가격 문서에 따르면 Claude 4.6 이후 모델 중 요청 길이로 가격이 달라지는 것은 Haiku 5.5뿐인데요. 같은 문서에 정리된 100만 토큰당 API 가격은 이렇습니다.
| 모델 | 입력 | 출력 |
|---|---|---|
| Haiku 5.5 (요청 10만 토큰 이하) | 0.1달러 | 0.5달러 |
| Haiku 5.5 (요청 10만 토큰 초과) | 0.5달러 | 2.5달러 |
| Haiku 4.5 | 1달러 | 5달러 |
| Sonnet 5.5 | 2달러 | 10달러 |
Anthropic은 Haiku 5.5가 10만 토큰 이하 요청에서 Haiku 4.5보다 90%, 그보다 긴 요청에서 50% 싸다고 밝혔는데요. 한 가지 주의할 점은 Haiku 5.5가 새 토크나이저(글을 토큰으로 자르는 방식)를 쓴다는 것입니다. 문서에 따르면 같은 글이 Haiku 4.5보다 토큰 수로 약 30% 더 많이 세어지기 때문에, 비용을 계산할 때는 토큰 단가만 보지 말고 실제 토큰 수를 다시 세어 보셔야 합니다.
가격은 10만 토큰 이하 요청 기준입니다. 컨텍스트 윈도우와 최대 출력은 같습니다.
대량 작업이라면 할인도 함께 챙겨 볼 만한데요. 급하지 않은 요청을 모아서 보내는 Batch API는 입력과 출력 모두 50% 할인되고, 같은 앞부분을 반복해서 보내는 경우에는 프롬프트 캐시를 읽는 값이 따로 더 낮게 매겨집니다. 그렇다면 이렇게 싼 Haiku 5.5로 Sonnet 5.5를 대신해도 되는 걸까요?
3. Haiku 5.5와 Sonnet 5.5 차이는 무엇일까요?
모델 개요 문서는 두 모델을 이렇게 소개합니다. Sonnet 5.5는 「속도와 지능의 가장 좋은 조합」이고, Haiku 5.5는 「분류, 추출, 라우팅처럼 대량으로 처리하고 응답 속도가 중요한 작업용」인데요. 상대적 속도는 Sonnet 5.5가 「빠름」, Haiku 5.5가 「가장 빠름」으로 표시되어 있고, 컨텍스트 윈도우 100만 토큰과 최대 출력 12만 8천 토큰은 같습니다.
능력 차이도 분명히 있습니다. Anthropic은 발표문에서 Terminal-Bench 4.0으로 측정하는 복잡한 에이전트 코딩 작업에는 여전히 Sonnet 5.5와 Opus 5.5가 더 나은 선택이라고 적었는데요. 대신 코딩 작업에서는 Haiku 5.5가 Opus 5.5나 Sonnet 5.5 아래에서 일부를 나눠 맡는 보조 에이전트(서브에이전트)로 잘 어울린다고 했습니다.
이 관계는 택배 물류센터에 빗대면 이해하기 쉬운데요. 수많은 상자를 지역별로 빠르게 나누는 분류 라인이 Haiku 5.5라면, 깨지기 쉬운 물건이나 주소가 애매한 상자처럼 판단이 필요한 짐을 따로 받아 처리하는 담당자가 Sonnet 5.5나 Opus 5.5입니다. 분류 라인이 빠르고 싸게 대부분의 상자를 처리해 주면, 사람 손이 필요한 상자에만 비싼 시간을 쓸 수 있죠.
단순하고 양이 많은 일은 Haiku 5.5가 처리하고, 판단이 필요한 일만 큰 모델로 넘기는 구조입니다.
모델 선택 가이드도 같은 방식을 소개하는데요. 값싼 모델이 대부분의 작업을 처리하고 어려운 판단만 큰 모델에 넘기면, 토큰 대부분이 낮은 단가로 계산된다고 설명합니다.
4. 마케터는 Haiku 5.5를 어떤 일에 쓰면 좋을까요?
공식 문서와 발표문이 꼽은 Haiku 5.5의 용도는 분류, 추출, 라우팅(요청을 알맞은 곳으로 나눠 보내는 일), 요약, 실시간 고객 상담입니다. 이를 마케팅 실무에 대입해 보면 이런 일이 떠오르는데요. 어디까지나 공식 용도를 바탕으로 제가 정리한 예시라, 자신의 업무에 맞게 조정해 주세요.
- 분류: 상품 리뷰나 고객 문의를 「배송」, 「품질」, 「환불」처럼 정해 둔 유형으로 나누기
- 추출: 상품 상세 페이지 문구에서 소재, 사이즈, 가격 같은 항목만 뽑아 표로 정리하기
- 요약: 매일 쌓이는 문의 내역이나 회의록을 짧게 줄이기
- 라우팅: 들어온 문의를 담당 부서별로 나눠 보내기
발표문에는 HubSpot의 평가도 실려 있는데요. HubSpot은 거래 보고 같은 CRM 작업으로 새 모델을 평가하고 주로 작고 효율적인 모델을 시험하는데, Haiku 5.5가 그 평가에서 지금까지 본 가장 좋은 점수를 받았다고 밝혔습니다.
그렇다면 처음부터 Haiku 5.5로 시작해도 될까요? 모델 선택 가이드는 지연 시간이 중요하거나 비용에 민감하고, 양은 많지만 단순한 작업이라면 Haiku 5.5로 먼저 시작하는 「효율 우선」 방식을 권합니다.
Anthropic 모델 선택 가이드의 「효율 우선」 방식을 단계로 옮긴 그림입니다.
같은 가이드는 모델을 바꾸기 전에 노력 수준부터 조정해 보는 것이 나은 경우가 많다고도 적고 있습니다. Haiku 5.5의 API 기본 노력 수준은 Medium이라, 결과가 아쉬우면 한 단계 올려 보고, 그래도 부족할 때 Sonnet 5.5로 옮기는 순서가 자연스럽습니다.
※ 참고 사항: API로 쓰고 있다면 확인할 것
Haiku 4.5를 API로 쓰는 업무 자동화가 있다면, 모델 이름만 바꿔서는 안 되는 부분이 있는데요. 마이그레이션 가이드에서 실무자가 알아 둘 만한 것만 추리면 이렇습니다.
- 토큰 수 다시 세기: 같은 글이 약 30% 더 많은 토큰으로 세어져, 비용 추정과 최대 출력 설정을 다시 봐야 합니다.
- temperature 설정 빼기: 답의 무작위성을 조절하던
temperature,top_p,top_k는 요청에서 빼야 하는데요, 기본값이 아닌temperature·top_p값이나top_k를 보내면 오류가 나기 때문입니다. - 사고 블록 처리: 사고가 기본으로 켜져 있어 응답 앞에 사고 블록이 붙을 수 있어서, 첫 번째 블록을 답으로 읽던 코드는 고쳐야 합니다.
- 거절 응답 처리: 안전 분류기가 요청을 거절할 수 있어, 거절 응답(
refusal)을 받는 경우도 대비해야 합니다.
참고로 같은 날 Claude Max와 Team 요금제에 매달 API 크레딧이 포함되기 시작했는데요. 도움말에 따르면 Max 5x는 월 100달러, Max 20x는 월 200달러, Team은 좌석별 금액을 합쳐 최대 500달러이고, 남은 크레딧은 다음 결제 주기로 넘어가지 않습니다. Free와 Pro 요금제는 대상이 아니니, 이 부분은 요금제를 확인해 보시길 권합니다.
정리하면 Claude Haiku 5.5는 분류, 추출, 요약처럼 양이 많고 형식이 정해진 일을 빠르고 싸게 처리하는 모델이고, 판단이 많이 필요한 일은 여전히 Sonnet 5.5나 Opus 5.5의 몫입니다. 저도 리뷰 분류처럼 반복되는 일을 Haiku 5.5에 맡기는 방법을 공부하면서 다시 정리해 보겠습니다. 자세한 내용은 Haiku 5.5 발표문과 모델 문서를 참고해 주세요.
자주 묻는 질문
- Claude Haiku 5.5 가격은 얼마인가요?
- API 기준으로 요청이 10만 토큰 이하면 입력 100만 토큰당 0.1달러, 출력 100만 토큰당 0.5달러이고, 10만 토큰을 넘으면 입력 0.5달러, 출력 2.5달러입니다. Batch API로 보내면 입력과 출력 모두 50% 할인됩니다.
- Haiku 5.5와 Sonnet 5.5 차이는 무엇인가요?
- Haiku 5.5는 분류·추출·라우팅처럼 양이 많고 응답 속도가 중요한 작업용이고, Sonnet 5.5는 속도와 지능의 균형을 맞춘 모델입니다. 10만 토큰 이하 요청 기준 API 가격은 Haiku 5.5가 Sonnet 5.5의 20분의 1이고, 복잡한 에이전트 코딩에는 Sonnet 5.5가 더 낫다고 Anthropic은 밝혔습니다.
- Claude 앱에서도 Haiku 5.5를 쓸 수 있나요?
- Anthropic이 claude.ai와 iOS·안드로이드 앱용 Haiku 5.5 시스템 프롬프트를 공개했고, 모델·노력 설정 도움말에도 Haiku 5.5가 올라 있습니다. 다만 요금제별 제공 범위는 공식 문서에서 확인하지 못했으니 모델 메뉴에서 직접 확인해 주세요.
- Haiku 4.5에서 Haiku 5.5로 바꾸면 비용이 무조건 줄어드나요?
- 토큰 단가는 크게 낮아졌지만, 새 토크나이저 때문에 같은 글이 약 30% 더 많은 토큰으로 세어집니다. 또 10만 토큰을 넘는 요청은 더 높은 단가가 붙으니, 실제 자료로 토큰 수를 다시 세어 비교해 보시길 권합니다.
관련 글 더 보기
Claude 모델을 고를 때 함께 보면 좋은 글들입니다.
- Claude Sonnet 5.5 출시 | Opus 5.5와 차이, 업무별로 고르는 법 - Sonnet 5.5와 Opus 5.5를 나눠 쓰는 기준과 노력 수준 고르는 법
- 토큰과 컨텍스트 윈도우란? AI에 긴 자료를 넣기 전에 알아 둘 기초 - 토큰 단위 요금과 100만 토큰 컨텍스트가 무슨 뜻인지
- 챗봇, AI 에이전트, 자동화는 무엇이 다를까 - 서브에이전트와 업무 자동화를 이해하는 기초
