Introducing Claude Haiku 5.5
Quick Summary
Anthropic은 고빈도·비용 민감 작업을 겨냥한 Claude Haiku 5.5를 출시하고, Haiku 4.5 대비 평균 실행 비용 약 75% 절감과 성능 개선, Sonnet 5.5 캐시 읽기 가격 인하 및 Max·Team 구독자용 월간 API 크레딧을 발표했다.
🖼️ 인포그래픽

🖼️ 4컷 인포그래픽

💡 한 줄 요약
Anthropic은 고빈도·비용 민감 작업을 겨냥한 Claude Haiku 5.5를 출시하고, Haiku 4.5 대비 평균 실행 비용 약 75% 절감과 성능 개선, Sonnet 5.5 캐시 읽기 가격 인하 및 Max·Team 구독자용 월간 API 크레딧을 발표했다.
📌 핵심 요약
- 2026년 10월 7일 발표된 Claude Haiku 5.5는 요약·압축·데이터베이스 질의·분류, 코딩 보조 에이전트, 실시간 고객 지원·브라우저 사용에 적합하도록 설계됐다. Anthropic은 자사가 출시한 소형 모델 중 가장 저렴하고 빠르며 유능하다고 설명하며, 속도 우위는 각 모델의 표준 속도 기준이고 Fast Mode의 Opus보다는 느리다고 명시했다.
- Haiku 5.5는 GDPval-AA v2.1에서 1620, OSWorld 2.1 오프라인 하위 집합에서 72.4%, Terminal-Bench 4.0에서 39.2%를 기록했다. 처음으로 effort 설정을 지원하는 Haiku 계열 모델이며, Anthropic은 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 더 적합하다고 설명했다.
- Haiku 5.5는 Haiku 4.5보다 평균 실행 비용이 약 75% 낮다. 100,000토큰 이하 프롬프트의 토큰 단가는 90%, 이를 초과하는 프롬프트는 50% 낮으며, 평균 비용 추정에는 작업당 토큰 사용량이 조금 늘어나는 토크나이저 변경도 반영됐다. 초기 고객들은 속도·정확도 개선을 보고했으며, HubSpot은 세 차례 실행 평균 92.8%, AlphaSense는 400개 질의 평가에서 Haiku 4.5의 0.76 대비 0.84를 보고했다.
- Anthropic은 Haiku 4.5 대비 거의 모든 정렬 평가에서 개선됐다고 보고했다. 사이버 보안 보호 장치는 Sonnet 5.5보다 폭넓은 방어 작업을 허용하지만 침투 테스트 등을 차단하며, 생물학 보호 장치는 Sonnet 5·Sonnet 5.5·Opus 5와 같다. Haiku 5.5는 Amazon Web Services·Google Cloud·Microsoft Azure를 포함한 모든 플랫폼에서 제공되며, Claude Platform의 모델 식별자는 claude-haiku-5-5다.
- Sonnet 5.5 캐시 읽기 가격은 100만 토큰당 $0.20에서 $0.10으로 내려 대부분의 에이전트 작업 비용이 약 20% 줄어든다고 설명됐다. 발표 주간에 도입될 월간 API 크레딧은 Max 5x에 $100, Max 20x에 $200, Team에 사용자 간 공동 사용 기준 최대 $500이며 모든 모델에 사용할 수 있다. Claude Python·TypeScript SDK에는 컴퓨터 사용·브라우저 사용 베타 지원이 추가된다.
🧩 주요 포인트
- 작업 범위에 따른 모델 선택: Haiku 5.5의 속도·비용 개선은 요약·압축·보조 에이전트처럼 범위가 좁고 반복적인 작업의 활용 여지를 넓히며, 복잡한 에이전트 코딩에서는 Sonnet 5.5·Opus 5.5의 우위가 유지된다.
- 단가와 실제 비용의 구분: 100,000토큰 기준의 차등 가격, 토크나이저 변경, effort 설정을 함께 고려해야 Haiku 5.5의 평균 약 75% 비용 절감이 개별 작업에도 적용되는지 판단할 수 있다.
- 도입 가능성과 활용 제약: 주요 클라우드 제공, Max·Team API 크레딧, Python·TypeScript SDK 베타 지원은 활용 경로를 넓히지만, 침투 테스트 차단과 생물학 보호 장치의 제한은 작업 적합성 판단에 계속 영향을 준다.
🧠 상세 정리
1. 고빈도 작업을 위한 Haiku 5.5 출시
Anthropic은 2026년 10월 7일 Claude Haiku 5.5를 발표하며, 자사가 지금까지 출시한 소형 모델 중 가장 저렴하고 빠르며 유능한 모델이라고 소개했다. 핵심 대상은 처리량이 많고 비용에 민감한 작업으로, 요약·압축·데이터베이스 질의·분류처럼 짧고 반복적인 요청을 안정적으로 처리하도록 설계됐다는 설명이다. 코딩에서는 Opus 5.5와 Sonnet 5.5의 보조 에이전트로 함께 사용할 수 있으며, 실시간 고객 지원과 브라우저 사용처럼 응답 속도가 중요한 작업에도 적합하다고 제시했다. 다만 가장 빠르다는 주장은 각 모델의 표준 속도를 비교한 것으로, Fast Mode로 실행되는 Opus 모델보다는 느리다는 단서가 붙는다. 발표는 Haiku 5.5의 성능과 가격뿐 아니라 Sonnet 5.5의 캐시 읽기 가격 인하 및 Max·Team 구독자의 API 활용 지원까지 함께 다룬다.
2. 지식 업무와 컴퓨터 사용 벤치마크
성능표는 Haiku 5.5, Haiku 4.5, GPT-6 Luna를 비교하고 Sonnet 5.5를 참고 모델로 제시한다. 지식 업무 평가인 GDPval-AA v2.1의 점수는 이 순서대로 1620, 735, 1437, 1840이며, AA-Briefcase v1.1에서는 각각 1578, 614, 1336, 1824다. 컴퓨터 사용 평가인 OSWorld 2.1의 오프라인 하위 집합에서는 각각 72.4%, 15.7%, 48.9%, 83.9%를 기록했다. 이 결과에서 Haiku 5.5는 두 지식 업무 평가와 컴퓨터 사용 평가 모두 Haiku 4.5 및 GPT-6 Luna보다 높은 수치를 보였지만, Sonnet 5.5에는 미치지 못했다. 본문은 OSWorld를 실제 컴퓨터에서 길고 여러 단계로 이루어진 작업을 완료하는 능력의 평가로 설명하고, Artificial Analysis의 GDPval-AA v2.1은 44개 직종의 실제 전문 업무를 평가한다고 소개하며, 구체적인 평가 방법은 Haiku 5.5 System Card를 참조하도록 안내한다.
3. 추론·코딩 성능과 effort 조절
Humanity’s Last Exam에서 Haiku 5.5와 Haiku 4.5는 도구 없이 각각 45.9%와 10.2%, 도구를 사용하면 57.4%와 18.7%를 기록했으며, Sonnet 5.5의 해당 수치는 56.9%와 64.5%이고 GPT-6 Luna의 결과는 제시되지 않았다. 에이전트 코딩 평가 Terminal-Bench 4.0에서는 Haiku 5.5가 39.2%, Haiku 4.5가 0.0%, GPT-6 Luna가 16.4%, Sonnet 5.5가 70.6%를 기록했다. FrontierCode 1.1의 Main 평가에서는 Haiku 5.5가 46.4%, GPT-6 Luna가 42.4%, Xhigh 설정의 Sonnet 5.5가 52.1%였으며, Haiku 4.5의 결과는 제시되지 않았다. 시각적 추론 평가 Chartography의 도구 없는 결과는 Haiku 5.5 46.4%, Haiku 4.5 6.4%, GPT-6 Luna 29.1%, Sonnet 5.5 61.6%다. Haiku 5.5는 effort 설정을 조절할 수 있는 첫 Haiku 계열 모델로, 사용자가 비용과 지능 중 어느 쪽을 최적화할지 선택할 수 있다. 본문은 OSWorld 2.1 오프라인 하위 집합, GDPval-AA v2.1, 도구 없는 Humanity’s Last Exam에 대해 effort 설정별 정확도와 비용의 관계를 차트로 제시하며, 마지막 평가는 전문가 수준의 학술 지식과 추론을 측정한다고 설명한다.
4. Asana·HubSpot·AlphaSense의 초기 평가
Anthropic은 초기 고객 테스트에서도 앞서 제시한 성능과 비용 개선에 부합하는 결과가 보고됐다고 설명하며 고객들의 평가를 인용한다. Asana의 Aaron Vinh는 AI Teammates 평가에서 버그 분류, 프로젝트 설정, 대규모 포트폴리오의 고위험·기한 초과 업무 검색 등을 시험했으며, 현재 사용 모델보다 작업 완료 지연이 30% 넘게 줄고 에이전트 턴당 추론 속도가 최대 2.5배 빨라졌다고 말했다. HubSpot의 Ze’ev Klapow는 거래 보고 등 CRM 작업을 모의 포털에서 평가했고, Haiku 5.5가 세 차례 실행 평균 92.8%로 해당 평가군에서 지금까지 가장 높은 점수를 기록했다고 밝혔다. 오래됐지만 판단이 모호한 기록을 찾는 CRM 감사 작업에서도 시험한 모델 중 완료 속도가 가장 빠르고 적중률이 가장 높으며 오탐률이 가장 낮았다는 설명이다. AlphaSense의 Daniel Campos는 운영 환경에서 주당 약 800만 회 호출되는 Ask in Document에 대해 400개 질의를 평가했고, Haiku 5.5가 Haiku 4.5의 0.76 대비 0.84로 통계적으로 유의한 개선을 보였다고 보고했다.
5. Box·Rogo·Cognition이 제시한 활용 사례
Box의 Yashodha Bhavnani는 대량의 기업 콘텐츠를 처리하는 Box AI에서 효율과 비용 관리가 중요하다고 설명하며, 초기 테스트에서 Haiku 5.5가 Haiku 4.5보다 11점 높은 점수를 약 절반의 지연으로 달성했다고 밝혔다. 활용 대상으로는 비용 보고서, 재무 요약, 주간 반복 검토처럼 규모가 큰 분석 작업을 제시했다. Rogo의 Alex Wang은 빠른 조회·보조 에이전트·요약 등 짧고 처리량이 많은 작업에 적합하다고 평가했고, 큰 모델이 발표 자료를 만드는 동안 Haiku 5.5가 10-K에서 필요한 부문 매출 항목을 추출하는 사례를 들었다. 그는 해당 역할에 맡길 만한 정확도를 갖추면서도 빠르고 저렴해 자주 실행할 수 있다고 설명했다. Cognition의 Walden Yan은 Haiku 5.5가 Devin Fusion의 보조 모델 선택지로 추가됐으며, 이를 사용할 때 비용과 지연을 줄이면서 FrontierCode 점수 66.2를 유지한다고 밝혔다. 이 구성은 Opus 5.5를 주도 모델로 사용하는 Devin CLI에서 바로 시험할 수 있다고 안내됐다.
6. 100,000토큰 기준의 차등 가격과 평균 비용
Haiku 5.5의 가격은 프롬프트가 100,000토큰 이하인지 이를 초과하는지에 따라 달라지며, 이전 Haiku 모델 요청의 약 90%가 전자에 해당했다. 100만 토큰당 Haiku 5.5의 캐시 읽기는 각각 $0.01과 $0.05, 캐시 쓰기는 $0.125와 $0.625, 입력은 $0.10과 $0.50, 출력은 $0.50과 $2.50다. 같은 항목 순서로 Haiku 4.5는 $0.10, $1.25, $1.00, $5.00이고 Sonnet 5.5는 $0.10, $2.50, $2.00, $10.00로 제시된다. 이에 따라 Haiku 5.5의 토큰 단가는 Haiku 4.5보다 100,000토큰 이하 요청에서 90%, 이를 초과하는 요청에서 50% 낮다. Anthropic이 제시한 평균 실행 비용 약 75% 절감은 요청 길이의 분포뿐 아니라 같은 작업을 완료하는 데 소비되는 토큰 수의 변화도 반영한 추정이다. Haiku 5.5는 Sonnet 5.5와 Opus 5.5의 것과 유사한 새 토크나이저를 사용하므로 작업당 토큰 사용량이 조금 늘어난다는 설명이 덧붙는다.
7. 안전성 평가, 보호 장치와 제공 플랫폼
Anthropic은 Haiku 5.5가 Haiku 4.5 대비 거의 모든 정렬 평가에서 크게 개선됐으며, 특히 정렬에 어긋나는 행동의 사례와 오용에 협조하려는 경향이 줄었다고 보고하고 세부 평가 과정과 결과는 시스템 카드에 제시한다고 설명했다. 사이버 보안 보호 장치는 Haiku 4.5보다 엄격하지만 다른 최근 모델에 적용된 것보다는 다소 덜 엄격하며, Sonnet 5.5보다 폭넓은 방어 작업을 허용하면서도 침투 테스트와 공격자가 사용할 가능성이 더 높은 기법은 차단한다. 생물학 보호 장치는 Sonnet 5·Sonnet 5.5·Opus 5와 동일하게 연구 질문을 허용하되 해를 끼칠 가능성이 높다고 판단하는 요청은 제한한다. 더 폭넓은 생물학·사이버 활동을 수행하는 조직은 Life Sciences Verification Program과 Cyber Verification Program에 신청할 수 있다. Haiku 5.5는 발표 시점부터 Amazon Web Services, Google Cloud, Microsoft Azure를 포함한 모든 플랫폼에서 제공된다. Claude Platform에서는 claude-haiku-5-5로 사용할 수 있으며, 이전을 위한 세부 사항은 마이그레이션 가이드로 안내한다.
8. Sonnet 5.5 가격 인하와 모델별 작업 적합성
Anthropic은 발표 당일부터 Claude Sonnet 5.5의 캐시 읽기 가격을 100만 토큰당 $0.20에서 $0.10으로 50% 낮춘다고 밝혔다. 캐시 읽기가 모델의 토큰 소비에서 큰 비중을 차지하기 때문에, 대부분의 에이전트 작업에서는 Sonnet 5.5의 비용이 약 20% 감소한다는 설명이다. 본문은 명령줄 인터페이스에서 복잡하고 여러 단계로 이루어진 전문 작업을 완료하는 능력을 측정하는 Terminal-Bench 4.0을 통해 가격 인하 이후의 성능 대비 비용 관계를 제시한다. 이어 이 평가와 같은 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 여전히 더 나은 선택이라고 명시한다. 반면 Haiku 5.5는 압축·요약·보조 에이전트처럼 범위가 더 좁은 작업에 가장 적합하며, 이전 Claude 버전에서는 비용 때문에 수행하기 어려웠던 작업의 활용 가능성을 넓히는 모델로 설명된다.
9. 월간 API 크레딧과 개발자 SDK 업데이트
Anthropic은 발표가 이루어진 주간에 모든 Max·Team 구독자를 대상으로 Claude Platform에서 사용할 수 있는 새 월간 API 크레딧을 도입할 예정이라고 밝혔다. Max 5x 사용자는 매월 $100, Max 20x 사용자는 $200를 받고, Team 구독자는 사용자들이 공동으로 사용하는 방식으로 최대 $500를 제공받는다. 이 크레딧은 API를 호출하는 도구·앱·에이전트 제작을 실험하도록 지원하기 위한 것이며, 특정 모델에 한정되지 않고 모든 모델에 사용할 수 있다. 구체적인 정보는 Help Center 문서를 통해 안내한다. 개발자를 위해 Claude Python 및 TypeScript SDK도 업데이트해 컴퓨터 사용과 브라우저 사용을 베타로 지원한다. Anthropic은 Haiku 5.5의 속도·성능·가격 조합이 이 작업들에 특히 적합하다고 설명하며, 관련 사용법은 Claude Platform 문서로 연결한다.
🧾 핵심 주장 / 시사점
- Haiku 5.5의 개선은 작은 모델에 더 많은 반복 작업을 맡길 근거를 제공하지만, 벤치마크와 본문의 설명은 복잡한 코딩에서 상위 모델을 계속 선택할 이유도 보여준다.
- 평균 비용 약 75% 절감은 모든 요청에 동일하게 적용되는 할인율이 아니다. 프롬프트 길이에 따른 단가 차이와 토크나이저 변경을 함께 반영해야 실제 작업 비용을 해석할 수 있다.
- API 크레딧과 SDK 베타 지원은 에이전트·앱 실험의 접근성을 넓히는 조치이며, 실제 활용 범위는 모델별 작업 적합성과 사이버 보안·생물학 보호 장치에 함께 좌우된다.
✅ 액션 아이템
- 요약·압축·보조 에이전트에는 Haiku 5.5의 적용을 검토하고, 복잡한 에이전트 코딩에는 Sonnet 5.5·Opus 5.5의 적합성을 비교한다.
- Haiku 5.5의 비용을 평가할 때 100,000토큰 기준의 차등 가격, 토크나이저 변경, effort 설정을 함께 반영한다.
- Max·Team API 크레딧과 Python·TypeScript SDK 베타 지원의 활용 가능성을 검토하고, 침투 테스트 차단과 생물학 보호 장치의 제한을 작업 적합성 판단에 반영한다.
❓ 열린 질문
- 대상 작업에서 Haiku 5.5의 effort 설정을 어떻게 선택해야 비용과 성능의 균형을 맞출 수 있는가?
- 100,000토큰 기준의 요청 분포와 토크나이저 변경을 반영하면 실제 Haiku 5.5 비용 절감률은 평균 약 75%와 얼마나 달라지는가?
- 요약·압축·보조 에이전트와 복잡한 에이전트 코딩 사이에서 Haiku 5.5와 Sonnet 5.5·Opus 5.5를 선택하는 기준은 무엇인가?