Claude Haiku 5.5
Claude Haiku 5.5 API: Anthropic 역대 가장 빠르고 저렴하며 성능이 뛰어난 소형 모델. 100만 토큰 컨텍스트, Haiku 최초의 effort 조절, 공식 단가는 Haiku 4.5보다 최대 90% 저렴
Claude Haiku 5.5는 Anthropic이 2026년 10월 7일 공개한 새 Haiku로, Claude Haiku 4.5의 후속 모델입니다. Anthropic은 이 모델을 “지금까지 출시한 소형 모델 중 가장 저렴하고, 가장 빠르며, 성능이 가장 뛰어난 모델”이라고 소개하며, 현재 Claude 라인업에서 지연 시간이 가장 짧습니다. 속도와 비용이 중요한 대량 작업을 위해 설계되어 분류, 라우팅, 정보 추출, 요약과 컨텍스트 압축, 실시간 고객 지원, 그리고 Claude Opus 5.5나 Sonnet 5.5가 이끄는 코딩 에이전트의 서브에이전트 역할에 적합합니다. 100만 토큰 컨텍스트와 요청당 최대 12.8만 토큰 출력을 지원하고, 적응형 사고가 기본으로 켜져 있으며, effort를 조절할 수 있는 첫 Haiku입니다(low부터 max까지 5단계, 기본값 medium). 프롬프트가 10만 토큰 이하일 때 공식 가격은 100만 토큰당 입력 $0.10, 출력 $0.50으로 Haiku 4.5보다 90% 저렴합니다. 지금 연동을 준비하고 있습니다. 이메일을 남기시면 출시 당일 알려 드립니다.
공식 출시: 2026-10-07 · NezhaGate에서는 아직 호출할 수 없습니다
주요 특징
- Anthropic 역대 가장 저렴하고 빠르며 성능이 뛰어난 소형 모델이자 현재 Claude 라인업에서 지연 시간이 가장 짧은 모델
- 공식 가격 대폭 인하: 프롬프트 10만 토큰 이하에서 100만 토큰당 입력 $0.10, 출력 $0.50, 캐시 읽기 $0.01로 Haiku 4.5보다 90% 저렴. 10만 토큰 초과 시 $0.50 / $2.50로 여전히 50% 저렴. Batch API는 추가로 50% 절약
- 100만 토큰 컨텍스트(Haiku 4.5는 20만)와 요청당 최대 12.8만 토큰 출력(기존 6.4만). 이미지 입력 지원, 신뢰할 수 있는 지식 기준 시점은 2026년 6월
- effort를 조절할 수 있는 첫 Haiku: low, medium, high, xhigh, max 5단계, 기본값 medium. 적응형 사고가 기본으로 켜져 있고 간단한 요청은 사고 없이 바로 답할 수 있음
- 에이전트 성능 대폭 향상: 컴퓨터 사용 벤치마크 OSWorld 2.1은 15.7% → 72.4%, 명령줄 작업 벤치마크 Terminal-Bench 4.0은 0.0% → 39.2%로 모두 GPT-6 Luna(48.9%, 16.4%)를 앞섬
- 폭넓은 도구 지원: 도구 호출(특정 도구 강제 지정 가능), 구조화된 출력, 프롬프트 캐싱, Batch API, 컴퓨터 사용 도구 세트, 새로 추가된 브라우저 사용 도구
- Anthropic이 권하는 활용법: Opus 5.5나 Sonnet 5.5가 이끄는 코딩 에이전트에서 검색·읽기·요약 같은 수많은 작은 작업을 맡는 서브에이전트로 써서 전체 비용과 지연 시간을 줄임
- Anthropic 출시 페이지에 실린 고객 결과: Box는 Haiku 4.5보다 점수가 11점 높고 지연 시간은 약 절반, Asana는 작업 완료 지연 시간이 30% 이상 줄었다고 밝힘
이전 세대 Haiku 4.5 대비 개선점
컨텍스트 5배, 출력 2배, Haiku 최초의 effort 조절, 크게 오른 에이전트 성능. 그러면서도 가격은 더 낮습니다.
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| 출시일 | 2025-10-15 | 2026-10-07 |
| 컨텍스트 윈도우 | 20만 토큰 | 100만 토큰 |
| 요청당 최대 출력 | 6.4만 토큰 | 12.8만 토큰 |
| 사고 방식 | 수동 예산 설정(budget_tokens) | 적응형 사고, 기본으로 켜짐 |
| effort 조절 | 미지원 | low / medium / high / xhigh / max, 기본값 medium |
| 신뢰할 수 있는 지식 기준 시점 | 2025년 2월 | 2026년 6월 |
| 브라우저 사용 도구 | 미지원 | 지원 |
| 공식 가격: 입력(100만 토큰당) | $1 | $0.10(프롬프트 10만 토큰 이하) / $0.50(10만 초과) |
| 공식 가격: 출력(100만 토큰당) | $5 | $0.50 / $2.50 |
| 공식 가격: 캐시 읽기(100만 토큰당) | $0.10 | $0.01 / $0.05 |
| OSWorld 2.1 오프라인 하위 세트(컴퓨터 사용) | 15.7% | 72.4% |
| Terminal-Bench 4.0(명령줄 에이전트 작업) | 0.0% | 39.2% |
| Humanity’s Last Exam(도구 미사용 / 도구 사용) | 10.2% / 18.7% | 45.9% / 57.4% |
| GDPval-AA v2.1(실무 과제, Elo) | 735 | 1620 |
| AA-Briefcase v1.1(에이전트형 지식 작업, Elo) | 614 | 1578 |
사양과 가격은 Anthropic 공식 문서, 벤치마크 점수는 2026년 10월 7일 Anthropic 출시 발표 기준입니다. 표의 가격은 Anthropic 공식 가격이며 저희 요금이 아닙니다. Haiku 5.5는 새 토크나이저를 써서 같은 텍스트를 약 30% 더 많은 토큰으로 계산하지만, Anthropic에 따르면 평균 실행 비용은 여전히 Haiku 4.5보다 약 75% 낮습니다.
활용 사례
자주 묻는 질문
Claude Haiku 5.5는 Haiku 4.5보다 무엇이 좋아졌나요?
Claude Haiku 5.5의 공식 가격은 얼마인가요?
Haiku 5.5는 토큰을 더 많이 쓰나요?
effort는 어떻게 고르나요? 사고를 끌 수 있나요?
Haiku 4.5에서 옮기려면 무엇을 바꿔야 하나요?
여기서 Claude Haiku 5.5를 언제 호출할 수 있나요?
출시 후에는 어떻게 호출하나요? Claude Code에서도 쓸 수 있나요?
지금 바로 쓸 수 있는 Claude 모델이 있나요?
지금 사용 가능
다음 모델은 지금 NezhaGate에서 바로 호출할 수 있습니다:
Claude Sonnet 5.5
Anthropic 신세대 Sonnet · 속도와 지능의 최적 조합
Claude Opus 5.5
Anthropic 차세대 Opus · 100만 토큰 컨텍스트 · 적응형 사고
Claude Sonnet 5
Anthropic 차세대 Sonnet · Opus에 가까운 코딩
Gemini 3.8 Flash
최신 Flash · 적응형 사고
DeepSeek V4.1 Flash
DeepSeek의 현재 Flash 모델 · 사고 모드 켜고 끄기
GPT-6 Luna
GPT-6 제품군에서 가장 효율적인 대량 처리 모델