NezhaGateNezhaGate
Anthropic ● 출시 예정

Claude Haiku 5.5

claude-haiku-5-5

Claude Haiku 5.5 API: Anthropic 역대 가장 빠르고 저렴하며 성능이 뛰어난 소형 모델. 100만 토큰 컨텍스트, Haiku 최초의 effort 조절, 공식 단가는 Haiku 4.5보다 최대 90% 저렴

Claude Haiku 5.5는 Anthropic이 2026년 10월 7일 공개한 새 Haiku로, Claude Haiku 4.5의 후속 모델입니다. Anthropic은 이 모델을 “지금까지 출시한 소형 모델 중 가장 저렴하고, 가장 빠르며, 성능이 가장 뛰어난 모델”이라고 소개하며, 현재 Claude 라인업에서 지연 시간이 가장 짧습니다. 속도와 비용이 중요한 대량 작업을 위해 설계되어 분류, 라우팅, 정보 추출, 요약과 컨텍스트 압축, 실시간 고객 지원, 그리고 Claude Opus 5.5나 Sonnet 5.5가 이끄는 코딩 에이전트의 서브에이전트 역할에 적합합니다. 100만 토큰 컨텍스트와 요청당 최대 12.8만 토큰 출력을 지원하고, 적응형 사고가 기본으로 켜져 있으며, effort를 조절할 수 있는 첫 Haiku입니다(low부터 max까지 5단계, 기본값 medium). 프롬프트가 10만 토큰 이하일 때 공식 가격은 100만 토큰당 입력 $0.10, 출력 $0.50으로 Haiku 4.5보다 90% 저렴합니다. 지금 연동을 준비하고 있습니다. 이메일을 남기시면 출시 당일 알려 드립니다.

공식 출시: 2026-10-07 · NezhaGate에서는 아직 호출할 수 없습니다

주요 특징

이전 세대 Haiku 4.5 대비 개선점

컨텍스트 5배, 출력 2배, Haiku 최초의 effort 조절, 크게 오른 에이전트 성능. 그러면서도 가격은 더 낮습니다.

Claude Haiku 4.5Claude Haiku 5.5
출시일2025-10-152026-10-07
컨텍스트 윈도우20만 토큰100만 토큰
요청당 최대 출력6.4만 토큰12.8만 토큰
사고 방식수동 예산 설정(budget_tokens)적응형 사고, 기본으로 켜짐
effort 조절미지원low / medium / high / xhigh / max, 기본값 medium
신뢰할 수 있는 지식 기준 시점2025년 2월2026년 6월
브라우저 사용 도구미지원지원
공식 가격: 입력(100만 토큰당)$1$0.10(프롬프트 10만 토큰 이하) / $0.50(10만 초과)
공식 가격: 출력(100만 토큰당)$5$0.50 / $2.50
공식 가격: 캐시 읽기(100만 토큰당)$0.10$0.01 / $0.05
OSWorld 2.1 오프라인 하위 세트(컴퓨터 사용)15.7%72.4%
Terminal-Bench 4.0(명령줄 에이전트 작업)0.0%39.2%
Humanity’s Last Exam(도구 미사용 / 도구 사용)10.2% / 18.7%45.9% / 57.4%
GDPval-AA v2.1(실무 과제, Elo)7351620
AA-Briefcase v1.1(에이전트형 지식 작업, Elo)6141578

사양과 가격은 Anthropic 공식 문서, 벤치마크 점수는 2026년 10월 7일 Anthropic 출시 발표 기준입니다. 표의 가격은 Anthropic 공식 가격이며 저희 요금이 아닙니다. Haiku 5.5는 새 토크나이저를 써서 같은 텍스트를 약 30% 더 많은 토큰으로 계산하지만, Anthropic에 따르면 평균 실행 비용은 여전히 Haiku 4.5보다 약 75% 낮습니다.

활용 사례

대량 분류, 태깅, 의도 파악, 요청 라우팅
정보 추출: 계약서, 웹 페이지, 채팅 기록에서 필드를 뽑아 구조화된 JSON으로 출력
긴 문서와 긴 대화의 요약, 컨텍스트 압축
코딩 에이전트의 서브에이전트: 코드 검색, 파일 읽기, 명령 실행, 결과 정리
실시간 고객 지원, 챗봇, 데이터베이스 조회형 Q&A
브라우저·컴퓨터 사용 에이전트: 양식 입력, 페이지 탐색, 여러 사이트의 정보 수집

자주 묻는 질문

Claude Haiku 5.5는 Haiku 4.5보다 무엇이 좋아졌나요?
크게 다섯 가지입니다. ① 컨텍스트가 20만에서 100만 토큰으로, 출력 상한이 6.4만에서 12.8만 토큰으로 늘었습니다. ② 사고 방식이 수동 예산 설정(budget_tokens)에서 적응형 사고로 바뀌었고, Haiku 최초로 effort를 조절할 수 있습니다. ③ 에이전트 성능이 크게 올라 OSWorld 2.1은 15.7%에서 72.4%, Terminal-Bench 4.0은 0.0%에서 39.2%, Humanity’s Last Exam(도구 미사용)은 10.2%에서 45.9%가 되었습니다. ④ 신뢰할 수 있는 지식 기준 시점이 2025년 2월에서 2026년 6월로 바뀌었고, 브라우저 사용 도구가 새로 추가되었습니다. ⑤ 가격은 프롬프트 10만 토큰 이하에서 단가가 90%, 그 이상에서는 50% 내려갔습니다. Anthropic은 거의 모든 정렬(alignment) 평가에서 Haiku 4.5보다 크게 개선되었다고도 밝혔습니다.
Claude Haiku 5.5의 공식 가격은 얼마인가요?
Anthropic은 프롬프트 길이에 따라 두 구간으로 가격을 매깁니다(100만 토큰당). 프롬프트 10만 토큰 이하: 입력 $0.10, 출력 $0.50, 5분 캐시 쓰기 $0.125, 1시간 캐시 쓰기 $0.20, 캐시 읽기 $0.01. 10만 토큰 초과: 모든 요금이 5배로, 입력 $0.50, 출력 $2.50, 캐시 읽기 $0.05입니다. Batch API를 쓰면 추가로 50% 절약됩니다. 참고로 Haiku 4.5는 입력 $1, 출력 $5입니다. 모두 Anthropic 공식 가격이며, 저희 요금은 출시 때 공개합니다.
Haiku 5.5는 토큰을 더 많이 쓰나요?
알아 두실 점이 두 가지 있습니다. 첫째, Claude Opus 4.7부터 쓰인 새 토크나이저를 사용해서 같은 텍스트도 Haiku 4.5보다 약 30% 더 많은 토큰으로 계산됩니다. 둘째, 사고가 기본으로 켜져 있고 사고 토큰은 출력으로 과금되며 max_tokens에도 포함됩니다. effort가 높을수록 더 많이 생각합니다. 독립 평가 기관 Artificial Analysis는 max 설정에서 Intelligence Index 과제 하나당 약 16.2만 출력 토큰을 측정했습니다. 대량의 간단한 요청에는 대개 low나 기본값 medium이면 충분합니다. 이를 모두 감안해도 Anthropic은 평균 실행 비용이 Haiku 4.5보다 약 75% 낮다고 밝혔습니다.
effort는 어떻게 고르나요? 사고를 끌 수 있나요?
Anthropic의 권장 사항은 다음과 같습니다. 코딩 에이전트를 포함한 대부분의 작업은 기본값 medium으로 시작하세요. 채팅, 짧은 도구 작업, 대량의 간단한 요청에는 가장 빠르고 저렴한 low를 쓰되, 긴 에이전트 프롬프트에서는 low일 때 검색을 건너뛰거나 일찍 끝내는 경우가 늘어납니다. 지식 작업, 긴 에이전트 작업, 지시를 엄격히 따라야 하는 경우에는 high를 쓰세요. xhigh와 max는 평가에서 품질 향상이 확인될 때만 쓰고, Sonnet 5.5와 품질·비용·속도를 비교해 보세요. 사고는 effort가 high 이하일 때 thinking: disabled로 끌 수 있지만 xhigh와 max에서는 끌 수 없습니다. 사고 내용은 기본적으로 반환되지 않으며, thinking.display를 summarized로 설정하면 요약을 받을 수 있습니다.
Haiku 4.5에서 옮기려면 무엇을 바꿔야 하나요?
주요 변경 사항은 다음과 같습니다. 모델 ID는 claude-haiku-5-5입니다(날짜 접미사 없음). 사고 예산(budget_tokens)을 지정하면 400 오류가 나므로 적응형 사고와 effort를 쓰세요. temperature, top_p, top_k는 빼세요(top_k, 또는 기본값이 아닌 temperature·top_p는 400 오류). 어시스턴트 메시지 프리필은 더 이상 받지 않으므로 구조화된 출력을 쓰거나 시스템 프롬프트에서 형식을 지정하세요. 응답이 사고 블록으로 시작할 수 있으니 텍스트는 위치가 아니라 type으로 고르세요. 같은 텍스트의 토큰 수가 늘어나므로 max_tokens와 비용 추정을 다시 확인하세요. 컴퓨터 사용은 computer_toolset_20260801 도구 세트로 옮겨야 합니다. 안전 분류기가 요청을 거절할 수 있으므로 stop_reason refusal도 처리하세요.
여기서 Claude Haiku 5.5를 언제 호출할 수 있나요?
지금 연동과 테스트를 진행하고 있습니다. 안정적으로 호출할 수 있게 되는 즉시 이 페이지를 출시 상태로 바꾸고 가격을 공개합니다. 이메일을 남기시면 출시 당일 알려 드립니다.
출시 후에는 어떻게 호출하나요? Claude Code에서도 쓸 수 있나요?
두 가지 API를 모두 쓸 수 있습니다. OpenAI 호환 API(/v1/chat/completions)와 네이티브 Anthropic Messages API(/anthropic)에서 모델 이름을 claude-haiku-5-5로 지정하면 됩니다. Claude Code는 백그라운드의 작은 작업 상당수를 Haiku 모델에 맡깁니다. Haiku 5.5가 출시되면 Claude Code의 Haiku 모델을 claude-haiku-5-5로 설정하세요. 설정 방법은 문서의 Claude Code 페이지에 있습니다.
지금 바로 쓸 수 있는 Claude 모델이 있나요?
네. Claude Sonnet 5.5, Claude Opus 5.5, Claude Sonnet 5는 이미 출시되어 바로 호출할 수 있습니다. 그동안 저렴하고 빠른 소형 모델이 필요하다면 Gemini 3.8 Flash, DeepSeek V4.1 Flash, GPT-6 Luna도 쓸 수 있습니다.

지금 사용 가능

다음 모델은 지금 NezhaGate에서 바로 호출할 수 있습니다:

전체 보기 →