NezhaGateNezhaGate
채팅

Claude Sonnet 5

⧉
claude-sonnet-5

Claude Sonnet 5는 Anthropic의 차세대 Sonnet 모델입니다. Sonnet 등급의 속도와 가격을 유지하면서 코딩과 에이전트 성능은 Opus에 가깝습니다. 적응형 사고가 기본으로 켜져 있고, low부터 max까지 다섯 단계로 사고 깊이와 속도를 조절할 수 있습니다. 이미지 이해, 도구 호출, 프롬프트 캐싱을 지원합니다. OpenAI API와 완전히 호환되어 model을 claude-sonnet-5로 바꾸기만 하면 되며, 네이티브 Anthropic Messages API로 Claude Code를 바로 연결할 수도 있습니다.

채팅코드에이전트이미지 이해프롬프트 캐싱

온라인 테스트 · 플레이그라운드

Claude Sonnet 5 바로 여기서 사용해 보기 (로그인 후 사용 가능).

입력

고급 설정
웹 검색
메모리 · 멀티턴
사고 과정

대화

대화를 시작해 보세요아래에 메시지를 입력해 시작하세요

소개: Claude Sonnet 5

Claude Sonnet 5는 Anthropic Sonnet 계열의 최신 모델이자 Claude 5 세대의 Sonnet입니다. Sonnet 등급의 속도와 가격을 그대로 유지하면서 코딩과 에이전트 작업의 품질을 Opus에 가까운 수준까지 끌어올렸습니다. 적응형 사고가 기본으로 켜져 있어 얼마나 생각할지를 모델이 스스로 정합니다. 간단한 요청에는 바로 답하고, 어려운 문제는 먼저 충분히 추론한 뒤 답합니다. 또한 low / medium / high / xhigh / max 다섯 단계로 사고 깊이와 속도 사이에서 균형을 고를 수 있습니다. 이미지 입력, 도구 호출, 프롬프트 캐싱을 지원합니다. NezhaGate에서는 두 가지 방식으로 제공합니다. 하나는 OpenAI 호환 엔드포인트로, base_url을 NezhaGate로 지정하고 model을 claude-sonnet-5로 설정하면 기존 OpenAI SDK를 그대로 쓸 수 있습니다. 다른 하나는 네이티브 Anthropic Messages API로, ANTHROPIC_BASE_URL을 NezhaGate의 /anthropic으로 지정하면 Claude Code가 바로 연결되며 thinking, tool_use, 프롬프트 캐싱이 그대로 유지됩니다. 사용한 만큼만 과금하고, 실패한 요청에는 과금하지 않습니다.

활용 사례

일상적인 코딩과 에이전트

코드 작성, 리팩터링, 디버깅은 물론 도구 호출을 이용한 다단계 에이전트 루프까지 돌릴 수 있습니다. 하루에도 수없이 호출하는 코딩 도우미나 봇의 기본 모델로 잘 맞습니다.

대량의 프로덕션 트래픽

고객 응대, 정보 추출, 요약, 분류 같은 대량 작업에 적합합니다. Opus에 가까운 품질은 원하지만 Opus 요금은 부담스러울 때 좋은 선택입니다.

긴 문서와 코드베이스

계약서, 논문, 매뉴얼, 저장소를 요약하고 정보를 뽑아내며 질문에 답합니다. 프롬프트 캐싱 덕분에 같은 자료에 반복해서 묻는 비용이 크게 줄어듭니다.

필요한 만큼 깊게 추론

가벼운 대화는 low로 빠르게, 까다로운 버그나 계획 수립은 high나 xhigh로 올리세요. 토큰당 가격은 모든 단계에서 같습니다.

텍스트와 이미지가 섞인 작업

스크린샷, 차트, 디자인 시안을 읽고 분석이나 코드로 답합니다. base64와 원격 이미지 URL을 모두 받습니다.

어떻게 고를까

대부분의 작업에서는 Claude Sonnet 5를 기본 Claude로 쓰세요. Claude Opus 5보다 빠르고 저렴하면서도 코딩과 에이전트 작업에서는 Opus 5에 가깝습니다. 가장 어려운 추론이나 대규모 코드 프로젝트에는 Claude Opus 5로, 서사와 장문 글쓰기에는 Claude Fable 5로 바꾸세요. 이미 Claude Sonnet 4.6에 맞춰 조정한 기존 워크플로는 4.6을 계속 써도 됩니다. 모두 같은 엔드포인트에서 model 필드만 바꾸면 전환됩니다.

자주 묻는 질문

Claude Sonnet 5는 어떤 모델인가요?
Claude Sonnet 5는 Anthropic의 최신 Sonnet 모델로 Claude 5 세대에 속합니다. Sonnet의 속도와 가격으로 Opus에 가까운 코딩·에이전트 성능을 내는 것을 목표로 하며, 적응형 사고가 기본으로 켜져 있고 이미지 입력, 도구 호출, 프롬프트 캐싱을 지원합니다. NezhaGate에서는 OpenAI 호환 API와 네이티브 Anthropic Messages API 중 어느 쪽으로도 호출할 수 있습니다.
Claude Sonnet 4.6과 무엇이 다른가요?
새로운 세대의 모델입니다. 코딩과 에이전트 성능이 더 강해졌고, 적응형 사고가 기본으로 켜지며(Sonnet 4.6은 요청할 때만 사고합니다), 사고 단계에 xhigh가 추가되었고, 더 높은 해상도의 이미지를 이해합니다. Anthropic 공식 가격도 100만 토큰당 입력 $2, 출력 $10으로 Sonnet 4.6의 $3 / $15보다 낮습니다. 비용을 비교할 때는 Sonnet 5가 새 토크나이저를 써서 같은 텍스트라도 토큰이 약 30% 더 많이 잡힌다는 점에 유의하세요. 토큰당 단가보다 작업 하나를 끝내는 데 든 총비용으로 비교하는 것이 정확합니다.
temperature가 무시되는 이유는 무엇인가요?
Anthropic은 이 세대부터 temperature / top_p / top_k를 받지 않습니다. 기존 OpenAI SDK 코드가 수정 없이 동작하도록 게이트웨이가 전달 전에 이 세 파라미터를 제거하므로, 요청은 오류 없이 성공하고 샘플링은 모델 기본값으로 실행됩니다. 출력을 조정하고 싶다면 대신 reasoning_effort(low / medium / high / xhigh / max)로 사고 깊이를 지정하세요. 모든 단계의 토큰당 가격은 같고, 깊게 생각할수록 출력 토큰이 늘어날 뿐입니다.
사고를 끌 수 있나요?
네. 네이티브 Anthropic Messages API에서 thinking: {"type": "disabled"}를 보내면 모델이 생각하지 않고 바로 답하므로 가장 빠르고 저렴합니다. OpenAI 호환 엔드포인트에서는 reasoning_effort: low로 비슷한 효과를 낼 수 있습니다. 모델이 사고한 경우 사고 토큰은 출력으로 과금됩니다.
Claude Code를 바로 연결할 수 있나요?
네. ANTHROPIC_BASE_URL을 NezhaGate의 /anthropic으로 지정하고, 게이트웨이 키를 x-api-key로 사용하며, model을 claude-sonnet-5로 설정하세요. thinking, tool_use, 프롬프트 캐싱, 스트리밍 SSE가 모두 그대로 전달됩니다.

관련 모델

연동할 수 있는 다른 모델도 둘러보세요.

전체 보기 →