NezhaGateNezhaGate
채팅

Doubao Seed 2.1 Turbo

⧉
doubao-seed-2-1-turbo
모델 타입 ProTurbo

Doubao Seed 2.1 Turbo는 Doubao Seed 2.1 제품군의 저가형 버전으로, 단가가 Pro의 약 절반이라 일상 대화와 대량 작업에 알맞습니다. 기본적으로 먼저 생각한 뒤 답하며, 추론 과정은 reasoning_content로 반환되고 출력 단가로 과금됩니다(reasoning_effort: "minimal"을 보내면 대개 생각을 건너뛰지만 Pro만큼 확실하지는 않습니다). 도구 호출, JSON 출력, 스트리밍, 이미지 입력(base64 또는 공개 링크)을 지원합니다. 반복되는 긴 접두어는 자동으로 캐시에 적중할 수 있으며 그 부분은 캐시 단가로 정산됩니다. OpenAI 호환이므로 model을 doubao-seed-2-1-turbo로 지정하면 되며, 사용한 만큼 과금하고 실패한 호출에는 과금하지 않습니다.

채팅추론저비용프롬프트 캐싱OpenAI 호환

온라인 테스트 · 플레이그라운드

Doubao Seed 2.1 Turbo 바로 여기서 사용해 보기 (로그인 후 사용 가능).

입력

고급 설정
웹 검색
메모리 · 멀티턴

대화

대화를 시작해 보세요아래에 메시지를 입력해 시작하세요

소개: Doubao Seed 2.1 Turbo

Doubao Seed 2.1 Turbo는 Doubao Seed 2.1 제품군의 저가형 버전으로, NezhaGate에서 OpenAI 호환 API로 제공합니다. 단가가 Pro의 약 절반이라 일상 대화와 대량 작업에 알맞으며, 이미지 입력도 지원합니다. 기본적으로 먼저 생각한 뒤 답하며, 추론 과정은 message.reasoning_content로, 답변은 content로 반환되고 추론 토큰은 출력 단가로 과금됩니다. 도구 호출, JSON 출력, 스트리밍, 프롬프트 캐싱을 지원합니다. model을 doubao-seed-2-1-turbo로 지정하면 바로 쓸 수 있으며, 사용한 만큼 과금하고 실패한 호출에는 과금하지 않습니다.

활용 사례

일상 대화와 질의응답

단가가 낮아 고객 지원, 질의응답, 일상적인 글쓰기처럼 자주 오가는 대화에 알맞습니다. 모델 전환은 model 필드만 바꾸면 됩니다.

대량 텍스트 처리

분류, 추출, 요약, 재작성 같은 일괄 작업에 알맞으며, 단가는 Pro의 약 절반입니다.

이미지 이해

스크린샷, 영수증, 차트를 읽고 질문에 답합니다. 측정해 보니 이미지 속 글자를 정확하게 읽었습니다. 이미지는 base64나 공개 링크로 보낼 수 있습니다.

같은 긴 문서에 반복해서 묻기

반복되는 긴 접두어는 자동으로 캐시에 적중하며(측정해 보니 두 번째 호출의 입력 9,828 토큰 중 9,528 토큰), 그 부분은 캐시 단가로 정산됩니다.

어떻게 고를까

일상 대화나 대량 작업처럼 단가가 중요하면 Turbo를(반복되는 긴 접두어는 자동으로 캐시됩니다), Doubao Seed 2.1 시리즈 플래그십의 추론, 코딩, 에이전트 능력이 필요하다면 Pro를 고르세요. 두 모델 모두 Doubao Seed 2.1 제품군이라 model 필드만 바꾸면 전환됩니다.

자주 묻는 질문

생각을 끌 수 있나요?
대개는 가능하지만 Pro만큼 확실하지는 않습니다. reasoning_effort: "minimal"을 보내면 측정해 보니 12번 중 8번은 생각하지 않고 바로 답했고, 나머지 4번은 추론 내용을 반환했습니다. thinking: {"type": "disabled"}는 이 모델에서 효과가 없습니다. 지정하지 않으면 먼저 생각한 뒤 답하며, 추론 토큰은 usage.completion_tokens 안에서 출력 단가로 과금됩니다.
max_tokens로 출력을 제한할 수 있나요?
아니요. max_tokens는 보낼 수 있지만 출력이 잘리지 않습니다(측정해 보니 60으로 지정해도 5,929 토큰이 생성되었습니다). 요금은 usage에 나온 실제 토큰 수로 정산됩니다. 짧은 답이 필요하면 프롬프트에서 간결하게 답하라고 요청하세요.
프롬프트 캐싱을 지원하나요?
네. 반복되는 긴 접두어는 자동으로 캐시에 적중하며, 측정해 보니 두 번째 호출의 입력 9,828 토큰 중 9,528 토큰이 캐시되었고 그 부분은 캐시 단가로 정산되었습니다. 적중 여부는 업스트림이 정하고 과금은 반환된 usage를 따릅니다.
Pro와는 어떻게 고르나요?
Turbo는 단가가 Pro의 약 절반이지만, 간단한 질문에 더 오래 생각할 때가 있습니다. 측정해 보니 같은 다섯 단어짜리 인사에 Turbo는 412~3,656 토큰, Pro는 362~802 토큰을 썼으며, 실제 비용은 usage를 따릅니다. 입력이 길고 출력이 짧은 대량 작업(자동 캐싱도 적용됨)이라면 Turbo가 더 저렴하고, 플래그십급 추론, 코딩, 에이전트 능력이 필요하면 Pro를 고르세요.
실패한 호출에도 과금되나요?
아니요. 정상적으로 응답한 호출만 실제 사용량으로 정산합니다. 업스트림 오류와 타임아웃은 잔액에 전혀 영향을 주지 않습니다.

관련 모델

연동할 수 있는 다른 모델도 둘러보세요.

전체 보기 →