NezhaGate
Chat

Gemini 3.6 Flash

gemini-3.6-flash
모델 타입 MediumHighLowTiered

Gemini 3.6 Flash는 Google의 차세대 고속 사고 모델입니다. 100만 토큰 컨텍스트, 최대 64K 출력, 이미지 입력을 지원합니다. 표준(Medium) 등급은 사고 예산이 균형 잡혀 있어 일상 채팅과 에이전트 워크플로에 적합합니다. OpenAI API와 완전히 호환되며 model을 gemini-3.6-flash로 지정하세요.

채팅사고1M 컨텍스트OpenAI 호환

온라인 테스트 · 플레이그라운드

Gemini 3.6 Flash 바로 여기서 사용해 보기 (로그인 후 사용 가능)。

Input

고급 설정
웹 검색
메모리 · 멀티턴

대화

대화를 시작해 보세요아래에 메시지를 입력해 시작하세요

소개: Gemini 3.6 Flash

Gemini 3.6 Flash는 Google의 새 세대 고속 사고 모델입니다. Flash 등급의 지연과 비용을 유지하면서 명시적인 사고(추론) 단계를 더했고, 1,000,000 토큰 컨텍스트에 최대 64K 출력, 이미지 입력을 지원합니다. NezhaGate는 사고 예산 등급 네 가지를 제공합니다. 표준인 gemini-3.6-flash, 더 깊이 생각하는 gemini-3.6-flash-high, 가장 빠른 gemini-3.6-flash-low, 그리고 요청마다 모델이 사고량을 직접 정하는 gemini-3.6-flash-tiered입니다. 네 등급 모두 토큰당 단가가 같습니다. 어떤 등급이 얼마나 생각했는지는 출력 토큰으로 드러날 뿐입니다. OpenAI 호환 엔드포인트로 제공되므로 base_url을 NezhaGate로 돌리고 model을 "gemini-3.6-flash"로 두면 기존 OpenAI SDK 코드를 그대로 재사용할 수 있으며, 사용한 만큼 과금하고 실패한 요청에는 과금하지 않습니다.

활용 사례

생각이 필요한 일상 채팅과 에이전트

표준 등급이 속도와 추론의 균형을 잡아, 빠르게 답하면서도 생각은 해야 하는 상담 봇, 어시스턴트, 에이전트 워크플로에 맞습니다.

100만 토큰 규모의 문서 작업

100만 컨텍스트 창이 큰 저장소, 긴 보고서, 계약서 묶음을 한 번에 삼켜 요약하고 검색하고 교차 확인합니다.

텍스트와 이미지 혼합 이해

이미지 입력으로 스크린샷 질의응답, 양식과 차트 판독 등 멀티모달 분석을 지원합니다.

난이도가 고르지 않은 작업

tiered 변형은 요청마다 모델이 사고 예산을 직접 고르게 합니다. 쉬운 질문에는 빠른 답을, 어려운 질문에는 더 긴 숙고를 주므로 난이도 편차가 큰 실제 트래픽에 잘 맞습니다.

어떻게 고를까

기본은 표준 gemini-3.6-flash를 쓰세요. 다단계 추론에는 gemini-3.6-flash-high로 바꾸고, 대량 분류 · 추출 · 고쳐 쓰기에는 실무적으로 가장 빠르고 저렴한 gemini-3.6-flash-low를 쓰세요. 요청 난이도가 예측되지 않고 모델에 맡기고 싶다면 gemini-3.6-flash-tiered를 고르면 됩니다. 네 등급이 가격을 공유하므로 등급 변경은 model 필드를 바꾸는 것뿐입니다. 더 깊은 추론이 필요하면 Gemini 3.1 Pro로 올리세요.

자주 묻는 질문

Gemini 3.6 Flash의 네 등급은 무엇이 다른가요?
사고 예산만 다릅니다. low가 가장 적게 생각하고 가장 빠르게 답하며, 접미사가 없는 표준 id가 중간, high가 가장 많이 생각해 다단계 추론에 맞고, tiered는 요청마다 모델이 직접 정합니다. 바탕이 되는 모델, 컨텍스트 창, 멀티모달 지원은 모두 같습니다.
네 등급이 왜 모두 같은 가격인가요?
차이가 이미 사용량에 드러나기 때문입니다. 사고 토큰은 출력 토큰으로 과금되므로 high 등급은 자연히 low 등급보다 출력 토큰을 더 씁니다. 여기에 토큰당 할증까지 얹으면 같은 것을 두 번 받는 셈이라, 네 등급이 하나의 단가를 공유하고 실제 청구액은 그 등급이 실제로 얼마나 생각했는지를 따라갑니다.
컨텍스트 창은 얼마나 되나요?
입력 약 1,000,000 토큰에 호출당 출력 최대 64K이며, 네 등급 모두 같습니다.
이미지 입력과 스트리밍을 지원하나요?
둘 다 지원합니다. 이미지는 OpenAI의 image_url 형식으로 넣고, 요청에 stream=true를 주면 답변을 토큰 단위로 받습니다.
OpenAI SDK로 어떻게 호출하나요?
base_url을 NezhaGate로 돌리고 NezhaGate API 키를 넣은 뒤 model을 "gemini-3.6-flash"(또는 접미사가 붙은 등급 id)로 두세요. 나머지는 기존 OpenAI 코드와 같습니다.

관련 모델

연동할 수 있는 다른 모델도 둘러보세요.

전체 보기 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

에이전트 코딩을 위한 프런티어 플래그십

$2.00/1M 입력 · $12.00/1M 출력 ↓75% 보기 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

일상용 균형형 에이전트 코딩 모델

$1.20/1M 입력 · $7.00/1M 출력 ↓77% 보기 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

빠르고 저렴한 에이전트 코딩 모델

$0.80/1M 입력 · $4.80/1M 출력 ↓68% 보기 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

플래그십 채팅 · 추론 모델

$0.70/1M 입력 · $4.20/1M 출력 ↓86% 보기 →
GPT-6 Astra Chat

GPT-6 Astra

gpt-6-astra

OpenAI 차세대 플래그십 — 105만 컨텍스트

$2.80/1M 입력 · $14.00/1M 출력 ↓72% 보기 →
GPT Image 2 이미지

GPT Image 2

gpt-image-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.015/장부터 보기 →
GPT Image 2.5 Flare 이미지

GPT Image 2.5 Flare

gpt-image-2.5-flare

차세대 이미지 모델 — 깔끔하고 매끄러운

$0.015/장부터 보기 →
GPT Image 2.5 Sunburst 이미지

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

차세대 이미지 모델 — 질감이 더 진한

$0.015/장부터 보기 →
Nano Banana 2 이미지

Nano Banana 2

nano-banana-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.025/장부터 보기 →
Nano Banana Pro 이미지

Nano Banana Pro

nano-banana-pro

플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.040/장부터 보기 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

균형 잡히고 효율적인 채팅 · 코딩 모델

$1.50/1M 입력 · $7.50/1M 출력 ↓50% 보기 →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Anthropic의 차세대 플래그십

$4.00/1M 입력 · $20.00/1M 출력 보기 →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Anthropic Fable 시리즈 · 서사와 장문 글쓰기

$8.00/1M 입력 · $40.00/1M 출력 보기 →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Google의 차세대 플래그십 추론 모델

$0.50/1M 입력 · $3.00/1M 출력 ↓75% 보기 →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

최신 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

이전 세대 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

심층 사고 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

가장 빠르고 가장 저렴한 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

사고량 자동 조절

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

빠르고 지연이 낮은 비용 효율형 채팅 모델

$0.30/1M 입력 · $1.20/1M 출력 ↓57% 보기 →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

차세대 고속 사고 모델

$0.45/1M 입력 · $2.70/1M 출력 ↓70% 보기 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

빠르고 지연이 낮은 비용 효율형 채팅

$0.30/1M 입력 · $1.20/1M 출력 ↓46% 보기 →
Veo 3.1 영상

Veo 3.1

veo-3.1

텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도

$0.075/건부터 보기 →
Seedance 2.5 영상

Seedance 2.5

seedance-2.5

텍스트 / 이미지 투 비디오 · 최대 30초

$0.158/초 보기 →
Seedance 2.0 영상

Seedance 2.0

seedance-2.0

텍스트 / 이미지 투 비디오 · 5~15초

$0.150/초 보기 →
Seedance 2.0 Fast 영상

Seedance 2.0 Fast

seedance-2.0-fast

낮은 지연 · 최저 비용

$0.100/초 보기 →
Seedance 2.0 Mini 영상

Seedance 2.0 Mini

seedance-2.0-mini

엔트리 등급 · 최저 비용

$0.066/초 보기 →
Wan 3.0 영상

Wan 3.0

wan3.0-video

엔드포인트 하나에 다섯 가지 모드 · 최대 30초

$0.120/초 보기 →
Wan 3.0 Prime 영상

Wan 3.0 Prime

wan3.0-video-prime

성능은 동일 · 속도는 몇 배

$0.160/초 보기 →
MiniMax H3 영상

MiniMax H3

minimax-h3

1080P · 네이티브 오디오

$0.036/초 보기 →
Grok Imagine Video 1.5 영상

Grok Imagine Video 1.5

grok-imagine-video-1.5

건당 과금 · 최대 15초

$0.300/건부터 보기 →