온라인 테스트 · 플레이그라운드
Gemini 3.6 Flash 바로 여기서 사용해 보기 (로그인 후 사용 가능)。
Input
고급 설정
대화
소개: Gemini 3.6 Flash
Gemini 3.6 Flash는 Google의 새 세대 고속 사고 모델입니다. Flash 등급의 지연과 비용을 유지하면서 명시적인 사고(추론) 단계를 더했고, 1,000,000 토큰 컨텍스트에 최대 64K 출력, 이미지 입력을 지원합니다. NezhaGate는 사고 예산 등급 네 가지를 제공합니다. 표준인 gemini-3.6-flash, 더 깊이 생각하는 gemini-3.6-flash-high, 가장 빠른 gemini-3.6-flash-low, 그리고 요청마다 모델이 사고량을 직접 정하는 gemini-3.6-flash-tiered입니다. 네 등급 모두 토큰당 단가가 같습니다. 어떤 등급이 얼마나 생각했는지는 출력 토큰으로 드러날 뿐입니다. OpenAI 호환 엔드포인트로 제공되므로 base_url을 NezhaGate로 돌리고 model을 "gemini-3.6-flash"로 두면 기존 OpenAI SDK 코드를 그대로 재사용할 수 있으며, 사용한 만큼 과금하고 실패한 요청에는 과금하지 않습니다.
활용 사례
표준 등급이 속도와 추론의 균형을 잡아, 빠르게 답하면서도 생각은 해야 하는 상담 봇, 어시스턴트, 에이전트 워크플로에 맞습니다.
100만 컨텍스트 창이 큰 저장소, 긴 보고서, 계약서 묶음을 한 번에 삼켜 요약하고 검색하고 교차 확인합니다.
이미지 입력으로 스크린샷 질의응답, 양식과 차트 판독 등 멀티모달 분석을 지원합니다.
tiered 변형은 요청마다 모델이 사고 예산을 직접 고르게 합니다. 쉬운 질문에는 빠른 답을, 어려운 질문에는 더 긴 숙고를 주므로 난이도 편차가 큰 실제 트래픽에 잘 맞습니다.
어떻게 고를까
기본은 표준 gemini-3.6-flash를 쓰세요. 다단계 추론에는 gemini-3.6-flash-high로 바꾸고, 대량 분류 · 추출 · 고쳐 쓰기에는 실무적으로 가장 빠르고 저렴한 gemini-3.6-flash-low를 쓰세요. 요청 난이도가 예측되지 않고 모델에 맡기고 싶다면 gemini-3.6-flash-tiered를 고르면 됩니다. 네 등급이 가격을 공유하므로 등급 변경은 model 필드를 바꾸는 것뿐입니다. 더 깊은 추론이 필요하면 Gemini 3.1 Pro로 올리세요.
자주 묻는 질문
Gemini 3.6 Flash의 네 등급은 무엇이 다른가요?
네 등급이 왜 모두 같은 가격인가요?
컨텍스트 창은 얼마나 되나요?
이미지 입력과 스트리밍을 지원하나요?
OpenAI SDK로 어떻게 호출하나요?
관련 모델
연동할 수 있는 다른 모델도 둘러보세요.
GPT-5.6 Sol
에이전트 코딩을 위한 프런티어 플래그십
GPT-5.6 Terra
일상용 균형형 에이전트 코딩 모델
GPT-5.6 Luna
빠르고 저렴한 에이전트 코딩 모델
GPT-5.5
플래그십 채팅 · 추론 모델
GPT-6 Astra
OpenAI 차세대 플래그십 — 105만 컨텍스트
GPT Image 2
고품질 텍스트-투-이미지 / 이미지-투-이미지 모델
GPT Image 2.5 Flare
차세대 이미지 모델 — 깔끔하고 매끄러운
GPT Image 2.5 Sunburst
차세대 이미지 모델 — 질감이 더 진한
Nano Banana 2
고품질 텍스트-투-이미지 / 이미지-투-이미지 모델
Nano Banana Pro
플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델
Claude Sonnet 4.6
균형 잡히고 효율적인 채팅 · 코딩 모델
Claude Opus 5
Anthropic의 차세대 플래그십
Claude Fable 5
Anthropic Fable 시리즈 · 서사와 장문 글쓰기
Gemini 3.1 Pro
Google의 차세대 플래그십 추론 모델
Gemini 3.8 Flash
최신 Flash · 적응형 사고
Gemini 3.7 Flash
이전 세대 Flash · 적응형 사고
Gemini 3.6 Flash High
심층 사고 등급
Gemini 3.6 Flash Low
가장 빠르고 가장 저렴한 등급
Gemini 3.6 Flash Tiered
사고량 자동 조절
Gemini 3 Flash
빠르고 지연이 낮은 비용 효율형 채팅 모델
Gemini 3.5 Flash
차세대 고속 사고 모델
Gemini 2.5 Flash
빠르고 지연이 낮은 비용 효율형 채팅
Veo 3.1
텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도
Seedance 2.5
텍스트 / 이미지 투 비디오 · 최대 30초
Seedance 2.0
텍스트 / 이미지 투 비디오 · 5~15초
Seedance 2.0 Fast
낮은 지연 · 최저 비용
Seedance 2.0 Mini
엔트리 등급 · 최저 비용
Wan 3.0
엔드포인트 하나에 다섯 가지 모드 · 최대 30초
Wan 3.0 Prime
성능은 동일 · 속도는 몇 배
MiniMax H3
1080P · 네이티브 오디오
Grok Imagine Video 1.5
건당 과금 · 최대 15초