Gemini 3.5 Flash
⧉Gemini 3.5 Flash는 사고 기능을 내장한 Google의 차세대 고속 모델입니다. 빠르고 비용 효율이 좋아 대량 채팅과 에이전트 작업에 적합합니다. OpenAI API와 완전히 호환되며 model을 gemini-3.5-flash로 지정하세요.
온라인 테스트 · 플레이그라운드
Gemini 3.5 Flash 바로 여기서 사용해 보기 (로그인 후 사용 가능)。
Input
고급 설정
대화
소개: Gemini 3.5 Flash
Gemini 3.5 Flash는 Google의 새 세대 고속 사고 모델로, 낮은 지연과 높은 동시성에 명시적인 사고(추론) 단계를 더해 속도와 어느 정도의 논리적 추론이 모두 필요한 대화와 처리 작업에 잘 맞습니다. NezhaGate에서는 OpenAI 호환 엔드포인트로 제공되므로 base_url을 NezhaGate로 돌리고 model 파라미터를 "gemini-3.5-flash"로 두면 기존 OpenAI SDK 코드를 그대로 재사용할 수 있으며, 사용한 만큼 과금하고 실패한 요청에는 과금하지 않습니다.
활용 사례
트래픽이 몰려도 낮은 지연과 안정적인 동작이 필요한 고객 응대 봇과 질의응답 어시스턴트를 구동합니다.
분류, 조건부 판단, 다단계 질의응답처럼 단순한 논리 추론이 필요한 작업에 사고 단계를 쓰되, 더 무거운 플래그십 모델까지 가지는 않습니다.
많은 문서를 요약하고 고쳐 쓰고 추출하고 분류하면서, 높은 처리량과 종량제 과금으로 단위 비용을 통제합니다.
도구 호출과 다중 턴 오케스트레이션 루프 안에서 빠른 판단 노드 역할을 해 단계마다 기다리는 시간을 줄입니다.
검증 단계에서 대화 기능을 빠르게 세우고, 필요해지면 균형형이나 플래그십 모델로 깔끔하게 옮깁니다.
어떻게 고를까
속도와 비용, 어느 정도의 추론을 함께 원할 때 Gemini 3.5 Flash를 고르세요. 플래그십 Gemini 3.1 Pro보다 빠르고 저렴하면서, 속도 위주인 Gemini 3 Flash와 Gemini 2.5 Flash보다는 명시적인 사고 단계가 더해져 있습니다. 가장 깊은 추론이 필요하면 Gemini 3.1 Pro로, 더 새로운 고속 사고 모델을 원하면 Gemini 3.6 Flash로 올리고, OpenAI 생태계의 고속 모델을 선호한다면 GPT-5.6 Luna와 비교해 보세요.
자주 묻는 질문
Gemini 3.5 Flash는 무엇인가요?
Gemini 3.5 Flash는 스트리밍을 지원하나요?
OpenAI SDK로 Gemini 3.5 Flash를 어떻게 호출하나요?
Gemini 3.5 Flash는 어떤 작업에 가장 잘 맞나요?
Gemini 3.5 Flash와 Gemini 3 Flash 중 무엇을 고를까요?
관련 모델
연동할 수 있는 다른 모델도 둘러보세요.
GPT-5.6 Sol
에이전트 코딩을 위한 프런티어 플래그십
GPT-5.6 Terra
일상용 균형형 에이전트 코딩 모델
GPT-5.6 Luna
빠르고 저렴한 에이전트 코딩 모델
GPT-5.5
플래그십 채팅 · 추론 모델
GPT-6 Astra
OpenAI 차세대 플래그십 — 105만 컨텍스트
GPT Image 2
고품질 텍스트-투-이미지 / 이미지-투-이미지 모델
GPT Image 2.5 Flare
차세대 이미지 모델 — 깔끔하고 매끄러운
GPT Image 2.5 Sunburst
차세대 이미지 모델 — 질감이 더 진한
Nano Banana 2
고품질 텍스트-투-이미지 / 이미지-투-이미지 모델
Nano Banana Pro
플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델
Claude Sonnet 4.6
균형 잡히고 효율적인 채팅 · 코딩 모델
Claude Opus 5
Anthropic의 차세대 플래그십
Claude Fable 5
Anthropic Fable 시리즈 · 서사와 장문 글쓰기
Gemini 3.1 Pro
Google의 차세대 플래그십 추론 모델
Gemini 3.8 Flash
최신 Flash · 적응형 사고
Gemini 3.7 Flash
이전 세대 Flash · 적응형 사고
Gemini 3.6 Flash
차세대 고속 사고 모델 · 사고 예산 4단계
Gemini 3.6 Flash High
심층 사고 등급
Gemini 3.6 Flash Low
가장 빠르고 가장 저렴한 등급
Gemini 3.6 Flash Tiered
사고량 자동 조절
Gemini 3 Flash
빠르고 지연이 낮은 비용 효율형 채팅 모델
Gemini 2.5 Flash
빠르고 지연이 낮은 비용 효율형 채팅
Veo 3.1
텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도
Seedance 2.5
텍스트 / 이미지 투 비디오 · 최대 30초
Seedance 2.0
텍스트 / 이미지 투 비디오 · 5~15초
Seedance 2.0 Fast
낮은 지연 · 최저 비용
Seedance 2.0 Mini
엔트리 등급 · 최저 비용
Wan 3.0
엔드포인트 하나에 다섯 가지 모드 · 최대 30초
Wan 3.0 Prime
성능은 동일 · 속도는 몇 배
MiniMax H3
1080P · 네이티브 오디오
Grok Imagine Video 1.5
건당 과금 · 최대 15초