NezhaGate
Chat

Gemini 3.1 Pro

gemini-3.1-pro
24시간 상태 성공률: 100.0%
-24h현재
성공과 당사 책임의 실패만 집계합니다. 초록은 해당 시간대의 성공, 빨강은 실패 비율입니다. 두 가지는 집계에서 제외됩니다 — 클라이언트 측 오류(잘못된 요청, 인증 실패, 잔액 부족 등 4xx)와 아직 진행 중인 요청. 막대 하나가 1시간이며, 실제 게이트웨이 호출 로그에서 집계합니다.

Gemini 3.1 Pro는 Google의 차세대 플래그십 멀티모달 모델로, 초장문 컨텍스트와 최상급 추론 · 코딩 성능을 갖췄습니다. OpenAI API와 완전히 호환되므로 기존 SDK에서 model만 gemini-3.1-pro로 바꾸면 됩니다. 기본은 낮은 추론 등급(더 빠르고 저렴)이며, reasoning_effort=high를 보내면 높은 추론 등급으로 전환됩니다(Preview 요금 적용). 응답에 reasoning_content 필드가 함께 담겨 모델의 사고 과정을 볼 수 있고, 스트리밍에서도 조각 단위로 내려옵니다.

채팅롱 컨텍스트멀티모달사고 과정 공개OpenAI 호환

온라인 테스트 · 플레이그라운드

Gemini 3.1 Pro 바로 여기서 사용해 보기 (로그인 후 사용 가능)。

Input

고급 설정
웹 검색
메모리 · 멀티턴

대화

대화를 시작해 보세요아래에 메시지를 입력해 시작하세요

소개: Gemini 3.1 Pro

Gemini 3.1 Pro는 Google의 차세대 플래그십 추론 모델로, 복잡한 다단계 추론과 롱 컨텍스트 이해, 텍스트와 이미지 같은 멀티모달 입력을 위해 만들어졌습니다. NezhaGate에서는 OpenAI 호환 API로 제공되므로 model을 "gemini-3.1-pro"로 두고 base_url을 NezhaGate로 돌리면 OpenAI SDK를 그대로 재사용할 수 있습니다. 기본값은 빠른 낮은 추론 등급이며, reasoning_effort="high"를 보내면 심층 추론 등급으로 전환됩니다(Preview 요금 적용). 사용한 만큼 과금하며 실패한 요청에는 과금하지 않습니다.

활용 사례

장문 분석

계약서, 보고서, 논문을 요약하고 추출하고 질의응답합니다. 긴 컨텍스트 창에 문서 전체를 담은 채 추론의 일관성을 유지합니다.

복잡한 추론과 계획

다단계 추론, 수학과 논리 문제, 과제 분해, 해법 설계처럼 분석의 사슬이 명확하고 구조적이어야 하는 작업을 다룹니다.

멀티모달 이해

텍스트와 이미지 입력을 함께 써서 차트 해석, 스크린샷 질의응답, 시각적 서술을 하나의 채팅 인터페이스로 처리합니다.

코드 생성과 리뷰

코드를 생성하고 설명하고 리팩터링합니다. 긴 컨텍스트로 파일이나 모듈 전체를 읽어 디버깅과 설계 리뷰를 돕습니다.

RAG 지식 질의응답

검색 증강 생성의 핵심 모델로서 검색된 문단을 사용자 질문과 함께 넣어 근거가 있고 인용 가능한 답을 만듭니다.

어떻게 고를까

가장 깊은 추론, 가장 긴 컨텍스트, 멀티모달 지원이 필요하면 플래그십 Gemini 3.1 Pro를 고르세요. 일상 채팅에서 낮은 지연과 비용 효율이 더 중요하다면 Google의 더 빠른 형제인 Gemini 3 Flash, Gemini 3.5 Flash, Gemini 2.5 Flash를 쓰면 됩니다. 공급사를 넘어 플래그십을 비교하려면 같은 방식으로 GPT-5.5나 Claude Sonnet 4.6으로 바꾸세요. 모두 하나의 OpenAI 호환 API 뒤에 있으므로 model 필드만 달라집니다.

자주 묻는 질문

Gemini 3.1 Pro는 무엇인가요?
Gemini 3.1 Pro는 Google의 차세대 플래그십 추론 모델로 복잡한 추론, 롱 컨텍스트, 텍스트와 이미지가 섞인 멀티모달 작업을 겨냥합니다. NezhaGate에서는 "gemini-3.1-pro"라는 모델 이름으로 OpenAI 호환 API에 노출되며, reasoning_effort 파라미터로 low(기본)와 high 두 등급을 고릅니다.
OpenAI SDK로 Gemini 3.1 Pro를 어떻게 호출하나요?
이미 쓰고 있는 OpenAI SDK를 그대로 쓰면 됩니다. 클라이언트의 base_url을 NezhaGate로 돌리고 NezhaGate API 키를 넣은 뒤 model을 "gemini-3.1-pro"로 두고 chat.completions를 호출하세요. 새 SDK도, 요청 형태 변경도 필요 없습니다. 더 깊은 추론이 필요하면 reasoning_effort="high"를 추가하거나 모델 이름 gemini-3.1-pro-high를 쓰세요.
low와 high 등급은 무엇이 다른가요? 예전 gemini-3.1-pro-preview는 아직 쓸 수 있나요?
두 등급은 같은 모델의 추론 깊이만 다릅니다. low(기본값)는 더 빠르고 저렴해 일상 채팅과 대량 작업에 좋고, high는 어려운 추론과 복잡한 코드를 위해 더 깊이 생각하며 Preview 요금으로 과금됩니다. reasoning_effort="high"를 보내면 전환됩니다. 예전 id인 gemini-3.1-pro-preview도 계속 동작하며 기존 가격 그대로 high 등급에 대응하므로 기존 연동을 고칠 필요가 없습니다.
Gemini 3.1 Pro를 호출할 때 모델의 사고 과정을 볼 수 있나요?
볼 수 있습니다. content에 담긴 답변과 별도로 응답에 reasoning_content 필드가 있고, 여기에 모델이 스스로 정리한 사고 과정이 들어갑니다. 스트리밍에서는 delta.reasoning_content로 조각 단위로 내려옵니다. 사고와 답변은 서로 다른 필드에 분리되어 섞이지 않으므로 content만 읽는 기존 클라이언트는 아무것도 고칠 필요가 없습니다. 과금은 사고 토큰이 출력 단가로 계산되어 usage.completion_tokens에 포함되고, 그중 사고에 해당하는 양은 usage.completion_tokens_details.reasoning_tokens에서 확인할 수 있습니다. 스트리밍 호출에서는 업스트림이 사고 토큰 수를 따로 보고하지 않아 이 필드가 0으로 표시되지만, 토큰은 여전히 completion_tokens에 집계되므로 비용은 비스트리밍과 같습니다.
Gemini 3.1 Pro는 어떤 작업에 가장 잘 맞나요?
깊은 추론, 긴 문서 처리, 텍스트와 이미지의 멀티모달 이해가 필요한 작업 — 장문 분석, 복잡한 문제 해결, 코드 리뷰, RAG 지식 질의응답 — 에 가장 잘 맞습니다. 지연에 민감하거나 저비용 대량 채팅이라면 더 빠른 Flash 모델을 고려하세요.
Gemini 3.1 Pro와 Gemini 3 Flash 중 무엇을 고를까요?
Gemini 3.1 Pro는 추론이 더 깊고 컨텍스트가 더 긴 플래그십으로 까다롭고 멀티모달한 작업에 적합하고, Gemini 3 Flash는 속도와 비용 효율이 먼저인 일상 채팅에 맞는 저지연 등급입니다. 둘 다 같은 OpenAI 호환 API로 제공되므로 전환은 model 필드만 바꾸면 됩니다.

관련 모델

연동할 수 있는 다른 모델도 둘러보세요.

전체 보기 →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

에이전트 코딩을 위한 프런티어 플래그십

$2.00/1M 입력 · $12.00/1M 출력 ↓75% 보기 →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

일상용 균형형 에이전트 코딩 모델

$1.20/1M 입력 · $7.00/1M 출력 ↓77% 보기 →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

빠르고 저렴한 에이전트 코딩 모델

$0.80/1M 입력 · $4.80/1M 출력 ↓68% 보기 →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

플래그십 채팅 · 추론 모델

$0.70/1M 입력 · $4.20/1M 출력 ↓86% 보기 →
GPT-6 Astra Chat

GPT-6 Astra

gpt-6-astra

OpenAI 차세대 플래그십 — 105만 컨텍스트

$2.80/1M 입력 · $14.00/1M 출력 ↓72% 보기 →
GPT Image 2 이미지

GPT Image 2

gpt-image-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.015/장부터 보기 →
GPT Image 2.5 Flare 이미지

GPT Image 2.5 Flare

gpt-image-2.5-flare

차세대 이미지 모델 — 깔끔하고 매끄러운

$0.015/장부터 보기 →
GPT Image 2.5 Sunburst 이미지

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

차세대 이미지 모델 — 질감이 더 진한

$0.015/장부터 보기 →
Nano Banana 2 이미지

Nano Banana 2

nano-banana-2

고품질 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.025/장부터 보기 →
Nano Banana Pro 이미지

Nano Banana Pro

nano-banana-pro

플래그십 텍스트-투-이미지 / 이미지-투-이미지 모델

$0.040/장부터 보기 →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

균형 잡히고 효율적인 채팅 · 코딩 모델

$1.50/1M 입력 · $7.50/1M 출력 ↓50% 보기 →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Anthropic의 차세대 플래그십

$4.00/1M 입력 · $20.00/1M 출력 보기 →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Anthropic Fable 시리즈 · 서사와 장문 글쓰기

$8.00/1M 입력 · $40.00/1M 출력 보기 →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

최신 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

이전 세대 Flash · 적응형 사고

$0.60/1M 입력 · $3.60/1M 출력 ↓7% 보기 →
Gemini 3.6 Flash Chat

Gemini 3.6 Flash

gemini-3.6-flash

차세대 고속 사고 모델 · 사고 예산 4단계

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

심층 사고 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

가장 빠르고 가장 저렴한 등급

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

사고량 자동 조절

$0.60/1M 입력 · $3.60/1M 출력 보기 →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

빠르고 지연이 낮은 비용 효율형 채팅 모델

$0.30/1M 입력 · $1.20/1M 출력 ↓57% 보기 →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

차세대 고속 사고 모델

$0.45/1M 입력 · $2.70/1M 출력 ↓70% 보기 →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

빠르고 지연이 낮은 비용 효율형 채팅

$0.30/1M 입력 · $1.20/1M 출력 ↓46% 보기 →
Veo 3.1 영상

Veo 3.1

veo-3.1

텍스트 / 이미지 투 비디오 · 다중 등급 · 다중 해상도

$0.075/건부터 보기 →
Seedance 2.5 영상

Seedance 2.5

seedance-2.5

텍스트 / 이미지 투 비디오 · 최대 30초

$0.158/초 보기 →
Seedance 2.0 영상

Seedance 2.0

seedance-2.0

텍스트 / 이미지 투 비디오 · 5~15초

$0.150/초 보기 →
Seedance 2.0 Fast 영상

Seedance 2.0 Fast

seedance-2.0-fast

낮은 지연 · 최저 비용

$0.100/초 보기 →
Seedance 2.0 Mini 영상

Seedance 2.0 Mini

seedance-2.0-mini

엔트리 등급 · 최저 비용

$0.066/초 보기 →
Wan 3.0 영상

Wan 3.0

wan3.0-video

엔드포인트 하나에 다섯 가지 모드 · 최대 30초

$0.120/초 보기 →
Wan 3.0 Prime 영상

Wan 3.0 Prime

wan3.0-video-prime

성능은 동일 · 속도는 몇 배

$0.160/초 보기 →
MiniMax H3 영상

MiniMax H3

minimax-h3

1080P · 네이티브 오디오

$0.036/초 보기 →
Grok Imagine Video 1.5 영상

Grok Imagine Video 1.5

grok-imagine-video-1.5

건당 과금 · 최대 15초

$0.300/건부터 보기 →