NezhaGate
Chat

Gemini 3.6 Flash

gemini-3.6-flash
Tipo de modelo MediumHighLowTiered

Gemini 3.6 Flash es el modelo rápido con razonamiento de nueva generación de Google: contexto de 1M de tokens, hasta 64K de salida y entrada de imagen. El nivel estándar (Medium) tiene un presupuesto de razonamiento equilibrado para el chat y los flujos con agentes del día a día. Totalmente compatible con la API de OpenAI: pon model en gemini-3.6-flash.

ChatRazonamientoContexto 1MCompatible con OpenAI

Prueba en directo · Playground

Prueba Gemini 3.6 Flash aquí mismo (disponible tras iniciar sesión)。

Input

Avanzado
Búsqueda web
Memoria · multiturno

Conversación

Empieza una conversaciónEscribe un mensaje abajo para empezar

Acerca de Gemini 3.6 Flash

Gemini 3.6 Flash es el modelo rápido con razonamiento de nueva generación de Google: añade un paso explícito de razonamiento manteniendo la latencia y el coste del nivel Flash, maneja un contexto de 1 000 000 de tokens con hasta 64K de salida y acepta entrada de imagen. NezhaGate expone cuatro niveles de presupuesto de razonamiento: el estándar gemini-3.6-flash, el más profundo gemini-3.6-flash-high, el más rápido gemini-3.6-flash-low y gemini-3.6-flash-tiered, donde el modelo decide en cada petición cuánto razonar. Los cuatro cuestan lo mismo por token: cuánto razona un nivel simplemente se refleja en los tokens de salida. Se sirve por un endpoint compatible con OpenAI: apunta base_url a NezhaGate y pon model en «gemini-3.6-flash» para reutilizar tu código actual del SDK de OpenAI, con facturación por uso y sin cargo por las peticiones fallidas.

Casos de uso

Chat y agentes del día a día que necesitan razonar

El nivel estándar equilibra velocidad y razonamiento, y encaja con bots de soporte, asistentes y flujos con agentes que deben responder rápido sin dejar de razonar.

Trabajo con documentos de un millón de tokens

La ventana de 1M de contexto se traga un repositorio grande, un informe largo o un montón de contratos de una sola vez para resumir, recuperar y contrastar.

Comprensión mixta de texto e imagen

La entrada de imagen permite preguntas sobre capturas de pantalla, lectura de formularios y gráficos y otros análisis multimodales.

Cargas de dificultad desigual

La variante tiered deja que el modelo elija su presupuesto de razonamiento en cada petición —respuestas rápidas para las preguntas fáciles y más deliberación para las difíciles—, lo que encaja con tráfico de producción con mucha variedad.

Cómo elegir

Usa el estándar gemini-3.6-flash por defecto; cambia a gemini-3.6-flash-high para razonamiento en varios pasos; usa gemini-3.6-flash-low para clasificación, extracción y reescritura en lote, donde en la práctica es a la vez el más rápido y el más barato; y elige gemini-3.6-flash-tiered cuando la dificultad de las peticiones sea impredecible y prefieras dejar que decida el modelo. Los cuatro comparten precio, así que cambiar de nivel es solo cambiar el campo model. Sube a Gemini 3.1 Pro cuando necesites más profundidad de razonamiento.

Preguntas frecuentes

¿Cuál es la diferencia entre los cuatro niveles de Gemini 3.6 Flash?
Solo el presupuesto de razonamiento: low razona menos y responde más rápido, el id estándar (sin sufijo) se queda en medio, high razona más y encaja con el razonamiento en varios pasos, y tiered deja que el modelo decida en cada petición. Comparten el mismo modelo subyacente, la misma ventana de contexto y el mismo soporte multimodal.
¿Por qué cuestan lo mismo los cuatro niveles?
Porque la diferencia ya se refleja en el consumo: los tokens de razonamiento se facturan como tokens de salida, así que el nivel high consume de forma natural más salida que el low. Añadir encima un recargo por token cobraría dos veces por lo mismo, así que los cuatro comparten tarifa y tu factura real sigue cuánto razonó de verdad el nivel elegido.
¿De qué tamaño es la ventana de contexto?
Unos 1 000 000 de tokens de entrada con hasta 64K tokens de salida por llamada, idéntico en los cuatro niveles.
¿Admite entrada de imagen y streaming?
Ambos. Pasa las imágenes con el formato image_url de OpenAI y pon stream=true en la petición para recibir la respuesta token a token.
¿Cómo lo llamo con el SDK de OpenAI?
Apunta base_url a NezhaGate, aporta tu clave API de NezhaGate y pon model en «gemini-3.6-flash» (o en uno de los ids con sufijo de nivel). Todo lo demás coincide con tu código actual de OpenAI.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →
GPT-5.6 Sol Chat

GPT-5.6 Sol

gpt-5.6-sol

Buque insignia de frontera para programación agéntica

$2.00/1M entrada · $12.00/1M salida ↓75% Ver →
GPT-5.6 Terra Chat

GPT-5.6 Terra

gpt-5.6-terra

Modelo equilibrado de programación agéntica para el día a día

$1.20/1M entrada · $7.00/1M salida ↓77% Ver →
GPT-5.6 Luna Chat

GPT-5.6 Luna

gpt-5.6-luna

Modelo rápido y económico de programación agéntica

$0.80/1M entrada · $4.80/1M salida ↓68% Ver →
GPT-5.5 Chat

GPT-5.5

gpt-5.5

Modelo insignia de chat y razonamiento

$0.70/1M entrada · $4.20/1M salida ↓86% Ver →
GPT-6 Astra Chat

GPT-6 Astra

gpt-6-astra

Buque insignia de nueva generación de OpenAI · contexto de 1,05M

$2.80/1M entrada · $14.00/1M salida ↓72% Ver →
GPT Image 2 Imagen

GPT Image 2

gpt-image-2

Modelo de alta calidad para texto a imagen e imagen a imagen

$0.015/img y más Ver →
GPT Image 2.5 Flare Imagen

GPT Image 2.5 Flare

gpt-image-2.5-flare

Modelo de imagen de nueva generación · limpio y suave

$0.015/img y más Ver →
GPT Image 2.5 Sunburst Imagen

GPT Image 2.5 Sunburst

gpt-image-2.5-sunburst

Modelo de imagen de nueva generación · más textura

$0.015/img y más Ver →
Nano Banana 2 Imagen

Nano Banana 2

nano-banana-2

Modelo de alta calidad para texto a imagen e imagen a imagen

$0.025/img y más Ver →
Nano Banana Pro Imagen

Nano Banana Pro

nano-banana-pro

Modelo insignia para texto a imagen e imagen a imagen

$0.040/img y más Ver →
Claude Sonnet 4.6 Chat

Claude Sonnet 4.6

claude-sonnet-4-6

Modelo equilibrado y eficiente para chat y código

$1.50/1M entrada · $7.50/1M salida ↓50% Ver →
Claude Opus 5 Chat

Claude Opus 5

claude-opus-5

Buque insignia de nueva generación de Anthropic

$4.00/1M entrada · $20.00/1M salida Ver →
Claude Fable 5 Chat

Claude Fable 5

claude-fable-5

Serie Fable de Anthropic · narrativa y textos largos

$8.00/1M entrada · $40.00/1M salida Ver →
Gemini 3.1 Pro Chat

Gemini 3.1 Pro

gemini-3.1-pro

Modelo insignia de razonamiento de nueva generación de Google

$0.50/1M entrada · $3.00/1M salida ↓75% Ver →
Gemini 3.8 Flash Chat

Gemini 3.8 Flash

gemini-3.8-flash

El Flash más reciente · razonamiento adaptativo

$0.60/1M entrada · $3.60/1M salida ↓7% Ver →
Gemini 3.7 Flash Chat

Gemini 3.7 Flash

gemini-3.7-flash

Flash anterior · razonamiento adaptativo

$0.60/1M entrada · $3.60/1M salida ↓7% Ver →
Gemini 3.6 Flash High Chat

Gemini 3.6 Flash High

gemini-3.6-flash-high

Nivel de razonamiento profundo

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash Low Chat

Gemini 3.6 Flash Low

gemini-3.6-flash-low

El nivel más rápido y económico

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3.6 Flash Tiered Chat

Gemini 3.6 Flash Tiered

gemini-3.6-flash-tiered

Razonamiento por niveles automático

$0.60/1M entrada · $3.60/1M salida Ver →
Gemini 3 Flash Chat

Gemini 3 Flash

gemini-3-flash-preview

Modelo de chat rápido, de baja latencia y económico

$0.30/1M entrada · $1.20/1M salida ↓57% Ver →
Gemini 3.5 Flash Chat

Gemini 3.5 Flash

gemini-3.5-flash

Modelo rápido con razonamiento de nueva generación

$0.45/1M entrada · $2.70/1M salida ↓70% Ver →
Gemini 2.5 Flash Chat

Gemini 2.5 Flash

gemini-2.5-flash

Chat rápido, de baja latencia y económico

$0.30/1M entrada · $1.20/1M salida ↓46% Ver →
Veo 3.1 Vídeo

Veo 3.1

veo-3.1

Texto / imagen a vídeo · varios niveles · varias resoluciones

$0.075/clip+ Ver →
Seedance 2.5 Vídeo

Seedance 2.5

seedance-2.5

Texto / imagen a vídeo · hasta 30 segundos

$0.158/s Ver →
Seedance 2.0 Vídeo

Seedance 2.0

seedance-2.0

Texto / imagen a vídeo · de 5 a 15 segundos

$0.150/s Ver →
Seedance 2.0 Fast Vídeo

Seedance 2.0 Fast

seedance-2.0-fast

Baja latencia · el coste más bajo

$0.100/s Ver →
Seedance 2.0 Mini Vídeo

Seedance 2.0 Mini

seedance-2.0-mini

Nivel de entrada · el coste más bajo

$0.066/s Ver →
Wan 3.0 Vídeo

Wan 3.0

wan3.0-video

Un endpoint, cinco modos · hasta 30 segundos

$0.120/s Ver →
Wan 3.0 Prime Vídeo

Wan 3.0 Prime

wan3.0-video-prime

Las mismas capacidades · varias veces más rápido

$0.160/s Ver →
MiniMax H3 Vídeo

MiniMax H3

minimax-h3

1080P · audio nativo

$0.036/s Ver →
Grok Imagine Video 1.5 Vídeo

Grok Imagine Video 1.5

grok-imagine-video-1.5

Facturado por clip · hasta 15 segundos

$0.300/clip+ Ver →