Gemini 3.6 Flash
⧉Gemini 3.6 Flash es el modelo rápido con razonamiento de nueva generación de Google: contexto de 1M de tokens, hasta 64K de salida y entrada de imagen. El nivel estándar (Medium) tiene un presupuesto de razonamiento equilibrado para el chat y los flujos con agentes del día a día. Totalmente compatible con la API de OpenAI: pon model en gemini-3.6-flash.
Prueba en directo · Playground
Prueba Gemini 3.6 Flash aquí mismo (disponible tras iniciar sesión)。
Input
Avanzado
Conversación
Acerca de Gemini 3.6 Flash
Gemini 3.6 Flash es el modelo rápido con razonamiento de nueva generación de Google: añade un paso explícito de razonamiento manteniendo la latencia y el coste del nivel Flash, maneja un contexto de 1 000 000 de tokens con hasta 64K de salida y acepta entrada de imagen. NezhaGate expone cuatro niveles de presupuesto de razonamiento: el estándar gemini-3.6-flash, el más profundo gemini-3.6-flash-high, el más rápido gemini-3.6-flash-low y gemini-3.6-flash-tiered, donde el modelo decide en cada petición cuánto razonar. Los cuatro cuestan lo mismo por token: cuánto razona un nivel simplemente se refleja en los tokens de salida. Se sirve por un endpoint compatible con OpenAI: apunta base_url a NezhaGate y pon model en «gemini-3.6-flash» para reutilizar tu código actual del SDK de OpenAI, con facturación por uso y sin cargo por las peticiones fallidas.
Casos de uso
El nivel estándar equilibra velocidad y razonamiento, y encaja con bots de soporte, asistentes y flujos con agentes que deben responder rápido sin dejar de razonar.
La ventana de 1M de contexto se traga un repositorio grande, un informe largo o un montón de contratos de una sola vez para resumir, recuperar y contrastar.
La entrada de imagen permite preguntas sobre capturas de pantalla, lectura de formularios y gráficos y otros análisis multimodales.
La variante tiered deja que el modelo elija su presupuesto de razonamiento en cada petición —respuestas rápidas para las preguntas fáciles y más deliberación para las difíciles—, lo que encaja con tráfico de producción con mucha variedad.
Cómo elegir
Usa el estándar gemini-3.6-flash por defecto; cambia a gemini-3.6-flash-high para razonamiento en varios pasos; usa gemini-3.6-flash-low para clasificación, extracción y reescritura en lote, donde en la práctica es a la vez el más rápido y el más barato; y elige gemini-3.6-flash-tiered cuando la dificultad de las peticiones sea impredecible y prefieras dejar que decida el modelo. Los cuatro comparten precio, así que cambiar de nivel es solo cambiar el campo model. Sube a Gemini 3.1 Pro cuando necesites más profundidad de razonamiento.
Preguntas frecuentes
¿Cuál es la diferencia entre los cuatro niveles de Gemini 3.6 Flash?
¿Por qué cuestan lo mismo los cuatro niveles?
¿De qué tamaño es la ventana de contexto?
¿Admite entrada de imagen y streaming?
¿Cómo lo llamo con el SDK de OpenAI?
Modelos relacionados
Descubre otros modelos que puedes integrar.
GPT-5.6 Sol
Buque insignia de frontera para programación agéntica
GPT-5.6 Terra
Modelo equilibrado de programación agéntica para el día a día
GPT-5.6 Luna
Modelo rápido y económico de programación agéntica
GPT-5.5
Modelo insignia de chat y razonamiento
GPT-6 Astra
Buque insignia de nueva generación de OpenAI · contexto de 1,05M
GPT Image 2
Modelo de alta calidad para texto a imagen e imagen a imagen
GPT Image 2.5 Flare
Modelo de imagen de nueva generación · limpio y suave
GPT Image 2.5 Sunburst
Modelo de imagen de nueva generación · más textura
Nano Banana 2
Modelo de alta calidad para texto a imagen e imagen a imagen
Nano Banana Pro
Modelo insignia para texto a imagen e imagen a imagen
Claude Sonnet 4.6
Modelo equilibrado y eficiente para chat y código
Claude Opus 5
Buque insignia de nueva generación de Anthropic
Claude Fable 5
Serie Fable de Anthropic · narrativa y textos largos
Gemini 3.1 Pro
Modelo insignia de razonamiento de nueva generación de Google
Gemini 3.8 Flash
El Flash más reciente · razonamiento adaptativo
Gemini 3.7 Flash
Flash anterior · razonamiento adaptativo
Gemini 3.6 Flash High
Nivel de razonamiento profundo
Gemini 3.6 Flash Low
El nivel más rápido y económico
Gemini 3.6 Flash Tiered
Razonamiento por niveles automático
Gemini 3 Flash
Modelo de chat rápido, de baja latencia y económico
Gemini 3.5 Flash
Modelo rápido con razonamiento de nueva generación
Gemini 2.5 Flash
Chat rápido, de baja latencia y económico
Veo 3.1
Texto / imagen a vídeo · varios niveles · varias resoluciones
Seedance 2.5
Texto / imagen a vídeo · hasta 30 segundos
Seedance 2.0
Texto / imagen a vídeo · de 5 a 15 segundos
Seedance 2.0 Fast
Baja latencia · el coste más bajo
Seedance 2.0 Mini
Nivel de entrada · el coste más bajo
Wan 3.0
Un endpoint, cinco modos · hasta 30 segundos
Wan 3.0 Prime
Las mismas capacidades · varias veces más rápido
MiniMax H3
1080P · audio nativo
Grok Imagine Video 1.5
Facturado por clip · hasta 15 segundos