Gemini 3.5 Flash
⧉Gemini 3.5 Flash es el modelo rápido de nueva generación de Google con razonamiento integrado: veloz y económico, para cargas de chat y agentes de gran volumen. Totalmente compatible con la API de OpenAI: pon model en gemini-3.5-flash.
Prueba en directo · Playground
Prueba Gemini 3.5 Flash aquí mismo (disponible tras iniciar sesión)。
Input
Avanzado
Conversación
Acerca de Gemini 3.5 Flash
Gemini 3.5 Flash es el modelo rápido con razonamiento de nueva generación de Google, que combina baja latencia y alta concurrencia con un paso explícito de razonamiento, lo que lo hace muy adecuado para conversaciones y tareas de procesamiento que necesitan a la vez velocidad y algo de razonamiento lógico. En NezhaGate se sirve por un endpoint compatible con OpenAI: apunta tu base_url a NezhaGate y pon el parámetro model en «gemini-3.5-flash» para reutilizar tu código actual del SDK de OpenAI, con facturación por uso y sin cargo por las peticiones fallidas.
Casos de uso
Da vida a bots de atención al cliente y asistentes de preguntas y respuestas que necesitan respuestas de baja latencia y un comportamiento estable bajo tráfico intenso.
Aprovecha el paso de razonamiento para tareas que requieren inferencia lógica sencilla —clasificación, decisiones condicionales, preguntas en varios pasos— sin recurrir a un modelo insignia más pesado.
Resume, reescribe, extrae o clasifica grandes volúmenes de documentos, usando el alto rendimiento y la facturación por uso para mantener bajo el coste unitario.
Actúa como nodo de decisión rápido dentro de bucles de llamada a herramientas y orquestación multiturno para reducir la espera en cada paso.
Monta funciones conversacionales rápidamente durante la validación y luego cambia sin fricción a un modelo equilibrado o insignia cuando haga falta.
Cómo elegir
Elige Gemini 3.5 Flash cuando quieras un equilibrio entre velocidad, coste y algo de razonamiento: es más rápido y barato que el insignia Gemini 3.1 Pro, pero añade un paso explícito de razonamiento frente a los más puramente rápidos Gemini 3 Flash y Gemini 2.5 Flash. Recurre a Gemini 3.1 Pro cuando una tarea necesite el razonamiento más profundo, sube a Gemini 3.6 Flash para un modelo rápido con razonamiento más reciente, o compara GPT-5.6 Luna si prefieres un modelo rápido del ecosistema de OpenAI.
Preguntas frecuentes
¿Qué es Gemini 3.5 Flash?
¿Admite streaming Gemini 3.5 Flash?
¿Cómo llamo a Gemini 3.5 Flash con el SDK de OpenAI?
¿Para qué es mejor Gemini 3.5 Flash?
Gemini 3.5 Flash frente a Gemini 3 Flash: ¿cómo elijo?
Modelos relacionados
Descubre otros modelos que puedes integrar.
GPT-5.6 Sol
Buque insignia de frontera para programación agéntica
GPT-5.6 Terra
Modelo equilibrado de programación agéntica para el día a día
GPT-5.6 Luna
Modelo rápido y económico de programación agéntica
GPT-5.5
Modelo insignia de chat y razonamiento
GPT-6 Astra
Buque insignia de nueva generación de OpenAI · contexto de 1,05M
GPT Image 2
Modelo de alta calidad para texto a imagen e imagen a imagen
GPT Image 2.5 Flare
Modelo de imagen de nueva generación · limpio y suave
GPT Image 2.5 Sunburst
Modelo de imagen de nueva generación · más textura
Nano Banana 2
Modelo de alta calidad para texto a imagen e imagen a imagen
Nano Banana Pro
Modelo insignia para texto a imagen e imagen a imagen
Claude Sonnet 4.6
Modelo equilibrado y eficiente para chat y código
Claude Opus 5
Buque insignia de nueva generación de Anthropic
Claude Fable 5
Serie Fable de Anthropic · narrativa y textos largos
Gemini 3.1 Pro
Modelo insignia de razonamiento de nueva generación de Google
Gemini 3.8 Flash
El Flash más reciente · razonamiento adaptativo
Gemini 3.7 Flash
Flash anterior · razonamiento adaptativo
Gemini 3.6 Flash
Modelo rápido de nueva generación · cuatro presupuestos de razonamiento
Gemini 3.6 Flash High
Nivel de razonamiento profundo
Gemini 3.6 Flash Low
El nivel más rápido y económico
Gemini 3.6 Flash Tiered
Razonamiento por niveles automático
Gemini 3 Flash
Modelo de chat rápido, de baja latencia y económico
Gemini 2.5 Flash
Chat rápido, de baja latencia y económico
Veo 3.1
Texto / imagen a vídeo · varios niveles · varias resoluciones
Seedance 2.5
Texto / imagen a vídeo · hasta 30 segundos
Seedance 2.0
Texto / imagen a vídeo · de 5 a 15 segundos
Seedance 2.0 Fast
Baja latencia · el coste más bajo
Seedance 2.0 Mini
Nivel de entrada · el coste más bajo
Wan 3.0
Un endpoint, cinco modos · hasta 30 segundos
Wan 3.0 Prime
Las mismas capacidades · varias veces más rápido
MiniMax H3
1080P · audio nativo
Grok Imagine Video 1.5
Facturado por clip · hasta 15 segundos