Mercado de modelos de IA
Explora todos los modelos de IA disponibles, compara precios y capacidades e intégralos en minutos. Ahora mismo ofrecemos 21 modelos, y seguimos añadiendo más. Además, 1 aún no disponible(s).

GPT-5.6
La familia GPT-5.6: Sol es el buque insignia de frontera, Terra el modelo equilibrado para el día a día y Luna el rápido y económico; una sola familia que va de la inteligencia de frontera a la ejecución a alta velocidad. Usa «Tipo de modelo» para elegir nivel.

GPT-5.5
GPT-5.5 ofrece chat, razonamiento y programación al más alto nivel, con streaming, contexto largo y tareas estructuradas. Totalmente compatible con el SDK de OpenAI: conéctalo a Codex, Cursor, Claude Code y herramientas similares sin tocar el código.

GPT-6 Astra
GPT-6 Astra es el buque insignia de nueva generación que OpenAI lanzó en septiembre de 2026: ventana de contexto de 1 050 000 tokens, hasta 128 000 tokens de salida, reasoning_effort hasta xhigh, entrada de imagen, llamada a herramientas y caché de prompts. Totalmente compatible con el SDK de OpenAI —pon model en gpt-6-astra— y disponible tanto en /chat/completions como en /responses. Pago por uso, las llamadas fallidas nunca se facturan; la entrada cacheada se cobra a una décima parte y no aplicamos el recargo por contexto largo que sí aplica la API oficial.

Claude Sonnet 4.6
Claude Sonnet 4.6 logra un equilibrio excelente entre capacidad y velocidad, y destaca en chat cotidiano, código y agentes a muy buen precio. Totalmente compatible con la API de OpenAI: pon model en claude-sonnet-4-6 y ya estás conectado.

Claude Opus 5
Claude Opus 5 es el buque insignia de nueva generación de Anthropic, con razonamiento adaptativo activado por defecto. Destaca en razonamiento complejo, ingeniería de software y orquestación de agentes, y admite comprensión de imágenes, uso de herramientas y caché de prompts. Totalmente compatible con la API de OpenAI: pon model en claude-opus-5, o usa la API nativa de mensajes de Anthropic para que Claude Code se conecte directamente.

Claude Fable 5
Claude Fable 5 pertenece a la serie Fable de Anthropic: misma generación y misma base de capacidades que Opus 5 (razonamiento adaptativo, uso de herramientas, comprensión de imágenes, caché de prompts), con un trazo más fino y más matices emocionales en narrativa y textos largos en chino. Totalmente compatible con la API de OpenAI: pon model en claude-fable-5; también se admite la API nativa de mensajes de Anthropic.

Gemini 3.1 Pro
Gemini 3.1 Pro es el buque insignia multimodal de nueva generación de Google, con una ventana de contexto muy larga y razonamiento y programación de primer nivel. Totalmente compatible con la API de OpenAI: pon model en gemini-3.1-pro en tu SDK actual. Por defecto usa el nivel de razonamiento bajo (más rápido y barato); pasa reasoning_effort=high para el nivel alto (facturado a la tarifa Preview). Las respuestas incluyen un campo reasoning_content para ver el razonamiento (también fragmento a fragmento en streaming).

Gemini 3.8 Flash
Gemini 3.8 Flash es la generación Flash más reciente de Google (lanzada en septiembre de 2026), creada para programación de largo recorrido, flujos con agentes y razonamiento complejo: contexto de 1M de tokens, hasta 64K de salida y entrada de imagen. Usa un presupuesto de razonamiento dinámico: respuestas rápidas para lo sencillo y más razonamiento para lo difícil. Totalmente compatible con la API de OpenAI: pon model en gemini-3.8-flash.

Gemini 3.7 Flash
Gemini 3.7 Flash es la generación anterior a la 3.8, con el mismo presupuesto de razonamiento dinámico, contexto de 1M de tokens y entrada de imagen. Encaja bien si tus prompts ya están ajustados para la 3.7 y prefieres no cambiar todavía. Totalmente compatible con la API de OpenAI: pon model en gemini-3.7-flash.

Gemini 3.6 Flash
La familia Gemini 3.6 Flash: un modelo con cuatro presupuestos de razonamiento. Medium para el equilibrio diario, High para razonamiento profundo, Low para velocidad y bajo coste, y Tiered deja que el modelo elija según la dificultad. Los cuatro cuestan lo mismo; razonar más simplemente significa más tokens de salida. Contexto de 1M y entrada de imagen. Usa «Tipo de modelo» para elegir nivel.

Gemini 3 Flash
Gemini 3 Flash se centra en la velocidad y la eficiencia de coste, para cargas de chat y agentes de gran volumen y baja latencia. Totalmente compatible con la API de OpenAI y con streaming: pon model en gemini-3-flash-preview.

Gemini 3.5 Flash
Gemini 3.5 Flash es el modelo rápido de nueva generación de Google con razonamiento integrado: veloz y económico, para cargas de chat y agentes de gran volumen. Totalmente compatible con la API de OpenAI: pon model en gemini-3.5-flash.

Gemini 2.5 Flash
Gemini 2.5 Flash se centra en la velocidad y la eficiencia de coste, para cargas de chat y agentes a gran escala y con baja latencia, con entrada multimodal. Totalmente compatible con la API de OpenAI: pon model en gemini-2.5-flash.








