Claude Haiku 5.5
API de Claude Haiku 5.5: el modelo pequeño más rápido, barato y capaz de Anthropic hasta ahora, con 1M de tokens de contexto, el primer Haiku con control de esfuerzo (effort) y precios oficiales hasta un 90% más bajos que Haiku 4.5
Claude Haiku 5.5 es el nuevo Haiku de Anthropic, lanzado el 7 de octubre de 2026 como sucesor de Claude Haiku 4.5. Anthropic lo presenta como el modelo pequeño más barato, rápido y capaz que ha lanzado, y es el de menor latencia de la gama Claude actual. Está pensado para trabajo de gran volumen donde importan la velocidad y el coste: clasificación, enrutamiento, extracción, resúmenes y compactación de contexto, atención al cliente en tiempo real y subagentes dentro de agentes de programación dirigidos por Claude Opus 5.5 o Sonnet 5.5. Tiene 1M de tokens de contexto y hasta 128K tokens de salida, razona de forma adaptativa por defecto y es el primer Haiku con ajuste de esfuerzo (cinco niveles, de low a max; medium por defecto). Con prompts de hasta 100K tokens, el precio oficial es de $0.10 de entrada y $0.50 de salida por millón de tokens, un 90% menos que Haiku 4.5. Lo estamos integrando: déjanos tu correo y te avisaremos el día que esté disponible.
Publicado por el fabricante: 2026-10-07 · aún no disponible en NezhaGate
Puntos fuertes
- El modelo pequeño más barato, rápido y capaz de Anthropic hasta la fecha, y el de menor latencia de la gama Claude actual
- Precios oficiales mucho más bajos: con prompts de hasta 100K tokens, $0.10 de entrada, $0.50 de salida y $0.01 por lectura de caché por millón de tokens, un 90% menos que Haiku 4.5; por encima de 100K tokens, $0.50 / $2.50, aún un 50% menos; la Batch API ahorra otro 50%
- 1M de tokens de contexto (Haiku 4.5: 200K) y hasta 128K tokens de salida por petición (antes, 64K); entrada de imágenes; conocimiento fiable hasta junio de 2026
- El primer Haiku con control de esfuerzo: low, medium, high, xhigh y max, medium por defecto; el razonamiento adaptativo viene activado y las peticiones sencillas pueden responderse sin razonar
- Un gran salto en tareas agénticas: uso de ordenador en OSWorld 2.1 del 15.7% al 72.4% y tareas de línea de comandos en Terminal-Bench 4.0 del 0.0% al 39.2%, ambos por encima de GPT-6 Luna (48.9% y 16.4%)
- Herramientas completas: llamadas a herramientas (también forzando una concreta), salidas estructuradas, caché de prompts, Batch API, el conjunto de herramientas de uso de ordenador y la nueva herramienta de uso del navegador
- Una combinación que recomienda Anthropic: en agentes de programación dirigidos por Opus 5.5 o Sonnet 5.5, Haiku 5.5 trabaja como subagente en las muchas tareas pequeñas (buscar, leer, resumir) y reduce el coste y la latencia totales
- Resultados de clientes en la página de lanzamiento de Anthropic: Box midió 11 puntos más que con Haiku 4.5 con aproximadamente la mitad de latencia; Asana redujo más de un 30% la latencia al completar tareas
Qué mejora Haiku 5.5 frente a Haiku 4.5
Cinco veces más contexto, el doble de salida, control de esfuerzo por primera vez y resultados agénticos muy superiores, a un precio más bajo.
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| Lanzamiento | 2025-10-15 | 2026-10-07 |
| Ventana de contexto | 200K tokens | 1M tokens |
| Salida máxima por petición | 64K tokens | 128K tokens |
| Razonamiento | Presupuesto manual (budget_tokens) | Adaptativo, activado por defecto |
| Control de esfuerzo (effort) | No disponible | low / medium / high / xhigh / max, medium por defecto |
| Conocimiento fiable hasta | febrero de 2025 | junio de 2026 |
| Herramienta de uso del navegador | No disponible | Disponible |
| Precio oficial: entrada (por 1M tokens) | $1 | $0.10 (prompts de hasta 100K tokens) / $0.50 (más de 100K) |
| Precio oficial: salida (por 1M tokens) | $5 | $0.50 / $2.50 |
| Precio oficial: lectura de caché (por 1M tokens) | $0.10 | $0.01 / $0.05 |
| OSWorld 2.1, subconjunto offline (uso de ordenador) | 15.7% | 72.4% |
| Terminal-Bench 4.0 (tareas de agente en línea de comandos) | 0.0% | 39.2% |
| Humanity’s Last Exam (sin herramientas / con herramientas) | 10.2% / 18.7% | 45.9% / 57.4% |
| GDPval-AA v2.1 (tareas de trabajo reales, Elo) | 735 | 1620 |
| AA-Briefcase v1.1 (trabajo de conocimiento agéntico, Elo) | 614 | 1578 |
Especificaciones y precios: documentación de Anthropic; puntuaciones: anuncio de lanzamiento de Anthropic del 7 de octubre de 2026. Los precios de esta tabla son los oficiales de Anthropic, no los nuestros. Haiku 5.5 usa un tokenizador nuevo que cuenta el mismo texto como aproximadamente un 30% más de tokens; Anthropic afirma que, de media, sigue costando alrededor de un 75% menos de ejecutar que Haiku 4.5.
Casos de uso
Preguntas frecuentes
¿Qué mejora Claude Haiku 5.5 respecto a Haiku 4.5?
¿Cuál es el precio oficial de Claude Haiku 5.5?
¿Haiku 5.5 consume más tokens?
¿Qué nivel de esfuerzo conviene usar? ¿Se puede desactivar el razonamiento?
¿Qué cambia al migrar desde Haiku 4.5?
¿Cuándo podré llamar a Claude Haiku 5.5 aquí?
¿Cómo se llamará y funciona con Claude Code?
¿Hay algún modelo Claude que pueda usar ya?
Disponibles ya
Estos modelos ya se pueden usar en NezhaGate:
Claude Sonnet 5.5
El nuevo Sonnet de Anthropic · la mejor combinación de velocidad e inteligencia
Claude Opus 5.5
El nuevo Opus de Anthropic · contexto de 1M · razonamiento adaptativo
Claude Sonnet 5
El nuevo Sonnet de Anthropic · programación cercana a Opus
Gemini 3.8 Flash
El Flash más reciente · razonamiento adaptativo
DeepSeek V4.1 Flash
El modelo Flash actual de DeepSeek · razonamiento activable
GPT-6 Luna
El GPT-6 más eficiente, pensado para grandes volúmenes