NezhaGateNezhaGate
Anthropic ● Próximamente

Claude Haiku 5.5

claude-haiku-5-5

API de Claude Haiku 5.5: el modelo pequeño más rápido, barato y capaz de Anthropic hasta ahora, con 1M de tokens de contexto, el primer Haiku con control de esfuerzo (effort) y precios oficiales hasta un 90% más bajos que Haiku 4.5

Claude Haiku 5.5 es el nuevo Haiku de Anthropic, lanzado el 7 de octubre de 2026 como sucesor de Claude Haiku 4.5. Anthropic lo presenta como el modelo pequeño más barato, rápido y capaz que ha lanzado, y es el de menor latencia de la gama Claude actual. Está pensado para trabajo de gran volumen donde importan la velocidad y el coste: clasificación, enrutamiento, extracción, resúmenes y compactación de contexto, atención al cliente en tiempo real y subagentes dentro de agentes de programación dirigidos por Claude Opus 5.5 o Sonnet 5.5. Tiene 1M de tokens de contexto y hasta 128K tokens de salida, razona de forma adaptativa por defecto y es el primer Haiku con ajuste de esfuerzo (cinco niveles, de low a max; medium por defecto). Con prompts de hasta 100K tokens, el precio oficial es de $0.10 de entrada y $0.50 de salida por millón de tokens, un 90% menos que Haiku 4.5. Lo estamos integrando: déjanos tu correo y te avisaremos el día que esté disponible.

Publicado por el fabricante: 2026-10-07 · aún no disponible en NezhaGate

Puntos fuertes

Qué mejora Haiku 5.5 frente a Haiku 4.5

Cinco veces más contexto, el doble de salida, control de esfuerzo por primera vez y resultados agénticos muy superiores, a un precio más bajo.

Claude Haiku 4.5Claude Haiku 5.5
Lanzamiento2025-10-152026-10-07
Ventana de contexto200K tokens1M tokens
Salida máxima por petición64K tokens128K tokens
RazonamientoPresupuesto manual (budget_tokens)Adaptativo, activado por defecto
Control de esfuerzo (effort)No disponiblelow / medium / high / xhigh / max, medium por defecto
Conocimiento fiable hastafebrero de 2025junio de 2026
Herramienta de uso del navegadorNo disponibleDisponible
Precio oficial: entrada (por 1M tokens)$1$0.10 (prompts de hasta 100K tokens) / $0.50 (más de 100K)
Precio oficial: salida (por 1M tokens)$5$0.50 / $2.50
Precio oficial: lectura de caché (por 1M tokens)$0.10$0.01 / $0.05
OSWorld 2.1, subconjunto offline (uso de ordenador)15.7%72.4%
Terminal-Bench 4.0 (tareas de agente en línea de comandos)0.0%39.2%
Humanity’s Last Exam (sin herramientas / con herramientas)10.2% / 18.7%45.9% / 57.4%
GDPval-AA v2.1 (tareas de trabajo reales, Elo)7351620
AA-Briefcase v1.1 (trabajo de conocimiento agéntico, Elo)6141578

Especificaciones y precios: documentación de Anthropic; puntuaciones: anuncio de lanzamiento de Anthropic del 7 de octubre de 2026. Los precios de esta tabla son los oficiales de Anthropic, no los nuestros. Haiku 5.5 usa un tokenizador nuevo que cuenta el mismo texto como aproximadamente un 30% más de tokens; Anthropic afirma que, de media, sigue costando alrededor de un 75% menos de ejecutar que Haiku 4.5.

Casos de uso

Clasificación, etiquetado, detección de intención y enrutamiento de peticiones a gran escala
Extracción: sacar campos de contratos, páginas web y chats a JSON estructurado
Resúmenes y compactación de contexto en documentos y conversaciones largas
Subagentes en agentes de programación: buscar código, leer archivos, ejecutar comandos y reunir resultados para el modelo principal
Atención al cliente en tiempo real, chatbots y consultas a bases de datos
Agentes de navegador y de uso de ordenador: rellenar formularios, navegar entre páginas y recopilar información de varios sitios

Preguntas frecuentes

¿Qué mejora Claude Haiku 5.5 respecto a Haiku 4.5?
Destacan cinco cosas. (1) El contexto pasa de 200K a 1M de tokens y el límite de salida, de 64K a 128K tokens. (2) El razonamiento pasa de un presupuesto manual (budget_tokens) a razonamiento adaptativo, y Haiku tiene control de esfuerzo por primera vez. (3) Las tareas agénticas dan un salto: OSWorld 2.1 del 15.7% al 72.4%, Terminal-Bench 4.0 del 0.0% al 39.2% y Humanity’s Last Exam sin herramientas del 10.2% al 45.9%. (4) El conocimiento fiable llega hasta junio de 2026 (antes, febrero de 2025) y se añade la herramienta de uso del navegador. (5) Los precios bajan: un 90% menos por token con prompts de hasta 100K tokens y un 50% menos por encima. Anthropic también informa de grandes mejoras frente a Haiku 4.5 en casi todas sus evaluaciones de alineación.
¿Cuál es el precio oficial de Claude Haiku 5.5?
Anthropic aplica dos tramos según la longitud del prompt (por millón de tokens). Prompts de hasta 100K tokens: $0.10 de entrada, $0.50 de salida, $0.125 por escritura en caché de 5 minutos, $0.20 por escritura en caché de 1 hora y $0.01 por lectura de caché. Prompts de más de 100K tokens: todas las tarifas son cinco veces más altas, es decir, $0.50 de entrada, $2.50 de salida y $0.05 por lectura de caché. La Batch API ahorra otro 50%. Como referencia, Haiku 4.5 cuesta $1 de entrada y $5 de salida. Son precios oficiales de Anthropic; nuestro precio se publicará en el lanzamiento.
¿Haiku 5.5 consume más tokens?
Hay dos cosas que conviene saber. Primero, usa el tokenizador nuevo que llegó con Claude Opus 4.7, así que el mismo texto cuenta aproximadamente un 30% más de tokens que en Haiku 4.5. Segundo, el razonamiento está activado por defecto y sus tokens se cobran como salida y cuentan dentro de max_tokens; cuanto mayor es el esfuerzo, más razona. La firma independiente Artificial Analysis midió unos 162K tokens de salida por tarea de su Intelligence Index con esfuerzo max. Para peticiones sencillas de gran volumen suele bastar con low o con el medium por defecto. Con todo, Anthropic afirma que, de media, Haiku 5.5 cuesta alrededor de un 75% menos de ejecutar que Haiku 4.5.
¿Qué nivel de esfuerzo conviene usar? ¿Se puede desactivar el razonamiento?
La recomendación de Anthropic: empieza con medium, el valor por defecto, para la mayoría de tareas, incluida la programación agéntica. Usa low, el nivel más rápido y barato, para chat, tareas cortas con herramientas y peticiones sencillas de gran volumen; en prompts de agente largos, con low el modelo tiende más a saltarse una búsqueda o a terminar antes de tiempo. Usa high para trabajo de conocimiento, tareas de agente más largas y cuando haya que seguir instrucciones al pie de la letra. Usa xhigh o max solo si tus evaluaciones muestran una mejora, y compáralos con Sonnet 5.5 en calidad, coste y velocidad. El razonamiento se desactiva con thinking: disabled en esfuerzo high o inferior, pero no en xhigh ni max. Por defecto no se devuelve el texto del razonamiento; con thinking.display en summarized recibes un resumen.
¿Qué cambia al migrar desde Haiku 4.5?
Lo principal: el ID del modelo pasa a ser claude-haiku-5-5 (sin sufijo de fecha); un presupuesto de razonamiento (budget_tokens) devuelve ahora un 400, así que usa razonamiento adaptativo con effort; elimina temperature, top_p y top_k (top_k, o un temperature o top_p distinto del valor por defecto, devuelve un 400); ya no se acepta el prefill del asistente, así que usa salidas estructuradas o indica el formato en el prompt de sistema; una respuesta puede empezar con bloques de razonamiento, así que elige los bloques de texto por su type y no por su posición; el mismo texto cuenta más tokens, así que revisa max_tokens y tus estimaciones de coste; el uso de ordenador pasa al conjunto computer_toolset_20260801; y gestiona stop_reason refusal, porque los clasificadores de seguridad pueden rechazar una petición.
¿Cuándo podré llamar a Claude Haiku 5.5 aquí?
Lo estamos integrando y probando. En cuanto se pueda llamar de forma estable, esta página pasará a disponible y mostrará el precio. Déjanos tu correo y te escribiremos ese mismo día.
¿Cómo se llamará y funciona con Claude Code?
Funcionarán las dos API: la compatible con OpenAI (/v1/chat/completions) y la API nativa Anthropic Messages (/anthropic), con el modelo claude-haiku-5-5. Claude Code envía muchas tareas pequeñas en segundo plano a su modelo Haiku; cuando Haiku 5.5 esté disponible, configura claude-haiku-5-5 como modelo Haiku de Claude Code. La página de Claude Code de nuestra documentación explica cómo.
¿Hay algún modelo Claude que pueda usar ya?
Sí. Claude Sonnet 5.5, Claude Opus 5.5 y Claude Sonnet 5 ya están disponibles y se pueden llamar ahora mismo. Si mientras tanto buscas un modelo pequeño, barato y rápido, también tienes Gemini 3.8 Flash, DeepSeek V4.1 Flash y GPT-6 Luna.

Disponibles ya

Estos modelos ya se pueden usar en NezhaGate:

Ver todo →