NezhaGateNezhaGate
Chat

Claude Sonnet 5

⧉
claude-sonnet-5

Claude Sonnet 5 es el Sonnet de nueva generación de Anthropic: la velocidad y el precio de la gama Sonnet, con programación y trabajo de agentes cercanos a Opus. El razonamiento adaptativo viene activado por defecto y cinco niveles de esfuerzo (de low a max) permiten elegir entre profundidad y velocidad. Admite comprensión de imágenes, uso de herramientas y caché de prompts. Totalmente compatible con la API de OpenAI: indica model como claude-sonnet-5; o usa la API nativa de mensajes de Anthropic para conectar Claude Code directamente.

ChatCódigoAgentesComprensión de imágenesCaché de prompts

Prueba en directo

Prueba Claude Sonnet 5 aquí mismo (disponible tras iniciar sesión).

Entrada

Avanzado
Búsqueda web
Memoria · multiturno
Razonamiento

Conversación

Empieza una conversaciónEscribe un mensaje abajo para empezar

Acerca de Claude Sonnet 5

Claude Sonnet 5 es el modelo más reciente de la línea Sonnet de Anthropic: el Sonnet de la generación Claude 5. Mantiene la velocidad y el precio de la gama Sonnet y lleva la programación y el trabajo de agentes a una calidad cercana a Opus. El razonamiento adaptativo viene activado por defecto: el modelo decide cuánto razonar, responde directamente a las peticiones sencillas y piensa primero las difíciles; además, cinco niveles de esfuerzo (low / medium / high / xhigh / max) permiten elegir entre profundidad y velocidad. Admite entrada de imágenes, uso de herramientas y caché de prompts. NezhaGate lo ofrece de dos formas: el endpoint compatible con OpenAI (apunta base_url a NezhaGate, indica model como claude-sonnet-5 y reutiliza tu SDK de OpenAI sin cambios) y la API nativa de mensajes de Anthropic (apunta ANTHROPIC_BASE_URL al /anthropic de NezhaGate para que Claude Code se conecte directamente, con thinking, tool_use y caché de prompts intactos). Se factura por uso y las peticiones fallidas no se cobran.

Casos de uso

Programación y agentes del día a día

Escribe, refactoriza y depura código, y ejecuta bucles de agentes de varios pasos con llamadas a herramientas: una buena opción por defecto para asistentes de programación y bots que hacen muchas llamadas al día.

Tráfico de producción a gran volumen

Respuestas de soporte, extracción, resúmenes y clasificación a escala, cuando quieres una calidad cercana a Opus sin pagar tarifas de Opus.

Documentos largos y bases de código

Resume, extrae información y responde preguntas sobre contratos, artículos, manuales y repositorios; la caché de prompts abarata mucho las preguntas repetidas sobre el mismo material.

Razonamiento a demanda

Deja el esfuerzo en low para el chat rápido y súbelo a high o xhigh para bugs difíciles y planificación; el precio por token es el mismo en todos los niveles.

Tareas con texto e imágenes

Lee capturas de pantalla, gráficos y maquetas de diseño y responde con análisis o código; acepta tanto base64 como URL de imágenes remotas.

Cómo elegir

Usa Claude Sonnet 5 como tu Claude por defecto para la mayoría del trabajo: es más rápido y más barato que Claude Opus 5 y se le acerca en programación y tareas de agentes. Sube a Claude Opus 5 para el razonamiento más difícil y los proyectos de código más grandes, o cambia a Claude Fable 5 para narrativa y textos largos; mantén Claude Sonnet 4.6 en los flujos que ya estén ajustados para él. Todos se cambian con un solo campo model en el mismo endpoint.

Preguntas frecuentes

¿Qué es Claude Sonnet 5?
Claude Sonnet 5 es el modelo Sonnet más reciente de Anthropic, de la generación Claude 5. Busca una calidad cercana a Opus en programación y agentes con la velocidad y el precio de Sonnet, con razonamiento adaptativo activado por defecto, entrada de imágenes, uso de herramientas y caché de prompts. En NezhaGate puedes llamarlo por la API compatible con OpenAI o por la API nativa de mensajes de Anthropic.
¿En qué se diferencia de Claude Sonnet 4.6?
Es una generación más nueva: más fuerte en programación y agentes, con razonamiento adaptativo activado por defecto (Sonnet 4.6 solo razona si se lo pides), un nivel de esfuerzo más (xhigh) y comprensión de imágenes de mayor resolución. El precio de lista de Anthropic también es menor: $2 / $10 por millón de tokens de entrada / salida, frente a $3 / $15. Al comparar facturas, ten en cuenta que Sonnet 5 usa un tokenizador nuevo que cuenta aproximadamente un 30 % más de tokens para el mismo texto, así que compara el coste de una tarea terminada y no la tarifa por token.
¿Por qué se ignora mi temperature?
Anthropic ya no acepta temperature / top_p / top_k en esta generación. Para que el código existente con el SDK de OpenAI siga funcionando sin cambios, la pasarela elimina esos tres parámetros antes de reenviar la petición: la llamada se completa, no se produce ningún error y el muestreo usa los valores por defecto del modelo. Para orientar la salida, usa reasoning_effort (low / medium / high / xhigh / max): todos los niveles cuestan lo mismo por token; razonar más solo genera más tokens.
¿Puedo desactivar el razonamiento?
Sí. En la API nativa de mensajes de Anthropic, envía thinking: {"type": "disabled"} y el modelo responderá directamente, que es lo más rápido y barato. En el endpoint compatible con OpenAI, reasoning_effort: low consigue un efecto parecido. Siempre que el modelo razona, los tokens de razonamiento se facturan como salida.
¿Puede Claude Code conectarse directamente?
Sí. Apunta ANTHROPIC_BASE_URL al /anthropic de NezhaGate, usa tu clave de la pasarela como x-api-key e indica model como claude-sonnet-5. Thinking, tool_use, la caché de prompts y el streaming SSE pasan sin cambios.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →