NezhaGateNezhaGate

Cómo se cobran el chat, las imágenes y el vídeo, cómo se liquidan las retenciones, cuándo no se cobra nada y cómo consultar el gasto, recargar y pedir reembolsos.

Créditos

Tu saldo se muestra en créditos: 1 dólar estadounidense = 200 créditos. Los precios de la página de precios y de la documentación están en dólares estadounidenses y se convierten a créditos con esa equivalencia al cobrarse. /v1/usage devuelve tanto el saldo en dólares como los créditos.

Cómo se cobra cada tipo de modelo

TipoSe cobra porNotas
ChatTokens: entrada y salida con precios separados (USD por millón de tokens)Los aciertos de caché se cobran al precio de lectura de caché, más bajo; los tokens de razonamiento, al precio de salida.
ImagenPor imagen, con precio según el nivel de resolución (1K / 2K / 4K)Pagas las imágenes realmente entregadas; las fallidas no se cobran.
VídeoCasi siempre por segundo (tarifa × duración); algunos modelos, por clipSi un modelo cobra por segundo o por clip se indica en la página de precios y en su documentación.

Precios de todos los modelos →

El chat en detalle

  • usage.prompt_tokens es la entrada y usage.completion_tokens la salida; los aciertos de caché se cobran aparte, al precio de lectura de caché.
  • En los modelos de razonamiento, los tokens de razonamiento cuentan como salida y se cobran al precio de salida, leas o no el razonamiento; la mayoría de los modelos indican cuántos fueron en usage.completion_tokens_details.reasoning_tokens.
  • Si un streaming se corta a medias, pagas el uso generado hasta que se cortó, no una respuesta completa.
  • La caché de prompts de Claude también tiene un precio de escritura en caché; los precios de lectura y de escritura de caché de cada modelo están en su documentación y en la página de precios.

Retención y liquidación

  • Antes de ejecutar una petición, se retiene de tu saldo un importe estimado. Si el saldo no alcanza, recibes 402 insufficient_quota y no se llama al modelo.
  • El chat se liquida según el uso real y devuelve el resto de la retención; las imágenes, según el número de imágenes entregadas; el vídeo, según la duración o el clip que pediste, igual que la retención.
  • Cuantas más peticiones se ejecutan a la vez, más se retiene. Con el saldo justo, una petición puede recibir 402 por las retenciones; se resuelve a medida que se liquidan las peticiones anteriores.

Los fallos no se cobran

Ninguna petición fallida se cobra, tanto si el proveedor falló, agotó el tiempo de espera o rechazó el contenido como si el error fue de la pasarela. Un trabajo asíncrono fallido devuelve automáticamente toda su retención, y el motivo queda en el registro de llamadas.

Cuando responde otro modelo

Si algún modelo de chat no está disponible por un momento, la pasarela puede hacer que responda otro modelo para que la petición no falle. En ese caso pagas el precio más bajo de los dos modelos, y el registro de llamadas indica qué modelo respondió y qué precio se aplicó.

Consultar tu gasto

  • Consola → Registros de llamadas: cada llamada de los últimos 60 días con el modelo, la duración, el uso y el cargo; las llamadas fallidas muestran el motivo.
  • Consola → Uso: totales por día, por modelo y por clave, con exportación a CSV.
  • Desde tu código: GET /v1/usage devuelve el saldo, el gasto total y el de hoy, y el uso por modelo; consulta la referencia de la API.

Recargas y reembolsos

Recarga en la página Facturación de la consola: desde ¥10 (260 créditos) con WeChat Pay, y desde $5 con USDT o tarjeta. Los créditos no caducan. Las bonificaciones por registro y por la primera recarga se explican en las preguntas frecuentes.

En los 7 días siguientes a una recarga, puedes pedir al soporte el reembolso de los créditos comprados que no hayas usado, con una comisión de $0.40 por reembolso; los créditos de bonificación no se reembolsan. Los pagos con USDT también se pueden reembolsar.