NezhaGateNezhaGate
Imagen ● Operativo Estado del servicio →

Grok Imagine Image

⧉
grok-imagine-image
Tipo de modelo StandardQuality

Grok Imagine Image es el modelo de generación de imágenes de xAI (nivel Standard). Un solo modelo genera desde texto y edita imágenes: en 1K suele tardar 5-10 segundos y en 2K unos 12, con rótulos en chino e inglés precisos. La edición admite varias imágenes de referencia y redibuja conservando el sujeto original. Compatible con la API de imágenes de OpenAI: pon model a grok-imagine-image. 1K y 2K cuestan lo mismo; se cobra por imagen y los trabajos fallidos se reembolsan por completo.

Texto a imagenEdición1K/2KRápido

Prueba en directo

Prueba Grok Imagine Image aquí mismo (disponible tras iniciar sesión).

Model Type

Entrada

Imagen

Salida

image
Los resultados aparecerán aquí al ejecutar.
🕑 Los resultados se conservan 60 días y después se eliminan automáticamente; descarga lo que quieras guardar.

Acerca de Grok Imagine Image

Grok Imagine Image es el modelo de generación de imágenes de xAI; NezhaGate ofrece el nivel Standard (grok-imagine-image) y el nivel Quality (grok-imagine-image-quality). Standard destaca por velocidad y precio unitario: en 1K suele tardar 5-10 segundos y en 2K unos 12, con rótulos en chino e inglés precisos, ideal para carteles, imágenes para redes y trabajos por lotes. La API es compatible con la de imágenes de OpenAI: texto a imagen va a /v1/images/generations y, para editar, pon las referencias en image o images (URL, data: URI o base64) o llama a /v1/images/edits. Al enviar recibes al instante un id de trabajo; consulta GET /v1/images/jobs/{id} para obtener la imagen. Siete proporciones (1:1, 3:4, 2:3, 9:16, 4:3, 3:2, 16:9) y dos resoluciones, 1K y 2K; no hay 4K. 1K y 2K cuestan lo mismo, se cobra por imagen y los trabajos fallidos se reembolsan por completo.

Casos de uso

Carteles y piezas de campaña

Titulares, eslóganes y precios en chino o inglés van directamente en el prompt y las imágenes llegan rápido, para iterar carteles y banners de producto.

Imágenes para redes y contenido

Portadas e imágenes para Xiaohongshu, WeChat, X y similares, generadas directamente en 3:4, 9:16, 16:9 y otras proporciones.

Edición de imágenes

Cambiar fondos o materiales, convertir un logotipo en un objeto físico: el sujeto original se mantiene y el resto se redibuja según el prompt; se pueden combinar varias referencias.

Generación por lotes

Precio unitario bajo y rapidez para flujos que generan muchos candidatos y eligen el mejor.

Cómo elegir

Elige Standard, grok-imagine-image, por velocidad, precio y trabajo por lotes; elige Quality, grok-imagine-image-quality, para portadas y carteles finales donde importan el detalle y el texto. Quality cuesta el doble que Standard, también con 1K y 2K al mismo precio. Para 4K, usa GPT Image 2 o los modelos Nano Banana.

Preguntas frecuentes

¿Qué proporciones y resoluciones admite?
Siete proporciones - 1:1, 3:4, 2:3, 9:16, 4:3, 3:2, 16:9 - en 1K o 2K (envía resolution: "2K" o un tamaño en píxeles de clase 2048); no hay 4K. La pasarela guía al modelo para componer en la proporción elegida y después recorta al tamaño exacto que pediste.
¿La edición cambia la proporción?
En el nivel Standard la edición conserva la proporción de la imagen original; si pides otra, la pasarela recorta al centro, así que se puede perder contenido de los bordes. Al editar, pon en size la misma proporción que el original o usa el nivel Quality, que genera en la proporción que elijas.
¿Cuántas imágenes de referencia puedo enviar?
Varias: una en image o varias en images (en nuestras pruebas se combinaron dos referencias en una sola imagen). Cada una puede ser una URL pública, una data: URI o base64.
¿Se cobra si falla la generación?
No. Las generaciones fallidas, los tiempos de espera y los rechazos de moderación se reembolsan por completo; solo pagas por imagen cuando se entrega.

Modelos relacionados

Descubre otros modelos que puedes integrar.

Ver todo →