Volver a Modelos

GPT Image 2

La familia GPT Image 2 de OpenAI para generar imágenes a partir de texto y editarlas con referencias mediante la OpenAI Images API.

Texto a imagendesde$0.0075Edición de imagendesde$0.0075
Preciosdesde $0.0075/solicitud
Latencia~60 segundos en promedio
Resolución1K/2K/4K
Ideal paraopenai, gpt-image-2, text-to-image

Parámetros

Costo Estimado

Ahorras 75% en este modelo
Costo base por request$0.03
Descuento-75%
Tu Total$0.0075
Ahorras $0.023 por solicitud

Inicia sesión para ejecutar modelos

Output Preview

Ready

No output yet

Run the model to see generated results.

Ejemplo de salida

Ejemplo de API— Parámetros Actuales

generate.py
import requests

result = requests.post(
    'https://api.e2x.ai/v1/jobs/submit',
    headers={
        'Authorization': f'Bearer {API_KEY}',
        'Content-Type': 'application/json'
    },
    json={
  'model': 'openai/gpt-image-2/text-to-image',
  'input': {}
}
)

Obtener trabajo— Consultar resultado

get_job.py
import time

job_id = result.json()['jobId']

while True:
    response = requests.get(
        f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
        headers={'Authorization': f'Bearer {'{API_KEY}'}'}
    )
    data = response.json()['data']

    if data['status'] == 'completed':
        print('Done!', data['outputs'][0]['url'])
        break
    elif data['status'] == 'failed':
        raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")

    time.sleep(2)
Explorar alternativas

Modelos relacionados

Descubre más modelos de IA para Texto a imagen

Ver todos los modelos

API text-to-image de GPT Image 2 en E2X

GPT Image 2 es el gpt-image-2-2026-04-21 de OpenAI, y es el modelo que le damos a la gente cuando las palabras dentro de la imagen tienen que estar bien. Lo exponemos como openai/gpt-image-2/text-to-image. Con resolution=1K, nuestro valor por defecto, cobramos $0.0525 por imagen sea cual sea el quality que envíe, frente a los $0.211 del request comparable de nivel alto en fal.ai.

¿Ya tiene una imagen que quiere cambiar en lugar de reemplazar? GPT Image 2 edit-image acepta referencias y un mask opcional: mismo modelo, misma tarifa.

Cómo funciona el precio en realidad

Esto no es una tarifa plana por imagen, y solo uno de los dos mandos mueve su factura.

La resolución es la palanca de verdad: 1K es ×1, 2K es ×2, 4K es ×3.

quality es un multiplicador ×7 en todos sus valores. low, medium, high y auto acaban en el mismo número, así que enviar quality: "low" compra una imagen peor por el mismo dinero. Es una peculiaridad de cómo nuestra configuración mapea el parámetro —lo sabemos— y hasta que lo arreglemos no hay ninguna razón para enviar otra cosa que high. La tarifa base de $0.0075 que quizá haya visto citada se aplica únicamente a un request que no lleve ningún campo quality. Es el coeficiente del que parte nuestro motor de precios, no el precio de una imagen terminada.

Lo que se le factura en realidad, comprobado el 26 de agosto de 2026:

Tamaño de salidaE2X, cualquier valor de qualityfal.ai (high)vs. E2X
1024×1024 (1K, nuestro valor por defecto)$0.0525$0.211somos un 75% más baratos
2560×1440 (2K)$0.105$0.222somos un 53% más baratos
3840×2160 (4K)$0.1575$0.401somos un 61% más baratos

Mire la forma de esa tabla antes de comprometer un presupuesto. fal apenas cobra más por 2K que por 1K —$0.211 frente a $0.222— mientras que nuestro precio se duplica. Nuestra ventaja es máxima en 1K y se estrecha según sube.

OpenAI no puede entrar en la tabla: factura por tokens, así que no existe una cifra oficial por imagen, y cualquier número que vea en otro sitio es la salida de la calculadora de alguien. Ponemos fecha a nuestras filas porque las volvemos a comprobar.

Los precios y las condiciones de los productos pueden cambiar con el tiempo; consulte los precios vigentes de cada proveedor antes de tomar una decisión de compra. Los precios de Google Batch o Flex no son directamente equivalentes a un request estándar de API bajo demanda, porque la programación, la disponibilidad y las condiciones de procesamiento son distintas; por eso quedan excluidos de esta comparación. Se trata de una comparación acotada, no de una afirmación de que E2X sea la opción más barata del mundo en cualquier configuración.

El texto legible es la razón para elegir este modelo

La mayoría de los modelos de imagen siguen convirtiendo el cuerpo de texto en garabatos decorativos que parecen letras desde tres metros. Este no, y esa única capability es la razón por la que ocupa un nivel premium en nuestro catálogo. Lo que aguanta:

  • Párrafos densos en cuerpos pequeños: texto corrido que sobrevive a un zoom, notas al pie, la línea legal al fondo de un póster.
  • Salida multilingüe, incluido CJK junto al alfabeto latino en una misma composición.
  • Maquetaciones estructuradas: infografías, tablas comparativas, diapositivas de marketing donde tipografía y gráficos tienen que concordar.
  • Etiquetas de producto y packaging, donde un nombre de marca mal escrito se carga el asset entero.

Con él llegan dos cosas más. La resolución alcanza 4K, un salto real respecto al techo de 1536px de GPT Image 1, y background: "transparent" le da un recorte sin pasada de matte: solo PNG o WebP, ya que JPEG no tiene canal alfa.

El modelo funciona sobre razonamiento de la serie O: planifica la composición y se autocomprueba antes de renderizar. Primero la calidad. Por eso es más lento que un modelo de nivel flash, y por eso publicamos aquí un ETA de 60 segundos en lugar de prometerle tres.

Request de API: entra el prompt, sale la imagen

Cree una key en su dashboard y manténgala en su servidor. prompt es el único campo obligatorio.

curl -X POST https://api.e2x.ai/v1/jobs/submit \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-image-2/text-to-image",
    "input": {
      "prompt": "Cartel de búsqueda de personal para una panadería costera. El titular dice FLOUR & SALT en una sans condensada. Debajo, cuatro líneas de texto a 9 pt con los puestos abiertos. Textura de papel cálido, una sola tinta.",
      "aspect_ratio": "2:3",
      "resolution": "2K",
      "quality": "high"
    }
  }'

Devolvemos un job ID. Haga polling, o envíe un webhookUrl y sáltese el bucle.

const headers = {
  Authorization: `Bearer ${process.env.E2X_API_KEY}`,
  "Content-Type": "application/json",
};

const submitted = await fetch("https://api.e2x.ai/v1/jobs/submit", {
  method: "POST",
  headers,
  body: JSON.stringify({
    model: "openai/gpt-image-2/text-to-image",
    input: {
      prompt: "Captura cuadrada para la app store. Mockup del dispositivo sobre un fondo verde menta. Barra de subtítulo abajo en japonés e inglés, ambos perfectamente legibles.",
      aspect_ratio: "1:1",
      resolution: "1K",
      quality: "high",
      background: "transparent",
    },
  }),
}).then((r) => r.json());

const jobId = submitted.data.jobId;

while (true) {
  const job = await fetch(`https://api.e2x.ai/v1/jobs/${jobId}`, { headers })
    .then((r) => r.json());
  if (job.data.status === "completed") {
    console.log(job.data.outputs[0].url);
    break;
  }
  if (job.data.status === "failed") {
    throw new Error(job.data.error?.message || "Generation failed");
  }
  await new Promise((r) => setTimeout(r, 3000));
}

El status recorre pending → processing → completed, o se detiene en failed o cancelled. Cuidado con las mayúsculas: los valores de resolution van en mayúscula, 1K, 2K, 4K. Nuestro valor por defecto de aspect ratio es 1:1, y el enum es amplio, de 21:9 hasta 1:3. La especificación legible por máquina lleva el schema y el precio actuales.

Cómo elegir entre nuestros modelos de text-to-image

Cinco generadores en esta categoría, y GPT Image 2 es el caro. A veces eso es lo correcto. A menudo no.

ModeloPrecio / imagenElíjalo cuando
GPT Image 2$0.0525 (high/1K)Texto legible, packaging, 4K, transparencia
Nano Banana Pro$0.075Realismo de retrato, varias referencias mantenidas consistentes
Nano Banana 2$0.04Calidad de la generación actual a un precio de trabajo
Nano Banana 2 Lite$0.0238Volumen, velocidad, escenas simples
Nano Banana (legacy)$0.0312Una integración antigua que aún no ha migrado

La diferencia es estrecha, pero real. Si la tipografía tiene que leerse, venga aquí. Para caras, o para un personaje mantenido consistente a lo largo de varias referencias, Nano Banana Pro es más fuerte y con gusto nos quedaremos con su dinero allí. Para una imagen principal o un fondo, Nano Banana 2 hace el trabajo a tres cuartas partes de nuestra tarifa y termina antes.

Una más, ya que preferimos decirla a que la descubra por su cuenta: Nano Banana 2 Lite es más barato y más nuevo que el Nano Banana legacy. ¿Sigue en el slug antiguo? Migrar es dinero gratis. El resto está en la categoría text-to-image y en el catálogo de modelos.

Cómo escribir prompts para un modelo que piensa antes de dibujar

La pasada de razonamiento premia la especificación y castiga la vaguedad. Cite su texto exactamente y diga dónde va: «el titular dice 'FLOUR & SALT', centrado, en el tercio superior» consigue esa cadena, mientras que «un póster de panadería con algo de texto» consigue un disparate plausible en una tipografía bonita. Describa la maquetación como maquetación: banda superior, columna izquierda, filete de pie. El planificador respeta un brief espacial.

Ajuste la transparencia con background: "transparent", no con una frase. Tres reglas de tamaño de OpenAI que conviene conocer antes de un rechazo: ambos lados múltiplos de 16, el lado más largo por debajo de 3840px, y un aspect ratio no más ancho que 3:1.

Qué comprobar antes de poner nada en producción

Cada imagen de este modelo lleva dos capas de procedencia, y ninguna es opcional en ningún nivel de calidad.

Primero, metadatos C2PA que identifican la salida como generada por ChatGPT Images: X, Meta, LinkedIn y TikTok los leen y adjuntan una etiqueta «Made with AI» al subirla. Segundo, un watermark de píxel imperceptible más reciente dentro de los propios datos de la imagen, que sobrevive al borrado de metadatos que la gente intenta primero.

No podemos eliminar ninguna de las dos, y tampoco puede nadie más que revenda este modelo. No ofrecemos salida white-label en GPT Image 2. Si un contrato con un cliente prohíbe assets etiquetados como IA, resuélvalo antes de construir aquí.

Y la trampa de presupuesto, una vez más: quality no es un dial de coste. Bajar a low para las pasadas de borrador es una costumbre traída de otras plataformas; aquí quema los mismos $0.0525 mientras degrada exactamente el renderizado de texto por el que vino. Controle el gasto con resolution: haga borradores en 1K y publique en 2K o 4K.

Preguntas frecuentes

¿Qué es GPT Image 2?

El modelo de generación de imágenes de OpenAI, snapshot gpt-image-2-2026-04-21, lanzado el 21 de abril de 2026 como sucesor de GPT Image 1.5. Usa razonamiento de la serie O para planificar una composición antes de renderizarla, y su capability destacada es el texto preciso dentro de la imagen, en tamaños pequeños y en varios idiomas.

¿Cuánto cuesta GPT Image 2 text-to-image en E2X?

$0.0525 por imagen con nuestros valores por defecto, quality=high y resolution=1K. 2K lo duplica a $0.105 y 4K lo triplica a $0.1575. Esas eran nuestras tarifas en la comprobación del 26 de agosto de 2026.

¿Por qué no debería tomar $0.0075 como el precio de una imagen?

Porque $0.0075 es nuestra tarifa base sin multiplicar, y solo se aplica a un request que no lleve ningún campo quality. Cualquier valor de quality la multiplica por siete, y la resolución vuelve a multiplicar por encima. Presupueste con la configuración que realmente está enviando, o su modelo de costes se irá por un factor de siete.

¿Enviar un ajuste de calidad más bajo reduce lo que pago?

No. Nuestro multiplicador es ×7 tanto para low como para medium, high y auto, así que todos ellos facturan $0.0525 en 1K. Enviar low cuesta lo mismo y devuelve menos. La resolución es el parámetro que de verdad cambia su factura.

¿Es E2X más barato que fal.ai para GPT Image 2?

En todas las resoluciones que comprobamos, sí. En 1024×1024 son $0.0525 con nosotros frente a $0.211 allí, un 75% menos; en 2K, $0.105 frente a $0.222, un 53% menos; en 4K, $0.1575 frente a $0.401, un 61% menos. OpenAI factura por token en lugar de por imagen, así que no hay un precio de lista oficial con el que comparar directamente.

¿Las imágenes generadas llevan watermark?

Sí, de dos formas: metadatos C2PA que las plataformas sociales leen para aplicar etiquetas «Made with AI», más un watermark de píxel imperceptible incrustado en los datos de la imagen. Ambos están presentes en todos los niveles de calidad, y ningún proveedor —nosotros incluidos— puede desactivarlos.

¿Debería usar GPT Image 2 o Nano Banana Pro?

Elija GPT Image 2 cuando la imagen contenga texto que una persona vaya a leer: packaging, infografías, UI, pósteres. Elija Nano Banana Pro cuando necesite realismo de retrato o un personaje consistente a lo largo de varias imágenes de referencia. Cuestan aproximadamente lo mismo en 1K, así que elija por fortaleza, no por presupuesto.