Loading...
Loading...
La familia GPT Image 2 de OpenAI para generar imágenes a partir de texto y editarlas con referencias mediante la OpenAI Images API.
Inicia sesión para ejecutar modelos
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'openai/gpt-image-2/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)GPT Image 2 es el gpt-image-2-2026-04-21 de OpenAI, y es el modelo que le damos a la gente cuando las palabras dentro de la imagen tienen que estar bien. Lo exponemos como openai/gpt-image-2/text-to-image. Con resolution=1K, nuestro valor por defecto, cobramos $0.0525 por imagen sea cual sea el quality que envíe, frente a los $0.211 del request comparable de nivel alto en fal.ai.
¿Ya tiene una imagen que quiere cambiar en lugar de reemplazar? GPT Image 2 edit-image acepta referencias y un mask opcional: mismo modelo, misma tarifa.
Esto no es una tarifa plana por imagen, y solo uno de los dos mandos mueve su factura.
La resolución es la palanca de verdad: 1K es ×1, 2K es ×2, 4K es ×3.
quality es un multiplicador ×7 en todos sus valores. low, medium, high y auto acaban en el mismo número, así que enviar quality: "low" compra una imagen peor por el mismo dinero. Es una peculiaridad de cómo nuestra configuración mapea el parámetro —lo sabemos— y hasta que lo arreglemos no hay ninguna razón para enviar otra cosa que high. La tarifa base de $0.0075 que quizá haya visto citada se aplica únicamente a un request que no lleve ningún campo quality. Es el coeficiente del que parte nuestro motor de precios, no el precio de una imagen terminada.
Lo que se le factura en realidad, comprobado el 26 de agosto de 2026:
| Tamaño de salida | E2X, cualquier valor de quality | fal.ai (high) | vs. E2X |
|---|---|---|---|
| 1024×1024 (1K, nuestro valor por defecto) | $0.0525 | $0.211 | somos un 75% más baratos |
| 2560×1440 (2K) | $0.105 | $0.222 | somos un 53% más baratos |
| 3840×2160 (4K) | $0.1575 | $0.401 | somos un 61% más baratos |
Mire la forma de esa tabla antes de comprometer un presupuesto. fal apenas cobra más por 2K que por 1K —$0.211 frente a $0.222— mientras que nuestro precio se duplica. Nuestra ventaja es máxima en 1K y se estrecha según sube.
OpenAI no puede entrar en la tabla: factura por tokens, así que no existe una cifra oficial por imagen, y cualquier número que vea en otro sitio es la salida de la calculadora de alguien. Ponemos fecha a nuestras filas porque las volvemos a comprobar.
Los precios y las condiciones de los productos pueden cambiar con el tiempo; consulte los precios vigentes de cada proveedor antes de tomar una decisión de compra. Los precios de Google Batch o Flex no son directamente equivalentes a un request estándar de API bajo demanda, porque la programación, la disponibilidad y las condiciones de procesamiento son distintas; por eso quedan excluidos de esta comparación. Se trata de una comparación acotada, no de una afirmación de que E2X sea la opción más barata del mundo en cualquier configuración.
La mayoría de los modelos de imagen siguen convirtiendo el cuerpo de texto en garabatos decorativos que parecen letras desde tres metros. Este no, y esa única capability es la razón por la que ocupa un nivel premium en nuestro catálogo. Lo que aguanta:
Con él llegan dos cosas más. La resolución alcanza 4K, un salto real respecto al techo de 1536px de GPT Image 1, y background: "transparent" le da un recorte sin pasada de matte: solo PNG o WebP, ya que JPEG no tiene canal alfa.
El modelo funciona sobre razonamiento de la serie O: planifica la composición y se autocomprueba antes de renderizar. Primero la calidad. Por eso es más lento que un modelo de nivel flash, y por eso publicamos aquí un ETA de 60 segundos en lugar de prometerle tres.
Cree una key en su dashboard y manténgala en su servidor. prompt es el único campo obligatorio.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2/text-to-image",
"input": {
"prompt": "Cartel de búsqueda de personal para una panadería costera. El titular dice FLOUR & SALT en una sans condensada. Debajo, cuatro líneas de texto a 9 pt con los puestos abiertos. Textura de papel cálido, una sola tinta.",
"aspect_ratio": "2:3",
"resolution": "2K",
"quality": "high"
}
}'
Devolvemos un job ID. Haga polling, o envíe un webhookUrl y sáltese el bucle.
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submitted = await fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({
model: "openai/gpt-image-2/text-to-image",
input: {
prompt: "Captura cuadrada para la app store. Mockup del dispositivo sobre un fondo verde menta. Barra de subtítulo abajo en japonés e inglés, ambos perfectamente legibles.",
aspect_ratio: "1:1",
resolution: "1K",
quality: "high",
background: "transparent",
},
}),
}).then((r) => r.json());
const jobId = submitted.data.jobId;
while (true) {
const job = await fetch(`https://api.e2x.ai/v1/jobs/${jobId}`, { headers })
.then((r) => r.json());
if (job.data.status === "completed") {
console.log(job.data.outputs[0].url);
break;
}
if (job.data.status === "failed") {
throw new Error(job.data.error?.message || "Generation failed");
}
await new Promise((r) => setTimeout(r, 3000));
}
El status recorre pending → processing → completed, o se detiene en failed o cancelled. Cuidado con las mayúsculas: los valores de resolution van en mayúscula, 1K, 2K, 4K. Nuestro valor por defecto de aspect ratio es 1:1, y el enum es amplio, de 21:9 hasta 1:3. La especificación legible por máquina lleva el schema y el precio actuales.
Cinco generadores en esta categoría, y GPT Image 2 es el caro. A veces eso es lo correcto. A menudo no.
| Modelo | Precio / imagen | Elíjalo cuando |
|---|---|---|
| GPT Image 2 | $0.0525 (high/1K) | Texto legible, packaging, 4K, transparencia |
| Nano Banana Pro | $0.075 | Realismo de retrato, varias referencias mantenidas consistentes |
| Nano Banana 2 | $0.04 | Calidad de la generación actual a un precio de trabajo |
| Nano Banana 2 Lite | $0.0238 | Volumen, velocidad, escenas simples |
| Nano Banana (legacy) | $0.0312 | Una integración antigua que aún no ha migrado |
La diferencia es estrecha, pero real. Si la tipografía tiene que leerse, venga aquí. Para caras, o para un personaje mantenido consistente a lo largo de varias referencias, Nano Banana Pro es más fuerte y con gusto nos quedaremos con su dinero allí. Para una imagen principal o un fondo, Nano Banana 2 hace el trabajo a tres cuartas partes de nuestra tarifa y termina antes.
Una más, ya que preferimos decirla a que la descubra por su cuenta: Nano Banana 2 Lite es más barato y más nuevo que el Nano Banana legacy. ¿Sigue en el slug antiguo? Migrar es dinero gratis. El resto está en la categoría text-to-image y en el catálogo de modelos.
La pasada de razonamiento premia la especificación y castiga la vaguedad. Cite su texto exactamente y diga dónde va: «el titular dice 'FLOUR & SALT', centrado, en el tercio superior» consigue esa cadena, mientras que «un póster de panadería con algo de texto» consigue un disparate plausible en una tipografía bonita. Describa la maquetación como maquetación: banda superior, columna izquierda, filete de pie. El planificador respeta un brief espacial.
Ajuste la transparencia con background: "transparent", no con una frase. Tres reglas de tamaño de OpenAI que conviene conocer antes de un rechazo: ambos lados múltiplos de 16, el lado más largo por debajo de 3840px, y un aspect ratio no más ancho que 3:1.
Cada imagen de este modelo lleva dos capas de procedencia, y ninguna es opcional en ningún nivel de calidad.
Primero, metadatos C2PA que identifican la salida como generada por ChatGPT Images: X, Meta, LinkedIn y TikTok los leen y adjuntan una etiqueta «Made with AI» al subirla. Segundo, un watermark de píxel imperceptible más reciente dentro de los propios datos de la imagen, que sobrevive al borrado de metadatos que la gente intenta primero.
No podemos eliminar ninguna de las dos, y tampoco puede nadie más que revenda este modelo. No ofrecemos salida white-label en GPT Image 2. Si un contrato con un cliente prohíbe assets etiquetados como IA, resuélvalo antes de construir aquí.
Y la trampa de presupuesto, una vez más: quality no es un dial de coste. Bajar a low para las pasadas de borrador es una costumbre traída de otras plataformas; aquí quema los mismos $0.0525 mientras degrada exactamente el renderizado de texto por el que vino. Controle el gasto con resolution: haga borradores en 1K y publique en 2K o 4K.
El modelo de generación de imágenes de OpenAI, snapshot gpt-image-2-2026-04-21, lanzado el 21 de abril de 2026 como sucesor de GPT Image 1.5. Usa razonamiento de la serie O para planificar una composición antes de renderizarla, y su capability destacada es el texto preciso dentro de la imagen, en tamaños pequeños y en varios idiomas.
$0.0525 por imagen con nuestros valores por defecto, quality=high y resolution=1K. 2K lo duplica a $0.105 y 4K lo triplica a $0.1575. Esas eran nuestras tarifas en la comprobación del 26 de agosto de 2026.
Porque $0.0075 es nuestra tarifa base sin multiplicar, y solo se aplica a un request que no lleve ningún campo quality. Cualquier valor de quality la multiplica por siete, y la resolución vuelve a multiplicar por encima. Presupueste con la configuración que realmente está enviando, o su modelo de costes se irá por un factor de siete.
No. Nuestro multiplicador es ×7 tanto para low como para medium, high y auto, así que todos ellos facturan $0.0525 en 1K. Enviar low cuesta lo mismo y devuelve menos. La resolución es el parámetro que de verdad cambia su factura.
En todas las resoluciones que comprobamos, sí. En 1024×1024 son $0.0525 con nosotros frente a $0.211 allí, un 75% menos; en 2K, $0.105 frente a $0.222, un 53% menos; en 4K, $0.1575 frente a $0.401, un 61% menos. OpenAI factura por token en lugar de por imagen, así que no hay un precio de lista oficial con el que comparar directamente.
Sí, de dos formas: metadatos C2PA que las plataformas sociales leen para aplicar etiquetas «Made with AI», más un watermark de píxel imperceptible incrustado en los datos de la imagen. Ambos están presentes en todos los niveles de calidad, y ningún proveedor —nosotros incluidos— puede desactivarlos.
Elija GPT Image 2 cuando la imagen contenga texto que una persona vaya a leer: packaging, infografías, UI, pósteres. Elija Nano Banana Pro cuando necesite realismo de retrato o un personaje consistente a lo largo de varias imágenes de referencia. Cuestan aproximadamente lo mismo en 1K, así que elija por fortaleza, no por presupuesto.