Loading...
Loading...
La famiglia GPT Image 2 di OpenAI per la generazione da testo e la modifica di immagini basata su riferimenti tramite le OpenAI Images API.
Accedi per eseguire i modelli
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'openai/gpt-image-2/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)GPT Image 2 è il gpt-image-2-2026-04-21 di OpenAI, ed è il modello che consegniamo quando le parole dentro l'immagine devono essere corrette. Lo esponiamo come openai/gpt-image-2/text-to-image. Con resolution=1K, il nostro default, applichiamo una tariffa di $0.0525 per immagine qualunque quality invii — contro i $0.211 della request comparabile di fascia alta su fal.ai.
Ha già un'immagine da modificare invece che da ricreare? GPT Image 2 edit-image accetta reference e una mask opzionale, stesso modello e stesso listino.
Non è un addebito fisso per immagine, e solo una delle due manopole muove il Suo conto.
La risoluzione è la leva vera: 1K è ×1, 2K è ×2, 4K è ×3.
La quality è un moltiplicatore ×7 a ogni impostazione. low, medium, high e auto finiscono tutte sullo stesso numero, quindi inviare quality: "low" compra un'immagine peggiore per gli stessi soldi. È una stranezza nel modo in cui la nostra configurazione mappa il parametro, perciò non c'è alcun motivo di inviare qualcosa di diverso da high. La tariffa base di $0.0075 che potrebbe vedere citata si applica soltanto a una request che non porta alcun campo quality. È il coefficiente da cui parte il nostro motore di pricing, non il prezzo di un'immagine finita.
Quello che Le viene effettivamente fatturato, verificato il 26 agosto 2026:
| Dimensione di output | E2X, qualsiasi valore di quality | fal.ai (high) | vs. E2X |
|---|---|---|---|
| 1024×1024 (1K, il nostro default) | $0.0525 | $0.211 | siamo il 75% più bassi |
| 2560×1440 (2K) | $0.105 | $0.222 | siamo il 53% più bassi |
| 3840×2160 (4K) | $0.1575 | $0.401 | siamo il 61% più bassi |
Guardi la forma di questa tabella prima di impegnare un budget. fal chiede a malapena qualcosa in più per il 2K rispetto al 1K — $0.211 contro $0.222 — mentre il nostro prezzo raddoppia. Il nostro vantaggio è massimo a 1K e si restringe salendo.
OpenAI stessa non può entrare nella tabella: fattura a token, quindi non esiste alcun dato ufficiale per immagine, e qualunque numero veda altrove è l'output della calcolatrice di qualcuno. Datiamo le nostre righe perché le ricontrolliamo.
I prezzi e le condizioni dei prodotti possono cambiare nel tempo. Verifichi i prezzi aggiornati di ciascun provider prima di prendere una decisione d'acquisto. Il prezzo Google Batch o Flex non è direttamente equivalente a una request API on-demand standard, perché le condizioni di pianificazione, disponibilità ed elaborazione sono diverse; è quindi escluso da questo confronto. Si tratta di un confronto circoscritto a uno scenario d'uso specifico, non dell'affermazione che E2X sia l'opzione più economica al mondo in ogni configurazione.
La maggior parte dei modelli di immagini trasforma ancora il testo corrente in ghirigori decorativi che sembrano lettere a tre metri di distanza. Questo no, e quella singola capability è il motivo per cui sta in un tier premium del nostro catalogo. Ecco cosa regge:
Insieme arrivano due cose. La risoluzione arriva al 4K, un salto reale rispetto al tetto di 1536px di GPT Image 1, e background: "transparent" Le dà un ritaglio senza un passaggio di scontorno — solo PNG o WebP, dato che il JPEG non ha canale alpha.
Il modello gira sul ragionamento della serie O, pianificando la composizione e autoverificandosi prima di rendere. Prima la qualità. È per questo che è più lento di un modello di fascia flash, ed è per questo che qui pubblichiamo un ETA di 60 secondi invece di prometterLe tre.
Crei una API key nella dashboard e la tenga lato server. prompt è l'unico campo obbligatorio.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2/text-to-image",
"input": {
"prompt": "Poster di reclutamento per una panetteria sulla costa. Il titolo recita FLOUR & SALT in un sans condensato. Sotto, quattro righe di testo corrente a 9pt che elencano le posizioni aperte. Texture di carta calda, un solo colore di inchiostro.",
"aspect_ratio": "2:3",
"resolution": "2K",
"quality": "high"
}
}'
Restituiamo un job ID. Faccia polling, oppure invii un webhookUrl e salti il loop.
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submitted = await fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({
model: "openai/gpt-image-2/text-to-image",
input: {
prompt: "Screenshot quadrato per l'app store. Mockup del dispositivo su un fondo verde menta. Barra di didascalia in basso in giapponese e inglese, entrambe perfettamente leggibili.",
aspect_ratio: "1:1",
resolution: "1K",
quality: "high",
background: "transparent",
},
}),
}).then((r) => r.json());
const jobId = submitted.data.jobId;
while (true) {
const job = await fetch(`https://api.e2x.ai/v1/jobs/${jobId}`, { headers })
.then((r) => r.json());
if (job.data.status === "completed") {
console.log(job.data.outputs[0].url);
break;
}
if (job.data.status === "failed") {
throw new Error(job.data.error?.message || "Generation failed");
}
await new Promise((r) => setTimeout(r, 3000));
}
Lo status cammina da pending → processing → completed, oppure si arresta su failed o cancelled. Attenzione alle maiuscole — i valori di resolution sono in maiuscolo: 1K, 2K, 4K. Il nostro default di aspect ratio è 1:1, e l'enum è ampio, da 21:9 fino a 1:3. La specifica leggibile dalle macchine porta lo schema e il prezzo aggiornati.
Cinque generatori in questa categoria, e GPT Image 2 è quello costoso. A volte è la scelta giusta. Spesso non lo è.
| Modello | Prezzo / immagine | Da scegliere quando |
|---|---|---|
| GPT Image 2 | $0.0525 (high/1K) | Testo leggibile, packaging, 4K, trasparenza |
| Nano Banana Pro | $0.075 | Realismo dei ritratti, più reference tenute coerenti |
| Nano Banana 2 | $0.04 | Qualità della generazione attuale a un prezzo di lavoro |
| Nano Banana 2 Lite | $0.0238 | Volume, velocità, scene semplici |
| Nano Banana (legacy) | $0.0312 | Una vecchia integrazione che non ha migrato |
Lo spartiacque è stretto ma reale. Se la tipografia deve essere leggibile, venga qui. Per i volti, o per un personaggio tenuto coerente su più reference, Nano Banana Pro è più forte e saremo ben lieti di prendere i Suoi soldi da quella parte. Per un'immagine hero o uno sfondo, Nano Banana 2 fa il lavoro a tre quarti della nostra tariffa e finisce prima.
Un'ultima cosa, dato che preferiamo dirla piuttosto che fargliela scoprire: Nano Banana 2 Lite è più economico e più recente del Nano Banana legacy. È ancora sul vecchio slug? Migrare è denaro regalato. Il resto sta nella categoria text-to-image e nel catalogo modelli.
Il passaggio di ragionamento premia la specificità e punisce la vaghezza. Citi il Suo testo esattamente e dica dove va: "il titolo recita 'FLOUR & SALT', centrato, terzo superiore" ottiene quella stringa, mentre "un poster di panetteria con del testo" ottiene assurdità plausibili in un bel carattere. Descriva il layout come layout — fascia superiore, colonna sinistra, filetto di piede. Il pianificatore rispetta un brief spaziale.
Imposti la trasparenza con background: "transparent", non con una frase. Tre regole dimensionali di OpenAI, utili da conoscere prima di un rifiuto: entrambi i lati multipli di 16, lato più lungo sotto i 3840px, aspect ratio non più largo di 3:1.
Ogni immagine di questo modello porta due livelli di provenienza, e nessuno dei due è opzionale, a nessun tier di qualità.
Primo, metadati C2PA che identificano l'output come generato da ChatGPT Images — X, Meta, LinkedIn e TikTok li leggono e applicano un'etichetta "Made with AI" al caricamento. Secondo, un watermark impercettibile a livello di pixel più recente, dentro i dati dell'immagine stessa, che sopravvive alla rimozione dei metadati che di solito si tenta per prima.
Non possiamo rimuovere né l'uno né l'altro, e non può farlo nessun altro che rivenda questo modello. Su GPT Image 2 non offriamo output in white-label. Se un contratto con un cliente vieta asset etichettati come IA, risolva la questione prima di costruire qui.
E la trappola di budget, ancora una volta: quality non è una manopola di costo. Scendere a low per le bozze è un'abitudine presa da altre piattaforme; qui brucia gli stessi $0.0525 degradando esattamente il rendering del testo per cui è venuto. Controlli la spesa con resolution — faccia le bozze a 1K, vada in produzione a 2K o 4K.
Il modello di generazione di immagini di OpenAI, snapshot gpt-image-2-2026-04-21, rilasciato il 21 aprile 2026 come successore di GPT Image 1.5. Usa il ragionamento della serie O per pianificare una composizione prima di renderla, e la sua capability di spicco è il testo accurato dentro l'immagine a piccole dimensioni e in più lingue.
$0.0525 per immagine con i nostri default, quality=high e resolution=1K. Il 2K raddoppia a $0.105, il 4K triplica a $0.1575. Erano le nostre tariffe alla verifica del 26 agosto 2026.
Perché $0.0075 è la nostra tariffa base senza moltiplicatori e si applica soltanto a una request che non porta alcun campo quality. Qualsiasi valore di quality la moltiplica per sette, e la risoluzione moltiplica ancora sopra. Quoti la configurazione che sta davvero inviando, altrimenti il Suo modello di costo sbaglia di un fattore sette.
No. Il nostro moltiplicatore è ×7 sia per low, sia per medium, high e auto, quindi ognuno di essi fattura $0.0525 a 1K. Inviare low costa uguale e restituisce meno. La risoluzione è il parametro che cambia davvero il Suo conto.
A ogni risoluzione che abbiamo verificato, sì. A 1024×1024 sono $0.0525 da noi contro $0.211 da loro, il 75% in meno; a 2K, $0.105 contro $0.222, il 53% in meno; a 4K, $0.1575 contro $0.401, il 61% in meno. OpenAI stessa fattura a token invece che a immagine, quindi non esiste un prezzo di listino ufficiale con cui confrontarsi direttamente.
Sì, in due modi: metadati C2PA che le piattaforme social leggono per applicare le etichette "Made with AI", più un watermark impercettibile a livello di pixel incorporato nei dati dell'immagine. Entrambi sono presenti a ogni tier di qualità, e nessun provider — noi compresi — può disattivarli.
Scelga GPT Image 2 quando l'immagine contiene testo che una persona leggerà: packaging, infografiche, UI, poster. Scelga Nano Banana Pro quando Le serve realismo nei ritratti o un personaggio coerente su più reference image. A 1K costano più o meno uguale, quindi scelga in base al punto di forza, non al budget.