Loading...
Loading...
Livello premium di Nano Banana basato su gemini-3-pro-image: testo-immagine e modifica, con testo leggibile nell'immagine e output fino a 4K.
Accedi per eseguire i modelli
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'google/nano-banana-pro/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)Nano Banana Pro è il nome commerciale che Google dà a gemini-3-pro-image, il gradino più alto della sua famiglia di modelli per immagini. Facciamo girare il suo endpoint di generazione come google/nano-banana-pro/text-to-image — entra soltanto un prompt — e applichiamo una tariffa di $0.075 per immagine a 1K e 2K, con il 4K fatturato a $0.15. fal.ai chiede il doppio per la request identica.
Ha già un'immagine che preferirebbe alterare invece che ricreare? Nano Banana Pro edit-image è lo stesso modello allo stesso prezzo, con un campo image_urls per le Sue reference.
Dove si collocava il nostro numero alla verifica del 26 agosto 2026:
| Provider API | Prezzo (1K/2K) | Prezzo (4K) | vs. E2X |
|---|---|---|---|
| E2X | $0.075 | $0.15 | — |
| fal.ai | $0.15 | $0.30 | siamo il 50% più bassi |
| Google Gemini API | $0.134 | $0.24 | siamo il 44% più bassi |
I prezzi e le condizioni dei prodotti possono cambiare nel tempo. Verifichi i prezzi aggiornati di ciascun provider prima di prendere una decisione d'acquisto. Il prezzo Google Batch o Flex non è direttamente equivalente a una request API on-demand standard, perché le condizioni di pianificazione, disponibilità ed elaborazione sono diverse; è quindi escluso da questo confronto. Si tratta di un confronto circoscritto a uno scenario d'uso specifico, non dell'affermazione che E2X sia l'opzione più economica al mondo in ogni configurazione.
resolution è qui il nostro unico fattore di fatturazione. 1K e 2K costano gli stessi $0.075 — non c'è motivo di rendere a 1K a meno che la banda non conti per Lei — e il 4K raddoppia.
Generare dal nulla è un problema più difficile che modificare. Non c'è alcuna reference ad ancorare la composizione, quindi tutto quello che il modello azzecca deve uscire dal suo stesso ragionamento sulla Sua frase. Tre capability reggono quasi tutto il peso.
Tipografia che sopravvive. È il motivo per cui si pagano i prezzi di Pro. Il modello rende parole stilizzate e leggibili dentro l'inquadratura — titoli, listini prezzi, menu board, etichette di grafici, testi di packaging — in più lingue e a dimensioni in cui i modelli più economici producono ghirigori decorativi. Un poster con uno slogan vero sopra è una singola request, non una request più un'ora dentro uno strumento di design.
Grounding con Google Search. Il modello può consultare la ricerca in tempo reale mentre compone. Chieda un edificio specifico, una divisa specifica, un piatto impiattato come lo impiatta una cucina specifica, e ha un posto dove guardare oltre ai propri pregiudizi statistici. Conta molto di più nel text-to-image che nell'editing, dove la fotografia sorgente ha già risolto la questione di che aspetto abbia una cosa.
4K reale, fino a 4096×4096. Non un upscale attaccato dopo. Il nostro enum resolution è in minuscolo — 1k, 2k, 4k — e solo 4k cambia il prezzo.
C'è una quarta cosa che vale la pena sapere, perché compare nei Suoi grafici di latenza e non nelle fatture. Il modello ragiona per immagini prima di decidere, producendo lungo la strada delle "thought image" intermedie. Google non le restituisce, e noi non le fatturiamo. Metta in conto circa 30 secondi per request e il numero smette di sorprendere.
prompt è l'unico campo obbligatorio. Generi una API key nella dashboard, la tenga dietro il Suo backend e invii una POST al nostro endpoint di submit.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/nano-banana-pro/text-to-image",
"input": {
"prompt": "Un poster di viaggio vintage per le Isole Fær Øer. Aspetto serigrafato, quattro colori piatti, nebbia fitta sulle scogliere di basalto. Le parole VISIT FAROE composte in un sans serif condensato lungo il terzo inferiore.",
"aspect_ratio": "2:3",
"resolution": "2k"
}
}'
Riceve indietro un job ID. Faccia polling, oppure ci passi un webhookUrl nel body di submit e sarà avvisato da noi:
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submit = (input) =>
fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({ model: "google/nano-banana-pro/text-to-image", input }),
}).then((r) => r.json());
const { data } = await submit({
prompt:
"Infografica isometrica di una filiera del caffè, sei fasi etichettate, palette terrosa desaturata, tutte le etichette in portoghese e leggibili a piccole dimensioni.",
aspect_ratio: "16:9",
resolution: "4k",
});
let job;
do {
await new Promise((r) => setTimeout(r, 2500));
job = await fetch(`https://api.e2x.ai/v1/jobs/${data.jobId}`, { headers })
.then((r) => r.json());
} while (job.data.status === "pending" || job.data.status === "processing");
if (job.data.status !== "completed") throw new Error(job.data.error?.message);
console.log(job.data.outputs[0].url);
Due dettagli dello schema che colgono di sorpresa. Il nostro default di aspect_ratio è 9:16, quindi una request che omette il campo torna indietro verticale — lo imposti ogni volta. E l'enum è ampio: dieci rapporti, da 1:1 e 4:5 fino a 21:9, che coprono la maggior parte dei formati pubblicitari e social senza doverli ritagliare dopo. La specifica leggibile dalle macchine porta l'elenco aggiornato e il prezzo aggiornato.
Pro è il generatore più caro di questa famiglia, e a molto lavoro non serve:
| Modello | Prezzo / immagine | Da scegliere quando |
|---|---|---|
| Nano Banana Pro | $0.075 | Testo leggibile nell'immagine, grounding di ricerca o 4K |
| Nano Banana 2 | $0.04 | Qualità della generazione attuale a metà prezzo |
| Nano Banana 2 Lite | $0.0238 | Lavoro a volume a 1K, dove la velocità conta di più |
| Nano Banana (legacy) | $0.0312 | Una vecchia integrazione che non ha ancora spostato |
| GPT Image 2 | $0.0525 a qualità high / 1K | Vuole la resa di OpenAI, o sfondi trasparenti |
Parta da Nano Banana 2. Costa poco più della metà di Pro, rende bene il testo e, per scatti di prodotto, miniature e immagini editoriali, raramente riuscirà a dire quale tier ha prodotto il file. Salga a Pro quando le parole nell'immagine sono il deliverable — un menu, un'infografica, un asset di campagna bilingue — o quando un cliente ha bisogno di 4096 pixel sul lato lungo.
Una riga merita una seconda occhiata: Nano Banana 2 Lite costa meno del Nano Banana legacy ed è più recente di lui. Google stessa definisce l'originale il proprio modello legacy e raccomanda Lite come sostituto. Se sta ancora chiamando il vecchio slug, sono soldi lasciati sul tavolo.
GPT Image 2 è l'unico vero rivale sulla tipografia, e arriva con un'estetica diversa — più fredda, più letterale, e capace di restituire uno sfondo trasparente, cosa che nessun modello di immagini Gemini fa. Le opzioni restanti vivono nella categoria text-to-image, e tutto quello che facciamo girare sta nella pagina del catalogo modelli.
Metta fra virgolette la stringa che vuole. La racchiuda fra virgolette, la scriva esattamente e dica dove va — "le parole 'MARTEDÌ A METÀ PREZZO' in alto, sans condensato, bianco su rosso". Se descrive il testo il modello interpreta; se lo cita, il modello trascrive.
Fissi la tipografia prima della scena. I prompt che aprono con il layout e la tipografia, e poi descrivono le immagini attorno, tengono il proprio testo meglio dei prompt che seppelliscono le parole nell'ultima proposizione.
Poi lo lasci lavorare. Poiché questo modello ragiona prima di dipingere, un prompt con vincoli strutturali reali — conti gli elementi, nomini la palette, fissi l'ordine di lettura — viene usato davvero. Gli aggettivi vaghi vengono mediati.
Ogni immagine porta un watermark SynthID, il segnale di provenienza impercettibile di Google. Non esiste alcun parametro per spegnerlo da nessuna parte, qui compreso. Gli strumenti di rilevamento a valle lo vedranno, quindi se un contratto vieta deliverable con watermark, risolva prima quel punto.
Controlli le Sue assunzioni sull'aspect ratio se sta migrando una configurazione da un altro provider. Il nostro default è il verticale, non il quadrato, e una pipeline che dava per scontato 1:1 produrrà in silenzio file 9:16 finché qualcuno non se ne accorge.
È gemini-3-pro-image, il tier premium della famiglia Nano Banana di Google. Il tier è costruito per lavoro visivo esigente — tipografia leggibile dentro l'immagine, dettaglio ancorato alla ricerca, output fino a 4096×4096 — e non per il tempo di consegna più rapido possibile.
$0.075 per immagine a 1K e 2K, e $0.15 a 4K. È la metà della tariffa di fal.ai e il 44% sotto l'API di Google stessa, alla nostra verifica del 26 agosto 2026. I prezzi si muovono, quindi confermi sulla pagina del modello aggiornata prima di costruirci sopra un budget.
Sì, ed è il motivo principale per scegliere questo tier. Rende titoli, etichette e testi correnti stilizzati dentro l'immagine, in più lingue, a dimensioni in cui la maggior parte dei modelli di immagini fallisce. Metta la formulazione fra virgolette nel Suo prompt invece di parafrasarla.
Stesso modello, stessi $0.075, input diverso. Text-to-image prende solo un prompt. Edit-image prende in più un array image_urls di reference, che è ciò che serve quando un'immagine esistente va modificata invece che ricreata.
Circa 30 secondi. Il modello produce "thought image" intermedie mentre ragiona sulla composizione — Google non le restituisce e noi non le fatturiamo, ma è lì che se ne va il tempo. I modelli di fascia flash sono diverse volte più veloci, se per Lei la latenza conta più della qualità.
Sì. Ogni output include un watermark SynthID, il marcatore invisibile di Google per i contenuti generati dall'IA. Nessun provider espone un modo per disattivarlo, noi compresi.
Solo a volte. Nano Banana 2 costa $0.04 contro $0.075 e regge bene sulla maggior parte del lavoro fotografico e illustrativo. Paghi Pro quando l'immagine contiene testo che qualcuno leggerà davvero, quando Le serve accuratezza ancorata alla ricerca, o quando l'output deve essere in 4K.
Dieci: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9. Il nostro default è 9:16, quindi imposti il campo esplicitamente a meno che non voglia un output verticale.