Loading...
Loading...
Niveau premium de Nano Banana basé sur gemini-3-pro-image : texte-image et retouche, avec du texte lisible dans l'image et une sortie jusqu'en 4K.
Connectez-vous pour exécuter des modèles
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'google/nano-banana-pro/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)Nano Banana Pro est le nom produit que Google donne à gemini-3-pro-image, le barreau le plus haut de sa famille image. Nous opérons son endpoint de génération sous google/nano-banana-pro/text-to-image — rien d'autre qu'un prompt en entrée — et nous facturons $0.075 par image en 1K et en 2K, la 4K étant facturée $0.15. fal.ai demande le double pour la requête identique.
Vous avez déjà une image que vous préférez modifier plutôt que remplacer ? Nano Banana Pro edit-image, c'est le même modèle au même prix, avec un champ image_urls pour vos références.
Où se situait notre chiffre lors de la vérification du 26 août 2026 :
| Provider API | Prix (1K/2K) | Prix (4K) | vs. E2X |
|---|---|---|---|
| E2X | $0.075 | $0.15 | — |
| fal.ai | $0.15 | $0.30 | nous sommes 50 % moins cher |
| Google Gemini API | $0.134 | $0.24 | nous sommes 44 % moins cher |
Les prix et les conditions produit peuvent changer. Vérifiez les tarifs en vigueur de chaque provider avant toute décision d'achat. La tarification Google Batch ou Flex n'est pas directement équivalente à une requête API on-demand standard, car les conditions de planification, de disponibilité et de traitement diffèrent ; elle est donc exclue de cette comparaison. Il s'agit d'une comparaison délimitée, et non d'une affirmation selon laquelle E2X serait l'option la moins chère au monde dans toutes les configurations.
resolution est ici notre unique facteur de facturation. La 1K et la 2K coûtent les mêmes $0.075 — il n'y a aucune raison de rendre en 1K sauf si la bande passante compte pour vous — et la 4K double la note.
Générer à partir de rien est un problème plus dur qu'éditer. Il n'y a aucune référence pour ancrer la composition : tout ce que le modèle réussit doit sortir de son propre raisonnement sur votre phrase. Trois capabilities portent l'essentiel du poids.
Une typographie qui survit. C'est la raison de payer un tarif Pro. Le modèle rend des mots stylisés et lisibles dans le cadre — titres, listes de prix, ardoises de menu, étiquettes de graphiques, textes de packaging — dans plusieurs langues, à des tailles où les modèles moins chers produisent des gribouillis décoratifs. Une affiche avec un vrai slogan dessus, c'est une seule requête, pas une requête plus une heure dans un outil de design.
Le grounding Google Search. Le modèle peut consulter la recherche en direct pendant qu'il compose. Demandez un bâtiment précis, un uniforme précis, un plat dressé comme une cuisine précise le dresse, et il a un endroit où regarder en dehors de ses propres a priori. Cela compte bien plus en text-to-image qu'en édition, où la photo source a déjà tranché la question de l'apparence des choses.
De la vraie 4K, jusqu'à 4096×4096. Pas un upscale rajouté après coup. Notre enum resolution est en minuscules — 1k, 2k, 4k — et seul 4k change le prix.
Il y a une quatrième chose à connaître, parce qu'elle apparaît dans vos graphes de latence plutôt que sur vos factures. Le modèle raisonne visuellement avant de s'engager, produisant en chemin des « thought images » intermédiaires. Google ne les renvoie pas, et nous ne les facturons pas. Budgétez environ 30 secondes par requête et le chiffre cesse d'être surprenant.
prompt est le seul champ obligatoire. Créez une API key dans le dashboard, gardez-la derrière votre propre backend, et postez sur notre endpoint de soumission.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/nano-banana-pro/text-to-image",
"input": {
"prompt": "Une affiche de voyage vintage pour les îles Féroé. Rendu sérigraphie, quatre aplats de couleur, brouillard épais sur des falaises de basalte. Les mots VISIT FAROE composés dans une sans serif condensée sur le tiers inférieur.",
"aspect_ratio": "2:3",
"resolution": "2k"
}
}'
Vous récupérez un job ID. Faites du polling, ou donnez-nous un webhookUrl dans le body de soumission et c'est nous qui vous notifierons :
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submit = (input) =>
fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({ model: "google/nano-banana-pro/text-to-image", input }),
}).then((r) => r.json());
const { data } = await submit({
prompt:
"Infographie isométrique d'une chaîne d'approvisionnement du café, six étapes annotées, palette de terres désaturée, toutes les légendes en portugais et lisibles en petite taille.",
aspect_ratio: "16:9",
resolution: "4k",
});
let job;
do {
await new Promise((r) => setTimeout(r, 2500));
job = await fetch(`https://api.e2x.ai/v1/jobs/${data.jobId}`, { headers })
.then((r) => r.json());
} while (job.data.status === "pending" || job.data.status === "processing");
if (job.data.status !== "completed") throw new Error(job.data.error?.message);
console.log(job.data.outputs[0].url);
Deux détails de schema qui piègent régulièrement. Notre valeur par défaut d'aspect_ratio est 9:16 : une requête qui omet le champ revient donc en portrait — réglez-le à chaque fois. Et l'enum est large : dix ratios, de 1:1 et 4:5 jusqu'à 21:9, ce qui couvre la plupart des formats publicitaires et sociaux sans recadrage a posteriori. La spécification lisible par machine porte la liste et le prix en vigueur.
Pro est le générateur le plus cher de cette famille, et beaucoup de travaux n'en ont pas besoin :
| Modèle | Prix / image | À choisir quand |
|---|---|---|
| Nano Banana Pro | $0.075 | Texte lisible dans l'image, search grounding, ou 4K |
| Nano Banana 2 | $0.04 | La qualité de la génération actuelle à la moitié du prix |
| Nano Banana 2 Lite | $0.0238 | Travail en volume en 1K, et la vitesse prime |
| Nano Banana (legacy) | $0.0312 | Une vieille intégration que vous n'avez pas encore déplacée |
| GPT Image 2 | $0.0525 en high / 1K | Vous voulez le rendu d'OpenAI, ou des fonds transparents |
Commencez par Nano Banana 2. Il coûte un peu plus de la moitié de Pro, il rend bien le texte, et pour des photos produit, des vignettes et de l'imagerie éditoriale vous serez rarement capable de dire quel palier a produit le fichier. Montez à Pro quand les mots dans l'image sont le livrable — un menu, une infographie, un asset de campagne bilingue — ou quand un client a besoin de 4096 pixels sur le grand côté.
Une ligne mérite un second regard : Nano Banana 2 Lite est moins cher que le Nano Banana legacy et plus récent que lui. Google lui-même qualifie l'original de modèle legacy et recommande Lite comme remplaçant. Si vous appelez encore l'ancien slug, c'est de l'argent gratuit laissé sur la table.
GPT Image 2 est le seul véritable rival sur la typographie, et il arrive avec un autre rendu — plus froid, plus littéral, et capable de renvoyer un fond transparent, ce qu'aucun modèle image Gemini ne fait. Les options restantes vivent dans la catégorie text-to-image, et tout ce que nous opérons est sur la page catalogue de modèles.
Citez la chaîne que vous voulez. Mettez-la entre guillemets, orthographiez-la exactement, et dites où elle va — « les mots "HALF PRICE TUESDAY" en haut, sans serif condensée, blanc sur rouge ». Décrivez le texte et le modèle interprète ; citez-le et le modèle transcrit.
Posez la typographie avant la scène. Les prompts qui ouvrent sur la mise en page et la typographie, puis décrivent l'imagerie autour, tiennent mieux leur texte que ceux qui enterrent la copie dans la dernière proposition.
Ensuite, laissez-le travailler. Comme ce modèle raisonne avant de peindre, un prompt avec de vraies contraintes structurelles — comptez les éléments, nommez la palette, fixez l'ordre de lecture — est réellement exploité. Les adjectifs vagues, eux, sont moyennés.
Chaque image porte un watermark SynthID, le signal de provenance imperceptible de Google. Il n'existe nulle part de paramètre pour l'éteindre, ici compris. Les outils de détection en aval le verront : si un contrat interdit les livrables watermarkés, réglez ce point d'abord.
Vérifiez vos hypothèses d'aspect ratio si vous migrez une config depuis un autre provider. Le portrait est notre valeur par défaut, pas le carré, et un pipeline qui supposait 1:1 produira silencieusement des fichiers 9:16 jusqu'à ce que quelqu'un s'en aperçoive.
C'est gemini-3-pro-image, le palier premium de la famille Nano Banana de Google. Ce palier est conçu pour du travail visuel exigeant — typographie lisible dans l'image, détail grounded par la recherche, sortie jusqu'à 4096×4096 — plutôt que pour le temps de traitement le plus court possible.
$0.075 par image en 1K et 2K, et $0.15 en 4K. C'est la moitié du tarif de fal.ai et 44 % sous l'API de Google elle-même, à la date de notre vérification du 26 août 2026. Les prix bougent : confirmez sur la page modèle en direct avant de bâtir un budget dessus.
Oui, et c'est la raison principale de choisir ce palier. Il rend des titres stylisés, des légendes et du texte courant à l'intérieur de l'image, dans plusieurs langues, à des tailles où la plupart des modèles image échouent. Mettez la formulation entre guillemets dans votre prompt au lieu de la paraphraser.
Même modèle, mêmes $0.075, entrée différente. Text-to-image ne prend qu'un prompt. Edit-image prend en plus un tableau image_urls de références, ce qu'il vous faut quand une image existante doit être modifiée plutôt que recréée.
Environ 30 secondes. Le modèle produit des « thought images » intermédiaires pendant qu'il raisonne sur la composition — Google ne les renvoie pas et nous ne les facturons pas, mais c'est là que part le temps. Les modèles du palier flash sont plusieurs fois plus rapides si la latence prime sur la qualité pour vous.
Oui. Chaque sortie contient un watermark SynthID, le marqueur invisible de Google pour les contenus générés par IA. Aucun provider n'expose de moyen de le désactiver, nous compris.
Seulement parfois. Nano Banana 2 coûte $0.04 contre $0.075 et tient bien la route sur la plupart des travaux photographiques et illustratifs. Payez Pro quand l'image contient du texte que quelqu'un lira vraiment, quand il vous faut une exactitude grounded par la recherche, ou quand la sortie doit être en 4K.
Dix : 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 et 21:9. Notre valeur par défaut est 9:16 : réglez donc le champ explicitement, sauf si vous voulez une sortie en portrait.