Loading...
Loading...
La famille GPT Image 2 d'OpenAI pour la génération texte-image et la retouche à partir d'images de référence via l'API OpenAI Images.
Connectez-vous pour exécuter des modèles
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'openai/gpt-image-2/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)GPT Image 2, c'est le gpt-image-2-2026-04-21 d'OpenAI, et c'est le modèle que nous mettons entre les mains des gens quand les mots à l'intérieur de l'image doivent être justes. Nous l'exposons sous openai/gpt-image-2/text-to-image. À resolution=1K, notre valeur par défaut, nous facturons $0.0525 par image quelle que soit la quality envoyée — contre $0.211 pour la requête comparable en palier high sur fal.ai.
Vous avez déjà une image à modifier plutôt qu'à remplacer ? GPT Image 2 edit-image prend des références et un mask optionnel, même modèle et même grille tarifaire.
Ce n'est pas un forfait par image, et un seul des deux boutons fait bouger votre facture.
La résolution est le vrai levier : 1K est en ×1, 2K en ×2, 4K en ×3.
La quality est un multiplicateur ×7 à tous les réglages. low, medium, high et auto aboutissent tous au même chiffre : envoyer quality: "low" vous achète donc une image moins bonne pour le même prix. C'est une bizarrerie de la façon dont notre config mappe le paramètre, et il n'y a donc aucune raison d'envoyer autre chose que high. Le tarif de base de $0.0075 que vous verrez peut-être cité ne s'applique qu'à une requête ne portant aucun champ quality. C'est le coefficient dont part notre moteur de tarification, pas le prix d'une image finie.
Ce qui vous est réellement facturé, vérifié le 26 août 2026 :
| Taille de sortie | E2X, quelle que soit la valeur de quality | fal.ai (high) | vs. E2X |
|---|---|---|---|
| 1024×1024 (1K, notre défaut) | $0.0525 | $0.211 | nous sommes 75 % moins cher |
| 2560×1440 (2K) | $0.105 | $0.222 | nous sommes 53 % moins cher |
| 3840×2160 (4K) | $0.1575 | $0.401 | nous sommes 61 % moins cher |
Regardez la forme de tout ça avant d'engager un budget. fal facture à peine plus la 2K que la 1K — $0.211 contre $0.222 — alors que notre prix double. Notre avantage est maximal en 1K et se resserre à mesure que vous montez.
OpenAI ne peut pas figurer dans le tableau : la facturation se fait aux tokens, donc aucun chiffre officiel par image n'existe, et tout nombre que vous verrez ailleurs est le résultat de la calculette de quelqu'un. Nous datons nos lignes parce que nous les revérifions.
Les prix et les conditions produit peuvent changer. Vérifiez les tarifs en vigueur de chaque provider avant toute décision d'achat. La tarification Google Batch ou Flex n'est pas directement équivalente à une requête API on-demand standard, car les conditions de planification, de disponibilité et de traitement diffèrent ; elle est donc exclue de cette comparaison. Il s'agit d'une comparaison délimitée, et non d'une affirmation selon laquelle E2X serait l'option la moins chère au monde dans toutes les configurations.
La plupart des modèles image transforment encore le texte courant en gribouillis décoratifs qui ressemblent à des lettres à trois mètres de distance. Celui-ci non, et cette seule capability explique sa place au palier premium de notre catalogue. Ce qu'il encaisse :
Deux choses arrivent avec. La résolution atteint la 4K, un vrai bond par rapport au plafond de 1536 px de GPT Image 1, et background: "transparent" vous donne un détourage sans passe de matting — PNG ou WebP uniquement, puisque le JPEG n'a pas de canal alpha.
Le modèle tourne sur du raisonnement de série O : il planifie la composition et se relit avant de rendre. La qualité d'abord. C'est pour ça qu'il est plus lent qu'un modèle du palier flash, et pourquoi nous publions ici une ETA de 60 secondes au lieu de vous en promettre trois.
Créez une API key dans votre dashboard, gardez-la côté serveur. prompt est le seul champ obligatoire.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2/text-to-image",
"input": {
"prompt": "Affiche de recrutement pour une boulangerie du bord de mer. Le titre affiche FLOUR & SALT en sans serif condensée. En dessous, quatre lignes de texte en corps 9 listant les postes ouverts. Texture de papier chaude, une seule couleur encre.",
"aspect_ratio": "2:3",
"resolution": "2K",
"quality": "high"
}
}'
Nous renvoyons un job ID. Faites du polling, ou envoyez un webhookUrl et sautez la boucle.
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submitted = await fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({
model: "openai/gpt-image-2/text-to-image",
input: {
prompt: "Capture d'écran carrée pour l'App Store. Maquette d'appareil sur un aplat menthe. Barre de légende en bas, en japonais et en anglais, toutes deux parfaitement lisibles.",
aspect_ratio: "1:1",
resolution: "1K",
quality: "high",
background: "transparent",
},
}),
}).then((r) => r.json());
const jobId = submitted.data.jobId;
while (true) {
const job = await fetch(`https://api.e2x.ai/v1/jobs/${jobId}`, { headers })
.then((r) => r.json());
if (job.data.status === "completed") {
console.log(job.data.outputs[0].url);
break;
}
if (job.data.status === "failed") {
throw new Error(job.data.error?.message || "Generation failed");
}
await new Promise((r) => setTimeout(r, 3000));
}
Le statut chemine pending → processing → completed, ou s'arrête sur failed ou cancelled. Attention à la casse — les valeurs de résolution sont en majuscules : 1K, 2K, 4K. Notre aspect ratio par défaut est 1:1, et l'enum est large, de 21:9 à 1:3. La spécification lisible par machine porte le schema et le prix en vigueur.
Cinq générateurs dans cette catégorie, et GPT Image 2 est le cher. Parfois c'est le bon choix. Souvent non.
| Modèle | Prix / image | À choisir quand |
|---|---|---|
| GPT Image 2 | $0.0525 (high/1K) | Texte lisible, packaging, 4K, transparence |
| Nano Banana Pro | $0.075 | Réalisme du portrait, plusieurs références tenues cohérentes |
| Nano Banana 2 | $0.04 | La qualité de la génération actuelle à un prix de travail |
| Nano Banana 2 Lite | $0.0238 | Volume, vitesse, scènes simples |
| Nano Banana (legacy) | $0.0312 | Une intégration ancienne que vous n'avez pas migrée |
La ligne de partage est étroite mais réelle. Si la typo doit être lisible, venez ici. Pour des visages, ou un personnage tenu cohérent sur plusieurs références, Nano Banana Pro est plus fort et nous prendrons volontiers votre argent là-bas. Pour une image hero ou un plan de fond, Nano Banana 2 fait le travail aux trois quarts de notre tarif et termine plus tôt.
Encore une chose, puisque nous préférons vous la dire plutôt que vous laisser la découvrir : Nano Banana 2 Lite est moins cher et plus récent que le Nano Banana legacy. Toujours sur l'ancien slug ? Migrer, c'est de l'argent gratuit. Le reste se trouve dans la catégorie text-to-image et le catalogue de modèles.
La passe de raisonnement récompense la spécification et punit le vague. Citez votre texte exactement et dites où il va : « le titre affiche "FLOUR & SALT", centré, tiers supérieur » vous donne cette chaîne, alors que « une affiche de boulangerie avec du texte » vous donne un charabia plausible dans une jolie police. Décrivez la mise en page comme une mise en page — bandeau supérieur, colonne de gauche, filet de pied de page. Le planificateur honore un brief spatial.
Réglez la transparence avec background: "transparent", pas avec une phrase. Trois règles de taille venues d'OpenAI, bonnes à connaître avant un refus : les deux côtés multiples de 16, le plus grand côté sous 3840 px, un aspect ratio pas plus large que 3:1.
Chaque image issue de ce modèle porte deux couches de provenance, et aucune n'est optionnelle, à quelque palier de quality que ce soit.
D'abord, des métadonnées C2PA identifiant la sortie comme générée par ChatGPT Images — X, Meta, LinkedIn et TikTok les lisent et apposent un label « Made with AI » à l'upload. Ensuite, un watermark de pixels imperceptible et plus récent, inscrit dans les données de l'image elle-même, qui survit au retrait des métadonnées que les gens tentent en premier.
Nous ne pouvons retirer ni l'un ni l'autre, et personne d'autre revendant ce modèle ne le peut. Nous ne proposons pas de sortie white-label sur GPT Image 2. Si un contrat client interdit les assets étiquetés IA, réglez ce point avant de construire ici.
Et le piège budgétaire, encore une fois : quality n'est pas un bouton de coût. Descendre à low pour des passes de brouillon est une habitude venue d'autres plateformes ; ici, ça brûle les mêmes $0.0525 tout en dégradant exactement le rendu de texte pour lequel vous êtes venu. Contrôlez la dépense avec resolution — brouillonnez en 1K, livrez en 2K ou 4K.
Le modèle de génération d'images d'OpenAI, snapshot gpt-image-2-2026-04-21, sorti le 21 avril 2026 comme successeur de GPT Image 1.5. Il utilise le raisonnement de série O pour planifier une composition avant de rendre, et sa capability marquante est le texte exact dans l'image, en petites tailles et à travers les langues.
$0.0525 par image à nos valeurs par défaut, quality=high et resolution=1K. La 2K double à $0.105, la 4K triple à $0.1575. C'étaient nos tarifs lors de la vérification du 26 août 2026.
Parce que $0.0075 est notre tarif de base non multiplié, et qu'il ne s'applique qu'à une requête ne portant aucun champ quality. Toute valeur de quality le multiplie par sept, et la résolution multiplie encore par-dessus. Chiffrez la configuration que vous envoyez réellement, sinon votre modèle de coût tombe à côté d'un facteur sept.
Non. Notre multiplicateur est de ×7 pour low, medium, high et auto indifféremment : chacun facture donc $0.0525 en 1K. Envoyer low coûte pareil et rend moins. La résolution est le paramètre qui change réellement votre facture.
À toutes les résolutions que nous avons vérifiées, oui. En 1024×1024, c'est $0.0525 chez nous contre $0.211 là-bas, 75 % de moins ; en 2K, $0.105 contre $0.222, 53 % de moins ; en 4K, $0.1575 contre $0.401, 61 % de moins. OpenAI lui-même facture au token plutôt qu'à l'image : il n'y a donc pas de tarif public officiel à comparer directement.
Oui, de deux façons : des métadonnées C2PA que les plateformes sociales lisent pour appliquer des labels « Made with AI », plus un watermark de pixels imperceptible inscrit dans les données de l'image. Les deux sont présents à tous les paliers de quality, et aucun provider — nous compris — ne peut les désactiver.
Prenez GPT Image 2 quand l'image contient du texte qu'un humain va lire : packaging, infographies, interfaces, affiches. Prenez Nano Banana Pro quand il vous faut du réalisme de portrait ou un personnage cohérent sur plusieurs images de référence. Ils coûtent à peu près pareil en 1K : choisissez sur la force, pas sur le budget.