Loading...
Loading...
Семейство GPT Image 2 от OpenAI: генерация изображений по тексту и редактирование по референсу через OpenAI Images API.
Войдите, чтобы запускать модели
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'openai/gpt-image-2/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)GPT Image 2 — это gpt-image-2-2026-04-21 от OpenAI, и это та модель, которую мы даём людям, когда слова внутри картинки обязаны быть правильными. Мы отдаём её как openai/gpt-image-2/text-to-image. При resolution=1K, нашем значении по умолчанию, мы берём $0.0525 за изображение при любом quality, который вы пришлёте, — против $0.211 за сопоставимый request верхнего уровня на fal.ai.
Уже есть изображение, которое нужно изменить, а не заменить? GPT Image 2 edit-image принимает референсы и необязательную mask, та же модель и тот же прайс.
Это не фиксированная плата за изображение, и ваш счёт двигает только одна из двух ручек.
Настоящий рычаг — разрешение: 1K — это ×1, 2K — ×2, 4K — ×3.
Quality — это множитель ×7 при любом значении. low, medium, high и auto приходят к одной и той же цифре, так что отправка quality: "low" покупает худшее изображение за те же деньги. Это особенность того, как наш конфиг отображает этот параметр, поэтому нет причин присылать что-либо, кроме high. Базовая ставка $0.0075, которую вы можете где-то увидеть, относится только к request, где поля quality нет вовсе. Это коэффициент, с которого стартует наш прайсинг-движок, а не цена готового изображения.
Что вам на самом деле выставят, по данным проверки 26 августа 2026 года:
| Размер вывода | E2X, любое значение quality | fal.ai (high) | против E2X |
|---|---|---|---|
| 1024×1024 (1K, наше значение по умолчанию) | $0.0525 | $0.211 | мы на 75% дешевле |
| 2560×1440 (2K) | $0.105 | $0.222 | мы на 53% дешевле |
| 3840×2160 (4K) | $0.1575 | $0.401 | мы на 61% дешевле |
Посмотрите на форму этой таблицы, прежде чем фиксировать бюджет. fal берёт за 2K едва ли больше, чем за 1K — $0.211 против $0.222, — тогда как наша цена удваивается. Наше преимущество максимально на 1K и сужается по мере подъёма.
Сам OpenAI в таблицу попасть не может: он тарифицирует по токенам, поэтому официальной цифры за изображение не существует, и любое число, которое вы увидите в другом месте, — это чей-то результат из калькулятора. Мы ставим дату на свои строки, потому что перепроверяем их.
Цены и условия продуктов со временем меняются; проверьте актуальные цены каждого провайдера, прежде чем принимать решение о покупке. Цены Google Batch или Flex не эквивалентны напрямую стандартному on-demand API request, поскольку планирование, доступность и условия обработки отличаются; поэтому они исключены из этого сравнения. Это ограниченное по охвату сравнение, а не утверждение, что E2X — самый дешёвый вариант в мире при любой конфигурации.
Большинство моделей изображений до сих пор превращают основной текст в декоративные закорючки, которые с трёх метров похожи на буквы. Эта — нет, и именно эта одна возможность держит её в премиальном тарифе нашего каталога. Что она выдерживает:
Вместе с ней идут ещё две вещи. Разрешение доходит до 4K — настоящий скачок по сравнению с потолком GPT Image 1 в 1536 пикселей, — а background: "transparent" даёт вам вырезанный объект без отдельного прохода обтравки: только PNG или WebP, поскольку у JPEG нет альфа-канала.
Модель работает на рассуждении O-серии: планирует композицию и самопроверяется перед отрисовкой. Качество на первом месте. Поэтому она медленнее модели flash-уровня, и поэтому мы публикуем здесь ETA в 60 секунд, а не обещаем вам три.
Создайте ключ в дашборде, держите его на сервере. prompt — единственное обязательное поле.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-image-2/text-to-image",
"input": {
"prompt": "Постер о найме для приморской пекарни. Заголовок гласит FLOUR & SALT узким гротеском. Под ним четыре строки основного текста кеглем 9 пунктов с перечнем открытых вакансий. Тёплая фактура бумаги, одна краска.",
"aspect_ratio": "2:3",
"resolution": "2K",
"quality": "high"
}
}'
Мы возвращаем job ID. Опрашивайте его или пришлите webhookUrl и пропустите цикл.
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submitted = await fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({
model: "openai/gpt-image-2/text-to-image",
input: {
prompt: "Квадратный скриншот для магазина приложений. Мокап устройства на мятном поле. Полоса с подписью внизу на японском и английском, обе полностью читаемы.",
aspect_ratio: "1:1",
resolution: "1K",
quality: "high",
background: "transparent",
},
}),
}).then((r) => r.json());
const jobId = submitted.data.jobId;
while (true) {
const job = await fetch(`https://api.e2x.ai/v1/jobs/${jobId}`, { headers })
.then((r) => r.json());
if (job.data.status === "completed") {
console.log(job.data.outputs[0].url);
break;
}
if (job.data.status === "failed") {
throw new Error(job.data.error?.message || "Generation failed");
}
await new Promise((r) => setTimeout(r, 3000));
}
Статус шагает pending → processing → completed либо останавливается на failed или cancelled. Следите за регистром — значения разрешения пишутся заглавными: 1K, 2K, 4K. Значение aspect ratio по умолчанию у нас 1:1, а enum широкий: от 21:9 до 1:3. Машиночитаемая спецификация несёт актуальную schema и цену.
В этой категории пять генераторов, и GPT Image 2 — дорогой. Иногда это правильно. Часто — нет.
| Модель | Цена / изображение | Когда брать |
|---|---|---|
| GPT Image 2 | $0.0525 (high/1K) | Читаемый текст, упаковка, 4K, прозрачность |
| Nano Banana Pro | $0.075 | Портретный реализм, несколько референсов, удержанных консистентно |
| Nano Banana 2 | $0.04 | Качество текущего поколения по рабочей цене |
| Nano Banana 2 Lite | $0.0238 | Объём, скорость, простые сцены |
| Nano Banana (legacy) | $0.0312 | Старая интеграция, которую вы не мигрировали |
Разделение узкое, но реальное. Если шрифт должен быть читаемым, вам сюда. Для лиц или одного персонажа, удержанного консистентно на нескольких референсах, Nano Banana Pro сильнее, и мы с удовольствием возьмём ваши деньги там. Для главного изображения или подложки фона Nano Banana 2 справится за три четверти нашей ставки и закончит раньше.
Ещё одно, раз уж мы предпочитаем сказать, а не дать вам выяснить самим: Nano Banana 2 Lite и дешевле, и новее legacy Nano Banana. Всё ещё на старом slug? Миграция — деньги из воздуха. Остальное лежит в категории text-to-image и в каталоге моделей.
Проход рассуждения вознаграждает точность и наказывает расплывчатость. Цитируйте свой текст дословно и говорите, где он стоит: «заголовок гласит "FLOUR & SALT", по центру, верхняя треть» даст именно эту строку, а «постер пекарни с каким-то текстом» даст правдоподобную бессмыслицу приятным шрифтом. Описывайте макет как макет — верхняя плашка, левая колонка, линейка в подвале. Планировщик уважает пространственный бриф.
Прозрачность задавайте через background: "transparent", а не предложением. Три правила по размерам от OpenAI, которые стоит знать до отказа: обе стороны кратны 16, длинная сторона меньше 3840 пикселей, соотношение сторон не шире 3:1.
Каждое изображение от этой модели несёт два слоя происхождения, и ни один из них не отключается ни на одном уровне качества.
Первый — метаданные C2PA, помечающие результат как созданный ChatGPT Images: X, Meta, LinkedIn и TikTok их читают и вешают при загрузке ярлык «Made with AI». Второй — более новый незаметный пиксельный водяной знак в самих данных изображения, который переживает срезание метаданных, к которому прибегают в первую очередь.
Мы не можем убрать ни то, ни другое, и никто другой, перепродающий эту модель, тоже. Мы не предлагаем white-label вывод на GPT Image 2. Если договор с клиентом запрещает материалы с пометкой ИИ, решите это до того, как строить здесь.
И ещё раз про бюджетную ловушку: quality — не регулятор стоимости. Опускаться до low для черновых прогонов — привычка с других платформ; здесь она сжигает те же $0.0525 и при этом ухудшает ровно тот рендеринг текста, ради которого вы пришли. Управляйте тратами через resolution: черновики в 1K, выкатка в 2K или 4K.
Модель генерации изображений от OpenAI, снапшот gpt-image-2-2026-04-21, выпущенная 21 апреля 2026 года как преемница GPT Image 1.5. Она использует рассуждение O-серии, чтобы спланировать композицию перед отрисовкой, а её выдающаяся возможность — точный текст в кадре в мелких размерах и на разных языках.
$0.0525 за изображение при наших значениях по умолчанию, quality=high и resolution=1K. 2K удваивает это до $0.105, 4K утраивает до $0.1575. Такими были наши ставки на момент проверки 26 августа 2026 года.
Потому что $0.0075 — это наша базовая ставка без множителей, и относится она только к request, где поля quality нет вовсе. Любое значение quality умножает её на семь, а разрешение умножает ещё раз сверху. Считайте по той конфигурации, которую действительно отправляете, иначе ваша модель затрат промахнётся в семь раз.
Нет. Наш множитель равен ×7 одинаково для low, medium, high и auto, так что каждое из них тарифицируется в $0.0525 на 1K. Отправка low стоит столько же и возвращает меньше. Параметр, который действительно меняет ваш счёт, — разрешение.
На каждом разрешении, которое мы проверяли, — да. На 1024×1024 это $0.0525 у нас против $0.211 там, на 75% ниже; на 2K — $0.105 против $0.222, на 53% ниже; на 4K — $0.1575 против $0.401, на 61% ниже. Сам OpenAI тарифицирует по токенам, а не по изображениям, поэтому официальной прайсовой цены для прямого сравнения нет.
Да, в двух видах: метаданные C2PA, которые социальные платформы читают, чтобы повесить ярлык «Made with AI», плюс незаметный пиксельный водяной знак, вшитый в данные изображения. Оба присутствуют на любом уровне качества, и ни один провайдер — включая нас — не может их выключить.
Берите GPT Image 2, когда на изображении есть текст, который человек будет читать: упаковка, инфографика, UI, постеры. Берите Nano Banana Pro, когда нужен портретный реализм или консистентный персонаж на нескольких референсных изображениях. На 1K они стоят примерно одинаково, поэтому выбирайте по сильной стороне, а не по бюджету.