Текст в изображение
Создавайте изображения по текстовым описаниям.
О моделях «текст в изображение»
«Текст в изображение» принимает текстовое описание и возвращает статичное изображение. Исходная картинка не нужна: весь вход — это промпт, а модель с нуля выстраивает объект, стиль, свет и композицию. Это самый быстрый способ получить изображение, которого ещё не существует, поэтому такой сценарий встречается в концептах продуктов, заголовочных иллюстрациях статей, кадрах раскадровки, вариантах рекламы, иконках приложений и референсах, которые передают дизайнеру.
Основную работу делает формулировка промпта. Названные объект, техника исполнения, освещение и соотношение сторон обычно влияют на результат сильнее, чем нагромождение прилагательных, а сгенерировать небольшую партию и выбрать лучший вариант эффективнее, чем бесконечно править один промпт. Текст внутри изображения остаётся слабым местом всей области, поэтому воспринимайте попавшие в результат надписи как бонус, а не как гарантию, и накладывайте важные подписи самостоятельно. Модели также различаются по доступным разрешениям, а некоторые тарифицируют большие размеры отдельно.
В этой категории на E2X сейчас представлено семейство Nano Banana от Google, включая варианты Pro и Lite, а также GPT Image 2 от OpenAI. Все они вызываются одинаково: отправьте слаг модели и объект с входными данными на эндпоинт задач, а затем опрашивайте полученный идентификатор задачи, пока результат не будет готов. Переключение между ними — изменение одной строки, а платите вы за запрос с предоплаченного баланса, поэтому сравнение двух моделей на одном промпте стоит ровно двух запросов.
Часто задаваемые вопросы
Нужно ли исходное изображение для «текста в изображение»?
Нет. Единственный обязательный вход — промпт, и модель строит картинку с нуля. Если изображение уже есть и его нужно изменить, вам подойдёт категория «изображение в изображение».
Как тарифицируется генерация?
За запрос, списание идёт с предоплаченного баланса. У каждой модели в каталоге указана своя цена за запрос ещё до вызова, а некоторые берут больше за увеличенный размер результата.
Могут ли эти модели поместить читаемый текст внутрь изображения?
Иногда, но ни одна модель изображений этого не гарантирует. Для заголовков, цен или логотипов сгенерируйте фон, а надписи добавьте потом в дизайн-инструменте.
Что делать, если хочется попробовать другую модель?
Поменяйте слаг модели в запросе. Эндпоинт, аутентификация и схема опроса задачи остаются одинаковыми для всех моделей каталога.