Voltar para Modelos

Nano Banana Pro

Nível premium do Nano Banana baseado no gemini-3-pro-image: texto em imagem e edição, com texto legível dentro da imagem e saída de até 4K.

Edição de Imagema partir de$0.075Texto para Imagema partir de$0.075
Preçosa partir de $0.075/solicitação
Latência~30 segundos em média
Resolução1K/2K/4K
Melhor paratext to image

Parâmetros

Custo Estimado

Você economiza 50% neste modelo
Custo base por request$0.15
Desconto-50%
Seu Total$0.075
Você economiza $0.075 por solicitação

Entre para executar modelos

Output Preview

Ready

No output yet

Run the model to see generated results.

Exemplo de Saída

Exemplo de API— Parâmetros Atuais

generate.py
import requests

result = requests.post(
    'https://api.e2x.ai/v1/jobs/submit',
    headers={
        'Authorization': f'Bearer {API_KEY}',
        'Content-Type': 'application/json'
    },
    json={
  'model': 'google/nano-banana-pro/text-to-image',
  'input': {}
}
)

Obter Trabalho— Consultar resultado

get_job.py
import time

job_id = result.json()['jobId']

while True:
    response = requests.get(
        f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
        headers={'Authorization': f'Bearer {'{API_KEY}'}'}
    )
    data = response.json()['data']

    if data['status'] == 'completed':
        print('Done!', data['outputs'][0]['url'])
        break
    elif data['status'] == 'failed':
        raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")

    time.sleep(2)
Explorar alternativas

Modelos relacionados

Descubra mais modelos de IA para Texto para Imagem

Ver todos os modelos

API Nano Banana Pro Text-to-Image na E2X

Nano Banana Pro é o nome de produto que o Google dá ao gemini-3-pro-image, o degrau mais alto da sua família de imagem. Rodamos o endpoint de geração como google/nano-banana-pro/text-to-image — entra só um prompt, mais nada — e cobramos $0.075 por imagem em 1K e 2K, com 4K faturado a $0.15. A fal.ai quer o dobro disso pelo request idêntico.

Já tem uma imagem que você prefere alterar em vez de substituir? Nano Banana Pro edit-image é o mesmo modelo pelo mesmo preço, com um campo image_urls para as suas referências.

Onde o nosso número estava na checagem de 26 de agosto de 2026:

Provider de APIPreço (1K/2K)Preço (4K)vs. E2X
E2X$0.075$0.15—
fal.ai$0.15$0.30somos 50% mais baratos
Google Gemini API$0.134$0.24somos 44% mais baratos

Os preços e as condições dos produtos podem mudar. Verifique o preço atual de cada provider antes de tomar uma decisão de compra. O preço do Google Batch ou Flex não é diretamente equivalente a um request de API on-demand padrão, porque as condições de agendamento, disponibilidade e processamento são diferentes; por isso ele ficou fora desta comparação. Esta é uma comparação de escopo limitado, não uma afirmação de que a E2X é a opção mais barata do mundo em qualquer configuração.

resolution é o nosso único fator de cobrança aqui. 1K e 2K custam os mesmos $0.075 — não há razão para renderizar em 1K a menos que banda importe para você — e 4K dobra o valor.

O que o tier Pro faz partindo do zero

Gerar a partir do nada é um problema mais difícil do que editar. Não existe referência para ancorar a composição, então tudo que o modelo acerta tem que sair do raciocínio dele sobre a sua frase. Três capabilities carregam quase todo o peso.

Tipografia que sobrevive. É esta a razão para pagar preço de Pro. O modelo renderiza palavras estilizadas e legíveis dentro do quadro — manchetes, listas de preço, cardápios, rótulos de gráfico, texto de embalagem — em vários idiomas e em tamanhos nos quais modelos mais baratos produzem rabiscos decorativos. Um cartaz com um slogan de verdade é um único request, não um request mais uma hora dentro de uma ferramenta de design.

Grounding com o Google Search. O modelo consegue consultar a busca ao vivo enquanto compõe. Peça um prédio específico, um uniforme específico, um prato montado do jeito que uma cozinha específica monta, e ele tem onde olhar além dos próprios vieses. Isso pesa muito mais em text-to-image do que em edição, onde a fotografia de origem já resolve a questão de como a coisa é.

4K de verdade, até 4096×4096. Não é um upscale pregado depois. O nosso enum de resolution é em minúsculas — 1k, 2k, 4k — e só 4k muda o preço.

Tem uma quarta coisa que vale conhecer, porque ela aparece nos seus gráficos de latência e não na sua fatura. O modelo raciocina visualmente antes de se comprometer, produzindo "thought images" intermediárias pelo caminho. O Google não devolve essas imagens, e não cobramos por elas. Reserve algo em torno de 30 segundos por request e o número deixa de ser surpresa.

API request: do prompt ao quadro pronto

prompt é o único campo obrigatório. Gere uma API key no dashboard, mantenha ela atrás do seu próprio backend e faça POST no nosso endpoint de submit.

curl -X POST https://api.e2x.ai/v1/jobs/submit \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/nano-banana-pro/text-to-image",
    "input": {
      "prompt": "Um cartaz de viagem vintage das Ilhas Faroe. Aparência de serigrafia, quatro cores chapadas, névoa densa sobre falésias de basalto. As palavras VISIT FAROE em uma sans serif condensada ao longo do terço inferior.",
      "aspect_ratio": "2:3",
      "resolution": "2k"
    }
  }'

Você recebe de volta um job ID. Faça polling nele, ou nos passe um webhookUrl no corpo do submit e nós avisamos você:

const headers = {
  Authorization: `Bearer ${process.env.E2X_API_KEY}`,
  "Content-Type": "application/json",
};

const submit = (input) =>
  fetch("https://api.e2x.ai/v1/jobs/submit", {
    method: "POST",
    headers,
    body: JSON.stringify({ model: "google/nano-banana-pro/text-to-image", input }),
  }).then((r) => r.json());

const { data } = await submit({
  prompt:
    "Infográfico isométrico de uma cadeia de suprimento de café, seis etapas rotuladas, paleta terrosa discreta, todos os rótulos em português e legíveis em tamanho pequeno.",
  aspect_ratio: "16:9",
  resolution: "4k",
});

let job;
do {
  await new Promise((r) => setTimeout(r, 2500));
  job = await fetch(`https://api.e2x.ai/v1/jobs/${data.jobId}`, { headers })
    .then((r) => r.json());
} while (job.data.status === "pending" || job.data.status === "processing");

if (job.data.status !== "completed") throw new Error(job.data.error?.message);
console.log(job.data.outputs[0].url);

Dois detalhes do schema que pegam as pessoas de surpresa. O nosso default de aspect_ratio é 9:16, então um request que omite o campo volta em retrato — defina ele toda vez. E o enum é largo: dez ratios, de 1:1 e 4:5 até 21:9, o que cobre a maioria dos formatos de anúncio e de social sem cortar depois. A spec legível por máquina carrega a lista atual e o preço atual.

Escolhendo entre os nossos modelos text-to-image

Pro é o gerador mais caro desta família, e muito trabalho não precisa dele:

ModeloPreço / imagemEscolha quando
Nano Banana Pro$0.075Texto legível dentro da imagem, grounding de busca ou 4K
Nano Banana 2$0.04Qualidade da geração atual pela metade do preço
Nano Banana 2 Lite$0.0238Trabalho de volume em 1K, e velocidade é o que mais importa
Nano Banana (legado)$0.0312Uma integração antiga que você ainda não moveu
GPT Image 2$0.0525 em high / 1KVocê quer a renderização da OpenAI, ou fundos transparentes

Comece pelo Nano Banana 2. Ele custa pouco mais da metade do Pro, renderiza texto bem, e em fotos de produto, thumbnails e imagem editorial você raramente vai conseguir dizer qual tier produziu o arquivo. Suba para o Pro quando as palavras na imagem forem a entrega — um cardápio, um infográfico, uma peça de campanha bilíngue — ou quando um cliente precisar de 4096 pixels no lado maior.

Uma linha merece um segundo olhar: o Nano Banana 2 Lite é mais barato que o Nano Banana legado e mais novo que ele. O próprio Google chama o original de modelo legado e recomenda o Lite como substituto. Se você ainda chama o slug antigo, isso é dinheiro largado na mesa.

O GPT Image 2 é o único rival de verdade em tipografia, e ele chega com uma aparência diferente — mais fria, mais literal, e capaz de devolver fundo transparente, coisa que nenhum modelo de imagem do Gemini faz. As opções restantes estão na categoria text-to-image, e tudo que rodamos está na página do catálogo de modelos.

Acertando as palavras dentro do quadro

Cite a string que você quer. Coloque entre aspas, escreva exatamente e diga onde ela fica — "as palavras 'HALF PRICE TUESDAY' no topo, sans condensada, branco sobre vermelho". Descreva o texto e o modelo interpreta; cite o texto e o modelo transcreve.

Defina a tipografia antes da cena. Prompts que abrem pelo layout e pela tipografia e só depois descrevem a imagem em volta seguram melhor o texto do que prompts que enterram as palavras na última oração.

Depois, deixe o modelo trabalhar. Como ele raciocina antes de pintar, um prompt com restrições estruturais reais — conte os elementos, nomeie a paleta, fixe a ordem de leitura — é aproveitado. Adjetivos vagos são achatados na média.

Antes de colocar em produção

Toda imagem carrega um watermark SynthID, o sinal de proveniência imperceptível do Google. Não existe parâmetro para desligar isso em lugar nenhum, aqui inclusive. Ferramentas de detecção lá na frente vão enxergar o marcador, então, se um contrato proíbe entregas com watermark, resolva isso primeiro.

Confira as suas premissas de aspect ratio se estiver migrando uma config de outro provider. Retrato é o nosso default, não quadrado, e um pipeline que assumiu 1:1 vai produzir arquivos 9:16 em silêncio até alguém perceber.

Perguntas frequentes

Qual modelo do Google é o Nano Banana Pro?

É o gemini-3-pro-image, o tier premium da família Nano Banana do Google. O tier foi construído para trabalho visual exigente — tipografia legível dentro da imagem, detalhe apoiado em busca, saída até 4096×4096 — e não para o retorno mais rápido possível.

Quanto custa o Nano Banana Pro text-to-image na E2X?

$0.075 por imagem em 1K e 2K, e $0.15 em 4K. Isso é metade da tarifa da fal.ai e 44% abaixo da própria API do Google, conforme a nossa checagem de 26 de agosto de 2026. Preços mudam, então confirme na página do modelo ao vivo antes de montar um orçamento em cima disso.

Ele consegue gerar imagens com texto legível?

Sim, e é a principal razão para escolher este tier. Ele renderiza manchetes estilizadas, rótulos e texto corrido dentro da imagem, em vários idiomas, em tamanhos nos quais a maioria dos modelos de imagem falha. Coloque a redação entre aspas no seu prompt em vez de parafrasear.

Qual é a diferença entre os endpoints text-to-image e edit-image?

Mesmo modelo, mesmos $0.075, entrada diferente. Text-to-image aceita apenas um prompt. O edit-image aceita, além disso, um array image_urls de referências, que é o que você quer quando uma imagem existente precisa ser alterada em vez de recriada.

Quanto tempo leva uma geração?

Uns 30 segundos. O modelo produz "thought images" intermediárias enquanto raciocina sobre a composição — o Google não devolve essas imagens e nós não cobramos por elas, mas é aí que o tempo vai. Modelos de tier flash são várias vezes mais rápidos se latência valer mais que qualidade para você.

As imagens do Nano Banana Pro têm watermark?

Têm. Toda saída inclui um watermark SynthID, o marcador invisível do Google para conteúdo gerado por IA. Nenhum provider expõe uma forma de desligar isso, nós inclusive.

O Nano Banana Pro compensa em vez do Nano Banana 2?

Só às vezes. O Nano Banana 2 custa $0.04 contra $0.075 e se sustenta bem na maior parte do trabalho fotográfico e ilustrativo. Pague por Pro quando a imagem contiver texto que alguém vai de fato ler, quando você precisar de precisão apoiada em busca, ou quando a saída tiver que ser 4K.

Quais aspect ratios são suportados?

Dez deles: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9. O nosso default é 9:16, então defina o campo explicitamente a menos que você queira saída em retrato.