Loading...
Loading...
Nível premium do Nano Banana baseado no gemini-3-pro-image: texto em imagem e edição, com texto legível dentro da imagem e saída de até 4K.
Entre para executar modelos
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'google/nano-banana-pro/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)Nano Banana Pro é o nome de produto que o Google dá ao gemini-3-pro-image, o degrau mais alto da sua família de imagem. Rodamos o endpoint de geração como google/nano-banana-pro/text-to-image — entra só um prompt, mais nada — e cobramos $0.075 por imagem em 1K e 2K, com 4K faturado a $0.15. A fal.ai quer o dobro disso pelo request idêntico.
Já tem uma imagem que você prefere alterar em vez de substituir? Nano Banana Pro edit-image é o mesmo modelo pelo mesmo preço, com um campo image_urls para as suas referências.
Onde o nosso número estava na checagem de 26 de agosto de 2026:
| Provider de API | Preço (1K/2K) | Preço (4K) | vs. E2X |
|---|---|---|---|
| E2X | $0.075 | $0.15 | — |
| fal.ai | $0.15 | $0.30 | somos 50% mais baratos |
| Google Gemini API | $0.134 | $0.24 | somos 44% mais baratos |
Os preços e as condições dos produtos podem mudar. Verifique o preço atual de cada provider antes de tomar uma decisão de compra. O preço do Google Batch ou Flex não é diretamente equivalente a um request de API on-demand padrão, porque as condições de agendamento, disponibilidade e processamento são diferentes; por isso ele ficou fora desta comparação. Esta é uma comparação de escopo limitado, não uma afirmação de que a E2X é a opção mais barata do mundo em qualquer configuração.
resolution é o nosso único fator de cobrança aqui. 1K e 2K custam os mesmos $0.075 — não há razão para renderizar em 1K a menos que banda importe para você — e 4K dobra o valor.
Gerar a partir do nada é um problema mais difícil do que editar. Não existe referência para ancorar a composição, então tudo que o modelo acerta tem que sair do raciocínio dele sobre a sua frase. Três capabilities carregam quase todo o peso.
Tipografia que sobrevive. É esta a razão para pagar preço de Pro. O modelo renderiza palavras estilizadas e legíveis dentro do quadro — manchetes, listas de preço, cardápios, rótulos de gráfico, texto de embalagem — em vários idiomas e em tamanhos nos quais modelos mais baratos produzem rabiscos decorativos. Um cartaz com um slogan de verdade é um único request, não um request mais uma hora dentro de uma ferramenta de design.
Grounding com o Google Search. O modelo consegue consultar a busca ao vivo enquanto compõe. Peça um prédio específico, um uniforme específico, um prato montado do jeito que uma cozinha específica monta, e ele tem onde olhar além dos próprios vieses. Isso pesa muito mais em text-to-image do que em edição, onde a fotografia de origem já resolve a questão de como a coisa é.
4K de verdade, até 4096×4096. Não é um upscale pregado depois. O nosso enum de resolution é em minúsculas — 1k, 2k, 4k — e só 4k muda o preço.
Tem uma quarta coisa que vale conhecer, porque ela aparece nos seus gráficos de latência e não na sua fatura. O modelo raciocina visualmente antes de se comprometer, produzindo "thought images" intermediárias pelo caminho. O Google não devolve essas imagens, e não cobramos por elas. Reserve algo em torno de 30 segundos por request e o número deixa de ser surpresa.
prompt é o único campo obrigatório. Gere uma API key no dashboard, mantenha ela atrás do seu próprio backend e faça POST no nosso endpoint de submit.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/nano-banana-pro/text-to-image",
"input": {
"prompt": "Um cartaz de viagem vintage das Ilhas Faroe. Aparência de serigrafia, quatro cores chapadas, névoa densa sobre falésias de basalto. As palavras VISIT FAROE em uma sans serif condensada ao longo do terço inferior.",
"aspect_ratio": "2:3",
"resolution": "2k"
}
}'
Você recebe de volta um job ID. Faça polling nele, ou nos passe um webhookUrl no corpo do submit e nós avisamos você:
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submit = (input) =>
fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({ model: "google/nano-banana-pro/text-to-image", input }),
}).then((r) => r.json());
const { data } = await submit({
prompt:
"Infográfico isométrico de uma cadeia de suprimento de café, seis etapas rotuladas, paleta terrosa discreta, todos os rótulos em português e legíveis em tamanho pequeno.",
aspect_ratio: "16:9",
resolution: "4k",
});
let job;
do {
await new Promise((r) => setTimeout(r, 2500));
job = await fetch(`https://api.e2x.ai/v1/jobs/${data.jobId}`, { headers })
.then((r) => r.json());
} while (job.data.status === "pending" || job.data.status === "processing");
if (job.data.status !== "completed") throw new Error(job.data.error?.message);
console.log(job.data.outputs[0].url);
Dois detalhes do schema que pegam as pessoas de surpresa. O nosso default de aspect_ratio é 9:16, então um request que omite o campo volta em retrato — defina ele toda vez. E o enum é largo: dez ratios, de 1:1 e 4:5 até 21:9, o que cobre a maioria dos formatos de anúncio e de social sem cortar depois. A spec legível por máquina carrega a lista atual e o preço atual.
Pro é o gerador mais caro desta família, e muito trabalho não precisa dele:
| Modelo | Preço / imagem | Escolha quando |
|---|---|---|
| Nano Banana Pro | $0.075 | Texto legível dentro da imagem, grounding de busca ou 4K |
| Nano Banana 2 | $0.04 | Qualidade da geração atual pela metade do preço |
| Nano Banana 2 Lite | $0.0238 | Trabalho de volume em 1K, e velocidade é o que mais importa |
| Nano Banana (legado) | $0.0312 | Uma integração antiga que você ainda não moveu |
| GPT Image 2 | $0.0525 em high / 1K | Você quer a renderização da OpenAI, ou fundos transparentes |
Comece pelo Nano Banana 2. Ele custa pouco mais da metade do Pro, renderiza texto bem, e em fotos de produto, thumbnails e imagem editorial você raramente vai conseguir dizer qual tier produziu o arquivo. Suba para o Pro quando as palavras na imagem forem a entrega — um cardápio, um infográfico, uma peça de campanha bilíngue — ou quando um cliente precisar de 4096 pixels no lado maior.
Uma linha merece um segundo olhar: o Nano Banana 2 Lite é mais barato que o Nano Banana legado e mais novo que ele. O próprio Google chama o original de modelo legado e recomenda o Lite como substituto. Se você ainda chama o slug antigo, isso é dinheiro largado na mesa.
O GPT Image 2 é o único rival de verdade em tipografia, e ele chega com uma aparência diferente — mais fria, mais literal, e capaz de devolver fundo transparente, coisa que nenhum modelo de imagem do Gemini faz. As opções restantes estão na categoria text-to-image, e tudo que rodamos está na página do catálogo de modelos.
Cite a string que você quer. Coloque entre aspas, escreva exatamente e diga onde ela fica — "as palavras 'HALF PRICE TUESDAY' no topo, sans condensada, branco sobre vermelho". Descreva o texto e o modelo interpreta; cite o texto e o modelo transcreve.
Defina a tipografia antes da cena. Prompts que abrem pelo layout e pela tipografia e só depois descrevem a imagem em volta seguram melhor o texto do que prompts que enterram as palavras na última oração.
Depois, deixe o modelo trabalhar. Como ele raciocina antes de pintar, um prompt com restrições estruturais reais — conte os elementos, nomeie a paleta, fixe a ordem de leitura — é aproveitado. Adjetivos vagos são achatados na média.
Toda imagem carrega um watermark SynthID, o sinal de proveniência imperceptível do Google. Não existe parâmetro para desligar isso em lugar nenhum, aqui inclusive. Ferramentas de detecção lá na frente vão enxergar o marcador, então, se um contrato proíbe entregas com watermark, resolva isso primeiro.
Confira as suas premissas de aspect ratio se estiver migrando uma config de outro provider. Retrato é o nosso default, não quadrado, e um pipeline que assumiu 1:1 vai produzir arquivos 9:16 em silêncio até alguém perceber.
É o gemini-3-pro-image, o tier premium da família Nano Banana do Google. O tier foi construído para trabalho visual exigente — tipografia legível dentro da imagem, detalhe apoiado em busca, saída até 4096×4096 — e não para o retorno mais rápido possível.
$0.075 por imagem em 1K e 2K, e $0.15 em 4K. Isso é metade da tarifa da fal.ai e 44% abaixo da própria API do Google, conforme a nossa checagem de 26 de agosto de 2026. Preços mudam, então confirme na página do modelo ao vivo antes de montar um orçamento em cima disso.
Sim, e é a principal razão para escolher este tier. Ele renderiza manchetes estilizadas, rótulos e texto corrido dentro da imagem, em vários idiomas, em tamanhos nos quais a maioria dos modelos de imagem falha. Coloque a redação entre aspas no seu prompt em vez de parafrasear.
Mesmo modelo, mesmos $0.075, entrada diferente. Text-to-image aceita apenas um prompt. O edit-image aceita, além disso, um array image_urls de referências, que é o que você quer quando uma imagem existente precisa ser alterada em vez de recriada.
Uns 30 segundos. O modelo produz "thought images" intermediárias enquanto raciocina sobre a composição — o Google não devolve essas imagens e nós não cobramos por elas, mas é aí que o tempo vai. Modelos de tier flash são várias vezes mais rápidos se latência valer mais que qualidade para você.
Têm. Toda saída inclui um watermark SynthID, o marcador invisível do Google para conteúdo gerado por IA. Nenhum provider expõe uma forma de desligar isso, nós inclusive.
Só às vezes. O Nano Banana 2 custa $0.04 contra $0.075 e se sustenta bem na maior parte do trabalho fotográfico e ilustrativo. Pague por Pro quando a imagem contiver texto que alguém vai de fato ler, quando você precisar de precisão apoiada em busca, ou quando a saída tiver que ser 4K.
Dez deles: 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9. O nosso default é 9:16, então defina o campo explicitamente a menos que você queira saída em retrato.