Loading...
Loading...
Nível premium do Nano Banana baseado no gemini-3-pro-image: texto em imagem e edição, com texto legível dentro da imagem e saída de até 4K.
Entre para executar modelos
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'google/nano-banana-pro/edit-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)Nano Banana Pro é o gemini-3-pro-image do Google — o tier mais alto da família Nano Banana, e o que buscamos quando uma edição precisa se sustentar em tamanho cheio. Expomos a capability de edição dele como google/nano-banana-pro/edit-image, e cobramos $0.075 por imagem editada em 1K e 2K. Isso é metade do que o mesmo request custa hoje na fal.ai ou na Replicate.
Sem imagem de origem para trabalhar? Então o que você quer é o Nano Banana Pro text-to-image — mesmo modelo, mesmo preço, só prompt.
Aqui está onde o nosso preço estava quando checamos pela última vez, em 26 de agosto de 2026:
| Provider de API | Preço (1K/2K) | Preço (4K) | vs. E2X |
|---|---|---|---|
| E2X | $0.075 | $0.15 | — |
| fal.ai | $0.15 | $0.30 | somos 50% mais baratos |
| Replicate | $0.15 | $0.30 | somos 50% mais baratos |
| Google Gemini API | $0.134 | $0.24 | somos 44% mais baratos |
Datamos essa tabela porque a checamos de novo, e porque os preços mudam.
Os preços e as condições dos produtos podem mudar. Verifique o preço atual de cada provider antes de tomar uma decisão de compra. O preço do Google Batch ou Flex não é diretamente equivalente a um request de API on-demand padrão, porque as condições de agendamento, disponibilidade e processamento são diferentes; por isso ele ficou fora desta comparação. Esta é uma comparação de escopo limitado, não uma afirmação de que a E2X é a opção mais barata do mundo em qualquer configuração.
A maioria dos modelos de imagem trata uma edição como uma geração nova que por acaso lembra o original. Este trata como composição, e você sente a diferença em três lugares.
Ele segura quatorze referências de uma vez. O Google divide esse orçamento por papel: até 5 imagens de personagem quando uma pessoa precisa continuar reconhecível, até 6 imagens de objeto para colocação de produto em alta fidelidade, até 3 referências de estilo. Um composto de anúncio inteiro — modelo, produto, paleta da marca — entra como um único request em vez de uma corrente de três chamadas que você tem que ficar vigiando.
Ele escreve texto legível. Esta é a maior razão isolada para recomendarmos o Pro em vez dos tiers mais baratos para qualquer coisa comercial. Ele renderiza texto estilizado e legível para infográficos, cardápios, diagramas e embalagens, e dá conta de layouts multilíngues — entregue a ele um infográfico em inglês, peça a versão em espanhol, e o resto da arte fica no lugar. A maioria dos modelos de imagem ainda transforma texto corrido em rabiscos decorativos.
Resolução que leva a algum lugar. 1K, 2K ou 4K até 4096×4096. Precificamos 1K e 2K de forma idêntica, a $0.075; 4K dobra.
Um comportamento para conhecer antes de nos comparar com qualquer um: o modelo gera "thought images" intermediárias enquanto raciocina sobre a composição. O Google não devolve essas imagens e não cobramos por elas. É também por isso que você deve esperar mais ou menos 30 segundos por request, e não os dois ou três que um modelo de tier flash levaria.
Crie uma API key no seu dashboard, mantenha ela no servidor e mande o job para o nosso endpoint de submit. Exigimos dois campos: prompt e image_urls.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/nano-banana-pro/edit-image",
"input": {
"prompt": "Coloque a garrafa sobre ardósia molhada sob luz do dia difusa de céu nublado. Mantenha o texto do rótulo nítido e inalterado.",
"image_urls": [
"https://example.com/product.jpg",
"https://example.com/mood.jpg"
],
"aspect_ratio": "4:5",
"resolution": "2k"
}
}'
Devolvemos um job ID. Faça polling nele até o status assentar:
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submitted = await fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({
model: "google/nano-banana-pro/edit-image",
input: {
prompt: "Substitua o fundo por um pátio milanês ensolarado. Mantenha o rosto e as roupas do sujeito idênticos.",
image_urls: ["https://example.com/portrait.jpg"],
aspect_ratio: "16:9",
resolution: "1k",
},
}),
}).then((r) => r.json());
const jobId = submitted.data.jobId;
while (true) {
const job = await fetch(`https://api.e2x.ai/v1/jobs/${jobId}`, { headers })
.then((r) => r.json());
if (job.data.status === "completed") {
console.log(job.data.outputs[0].url);
break;
}
if (job.data.status === "failed") {
throw new Error(job.data.error?.message || "Image edit failed");
}
await new Promise((r) => setTimeout(r, 2000));
}
O status corre pending → processing → completed, ou para em failed ou cancelled. Não quer fazer polling? Mande um webhookUrl no corpo do submit e nós chamamos você quando ficar pronto.
Dois detalhes do schema que mordem: o nosso default de aspect ratio é 9:16, não 1:1, então defina explicitamente a menos que você queira retrato — e os valores de resolution são em minúsculas (1k, 2k, 4k). A spec legível por máquina ao vivo sempre carrega o schema atual e o preço atual.
Pro é o nosso editor de imagem mais caro, e ele é genuinamente exagerado para boa parte do trabalho. Aqui está o mapa honesto do que mais rodamos:
| Modelo | Preço / imagem | Escolha quando |
|---|---|---|
| Nano Banana Pro | $0.075 | Texto dentro da imagem, muitas referências, saída em 4K |
| Nano Banana 2 | $0.04 | Qualidade da geração atual, sem exigência de 4K |
| Nano Banana 2 Lite | $0.0238 | Volume alto, edições simples, orçamento apertado |
| Nano Banana (legado) | $0.0312 | Nada. O Google desliga em 2 de outubro de 2026 |
| GPT Image 2 | $0.0525 em qualidade high | Edição baseada em mask, ou a renderização de texto da OpenAI |
Leia essa tabela de novo e repare na linha do legado. O Google aposenta o gemini-2.5-flash-image em 2 de outubro de 2026, e o Nano Banana 2 Lite é ao mesmo tempo mais barato e mais novo que ele — $0.0238 contra $0.0312. Se você ainda está no antigo, essa migração se paga duas vezes. Preferimos te dizer isso a te vender um tier de que você não precisa.
O resto é questão de orçamento. O Pro custa mais ou menos três vezes o Lite. Se as suas edições são trocas de fundo e mudanças de cor em resolução de rede social, o Lite faz isso e você fica com a diferença. Se um cliente vai ler as palavras assadas dentro da imagem, volte para o Pro. Navegue por tudo na categoria image-to-image ou no catálogo de modelos completo.
O hábito que vem do text-to-image é descrever a cena inteira. Numa edição, essa instrução briga com a referência e você recebe uma regeneração à deriva em vez de uma mudança.
Escreva o delta. Nomeie o que muda, depois nomeie o que não pode mudar: "troque o casaco por lã cinza-chumbo, mantenha a pose, o rosto e a iluminação idênticos" ganha de uma descrição completa da cena quase sempre. Quando várias referências entram na mesma chamada, rotule elas — "imagem 1 é a pessoa, imagem 2 é o produto, imagem 3 é só o tratamento de cor" — porque nada mais conta ao modelo que o seu terceiro anexo era uma paleta e não um sujeito.
Editando texto? Cite a string exata. Parafrasear é convite para reinterpretação.
Toda saída carrega um watermark SynthID. É o marcador de proveniência imperceptível do Google, ele se aplica sem exceção, e nem nós nem nenhum outro provider pode expor um botão para desligar isso. Se o seu pipeline roda detecção lá na frente, ou se um contrato de cliente proíbe assets com watermark, resolva isso antes de integrar.
Fique de olho nos defaults de resolução se estiver portando uma config. O nosso default é 1K e o da fal.ai também; a Replicate tem default 2K. O preço aqui é o mesmo entre esses tiers, mas as dimensões da sua saída não vão bater com o que você supôs.
Nano Banana Pro é o nome de produto do gemini-3-pro-image do Google, o tier premium da família Nano Banana. Ele mira trabalho visual complexo — composição com várias referências, consistência de personagem, texto legível dentro da imagem, saída até 4K — e não a geração mais rápida possível.
Cobramos $0.075 por imagem editada em resolução 1K e 2K, com 4K faturado pelo dobro. Esse era o nosso preço na checagem de 26 de agosto de 2026. Preços mudam, então confirme na página do modelo ao vivo antes de orçar em cima disso.
Quatorze no total. O Google limita a mistura por papel: no máximo 5 imagens de personagem para consistência, no máximo 6 imagens de objeto para inclusão em alta fidelidade e no máximo 3 referências de estilo.
Para os preços on-demand comparáveis que checamos naquela data, sim — $0.075 conosco contra $0.15 nas duas. Isso é 50% de economia num request equivalente. Planos diferentes, produtos de batch ou preços promocionais não fazem parte dessa comparação.
Sim. Toda imagem do Nano Banana Pro inclui um watermark SynthID, o marcador imperceptível do Google para conteúdo gerado por IA. Nenhum provider oferece um parâmetro para desligar isso, nós inclusive.
Use o Pro quando a imagem contiver texto legível, quando você estiver combinando várias referências, ou quando precisar de 4K. Para trocas de fundo e retoque simples em resolução de rede social, o Nano Banana 2 Lite custa um terço disso e a diferença raramente aparece.
Não. Você envia um job e depois faz polling do status dele ou nos dá um webhookUrl. Um job concluído expõe o resultado em data.outputs[0].url. Espere uns 30 segundos de processamento.