Loading...
Loading...
gemini-3-pro-image をベースにした Nano Banana の上位モデル。テキストからの生成と編集に対応し、画像内の文字も読みやすく、最大 4K で出力できます。
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'google/nano-banana-pro/text-to-image',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)Nano Banana Pro は、Google が gemini-3-pro-image に与えた製品名で、同社の画像ファミリーの最上段にあたります。当社ではその生成 endpoint を google/nano-banana-pro/text-to-image として運用しており — 入力は prompt だけです — 1K と 2K で 1 枚あたり $0.075、4K は $0.15 で課金しています。fal.ai は同一の request にその 2 倍を求めます。
すでにある画像を、差し替えではなく変更したいのでしょうか。Nano Banana Pro edit-image は同じモデルを同じ価格で提供し、参照画像用の image_urls フィールドが付きます。
2026年8月26日の確認時点での当社の数字は次のとおりです。
| API プロバイダー | 価格(1K/2K) | 価格(4K) | E2X との比較 |
|---|---|---|---|
| E2X | $0.075 | $0.15 | — |
| fal.ai | $0.15 | $0.30 | 当社が 50% 低価格 |
| Google Gemini API | $0.134 | $0.24 | 当社が 44% 低価格 |
価格および製品条件は変更される場合があります。購入を判断する前に、各プロバイダーの最新価格をご確認ください。Google の Batch または Flex 価格は、スケジューリング・空き状況・処理条件が異なるため、標準的なオンデマンド API request と直接同等ではなく、この比較には含めていません。これは特定の条件に絞った比較であり、E2X があらゆる構成において世界最安であると主張するものではありません。
ここで課金に影響する要素は resolution だけです。1K と 2K は同じ $0.075 です。帯域幅が問題にならない限り、1K でレンダリングする理由はありません。そして 4K はその倍になります。
何もないところからの生成は、編集より難しい問題です。構図を固定してくれる参照がないため、モデルが正しく仕上げるものはすべて、あなたの文章に対する自身の推論から出てこなければなりません。重さの大半を担うのは 3 つの capability です。
破綻しないタイポグラフィ。 これこそが Pro の価格を払う理由です。このモデルは、スタイルの付いた読める文字をフレーム内に描画します。見出し、価格表、メニューボード、グラフのラベル、パッケージのコピー — それを複数の言語で、安いモデルなら装飾的なミミズ文字になるサイズで描きます。本物のスローガンが入ったポスターは request 1 回で完成し、request にデザインツールでの 1 時間を足す必要はありません。
Google Search grounding。 モデルは構図を組み立てながらライブ検索を参照できます。特定の建物、特定の制服、特定の料理をその料理らしい盛り付けで、と指定すれば、自身の事前分布以外に参照先を持てるということです。これは編集よりも text-to-image ではるかに重要です。編集では、ソース写真がすでに「それがどう見えるか」という問いに決着をつけているからです。
本物の 4K、最大 4096×4096。 後付けのアップスケールではありません。当社の resolution enum は小文字で — 1k、2k、4k — 価格が変わるのは 4k だけです。
請求書ではなくレイテンシのグラフに現れるため、知っておく価値のある 4 つ目があります。このモデルは確定する前に視覚的に推論し、その過程で中間的な「思考画像」を生成します。Google はそれらを返しませんし、当社はそれらに課金しません。1 request あたり約 30 秒を見込んでいただければ、その数字が意外に感じられることはなくなります。
必須フィールドは prompt だけです。ダッシュボードで API key を発行し、自前のバックエンドの背後に置いたうえで、当社の submit endpoint に POST してください。
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/nano-banana-pro/text-to-image",
"input": {
"prompt": "フェロー諸島のヴィンテージ旅行ポスター。シルクスクリーン調、フラットな 4 色、玄武岩の断崖にかかる濃い霧。下から 3 分の 1 に VISIT FAROE の文字をコンデンスドのサンセリフで配置。",
"aspect_ratio": "2:3",
"resolution": "2k"
}
}'
job ID が返ってきます。polling するか、submit の body に webhookUrl を渡していただければ、代わりに当社から通知します。
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const submit = (input) =>
fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({ model: "google/nano-banana-pro/text-to-image", input }),
}).then((r) => r.json());
const { data } = await submit({
prompt:
"コーヒーのサプライチェーンのアイソメトリック・インフォグラフィック、ラベル付きの 6 段階、くすんだアースカラーのパレット、ラベルはすべてポルトガル語で小さいサイズでも判読可能。",
aspect_ratio: "16:9",
resolution: "4k",
});
let job;
do {
await new Promise((r) => setTimeout(r, 2500));
job = await fetch(`https://api.e2x.ai/v1/jobs/${data.jobId}`, { headers })
.then((r) => r.json());
} while (job.data.status === "pending" || job.data.status === "processing");
if (job.data.status !== "completed") throw new Error(job.data.error?.message);
console.log(job.data.outputs[0].url);
見落とされやすい schema の詳細が 2 つあります。当社の aspect_ratio のデフォルトは 9:16 なので、このフィールドを省いた request は縦長で返ってきます。毎回指定してください。そして enum は広く、1:1 や 4:5 から 21:9 まで 10 種類の比率があり、後からクロップしなくても広告や SNS のフォーマットの大半をカバーできます。機械可読な仕様に最新の一覧と最新の価格を掲載しています。
Pro はこのファミリーで最も高価なジェネレーターであり、多くの仕事にはそこまで必要ありません。
| モデル | 1 枚あたりの価格 | こんなときに |
|---|---|---|
| Nano Banana Pro | $0.075 | 判読可能な画像内テキスト、search grounding、または 4K |
| Nano Banana 2 | $0.04 | 現行世代の品質を半額で |
| Nano Banana 2 Lite | $0.0238 | 1K での大量処理、速度が最優先 |
| Nano Banana(レガシー) | $0.0312 | まだ移していない古い統合 |
| GPT Image 2 | high / 1K で $0.0525 | OpenAI のレンダリング、または背景の透過が欲しい |
まず Nano Banana 2 から始めてください。Pro の半分をやや上回る価格で、テキストもよく描画します。商品撮影、サムネイル、記事用のビジュアルであれば、どのティアが生成したファイルか見分けられることはめったにありません。画像の中の文字そのものが成果物である場合 — メニュー、インフォグラフィック、二言語のキャンペーン素材など — や、クライアントが長辺 4096 ピクセルを必要とする場合に Pro へ上がってください。
もう一度見ていただきたい行があります。Nano Banana 2 Lite はレガシーの Nano Banana より安く、しかも新しいモデルです。 Google 自身が初代を自社のレガシーモデルと呼び、代替として Lite を推奨しています。まだ古い slug を呼んでいるのであれば、それは机の上に置き去りにされた利益です。
タイポグラフィにおける唯一の本物の対抗馬が GPT Image 2 で、こちらは異なる質感で到達します。より冷たく、より字義どおりで、どの Gemini 画像モデルもできない背景の透過を返せます。残りの選択肢は text-to-image カテゴリにあり、当社が運用しているすべてはモデルカタログのページに揃っています。
出したい文字列は引用してください。引用符で囲み、正確に綴り、どこに置くかを述べてください。「上部に 'HALF PRICE TUESDAY' の文字、コンデンスドのサンセリフ、赤地に白」といった具合です。テキストを描写すればモデルは解釈しますが、引用すればモデルは書き写します。
シーンより先に文字を決めてください。レイアウトとタイポグラフィから書き始め、その周囲のイメージを描写する prompt のほうが、テキストを最後の節に埋めた prompt よりコピーをよく保ちます。
そのうえで、あとは任せてください。このモデルは描く前に推論するため、実際の構造的制約を含む prompt — 要素を数える、パレットを指定する、読む順序を固定する — は実際に使われます。曖昧な形容詞は平均化されます。
すべての画像に、Google の知覚できない来歴シグナルである SynthID watermark が入ります。ここを含め、どこにもこれを切るパラメーターはありません。下流の検出ツールはこれを見つけるため、契約で watermark 入りの納品物が禁じられている場合は、先に整理してください。
他社から設定を移行する場合は、aspect ratio の前提を確認してください。当社のデフォルトは正方形ではなく縦長です。1:1 を前提としたパイプラインは、誰かが気づくまで黙って 9:16 のファイルを生成し続けます。
gemini-3-pro-image で、Google の Nano Banana ファミリーのプレミアムティアです。このティアは、最速のターンアラウンドのためではなく、要求の厳しいビジュアル制作 — 判読可能な画像内タイポグラフィ、検索に裏づけられたディテール、最大 4096×4096 の出力 — のために作られています。
1K と 2K で 1 枚あたり $0.075、4K で $0.15 です。2026年8月26日 の確認時点で、fal.ai の料金の半分、Google 自身の API より 44% 低い水準でした。価格は変動しますので、それを前提に予算を組む前に最新のモデルページでご確認ください。
はい。それこそがこのティアを選ぶ主な理由です。スタイルの付いた見出し、ラベル、本文コピーを、複数の言語で、大半の画像モデルが失敗するサイズで画像内に描画します。prompt では言い換えるのではなく、文言を引用符で囲んで指定してください。
同じモデル、同じ $0.075 で、入力が異なります。text-to-image は prompt のみを受け取ります。Edit-image はそれに加えて参照画像の image_urls 配列を受け取ります。既存の画像を作り直すのではなく変更する必要があるときは、そちらをお使いください。
約 30 秒です。モデルは構図について推論しながら中間的な「思考画像」を生成します。Google はそれらを返さず、当社も課金しませんが、時間が費やされているのはそこです。品質よりレイテンシが優先されるのであれば、flash ティアのモデルは数倍高速です。
はい。すべての出力に、AI 生成コンテンツ向けの Google の不可視マーカーである SynthID watermark が含まれます。当社を含め、これを無効化する手段を公開しているプロバイダーはありません。
場合によります。Nano Banana 2 は $0.075 に対して $0.04 で、写真的・イラスト的な仕事の大半でしっかり通用します。誰かが実際に読むコピーが画像に含まれる場合、検索に裏づけられた正確さが必要な場合、出力が 4K でなければならない場合に、Pro の代金をお支払いください。
10 種類です。1:1、2:3、3:2、3:4、4:3、4:5、5:4、9:16、16:9、21:9。当社のデフォルトは 9:16 なので、縦長の出力でよい場合を除き、このフィールドを明示的に指定してください。