演示文稿的 AI 工具:生成氛围,别生成证据
第三排有个人以前见过您那张图库照片。也许是在某个竞争对手的首页上,也许是在这个季度他坐着听完的上一份文稿里。那是小的失败。大的那个,是第十九页上那张屋里没人说得清来源的图表。
AI 干净利落地解决了第一个问题,又把第二个问题弄得糟糕得多。人们做这类活儿用的图像模型正是我们在跑的——Nano Banana 2 Lite、Nano Banana 2 和 Nano Banana Pro——这让我们对您把它们指向文稿正确的那一半有直接的利害关系。生成氛围。绝不生成证据。

一份演示文稿的两半
一份文稿同时是一个论证和一个表面。论证是您的数字、您的主张、那张说明系统实际怎么运转的图。表面是眼睛在读到任何一个字之前落到的一切:章节分隔页、标题背后的纹理、那套让四十页感觉像一份文档而不是四十页的插画语言。
图像模型在表面上出色。它们在论证上是主动危险的。下面全部内容,都是这句话的展开。
生成图像配得上自己位置的地方
有六件活儿,我们会先去找模型而不是图库:
- 章节分隔页。 六个章节需要六张彼此成套、又不属于任何别人的图。这是清单上价值最高的用法,因为这正是图库摄影明显失守的地方。
- 背景、纹理与渐变。 没有主体,没有焦点。生成便宜,重摇轻而易举,而且模型完全不需要在任何事情上是对的。
- 标题页的主视觉。 被看的时间最长,而且往往是唯一还得扛住印刷的那张图。
- 一套一致的插画语言。 四十页看起来像同一位插画师全画完了。
- 本地化后的文稿。 您用英语做的,马德里需要西班牙语版,而画面应该扛过这次翻译。
- 留存件。 会后发出去的 PDF 的封面图,分辨率要在印刷上撑得住。
这些没有一样是内容。它们全都是内容所在的容器——恰恰是一个会编造东西的模型待着安全的地方。
它会让您难堪的地方
图表与数据可视化。 一张生成的图表是披着真实数据视觉语法的编造数据:网格线、坐标轴刻度、一条看着像是刻意为之的趋势。它是那一页上最像权威的东西,而里面每一个数字都是虚构。在商业演示里这是最糟糕的一种失败,因为在有人去核对之前,整个屋子都相信它。请在真正持有数字的工具里做图表。
标注必须正确的示意图。 Nano Banana Pro 能渲染可读的文字。那和了解您的架构不是一回事。它产出的是里面填着看似合理词汇的方框和箭头,排布方式则是看似合理地错着,而那个系统的负责人四秒钟就能看出来。请在画图工具里画。
任何跟地理有关的东西。 生成的地图会把海岸线、国界和城市位置弄得微妙地错——很难发现,一旦被发现就无从辩解。我们写过为什么 AI 图像生成器画不好地图。
您自己的产品。 一份生成出来的、近似您 UI 的东西,是关于一个观众可以自己去看的东西撒的谎。截图去。

标题页是文字问题被定下来的地方
大多数幻灯片配图里根本不该有字;字属于幻灯片本身,用真正的字体,可编辑。但标题页常常想要一个词烤进画面里,而本地化又想把整个东西用另一种语言重建一遍。那是整套文稿工作流里,唯一一个多花钱是对的地方。
Nano Banana Pro 是 gemini-3-pro-image,而可读、带样式、多语言的图内文字正是它存在的理由。按我们 2026 年 8 月 26 日的价格核查,在我们 API 上每次 request $0.075。它对 1K 和 2K 输出还收同样的价,这让那一档上的 2K 成了白拿的钱——拿上,尤其是任何要送印的东西。
Nano Banana 2 也渲染图内文字。它是 gemini-3.1-flash-image,能力在那儿,对单个短词通常能落地。我们仍然不会把那句所有人盯着看九十秒的标题交给它,也完全不会在它身上尝试语言替换。那是 Pro 的活儿,走 Pro 的 edit endpoint:把英文标题页递给它,要一份西班牙语的,画面存活下来,文字换掉。
初代 Nano Banana 完全做不到这件事——它是 2.5 代的模型,图内文字是随 Gemini 3 到来的——而且无论如何它都会在 2026 年 10 月 2 日退役。别在它上面开一套文稿工作流。
还有一条跟文字无关的档位提醒:如果您需要的是一个压在幻灯片背景上的抠像形状,而不是垫在下面的一个矩形,那么 GPT Image 2 是我们目录里唯一带 background: transparent 参数的模型。1K 下 $0.0525。
幻灯片是 16:9,而默认值不是
这是会让人赔上第一个下午的细节。我们在 Google 那几档上的 aspect_ratio 默认值——Nano Banana 2、Nano Banana Pro 和 legacy 模型——是 9:16。竖版。不钉死比例就去要一张幻灯片配图,您会为一个宽表面拿到一张高图,裁掉它,然后您喜欢的那个构图就没了。
Nano Banana 2 Lite 的默认值又不一样,是 1:1。也不是幻灯片。
每一次都钉死它:
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer $E2X_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/nano-banana-2-lite/text-to-image",
"input": {
"prompt": "冷灰色半透明纸层层交叠的宽幅抽象纹理,柔和的侧掠光,无文字,无 logo",
"aspect_ratio": "16:9"
}
}'
还有两个比例值得知道。21:9 在每一个 Google 档位上都有,适合内容页顶部一条出血横幅。只有 Lite 带着 4:1、1:4、8:1 和 1:8——用来拍照荒唐,用来做模板侧边一条细窄的装饰长条则完美。

四十页看起来像同一份文稿
这里的失败不是质量,是漂移。四十条各自独立的 prompt 会产出四十张各自都还行、合在一起却像一块委员会拼出来的情绪板的图。第四页是绘画感的,第九页跑成了摄影,第二十二页捡了一个没人选过的颜色。
解法是一张风格参考图,在这份文稿的每一张图上复用。先生成一张您满意的图,然后在之后每一次 request 上都把那张图作为参考送回去,而不是再用文字把风格描述一遍。Nano Banana 2 最多接受十四张参考图。Nano Banana Pro 把它的十四张按角色拆开,其中最多三张专用于风格参考,正是这套机制让这件事变得可靠,而不是靠运气。
这个方法我们在让 Nano Banana 的输出在整组里保持一致里正经写过。如果您的问题是单张图一开始就出不对,那是另一种修法,在 Nano Banana prompt 指南里。
一份真实文稿的配图要花多少钱
拿一份四十页的文稿,每个章节分隔页配一张图,再加一张标题主视觉。算它十二张图。
在 $0.0238 的 Nano Banana 2 Lite 上,是 $0.29。在 $0.075 的 Nano Banana Pro 上,是 $0.90。把每一张都重摇三次,因为第一遍从来都不行,您也还没花到三美元。一份图库照片的授权都比这贵,而且它还附带一个属性:别人也在用它。
价格与产品条款可能随时间变化;在做出采购决定前,请核对各家提供商的当前价格。Google 的 Batch 或 Flex 价格在调度、可用容量和处理条件上均有所不同,因此与标准的按需 API request 并不直接等价,已从本对比中排除。这是一次限定范围的对比,并非声称 E2X 在任何配置下都是全球最便宜的选择。
我们真正会把您放在哪一档
不是 Pro。至少不是整份文稿都用 Pro。
标题页用 Pro,任何带着一个词或者需要语言替换的图也用 Pro。每一张分隔页、纹理和背景用 Lite,因为那些图里没有文字、没有产品、没有主张,也没有任何东西是更便宜的模型会做得明显更差的。
分辨率的账也是同样走向。一台会议室投影仪跑的是 1920×1080,所以给一张投影出去的幻灯片上 4K,是您付了钱又扔掉的像素——Nano Banana 2 的 4K 是 $0.08,对上 1K 的 $0.04。为印刷版会刊上 4K。不为投影上。
在这一切变成一条流水线之前,有一条条款要读。SynthID 搭在每一份 Google 图像输出里一起走——那是 Google 自己的来源标记,在画面里不可见,而且没有作为参数暴露给我们,也没有暴露给任何其他转售那个 API 的人。代理商和企业的交付条款有时禁止交出带 watermark 的素材。请在合作的第一周问,别等到文稿要交付的那一周。
逐档拆解是另一篇,给那些想要通用答案而不是我们这份针对文稿的意见的人:Nano Banana 模型对比。想按活儿而不是按名字来挑,从 text-to-image 开始;上面引用的价格和默认值都写在我们目录里各个模型自己的页面上。
常见问题
做专业演示文稿你们用什么 AI 工具?
对一份文稿的视觉表面——章节分隔页、背景、纹理和标题页主视觉——图像生成 API 是对的工具,我们大部分用每次 request $0.0238 的 Nano Banana 2 Lite,任何带可读文字的用 $0.075 的 Nano Banana Pro。对文稿的内容——图表、架构图、地图、产品截图——请用真正持有数据或真实事物的那个工具,因为生成出来的版本是看着很权威的编造信息。
AI 能生成我演示文稿里的图表吗?
它能产出一个看起来完全像图表的东西,而里面每一个数值都是捏造的。那是您能放上一张商业幻灯片的最危险的东西,因为观众会把它当证据读。请在一个连着您真实数字的工具里做图表,把图像生成留给那页上不承载任何主张的部分。
哪个 AI 模型能在标题页上渲染可读的文字?
Nano Banana Pro,gemini-3-pro-image,是为可读、带样式、多语言的图内文字而造的那一档,截至 2026 年 8 月 26 日,在我们 API 上每次 request $0.075。Nano Banana 2 也渲染图内文字,处理单个短词还算过得去。初代 Nano Banana 完全做不到,因为那项能力是随 Gemini 3 这一代到来的。
AI 幻灯片配图该用什么 aspect ratio?
请在每一次 request 上把 aspect_ratio 显式设成 16:9。我们在 Nano Banana 2、Nano Banana Pro 和 legacy 模型上的默认值是 9:16——竖版——而 Nano Banana 2 Lite 默认 1:1,所以一个没钉死的 request 每一次都会给您一个对幻灯片来说错误的形状。出血横幅条用 21:9。
给一整份文稿生成配图要多少钱?
一份四十页的文稿,每个章节分隔页一张图再加一张标题主视觉,大约是十二张图。按 Nano Banana 2 Lite 的 $0.0238 算大约 $0.29;按 Nano Banana Pro 的 $0.075 算是 $0.90。就算每张图允许重摇三次,整份文稿也比一份图库照片的授权便宜。
我怎么让 AI 图像在整份演示文稿里保持一致?
先生成一张您满意的图,然后在之后每一次 request 上把那张图作为风格参考传进去,而不是再用文字把那个样子描述一遍。Nano Banana 2 最多接受十四张参考图,而 Nano Banana Pro 在它的十四个槽位里专门留出最多三个给风格参考。把一种风格用文字分别描述四十遍,产出的是四十种略有不同的风格。