海报和人像的失败方式不一样。插图弱一点,图还是有人看;字写错了,整张图就废了。Google 把文字本身的写法规则公布了出来,而这恰恰是大多数提示词合集跳过的一段。

Nano Banana Pro 海报与信息图文字:先给结论

先写文案,再写它长什么样,最后写版式。Google 自己的建议只有一句话:「Clearly state what text should appear and how it should look.」

三项里少写任何一项,模型都会替你编,包括拼写。

Google 说模型在文字上能做什么

模型页用使用场景开头:模型可以「generate clear text for posters and intricate diagrams, then translate your designs for different locales」。

字体这件事它也给了一句:「Describe what type of font you want, or simulate different types of handwriting.」

提示词指南的第一条技巧说的是同一件事:清晰易读的文字,才让「impactful posters, intricate diagrams, and even detailed product mockups」成立。

然后局限章节把它压了回来。渲染「small text, fine details, and producing accurate spellings may not work perfectly」。

老实的读法是:大字、刻意设计的字,模型很强;小字、附属说明,不可靠。所以把大字留给关键信息,小字全部当成需要复核的内容来对待。

先写出文字本身,再描述它的样子

每个文字元素写四件事:确切的字符串、字体或气质、字重或颜色、摆在哪个位置。指南的示例就是为一个标题把这四项全写齐了。

把字符串用引号框住,比任何形容词都重要。引号告诉模型这些字符是内容,不是描述。

字符串尽量短。一个十二个字的标题出错的位置,比一整个句子少得多;官方海报示例给的也都是标语,不是段落。

给版式一个编号结构

一堵文字墙首先是版式问题,其次才是渲染问题。Google 自己的图表提示词就是靠编号来对付它的。其中一条要求做平铺摄影,并让「simple, numbered labels—“01”, “02”, “03”, “04” - mark each stage of the process」。

另一条用箭头搭出流向:画面叙事「flows from left to right in clear steps」,用黑色手绘箭头把视线从太阳引到房子。两个习惯都值得抄:先给每个区块编号,再说明读者的目光往哪个方向走。

需要多个画面时,一次只要一个。官方有两条提示词就是这么写的:一条明确要四张独立的图,并声明合成一张不算;另一条要十版,写法是「one at a time, each it’s own server call」。

案例:三个可以直接照抄的版式

三个提示词都建在 Google 公布的句子上。哪些是模型自己的示例、哪些是你需要提供的场景,都标在注释里。

一张示意图:竖向信息图版式,四个带边框的区块承载图表,另有一块图像网格。
本站自绘示意图,非官方示例,由 AI Tool Blog 编辑部制作 AI Tool Blog

案例一:一张流程信息图

起点:一个能用四步讲完的流程,且没有必须精确的数字。

Create an infographic that shows how to make elaichi chai. Flat lay photography on a clean light gray background. Numbered labels "01", "02", "03", "04" mark each stage, and simple hand-drawn arrows guide the eye from left to right. All text in a clean sans-serif font, correctly spelt. Format 16:9

第一句是 Google 模型页原文。其余部分照搬了它另外几张图表示例里「编号 + 箭头」的做法。在图片公开之前一定先核对拼写,拼写准确是官方写明的弱项。

案例二:一张要在另一个语言市场用的海报

起点:一个海报概念,要投两个市场,标语一个字都不能变。

Create a poster ad for a sparkling water called 'Aura Fizz'. The setting is a London street at dusk with neon lights. The tagline should be "Taste the Aura". The can design should be minimalist. Make the aspect ratio 16:9.

然后对同一张图再做一轮:Localize this concept to a Japan setting, keep the can exactly the same, making sure to translate the words "Taste the Aura" accurately and authentically

两条指令都是 Google 原文。本地化那一轮是最容易出语法问题的地方,发布前请母语者把标语读一遍。

案例三:带事实约束的数据信息图

起点:一个数字写错比不写更糟的题目。

A scientifically accurate cross-section diagram of the topic in the attached reference. Keep every label short and legible, use numbered callouts, and add no figure that is not in the source. Format 16:9

开头那个短语来自 Google 对「事实约束」给出的示例。指南同时警告:你的输入本身也必须是事实,因为模型只会照着画。

有一个前提要说明白:剖面图几乎全是细节,而细节是模型页写明的弱项。

数字承担含义时,逐个核对

信息图靠的是可信度。一张小数点挪了位的图表,比没有图表更糟。

Google 说得很清楚,这件事没有解决。生成信息图、给图表做标注、展示复杂数据时,模型「may misinterpret information or produce factually incorrect results」。

接下来的流程很短。不要让模型去找数字,把数字写进提示词或附上的参考图,然后从成品里逐个读回来。

再把小字念一遍。小字是官方记录的失败模式,而最先糊掉的总是单位、免责声明或者来源行。分辨率救不了这些,官方提供 1K、2K、4K 三档输出,但没有任何一档能把模型没画对的字形修回来。

提示词框架的其余部分,Nano Banana Pro 提示词指南讲得更全,上手教程说了从哪里开始。修图那一篇处理手上已有的图片,Nano Banana Pro 与 Nano Banana 的对比说明两代模型的区别。想用代码做同样的事,接着看 API 指南

常见问题

标题真能拼对吗? 短的字符串通常可以。拼写准确被列为弱项,所以放大到原尺寸逐个词读一遍。

海报是中文的,提示词要用英文写吗? 不一定。英文指令加引号里的目标语言字符串就能用,模型页也展示了为不同语言市场改写的设计。

一张信息图放几个区块合适? 少到仍然可读为止。Google 自己的图表示例用了四个编号阶段,这个量可以当作上限。

提高分辨率能救小字吗? 不能。1K、2K、4K 都能出,但分辨率修不好一个模型本身就没画对的字形。

自己把字写好,再让模型去画。