Nano Banana Pro 是一个基于 Gemini 3 的图像生成与编辑模型,面向需要精细控制和高质量视觉结果的创意工作流。它不仅可以根据提示词生成图像,也能围绕已有图像调整文字、视角、景别、色彩、光线、分辨率和画面比例。官网展示的案例覆盖海报、信息图、产品原型、品牌设计、建筑可视化、时尚摄影、故事分镜以及真实感风景、植物、人物和动物等场景,重点体现了对文字、参考图、主体关系和视觉细节的处理能力。
核心功能
生成清晰可读的图像文字
Nano Banana Pro 可以生成适合海报、复杂图表和产品模型的清晰文字。使用者可以在提示词中描述字体类型,也可以要求模拟不同的手写风格。官网示例包括把木材排列成完整句子、将建筑外立面组合成“BERLIN”、制作复古风格的“TYPOGRAPHY”字样,以及让拟声词的字母形状表达“CRASH”“WHOOSH”等词义。示例还展示了将食物本身组成“MINT”“SOUP”“SUSHI”等单词的设计方式。
利用现实世界知识制作信息图
模型可以使用现实世界知识和深度推理能力,生成带有注释、数据表达或手写笔记转图表的图像。官网案例包括太阳能系统流程图、植物养护信息图、豆蔻茶制作步骤图,以及解释光和色彩理论的棱镜示意图。相关结果可以把主题拆成步骤、流程、标签和说明,适合将知识内容组织成易于理解的视觉呈现;示例中还出现了基于太阳能资料和牛顿光色理论资料制作画面的提示词。
翻译与本地化视觉内容
在保留原有设计概念的基础上,模型可以生成本地化文字,或翻译图像中的文字。官网演示了把饮料罐上的英文翻译成韩文,同时保持其他设计内容不变;也展示了将同一款饮料广告分别本地化到伦敦、墨西哥和日本,以及把英国咖啡店场景调整为德国场景,并将菜单和广告文字翻译为德语。这个功能面向国际市场视觉测试、广告适配和不同地区的海报或信息图制作。
从草图和参考图发展设计
Nano Banana Pro 可以把涂鸦转化为产品,把草图转化为物体,也可以把想法发展为三维建筑渲染。官网案例包括依据“WAVE”草图生成流体字标,并进一步制作包袋、咖啡杯、T恤和街头海报等品牌应用;还展示了根据汽车线稿与纸扇参考图生成纸质纹理的写实汽车,以及把椅子草图与彩色复古汽车的颜色和纹理结合,生成写实椅子。建筑案例则从“Cliff Side Pods”草图出发,生成白色黏土模型、微缩场景、金属走道特写和悬崖日落渲染等不同设计过程画面。
控制构图、光线、色彩和镜头
模型支持通过提示词调整图像中的拍摄角度、景别和景深,包括广角、全景和特写等方式。官网示例展示了从人物面部特写扩展为演唱会人群中的宽幅画面、改变焦点使人脸或手部清晰、将森林中的人物调整为远景,以及把黄昏场景改为白天、把场景转换为夜晚、用散景替换体积光、生成强烈的明暗对照光影。由此可以针对同一场景进行视角、焦点、时间、照明方向和氛围的多种尝试。
放大、改比例并保持主体一致
Nano Banana Pro 提供 1K、2K 和 4K 分辨率的清晰视觉生成能力,也支持将图像放大并保持 16:9 画面比例。官网案例包括对蒸汽朋克飞艇插画、粉色云朵中的宇航员以及露珠蜘蛛进行不同程度的近距离放大,呈现人物装备、机械结构、蜘蛛腿部纹理和水滴等细节。模型还可以调整为 1:1、4:3、5:3、1.85:1、2.39:1、2.75:1、4:1、9:16 和 1:4 等比例,并在示例中要求缩减或扩展背景,同时锁定角色位置。
使用方式
官网正文主要通过自然语言提示词展示使用方式:使用者可以描述要生成的图像,也可以提出对已有画面的修改要求,例如改变景别、焦点、时间、光线、颜色、画面比例或将多张参考图组合成一个场景。正文展示了连续生成多个画面、逐张制作分镜、一次生成多个设计选项等工作流,但没有说明具体客户端、浏览器插件、命令行、API、注册要求或模型密钥要求。
适用人群与场景
平面与品牌设计人员可以用它从草图发展字标、产品应用和广告样机;广告与国际市场团队可以测试不同国家和语言的包装、饮料广告、数字屏幕与户外海报;建筑与产品设计人员可以将线稿转为汽车、椅子和建筑的三维视觉方案;摄影、影视和概念艺术创作者则可以调整镜头、焦点、光影、色彩与景别,制作场景合成、时尚编辑画面、科幻景观和故事分镜。需要保持多个角色或物体关系的创作者,还可以参考官网展示的角色一致性与场景合成流程。
注意事项
正文没有提供价格、免费额度、付费档位、注册方式或具体输出限制,因此无法根据官网正文判断是否需要付费或如何计费。主体一致性示例明确提到单个工作流最多保持五个角色和十四个物体的忠实度;分辨率示例列出 1K、2K 和 4K;部分宽高比示例要求通过缩减或扩展背景来保持角色位置不变。