logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Nano Banana 2 文生图:提示词驱动的高速图像生成(宽高比·安全控制)| RunComfy

google/nano-banana-2/text-to-image

使用 Nano Banana 2 从文本提示词生成高质量图像,提供宽高比、安全容忍度、输出格式和可选提示词增强的实用控制。

用于图像生成的提示词。
生成图像的宽高比。
生成图像的分辨率。
Idle
The rate is $0.063 per image for 1K. 0.5K is $0.041, 2K is $0.10, and 4K is $0.13.

Nano Banana 2 简介

Nano Banana 2 是一款专为快速迭代和精准提示词追随设计的高速模型。它能将简短或详细的提示词转化为高质量图像,同时提供生产工作流中可依赖的实用控制——宽高比选择、安全容忍度、输出格式和可选的提示词增强。

适用场景:快速概念探索 | 营销创意草稿 | 社交媒体图像和缩略图 | 批量变体生成

Nano Banana 2#


Nano Banana 2(Gemini 3.1 Flash Image)是 Google DeepMind 的 Flash 级别图像生成模型,专为高速视觉创作而设计,具备精确的指令追随、出色的排版渲染和现实世界知识集成。


Nano Banana 2 文生图将单个文本提示词转化为 1 张图像,支持通过种子控制进行可重现生成,以及 0.5K 到 4K 的灵活分辨率层级。针对快速迭代、可预测的构图和可用于生产的输出进行了优化。


输出格式:png、jpeg 或 webp。输出:静态图像(批次大小:1)。


Nano Banana 2 亮点#

  • 极速生成:专为快速草稿→精修循环和低延迟而设计。
  • 种子可重现:用固定种子锁定视觉方向,或更改种子探索新变体。
  • 灵活分辨率层级:根据工作流阶段选择 0.5K / 1K / 2K / 4K。
  • 智能宽高比处理:用 "auto" 保留原始比例,或明确控制构图。
  • 出色的排版渲染:生成图像内可读文本和结构化布局。
  • 可选的网络搜索增强:启用网络搜索以获取最新参考信息。

Nano Banana 2 参数#

以下控制项可用于 Nano Banana 2 文生图。


参数必填类型默认值范围 / 选项说明
prompt*是 (*)string (str)A cinematic close-up portrait...—描述被写体、场景、光照、风格和构图的文本提示词。
aspect_ratio否stringautoauto, 21:9, 16:9, 3:2, 4:3, 5:4, 1:1, 4:5, 3:4, 2:3, 9:16构图。"auto" 保持自然构图。
resolution否string1K0.5K, 1K, 2K, 4K目标分辨率。越高细节越丰富。

分辨率与生成策略#

  • 0.5K–1K:适合快速草稿和布局测试。
  • 2K:社交媒体和营销视觉的均衡之选。
  • 4K:用于印刷或主横幅的高精细生产输出。

创意阶段用低分辨率×多种子尝试,构图确定后再提升分辨率。


如何使用 Nano Banana 2#

1) 编写结构化提示词:被写体 → 动作 → 环境 → 风格 → 相机/光照。

2) 根据最终交付物设置 aspect_ratio(或保持 "auto")。

3) 根据草稿 vs. 正式生产选择分辨率。

4) 需要可重现结果时固定种子。

5) 生成 1 张图像,检查构图、光照和排版。

6) 通过调整小变量(姿势、颜色、氛围)迭代,而非重写整个提示词。


提示词最佳实践#

  • 从主要被写体和动作开始。
  • 明确指定相机角度和光照。
  • 排版指令要精确。
  • 避免矛盾的风格指向。
  • 精修概念时使用一致的种子。

官方资源#

  • Gemini API 图像生成文档:https://ai.google.dev/gemini-api/docs/image-generation
  • Build with Nano Banana 2:https://blog.google/innovation-and-ai/technology/developers-tools/build-with-nano-banana-2/
  • Gemini 图像生成概览:https://gemini.google/overview/image-generation/

相关模型

gpt-4o-image/edit

根据提示词编辑图像,可选使用遮罩,并设置宽高比。

seedream-4-5/edit-sequential

上传 1~14 张参考图,按文字指令进行编辑,并设置最多 15 张序列输出。

flux-2/turbo/text-to-image

Flux 2 Turbo Text to Image 可根据文字快速生成高质量图像,并控制提示词遵循度、随机种子、宽高比和输出格式。

ideogram-v3/replace-background

使用 Ideogram 3 根据提示词替换图像背景。

z-image/turbo/controlnet/lora

根据一张控制图片生成新图,支持最多 3 个 LoRA、4 种预处理模式、分阶段 ControlNet 控制及 1–8 个推理步。

wan-2-2/flash/text-to-image

根据必填提示词生成图像。可设置选填反向提示词、15 种输出尺寸、Magic Prompt 扩写和随机种子。

常见问题

Nano Banana 2 文生图最适合什么场景?

Nano Banana 2 文生图专为快速迭代和稳定的提示词追随而设计,非常适合快速概念探索、营销创意草稿、缩略图以及批量生成多种变体。

Nano Banana 2 文生图支持哪些宽高比?

Nano Banana 2 文生图支持常见的宽高比,包括 21:9、16:9、3:2、4:3、5:4、1:1、4:5、3:4、2:3 和 9:16。请选择与目标布局(横幅、方形帖子、故事等)匹配的比例。

每次请求可以生成多少张图像?

Nano Banana 2 文生图支持每次请求生成 1-4 张图像。如需更多变化,可保留相同提示词,使用不同的种子或稍作修改后重新生成。

enhance_prompt 有什么作用?

启用后,enhance_prompt 会尝试扩展或优化你的提示词,以提高描述力和连贯性。如果你更喜欢精确控制,请将其关闭,自己明确指定被写体、风格、光照和构图等约束。

有哪些输出格式可用?

Nano Banana 2 文生图可以输出 jpeg、png 或 webp 格式的图像。png 适合清晰的图形和文字,jpeg 适合较小的文件,webp 则在质量和大小之间提供了良好的平衡。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Seedance 2.5 Reference to Video 1080p
  • Seedance 2.5 1080p Text to video
  • Seedance 2.5 1080p
  • MiniMax H3 Open
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • 查看所有模型 →
图像模型
  • Qwen Image 3.0 Edit
  • Qwen Image 3.0 Pro Edit
  • Qwen Image 3.0
  • seedream 4.0
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

Nano Banana 2 示例