根据提示词编辑图像,可选使用遮罩,并设置宽高比。
Nano Banana 2(Gemini 3.1 Flash Image)是 Google DeepMind 的 Flash 级别图像生成模型,专为高速视觉创作而设计,具备精确的指令追随、出色的排版渲染和现实世界知识集成。
Nano Banana 2 文生图将单个文本提示词转化为 1 张图像,支持通过种子控制进行可重现生成,以及 0.5K 到 4K 的灵活分辨率层级。针对快速迭代、可预测的构图和可用于生产的输出进行了优化。
输出格式:png、jpeg 或 webp。输出:静态图像(批次大小:1)。
以下控制项可用于 Nano Banana 2 文生图。
| 参数 | 必填 | 类型 | 默认值 | 范围 / 选项 | 说明 |
|---|---|---|---|---|---|
| prompt* | 是 (*) | string (str) | A cinematic close-up portrait... | — | 描述被写体、场景、光照、风格和构图的文本提示词。 |
| aspect_ratio | 否 | string | auto | auto, 21:9, 16:9, 3:2, 4:3, 5:4, 1:1, 4:5, 3:4, 2:3, 9:16 | 构图。"auto" 保持自然构图。 |
| resolution | 否 | string | 1K | 0.5K, 1K, 2K, 4K | 目标分辨率。越高细节越丰富。 |
创意阶段用低分辨率×多种子尝试,构图确定后再提升分辨率。
1) 编写结构化提示词:被写体 → 动作 → 环境 → 风格 → 相机/光照。
2) 根据最终交付物设置 aspect_ratio(或保持 "auto")。
3) 根据草稿 vs. 正式生产选择分辨率。
4) 需要可重现结果时固定种子。
5) 生成 1 张图像,检查构图、光照和排版。
6) 通过调整小变量(姿势、颜色、氛围)迭代,而非重写整个提示词。
根据提示词编辑图像,可选使用遮罩,并设置宽高比。
上传 1~14 张参考图,按文字指令进行编辑,并设置最多 15 张序列输出。
Flux 2 Turbo Text to Image 可根据文字快速生成高质量图像,并控制提示词遵循度、随机种子、宽高比和输出格式。
使用 Ideogram 3 根据提示词替换图像背景。
根据一张控制图片生成新图,支持最多 3 个 LoRA、4 种预处理模式、分阶段 ControlNet 控制及 1–8 个推理步。
根据必填提示词生成图像。可设置选填反向提示词、15 种输出尺寸、Magic Prompt 扩写和随机种子。
Nano Banana 2 文生图专为快速迭代和稳定的提示词追随而设计,非常适合快速概念探索、营销创意草稿、缩略图以及批量生成多种变体。
Nano Banana 2 文生图支持常见的宽高比,包括 21:9、16:9、3:2、4:3、5:4、1:1、4:5、3:4、2:3 和 9:16。请选择与目标布局(横幅、方形帖子、故事等)匹配的比例。
Nano Banana 2 文生图支持每次请求生成 1-4 张图像。如需更多变化,可保留相同提示词,使用不同的种子或稍作修改后重新生成。
启用后,enhance_prompt 会尝试扩展或优化你的提示词,以提高描述力和连贯性。如果你更喜欢精确控制,请将其关闭,自己明确指定被写体、风格、光照和构图等约束。
Nano Banana 2 文生图可以输出 jpeg、png 或 webp 格式的图像。png 适合清晰的图形和文字,jpeg 适合较小的文件,webp 则在质量和大小之间提供了良好的平衡。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。









