logo
RunComfy
  • ComfyUI
  • 训练器新
  • 模型
  • API
  • 定价
discord logo
模型
探索
所有模型
资源库
生成记录
模型 API
API 文档
API 密钥
账户
使用情况

Vidu Q2 文生图:1080p、2k 与 4k 图片生成 | RunComfy

vidu/q2/text-to-image

根据文本生成静态图片,并明确控制宽高比、1080p 至 4k 分辨率和随机种子。

用于图片生成的文本提示词,最多 1500 个字符。
输出图片的宽高比,可选 16:9、9:16 或 1:1。
输出图片分辨率,可选 1080p、2k 或 4k。
用于改变或对比生成结果的整数随机种子。
Idle
The rate is $0.03 per image.

Vidu Q2 文生图简介

Vidu Q2 Text to Image 根据文本提示词生成静态图片。这个 RunComfy 页面只有四个输入:`prompt`、`aspect_ratio`、`resolution` 和 `seed`。你可以选择 16:9、9:16 或 1:1 宽高比,并请求 1080p、2k 或 4k 输出。这个端点不接受参考图;如需用现有图片引导结果,请使用单独的 Vidu Q2 Reference to Image 模型。

Vidu Q2 文生图概览#


Vidu Q2 Text to Image 根据文本指令生成静态图片。提示词用于描述主体、场景、构图、光线与风格;本页面另外提供宽高比、输出分辨率和随机种子控制。


这个端点只支持文生图,schema 中没有参考图、反向提示词、视频或音频输入。


输入参数#


参数类型默认值/范围说明
promptstring必填; 最多 1500 个字符描述要生成的图片。
aspect_ratiostring可选; 默认: 16:9; 可选值: 16:9, 9:16, 1:1输出图片的宽高比。
resolutionstring可选; 默认: 1080p; 可选值: 1080p, 2k, 4k请求的输出分辨率。
seedinteger可选; 默认: 0用于改变或对比生成结果的随机种子。

提示词指南#


  • 先写主体与动作,再补充场景、构图、光线、材质和风格。
  • 按最终用途选择 aspect_ratio:横向版式用 16:9,竖向版式用 9:16,方形素材用 1:1。
  • resolution 只能使用 1080p、2k 或 4k。
  • 对比或回看结果时,请同时记录随机种子、提示词和其他设置。
  • 避免相互矛盾的要求;如果两个视觉目标冲突,请明确优先级。
  • 这个端点没有参考图字段,因此关键主体特征与版式细节都需要直接写入提示词。

提示词结构示例#


主体与动作,环境,构图或镜头角度,光线,材质,配色,视觉风格


例如:哑光钴蓝色无线耳机置于白色亚克力台面,居中产品摄影,柔和顶光,清晰阴影,克制的编辑风格。


工作流#


在适合的情况下,可先用默认 1080p 设置迭代提示词;如果最终候选需要更高分辨率,再请求 2k 或 4k。提示词不超过 1500 个字符,并且只使用文档中列出的枚举值。


可在 RunComfy 界面中试用 Vidu Q2 Text to Image 模型。商用前,请查看当前的模型提供方与 RunComfy 条款,并确认你对提示词和生成结果拥有必要权利。

相关模型

ideogram-v4/text-to-image

根据文本提示词生成海报、标志和以字体排版为核心的图像。

qwen-edit-2509/lora/next-scene

根据必填提示词和一张必填源图像,创建下一场景的编辑图像。可选六种输出尺寸,并可设置 2–50 步推理、0–20 的引导强度(默认值:6)、1–4 张结果、随机种子以及 JPEG 或 PNG 输出。

gpt-image-2.5/flare/text-to-image

快速生成文本到图像,具有清晰的细节和准确的图像内文本。

flux-1-kontext/dev/image-to-image

支持文字控制图像编辑,具备风格记忆与多层细化能力

qwen-edit-2509/lora/multiple-angles

根据必填提示词调整一张源图的镜头角度或进行其他编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图以及 JPEG/PNG 输出。

gpt-image-1-5/image-to-image

根据文字指令编辑或转换 1–10 张参考图片,并精确设置尺寸、背景、质量、输入保真度与输出格式。

常见问题

Vidu Q2 Text to Image 可以做什么?

它根据文本提示词生成静态图片。这个页面还可以设置 aspect_ratio、resolution 和 seed。宽高比可选 16:9、9:16 或 1:1,分辨率可选 1080p、2k 或 4k。

应该如何比较 Vidu Q2 与较早的文生图模型?

在条件允许时使用相同的提示词、宽高比、分辨率和随机种子,再比较提示词遵循度、构图、细节与一致性。本页面没有提供 Vidu Q2 相对 Vidu Q1 的经过验证的速度或质量基准,因此应使用自己的内容测试,而不是默认它在所有场景下都更好。

Vidu Q2 Text to Image 可以免费使用吗?

本页面没有承诺无限免费生成或固定期限的促销额度。积分、价格与资格可能变化,规划使用前请以 RunComfy 账号中显示的最新信息为准。

这个 Vidu Q2 端点适合哪些人?

它适合需要用提示词生成静态图片的创作者、设计师、营销人员和制作团队,可用于概念图、故事板、营销草稿、产品视觉和版式探索。请根据最终用途选择宽高比与分辨率。

可以使用哪些输出分辨率和宽高比?

resolution 可选 1080p、2k 或 4k,默认 1080p;aspect_ratio 可选 16:9、9:16 或 1:1,默认 16:9。API 请求中必须使用这些准确值。

这个文生图端点可以添加参考图吗?

不可以。本页面的 schema 没有图片输入,只接受 prompt、aspect_ratio、resolution 和 seed。如需用一张或多张现有图片引导结果,请使用单独的 Vidu Q2 Reference to Image 模型。

可以在哪里使用 Vidu Q2 Text to Image?

你可以通过 RunComfy 的浏览器界面使用这个模型。页面记录的字段也是接入对应服务时需要验证的值;可用性与账号限制请以当前产品界面显示的信息为准。

主要输入限制有哪些?

提示词的说明上限为 1500 个字符;宽高比和分辨率只能使用列出的枚举值;seed 必须是整数。这个端点没有参考图、反向提示词、视频或音频字段。

Vidu Q2 处理请求有多快?

本页面不保证固定渲染时间。完成速度可能受请求分辨率、模型提供方负载与账号条件影响。如果延迟很重要,请在自己的工作流中分别测试有代表性的 1080p、2k 和 4k 请求。

关注我们
  • 领英
  • Facebook
  • Instagram
  • Twitter
支持
  • Discord
  • 电子邮件
  • 系统状态
  • 附属
视频模型
  • Runway Aleph 2
  • Wan 2.5
  • Wan 2.6 Flash
  • MiniMax H3 Max
  • Wan 3.0 Reference To Video
  • Seedance 2.5 Reference to Video 480p
  • 查看所有模型 →
图像模型
  • Wan 2.6 Image to Image
  • Seedream 5.0 Pro
  • Flux 2 Klein 9B
  • Nano Banana Pro
  • Nano Banana 2 Edit
  • Z Image Turbo LoRA
  • 查看所有模型 →
法律
  • 服务条款
  • 隐私政策
  • Cookie 政策
RunComfy
版权 2026 RunComfy. 保留所有权利。

RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。

使用 Vidu Q2 生成的创意示例