根据文本提示词生成海报、标志和以字体排版为核心的图像。
Vidu Q2 Text to Image 根据文本指令生成静态图片。提示词用于描述主体、场景、构图、光线与风格;本页面另外提供宽高比、输出分辨率和随机种子控制。
这个端点只支持文生图,schema 中没有参考图、反向提示词、视频或音频输入。
| 参数 | 类型 | 默认值/范围 | 说明 |
|---|---|---|---|
| prompt | string | 必填; 最多 1500 个字符 | 描述要生成的图片。 |
| aspect_ratio | string | 可选; 默认: 16:9; 可选值: 16:9, 9:16, 1:1 | 输出图片的宽高比。 |
| resolution | string | 可选; 默认: 1080p; 可选值: 1080p, 2k, 4k | 请求的输出分辨率。 |
| seed | integer | 可选; 默认: 0 | 用于改变或对比生成结果的随机种子。 |
aspect_ratio:横向版式用 16:9,竖向版式用 9:16,方形素材用 1:1。resolution 只能使用 1080p、2k 或 4k。主体与动作,环境,构图或镜头角度,光线,材质,配色,视觉风格
例如:哑光钴蓝色无线耳机置于白色亚克力台面,居中产品摄影,柔和顶光,清晰阴影,克制的编辑风格。
在适合的情况下,可先用默认 1080p 设置迭代提示词;如果最终候选需要更高分辨率,再请求 2k 或 4k。提示词不超过 1500 个字符,并且只使用文档中列出的枚举值。
可在 RunComfy 界面中试用 Vidu Q2 Text to Image 模型。商用前,请查看当前的模型提供方与 RunComfy 条款,并确认你对提示词和生成结果拥有必要权利。
根据文本提示词生成海报、标志和以字体排版为核心的图像。
根据必填提示词和一张必填源图像,创建下一场景的编辑图像。可选六种输出尺寸,并可设置 2–50 步推理、0–20 的引导强度(默认值:6)、1–4 张结果、随机种子以及 JPEG 或 PNG 输出。
快速生成文本到图像,具有清晰的细节和准确的图像内文本。
支持文字控制图像编辑,具备风格记忆与多层细化能力
根据必填提示词调整一张源图的镜头角度或进行其他编辑,并可设置六种输出尺寸、推理步数、引导强度、1–4 张结果图以及 JPEG/PNG 输出。
根据文字指令编辑或转换 1–10 张参考图片,并精确设置尺寸、背景、质量、输入保真度与输出格式。
它根据文本提示词生成静态图片。这个页面还可以设置 aspect_ratio、resolution 和 seed。宽高比可选 16:9、9:16 或 1:1,分辨率可选 1080p、2k 或 4k。
在条件允许时使用相同的提示词、宽高比、分辨率和随机种子,再比较提示词遵循度、构图、细节与一致性。本页面没有提供 Vidu Q2 相对 Vidu Q1 的经过验证的速度或质量基准,因此应使用自己的内容测试,而不是默认它在所有场景下都更好。
本页面没有承诺无限免费生成或固定期限的促销额度。积分、价格与资格可能变化,规划使用前请以 RunComfy 账号中显示的最新信息为准。
它适合需要用提示词生成静态图片的创作者、设计师、营销人员和制作团队,可用于概念图、故事板、营销草稿、产品视觉和版式探索。请根据最终用途选择宽高比与分辨率。
resolution 可选 1080p、2k 或 4k,默认 1080p;aspect_ratio 可选 16:9、9:16 或 1:1,默认 16:9。API 请求中必须使用这些准确值。
不可以。本页面的 schema 没有图片输入,只接受 prompt、aspect_ratio、resolution 和 seed。如需用一张或多张现有图片引导结果,请使用单独的 Vidu Q2 Reference to Image 模型。
你可以通过 RunComfy 的浏览器界面使用这个模型。页面记录的字段也是接入对应服务时需要验证的值;可用性与账号限制请以当前产品界面显示的信息为准。
提示词的说明上限为 1500 个字符;宽高比和分辨率只能使用列出的枚举值;seed 必须是整数。这个端点没有参考图、反向提示词、视频或音频字段。
本页面不保证固定渲染时间。完成速度可能受请求分辨率、模型提供方负载与账号条件影响。如果延迟很重要,请在自己的工作流中分别测试有代表性的 1080p、2k 和 4k 请求。
RunComfy 是首选的 ComfyUI 平台,提供 ComfyUI 在线 环境和服务,以及 ComfyUI 工作流 具有惊艳的视觉效果。 RunComfy还提供 AI Models, 帮助艺术家利用最新的AI工具创作出令人惊叹的艺术作品。





