嘗試:
minimax-h3-open/reference-to-video
image-to-video

來自影像、視訊和音訊提示的視訊的開放權重參考。

minimax-h3-open/image-to-video
image-to-video

開放權重圖像到視頻,具有可選的最後一幀和原生立體聲音頻。

minimax-h3-open/text-to-video
text-to-video

開放式文字轉視頻,具有 480p/768p 和原生立體聲音頻。

flux-3/extend-video/draft
video-to-video

FLUX 3 Draft Extend: 720p 的快速低成本剪輯延續草稿

flux-3/keyframes-to-video/draft
image-to-video

FLUX 3 草稿關鍵影格:720p 快速多關鍵影格影片預覽

flux-3/first-last-frame-to-video/draft
image-to-video

FLUX 3 Draft FLF:720p 快速開始結束幀影片預覽

flux-3/image-to-video/draft
image-to-video

FLUX 3 Draft I2V:720p 快速靜態影片預覽草稿

wan-2-6/image-to-image
image-to-image

Wan 2.6 Image-to-Image:基於指令的AI,實現無縫視覺編輯和可擴展的風格適配

seedream-4-5/edit
image-to-image

使用 Seedream 4.5 Edit 圖片編輯轉換視覺內容,實現連貫的照片級真實圖像創建和精準的品牌一致性。

seedream-5.0-pro/image-to-image
image-to-image

由參考圖片引導的圖片編輯,支援版面控制、圖層分離和多語言文字

wan-2.7/image-to-video
image-to-video

將靜態畫面製作成動作流暢、音訊可控的影片。

wan-2-5/image-to-video
image-to-video

以 Wan 2.5 將靜態圖片快速轉為流暢動態影片,讓創作更具臨場感。

flux-3/text-to-video/draft
text-to-video

FLUX 3 Draft:快速、低成本的 720p 文字轉影片預覽

seedance-2.5/first-last-frame/480p
image-to-video

Seedance 2.5 FLF2V 480p:更低成本的首末幀草稿轉場

seedance-2.5/reference-to-video/480p
image-to-video

Seedance 2.5 Reference 480p:更低成本的多參考草稿影片

seedance-2.5/image-to-video/480p
image-to-video

Seedance 2.5 480p:快速、低成本的靜圖轉動畫草稿

seedance-2.5/text-to-video/480p
text-to-video

Seedance 2.5 480p:用提示詞快速、低成本生成文生影片草稿

flux-3/extend-video
video-to-video

透過場景一致的運動將現有剪輯延長到最終畫面之外

flux-3/keyframes-to-video
image-to-video

從具有可選音頻的多關鍵幀靜態圖像生成視頻

flux-3/first-last-frame-to-video
image-to-video

根據起始幀與結束幀生成可選原生音訊的過渡影片

flux-3/image-to-video
image-to-video

將起始靜幀動畫化為可選原生音訊的短影片

seedance-2.5/first-last-frame/720p
image-to-video

Seedance 2.5 First & Last Frame:將開始畫面與結束畫面銜接為流暢的電影級影片

flux-2/flash/edit
image-to-image

Flux 2 Flash Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。

nano-banana/pro/edit
image-to-image

使用Nano Banana Pro將草圖轉化為精確的2K-4K視覺效果,智慧校正與無縫創意控制。

seedream-4-0/edit
image-to-image

根據必填提示詞編輯或融合 1–10 張必填 JPEG 或 PNG 圖片。可選擇 `1K`、`2K`、`4K` 或八種固定解析度。

wan-2-6/flash/image-to-video
image-to-video

將靜態影像變成動作自然、對白同步且創作可控的逼真影片場景。

wan-2.7/edit
image-to-image

WAN 2.7 圖片編輯支援 1–4 張參考圖片的文字指令編輯,並提供選填的提示詞擴寫、中英文指令與預設輸出尺寸。

gpt-image-2/text-to-image
text-to-image

生成品牌視覺素材,準確呈現圖片內文字與 Logo。

qwen-image-edit-2511/lora
image-to-image

基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。

gpt-image-2/edit
image-to-image

OpenAI 的 GPT Image 2 影像編輯:透過精確的文字控制和輸入輸出繪畫進行影像到影像編輯

nano-banana-2/edit
image-to-image

使用 Nano Banana 2 Edit 進行提示詞驅動的圖像編輯,支援多圖輸入,並可控制寬高比、解析度、安全容忍度和輸出選項。

happyhorse-1.1/reference-to-video
reference-to-video

只要一段提示詞,即可根據參考圖生成流暢的 720P 或 1080P 影片。

seedance-v1.5-pro/text-to-video
text-to-video

根據文字產生 4–12 秒影片,支援 480p、720p、1080p、6 種長寬比,以及音訊和固定鏡頭設定。

hailuo-2-3/fast/standard/image-to-video
image-to-video

以Hailuo 2.3 Fast Standard輕鬆將靜態圖片轉化為流暢動態影片,展現真實創意。

seedance-2.5/image-to-video/720p
image-to-video

Seedance 2.5:將靜態圖片轉化為電影級 AI 影片

seedance-2.5/reference-to-video/720p
reference-to-video

Seedance 2.5 Reference to Video:依參考素材產生電影級 AI 影片

wan-2-6/text-to-video
text-to-video

根據文字提示詞生成 5 秒、10 秒或 15 秒影片,可加入來源音訊,並設定尺寸、鏡頭結構、反向提示詞、隨機種子、提示詞擴寫和生成音訊。

minimax-h3/text-to-video
text-to-video

MiniMax H3:768p/2K 文字轉視頻,附原生立體聲音訊

flux-2/dev/text-to-image
text-to-image

根據必填提示詞產生圖片,可從六種固定尺寸預設中選擇,並設定整數隨機種子;`seed` 預設值 `-1` 代表隨機取種。

minimax-h3/reference-to-video
reference-to-video

從圖像、視頻和音頻參考生成 768p 或 2K 視頻

flux-2/pro/edit
image-to-image

透過文字指令和最多 10 張來源圖片進行圖片編輯,並可選擇七種尺寸以及 JPEG 或 PNG 輸出。

wan-2-2/image-to-video
image-to-video

以 AI 精準轉換圖片為影片,結合高畫質、流暢動畫與創意控制

seedream-4-0/text-to-image
text-to-image

以直覺方式生成高畫質影像,支援多重輸入與創意融合功能

flux-2-klein/9b/text-to-image
text-to-image

高保真 4 步驟文字到圖像,具有清晰的文字渲染

kling-video-o3/pro/image-to-video
image-to-video

3–15s 專業級電影感圖片轉影片,輸出每秒 $0.112 起。

nano-banana/edit
image-to-image

依提示詞編輯或組合 1–10 張圖像,並設定長寬比、格式與輸出數量。

flux-2/turbo/edit
image-to-image

Flux 2 Turbo Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。

wan-2-6/image-to-video
image-to-video

使用Wan 2.6將靜態圖像轉換為動態同步的高清影片內容,支援靈活控制。

happyhorse-1.1/text-to-video
text-to-video

支援文字、圖片和參考素材輸入,並可同步產生原生音訊的多模態 AI 影片模型。

seedream-4-5/text-to-image
text-to-image

僅透過文字產生圖片,並可選擇 2K、4K 或 9 個固定尺寸。

seedream-5.0-pro/text-to-image
text-to-image

具備版面與圖層控制的文字轉圖片和圖片編輯模型

seedance-2.0/pro
text-to-video

生成 2K 電影感影片,支援精準口型同步與鏡頭控制。

happyhorse-1.0/video-edit
video-to-video

HappyHorse 1.0 Video Edit:阿里巴巴的 HappyHorse 1.0 視頻編輯器可以編輯輸入視頻,其中包含文本說明和參考圖像,以進行風格轉移、本地替換和服裝交換。

nano-banana/pro/text-to-image
text-to-image

依提示詞生成 1–4 張圖片,並設定寬高比、解析度、格式與回傳方式。

happyhorse-1.1/image-to-video
image-to-video

只要一段提示詞,即可將靜態照片變成流暢的 720P 或 1080P 影片。

wan-2-6/video-to-video
video-to-video

根據文字提示詞和 1~3 段參考影片生成影片,並可設定時長、輸出尺寸、鏡頭結構、隨機種子、反向提示詞和音訊生成。

seedance-v1.5-pro/image-to-video
image-to-video

使用 Seedance 1.5 Pro 將靜態圖像轉換為具有流暢、逼真過渡和創意靈活性的電影級影片剪輯。

z-image/turbo/text-to-image
text-to-image

依提示詞生成 1–4 張圖片,並可選擇長寬比、推論步數、隨機種子與檔案格式。

kling-video-o3/standard/image-to-video
image-to-video

以每秒 $0.084,將圖片製作成 3–15 秒影片。

nano-banana-2/text-to-image
text-to-image

使用 Nano Banana 2 進行快速、高品質的文字轉圖像,支援寬高比、安全容忍度和輸出格式控制。

minimax-h3/image-to-video
image-to-video

將第一幀圖像動畫化為 768p 或 2K 視頻,最長 15 秒

gemini-3-pro-image-preview/edit
image-to-image

依提示詞編輯或轉換最多 20 張參考圖片,並設定生成數量、格式、寬高比與解析度。

seedance-1-0/pro/fast/image-to-video
image-to-video

以Seedance 1.0 Pro Fast快速將靜態圖片轉化為流暢、真實的影片,讓創意設計更具故事感。

seedance-1-0/pro/image-to-video
image-to-video

以 AI 將靜態圖像轉化為動態影片,打造自然順暢的角色敘事效果。

qwen-image/text-to-image
text-to-image

支援中文的 AI 文字轉圖工具,精準生成高質感影像

seedream-4-5/edit-sequential
image-to-image

上傳 1~14 張參考圖片,依文字指令進行編輯,並設定最多 15 張序列輸出。

nano-banana-2-lite/edit
image-to-image

快速、低成本的提示詞圖片編輯模型,以固定 1K 解析度輸出。

wan-2.7/text-to-video
text-to-video

透過多組參考素材和影格控制生成 1080p 影片。

wan-2.7/reference-to-video
reference-to-video

將圖片或音訊參考製作成動作可精準控制的高畫質影片。

flux-2/flash/text-to-image
text-to-image

透過精細控制和可重現設定,快速產生準確的設計視覺。

ideogram-v4/text-to-image
text-to-image

根據文字提示詞生成海報、標誌與以字體排版為核心的圖片。

seedream-5/lite/text-to-image
text-to-image

Seedream 5.0 Lite 文字生成圖像:支援精確版面與字體排版控制的提示詞到視覺引擎

seedance-2.5/text-to-video/720p
text-to-video

Seedance 2.5:一致性更強、支援更長片段的電影級 AI 影片

nano-banana/text-to-image
text-to-image

以文字生成與編輯圖像,輕鬆打造品牌與故事的視覺設計

qwen-image-edit-2511
image-to-image

進階圖片編輯模型,可在精準修改畫面的同時維持幾何結構與主體一致性。

flux-3/image/coming-soon
text-to-image

FLUX 3 Image 是一款支援參考圖引導和清晰文字生成的多模態圖像模型

kling-3.0/standard/text-to-video
text-to-video

Kling 3.0:創作具有同步對話和一致角色的多場景電影。

seedance-2.0-mini/image-to-video
image-to-video

將起始圖片製作成帶有原生音訊的電影感短片。

kling-2-6/motion-control-pro
video-to-video

高保真電影感動作模型,可流暢移轉動作並靈活控制畫面。

qwen-image/edit
image-to-image

支援雙語文字處理與物件編輯,讓設計更自由直覺

qwen-image-2512
text-to-image

根據提示詞生成寫實圖片,精準呈現中英文文字,並維持均衡穩定的版面。

wan-2-2/text-to-video
text-to-video

使用 Wan 2.2 Plus 依提示詞生成 5 秒影片,並設定尺寸、隨機種子與提示詞擴充。

wan-2.7/pro/edit
image-to-image

WAN 2.7 Pro 圖片編輯支援 1–4 張參考圖片、提示詞擴寫和高品質指令編輯,操作欄位與標準編輯版本相同。

flux-2/pro/text-to-image
text-to-image

根據文字提示詞產生圖片,並可設定六種尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。

flux-2/dev/edit
image-to-image

根據最多三張來源圖片進行圖片編輯,並可調整引導強度、推理步數、輸出數量、提示詞擴充、尺寸、隨機種子和格式。

kling-video-o3/pro/video-to-video
video-to-video

Prompt-driven Pro-tier video editing at $0.168 per second.

sora-2/image-to-video
image-to-video

將靜態圖片轉化為細膩動態影片,享受真實音畫同步的創作體驗。

flux-1-kontext/pro/edit
image-to-image

使用 FLUX Kontext Pro 根據必填文字指令編輯一張必填圖片,並可設定種子和 9 種寬高比。

hailuo-2-3/fast/pro/image-to-video
image-to-video

將靜態影像轉化為流暢1080p影片,展現真實動感與創意自由

wan-2.7/edit-video
edit-video

透過 AI 轉換既有影片,同時維持動作穩定與設計一致。

kling-2-6/pro/image-to-video
image-to-video

將一張參考圖製作成 5 秒或 10 秒的影片,並可設定反向提示詞與原生音訊產生。

wan-2-2/lora/image-to-video
image-to-video

依提示詞讓起始圖像動起來,並設定 LoRA、影格數、FPS、解析度、長寬比、推論步數與隨機種子。

seedream-5/lite/edit
image-to-image

Seedream 5.0 Lite 將參考圖像轉化為版面精準、風格一致的設計,助力創意工作流程。

qwen-image-2512/lora
text-to-image

根據文字生成精緻圖像,透過精準細節與彈性風格控制服務設計工作流程。

hunyuan-video-v1.5/image-to-video
image-to-video

依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。

ace-step-1.5/text-to-audio
text-to-audio

根據風格標籤和歌詞生成最長 4 分鐘、帶人聲的歌曲。

veo-3-1/fast/image-to-video
image-to-video

Veo 3.1 Fast 以AI技術將影像瞬間轉化為動態影片,打造創意視覺作品。

wan-2-5/text-to-video
text-to-video

根據必填提示詞生成 5 秒或 10 秒影片。可新增選填 WAV/MP3 音訊、負面提示詞,並從 13 種輸出尺寸中選擇。

seedream-4-0/edit-sequential
image-to-image

以 Seedream 4.0 Edit sequential 實現連貫影像轉換,精準控制風格與細節,打造一致的創作流暢體驗。

kling-3.0/pro/image-to-video
image-to-video

Kling V3.0 系列中畫面品質與動作真實感最高的高階圖片轉影片模型。

q2/reference-to-image
image-to-image

根據提示詞和最多 7 張參考圖產生圖片,並可選擇長寬比、1080p 至 4k 解析度和隨機種子。

bytedance/upscale/video
video-to-video

將來源影片放大至所選目標解析度與影格率。

seed-audio-1.0/text-to-audio
text-to-audio

根據文字、參考音訊或圖片產生自然的語音與音訊。

wan-2-2/animate/video-to-video
video-to-video

使用參考圖與來源影片生成動畫影片,可選擇輸出尺寸並設定隨機種子。

hailuo-02/image-to-video
image-to-video

以 AI 智慧將靜態圖像轉化為高畫質動態影片,助力創意無限發揮

flux-2/lora
text-to-image

依文字生成圖片,並以個別權重組合最多 3 個 LoRA。

flux-1-kontext/max/edit
image-to-image

使用 FLUX Kontext Max 依提示詞編輯圖像,並設定隨機種子與 9 種長寬比之一。

kling-3.0/standard/image-to-video
image-to-video

透過攝影機和音訊控制將靜態照片轉變為影片動作剪輯。

gemini-omni-flash/reference-to-video
reference-to-video

根據參考影像和提示詞生成含同步音訊的短影片。

wan-2-6/text-to-image
text-to-image

將文字創意轉化為符合品牌調性的視覺內容,並精準控制畫面風格。

flux-2/max/edit
image-to-image

根據文字指令編輯 1–10 張參考圖片,並選擇固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。

gemini-omni-flash/video-edit
video-to-video

根據文字指令編輯來源影片,同時維持場景結構與動作連貫。

ai-avatar/v2/standard
image-to-video

使用一張人像和一段音訊產生口播數字人影片,並可透過提示詞引導動作與表達方式。

hailuo-02/pro/image-to-video
image-to-video

使用 Hailuo 02 Pro 依提示詞讓起始圖像動起來,生成 6 秒影片。

hailuo-2-3/standard/image-to-video
image-to-video

Hailuo 2.3 讓設計師輕鬆將靜態圖像轉化為逼真動態影片,精準掌控每個細節創意。

wan-2-2/first-last-frame
image-to-video

以雙影格技術生成高保真流暢影片,提升設計表現力與創作效率。

omnihuman/v1.5
image-to-video

根據一張必填人物圖片和一段 35 秒以內的必填音訊生成影片。可使用六種支援語言填寫選填生成指引,並設定預設值為 -1 的隨機種子。

cinematic-video-generator
text-to-video

達到 Seedance 2.0 水準的電影級影片生成,兼具出色的視覺保真度與自然的鏡頭運動

happyhorse-1.0/image-to-video
image-to-video

Alibaba 上的 HappyHorse 1.0 I2V 將靜態圖像動畫化為原生 1080p 視頻,具有物理精確的運動和身份穩定的主題。

flux-2/max/text-to-image
text-to-image

根據文字提示建立新圖片,可選擇 6 個固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。

grok-2/image
text-to-image

依照文字提示詞產生圖片,每次可輸出 1–10 張。

wan-2-2/fun-control
video-to-video

以首幀風格重塑整支影片,確保AI影像風格一致、創作更流暢。

flux-2-klein/4b/text-to-image
text-to-image

4 步亞秒級文字到圖像,具有即時準確的視覺效果

z-image/turbo/image-to-image
image-to-image

根據提示詞轉換一張輸入圖片,並可設定變換強度、尺寸、1–8 個推理步、隨機種子、提示詞擴寫以及 JPEG、PNG 或 WebP 輸出。

ace-step/audio-outpaint
audio-to-audio

在音軌開頭、結尾或兩端續寫風格一致的新內容。

gpt-image-1-5/image-to-image
image-to-image

根據文字指令編輯或轉換 1–10 張參考圖片,並精確設定尺寸、背景、品質、輸入保真度與輸出格式。

seedance-2.0/fast
text-to-video

透過多模態參考、口型同步與鏡頭控制,更快生成具有電影感的短片。

dreamina-3-0/image-to-video
image-to-video

利用Dreamina 3.0,將靜態影像即刻轉化為流暢2K影片,完美呈現細緻動態與真實光影。

sora-2/text-to-video
text-to-video

根據必填文字提示詞生成影音同步影片。輸出尺寸可選 `1280x720` 或 `720x1280`,時長可選 `4`、`8` 或 `12` 秒。

flux-3/text-to-video
text-to-video

FLUX 3 Video 可將文字提示詞生成帶原生音訊的電影感短片

wan-2.7/text-to-image
text-to-image

WAN 2.7 文字轉圖像:精準理解提示詞,提供多種尺寸預設,每次最多生成 5 張圖像

wan-2-1/image-to-video
image-to-video

以 AI 將靜態圖像轉換為流暢動態影片,呈現電影級畫面與真實運動感。

qwen-edit-2509/lora/edit-skin
image-to-image

編輯單張圖片的皮膚細節,並設定尺寸、步數、引導強度、生成數量、格式與隨機種子。

live-avatar
image-to-video

將靜態人像轉換成表情自然、栩栩如生且可精細控制的影片。

flux-2/flex/edit
image-to-image

透過提示詞編輯 1–10 張圖片,並調整尺寸、提示詞擴充、引導強度、步數、隨機種子與格式。

ltx-2/fast/image-to-video
image-to-video

根據起始圖片和提示詞生成 16:9 影片,可選擇時長、解析度、幀率以及是否產生音訊。

qwen-edit-2509/multi-image-edit-plus
image-to-image

根據 800 個字元以內的必填指令編輯 1–3 張必填來源圖片。可請求 1–6 張結果,新增 500 個字元以內的負面提示詞,並設定 0–2147483647 的隨機種子。

nano-banana-2-lite/text-to-image
text-to-image

快速、低成本的文字轉圖片模型,以固定 1K 解析度輸出。

kling-2-1/standard/image-to-video
image-to-video

使用 Kling 2.1 Standard 根據必填圖片和提示詞生成影片,並可設定時長、寬高比、負向提示詞和提示詞強度。

fantasy-portrait/image-to-video
image-to-video

結合必填的人像圖片、參考影片和提示詞,產生表情與動作自然的人像動畫。

gemini-3-pro-image-preview/text-to-image
text-to-image

根據必填提示詞產生 1–4 張圖片,並可選擇 10 種長寬比、1K/2K/4K 解析度、三種檔案格式和同步傳回模式。

wan-2.7/pro/text-to-image
text-to-image

WAN 2.7 Pro 文字生成圖片模型,操作方式與標準版相同,支援中英文提示詞,每次最多生成 5 張適合印刷與大型版面的高精細靜態圖片。

infinite-talk/image-to-video
image-to-video

以照片生成自然對話影片,呈現真實臉部動作與表情

qwen-edit-2509/lora/fusion
image-to-image

根據必填提示詞來組合或編輯 1–10 張來源圖片,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖、隨機種子以及 JPEG/PNG 輸出。

hailuo-2-3/pro/image-to-video
image-to-video

以智慧引擎將靜態圖像化為流暢 1080p 影片,細節逼真、創作靈活。

dreamina-3-0/pro/image-to-video
image-to-video

以 Dreamina 3.0 將靜態圖片動態化,快速生成高品質 2K 影片,展現真實細膩的視覺表現。

seedance-2.0-mini/video-to-video
video-to-video

根據文字提示詞改造來源影片,並支援原生音訊。

scail
video-to-video

將驅動影片中的動作轉移到參考角色圖片,同時盡量維持角色可辨識。

flux-1-schnell/text-to-image
text-to-image

支援快速文字轉圖像,適用創作者與設計師的靈活生成工具

dreamina-4-0/text-to-image
text-to-image

新一代AI工具,結合文字生成與精準影像編輯,創造高品質視覺作品。

z-image/turbo/inpainting
image-to-image

透過遮罩精準局部重繪,完成照片精修、物件修改與場景修復。

ltx-2/pro/image-to-video
image-to-video

根據提示詞讓必填來源圖片動起來,可精確選擇 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,並可產生音訊。

ideogram-v2/generate
text-to-image

使用 6 種風格和 11 種長寬比,產生包含文字設計的視覺圖片。

hailuo-2-3/pro/text-to-video
text-to-video

智慧AI影片創作工具,將文字轉化為1080p動態影像,輕鬆打造富有情感與張力的視覺故事。

qwen-edit-2509/lora
image-to-image

根據必填提示詞編輯 1–10 張來源圖片,並可視需要套用最多三個 LoRA 項目。可選擇六種輸出尺寸,並可設定推理步數、引導強度、1–4 張結果、隨機種子以及 Default、JPEG 或 PNG 輸出。

kling-video-o3/4K/image-to-video
image-to-video

電影感 4K 圖片轉影片,輸出每秒 $0.42。

veo-3-1/first-last-frame-to-video
image-to-video

以 AI 將靜態圖像轉化為動態影片,支援音效同步與場景銜接,提升創作真實感與效率

veo-3-1/fast/first-last-frame-to-video
image-to-video

以Veo 3.1 Fast 輕鬆將影像轉為動態影片,展現創意視覺與專業級畫面品質。

kling-2-1/master/image-to-video
image-to-video

以 Kling 2.1 將靜態圖片與文字提示轉化為高畫質動態影片,展現真實立體運動效果。

wan-2-2/lora/text-to-video
text-to-video

依提示詞生成影片,並設定 LoRA、解析度、長寬比、影格數、FPS、推論步數與隨機種子。

pixverse/v5.5/effects
image-to-video

使用 48 個效果預設之一為 1 張必填來源圖片製作動畫,並可設定解析度、片長、反向提示詞和提示詞最佳化。

kling-2-1/pro/image-to-video
image-to-video

使用 Kling 2.1 Pro 根據必填起始圖片和提示詞生成影片,並可設定選填結束圖片、時長、寬高比、負向提示詞和提示詞強度。

dreamina-4-0/edit
image-to-image

以 Dreamina 4.0 輕鬆完成高精度圖像轉圖像創作,呈現細膩且具風格的 4K 視覺效果,專為設計師而生。

hailuo-02/text-to-video
text-to-video

使用 Hailuo 02 根據一段必填文字提示詞生成 6 秒或 10 秒影片,並可選擇提示詞擴寫。

aurora
image-to-video

依照圖片、音訊和提示詞產生影片,並分別調整文字與音訊的引導強度。

ace-step/audio-inpaint
audio-to-audio

精確重製音軌中的指定片段,其餘部分保持不變。

kling-video-o3/pro/text-to-video
text-to-video

專業級電影感文字轉影片,輸出每秒 $0.112。

wan-2-2/text-to-image
text-to-image

使用 Wan 2.2 Plus 依提示詞生成圖像,並設定尺寸、隨機種子與提示詞擴充。

veo-3/image-to-video
image-to-video

以AI將靜態圖像轉為動態影片,具有風格控制與鏡頭運動功能,助你輕鬆展現創意。

kling-2-6/pro/text-to-video
text-to-video

輸入文字即可產生短影片,並可設定時長、長寬比與是否產生音訊。

wan-2-5/text-to-image
text-to-image

根據 2000 字元以內的必填提示詞生成圖片。可填寫選填負面提示詞,並從 13 種輸出尺寸中選擇。

kling-1-6/pro/image-to-video
image-to-video

精準提示理解、自然畫面運動與高畫質影像呈現,創造逼真AI影片。

hunyuan/image-to-video
image-to-video

以單張圖片輕鬆生成流暢影片,動作自然、轉場順暢,為創作者開啟更多靈感可能。

sync/lipsync/v2/pro
video-to-video

根據必填影片 URL 和音訊 URL 建立口型同步影片,並可從五種模式中選擇音影片時長不一致的處理方式。

flux-2/lora/edit
image-to-image

使用最多 3 張圖片與 3 個 LoRA 進行編輯,並可控制 6 個精確尺寸預設、提示詞引導強度、推理步數、隨機種子以及 JPEG、PNG 或 WebP 輸出。

kling-video-o3/pro/reference-to-video
reference-to-video

專業級參考圖生成影片,支援 3–15s 輸出,每秒 $0.112 起。

react-1
video-to-video

使用必填音訊驅動一段短片,並控制情緒、編輯範圍、音訊與影片時長不一致時的處理方式和表現力。

wan-2-2/fun-inpaint
image-to-video

從靜態影像創造流暢影片,精準控制動態過渡,讓創作更具電影感。

qwen-edit-2509/lora/next-scene
image-to-image

根據必填提示詞和一張必填來源圖片,建立下一個場景的編輯圖片。可選擇六種輸出尺寸,並可設定 2–50 步推理、0–20 的引導強度(預設值:6)、1–4 張結果、隨機種子以及 JPEG 或 PNG 輸出。

chrono-edit/lora/paintbrush
image-to-image

根據必填提示詞編輯一張來源圖片,並可設定選填遮罩、2–50 個推理步驟、480p/720p 解析度、隨機種子和三種輸出格式。

reve/edit
image-to-image

根據必填提示詞編輯一張必填參考圖片。可請求 1–4 張結果,選擇 PNG、JPEG 或 WebP 輸出,並可透過 `sync_mode` 返回 data URI。

kling-2-6/motion-control-standard
video-to-video

以 AI 精準移轉動作,快速產生穩定流暢的角色動畫。

seedance-2.0-mini/text-to-video
text-to-video

快速、低成本的多鏡頭 AI 影片模型,原生支援音訊和參考素材。

flux-2/flex/text-to-image
text-to-image

依文字生成圖片,並調整尺寸、提示詞擴充、引導強度、步數、隨機種子與格式。

infinite-talk/fast
audio-to-video

使用一段音訊與一張圖片生成影片,並可視需要設定提示詞與隨機種子。

z-image/turbo/inpainting/lora
image-to-image

透過遮罩精準局部重繪,並可疊加 LoRA,快速完成商品圖與創意圖片修改。

chrono-edit/lora
image-to-image

根據必填文字指令編輯一張必填圖片,並可設定提示詞擴寫、兩種輸出解析度、種子和輸出格式。

veo-3-1/extend-video
video-to-video

依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。

qwen-edit-2509/lora/inscene
image-to-image

依提示詞修改現有場景中的元素,並設定尺寸、步數、引導強度、生成數量、格式與隨機種子。

elevenlabs/music-generation
text-to-audio

透過提示詞創作歌曲,支援 44.1 kHz WAV 輸出與分段編輯。

flux-1-kontext/dev/image-to-image
image-to-image

支援多層次風格控制與物件替換,創作更靈活高效

happyhorse-1.0/text-to-video
text-to-video

HappyHorse 1.0 提供原生 1080p 輸出、電影級運動與多鏡頭一致性。

gemini-omni-flash/image-to-video
image-to-video

將一張靜態影像生成含同步音訊的短影片。

video-background-removal/fast/video-to-video
video-to-video

使用 Fast 版本移除影片背景,並設定輸出編碼、前景邊緣細化與主體類型。

qwen-image-layered
image-to-image

將圖像分解成可編輯的 RGBA 圖層,實現精準物件隔離和靈活設計控制。

seedream-4-0/sequential
text-to-image

以文字生成連貫的視覺故事,維持風格一致與敘事節奏,激發設計創意。

ltx-2/pro/text-to-video
text-to-video

根據必填提示詞產生影片,可精確選擇 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,並可產生音訊。

luma-ray-2/image-to-video
image-to-video

以單張影像創造流暢生動畫面,讓創意轉化為電影級視覺,輕鬆展現專業作品。

kling-video-o3/4K/reference-to-video
reference-to-video

電影感 4K 參考圖生成影片,輸出每秒 $0.42。

qwen-edit-2509/lora/multiple-angles
image-to-image

根據提示詞調整一張必填的來源圖片的鏡頭角度或進行其他編輯,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖以及 JPEG/PNG 輸出。

pixverse/v5.5/image-to-video
image-to-video

以文字驅動起始圖片產生影片,並設定長寬比、解析度、時長、風格、音訊與多片段。

happyhorse-1.0/reference-to-video
reference-to-video

HappyHorse 1.0 參考影片將多達 9 個參考影像和提示融合成一個具有穩定身份的連貫多字元片段。

kling-2-5/turbo/image-to-video
image-to-video

以Kling 2.5 Turbo將靜態影像轉化為流暢電影級影片,創造細膩動態視覺。

kling-video-o1/image-to-video/reference
image-to-video

透過必填參考圖片與元素陣列生成影片,使用按順序編號的 @Image 和 @Element 標記,並精確控制片長與長寬比。

seedance-1-0/pro/fast/text-to-video
text-to-video

快速將文字轉化為影像的AI影片製作工具,為創作者提供靈活且高效的視覺敘事體驗。

kling-2-5/turbo/text-to-video
text-to-video

使用 Kling 2.5 Turbo 依提示詞生成影片,並設定時長、長寬比與負面提示詞。

video-background-removal/video-to-video
video-to-video

將影片中的人物或物體與背景分離,並設定輸出編碼、前景邊緣細化與主體類型。

seedance-1.0/text-to-video
text-to-video

使用 Seedance 1.0 依提示詞生成影片,並設定解析度、長寬比與時長。

veo-3-1/image-to-video
image-to-video

運用Veo 3.1將靜態影像轉化為流暢影片,展現真實動感與創意敘事力。

longcat-image/edit
image-to-image

根據文字提示詞編輯 1 張源圖片,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。

veo-3-1/reference-to-video
image-to-video

以 Veo 3.1 將靜態圖像轉換成流暢影片,快速呈現電影般的視覺效果,創作更高效。

flux-1-kontext/pro/text-to-image
text-to-image

高精準 AI 文字轉圖像工具,支援細節調整與靈活創作。

sora-2/pro/image-to-video
image-to-video

使用 Sora 2 Pro 依提示詞讓參考圖動起來,並選擇輸出尺寸與時長。

kling-video-o1/standard/video-edit
video-to-video

透過文字指令編輯現有影片,可加入最多 10 張參考圖片,並選擇是否保留原音。

veo-3-1/fast/extend-video
video-to-video

依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。

wan-2-1/text-to-video
text-to-video

使用 Wan 2.1 依文字提示詞生成影片,並設定解析度、長寬比、影格數、影格率等選項。

runway-gen-4/turbo/image-to-video
image-to-video

角色穩定、動作流暢、語意理解強,打造高品質影片創作流程

wan-2-2/lora/text-to-image
text-to-image

依提示詞生成圖像,並設定 LoRA、圖像尺寸、格式、推論步數、負面提示詞與隨機種子。

chrono-edit/lora/upscaler
image-to-image

對一張必填輸入圖片進行放大,並可調整推理步數、LoRA 作用強度、種子和輸出格式。

video-background-removal/green-screen
video-to-video

移除影片背景,並依後製流程調整輸出編碼與溢色抑制強度。

seedvr2/upscale/video
video-to-video

修復並放大一段必填來源影片。可設定輸出寬度、載入影格數、播放影格率、隨機種子、修復強度和批次大小。

creatify/lipsync
video-to-video

將音訊軌道與影片同步,並設定是否循環影片。

kling/lipsync/audio-to-video
video-to-video

透過兩個必填 URL,將音訊軌道與現有影片同步。

qwen-edit-2509/lora/relight
image-to-image

根據提示詞為一張必填的來源圖片重新布光或進行編輯,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖、隨機種子以及 JPEG/PNG 輸出。

kling-video-o3/standard/text-to-video
text-to-video

根據文字生成 3–15 秒電影感影片,並可選擇同步音訊。

z-image/turbo/text-to-image/lora
text-to-image

依文字生成圖片,可套用最多 3 個 LoRA,並調整尺寸、權重與隨機種子。

flux-1-kontext/max/text-to-image
text-to-image

以文字快速生成高品質圖像,精準控制細節與風格,助力創意設計實現。

recraft-v3/text-to-image
text-to-image

透過豐富的風格、尺寸與配色設定,產生點陣圖、數字插畫或向量風格圖片。

gpt-4o-image/edit
image-to-image

依提示詞編輯圖像,可選使用遮罩,並設定長寬比。

flux-1-1-pro/ultra/text-to-image
text-to-image

使用 FLUX1.1 Pro Ultra 生成最高 2K 的寫實圖片。

dreamina-3-0/pro/text-to-video
text-to-video

以Dreamina 3.0將文字轉化為動態影像,精準呈現電影級創意場景。

dreamina-3-0/text-to-video
text-to-video

以Dreamina 3.0快速將文字轉為生動畫面,靈活打造專業影片創作。

veo-3-1/fast/text-to-video
text-to-video

以 Veo 3.1 Fast 快速將文字或圖像轉為高質感影片,實現創意即時視覺化。

ideogram-v3/edit
image-to-image

使用 Ideogram 3 依提示詞編輯圖像中的遮罩區域。

veo-3-1/text-to-video
text-to-video

以 Veo 3.1 將文字轉化為電影級影片,結合精準控制與真實音效,激發創意靈感。

hailuo-2-3/standard/text-to-video
text-to-video

以文字打造動感影片,Hailuo 2.3 結合高階動態生成技術,讓創作者輕鬆產出逼真10秒短片。

flux-1-1-pro/text-to-image
text-to-image

使用 FLUX1.1 Pro 生成構圖精準、細節豐富且符合提示詞的圖片。

gpt-4o-image/text-to-image
text-to-image

透過精細的提示詞控制,生成寫實且文字呈現準確的圖片。

ideogram-v3/text-to-image
text-to-image

使用 Ideogram 3.0 根據文字生成圖片,並設定寬高比、速度、配色與風格。

wan-2-1/lora
text-to-video

應用一個自訂 LoRA,並透過詳細的輸出與取樣設定產生 Wan 2.1 影片。

hunyuan/video-to-video
video-to-video

使用騰訊 Hunyuan Video 將現有影片轉換為新的視覺風格。

imagen-4/ultra/text-to-image
text-to-image

使用 Imagen 4 Ultra 依提示詞生成圖像,並設定負面提示詞、長寬比與隨機種子。

sora-2/pro/text-to-video
text-to-video

使用 Sora 2 Pro 依文字提示詞生成影片,並選擇輸出尺寸與時長。

wan-2-2/flash/text-to-image
text-to-image

根據必填提示詞生成圖片。可設定選填負面提示詞、15 種輸出尺寸、Magic Prompt 擴寫和隨機種子。

ideogram-v3/remix
image-to-image

使用 Ideogram 3 依提示詞重混圖像,並設定圖像權重、長寬比等選項。

runway-aleph/video-to-video
video-to-video

調整風格光影、增減物件,靈活創作高品質影片畫面

wan-2-2/vace-fun
image-to-video

根據必填提示詞將一張必填參考圖片製作成影片。可設定輸出尺寸、影格數、播放影格率、隨機種子、步數、引導強度和 shift。

wan-2-1/fusionx/image-to-video
image-to-video

以 AI 技術打造電影級影片,精準控制圖像轉化流程,激發無限創意

imagen-4/fast/text-to-image
text-to-image

使用 Imagen 4 Fast 依提示詞生成圖像,並設定負面提示詞、長寬比與隨機種子。

pikadditions
image-to-video

使用 Pikadditions 將圖像中的人物或物件加入現有影片。

veo-3/fast/text-to-video
text-to-video

從文字提示快速生成具對話和音效的動態短片

pikaframes
image-to-video

使用 Pikaframes 將起始圖片到結束圖片之間的變化製作成流暢動畫。

pika-2-2/image-to-video
image-to-video

以圖像或文字生成高畫質短片,創造獨特動畫效果的靈活AI工具。

ideogram-v3/reframe
image-to-image

使用 Ideogram 3 Reframe 變更圖像的長寬比與解析度。

ideogram-v3/replace-background
image-to-image

使用 Ideogram 3 依提示詞替換圖像背景。

wan-2-2/fun-camera
image-to-video

根據必填提示詞將一張必填圖片製作成影片。可設定輸出尺寸、影格數、播放影格率、鏡頭運動強度、隨機種子、步數、引導強度和 shift。

runway-gen-3-alpha/turbo/image-to-video
image-to-video

支援高擬真動畫與風格控制,Runway Gen-3 Alpha Turbo 為設計師開啟創作新境界

hunyuan/text-to-video
text-to-video

使用騰訊 Hunyuan Video 根據文字提示詞生成高品質影片。

kling-2-1/master/text-to-video
text-to-video

使用 Kling 2.1 Master 依提示詞生成影片,並設定時長、長寬比、負面提示詞與提示詞強度。

wan-2-2/speech-to-video
speech-to-video

根據一張圖片和一段音訊,產生說話、唱歌或表演影片。

kling-1-6/pro/text-to-video
text-to-video

根據必填提示詞產生 5 秒或 10 秒影片。可選擇 `16:9`、`9:16` 或 `1:1`,填寫選填負面提示詞,並調整提示詞強度。

pikaffects
image-to-video

為單張圖片套用所選的 Pikaffect 特效,並將結果生成影片。

pikascenes
image-to-video

使用 1–6 張圖像組合場景,並透過 Pikascenes 將其製作成動態影片。

veo-3/text-to-video
text-to-video

使用 Google Veo 3 依文字提示詞生成影片,並選擇是否生成音訊。

hailuo-02/pro/text-to-video
text-to-video

使用 Hailuo 02 Pro 根據一段必填文字提示詞生成 6 秒影片,並可選擇提示詞擴寫。

sync/lipsync/v2
video-to-video

根據必填影片 URL 和音訊 URL 建立口型同步影片。可選擇 `lipsync-2` 或 `lipsync-2-pro`;相同時長下,Pro 費用約為基礎版的 1.67 倍。另有五種時長不一致處理模式。

SkyReels V1

支援33種表情與400+動作,輕鬆創作具質感的人像短片

imagen-4/text-to-image
text-to-image

高畫質、快速輸出的AI文字轉圖像工具,助你輕鬆創作專業級影像設計

kling/lipsync/text-to-video
video-to-video

依文字生成語音並與影片同步,可選擇音色、語言與語速。

Veo 2

支援物理模擬、鏡頭控制與寫實動作的影片創作工具

pikaswaps
image-to-video

透過遮罩或區域描述替換影片中的選取區域,並可視需要使用圖像與提示詞。

pika-2-2/text-to-video
text-to-video

使用 Pika 2.2 根據文字提示詞生成高品質影片。

luma-ray-2/text-to-video
text-to-video

根據必填文字提示詞產生影片。可選擇六種長寬比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循環播放。

Hailuo Video 01

文字與圖像轉換影片新選擇,創作者專屬的高一致性影像工具

Zoom Out

結合 AI 數位變焦與電影美學,強化畫面情緒與場景空間感

Hailuo Video 01 Director

預設鏡位+運鏡指令,快速打造電影感創意影像

Hailuo Video 01 Live

AI 驅動動畫工具,精準控制臉部與鏡頭,靜態插圖即刻變動畫

Kling 1.5 Pro

圖文轉影像高解析度輸出,Kling 1.5 Pro助設計師快速實現創意影片構想。

hunyuan-video-v1.5/text-to-video
text-to-video

根據必填提示詞產生 5 秒或 8 秒影片,並可設定負面提示詞、四種指定尺寸和隨機種子。

sam-3/image-to-image
image-to-image

用簡短文字指定目標,分割圖片中的對應區域。

sam-3/video-to-video
video-to-video

依文字描述,在影片的連續畫面中分割指定目標。

imagineart-1.5-preview/text-to-image
text-to-image

依文字提示詞生成圖片,並設定寬高比與隨機種子。

infinite-talk/fast/multi
audio-to-video

使用兩段音訊與一張圖片生成影片,並設定兩位人物的發言順序。

infinite-talk/fast/video-to-video
video-to-video

使用一段音訊處理現有影片,並可視需要設定提示詞與隨機種子。

ltx-2/fast/text-to-video
text-to-video

根據文字提示詞生成 16:9 影片,可選擇時長、解析度、幀率以及是否產生音訊。

ltx-2/retake-video
video-to-video

根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。

lucy-edit/fast
video-to-video

透過影片 URL 與文字指令編輯現有影片。

ovis-image
text-to-image

依文字生成圖片,可設定負面提示詞、6 種長寬比與取樣參數。

kling-video-o1/image-to-video
image-to-video

在必填起始圖片與結束圖片之間生成 5 秒或 10 秒影片,並透過包含 @Image1 和 @Image2 引用的必填提示詞引導轉場。

kling-video-o1/video-to-video/reference
video-to-video

以參考影片產生新鏡頭,可使用提示詞、元素和圖片,並選擇畫面比例、時長及是否保留原始音軌。

kling-video-o1/video-to-video/edit
video-to-video

使用提示詞編輯參考影片,可加入元素與圖片參考,並可選擇保留原始音軌。

pixverse/v5.5/text-to-video
text-to-video

根據必填文字提示詞生成影片,並精確控制長寬比、解析度、片長、風格、隨機種子、音訊、多片段和提示詞最佳化。

pixverse/v5.5/transition
image-to-video

以必填的起始圖片和結束圖片生成轉場影片,並可控制提示詞、長寬比、解析度、片長、風格、音訊和提示詞最佳化。

q2/text-to-image
text-to-image

根據文字產生圖片,可選擇 16:9、9:16 或 1:1 長寬比、1080p/2k/4k 輸出和隨機種子。

seedream-4-5/sequential
text-to-image

僅以文字產生最多 15 張序列圖片,並可從 11 個解析度選項中選擇。

ai-avatar/v2/pro
image-to-video

根據 1 張必填圖片和 1 個必填音訊檔案生成數字人影片,並可用文字提示詞補充生成指令。

longcat-image/text-to-image
text-to-image

根據文字生成圖片,提供 6 個精確尺寸預設,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。

z-image/turbo/controlnet/lora
image-to-image

根據一張控制圖片產生新圖,支援最多 3 個 LoRA、4 種預處理模式、分階段 ControlNet 控制及 1–8 個推理步。

z-image/turbo/image-to-image/lora
image-to-image

結合原圖、提示詞和最多 3 個 LoRA 完成圖片轉換,推理步數可設為 1–8。

steady-dancer
video-to-video

依照驅動影片中的動作,讓參考圖片動起來。

stepx-edit2
text-to-image

根據文字指令編輯一張來源圖片,並可設定反向提示詞、隨機種子、思考與反思模式,以及 JPEG 或 PNG 輸出。

one-to-all-animation/1.3b
video-to-video

將驅動影片中的動作遷移到參考角色圖片,並可設定正向/反向提示詞和產生參數。

one-to-all-animation/14b
video-to-video

將驅動影片中的動作遷移到參考角色圖片,並可調整提示詞、解析度、推理步數、圖片引導與姿態引導。

gpt-image-1-5/text-to-image
text-to-image

根據文字提示產生細節豐富的圖片,並可設定尺寸、背景、品質與輸出格式。

kling-video-o1/standard/image-to-video
image-to-video

根據必填提示詞讓首格圖片動起來,並可透過可選的尾格圖片控制影片結尾。

kling-video-o1/standard/text-to-video
text-to-video

根據文字提示詞生成影片,可選擇長寬比以及 5 秒或 10 秒時長。

lucy-edit/restyle
video-to-video

透過文字指令重新詮釋現有影片,同時盡量保留來源影片的動作與整體構圖。

flux-2/turbo/text-to-image
text-to-image

Flux 2 Turbo Text to Image 可根據文字快速生成高品質圖像,並控制提示詞遵循度、隨機種子、長寬比和輸出格式。

ltx-2-19b/text-to-video/lora
text-to-video

根據提示詞生成音訊與影片同步的動態短片,並精確控制 LoRA 風格。

ltx-2-19b/image-to-video/lora
image-to-video

將靜態圖像轉化為富有表現力的動態短片,並生成同步音訊。

ltx-2-19b/video-to-video/lora
video-to-video

以電影級動作表現和精細創作控制,高效轉換現有影片。

kling-3.0/pro/text-to-video
text-to-video

Kling V3.0 系列中具有最高視覺保真度的優質電影文字轉影片。

kling-3.0/4k/text-to-video
text-to-video

生成帶有同步對白和一致角色的原生 4K 電影感文字轉影片。

kling-3.0/4k/image-to-video
image-to-video

將靜態圖片製作成原生 4K 電影感影片,支援首尾影格引導與同步音訊。

ace-step/text-to-audio
text-to-audio

根據文字標籤生成最長 4 分鐘、帶人聲與歌詞的歌曲。

kling-video-o3/standard/video-to-video
video-to-video

按輸出影片每秒 $0.126,透過提示詞編輯影片。

kling-video-o3/standard/reference-to-video
reference-to-video

根據參考素材生成 3–15 秒影片,起價為每秒 $0.084。

kling-video-o3/4K/text-to-video
text-to-video

電影感 4K 文字轉影片,輸出每秒 $0.42。

gemini-omni-flash/text-to-video
text-to-video

根據文字提示詞產生帶同步音訊的電影級影片。

Luma Dream Machine

AI 生成影片工具,支援圖像與文字輸入,畫面自然流暢,創作自由靈活