來自影像、視訊和音訊提示的視訊的開放權重參考。
Category
開放權重圖像到視頻,具有可選的最後一幀和原生立體聲音頻。
開放式文字轉視頻,具有 480p/768p 和原生立體聲音頻。
FLUX 3 Draft Extend: 720p 的快速低成本剪輯延續草稿
FLUX 3 草稿關鍵影格:720p 快速多關鍵影格影片預覽
FLUX 3 Draft FLF:720p 快速開始結束幀影片預覽
FLUX 3 Draft I2V:720p 快速靜態影片預覽草稿
Wan 2.6 Image-to-Image:基於指令的AI,實現無縫視覺編輯和可擴展的風格適配
使用 Seedream 4.5 Edit 圖片編輯轉換視覺內容,實現連貫的照片級真實圖像創建和精準的品牌一致性。
由參考圖片引導的圖片編輯,支援版面控制、圖層分離和多語言文字
將靜態畫面製作成動作流暢、音訊可控的影片。
以 Wan 2.5 將靜態圖片快速轉為流暢動態影片,讓創作更具臨場感。
FLUX 3 Draft:快速、低成本的 720p 文字轉影片預覽
Seedance 2.5 FLF2V 480p:更低成本的首末幀草稿轉場
Seedance 2.5 Reference 480p:更低成本的多參考草稿影片
Seedance 2.5 480p:快速、低成本的靜圖轉動畫草稿
Seedance 2.5 480p:用提示詞快速、低成本生成文生影片草稿
透過場景一致的運動將現有剪輯延長到最終畫面之外
從具有可選音頻的多關鍵幀靜態圖像生成視頻
根據起始幀與結束幀生成可選原生音訊的過渡影片
將起始靜幀動畫化為可選原生音訊的短影片
Seedance 2.5 First & Last Frame:將開始畫面與結束畫面銜接為流暢的電影級影片
Flux 2 Flash Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。
使用Nano Banana Pro將草圖轉化為精確的2K-4K視覺效果,智慧校正與無縫創意控制。
根據必填提示詞編輯或融合 1–10 張必填 JPEG 或 PNG 圖片。可選擇 `1K`、`2K`、`4K` 或八種固定解析度。
將靜態影像變成動作自然、對白同步且創作可控的逼真影片場景。
WAN 2.7 圖片編輯支援 1–4 張參考圖片的文字指令編輯,並提供選填的提示詞擴寫、中英文指令與預設輸出尺寸。
生成品牌視覺素材,準確呈現圖片內文字與 Logo。
基於 LoRA 的圖片編輯模型,可在維持結構和主體一致性的同時精準修改創意素材。
OpenAI 的 GPT Image 2 影像編輯:透過精確的文字控制和輸入輸出繪畫進行影像到影像編輯
使用 Nano Banana 2 Edit 進行提示詞驅動的圖像編輯,支援多圖輸入,並可控制寬高比、解析度、安全容忍度和輸出選項。
只要一段提示詞,即可根據參考圖生成流暢的 720P 或 1080P 影片。
根據文字產生 4–12 秒影片,支援 480p、720p、1080p、6 種長寬比,以及音訊和固定鏡頭設定。
以Hailuo 2.3 Fast Standard輕鬆將靜態圖片轉化為流暢動態影片,展現真實創意。
Seedance 2.5:將靜態圖片轉化為電影級 AI 影片
Seedance 2.5 Reference to Video:依參考素材產生電影級 AI 影片
根據文字提示詞生成 5 秒、10 秒或 15 秒影片,可加入來源音訊,並設定尺寸、鏡頭結構、反向提示詞、隨機種子、提示詞擴寫和生成音訊。
MiniMax H3:768p/2K 文字轉視頻,附原生立體聲音訊
根據必填提示詞產生圖片,可從六種固定尺寸預設中選擇,並設定整數隨機種子;`seed` 預設值 `-1` 代表隨機取種。
從圖像、視頻和音頻參考生成 768p 或 2K 視頻
透過文字指令和最多 10 張來源圖片進行圖片編輯,並可選擇七種尺寸以及 JPEG 或 PNG 輸出。
以 AI 精準轉換圖片為影片,結合高畫質、流暢動畫與創意控制
以直覺方式生成高畫質影像,支援多重輸入與創意融合功能
高保真 4 步驟文字到圖像,具有清晰的文字渲染
3–15s 專業級電影感圖片轉影片,輸出每秒 $0.112 起。
依提示詞編輯或組合 1–10 張圖像,並設定長寬比、格式與輸出數量。
Flux 2 Turbo Edit 可依照明確的文字指令編輯最多 4 張參考圖,並精確控制尺寸和輸出格式。
使用Wan 2.6將靜態圖像轉換為動態同步的高清影片內容,支援靈活控制。
支援文字、圖片和參考素材輸入,並可同步產生原生音訊的多模態 AI 影片模型。
僅透過文字產生圖片,並可選擇 2K、4K 或 9 個固定尺寸。
具備版面與圖層控制的文字轉圖片和圖片編輯模型
生成 2K 電影感影片,支援精準口型同步與鏡頭控制。
HappyHorse 1.0 Video Edit:阿里巴巴的 HappyHorse 1.0 視頻編輯器可以編輯輸入視頻,其中包含文本說明和參考圖像,以進行風格轉移、本地替換和服裝交換。
依提示詞生成 1–4 張圖片,並設定寬高比、解析度、格式與回傳方式。
只要一段提示詞,即可將靜態照片變成流暢的 720P 或 1080P 影片。
根據文字提示詞和 1~3 段參考影片生成影片,並可設定時長、輸出尺寸、鏡頭結構、隨機種子、反向提示詞和音訊生成。
使用 Seedance 1.5 Pro 將靜態圖像轉換為具有流暢、逼真過渡和創意靈活性的電影級影片剪輯。
依提示詞生成 1–4 張圖片,並可選擇長寬比、推論步數、隨機種子與檔案格式。
以每秒 $0.084,將圖片製作成 3–15 秒影片。
使用 Nano Banana 2 進行快速、高品質的文字轉圖像,支援寬高比、安全容忍度和輸出格式控制。
將第一幀圖像動畫化為 768p 或 2K 視頻,最長 15 秒
依提示詞編輯或轉換最多 20 張參考圖片,並設定生成數量、格式、寬高比與解析度。
以Seedance 1.0 Pro Fast快速將靜態圖片轉化為流暢、真實的影片,讓創意設計更具故事感。
以 AI 將靜態圖像轉化為動態影片,打造自然順暢的角色敘事效果。
支援中文的 AI 文字轉圖工具,精準生成高質感影像
上傳 1~14 張參考圖片,依文字指令進行編輯,並設定最多 15 張序列輸出。
快速、低成本的提示詞圖片編輯模型,以固定 1K 解析度輸出。
透過多組參考素材和影格控制生成 1080p 影片。
將圖片或音訊參考製作成動作可精準控制的高畫質影片。
透過精細控制和可重現設定,快速產生準確的設計視覺。
根據文字提示詞生成海報、標誌與以字體排版為核心的圖片。
Seedream 5.0 Lite 文字生成圖像:支援精確版面與字體排版控制的提示詞到視覺引擎
Seedance 2.5:一致性更強、支援更長片段的電影級 AI 影片
以文字生成與編輯圖像,輕鬆打造品牌與故事的視覺設計
進階圖片編輯模型,可在精準修改畫面的同時維持幾何結構與主體一致性。
FLUX 3 Image 是一款支援參考圖引導和清晰文字生成的多模態圖像模型
Kling 3.0:創作具有同步對話和一致角色的多場景電影。
將起始圖片製作成帶有原生音訊的電影感短片。
高保真電影感動作模型,可流暢移轉動作並靈活控制畫面。
支援雙語文字處理與物件編輯,讓設計更自由直覺
根據提示詞生成寫實圖片,精準呈現中英文文字,並維持均衡穩定的版面。
使用 Wan 2.2 Plus 依提示詞生成 5 秒影片,並設定尺寸、隨機種子與提示詞擴充。
WAN 2.7 Pro 圖片編輯支援 1–4 張參考圖片、提示詞擴寫和高品質指令編輯,操作欄位與標準編輯版本相同。
根據文字提示詞產生圖片,並可設定六種尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。
根據最多三張來源圖片進行圖片編輯,並可調整引導強度、推理步數、輸出數量、提示詞擴充、尺寸、隨機種子和格式。
Prompt-driven Pro-tier video editing at $0.168 per second.
將靜態圖片轉化為細膩動態影片,享受真實音畫同步的創作體驗。
使用 FLUX Kontext Pro 根據必填文字指令編輯一張必填圖片,並可設定種子和 9 種寬高比。
將靜態影像轉化為流暢1080p影片,展現真實動感與創意自由
透過 AI 轉換既有影片,同時維持動作穩定與設計一致。
將一張參考圖製作成 5 秒或 10 秒的影片,並可設定反向提示詞與原生音訊產生。
依提示詞讓起始圖像動起來,並設定 LoRA、影格數、FPS、解析度、長寬比、推論步數與隨機種子。
Seedream 5.0 Lite 將參考圖像轉化為版面精準、風格一致的設計,助力創意工作流程。
根據文字生成精緻圖像,透過精準細節與彈性風格控制服務設計工作流程。
依圖片與提示詞生成 5 秒或 8 秒的 480p 或 720p 影片。
根據風格標籤和歌詞生成最長 4 分鐘、帶人聲的歌曲。
Veo 3.1 Fast 以AI技術將影像瞬間轉化為動態影片,打造創意視覺作品。
根據必填提示詞生成 5 秒或 10 秒影片。可新增選填 WAV/MP3 音訊、負面提示詞,並從 13 種輸出尺寸中選擇。
以 Seedream 4.0 Edit sequential 實現連貫影像轉換,精準控制風格與細節,打造一致的創作流暢體驗。
Kling V3.0 系列中畫面品質與動作真實感最高的高階圖片轉影片模型。
根據提示詞和最多 7 張參考圖產生圖片,並可選擇長寬比、1080p 至 4k 解析度和隨機種子。
將來源影片放大至所選目標解析度與影格率。
根據文字、參考音訊或圖片產生自然的語音與音訊。
使用參考圖與來源影片生成動畫影片,可選擇輸出尺寸並設定隨機種子。
以 AI 智慧將靜態圖像轉化為高畫質動態影片,助力創意無限發揮
依文字生成圖片,並以個別權重組合最多 3 個 LoRA。
使用 FLUX Kontext Max 依提示詞編輯圖像,並設定隨機種子與 9 種長寬比之一。
透過攝影機和音訊控制將靜態照片轉變為影片動作剪輯。
根據參考影像和提示詞生成含同步音訊的短影片。
將文字創意轉化為符合品牌調性的視覺內容,並精準控制畫面風格。
根據文字指令編輯 1–10 張參考圖片,並選擇固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。
根據文字指令編輯來源影片,同時維持場景結構與動作連貫。
使用一張人像和一段音訊產生口播數字人影片,並可透過提示詞引導動作與表達方式。
使用 Hailuo 02 Pro 依提示詞讓起始圖像動起來,生成 6 秒影片。
Hailuo 2.3 讓設計師輕鬆將靜態圖像轉化為逼真動態影片,精準掌控每個細節創意。
以雙影格技術生成高保真流暢影片,提升設計表現力與創作效率。
根據一張必填人物圖片和一段 35 秒以內的必填音訊生成影片。可使用六種支援語言填寫選填生成指引,並設定預設值為 -1 的隨機種子。
達到 Seedance 2.0 水準的電影級影片生成,兼具出色的視覺保真度與自然的鏡頭運動
Alibaba 上的 HappyHorse 1.0 I2V 將靜態圖像動畫化為原生 1080p 視頻,具有物理精確的運動和身份穩定的主題。
根據文字提示建立新圖片,可選擇 6 個固定尺寸預設、隨機種子以及 JPEG 或 PNG 輸出。
依照文字提示詞產生圖片,每次可輸出 1–10 張。
以首幀風格重塑整支影片,確保AI影像風格一致、創作更流暢。
4 步亞秒級文字到圖像,具有即時準確的視覺效果
根據提示詞轉換一張輸入圖片,並可設定變換強度、尺寸、1–8 個推理步、隨機種子、提示詞擴寫以及 JPEG、PNG 或 WebP 輸出。
在音軌開頭、結尾或兩端續寫風格一致的新內容。
根據文字指令編輯或轉換 1–10 張參考圖片,並精確設定尺寸、背景、品質、輸入保真度與輸出格式。
透過多模態參考、口型同步與鏡頭控制,更快生成具有電影感的短片。
利用Dreamina 3.0,將靜態影像即刻轉化為流暢2K影片,完美呈現細緻動態與真實光影。
根據必填文字提示詞生成影音同步影片。輸出尺寸可選 `1280x720` 或 `720x1280`,時長可選 `4`、`8` 或 `12` 秒。
FLUX 3 Video 可將文字提示詞生成帶原生音訊的電影感短片
WAN 2.7 文字轉圖像:精準理解提示詞,提供多種尺寸預設,每次最多生成 5 張圖像
以 AI 將靜態圖像轉換為流暢動態影片,呈現電影級畫面與真實運動感。
編輯單張圖片的皮膚細節,並設定尺寸、步數、引導強度、生成數量、格式與隨機種子。
將靜態人像轉換成表情自然、栩栩如生且可精細控制的影片。
透過提示詞編輯 1–10 張圖片,並調整尺寸、提示詞擴充、引導強度、步數、隨機種子與格式。
根據起始圖片和提示詞生成 16:9 影片,可選擇時長、解析度、幀率以及是否產生音訊。
根據 800 個字元以內的必填指令編輯 1–3 張必填來源圖片。可請求 1–6 張結果,新增 500 個字元以內的負面提示詞,並設定 0–2147483647 的隨機種子。
快速、低成本的文字轉圖片模型,以固定 1K 解析度輸出。
使用 Kling 2.1 Standard 根據必填圖片和提示詞生成影片,並可設定時長、寬高比、負向提示詞和提示詞強度。
結合必填的人像圖片、參考影片和提示詞,產生表情與動作自然的人像動畫。
根據必填提示詞產生 1–4 張圖片,並可選擇 10 種長寬比、1K/2K/4K 解析度、三種檔案格式和同步傳回模式。
WAN 2.7 Pro 文字生成圖片模型,操作方式與標準版相同,支援中英文提示詞,每次最多生成 5 張適合印刷與大型版面的高精細靜態圖片。
以照片生成自然對話影片,呈現真實臉部動作與表情
根據必填提示詞來組合或編輯 1–10 張來源圖片,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖、隨機種子以及 JPEG/PNG 輸出。
以智慧引擎將靜態圖像化為流暢 1080p 影片,細節逼真、創作靈活。
以 Dreamina 3.0 將靜態圖片動態化,快速生成高品質 2K 影片,展現真實細膩的視覺表現。
根據文字提示詞改造來源影片,並支援原生音訊。
將驅動影片中的動作轉移到參考角色圖片,同時盡量維持角色可辨識。
支援快速文字轉圖像,適用創作者與設計師的靈活生成工具
新一代AI工具,結合文字生成與精準影像編輯,創造高品質視覺作品。
透過遮罩精準局部重繪,完成照片精修、物件修改與場景修復。
根據提示詞讓必填來源圖片動起來,可精確選擇 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,並可產生音訊。
使用 6 種風格和 11 種長寬比,產生包含文字設計的視覺圖片。
智慧AI影片創作工具,將文字轉化為1080p動態影像,輕鬆打造富有情感與張力的視覺故事。
根據必填提示詞編輯 1–10 張來源圖片,並可視需要套用最多三個 LoRA 項目。可選擇六種輸出尺寸,並可設定推理步數、引導強度、1–4 張結果、隨機種子以及 Default、JPEG 或 PNG 輸出。
電影感 4K 圖片轉影片,輸出每秒 $0.42。
以 AI 將靜態圖像轉化為動態影片,支援音效同步與場景銜接,提升創作真實感與效率
以Veo 3.1 Fast 輕鬆將影像轉為動態影片,展現創意視覺與專業級畫面品質。
以 Kling 2.1 將靜態圖片與文字提示轉化為高畫質動態影片,展現真實立體運動效果。
依提示詞生成影片,並設定 LoRA、解析度、長寬比、影格數、FPS、推論步數與隨機種子。
使用 48 個效果預設之一為 1 張必填來源圖片製作動畫,並可設定解析度、片長、反向提示詞和提示詞最佳化。
使用 Kling 2.1 Pro 根據必填起始圖片和提示詞生成影片,並可設定選填結束圖片、時長、寬高比、負向提示詞和提示詞強度。
以 Dreamina 4.0 輕鬆完成高精度圖像轉圖像創作,呈現細膩且具風格的 4K 視覺效果,專為設計師而生。
使用 Hailuo 02 根據一段必填文字提示詞生成 6 秒或 10 秒影片,並可選擇提示詞擴寫。
依照圖片、音訊和提示詞產生影片,並分別調整文字與音訊的引導強度。
精確重製音軌中的指定片段,其餘部分保持不變。
專業級電影感文字轉影片,輸出每秒 $0.112。
使用 Wan 2.2 Plus 依提示詞生成圖像,並設定尺寸、隨機種子與提示詞擴充。
以AI將靜態圖像轉為動態影片,具有風格控制與鏡頭運動功能,助你輕鬆展現創意。
輸入文字即可產生短影片,並可設定時長、長寬比與是否產生音訊。
根據 2000 字元以內的必填提示詞生成圖片。可填寫選填負面提示詞,並從 13 種輸出尺寸中選擇。
精準提示理解、自然畫面運動與高畫質影像呈現,創造逼真AI影片。
以單張圖片輕鬆生成流暢影片,動作自然、轉場順暢,為創作者開啟更多靈感可能。
根據必填影片 URL 和音訊 URL 建立口型同步影片,並可從五種模式中選擇音影片時長不一致的處理方式。
使用最多 3 張圖片與 3 個 LoRA 進行編輯,並可控制 6 個精確尺寸預設、提示詞引導強度、推理步數、隨機種子以及 JPEG、PNG 或 WebP 輸出。
專業級參考圖生成影片,支援 3–15s 輸出,每秒 $0.112 起。
使用必填音訊驅動一段短片,並控制情緒、編輯範圍、音訊與影片時長不一致時的處理方式和表現力。
從靜態影像創造流暢影片,精準控制動態過渡,讓創作更具電影感。
根據必填提示詞和一張必填來源圖片,建立下一個場景的編輯圖片。可選擇六種輸出尺寸,並可設定 2–50 步推理、0–20 的引導強度(預設值:6)、1–4 張結果、隨機種子以及 JPEG 或 PNG 輸出。
根據必填提示詞編輯一張來源圖片,並可設定選填遮罩、2–50 個推理步驟、480p/720p 解析度、隨機種子和三種輸出格式。
根據必填提示詞編輯一張必填參考圖片。可請求 1–4 張結果,選擇 PNG、JPEG 或 WebP 輸出,並可透過 `sync_mode` 返回 data URI。
以 AI 精準移轉動作,快速產生穩定流暢的角色動畫。
快速、低成本的多鏡頭 AI 影片模型,原生支援音訊和參考素材。
依文字生成圖片,並調整尺寸、提示詞擴充、引導強度、步數、隨機種子與格式。
使用一段音訊與一張圖片生成影片,並可視需要設定提示詞與隨機種子。
透過遮罩精準局部重繪,並可疊加 LoRA,快速完成商品圖與創意圖片修改。
根據必填文字指令編輯一張必填圖片,並可設定提示詞擴寫、兩種輸出解析度、種子和輸出格式。
依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。
依提示詞修改現有場景中的元素,並設定尺寸、步數、引導強度、生成數量、格式與隨機種子。
透過提示詞創作歌曲,支援 44.1 kHz WAV 輸出與分段編輯。
支援多層次風格控制與物件替換,創作更靈活高效
HappyHorse 1.0 提供原生 1080p 輸出、電影級運動與多鏡頭一致性。
將一張靜態影像生成含同步音訊的短影片。
使用 Fast 版本移除影片背景,並設定輸出編碼、前景邊緣細化與主體類型。
將圖像分解成可編輯的 RGBA 圖層,實現精準物件隔離和靈活設計控制。
以文字生成連貫的視覺故事,維持風格一致與敘事節奏,激發設計創意。
根據必填提示詞產生影片,可精確選擇 6、8 或 10 秒,1080p~2160p,25 或 50 FPS,固定 16:9,並可產生音訊。
以單張影像創造流暢生動畫面,讓創意轉化為電影級視覺,輕鬆展現專業作品。
電影感 4K 參考圖生成影片,輸出每秒 $0.42。
根據提示詞調整一張必填的來源圖片的鏡頭角度或進行其他編輯,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖以及 JPEG/PNG 輸出。
以文字驅動起始圖片產生影片,並設定長寬比、解析度、時長、風格、音訊與多片段。
HappyHorse 1.0 參考影片將多達 9 個參考影像和提示融合成一個具有穩定身份的連貫多字元片段。
以Kling 2.5 Turbo將靜態影像轉化為流暢電影級影片,創造細膩動態視覺。
透過必填參考圖片與元素陣列生成影片,使用按順序編號的 @Image 和 @Element 標記,並精確控制片長與長寬比。
快速將文字轉化為影像的AI影片製作工具,為創作者提供靈活且高效的視覺敘事體驗。
使用 Kling 2.5 Turbo 依提示詞生成影片,並設定時長、長寬比與負面提示詞。
將影片中的人物或物體與背景分離,並設定輸出編碼、前景邊緣細化與主體類型。
使用 Seedance 1.0 依提示詞生成影片,並設定解析度、長寬比與時長。
運用Veo 3.1將靜態影像轉化為流暢影片,展現真實動感與創意敘事力。
根據文字提示詞編輯 1 張源圖片,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。
以 Veo 3.1 將靜態圖像轉換成流暢影片,快速呈現電影般的視覺效果,創作更高效。
高精準 AI 文字轉圖像工具,支援細節調整與靈活創作。
使用 Sora 2 Pro 依提示詞讓參考圖動起來,並選擇輸出尺寸與時長。
透過文字指令編輯現有影片,可加入最多 10 張參考圖片,並選擇是否保留原音。
依照提示詞將現有影片延長 7 秒,以 720p 輸出,並可選擇是否產生音訊。
使用 Wan 2.1 依文字提示詞生成影片,並設定解析度、長寬比、影格數、影格率等選項。
角色穩定、動作流暢、語意理解強,打造高品質影片創作流程
依提示詞生成圖像,並設定 LoRA、圖像尺寸、格式、推論步數、負面提示詞與隨機種子。
對一張必填輸入圖片進行放大,並可調整推理步數、LoRA 作用強度、種子和輸出格式。
移除影片背景,並依後製流程調整輸出編碼與溢色抑制強度。
修復並放大一段必填來源影片。可設定輸出寬度、載入影格數、播放影格率、隨機種子、修復強度和批次大小。
將音訊軌道與影片同步,並設定是否循環影片。
透過兩個必填 URL,將音訊軌道與現有影片同步。
根據提示詞為一張必填的來源圖片重新布光或進行編輯,並可設定六種輸出尺寸、推理步數、引導強度、1–4 張結果圖、隨機種子以及 JPEG/PNG 輸出。
根據文字生成 3–15 秒電影感影片,並可選擇同步音訊。
依文字生成圖片,可套用最多 3 個 LoRA,並調整尺寸、權重與隨機種子。
以文字快速生成高品質圖像,精準控制細節與風格,助力創意設計實現。
透過豐富的風格、尺寸與配色設定,產生點陣圖、數字插畫或向量風格圖片。
依提示詞編輯圖像,可選使用遮罩,並設定長寬比。
使用 FLUX1.1 Pro Ultra 生成最高 2K 的寫實圖片。
以Dreamina 3.0將文字轉化為動態影像,精準呈現電影級創意場景。
以Dreamina 3.0快速將文字轉為生動畫面,靈活打造專業影片創作。
以 Veo 3.1 Fast 快速將文字或圖像轉為高質感影片,實現創意即時視覺化。
使用 Ideogram 3 依提示詞編輯圖像中的遮罩區域。
以 Veo 3.1 將文字轉化為電影級影片,結合精準控制與真實音效,激發創意靈感。
以文字打造動感影片,Hailuo 2.3 結合高階動態生成技術,讓創作者輕鬆產出逼真10秒短片。
使用 FLUX1.1 Pro 生成構圖精準、細節豐富且符合提示詞的圖片。
透過精細的提示詞控制,生成寫實且文字呈現準確的圖片。
使用 Ideogram 3.0 根據文字生成圖片,並設定寬高比、速度、配色與風格。
應用一個自訂 LoRA,並透過詳細的輸出與取樣設定產生 Wan 2.1 影片。
使用騰訊 Hunyuan Video 將現有影片轉換為新的視覺風格。
使用 Imagen 4 Ultra 依提示詞生成圖像,並設定負面提示詞、長寬比與隨機種子。
使用 Sora 2 Pro 依文字提示詞生成影片,並選擇輸出尺寸與時長。
根據必填提示詞生成圖片。可設定選填負面提示詞、15 種輸出尺寸、Magic Prompt 擴寫和隨機種子。
使用 Ideogram 3 依提示詞重混圖像,並設定圖像權重、長寬比等選項。
調整風格光影、增減物件,靈活創作高品質影片畫面
根據必填提示詞將一張必填參考圖片製作成影片。可設定輸出尺寸、影格數、播放影格率、隨機種子、步數、引導強度和 shift。
以 AI 技術打造電影級影片,精準控制圖像轉化流程,激發無限創意
使用 Imagen 4 Fast 依提示詞生成圖像,並設定負面提示詞、長寬比與隨機種子。
使用 Pikadditions 將圖像中的人物或物件加入現有影片。
從文字提示快速生成具對話和音效的動態短片
使用 Pikaframes 將起始圖片到結束圖片之間的變化製作成流暢動畫。
以圖像或文字生成高畫質短片,創造獨特動畫效果的靈活AI工具。
使用 Ideogram 3 Reframe 變更圖像的長寬比與解析度。
使用 Ideogram 3 依提示詞替換圖像背景。
根據必填提示詞將一張必填圖片製作成影片。可設定輸出尺寸、影格數、播放影格率、鏡頭運動強度、隨機種子、步數、引導強度和 shift。
支援高擬真動畫與風格控制,Runway Gen-3 Alpha Turbo 為設計師開啟創作新境界
使用騰訊 Hunyuan Video 根據文字提示詞生成高品質影片。
使用 Kling 2.1 Master 依提示詞生成影片,並設定時長、長寬比、負面提示詞與提示詞強度。
根據一張圖片和一段音訊,產生說話、唱歌或表演影片。
根據必填提示詞產生 5 秒或 10 秒影片。可選擇 `16:9`、`9:16` 或 `1:1`,填寫選填負面提示詞,並調整提示詞強度。
為單張圖片套用所選的 Pikaffect 特效,並將結果生成影片。
使用 1–6 張圖像組合場景,並透過 Pikascenes 將其製作成動態影片。
使用 Google Veo 3 依文字提示詞生成影片,並選擇是否生成音訊。
使用 Hailuo 02 Pro 根據一段必填文字提示詞生成 6 秒影片,並可選擇提示詞擴寫。
根據必填影片 URL 和音訊 URL 建立口型同步影片。可選擇 `lipsync-2` 或 `lipsync-2-pro`;相同時長下,Pro 費用約為基礎版的 1.67 倍。另有五種時長不一致處理模式。
支援33種表情與400+動作,輕鬆創作具質感的人像短片
高畫質、快速輸出的AI文字轉圖像工具,助你輕鬆創作專業級影像設計
依文字生成語音並與影片同步,可選擇音色、語言與語速。
支援物理模擬、鏡頭控制與寫實動作的影片創作工具
透過遮罩或區域描述替換影片中的選取區域,並可視需要使用圖像與提示詞。
使用 Pika 2.2 根據文字提示詞生成高品質影片。
根據必填文字提示詞產生影片。可選擇六種長寬比、`540p`/`720p`/`1080p`、`5` 秒/`9` 秒,以及是否循環播放。
文字與圖像轉換影片新選擇,創作者專屬的高一致性影像工具
結合 AI 數位變焦與電影美學,強化畫面情緒與場景空間感
預設鏡位+運鏡指令,快速打造電影感創意影像
AI 驅動動畫工具,精準控制臉部與鏡頭,靜態插圖即刻變動畫
圖文轉影像高解析度輸出,Kling 1.5 Pro助設計師快速實現創意影片構想。
根據必填提示詞產生 5 秒或 8 秒影片,並可設定負面提示詞、四種指定尺寸和隨機種子。
用簡短文字指定目標,分割圖片中的對應區域。
依文字描述,在影片的連續畫面中分割指定目標。
依文字提示詞生成圖片,並設定寬高比與隨機種子。
使用兩段音訊與一張圖片生成影片,並設定兩位人物的發言順序。
使用一段音訊處理現有影片,並可視需要設定提示詞與隨機種子。
根據文字提示詞生成 16:9 影片,可選擇時長、解析度、幀率以及是否產生音訊。
根據提示詞重做現有影片中的指定片段,並可選擇替換音訊、畫面或同時替換兩者。
透過影片 URL 與文字指令編輯現有影片。
依文字生成圖片,可設定負面提示詞、6 種長寬比與取樣參數。
在必填起始圖片與結束圖片之間生成 5 秒或 10 秒影片,並透過包含 @Image1 和 @Image2 引用的必填提示詞引導轉場。
以參考影片產生新鏡頭,可使用提示詞、元素和圖片,並選擇畫面比例、時長及是否保留原始音軌。
使用提示詞編輯參考影片,可加入元素與圖片參考,並可選擇保留原始音軌。
根據必填文字提示詞生成影片,並精確控制長寬比、解析度、片長、風格、隨機種子、音訊、多片段和提示詞最佳化。
以必填的起始圖片和結束圖片生成轉場影片,並可控制提示詞、長寬比、解析度、片長、風格、音訊和提示詞最佳化。
根據文字產生圖片,可選擇 16:9、9:16 或 1:1 長寬比、1080p/2k/4k 輸出和隨機種子。
僅以文字產生最多 15 張序列圖片,並可從 11 個解析度選項中選擇。
根據 1 張必填圖片和 1 個必填音訊檔案生成數字人影片,並可用文字提示詞補充生成指令。
根據文字生成圖片,提供 6 個精確尺寸預設,並可設定推理步數、引導強度、隨機種子以及 JPEG、PNG 或 WebP 輸出。
根據一張控制圖片產生新圖,支援最多 3 個 LoRA、4 種預處理模式、分階段 ControlNet 控制及 1–8 個推理步。
結合原圖、提示詞和最多 3 個 LoRA 完成圖片轉換,推理步數可設為 1–8。
依照驅動影片中的動作,讓參考圖片動起來。
根據文字指令編輯一張來源圖片,並可設定反向提示詞、隨機種子、思考與反思模式,以及 JPEG 或 PNG 輸出。
將驅動影片中的動作遷移到參考角色圖片,並可設定正向/反向提示詞和產生參數。
將驅動影片中的動作遷移到參考角色圖片,並可調整提示詞、解析度、推理步數、圖片引導與姿態引導。
根據文字提示產生細節豐富的圖片,並可設定尺寸、背景、品質與輸出格式。
根據必填提示詞讓首格圖片動起來,並可透過可選的尾格圖片控制影片結尾。
根據文字提示詞生成影片,可選擇長寬比以及 5 秒或 10 秒時長。
透過文字指令重新詮釋現有影片,同時盡量保留來源影片的動作與整體構圖。
Flux 2 Turbo Text to Image 可根據文字快速生成高品質圖像,並控制提示詞遵循度、隨機種子、長寬比和輸出格式。
根據提示詞生成音訊與影片同步的動態短片,並精確控制 LoRA 風格。
將靜態圖像轉化為富有表現力的動態短片,並生成同步音訊。
以電影級動作表現和精細創作控制,高效轉換現有影片。
Kling V3.0 系列中具有最高視覺保真度的優質電影文字轉影片。
生成帶有同步對白和一致角色的原生 4K 電影感文字轉影片。
將靜態圖片製作成原生 4K 電影感影片,支援首尾影格引導與同步音訊。
根據文字標籤生成最長 4 分鐘、帶人聲與歌詞的歌曲。
按輸出影片每秒 $0.126,透過提示詞編輯影片。
根據參考素材生成 3–15 秒影片,起價為每秒 $0.084。
電影感 4K 文字轉影片,輸出每秒 $0.42。
根據文字提示詞產生帶同步音訊的電影級影片。
AI 生成影片工具,支援圖像與文字輸入,畫面自然流暢,創作自由靈活
RunComfy 是首選的 ComfyUI 平台,提供 ComfyUI 在線 環境和服務,以及 ComfyUI 工作流程 具有驚豔的視覺效果。 RunComfy還提供 AI Models, 幫助藝術家利用最新的AI工具創作出令人驚艷的藝術作品。
