HappyHorse 1.0はネイティブ1080p出力、シネマティックなモーション、マルチショットの一貫性を備えたテキストto動画モデルです。


RunComfy の HappyHorse 1.0 I2V は、Alibaba の非同期ビデオ合成 API を happyhorse-1.0-i2v モデルで使用します。ソース画像をアップロードし、モーションに焦点を当てたプロンプトを作成すると、モデルは元のフレームの被写体のアイデンティティ、色、構成を維持しながら、一貫した短いクリップをレンダリングします。
それが重要な理由: HappyHorse 1.0 I2V は、盲目的な人間の好みの投票において、Seedance 2.0 や他の商用システムを上回り、Elo 1392 で Artificial Analysis の画像からビデオへのアリーナでトップに立っています。 DMD-2 蒸留を備えた 15B パラメーターの統合トランスを搭載したこのモデルは、顔の忠実度、製品の形状、またはシーンの連続性を犠牲にすることなく、競争力のある速度で 1080p 出力を提供します。
出力形式: ビデオ / 解像度層: 720P または 1080P / 期間: 3 ~ 15 秒 / ソース: 単一の静止画像 / アスペクト比: 最初のフレームの画像に従います (テキストからビデオへの場合とは異なり、個別の比率パラメータはありません)
| パラメータ | 必須 | タイプ | デフォルト | 範囲/オプション | 説明 |
|---|---|---|---|---|---|
| 画像の URL* | はい | 文字列 | — | JPEG、JPG、PNG、WEBP;最小 300 ピクセルの側面。 1:2.5–2.5:1;最大10MB | モデルがアニメーション化する最初のフレーム画像。 |
| プロンプト* | はい | 文字列 | — | 最大 5000 日中韓以外または 2500 日中韓 | モーション、カメラ、照明、雰囲気 (プロバイダーの切り捨てルールに準拠)。 |
| 解像度 | いいえ | 文字列 | 1080P | 720P、1080P | 出力ビデオ解像度層。 |
| 期間 | いいえ | 整数 | 5 | 3–15 | 出力ビデオの継続時間を秒単位で指定します。 |
| 種子 | いいえ | 整数 | 0 | 0 ~ 2147483647 | オプションのランダムシード。プロバイダーが自動的に選択するようにするには、0 を使用します。 |
| 透かし | いいえ | ブール値 | 本当 | 真、偽 | true (プロバイダーのデフォルト) の場合、右下に「Happy Horse」マークが表示されます。 |
HappyHorse 1.0はネイティブ1080p出力、シネマティックなモーション、マルチショットの一貫性を備えたテキストto動画モデルです。
静止画像をリアルな2K映像へ変換。精密で自然な動きをAIが自動生成。
写真を自然な動きと音声で再現し、魅力的なトーキング動画を簡単生成
テキスト プロンプトと 1 ~ 3 つの参照クリップから動画を作成し、長さ、出力サイズ、ショット構造、シード、ネガティブ プロンプト、音声生成をコントロールします。
1枚の必須画像を、必須プロンプトに従って動画化します。出力サイズ、フレーム数、フレームレート、カメラ動作強度、シード、ステップ、ガイダンス、シフトを設定できます。
Google Veo 3でテキストプロンプトから動画を生成し、音声を生成するかどうかを選択します。
HappyHorse 1.0 I2V は、HappyHorse 1.0 のイメージからビデオへのバージョンであり、Elo 1392 の Artificial Analysis Image-to-Video Arena のナンバー 1 モデルです。 HappyHorse 1.0 I2V は、15B パラメーターの統合トランスフォーマーを使用して、単一のソース画像をネイティブ 1080p ビデオにアニメーション化し、物理的に正確なモーションを追加しながら、被写体のアイデンティティ、色、照明、構成を維持します。
Artificial Analysis ビデオ アリーナ (ブラインド A/B 人間優先 Elo システム) では、HappyHorse 1.0 I2V は Elo 1392 の音声なしの画像からビデオへのカテゴリで第 1 位を保持しています。2026 年初頭の時点で、Seedance 2.0 より約 30 ~ 50 Elo ポイント上、Kling 3.0 Pro、Veo 3.1、および Runway Gen-4.5 よりもはるかに上回っています。
HappyHorse 1.0 I2V は、3 ~ 15 秒の選択可能な持続時間でネイティブ 720P または 1080P HD クリップを出力します。出力アスペクト比はソース画像の比率に従い、詳細レベルは再グレーディングなしで広告配信やソーシャル パブリッシングに適しています。
はい。 HappyHorse 1.0 I2V は、入力フレームからの顔の特徴、製品の形状、パッケージングの詳細、全体的な構成を保持するように設計されています。クリップ全体でアイデンティティとレイアウトを安定させながら、モーション、カメラの動き、照明の進化を適用します。
プロンプトでは、モーションとカメラの言語について説明する必要があり、画像が示している内容を再度説明するものではありません。ドリフト、ドリーイン、軌道、傾く、明らかにする、まばたきする、息をするなどの動詞を使用します。固定しておくべきもの (アイデンティティ、パッケージング、背景) を指定します。照明の進化と雰囲気を追加して、映画のような結果を実現します。
HappyHorse 1.0 I2V は、40 層の 150 億パラメータのシングルストリーム セルフアテンション トランスフォーマを搭載しています (サンドイッチ設計 - 端にモダリティ固有の埋め込み/デコード、中央に 32 の共有パラメータ層)。 DMD-2 蒸留により、分類子を使用しないガイダンスなしで推論が 8 つのノイズ除去ステップに削減され、H100 で約 38 秒で 1080p クリップが可能になります。
HappyHorse 1.0 I2V は、製品発表クリップ、ポートレート アニメーション、キャラクター モーション ショット、映画のような広告ティーザー、パッケージからプレゼンテーションへの移行、およびすでに強力な静止画像があり、それを安定したアイデンティティで動かす必要がある短い形式のソーシャル コンテンツに最適です。
RunComfy is the premier ComfyUI platform, offering ComfyUI online environment and services, along with ComfyUI workflows featuring stunning visuals. RunComfy also provides AI Models, enabling artists to harness the latest AI tools to create incredible art.





