Alibaba의 HappyHorse 1.0 Video Edit는 스타일 전송, 로컬 교체 및 복장 교체를 위한 텍스트 지침과 참조 이미지로 입력 비디오를 편집합니다.
시작 스틸과 끝 스틸을 업로드하고, 그 사이에 일어나는 일에 대한 간략한 설명을 추가하고, 선택적으로 동기화된 네이티브 오디오가 포함된 짧은 클립을 받으세요. RunComfy에서는 모델 UI에 두 키프레임을 모두 고정한 다음 HTTP API에서 동일한 입력을 재사용할 수 있습니다.
출력 형식: 비디오 / 시작 + 종료 이미지 / 5~20초 / 720p 또는 1080p / 선택적 네이티브 오디오
| 매개변수 | 필수 | 유형 | 기본값 | 범위 / 옵션 | 설명 |
|---|---|---|---|---|---|
| start_image_url* | 예(*) | 문자열 | — | PNG, JPEG, WebP URL | 비디오의 첫 번째 프레임으로 사용된 이미지입니다. |
| end_image_url* | 예(*) | 문자열 | — | PNG, JPEG, WebP URL | 비디오의 마지막 프레임으로 사용된 이미지입니다. |
| 프롬프트* | 예(*) | 문자열 | — | — | 두 프레임 사이의 전환과 모션을 설명하는 텍스트입니다. |
| aspect_ratio | 아니요 | 문자열 | 자동 | 자동, 21:9, 2:1, 16:9, 4:3, 1:1, 3:4, 9:16 | 출력 프레임 모양; 자동을 사용하면 모델이 선택할 수 있습니다. |
| 해결 | 아니요 | 문자열 | 720p | 720p, 1080p | 출력 해상도. |
| 기간 | 아니요 | 정수 | 5 | 5~20 | 클립 길이(초) 실제로 엔드 프레임을 배치할 수 있도록 필요합니다. |
| generate_audio | 아니요 | 부울 | 사실 | 사실, 거짓 | 동기화된 오디오를 생성할지 여부입니다. |
| safety_tolerance | 아니요 | 정수 | 2 | 0~4 | 0이 가장 엄격합니다. 4가 가장 허용적입니다. |
FLUX 3 First Last Frame to Video에 대한 청구는 생성된 클립의 길이와 선택한 해상도를 기준으로 합니다.
| 해결 | 평가 |
|---|---|
| 720p | 초당 $0.17 |
| 1080p | 초당 $0.29 |
예상 비용 예시(720p)
| 기간 | 대략. 비용 |
|---|---|
| 5초 | ~$0.85 |
| 10초 | ~$1.70 |
| 20초 | ~$3.40 |
예상 비용 예시(1080p)
| 기간 | 대략. 비용 |
|---|---|
| 5초 | ~$1.45 |
| 10초 | ~$2.90 |
| 20초 | ~$5.80 |
Alibaba의 HappyHorse 1.0 Video Edit는 스타일 전송, 로컬 교체 및 복장 교체를 위한 텍스트 지침과 참조 이미지로 입력 비디오를 편집합니다.
두 개의 음성과 이미지 한 장으로 동영상을 만들고 화자의 재생 순서를 지정할 수 있습니다.
이미지 한 장으로 역동적인 AI 영상을 만들어내는 혁신적인 도구
프롬프트에서 동영상을 생성하고 LoRA, 해상도, 화면비, 프레임, FPS, 단계, 시드를 설정합니다.
프롬프트, 해상도, 추론, 이미지 가이던스 및 포즈 가이던스 컨트롤을 사용하여 드라이빙 영상의 모션으로 참조 캐릭터 이미지를 애니메이션화합니다.
출력 1초당 $0.42로 만드는 영화 같은 4K 텍스트-투-비디오.
FLUX 3 First Last Frame to Video은 시작 이미지, 끝 이미지 및 텍스트 프롬프트를 가져온 다음 선택적으로 동기화된 기본 오디오를 사용하여 두 키프레임 사이의 모션을 생성합니다. 두 북엔드 프레임이 이미 잠겨 있는 경우 포즈 간 전환, 제품 노출 호 및 장면 브리지에 적합합니다.
FLUX 3 First Last Frame to Video은 시작 및 종료 스틸을 모두 잠그므로 클립의 시작과 끝을 제어할 수 있습니다. FLUX 3 Image to Video에는 시작 이미지만 필요하며 필수 종료 프레임 없이 해당 단일 프레임에서 모션을 계속합니다.
예. 오디오 생성은 기본적으로 켜져 있으므로 FLUX 3 First Last Frame to Video은(는) 그림과 함께 동기화된 음성, SFX 및 분위기를 출력할 수 있습니다. 무성 영상이 필요할 때는 끄세요.
지속 시간은 5초에서 20초 사이의 정수입니다. 명시적인 길이는 전환 속도에 맞게 끝 프레임을 올바르게 배치하는 데 도움이 됩니다.
해결 옵션은 720p(기본값) 및 1080p입니다. 가로세로 비율은 기본적으로 자동으로 설정되어 있습니다. 또는 알려진 게재 형식에 대해 21:9, 2:1, 16:9, 4:3, 1:1, 3:4 또는 9:16을 잠글 수 있습니다.
start_image_url, end_image_url 및 프롬프트가 필요합니다. 선택 필드는 aspect_ratio, 해상도, 기간(5–20, 기본값 5), generate_audio 및 safety_tolerance(0–4, 기본값 2)입니다. 시작 및 종료 이미지는 PNG, JPEG 또는 WebP URL이어야 합니다.
RunComfy 모델 UI에서 프로토타입을 만든 다음 동일한 입력 필드(start_image_url, end_image_url, 프롬프트, aspect_ratio, 해상도, 기간, generate_audio, safety_tolerance)를 사용하여 RunComfy API를 통해 동일한 템플릿을 호출합니다. 먼저 UI에서 프롬프트와 키프레임을 확인한 다음 자동화된 작업에 계정 API 키와 크레딧을 사용하세요.
청구는 생성된 비디오 길이 및 해상도를 기준으로 합니다. 720p에서는 초당 $0.17, 1080p에서는 초당 $0.29입니다. 최신 요금은 이 페이지에 표시된 가격을 참조하세요.
RunComfy is the premier ComfyUI platform, offering ComfyUI online environment and services, along with ComfyUI workflows featuring stunning visuals. RunComfy also provides AI Models, enabling artists to harness the latest AI tools to create incredible art.





