Seedance 1.5 Pro로 정적인 이미지를 매끄럽고 사실적인 전환과 창의적 유연성을 갖춘 시네마틱 비디오 클립으로 변환하세요.
FLUX 3는 이미지, 영상, 오디오를 함께 학습해 움직임과 소리를 같은 기반에서 이해하는 Black Forest Labs의 차세대 통합 모델입니다. 이 페이지에서는 영상 기능에 초점을 맞춰, 실제 제작 환경에서 FLUX 3 Video를 사용하는 경험을 미리 소개합니다.
참고: FLUX 3 Video는 곧 출시될 예정입니다. Black Forest Labs가 공개 모델과 API를 마무리하는 동안 이 페이지에서 예정된 사용 경험을 미리 확인할 수 있습니다.
크리에이터가 FLUX 3 Video를 선택하는 이유는 다음과 같습니다.
FLUX 3 Video가 제공하는 기능을 간단히 정리하면 다음과 같습니다.
Black Forest Labs는 FLUX 3 Video를 여러 생성 모드를 제공하고 모든 결과에 네이티브 오디오를 포함할 수 있는 하나의 멀티모달 모델로 설명합니다. 공식적으로 확인된 작업은 다음과 같습니다.
이러한 모드 외에도 FLUX 3 Video는 다음 기능을 제공합니다.
FLUX 3 Video가 돋보이는 이유는 영상과 소리를 나중에 붙이는 것이 아니라 처음부터 함께 설계한다는 점입니다. 한 번의 생성으로 동작에 맞춘 대사, 폴리 사운드, 환경음, 음악을 만들 수 있습니다. 문이 닫히는 순간 충격음이 나고, 경고등의 점멸에 맞춰 알람이 울리며, 카메라가 움직이는 같은 샷 안에서 인물이 말하도록 연출할 수 있습니다.
이러한 동기화는 모델의 학습 방식에서 비롯됩니다. Black Forest Labs에 따르면 영상 예측이 FLUX 3 학습 연산량의 95% 이상을 차지했습니다. 이 과정에서 모델은 접촉, 움직임, 무게, 인과관계, 즉 현실 세계가 실제로 작동하는 방식을 학습해야 했습니다. 오디오는 이 월드 모델의 결과로 학습되므로 화면 속 사건과 그 사건에서 발생하는 소리가 맞아떨어지고, 말소리가 입 움직임을 따라갑니다. 크리에이터 입장에서는 움직임이 물리적으로 자연스럽게 보이고, 사운드트랙이 편집을 방해하는 대신 영상의 설득력을 높여 준다는 뜻입니다.
미리보기 단계에서도 예측 가능한 결과를 얻으려면 다음 요령을 활용하세요.
FLUX 3 Video는 아직 얼리 액세스 단계이므로, 현재 가장 명확한 근거는 오디오가 포함된 10초 720p 영상을 사용한 Black Forest Labs의 예비 평가입니다. 이 일대일 비교에서 평가자들이 FLUX 3를 선택한 비율은 Luma Ray 3.2 대비 93%, Runway Gen-4.5 대비 77%, Grok Imagine Video 대비 최대 69%, Kling v3 Pro 대비 60%, Seedance 2.0 및 Gemini Omni Flash 대비 각각 52%였습니다. 초기 수치라 앞으로 달라질 수 있지만, 아래 비교를 단순한 기대가 아닌 현재 확인된 기능을 바탕으로 이해하는 기준이 됩니다.
FLUX 3 Video는 아직 제한적 얼리 액세스 단계인 모델의 미리보기이므로 다음과 같이 기대 수준을 설정하는 것이 좋습니다.
FLUX 3 Video는 모델이 나아갈 방향을 먼저 보여 주는 제품입니다. 정식 출시로 향하는 동안 기능과 제한은 계속 달라질 수 있습니다.
Black Forest Labs는 FLUX 3 AI를 여러 에디션으로 구성된 하나의 멀티모달 기반으로 출시합니다. 각 에디션은 자체 얼리 액세스 기간을 거쳐 단계적으로 공개될 예정입니다. 공식 출시 계획은 다음과 같습니다.
Black Forest Labs는 오픈 웨이트 공개 계획도 확인했습니다. FLUX 3 Dev 백본이 제공되면, 이전 FLUX 버전에서 대규모 LoRA 생태계가 성장했던 것처럼 반복해서 등장하는 캐릭터, 스타일, 브랜드 룩을 위한 FLUX 3 dev LoRA 파인튜닝을 포함한 커뮤니티 FLUX 3 LoRA 워크플로가 자연스럽게 등장할 것으로 예상됩니다.
대부분의 팀에서는 FLUX 3 Video가 일상적인 영상 제작을 담당하고, FLUX 3 Dev와 FLUX 3 dev LoRA가 셀프 호스팅 맞춤화의 가능성을 열어 줍니다.
요약하면, FLUX 3 Video는 곧 RunComfy에 출시될 예정입니다. 프롬프트와 참조 자료를 바탕으로 동기화된 네이티브 오디오가 포함된 시네마틱 영상을 만드는 통합 멀티모달 기반입니다.
Seedance 1.5 Pro로 정적인 이미지를 매끄럽고 사실적인 전환과 창의적 유연성을 갖춘 시네마틱 비디오 클립으로 변환하세요.
텍스트로 3~15초 시네마틱 영상을 만들고 동기화 오디오를 선택해 추가합니다.
필수 입력 이미지를 프롬프트에 따라 동영상으로 만듭니다. 6·8·10초, 1080p~2160p, 25·50 FPS, 고정 16:9, 오디오 생성 여부를 설정할 수 있습니다.
Fast 버전으로 영상 배경을 제거하고 코덱, 가장자리 보정, 피사체 유형을 설정하세요.
필요한 오디오 트랙으로 짧은 소스 동영상을 구동한 다음 감정을 제어하고 범위를 편집하고 영상 길이 불일치 동작 및 표현력을 제어합니다.
Tencent Hunyuan Video로 기존 영상을 새로운 스타일로 변환합니다.
FLUX 3 Video는 곧 출시될 예정입니다. Black Forest Labs가 통합 멀티모달 모델과 API의 공개 버전을 마무리하는 동안, 이 페이지에서 FLUX 3 Video의 사용 경험을 미리 살펴볼 수 있습니다. FLUX 3 백엔드가 활성화되기 전까지 화면에 표시되는 입력 항목과 제한은 현재 이 미리보기를 구동하는 모델의 사양을 따릅니다.
FLUX 3 Video는 프롬프트와 선택적으로 추가한 이미지, 영상, 오디오 참조 자료를 바탕으로 네이티브 오디오가 포함된 짧은 시네마틱 영상을 만드는 모델입니다. 참조 자료와의 일관성, 영상과 소리의 동기화가 중요한 광고 소재, 영화 프리비주얼, 브랜드 스토리텔링 제작에 적합합니다.
FLUX 3 Video는 Black Forest Labs의 기술을 움직임과 소리로 확장해 하나의 멀티모달 기반에 통합합니다. 공식적으로 확인된 기능은 텍스트 투 비디오, 이미지 투 비디오, 비디오 투 비디오, 영상과 오디오 이어 만들기, 키프레임 투 비디오의 다섯 가지입니다. 여기에 네이티브 오디오, 다국어 대사, 한 번에 최대 20초 길이의 영상 생성도 지원할 예정입니다. 실제 향상 폭은 콘텐츠에 따라 달라지므로, 모델이 출시되면 같은 프롬프트로 영상을 비교해 보세요.
FLUX 3 Video는 한 번에 최대 20초 길이의 영상을 생성합니다. 일반적인 영상 모델에서 흔한 10초 제한의 약 두 배로, 대사의 호흡이나 느린 극적 장면을 담을 여유가 있습니다. 캐릭터의 일관성을 유지하면서 여러 장면을 이어 몇 분 길이의 시퀀스로 만드는 것도 가능합니다. 현재 이 미리보기를 구동하는 모델에서는 4~15초를 지정할 수 있으며, 정식 FLUX 3 Video는 최대 20초에 대응하도록 설계되었습니다.
네. 네이티브 오디오는 FLUX 3 Video의 핵심 기능입니다. 현재 이 미리보기를 구동하는 모델에서도 오디오 생성을 켜면 대사, 효과음, 음악이 영상과 동기화된 다국어 립싱크 영상을 출력할 수 있습니다. 무음 영상이 필요하면 오디오 생성을 끌 수 있습니다. 립싱크 품질은 프롬프트의 명확성과 장면 구성에 따라 달라집니다.
FLUX 3는 학습 연산의 대부분을 영상 예측에 사용했기 때문에 접촉, 움직임, 무게, 인과관계처럼 현실 세계가 작동하는 방식을 학습해야 했습니다. 네이티브 오디오도 이 월드 모델을 기반으로 학습되어, 화면 속 사건과 그에 따른 소리가 맞아떨어지고 대사에 입 모양이 따라갑니다. 실제로 FLUX 3 Video는 풍부한 표정과 물리적으로 자연스러운 움직임이 강점으로 꼽힙니다.
네. 참조 자료 가이드는 FLUX 3 Video의 핵심입니다. 참조 이미지와 명확한 프롬프트를 함께 사용하면 프레임이 바뀌어도 인물의 특징, 의상, 분위기를 안정적으로 유지하는 데 도움이 됩니다. 또한 FLUX 3는 원본 영상의 대상을 새로운 장면으로 이어가도록 설계되었습니다. 현재 이 미리보기를 구동하는 모델에서도 지원 한도 안에서 이미지, 영상, 오디오를 참조 자료로 첨부해 일관성을 높일 수 있습니다.
현재 이 미리보기를 구동하는 모델에서는 중국어 prompt는 약 500자 이하, 영어 prompt는 약 1000단어 이하를 권장합니다. 참조용 images는 최대 9장, videos는 최대 3개(각 2~15초), audios는 최대 3개(각 2~15초, 15 MB 미만)까지 첨부할 수 있습니다. 필수 입력은 prompt뿐입니다. FLUX 3 Video 출시 시 제한이 바뀔 수 있으므로 최신 파라미터 패널을 확인하세요.
resolution은 480p, 720p(기본값), 1080p, 4K 중에서 선택할 수 있습니다. aspect_ratio는 adaptive(기본값이며 모델이 가장 가까운 비율을 선택) 또는 16:9, 9:16, 4:3, 3:4, 1:1, 21:9로 고정할 수 있습니다. 현재 이 미리보기를 구동하는 모델에서는 duration에 4~15 사이의 정수를 지정하며 기본값은 5초입니다. 정식 FLUX 3 Video는 한 번에 최대 20초 길이의 영상을 생성하도록 설계되었습니다.
FLUX 3 AI는 여러 에디션을 갖춘 하나의 기반 모델로 계획되어 있습니다. Black Forest Labs는 호스팅형 FLUX 3 Video와 함께 FLUX 3 Image, FLUX 3 Action(로보틱스용 FLUX-mimic), 오픈 웨이트 멀티모달 백본인 FLUX 3 Dev를 발표했습니다. 오픈 웨이트 공개 계획도 확인되었으므로, FLUX 3 Dev 백본이 출시되면 반복해서 등장하는 캐릭터, 스타일, 브랜드 룩을 위한 FLUX 3 dev LoRA 학습을 포함한 커뮤니티 FLUX 3 LoRA 워크플로가 등장할 것으로 예상됩니다.
먼저 RunComfy 모델 UI에서 결과를 시험한 다음, 동일한 Input 필드(prompt, images, videos, audios, aspect_ratio, duration, resolution, generate_audio, seed)를 사용해 RunComfy API로 같은 템플릿을 호출하세요. UI에서 프롬프트와 미디어 제한을 검증한 뒤 계정의 API 키와 크레딧을 사용해 작업을 자동화하면 됩니다.
현재 이 미리보기를 구동하는 Seedance 2.0 Pro는 생성 영상의 길이에 따라 크레딧을 사용합니다. 초당 요금은 480p가 $0.08, 720p가 $0.175, 1080p가 $0.40, 4K가 $0.90입니다. FLUX 3 Video 출시 시 가격도 업데이트되므로 이 페이지에 표시되는 최신 요금을 확인하세요.
RunComfy는 최고의 ComfyUI 플랫폼으로서 ComfyUI 온라인 환경과 서비스를 제공하며 ComfyUI 워크플로우 멋진 비주얼을 제공합니다. RunComfy는 또한 제공합니다 AI Models, 예술가들이 최신 AI 도구를 활용하여 놀라운 예술을 창조할 수 있도록 지원합니다.





