logo
RunComfy
  • ComfyUI
  • ТренерНовое
  • Модели
  • API
  • Цены
discord logo
МОДЕЛИ
Обзор
Все модели
БИБЛИОТЕКА
Генерации
API МОДЕЛЕЙ
Документация API
API-ключи
АККАУНТ
Использование

Wan 2.2 S2V: Генератор речи в видео | RunComfy

wan-ai/wan-2-2/speech-to-video

Объедините одно изображение и один аудиофайл, чтобы создать видео с говорящим, поющим или выступающим персонажем в разрешении 480P или 720P.

Необходимое изображение в формате JPG, JPEG, PNG, BMP или WEBP. Ширина и высота должны быть больше 400, но не превышать 7000 пикселей.
0:00
0:00
Обязательный аудиофайл в формате WAV или MP3 продолжительностью менее 20 секунд и размером менее 15 МБ.
Выберите речь, пение или исполнение; по умолчанию — речь.
Выберите выход 480P или 720P; по умолчанию: 480P.
Idle
The rate is $0.10 per second for 480P, and $0.20 per second for 720P.

Обзор Wan 2.2 S2V

Wan 2.2 S2V превращает обязательное неподвижное изображение и обязательную аудиодорожку в видео с персонажем. Выберите речь, пение или выступление в соответствии с записью, затем задайте разрешение 480P либо 720P. Для изображения и аудио действуют ограничения по формату, размерам, продолжительности и объёму файла.

Возможности Wan 2.2 S2V

Изображение и аудиовход

Создайте видео из одного обязательного изображения и одного обязательного аудиофайла без текстового промпта.

Движение персонажей, управляемое звуком

Используйте запись для создания видеоролика персонажа с выбором режима речи, пения или более широкого выступления.

Три режима анимации

Выберите речь для диалога, пение для вокала или исполнение для более широких сценических задач; по умолчанию используется речь.

Два выходных разрешения

Генерируйте с разрешением 480P по умолчанию или выберите 720P, если требуется более высокое выходное разрешение.

Wan 2.2 S2V новости и примеры на X

Похожие модели

video-background-removal/video-to-video

Отделяйте людей или предметы от фона видео и настраивайте кодек, уточнение краёв и тип объекта.

pikaframes

Создайте в Pikaframes плавную анимацию между начальным и конечным изображениями.

happyhorse-1.0/image-to-video

HappyHorse 1.0 I2V на Alibaba анимирует неподвижное изображение в видео с разрешением 1080p с физически точным движением и объектами со стабильной идентичностью.

pika-2-2/text-to-video

Создавайте качественные видео по текстовым промптам с помощью Pika 2.2.

pixverse/v5.5/image-to-video

Оживите стартовое изображение по тексту и настройте формат, разрешение, длительность, стиль, аудио и несколько клипов.

kling-video-o3/pro/image-to-video

Анимация изображений Pro-уровня: кинематографические ролики длительностью 3–15 с от $0.112 за секунду.

Часто задаваемые вопросы

Какие входные данные требуются для Wan 2.2 S2V?

Требуются одно изображение и один аудиофайл. В этом интерфейсе нет поля для текстового промпта.

Какие форматы изображений поддерживаются?

Используйте JPG, JPEG, PNG, BMP или WEBP. Ширина и высота изображения должны быть больше 400, но не превышать 7000 пикселей.

Каковы требования к аудио?

Используйте аудиофайл в формате WAV или MP3 продолжительностью менее 20 секунд. Размер файла также должен быть меньше 15 МБ.

Какие режимы анимации доступны?

Выберите речь, пение или исполнение. По умолчанию используется речь.

Какие разрешения я могу создать?

Выберите 480P или 720P. По умолчанию — 480P.

Сколько стоит генерация?

Для 5-секундного видео требуется 68 кредитов.

Когда выбирать режимы speech, sing и perform?

Для диалога выберите speech, для вокала — sing, а для более общей анимации персонажа — perform.

Почему загрузка может быть отклонена?

Проверьте поддерживаемый тип файла и ограничения. Изображения должны соответствовать обоим правилам размера, а аудио должно соответствовать правилам формата, продолжительности и размера файла.

Поддерживает ли Wan 2.2 S2V пакетную генерацию?

Да. Поддерживаются пакеты из 1, 2, 3 или 4 задач.

Меняет ли режим исполнения требования к изображению и аудио?

Нет. Для режимов speech, sing и perform действуют одинаковые ограничения по формату, размерам, длительности и объёму файла.

Подписывайтесь на нас
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Поддержка
  • Discord
  • Email
  • Статус системы
  • партнёр
Модели видео
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Посмотреть все модели →
Модели изображений
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Посмотреть все модели →
Юридическая информация
  • Условия обслуживания
  • Политика конфиденциальности
  • Политика в отношении файлов cookie
RunComfy
Авторское право 2026 RunComfy. Все права защищены.

RunComfy - ведущая ComfyUI платформа, предлагающая ComfyUI онлайн среду и услуги, а также рабочие процессы ComfyUI с потрясающей визуализацией. RunComfy также предоставляет AI Models, позволяя художникам использовать новейшие инструменты AI для создания невероятного искусства.

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...