logo
RunComfy
  • ComfyUI
  • TrainerNeu
  • Modelle
  • API
  • Preise
discord logo
MODELLE
Erkunden
Alle Modelle
BIBLIOTHEK
Generierungen
MODELL-APIS
API-Dokumentation
API-Schlüssel
KONTO
Nutzung

Omnihuman 1.5: Porträt- und Audio-Videogenerator | RunComfy

bytedance/omnihuman/v1.5

Erstellen Sie ein Video aus einem erforderlichen Porträtbild und einer erforderlichen Audiospur, die kürzer als 35 Sekunden ist. Fügen Sie optionale Anleitungen in sechs unterstützten Sprachen hinzu und verwenden Sie das Seed-Steuerelement, dessen Standardwert -1 ist.

Erforderliche URL des Porträtbilds, das als visuelle Quelle verwendet wird.
0:00
0:00
Erforderliche URL des steuernden Audios. Der Ton muss kürzer als 35 Sekunden sein.
Optionale Generierungsanleitung. Unterstützte Sprachen: Chinesisch, Englisch, Japanisch, Koreanisch, mexikanischem Spanisch und Indonesisch.
Ganzzahliger Startwert zur Steuerung der Generierung; Standard: -1.
Idle
The rate is $0.18 per second.

Omnihuman 1.5

Omnihuman 1.5 generiert ein Video aus der Porträt-URL im erforderlichen Feld `image_url` und der Audio-URL im erforderlichen Feld `audio_url`. Der Ton muss kürzer als 35 Sekunden sein. Verwenden Sie das optionale `prompt` für die Generierungsanleitung in Chinesisch, Englisch, Japanisch, Koreanisch, mexikanischem Spanisch oder Indonesisch und legen Sie bei Bedarf `seed` fest. Der Standardwert ist -1.

Omnihuman 1.5 Übersicht#


Omnihuman 1.5 verwendet ein erforderliches Porträtbild und eine erforderliche Audiospur, um ein Video zu generieren. Die offengelegten Steuerelemente sind auf die beiden Quell-URLs, optionale Textführung und einen Startwert beschränkt.


Eingaben und Bedienelemente#


  • image_url – Erforderlich. Geben Sie die direkt zugängliche URL eines Porträtbildes an.
  • audio_url – Erforderlich. Geben Sie die direkt zugängliche URL des steuernden Audios an; es muss kürzer als 35 Sekunden sein.
  • prompt – Optionaler Anleitungstext. Unterstützte Sprachen sind Chinesisch, Englisch, Japanisch, Koreanisch, mexikanischem Spanisch und Indonesisch.
  • seed – Ganzzahliger Startwert für die Generierung. Der Standardwert ist -1.

Vorgeschlagener Arbeitsablauf#


  1. Fügen Sie eine Porträtbild-URL zu image_url hinzu.
  2. Fügen Sie eine Audio-URL zu audio_url hinzu und stellen Sie sicher, dass der Titel kürzer als 35 Sekunden ist.
  3. Geben Sie bei Bedarf eine kurze Anleitung in prompt in einer der sechs unterstützten Sprachen ein.
  4. Legen Sie seed fest, wenn Sie eine explizite Seed-Steuerung benötigen, und senden Sie dann die Anfrage.

Das Eingabeschema stellt keine Steuerelemente für Ausgabeauflösung, Seitenverhältnis, Bildrate oder Ausgabeformat bereit.

Verwandte Modelle

ai-avatar/v2/pro

Erstellen Sie ein Avatar-Video aus einer erforderlichen Bild- und Audiodatei, mit einem optionalen Prompt zur Unterstützung bei der Generierung.

seedance-2.5/first-last-frame/720p

Seedance 2.5 First & Last Frame: Verbindet Start- und Endbild zu einem flüssigen filmischen Video

hailuo-02/pro/image-to-video

Animieren Sie mit Hailuo 02 Pro ein Ausgangsbild anhand eines Prompts zu einem sechssekündigen Video.

seed-audio-1.0/text-to-audio

Erzeugt natürliche Sprache und Audio aus Text, Referenzaudio oder einem Bild.

seedance-v1.5-pro/image-to-video

Verwandeln Sie statische Bilder in filmreife Videoclips mit flüssigen, realistischen Übergängen und kreativer Flexibilität – powered by Seedance 1.5 Pro.

kling-video-o3/standard/text-to-video

Erzeuge aus Text filmische Videos von 3 bis 15 Sekunden – auf Wunsch mit Ton.

Häufig gestellte Fragen

Was macht Omnihuman 1.5?

Es generiert ein Video aus der erforderlichen Porträt-URL in image_url und der erforderlichen Audio-URL in audio_url, mit optionaler prompt-Anleitung und seed-Steuerung.

Welche Felder sind Pflichtfelder?

Sowohl image_url als auch audio_url sind erforderlich. prompt und seed sind optionale Steuerelemente.

Was soll ich in `image_url` angeben?

Geben Sie eine direkt zugängliche URL für ein Porträtbild an, das als visuelle Quelle verwendet werden soll.

Wie hoch ist die Begrenzung der Audiodauer?

Der über audio_url bereitgestellte Ton muss kürzer als 35 Sekunden sein.

Welche Sprachen kann ich in `prompt` verwenden?

prompt unterstützt Chinesisch, Englisch, Japanisch, Koreanisch, mexikanischem Spanisch und Indonesisch.

Wie funktioniert `seed`?

seed ist ein ganzzahliges Steuerelement, dessen Standardwert -1 ist.

Was sollte ich überprüfen, bevor ich die Quelldateien übermittle?

Stellen Sie sicher, dass image_url und audio_url direkt zugänglich sind und dass der Ton kürzer als 35 Sekunden ist.

Welche Ausgabesteuerungen werden angezeigt?

Das Eingabeschema stellt keine Felder für Ausgabeauflösung, Seitenverhältnis, Bildrate oder Ausgabeformat bereit.

Was ist die Checkliste für die endgültige Anfrage?

Geben Sie image_url und audio_url an, halten Sie die Audiolänge unter 35 Sekunden, verwenden Sie eine unterstützte Sprache, wenn Sie prompt hinzufügen, und überprüfen Sie seed vor dem Absenden.

Folge uns
  • LinkedIn
  • Facebook
  • Instagram
  • Twitter
Support
  • Discord
  • E-Mail
  • Systemstatus
  • Partner
Videomodelle
  • MiniMax H3 Open
  • FLUX 3 Image to Video
  • MiniMax H3 Open Image to Video
  • Wan 2.6 Flash
  • Happy Horse 1.1 reference to video
  • Seedance 1.5 Pro Text to Video
  • Alle Modelle anzeigen →
Bildmodelle
  • Seedream 5.0 Pro Image Edit
  • Flux 2 Flash Edit
  • Nano Banana Pro
  • seedream 4.0
  • GPT Image 2
  • Qwen Image Edit 2511 LoRA
  • Alle Modelle anzeigen →
Rechtliches
  • Nutzungsbedingungen
  • Datenschutzrichtlinie
  • Cookie-Richtlinie
RunComfy
Urheberrecht 2026 RunComfy. Alle Rechte vorbehalten.

RunComfy ist die führende ComfyUI Plattform, die ComfyUI online Umgebung und Services bietet, zusammen mit ComfyUI Workflows mit atemberaubenden Visualisierungen. RunComfy bietet auch AI Models, Künstlern ermöglichen, die neuesten AI-Tools zu nutzen, um unglaubliche Kunst zu schaffen.

Omnihuman 1.5 Beispiele

Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...
Video thumbnail
Loading...