Model icon
omni-flash
Text to Video
Image to Video
Video to Video
Model:
Die Omni Flash API unterstützt Text-zu-Video, Bild-zu-Video, Referenzfusion mit drei Bildern und Videoeingabe-Generierung mit Steuerung von 720p, 1080p, Dauer und Seitenverhältnis.
Input
168/20000
Hinzugefügt 1/3

Dateien hier ablegen, einfügen oder eine URL hinzufügen. Use no image for text-to-video, one image for image-to-video, or three images for reference fusion.

Image Urls 1

Dateien hier ablegen, einfügen oder eine URL hinzufügen. video/mp4,video/quicktime,video/webm,video/x-matroska · 100 MiB

Output

Beispielausgabe

Dies sind Beispieldaten. Generieren Sie ein neues Ergebnis, um die echte Ausgabe zu sehen.

Task-ID:OMNIFLASHPREVIEWErstellt:2026-06-03T00:00:00
Status:finishedFortschritt:100%

Example video

Preisinformationen

Transparente Preise ohne versteckte Kosten. Bezahle nur, was du nutzt.

Googleomni-flash
720p/1080p - no video input - 4s
PoYo-Preis
$0.600/gen
120 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
720p/1080p - no video input - 6s
PoYo-Preis
$0.750/gen
150 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
720p/1080p - no video input - 8s
PoYo-Preis
$1.00/gen
200 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
720p/1080p - no video input - 10s
PoYo-Preis
$1.10/gen
220 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
4K - no video input - 4s
PoYo-Preis
$1.25/gen
250 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
4K - no video input - 6s
PoYo-Preis
$1.50/gen
300 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
4K - no video input - 8s
PoYo-Preis
$1.75/gen
350 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
4K - no video input - 10s
PoYo-Preis
$2.25/gen
450 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
720p/1080p / mit Videoeingabe
PoYo-Preis
$1.50/gen
300 Credits
Offizieller Preis
-
Du sparst
-
Googleomni-flash
4K / mit Videoeingabe
PoYo-Preis
$2.00/gen
400 Credits
Offizieller Preis
-
Du sparst
-

* Tatsächliche Gebühren basieren auf dem endgültigen Ergebnis.

Introduction

Vollständige Anleitung zur Verwendung von Omni Flash API für multimodale Videoerstellung

Omni Flash API für multimodale Videoerstellung

Omni Flash auf PoYo akzeptiert nur einen Prompt, einen Prompt mit einem Quellbild, drei Referenzbildern oder eine kurze Videoreferenz. Es ist für Kurzvideo-Workflows konzipiert, bei denen Teams praktische Kontrollen für Auflösung, Seitenverhältnis und Dauer benötigen, während die öffentliche API-Anfrage kompakt bleibt.

Hauptfunktionen der Omni Flash API

Die Seitenbeispiele verwenden von PoYo gehostete CDN-Medien und sind auf die unterstützten API-Modi abgestimmt: Text-zu-Video, Bild-zu-Video und Videoeingabe-Generierung.

01

Bewegung aus nur einem Prompt generieren

Verwenden Sie die Text-Only-Generierung, wenn Sie schnelle Konzeptclips erstellen möchten, ohne Quellmedien vorzubereiten. Beschreiben Sie Physik, Kamerabewegung, Materialverhalten und Atmosphäre im Prompt und wählen Sie dann 720p- oder 1080p-Ausgabe.

  • Text-zu-Video ohne Bild- oder Videoeingabe
  • Dauersteuerung für 4s, 6s, 8s oder 10s
  • Seitenverhältnisse für Breitbild, Hochformat, Quadrat und Porträt

02

Ein Bild animieren und Motiv erhalten

Für Bild-zu-Video laden Sie ein Quellbild hoch und beschreiben, wie es sich bewegen soll. Dieses offizielle Google DeepMind Löwenzahn-Zeichenbeispiel bewahrt die einfache Strichzeichnung als visuelle Ankerpunkt und verwandelt sie in eine kurze animierte Szene.

  • Eine Bild-URL für Bild-zu-Video
  • Bewegung und Umgebungsdetails über Prompt steuerbar
  • Ideal für Skizzen, Produktaufnahmen und visuelle Konzepte

03

Video-Referenz für Bewegung und Stiltransfer verwenden

Wenn ein Quellvideo bereitgestellt wird, wechselt Omni Flash in den Videoeingabe-Workflow. Verwenden Sie es, um Bewegungsmuster, Timing oder Szenenstruktur zu übertragen und optional Referenzbilder über dieselbe Anfrage hinzuzufügen.

  • Maximal eine Video-URL pro Anfrage
  • Dauerangabe entfällt bei Videoeingaben
  • Unterstützt 720p- und 1080p-Auflösungen

Wofür Teams die Omni Flash API nutzen

01

Konzeptvideo-Entwürfe

Erstellen Sie kurze Clips aus einfachen Prompts für Pitches, Storyboards und kreative Tests.

02

Bild-zu-Video Assets

Animieren Sie Produktfotos, Illustrationen und Standbilder zu kurzen Social- oder Kampagnenclips.

03

Fusion von Referenzbildern

Reichen Sie drei Quellbilder ein, wenn eine Szene mehrere visuelle Referenzen in einer Generierungsanfrage benötigt.

04

Variationen mit Videoeingabe

Verwenden Sie eine Video-Referenz, um Bewegungen zu steuern, während Sie das finale Aussehen und die Ausgabeauflösung anpassen.

Omni Flash vs Veo 3.1 vs Seedance 2.0 – Vergleich der Video-Modelle

FeatureOmni FlashVeo 3.1Seedance 2.0
ProviderGoogle Gemini OmniGoogle DeepMind VeoByteDance Seedance
Am besten geeignet fürKonversationelle Videobearbeitung, Prompt-zu-Video, Bild-zu-Video und referenzgestützte IterationFilmische Generierung, natives Audio, bildgesteuerte Aufnahmen und Produktions-PrevisualisierungMehrszenige Geschichten, native Audio-Video-Generierung, Lippensynchronisation und komplexe multimodale Referenzen
Offizielle PositionierungVideos aus beliebigen Eingaben erstellen und bearbeiten – mit Weltverständnis und konversationeller VerfeinerungFührendes Videogenerierungsmodell für Filmemacher und Storyteller mit Realismus, hoher Prompt-Treue und AudioNatives multimodales Audio-Video-Generierungsmodell für Text-, Bild-, Audio- und Videoeingaben
Eingabemodi auf PoYoNur Prompt, 1 Bild, 3 Bilder oder 1 Video-URLPrompt, Bildführung, erstes/letztes Frame, Referenzbilder oder Videoerweiterung – abhängig von der StufeText-, Bild-, Video- und Audio-Referenz-Workflows über die Seedance 2 API-Seite
Ausgabe und AudioVideoausgabe auf PoYo; die offizielle Modellkarte beschreibt hochauflösende Videos mit AudioVideo mit nativem Audio oder ohne Ton, abhängig von den ModelleinstellungenNative gemeinsame Audio-Video-Generierung mit Dialogen, SFX, Musik und Umgebungsgeräuschen
Auflösung auf PoYo720p, 1080p720p oder 1080p, abhängig von der Stufe480p, 720p, 1080p – abhängig vom Modell
Dauer auf PoYo4 s, 6 s, 8 s oder 10 s für Jobs ohne Videoeingabe; bei Videoeingaben wird ein eigener Modus verwendetIn der Regel 4 s, 6 s oder 8 s Generierungsdauer; die Erweiterungsfunktion unterstützt die Fortsetzung von Quellvideos4–15 Sekunden, Abrechnung pro Sekunde
Veröffentlichter EvaluierungsstatusGoogle gibt an, dass detaillierte Evaluierungen für T2VA, I2VA, R2VA, Bearbeitung und Bildgenerierung mit der Einführung der Entwickler- und Enterprise-APIs veröffentlicht werdenGoogle veröffentlicht Angaben zu Veo 3.1 hinsichtlich Präferenz, Alignment, visueller Qualität, Audio-Video-Alignment und PhysiksimulationDie Modellkarte von Seedance 2.0 berichtet über umfassende Verbesserungen und Leistung auf Spitzenniveau in Experten- und öffentlichen Nutzertests
Wählen Sie dieses Modell, wennSie die Google Omni Flash-Suchabdeckung, konversationelle Bearbeitungssprache und kompakte PoYo API-Steuerung benötigenSie ein ausgereiftes filmisches Modell mit nativen Audiooptionen und stärkerer öffentlicher Benchmark-Evidenz benötigenSie längere Mehrszenen-Clips, Audio-/Lippensynchronisations-Workflows und umfangreichere multimodale Referenzen benötigen

Modellfähigkeiten ändern sich schnell. Die Tabelle kombiniert öffentliche Modellinformationen und die aktuelle API-Oberfläche von PoYo (Stand Juni 2026). Prüfen Sie vor der Produktivintegration die aktuellen Request-Felder und Preise in der PoYo-Dokumentation.

So verwenden Sie die Omni Flash API auf PoYo

Schritt 1: Erstelle deinen API-Schlüssel
Generiere einen PoYo API-Schlüssel und sende Anfragen an den einheitlichen asynchronen Generierungs-Endpunkt.
API-Schlüssel erstellen

Schritt 2: Wähle einen Eingabemodus
Sende nur prompt für Text-zu-Video, füge ein image_urls-Element für Bild-zu-Video hinzu, sende drei Bilder für Referenzfusion oder füge ein video_urls-Element für Videoeingabe-Generierung hinzu.
Credits hinzufügen

Schritt 3: Status abfragen oder Webhook nutzen
Verwende die zurückgegebene Aufgaben-ID, um den Fortschritt abzufragen, oder gib callback_url an, um das fertige Video asynchron zu erhalten.
API-Dokumentation öffnen

Omni Flash API FAQ

Was ist Omni Flash in Google Flow?

In Google Flow bezeichnet Omni Flash Gemini Omni Flash, Googles konversationales Videomodell zum Erstellen und Bearbeiten von Videos aus verschiedenen Eingaben. Google beschreibt es als ein Modell, das alles aus beliebigen Eingaben erstellen kann, beginnend mit Video, und sagt, dass Flow-Nutzer reale Inspiration mit generierten Inhalten kombinieren und konversationell iterieren können. Google Flow Ankündigung

Was ist Omni Flash?

Omni Flash wird häufig als Bezeichnung für Googles Gemini Omni Flash verwendet. Die Google DeepMind Model Card beschreibt es als natives multimodales Modell für Text-, Bild-, Audio- und Videoeingaben, das hochqualitative, hochauflösende Videos mit Audio erstellt, konversationelle Bearbeitung unterstützt und auf Weltverständnis sowie Multimodalität ausgelegt ist. Auf PoYo bietet die Omni Flash API Workflows für Prompt, Bild- und Video-Referenzen mit Steuerung von Auflösung, Dauer und Seitenverhältnis. Google DeepMind Model Card

Wie viel besser ist Omni Flash im Vergleich zu Veo 3.1?

Es gibt keine öffentlichen, direkt vergleichbaren Werte, die zeigen, dass Omni Flash einen festen Prozentsatz besser ist als Veo 3.1. Google kündigt an, dass Bewertungsdetails für T2VA, I2VA, R2VA, Videobearbeitung und Bildgenerierung geteilt werden, wenn Entwickler- und Enterprise-APIs verfügbar sind. Veo 3.1 hat bereits öffentliche Benchmark-Angaben zu Präferenz, Prompt-Alignment, visueller Qualität, Audio-Video-Alignment und realistische Physik. In der Praxis wähle Omni Flash für konversationelle Bearbeitung und beliebige Eingabe-Iterationen; Veo 3.1 eignet sich, wenn ein etablierteres cineastisches Videomodell mit veröffentlichten Benchmark-Daten benötigt wird. Veo 3.1 Übersicht

Wie verwendet man Google Omni Flash?

In Google-Produkten verwende Gemini Omni Flash über Gemini, Google Flow, YouTube oder Flow Music, je nach Plan und Region. Beginne mit einem Prompt, Bild, Video oder einer anderen Referenz und verfeinere das Ergebnis über Folgeanweisungen. Auf PoYo erstelle einen API-Schlüssel, sende model: "omni-flash" mit Prompt und optional image_urls oder video_urls, dann frage den Status-Endpunkt ab oder nutze einen Webhook, um das Video abzurufen.

Welche Eingabemodi unterstützt Omni Flash auf PoYo?

PoYo unterstützt Text-zu-Video ohne Quellmedien, Bild-zu-Video mit einem Bild, Referenzfusion mit drei Bildern und Videoeingabe-Generierung mit einer Video-URL.

Kann ich zwei Bilder hochladen?

Nein. Die öffentliche API akzeptiert für dieses Modell 0, 1 oder 3 Bilder. Anfragen mit zwei Bildern werden abgelehnt, um den Eingabemodus eindeutig zu halten.

Kann ich Dauer mit video_urls senden?

Nein. Wenn video_urls angegeben wird, lasse die Dauer weg. Videoeingabe-Jobs nutzen ihre eigene feste Abrechnung und Generierungsart.

Welche Auflösungen und Seitenverhältnisse sind verfügbar?

Auflösung unterstützt 720p und 1080p. Seitenverhältnis unterstützt 16:9, 9:16, 1:1, 4:3 und 3:4.

Speichert PoYo interne Upstream-Payload-Felder?

Nein. PoYo speichert nur nutzerrelevante Anfragefelder wie prompt, image_urls, video_urls, resolution, duration, aspect_ratio, model und callback_url, falls angegeben.

Warum PoYo für die Omni Flash API nutzen?

01

Einheitliche asynchrone API

Sende Aufgaben über denselben PoYo-Generierungsendpunkt und hole fertige Dateien über den Standard-Aufgabenstatus-Flow ab.

02

Klare Steuerungen

Auflösung, Dauer, Seitenverhältnis, Bildanzahl und Videoeingabe sind explizite Anfragefelder.

03

Transparente Credits

Die Model Card und Preistabelle zeigen Dauer- und Videoeingabe-Creditstufen vor der Generierung an.

04

Sauber gespeicherte Eingaben

Aufgabenaufzeichnungen enthalten nur nutzerrelevante Felder, was Debugging und Support vereinfacht.