Model icon
omni-flash
Text to Video
Image to Video
Video to Video
Modelo:
Omni Flash API admite la fusión de referencias text-to-video, image-to-video, three-image y la generación video-input con controles de 720p, 1080p, duración y aspect-ratio.
Input
168/20000
Added 1/3

Drop files here, paste files, or add a URL. Use no image for text-to-video, one image for image-to-video, or three images for reference fusion.

Image Urls 1
——

Drop files here, paste files, or add a URL. video/mp4,video/quicktime,video/webm,video/x-matroska · 100 MiB

Output

Salida de ejemplo

Estos son datos de muestra. Genere un nuevo resultado para ver el resultado real.

ID de tarea:OMNIFLASHPREVIEWCreado:2026-06-03T00:00:00
Estado:finishedProgreso:100%

Example video

Detalles de precios

Precios transparentes sin tarifas ocultas. Pague solo por lo que use.

Googleomni-flash
720p/1080p - no video input - 4s
Precio de PoYo
$0.600/generación
120 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
720p/1080p - no video input - 6s
Precio de PoYo
$0.750/generación
150 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
720p/1080p - no video input - 8s
Precio de PoYo
$1.00/generación
200 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
720p/1080p - no video input - 10s
Precio de PoYo
$1.10/generación
220 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
4K - no video input - 4s
Precio de PoYo
$1.25/generación
250 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
4K - no video input - 6s
Precio de PoYo
$1.50/generación
300 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
4K - no video input - 8s
Precio de PoYo
$1.75/generación
350 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
4K - no video input - 10s
Precio de PoYo
$2.25/generación
450 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
720p/1080p / con entrada de vídeo
Precio de PoYo
$1.50/generación
300 créditos
Precio oficial
-
Ahorras
-
Googleomni-flash
4K / con entrada de vídeo
Precio de PoYo
$2.00/generación
400 créditos
Precio oficial
-
Ahorras
-

* Las tarifas reales se basan en el resultado final.

Introducción

Guía completa para usar Omni Flash API para generación de vídeo multimodal

Omni Flash API para generación de vídeo multimodal

Omni Flash en PoYo acepta un prompt solo, un prompt con una imagen fuente, tres imágenes de referencia o una referencia de video corta. Está diseñado para flujos de trabajo de video cortos donde los equipos necesitan controles prácticos de resolución, relación de aspecto y duración, manteniendo al mismo tiempo la request pública API compacta.

Características clave de Omni Flash API

Los ejemplos de página utilizan medios PoYo-hosted CDN y coinciden con los modos API admitidos: generación text-to-video, image-to-video y video-input.

01

Genera movimiento desde un solo prompt

Utilice la generación text-only cuando desee clips conceptuales rápidos sin preparar el medio de origen. Describe la física de la escena, el movimiento de la cámara, el comportamiento del material y la atmósfera en el prompt, luego elige una salida de 720p o 1080p.

  • Text-to-video sin entrada de imagen o vídeo
  • Controles de duración de 4, 6, 8 o 10 segundos
  • Relaciones de aspecto para diseños de pantalla ancha, vertical, cuadrado y vertical

02

Animar una imagen conservando el sujeto.

Para image-to-video, cargue una imagen de origen y explique cómo debe moverse. Este ejemplo oficial de dibujo de diente de león de DeepMind de Google mantiene el arte lineal simple como ancla visual y lo convierte en una escena animada corta.

  • Una imagen URL para image-to-video
  • Detalles de movimiento y entorno Prompt-led
  • Útil para bocetos, marcos de productos y conceptos visuales.

03

Utilice una referencia de vídeo para la transferencia de movimiento y estilo.

Cuando se proporciona un vídeo fuente, Omni Flash cambia a un flujo de trabajo video-input. Úselo para transferir señales de movimiento, sincronización o estructura de escena y, opcionalmente, agregue imágenes de referencia a través de la misma request.

  • Como máximo un vídeo URL por request
  • Se omite la duración de los trabajos video-input
  • Admite niveles de resolución de 720p y 1080p

Qué construyen los equipos con Omni Flash API

01

Borradores de vídeo conceptuales

Genere clips cortos a partir de prompts para presentaciones, guiones gráficos y pruebas de dirección creativa.

02

Activos de Image-to-video

Anime fotografías de productos, ilustraciones y fotogramas fijos en breves clips sociales o de campaña.

03

Fusión de imágenes de referencia

Envíe tres imágenes de origen cuando una escena necesite múltiples referencias visuales en una request de generación.

04

Variaciones de Video-input

Utilice una referencia de vídeo para guiar el movimiento mientras ajusta el aspecto final y la resolución de salida.

Omni Flash vs Veo 3.1 vs Seedance 2.0 - Comparación de modelos en vídeo

Funciónflash omnidireccionalVeo 3.1Seedance 2.0
ProviderGoogle Gemini OmniGoogle Mente Profunda VeoByteDance Seedance
Mejor paraEdición de video conversacional, iteración prompt-to-video, image-to-video y reference-guidedGeneración cinematográfica, audio nativo, tomas image-guided y previsualización de producción.Historias de Multi-shot, generación nativa de audio-video, lip-sync y referencias multimodales complejas
Posicionamiento oficialCree y edite videos a partir de cualquier entrada, con comprensión del mundo y refinamiento de la conversación.Modelo líder en generación de video para cineastas y narradores, con realismo, adherencia prompt y audio.Modelo de generación multimodal nativo audio-video para entradas de texto, imagen, audio y video.
Modos de entrada en PoYoSolo Prompt, imagen 1, imágenes 3 o video 1 URLPrompt, guía de imágenes, primeros cuadros /last, imágenes de referencia o extensión de video según el nivelFlujos de trabajo de referencia de texto, imagen, video y audio a través de la página Seedance 2 API
Salida y audioSalida de vídeo en PoYo; La tarjeta del modelo oficial describe el video high-resolution con audio.Vídeo con audio nativo o salida silenciosa según la configuración del modeloGeneración conjunta nativa audio-video con diálogo, SFX, música y ambiente.
Resolución en PoYo720p, 1080p720p o 1080p según el nivel480p, 720p, 1080p según el modelo
Duración en PoYo4s, 6s, 8s, 10s para trabajos no-video-input; la entrada de vídeo utiliza su propio modoPor lo general, generación 4, 6 u 8; la extensión admite la continuación source-video4-15 segundos, facturados por segundo
Estado de evaluación publicadoGoogle dice que se compartirán evaluaciones detalladas de T2VA, I2VA, R2VA, edición y generación de imágenes cuando el desarrollador y la empresa APIs se implementen.Google publica preferencias, alineación, calidad visual, alineación de audio-video y afirmaciones físicas de Veo 3.1La tarjeta modelo Seedance 2.0 informa amplias mejoras y el rendimiento de leading-level en pruebas de usuarios públicos y expertos
Elija esto cuandoNecesita cobertura de búsqueda Google Omni Flash, lenguaje de edición conversacional y controles compactos PoYo APINecesita un modelo cinematográfico maduro con opciones de audio nativas y pruebas comparativas públicas más sólidas.Necesita clips multi-shot más largos, flujos de trabajo de audio/lip-sync y referencias multimodales más ricas

Las capacidades del modelo cambian rápidamente. La tabla combina información del modelo público y la superficie actual API de PoYo a junio de 2026; verifique los campos de request actuales y los precios en los documentos PoYo antes de la integración de producción.

Cómo utilizar Omni Flash API en PoYo

Paso 1: Cree su clave API
Genere una clave PoYo API y envíe requests a la generación asincrónica unificada endpoint.
Crear clave API

Paso 2: elegir un modo de entrada
Enviar solo prompt para text-to-video, agregue un elemento image_urls para image-to-video, envíe tres imágenes para fusión de referencia o agregue un elemento video_urls para video-input generación.
Agregar créditos

Paso 3: sondear el estado o usar el webhook
Uuse el ID de tarea devuelto para consultar el progreso o proporcionar callback_url para recibir el video terminado de forma asincrónica.
Abra la documentación de API

Flash omnidireccional API FAQ

¿Qué es Omni Flash en Google Flow?

En Google Flow, Omni Flash se refiere a Gemini Omni Flash, el modelo de video conversacional de Google para crear y editar videos a partir de diferentes tipos de entrada. Google lo describe como un modelo que puede crear cualquier cosa a partir de cualquier entrada, comenzando con video, y dice que los usuarios de Flow pueden combinar la inspiración de real-world con contenido generado e iterar de forma conversacional. Anuncio de Google Flow

¿Qué es OmniFlash?

Omni Flash se usa comúnmente para referirse al Omni Flash Gemini de Google. La tarjeta modelo Google DeepMind lo describe como un modelo multimodal nativo para entradas de texto, imagen, audio y video que crea videos high-quality, high-resolution con audio, admite edición conversacional y está diseñado en torno a la comprensión mundial y la multimodalidad. En PoYo, Omni Flash API expone los flujos de trabajo prompt, imagen y video-reference con resolución, duración y controles aspect-ratio. Tarjeta modelo Google DeepMind

¿Cuánto mejor es Omni Flash mejor que Veo 3.1?

No hay una puntuación pública apples-to-apples que demuestre que Omni Flash es un porcentaje fijo mejor que Veo 3.1. Google dice que los detalles de evaluación de Omni Flash para T2VA, I2VA, R2VA, edición de video y generación de imágenes se compartirán cuando el desarrollador y la empresa APIs se lancen. Veo 3.1 ya tiene reclamaciones públicas de referencia de preferencia de Google, alineación de prompt, calidad visual, alineación de audio-video y física realista. En la práctica, elija Omni Flash para la edición conversacional y la iteración any-input; elija Veo 3.1 cuando desee un modelo de vídeo cinematográfico más establecido con evidencia de referencia publicada. Veo 3.1 descripción general

¿Cómo utilizar Google Omni Flash?

En los productos Google, utilice Gemini Omni Flash a través de Gemini, Google Flow, YouTube o Flow Music cuando esté disponible para su plan y región. Comience con un prompt, una imagen, un video u otra referencia, luego refine el resultado mediante las instrucciones de follow-up. En PoYo, cree una clave API, envíe model: "omni-flash" con un prompt y un image_urls o video_urls, luego sondee el estado endpoint o use un webhook para recuperar el video.

¿Qué modos de entrada admite Omni Flash en PoYo?

PoYo admite text-to-video sin medios de origen, image-to-video con una imagen, fusión de referencia con tres imágenes y generación video-input con un video URL.

¿Puedo subir dos imágenes?

No. El API público acepta imágenes 0, 1 o 3 para este modelo. Las requests con dos imágenes se rechazan, por lo que el modo de entrada permanece inequívoco.

¿Puedo enviar duración con video_urls?

No. Cuando se proporcione video_urls, omita la duración. Los trabajos Video-input utilizan su propio modo de generación y facturación fija.

¿Qué resoluciones y relaciones de aspecto están disponibles?

La resolución admite 720p y 1080p. La relación de aspecto admite 16:9, 9:16, 1:1, 4:3 y 3:4.

¿PoYo almacena campos internos de carga útil ascendente?

No. PoYo almacena solo campos de request de user-facing, como prompt, image_urls, video_urls, resolución, duración, relación de aspecto, modelo y callback_url cuando se proporcionan.

Por qué utilizar PoYo para Omni Flash API

01

Asíncrono unificado API

Envíe tareas a través de la misma generación PoYo endpoint y recupere archivos finales con el flujo de estado de tarea estándar.

02

Controles claros

La resolución, la duración, la relación de aspecto, el recuento de imágenes y la entrada de vídeo son campos de request explícitos.

03

Créditos transparentes

La tarjeta modelo y la tabla de precios exponen los niveles de crédito duration-based y video-input antes de la generación.

04

Limpiar entrada almacenada

Los registros de entrada de tareas mantienen únicamente los campos user-facing, lo que simplifica la depuración y la atención al cliente.