Model icon
omni-flash
Text to Video
Image to Video
Video to Video
モデル:
Omni Flash API は、テキストからビデオへ、画像からビデオへ、3 つの画像の参照融合、および 720p、1080p、デュレーション、およびアスペクト比の制御によるビデオ入力生成をサポートします。
Input
168/20000
Added 1/3

Drop files here, paste files, or add a URL. Use no image for text-to-video, one image for image-to-video, or three images for reference fusion.

Image Urls 1

Drop files here, paste files, or add a URL. video/mp4,video/quicktime,video/webm,video/x-matroska · 100 MiB

Output

出力例

これはサンプルデータです。新しい結果を生成すると実際の出力を確認できます。

タスクID:OMNIFLASHPREVIEW作成日時:2026-06-03T00:00:00
ステータス:finished進行状況:100%

Example video

価格詳細

透明な価格設定。隠れた費用はありません。使った分だけ支払えます。

Googleomni-flash
720p/1080p - no video input - 4s
PoYo価格
$0.600/生成
120 クレジット
公式価格
-
節約率
-
Googleomni-flash
720p/1080p - no video input - 6s
PoYo価格
$0.750/生成
150 クレジット
公式価格
-
節約率
-
Googleomni-flash
720p/1080p - no video input - 8s
PoYo価格
$1.00/生成
200 クレジット
公式価格
-
節約率
-
Googleomni-flash
720p/1080p - no video input - 10s
PoYo価格
$1.10/生成
220 クレジット
公式価格
-
節約率
-
Googleomni-flash
4K - no video input - 4s
PoYo価格
$1.25/生成
250 クレジット
公式価格
-
節約率
-
Googleomni-flash
4K - no video input - 6s
PoYo価格
$1.50/生成
300 クレジット
公式価格
-
節約率
-
Googleomni-flash
4K - no video input - 8s
PoYo価格
$1.75/生成
350 クレジット
公式価格
-
節約率
-
Googleomni-flash
4K - no video input - 10s
PoYo価格
$2.25/生成
450 クレジット
公式価格
-
節約率
-
Googleomni-flash
720p/1080p / 動画入力あり
PoYo価格
$1.50/生成
300 クレジット
公式価格
-
節約率
-
Googleomni-flash
4K / 動画入力あり
PoYo価格
$2.00/生成
400 クレジット
公式価格
-
節約率
-

* 実際の料金は最終出力に基づきます。

紹介

Omni Flash マルチモーダルビデオ生成用 API を使用するための完全なガイド

Omni Flash マルチモーダルビデオ生成用 API

PoYo 上の Omni Flash は、プロンプトのみ、1 つのソース画像、3 つの参照画像、または短いビデオ参照を含むプロンプトを受け入れます。これは、チームがパブリック API リクエストをコンパクトに保ちながら、解像度、アスペクト比、再生時間を実際に制御する必要がある短いビデオ ワークフロー向けに構築されています。

Omni Flash APIの主な機能

ページの例では、PoYo でホストされる CDN メディアを使用し、サポートされている API モード (テキストからビデオへ、イメージからビデオへ、およびビデオ入力生成) に一致します。

01

単一のプロンプトからモーションを生成

ソース メディアを準備せずに高速コンセプト クリップが必要な場合は、テキストのみの生成を使用します。プロンプトでシーンの物理学、カメラの動き、マテリアルの動作、雰囲気を説明し、720p または 1080p 出力を選択します。

  • 画像またはビデオ入力を使用しないテキストからビデオへの変換
  • 4s、6s、8s、または 10s 持続時間コントロール
  • ワイドスクリーン、縦型、正方形、縦型レイアウトのアスペクト比

02

被写体を保持したまま 1 つの画像をアニメーション化する

画像からビデオへの変換の場合は、ソース画像を 1 つアップロードし、それがどのように移動するかを説明します。この公式 Google DeepMind 鳥の描画サンプルでは、​​シンプルな線画を視覚的なアンカーとして保持しながら、それを短いアニメーション シーンに変換します。

  • 画像からビデオへの 1 つの画像 URL
  • プロンプト主導の動きと環境の詳細
  • スケッチ、製品フレーム、ビジュアルコンセプトに役立ちます

03

モーションとスタイルの転送にビデオ リファレンスを使用する

ソースビデオが提供されると、Omni Flash はビデオ入力ワークフローに切り替わります。これを使用して、同じリクエストを通じてオプションで参照画像を追加しながら、モーション キュー、タイミング、またはシーン構造を転送します。

  • リクエストごとに最大 1 つのビデオ URL
  • ビデオ入力ジョブの場合、期間は省略されます
  • 720p および 1080p 解像度層をサポート

Omni Flash API を使用してチームが構築するもの

01

コンセプトビデオの草稿

ピッチ、ストーリーボード、クリエイティブ ディレクション テスト用の単純なプロンプトから短いクリップを生成します。

02

画像からビデオへのアセット

製品の写真、イラスト、静止画をアニメーション化して、短いソーシャル クリップやキャンペーン クリップを作成します。

03

参照画像の融合

シーンで 1 回の生成リクエストで複数のビジュアル リファレンスが必要な場合は、3 つのソース イメージを送信します。

04

ビデオ入力のバリエーション

ビデオリファレンスを使用してモーションをガイドし、最終的な外観と出力解像度を調整します。

Omni Flash vs Veo 3.1 vs Seedance 2.0 - ビデオモデルの比較

特徴Omni FlashVeo 3.1Seedance 2.0
プロバイダーGoogle Gemini OmniGoogle DeepMind VeoByteDance Seedance
最適な用途会話型ビデオ編集、プロンプトからビデオへ、画像からビデオへ、リファレンスガイド付き反復映画のような生成、ネイティブ オーディオ、画像ガイド付きショット、制作の事前ビジュアライゼーションマルチショット ストーリー、ネイティブ オーディオビデオ生成、リップシンク、および複雑なマルチモーダル リファレンス
公式的な位置づけ世界を理解し、会話を洗練させて、あらゆる入力からビデオを作成および編集しますリアリズム、迅速な遵守、オーディオを備えた、映画制作者やストーリーテラー向けの主要なビデオ生成モデルテキスト、画像、オーディオ、ビデオ入力用のネイティブ マルチモーダル オーディオ/ビデオ生成モデル
PoYoの入力モードプロンプトのみ、1 つの画像、3 つの画像、または 1 つのビデオ URLプロンプト、画像ガイダンス、最初/最後のフレーム、参照画像、または階層に応じたビデオ拡張子Seedance 2 API ページを介したテキスト、画像、ビデオ、およびオーディオのリファレンス ワークフロー
出力とオーディオPoYo のビデオ出力。公式モデルカードには音声付きの高解像度ビデオが記載されていますモデルの設定に応じて、ネイティブオーディオまたはサイレント出力を含むビデオダイアログ、SFX、音楽、アンビエンスを備えたネイティブ オーディオとビデオの共同生成
PoYoの解像度720p, 1080p層に応じて 720p または 1080p480p、720p、1080p(モデルによる)
PoYoでの持続時間ビデオ入力のないジョブの場合は 4s、6s、8s、10s。ビデオ入力は独自のモードを使用します通常は 4s、6s、または 8s 世代です。拡張機能はソースビデオの継続をサポートします4-15 秒、1 秒ごとに請求されます
公開された評価ステータスGoogle によると、T2VA、I2VA、R2VA、編集、画像生成の詳細な評価は、開発者およびエンタープライズ API の展開時に共有される予定ですGoogle は、Veo 3.1 の設定、調整、ビジュアル品質、オーディオビデオの調整、および物理的主張を公開します。Seedance 2.0 モデル カードは、専門家および一般ユーザーのテストで広範な改善と最高レベルのパフォーマンスを報告
こんなときに選択してくださいGoogle Omni Flash 検索範囲、会話型編集言語、コンパクトな PoYo API コントロールが必要ですネイティブオーディオオプションと強力な公開ベンチマーク証拠を備えた成熟した映画モデルが必要ですより長いマルチショット クリップ、オーディオ/リップシンク ワークフロー、より豊富なマルチモーダル リファレンスが必要

モデルの機能はすぐに変化します。この表は、公開モデル情報と 2026 年 6 月時点の PoYo の現在の API サーフェスを組み合わせたものです。運用統合の前に、PoYo ドキュメントで現在のリクエスト フィールドと価格を確認してください。

PoYo で Omni Flash API を使用する方法

ステップ 1: API キーを作成する
PoYo API キーを生成し、統合非同期生成エンドポイントにリクエストを送信します。
APIキーの作成

ステップ 2: 入力モードを選択する
送信のみ prompt テキストからビデオへの変換の場合は、1 つ追加します image_urls 画像からビデオへの項目、参照融合のために 3 つの画像を送信するか、1 つ追加します video_urls ビデオ入力生成の項目。
クレジットを追加する

ステップ 3: ステータスをポーリングするか、Webhook を使用する
返されたタスク ID を使用して進行状況をクエリするか、 callback_url 完成したビデオを非同期で受信します。
オープンAPIドキュメント

Omni Flash API FAQ

GoogleフローのOmni Flashとは何ですか?

Google フローでは、Omni Flash は、さまざまな種類の入力からビデオを作成および編集するための Google の会話ビデオ モデルである Gemini Omni Flash を指します。 Google は、ビデオをはじめ、あらゆる入力からあらゆるものを作成できるモデルとしてこれを説明し、Flow ユーザーは現実世界のインスピレーションを生成されたコンテンツとブレンドし、会話形式で繰り返すことができると述べています。 Google フローのお知らせ

Omni Flashとは何ですか?

Omni Flash は、Google の Gemini Omni Flash を指すのによく使用されます。 Google DeepMind モデル カードは、テキスト、画像、オーディオ、およびビデオ入力のネイティブ マルチモーダル モデルとして説明しています。これは、オーディオ付きの高品質、高解像度ビデオを作成し、会話型編集をサポートし、世界理解とマルチモーダルを中心に設計されています。 PoYo では、Omni Flash API は、解像度、継続時間、およびアスペクト比の制御を備えたプロンプト、画像、およびビデオ参照ワークフローを公開します。 Google DeepMind モデルカード

Omni Flash は Veo 3.1 に比べてどれくらい優れていますか?

Omni Flash が Veo 3.1 よりも一定の割合で優れていることを証明する公開の同一スコアはありません。 Google によると、T2VA、I2VA、R2VA、ビデオ編集、画像生成に関する Omni Flash の評価詳細は、開発者およびエンタープライズ API が公開されるときに共有される予定です。 Veo 3.1 は、好み、プロンプト調整、ビジュアル品質、オーディオとビデオの調整、および現実的な物理学について、すでに Google ベンチマークを公開しています。実際には、会話型編集と任意の入力反復には Omni Flash を選択します。公開されたベンチマーク証拠を備えた、より確立された映画のようなビデオ モデルが必要な場合は、Veo 3.1 を選択してください。 Veo 3.1の概要

Google Omni Flashの使い方は?

Google 製品では、プランと地域で利用可能な場合は、Gemini、Google Flow、YouTube、または Flow Music を介して Gemini Omni Flash を使用します。プロンプト、画像、ビデオ、またはその他の参考資料から始めて、フォローアップの指示に従って結果を改良します。 PoYo で API キーを作成し、送信します model: "omni-flash" プロンプトとオプション付きimage_urlsまたは video_urls、ステータス エンドポイントをポーリングするか、Webhook を使用してビデオを取得します。

Omni Flash は PoYo でどのような入力モードをサポートしていますか?

PoYo は、ソース メディアを使用しないテキストからビデオへの変換、1 つの画像による画像からビデオへの変換、3 つの画像によるリファレンス フュージョン、および 1 つのビデオ URL によるビデオ入力生成をサポートします。

画像を2枚アップロードしてもいいですか?

いいえ。パブリック API は、このモデルに対して 0、1、または 3 つの画像を受け入れます。 2 つの画像を含むリクエストは拒否されるため、入力モードは明確なままになります。

video_urlsでデュレーションを送信できますか?

いいえ。video_urls が指定されている場合は、期間を省略します。ビデオ入力ジョブは、独自の固定請求および生成モードを使用します。

どの解像度とアスペクト比が利用可能ですか?

解像度は720pと1080pをサポートします。アスペクト比は 16:9、9:16、1:1、4:3、3:4 をサポートします。

PoYo は内部アップストリーム ペイロード フィールドを保存しますか?

いいえ。PoYo は、プロンプト、image_urls、video_urls、解像度、期間、aspect_ratio、モデル、callback_url などのユーザー向けリクエスト フィールド (指定されている場合) のみを保存します。

Omni Flash API に PoYo を使用する理由

01

統合された非同期 API

同じ PoYo 生成エンドポイントを通じてタスクを送信し、標準のタスク ステータス フローで最終ファイルを取得します。

02

明確なコントロール

解像度、継続時間、アスペクト比、画像数、ビデオ入力は明示的なリクエスト フィールドです。

03

透明性のあるクレジット

モデル カードと価格表は、生成前に期間ベースおよびビデオ入力のクレジット階層を公開します。

04

保存された入力をクリーンアップする

タスク入力レコードにはユーザーに表示されるフィールドのみが保持されるため、デバッグとカスタマー サポートが簡素化されます。