01
단일 프롬프트에서 모션 생성
소스 미디어를 준비하지 않고 빠른 컨셉 클립을 원할 경우 텍스트 전용 생성을 사용하세요. 프롬프트에서 장면 물리학, 카메라 움직임, 재료 동작 및 분위기를 설명한 다음 720p 또는 1080p 출력을 선택합니다.
- 이미지나 비디오 입력 없이 텍스트를 비디오로 변환
- 4s, 6s, 8s 또는 10s 지속 시간 컨트롤
- 와이드스크린, 수직, 정사각형 및 세로 레이아웃의 종횡비
숨겨진 비용 없이 투명한 가격입니다. 사용한 만큼만 지불하세요.
| 모델 | 사양 | PoYo 가격 | 공식 가격 | 절약률 |
|---|---|---|---|---|
720p/1080p - no video input - 4s | $0.600/생성 120 크레딧 /생성 | - | - | |
720p/1080p - no video input - 6s | $0.750/생성 150 크레딧 /생성 | - | - | |
720p/1080p - no video input - 8s | $1.00/생성 200 크레딧 /생성 | - | - | |
720p/1080p - no video input - 10s | $1.10/생성 220 크레딧 /생성 | - | - | |
4K - no video input - 4s | $1.25/생성 250 크레딧 /생성 | - | - | |
4K - no video input - 6s | $1.50/생성 300 크레딧 /생성 | - | - | |
4K - no video input - 8s | $1.75/생성 350 크레딧 /생성 | - | - | |
4K - no video input - 10s | $2.25/생성 450 크레딧 /생성 | - | - | |
720p/1080p / 비디오 입력 있음 | $1.50/생성 300 크레딧 /생성 | - | - | |
4K / 비디오 입력 있음 | $2.00/생성 400 크레딧 /생성 | - | - |
* 실제 비용은 최종 출력을 기준으로 합니다.
멀티모달 비디오 생성을 위한 Omni Flash API 사용에 대한 전체 가이드
페이지 예제는 PoYo 호스팅 CDN 미디어를 사용하며 지원되는 API 모드(텍스트-비디오, 이미지-비디오 및 비디오 입력 생성)와 일치합니다.
01
소스 미디어를 준비하지 않고 빠른 컨셉 클립을 원할 경우 텍스트 전용 생성을 사용하세요. 프롬프트에서 장면 물리학, 카메라 움직임, 재료 동작 및 분위기를 설명한 다음 720p 또는 1080p 출력을 선택합니다.
02
이미지-비디오의 경우 하나의 소스 이미지를 업로드하고 어떻게 이동해야 하는지 설명하세요. 이 공식 Google DeepMind 새 그림 예제는 간단한 라인 아트를 시각적 기준으로 유지하면서 짧은 애니메이션 장면으로 전환합니다.
03
소스 비디오가 제공되면 Omni Flash는 비디오 입력 워크플로로 전환됩니다. 동일한 요청을 통해 선택적으로 참조 이미지를 추가하는 동시에 모션 큐, 타이밍 또는 장면 구조를 전송하는 데 사용합니다.
프레젠테이션, 스토리보드 및 창의적인 방향 테스트를 위한 일반 프롬프트에서 짧은 클립을 생성합니다.
제품 사진, 일러스트레이션, 스틸 프레임을 짧은 소셜 또는 캠페인 클립으로 애니메이션화합니다.
한 생성 요청에서 장면에 여러 시각적 참조가 필요한 경우 소스 이미지 3개를 제출하세요.
최종 모양과 출력 해상도를 조정하는 동안 비디오 참조를 사용하여 모션을 안내합니다.
| 특징 | Omni Flash | Veo 3.1 | Seedance 2.0 |
|---|---|---|---|
| 공급자 | Google Gemini Omni | Google DeepMind Veo | ByteDance Seedance |
| 최고의 대상 | 대화형 비디오 편집, 프롬프트-비디오, 이미지-비디오 및 참조 기반 반복 | 시네마틱 생성, 네이티브 오디오, 이미지 가이드 샷, 프로덕션 사전 시각화 | 멀티샷 스토리, 네이티브 오디오-비디오 생성, 립싱크 및 복잡한 멀티모달 참조 |
| 공식 포지셔닝 | 세계에 대한 이해와 대화 개선을 통해 모든 입력에서 비디오를 만들고 편집합니다. | 현실감, 신속한 준수, 오디오를 갖춘 영화 제작자와 스토리텔러를 위한 선도적인 비디오 생성 모델 | 텍스트, 이미지, 오디오 및 비디오 입력을 위한 기본 다중 모달 오디오-비디오 생성 모델 |
| PoYo의 입력 모드 | 프롬프트만, 이미지 1개, 이미지 3개 또는 비디오 1개 URL | 계층에 따라 프롬프트, 이미지 안내, 첫 번째/마지막 프레임, 참조 이미지 또는 비디오 확장 | Seedance 2 API 페이지를 통한 텍스트, 이미지, 비디오 및 오디오 참조 워크플로 |
| 출력 및 오디오 | PoYo의 비디오 출력; 공식 모델 카드에는 오디오가 포함된 고해상도 비디오가 설명되어 있습니다. | 모델 설정에 따라 기본 오디오 또는 무음 출력이 포함된 비디오 | 대화, SFX, 음악 및 분위기를 갖춘 네이티브 오디오-비디오 공동 생성 |
| PoYo의 해상도 | 720p, 1080p | 계층에 따라 720p 또는 1080p | 모델에 따라 480p, 720p, 1080p |
| PoYo의 지속 시간 | 비디오 입력이 없는 작업의 경우 4s, 6s, 8s, 10s; 비디오 입력은 자체 모드를 사용합니다. | 일반적으로 4s, 6s 또는 8s 세대입니다. 확장은 소스-비디오 연속을 지원합니다 | 4-15초, 초당 청구됨 |
| 게시된 평가 상태 | Google는 개발자 및 엔터프라이즈 API가 출시되면 자세한 T2VA, I2VA, R2VA, 편집 및 이미지 생성 평가가 공유될 것이라고 말합니다. | Google는 Veo 3.1 기본 설정, 정렬, 시각적 품질, 오디오-비디오 정렬 및 물리적 주장을 게시합니다. | Seedance 2.0 모델 카드는 전문가 및 일반 사용자 테스트에서 광범위한 개선과 최고 수준의 성능을 보고합니다. |
| 이럴 때 선택하세요 | Google Omni Flash 검색 범위, 대화형 편집 언어 및 컴팩트한 PoYo API 컨트롤이 필요합니다. | 네이티브 오디오 옵션과 강력한 공개 벤치마크 증거를 갖춘 성숙한 영화 모델이 필요합니다. | 더 긴 멀티샷 클립, 오디오/립싱크 워크플로, 더 풍부한 멀티모달 참조가 필요합니다. |
모델 기능은 빠르게 변경됩니다. 이 표는 공개 모델 정보와 2026년 6월 기준 PoYo의 현재 API 표면을 결합한 것입니다. 생산 통합 전에 PoYo 문서에서 현재 요청 필드와 가격을 확인하세요.
1단계: API 키 생성
PoYo API 키를 생성하고 통합 비동기 생성 엔드포인트에 요청을 제출합니다.
API 키 생성
2단계: 입력 모드 선택
보내기만 prompt 텍스트를 비디오로 변환하려면 하나를 추가하세요. image_urls 이미지-비디오용 항목, 참조 융합을 위해 세 개의 이미지를 보내거나 하나를 추가 video_urls 비디오 입력 생성을 위한 항목입니다.
크레딧 추가
3단계: 상태 폴링 또는 웹훅 사용
반환된 작업 ID를 사용하여 진행 상황을 쿼리하거나 제공합니다. callback_url 완성된 비디오를 비동기적으로 수신합니다.
오픈 API 문서
model: "omni-flash" 프롬프트 및 선택 사항 포함image_urls또는 video_urls, 상태 엔드포인트를 폴링하거나 웹후크를 사용하여 비디오를 검색합니다.동일한 PoYo 생성 엔드포인트를 통해 작업을 제출하고 표준 작업 상태 흐름에 따라 최종 파일을 검색합니다.
해상도, 지속 시간, 화면 비율, 이미지 수 및 비디오 입력은 명시적인 요청 필드입니다.
모델 카드와 가격표에는 생성 전 기간 기반 및 비디오 입력 크레딧 등급이 표시됩니다.
작업 입력 레코드는 사용자에게 표시되는 필드만 유지하므로 디버깅 및 고객 지원이 단순화됩니다.