GPT Image 2.5 API 출시. 이미지 생성과 편집을 시작하세요 →
GPT Image 2.5 API 출시. 이미지 생성과 편집을 시작하세요 →
PoYoPoYo
API 마켓
가격
엔터프라이즈
Ctrl+K
poyo.ai

하나의 API. 모든 모델.

개발자를 위해 구축

All systems operational

리소스

  • 대안 허브
  • 비교 허브
  • 블로그
  • 제공업체
  • 제휴 프로그램
  • Features
  • 사이트맵

© 2025 PoYo API. All rights reserved.

인기 모델hot

  • Seedance 2.5
  • MiniMax H3 / Hailuo 03
  • FLUX 3
  • Nano Banana Pro
  • Seedance 2
  • GPT Image 2

신규 모델new

  • GPT-6.1 Sol
  • Claude Sonnet 5.5
  • MiniMax H3 Max
  • MiniMax H3 Max Turbo
  • Qwen Image 2.1
  • GPT-6 Luna

출시 예정soon

  • Wan Animate 2

모든 제공업체

Google

  • Nano Banana Pro
  • Gemini Omni 1.1 Flash
  • Gemini 3.7 Flash
  • Gemini 3.8 Flash
  • Gemini 3.1 Flash TTS
  • Nano Banana
  • Veo 3.1
  • Veo 3.1 Official
  • Omni Flash
  • Nano Banana 2
  • Gemini 3.5 Flash
  • Nano Banana 2 Lite
  • Gemini 3 Series

Kling

  • Kling 3.0 Motion Control
  • Kling 3.0
  • Kling O3
  • Kling 1.6
  • Kling 2.1
  • Kling 2.6
  • Kling Avatar 2.0
  • Kling 2.5 Turbo Pro
  • Kling 3.0 Turbo
  • Kling 2.6 Motion Control
  • Kling O3 Image
  • Kling O1 Image

Anthropic

  • Claude Sonnet 5
  • Claude Fable 5.1
  • Claude Opus 5
  • Claude Opus 5.5
  • Claude Sonnet 5.5
  • Claude Opus 4.8
  • Claude Opus 4.7
  • Claude 4.6 API
  • Claude 4.5 Series

MiniMax

  • MiniMax H3 / Hailuo 03
  • MiniMax H3 Max
  • MiniMax H3 Max Turbo
  • MiniMax Music 2.6
  • Hailuo 02
  • Hailuo 2.3

Tripo3D

  • Tripo3D H3.1
  • Tripo3D P1

Moonshot AI

  • Kimi K3

OpenAI

  • GPT Image 2
  • Sora 2 Official
  • GPT-6 Astra
  • GPT-6 Sol
  • GPT Image 2.5
  • GPT-5.6
  • GPT-6 Luna
  • GPT-6.1 Sol
  • GPT Image 1.5
  • GPT-4o Image
  • GPT-5.5
  • GPT-5.4
  • GPT-5.2

Seedream

  • Seedream 5.0 Pro
  • Seedream 4
  • Seedream 4.5
  • Seedream 5.0 Lite

Seedance

  • Seedance 2.5
  • Seedance 2
  • Seedance 2.0 Mini
  • Seedance 1.0 Pro
  • Seedance 1.5 Pro

DeepSeek

  • DeepSeek V4 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4.1 Flash

Hunyuan

  • Hunyuan 3D v3.1

ElevenLabs

  • ElevenLabs Music
  • ElevenLabs TTS Turbo v2.5
  • ElevenLabs V3 TTS

Black Forest Labs

  • FLUX 3
  • FLUX.2
  • Flux Kontext
  • Flux Dev
  • Flux Schnell

Alibaba

  • Qwen Image 3.0
  • Happy Horse 1.1
  • Wan 2.7 Video
  • Wan 3.0
  • Wan 3.0 Video Prime
  • Qwen Image 2.1
  • Wan Animate 2
  • Wan 2.2 Fast
  • Z-Image
  • Wan 2.5
  • Wan 2.6
  • Wan 2.7 Image
  • Wan Animate
  • Happy Horse

xAI

  • Grok 4.6
  • Grok 4.7
  • Grok Imagine Image 2.0
  • xAI TTS 1
  • Grok Imagine
  • Grok Imagine Video 1.5
  • Grok Imagine Image Quality

Meshy

  • Meshy 6 3D

Runway

  • Runway Gen-4.5

PoYo

  • AI Video Background Removal
  • AI Video Upscaler
  • Image Translator
  • Video Translator
  • Suno Music
GitHubXInstagramYouTubeDiscordTelegramEmail
고객 지원문서
이미지비디오3D오디오아바타도구
Loading playground...
오디오 생성기 가이드

음성과 음악 제작을 위한 완전한 오디오 생성기 사용에 대한 전체 가이드

음성과 음악 제작을 위한 완전한 오디오 생성기

PoYo 오디오 생성기는 음성, 보이스오버, 음악 생성 모델을 하나의 집중된 워크스페이스에 모읍니다. ElevenLabs, Gemini, xAI, MiniMax 등 실행 가능한 오디오 모델을 Input 패널에서 바로 선택할 수 있습니다.

각 모델은 고유 설정을 유지하므로 언어, 목소리, 감정 태그, 속도, 가사, 인스트루멘털 모드, 출력 형식, 미리보기, JSON 응답, 다운로드가 지원되는 경우에만 표시됩니다.

시작하기

PoYo 오디오 생성기 핵심 기능

음성, 보이스오버, 음악을 생성하고 미리보기, 다운로드, API 검증까지 이어갑니다.

01

표현력 있는 다국어 Text-to-Speech

스크립트, 제품 문구, 내레이션, 대화를 자연스러운 오디오로 변환합니다. 지원 모델은 목소리, 언어, 감정 태그, 텍스트 정규화, 속도, 타임스탬프를 제공합니다.

  • 텍스트 스크립트에서 보이스오버 생성
  • 지원 시 언어, 목소리, 전달 방식을 제어
  • 앱, 영상, 강의, 에이전트용 음성 제작
다국어 Text-to-Speech 워크플로

02

Prompt-to-Music 및 곡 생성

프롬프트, 가사, 인스트루멘털 설정, 구조화된 작곡 아이디어로 음악을 만듭니다. 데모, 후크, 배경 트랙, 창작 방향 탐색에 적합합니다.

  • 곡, 인스트루멘털, 음악 콘셉트 생성
  • 무드, 장르, 편곡, 가사, 보컬 제어
  • 모델별 작곡 필드 활용
Prompt-to-Music 워크플로

03

모델별 품질, 지연 시간, 형식 제어

오디오 모델 패밀리를 전환해도 각 모델의 기본 제어를 유지합니다. 빠른 TTS, 표현력 있는 음성, 음악 생성, 샘플레이트, 비트레이트, 출력 형식이 활성 모델에 맞춰 표시됩니다.

  • 하나의 선택기에서 오디오 제공자 비교
  • 활성 모델이 지원하는 파라미터만 표시
  • MP3, WAV, OGG, PCM 또는 제공자 형식 선택
오디오 모델 제어와 형식

04

미리보기, 다운로드, API 핸드오프

생성된 오디오를 브라우저에서 듣고, JSON과 타임스탬프를 확인하며, 최종 파일을 다운로드한 뒤 API 또는 에이전트 워크플로로 옮길 수 있습니다.

  • 다운로드 전 오디오 출력 확인
  • 편집과 게시용 파일 다운로드
  • API 통합 전 프롬프트와 파라미터 검증
오디오 미리보기와 API 핸드오프

PoYo 오디오 생성기로 만들 수 있는 것

01

영상 보이스오버와 더빙

스크립트에서 제품 설명, 짧은 영상, 튜토리얼, 다국어 더빙 초안을 생성합니다.

02

팟캐스트, 오디오북, 강의 내레이션

강의 음성, 챕터 미리듣기, 팟캐스트 세그먼트, 긴 내레이션 테스트를 만듭니다.

03

다국어 앱 음성과 접근성

앱 음성, 온보딩 내레이션, 읽기 보조형 오디오, 현지화된 음성 경험을 프로토타입합니다.

04

음악 데모, 노래, 인스트루멘털

프롬프트, 가사, 스타일 방향으로 곡 아이디어, 배경 트랙, 후크, 데모를 만듭니다.

05

소셜, 게임, 크리에이티브 오디오

캐릭터 목소리, 게임 UI 사운드, 크리에이터 에셋, 인터랙티브 오디오 콘셉트를 탐색합니다.

06

개발자, API, 에이전트 워크플로

API 제품에 통합하기 전에 프롬프트, 목소리, 형식, 미리보기, JSON 응답을 검증합니다.

PoYo에서 오디오 생성기 사용 방법

1. Input 패널에서 오디오 모델을 선택합니다. 음성 또는 음악 워크플로에 맞는 제공자와 실행 모델을 선택하세요.

2. 텍스트, 가사, 음악 방향을 추가합니다. 스크립트, 프롬프트, 언어, 목소리 스타일, 무드, 악기, 가사를 입력합니다.

3. 모델별 설정을 조정합니다. 목소리, 감정 태그, 속도, 샘플레이트, 비트레이트, 형식, 가사 최적화, 인스트루멘털 모드를 설정합니다.

4. 실행, 미리보기, 다운로드합니다. 생성을 제출하고 오디오를 들어본 뒤 필요한 경우 JSON을 확인하고 파일을 다운로드합니다.

오디오 생성기 FAQ

오디오 생성기는 무엇을 만들 수 있나요?

선택한 모델에 따라 Text-to-Speech, 보이스오버, 내레이션, 대화, 음악 데모, 노래, 인스트루멘털을 만들 수 있습니다. Input 패널은 활성 모델이 지원하는 필드만 보여줍니다.

처음에는 어떤 오디오 모델을 선택해야 하나요?

표현력 있는 보이스오버는 ElevenLabs V3 TTS, 빠른 음성 테스트는 ElevenLabs TTS Turbo v2.5 또는 xAI TTS 1, 스타일 지시형 음성은 Gemini 3.1 Flash TTS, 구조화된 음악은 ElevenLabs Music, 프롬프트와 가사 워크플로는 MiniMax Music 2.6, 범용 음악 생성은 Generate Music으로 시작하세요.

생성된 오디오는 얼마나 자연스럽나요?

품질은 모델, 프롬프트, 언어, 목소리, 출력 설정에 따라 달라집니다. 최신 TTS는 매우 자연스럽지만 실제 사용 전에는 청취 검수, 발음 수정, 속도 확인, 마스터링이 필요할 수 있습니다.

언어, 감정, 목소리, 속도, 음악 스타일을 제어할 수 있나요?

모델이 지원하면 가능합니다. 음성 모델은 언어, 목소리, 속도, 안정성, 스타일, 감정 태그, 타임스탬프를 제공할 수 있고 음악 모델은 장르, 무드, 가사, 인스트루멘털, 구조, 형식을 제공할 수 있습니다.

어떤 오디오 형식을 미리보기 또는 다운로드할 수 있나요?

갤러리는 일반적인 오디오 파일을 브라우저에서 재생합니다. 제공자 응답에 따라 MP3, WAV, OGG, Opus, PCM, mu-law, A-law, 타임스탬프 또는 보조 파일이 포함될 수 있습니다.

오디오 품질을 개선하려면 어떻게 해야 하나요?

깔끔한 스크립트, 발음 힌트, 구체적인 목소리 방향, 자연스러운 속도, 절제된 감정 태그를 사용하세요. 음악은 장르, 무드, 템포, 악기, 보컬, 구조, 가사, 피해야 할 요소를 명확히 쓰세요.

생성 시간과 가격은 어떻게 계산되나요?

모델, 텍스트 길이, 길이, 형식, 음악 길이, 품질 설정, 제공자에 따라 달라집니다. 긴 내레이션이나 음악을 실행하기 전 Input 하단의 현재 모델 비용을 확인하세요.

생성 오디오를 상업적으로 사용할 수 있나요?

상업적 사용은 모델, 제공자 약관, 계정 플랜, 스크립트, 가사, 목소리, 참조 및 업로드 자료의 권리에 따라 달라집니다. 관련 약관을 확인하세요.

PoYo로 오디오를 생성하는 이유

01

여러 오디오 모델을 하나의 공간에서

프롬프트를 다시 만들지 않고 음성, 목소리, 음악 모델을 비교합니다.

02

네이티브 오디오 파라미터

각 모델의 목소리, 언어, 스타일, 가사, 형식, 결과 흐름을 유지합니다.

03

브라우저 오디오 미리보기

다운로드 전에 Output Gallery에서 생성 오디오를 바로 들어봅니다.

04

Playground와 API 워크플로

스크립트, 프롬프트, 목소리, 형식, JSON을 테스트한 뒤 API 제품으로 이동합니다.