Examples
가격 세부정보
숨겨진 비용 없이 투명한 가격입니다. 사용한 만큼만 지불하세요.
Text to speech
PoYo 가격
$0.080
16 크레딧
공식 가격
$0.100
Fal
절약률
20%
| 모델 | 사양 | PoYo 가격 | 공식 가격 | 절약률 |
|---|---|---|---|---|
Text to speech | $0.080 16 크레딧 per 1000 characters | $0.100 Fal | 20% |
* 실제 비용은 최종 출력을 기준으로 합니다.
소개
표현력 있는 AI 음성을 위한 합리적인 ElevenLabs V3 TTS API 사용에 대한 전체 가이드
표현력 있는 AI 음성을 위한 합리적인 ElevenLabs V3 TTS API
PoYo에서 ElevenLabs V3 TTS text-to-speech 워크플로를 구축하세요. [excited], [whispers], [laughs] 같은 태그로 톤을 지시하고 voice, stability, language_code, normalization, timestamps를 하나의 비동기 API로 제어합니다.
PoYo에서 사용 가능한 ElevenLabs V3 TTS API 모델
01
프로덕션용 표현력 TTS 모델입니다. PoYo에서는 1000자당 16 크레딧, 즉 1000자당 $0.08로 사용할 수 있습니다.
ElevenLabs V3 TTS가 다른 이유
단순히 텍스트를 읽는 것이 아니라 스크립트를 연기하도록 설계되었습니다.
01
스크립트에서 직접 연기 지시
텍스트 안의 audio tags로 감정, 속도, 음성 반응을 제어할 수 있습니다.
- [excited], [whispers], [laughs] 같은 태그
- 더 자연스러운 내레이션과 대화
- 스크립트와 연기 지시를 하나의 입력에 유지

02
제품 통합을 위한 API 제어
text, voice, stability, timestamps, language_code, apply_text_normalization을 전송합니다. 프리셋 voice 또는 사용자 ElevenLabs voice ID를 사용할 수 있습니다.
- stability는 0에서 1 사이
- language_code로 다국어 생성
- timestamps로 자막과 편집 정렬

무엇을 만들 수 있나요
01
영상 보이스오버
릴스, 제품 데모, 광고, 출시 영상용 표현력 있는 내레이션을 생성합니다.
02
학습 콘텐츠
강의 스크립트와 튜토리얼을 명확한 음성으로 변환합니다.
03
캐릭터와 대화
audio tags로 캐릭터 대사, 앱 어시스턴트, 대화형 콘텐츠를 프로토타이핑합니다.
04
현지화
language_code와 normalization으로 다국어 음성 자산을 생성합니다.
ElevenLabs V3 TTS API vs fal.ai ElevenLabs V3 TTS — 모델 비교
PoYo는 간단한 비동기 생성 워크플로와 더 낮은 기준 가격으로 ElevenLabs V3 TTS를 제공합니다.
| 항목 | PoYo | fal.ai |
|---|---|---|
| 공개 모델 ID | elevenlabs-v3-tts | fal-ai/elevenlabs/tts/eleven-v3 |
| 가격 | $0.08 / 1000자 | $0.10 / 1000자 |
| PoYo 크레딧 | 16 크레딧 / 1000자 | N/A |
| 최대 텍스트 | 5000자 | 제공자에 따라 다름 |
PoYo는 1000자당 16 크레딧을 사용합니다. 1 크레딧은 $0.005입니다.
PoYo에서 ElevenLabs V3 TTS 사용 방법
- API 키 받기: PoYo 계정을 만들고 대시보드에서 API 키를 생성합니다. API 키 받기 ->
- 스크립트 작성: 1-5000자를 입력하고 [excited], [whispers], [laughs] 같은 태그를 추가합니다.
- 음성 설정 선택: 프리셋 voice 또는 사용자 voice ID를 입력하고 stability, language_code, timestamps, normalization을 설정합니다.
- 제출 및 조회: 생성 작업을 제출한 뒤 표준 상태 API로 오디오 파일을 받습니다. API 문서 보기 ->
ElevenLabs V3 TTS FAQ
ElevenLabs V3 TTS란 무엇인가요?
스크립트를 자연스러운 AI 음성으로 변환하는 표현력 중심 text-to-speech 모델입니다. audio tags, 감정, voice, 언어 제어를 지원합니다.
어디에 사용할 수 있나요?
보이스오버, 내레이션, 제품 데모 오디오, 교육 콘텐츠, 캐릭터 대사, 앱 어시스턴트, 현지화, 숏폼 음성에 사용할 수 있습니다.
사용자 지정 voice를 쓸 수 있나요?
예. voice 필드는 voice 이름 또는 사용자 ElevenLabs voice ID를 받을 수 있습니다.
요금은 어떻게 계산되나요?
PoYo는 1000자당 16 크레딧, 즉 1000자당 $0.08로 과금합니다.
PoYo를 사용하는 이유
01
합리적인 가격
ElevenLabs V3 TTS를 1000자당 $0.08로 사용할 수 있습니다.
02
통합 모델 접근
오디오, 이미지, 영상 모델을 같은 계정, 결제, 상태 조회, callback으로 이용합니다.
03
프로덕션 워크플로
비동기 작업을 제출하고 완료된 오디오 파일을 안정적으로 가져옵니다.
04
명확한 제어
text, voice, stability, language, normalization, timestamps를 제어합니다.