Model icon
elevenlabs-v3-tts
Text to Speech
모델:
ElevenLabs V3 TTS API는 텍스트 음성 변환, 오디오 생성 및 음성 합성를 지원하며 음악 제작, 오디오 프로덕션, 현지화, 미디어 자동화에 적합합니다.
Input
114/5000

1-5000 characters. Use audio tags for expressive delivery and multi-speaker scripts.

Custom

Use a fal example voice name or enable Custom to enter an ElevenLabs voice ID.

Optional ISO 639-1 language code used to enforce a specific language.

Return aligned timestamp data when available.

Output

예시 출력

이는 샘플 데이터입니다. 새 결과를 생성하면 실제 출력을 확인할 수 있습니다.

작업 ID:elevenlabs-v3-tts-example생성 시간:PoYo official example
상태:finished진행률:100%

ElevenLabs V3 TTS example output

Examples
가격 세부정보

숨겨진 비용 없이 투명한 가격입니다. 사용한 만큼만 지불하세요.

ElevenLabselevenlabs-v3-tts
Text to speech
PoYo 가격
$0.080
16 크레딧
공식 가격
$0.100
Fal
절약률
20%

* 실제 비용은 최종 출력을 기준으로 합니다.

소개

표현력 있는 AI 음성을 위한 합리적인 ElevenLabs V3 TTS API 사용에 대한 전체 가이드

표현력 있는 AI 음성을 위한 합리적인 ElevenLabs V3 TTS API

PoYo에서 ElevenLabs V3 TTS text-to-speech 워크플로를 구축하세요. [excited], [whispers], [laughs] 같은 태그로 톤을 지시하고 voice, stability, language_code, normalization, timestamps를 하나의 비동기 API로 제어합니다.

PoYo에서 사용 가능한 ElevenLabs V3 TTS API 모델

01

elevenlabs-v3-tts

프로덕션용 표현력 TTS 모델입니다. PoYo에서는 1000자당 16 크레딧, 즉 1000자당 $0.08로 사용할 수 있습니다.
Playground 열기

ElevenLabs V3 TTS가 다른 이유

단순히 텍스트를 읽는 것이 아니라 스크립트를 연기하도록 설계되었습니다.

01

스크립트에서 직접 연기 지시

텍스트 안의 audio tags로 감정, 속도, 음성 반응을 제어할 수 있습니다.
  • [excited], [whispers], [laughs] 같은 태그
  • 더 자연스러운 내레이션과 대화
  • 스크립트와 연기 지시를 하나의 입력에 유지
ElevenLabs v3 audio tags interface

02

제품 통합을 위한 API 제어

text, voice, stability, timestamps, language_code, apply_text_normalization을 전송합니다. 프리셋 voice 또는 사용자 ElevenLabs voice ID를 사용할 수 있습니다.
  • stability는 0에서 1 사이
  • language_code로 다국어 생성
  • timestamps로 자막과 편집 정렬
ElevenLabs API audio generation visual

무엇을 만들 수 있나요

01

영상 보이스오버

릴스, 제품 데모, 광고, 출시 영상용 표현력 있는 내레이션을 생성합니다.

02

학습 콘텐츠

강의 스크립트와 튜토리얼을 명확한 음성으로 변환합니다.

03

캐릭터와 대화

audio tags로 캐릭터 대사, 앱 어시스턴트, 대화형 콘텐츠를 프로토타이핑합니다.

04

현지화

language_code와 normalization으로 다국어 음성 자산을 생성합니다.

ElevenLabs V3 TTS API vs fal.ai ElevenLabs V3 TTS — 모델 비교

PoYo는 간단한 비동기 생성 워크플로와 더 낮은 기준 가격으로 ElevenLabs V3 TTS를 제공합니다.
항목PoYofal.ai
공개 모델 IDelevenlabs-v3-ttsfal-ai/elevenlabs/tts/eleven-v3
가격$0.08 / 1000자$0.10 / 1000자
PoYo 크레딧16 크레딧 / 1000자N/A
최대 텍스트5000자제공자에 따라 다름

PoYo는 1000자당 16 크레딧을 사용합니다. 1 크레딧은 $0.005입니다.

PoYo에서 ElevenLabs V3 TTS 사용 방법

  1. API 키 받기: PoYo 계정을 만들고 대시보드에서 API 키를 생성합니다. API 키 받기 ->
  2. 스크립트 작성: 1-5000자를 입력하고 [excited], [whispers], [laughs] 같은 태그를 추가합니다.
  3. 음성 설정 선택: 프리셋 voice 또는 사용자 voice ID를 입력하고 stability, language_code, timestamps, normalization을 설정합니다.
  4. 제출 및 조회: 생성 작업을 제출한 뒤 표준 상태 API로 오디오 파일을 받습니다. API 문서 보기 ->

ElevenLabs V3 TTS FAQ

ElevenLabs V3 TTS란 무엇인가요?

스크립트를 자연스러운 AI 음성으로 변환하는 표현력 중심 text-to-speech 모델입니다. audio tags, 감정, voice, 언어 제어를 지원합니다.

어디에 사용할 수 있나요?

보이스오버, 내레이션, 제품 데모 오디오, 교육 콘텐츠, 캐릭터 대사, 앱 어시스턴트, 현지화, 숏폼 음성에 사용할 수 있습니다.

사용자 지정 voice를 쓸 수 있나요?

예. voice 필드는 voice 이름 또는 사용자 ElevenLabs voice ID를 받을 수 있습니다.

요금은 어떻게 계산되나요?

PoYo는 1000자당 16 크레딧, 즉 1000자당 $0.08로 과금합니다.

PoYo를 사용하는 이유

01

합리적인 가격

ElevenLabs V3 TTS를 1000자당 $0.08로 사용할 수 있습니다.

02

통합 모델 접근

오디오, 이미지, 영상 모델을 같은 계정, 결제, 상태 조회, callback으로 이용합니다.

03

프로덕션 워크플로

비동기 작업을 제출하고 완료된 오디오 파일을 안정적으로 가져옵니다.

04

명확한 제어

text, voice, stability, language, normalization, timestamps를 제어합니다.