Model icon
elevenlabs-v3-tts
Text to Speech
Modelo:
ElevenLabs V3 TTS API genera discurso multilingüe expresivo con etiquetas de audio, entrega emocional y flujos de trabajo de voz dialogue-style.
Input
114/5000

1-5000 characters. Use audio tags for expressive delivery and multi-speaker scripts.

Custom

Use a fal example voice name or enable Custom to enter an ElevenLabs voice ID.

Optional ISO 639-1 language code used to enforce a specific language.

Return aligned timestamp data when available.

Output

Salida de ejemplo

Estos son datos de muestra. Genere un nuevo resultado para ver el resultado real.

ID de tarea:elevenlabs-v3-tts-exampleCreado:PoYo official example
Estado:finishedProgreso:100%

ElevenLabs V3 TTS example output

Examples
Detalles de precios

Precios transparentes sin tarifas ocultas. Pague solo por lo que use.

ElevenLabselevenlabs-v3-tts
Text to speech
Precio de PoYo
$0.080
16 créditos
Precio oficial
$0.100
Fal
Ahorras
20%

* Las tarifas reales se basan en el resultado final.

Introducción

Guía completa para usar ElevenLabs V3 TTS API asequible para voz expresiva de IA

ElevenLabs V3 TTS API asequible para voz expresiva de IA

Cree flujos de trabajo text-to-speech expresivos con ElevenLabs V3 TTS en PoYo. Genere audio de voz natural con IA a partir de guiones, guíe el rendimiento con etiquetas de audio como [emocionado], [susurros] y [risas] y controle la voz, la estabilidad, el idioma, la normalización del texto y las marcas de tiempo a través de un API asíncrono.

Modelos disponibles ElevenLabs V3 TTS API en PoYo

01

elevenlabs-v3-tts

Production-ready expresivo TTS a créditos 16 por caracteres 1000, equivalentes a $0.08 por caracteres 1000 en PoYo, con controles de voz, estabilidad, idioma, normalización y marcas de tiempo.
Prueba el patio de juegos

Por qué ElevenLabs V3 TTS es diferente

ElevenLabs V3 TTS está diseñado para una salida de voz que funciona, no solo lee. Úselo para narraciones, diálogos, locuciones de productos, localización y audio de personajes.

01

Script-Level Dirección de actuación

Controle el tono emocional, la entrega y las reacciones humanas directamente dentro del texto. Esto hace que el mismo campo de guión sea útil tanto para el contenido hablado como para la dirección de la interpretación.
  • Utilice etiquetas como [emocionado], [susurros] y [risas] para guiar el tono.
  • Cree narraciones, diálogos de personajes y voces en off sociales más naturales.
  • Mantenga un único campo de texto como fuente de verdad tanto para el guión como para las pistas de interpretación.
Interfaz de etiquetas de audio ElevenLabs v3

02

Controles API para productos reales

Envíe los campos expuestos en los documentos PoYo API: texto, voz, estabilidad, marcas de tiempo, código_idioma y aplicar_normalización_texto. Utilice nombres de voz preestablecidos en el patio de juegos o pase identificaciones de voz ElevenLabs personalizadas en producción.
  • Mantenga la estabilidad entre 0 y 1 para un comportamiento de voz predecible.
  • Utilice language_code para generación multilingüe.
  • Habilite marcas de tiempo cuando se necesiten datos de alineación posteriores.
ElevenLabs API visual de generación de audio

Lo que puedes construir

01

Locuciones de vídeos cortos

Genere narraciones expresivas para reels, demostraciones de productos, anuncios, explicaciones y videos de lanzamiento.

02

Contenido de aprendizaje

Convierta guiones de cursos, guías de incorporación y tutoriales en audio hablado claro.

03

Personajes y diálogo

Prototipo de líneas de personajes, asistentes de aplicaciones, flujos de juegos de rol y diálogos narrativos mediante etiquetas de audio.

04

Localization

Genere activos de voz multilingües con códigos de idioma y control de normalización de texto.

ElevenLabs V3 TTS API vs fal.ai ElevenLabs V3 TTS - Comparación de modelos

PoYo expone ElevenLabs V3 TTS a través de un flujo de trabajo de generación asíncrono simple con precios de referencia más bajos.
FunciónPoYofal.ai
Público model IDelevenlabs-v3-ttsfal-ai/elevenlabs/tts/eleven-v3
Precio de referencia$0.08 por caracteres 1000$0.10 por caracteres 1000
Créditos PoYoCréditos 16 por caracteres 1000N/A
Longitud máxima del textoPersonajes 5000Dependiente del proveedor
WorkflowEnviar tarea, sondear el estado estándar, descargar archivos de audioProvider-specific endpoint

El precio de PoYo utiliza créditos 16 por caracteres 1000. Un crédito tiene el precio de $0.005.

Cómo utilizar ElevenLabs V3 TTS en PoYo

  1. Obtenga su clave API: Cree una cuenta PoYo y genere una clave API desde el panel. Obtenga la clave API ->
  2. Escriba el guión: Ingrese los caracteres 1-5000 y agregue etiquetas de audio como [emocionado], [susurros] o [risas] cuando desee más expresivo. entrega.
  3. Elija la configuración de voz: Seleccione un nombre de voz preestablecido, ingrese una identificación de voz ElevenLabs personalizada en JSON, ajuste la estabilidad y, opcionalmente, establezca el código de idioma, las marcas de tiempo y apply_text_normalization.
  4. Enviar y recuperar: Envíe la tarea a través del generador API de PoYo, luego sondee el estado de la tarea estándar endpoint para salida de audio. Ver documentos de API ->

ElevenLabs V3 TTS FAQ

¿Qué es ElevenLabs V3 TTS?

ElevenLabs V3 TTS es un modelo expresivo text-to-speech que convierte guiones escritos en audio de voz natural con IA. Está diseñado para seguir etiquetas de audio en línea, señales emocionales, configuraciones de voz y controles de idioma para que el habla generada pueda sonar más dirigida y performance-aware.

¿Para qué se utiliza el ElevenLabs V3 TTS API?

Úselo para generar voces en off, narraciones, audio de demostración de productos, contenido de aprendizaje, diálogos de personajes, voz del asistente de aplicaciones, audio de localización y pistas de voz multimedia short-form.

¿Qué entrada se requiere?

El campo de texto es obligatorio y debe tener entre caracteres 1 y 5000. La voz, la estabilidad, las marcas de tiempo, el código de idioma y la normalización de texto son controles opcionales.

¿Puedo usar una voz ElevenLabs personalizada?

Sí. El campo de voz acepta un nombre de voz o una identificación de voz. El patio de juegos expone voces preestablecidas comunes y el modo JSON puede enviar una identificación de voz ElevenLabs personalizada.

¿Cómo se calcula la facturación?

PoYo factura ElevenLabs V3 TTS en créditos 16 por caracteres 1000, lo que equivale a $0.08 por caracteres 1000.

¿Puedo usar etiquetas expresivas?

Sí. El modelo está diseñado para guiones de voz expresivos y admite etiquetas de audio como [emocionado], [susurros] y [risas].

¿Cómo obtengo el resultado?

Envíe la request de generación y luego use el ID de tarea con el estado de tarea estándar de PoYo, endpoint. Las tareas finalizadas devuelven archivos de audio y pueden incluir datos de marca de tiempo cuando se soliciten.

Por qué utilizar PoYo

01

Precios asequibles

Utilice ElevenLabs V3 TTS a $0.08 por caracteres 1000 con facturación clara de per-character.

02

Acceso al modelo unificado

Utilice la misma cuenta PoYo, facturación, sondeo de estado y flujo de trabajo de devolución de llamadas en modelos de texto, imagen, video y audio.

03

Flujo de trabajo de producción

Envíe trabajos asíncronos, sondee el estado estable de las tareas y recupere archivos de audio terminados desde una superficie API.

04

Controles claros

Exponga los controles centrales necesarios en la producción: texto, voz, estabilidad, idioma, normalización y marcas de tiempo.