Model icon
xai-tts-1
Text to Speech
Modelo:
xAI TTS 1 es un modelo low-latency multilingüe text-to-speech para la generación de voz natural y expresiva en productos de voz y creación de contenido real-time.
Input
126/15000

1-15000 characters. Supports inline and wrapping speech tags for expressive delivery.

Only used for MP3 output.

Output

Salida de ejemplo

Estos son datos de muestra. Genere un nuevo resultado para ver el resultado real.

ID de tarea:xai-tts-1-exampleCreado:2026-06-25 22:44:04
Estado:finishedProgreso:100%
Examples
Detalles de precios

Precios transparentes sin tarifas ocultas. Pague solo por lo que use.

xAIxai-tts-1
Text to speech
Precio de PoYo
$0.012
2.4 créditos
Precio oficial
$0.015
Fal
Ahorras
20%

* Las tarifas reales se basan en el resultado final.

Introducción

Guía completa para usar Asequible xAI TTS 1 API para Low-Latency Voz

Asequible xAI TTS 1 API para Low-Latency Voz

Cree agentes de voz, robots de soporte, narraciones y productos de voz multilingües con xAI TTS 1 en PoYo. Utilice un API asíncrono para voces expresivas, etiquetas de voz, lenguaje auto-detection, salida MP3/WAV/PCM/telephony, sondeo de tareas estándar y devoluciones de llamada webhook con facturación clara de per-character.

Modelos disponibles xAI TTS 1 API en PoYo

01

xai-tts-1

Production-ready text-to-speech a créditos 2.4 por caracteres 1000, equivalentes a $0.012 por caracteres 1000 en PoYo, con cinco voces, idioma auto-detection, etiquetas de voz y salida de audio configurable.
Prueba el patio de juegos

Características clave de xAI TTS 1 API

xAI TTS 1 está diseñado para la generación de voz natural y receptiva en productos reales, desde agentes de voz hasta canalizaciones de contenido.

01

Voz natural con baja latencia

Genere un discurso que suene fluido y expresivo sin obligar a los usuarios a pasar por un flujo de trabajo por lotes lento. Esto es especialmente útil para asistentes, atención al cliente y experiencias interactivas de productos.

  • Cree una entrega natural para los agentes y la narración.
  • Utilice la generación responsiva para los flujos de trabajo de productos.
  • Mantenga la facturación predecible con los precios per-character.
xAI TTS generación de voz

02

Etiquetas de voz para un control preciso

Agregue expresión directamente en el campo de texto con etiquetas en línea y envolventes. Los equipos pueden mantener juntos la dirección del guión y la interpretación en lugar de mantener un sistema de dirección de voz separado.

  • Utilice etiquetas en línea como [risa], [pausa] y [suspiro].
  • Utilice etiquetas envolventes como <whisper> y <slow>.
  • Guía de tono, sincronización y énfasis en un texto.
Etiquetas de voz xAI TTS

03

Idiomas 20+ con detección automática

Establezca language_code en automático para scripts mixtos o desconocidos, o elija un código BCP-47 para flujos de trabajo de localización más estrictos. Esto ayuda a los equipos a ofrecer salida de voz multilingüe sin cambiar endpoints.

  • Idioma Auto-detect del texto.
  • Admite inglés, chino, francés, alemán, japonés, coreano, español y más.
  • Utilice una forma API para productos de voz multilingües.
xAI TTS discurso multilingüe

04

Formatos de salida de audio flexibles

Elija compacto MP3, producción WAV o PCM, o telephony-oriented mu-law y A-law de salida. Configure la frecuencia de muestreo y la velocidad de bits de MP3 desde la misma carga útil de request.

  • Utilice MP3 para reproducción y entrega compactas.
  • Utilice WAV o PCM para editar y post-production.
  • Utilice mu-law o A-law para canalizaciones de telefonía.
Formatos de salida xAI TTS

¿Qué puedes construir con xAI TTS 1 API?

01

Agentes de voz

Genere respuestas de asistente naturales para agentes de productos, flujos de incorporación y herramientas de soporte real-time.

02

Bots de atención al cliente

Convierta los guiones de soporte y las respuestas dinámicas en un discurso cálido y claro para experiencias de servicio automatizadas.

03

Narración y locuciones

Cree demostraciones de productos, narraciones breves en video, audio de capacitación, anuncios y pistas de voz de creadores.

04

Aplicaciones multilingües

Envíe salida hablada localizada en un flujo de trabajo con el idioma auto-detection y formatos de audio consistentes.

Precios de xAI TTS 1: PoYo frente a fal.ai

PoYo expone xAI TTS 1 a través del flujo de trabajo de generación asíncrona estándar con un precio unitario de referencia más bajo según la captura de pantalla de precios proporcionada.

FunciónPoYoFal.ai
Público model IDxai-tts-1xai/tts/v1
Fal.ai$0.012 por caracteres 1000$0.015 por caracteres 1000
Créditos PoYoCréditos 2.4 por caracteres 1000N/A
Longitud máxima del textoPersonajes 15000Personajes 15000
Formatos de salidaMP3, WAV, PCM, mu-law, A-lawMP3, WAV, PCM, mu-law, A-law

El precio de PoYo utiliza créditos 2.4 por caracteres 1000. Un crédito tiene el precio de $0.005.

Cómo utilizar xAI TTS 1 API en PoYo

  1. Obtenga su clave API: Cree una cuenta PoYo y genere una clave API desde el panel. Obtenga la clave API ->
  2. Escriba el guión: Ingrese los caracteres 1-15000 y agregue etiquetas como [pausa], [risa], [suspiro], <whisper>, o <slow> cuando necesite una entrega expresiva.
  3. Elija voz y salida: Seleccione eve, ara, rex, sal o leo; establezca language_code en automático o en un código BCP-47 compatible; luego elija el códec, la frecuencia de muestreo y la velocidad de bits de MP3.
  4. Enviar y recuperar: Envíe la tarea a través de la generación de API de PoYo, luego sondee el estado de la tarea estándar endpoint o reciba un Devolución de llamada webhook. Ver documentos de API ->

xAI TTS 1 FAQ

¿Qué voces admite xAI TTS 1?

PoYo expone los cinco ajustes preestablecidos fal/xAI: eve para una entrega enérgica, ara para un discurso cálido y amigable, rex para un discurso claro y seguro, sal para una salida suave y equilibrada y leo para una narración autorizada.

¿Cuánto cuesta xAI TTS 1 en PoYo?

xAI TTS 1 cuesta créditos 2.4 por caracteres 1000 en PoYo, equivalente a $0.012 por caracteres 1000. La facturación se basa en la longitud del campo de texto.

¿Cuál es la longitud máxima del texto?

El campo de texto admite caracteres de 1 a 15000 por request. Divida guiones más largos en varias tareas si necesita audio chapter-level o long-form.

¿xAI TTS 1 admite la detección automática de idioma?

Sí. Configure language_code en auto para permitir que el modelo detecte el idioma del texto o pase un código BCP-47 compatible, como en, zh, ja, ko, fr, de, ru, es-MX o pt-BR.

¿Cómo funcionan las etiquetas de voz?

Las etiquetas de voz se escriben directamente dentro del texto. Utilice etiquetas en línea como [risa], [pausa] y [suspiro], o etiquetas envolventes como text y text para guiar la entrega.

¿Puedo generar WAV, PCM, mu-law o A-law?

Sí. output_format.codec admite mp3, wav, pcm, mulaw y alaw. También puede configurar sample_rate y para MP3 puede configurar bit_rate.

¿xAI TTS 1 es adecuado para agentes de voz real-time?

El modelo está diseñado para el habla natural low-latency, lo que lo convierte en una excelente opción para agentes de voz, robots de soporte, respuestas de asistentes y flujos de trabajo de aplicaciones interactivas.

¿Cómo obtengo el audio generado?

Envíe una tarea de generación y utilice el task_id devuelto con el estado estándar de PoYo, endpoint. Si se proporciona callback_url, PoYo envía un webhook cuando la tarea finaliza o falla.

Por qué utilizar PoYo para xAI TTS 1 API Acceso

01

Facturación de personajes asequible

Genere discurso xAI TTS 1 a $0.012 por caracteres 1000 con uso de crédito transparente.

02

Flujo de trabajo unificado API

Utilice el mismo patrón de envío, estado, devolución de llamada, facturación y recuperación de archivos PoYo que otros modelos de generación.

03

Controles de producción

Controle la voz, el idioma, el códec, la frecuencia de muestreo y la velocidad de bits desde una carga útil developer-friendly.

04

Resultados asíncronos confiables

Envíe tareas, sondee el estado estable y recupere archivos de audio a través de la estructura de salida de tareas estándar de PoYo.