Model icon
xai-tts-1
Text to Speech
Modèle:
xAI TTS 1 est un modèle de synthèse vocale multilingue à faible latence pour générer des voix naturelles et expressives dans les produits vocaux en temps réel et la création de contenu.
Input
126/15000

1-15000 characters. Supports inline and wrapping speech tags for expressive delivery.

Only used for MP3 output.

Output

Exemple de sortie

Ceci est un exemple de données. Générez un nouveau résultat pour voir la sortie réelle.

ID de tâche:xai-tts-1-exampleCréé:2026-06-25 22:44:04
Statut:finishedProgression:100%
Examples
Détails des prix

Tarification transparente, sans frais cachés. Payez à l'usage.

xAIxai-tts-1
Text to speech
Prix PoYo
$0.012
2.4 crédits
Prix officiel
$0.015
Fal
Économie
20%

* Les frais réels sont basés sur la sortie finale.

Introduction

Guide complet d'utilisation de API xAI TTS 1 économique pour voix à faible latence

API xAI TTS 1 économique pour voix à faible latence

Créez des agents vocaux, bots de support, narrations et produits vocaux multilingues avec xAI TTS 1 sur PoYo. Utilisez une API asynchrone unique pour des voix expressives, les balises vocales, la détection automatique de la langue, les sorties MP3/WAV/PCM/téléphonie, le polling standard et les webhooks, avec une facturation claire par caractère.

Modèles d'API xAI TTS 1 disponibles sur PoYo

01

xai-tts-1

Synthèse vocale prête pour la production à 2.4 credits pour 1000 caractères, soit $0.012 pour 1000 caractères sur PoYo, avec cinq voix, détection automatique de la langue, balises vocales et sortie audio configurable.
Essayer le Playground

Fonctionnalités clés de l'API xAI TTS 1

xAI TTS 1 est conçu pour générer une voix naturelle et réactive dans de vrais produits, des agents vocaux aux pipelines de contenu.

01

Voix naturelle à faible latence

Générez une voix fluide et expressive sans imposer un lent workflow par lots. C’est particulièrement utile pour les assistants, le support client et les expériences produit interactives.

  • Créer une diction naturelle pour agents et narrations.
  • Utiliser une génération réactive pour les workflows produit.
  • Garder des coûts prévisibles avec une tarification par caractère.
génération vocale xAI TTS

02

Balises vocales pour un contrôle fin

Ajoutez l’expression directement dans le champ text avec des balises inline et englobantes. Les équipes gardent le script et les indications de performance dans la même requête, sans système séparé de direction vocale.

  • Utiliser des balises inline comme [laugh], [pause] et [sigh].
  • Utiliser des balises englobantes comme <whisper> et <slow>.
  • Guider le ton, le rythme et l’emphase dans un seul text.
balises vocales xAI TTS

03

20+ langues avec détection automatique

Définissez language_code sur auto pour les scripts mixtes ou inconnus, ou choisissez un code BCP-47 pour des workflows de localisation plus stricts. Les équipes peuvent ainsi livrer de la voix multilingue sans changer d’endpoint.

  • Détecter automatiquement la langue à partir du text.
  • Prendre en charge anglais, chinois, français, allemand, japonais, coréen, espagnol et plus encore.
  • Utiliser une même structure API pour les produits vocaux multilingues.
voix multilingue xAI TTS

04

Formats de sortie audio flexibles

Choisissez MP3 compact, WAV ou PCM pour la production, ou une sortie mu-law et A-law orientée téléphonie. Configurez sample_rate et MP3 bit_rate dans le même payload.

  • Utiliser MP3 pour une lecture et une diffusion compactes.
  • Utiliser WAV ou PCM pour le montage et la postproduction.
  • Utiliser mu-law ou A-law pour les pipelines téléphoniques.
formats de sortie xAI TTS

Que créer avec l'API xAI TTS 1 ?

01

Agents vocaux

Générez des réponses naturelles d’assistant pour agents produit, parcours d’onboarding et outils de support en temps réel.

02

Bots de support client

Transformez scripts de support et réponses dynamiques en voix chaleureuse et claire pour des expériences de service automatisées.

03

Narration et voix off

Créez des démos produit, narrations de vidéos courtes, audios de formation, annonces et pistes vocales créateur.

04

Applications multilingues

Livrez une voix localisée dans un même workflow avec détection automatique de la langue et formats audio cohérents.

Tarifs xAI TTS 1 : PoYo vs fal.ai

PoYo expose xAI TTS 1 via le workflow standard de génération asynchrone avec un prix unitaire de référence plus bas, basé sur la capture tarifaire fournie.

FonctionnalitéPoYoFal.ai
ID public du modèlexai-tts-1xai/tts/v1
Prix de référence$0.012 per 1000 characters$0.015 per 1000 characters
PoYo credits2.4 credits per 1000 charactersN/A
Longueur maximale du text15000 characters15000 characters
Formats de sortieMP3, WAV, PCM, mu-law, A-lawMP3, WAV, PCM, mu-law, A-law

Le tarif PoYo utilise 2.4 credits pour 1000 caractères. Un credit coûte $0.005.

Comment utiliser l'API xAI TTS 1 sur PoYo

  1. Obtenir votre clé API : Créez un compte PoYo et générez une clé API depuis le dashboard. Obtenir une clé API ->
  2. Rédiger le text : Entrez 1 à 15000 caractères et ajoutez des balises comme [pause], [laugh], [sigh], <whisper> ou <slow> pour une diction expressive.
  3. Choisir la voix et la sortie : Sélectionnez eve, ara, rex, sal ou leo ; définissez language_code sur auto ou sur un code BCP-47 pris en charge ; choisissez ensuite codec, sample_rate et MP3 bit_rate.
  4. Soumettre et récupérer : Soumettez la tâche via la generate API de PoYo, puis interrogez l’endpoint standard de statut ou recevez un webhook. Voir la documentation API ->

FAQ xAI TTS 1

Quelles voix xAI TTS 1 prend-il en charge ?

PoYo expose les cinq presets fal/xAI : eve pour une diction énergique, ara pour une voix chaleureuse et amicale, rex pour une voix claire et assurée, sal pour une sortie fluide et équilibrée, et leo pour une narration autoritaire.

Combien coûte xAI TTS 1 sur PoYo ?

xAI TTS 1 coûte 2.4 credits pour 1000 caractères sur PoYo, soit $0.012 pour 1000 caractères. La facturation dépend de la longueur du champ text.

Quelle est la longueur maximale du text ?

Le champ text prend en charge 1 à 15000 caractères par requête. Découpez les scripts plus longs en plusieurs tâches pour les chapitres ou l’audio long format.

xAI TTS 1 prend-il en charge la détection automatique de la langue ?

Oui. Définissez language_code sur auto pour laisser le modèle détecter la langue du text, ou passez un code BCP-47 pris en charge comme en, zh, ja, ko, fr, de, ru, es-MX ou pt-BR.

Comment fonctionnent les balises vocales ?

Les balises vocales s’écrivent directement dans le text. Utilisez des balises inline comme [laugh], [pause] et [sigh], ou des balises englobantes comme <whisper>text</whisper> et <slow>text</slow> pour guider la diction.

Puis-je sortir en WAV, PCM, mu-law ou A-law ?

Oui. output_format.codec prend en charge mp3, wav, pcm, mulaw et alaw. Vous pouvez aussi définir sample_rate et, pour MP3, bit_rate.

xAI TTS 1 convient-il aux agents vocaux en temps réel ?

Le modèle est conçu pour une voix naturelle à faible latence, ce qui le rend adapté aux agents vocaux, bots de support, réponses d’assistant et workflows interactifs.

Comment récupérer l’audio généré ?

Soumettez une tâche de génération et utilisez le task_id retourné avec l’endpoint standard de statut de PoYo. Si callback_url est fourni, PoYo envoie un webhook lorsque la tâche se termine ou échoue.

Pourquoi utiliser PoYo pour accéder à l'API xAI TTS 1

01

Facturation par caractère abordable

Générez de la voix xAI TTS 1 à $0.012 pour 1000 caractères avec une consommation de credits transparente.

02

Workflow API unifié

Utilisez le même schéma PoYo de soumission, statut, callback, facturation et récupération de fichiers que les autres modèles de génération.

03

Contrôles de production

Contrôlez voice, language, codec, sample_rate et bit_rate depuis un payload pensé pour les développeurs.

04

Résultats asynchrones fiables

Soumettez des tâches, interrogez un statut stable et récupérez les fichiers audio via la structure standard de sortie de tâche PoYo.