Model icon
xai-tts-1
Text to Speech
Model:
xAI TTS 1 ist ein latenzarmes mehrsprachiges Text-to-Speech-Modell für natürliche, ausdrucksstarke Sprachgenerierung in Echtzeit-Sprachprodukten und der Content-Erstellung.
Input
126/15000

1-15000 characters. Supports inline and wrapping speech tags for expressive delivery.

Only used for MP3 output.

Output

Beispielausgabe

Dies sind Beispieldaten. Generieren Sie ein neues Ergebnis, um die echte Ausgabe zu sehen.

Task-ID:xai-tts-1-exampleErstellt:2026-06-25 22:44:04
Status:finishedFortschritt:100%
Examples
Preisinformationen

Transparente Preise ohne versteckte Kosten. Bezahle nur, was du nutzt.

xAIxai-tts-1
Text to speech
PoYo-Preis
$0.012
2.4 Credits
Offizieller Preis
$0.015
Fal
Du sparst
20%

* Tatsächliche Gebühren basieren auf dem endgültigen Ergebnis.

Introduction

Vollständige Anleitung zur Verwendung von Preiswerte xAI TTS 1 API für Sprache mit niedriger Latenz

Preiswerte xAI TTS 1 API für Sprache mit niedriger Latenz

Erstelle Sprachagenten, Support-Bots, Vertonungen und mehrsprachige Sprachprodukte mit xAI TTS 1 auf PoYo. Nutze eine asynchrone API für ausdrucksstarke Stimmen, Sprach-Tags, automatische Spracherkennung, MP3/WAV/PCM/Telefonie-Ausgabe, standardisierte Statusabfragen und Webhook-Callbacks mit klarer Abrechnung pro Zeichen.

Verfügbare xAI TTS 1 API-Modelle auf PoYo

01

xai-tts-1

Produktionsreife Text-to-Speech-Ausgabe für 2.4 credits pro 1000 Zeichen, entsprechend $0.012 pro 1000 Zeichen auf PoYo, mit fünf Stimmen, automatischer Spracherkennung, Sprach-Tags und konfigurierbarer Audioausgabe.
Playground testen

Kernfunktionen der xAI TTS 1 API

xAI TTS 1 ist für natürliche, reaktionsschnelle Sprachgenerierung in echten Produkten ausgelegt, von Sprachagenten bis zu Content-Pipelines.

01

Natürliche Stimme mit niedriger Latenz

Erzeuge flüssige und ausdrucksstarke Sprache, ohne Nutzer durch einen langsamen Batch-Workflow zu schicken. Das ist besonders nützlich für Assistenten, Kundensupport und interaktive Produkterlebnisse.

  • Natürliche Wiedergabe für Agenten und Vertonungen erstellen.
  • Reaktionsschnelle Generierung für Produkt-Workflows nutzen.
  • Kosten mit zeichenbasierter Preisgestaltung planbar halten.
xAI TTS Sprachgenerierung

02

Sprach-Tags für feine Steuerung

Füge Ausdruck direkt im text-Feld mit Inline- und umschließenden Tags hinzu. Teams können Skript und Regieanweisungen gemeinsam pflegen, statt ein separates Voice-Direction-System zu betreiben.

  • Inline-Tags wie [laugh], [pause] und [sigh] verwenden.
  • Umschließende Tags wie <whisper> und <slow> verwenden.
  • Ton, Timing und Betonung in einem text steuern.
xAI TTS Sprach-Tags

03

20+ Sprachen mit automatischer Erkennung

Setze language_code auf auto für gemischte oder unbekannte Skripte oder wähle einen BCP-47-Code für strengere Lokalisierungsprozesse. So liefern Teams mehrsprachige Sprachausgabe ohne Endpoint-Wechsel aus.

  • Sprache automatisch aus dem text erkennen.
  • Englisch, Chinesisch, Französisch, Deutsch, Japanisch, Koreanisch, Spanisch und weitere Sprachen unterstützen.
  • Eine API-Struktur für mehrsprachige Sprachprodukte nutzen.
xAI TTS mehrsprachige Sprache

04

Flexible Audioausgabeformate

Wähle kompaktes MP3, produktionsgeeignetes WAV oder PCM oder telefonieorientierte mu-law- und A-law-Ausgabe. sample_rate und MP3 bit_rate werden im selben Request-Payload konfiguriert.

  • MP3 für kompakte Wiedergabe und Auslieferung nutzen.
  • WAV oder PCM für Schnitt und Postproduktion nutzen.
  • mu-law oder A-law für Telefonie-Pipelines nutzen.
xAI TTS Ausgabeformate

Was kannst du mit der xAI TTS 1 API bauen?

01

Sprachagenten

Erzeuge natürliche Assistentenantworten für Produktagenten, Onboarding-Flows und Echtzeit-Supporttools.

02

Kundensupport-Bots

Verwandle Support-Skripte und dynamische Antworten in warme, klare Sprache für automatisierte Service-Erlebnisse.

03

Narration und Voiceover

Erstelle Produktdemos, Kurzvideo-Narration, Trainingsaudio, Ankündigungen und Voice-Tracks für Creator.

04

Mehrsprachige Anwendungen

Liefere lokalisierte Sprachausgabe in einem Workflow mit automatischer Spracherkennung und konsistenten Audioformaten.

xAI TTS 1 Preise: PoYo vs fal.ai

PoYo stellt xAI TTS 1 über den standardisierten asynchronen Generierungsworkflow bereit und nutzt einen niedrigeren Referenzpreis gemäß dem bereitgestellten Preisscreenshot.

MerkmalPoYoFal.ai
Öffentliche Modell-IDxai-tts-1xai/tts/v1
Referenzpreis$0.012 per 1000 characters$0.015 per 1000 characters
PoYo credits2.4 credits per 1000 charactersN/A
Maximale text-Länge15000 characters15000 characters
AusgabeformateMP3, WAV, PCM, mu-law, A-lawMP3, WAV, PCM, mu-law, A-law

PoYo berechnet 2.4 credits pro 1000 Zeichen. Ein credit kostet $0.005.

So nutzt du die xAI TTS 1 API auf PoYo

  1. API-Key erhalten: Erstelle ein PoYo-Konto und generiere einen API-Key im Dashboard. API-Key erhalten ->
  2. Text schreiben: Gib 1-15000 Zeichen ein und ergänze Tags wie [pause], [laugh], [sigh], <whisper> oder <slow>, wenn du ausdrucksstarke Ausgabe brauchst.
  3. Stimme und Ausgabe wählen: Wähle eve, ara, rex, sal oder leo; setze language_code auf auto oder einen unterstützten BCP-47-Code; wähle dann codec, sample_rate und MP3 bit_rate.
  4. Absenden und abrufen: Sende die Aufgabe über die PoYo generate API, frage danach den Standard-Status-Endpunkt ab oder empfange einen Webhook-Callback. API-Dokumentation ansehen ->

xAI TTS 1 FAQ

Welche Stimmen unterstützt xAI TTS 1?

PoYo stellt fünf fal/xAI-Presets bereit: eve für energiegeladene Ausgabe, ara für warme freundliche Sprache, rex für selbstbewusste klare Sprache, sal für glatte ausgewogene Ausgabe und leo für autoritative Narration.

Was kostet xAI TTS 1 auf PoYo?

xAI TTS 1 kostet auf PoYo 2.4 credits pro 1000 Zeichen, entsprechend $0.012 pro 1000 Zeichen. Die Abrechnung basiert auf der Länge des text-Felds.

Wie lang darf der text maximal sein?

Das text-Feld unterstützt 1 bis 15000 Zeichen pro Request. Teile längere Skripte in mehrere Aufgaben auf, wenn du Kapitel oder Langform-Audio brauchst.

Unterstützt xAI TTS 1 automatische Spracherkennung?

Ja. Setze language_code auf auto, damit das Modell die Sprache aus dem text erkennt, oder übergib einen unterstützten BCP-47-Code wie en, zh, ja, ko, fr, de, ru, es-MX oder pt-BR.

Wie funktionieren Sprach-Tags?

Sprach-Tags werden direkt im text geschrieben. Nutze Inline-Tags wie [laugh], [pause] und [sigh] oder umschließende Tags wie <whisper>text</whisper> und <slow>text</slow>, um die Ausgabe zu steuern.

Kann ich WAV, PCM, mu-law oder A-law ausgeben?

Ja. output_format.codec unterstützt mp3, wav, pcm, mulaw und alaw. Zusätzlich kannst du sample_rate setzen und für MP3 bit_rate konfigurieren.

Eignet sich xAI TTS 1 für Echtzeit-Sprachagenten?

Das Modell ist für natürliche Sprache mit niedriger Latenz ausgelegt und passt gut zu Sprachagenten, Support-Bots, Assistentenantworten und interaktiven App-Workflows.

Wie erhalte ich die erzeugte Audiodatei?

Sende eine Generierungsaufgabe und nutze die zurückgegebene task_id mit dem Standard-Status-Endpunkt von PoYo. Wenn callback_url angegeben ist, sendet PoYo einen Webhook, sobald die Aufgabe abgeschlossen ist oder fehlschlägt.

Warum PoYo für den Zugriff auf die xAI TTS 1 API nutzen

01

Günstige Zeichenabrechnung

Generiere xAI TTS 1 Sprache für $0.012 pro 1000 Zeichen mit transparenter credit-Nutzung.

02

Einheitlicher API-Workflow

Nutze dasselbe PoYo-Muster für Submit, Status, Callback, Billing und Dateiabruf wie bei anderen Generierungsmodellen.

03

Produktionssteuerung

Steuere voice, language, codec, sample_rate und bit_rate in einem entwicklerfreundlichen Payload.

04

Zuverlässige asynchrone Ergebnisse

Sende Aufgaben, frage stabile Statuswerte ab und rufe Audiodateien über die Standard-Output-Struktur von PoYo ab.