Model icon
xai-tts-1
Text to Speech
モデル:
xAI TTS 1 は、リアルタイム音声プロダクトやコンテンツ制作向けに、自然で表現力豊かな音声を生成する低遅延の多言語テキスト読み上げモデルです。
Input
126/15000

1-15000 characters. Supports inline and wrapping speech tags for expressive delivery.

Only used for MP3 output.

Output

出力例

これはサンプルデータです。新しい結果を生成すると実際の出力を確認できます。

タスクID:xai-tts-1-example作成日時:2026-06-25 22:44:04
ステータス:finished進行状況:100%
Examples
価格詳細

透明な価格設定。隠れた費用はありません。使った分だけ支払えます。

xAIxai-tts-1
Text to speech
PoYo価格
$0.012
2.4 クレジット
公式価格
$0.015
Fal
節約率
20%

* 実際の料金は最終出力に基づきます。

紹介

低価格の xAI TTS 1 API、低遅延音声向け を使用するための完全なガイド

低価格の xAI TTS 1 API、低遅延音声向け

PoYo の xAI TTS 1 で、音声エージェント、サポートボット、ナレーション、多言語音声プロダクトを構築できます。表現力のある音声、音声タグ、言語自動検出、MP3/WAV/PCM/電話向け出力、標準ステータスポーリング、Webhook コールバックを、文字単位の明確な課金で利用できます。

PoYoで利用できるxAI TTS 1 APIモデル

01

xai-tts-1

本番利用向けのテキスト読み上げ。PoYo では 1000 文字あたり 2.4 credits、つまり $0.012 / 1000 文字で、5 種類の音声、言語自動検出、音声タグ、設定可能な音声出力に対応します。
Playground で試す

xAI TTS 1 API の主な機能

xAI TTS 1 は、音声エージェントからコンテンツ制作パイプラインまで、実際のプロダクトで自然かつ応答性の高い音声生成を行うために設計されています。

01

低遅延で自然な音声

遅いバッチ処理を待たせずに、流暢で表現力のある音声を生成します。アシスタント、カスタマーサポート、インタラクティブなプロダクト体験に特に有効です。

  • エージェントやナレーション向けに自然な話し方を生成。
  • プロダクトワークフローに応答性の高い生成を利用。
  • 文字単位課金でコストを予測しやすく管理。
xAI TTS 音声生成

02

細かく制御できる音声タグ

インラインタグや囲みタグを使って、text フィールド内で直接表現を指定できます。別の音声演出システムを用意せず、スクリプトと演出指示を同じリクエストで管理できます。

  • [laugh]、[pause]、[sigh] などのインラインタグを使用。
  • <whisper> や <slow> などの囲みタグを使用。
  • 1 つの text でトーン、間、強調を指定。
xAI TTS 音声タグ

03

20 以上の言語と自動検出

混在または不明な言語には language_code を auto に設定し、厳密なローカライズには BCP-47 コードを指定できます。エンドポイントを変えずに多言語音声を提供できます。

  • text から言語を自動検出。
  • 英語、中国語、フランス語、ドイツ語、日本語、韓国語、スペイン語などに対応。
  • 多言語音声プロダクトを同じ API 形状で構築。
xAI TTS 多言語音声

04

柔軟な音声出力形式

軽量な MP3、制作向けの WAV/PCM、電話向けの mu-law/A-law を選択できます。同じリクエスト payload で sample_rate と MP3 bit_rate も設定できます。

  • 再生と配信には軽量な MP3 を使用。
  • 編集やポストプロダクションには WAV または PCM を使用。
  • 電話音声パイプラインには mu-law または A-law を使用。
xAI TTS 出力形式

xAI TTS 1 API で作れるもの

01

音声エージェント

プロダクトエージェント、オンボーディング、リアルタイムサポート向けに自然なアシスタント応答を生成します。

02

カスタマーサポートボット

サポートスクリプトや動的な返信を、温かく明瞭な自動サービス音声に変換します。

03

ナレーションとボイスオーバー

製品デモ、短尺動画のナレーション、研修音声、告知、クリエイター向け音声トラックを作成します。

04

多言語アプリケーション

言語自動検出と一貫した音声形式により、1 つのワークフローでローカライズ音声を提供します。

xAI TTS 1 料金:PoYo vs fal.ai

PoYo は標準の非同期生成ワークフローで xAI TTS 1 を提供し、提示された価格スクリーンショットに基づく低い参考単価を採用しています。

項目PoYoFal.ai
公開モデル IDxai-tts-1xai/tts/v1
参考価格$0.012 per 1000 characters$0.015 per 1000 characters
PoYo credits2.4 credits per 1000 charactersN/A
最大 text 長15000 characters15000 characters
出力形式MP3, WAV, PCM, mu-law, A-lawMP3, WAV, PCM, mu-law, A-law

PoYo の価格は 1000 文字あたり 2.4 credits です。1 credit は $0.005 です。

PoYo で xAI TTS 1 API を使う方法

  1. API Key を取得: PoYo アカウントを作成し、ダッシュボードで API Key を生成します。API Key を取得 ->
  2. text を書く: 1〜15000 文字を入力し、表現が必要な場合は [pause]、[laugh]、[sigh]、<whisper>、<slow> などのタグを追加します。
  3. 音声と出力を選ぶ: eve、ara、rex、sal、leo を選択し、language_code を auto または対応する BCP-47 コードに設定してから、codec、sample_rate、MP3 bit_rate を選びます。
  4. 送信して取得: PoYo generate API でタスクを送信し、標準ステータスエンドポイントをポーリングするか Webhook コールバックを受け取ります。API ドキュメントを見る ->

xAI TTS 1 FAQ

xAI TTS 1 はどの音声に対応していますか?

PoYo は fal/xAI の 5 つのプリセットを提供します。eve はエネルギッシュ、ara は温かく親しみやすい音声、rex は自信のある明瞭な音声、sal は滑らかでバランスの取れた出力、leo は権威あるナレーション向けです。

PoYo での xAI TTS 1 の料金はいくらですか?

PoYo での xAI TTS 1 は 1000 文字あたり 2.4 credits、つまり $0.012 / 1000 文字です。課金は text フィールドの長さに基づきます。

text の最大長は?

text フィールドは 1 リクエストあたり 1〜15000 文字に対応します。長いスクリプトは章や段落ごとに複数タスクへ分割してください。

xAI TTS 1 は言語自動検出に対応していますか?

はい。language_code を auto に設定すると text から言語を検出します。en、zh、ja、ko、fr、de、ru、es-MX、pt-BR などの対応 BCP-47 コードも渡せます。

音声タグはどう使いますか?

音声タグは text 内に直接書きます。[laugh]、[pause]、[sigh] のようなインラインタグや、<whisper>text</whisper>、<slow>text</slow> のような囲みタグで話し方を調整できます。

WAV、PCM、mu-law、A-law で出力できますか?

はい。output_format.codec は mp3、wav、pcm、mulaw、alaw に対応します。sample_rate も設定でき、MP3 では bit_rate も設定できます。

xAI TTS 1 はリアルタイム音声エージェントに適していますか?

このモデルは低遅延で自然な音声向けに設計されており、音声エージェント、サポートボット、アシスタント応答、インタラクティブなアプリワークフローに適しています。

生成された音声はどう取得しますか?

生成タスクを送信し、返された task_id を PoYo の標準ステータスエンドポイントで使用します。callback_url を指定すると、タスク完了または失敗時に PoYo が Webhook を送信します。

xAI TTS 1 API アクセスに PoYo を使う理由

01

低価格な文字単位課金

xAI TTS 1 の音声を $0.012 / 1000 文字で生成し、credit 消費を明確に把握できます。

02

統一された API ワークフロー

他の生成モデルと同じ PoYo の送信、ステータス、コールバック、課金、ファイル取得パターンを利用できます。

03

本番向け制御

開発者が扱いやすい payload で voice、language、codec、sample_rate、bit_rate を制御できます。

04

信頼できる非同期結果

タスクを送信し、安定したステータスをポーリングし、PoYo 標準のタスク出力構造から音声ファイルを取得できます。