01
表現力のある多言語 Text-to-Speech
スクリプト、商品説明、ナレーション、会話を自然な音声に変換します。対応モデルでは声、言語、感情タグ、テキスト正規化、速度、タイムスタンプを調整できます。
- スクリプトからナレーションを生成
- 対応時に言語、声、話し方を制御
- アプリ、動画、講座、エージェント向け音声を作成

音声と音楽制作のための音声ジェネレーター を使用するための完全なガイド
PoYo 音声ジェネレーターは、音声、ナレーション、音楽生成モデルを 1 つの集中したワークスペースにまとめます。ElevenLabs、Gemini、xAI、MiniMax などの実行可能な音声モデルを Input パネルで直接選択できます。
各モデルはネイティブ設定を保持するため、言語、声、感情タグ、速度、歌詞、インストゥルメンタル、出力形式、プレビュー、JSON、ダウンロードは対応モデルでのみ表示されます。
音声、ナレーション、音楽を生成し、プレビュー、ダウンロード、API 検証まで進められます。
01
スクリプト、商品説明、ナレーション、会話を自然な音声に変換します。対応モデルでは声、言語、感情タグ、テキスト正規化、速度、タイムスタンプを調整できます。

02
プロンプト、歌詞、インストゥルメンタル設定、構成案から音楽を生成します。デモ、フック、伴奏、制作方向の検討に使えます。

03
音声モデルを切り替えても、各モデルのネイティブ設定を保てます。高速 TTS、表現力のある声、音楽生成、サンプルレート、ビットレート、出力形式がモデルごとに表示されます。

04
生成音声をブラウザで再生し、JSON やタイムスタンプを確認し、最終ファイルをダウンロードして API やエージェントのワークフローに移せます。

商品紹介、短尺動画、チュートリアル、多言語版の音声トラックをスクリプトから作成します。
レッスン、章のプレビュー、ポッドキャストの一部、長文ナレーションの試作を生成します。
アプリ音声、オンボーディング、読み上げ体験、ローカライズ音声を検証します。
プロンプト、歌詞、スタイル指定から曲のアイデア、伴奏、フック、デモを作成します。
キャラクター音声、ゲーム UI 音、クリエイター素材、インタラクティブ音声案を探索します。
API 実装前にプロンプト、声、形式、プレビュー、JSON 応答を検証します。
1. Input パネルで音声モデルを選びます。音声または音楽に合うプロバイダーと実行モデルを選択します。
2. テキスト、歌詞、音楽方向を入力します。スクリプト、プロンプト、言語、声のスタイル、ムード、楽器、歌詞を追加します。
3. モデル固有の設定を調整します。声、感情タグ、速度、サンプルレート、ビットレート、形式、歌詞最適化、インスト設定を必要に応じて変更します。
4. 実行、プレビュー、ダウンロード。生成を開始し、音声を確認し、必要なら JSON を見て、ファイルをダウンロードします。
選択したモデルに応じて、Text-to-Speech、ナレーション、会話、音楽デモ、楽曲、インストを作成できます。Input パネルには対応フィールドだけが表示されます。
表現力のあるナレーションは ElevenLabs V3 TTS、速い音声テストは ElevenLabs TTS Turbo v2.5 または xAI TTS 1、スタイル指定の音声は Gemini 3.1 Flash TTS、構造化された音楽は ElevenLabs Music、歌詞付き音楽は MiniMax Music 2.6、汎用音楽は Generate Music から始めるのがおすすめです。
品質はモデル、プロンプト、言語、声、出力設定によって変わります。最新 TTS は自然に聞こえますが、実運用では試聴、発音修正、テンポ確認、マスタリングが重要です。
モデルが対応していれば可能です。音声モデルでは言語、声、速度、安定性、スタイル、感情タグ、タイムスタンプを、音楽モデルではジャンル、ムード、歌詞、インスト、構成、形式を扱えます。
ギャラリーでは一般的な音声ファイルをブラウザで再生できます。出力には MP3、WAV、OGG、Opus、PCM、mu-law、A-law、タイムスタンプなどが含まれる場合があります。
きれいな原稿、発音のヒント、具体的な声の指示、自然な間、控えめな感情タグを使います。音楽ではジャンル、ムード、テンポ、楽器、ボーカル、構成、歌詞、避けたい要素を書きます。
モデル、文字数、長さ、形式、音楽の長さ、品質設定、プロバイダーによって変わります。長い音声や音楽を実行する前に Input フッターのコストを確認してください。
商用利用はモデル、プロバイダー規約、プラン、スクリプト、歌詞、声、参考素材、アップロード素材の権利に依存します。必ず規約を確認してください。
プロンプトを作り直さず、音声、声、音楽モデルを比較できます。
各モデルの声、言語、スタイル、歌詞、形式、結果フローを保ちます。
ダウンロード前に Output Gallery で生成音声を確認できます。
スクリプト、声、形式、JSON をテストしてから API 製品に移行できます。