GPT Image 2.5 API が登場。画像生成・編集を今すぐ体験 →
GPT Image 2.5 API が登場。画像生成・編集を今すぐ体験 →
PoYoPoYo
APIマーケット
価格
エンタープライズ
Ctrl+K
poyo.ai

1つのAPIですべてのモデルを。

開発者のために構築

All systems operational

リソース

  • 代替ハブ
  • 比較ハブ
  • ブログ
  • プロバイダー
  • アフィリエイト
  • Features
  • サイトマップ

© 2025 PoYo API. All rights reserved.

人気モデルhot

  • Seedance 2.5
  • MiniMax H3 / Hailuo 03
  • FLUX 3
  • Nano Banana Pro
  • Seedance 2
  • GPT Image 2

新着モデルnew

  • GPT-6.1 Sol
  • Claude Sonnet 5.5
  • MiniMax H3 Max
  • MiniMax H3 Max Turbo
  • Qwen Image 2.1
  • GPT-6 Luna

公開予定soon

  • Wan Animate 2

すべてのプロバイダー

Google

  • Nano Banana Pro
  • Gemini Omni 1.1 Flash
  • Gemini 3.7 Flash
  • Gemini 3.8 Flash
  • Gemini 3.1 Flash TTS
  • Nano Banana
  • Veo 3.1
  • Veo 3.1 Official
  • Omni Flash
  • Nano Banana 2
  • Gemini 3.5 Flash
  • Nano Banana 2 Lite
  • Gemini 3 Series

Kling

  • Kling 3.0 Motion Control
  • Kling 3.0
  • Kling O3
  • Kling 1.6
  • Kling 2.1
  • Kling 2.6
  • Kling Avatar 2.0
  • Kling 2.5 Turbo Pro
  • Kling 3.0 Turbo
  • Kling 2.6 Motion Control
  • Kling O3 Image
  • Kling O1 Image

Anthropic

  • Claude Sonnet 5
  • Claude Fable 5.1
  • Claude Opus 5
  • Claude Opus 5.5
  • Claude Sonnet 5.5
  • Claude Opus 4.8
  • Claude Opus 4.7
  • Claude 4.6 API
  • Claude 4.5 Series

MiniMax

  • MiniMax H3 / Hailuo 03
  • MiniMax H3 Max
  • MiniMax H3 Max Turbo
  • MiniMax Music 2.6
  • Hailuo 02
  • Hailuo 2.3

Tripo3D

  • Tripo3D H3.1
  • Tripo3D P1

Moonshot AI

  • Kimi K3

OpenAI

  • GPT Image 2
  • Sora 2 Official
  • GPT-6 Astra
  • GPT-6 Sol
  • GPT Image 2.5
  • GPT-5.6
  • GPT-6 Luna
  • GPT-6.1 Sol
  • GPT Image 1.5
  • GPT-4o Image
  • GPT-5.5
  • GPT-5.4
  • GPT-5.2

Seedream

  • Seedream 5.0 Pro
  • Seedream 4
  • Seedream 4.5
  • Seedream 5.0 Lite

Seedance

  • Seedance 2.5
  • Seedance 2
  • Seedance 2.0 Mini
  • Seedance 1.0 Pro
  • Seedance 1.5 Pro

DeepSeek

  • DeepSeek V4 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4.1 Flash

Hunyuan

  • Hunyuan 3D v3.1

ElevenLabs

  • ElevenLabs Music
  • ElevenLabs TTS Turbo v2.5
  • ElevenLabs V3 TTS

Black Forest Labs

  • FLUX 3
  • FLUX.2
  • Flux Kontext
  • Flux Dev
  • Flux Schnell

Alibaba

  • Qwen Image 3.0
  • Happy Horse 1.1
  • Wan 2.7 Video
  • Wan 3.0
  • Wan 3.0 Video Prime
  • Qwen Image 2.1
  • Wan Animate 2
  • Wan 2.2 Fast
  • Z-Image
  • Wan 2.5
  • Wan 2.6
  • Wan 2.7 Image
  • Wan Animate
  • Happy Horse

xAI

  • Grok 4.6
  • Grok 4.7
  • Grok Imagine Image 2.0
  • xAI TTS 1
  • Grok Imagine
  • Grok Imagine Video 1.5
  • Grok Imagine Image Quality

Meshy

  • Meshy 6 3D

Runway

  • Runway Gen-4.5

PoYo

  • AI Video Background Removal
  • AI Video Upscaler
  • Image Translator
  • Video Translator
  • Suno Music
GitHubXInstagramYouTubeDiscordTelegramEmail
カスタマーサポートドキュメント
画像動画3D音声アバターツール
Loading playground...
音声ジェネレーターガイド

音声と音楽制作のための音声ジェネレーター を使用するための完全なガイド

音声と音楽制作のための音声ジェネレーター

PoYo 音声ジェネレーターは、音声、ナレーション、音楽生成モデルを 1 つの集中したワークスペースにまとめます。ElevenLabs、Gemini、xAI、MiniMax などの実行可能な音声モデルを Input パネルで直接選択できます。

各モデルはネイティブ設定を保持するため、言語、声、感情タグ、速度、歌詞、インストゥルメンタル、出力形式、プレビュー、JSON、ダウンロードは対応モデルでのみ表示されます。

作成を開始

PoYo 音声ジェネレーターの主な機能

音声、ナレーション、音楽を生成し、プレビュー、ダウンロード、API 検証まで進められます。

01

表現力のある多言語 Text-to-Speech

スクリプト、商品説明、ナレーション、会話を自然な音声に変換します。対応モデルでは声、言語、感情タグ、テキスト正規化、速度、タイムスタンプを調整できます。

  • スクリプトからナレーションを生成
  • 対応時に言語、声、話し方を制御
  • アプリ、動画、講座、エージェント向け音声を作成
多言語 Text-to-Speech ワークフロー

02

Prompt-to-Music と楽曲制作

プロンプト、歌詞、インストゥルメンタル設定、構成案から音楽を生成します。デモ、フック、伴奏、制作方向の検討に使えます。

  • 曲、インスト、音楽コンセプトを生成
  • ムード、ジャンル、編曲、歌詞、ボーカルを指定
  • モデル固有の作曲フィールドを利用
Prompt-to-Music ワークフロー

03

モデル固有の品質、速度、形式設定

音声モデルを切り替えても、各モデルのネイティブ設定を保てます。高速 TTS、表現力のある声、音楽生成、サンプルレート、ビットレート、出力形式がモデルごとに表示されます。

  • 複数の音声プロバイダーを 1 つのセレクターで比較
  • 対応パラメータだけを表示
  • MP3、WAV、OGG、PCM などを選択
音声モデル設定と形式

04

プレビュー、ダウンロード、API 連携

生成音声をブラウザで再生し、JSON やタイムスタンプを確認し、最終ファイルをダウンロードして API やエージェントのワークフローに移せます。

  • ダウンロード前に音声を確認
  • 編集や公開用の音声ファイルを取得
  • API 統合前にプロンプトと設定を検証
音声プレビューと API 連携

PoYo 音声ジェネレーターで作れるもの

01

動画ナレーションと吹き替え

商品紹介、短尺動画、チュートリアル、多言語版の音声トラックをスクリプトから作成します。

02

ポッドキャスト、オーディオブック、講座音声

レッスン、章のプレビュー、ポッドキャストの一部、長文ナレーションの試作を生成します。

03

多言語アプリ音声とアクセシビリティ

アプリ音声、オンボーディング、読み上げ体験、ローカライズ音声を検証します。

04

音楽デモ、楽曲、インスト

プロンプト、歌詞、スタイル指定から曲のアイデア、伴奏、フック、デモを作成します。

05

SNS、ゲーム、クリエイティブ音声

キャラクター音声、ゲーム UI 音、クリエイター素材、インタラクティブ音声案を探索します。

06

開発者、API、エージェントのワークフロー

API 実装前にプロンプト、声、形式、プレビュー、JSON 応答を検証します。

PoYo で音声ジェネレーターを使う方法

1. Input パネルで音声モデルを選びます。音声または音楽に合うプロバイダーと実行モデルを選択します。

2. テキスト、歌詞、音楽方向を入力します。スクリプト、プロンプト、言語、声のスタイル、ムード、楽器、歌詞を追加します。

3. モデル固有の設定を調整します。声、感情タグ、速度、サンプルレート、ビットレート、形式、歌詞最適化、インスト設定を必要に応じて変更します。

4. 実行、プレビュー、ダウンロード。生成を開始し、音声を確認し、必要なら JSON を見て、ファイルをダウンロードします。

音声ジェネレーターのよくある質問

音声ジェネレーターでは何を作れますか?

選択したモデルに応じて、Text-to-Speech、ナレーション、会話、音楽デモ、楽曲、インストを作成できます。Input パネルには対応フィールドだけが表示されます。

最初にどの音声モデルを選ぶべきですか?

表現力のあるナレーションは ElevenLabs V3 TTS、速い音声テストは ElevenLabs TTS Turbo v2.5 または xAI TTS 1、スタイル指定の音声は Gemini 3.1 Flash TTS、構造化された音楽は ElevenLabs Music、歌詞付き音楽は MiniMax Music 2.6、汎用音楽は Generate Music から始めるのがおすすめです。

生成音声はどれくらい自然ですか?

品質はモデル、プロンプト、言語、声、出力設定によって変わります。最新 TTS は自然に聞こえますが、実運用では試聴、発音修正、テンポ確認、マスタリングが重要です。

言語、感情、声、速度、音楽スタイルを制御できますか?

モデルが対応していれば可能です。音声モデルでは言語、声、速度、安定性、スタイル、感情タグ、タイムスタンプを、音楽モデルではジャンル、ムード、歌詞、インスト、構成、形式を扱えます。

どの音声形式をプレビューまたはダウンロードできますか?

ギャラリーでは一般的な音声ファイルをブラウザで再生できます。出力には MP3、WAV、OGG、Opus、PCM、mu-law、A-law、タイムスタンプなどが含まれる場合があります。

音質を改善するには?

きれいな原稿、発音のヒント、具体的な声の指示、自然な間、控えめな感情タグを使います。音楽ではジャンル、ムード、テンポ、楽器、ボーカル、構成、歌詞、避けたい要素を書きます。

生成時間と料金はどう決まりますか?

モデル、文字数、長さ、形式、音楽の長さ、品質設定、プロバイダーによって変わります。長い音声や音楽を実行する前に Input フッターのコストを確認してください。

生成音声を商用利用できますか?

商用利用はモデル、プロバイダー規約、プラン、スクリプト、歌詞、声、参考素材、アップロード素材の権利に依存します。必ず規約を確認してください。

PoYo で音声生成を行う理由

01

複数の音声モデルを 1 つのワークスペースで

プロンプトを作り直さず、音声、声、音楽モデルを比較できます。

02

ネイティブ音声パラメータ

各モデルの声、言語、スタイル、歌詞、形式、結果フローを保ちます。

03

ブラウザ内音声プレビュー

ダウンロード前に Output Gallery で生成音声を確認できます。

04

Playground と API ワークフロー

スクリプト、声、形式、JSON をテストしてから API 製品に移行できます。