L’API GPT Image 2.5 est disponible. Créez et modifiez des images →
L’API GPT Image 2.5 est disponible. Créez et modifiez des images →
PoYoPoYo
Marché
Tarifs
Enterprise
Ctrl+K
poyo.ai

Une API. Tous les modèles.

Conçu pour les développeurs

All systems operational

Ressources

  • Centre des alternatives
  • Centre des comparaisons
  • Blog
  • Fournisseurs
  • Programme d'affiliation
  • Features
  • Plan du site

© 2025 PoYo API. Tous droits réservés.

Modèles populaireshot

  • Seedance 2.5
  • MiniMax H3 / Hailuo 03
  • FLUX 3
  • Nano Banana Pro
  • Seedance 2
  • GPT Image 2

Nouveautésnew

  • GPT-6.1 Sol
  • Claude Sonnet 5.5
  • MiniMax H3 Max
  • MiniMax H3 Max Turbo
  • Qwen Image 2.1
  • GPT-6 Luna

À venirsoon

  • Wan Animate 2

Tous les fournisseurs

Google

  • Nano Banana Pro
  • Gemini Omni 1.1 Flash
  • Gemini 3.7 Flash
  • Gemini 3.8 Flash
  • Gemini 3.1 Flash TTS
  • Nano Banana
  • Veo 3.1
  • Veo 3.1 Official
  • Omni Flash
  • Nano Banana 2
  • Gemini 3.5 Flash
  • Nano Banana 2 Lite
  • Gemini 3 Series

Kling

  • Kling 3.0 Motion Control
  • Kling 3.0
  • Kling O3
  • Kling 1.6
  • Kling 2.1
  • Kling 2.6
  • Kling Avatar 2.0
  • Kling 2.5 Turbo Pro
  • Kling 3.0 Turbo
  • Kling 2.6 Motion Control
  • Kling O3 Image
  • Kling O1 Image

Anthropic

  • Claude Sonnet 5
  • Claude Fable 5.1
  • Claude Opus 5
  • Claude Opus 5.5
  • Claude Sonnet 5.5
  • Claude Opus 4.8
  • Claude Opus 4.7
  • Claude 4.6 API
  • Claude 4.5 Series

MiniMax

  • MiniMax H3 / Hailuo 03
  • MiniMax H3 Max
  • MiniMax H3 Max Turbo
  • MiniMax Music 2.6
  • Hailuo 02
  • Hailuo 2.3

Tripo3D

  • Tripo3D H3.1
  • Tripo3D P1

Moonshot AI

  • Kimi K3

OpenAI

  • GPT Image 2
  • Sora 2 Official
  • GPT-6 Astra
  • GPT-6 Sol
  • GPT Image 2.5
  • GPT-5.6
  • GPT-6 Luna
  • GPT-6.1 Sol
  • GPT Image 1.5
  • GPT-4o Image
  • GPT-5.5
  • GPT-5.4
  • GPT-5.2

Seedream

  • Seedream 5.0 Pro
  • Seedream 4
  • Seedream 4.5
  • Seedream 5.0 Lite

Seedance

  • Seedance 2.5
  • Seedance 2
  • Seedance 2.0 Mini
  • Seedance 1.0 Pro
  • Seedance 1.5 Pro

DeepSeek

  • DeepSeek V4 Flash
  • DeepSeek V4 Pro
  • DeepSeek V4.1 Flash

Hunyuan

  • Hunyuan 3D v3.1

ElevenLabs

  • ElevenLabs Music
  • ElevenLabs TTS Turbo v2.5
  • ElevenLabs V3 TTS

Black Forest Labs

  • FLUX 3
  • FLUX.2
  • Flux Kontext
  • Flux Dev
  • Flux Schnell

Alibaba

  • Qwen Image 3.0
  • Happy Horse 1.1
  • Wan 2.7 Video
  • Wan 3.0
  • Wan 3.0 Video Prime
  • Qwen Image 2.1
  • Wan Animate 2
  • Wan 2.2 Fast
  • Z-Image
  • Wan 2.5
  • Wan 2.6
  • Wan 2.7 Image
  • Wan Animate
  • Happy Horse

xAI

  • Grok 4.6
  • Grok 4.7
  • Grok Imagine Image 2.0
  • xAI TTS 1
  • Grok Imagine
  • Grok Imagine Video 1.5
  • Grok Imagine Image Quality

Meshy

  • Meshy 6 3D

Runway

  • Runway Gen-4.5

PoYo

  • AI Video Background Removal
  • AI Video Upscaler
  • Image Translator
  • Video Translator
  • Suno Music
GitHubXInstagramYouTubeDiscordTelegramEmail
AssistanceDocumentation
ImageVidéo3DAudioAvatarOutils
Loading playground...
Guide du générateur audio

Guide complet d'utilisation de Un générateur audio complet pour la voix et la musique

Un générateur audio complet pour la voix et la musique

Le générateur audio PoYo regroupe les modèles de génération vocale, de voix off et de musique dans un espace de travail ciblé. Vous pouvez choisir ElevenLabs, Gemini, xAI, MiniMax et d'autres modèles audio exécutables directement dans le panneau Input.

Chaque modèle conserve ses réglages natifs : langue, voix, tags d'émotion, vitesse, paroles, mode instrumental, format de sortie, aperçu, réponse JSON et téléchargement n'apparaissent que lorsque le modèle actif les prend en charge.

Commencer

Fonctions clés du générateur audio PoYo

Générez parole, voix off et musique, puis prévisualisez, téléchargez et validez vos paramètres pour l'API.

01

Text-to-speech multilingue expressif

Transformez scripts, textes produit, narration et dialogues en audio naturel. Les modèles compatibles exposent les voix, langues, tags d'émotion, normalisation du texte, vitesse et timestamps.

  • Créer des voix off à partir de scripts
  • Contrôler langue, voix et interprétation si disponible
  • Produire de l'audio pour apps, vidéos, cours et agents
Workflow text-to-speech multilingue

02

Prompt-to-music et création de chansons

Créez de la musique à partir de prompts, paroles, mode instrumental et idées de composition structurées. Les modèles text-to-music aident à produire démos, hooks, pistes d'accompagnement et directions créatives.

  • Générer chansons, instrumentaux et concepts musicaux
  • Guider humeur, genre, arrangement, paroles et voix
  • Utiliser les champs de composition propres au modèle
Workflow prompt-to-music

03

Qualité, latence et formats propres à chaque modèle

Passez d'une famille de modèles audio à l'autre sans perdre les contrôles natifs. TTS rapide, voix expressives, musique, sample rate, bitrate, format de sortie et options de qualité restent liés au modèle actif.

  • Comparer les fournisseurs audio depuis un seul sélecteur
  • Afficher uniquement les paramètres pris en charge
  • Choisir MP3, WAV, OGG, PCM ou formats fournisseur
Contrôles audio et formats

04

Aperçu, téléchargement et passage à l'API

Écoutez l'audio généré dans le navigateur, inspectez JSON et timestamps quand ils sont renvoyés, téléchargez le fichier final et réutilisez les réglages validés dans vos workflows API ou agents.

  • Écouter les sorties audio avant téléchargement
  • Télécharger les fichiers pour montage et publication
  • Valider prompts et paramètres avant intégration API
Aperçu audio et passage API

Que créer avec le générateur audio PoYo ?

01

Voix off vidéo et doublage

Créez narration, audio de démonstration produit, doublage multilingue et pistes vocales pour réseaux sociaux.

02

Podcasts, livres audio et cours

Générez leçons parlées, aperçus de chapitres, segments de podcast et tests de narration longue.

03

Voix d'app multilingues et accessibilité

Prototypez voix d'application, narration d'onboarding, audio de type lecteur d'écran et expériences localisées.

04

Démos musicales, chansons et instrumentaux

Créez idées de chansons, beds instrumentaux, hooks, démos et musiques d'accompagnement.

05

Concepts audio sociaux, jeu et création

Explorez voix de personnages, sons d'interface jeu, assets créateur et concepts audio interactifs.

06

Workflows développeur, API et agents

Validez prompts, voix, formats, aperçus et réponses JSON avant l'intégration API.

Comment utiliser le générateur audio sur PoYo

1. Choisissez un modèle audio dans Input. Sélectionnez le fournisseur et le modèle exécutable adapté à la voix ou à la musique.

2. Ajoutez texte, paroles ou direction musicale. Renseignez script, prompt, langue, style de voix, humeur, instrumentation ou paroles.

3. Ajustez les contrôles du modèle. Configurez uniquement les options visibles : voix, tags d'émotion, vitesse, sample rate, bitrate, format, lyrics optimizer ou mode instrumental.

4. Lancez, écoutez et téléchargez. Soumettez la génération, écoutez l'aperçu, inspectez JSON si nécessaire, puis téléchargez le fichier.

Questions fréquentes sur le générateur audio

Que peut créer le générateur audio ?

Le générateur audio PoYo peut créer text-to-speech, voix off, narration, dialogue, démos musicales, chansons et instrumentaux selon le modèle choisi. Le panneau Input n'affiche que les champs pris en charge.

Quel modèle audio choisir en premier ?

Commencez par ElevenLabs V3 TTS pour des voix off expressives, ElevenLabs TTS Turbo v2.5 ou xAI TTS 1 pour des tests rapides, Gemini 3.1 Flash TTS pour une parole guidée par style, ElevenLabs Music pour la musique structurée, MiniMax Music 2.6 pour prompts et paroles, et Generate Music pour la création musicale générale.

L'audio généré est-il naturel ?

La qualité dépend du modèle, du prompt, de la langue, de la voix et des réglages. Les modèles TTS modernes peuvent être très naturels, mais une écoute, des corrections de prononciation, un contrôle du rythme et un mastering restent utiles.

Puis-je contrôler langue, émotion, voix, vitesse ou style musical ?

Oui quand le modèle le permet. Certains modèles vocaux exposent langue, voix, vitesse, stabilité, style, tags d'émotion ou timestamps. Les modèles musicaux peuvent exposer genre, humeur, paroles, instrumental, structure et format.

Quels formats audio puis-je prévisualiser ou télécharger ?

La galerie lit les fichiers audio courants dans le navigateur. Selon le fournisseur, les téléchargements peuvent inclure MP3, WAV, OGG, Opus, PCM, mu-law, A-law, timestamps ou fichiers associés.

Comment améliorer la qualité audio ?

Utilisez des scripts propres, des indications de prononciation, une direction vocale précise, un rythme réaliste et des tags d'émotion modérés. Pour la musique, décrivez genre, humeur, tempo, instruments, voix, structure, paroles et éléments à éviter.

Combien de temps dure la génération et comment le prix est-il calculé ?

Le temps et le coût varient selon modèle, longueur du texte, durée, format, longueur musicale, qualité et fournisseur. Vérifiez le coût du modèle actif dans le footer Input avant les longues générations.

Puis-je utiliser l'audio généré commercialement ?

L'usage commercial dépend du modèle, des conditions fournisseur, du plan et des droits liés aux scripts, paroles, voix, références et fichiers importés. Vérifiez les conditions et évitez les contenus sans autorisation.

Pourquoi utiliser PoYo pour l'audio ?

01

Un espace pour plusieurs modèles audio

Comparez voix, speech et musique sans reconstruire vos prompts dans plusieurs outils.

02

Paramètres audio natifs

Chaque modèle garde ses voix, langues, styles, paroles, formats et résultats.

03

Aperçu audio dans le navigateur

Écoutez les sorties directement dans la galerie avant téléchargement.

04

Workflow Playground et API

Testez scripts, prompts, voix, formats et JSON avant de passer en production API.