
AI API untuk pengembang
API Teks ke Suara
Tambahkan pembuatan suara AI ke produk Anda dengan PoYo API Teks ke Suara. Bandingkan model TTS, kontrol suara, bahasa, format audio, stempel waktu, dan harga untuk alur kerja narasi.
Model yang cocok
4 model

$0.04 /1.000 karakter
elevenlabs-tts-turbo-2-5
Generate low-latency multilingual speech with ElevenLabs TTS Turbo v2.5. Supports voice selection, stability, similarity boost, style, speed, timestamps, language code, context text, and text normalization.

$0.08 /1.000 karakter
elevenlabs-v3-tts
Generate expressive text-to-speech audio with ElevenLabs V3 TTS. Supports audio tags, voice selection, stability, language code, text normalization, and optional timestamps for production speech workflows.

$0.12 /1.000 karakter
gemini-3-1-flash-tts
Generate expressive multilingual speech with Gemini 3.1 Flash TTS. Supports granular audio tags, natural-language style instructions, Gemini voice presets, two-speaker dialogue, and MP3, WAV, or OGG Opus output.

$0.012 /1.000 karakter
xai-tts-1
Generate low-latency expressive multilingual speech with xAI TTS 1. Supports speech tags, five voice presets, automatic language detection, and flexible MP3, WAV, PCM, mu-law, or A-law output.
Teks untuk Pidato Model API - Harga dan Model yang Cocok
Bandingkan penyedia, masukan yang didukung, format keluaran dan harga sebelum memilih model.
Cocok dengan tugas
Model muncul di sini hanya jika katalog metadata mereka termasuk Text to Speech.
Perbandingan penyedia
Ulasan keluarga model di seluruh penyedia tanpa meninggalkan direktori tugas.
API-jalan siap
Setiap kartu model menghubungkan ke PoYo harga, contoh, kontrol taman bermain dan API details.
| Model | Penyedia | Jenis tugas | Harga |
|---|---|---|---|
| ElevenLabs TTS Turbo v2.5 elevenlabs-tts-turbo-2-5 | ElevenLabs | Text to Speech | $0.04/1.000 karakter |
| ElevenLabs V3 TTS elevenlabs-v3-tts | ElevenLabs | Text to Speech | $0.08/1.000 karakter |
| Gemini 3.1 Flash TTS gemini-3-1-flash-tts | Text to Speech | $0.12/1.000 karakter | |
| xAI TTS 1 xai-tts-1 | xAI | Text to Speech | $0.012/1.000 karakter |
Pertanyaan yang sering diajukan
Apa itu API Teks ke Suara?
+
API teks ke ucapan menghasilkan audio lisan dari teks tertulis. Ini mengaktifkan fitur narasi dan suara dalam aplikasi tanpa merekam setiap skrip secara manual. Model yang dipilih menentukan suara, bahasa, kontrol bicara, dan format output yang tersedia.
Bagaimana cara memilih model TTS API?
+
Uji skrip Anda yang sebenarnya, termasuk nama, angka, dan kalimat panjang. Bandingkan pengucapan, kealamian, kontrol ekspresif, konsistensi suara, dan biaya. Konfirmasikan bahasa dan format audio yang diperlukan, dan periksa alur permintaan yang terdokumentasi jika waktu respons penting bagi produk Anda.
Bisakah saya memilih suara, kecepatan bicara, dan emosi?
+
Kontrol yang tersedia bervariasi berdasarkan model. Titik akhir mungkin menawarkan preset suara, kecepatan, stabilitas, instruksi gaya, atau tag audio. Gunakan bidang yang terdokumentasi dan nilai yang didukung; model tanpa kontrol kecepatan atau emosi tidak boleh diharapkan untuk menafsirkan parameter sewenang-wenang.
Bahasa apa saja yang didukung oleh API teks ke ucapan?
+
Cakupan bahasa dan kualitas pengucapan bergantung pada model dan suaranya. Periksa opsi bahasa yang terdokumentasi atau perilaku deteksi, lalu uji teks asli dan bagian bahasa campuran. Label multibahasa tidak menjamin kualitas yang sama untuk setiap aksen atau nama diri.
Bagaimana cara memperbaiki nama, singkatan, atau angka yang salah diucapkan?
+
Tulis ulang bagian untuk bahasa lisan, perluas singkatan yang ambigu dan uji kalimat pendek. Gunakan kontrol pengucapan atau normalisasi yang terdokumentasi jika tersedia. Simpan versi teks yang telah diulas untuk narasi daripada berasumsi bahwa rangkaian tampilan tertulis selalu merupakan masukan ucapan terbaik.
Bisakah saya membuat narasi panjang?
+
Periksa batas teks titik akhir dan perilaku durasi yang didukung. Bagilah skrip panjang pada batas paragraf atau kalimat alami, gunakan kembali pengaturan suara, dan tinjau transisi setelah perakitan. Pertahankan bidang konteks di mana model mendukungnya untuk membantu kesinambungan di seluruh permintaan terpisah.
Apakah TTS API mengkloning suara secara otomatis?
+
Tidak. Memilih suara sintetis atau preset berbeda dengan membuat tiruan dari rekaman. Kloning suara memerlukan alur kerja yang didukung secara khusus dan izin yang sesuai. Periksa titik akhir yang tersedia sebelum merancang produk dengan identitas suara khusus.
Bisakah saya mendapatkan stempel waktu kata atau membuat dialog?
+
Beberapa model menyediakan stempel waktu atau kontrol beberapa speaker, sementara model lainnya tidak. Konfirmasikan bidang keluaran dan minta opsi pada halaman model. Validasi perataan pada skrip Anda sendiri sebelum menggunakan stempel waktu untuk subtitle atau penyorotan teks yang disinkronkan.
Format audio apa yang bisa saya minta?
+
Gunakan format dan pilihan kualitas yang didokumentasikan untuk model TTS yang dipilih. Pemutaran, telepon, dan pengeditan mungkin memerlukan codec atau kecepatan sampel yang berbeda. Periksa keluaran yang telah selesai dan konversikan dalam langkah media terpisah saat aplikasi Anda memerlukan format yang tidak didukung.
Bagaimana cara mengambil ucapan yang dihasilkan melalui PoYo?
+
Gunakan titik akhir pembuatan model yang dipilih, simpan task_id dan ambil audio yang telah selesai melalui kueri status atau callback_url yang didukung. Jangan menyimpulkan titik akhir streaming dari frasa TTS latensi rendah; periksa antarmuka PoYo persis yang didokumentasikan untuk model itu.
Bagaimana cara menghitung harga API teks ke ucapan?
+
Penetapan harga TTS dapat menggunakan karakter, token, generasi, atau unit khusus model lainnya. Periksa bagaimana tingkat yang dipilih menghitung penggunaan dan bagaimana pengaturan opsional memengaruhinya. Perkirakan skrip lengkap dan percobaan ulang yang diharapkan, daripada membandingkan harga mentah dengan unit penagihan yang berbeda.
Bagaimana cara menghubungkan TTS dengan API avatar yang bisa berbicara?
+
Buat dan tinjau pidatonya terlebih dahulu, lalu konfirmasikan bahwa format dan panjangnya memenuhi persyaratan titik akhir avatar. Berikan audio dengan potret yang sesuai dan lacak tugas avatar secara terpisah. Pertahankan pengaturan teks narasi dan suara agar revisi dapat mereproduksi penyampaian yang diinginkan.
Menjelajahi semua model AI
Buka pasar model penuh untuk membandingkan gambar, video, audio, chat, 3D dan model alat.
Lihat semua modelMembangun dengan API
Buka halaman model untuk parameter, harga dan dokumentasi API.
Dokumentasi APIHalaman tugas yang terkait