Metinden Sese API

Geliştiriciler için AI API'leri

Metinden Sese API

PoYo Metin Okuma API'si ile ürününüze yapay zeka ses oluşturma özelliği ekleyin. Anlatım iş akışlarına yönelik TTS modellerini, ses kontrollerini, dilleri, ses formatlarını, zaman damgalarını ve fiyatlandırmayı karşılaştırın.

Metinden Konuşmaya Model API'leri - Fiyatlandırma ve Model Uyumu

Model seçmeden önce sağlayıcıları, desteklenen girişleri, çıktı biçimlerini ve fiyatları karşılaştırın.

Tam görev eşleşmesi

Modeller burada yalnızca katalog meta verileri Text to Speech içerdiğinde görünür.

Sağlayıcı karşılaştırması

Görev dizininden ayrılmadan sağlayıcılar arasındaki model ailelerini inceleyin.

API'ye hazır yollar

Her model kartı PoYo fiyatlandırmasına, örneklere, oyun alanı kontrollerine ve API ayrıntılarına bağlantı verir.

ModelProviderGörev türleriFiyat
ElevenLabs TTS Turbo v2.5

elevenlabs-tts-turbo-2-5

ElevenLabsText to Speech$0.04/1.000 karakter
ElevenLabs V3 TTS

elevenlabs-v3-tts

ElevenLabsText to Speech$0.08/1.000 karakter
Gemini 3.1 Flash TTS

gemini-3-1-flash-tts

GoogleText to Speech$0.12/1.000 karakter
xAI TTS 1

xai-tts-1

xAIText to Speech$0.012/1.000 karakter

Sık sorulan sorular

Metinden Sese API nedir?

+

Metinden konuşmaya API, yazılı metinden konuşma sesi üretir. Her komut dosyasını manuel olarak kaydetmeye gerek kalmadan bir uygulamada anlatım ve ses özelliklerini etkinleştirir. Seçilen model mevcut sesleri, dilleri, konuşma kontrollerini ve çıktı formatlarını belirler.

TTS API modelini nasıl seçerim?

+

İsimler, sayılar ve uzun cümleler de dahil olmak üzere gerçek komut dosyalarınızı test edin. Telaffuz, doğallık, ifade kontrolü, ses tutarlılığı ve maliyeti karşılaştırın. Gerekli dili ve ses formatını onaylayın ve yanıt süresi ürününüz için önemliyse belgelenen istek akışını kontrol edin.

Sesi, konuşma hızını ve duyguyu seçebilir miyim?

+

Mevcut kontroller modele göre değişir. Bir uç nokta, ses ön ayarları, hız, kararlılık, stil talimatları veya ses etiketleri sunabilir. Belgelenen alanları ve desteklenen değerleri kullanın; Hız veya duygu kontrolü olmayan bir modelin keyfi bir parametreyi yorumlaması beklenmemelidir.

Metin okuma API'si hangi dilleri destekliyor?

+

Dil kapsamı ve telaffuz kalitesi modele ve sese bağlıdır. Belgelenen dil seçeneklerini veya algılama davranışını kontrol edin, ardından yerel metni ve karma dildeki pasajları test edin. Çok dilli bir etiket, her aksan veya özel isim için eşit kaliteyi garanti etmez.

Yanlış telaffuz edilen adları, kısaltmaları veya sayıları nasıl düzeltebilirim?

+

Konuşma dili için pasajı yeniden yazın, belirsiz kısaltmaları genişletin ve kısa bir cümleyi test edin. Mümkün olduğunda belgelenmiş telaffuz veya normalleştirme kontrollerini kullanın. Yazılı bir ekran dizesinin her zaman en iyi konuşma girişi olduğunu varsaymak yerine, anlatım için gözden geçirilmiş bir metin sürümünü saklayın.

Uzun biçimli anlatım oluşturabilir miyim?

+

Uç nokta metin sınırını ve desteklenen süre davranışını kontrol edin. Uzun metinleri doğal paragraf veya cümle sınırlarında bölün, ses ayarlarını yeniden kullanın ve birleştirme sonrasında geçişleri gözden geçirin. Ayrı istekler arasında sürekliliğe yardımcı olmak için modelin desteklediği bağlam alanlarını koruyun.

TTS API otomatik olarak sesi kopyalar mı?

+

Hayır. Sentetik bir ses veya ön ayar seçmek, bir kayıttan klon oluşturmaktan farklıdır. Ses klonlama, özel olarak desteklenen bir iş akışı ve uygun izin gerektirir. Özel bir ses kimliği etrafında bir ürün tasarlamadan önce mevcut uç noktayı kontrol edin.

Kelime zaman damgalarını alabilir miyim veya diyalog oluşturabilir miyim?

+

Bazı modeller zaman damgaları veya çoklu hoparlör kontrolleri sağlarken diğerleri sağlamaz. Model sayfasındaki çıktı alanlarını ve istek seçeneklerini onaylayın. Altyazılar veya senkronize metin vurgulama için zaman damgalarını kullanmadan önce kendi komut dosyanızdaki hizalamayı doğrulayın.

Hangi ses formatlarını talep edebilirim?

+

Seçilen TTS modeli için belgelenen formatları ve kalite seçeneklerini kullanın. Oynatma, telefon ve düzenleme, farklı codec'ler veya örnekleme hızları gerektirebilir. Tamamlanan çıktıyı inceleyin ve uygulamanız desteklenmeyen bir formata ihtiyaç duyduğunda bunu ayrı bir medya adımında dönüştürün.

PoYo aracılığıyla oluşturulan konuşmayı nasıl alırım?

+

Seçilen model oluşturma uç noktasını kullanın, task_id'yu kaydedin ve tamamlanan sesi durum sorguları veya desteklenen bir callback_url aracılığıyla alın. Düşük gecikmeli TTS ifadesinden akış uç noktası sonucunu çıkarmayın; söz konusu model için belgelenen tam PoYo arayüzünü kontrol edin.

Metinden konuşmaya API fiyatlandırması nasıl hesaplanır?

+

TTS fiyatlandırmasında karakterler, belirteçler, nesil veya modele özgü başka bir birim kullanılabilir. Seçilen katmanın kullanımı nasıl saydığını ve isteğe bağlı ayarların bunu nasıl etkilediğini kontrol edin. Ham fiyatları farklı faturalandırma birimleriyle karşılaştırmak yerine, komut dosyasının tamamını ve beklenen yeniden deneme sayısını tahmin edin.

TTS'yi konuşan bir avatar API'sine nasıl bağlayabilirim?

+

Önce konuşmayı oluşturun ve gözden geçirin, ardından biçiminin ve uzunluğunun avatar uç noktası gereksinimlerini karşıladığını doğrulayın. Sesi uygun bir portre ile sağlayın ve avatar görevini ayrı olarak izleyin. Revizyonların amaçlanan sunumu yeniden üretebilmesi için anlatım metni ve ses ayarlarını koruyun.