Model icon
elevenlabs-v3-tts
Text to Speech
Mô hình:
ElevenLabs V3 TTS API tạo ra ngôn ngữ đa ngôn ngữ biểu cảm với thẻ âm thanh, giao thông cảm xúc và dòng công việc thoại theo phong cách đối thoại.
Input
114/5000

1-5000 characters. Use audio tags for expressive delivery and multi-speaker scripts.

Custom

Use a fal example voice name or enable Custom to enter an ElevenLabs voice ID.

Optional ISO 639-1 language code used to enforce a specific language.

Return aligned timestamp data when available.

Output

Ví dụ về kết quả

Đây là dữ liệu mẫu. Tạo ra một kết quả mới để xem sản lượng thực.

ID nhiệm vụ:elevenlabs-v3-tts-exampleĐược tạo ra:PoYo official example
Trạng thái:finishedTiến bộ:100%

ElevenLabs V3 TTS example output

Examples
Chi tiết về giá

Giá cả minh bạch mà không có phí ẩn. Chọn tiền đi.

ElevenLabselevenlabs-v3-tts
Text to speech
Giá PoYo
$0.080
16 tín dụng
Giá chính thức
$0.100
Fal
Anh cứu
20%

* Các khoản phí thực tế được dựa trên kết quả cuối cùng.

Khởi đầu

Hướng dẫn đầy đủ về việc sử dụng Giá cả phải chăng ElevenLabs V3 TTS API cho giọng nói AI biểu hiện

Giá cả phải chăng ElevenLabs V3 TTS API cho giọng nói AI biểu hiện

Xây dựng các dòng công việc văn bản-thủ ngôn biểu cảm bằng ElevenLabs V3 TTS trên PoYo. Tạo âm thanh âm thanh AI tự nhiên từ kịch bản, hướng dẫn hiệu suất với thẻ âm thanh như [excited], [whispers], và [laughs], và kiểm soát giọng nói, ổn định, ngôn ngữ, bình thường hóa văn bản, và dấu thời gian thông qua một asynch API.

Có sẵn ElevenLabs V3 TTS API Mô hình trên PoYo

01

elevenlabs-v3-tts

TTS biểu hiện sẵn sàng sản xuất tại 16 tín dụng mỗi 1000 chữ cái, bằng với $0.08 mỗi 1000 chữ cái trên PoYo, với điều khiển cho giọng nói, ổn định, ngôn ngữ, bình thường hóa, và timestamps.
Hãy thử sân chơi

Tại sao ElevenLabs V3 TTS khác nhau

ElevenLabs V3 TTS được xây dựng để phát ra giọng nói, không chỉ đọc. Sử dụng nó cho câu chuyện, đối thoại, giọng nói sản phẩm, địa phương hóa và âm thanh nhân vật.

01

Định hướng hiệu suất Script-Level

Kiểm soát giọng nói cảm xúc, giao tiếp và phản ứng của con người trực tiếp trong văn bản. Điều này làm cho cùng một trường kịch bản hữu ích cho cả nội dung nói và hướng hoạt động.
  • Sử dụng các thẻ như [sự phấn khích], [sẽ thì thầm] và [số cười] để hướng dẫn giọng nói.
  • Tạo câu chuyện tự nhiên hơn, đối thoại nhân vật và các giọng nói xã hội.
  • Giữ một trường văn bản duy nhất như là nguồn sự thật cho cả kịch bản và tín hiệu hiệu hiệu suất.
ElevenLabs v3 giao diện thẻ âm thanh

02

API Kiểm soát cho các sản phẩm thực

Gửi các trường được phơi bày trong các tài liệu PoYo API: văn bản, giọng nói, ổn định, dấu thời gian, language_code, và apply_text_normalization. Sử dụng tên giọng nói được đặt trước trong sân chơi hoặc thông qua ID giọng nói tùy chỉnh ElevenLabs trong sản xuất.
  • Giữ sự ổn định giữa 0 và 1 để có thể dự đoán được hành vi giọng nói.
  • Sử dụng language_code cho việc tạo ra nhiều ngôn ngữ.
  • Khả năng đánh dấu thời gian khi cần dữ liệu sắp xếp dòng chảy xuống.
ElevenLabs API phát âm trực quan

Những gì bạn có thể xây dựng

01

Video ngắn Voiceovers

Tạo câu chuyện biểu cảm cho cuộn, trình bày sản phẩm, quảng cáo, giải thích và ra mắt video.

02

Nội dung học tập

Chuyển đổi các kịch bản khóa học, hướng dẫn và hướng dẫn thành âm thanh nói rõ ràng.

03

Nhân vật và đối thoại

Các dòng nhân vật nguyên mẫu, trợ lý ứng dụng, dòng chảy chơi vai trò và đối thoại kể chuyện bằng cách sử dụng thẻ âm thanh.

04

Địa điểm

Tạo tài sản ngôn ngữ đa ngôn ngữ với mã ngôn ngữ và kiểm soát bình thường hóa văn bản.

ElevenLabs V3 TTS API vs fal.ai ElevenLabs V3 TTS Mô hình so sánh

PoYo phơi bày ElevenLabs V3 TTS thông qua một dòng công việc tạo bất đồng bộ đơn giản với giá tham chiếu thấp hơn.
Tính năngPoYofal.ai
ID mô hình công cộngelevenlabs-v3-ttsfal-ai/elevenlabs/tts/eleven-v3
Giá tham chiếu$0.08 cho mỗi ký tự 1000$0.10 cho mỗi ký tự 1000
Các khoản tín dụng PoYoCác tín dụng 16 cho mỗi ký tự 1000N/A
Dũ dài văn bản tối đaCác ký tự 5000Tùy thuộc vào nhà cung cấp
Phòng chảy công việcĐưa nhiệm vụ, tình trạng tiêu chuẩn cuộc thăm dò, tải xuống các tệp âm thanhĐiểm cuối cụ thể cho nhà cung cấp

Giá PoYo sử dụng tín dụng 16 cho mỗi ký tự 1000. Một tín dụng có giá tại $0.005.

Làm thế nào để sử dụng ElevenLabs V3 TTS trên PoYo

  1. Nhận cái của anh khóa API: Tạo một PoYo tính toán và tạo ra một khóa API từ bảng điều khiển. Đi nào. khóa API ->
  2. Hãy viết kịch bản: Nhập vào 1-5000 và thêm thẻ âm thanh như [excited], [whispers], hoặc [laughs] khi bạn muốn giao dịch biểu cảm hơn.
  3. Chọn cài đặt giọng nói: Chọn tên giọng nói được đặt trước, nhập tùy chỉnh ElevenLabs ID giọng nói trong JSON, điều chỉnh độ ổn định, và tùy chọn đặt language_code, timestamp, và apply_text_normalization.
  4. Đưa và lấy: Đưa nhiệm vụ qua PoYolà tạo ra API, sau đó khảo sát các điểm cuối trạng thái nhiệm vụ tiêu chuẩn cho đầu ra âm thanh. Xem API - Các tài liệu ->

ElevenLabs V3 TTS FAQ

ElevenLabs V3 TTS là gì?

ElevenLabs V3 TTS là một mô hình văn bản nói chung biểu hiện biến kịch bản viết thành âm thanh giọng nói AI tự nhiên. Nó được thiết kế để theo dõi thẻ âm thanh trong đường, tín hiệu cảm xúc, cài đặt giọng nói và kiểm soát ngôn ngữ để phát biểu được tạo ra có thể nghe được hướng dẫn hơn và nhận thức hiệu suất.

ElevenLabs V3 TTS API được sử dụng cho gì?

Sử dụng nó để tạo ra các giọng nói, câu chuyện, âm thanh demo sản phẩm, nội dung học tập, đối thoại nhân vật, giọng nói trợ lý ứng dụng, âm thanh địa phương hóa và các bản nhạc giọng nói phương tiện truyền thông dạng ngắn.

Cần có thông tin nào?

Các trường văn bản là cần thiết và phải nằm giữa các ký tự 1 và 5000. Tiếng nói, ổn định, dấu thời gian, language_code và bình thường hóa văn bản là các điều khiển tùy chọn.

Tôi có thể sử dụng giọng nói ElevenLabs tùy chỉnh không?

Có. Vùng giọng nói chấp nhận tên giọng nói hoặc ID giọng nói. Khu chơi game phơi bày các giọng nói được thiết lập sẵn phổ biến, và chế độ JSON có thể gửi một ID giọng nói tùy chỉnh ElevenLabs.

Làm thế nào tính toán hóa đơn?

PoYo hóa đơn ElevenLabs V3 TTS tại 16 tín dụng cho mỗi ký tự 1000, tương đương với $0.08 cho mỗi ký tự 1000.

Tôi có thể dùng các thẻ biểu cảm không?

Có. Mô hình được thiết kế cho các kịch bản nói chuyện biểu cảm và hỗ trợ thẻ âm thanh như [excited], [whispers], và [laughs].

Làm sao tôi có được kết quả?

Đưa ra yêu cầu tạo, sau đó sử dụng ID nhiệm vụ với điểm cuối trạng thái nhiệm vụ tiêu chuẩn của PoYo. Các nhiệm vụ hoàn thành trả lại các tệp âm thanh và có thể bao gồm dữ liệu dấu thời gian khi yêu cầu.

Tại sao sử dụng PoYo

01

Giá cả có giá cả

Sử dụng ElevenLabs V3 TTS tại $0.08 cho mỗi ký tự 1000 với hóa đơn rõ ràng cho mỗi ký tự.

02

Phiên bản mô hình thống nhất

Sử dụng cùng một tài khoản PoYo, hóa đơn, thăm dò tình trạng và dòng công việc callback trên các mô hình văn bản, hình ảnh, video và âm thanh.

03

Phòng làm việc sản xuất

Gửi các công việc bất đồng bộ, khảo sát trạng thái nhiệm vụ ổn định, và lấy lại các tệp âm thanh hoàn thành từ một bề mặt API.

04

Các điều khiển rõ ràng

Khám phá các điều khiển cốt lõi cần thiết trong sản xuất: văn bản, giọng nói, ổn định, ngôn ngữ, bình thường hóa và dấu thời gian.