
AI API untuk pengembang
API Teks ke Gambar
Bangun pembuatan gambar AI ke dalam produk Anda dengan PoYo API Teks ke Gambar. Bandingkan model gambar, kontrol cepat, ukuran keluaran, dan harga untuk aplikasi kreatif dan alur kerja otomatis.
Model yang cocok
26 model

$0.04 /generasi
nano-banana-pro
Google's advanced Gemini 3 Pro image model featuring 4K resolution, enhanced reasoning, real-time data integration, and multi-image composition capabilities.

$0.01 /generasi
gpt-image-2
OpenAI's premium image generation family for text-to-image creation and single-image editing with simple prompt-driven controls.

$0.024 /gambar
qwen-image-3
Alibaba's third-generation image model for long prompts, information-dense layouts, fine text rendering, multilingual visuals, and knowledge-rich image generation.

$0.075 /gambar
seedream-5.0-pro
ByteDance's flagship image model for precise prompt following, dense layouts, multilingual text rendering, and region-precise editing.

$0.007 /generasi
gpt-image-2.5-flare
OpenAI image generation and editing with high-fidelity reference images, precise inpainting, multi-turn consistency, and transparent backgrounds. Explore Flare and Sunburst and compare GPT Image 2.5 with GPT Image 2 on PoYo.

$0.04 /gambar
grok-imagine-image-2.0
xAI image generation and editing with up to three input images, five supported aspect ratios, 1K or 2K resolution, selectable quality, and up to four outputs.

$0.03 /generasi
qwen-image-2.1
Alibaba's 7B open-weight unified text-to-image and editing model with native RGBA transparency, up to 10 reference images, and 2K resolution.

$0.02 /gambar
nano-banana-2.1
Generate and edit 1K, 2K and 4K images with Google's Nano Banana 2.1. Combine up to 10 reference images for product visuals, posters and consistent creative assets. From 4 credits ($0.02) per image.

$0.02 /gambar
seedream-5.0-flash
ByteDance's fast, cost-efficient image model for 1K/1.5K/2K generation, multi-reference editing, and multilingual visual content. 4 credits per image.

$0.03 /generasi
flux-2-pro
Black Forest Labs' production-grade model combining 4MP image generation and editing with multi-reference support, precise typography, and hex color control.

$0.01 /generasi
gpt-image-1.5
OpenAI's latest image model with 4x speed, precision editing, and superior text rendering.

$0.03 /gambar
grok-imagine-image
xAI's Aurora-powered visual AI for image generation and video creation with Fun, Normal, and Spicy creative modes.

$0.025 /generasi
nano-banana
Google's leaderboard-topping image model (Gemini 2.5 Flash) excelling in natural language editing, character consistency, and multi-image blending.

$0.025 /generasi
seedream-4
ByteDance's multimodal image model for native 1K to 4K generation, reference-guided editing, and batch outputs up to 15 images.

$0.01 /generasi
z-image
Alibaba's efficient 6B-parameter image model with sub-second generation and exceptional Chinese-English bilingual text rendering capabilities.

$0.04 /generasi
flux-kontext-pro
Black Forest Labs' in-context image generation and editing family for scene-preserving edits, text replacement, and prompt-driven visual changes.

$0.02 /generasi
gpt-4o-image
OpenAI's native multimodal image generator with exceptional text rendering, precise prompt following, and conversational editing capabilities.

$0.025 /generasi
seedream-4.5
ByteDance's unified 4K image generation and editing model with professional-grade text rendering and commercial photography quality.

$0.025 /generasi
nano-banana-2-new
Google's next-gen image model powered by Gemini 3.1 Flash with native 2K/4K resolution, chain-of-thought reasoning, precise multi-language text rendering, and up to 14 reference images.

$0.025 /generasi
seedream-5.0-lite
ByteDance's efficient multimodal image model with native 2K/3K resolution, deep thinking, bilingual text rendering, and smart editing.

$0.021 /generasi
wan-2.7-image
Alibaba's unified Wan 2.7 image family for text-to-image generation and reference-based image editing with standard and pro quality tiers.

$0.025 /generasi
nano-banana-2-lite
Google's fastest and most cost-efficient Gemini Image model, built for rapid ideation, high-throughput image generation, low-latency creative workflows, and scaled production pipelines.

$0.018 /gambar
kling-o3-image
Kling's O3 image family supports prompt-only generation, multi-reference editing, single outputs, and connected series generation with 1K to 4K resolution tiers.

$0.02 /megapiksel
flux-dev
Black Forest Labs image model for text-to-image generation and single-image editing with output-size based pricing.

$0.002 /megapiksel
flux-schnell
Black Forest Labs fast text-to-image model for low-cost prompt-based image generation with output-size based pricing.

$0.04 /gambar
grok-imagine-image-quality
xAI's higher-fidelity Grok Imagine image model for polished text-to-image generation and reference-based image editing.
Teks ke gambar Model API - Harga dan Model yang Cocok
Bandingkan penyedia, masukan yang didukung, format keluaran dan harga sebelum memilih model.
Cocok dengan tugas
Model muncul di sini hanya jika katalog metadata mereka termasuk Text to Image.
Perbandingan penyedia
Ulasan keluarga model di seluruh penyedia tanpa meninggalkan direktori tugas.
API-jalan siap
Setiap kartu model menghubungkan ke PoYo harga, contoh, kontrol taman bermain dan API details.
| Model | Penyedia | Jenis tugas | Harga |
|---|---|---|---|
| Nano Banana Pro nano-banana-pro | Text to Image, Image to Image | $0.04/generasi | |
| GPT Image 2 gpt-image-2 | OpenAI | Text to Image, Image to Image | $0.01/generasi |
| Qwen Image 3.0 qwen-image-3 | Alibaba | Text to Image, Image to Image, Uncensored | $0.024/gambar |
| Seedream 5.0 Pro seedream-5.0-pro | Seedream | Text to Image, Image to Image, Uncensored | $0.075/gambar |
| GPT Image 2.5 gpt-image-2.5-flare | OpenAI | Text to Image, Image to Image | $0.007/generasi |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | xAI | Text to Image, Image to Image | $0.04/gambar |
| Qwen Image 2.1 qwen-image-2.1 | Alibaba | Text to Image, Image to Image | $0.03/generasi |
| Nano Banana 2.1 nano-banana-2.1 | Text to Image, Image to Image | $0.02/gambar | |
| Seedream 5.0 Flash seedream-5.0-flash | Seedream | Text to Image, Image to Image | $0.02/gambar |
| FLUX.2 flux-2-pro | Black Forest Labs | Text to Image, Image to Image | $0.03/generasi |
| GPT Image 1.5 gpt-image-1.5 | OpenAI | Text to Image, Image to Image | $0.01/generasi |
| Grok Imagine grok-imagine-image | xAI | Text to Image, Image to Video, Uncensored | $0.03/gambar |
| Nano Banana nano-banana | Text to Image, Image to Image | $0.025/generasi | |
| Seedream 4 seedream-4 | Seedream | Text to Image, Image to Image | $0.025/generasi |
| Z-Image z-image | Alibaba | Text to Image, Uncensored | $0.01/generasi |
| Flux Kontext flux-kontext-pro | Black Forest Labs | Text to Image, Image to Image | $0.04/generasi |
| GPT-4o Image gpt-4o-image | OpenAI | Text to Image, Image to Image | $0.02/generasi |
| Seedream 4.5 seedream-4.5 | Seedream | Text to Image, Image to Image, Uncensored | $0.025/generasi |
| Nano Banana 2 nano-banana-2-new | Text to Image, Image to Image | $0.025/generasi | |
| Seedream 5.0 Lite seedream-5.0-lite | Seedream | Text to Image, Image to Image, Uncensored | $0.025/generasi |
| Wan 2.7 Image wan-2.7-image | Alibaba | Text to Image, Image to Image | $0.021/generasi |
| Nano Banana 2 Lite nano-banana-2-lite | Text to Image, Image to Image | $0.025/generasi | |
| Kling O3 Image kling-o3-image | Kling | Text to Image, Image to Image | $0.018/gambar |
| Flux Dev flux-dev | Black Forest Labs | Text to Image, Image to Image | $0.02/megapiksel |
| Flux Schnell flux-schnell | Black Forest Labs | Text to Image | $0.002/megapiksel |
| Grok Imagine Image Quality grok-imagine-image-quality | xAI | Text to Image, Image to Image | $0.04/gambar |
Pertanyaan yang sering diajukan
Apa itu API Teks ke Gambar?
+
API teks ke gambar menghasilkan gambar baru dari instruksi teks. Aplikasi Anda mengirimkan perintah dan pengaturan yang didukung ke model, lalu mengambil hasilnya. Ini berguna untuk produk kreatif, produksi kampanye, dan pembuatan aset otomatis ketika tidak ada gambar untuk diedit.
Bagaimana cara menulis perintah untuk API pembuatan gambar AI?
+
Mulailah dengan subjek utama, lalu jelaskan aksi atau tampilannya, komposisi, latar belakang, pencahayaan, dan gayanya. Pisahkan persyaratan penting dari detail dekoratif. Untuk konsep produk, tentukan material dan sudut kamera; untuk poster, tentukan tata letak yang diinginkan dan kutip teks persis yang Anda inginkan.
Model teks ke gambar mana yang harus saya pilih?
+
Uji beberapa model dengan petunjuk representatif dan pengaturan keluaran yang sama. Skor detail yang penting bagi kasus penggunaan Anda: bentuk produk, tampilan, huruf, komposisi, atau gaya ilustrasi. Bandingkan hasil yang dapat digunakan dan biaya percobaan ulang daripada hanya memilih berdasarkan harga awal terendah yang tercantum.
Bisakah API teks ke gambar menghasilkan teks yang dapat dibaca dalam gambar?
+
Beberapa model gambar menangani penulisan huruf lebih baik daripada yang lain, namun teks yang dihasilkan masih perlu diperiksa. Usahakan salinan yang diminta singkat dan dikutip dengan jelas. Untuk salinan legal, harga, atau tipografi merek yang tepat, buat visualnya terlebih dahulu dan tambahkan teks akhir dengan alur kerja desain atau rendering Anda.
Bagaimana cara menjaga karakter atau gaya visual tetap konsisten?
+
Gunakan kembali deskripsi gaya yang jelas dan uji struktur prompt yang sama di seluruh rangkaian gambar Anda. Jika identitas seseorang atau produk harus tetap dekat dengan desain yang sudah ada, gunakan model dengan input gambar referensi yang didukung melalui Image to Image. Prompt teks yang berulang saja tidak menjamin keluaran yang sama.
Resolusi dan rasio aspek manakah yang tersedia?
+
Dimensi dan rasio aspek yang didukung khusus untuk model dan titik akhir yang dipilih. Pilih pengaturan yang sesuai dengan penempatan akhir, seperti postingan sosial potret atau sampul lanskap. Periksa halaman model sebelum mengirim permintaan; dimensi yang ditingkatkan dan resolusi generasi asli adalah pengukuran yang berbeda.
Bisakah saya membuat banyak gambar atau mengotomatiskan satu batch?
+
Anda dapat mengoordinasikan beberapa permintaan API di aplikasi Anda. Periksa apakah model yang dipilih juga menawarkan parameter jumlah keluaran, karena satu permintaan tidak selalu berupa satu gambar. Batasi pekerjaan bersamaan sesuai kuota akun Anda, simpan setiap ID tugas yang dikembalikan, dan lacak biaya batch lengkap.
Apa perbedaan antara API teks ke gambar dan gambar ke gambar?
+
Text to Image menciptakan visual baru dari instruksi tertulis. Gambar ke Gambar dimulai dengan gambar yang sudah ada dan menggunakannya untuk memandu pengeditan, variasi, atau komposisi baru. Pilih yang terakhir ketika produk, orang, atau tata letak tertentu harus memberikan titik awal visual.
Bagaimana cara menerima gambar yang dihasilkan?
+
Untuk titik akhir generasi PoYo, kirimkan model dan masukannya ke /api/generate/submit. Simpan task_id yang dikembalikan, lalu kueri /api/generate/status/{task_id} atau berikan callback_url yang didukung. Baca output dari respons tugas yang telah selesai dan simpan aset apa pun yang perlu disimpan oleh aplikasi Anda.
Bagaimana cara menghitung harga API teks ke gambar?
+
Bandingkan harga model dan unit penagihannya. Tergantung pada titik akhir, pembuatan gambar dapat diberi harga per gambar, per generasi, atau berdasarkan ukuran gambar, dengan biaya tambahan untuk opsi tertentu. Gunakan harga model saat ini dan pengaturan yang dipilih untuk memperkirakan batch daripada berasumsi semua API gambar memiliki biaya yang sama.
Apa yang harus saya lakukan jika permintaan gambar gagal atau waktu habis?
+
Periksa status tugas sebelum mengirimkan lagi: batas waktu jaringan tidak membuktikan bahwa pembuatan gagal. Periksa validasi input, pengaturan gambar, saldo akun, dan kesalahan yang dikembalikan. Untuk gambar yang sudah selesai tetapi tidak sesuai, sederhanakan perintah atau ubah pengaturan satu per satu sehingga Anda dapat mengidentifikasi apa yang meningkatkan hasilnya.
Di mana saya dapat menemukan contoh Python, JavaScript, dan permintaan?
+
Buka halaman model untuk dokumentasi API, kolom permintaan saat ini, dan contohnya. Setiap model juga memiliki sumber daya /models/{model-id}/llms.txt dengan detail integrasi khusus model. Simpan kunci API Anda dalam konfigurasi sisi server dan gunakan pengidentifikasi model yang terdokumentasi saat mengadaptasi contoh ke aplikasi Anda.
Menjelajahi semua model AI
Buka pasar model penuh untuk membandingkan gambar, video, audio, chat, 3D dan model alat.
Lihat semua modelMembangun dengan API
Buka halaman model untuk parameter, harga dan dokumentasi API.
Dokumentasi APIHalaman tugas yang terkait