
AI API untuk pengembang
API Gambar ke Gambar
Integrasikan pengeditan gambar AI dengan API Gambar ke Gambar PoYo. Bandingkan model gambar referensi, kontrol pengeditan, kualitas keluaran, dan harga untuk foto produk, potret, dan variasi visual.
Model yang cocok
24 model

$0.04 /generasi
nano-banana-pro
Google's advanced Gemini 3 Pro image model featuring 4K resolution, enhanced reasoning, real-time data integration, and multi-image composition capabilities.

$0.01 /generasi
gpt-image-2
OpenAI's premium image generation family for text-to-image creation and single-image editing with simple prompt-driven controls.

$0.024 /gambar
qwen-image-3
Alibaba's third-generation image model for long prompts, information-dense layouts, fine text rendering, multilingual visuals, and knowledge-rich image generation.

$0.075 /gambar
seedream-5.0-pro
ByteDance's flagship image model for precise prompt following, dense layouts, multilingual text rendering, and region-precise editing.

$0.007 /generasi
gpt-image-2.5-flare
OpenAI image generation and editing with high-fidelity reference images, precise inpainting, multi-turn consistency, and transparent backgrounds. Explore Flare and Sunburst and compare GPT Image 2.5 with GPT Image 2 on PoYo.

$0.04 /gambar
grok-imagine-image-2.0
xAI image generation and editing with up to three input images, five supported aspect ratios, 1K or 2K resolution, selectable quality, and up to four outputs.

$0.03 /generasi
qwen-image-2.1
Alibaba's 7B open-weight unified text-to-image and editing model with native RGBA transparency, up to 10 reference images, and 2K resolution.

$0.02 /gambar
nano-banana-2.1
Generate and edit 1K, 2K and 4K images with Google's Nano Banana 2.1. Combine up to 10 reference images for product visuals, posters and consistent creative assets. From 4 credits ($0.02) per image.

$0.02 /gambar
seedream-5.0-flash
ByteDance's fast, cost-efficient image model for 1K/1.5K/2K generation, multi-reference editing, and multilingual visual content. 4 credits per image.

$0.03 /generasi
flux-2-pro
Black Forest Labs' production-grade model combining 4MP image generation and editing with multi-reference support, precise typography, and hex color control.

$0.01 /generasi
gpt-image-1.5
OpenAI's latest image model with 4x speed, precision editing, and superior text rendering.

$0.025 /generasi
nano-banana
Google's leaderboard-topping image model (Gemini 2.5 Flash) excelling in natural language editing, character consistency, and multi-image blending.

$0.025 /generasi
seedream-4
ByteDance's multimodal image model for native 1K to 4K generation, reference-guided editing, and batch outputs up to 15 images.

$0.04 /generasi
flux-kontext-pro
Black Forest Labs' in-context image generation and editing family for scene-preserving edits, text replacement, and prompt-driven visual changes.

$0.02 /generasi
gpt-4o-image
OpenAI's native multimodal image generator with exceptional text rendering, precise prompt following, and conversational editing capabilities.

$0.025 /generasi
seedream-4.5
ByteDance's unified 4K image generation and editing model with professional-grade text rendering and commercial photography quality.

$0.025 /generasi
nano-banana-2-new
Google's next-gen image model powered by Gemini 3.1 Flash with native 2K/4K resolution, chain-of-thought reasoning, precise multi-language text rendering, and up to 14 reference images.

$0.025 /generasi
seedream-5.0-lite
ByteDance's efficient multimodal image model with native 2K/3K resolution, deep thinking, bilingual text rendering, and smart editing.

$0.021 /generasi
wan-2.7-image
Alibaba's unified Wan 2.7 image family for text-to-image generation and reference-based image editing with standard and pro quality tiers.

$0.025 /generasi
nano-banana-2-lite
Google's fastest and most cost-efficient Gemini Image model, built for rapid ideation, high-throughput image generation, low-latency creative workflows, and scaled production pipelines.

$0.018 /gambar
kling-o3-image
Kling's O3 image family supports prompt-only generation, multi-reference editing, single outputs, and connected series generation with 1K to 4K resolution tiers.

$0.018 /gambar
kling-o1-image-edit
Kling O1 Image Edit focuses on reference-based image transformation with optional elements guidance, flexible aspect ratios, and 1K or 2K output tiers.

$0.02 /megapiksel
flux-dev
Black Forest Labs image model for text-to-image generation and single-image editing with output-size based pricing.

$0.04 /gambar
grok-imagine-image-quality
xAI's higher-fidelity Grok Imagine image model for polished text-to-image generation and reference-based image editing.
Gambar ke gambar Model API - Harga dan Model yang Cocok
Bandingkan penyedia, masukan yang didukung, format keluaran dan harga sebelum memilih model.
Cocok dengan tugas
Model muncul di sini hanya jika katalog metadata mereka termasuk Image to Image.
Perbandingan penyedia
Ulasan keluarga model di seluruh penyedia tanpa meninggalkan direktori tugas.
API-jalan siap
Setiap kartu model menghubungkan ke PoYo harga, contoh, kontrol taman bermain dan API details.
| Model | Penyedia | Jenis tugas | Harga |
|---|---|---|---|
| Nano Banana Pro nano-banana-pro | Text to Image, Image to Image | $0.04/generasi | |
| GPT Image 2 gpt-image-2 | OpenAI | Text to Image, Image to Image | $0.01/generasi |
| Qwen Image 3.0 qwen-image-3 | Alibaba | Text to Image, Image to Image, Uncensored | $0.024/gambar |
| Seedream 5.0 Pro seedream-5.0-pro | Seedream | Text to Image, Image to Image, Uncensored | $0.075/gambar |
| GPT Image 2.5 gpt-image-2.5-flare | OpenAI | Text to Image, Image to Image | $0.007/generasi |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | xAI | Text to Image, Image to Image | $0.04/gambar |
| Qwen Image 2.1 qwen-image-2.1 | Alibaba | Text to Image, Image to Image | $0.03/generasi |
| Nano Banana 2.1 nano-banana-2.1 | Text to Image, Image to Image | $0.02/gambar | |
| Seedream 5.0 Flash seedream-5.0-flash | Seedream | Text to Image, Image to Image | $0.02/gambar |
| FLUX.2 flux-2-pro | Black Forest Labs | Text to Image, Image to Image | $0.03/generasi |
| GPT Image 1.5 gpt-image-1.5 | OpenAI | Text to Image, Image to Image | $0.01/generasi |
| Nano Banana nano-banana | Text to Image, Image to Image | $0.025/generasi | |
| Seedream 4 seedream-4 | Seedream | Text to Image, Image to Image | $0.025/generasi |
| Flux Kontext flux-kontext-pro | Black Forest Labs | Text to Image, Image to Image | $0.04/generasi |
| GPT-4o Image gpt-4o-image | OpenAI | Text to Image, Image to Image | $0.02/generasi |
| Seedream 4.5 seedream-4.5 | Seedream | Text to Image, Image to Image, Uncensored | $0.025/generasi |
| Nano Banana 2 nano-banana-2-new | Text to Image, Image to Image | $0.025/generasi | |
| Seedream 5.0 Lite seedream-5.0-lite | Seedream | Text to Image, Image to Image, Uncensored | $0.025/generasi |
| Wan 2.7 Image wan-2.7-image | Alibaba | Text to Image, Image to Image | $0.021/generasi |
| Nano Banana 2 Lite nano-banana-2-lite | Text to Image, Image to Image | $0.025/generasi | |
| Kling O3 Image kling-o3-image | Kling | Text to Image, Image to Image | $0.018/gambar |
| Kling O1 Image kling-o1-image-edit | Kling | Image to Image | $0.018/gambar |
| Flux Dev flux-dev | Black Forest Labs | Text to Image, Image to Image | $0.02/megapiksel |
| Grok Imagine Image Quality grok-imagine-image-quality | xAI | Text to Image, Image to Image | $0.04/gambar |
Pertanyaan yang sering diajukan
Apa itu API Gambar ke Gambar?
+
API gambar ke gambar menghasilkan gambar yang diedit atau variasi dari gambar sumber dan instruksi. Tidak seperti pembuatan teks saja, gambar memberikan informasi visual tentang subjek, tata letak, atau gaya. Model yang dipilih menentukan seberapa dekat model tersebut mengikuti referensi tersebut dan mode pengeditan apa yang tersedia.
Bagaimana cara mengirim gambar ke API pengeditan gambar?
+
Gunakan kolom masukan gambar yang didokumentasikan untuk titik akhir yang dipilih. Beberapa menerima URL gambar yang dapat diakses publik, sementara yang lain mungkin mendukung pengkodean yang berbeda. Verifikasi format file, dimensi, ukuran dan aksesibilitas URL sebelum mengirimkan; URL sesi browser pribadi tidak akan secara otomatis dapat diakses oleh layanan pembangkitan.
Bagaimana cara mempertahankan produk atau orang saat mengedit?
+
Gunakan gambar sumber yang jelas dan detail serta nyatakan properti mana yang harus tetap sama, seperti tampilan, kemasan, penempatan logo, atau geometri produk. Buatlah satu perubahan yang berarti pada satu waktu. Periksa hasilnya dengan cermat, karena instruksi untuk mempertahankan subjek tidak menjamin detail yang identik dengan piksel.
Apakah setiap gambar ke gambar API mendukung masker atau inpainting?
+
Tidak. Pembuatan referensi, pengeditan berbasis instruksi, pengecatan dan pengecatan bertopeng adalah kemampuan yang berbeda. Gunakan dokumentasi model untuk mengonfirmasi mode pengeditan dan bidang yang wajib diisi. Jika tidak ada input mask yang didokumentasikan, jangan berasumsi bahwa menambahkan kolom mask akan membatasi pengeditan pada satu wilayah.
Bisakah saya menggunakan beberapa gambar referensi?
+
Beberapa model mendukung banyak gambar, dengan batasan khusus model dan perilaku referensi. Jelaskan peran setiap gambar, seperti identitas produk, komposisi atau gaya, jika didukung. Hindari referensi yang bertentangan dan konfirmasikan jumlah gambar yang diterima sebelum membuat alur kerja multi-gambar.
Apa yang membuat perintah pengeditan gambar bagus?
+
Jelaskan perubahan yang diinginkan dan detail yang perlu dipertahankan dalam instruksi yang terpisah dan konkrit. Misalnya, meminta latar belakang baru dengan tetap menjaga bentuk, warna, dan label produk tidak berubah. Hindari meminta pengeditan yang tidak terkait sekaligus; revisi bertahap membuat kegagalan lebih mudah didiagnosis.
Bisakah saya meningkatkan resolusi gambar dengan API gambar ke gambar?
+
Beberapa model gambar menawarkan dimensi keluaran yang lebih tinggi, namun menghasilkan variasi yang lebih besar juga dapat mengubah konten. Periksa apakah kebutuhan Anda adalah pengeditan, render baru, atau peningkatan yang sesuai. Tinjau ukuran output dan pelestarian detail secara terpisah, dan gunakan alat penyempurnaan khusus jika lebih sesuai dengan aset.
Apa perbedaan gambar ke gambar dari teks ke gambar?
+
Gambar ke Gambar dimulai dengan materi sumber visual dan instruksi tentang cara mengubahnya. Text to Image diawali dengan deskripsi tertulis. Gunakan API pengeditan gambar untuk revisi produk, perubahan potret, dan variasi berdasarkan referensi; gunakan pembuatan hanya teks saat Anda menjelajahi visual baru dari awal.
Bagaimana cara mengambil gambar yang telah diedit melalui PoYo?
+
Kirimkan model yang dipilih dan masukan gambarnya melalui titik akhir pembuatan yang terdokumentasi. Simpan task_id dan ambil hasil yang telah selesai melalui polling status atau panggilan balik webhook yang didukung. Simpan hubungan sumber-ke-output di aplikasi Anda sehingga pengguna dapat membandingkan versi dan mengidentifikasi permintaan mana yang membuat setiap pengeditan.
Apa yang memengaruhi harga API gambar ke gambar?
+
Model, ukuran keluaran, jumlah gambar, dan fitur pengeditan opsional dapat memengaruhi biaya. Beberapa titik akhir juga menentukan harga input referensi atau pemrosesan berdasarkan ukuran secara terpisah. Bandingkan unit penagihan dan tingkatan yang relevan pada halaman model, lalu perkirakan jumlah upaya pengeditan yang diperlukan untuk mendapatkan hasil yang dapat diterima.
Mengapa gambar yang diedit mengubah detail yang ingin saya simpan?
+
Model ini mungkin menafsirkan permintaan tersebut sebagai regenerasi yang lebih luas, terutama dengan instruksi yang bertentangan atau referensi yang tidak jelas. Gunakan gambar sumber yang lebih bersih, persempit hasil edit, dan beri nama secara eksplisit pada detail yang ingin dipertahankan. Uji mode pengeditan khusus atau model pengikut referensi lainnya ketika masalah yang sama masih terjadi.
Di mana saya dapat menemukan contoh permintaan API pengeditan gambar?
+
Setiap halaman model PoYo tertaut ke dokumentasi API dengan bidang gambarnya saat ini, pengaturan yang didukung, dan contoh. Sumber daya llms.txt khusus model juga berguna untuk asisten pengkodean dan pekerjaan integrasi. Salin struktur untuk titik akhir tersebut daripada berasumsi semua API pengeditan gambar menerima parameter yang sama.
Menjelajahi semua model AI
Buka pasar model penuh untuk membandingkan gambar, video, audio, chat, 3D dan model alat.
Lihat semua modelMembangun dengan API
Buka halaman model untuk parameter, harga dan dokumentasi API.
Dokumentasi APIHalaman tugas yang terkait