Qwen Gambar 3.0: Semua yang Perlu Anda Ketahui
Pelajari apa Qwen Gambar 3.0 adalah, bagaimana itu 4.5K-Token prompt, 10px penyaluran teks, dukungan multilingual, pengeditan gambar, dan pekerjaan generasi berbasis pengetahuan.


Qwen Gambar 3.0 adalah model dasar gambar generasi ketiga dari Qwen Tim. Diumumkan pada bulan Juli 21, 2026, dirancang untuk memindahkan generasi gambar AI di luar gambar mandiri yang menarik dan menuju visual yang dapat membawa informasi yang berguna: surat kabar, grafis pendidikan, storyboard, konsep antarmuka, gambar beranot, dan desain lain yang berat konten.
Upgrade judulnya adalah 4.5K-Limit instruksi token, rendering teks pada ukuran kecil seperti 10 piksel, rendering asli melalui 12 Bahasa, dukungan untuk 20+ font dan 100+ gaya visual, dan penggunaan yang lebih kuat dari pengetahuan visual dan dunia. Model ini menerima input teks dan gambar dan dapat melakukan generasi gambar dan pengeditan gambar.
Kemampuan tersebut terdengar ambisius, tetapi beberapa detail upstream tetap tidak diungkapkan: Qwen tidak menerbitkan jumlah parameter, arsitektur rinci, resolusi asli atau maksimum, lisensi, persyaratan perangkat keras lokal, atau rencana berat yang terbuka. Secara terpisah, PoYo sekarang menyediakan produksi API akses dengan dua ID model, dapat dipilih 1K dan 2K output, dan harga per gambar yang diterbitkan.
Qwen Gambar 3.0 Dengan sekelip mata
| Fitur | Informasi yang dikonfirmasi |
|---|---|
| Nama resmi | Qwen-Image-3.0 |
| Diumumkan | Juli 21, 2026 |
| Jenis model | Model dasar pembuatan gambar dan pengeditan |
| Input | Teks dan gambar |
| Output | Gambar |
| Panjang instruksi maksimum | 4.5K token |
| Pengiriman teks kecil | Teks kecil sekitar 10px |
| Bahasa | Native rendering 12 Bahasa |
| Fonts | Lebih dari 20 |
| Gaya visual | Lebih dari 100 |
| ID model QwenCloud di atas | qwen-image-3.0-pro |
| PoYo ID model | qwen-image-3, qwen-image-3-pro |
| PoYo API status | Tersedia sekarang |
| PoYo opsi output | 1K dan 2K |
| Jumlah parameter | Tidak diungkapkan |
| Resolusi maksimum | Tidak diungkapkan |
| Berat terbuka dan lisensi | Tidak diungkapkan |
Rilis resmi menggambarkan model melalui tiga ide: Isi Kaya, Detail Yang Benar, dan Pengetahuan mendalam. Qwen mengumbarnya dengan satu tema yang lebih luas, “Real”bukan hanya fotorealisme, tetapi konten yang substansial dan cukup berguna untuk pekerjaan praktis.
Apa yang Baru di Qwen Gambar 3.0?
Sebelumnya Qwen Rilis gambar menetapkan reputasi keluarga model untuk tipografi dan pengeditan gambar yang tepat. Qwen Gambar 2.0 kemudian menggabungkan generasi dan pengeditan dalam satu model, mendukung native 2K output, dan instruksi diterima hingga 1K tokens.
Qwen Gambar 3.0 memperluas jumlah dan kompleksitas informasi yang dapat ditangani dalam satu permintaan. Batas instruksi meningkat dari 1K untuk 4.5K token, sementara contoh resmi menekankan lebih banyak pada tata letak padat, antarmuka berpasangan, teks kecil, rumus, konten multilingual, dan grafis kaya pengetahuan.
| Daerah | Qwen Gambar 2.0 | Qwen Gambar 3.0 |
|---|---|---|
| Panjang instruksi | Sampai 1K token | Sampai 4.5K token |
| Generasi dan pengeditan | Persatuan dalam satu model | Kedua didukung |
| Resolusi asli | 2K diungkapkan | Belum diungkapkan |
| Penekanan utama | Tipografi, kepatuhan semantik, fotorealisme | Isi yang kaya, detail yang baik, pengetahuan yang mendalam |
| Teks kecil yang padat | Penulisan teks yang lebih baik | Secara resmi ditunjukkan pada sekitar 10px |
| Tata letak yang kompleks | Poster, slide, komik, infografis | Surat kabar, kertas ujian, storyboard, antarmuka berlengan, grafis multi panel |
Perbandingan ini tidak harus dibaca sebagai bukti bahwa setiap Qwen Gambar 3.0 output secara otomatis lebih akurat. Ini menggambarkan kemampuan dan posisi Qwen telah mengumumkan. Tes independen, yang dapat diulang masih diperlukan untuk mengukur konsistensi di antara prompt.
Isi yang Kaya: Prompts yang Lebih Lama dan Layout Denser
Pembagian 4.5K-Token input limit adalah salah satu dari Qwen Gambar 3.0Perubahan yang paling jelas. Ini memungkinkan prompt untuk menggambarkan banyak wilayah, label, hubungan, dan aturan visual tanpa mengkompresi keseluruhan singkat menjadi beberapa kalimat.
Ini tidak berarti bahwa gambar akan berisi 4,500 tanda teks yang terjemahan sempurna. Ini berarti model dapat menerima instruksi panjang itu, termasuk deskripsi konten, tata letak, gaya, tipografi, dan hubungan spasial.
Visual multi-panel dalam satu generasi
Dalam satu contoh resmi, Qwen Gambar 3.0 menghasilkan total 3×3 jaringan pendidikan dalam satu pass. Itu kira-kira 3.7K-token prompt menggambarkan sembilan subjek terpisah, termasuk geometri, fisika, biologi, kedokteran, sastra, perbankan, dan aljabar abstrak. Panel individu berisi ilustrasi, rumus, grafik, teks Cina dan Inggris, dan hierarki visual mereka sendiri.
Contoh ini menguji lebih dari panjang prompt. Model harus menjaga konsep paralel terpisah, menempatkan mereka di wilayah yang diminta, dan mencegah isi satu panel bocor ke yang lain.
Kemampuan itu bisa berguna untuk:
- Poster pendidikan dan materi pelajaran
- Spread editorial dan halaman gaya surat kabar
- Jaringan perbandingan produk
- Film drama pendek dan storyboard iklan
- Dokumen dan lembar kerja ujian
- Menu, katalog, dan laporan visual
Gambar dan antarmuka yang terpasang
Qwen juga menunjukkan kompleksitas vertikal atau beranggotakan. Satu prompt meminta model untuk menempatkan antarmuka VS Code di sekitar Qwen Chat interface, yang berisi WeChat interface, yang pada gilirannya berisi poster kopi.
Jenis tugas gambar-dalam-gambar ini menguji penganjang semantik, skala relatif, pengetahuan antarmuka, dan kemampuan model untuk mempertahankan beberapa lapisan konten. Hal ini terutama relevan dengan konsep UI, ilustrasi perangkat lunak, iklan berbasis layar, dan grafik editorial.
Detail Otentik: Teks Kecil dan Tekstur yang Realistis
Qwen menggunakan “Authentic Details” untuk menggambarkan baik tipografi dan detail fisik. Model ini dimaksudkan untuk menghasilkan konten teks yang padat sementara juga meningkatkan isyarat visual kecil yang membuat orang, objek, dan bahan terlihat dapat dipercaya.
Teks kecil seperti 10 piksel
Qwen mengatakan Qwen Gambar 3.0 dapat menerjemahkan teks yang dapat dibaca pada sekitar 10px. Contoh resmi dari program ini adalah:
- Infografis hiu paus berat teks
- Halaman surat kabar dengan beberapa kolom
- Sebuah makalah akademik dengan geometri aljabar
- Superskrip, subskrip, huruf Yunani, braces, pecahan, dan rumus multiline
- Anotasi tulisan tangan ditambahkan ke halaman buku yang difoto
Ini berpotensi berharga untuk poster, antarmuka, slide, dokumen, dan diagram teknis. Namun, kecerdasannya dan ketepatanannya tidak sama. Sebuah baris dapat terlihat tipografi meyakinkan sementara masih mengandung kata yang salah ditulis, nomor yang salah, atau rumus yang salah. Teks dan isi fakta yang dihasilkan harus selalu diperiksa sebelum dipublikasikan.
Detail fotografi yang bagus
Contoh resmi juga berfokus pada pori-pori kulit, benang rambut individu, ekspresi mikro, kertas, kain, brushwork, dan tekstur halus lainnya. Tujuan adalah untuk mengurangi penampilan halus atau sintetis yang sering mengungkapkan potret atau gambar produk yang dihasilkan AI.
Detail halus lebih penting dari potret fotorealistik. Hal ini dapat meningkatkan:
- Bahan produk seperti kaca, logam, kulit, dan kain
- Foto makanan dan minuman
- Gambar editorial dan gaya hidup
- Karya seni sejarah dan pemulihan dokumen
- Alam dekat dan ilustrasi ilmiah
Pengeditan yang sadar detail
Qwen Gambar 3.0 tidak terbatas pada generasi teks ke gambar. Dalam QwenDalam demonstrasi pengeditan, model ini menambahkan catatan studi tulisan tangan yang realistis ke halaman buku dan memulihkan lukisan tradisional yang rusak sambil mencoba untuk mempertahankan gradien tinta asli, tekstur bulu, komposisi, dan brushwork.
Contoh-contoh ini menunjukkan bahwa model dapat menggabungkan instruksi tingkat tinggi dengan penampilan gambar yang ada. Seperti halnya editor generatif lainnya, penggunaan produksi masih harus memeriksa apakah area di luar editing yang diminta telah berubah.
Pengetahuan mendalam: Bahasa, Gaya, Antarmuka, dan Fakta
Pilar ketiga dari Qwen Gambar 3.0 “Kelahian mendalam”. Ini menggambarkan kemampuan model untuk menghasilkan tidak hanya objek yang dapat dikenali, tetapi visual yang tergantung pada bahasa, konvensi antarmuka, gaya seni, dan pengetahuan subjek.
Native rendering 12 Bahasa
Qwen menyatakan bahwa model dapat secara asli 12 bahasa. Materi peluncuran terlihat menunjukkan Cina, Inggris, Jepang, Korea, dan Spanyol, tetapi tidak memberikan daftar resmi lengkap dari semua 12.
Perbedaan ini penting. Akan terlalu dini untuk menerbitkan daftar bahasa yang dicipta atau menganggap akurasi yang sama dalam setiap bahasa yang didukung. Kampanye multilingual harus ditinjau oleh penutur yang lancar untuk ejaan, titik, istirahat baris, dan tipografi yang sesuai budaya.
Lebih dari 20 font dan 100 gaya visual
QwenCloud daftar dukungan untuk over 20 font, sementara posting peluncuran menggambarkan lebih dari 100 gaya seni. Fungsi ini dapat membantu prompt mendefinisikan sistem visual yang lebih spesifik daripada hanya meminta “poster” atau “ilustrasi” umum.
Untuk kontrol yang lebih baik, prompt harus menggambarkan tipografi menurut fungsi:
- Teks yang tepat yang harus muncul
- Sistem bahasa dan tulisan
- Judul, subjudul, badan, label, atau caption
- Serif, sans serif, tulisan tangan, tampilan, atau gaya teknis
- Berat, penyelarasan, warna, jarak, dan hierarki
Kehadiran banyak gaya tidak menjamin reproduksi yang tepat dari font komersial yang diberi nama atau gaya seniman hidup. Pemeriksaan merek dan lisensi tetap menjadi tanggung jawab pengguna.
Generasi antarmuka realistis
Qwen Gambar 3.0 dapat mensimulasikan struktur visual yang akrab seperti:
- Halaman web
- Aplikasi perangkat lunak
- Permainan
- Kamar live stream
- Antarmuka obrolan
- Layar gaya seluler
Hal ini membuatnya berguna untuk konsep visual dan storyboard. Ini tidak secara otomatis mengubah output menjadi kode UI siap produksi atau menjamin bahwa antarmuka mengikuti standar aksesibilitas dan interaksi.
Pengetahuan dunia dan pengambilan web
Contoh resmi menggunakan pengetahuan subjek untuk membangun infografis ilmiah dan angka penelitian yang dicatatkan. Dalam satu kasus, model ini menyimpan foto serangga sambil menambahkan taksonomi, label morfologi, detail yang diperbesar, dan bar skala.
Qwen juga menunjukkan grafik cuaca saat ini yang dibuat dengan pengambilan online. Ini harus dipahami sebagai model-plus-alat alur kerja: akses web memberikan informasi terbaru, dan model gambar mengubahnya menjadi visual. Tidak ada bukti bahwa model dasar selalu berisi fakta saat ini.
Setiap output yang berat pengetahuan harus diverifikasi terhadap sumber yang dapat diandalkan. Penciptaan gambar dapat menyajikan informasi yang salah dengan pola visual yang sangat meyakinkan.
Apa yang Bisa Anda Ciptakan Qwen Gambar 3.0?
Aplikasi potensial model yang paling kuat adalah tugas di mana kualitas visual dan struktur informasi perlu berko-eksistensi.
Infografis dan materi pendidikan
Prompts panjang dapat mendefinisikan beberapa bagian, diagram, rumus, callouts, dan teks penjelasan. Ini membuat Qwen Gambar 3.0 pilihan yang menjanjikan untuk poster pelajaran, garis waktu, penjelasan ilmiah, dan grafik presentasi.
Koran dan tata letak editorial
Teks kecil, kolom, caption gambar, dan tekstur kertas dapat dihasilkan bersama. Hasilnya mungkin bekerja dengan baik sebagai konsep, ilustrasi, atau draf, tetapi salinan yang tepat harus ditik dengan manual ketika keakuratan sangat penting.
Storyboard dan komik
Panjang instruksi yang diperluas dapat menggambarkan beberapa gambar, lokasi, tindakan, sudut kamera, dan caption dalam satu prompt. Konsistensi karakter di seluruh panel masih perlu dievaluasi daripada diasumsikan.
Konsep UI dan game
Pengetahuan tentang pola antarmuka umum dapat mempercepat ide awal untuk aplikasi, dashboard, layar game, dan grafik live stream. Desainer harus memperlakukan hasil sebagai referensi visual, bukan spesifikasi antarmuka yang sudah selesai.
Kreatif e-commerce dan pemasaran
Kombinasi permukaan yang rinci, tata letak terstruktur, informasi produk, dan teks multilingual dapat mendukung mockup kampanye, halaman katalog, menu, dan penjelasan produk.
Anotasi dan pemulihan dokumen
Editing gambar dapat menambahkan catatan, label, diagram, dan elemen kontekstual lainnya ke gambar yang ada. Contoh restorasi seni yang ditunjukkan juga menunjukkan aliran kerja restorasi dan rekonstruksi kreatif, meskipun materi yang signifikan secara historis tidak boleh diubah tanpa tinjauan ahli dan pengungkapan yang jelas.
Bagaimana Mengakses Qwen Gambar 3.0
Qwen link ke Qwen Chat dari pengumuman peluncuran. Halaman QwenCloudnya mencantumkan ID model upstream:
qwen-image-3.0-pro
Identifikasi itu milik QwenCloud. Pada PoYo, permintaan produksi menggunakan salah satu ID model berikut:
qwen-image-3
qwen-image-3-pro
Kedua penggunaan PoYo” endpoint generasi asinkron dan mendukung input teks-ke-gambar dan gambar-ke-gambar, 1K atau 2K output, delapan aspek rasio, PNG atau JPEG output, ekstensi prompt, negatif prompt, dan kontrol biji. Misalnya, ekstensi prompt diaktifkan dengan:
{
"parameters": {
"prompt_extend": true
}
}
Status dan batas pra-view QwenCloud tidak menggambarkan PoYo ketersediaan. Integrasi produksi harus menggunakan PoYo Qwen Gambar 3.0 Dokumen untuk skema permintaan dan batas operasional saat ini.
PoYo harga model standar di 4.8 kredit ($0.024) per 1K atau 2K output image. Qwen Gambar 3 Biaya pro 6.4 kredit ($0.032) pada 1K dan 12 kredit ($0.06) pada 2K. Setiap gambar input menambahkan 0.5 kredit ($0.0025).
Bagaimana Menulis Lebih Baik Qwen Gambar 3.0 Tanda-tanda
Jendela instruksi yang lebih panjang paling berguna ketika prompt disusun. Hanya menambahkan lebih banyak sifat tidak mungkin akan meningkatkan hasil.
Struktur praktis adalah:
- Jelaskan tujuan dan kanvas, seperti poster pendidikan vertikal atau surat kabar tiga kolom.
- Jelaskan keseluruhan hierarki visual dan grid.
- Tentukan setiap bagian dalam urutan spasial.
- Tuliskan teks yang tepat dalam tanda kutip.
- Menentukan tipografi, bahasa, dan ukuran teks relatif.
- Jelaskan gambar, bahan, pencahayaan, dan gaya.
- Hubungan dan kendala negara, termasuk apa yang tidak boleh tumpang tindih.
- Mintalah label fakta hanya ketika Anda dapat memverifikasinya setelahnya.
Untuk tata letak yang kompleks, label bagian seperti “Header”, “Left column”, “Center panel”, dan “Footer” lebih berguna daripada satu paragraf yang tidak terstruktur. Saat mengedit gambar, katakan apa yang harus diubah dan apa yang tidak harus disentuh.
Batas dan Tak Dikenal Saat Ini
Qwen Gambar 3.0 adalah baru, dan materi peluncuran menekankan contoh-contoh tertentu daripada laporan teknis lengkap atau evaluasi independen. Perlu diingat bahwa ada beberapa batasan:
- Kebijakan akses upstream QwenCloud terpisah dari PoYo, dimana dua ID model terdokumentasi tersedia sekarang.
- Qwen tidak mengungkapkan jumlah parameter atau arsitektur model rinci.
- Qwen tidak menerbitkan resolusi asli atau maksimum yang dikonfirmasi; PoYo namun eksposur yang didukung 1K dan 2K opsi output.
- PoYo harga dipublikasikan, sementara batas rata-rata latensi dan tingkat produksi harus diperiksa terhadap dokumentasi layanan saat ini.
- Ketersediaan, lisensi, dan persyaratan penyebaran lokal tidak diketahui.
- Klaim dari sekitar 10px penulisan teks tidak menjamin keakuratan ejaan yang sempurna atau fakta.
- Daftar lengkap 12 bahasa yang didukung belum diterbitkan.
- Rumus yang kompleks, label ilmiah, dan fakta yang diperoleh masih membutuhkan verifikasi manusia.
- Gambar UI-seperti mungkin terlihat meyakinkan tanpa logis atau teknis valid antarmuka.
- Gambar resmi tidak mengukur seberapa konsisten kinerja model di generasi yang berulang.
Hindari mentransfer spesifikasi dari Qwen Gambar 2.0 untuk Qwen Gambar 3.0. Secara khusus, Qwen tidak mengkonfirmasi bahwa model baru memiliki jumlah parameter, arsitektur, batas resolusi, atau profil penyebaran yang sama.
Apakah Qwen Gambar 3.0 Layak Dilihat?
Ya, terutama untuk alur kerja yang secara historis membutuhkan generator gambar terpisah, alat tata letak, dan pass tipografi manual.
Yang paling penting Qwen Gambar 3.0 upgrade bukan satu pun skor kualitas gambar. Ini adalah upaya untuk membuat satu gambar yang dihasilkan menyimpan informasi yang lebih terstruktur, teks yang dapat dibaca yang lebih kecil, detail visual yang lebih kaya, dan pengetahuan subjek yang lebih luas pada saat yang sama.
Itu membuat model ini sangat relevan untuk pendidik, penerbit, desainer, tim e-commerce, dan pembuat konten. PoYo menyediakan praktik di rumah API jalur hari ini, sementara kesimpulan lokal tetap tidak jelas karena Qwen tidak merilis berat, lisensi, atau persyaratan perangkat keras.
Kesimpulan yang tepat adalah bahwa Qwen Gambar 3.0 adalah update yang signifikan yang berfokus pada produktivitas dengan tipografi dan tata letak yang tidak biasa ambisius. Biaya dan dukungan PoYo ukuran output sekarang didokumentasikan, sementara konsistensi, kecepatan, resolusi asli maksimum, dan pilihan penyebaran lokal masih membutuhkan evaluasi terpisah.
Pertanyaan yang Sering Ditanyakan
Apa itu Qwen Gambar 3.0?
Qwen Gambar 3.0 adalah QwenModel dasar generasi ketiga untuk pembuatan gambar dan pengeditan gambar. Ini berfokus pada tata letak yang padat informasi, detail visual halus, teks multilingual, simulasi antarmuka, dan konten visual yang kaya pengetahuan.
Kapan itu Qwen Gambar 3.0 dibebaskan?
Pembagian Qwen tim yang diumumkan Qwen Gambar 3.0 pada bulan Juli 21, 2026.
Berapa lama bisa Qwen Gambar 3.0 prompt?
Qwen mengatakan model menerima instruksi hingga 4.5K token. Ini adalah batas prompt, bukan jaminan bahwa 4,500 Token teks dapat diterjemahkan dengan akurat dalam satu gambar.
Bisa Qwen Gambar 3.0 menghasilkan teks kecil?
Qwen klaim model dapat menghasilkan teks yang dapat dibaca pada ukuran kecil sekitar 10 piksel. Ejaan, rumus, angka, dan pernyataan fakta yang tepat masih harus diperiksa secara manual.
Bahasa mana yang Qwen Gambar 3.0 dukungan?
Qwen menyatakan bahwa mendukung penerjemahan asli di seluruh 12 bahasa. Materi peluncuran menunjukkan beberapa bahasa, termasuk Cina, Inggris, Jepang, Korea, dan Spanyol, tetapi tidak menerbitkan lengkap 12- Daftar bahasa.
Bisa Qwen Gambar 3.0 mengedit gambar?
Ya. Contoh resmi menunjukkan model menambahkan catatan tertulis tangan, menambah foto dengan informasi teknis, dan memulihkan bagian yang hilang atau rusak dari karya seni tradisional.
Apakah Qwen Gambar 3.0 sumber terbuka?
Qwen belum mengumumkan beban terbuka atau lisensi untuk Qwen Gambar 3.0. PoYo menyediakan hosted API akses, tetapi itu tidak berarti bahwa berat lokal atau lisensi penyebaran lokal tersedia.
Apa itu Qwen Gambar 3.0 API Nama model?
PoYo penggunaan qwen-image-3 dan qwen-image-3-pro. Daftar halaman QwenCloud yang terpisah qwen-image-3.0-protidak bertukar arus ke atas dan PoYo identifikasi di API requests.
Apa resolusi Qwen Gambar 3.0 dukungan?
PoYo mendukung selektif 1K dan 2K output. Qwen belum mempublikasikan resolusi asli atau maksimum arsitektur yang dikonfirmasi, sehingga PoYo pilihan output tidak harus ditafsirkan sebagai klaim tentang resolusi pelatihan asli model.
Gunakan Qwen Gambar 3.0 halaman model untuk menghasilkan gambar sekarang, atau membaca PoYo Dokumentasi API sebelum terintegrasi.

