Qwen Hình ảnh 3.0: Mọi thứ bạn cần biết
Tìm hiểu Qwen Image 3.0 là gì, cách thức yêu cầu mã 4.5K của nó, trình bày văn bản 10px, hỗ trợ đa ngôn ngữ, chỉnh sửa hình ảnh và phát triển dựa trên kiến thức làm việc như thế nào.


Qwen Image 3.0 là mô hình nền hình ảnh lần tạo thứ ba từ nhóm Qwen. Được công bố vào tháng 7 21, 2026, nó được thiết kế để di chuyển việc tạo hình ảnh AI vượt ra khỏi hình ảnh độc lập hấp dẫn và hướng tới hình ảnh có thể mang thông tin hữu ích: báo, đồ họa giáo dục, storyboard, khái niệm giao diện, hình ảnh ghi chú và nội dung nặng khác thiết kế.
Các bản nâng cấp tiêu đề của nó là một giới hạn chỉ dẫn mã 4.5K, trình chiếu văn bản ở kích thước nhỏ như 10 pixel, bản địa rendering qua Ngôn ngữ 12, hỗ trợ cho Phông chữ 20+ và 100+ phong cách hình ảnh, và sử dụng mạnh mẽ hơn kiến thức thị giác và thế giới. Mô hình chấp nhận nhập văn bản và hình ảnh và có thể thực hiện cả việc tạo hình ảnh và chỉnh sửa hình ảnh.
Những khả năng đó nghe có vẻ tham vọng, nhưng một số chi tiết phía trước vẫn chưa được tiết lộ: Qwen đã không công bố số lượng tham số, kiến trúc chi tiết, độ phân giải bản địa hoặc tối đa, giấy phép, yêu cầu phần cứng địa phương hoặc kế hoạch trọng lượng mở. Ngoài ra, PoYo hiện cung cấp quyền truy cập đầu ra API với hai ID mô hình, đầu ra có thể chọn 1K và 2K, và công bố giá mỗi hình ảnh.
Qwen Hình ảnh 3.0 tại một cái nhìn
| Tính năng | Thông tin được xác nhận |
|---|---|
| Tên chính thức | Qwen-Image-3.0 |
| Được thông báo | Tháng 7 21, 2026 |
| Mô hình | Mô hình hình ảnh và chỉnh sửa nền tảng |
| Đầu vào | Văn bản và hình ảnh |
| Đầu ra | Hình ảnh |
| Độ dài tối đa của hướng dẫn | Các mã thông báo 4.5K |
| Định nghĩa văn bản nhỏ | Văn bản nhỏ như khoảng 10px |
| Ngôn ngữ | Bản dịch bản địa trên các ngôn ngữ 12 |
| Các font | Hơn 20 |
| Phong cách hình ảnh | Hơn 100 |
| ID mô hình QwenCloud phía trên | qwen-image-3.0-pro |
| Các chỉ số mô hình PoYo | qwen-image-3, qwen-image-3-pro |
| Tình trạng PoYo API | Có sẵn ngay bây giờ |
| Các tùy chọn đầu ra PoYo | 1K và 2K |
| Số lượng tham số | Không được tiết lộ |
| Độ phân giải tối đa | Không được tiết lộ |
| Đánh nặng và giấy phép mở | Không được tiết lộ |
Bản phát hành chính thức mô tả mô hình thông qua ba ý tưởng: Nội dung phong phú, chi tiết chân chính và kiến thức sâu sắcQwen tóm tắt chúng với một chủ đề rộng hơn, “Thực sự”không chỉ là sự thực tế, mà còn nội dung có tính chất và hữu ích đủ cho công việc thực tế.
Điều gì mới trong Qwen Image 3.0?
Các bản phát hành hình ảnh trước đây của Qwen đã thiết lập danh tiếng của gia đình mô hình về kiểu chữ và chỉnh sửa hình ảnh chính xác. Qwen Image 2.0 sau đó kết hợp tạo và chỉnh sửa trong một mô hình, hỗ trợ đầu ra 2K bản địa, và chấp nhận hướng dẫn lên đến mã 1K.
Qwen Image 3.0 mở rộng lượng và độ phức tạp của thông tin có thể được xử lý trong một yêu cầu. Giới hạn hướng dẫn tăng từ 1K đến mã thông báo 4.5K, trong khi các ví dụ chính thức nhấn mạnh nhiều hơn nhiều vào bố cục dày đặc, giao diện tổ hợp, văn bản nhỏ, công thức, nội dung đa ngôn ngữ và đồ họa giàu kiến thức.
| Khu vực | Qwen Hình ảnh 2.0 | Qwen Hình ảnh 3.0 |
|---|---|---|
| Độ dài của hướng dẫn | Tối đến mã thông báo 1K | Tối đến mã thông báo 4.5K |
| Tạo và chỉnh sửa | Thống nhất trong một mô hình | Cả hai đều được hỗ trợ |
| độ phân giải bản địa | 2K được tiết lộ | Không được tiết lộ |
| Điểm nhấn chính | Tiêu tả, sự tuân thủ ngữ nghĩa, quang học | Nội dung phong phú, chi tiết tinh tế, kiến thức sâu sắc |
| Văn bản nhỏ dày đặc | Việc dịch văn bản được cải thiện | Được chứng minh chính thức tại khoảng 10px |
| Các bố cục phức tạp | Plaket, slide, truyện tranh, infographics | Báo chí, bài thi, storyboard, giao diện tổ hợp, đồ họa đa bảng |
So sánh này không nên được xem là bằng chứng cho thấy mỗi Qwen Image 3.0 tự động chính xác hơn. Nó mô tả khả năng và vị trí Qwen đã công bố. Các thử nghiệm độc lập, lặp lại vẫn cần thiết để đo lường sự nhất quán giữa các yêu cầu.
Nội dung phong phú: Các prompt dài hơn và bố cục dày đặc hơn
Giới hạn nhập mã 4.5K là một trong những thay đổi rõ ràng nhất của Qwen Image 3.0. Nó cho phép một prompt mô tả nhiều vùng, nhãn, mối quan hệ và quy tắc trực quan mà không phải nén toàn bộ đoạn ngắn thành một vài câu.
Điều này không có nghĩa là hình ảnh sẽ chứa các mã thông báo 4,500 của văn bản được trình bày hoàn hảo. Nó có nghĩa là mô hình có thể chấp nhận một hướng dẫn dài đó, bao gồm mô tả về nội dung, bố cục, phong cách, kiểu chữ và mối quan hệ không gian.
Hình ảnh đa bảng trong một lần tạo
Trong một ví dụ chính thức, Qwen Image 3.0 tạo ra một lưới giáo dục 3×3 hoàn chỉnh trong một lần vượt qua. Khởi động mã 3.7K của nó mô tả chín chủ đề riêng biệt, bao gồm hình học, vật lý, sinh học, y học, văn học, ngân hàng và đại số trừu tượng. Các bảng cá nhân chứa các minh họa, công thức, biểu đồ, văn bản tiếng Trung và tiếng Anh và hệ thống phân cấp hình ảnh riêng của họ.
Ví dụ này kiểm tra nhiều hơn là chiều dài nhanh. Mô hình phải giữ các khái niệm song song tách biệt, đặt chúng vào các vùng yêu cầu và ngăn chặn nội dung của một bảng bị rò rỉ vào một bảng khác.
Khả năng đó có thể hữu ích cho:
- Các tấm biển giáo dục và tài liệu học tập
- Các tờ báo và các trang theo kiểu báo
- Các lưới so sánh sản phẩm
- Các bộ phim ngắn và các câu chuyện quảng cáo
- Các giấy kiểm tra và bảng làm việc
- Menu, danh mục và báo cáo trực quan
Hình ảnh và giao diện đinh
Qwen cũng cho thấy độ phức tạp dọc hoặc tổ. Một prompt hỏi yêu cầu mô hình đặt giao diện VS Code xung quanh giao diện Chat Qwen, chứa giao diện WeChat, mà lại chứa một tấm poster cà phê.
Loại nhiệm vụ hình ảnh trong hình ảnh này kiểm tra tổ ngữ, quy mô tương đối, kiến thức giao diện và khả năng của mô hình để bảo tồn nhiều lớp nội dung. Nó đặc biệt có liên quan đến các khái niệm UI, minh họa phần mềm, quảng cáo dựa trên màn hình và đồ họa biên tập.
Các chi tiết chính xác: văn bản nhỏ và kết cấu thực tế
Qwen sử dụng “Dữ liệu chính xác” để mô tả cả kiểu chữ và chi tiết vật lý. Mô hình này được thiết kế để tạo ra nội dung văn bản dày đặc trong khi cũng cải thiện các tín hiệu thị giác nhỏ làm cho mọi người, vật thể và vật liệu trông đáng tin cậy.
Văn bản nhỏ như 10 pixel
Qwen nói Qwen Hình ảnh 3.0 có thể render văn bản dễ đọc ở khoảng 10px. Ví dụ chính thức của nó bao gồm:
- Một hình ảnh cá mập cá voi nặng văn bản
- Một trang báo với nhiều cột
- Một bài học học với hình học đại số
- Các chữ cái, chữ cái, chữ cái Hy Lạp, các chữ cái, các phần và các công thức đa đường
- Những chú thích bằng chữ tay được thêm vào trang sách chụp ảnh
Điều này có thể có giá trị cho các tấm biển, giao diện, slide, tài liệu và sơ đồ kỹ thuật. Tuy nhiên, khả năng đọc và chính xác không phải là cùng một điều. Một dòng có thể trông thuyết phục về mặt kiểu chữ trong khi vẫn chứa một từ không đúng chữ, số không chính xác hoặc công thức sai. Các văn bản và nội dung thực tế được tạo nên luôn luôn được kiểm tra trước khi xuất bản.
Chi tiết nhiếp ảnh đẹp
Các ví dụ chính thức cũng tập trung vào lỗ chân lông da, các sợi tóc cá nhân, biểu hiện nhỏ, giấy, vải, bàn chải và các kết cấu tinh tế khác. Mục tiêu là giảm sự xuất hiện mịn hoặc tổng hợp thường tiết lộ một bức chân dung hoặc hình ảnh sản phẩm được tạo ra bởi AI.
Chi tiết tinh tế vượt ra ngoài những bức chân dung chân thực.
- Các vật liệu sản phẩm như thủy tinh, kim loại, da và vải
- Nhiếp ảnh thực phẩm và đồ uống
- Hình ảnh biên tập và lối sống
- Các tác phẩm nghệ thuật lịch sử và khôi phục tài liệu
- Bản chất gần gũi và minh họa khoa học
Thiết lập chi tiết
Qwen Image 3.0 không giới hạn trong việc tạo văn bản sang hình ảnh. Trong các minh họa chỉnh sửa của Qwen, mô hình này thêm các ghi chú viết tay thực tế vào một trang sách và khôi phục các bức tranh truyền thống bị hư hỏng trong khi cố gắng bảo tồn gradient mực ban đầu của chúng, kết cấu, thành phần và bàn chải.
Những ví dụ này cho thấy mô hình có thể kết hợp một hướng dẫn cấp cao với sự xuất hiện của một hình ảnh hiện có. Như với bất kỳ trình chỉnh sửa tạo nào, việc sử dụng sản xuất vẫn nên kiểm tra xem các khu vực bên ngoài chỉnh sửa yêu cầu đã thay đổi hay không.
Sự hiểu biết sâu sắc: Ngôn ngữ, phong cách, giao diện và sự thật
Cột thứ ba của Qwen Image 3.0 là “Thiết sâu”. Nó mô tả khả năng của mô hình để tạo ra không chỉ các đối tượng dễ nhận ra, mà còn hình ảnh phụ thuộc vào ngôn ngữ, các quy ước giao diện, phong cách nghệ thuật và kiến thức đối tượng.
Bản dịch bản địa trên các ngôn ngữ 12
Qwen cho biết mô hình có thể render bản địa các ngôn ngữ 12. Các tài liệu phóng có thể hiển thị Trung Quốc, Anh, Nhật Bản, Hàn Quốc và Tây Ban Nha, nhưng không cung cấp danh sách chính thức đầy đủ của tất cả 12.
Sự khác biệt này quan trọng. Sẽ là quá sớm để công bố một danh sách ngôn ngữ được phát minh ra hoặc giả định chính xác bằng nhau trong mỗi ngôn ngữ được hỗ trợ. Các chiến dịch đa ngôn ngữ nên được các người nói bằng tiếng nói xem xét về chính tả, dấu chấm, khe khe hàng và kiểu chữ phù hợp với văn hóa.
Hơn các phông chữ 20 và phong cách hình ảnh 100
QwenCloud liệt kê hỗ trợ cho hơn 20 phông chữ, trong khi bài đăng ra mắt mô tả nhiều phong cách nghệ thuật hơn 100. Những khả năng này có thể giúp một prompt xác định một hệ thống hình ảnh cụ thể hơn thay vì chỉ yêu cầu một “phông chữ” chung hoặc “hình minh họa”.
Để kiểm soát tốt hơn, một dấu hiệu cần mô tả typography theo chức năng:
- Các văn bản chính xác phải xuất hiện
- Hệ thống ngôn ngữ và văn bản
- Tiêu đề, phụ đề, thân hình, nhãn hoặc tiêu đề
- Serif, sans serif, chữ viết tay, màn hình hoặc phong cách kỹ thuật
- trọng lượng, sự sắp xếp, màu sắc, khoảng cách và thứ tự
Sự hiện diện của nhiều phong cách không đảm bảo tái tạo chính xác của một phông chữ thương mại được đặt tên hoặc phong cách của một nghệ sĩ sống. Việc kiểm tra thương hiệu và cấp phép vẫn là trách nhiệm của người dùng.
Tạo ra giao diện thực tế
Qwen Hình ảnh 3.0 có thể mô phỏng các cấu trúc hình ảnh quen thuộc như:
- Trang web
- Các ứng dụng phần mềm
- Trò chơi
- Phòng trực tiếp
- Các giao diện trò chuyện
- Màn hình kiểu di động
Điều này làm cho nó hữu ích cho các khái niệm trực quan và storyboard. Nó không tự động biến output thành mã UI sẵn sàng đầu ra hoặc đảm bảo rằng giao diện tuân thủ các tiêu chuẩn truy cập và tương tác.
Kiến thức thế giới và tìm kiếm web
Các ví dụ chính thức sử dụng kiến thức chủ đề để xây dựng các thông tin khoa học và số liệu nghiên cứu ghi chú. Trong một trường hợp, mô hình này bảo tồn một bức ảnh côn trùng trong khi thêm phân loại, nhãn hình học, chi tiết mở rộng và thanh quy mô.
Qwen cũng cho thấy một biểu đồ thời tiết hiện tại được tạo ra bằng cách truy cập trực tuyến. Điều đó nên được hiểu như một dòng công việc mô hình cộng với công cụ: truy cập web cung cấp thông tin gần đây, và mô hình hình ảnh biến nó thành hình ảnh. Không có bằng chứng cho thấy mô hình cơ bản luôn chứa các sự kiện hiện tại.
Bất kỳ đầu ra có nhiều kiến thức nào cũng nên được xác minh với một nguồn đáng tin cậy. Tạo hình ảnh có thể trình bày thông tin sai với chất đánh bóng trực quan thuyết phục cao.
Bạn có thể tạo ra gì với Qwen Image 3.0?
Các ứng dụng tiềm năng mạnh nhất của mô hình là các nhiệm vụ mà chất lượng hình ảnh và cấu trúc thông tin cần tồn tại cùng nhau.
Thông tin và tài liệu giáo dục
Các prompt dài có thể xác định nhiều phần, sơ đồ, công thức, lời kêu và văn bản giải thích. Điều này làm cho Qwen Image 3.0 là một lựa chọn hứa hẹn cho các bản đăng bài học, thời gian, giải thích khoa học và đồ họa trình bày.
Các tờ báo và bố cục biên tập
Các văn bản nhỏ, cột, tiêu đề hình ảnh và kết cấu giấy có thể được tạo ra cùng nhau. Kết quả có thể hoạt động tốt như một khái niệm, minh họa hoặc bản thảo, nhưng bản sao chính xác nên được đánh máy bằng tay khi độ chính xác là quan trọng.
Các tấm phim và truyện tranh
Độ dài hướng dẫn mở rộng có thể mô tả một số bức ảnh, vị trí, hành động, góc ảnh và tiêu đề trong một prompt. Sự phù hợp của các tính cách trên các bảng vẫn cần được đánh giá thay vì giả định.
Ý tưởng UI và trò chơi
Kiến thức về các mô hình giao diện phổ biến có thể đẩy nhanh ý tưởng sớm cho các ứng dụng, bảng điều khiển, màn hình trò chơi và đồ họa trực tiếp. Các nhà thiết kế nên xem kết quả như một tham chiếu trực quan, chứ không phải là một đặc điểm giao diện hoàn chỉnh.
Thương mại điện tử và tiếp thị sáng tạo
Sự kết hợp của các bề mặt chi tiết, bố cục có cấu trúc, thông tin sản phẩm và văn bản đa ngôn ngữ có thể hỗ trợ các mô hình chiến dịch, trang danh mục, menu và trình giải thích sản phẩm.
Các tài liệu ghi chú và khôi phục
Việc chỉnh sửa hình ảnh có thể thêm ghi chú, nhãn, sơ đồ và các yếu tố ngữ cảnh khác vào hình ảnh hiện có. Các ví dụ phục hồi nghệ thuật được chứng minh cũng chỉ ra các quy trình công việc phục hồi và tái thiết sáng tạo, mặc dù tài liệu có ý nghĩa lịch sử không nên được thay đổi mà không có đánh giá chuyên môn và tiết lộ rõ ràng.
Cách truy cập Qwen Hình ảnh 3.0
Qwen liên kết đến Qwen Chat từ thông báo ra mắt của nó. Trang QwenCloud của nó liệt kê ID mô hình dòng lên:
qwen-image-3.0-pro
Chỉ số đó thuộc về QwenCloud. Trên PoYo, yêu cầu sản xuất sử dụng một trong các thẻ định dạng mô hình sau:
qwen-image-3
qwen-image-3-pro
Cả hai sử dụng PoYo“đối đầu điểm tạo không đồng bộ và hỗ trợ đầu vào văn bản-đối với hình ảnh và hình ảnh-đằng hình ảnh, 1K hoặc 2K đầu ra, tám tỷ lệ khía cạnh, PNG hoặc JPEG đầu ra, mở rộng nhanh, lời mời tiêu cực và điều khiển hạt giống. Ví dụ, mở rộng nhanh được bật với:
{
"parameters": {
"prompt_extend": true
}
}
Tình trạng xem trước và giới hạn của QwenCloud không mô tả khả năng có sẵn của PoYo. PoYo Qwen Hình ảnh 3.0 tài liệu cho các quy trình yêu cầu hiện tại và giới hạn hoạt động.
PoYo giá mô hình tiêu chuẩn tại 4.8 tín dụng ($0.024) cho mỗi hình ảnh đầu ra 1K hoặc 2K. Qwen Image 3 Pro chi phí 6.4 tín dụng ($0.032) tại 1K và 12 tín dụng ($0.06) tại 2K Mỗi hình ảnh nhập thêm tín dụng 0.5 ($0.0025).
Làm thế nào để viết tốt hơn Qwen Hình ảnh 3.0 Lưu ý
Chiếc cửa sổ hướng dẫn dài hơn là hữu ích nhất khi các yêu cầu được tổ chức. Chỉ cần thêm thêm nhiều đặc điểm không có khả năng cải thiện sản lượng.
Một cấu trúc thực tế là:
- Định nghĩa mục đích và tấm tranh, chẳng hạn như một tấm áp phích giáo dục thẳng đứng hoặc một tờ báo ba cột.
- Mô tả hệ thống phân cấp và lưới hình ảnh tổng thể.
- Định nghĩa từng phần theo thứ tự không gian.
- Đặt văn bản hiển thị chính xác trong dấu trích dẫn.
- Định nghĩa kiểu chữ, ngôn ngữ và kích thước văn bản tương đối.
- Mô tả hình ảnh, vật liệu, ánh sáng và phong cách.
- Quan hệ và hạn chế của nhà nước, bao gồm cả những gì không được chồng chéo.
- Chỉ cần yêu cầu các nhãn thực tế khi bạn có thể xác minh chúng sau đó.
Đối với một bố cục phức tạp, nhãn phần như “Header”, “Làm cột trái”, “Pháp trung tâm”, và “Footer” hữu ích hơn một đoạn văn không cấu trúc. Khi chỉnh sửa hình ảnh, hãy nói rõ những gì nên thay đổi và những gì không nên bị ảnh hưởng.
Những hạn chế và những điều chưa được biết
Qwen Hình ảnh 3.0 là mới, và các tài liệu phóng nhấn mạnh các ví dụ được chọn thay vì một báo cáo kỹ thuật đầy đủ hoặc đánh giá độc lập. Hãy nhớ những hạn chế sau:
- Chính sách truy cập trên dòng của QwenCloud tách biệt với PoYo, nơi hai thẻ nhận dạng mô hình được ghi chép hiện có sẵn.
- Qwen đã không tiết lộ số lượng tham số hoặc kiến trúc mô hình chi tiết.
- Qwen đã không công bố một độ phân giải gốc hoặc tối đa xác nhận; tuy nhiên, PoYo cho thấy các tùy chọn đầu ra 1K và 2K được hỗ trợ.
- Giá PoYo được công bố, trong khi giới hạn độ trễ trung bình và tốc độ sản xuất nên được kiểm tra so với tài liệu dịch vụ hiện tại.
- Việc có sẵn, cấp phép và các yêu cầu triển khai địa phương không được biết.
- Việc tuyên bố về việc hiển thị văn bản khoảng 10px không đảm bảo chính xác chính tả hoặc thực tế hoàn hảo.
- Danh sách đầy đủ của các ngôn ngữ được hỗ trợ của 12 chưa được công bố.
- Các công thức phức tạp, nhãn khoa học và các sự thật được tìm thấy vẫn đòi hỏi phải xác minh bởi con người.
- Các hình ảnh tương tự UI có thể trông thuyết phục mà không có giao diện hợp lý hoặc kỹ thuật.
- Hình ảnh cửa sổ chính thức không đo mức độ hiệu suất nhất quán của mô hình qua các lần tạo lặp lại.
Tránh chuyển các thông số kỹ thuật từ Qwen Image 2.0 sang Qwen Image 3.0. Đặc biệt, Qwen đã không xác nhận rằng mô hình mới có cùng số lượng tham số, kiến trúc, giới hạn độ phân giải hoặc hồ sơ triển khai.
Qwen Image 3.0 có đáng xem không?
Có, đặc biệt là cho các dòng công việc mà trong lịch sử đã yêu cầu một máy tạo hình ảnh riêng biệt, công cụ bố trí và thông qua kiểu chữ thủ công.
Phong cấp 3.0 ảnh Qwen quan trọng nhất không phải là một điểm số chất lượng hình ảnh duy nhất. Đó là nỗ lực để tạo ra một hình ảnh chứa thông tin có cấu trúc hơn, văn bản dễ đọc nhỏ hơn, chi tiết thị giác phong phú hơn và kiến thức chủ đề rộng hơn cùng một lúc.
Điều đó làm cho mô hình đặc biệt phù hợp với các nhà giáo dục, nhà xuất bản, nhà thiết kế, các nhóm thương mại điện tử và các nhà sáng tạo nội dung. PoYo cung cấp một đường dẫn API được lưu trữ thực tế ngày nay, trong khi suy luận địa phương vẫn không rõ ràng vì Qwen đã không phát hành trọng lượng, cấp phép hoặc yêu cầu phần cứng.
Kết luận đúng là Qwen Image 3.0 là một bản cập nhật tập trung vào năng suất đáng kể với các yêu cầu kiểu chữ và bố cục đầy tham vọng bất thường. Chi phí và kích thước đầu ra PoYo được hỗ trợ hiện đã được ghi lại, trong khi sự nhất quán, tốc độ, độ phân giải bản địa tối đa và các tùy chọn triển khai địa phương vẫn cần đánh giá riêng biệt.
Những câu hỏi thường được hỏi
Qwen Image 3.0 là gì?
Qwen Image 3.0 là mô hình nền tảng lần tạo thứ ba của Qwen cho việc tạo hình ảnh và chỉnh sửa hình ảnh. Nó tập trung vào bố cục mật độ thông tin, chi tiết trực quan tinh tế, văn bản đa ngôn ngữ, mô phỏng giao diện và nội dung trực quan giàu kiến thức.
Qwen Image 3.0 được phát hành khi nào?
Nhóm Qwen công bố Qwen Image 3.0 vào tháng 7 21, 2026.
Một yêu cầu Qwen Image 3.0 có thể kéo dài bao lâu?
Qwen cho biết mô hình chấp nhận hướng dẫn lên đến mã prompt 4.5K. Đây là giới hạn prompt, không đảm bảo rằng các mã prompt văn bản 4,500 có thể được trình bày chính xác bên trong một hình ảnh.
Qwen Image 3.0 có thể tạo ra văn bản nhỏ không?
Qwen tuyên bố mô hình có thể render văn bản dễ đọc ở kích thước nhỏ như khoảng 10 pixel. Các chính xác chính tả, công thức, số và các tuyên bố thực tế vẫn cần phải được kiểm tra bằng tay.
Qwen Image 3.0 hỗ trợ ngôn ngữ nào?
Qwen tuyên bố rằng nó hỗ trợ dịch thuật bản địa trên tất cả các ngôn ngữ 12. Các tài liệu phóng của nó cho thấy một số ngôn ngữ, bao gồm tiếng Trung, tiếng Anh, tiếng Nhật, Hàn Quốc và tiếng Tây Ban Nha, nhưng không công bố danh sách đầy đủ về ngôn ngữ 12.
Qwen Image 3.0 có thể chỉnh sửa hình ảnh không?
Có. Các ví dụ chính thức cho thấy mô hình này thêm các ghi chú bằng tay, bổ sung các bức ảnh với thông tin kỹ thuật và khôi phục các phần bị mất hoặc hư hỏng của tác phẩm nghệ thuật truyền thống.
Qwen Image 3.0 có nguồn mở không?
Qwen đã không công bố trọng lượng mở hoặc giấy phép cho Qwen Image 3.0. PoYo cung cấp truy cập API được lưu trữ, nhưng điều đó không có nghĩa là có cân nặng địa phương hoặc giấy phép triển khai địa phương.
Tên mô hình Qwen 3.0 API là gì?
Sử dụng PoYo qwen-image-3 và qwen-image-3-proCác danh sách trang riêng biệt của QwenCloud qwen-image-3.0-pro; không hoán đổi mã định danh của nhà cung cấp với mã định danh PoYo trong các yêu cầu API.
Xác định độ phân giải nào của Qwen Image 3.0 hỗ trợ?
PoYo hỗ trợ đầu ra 1K và 2K có thể chọn. Qwen đã không công bố một độ phân giải kiến trúc bản địa hoặc tối đa xác nhận, vì vậy các lựa chọn đầu ra PoYo không nên được giải thích như là một tuyên bố về độ phân giải đào tạo bản địa của mô hình.
Sử dụng Qwen Hình ảnh 3.0 trang mô hình để tạo ra hình ảnh ngay bây giờ, hoặc đọc các Tài liệu PoYo API trước khi tích hợp.

