Robocikowo>ROBOCIKOWO
Qwen-Image-2.0

Qwen-Image-2.0

2.0 · Rodzina: Qwen
Nowej generacji foundacyjny model generacji obrazu z rodziny Qwen (Alibaba), ogłoszony 10.02.2026. Zunifikowana generacja i edycja w jednym trybie, natywne 2K i profesjonalny rendering typografii.
✓ Aktywny✓ Publiczny dostępModel generowania obrazówModel multimodalny📁 Qwen
Data premiery
10 lutego 2026
Dostęp:HostedWdrożenie:☁ Cloud

Przegląd

Qwen-Image-2.0 to foundacyjny model generacji obrazu z rodziny Qwen rozwijanej przez Alibaba (Tongyi Lab), ogłoszony 10 lutego 2026 roku jako kolejna generacja po modelach Qwen-Image oraz Qwen-Image-2512.

Kluczowe cechy

  • Profesjonalny rendering typografii — obsługa instrukcji o długości do 1 tys. tokenów, co pozwala generować gotowe infografiki, slajdy (PPT), plakaty i komiksy.
  • Silniejsze trzymanie się semantyki — natywna rozdzielczość 2K dla szczegółowych, realistycznych scen (ludzie, przyroda, architektura).
  • Zintegrowana generacja i edycja obrazu w jednym trybie, z poprawionym renderingiem tekstu.
  • Lżejsza architektura — mniejszy rozmiar modelu i szybsza inferencja.

W odróżnieniu od otwartych wag modeli Qwen-Image i Qwen-Image-2512, wagi Qwen-Image-2.0 nie zostały opublikowane — model udostępniono jako usługę hostowaną poprzez Qwen Chat. Rodzina Qwen-Image bazuje na architekturze dyfuzyjnego transformera (MMDiT).

Klasyfikacja
Model generowania obrazówModel multimodalny
Rodzina: Qwen
Dostęp i wdrożenie
Hostowane
Chmura
Wagi: Zamknięte
Kluczowe parametry
📥 Wejście: tekst, obraz

Specyfikacja techniczna

Modalności
⬇ Wejście (Input)
textimage
⬆ Wyjście (Output)
image

Możliwości i zastosowania

Natywne możliwości modelu
Generowanie obrazu z tekstu (text-to-image)
Zdolnosc modelu do tworzenia obrazow na podstawie opisu tekstowego (promptu), w tym kontroli stylu, kompozycji, proporcji i renderowania tekstu na obrazie.
Kategoria: vision
Edycja obrazów
Modyfikacja istniejącego obrazu na podstawie instrukcji tekstowej lub bezpośrednich adnotacji: usuwanie obiektów, zmiana stylu, dodawanie elementów, uzupełnianie fragmentów (inpainting/outpainting), zachowując tożsamość osób i spójność sceny.
Kategoria: vision

Architektura techniczna

Rdzeń architektury (Core Architecture)