Qwen-Image-3.0
Alibaba Cloud · China · 2026
Trzecia generacja modelu obrazowego Alibaby, zbudowana po to, by w jednym przebiegu wyrenderować czytelny tekst wielkości dziesięciu pikseli i całe układy stron — i pierwszy obrazowy Qwen bez otwartych wag.
Qwen-Image-3.0, wydany 21 lipca 2026 roku, to moment, w którym linia obrazowa Alibaby przestaje konkurować jakością obrazka, a zaczyna konkurować składem. Limit polecenia wzrósł z 1000 tokenów w Qwen-Image-2.0 do około 4500, a to wystarczy, by opisać nie jeden obraz, ale całą stronę — rozkładówkę gazety, kartę menu, storyboard, arkusz egzaminacyjny — i model jest uczony tak, by ułożyć tę stronę w jednym przebiegu, a nie składać ją z osobnych generacji. Sztandarowa obietnica dotyczy tekstu: zespół pokazuje czytelne znaki wielkości około dziesięciu pikseli, poprawnie złożone formuły matematyczne, dwanaście języków i różne kroje pisma — czyli dokładnie to, co dotąd trzymało generatory obrazu poza pracą projektową. Edycja z odniesieniem pozwala prowadzić wynik istniejącym zdjęciem, a obrazy można zagnieżdżać w obrazach, więc makiet ekranów i druków nie trzeba już dorabiać później w edytorze. Dwie rzeczy trzeba powiedzieć wprost, bo premiera tego nie zrobiła. Pierwsza: ta generacja wyszła bez raportu technicznego, bez tabeli wyników i bez podanej liczby parametrów — to odwrót u zespołu, którego dwa poprzednie modele obrazowe miały i publikacje, i liczby. Druga, ważniejsza dla każdego, kto wybrał Qwena za otwartość: wag nie opublikowano. Qwen-Image 1.0 wyszedł na licencji Apache 2.0 i dawał się uruchomić na własnym sprzęcie, a wersja 3.0 istnieje wyłącznie jako płatny punkt dostępowy, wpisany w Alibaba Cloud Model Studio pod identyfikatorem qwen-image-3.0-pro. Część zestawień podaje z tego powodu sierpień jako datę premiery; identyfikator w API pojawił się później niż sam model.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!