Trzy miliardy pobrań Qwena obiegły świat — a raport, z którego pochodzą, mówi, że modele-giganty to 1% ruchu
Opublikowano: 15.08.2026 · Źródło: Hugging Face — State of Open Models: Summer 2026 ↗
Hugging Face opublikował 14 sierpnia 2026 swój półroczny przegląd modeli o otwartych wagach, a nazajutrz jedna liczba z niego obiegła świat: rodzina Qwen od Alibaby przekroczyła trzy miliardy pobrań, wyprzedzając Google i Metę razem wzięte. Ta liczba to własne, skumulowane wyliczenie Alibaby ze wszystkich platform. Pomiar samego raportu jest węższy i bardziej użyteczny: na samym Hugging Face repozytoria Qwena pobrano w 2026 roku 2045 mln razy, wobec 418 mln u Google i 227 mln u Mety. Qwen odpowiada dziś za ponad połowę wszystkich pobrań modeli otwartych w serwisie, a na jego bazie powstało 151 448 modeli pochodnych — od 180 do 210 nowych dziennie, przy 82 506 u Google i 32 155 u Llamy.
Ustalenie, które nie przebiło się nigdzie, leży kilka wykresów dalej i podważa sposób, w jaki zwykle opisuje się ten wyścig. Modele poniżej miliarda parametrów odpowiadają za 83% wszystkich pobrań w historii serwisu. Modele powyżej 100 mld parametrów — czyli czołówka, ta od premier i tabel z wynikami testów — odpowiadają za 1%. Jeśli policzyć sam 2026 rok, wszystko powyżej 70 mld parametrów to wciąż tylko 3% ruchu. Rozkład jest bezlitosny także w drugą stronę: 85,6% modeli w serwisie ma w całym swoim życiu mniej niż 200 pobrań, a 1,5% zbiera 99,2% ruchu.
Ta sama nierównowaga widać w tym, co ludzie faktycznie uruchamiają u siebie. W formacie GGUF, czyli skwantyzowanych plikach do lokalnego uruchamiania na zwykłym sprzęcie, Qwen pobierany jest 39,6 mln razy miesięcznie, Gemma od Google 20,8 mln, a Llama 7,5 mln — i to mimo że repozytoriów GGUF Llama ma opublikowanych więcej niż Qwen. Raport odczytuje to jako różnicę strategii, a nie wyrok o jakości: Qwen wydaje modele w każdej klasie wielkości, od takich poniżej miliarda parametrów, które chodzą na laptopie, po czołówkę — a laboratorium publikujące wyłącznie duże modele zbiera ułamek ruchu. Moonshot, którego otwarty dorobek to same modele czołowe, zanotował 37 mln pobrań, czyli 55 razy mniej niż Qwen.
Dwa dalsze ustalenia warto odnotować każdemu, kto śledzi, kto co publikuje. Po pierwsze licencje: wśród chińskich wydań powyżej 20 mld parametrów 59% ma licencję Apache 2.0, a 22% MIT, i żadne nie ma zastrzeżenia niekomercyjnego — to tło dla rozdwojenia licencyjnego, które opisywaliśmy wczoraj przy Qwen3.8, gdzie mały model dostał Apache 2.0, a duży już nie. Po drugie autorstwo w najwyższej klasie: raport zauważa, że większość amerykańskich wydań powyżej 100 mld parametrów to pochodne chińskich modeli bazowych, a największą liczbę nowych repozytoriów publikują dziś producenci sprzętu — AMD i NVIDIA, po ponad 200 nowych repozytoriów każde — udostępniając warstwy optymalizacji i konwersji, a nie własne modele. Sam serwis urósł w tym czasie z 2,43 mln do 2,96 mln modeli.