Najczęściej pobierany model IBM nie jest czatem — i wyprzedza czat pięciokrotnie
Opublikowano: 1.09.2026 · Źródło: Licznik pobrań i karty modeli konta ibm-granite na Hugging Face ↗
Najczęściej używany model, jaki wydaje IBM, nie odpowie na pytanie, nie porozmawia i nie napisze linijki kodu. Ma 47 milionów parametrów, czyta tekst i zwraca listę 384 liczb. W trzydziestu dniach do 1 września 2026 r. pobrano go około 5,75 miliona razy — pięć razy częściej niż Granite 4.1 8B, najpopularniejszy czat tej firmy, i częściej niż wszystkie czaty Granite razem wzięte.
Mowa o modelu Granite Embedding Small English R2, opublikowanym w sierpniu 2025 r. To model osadzeń: zamienia fragment tekstu na położenie w przestrzeni, dzięki czemu wyszukiwarka potrafi znaleźć akapity najbliższe znaczeniowo pytaniu. Nikt z nim nie rozmawia. Siedzi pod okienkiem wyszukiwania, pod odnajdywaniem dokumentów i pod każdym układem, który podsuwa modelowi językowemu właściwy akapit, zanim ten odpowie.
Wczoraj napisaliśmy, że najczęściej używanym modelem IBM jest Granite 4.1 8B. Skan całego konta firmy na Hugging Face pokazuje, że to prawda wyłącznie wśród modeli, które mówią. Warto to sprostować, bo sam ranking mówi coś o branży: tabele wyników, premiery i relacje prasowe kręcą się wokół czatów, a licznik faktycznego użycia wygrywa infrastruktura. Rachunek jest prosty — system wyszukiwania wywołuje model osadzeń przy każdym indeksowanym dokumencie i przy każdym pytaniu wpisanym przez użytkownika, a czat odzywa się raz na rozmowę.
Ten sam wzór powtarza się niżej na liście IBM. Trzecie miejsce zajmuje model prognozujący szeregi czasowe, przed flagowym czatem o trzydziestu miliardach parametrów. Dwa kolejne modele osadzeń i strażnik treści stoją wyżej niż większość katalogu konwersacyjnego.
W tych kartach modeli jest jeszcze jeden szczegół wart uwagi. IBM pisze wprost, że nie uczył na zbiorze MS MARCO, z którego korzysta większość otwartych modeli osadzeń, bo jego licencja zabrania zastosowań komercyjnych. Ta decyzja kosztuje mierzalną trafność i firma podjęła ją mimo to — dokładnie ten sam kompromis udokumentowała tydzień temu, wydając model mowy w dwóch wersjach i zakazując komercyjnego użycia lepszej z nich. Czytane razem, obie decyzje opisują firmę, która woli opublikować model odrobinę słabszy niż taki, którego klient nie może legalnie wdrożyć.
Wielojęzyczny brat, wydany w kwietniu 2026 r., niesie szczegół o lokalnej wadze: 52 języki dostały osobny trening, a polski jest wśród nich. Każdy czat Granite wymienia dwanaście przetestowanych języków i polskiego nie ma w żadnym. Dla polskiej organizacji, która chce przeszukiwać własne dokumenty modelem IBM, koder wyszukiwania nie jest drugim wyborem — jest jedynym.