IBM Granite Embedding Small English R2
IBM · USA · 2025
Najczęściej pobierany model IBM w historii — i nie umie rozmawiać: 47 milionów parametrów zamieniających tekst na wektory do wyszukiwania, pobierane pięć razy częściej niż flagowy czat tej firmy.
Granite-Embedding-Small-English-R2 nie jest czatem i nie odpowie na pytanie. Czyta fragment tekstu i zwraca listę 384 liczb — położenie w przestrzeni, w której podobne znaczenia lądują blisko siebie. To maszyneria stojąca za wyszukiwarką w serwisie, za odnajdywaniem dokumentów i za każdym systemem, który podsuwa modelowi językowemu właściwy akapit, zanim ten odpowie. Jest też, z dużą przewagą, najczęściej używanym modelem, jaki IBM kiedykolwiek wydał. Repozytorium pobrano około 5,75 miliona razy w trzydziestu dniach do 1 września 2026 r. — mniej więcej pięć razy częściej niż Granite 4.1 8B, najpopularniejszy czat tej firmy, i częściej niż wszystkie czaty Granite z naszego katalogu razem wzięte. Powód jest prozaiczny: system wyszukiwania wywołuje model osadzeń przy każdym indeksowanym dokumencie i przy każdym zapytaniu, a czat odzywa się raz na rozmowę. Model jest mały z rozmysłem. 47 milionów parametrów, dwanaście warstw, wektor wyjściowy o 384 liczbach i okno kontekstu 8192 tokenów — IBM nazywa go pierwszym takim w tej klasie wielkości, a przetwarza około 199 dokumentów na sekundę na jednej karcie H100. Większy brat, granite-embedding-english-r2, ma 149 milionów parametrów i wektory 768-liczbowe, wypada o dwa do trzech punktów lepiej w większości testów wyszukiwania i jest o jedną trzecią wolniejszy. Architektura to ModernBERT: naprzemienne okna uwagi, pozycje rotacyjne, aktywacje GeGLU, brak wyrazów wolnych, słownik 50 368 tokenów uczony jednocześnie na kodzie i prozie. W pomiarach producenta osiąga 50,9 w wyszukiwaniu BEIR, 61,1 w MTEB-v2, 53,8 w wyszukiwaniu kodu i 39,8 w przeszukiwaniu długich dokumentów — na tyle blisko poprzedniego pokolenia o 125 milionach parametrów, które zastępuje, że różnicę widać głównie w tabeli. Najciekawsze jest to, czego w danych treningowych nie ma. IBM pisze wprost, że nie użył zbioru MS MARCO, na którym uczy się większość otwartych modeli osadzeń, bo jego licencja zabrania zastosowań komercyjnych. Ta decyzja kosztuje trafność i IBM podjął ją mimo to — dokładnie ten sam kompromis firma udokumentowała w sierpniu 2026 r., wydając model mowy w dwóch wersjach i zabraniając komercji przy lepszej z nich. Licencja to czysta Apache 2.0, bez wyłączeń terytorialnych. Wyłącznie angielski: dłuższy tekst jest przycinany, a obcojęzyczny obsługiwany słabo — polski czytelnik potrzebuje wielojęzycznej odmiany R2.
▸Newsy
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!