MDL-8068EST.2026 · IDX.552
Model językowyW produkcji

Qwen3-VL-Reranker-8B

Alibaba Cloud · China · 2026

Najdokładniejszy model w zestawie wyszukiwawczym Alibaby i zarazem najrzadziej używany: wygrywa każdą kolumnę tabeli producenta, a mimo to pobierany jest 48 razy rzadziej niż jego mniejszy brat.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Qwen3-VL-Reranker-8B, opublikowany 7 stycznia 2026 roku, obsługuje drugi etap wyszukiwania. Najpierw model osadzeń wyciąga z dużego indeksu może sto kandydatów — szybko i z grubsza. Potem model przestawiający wyniki czyta zapytanie razem z każdym kandydatem jako jedno wejście i wystawia ocenę trafności. Ponieważ widzi obie strony naraz, zamiast porównywać policzone wcześniej wektory, ocenia znacznie lepiej — i kosztuje znacznie więcej, bo pracę trzeba powtórzyć dla każdego kandydata każdego zapytania. Wejściem może być tekst, obraz, zrzut ekranu, slajd albo klatka nagrania, w dowolnym połączeniu i po obu stronach pary. Na tym polega sens tego modelu: zapytanie napisane słowami można ocenić względem strony, która istnieje wyłącznie jako skan. Podstawą jest Qwen3-VL-8B-Instruct: 36 warstw, wymiar ukryty 4096, moduł wizyjny z 27 bloków, 8,77 miliarda parametrów i wspierane okno 32 768 tokenów. Parametrów jest o około 622 miliony więcej niż w modelu osadzeń z tej samej rodziny, a różnica to dokładnie rozmiar warstwy wyjściowej słownika: 151 936 tokenów razy 4096 wymiarów. Ta warstwa nie jest tu ozdobą — model wystawia ocenę jako wartość logitu na tokenie wyjściowym, więc potrzebuje głowicy, którą model osadzeń mógł wyrzucić. W każdej kolumnie porównania opublikowanego przez Alibabę jest najlepszy z czwórki: 79,2 punktu średnio w części wyszukiwawczej MMEB-v2, 86,3 w wyszukiwaniu w dokumentach obrazowych, 74,9 w MMTEB, 83,6 w JinaVDR i 66,7 w ViDoRe v3. Ta ostatnia liczba jest o blisko sześć punktów wyższa niż u dwumiliardowego modelu przestawiającego i o prawie czternaście wyższa niż u dwumiliardowego modelu osadzeń. I prawie nikt go nie uruchamia. W 30 dniach do 1 września 2026 pobrano go z Hugging Face 43 201 razy, wobec 2,07 miliona pobrań Qwen3-VL-Reranker-2B — stosunek mniej więcej jeden do czterdziestu ośmiu. Wyjaśnienie jest konstrukcyjne, a nie gustowe. Model przestawiający wywołuje się raz na kandydata, więc lista stu dokumentów to sto przebiegów, zanim użytkownik cokolwiek zobaczy, a przy ośmiu miliardach parametrów to wydatek, na który większość wyszukiwarek nie pójdzie. Ten model jest właściwym wyborem tam, gdzie poprawność stoi wyżej niż czas odpowiedzi — w archiwach prawnych, medycznych i dokumentacji technicznej — a niewłaściwym za okienkiem wyszukiwania. Wagi na licencji Apache 2.0, bez wyłączenia dla Europy. Zestaw opisano w raporcie technicznym ze stycznia 2026 (arXiv 2601.04720).

#open weights#reranking#retrieval#multimodal#vision#multilingual#China
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję