Tencent Hy-MT2-7B
Tencent · China · 2026
Środkowy rozmiar otwartej rodziny tłumaczeniowej Tencenta: osiem miliardów parametrów w modelu gęstym, 33 języki, z myślą o jednej karcie serwerowej — nie o telefonie i nie o klastrze.
Hy-MT2-7B stoi między modelem 1,8 mld przeznaczonym do telefonów a trzydziestomiliardową mieszanką ekspertów pisaną pod serwery; opublikowano go razem z nimi 21 maja 2026 r. To model gęsty o 8,03 mld parametrów, obsługujący te same 33 języki i to samo tłumaczenie sterowane poleceniem co reszta rodziny: narzucony słownik terminów, nazwany styl, wierne zachowanie separatorów oraz tłumaczenie danych ustrukturyzowanych, które zmienia w plikach JSON i XML wartości czytelne dla człowieka, zostawiając w spokoju klucze, znaczniki i miejsca na zmienne. We własnym porównaniu Tencent zestawia go razem z modelem 30B-A3B, twierdząc, że oba wypadają lepiej niż ogólne modele otwarte, takie jak DeepSeek-V4-Pro i Kimi K2.6, uruchomione w trybie szybkiej odpowiedzi, czyli bez wcześniejszego rozpisywania rozumowania. To wykres producenta, a dobór porównania należy do producenta; niezależnie sprawdzalne jest to, że opublikowano zarówno wagi, jak i firmowy test IFMTBench mierzący trzymanie się instrukcji. Praktyczny argument za tym rozmiarem jest taki, że to największy z trzech modeli, który wciąż wygodnie działa jako model gęsty na jednym akceleratorze, bez kłopotów z obsługą kierowania do ekspertów. W trzydziestu dniach do 31 sierpnia 2026 r. wydanie dla llama.cpp pobrano 29 691 razy wobec 12 052 pobrań wag podstawowych. Licencja w repozytorium to czysty tekst Apache 2.0, sprawdzony w pliku LICENSE.txt — bez wyłączenia terytorialnego, które Tencent stosuje wobec Unii Europejskiej, Wielkiej Brytanii i Korei Południowej w modelach HunyuanOCR.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!