MDL-2834EST.2026 · IDX.997
Model językowyW produkcji

Ling-3.0-flash

InclusionAI (Ant Group) · China · 2026

Model o otwartych wagach od grupy Ant: 124 mld parametrów, z czego 5,1 mld aktywnych na token, i okno 256 tys. tokenów.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Ling-3.0-flash to bieżąca generacja modeli InclusionAI, otwartoźródłowego ramienia grupy Ant — spółki stojącej za Alipay — i pierwszy model tego wydawcy opisany w tym katalogu. Wagi pojawiły się na Hugging Face 2 sierpnia 2026 r. z deklaracją licencji MIT w karcie modelu; w repozytorium nie ma osobnego pliku licencji, więc warunki opierają się wyłącznie na tej jednej linijce metadanych. Sednem konstrukcji jest to, jak mała część modelu pracuje naraz. To mieszanka ekspertów o 124 miliardach parametrów łącznie i 5,1 miliarda aktywowanych na token — według wyliczeń samego producenta jest to około 12,4 procent parametrów i 8,1 procent obliczeń jego poprzedniego flagowca klasy biliona, Ring-2.6-1T, któremu ma dorównywać lub go wyprzedzać w kluczowych testach. Opublikowany indeks plików wag liczy w rzeczywistości 127,5 miliarda parametrów, czyli nieco więcej, niż mówi nagłówek. Router wybiera 8 z 512 ekspertów i dokłada jednego eksperta wspólnego. Najbardziej nietypowa jest warstwa uwagi. Zamiast doklejać uwagę liniową po treningu, InclusionAI trenowało na niej od początku, przeplatając Kimi Delta Attention z bramkowaną uwagą utajoną w stosunku 5:1 — 35 warstw KDA na 7 warstw MLA. Okno kontekstu rozszerzano etapami, z 8 tys. przez 32 tys. do 256 tys. tokenów, a wydany model obsługuje 262 144 tokeny. Celem jest praca agentowa, nie rozmowa. InclusionAI podaje, że trenowało model w ponad 10 tysiącach interaktywnych środowisk dla agentów programistycznych, ogólnych i badawczych, i dokłada hierarchiczny system pamięci podręcznej (SGLang HiCache z Mooncake), któremu przypisuje skrócenie czasu do pierwszego tokena o 60 do ponad 80 procent przy długich wejściach. Deklarowane mocne strony to rodzina testów SWE-Bench, Terminal-Bench, MCP-Atlas i inne zestawy sprawdzające korzystanie z narzędzi; wszystkie opublikowane liczby pochodzą od producenta. Tryb rozumowania jest domyślnie włączony i można go wyłączyć w pojedynczym zapytaniu. Model jest już hostowany przez podmioty trzecie: OpenRouter podaje go z oknem 262 tys. tokenów, a 27 sierpnia 2026 r. dołączyła tam jego odmiana dostrojona do finansów, Ling-3.0-flash-fin.

#open weights#MIT license#MoE#reasoning#agentic#256K context
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję