Wszystkie newsyPremiery

Meta otwiera destylat swojego zamknietego flagowca: Muse Glimmer uruchamia agentow na jednej karcie 24 GB

Opublikowano: 11.08.2026 · Źródło: Meta AI Research

Meta opublikowala Muse Glimmer 10 sierpnia 2026 roku — gesty model o okolo 29,6 mld parametrow, ktory wedlug firmy powstal przez destylacje logitow z odpowiedzi zamknietego flagowca Muse Spark. Wagi leza na Hugging Face na zwyklej licencji Apache 2.0, bez progow uzycia znanych z wczesniejszych licencji spolecznosciowych Meta. Deklarowany cel projektowy to "always-on local agent workflows": model, ktory na stale siedzi na prywatnym komputerze, wywoluje narzedzia, pisze i debuguje kod, czyta zrzuty ekranu i przechodzi przez wieloetapowe zadania bez wychodzenia do sieci. Widzenie zapewnia zamrozony enkoder ViT-G/14 o okolo 1,8 mld parametrow, a okno kontekstu wynosi 131 072 tokeny — znacznie mniej niz milion u modelu-nauczyciela, i to jest cena zejscia z rozmiaru. Sednem komunikatu sa liczby sprzetowe. Pelna precyzja wymaga 64 GB, ale Meta wydala dwie kwantyzacje czterobitowe: 32 GB przy deklarowanej stracie 0,2% jakosci i 24 GB — czyli jedna karta RTX 5090 — przy okolo 1%. Razem z modelem wyszla glowica DFlash do dekodowania spekulatywnego, ktora wedlug pomiarow producenta daje na tej karcie 233 tokeny na sekunde zamiast 75, a na MacBookach M4-Max i M5-Max przyspieszenie od 1,5 do 1,8 raza. Zapowiedziano tez integracje z llama.cpp, MLX, ExecuTorch, Ollama i LM Studio. We wlasnej karcie modelu Meta podaje 76,0 na SWE-Bench Verified, 51,2 na SWE-Bench Pro, 65,9 na OSWorld-Verified, 94,7 na AIME 2026 i 83,5 na GPQA Diamond. Wszystkie te liczby pochodza od producenta; w chwili pisania zaden niezalezny ranking nie opublikowal wyniku. Meta zaznacza, ze otwarte wydanie ocenila w ramach swojego Advanced AI Scaling Framework, i nie publikuje audytu zewnetrznego.