Leanstral 1.5
Mistral AI · Francja · 2026
Otwarty model na licencji Apache 2.0 do maszynowo sprawdzanej matematyki — wysyca miniF2F i rozwiązuje 587 z 672 zadań PutnamBench.
Leanstral 1.5, opublikowany przez Mistral AI 2 lipca 2026, to agent kodu dla Lean 4 — asystenta dowodów, w którym zapisuje się rozumowania matematyczne i własności programów tak, by ich poprawność sprawdzała maszyna, a nie recenzent. To rozróżnienie jest tu istotne: w odróżnieniu od czatbota proszonego o matematykę, wynik Leanstrala albo przechodzi przez jądro Lean, albo nie — znika więc typowe pytanie, czy model zmyśla. Model jest architekturą mixture-of-experts o 119 miliardach parametrów, z czego na token aktywowanych jest około 6 miliardów. Wagi wydano na licencji Apache 2.0 jako mistralai/Leanstral-1.5-119B-A6B na Hugging Face, a przez Labs API Mistrala model jest udostępniony bezpłatnie. W testach wysyca miniF2F wynikiem 100% na zbiorze walidacyjnym i testowym, rozwiązuje 587 z 672 zadań PutnamBench, osiąga 87% na FATE-H i 34% na trudniejszym FATE-X, a na FLTEval podnosi wynik z 28,9% przy jednej próbie do 43,2% przy ośmiu. Koszt Mistral szacuje na około cztery dolary za rozwiązane zadanie z PutnamBench. Najwięcej mówi jednak nie sam wynik, lecz skalowanie w czasie odpowiedzi: zwiększenie budżetu tokenów z 50 tys. do 4 mln podnosi liczbę rozwiązanych zadań Putnama z 44 do 587 — model wymienia więc moc obliczeniową na poprawność w sposób, na jaki niewiele systemów pozwala tak czytelnie. Mistral podaje też, że Leanstral znalazł pięć nieznanych wcześniej błędów, przeglądając 57 repozytoriów open source. Wcześniejszy punkt końcowy Leanstral (labs-leanstral-2603) został wyłączony 30 czerwca 2026 i to wydanie go zastępuje.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!