Anthropic przestraja filtr biologiczny w Fable 5: o 85% mniej przekierowań do słabszego modelu
Opublikowano: 9.08.2026 · Źródło: Anthropic ↗
Anthropic przestroił klasyfikatory bezpieczeństwa biologicznego w Claude Fable 5, swoim flagowcu klasy Mythos, żeby ograniczyć fałszywe alarmy. Firma podaje, że liczba przekierowań na tle biologicznym spadła o około 85% w jej produktach.
Warto wyjaśnić sam mechanizm, bo nie jest to odmowa odpowiedzi. Kiedy klasyfikator uzna, że pytanie dotyka chronionej biologii, zapytanie nie zostaje odrzucone — po cichu trafia do modelu Opus 5, opisywanego przez Anthropic jako „zdolny model, który nie ma takiego poziomu możliwości biologicznych jak Fable 5". Użytkownik dostaje odpowiedź, tyle że od modelu celowo wybranego dlatego, że wie mniej.
Problem polegał na tym, że filtr czytał zwykłe pytania jak niebezpieczne. Anthropic wymienia przypadki, które teraz mają przechodzić: interpretacja wyników badań, rozumienie objawów i nauka biologii w kontekście edukacyjnym, a także praca kliniczna personelu medycznego.
Skutek mocno różni się między produktami. Ogólny odsetek przekierowań spadł o około 67% w Claude.ai i 55% w Cowork, ale tylko o 17% w Claude Code i o 7% na platformie Claude — to znak, że lwia część pomyłek przypadała na czat konsumencki, a ruch przez API był nimi ledwie dotknięty.
Nie zmienił się natomiast twardy rdzeń zabezpieczenia. Pytania z zakresu wirusologii, toksykologii i projektowania cząsteczek nadal są przekierowywane, a Anthropic wprost stwierdza, że Fable 5 pozostaje modelem „jeszcze nienadającym się do profesjonalnych badań biologicznych i prac nad lekami"; firma zapowiada zamknięcie tej luki przez tak zwane zaufane ścieżki dostępu do zaawansowanych możliwości biologicznych.