Aya Vision 8B
Cohere Labs · Canada · 2025
Wielojęzyczny model wizyjno-językowy Cohere Labs: tekstowy model Aya Expanse o 8 mld parametrów z doczepioną wieżą wizyjną, który czyta obrazy i odpowiada w 23 językach, w tym po polsku.
Aya Vision 8B, opublikowany 3 marca 2025, rozszerza linię Aya z tekstu na obrazy, zachowując przy tym pokrycie językowe: przyjmuje zdjęcia i tekst na wejściu, zwraca tekst i pracuje w tych samych 23 językach co Aya Expanse, z polskim włącznie. Zastosowania wskazywane przez producenta to opisywanie obrazów i odpowiadanie na pytania o ich zawartość - odczytanie fotografii, wykresu albo strony tekstu i odpowiedź w języku użytkownika. Metadane repozytorium pokazują wprost, jak model zbudowano. Ma 8 631 842 032 parametry wobec 8 028 033 024 w Aya Expanse 8B, więc część wizyjna to około 604 mln parametrów - mniej więcej 7% całości, doczepione do gotowego modelu tekstowego. To standardowa konstrukcja modelu wizyjno-językowego i tłumaczy, dlaczego zachowanie wielojęzyczne przenosi się tak czysto. Licencja nie różni się od reszty rodziny: CC BY-NC 4.0 z zasadami dopuszczalnego użycia Cohere Labs, bez zgody na użytek komercyjny, wagi za bramką. Produkcyjna dokumentacja Cohere wymienia jako model hostowany wyłącznie wariant 32B, więc ten pozostaje wydaniem czysto wagowym. W ciągu trzydziestu dni do 18 sierpnia 2026 pobrano go 5730 razy, przy 324 polubieniach.
▸Wideo
Brak materiałów wideo.
▸Recenzje
Brak recenzji. Bądź pierwszy!