MDL-4018EST.2025 · IDX.759
WideoW produkcji

Wan2.1-I2V-14B-480P

Alibaba Cloud · China · 2025

Ten sam czternastomiliardowy animator zdjęć co wersja 720p, trenowany dla mniejszej klatki — i to jego ludzie faktycznie uruchamiają: pobierany jest dwuipółkrotnie częściej niż bliźniak w wysokiej rozdzielczości.

Ocena wujec.ai

/10

Ocena społeczności

brak głosów
Zaloguj się, aby ocenić

Wan2.1-I2V-14B-480P to standardowa połowa otwartej pary Alibaby do animowania zdjęć, opublikowana 25 lutego 2025 roku razem z resztą generacji Wan 2.1, na licencji Apache 2.0. Przyjmuje fotografię i polecenie tekstowe, a zwraca materiał zaczynający się od tej fotografii, w docelowej klatce 832×480. Architektonicznie to ta sama maszyna co wersja 720p: transformator dyfuzyjny o 40 warstwach i szerokości 5120, z 40 głowicami, 36 kanałami wejściowymi na obraz warunkujący i jego maskę, wspólnym koderem tekstu umt5-xxl z pułapem 512 tokenów i koderem wizyjnym CLIP do odczytania podanego zdjęcia. Pliki wag liczą 16,4 miliarda parametrów przy nazwie mówiącej o 14 miliardach; różnicę robi ścieżka warunkowania obrazem, a nie większy generator. Obie paczki dzieli więc nie rozmiar ani budowa, lecz rozdzielczość, dla której każdą trenowano — a Alibaba wydała je jako dwa osobne repozytoria zamiast jednego modelu z przełącznikiem. Ten wybór dał wynik wart odnotowania. Ten model pobierany jest z Hugging Face około 50 tysięcy razy miesięcznie wobec mniej więcej 19 tysięcy wersji 720p, a jednocześnie to wersja 720p ma prawie trzykrotnie więcej polubień. Wersję wysokiej rozdzielczości ludzie podziwiają, a uruchamiają tę standardową. Wzorzec powtarza się w całym otwartym wideo: wygrywa użyciem ta rozdzielczość, która mieści się na sprzęcie już posiadanym, cokolwiek pokazują testy porównawcze. To repozytorium jest też porządniejsze z dwóch pod względem papierów: plik LICENSE.txt, do którego odsyłają obie karty modeli, jest tutaj obecny, a w siostrzanej wersji 720p go brakuje. Do poleceń producent daje opcjonalne rozwijanie modelem Qwen2.5-VL-7B, a jak we wszystkich modelach tej rodziny animujących zdjęcie, ustawienie rozmiaru wyznacza pole powierzchni materiału, natomiast proporcje biorą się z fotografii wejściowej.

#image to video#video generation#open weights#apache 2.0
Strona oficjalna

Wideo

Brak materiałów wideo.

Recenzje

Brak recenzji. Bądź pierwszy!

Zaloguj się, aby napisać recenzję