Wan 2.1 — полностью открытая модель генерации видео от исследовательской команды Tongyi (Alibaba), распространяемая по лицензии Apache 2.0. Возглавляет рейтинг VBench среди моделей генерации видео.
В отличие от закрытых облачных сервисов вроде Runway или Sora, веса Wan 2.1 можно скачать и запустить на собственном оборудовании — без подписки, лимитов по числу генераций и без передачи данных на серверы третьей стороны. Важная оговорка: Alibaba с конца 2025 года выпустила более новые версии линейки — Wan 2.6 (декабрь 2025) и Wan 2.7 (весна 2026) — с расширенными возможностями (звук, режим рассуждений, контроль первого/последнего кадра), но они распространяются в первую очередь как облачный продукт Alibaba Cloud, а не как открытые веса. Wan 2.1 остаётся актуальным выбором именно как последняя полностью открытая локальная версия линейки, а не как новейшая версия Wan вообще.
Подходит разработчикам и техническим энтузиастам с достаточно мощной видеокартой, готовым настроить локальный запуск через ComfyUI, а также компаниям, которым важен полный контроль над видео-пайплайном без зависимости от зарубежного облачного сервиса.
Модель существует в нескольких вариантах, включая версии text-to-video и image-to-video на 14 млрд параметров — референсную точку для того, что в принципе способны открытые модели генерации видео.
Отдельная модификация Wan2.1-FLF2V-14B умеет генерировать видео по заданным первому и последнему кадру, что упрощает создание переходов и плавных анимаций между двумя опорными изображениями.
Модель доступна для скачивания из России напрямую — веса выложены на Hugging Face, GitHub и китайской платформе ModelScope, без региональных ограничений. Единственное требование — собственное оборудование с достаточным объёмом видеопамяти для локального запуска.
По открытости и возможности бесплатного локального запуска Wan 2.1 для видео — то же, чем Stable Diffusion является для изображений. Для пользователей без мощного GPU или без желания настраивать локальный запуск больше подойдут облачные Hailuo или Vidu.
Модель полностью бесплатна при локальном запуске — платить нужно только за собственное оборудование (видеокарту).
Нет, веса модели доступны на Hugging Face, GitHub и ModelScope без региональных ограничений.
Компьютер с достаточно мощной видеокартой и интерфейс вроде ComfyUI.
Исследовательская команда Tongyi (Alibaba, Китай).
Она генерирует видео по заданным первому и последнему кадру, упрощая создание плавных переходов и анимаций.