Что такое Wan и чем открытая модель отличается от платных сервисов
Платные генераторы видео вроде Sora, Runway и Kling дают качественный результат, но берут деньги за каждый ролик. Открытая модель работает иначе: команда разработчиков выкладывает веса - обученную модель - в открытый доступ, и дальше её можно ставить к себе и использовать без подписок и лимитов на списание.
Wan 2.2 - такая модель, созданная Alibaba и распространяемая под открытой лицензией. Она поддерживает два режима: text-to-video (описываете сцену словами и получаете клип) и image-to-video (загружаете фотографию, и модель оживляет её в движущийся ролик).
Открытые веса и лёгкая версия
У модели есть несколько размеров. Старшая версия даёт более качественную картинку, но требует серьёзного железа. Младшая версия на 5 миллиардов параметров рассчитана на обычную игровую видеокарту - пятисекундный ролик в HD она собирает за несколько минут. Для первого знакомства этого достаточно.
Веса модели лежат открыто на Hugging Face - общедоступном хранилище моделей. Их можно скачать и использовать без риска, что доступ отключат или выставят счёт задним числом.
Путь 1: в браузере, без видеокарты
Если мощной видеокарты нет, начните с готовой демо-страницы. Откройте витрину Wan на Hugging Face Spaces, заведите бесплатный аккаунт на Hugging Face (регистрация по почте), впишите описание сцены на английском языке - модель точнее понимает англоязычные промпты - и нажмите Generate. На бесплатных серверах возможна очередь, но ролик обычно собирается за несколько минут. Готовое видео можно скачать прямо со страницы в формате mp4.
Пример промпта: опишите сцену, свет и движение камеры. Например: уютная кофейня дождливым вечером, тёплый золотой свет, пар над чашкой кофе на деревянном столе, плавное движение камеры вперёд, малая глубина резкости.
Путь 2: локальная установка
Для игровой видеокарты NVIDIA от 8 ГБ видеопамяти модель можно поставить локально - без интернета, без очередей, с неограниченным числом генераций. Самый простой способ - через Pinokio, программу-лаунчер ИИ-приложений с установкой в один клик.
Установите Pinokio с официального сайта, в каталоге приложений найдите и установите ComfyUI - рабочий стол для запуска моделей изображений и видео, обновите его до последней версии перед первым запуском. Дальше откройте меню Workflow → Browse Templates → Video и выберите шаблон Wan 2.2 (T2V означает text-to-video). ComfyUI сам предложит докачать нужные файлы модели. Впишите промпт в поле описания и запустите генерацию - готовое видео появится в папке output.
Как получить результат, а не кашу
Начинайте с короткого ролика, а не с длинной сцены: пять секунд качественного движения лучше, чем тридцать секунд визуального шума. Опишите одну сцену, один объект, одно движение камеры - усложнять можно позже, когда станет понятно, как модель читает описания.
Пишите промпт по-английски и конкретно: не «красивое видео», а что именно в кадре, какой свет и как движется камера. Первый результат редко получается идеальным - меняйте формулировку и генерируйте заново, это быстрый процесс, а не разовая попытка.
Чек-лист
- Выбран путь под своё железо - браузер или локальная установка
- Промпт написан на английском и описывает сцену, свет и движение камеры
- Сцена простая: один объект, одно действие, одно движение
- Готовый ролик скачан себе, а не оставлен только в браузере
- Права на использование результата проверены под конкретную задачу