Когда из одной идеи нужно получить не отдельный кадр, а несколько связанных визуалов, Wan Image умеет работать с текстом, фотографиями и несколькими референсами. Семейство Alibaba Cloud позволяет создавать изображения с нуля, редактировать исходники и собирать последовательные серии, сохраняя персонажа или ключевые элементы сцены между генерациями.
Текущая ветка — Wan 2.7. В ней доступны Wan 2.7 Image и более мощная Wan 2.7 Image Pro. Обе модели поддерживают генерацию по тексту, работу с исходными изображениями, несколько референсов и интерактивное редактирование. Pro рассчитана на более требовательные задачи и позволяет получать 4K при генерации с нуля.
Wan удобен там, где одного изображения недостаточно. Например, можно создать первый рекламный кадр, затем сделать ещё несколько сцен с тем же человеком или продуктом и после этого точечно исправить отдельный результат. Модель подходит для:
Стандартная Wan 2.7 Image рассчитана на более быструю генерацию и поддерживает изображения до 2K. Wan 2.7 Image Pro даёт больше возможностей для финального качества: при генерации только по тексту доступно разрешение до 4K. Для редактирования и серий изображений максимальное разрешение ограничено 2K.
Pro также рассчитана на более точное выполнение сложных инструкций, сохранение объектов и работу с текстом внутри кадра. Для черновой идеи не всегда нужна самая мощная версия, а для финального рекламного изображения дополнительный контроль может быть полезен.
Одна из практичных возможностей Wan — передать несколько изображений и объяснить роль каждого.
Например, можно загрузить портрет человека и фотографию куртки:
Возьми человека с первого изображения и одежду со второго. Сохрани внешность, пропорции и детали куртки. Покажи героя в полный рост на светлой городской улице утром, естественная фотография на смартфон.
Для товара можно отдельно добавить упаковку и пример композиции, попросив сохранить реальный продукт, а вторую картинку использовать только как ориентир по свету и расположению предметов.
Wan 2.7 умеет изменять готовые изображения по текстовой инструкции. Можно заменить предмет, фон или часть композиции, не создавая сцену заново.
Если исходник должен остаться узнаваемым, лучше писать ограничения прямо:
Не меняй лицо девушки, волосы, позу и фон. Замени только сумку в её руке на сумку со второго референса и сохрани реальные размеры и освещение.
Это особенно полезно для коммерческих визуалов, где ошибка в форме продукта или одежде делает кадр непригодным.
Попробовать Wan можно через Нейролюб Studio. В интерфейсе выбирается доступная версия модели, после чего можно написать запрос по-русски и добавить фотографии, если нужны референсы.
Один и тот же товар или персонажа удобно проверить в нескольких генераторах — например, Wan, Seedream и GPT Image — и выбрать вариант, который точнее передал нужные детали.
Это актуальная ветка моделей Alibaba Cloud для изображений. Она поддерживает генерацию, редактирование, последовательные изображения и работу с несколькими референсами.