Содержание
Wan 3.0 превращает документы и референсы в готовое AI-видео
Alibaba Cloud открыла тестирование Wan 3.0 — нового поколения видеомодели семейства Wan. Главная перемена — генерация ролика продолжительностью до 30 секунд за один запуск. Это вдвое длиннее привычных 15-секундных клипов и даёт модели больше пространства для непрерывного движения камеры, развития сцены и короткого сюжета.
В видео можно превратить не только промпт
Wan 3.0 работает с текстом, изображениями, видео и аудио, а также принимает ссылки и офисные файлы. Среди поддерживаемых форматов заявлены DOC, XLS, PPT, PDF и Markdown. Например, презентацию продукта или документ с идеей можно использовать как исходный материал: модель извлечёт содержание и соберёт на его основе видеосцену.
Для более точного результата разрешено комбинировать референсы: до десяти изображений, пяти видео и пяти аудиофайлов. Такой подход полезен там, где важно сохранить внешность героя, предметы, пространство, визуальный стиль и звук между кадрами.
Больше контроля над готовым роликом
В Wan 3.0 заявлено редактирование фона, объекта, освещения и звука по инструкции или референсу. Модель также умеет продолжать видео и лучше удерживать детали персонажей, реквизита и сцены. Отдельный акцент сделан на синхронном звуке, стереоэффектах и поддержке разных диалектов.
Почему это важно креаторам и бизнесу
Тридцатисекундная генерация сокращает необходимость склеивать множество коротких фрагментов, а ввод из презентаций и документов может ускорить производство рекламных роликов, обучающих материалов и контента для соцсетей. Для маркетинга особенно интересна возможность собрать в одном задании брендовые референсы, исходное видео, музыку и сценарный документ.
Пока Wan 3.0 находится в стадии тестирования, поэтому доступность функций и качество результата могут отличаться в разных интерфейсах. Но сам формат релиза показывает направление рынка: AI-видеогенераторы переходят от отдельных красивых кадров к более длинным и управляемым производственным процессам.