Alibaba Wan3.0: Новый этап в генерации видео с помощью ИИ
Компания Alibaba, один из крупнейших IT-гигантов, представила Wan3.0 — новую версию своей модели искусственного интеллекта для генерации видео. Этот запуск произошел вскоре после привлечения около $10,2 млрд в рамках размещения акций на Гонконгской бирже.
Wan3.0 представляет собой значительный шаг вперед по сравнению с предыдущими версиями и конкурентами, переходя от простой «оживляющей картинки» к созданию полноценных, управляемых видеосцен. Модель способна генерировать 30-секундные видео за один проход, предлагая гораздо более сложный функционал.
Ключевые возможности Wan3.0
- Продолжительность видео: Генерация 30-секундных клипов за один раз.
- Нативный звук: Интеграция естественного звукового сопровождения.
- Множество персонажей: Возможность включать несколько действующих лиц в одну сцену.
- Разнообразные входные данные: Поддержка таких форматов, как DOC, PDF, PowerPoint или даже веб-страницы для преобразования в видео.
- Развитие действия: Сохранение одних и тех же героев и предметов на протяжении всего клипа с развивающимся сюжетом.
Эксперты отмечают, что Wan3.0 нацелен на решение одной из главных задач в области ИИ-генерации видео — создание длительных, последовательных сцен без потери качества или распада композиции. Это делает его заметным конкурентом таким моделям, как Seedance 2.5, Kling 3.0, MiniMax H3, Veo 3.1 и Grok Imagine, которые также стремятся к созданию более сложных и управляемых видеоматериалов.
Сам активно тестирую подобные генераторы, и 30 секунд с сохранением персонажей — это уже серьезно. Обычно на 5-10 секундах появляются артефакты или сюжет теряется. Главная проблема пока — это детализация мелких объектов и консистенция лиц при разных ракурсах. Попробую Wan3.0, если он действительно умеет работать с PDF, это будет прорыв для рабочих презентаций. Мой совет: всегда проверяйте сгенерированные движения, часто бывают неестественные рывки.