ITNEWS.pro
25 августа 2026 в 06:55
Подписаться
Alibaba научила нейросеть снимать кино из презентаций PowerPoint

Alibaba выпустила видеомодель Wan3.0, которая собирает готовый ролик длиной до 30 секунд, используя не только текстовое описание, но и напрямую обрабатывая документы, таблицы, презентации и веб-страницы. Загружаешь квартальный отчет или PDF с описанием презентации, а на выходе получаешь готовый рекламный ролик с озвучкой.

Компания объявила о планах вложить не менее $53 млрд за три года в облачные вычисления и ИИ-инфраструктуру, а капитальные расходы компании за прошедший финансовый год выросли с примерно $11,8 млрд до $17,7 млрд. Генеративное видео требует несопоставимо больше вычислительных мощностей, чем текстовые модели, поэтому запуск такого продукта без параллельного вложения в «железо» попросту не имеет смысла. Alibaba очень логично выстраивает эту связку: чем больше денег в инфраструктуру, тем быстрее и мощнее модели, тем сильнее позиции компании в конкуренции с американскими платформами вроде Veo от Google.

Технически Wan3.0 — не революция, а третий заметный шаг в серии моделей, которую Alibaba развивает несколько лет. Предыдущая версия, Wan2.5, уже умела генерировать звук вместе с видео в одном проходе, а не накладывать его поверх готовой картинки. Благодаря обучению на аудиовизуальных данных модель попадала в синхронизацию губ и естественно вписывала фоновые шумы. Wan3.0 удвоила длину клипа по сравнению с предшественницей (раньше — 15 секунд, теперь до 30) и добавила прием, которого не было ни у одного массового конкурента: понимание составных бизнес-документов как творческого материала. Вместо тщательно составленного текстового промта пользователь скармливает модели презентацию или таблицу — и получает видео, которое сохраняет детали персонажей, расположение объектов в кадре и плавность движения на протяжении всего ролика.

Для авторов, которые уже работают с ИИ-генерацией видео, Wan3.0 в первую очередь — не про творческие эксперименты, а про скорость превращения готового рабочего материала в контент: презентация для инвесторов, каталог товаров или сценарий ролика становится исходником для видео без промежуточного этапа написания промта.

Воспользоваться моделью можно или на популярных агрегаторах нейросетей для генерации видео и фото, или на сайте wan.video.

Подписывайся на наш Telegram и не пропусти главные новости!