Alibaba перевела генеративную видеомодель Wan 3.0 в стадию публичного бета-тестирования. По сравнению с версией 2.5 максимальная длительность создаваемого ролика выросла вдвое — до 30 секунд, а в функционал добавили автоматическую оптимизацию времени рендеринга и инструмент продления клипов. Однако ключевым нововведением для корпоративных сценариев стала не сама продолжительность видео, а работа со сложными входными данными: модель способна напрямую обрабатывать PDF-файлы, веб-страницы и презентации PPTX, одновременно принимая до 10 изображений, 5 видеофрагментов и 5 аудиодорожек в рамках одного запроса.

За счет параллельного парсинга структурированных документов и медиафайлов Wan 3.0 устраняет узкое горлышко в корпоративном конвейере генерации контента. Модель сокращает ручной труд при переносе данных из спецификаций продуктов и обучающих презентаций в готовые видеоролики без необходимости использовать сторонние сервисы раскадровки. В Alibaba утверждают, что архитектура новинки предотвращает искажения интерфейсов и потерю консистентности персонажей между сценами благодаря жесткой фиксации базовой геометрии и ключевых объектов.

Коммерческий доступ к нейросети уже открыт на портале wan.video, платформе Alibaba Cloud Model Studio и через API Qwen Cloud в стандартной версии и низколатентном тарифе Prime. Продвижение инструмента в сферах корпоративного обучения, маркетинга и симуляции данных для робототехники стало для Alibaba проверкой бизнес-модели: на фоне 75-процентного падения квартальной операционной прибыли из-за растущих расходов на инфраструктуру холдингу крайне необходимы B2B-инструменты видеогенерации, способные приносить реальную выручку от корпоративного ПО.

Генеративный ИИИИ в бизнесеАвтоматизацияОблачные вычисленияAlibaba