Kandinsky WM 1.0

Kandinsky WM 1.0 — семейство открытых image‑to‑video моделей для Physical AI. Модели получают первый кадр и текстовое описание, а затем генерируют физически правдоподобное продолжение сцены. Семейство предназначено для автономного транспорта, робототехники и сцен со сложной физикой.

В основе семейства лежит Kandinsky 5.0 Video Lite — диффузионная видеомодель на 2 миллиарда параметров.

4PAI-Bench-GВнутренняя валидация
5Physics-IQ Verified
6RBench

Текущие модели

Автономный транспорт

Предназначена для автономного транспорта. Она продолжает дорожные сцены с учётом направления движения, геометрии автомобилей, сигналов светофора, пешеходов и сложных ситуаций на дороге. Для её обучения использовалось 1,5 миллиона видеопримеров из мультикамерных записей, собранных в разных странах, городах и погодных условиях.

1,5 млн видеопримеровмультикамерные записиразные погодные условия

Робототехника

Предназначена для робототехники. Она генерирует продолжение сцен с роботами и манипуляторами, включая захват и перемещение объектов, бытовые задачи и длинные последовательности действий. Модель обучена на 2,2 миллиона видео с разными роботизированными платформами, ракурсами и типами задач.

2,2 млн видеоразные роботизированные платформы

Сложная физика

Предназначена для сцен со сложной физикой. Она генерирует движение людей, взаимодействие объектов, жидкости, деформации, разрушения, механические и индустриальные процессы. Для обучения использовалось 1,6 миллиона тщательно отфильтрованных и вручную отобранных видео.

движение людей и жидкостидеформации и разрушенияиндустриальные процессы