В России выпустили ИИ-модели для обучения роботов

Российские разработчики выпустили семейство генеративных моделей для создания синтетических видео, которые можно использовать при обучении роботов, беспилотного транспорта и промышленных систем.

В России выпустили ИИ-модели для обучения роботов
© Российская Газета

Модель опубликовали в открытом доступе, разрешив разработчикам бесплатно использовать и дорабатывать ее.

Семейство Kandinsky WM 1.0 создано на базе облегченной модели генерации видео и дополнительно обучено на нескольких миллионах записей с камер роботов, беспилотных автомобилей и промышленных объектов. Использованная в его основе видеомодель, по заверениям авторов проекта, насчитывает 2 млрд параметров.

Система создает ролики продолжительностью около пяти секунд. В них могут быть показаны захват и перемещение предметов, перестроение автомобиля, проезд перекрестка или отдельные этапы производственного процесса. Такие материалы предназначены в том числе для отработки редких и опасных ситуаций, которые трудно воспроизвести в реальных условиях: аварий, экстремальной погоды и отказов оборудования.

Чтобы повысить физическую достоверность видео, разработчики применили обучение с подкреплением. Специальные модели оценивали сохранение формы объектов, геометрию сцены и естественность движения, после чего результаты использовались как обратная связь при дообучении.

Разработка относится к направлению Physical AI, или физического ИИ. Такие системы должны воспринимать окружающую среду, учитывать ее изменения и управлять реальными устройствами. Одной из основных проблем в этой области остается нехватка открытых видеоданных: их сбор требует техники, датчиков, операторов и контролируемых условий.

В дальнейшем такие технологии планируется развивать в сторону моделей мира, способных моделировать изменение сцены во времени и использоваться при обучении и тестировании роботов. Сроки появления следующего поколения моделей не названы.