Модель имеет 19 миллиардов параметров и работает с текстом, изображениями, видео и управлением роботами в одной нейросети. В отличие от большинства систем, она использует один общий контекстный контейнер для всех задач без вызова внешних моделей. Модель генерирует непрерывное видео в реальном времени и может реагировать на новые команды без перезапуска. Для управления роботами используется обратная динамика, извлекающая сигналы управления из обычных интернет-видео. Обучение длилось около трёх месяцев на 320 GPU H100.
Ранее, в апреле 2024 года, компания выпустила мультимодальную языковую модель Reka Core.