Компания Cursor выложила в открытый доступ исходный код Mixture-of-Kittens (MoK), представляющего собой «мегаядро» для обучения моделей типа Mixture-of-Experts (MoE) на серверных стойках Nvidia GB300 NVL72. По данным самой компании, MoK обеспечивает ускорение работы до 2.37 раза по сравнению с лучшими публичными решениями и увеличил сквозную скорость обучения на 41%, поднимая показатель с 761 до 1070 токенов в секунду на одну видеокарту.
На данном ядре Cursor уже проводит обучение своей модели Composer, используя десятки тысяч графических процессоров.