Mellum2.1 — это модель с архитектурой, не изменившейся по сравнению с Mellum2, улучшение которой достигнуто за счёт обучения с подкреплением в реальных программных средах. Модель доступна на Hugging Face под лицензией Apache 2.0 и может работать на собственных GPU через vLLM или SGLang.
В бенчмарках Mellum2.1 обходит Mellum2 по 15 из 17 показателей и Qwen3.5-9B по 5 из 17. Лучший результат — 82.0 на LiveCodeBench v6, худший — 17.4 на Terminal-Bench 2.1. GGUF-версия модели весит от 7.0 GB.