Модели доступны на Hugging Face с поддержкой vLLM, SGLang и Ollama на оборудовании NVIDIA, AMD и Cerebras. IFM также предоставляет предобученные корпуса, промежуточные чекпоинты, код обучения и конфигурации.
В линейке реализованы технологии MoVA (Mixture-of-Value Attention) для расширения разреженности на слои внимания и Uno (LoRA-адаптер) для ускорения декодирования в ~3 раза без потери качества. IFM провела аудит на reward hacking, скорректировав точность модели 375B-A23B с 70.2% до 66.9%.