Liquid AI представила LFM2.5-8B-A1B: компактную MoE-модель для ноутбуков и смартфонов.
Liquid AI представила LFM2.5-8B-A1B, языковую MoE-модель на 8 млрд общих и 1 млрд активных параметров, предназначенную для инференса на ноутбуках, смартфонах и поддерживающую логический вывод по умолчанию.
Релиз продолжает линейку LFM2 и развивает вышедшую в октябре 2025 года LFM2-8B-A1B. Окно контекста расширено с 32 до 128 тысяч токенов, объём предобучения увеличен с 12 до 38 трлн токенов, а поверх добавлено крупномасштабное обучение с подкреплением.
Словарь токенизатора удвоен с 65,5 до 128 тыс. единиц. В Liquid AI отмечают, что это повышает эффективность обработки нелатинских письменностей: для русского языка примерно на 6%, а для тайского и хинди — кратно.
Скорость и работа с инструментами
Особый акцент разработчики делают на скорости и вызове инструментов. Согласно проведённым измерениям, на чипе Apple M5 Max модель выдаёт до 253 токенов в секунду, укладываясь в 6 ГБ памяти. На смартфоне производительность достигает около 30 токенов в секунду.
По результатам бенчмарков, в тестах на следование инструкциям и в агентных сценариях LFM2.5-8B-A1B сопоставима с заметно более крупными моделями, такими как Gemma-4-26B, при значительно меньшем числе активных параметров.
Поддержка и доступность
- Заявлена поддержка llama.cpp, MLX, vLLM, SGLang и ONNX Runtime.
- Лицензирование: LFM Open License.
- Ссылки: Блогпост, Документация, Веса на Hugging Face, Демо.

