Liquid AI представила компактную модель LFM2.5-VL-450M для edge-устройств.
Компания Liquid AI выпустила модель LFM2.5-VL-450M. Это vision-language модель, созданная специально для работы на edge-устройствах.
Она обрабатывает изображения размером 512×512 пикселей примерно за 240 миллисекунд прямо на устройстве, без необходимости подключения к облачным сервисам. Такая производительность позволяет анализировать видео поток с частотой около 4 кадров в секунду, обеспечивая не просто детекцию объектов, но и понимание происходящего в кадре.
Ключевое преимущество модели в том, что один проход инференса заменяет собой традиционную сложную связку детектор, классификатор и эвристики. Весь многоэтапный пайплайн выполняется за один раз.
В новой версии добавлены функции предсказания ограничивающих рамок (bounding box prediction) с показателем 81.28 на датасете RefCOCO-M, мультиязычная визуальная обработка, поддерживающая 8 языков, и возможность function calling.
Модель демонстрирует работоспособность на таких устройствах, как NVIDIA Jetson Orin, смартфон Samsung S25 Ultra и компьютерах с видеокартой AMD Radeon RX 395 и старше.
Веса модели являются открытыми. Ознакомиться с демо можно на Hugging Face.

