Вайб-кодинг 13.08.2026 05:08
Liquid AI выпустила лёгкую и быструю зрительно-языковую модель LFM2.5-VL-3B.
Зрительная модель всего на 3 млрд параметров, которая обгоняет модели более чем вдвое крупнее и при этом работает прямо на Galaxy S26 Ultra со скоростью около 20 токенов в секунду.
LFM2.5-VL-3B умеет работать с мобильными, веб- и настольными интерфейсами, читать экраны, документы и изображения из реального мира, а также точно привязывать объекты к координатам.
На ScreenSpot-v2 модель набирает 80,7 против 51,2 у Gemma-4-E4B.
При этом она превосходит заметно более крупные модели в задачах по интерфейсам, привязке объектов и распознаванию текста.
На M5 Max скорость достигает 228 токенов в секунду, а для работы требуется всего около 3 ГБ памяти.
Модель уже доступна на Hugging Face:
https://huggingface.co/LiquidAI/LFM2.5-VL-3B
#vk_feedЗрительная модель всего на 3 млрд параметров, которая обгоняет модели более чем вдвое крупнее и при этом работает прямо на Galaxy S26 Ultra со скоростью около 20 токенов в секунду.
LFM2.5-VL-3B умеет работать с мобильными, веб- и настольными интерфейсами, читать экраны, документы и изображения из реального мира, а также точно привязывать объекты к координатам.
На ScreenSpot-v2 модель набирает 80,7 против 51,2 у Gemma-4-E4B.
При этом она превосходит заметно более крупные модели в задачах по интерфейсам, привязке объектов и распознаванию текста.
На M5 Max скорость достигает 228 токенов в секунду, а для работы требуется всего около 3 ГБ памяти.
Модель уже доступна на Hugging Face:
https://huggingface.co/LiquidAI/LFM2.5-VL-3B
Комментарии (0)
Пока нет комментариев. Будьте первым!