TGViewer
Вайб-кодинг Вайб-кодинг @vibecoding_tg · 63.1K subscribers
Post #3678 23.4K
Liquid AI выпустила лёгкую и быструю зрительно-языковую модель LFM2.5-VL-3B.

Зрительная модель всего на 3 млрд параметров, которая обгоняет модели более чем вдвое крупнее и при этом работает прямо на Galaxy S26 Ultra со скоростью около 20 токенов в секунду.

LFM2.5-VL-3B умеет работать с мобильными, веб- и настольными интерфейсами, читать экраны, документы и изображения из реального мира, а также точно привязывать объекты к координатам.

На ScreenSpot-v2 модель набирает 80,7 против 51,2 у Gemma-4-E4B.

При этом она превосходит заметно более крупные модели в задачах по интерфейсам, привязке объектов и распознаванию текста.

На M5 Max скорость достигает 228 токенов в секунду, а для работы требуется всего около 3 ГБ памяти.

Модель уже доступна на Hugging Face:

https://huggingface.co/LiquidAI/LFM2.5-VL-3B
More from @vibecoding_tg
  1. Sep 26, 2026На Hugging Face вышла Qwen-Image-2.1-viggle-turbo v0.2. Она поддерживает генерацию по текс…
  2. Sep 26, 2026Claude Code теперь не будет резко обрывать работу, если 5-часовой лимит закончится прямо п…
  3. Sep 25, 2026Полезное на ночь: Docker выпустила первые официальные навыки для ИИ-агентов, которые работ…
  4. Sep 25, 2026Последний месяц би лайк:
  5. Sep 25, 2026Odyssey обучила модель мира на Diablo II. 😁 Под капотом вообще нет игрового движка. ИИ ге…
  6. Sep 25, 2026«Передумал», «Не буду оплачивать», «Давайте добавим ещё задач» — такие ситуации проще обсу…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →