TGViewer
эйай ньюз эйай ньюз @ai_newz · 97.2K subscribers
Post #1969 22.5K
Ничего особенного. Просто LLaMa.cpp на 7 млрд параметров работает со скоростью 40 токенов/сек на MacBook с чипом M2 Max.

Это стало возможным после недавного обновления репозитория от Герганова, где он полностью реализовал инференс моделей на Metal GPU (это специальный ускоритель на новых чипах Apple). Мы видим 0% CPU утилизации, и загрузку всех 38 Metal ядер. Поистине искусный инженер от народа!

От себя добавлю, что очень хочу увидеть будущее, где у каждого локально бегает своя персонализированная LLM-ка, помогающая в рутинных делах. Это называется модулярностью. Огромную модель тренируют централизовано, а далее каждый пользователь легко и быстро (мы к этому стремися) ее дошлифовывает на своих персональных данных и крутит только локально.

@ai_newz
  • 🔥 371
  • 👍 54
  • ❤ 21
  • 💯 11
  • 🤯 6
  • 👎 2
More from @ai_newz
  1. Oct 7, 2026OpenAI дропнули 722 пейпера по математике Это результат попытки OpenAI решить 4000 открыты…
  2. Oct 6, 2026Mistral выпустили Le Chaton Fat Le Chonk Mistral Large 4 это модель на триллион параметров…
  3. Oct 6, 2026OpenAI начала вводить вотермарки для текста Пока что это опция для API, которую можно добр…
  4. Oct 5, 2026Google урежут бесплатный Gemini до Flash-Lite С 9 октября в приложении Gemini начнут убира…
  5. Oct 5, 2026Почему роботов учат в симуляторах Собирать данные на реальных роботах дорого и долго. Симу…
  6. Oct 5, 2026Нейродайджест за неделю (#133) LLM - DevDay OpenAI — OpenAI представила постоянно работающ…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →