TGViewer
Вайб-кодинг по Чуйкову | Ментор Вайб-кодинг по Чуйкову | Ментор @vibe_coding · 6.78K subscribers
Post #523 2.18K
Apple становится лучшей техникой для запуска локальных моделей

Почему так? Ollama переехал на MLX.

MLX — фреймворк от Apple для работы с нейросетями. Главная фишка: CPU, GPU и Neural Engine работают с единой памятью.

Решил протестировать на своём Mac Studio M2 Max, 32 Гб оперативки.

Пока что портировали только одну модель: qwen3.5:35b-a3b-coding-nvfp4.

На скринкасте можете увидеть метрики скорости. Скорость генерации — стабильные 54–55 токенов в секунду.

Что по кодингу

Запустил минималистичный кодинг-агент Pi на этой модели, дал простые задачки.

Удивился — насколько быстро и неплохо он их закрывал.

Но при достижении ~50% (70к из 128к) контекстного окна качество заметно падало.

Тем не менее — это уже достаточно сильный буст по сравнению с прошлым годом.
  • 👏 10
  • 🔥 7
  • 🎉 2
More from @vibe_coding
  1. Sep 21, 2026Две бесплатные открытые альтернативы Grok Bot Я тут кайфанул от нового юзер экспириенса ра…
  2. Sep 20, 2026За 1 день закончились недельные лимиты в Codex за 200$, доплатил кредитами 20$, хватило на…
  3. Sep 16, 2026Нашел +1 причину перейти на терминальный Claude Code с десктопного. Оказывается десктоп ве…
  4. Sep 14, 2026Делюсь полезными халявными находками! Нашел дешевые +1 номера, сработало подтверждение ном…
  5. Sep 10, 2026Ребят, я тут планирую интеграцию Lovarus внешними CRM. Какие сейчас в РФ рынке в топе, что…
  6. Sep 10, 2026Тестирую новую Image модель от OpenAI. Они и раньше были крутыми. Не чувствую сильно уже р…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →