TGViewer
MrGips • Про LLM MrGips • Про LLM @procomfy · 2.18K subscribers
Post #100 2.51K
MTP или Multi-Token Prediction - это сейчас обсуждают все любители локальных LLM.

Проще говоря это ускоритель для вашей локальной модели, в моем случае Qwen 3.6 - 27b Q6_K_XL. Было 45 т/с - стало 75-80 т/с.

В этом видео я протестировал новинку:
https://youtu.be/IMOXiSjXKHo

Пишите свое мнение в комметарии. А также подписывайтесь на НАШ ЧАТ, где народ делится интересными промтами.

Приятной генерации и быстрых токенов!
YouTube Qwen3.6 : 27B - MTP - ускорение в 2 раза на RTX 5090 В этом видео хочу протестировать новую технологию MTP (Multi-Token Prediction) при которой модель учится предсказывать сразу несколько следующих слов (токенов) за один шаг, а не только одно, как это делалось раньше. Тестировать буду в llama.cpp на модели…
  • 👍 9
  • 🔥 5
More from @procomfy
  1. Sep 26, 2026Honda Accord созданный Opus 5.5 В комментариях под последним видео люди просили посмотреть…
  2. Sep 25, 2026НОВОЕ ВИДЕО! Claude Opus 5.5 VS GPT-6 Sol - Тест в Blender с реф. изображениями и чертежам…
  3. Sep 25, 2026Зачем платить за Photoshop, когда его можно просто навайбкодить? Увидел на реддите пост, г…
  4. Sep 23, 2026Тест с пеликаном на велосипеде вышел на новый уровень На реддит увидел эксперимент, где па…
  5. Sep 22, 2026Alibaba анонсировала Qwen 4 На конференции Apsara алибабаевцы анонсировали Qwen 4. Пока эт…
  6. Sep 21, 2026Чуть потестил Qwen Image 2.1 Вроде неплохо. Правда долговато генерит конврот. Боюсь предст…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →