TGViewer
AI Dev Broadcast AI Dev Broadcast @ai_dev_broadcast · 2.39K subscribers
Post #201 2.44K
Почему самая маленькая квантизированная модель оказалась медленнее — разбор на бенчмарках

Chris Merrick прогнал MobileNetV2 в трёх квантизациях (FP32/INT8/INT4) на Pixel 10. Результат - самая лёгкая по весу INT4 на CPU оказалась медленнее INT8. Вывод: размер файла не главный критерий быстродействия.

Полезно, если делаешь on-device inference и оптимизируешь модели под мобилки.

#AI #Android #OnDeviceAI
  • 👍 6
  • 👎 5
More from @ai_dev_broadcast
  1. Sep 23, 2026https://youtu.be/32zpk7tqs0M Запись доклада уже доступна на ютубе! Напомню, что я сравнил…
  2. Sep 23, 2026Post #271
  3. Sep 22, 2026❤️ Яндекс открыл претрейн, который учили с нуля - AliceAI-Foundation-80B-A3B-Base Сразу ст…
  4. Sep 22, 2026⚡️⚡️AI-агент съел токены и потерял контекст. Что делать? Разберемся на Mobius 2026 Autumn.…
  5. Sep 21, 2026🤯 Вышла Grok 4.7 Модель прокачали во всем по сравнению с Grok 4.6 и соперничает с Fable 5…
  6. Sep 18, 2026AGENTS.md теперь поддерживается в Claude Code 🤯 Дарио уже не тот #ClaudeCode
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →