TGViewer
Derp Learning Derp Learning @derplearning · 13.9K subscribers
Post #5191 3.78K

Forwarded from эйай ньюз

Bonsai Image 4B — чудеса квантизации

Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.

Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.

Инференс в браузере
Веса

@ai_newz
  • 🔥 34
  • 👍 3
More from @derplearning
  1. Sep 27, 2026Ии начинает маскироваться под людей! Сегодня ставишь ты em dash, а завтра Дарио продашь!
  2. Sep 27, 2026photo post
  3. Sep 27, 2026И снова китайцы радуют ai peakом Plants vs zombies Им там сиденс по карточкам что ли выдаю…
  4. Sep 26, 2026photo post
  5. Sep 26, 2026https://t.me/kuhlaikari/3616 алайнмент моделей дает свои плоды
  6. Sep 25, 2026It is Wednesday my dudes Без прочего контекста модели отвечают определенным образом, если…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →