TGViewer
very vibe coding very vibe coding @veryvibecoding · 120 subscribers
Post #1270 37

Forwarded from эйай ньюз

Bonsai Image 4B — чудеса квантизации

Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.

Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.

Инференс в браузере
Веса

@ai_newz
More from @veryvibecoding
  1. Sep 28, 2026Хуанг красавец. Кто-то торгует страхом, а кто-то продолжает продавать лопаты. Вообще на ст…
  2. Sep 28, 2026Маркетинг страха.. Хороший ярлык, все-таки любят китайцы заморачиваться с тем, чтобы всему…
  3. Sep 27, 2026железа пока нет - два мини по 16гб. сейчас как пойдут новые, куплю, наверное под квен 27б…
  4. Sep 27, 2026Прохожу курс детокса от Антропика, использую в качестве основной модели GPT. Впечатления с…
  5. Sep 27, 2026Кстати, в OpenCode GO обещают на подписке за $10 раздать DeepSeek и другие похожие модельк…
  6. Sep 27, 2026Недолго музыка играла - новый бан от Антропика получил на следующем сообщении после того,…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →