TGViewer
MLTimes MLTimes @mltimesofficial · 2.49K subscribers
Post #3055 698
Intel опустила вес тернарных LLM ниже 1,58 бита

Intel предложила BITCOS: формат хранит тернарные веса LLM в двух массивах — карте нулей и знаках остальных значений. На модели с 51,48% нулей расход снизился до 1,485 бита на вес без учета масштабов.

В тестах авторов декодирование в vLLM ускорилось максимум в 1,18 раза на CPU и в 1,27 раза на GPU. Переобучать модель не нужно, но выигрыш зависит от железа: на восьмиядерном Lunar Lake ускорения не получили. Работа пока опубликована только как препринт.

🔗 Читать: https://mltimes.ai/intel-opustila-ves-ternarnyh-llm-nizhe-1-58-bita/
  • 👍 2
More from @mltimesofficial
  1. Sep 24, 2026Gemini 4 приближается к запуску: Google хочет выпустить модель задолго до конца года Googl…
  2. Sep 24, 2026Учёные ООН: люди могут потерять контроль над ИИ-агентами Научная группа ООН заявила: гаран…
  3. Sep 23, 2026OpenAI призвала установить глобальные правила для самообучающегося ИИ OpenAI призвала стра…
  4. Sep 22, 2026OpenAI заявила о решении более 100 открытых задач новой ИИ-моделью OpenAI приписывает ново…
  5. Sep 22, 2026Alibaba представила ускоритель V900 и архитектуру для кластеров на 500 тысяч чипов Alibaba…
  6. Sep 22, 2026Ошибочный отчёт ИИ едва не привёл США к атаке на китайское судно Чат-бот сообщил американс…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →