TGViewer
Гостев из будущего Гостев из будущего @gostev_future · 1.41K subscribers
Post #212 760
Google представил TurboQuant — алгоритм сжатия, который уменьшает потребление памяти в больших языковых моделях.

Акции производители памяти припали: SanDisk −5.7%, Micron −3%, Western Digital −4.7%, Seagate −4%.

Что такое TurboQuant?

TurboQuant сжимает KV-кэш — временную память, в которой LLM хранит контекст разговора — до 3 бит без потери точности. Это даёт 6-кратное уменьшение размера памяти и до 8-кратное ускорение на GPU H100. KV-кэш — главное узкое место при инференсе: чем длиннее контекст, тем больше памяти нужно.

Меньше памяти нужно моделям → меньше чипов покупают Micron, Samsung, SK Hynix. Cloudflare CEO Matthew Prince назвал это «DeepSeek-моментом Google» — по аналогии с тем, как DeepSeek показал, что можно делать мощные модели дешевле.

@gostev_future
  • 👍 6
More from @gostev_future
  1. Sep 25, 2026Если посмотреть на маркетплейсы, можно решить, что мы наконец дожили до момента, когда мож…
  2. Sep 24, 2026Сегодня «Коммерсантъ» со ссылкой на экспертно-аналитический центр InfoWatch сообщил нескол…
  3. Sep 24, 2026Вчера Гайка Митич и Бойка Двачич снимали сюжет «Очумелые ручки» «Школьники и роботы». Гума…
  4. Sep 23, 2026На прошлой неделе обнаружилась биолаборатория Anthropic, на этой неделе у лаборатории уже…
  5. Sep 22, 2026Помните исследование о том, как ИИ играет в Civilization? А вот мой однофамилец Питер Гост…
  6. Sep 20, 2026Я уже писал о недавнем аресте австралийца Рубена Томсона из TeamPCP, который, при всех сво…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →