TGViewer
Зингер42. ИИ для бизнеса Зингер42. ИИ для бизнеса @izinger42 · 1.75K subscribers
Post #313 603
Неожиданное решение)
Ребята из https://taalas.com/ придумали как запечь LLM модель в кремний.

Это дало увеличение производительности более чем в 70 раз по сравнению с NvidiaH200.

Ну понятно что вы можете испольщовать только ту модель которая "упакована в этом чипе", что казалось бы огранчение), но
1. Ребята обещают что цикл от выпуска модели до перво чипа - 60 (!) дней!
2. Чип поддерживает LoRA, один из вариантов файнтьюнинга (адаптации) модели.
3. Т.к. модель по сути является не софтом а уже железом, вам не нужно ее хранить в памяти, что с учетом стоимости памяти невероятно круто.
4. Очень низкая задержка (менее 1 миллисекунды, энергоэффективность)
5. В команде всего 24 инженера.

Ну, пушка-бомба.
  • 🔥 11
  • ❤ 2
  • 👻 2
  • 🦄 2
More from @izinger42
  1. Sep 23, 2026Кажется, у меня в компании стало слишком много сотрудников Причем никто из новичков не ход…
  2. Sep 18, 2026Из последнего, может кому пригодится. Расставание с сотрудником, который настроил Агентов…
  3. Sep 15, 2026Полгода назад один мой хороший друг из Казахстана обратил мое внимание на методику OKR. Фу…
  4. Sep 11, 2026Шикарно) особенно когда дипсик пересылал запросы в Клод) ну и про иранский вайбкодинг)
  5. Sep 11, 2026Антропики выкатили жирнющий отчёт о использовании Клода с декабря 2025 по август 2026. Есл…
  6. Sep 8, 2026Недели три назад перестала работать ЮтубМузыка в доме, настройки роутера не менял. Оказыва…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →