TGViewer
Vingrig Vingrig @vingrigstudio · 514 subscribers
Post #215 281
LLaMA
Большая языковая модель, выпущенная Meta AI в феврале 2023 года. Были обучены модели различных размеров в диапазоне от 7 до 65 миллиардов весов.

В гите переписанная однофайловая Rust-реализация Llama2. Изначально это был Rust-порт llama2.c от Karpathy, но теперь в нем появилось больше функций, позволяющих масштабировать его до 70B:

Поддержка 4-разрядного GPT-Q квантования
Поддержка группового внимания к запросам (требуется для крупных лам)
Сопоставление памяти, загружает 70B мгновенно.
Статические проверки размера, никаких указателей

https://github.com/srush/llama2.rs
GitHub GitHub - srush/llama2.rs: A fast llama2 decoder in pure Rust. A fast llama2 decoder in pure Rust. . Contribute to srush/llama2.rs development by creating an account on GitHub.
More from @vingrigstudio
  1. Oct 6, 2026я никогда не любил верстать, но это... Мы с каждым днем, в вебе, теряем ориентиры. Какие ш…
  2. Sep 23, 2026Господи, какую имбу я сегодня случайно узнал. Если у вас, как и у меня, почта на гмаиле, и…
  3. Sep 21, 2026Я после разговора про генную инженерию понял одну интересную вещь. Когда слышишь «генная и…
  4. Sep 17, 2026Мозг Дрозофилы в Unity Собрал эксперимент: мозг мухи дрозофилы играет в игру. Видео прилож…
  5. Sep 16, 2026Свободное время Уже долгое время как заметил за собой такую вещь. Когда-то я думал, что де…
  6. Sep 3, 2026Ищу ui/ux дизайнера преимущественно который понимает особенности ios разработки ну и конеч…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →