Post #606 7.3K Apr 3, 2023, 02:53 UTC #AI工程1984年出生的女性软件工程师使用内存映射mmap的方式大幅降低本地运行LLaMa 所需的内存量。🖥 Github运行LLaMa 30B 现在只需要5.8G 内存,单机跑大模型门槛越来越低。-- 来源 👍 74 ❤ 9 🤯 7 👏 4 🥰 1