TGViewer
Pragmatic ML Pragmatic ML @pragmaticml · 393 subscribers
Post #12 810
Я потихоньку копаю историю про затачивание LLM-ок под свои задачи, желательно с инференсом на ноутбуке/смартфоне. Очень зацепила история про то, как дообучать большие модели меньшими ресурсами.
Собственно, про LoRa и QLoRa сейчас из каждого утюга, я вам принес разбор первой.
LoRA (Low-Rank Adaptation of Large Language Models) — это один из способов дообучать любую большую модель меньшим ресурсом (впрочем, можно применять и для большой линейной регрессии). Активно используется в файнтюнинге LLM-ок и диффузионных моделей. К тому же это прекрасное обобщение самой идеи дообучения моделей, ведь, если сложить все шаги градиентного спуска в процессе, мы получим такого же размера матрицу, агрегирующую все изменения.
Ссылка на статью
Мой разбор
Telegraph LoRa Допустим, вы хотите дообучить GPT-2 на Q&A вашего продукта. В стандартном сетапе DDP + mixed precision(fp16|fp32) вам понадобится как минимум V100 32Gb. А что если у меня есть только 4070 дома? Тут нам на помощь и приходит LoRa. Есть предположение, что изменение…
  • 🔥 10
  • ⚡ 1
  • ❤ 1
  • 🥴 1
  • 🍓 1
More from @pragmaticml
  1. Feb 13, 2024Cloudflare — пример того, как нужно решать вопросики. Даже за вычетом их крутых продуктов,…
  2. Feb 3, 2024В одной из первых домашек курса Efficient Deep Learning Systems предлагается порешать мале…
  3. Feb 2, 2024На фоне того, что Цукерберг скупает сотни H100 для обучения новых версий LLama, все осталь…
  4. Jan 31, 2024Наверное, стоит отдельно рассказать про топ 1 решение Kaggle соревы из поста выше. Не буду…
  5. Jan 31, 2024Про аугментации. Я довольно давно не копался в CV. Последнее, что я помнил — albumentation…
  6. Jan 30, 2024Про бенчмарки загрузки png картинок. Ужасно сгорел, перебирая разные способы загрузки png…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →