Так много незнакомых слов! Спешим на помощь с расширенным выпуском Технословаря.
🟣 Согласование — направление в разработке ИИ, когда нейросетям стараются привить человеческие ценности. Другими словами: «воспитание» модели, чтобы она не вредила, не врала и понимала, чего от неё хотят, а не исполняла команды буквально.
🟣 RAG — Retrieval-Augmented Generation, генерация с внешними знаниями. Метод, когда модель перед ответом ищет информацию во внешней базе знаний, а затем пишет ответ с опорой на найденное, а не только на обучающие данные.
🟣 MoE — Mixture of Experts, смесь экспертов. Архитектура, при которой внутри одной большой нейросети есть много специализированных подсетей, и для каждого запроса активируется только их часть. Позволяет делать модели намного быстрее и экономичнее почти без потери качества.
🟣 RLHF — Reinforcement Learning from Human Feedback, обучение с подкреплением на основе человеческой обратной связи. Метод дообучения LLM, когда люди оценивают ответы нейросети, на которых та начинает лучше понимать, какой ответ правильней и больше соответствует запросу. Иногда для оценки тренируют отдельную нейросеть-«судью», которая заменяет человека в RLHF.
🟣 Дистилляция — способ упаковать навыки большой нейросети в более компактную форму. Работает так: большая модель решает задачи, а маленькая модель учится подражать её ответам. Это позволяет сделать нейросеть, которая тратит меньше ресурсов и работает быстрее, а качество ответов на большинстве задач не снижается или падает незначительно.
Подписывайтесь 👉 @techno_yandex
Post #5208
14.4K
ТЕХНО: Яндекс про технологии

- 👍 50
- ❤ 23
- 🔥 8