Словарь ИИ сленга 1
Бывает читаешь статью или пост от реальныого эксперта, и ничерта не понимаешь в этих нейронках. Давайте разбираться, что же значат все эти странные слова, чтобы не потеряться в этом ИИ безумии. Погнали!
▪️LLM (Large Language Model) — Большая языковая модель. Это мощный ИИ, обученный на огромных массивах текста, который умеет генерировать осмысленные ответы, писать статьи, решать логические задачи или мимикрировать под заданную роль. Очень важно здесь, что это всего лишь модель (!), которая не имеет воли, мотивов и целей. Это модель представления о том, как все устроено, почерпнутая из огромного количества текстов. Когда мы к ней обращаемся через промпт, то модель начинает генерировать ответ. ChatGPT, Gemini, Claude, LLama, Mistral и прочие – это LLM. Важно не путать LLM (текствые модели) с другими генеративными моделями, типа Midjourney (картинки), Suno (музыка) или Kling (видео).
▪️Промпт (Prompt) — запрос или инструкция, который вы даёте генеративному ИИ, чтобы он сгенерировал ответ. Это может быть вопрос, фраза или чётко структурированный текст, по типу программного скрипта, написанного естественным языком. Промпт задает контекст и направление, по которому модель начинает "думать". Чем точнее и понятнее сформулирован промпт, тем лучше и релевантнее будет ответ.
▪️Системный промпт (System Prompt) — это скрытая от пользователя инструкция, задающая роль, определенный стиль поведения и рамки ответа перед началом основной генерации. В отличие от обычного промпта, который видит пользователь, системный промпт скрыт и используется для настройки базового контекста модели: как ей отвечать (формально, дружелюбно, кратко), какую роль играть (например, эксперт, учитель, консультант) и на что делать акцент. Системный промпт применяется для создания агентов и ботов на основе LLM.
▪️GenAI (Generative AI) — сокращение от "Генеративный ИИ", это общее название для технологий, которые используют модели ИИ для создания нового контента: текста, изображений, музыки, видео или кода. GenAI обучаются на огромных наборах данных и генерирует уникальные результаты на основе своего представления (модели мира) о том, что было в промпте.
▪️Генерация (Generation) — это процесс создания картинки, видео или текста моделью ИИ на основе заданного промпта. В момент генерации модель старается передать своё представление о том, что было задано в промпте. Генерация может происходить в режиме реального времени, где каждое следующее слово «подбирается» в зависимости от контекста и настроек модели, таких как температура и окна контекста. Чем лучше настроена генерация, тем осмысленнее и полезнее будет ответ.
▪️Токен (Token) — это кусочек текста (семантическая единица), из которых LLM собирает ответы. Могут быть отдельными словами, буквами, знаками препинания, пробелами или частями слов. Примерно в 100 токенах содержится от 50 до 70 слов (зависит от языка и алгоритма токенизации, который применяется при обучении модели). Пример: в английском “don’t” представляет 1 токен, а в русском “не делай” - 2 токена.
▪️Температура (Temperature) — настройка, которая определяет креативность ответа. Чем выше температура, тем более креативный и непредсказуемый будет ответ. Дефолтное значение температуры 1. Если температуру понизить до 0, то ответ будет очень сухим и шаблонным, если поднять выше единицы – получится белиберда.
▪️Окно контекста (Context Window) — это объем текста, который LLM видит и хранит в оперативной памяти одновременно, чтобы дать осмысленный ответ. Чем больше окно, тем более сложные запросы может обработать модель, удерживая "в памяти" больше информации. Короткое окно контекста приводит к тому, что в определённый момент вашего диалога с LLM модель “забудет начало” разговора и начнёт выдавать неточные ответы. Поэтому очень важно не засылать в LLM огромные документы с большим количеством текста. Она просто не запомнит все, а только начало и конец текста – остальное будет выдумывать на ходу.
В следующей части разберемся с новой порцией терминов, чтобы стать сыном маминой подруги в мире ИИ
@aimastersme | instagram
Post #204
1.13K

- ❤ 22
- 👍 3