Въезжаем в ИИ в 2026. Часть 1. Терминология (1/2)
Наконец-то дошли руки завершить первый полноценный пост из серии!
В качестве вводной хочется зафиксировать базовую терминологию, которой будем пользоваться дальше. Без этого любые разговоры про ИИ очень быстро превращаются в спор людей, которые говорят о разном, но одинаковыми словами
Общие термины
AGI (Artificial General Intelligence) - гипотетический общий интеллект уровня человека, способный решать любые задачи лучше человека. Когда-то считалось, что если компьютер обыграет человека в шахматы, то это уже своего рода AGI 🙂
ИИ (искусственный интеллект) - Область компьютерных наук. Состоит из классического ML (предсказательные модели, статистика, оптимизация) и Deep Learning (нейросети). ИИ - надмножество, а не синоним нейросетей или LLM.
Machine Learning (ML) - Методы, которые учатся на данных и делают предсказания. Большая часть ML не имеет отношения к генерации и существовала задолго до нейросетевого бума.
Deep Learning (DL) - Подраздел ML, основанный на многослойных нейросетях.
Идеи нейросетей активно изучались ещё в 60–80-х (в том числе в СССР), но реальный прорыв случился после ~2012 года из-за роста вычислительных ресурсов, GPU и больших датасетов.
Трансформеры - Архитектура нейросетей, позволившая обрабатывать весь контекст целиком, а не последовательно. Представлена в 2017 году. Именно масштабируемость трансформеров напрямую привела к появлению LLM.
Механизм внимания (Attention) - Механизм внутри трансформеров, позволяющий модели самой определять, какие части данных важнее. Ключевой эффект - возможность обучения на сырых, неструктурированных данных. Представлен в 2017 в статье "Attention is all you need” как основа трансформеров.
Языковые модели
Токен - Базовая единица, с которой работает языковая модель. Фактически это кусок текста (часть слова, символ или несколько символов). Модель оперирует последовательностями токенов, именно на них часто появляются лимиты
LLM (Large Language Models) - Класс моделей внутри DL, оптимизированных под предсказание следующего токена. Генерация текста, кода и рассуждений происходит как последовательное предсказание токен за токеном
GPT (Generative Pre-trained Transformer) - Семейство LLM на архитектуре трансформеров. Обучается генерировать текст, предсказывая следующий токен на основе предыдущих. За счёт такого подхода одна и та же модель может писать текст, код и вести диалог
BERT (Bidirectional Encoder Representations from Transformers) - семейство языковых моделей на трансформерах, обученных понимать текст, а не генерировать его. Хорошо подходит для классических NLP-задач: поиска, классификации, извлечения сущностей. В проде его часто дообучают под конкретные задачи
Продукты и их сравнения
ChatGPT / DeepSeek / Gemini / Grok / Perplexity
Семейства языковых моделей. Внутри каждого — большое количество версий.
Все построены на трансформерах, но отличаются конкретной архитектурой, объёмом и составом обучающих данных, способом дообучения и продуктовой обёрткой.
Про то, где именно они реально отличаются и почему, поговорим отдельным постом
Alice AI / GigaChat
Российские LLM-продукты, оптимизированные под собственные экосистемы (Яндекс / Сбер) и локальный рынок, в первую очередь - под язык
Агенты - Надстройка над LLM, при которой модель не просто отвечает на запрос, а планирует действия, вызывает инструменты, проверяет результат и может работать в несколько шагов. Используются для автоматизации и сложных сценариев
n8n - Один из самых популярных инструментов оркестрации. Используется для сборки автоматизаций, пайплайнов и агентных цепочек вокруг LLM без написания большого количества кода
Бенчмарки - Наборы тестов для сравнения языковых моделей между собой. Измеряют отдельные навыки (код, рассуждения, знания). Фан-факт: один из популярных бенчмарков называется Last Human Exam.
Post #142
3.01K
- ❤ 35
- 🔥 14
- 👍 9
- 😱 3
- ❤🔥 2