TGViewer
я так понимаю, Роман Васильев я так понимаю, Роман Васильев @ravasiliev_ch · 3.29K subscribers
Post #142 3.01K
Въезжаем в ИИ в 2026. Часть 1. Терминология (1/2)

Наконец-то дошли руки завершить первый полноценный пост из серии!
В качестве вводной хочется зафиксировать базовую терминологию, которой будем пользоваться дальше. Без этого любые разговоры про ИИ очень быстро превращаются в спор людей, которые говорят о разном, но одинаковыми словами

Общие термины

AGI (Artificial General Intelligence) - гипотетический общий интеллект уровня человека, способный решать любые задачи лучше человека. Когда-то считалось, что если компьютер обыграет человека в шахматы, то это уже своего рода AGI 🙂

ИИ (искусственный интеллект) - Область компьютерных наук. Состоит из классического ML (предсказательные модели, статистика, оптимизация) и Deep Learning (нейросети). ИИ - надмножество, а не синоним нейросетей или LLM.

Machine Learning (ML) - Методы, которые учатся на данных и делают предсказания. Большая часть ML не имеет отношения к генерации и существовала задолго до нейросетевого бума.

Deep Learning (DL) - Подраздел ML, основанный на многослойных нейросетях.
Идеи нейросетей активно изучались ещё в 60–80-х (в том числе в СССР), но реальный прорыв случился после ~2012 года из-за роста вычислительных ресурсов, GPU и больших датасетов.

Трансформеры - Архитектура нейросетей, позволившая обрабатывать весь контекст целиком, а не последовательно. Представлена в 2017 году. Именно масштабируемость трансформеров напрямую привела к появлению LLM.

Механизм внимания (Attention) - Механизм внутри трансформеров, позволяющий модели самой определять, какие части данных важнее. Ключевой эффект - возможность обучения на сырых, неструктурированных данных. Представлен в 2017 в статье "Attention is all you need” как основа трансформеров.

Языковые модели

Токен - Базовая единица, с которой работает языковая модель. Фактически это кусок текста (часть слова, символ или несколько символов). Модель оперирует последовательностями токенов, именно на них часто появляются лимиты

LLM (Large Language Models) - Класс моделей внутри DL, оптимизированных под предсказание следующего токена. Генерация текста, кода и рассуждений происходит как последовательное предсказание токен за токеном

GPT (Generative Pre-trained Transformer) - Семейство LLM на архитектуре трансформеров. Обучается генерировать текст, предсказывая следующий токен на основе предыдущих. За счёт такого подхода одна и та же модель может писать текст, код и вести диалог

BERT (Bidirectional Encoder Representations from Transformers) - семейство языковых моделей на трансформерах, обученных понимать текст, а не генерировать его. Хорошо подходит для классических NLP-задач: поиска, классификации, извлечения сущностей. В проде его часто дообучают под конкретные задачи

Продукты и их сравнения

ChatGPT / DeepSeek / Gemini / Grok / Perplexity
Семейства языковых моделей. Внутри каждого — большое количество версий.
Все построены на трансформерах, но отличаются конкретной архитектурой, объёмом и составом обучающих данных, способом дообучения и продуктовой обёрткой.
Про то, где именно они реально отличаются и почему, поговорим отдельным постом

Alice AI / GigaChat
Российские LLM-продукты, оптимизированные под собственные экосистемы (Яндекс / Сбер) и локальный рынок, в первую очередь - под язык

Агенты - Надстройка над LLM, при которой модель не просто отвечает на запрос, а планирует действия, вызывает инструменты, проверяет результат и может работать в несколько шагов. Используются для автоматизации и сложных сценариев

n8n - Один из самых популярных инструментов оркестрации. Используется для сборки автоматизаций, пайплайнов и агентных цепочек вокруг LLM без написания большого количества кода

Бенчмарки - Наборы тестов для сравнения языковых моделей между собой. Измеряют отдельные навыки (код, рассуждения, знания). Фан-факт: один из популярных бенчмарков называется Last Human Exam.
  • ❤ 35
  • 🔥 14
  • 👍 9
  • 😱 3
  • ❤‍🔥 2
More from @ravasiliev_ch
  1. Sep 19, 2026И немного фоточек/видео по мотивам школы!
  2. Sep 19, 2026🏫 Как я был директором ШАРа 2026 Яндекс каждый год проводит летние школы по разным профес…
  3. Aug 11, 2026👀 Про аналитическую насмотренность Больше года назад на одной из моих лекций в ШАРе молод…
  4. Jul 28, 2026🏆 Преподавание ML студентам очно в Москве Знаю, что этот канал читают многие мои выпускни…
  5. May 26, 2026📺 Аузан про образование в эпоху ИИ Посмотрел классный монолог Александра Аузана, декана э…
  6. May 24, 2026Сходил в гости в Доверительный интервал 🙂 Получилось 49 минут разговоров про аналитику с…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →