От автора: это серия постов – попытка ответить на вопрос, что ждёт SEO-аффилиатов в ближайшем будущем. Если ты здесь впервые: пролог, часть 1 , часть 2.
В «Дивном новом мире» людей с рождения распределяли по кастам – от альфы до эпсилона. Каста определяла всё: какую работу ты получишь, с кем будешь общаться, на что имеешь право претендовать. Никто не выбирал свою касту – систему просто проектировали так.
AI Mode проектирует точно такую же систему. Только не для людей, а для источников информации.
Если резюмировать предыдущие посты серии: чтобы закрыть интент пользователя, Google больше не нужно перебирать тонны контента на сторонних сайтах – сегодня он может воспроизвести ответ не хуже любого эксперта. Вопрос только в одном: насколько валидны данные, на которые он при этом опирается.
Валидный контент раскладывается на три составляющих – релевантность, достоверность, объективность, в порядке понижения ресурсоёмкости. Релевантность теперь закрывает LLM. А вот достоверность и объективность – это совсем другая история, потому что галлюцинации остаются бичом любой gen AI системы.
Как это устроено технически?
Под каждый запрос AI Mode собирает mini-RAG на лету, и дальше Q&A происходит по данным внутри этого корпуса. Качество mini-RAG, в свою очередь, зависит от достоверности корпуса данных и от так называемого grounding. С его помощью ответ должен быть «заземлён» на конкретные источники, а не сгенерирован из общей памяти модели.
Если совсем просто:
– корпус данных – это библиотека;
– RAG – система, которая ищет нужные страницы в этой библиотеке и отдаёт их модели;
– grounding – это то, что заставляет модель отвечать по найденным страницам, а не из общей памяти.
Grounding – прямая связь с цитируемостью. И вот почему цитирование – это не опция, а обязательная часть архитектуры.
Если AI всё переписывает, суммирует и интерпретирует из нескольких источников – кто отвечает, когда переписанное оказывается ложью? У Google по сути один выход: сослаться на первоисточник. С одной стороны, цитирование закрывает вопрос достоверности и объективности для пользователя. С другой – это юридический щит: при ошибке в ответе ответственность «заземлена» на авторе контента, а не на Google.
Продолжение ниже👇
