"Во-первых, выбор оператора сайта не случаен. В большинстве случаев он, по-видимому, преследует четкую цель: сужение информационного пространства в сторону релевантных и заслуживающих доверия источников.
Преобладание брендированных доменов свидетельствует о том, что модель часто хорошо понимает, какие собственные источники релевантны для данного запроса. В то же время, небрендированные источники предоставляют дополнительный контекст, при этом такие платформы, как Reddit и Trustpilot, играют значительную роль в областях, где важны мнения сообщества, отзывы и внешняя проверка.
Ещё одно важное открытие — различие между корневыми доменами и конкретными URL-путями. Корневые домены в основном связаны с более широкими информационными потребностями, в то время как URL-пути появляются, когда модели требуется более точная информация, например, сведения о продукте или ценах.
В целом, эти закономерности указывают на то, что разветвление поисковых запросов не просто генерирует множество поисковых запросов. Вместо этого, они, по-видимому, отражают структурированную стратегию поиска, в которой системы искусственного интеллекта объединяют собственные источники, внешнюю проверку и все более точное таргетирование в зависимости от намерений пользователя."
В сухом остатке – цитирования ChatGPT все больше достаются небольшой группе конкретных брендов типа Reddit или Trustpilot и все меньше менее "кошерным" ресурсам.