Как пролезть в ответы Perplexity AI и почему эта штука не вычитывает страницу целиком
Автор замесил 20 промптов через Perplexity API, каждый по три повтора — на выходе 60 ответов. Дальше взял каждую сноску [N] и сшил предложение из ответа с той страницей, откуда оно приползло. А потом для пары «предложение ответа — страница источника» рылся в HTML в поисках куска, максимально близкого к тому, что говорит ответ. Итог: из 1355 отсылок 948 вели на страницы, которые ещё открываются, и на 448 из них обнаружился пассаж — абзац, пункт списка или ячейка таблицы, — который накрывает хотя бы треть слов утверждения.
Главное для тех, кто пишет страницы: на сработавшей странице медианно вкатываются два пассажа из 85, где-то по 49 слов штука. В штуках это 2%, в словах побольше — медиана 6,4% текста страницы, среднее 11,6%. Короче, залетевший пассаж длиннее обычного. Так что готовиться надо не к тому, что кто-то прочтёт всю простыню, а к тому, что из неё выдернут один самодостаточный абзац. Что это значит для конкретного текста — разжёвано в разделе про работу с Perplexity, он торчит в середине, до разбора ошибок в коде. А границы, за которыми эти цифры перестают работать, вынесены отдельно — и там же сказано, как прогнать ту же проверку по своей нише.
С чего всё началось: в логе замера видно, какие URL Perplexity суёт в источники. А вот что именно уехало со страницы в ответ — весь текст, абзац или одна строчка списка — не видно от слова совсем.
Читать далее
👉 Telegram | Max
Post #5944
1.1K

- ❤ 1