Обычный поиск через API отдаёт агенту десять ссылок. Ответа в них нет, поэтому дальше агент лезет на пять-семь сайтов, качает HTML, чистит его от меню и баннеров, тащит в контекст всё полученное. На части сайтов ловит 403 и идёт к следующему.
Коллеги из поиска Яндекс.Поиска написали и попросили добавить в мой скилл инфоконтексты — как раз чтобы этот кусок работы исчез. Сделал, потестировал, погонял на боевых задачах.
🔍 Что за инфоконекст вообще такой?
Инфоконтекст — фрагмент найденной страницы примерно на 500 токенов, релевантный запросу. Потолок по документации — 2 048 токенов на документ и до 20 документов на запрос.
💎 Это дословная выдержка из документа. Её можно цитировать и на неё можно ссылаться — ровно то, ради чего в RAG обычно городят отдельный слой парсинга.
Варианты сценария: агент ищет товар, сразу видит цены нужных образцов и решает, стоит ли вообще идти на сайт.
Ну или если надо попросить Claude ходить на всякие
gov.ru сайты.💰 По деньгам всё дорого, но не в стиле Сбера
Синхронный поиск стоит
488 ₽ за тысячу запросов, с инфоконтекстами — 1 500 ₽. Короче плюс рубль на один поиск.За этот рубль на поиск агент не делает пять-семь заходов на страницы. Двадцать выдержек — около 10 000 токенов на двадцать источников, столько же обычно съедают три-четыре выкачанные целиком страницы. Плюс нет ожиданий на
fetch и нет ошибок 403.У соседей по рынку:
🔸 Perplexity Search API — $5 за тысячу, около 430 ₽, причём до пяти запросов пакуются в одну единицу тарификации. Выгоднее.
🔸 Tavily с извлечением контента — $16 за тысячу, около 1 370 ₽ — то же самое.
Яндекс дороже Perplexity и на уровне с Tavily. Зато поиск по российкому индексы: российские законы, госуслуги, региональные цены и локальные магазины Яндекс будет искать заметно меньше.
📐 Когда рубль не надо платить
Правило, к которому я пришёл: агент отвечает на вопрос — инфоконтексты включаем. Агент собирает таблицу позиций сайта — отложенный режим и никаких выдержек. Мониторим сайты конкурентов: тоже отключаем расширенный контекст.
В зарубежных поисках расширенные снипеты пока не работают, так что для турецкого индекса (я не знаю где ещё яндекс активно работает) включать его не надо.
🧹 Хак, который применил в скилле, и не только в этом
20 выдержек по 500 токенов — это около 10 000 токенов на один поиск. Печатать такое в stdout нельзя.
🔑 Инструмент агента пишет объём в файл, а в stdout отдаёт индекс: строка на документ. Дальше агент читает файл целиком или грепает нужный источник.
Делаю так для любого инструмента, который может вернуть много текста: поиск, логи, дампы базы.
Скилл лежит в репозитории, инфоконтексты включены по умолчанию, выключаются флагом
--no-snippets. В SKILL.md про это написал. Весь мой каталог скиллов: https://github.com/artwist-polyakov/polyakov-claude-skills/Расскажите, какие сервисы используете для добавления поисковых сервисов своим агентам?
----
Поляков считает — AI, код и кейсы
