Собрал
snitchmd, потому что дергать контент для LLM всё ещё больно.curl приносит HTML-шум или пустой каркас после JS-рендера. Claude Code идёт в web_fetch, получает примерно нихуя и начинает искать контент страницы в поисковиках, хотя URL уже был дан руками.Потом выясняется, что сайт сидит за Cloudflare, reCAPTCHA или похожей проверкой, и простая задача превращается в пляски выбора между Playwright, прокси, платным Tavily и одноразовым скрейпером.
snitchmd https://www.cloudflare.com/paypercrawl-signup/ --favor-precision
На входе URL. На выходе чистый Markdown в stdout, который сразу уходит в промпт, заметку или RAG-пайплайн.
Под капотом
CloakBrowser рендерит страницу и проходит антиботные проверки. rs-trafilatura вычищает контент до Markdown, сверху маленький Docker wrapper.Для кривых страниц и чуть более тонкой работы есть ручки
--wait, --wait-for-selector, --favor-precision, --favor-recall, --json, --html-output.Одна тупая и простая команда, которая закрывает кучу моих кейсов.
PS Звездочек накидайте пожалуйста в репу :)
