Не просто ещё одна Python-библиотека для парсинга страниц. Это — адаптивная экосистема, которая не ломается от первого же апдейта сайта и умеет самостоятельно находить ваши данные, даже если структура DOM поменялась.
🚫 Забудьте про бесконечный ребейз селекторов, бессмысленные переписывания парсеров и костыли на продакшене.
Scrapling — это:
✔️ Python-фреймворк от одного запроса до масштабного краулера.
✔️ Адаптивный парсер, который «понимает» изменения DOM.
✔️ Мощный набор инструментов для обхода анти-бота и динамического контента.
✔️ Библиотека, которую можно запустить в пару строк кода и она работает.
⚙️ Простая установка:
pip install scrapling
😰 Минимальный пример на Python
from scrapling.fetchers import StealthyFetcher
page = StealthyFetcher.fetch("https://example.com", headless=True)
titles = page.css(".post-title", adaptive=True).getall()
print(titles)
🪄 Адаптивные селекторы
Scrapling может обучить ваш парсер тому, как выглядят нужные элементы, и повторно находить их, даже если сайт их перемещает или перестраивает.
🕸 Обход анти-ботов и динамики
Умеет обходить защиту сайтов (например, Cloudflare Turnstile) из коробки, а также загружать страницы через полноценный браузер (Playwright).
⚡️ Spider-фреймворк с паузами/возобновлением
Может работать как полноценный краулер с:
* параллельными сессиями
* автоматической ротацией прокси
* возможностью паузы и продолжения
* статистикой в реальном времени — и всё это без тонны кода.
♎️ GitHub/Инструкция
#python #soft #github
