Автоматически имитирует поведение реального браузера, маскирует TLS-отпечаток, поддерживает прокси и сразу предоставляет удобные инструменты для парсинга HTML.
⚡️ Работает почти как обычный
requests — менять код практически не нужно.🛡 Маскирует запросы под Chrome или Safari, используя современные техники обхода детектирования.
🔄 Автоматически повторяет запросы при ошибках вроде 429, 503 и других временных ограничениях.
Сам извлекает:
* заголовок страницы;
* описание;
* автора;
* ссылки;
* изображения;
* email;
* HTML-таблицы;
* номера телефонов и д.р.
🧠 Может сразу преобразовать HTML в Markdown, а также вернуть готовый объект BeautifulSoup или lxml для дальнейшего парсинга.
🚀 Есть поддержка AsyncIO, прокси и сессий.
⚙️ Простая установка
pip install stealth_requests
▶️ Примеры использования
Обычный GET-запрос:
import stealth_requests as requests
resp = requests.get("https://example.com")
print(resp.status_code)
print(resp.text)
Использование сессии:
from stealth_requests import StealthSession
with StealthSession() as session:
resp = session.get("https://example.com")
Получить метаданные страницы:
print(resp.meta.title)
print(resp.meta.description)
print(resp.meta.author)
Получить все ссылки:
print(resp.links)
Получить email-адреса:
print(resp.emails)
Конвертировать страницу в Markdown:
markdown = resp.markdown()
Асинхронные запросы:
from stealth_requests import AsyncStealthSession
async with AsyncStealthSession() as session:
resp = await session.get("https://example.com")
💻 Для тех, кто занимается веб-скрейпингом, мониторингом сайтов или пишет парсеры на Python, Stealth-Requests может стать отличной заменой обычному
requests: минимум изменений в коде, встроенная маскировка под браузер и множество полезных инструментов для работы с HTML «из коробки».♎️ GitHub/Инструкция
😳 Лайф | 📲 Зеркало Max
#python #soft #github
