Crawlee: современный краулер для Node.js и Python
Crawlee — open-source библиотека краулинга от команды Apify: очереди, браузеры, ретраи. Когда брать Crawlee вместо «голого» Playwright.
Читать →
Crawlee — open-source библиотека краулинга от команды Apify: очереди, браузеры, ретраи. Когда брать Crawlee вместо «голого» Playwright.
Читать →
Apify — платформа для запуска парсеров (Actors) в облаке: маркетплейс, расписание, хранение датасетов. Когда брать Apify вместо своего сервера.
Читать →
Octoparse — desktop/cloud no-code парсер. Разбираем сильные стороны для e-com и маркетинга, лимиты и когда переходить на код.
Читать →
ParseHub — визуальный инструмент для парсинга сайтов без кода. Когда он ускоряет запуск, где упирается в лимиты и когда нужен кастомный стек.
Читать →
Cheerio — быстрый парсер HTML в Node.js без браузера. Когда его хватает вместо Puppeteer и как стыковать с HTTP-клиентом.
Читать →
Selenium для парсинга через браузерные драйверы. Где он уместен в 2026, чем слабее Playwright и когда лучше не строить скрейпер на Selenium.
Читать →
Puppeteer управляет Chromium из Node.js для парсинга SPA. Сравниваем с Playwright и Selenium, плюсы экосистемы и когда лучше другой инструмент.
Читать →
Playwright — автоматизация браузера для парсинга динамических сайтов. Когда он нужен вместо Scrapy, чем отличается от Puppeteer и Selenium.
Читать →
Beautiful Soup — библиотека для разбора HTML/XML в Python. Когда её хватает, как связать с requests и когда нужен Scrapy или Playwright.
Читать →
Scrapy — Python-фреймворк для масштабного парсинга: очереди, ретраи, пайплайны. Разбираем, когда он нужен и когда хватит Beautiful Soup или Playwright.
Читать →