Crawler.
Отправляйте URL, получайте данные, асинхронно и в любом масштабе.
Отправляйте миллионы URL в управляемую очередь push/pull, построенную на Crawling API, и получайте отрендеренные данные на свой вебхук или в облачное хранилище.
Никаких очередей, повторных попыток или прокси для запуска.
Отправьте URL. Получите доставленные данные.
Crawler в действии, вживую. Отправьте URL в очередь, затем получите отрендеренный результат на свой вебхук. Наведите курсор, чтобы приостановить и прочитать.
Краулинг в любом масштабе, очереди включены.
Всё, что делает крупные краулинги сложными, выполняется за вас: асинхронная очередь, повторные попытки, доставка и мониторинг, всё поверх Crawling API.
Асинхронные push и pull
Отправляйте столько URL, сколько хотите, и продолжайте работу. Crawlbase помещает их в очередь, планирует и рендерит в фоновом режиме, поэтому ваш клиент никогда не блокируется.
Построен на Crawling API
Сохраняется каждая функция Crawling API: рендеринг JavaScript, резидентные прокси, геотаргетинг, параметры и обход анти-бот-защиты в каждом запросе.
Доставка через вебхук
Направьте краулер на ваш эндпоинт, и каждый результат отправляется на него. Crawlbase следит за вашим вебхуком, чтобы доставка оставалась точной и надёжной.
Облачное хранилище
Предпочитаете получать данные по запросу? Храните каждую собранную страницу в облачном хранилище Crawlbase и забирайте её по собственному расписанию. Смотреть Cloud Storage.
Настраиваемые краулеры, живая статистика
Задайте имя краулеру для каждой задачи и наблюдайте за ним в реальном времени. Проверяйте статистику через API, приостанавливайте или возобновляйте работу в соответствии с вашим бюджетом.
Свежие данные, меньше повторных попыток
Каждая страница собирается вживую, ничего не кэшируется. Система push/pull повышает успешность почти до 100%, поэтому повторные попытки на стороне клиента практически исчезают.
Миграция в два дополнительных параметра.
Сохраните свои вызовы Crawling API. Добавьте колбэк и имя краулера, и вы работаете асинхронно.
Создайте краулер
Откройте панель Crawler, создайте именованный краулер и направьте его на ваш вебхук или облачное хранилище.
Отправьте URL
Вызовите Crawling API с callback=true и crawler=YourCrawlerName, для одного URL или миллионов.
Мы ставим в очередь и рендерим
Crawlbase планирует каждый запрос, ротирует резидентный прокси, рендерит страницу и повторяет любые неудачные попытки.
Доставьте результат
Каждая отрендеренная страница отправляется на ваш вебхук или записывается в облачное хранилище, в виде HTML или структурированного JSON.
Получайте и отслеживайте
Забирайте данные из хранилища, когда они готовы, и отслеживайте каждый краулер вживую, с приостановкой и возобновлением по требованию.
Что команды строят на Crawler.
Миллионы страниц
Отправьте целые каталоги или карты сайтов и позвольте очереди обработать их, без планирования на стороне клиента.
Данные в вашем стеке
Доставляйте отрендеренные страницы прямо на вебхук или в хранилище, готовые для вашего хранилища данных, индекса или модели.
Непрерывный мониторинг
Повторно собирайте цены, наличие и товарные позиции по расписанию, со свежими данными на каждом проходе.
Корпуса для обучения и RAG
Создавайте большие, чистые наборы страниц для обучения и поиска, забирая их из хранилища массово.
Уйдите от собственного краулера
Замените свою систему push/pull на нашу с помощью двух параметров и откажитесь от прокси, очередей и повторных попыток.
Миллионы сайтов
Собирайте данные с миллионов поддерживаемых сайтов с одним краулером и одним токеном.
One rate card, shared with every product.
Crawler pushes bill exactly like Crawling API requests: the same credits on the same ladder, with async delivery and retries included.
Only successful requests are billed, and rates fall as volume grows. Optional subscriptions from $99 / mo. Start free with up to 5,000 requests, no credit card.
Полезно знать.
Тестируйте бесплатно
До 5,000 запросов бесплатны, без кредитной карты. Один и тот же токен работает с Crawler, Crawling API и каждым скрапером.
Ценообразование по использованию
Платите за то, что собираете, без долгосрочных контрактов, отмена в любое время. Приостанавливайте и возобновляйте работу в соответствии с вашим бюджетом. Смотрите полную разбивку на странице с ценами.
Полностью документировано
Создание краулеров, колбэки и доставка полностью описаны в документации Crawler, с готовыми примерами для копирования.
Соответствие GDPR и CCPA
Crawlbase применяет стандарты защиты потребителей по всему миру, с заложенными в обработку данных принципами справедливости и прозрачности.
Создан для краулинга веба в любом масштабе.
Crawler работает в той же сети, что обслуживает более 70,000 разработчиков и самые требовательные краулинговые задачи в мире. Никаких очередей для запуска, никаких прокси для покупки, ничего не нужно патчить, когда сайт меняется.
Один токен для Crawler, Crawling API и каждого скрапера, с доставкой на ваш вебхук или в хранилище.
Вопросы о Crawler.
Собирайте веб асинхронно.
Отправляйте URL, мы доставляем данные.
Бесплатно для старта, до 5,000 запросов. Один токен для Crawler, Crawling API и каждого скрапера.