Crawler.
Отправляйте URL, получайте данные, асинхронно и в любом масштабе.
Отправляйте миллионы URL в управляемую очередь push/pull, построенную на Crawling API, и получайте отрендеренные данные на свой вебхук или в облачное хранилище.
Никаких очередей, повторных попыток или прокси для запуска.
Отправьте URL. Получите доставленные данные.
Crawler в действии, вживую. Отправьте URL в очередь, затем получите отрендеренный результат на свой вебхук. Наведите курсор, чтобы приостановить и прочитать.
Краулинг в любом масштабе, очереди включены.
Всё, что делает крупные краулинги сложными, выполняется за вас: асинхронная очередь, повторные попытки, доставка и мониторинг, всё поверх Crawling API.
Асинхронные push и pull
Отправляйте столько URL, сколько хотите, и продолжайте работу. Crawlbase помещает их в очередь, планирует и рендерит в фоновом режиме, поэтому ваш клиент никогда не блокируется.
Построен на Crawling API
Сохраняется каждая функция Crawling API: рендеринг JavaScript, резидентные прокси, геотаргетинг, параметры и обход анти-бот-защиты в каждом запросе.
Доставка через вебхук
Направьте краулер на ваш эндпоинт, и каждый результат отправляется на него. Crawlbase следит за вашим вебхуком, чтобы доставка оставалась точной и надёжной.
Облачное хранилище
Предпочитаете получать данные по запросу? Храните каждую собранную страницу в облачном хранилище Crawlbase и забирайте её по собственному расписанию. Смотреть Cloud Storage.
Настраиваемые краулеры, живая статистика
Задайте имя краулеру для каждой задачи и наблюдайте за ним в реальном времени. Проверяйте статистику через API, приостанавливайте или возобновляйте работу в соответствии с вашим бюджетом.
Свежие данные, меньше повторных попыток
Каждая страница собирается вживую, ничего не кэшируется. Система push/pull повышает успешность почти до 100%, поэтому повторные попытки на стороне клиента практически исчезают.
Миграция в два дополнительных параметра.
Сохраните свои вызовы Crawling API. Добавьте колбэк и имя краулера, и вы работаете асинхронно.
Создайте краулер
Откройте панель Crawler, создайте именованный краулер и направьте его на ваш вебхук или облачное хранилище.
Отправьте URL
Вызовите Crawling API с callback=true и crawler=YourCrawlerName, для одного URL или миллионов.
Мы ставим в очередь и рендерим
Crawlbase планирует каждый запрос, ротирует резидентный прокси, рендерит страницу и повторяет любые неудачные попытки.
Доставьте результат
Каждая отрендеренная страница отправляется на ваш вебхук или записывается в облачное хранилище, в виде HTML или структурированного JSON.
Получайте и отслеживайте
Забирайте данные из хранилища, когда они готовы, и отслеживайте каждый краулер вживую, с приостановкой и возобновлением по требованию.
Что команды строят на Crawler.
Миллионы страниц
Отправьте целые каталоги или карты сайтов и позвольте очереди обработать их, без планирования на стороне клиента.
Данные в вашем стеке
Доставляйте отрендеренные страницы прямо на вебхук или в хранилище, готовые для вашего хранилища данных, индекса или модели.
Непрерывный мониторинг
Повторно собирайте цены, наличие и товарные позиции по расписанию, со свежими данными на каждом проходе.
Корпуса для обучения и RAG
Создавайте большие, чистые наборы страниц для обучения и поиска, забирая их из хранилища массово.
Уйдите от собственного краулера
Замените свою систему push/pull на нашу с помощью двух параметров и откажитесь от прокси, очередей и повторных попыток.
Миллионы сайтов
Собирайте данные с миллионов поддерживаемых сайтов с одним краулером и одним токеном.
Добавьте сайты, которые вы собираете, и посмотрите цену.
Добавьте сайты, которые вы собираете, с их месячным объёмом и типом запроса. Мы группируем их по сложности и типу, затем рассчитываем цену для каждой группы по её суммарному объёму, поэтому чем больше вы собираете, тем дешевле выходит.
Пока нет сайтов. Добавьте один выше, чтобы начать оценку.
До 10,000 запросов бесплатно. Без кредитной карты.
Начать бесплатноСобираете более 1B в месяц? Свяжитесь с нами →Полезно знать.
Тестируйте бесплатно
До 10,000 запросов бесплатны, без кредитной карты. Один и тот же токен работает с Crawler, Crawling API и каждым скрапером.
Ценообразование по использованию
Платите за то, что собираете, без долгосрочных контрактов, отмена в любое время. Приостанавливайте и возобновляйте работу в соответствии с вашим бюджетом. Смотрите полную разбивку на странице с ценами.
Полностью документировано
Создание краулеров, колбэки и доставка полностью описаны в документации Crawler, с готовыми примерами для копирования.
Соответствие GDPR и CCPA
Crawlbase применяет стандарты защиты потребителей по всему миру, с заложенными в обработку данных принципами справедливости и прозрачности.
Создан для краулинга веба в любом масштабе.
Crawler работает в той же сети, что обслуживает более 70,000 разработчиков и самые требовательные краулинговые задачи в мире. Никаких очередей для запуска, никаких прокси для покупки, ничего не нужно патчить, когда сайт меняется.
Один токен для Crawler, Crawling API и каждого скрапера, с доставкой на ваш вебхук или в хранилище.
Вопросы о Crawler.
Собирайте веб асинхронно.
Отправляйте URL, мы доставляем данные.
Бесплатно для старта, до 10,000 запросов. Один токен для Crawler, Crawling API и каждого скрапера.