Cloud Storage.
Каждое сканирование сохранено, ничего не запрашивается повторно.
Добавьте store=true к любому сканированию, и Crawlbase сохранит отрендеренную страницу, JSON и скриншоты в облаке.
Получайте по RID, выполняйте полнотекстовый поиск и обойдитесь без базы данных, бакета S3 и резервных копий.
Сохраняйте одним флагом. Получайте по RID.
Cloud Storage, набранное вживую. Сохраните сканирование одним параметром, а затем получите его позже по его RID. Наведите курсор, чтобы приостановить и прочитать.
Хранилище, созданное для сканирований.
Сохраняйте, находите и загружайте собранные данные, не разворачивая собственное хранилище.
Сохранение одним флагом
Добавьте store=true к любому вызову Crawling API или направьте Crawler в облачное хранилище, и отрендеренная страница сохранится автоматически.
Получение по RID
Каждое сохранённое сканирование получает RID. Отправьте GET-запрос с ним, и страница вернётся напрямую, без повторного сканирования.
Полнотекстовый поиск
Ищите по всему, что вы просканировали, чтобы найти именно нужные страницы, вместо того чтобы просматривать собственную базу данных.
Страницы и скриншоты
Храните отрендеренный HTML, структурированный JSON и полностраничные скриншоты вместе, всё доступно по одному и тому же RID.
Масштабирование берём на себя
Crawlbase управляет масштабированием, резервным копированием и очисткой вашего пространства, так что вы можете отказаться от бакета S3 и обслуживания.
Цель вебхука Crawler
Используйте хранилище как цель доставки для асинхронного Crawler, чтобы крупные сканирования приходили готовыми к загрузке.
Один флаг для сохранения, один вызов для загрузки.
Оставьте своё сканирование как есть. Добавьте параметр для сохранения и GET для получения.
Добавьте store=true
Сканируйте любой URL с store=true или задайте облачное хранилище как цель вебхука вашего Crawler.
Мы сохраняем и индексируем
Отрендеренная страница, JSON и скриншот сохраняются и индексируются для полнотекстового поиска, с масштабированием на нашей стороне.
Сохраните RID
В ответе возвращается RID хранилища, который однозначно идентифицирует только что сохранённую вами страницу.
Получайте или ищите
Отправьте GET на эндпоинт хранилища с RID, ищите по своим сканированиям или загружайте из консоли.
Что команды хранят в Cloud Storage.
Буфер для вашего стека
Размещайте просканированные страницы в хранилище и загружайте их в своё хранилище данных, индекс или модель по своему собственному расписанию.
Снимки во времени
Сохраняйте каждое сканирование, чтобы сравнивать страницу за разные даты без повторного сканирования.
Поиск по вашим сканированиям
Выполняйте полнотекстовый поиск по всему сохранённому, чтобы найти именно нужные страницы и поля.
Откажитесь от собственного хранилища
Уберите бакет S3 и базу данных. Хранилище масштабируется, делает резервные копии и очищается само.
Корпуса для обучения и RAG
Создавайте и заново загружайте большие, чистые наборы страниц для обучения и извлечения прямо из хранилища.
Доставка через Crawler
Сочетайте хранилище с Crawler, чтобы высоконагруженные асинхронные сканирования приходили готовыми к получению.
One rate card, shared with every product.
Storage bills from the same balance as your crawls: half a credit keeps a page stored for a month, with no database to run.
Only successful requests are billed, and rates fall as volume grows. Optional subscriptions from $99 / mo. Start free with up to 5,000 requests, no credit card.
Хранилище, которое вам не нужно обслуживать.
Cloud Storage работает в той же сети, что обслуживает более 70,000 разработчиков. Не нужно разворачивать S3, делать резервные копии базы данных или что-либо очищать, когда оно заполнится.
Добавьте store=true один раз, и каждое сканирование будет сохранено, проиндексировано и готово к загрузке.
Вопросы о Cloud Storage.
Сохраняйте каждую страницу, которую сканируете.
Обойдитесь без базы данных.
Free to begin, no credit card. One balance across Cloud Storage and every product.