Скрапинг: страницы book на goodreads.com
Запрос, который сегодня возвращает страницы book с goodreads.com, с параметрами, шаблонами и типами ошибок из лога запросов с 14 Aug 2026.
Измерено на Crawlbase
Доля успеха по каждому запросу каждого аккаунта за August 2026: 99.4%. Шаблоны, страны и сбои взяты из лога запросов с 14 Aug 2026; 97.5% успешных вызовов использовали JavaScript-токен, медианный ответ занял 10.0s.
Среди 3 сайтов категории книги и аудио в Cookbook goodreads.com занимает 2 место из 3 по доле успеха; медиана категории 99.4%. Его медианный ответ 10.0s на уровне медианы категории 10.0s. 1 из 3 принимают обычный токен; этому сайту нужен JavaScript-токен.
Вызов
Страницы товаров здесь запрашивают чаще всего, со страной и токеном, которые успешны чаще всего. Замените путь-заполнитель настоящим URL товара с сайта.
curl "https://api.crawlbase.com/?token=YOUR_JS_TOKEN&url=https%3A%2F%2Fwww.goodreads.com%2Fbook%2Fexample-page%2Fexample-page"from crawlbase import CrawlingAPI api = CrawlingAPI({'token': 'YOUR_JS_TOKEN'}) r = api.get('https://www.goodreads.com/book/example-page/example-page') html = r['body']
const { CrawlingAPI } = require('crawlbase'); const api = new CrawlingAPI({ token: 'YOUR_JS_TOKEN' }); const r = await api.get('https://www.goodreads.com/book/example-page/example-page');
Важные параметры
| Параметр | Значение | Зачем |
|---|---|---|
country | не задавать | Большинство успешных вызовов не задают country (100%) и срабатывают с долей успеха 99.6%. |
javascript | использовать JavaScript-токен | 95.6% вызовов используют JavaScript-токен и срабатывают с долей успеха 99.6%. Обычный токен пробовали слишком редко (22 вызовов), чтобы что-то о нём сказать. |
Шаблоны URL, которые запрашивают аккаунты
| Шаблон | Доля успехов | JavaScript-токен | Страна | Параметры запроса |
|---|---|---|---|---|
/book/{slug}/{slug} | 49.0% | 100% | нет | from_choice |
/author/{slug}/{slug} | 44.5% | 100% | нет | нет |
/book/{slug} | 3.3% | 0.0% | нет | category, country, duration |
/book/{slug}/{id} | 2.0% | 100% | нет | нет |
Поля, которые вы получаете
Страница товара обычно несёт блок ld+json Product с названием, ценой, валютой и наличием и те же значения в видимой разметке. Сначала читайте блок: он меняется реже, чем вёрстка.
Что ломается и как починить
На сбои с 14 Aug 2026 сайт отвечал:
Запуск по расписанию
Обновление каталога это список URL товаров. Отправьте его в Crawler с callback-адресом, дайте ему распределить вызовы и повторить то, что сайт отклонил, и читайте результаты из Cloud Storage. Медианный ответ на этом сайте 10.0s.
Вопросы
Нужен ли браузер для скрапинга goodreads.com?
Да, для большинства страниц. Вызовы с JavaScript-токеном срабатывают с долей успеха 99.6%, а вызовы с обычным токеном достигают 100%.
Сколько стоит страница goodreads.com на Crawlbase?
1 кредит без браузера. goodreads.com относится к уровню стандартный.
Какой country задать для goodreads.com?
Никакой не нужен: большинство успешных вызовов оставляют его незаданным.