📌 Goodreadsの検索結果から収集できる書籍発見データとは?
このテンプレートは、検索結果ページから構造化されたレコードを収集します。これには、Keyword、Progress_result_count、Page_URL、Page、image_url、book_title、author、rating、rating_numbers、published_year、editionsが含まれます。出版社、著者、図書館員、文学研究者、書籍マーケターにとって有用です。
データはGoodreadsから収集されます。Goodreadsは、書籍のタイトル、評価、版、読者レビューなどを提供する書籍発見と読書のコミュニティです。
💰 価格
このテンプレートは現在無料で、行ごとの使用料はかかりません。Octoparseのプランやリソースの制限が適用される場合があります。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
KeywordProgress_result_countPage_URLPageimage_urlbook_titleauthorratingrating_numberspublished_yeareditions
{
"Keyword": "education",
"Progress_result_count": null,
"Page_URL": null,
"Page": "1",
"image_url": "https://i.gr-assets.com/images/S/compressed.photo.goodreads.com/books/1375414895i/17851885._SY75_.jpg",
"book_title": "I Am Malala: The Story of the Girl Who Stood Up for Education and Was Shot by the Taliban",
"author": "Malala Yousafzai",
"rating": "4.14",
"rating_numbers": "504,883",
"published_year": "2012",
"editions": "170"
}
🎯 ユースケース
- rating、rating_numbersを使用して、評価や評判をベンチマークします。
- image_url、book_titleを使用して、製品、コンテンツ、またはメニューカタログを構築し、比較します。
- authorを使用して、クリエイター、レビューワー、販売者、または店舗を調査します。
- Page_URLを使用して、レコードをソースページや下流の詳細収集にリンクします。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: Goodreadsの抽出ステップはすでに設定済みなので、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: サポートされているローカルまたはクラウド実行モードを選択して、一度限りのチェックや反復的な収集作業に対応できます。
- 構造化された反復可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、現在の入力、選択可能な値、およびこのテンプレート用に設定された意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- キーワード(1行に1つ)(必須)— 書籍のカテゴリや主題のキーワードを1行に1つずつ入力します。
- ページ数(任意)— 処理するGoodreadsの検索結果ページの数を設定します。
🚀 使い方
- テンプレートを開き、試すまたは開始を選択します。
- 上記の入力フィールドをすべて入力します。
- サポートされているローカルまたはクラウド実行モードを使用してタスクを開始します。
- 出力された行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされている出力フィールドが空になることがあります。上記の入力制限はテンプレートによって強制されます。
💡 ヒント
大規模なバッチを開始する前に、具体的で有効な入力を使用し、代表的な結果を確認してください。繰り返しレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
このスクレイパーはどのように機能しますか?
このテンプレートは、設定されたキーワード(1行に1つ)、ページ数の入力を受け取り、提供された各値を送信してGoodreadsの検索結果ページで返されたレコードを反復処理し、その後、Keyword、Progress_result_count、Page_URL、Page、image_urlなどのフィールドを含む構造化された行を出力します。
何を入力する必要がありますか?
「入力」セクションに示されているフィールドと受け入れ可能な値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
このテンプレートはどのようなデータを返しますか?
現在の出力フィールドと代表的なJSONのデータプレビューは、「出力」セクションにリストされています。ソースページが値を表示しない場合、フィールドの可用性は異なることがあります。
このテンプレートは無料で使用できますか?
現在無料で、行ごとの使用料はかかりません。Octoparseのプランやリソースの制限が適用される場合があります。
なぜ一部の出力フィールドが空になることがあるのですか?
ソースページは、すべてのレコードに対してすべての値を常に公開しているわけではなく、レイアウトはアイテム、市場、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したデータをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理できます。
🔗 関連テンプレート
- Goodreads Comments Scraper — 読者のレビューテキスト、評価、日付、いいねが必要な場合は、Goodreads Comments Scraperを使用してください。
- Google Books Scraper — 同等の書籍発見に加えて、ISBN、出版社、説明、主題、購入リンクのフィールドが必要な場合は、Google Books Scraperを使用してください。