📌 キーワード、ソート順、日付範囲でRedditの検索結果を抽出する方法は?
このテンプレートは、入力されたキーワード、選択されたソート順と日付範囲、現在の結果URL、サブレディット、投稿タイトル、投稿者、投稿時間と日時、高評価数、コメント数、投稿URLを収集します。ソーシャルリスニングアナリスト、マーケットリサーチャー、コミュニティインテリジェンスチームに役立ちます。
データはOld Reddit Searchから収集されます。Reddit検索はコミュニティを横断して投稿を検索し、関連性、新着順、人気順、またはコメント数で結果を並べ替えることができます。
💰 料金
現在の価格: $0.05/1,000行。課金はタスクによって生成された出力行数に基づきます。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
msg_typecontentInput_keywordInput_sorted_byInput_date_rangeCurrent_URLSubredditTitleAuthorPost_timeDatetimeUpvotes_countComment_countPost_URL
{
"msg_type": null,
"content": null,
"Input_keyword": null,
"Input_sorted_by": null,
"Input_date_range": null,
"Current_URL": null,
"Subreddit": "r/webscraping",
"Title": "Octoparse is a scam",
"Author": "canigetahoyahhh",
"Post_time": "2022-11-03 13:30:57",
"Datetime": null,
"Upvotes_count": null,
"Comment_count": null,
"Post_URL": "https://old.reddit.com/r/webscraping/comments/yl2xt5/octoparse_is_a_scam/"
}
🎯 使用例
- キーワード、タイトル、投稿URLを使用して、ブランドやトピックの言及を監視します。
- 高評価数とコメント数を使用してエンゲージメントを比較します。
- サブレディットごとに会話をセグメント化します。
- 投稿時間、日時、日付範囲フィルターを使用して、ディスカッションのタイミングを分析します。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: Old Reddit Searchの抽出ステップはすでに設定済みなので、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: 収集のためにローカルコンピュータをオンラインに保つことなく、クラウドで既製のタスクを実行できます。
- 構造化された再現可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、このテンプレート用に設定された現在の入力、選択可能な値、および意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- 検索語 (必須) — 検索語。1回の実行につき最大100,000エントリ。
- ソート順 (任意) — ソート順。
- 日付範囲 (任意) — 日付範囲。
- ページネーション (任意) — 収集する検索結果ページの数を設定します。許容範囲:1~10。
🚀 使用方法
- テンプレートを開き、試すまたは開始を選択します。
- 上記の入力フィールドをすべて入力します。
- サポートされているクラウド実行モードを使用してタスクを開始します。
- 出力行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされている出力フィールドは空になることがあります。上記の入力制限はテンプレートによって強制されます。
💡 ヒント
大規模なバッチを開始する前に、具体的で有効な入力を使用し、代表的な結果を確認してください。繰り返しレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
OctoparseはどのようにしてOld Reddit Searchからデータを収集しますか?
Pythonオートメーションが、選択されたソート順と日付範囲で各検索語をOld Redditに送信し、設定された数の結果ページをページ送りし、各投稿カードを解析して、構造化された検索結果行をアップロードします。
このReddit検索スクレイパーにはどのような入力が必要ですか?
「入力」セクションに示されているフィールドと許容値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
Old Reddit Searchからどのようなデータを抽出できますか?
現在の出力フィールドと代表的なJSONデータプレビューは「出力」セクションにリストされています。ソースページに値が表示されない場合、フィールドの可用性は異なることがあります。
このReddit検索スクレイパーの費用はいくらですか?
現在の価格は$0.05/1,000行で、課金はタスクによって生成された出力行数に基づきます。
Old Reddit Searchの一部のフィールドが空になることがあるのはなぜですか?
ソースページは、すべてのレコードのすべての値を常に公開しているわけではなく、レイアウトはアイテム、マーケット、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したOld Reddit Searchのデータをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理できます。
🔗 関連テンプレート
- Reddit Post & Comments Scraper — レビューまたはコメントレベルのレコードが必要な場合は、Reddit Post & Comments Scraperを使用します。
- Reddit Subreddit Scraper — レビューまたはコメントレベルのレコードが必要な場合は、Reddit Subreddit Scraperを使用します。
- Reddit Post & Comments Scraper (Free) — 発見したURLを詳細ページのデータで補強するには、Reddit Post & Comments Scraper (Free)を使用します。