📌 Redditから収集できるトレンドの投稿、サブレディット、作成者、エンゲージメントデータとは?
このテンプレートは、リスティングページから構造化されたレコードを収集します。これには、Title、Post_URL、Upvotes、Comnents、Subreddit、Subreddit_URL、Subreddit_type、Author、Author_profile、Post_timeが含まれます。ソーシャルリサーチャー、コミュニティマネージャー、コンテンツチーム、トレンドアナリストに役立ちます。
データはRedditから収集されます。Redditは、ユーザーが投稿を公開し議論する、トピックベースのサブレディットに組織されたコミュニティプラットフォームです。
💰 価格
このテンプレートは現在無料で、行ごとの使用料はありません。Octoparseのプランやリソースの制限が適用される場合があります。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
TitlePost_URLUpvotesComnentsSubredditSubreddit_URLSubreddit_typeAuthorAuthor_profilePost_time
{
"Title": "飛行機で誰かが私の肘掛けに足を乗せてきた。",
"Post_URL": "https://www.reddit.com/r/mildlyinfuriating/comments/1bohpeq/someone_dared_to_put_their_foot_on_my_arm_rest_on/",
"Upvotes": "33959",
"Comnents": "9351",
"Subreddit": "mildlyinfuriating",
"Subreddit_URL": "https://reddit.com/r/mildlyinfuriating/",
"Subreddit_type": "public",
"Author": "Top_Particular_741",
"Author_profile": "https://reddit.com/user/Top_Particular_741",
"Post_time": "2024-03-26 20:10:49"
}
🎯 ユースケース
- Upvotesを使用して、エンゲージメントと反応のシグナルを比較します。
- Titleを使用して、製品、コンテンツ、またはメニューのカタログを構築し、比較します。
- Post_timeを使用して、タイムラインと経時的な変化を調査します。
- Author、Author_profileを使用して、クリエイター、レビュアー、販売者、または店舗を調査します。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: Redditの抽出ステップはすでに設定されているため、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: サポートされているローカルまたはクラウド実行モードを選択して、一度限りのチェックや反復的な収集作業に合わせることができます。
- 構造化された反復可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、このテンプレート用に設定された現在の入力、選択可能な値、および意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- ページ数 (オプション) — ページネーションの数を設定します。許容範囲:1から1000。
🚀 使い方
- テンプレートを開き、試すまたは開始を選択します。
- 上記の入力フィールドをすべて入力します。
- サポートされているローカルまたはクラウド実行モードを使用してタスクを開始します。
- 出力された行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされた出力フィールドは空になることがあります。上記の入力制限はテンプレートによって強制されます。
💡 ヒント
大規模なバッチを開始する前に、具体的で有効な入力を使用し、代表的な結果を確認してください。繰り返しのレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
このスクレイパーはどのように機能しますか?
このテンプレートは、設定されたページ数(最大1,000)の入力を受け取り、設定されたリスティングソースを開き、Redditのリスティングページでそのレコードとページネーションを反復処理し、Title、Post_URL、Upvotes、Comnents、Subredditなどのフィールドを含む構造化された行を出力します。
何を入力する必要がありますか?
「入力」セクションに表示されているフィールドと許容値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
このテンプレートはどのようなデータを返しますか?
現在の出力フィールドと代表的なJSONのデータプレビューは、「出力」セクションに記載されています。ソースページに値が表示されない場合、フィールドが利用できないことがあります。
このテンプレートは無料で使用できますか?
現在無料で、行ごとの使用料はありません。Octoparseのプランやリソースの制限が適用される場合があります。
なぜ一部の出力フィールドが空になることがあるのですか?
ソースページは、すべてのレコードのすべての値を常に公開しているわけではなく、レイアウトはアイテム、マーケット、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したデータをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理することができます。
🔗 関連テンプレート
- Reddit Post & Comments Scraper — レビューまたはコメントレベルのレコードが必要な場合は、Reddit Post & Comments Scraperを使用してください。
- Reddit Subreddit Scraper — レビューまたはコメントレベルのレコードが必要な場合は、Reddit Subreddit Scraperを使用してください。
- Reddit Post & Comments Scraper (Free) — 発見したURLを詳細ページのデータで補強するには、Reddit Post & Comments Scraper (Free)を使用してください。