📌 選択したサブレディットフィードから投稿を収集する方法は?
このテンプレートは、サブレディットのURL、投稿のURL、リンクされた記事のURL、投稿のタイトル、作成者、投稿時間、高評価数、コメント数、選択したフィードタブなど、サブレディットと投稿のレコードを収集します。コミュニティマネージャー、ソーシャルリスニングチーム、リサーチアナリストに役立ちます。
データはOld Redditから収集されます。Redditはコミュニティプラットフォームであり、サブレディットフィードでは、新規、トップ、上昇中、物議を醸しているなどのタブで投稿が整理されています。
💰 価格
現在の価格: $0.02/1,000行。請求はタスクによって生成された出力行数に基づきます。
📦 出力
現在公開されている実装では、以下のフィールドを返すことができます:
SubredditSubreddit_URLPost_URLArticle_URLPost_titleAuthorPost_timeUpvoteComment_countTab
{
"Subreddit": "cats",
"Subreddit_URL": "https://old.reddit.com/r/cats/",
"Post_URL": "https://www.reddit.com/r/cats/comments/1bok11r/show_me_a_picture_of_your_cat_that_cracks_you_up/",
"Article_URL": null,
"Post_title": "見るたびに笑ってしまう猫の写真を見せてください。",
"Author": "EotEaH",
"Post_time": "2024/03/26 09:41:54 PM",
"Upvote": "12178",
"Comment_count": "1865",
"Tab": null
}
🎯 使用例
- 投稿のタイトルと記事のURLを使用して、サブレディットのトピックを監視します。
- 高評価数とコメント数を使用して、エンゲージメントを比較します。
- 作成者と投稿時間を使用して、投稿アクティビティを追跡します。
- 異なるサブレディットタブで表示されるコンテンツを比較します。
🐙 Octoparseを選ぶ理由
- すぐに使えるワークフロー: Old Redditの抽出ステップはすでに設定済みのため、スクレイパーをゼロから構築する必要はありません。
- 柔軟な実行: 収集のためにローカルコンピュータをオンラインに保つことなく、クラウドで既製のタスクを実行できます。
- 構造化された再現可能な出力: 結果は一貫した行として返されるため、手動でコピーしたページよりも比較、フィルタリング、重複排除、処理が容易です。
- 検証済みの入力ガードレール: フォームには、このテンプレート用に設定された現在の入力、選択可能な値、および意味のある制限が表示されます。
- 実用的なデータハンドオフ: Octoparseで結果を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理します。
📝 入力
以下のフィールドを入力してください:
- Tab (必須) — 収集するRedditのリスティングタブを選択します。利用可能なオプション:Hot、New、Rising、Controversial、Top。
- SubReddits or communities URLs (必須) — サブレディットのURL。1回の実行につき最大100,000エントリ。
- Max_Items (任意) — 受理範囲:1から999999999。
🚀 使用方法
- テンプレートを開き、試すまたは開始を選択します。
- 上記の入力フィールドをすべて入力します。
- サポートされているクラウド実行モードを使用してタスクを開始します。
- 出力行を確認し、構造化されたデータをエクスポートまたは処理します。
⚠️ 制限事項
結果は、実行時にソースサイトが公開する内容に依存します。ソースページが値を提供しない場合、リストされた出力フィールドは空になることがあります。上記の入力制限はテンプレートによって強制されます。
💡 ヒント
大規模なバッチを開始する前に、具体的で有効な入力を使用し、代表的な結果を確認してください。繰り返しレコードが不要な場合は、重複した入力を削除してください。
❓ よくある質問
OctoparseはどのようにしてOld Redditからデータを収集しますか?
Pythonオートメーションは、送信された各サブレディットURLを選択されたフィードタブで開き、設定されたアイテム目標に達するかコンテンツが終了するまでページ分割し、投稿カードを解析し、投稿ごとに1つの構造化された行をアップロードします。
このRedditサブレディットスクレイパーにはどのような入力が必要ですか?
入力セクションに示されているフィールドと受理される値を使用してください。ユーザーに関連する制限と選択可能なオプションのみがリストされています。
Old Redditからどのようなデータを抽出できますか?
現在の出力フィールドと代表的なJSONデータプレビューは、出力セクションにリストされています。ソースページが値を表示しない場合、フィールドの可用性は異なることがあります。
このRedditサブレディットスクレイパーの費用はいくらですか?
現在の価格は$0.02/1,000行で、請求はタスクによって生成された出力行数に基づきます。
なぜ一部のOld Redditフィールドが空になることがあるのですか?
ソースページは、すべてのレコードのすべての値を常に公開しているわけではなく、レイアウトはアイテム、マーケット、または現在のサイトの応答によって異なる場合があります。テンプレートは、現在のページがフィールドを提供する場合にそれを返します。
収集したOld Redditデータをエクスポートできますか?
Octoparseで構造化された行を確認し、お使いのOctoparse環境でサポートされているオプションを使用してエクスポートまたは処理できます。
🔗 関連テンプレート
- Reddit Search Scraper — 同じソースサイトでの補完的なワークフローには、Reddit Search Scraperを使用してください。
- Reddit Trending Scraper — 同じソースサイトでの補完的なワークフローには、Reddit Trending Scraperを使用してください。
- Reddit Post Scraper (by Keywords) — 同じソースサイトでの補完的なワークフローには、Reddit Post Scraper (by Keywords)を使用してください。